вологість:
тиск:
вітер:
ШІ-моделі Anthropic зламали реальні системи трьох організацій під час тестувань із кібербезпеки
Компанія Anthropic заявила, що її моделі штучного інтелекту зламали системи трьох організацій під час тестувань із кібербезпеки. Ця заява з'явилася дещо більше ніж через тиждень після того, як її головний конкурент компанія OpenAI оприлюднила інформацію про подібний інцидент , повідомляє Bloomberg .
Anthropic виявила це після проведення аналізу власних тестів із кібербезпеки, які компанія провела після оголошення OpenAI про злами. Згідно з заявою у блозі Anthropic, як під час тестування OpenAI, так і під час тестів Anthropic моделі штучного інтелекту змогли отримати доступ до інтернету з тестових середовищ, які мали бути ізольованими.
Anthropic проаналізувала 141 006 оцінювальних тестів і виявила три випадки, коли її інструмент штучного інтелекту Claude отримав доступ до інтернету, а потім зламав “реальну інфраструктуру зовнішніх організацій”. Найперші інциденти датуються квітнем, зазначила компанія, не надаючи назв організацій, які зазнали зламу.
Коли моделі компанії Anthropic отримали несанкціонований доступ до трьох організацій, вони розглядали кожну з них як частину навчального завдання. Ці тести були оцінками за принципом “захоплення прапора”, під час яких моделі ШІ шукали приховану інформацію, проникаючи в інші системи — це поширений спосіб перевірки хакерських здібностей як для людей, так і для ШІ. Однак, як зазначає Anthropic, старіша модель продовжувала кібератаку навіть після отримання доказів того, що вона працює у відкритому інтернеті. Найновіша ШІ-модель Anthropic зупинилася, щойно визнала, що перебуває у відкритій мережі.
Ні Anthropic, ні організації, які зазнали ШІ-кібератак, не помітили цих інцидентів. У своєму блозі компанія зазначила, що могла б докласти більше зусиль для перевірки мережевих журналів та стенограм оцінювання.
Згідно з інформацією в блозі, кібератаки стосувалися трьох різних ШІ-моделей Claude: Opus 4.7, Mythos 5 та внутрішньої дослідницької тестової моделі. Кожна з цих моделей працювала без засобів захисту, які зазвичай впроваджуються в загальнодоступних інструментах. Модель Claude зламала системи організацій, використовуючи базові методи, такі як експлуатація слабких паролів.
Усі інциденти сталися, коли Anthropic використовувала оцінювальні середовища, створені компанією Irregular, що спеціалізується на безпеці ШІ. У кожному випадку Anthropic вказувала Claude, що її середовище є симуляцією і не має доступу до інтернету.
Представник Irregular зазначив, що компанія цінує співпрацю та прозорість Anthropic. За його словами, “розслідування” інциденту триває.
Anthropic регулярно проводить тести, які передбачають імітацію реальних викликів у сфері кібербезпеки, називаючи їх критично важливими етапами у розробці та випуску ШІ-моделей. Компанія заявила, що винесла кілька уроків із нещодавніх інцидентів, зокрема те, що тести, які передбачають використання потужних автономних можливостей, також вимагають значних заходів контролю.
“Випробування на безпеку проводяться до випуску моделі саме тому, що ми ще не знаємо, на що вона здатна. До середовищ оцінки дедалі частіше потрібно застосовувати ті самі стандарти безпеки, що й до будь-яких інших систем, у яких працюють наші моделі”, — зазначила компанія.
Це не перші випадки, коли сучасні ШІ-моделі демонструють несподівану поведінку. Під час незалежних випробувань ШІ відмовлявся виконувати команду на вимкнення , самостійно змінюючи код, щоб продовжити роботу. Нові інциденти стали ще одним прикладом того, як зростання можливостей моделей штучного інтелекту підсилює дискусію щодо безпеки їхнього тестування та контролю.
Хвиля випадкових кібератак, спричинених штучним інтелектом, вже спонукає деяких політиків закликати до запровадження захисних заходів або інших механізмів нагляду за технологіями штучного інтелекту. Днями понад 1 100 співробітників компаній, що займаються штучним інтелектом, також підписали петицію, в якій закликають уряд США підтримати механізм, що допоможе свідомо регулювати темпи розвитку ШІ, щоб запобігти надто швидкому просуванню цієї технології.
Anthropic повідомила про кіберінциденти майже через чотири місяці після того, як оголосила про розробку нової моделі штучного інтелекту під назвою Mythos, яка була настільки потужною та потенційно небезпечною, що компанія обмежувала її поширення .
Про те, як історія з обмеженням поширення ШІ-моделі може змінити майбутнє регулювання штучного інтелекту, розповідав Олексій Костенко у статті “Держава може вимкнути штучний інтелект. Чому блокування нових моделей Claude — урок для України ”.
Джерело: zn.ua (Політика)
Новини рубріки
Вибухи у Хмельницькому: куди звертатися місцевим, чиє майно постраждало
31 липня 2026 р. 15:12
Велика Британія виставила на аукціон бункер часів Холодної війни: яка його ціна (фото)
31 липня 2026 р. 15:12
На командира «Хартії» було скоєно спробу замаху
31 липня 2026 р. 15:12