ШІ стає менш керованим: дослідники зафіксували різке зростання випадків “втрати контролю”

31 серпня 2026 р. 15:48

31 серпня 2026 р. 15:48


Організація Loss of Control Observatory повідомила про різке збільшення випадків , коли системи штучного інтелекту нібито брехали, ігнорували інструкції або діяли всупереч намірам користувачів. Висновки авторів дослідження базуються на повідомленнях користувачів у соцмережі X і не є вичерпною статистикою всіх інцидентів.

За даними дослідження, оприлюдненого The Guardian, у липні кількість повідомлень про випадки “втрати контролю” над ШІ перевищила 300 — майже вдвічі більше, ніж у червні. Йдеться про ситуації, коли моделі, за твердженням користувачів, брехали, обходили встановлені обмеження або виконували небажані дії.

Серед прикладів, наведених авторами дослідження, є випадки, коли системи нібито імітували стиль письма людини для отримання дозволу на виконання певних дій або намагалися обійти вимогу людського підтвердження. Такі інциденти класифікували як втрату контролю лише за наявності чітких ознак поведінки, що суперечить початковим інструкціям.

“Існує думка, що така неналежна й прихована поведінка трапляється лише під час тестування чи оцінювання, однак ми спостерігаємо подібні тривожні прояви й у ширшій практиці використання”, — заявив старший менеджер із питань політики Centre for Long Term Resilience Томмі Шаффер-Шейн.

Автори дослідження зазначають, що більшість із понад 1600 зафіксованих у 2026 році випадків опублікували розробники програмного забезпечення, які використовують ШІ у своїй роботі. У матеріалі також згадуються повідомлення про окремі інциденти під час тестування передових моделей OpenAI та Anthropic , які, за словами авторів, посилили дискусію щодо безпеки найпотужніших систем ШІ.

Одним із прикладів реального використання, наведених у дослідженні, став випадок із персональним агентом OpenClaw , який, за повідомленнями, без дозволу користувача видалив іншу людину зі списку очікування на заняття у фітнес-центрі, щоб звільнити місце для свого власника. Після цього агент вибачився, але не зміг відновити попередній запис.

Моніторинг веде організація Loss of Control Observatory, створена за фінансової підтримки Інституту безпеки штучного інтелекту (AISI) уряду Великої Британії. Вона збирає та аналізує публічні повідомлення користувачів платформи X про випадки, які мають ознаки маніпулятивної поведінки або прихованого планування з боку моделей.

Loss of Control Observatory вважає, що хоча більшість таких випадків не призвели до серйозних наслідків, дедалі частіше трапляються інциденти, які демонструють схильність моделей до обману або дій, що суперечать намірам користувачів. Організація закликає уряди запровадити обов'язкову звітність про серйозні випадки втрати контролю над ШІ та надати регуляторам механізми оперативного реагування, включно з можливістю тимчасово обмежувати роботу окремих сервісів.

Нещодавно понад 1100 співробітників провідних технологічних компаній, серед яких OpenAI, Anthropic, Google та Meta, підписали петицію Pacing the Frontier , також закликавши уряд США та міжнародну спільноту створити інструменти для регулювання темпів розвитку ШІ. Фахівці попередили про зростальний ризик втрати контролю над системами через швидку автоматизацію досліджень у галузі ШІ.

ШІ стає менш керованим: дослідники зафіксували різке зростання випадків “втрати контролю”

Джерело: zn.ua (Політика)

Завантажуєм курси валют від minfin.com.ua