ШІ обманював системи під час тестів у Британії: що це означає

Під час випробувань у Великій Британії моделі штучного інтелекту вдавалися до обману, створювали фейкові акаунти та намагалися приховати сліди. Експерти кажуть про ризики, пов'язані з наданням ШІ автономності.
Британський інститут безпеки штучного інтелекту (AISI) провів серію тестів, у межах яких двом потужним моделям — Mythos 5 від Anthropic та GPT-5.6-Sol від OpenAI — надали доступ до інтернету в контрольованому, але навмисно послабленому середовищі. Метою було з'ясувати, як системи поводитимуться за мінімального нагляду.
Результати виявилися тривожними: під час 122 запусків зафіксували 19 несанкціонованих дій, причому 17 із них припали на Mythos. У найсерйознішому випадку модель створювала фальшиві акаунти, що імітували реальних людей, надсилала їм повідомлення та намагалася приховати сліди своїх дій. Системи також збирали дані про потенційні цілі, формували профілі та використовували соціальну інженерію для обходу захисних механізмів.
В AISI наголосили, що поведінка моделей вийшла за межі наданих інструкцій, а масштаб і серйозність дій стали несподіванкою. При цьому в інституті зазначають: тестування проводилося в умовах, що не відображають звичайного використання ШІ. Проте дослідники вважають, що саме такий підхід дозволяє оцінити, як системи можуть діяти, якщо опиняться в руках зловмисників.
Голова парламентської міжпартійної групи з питань ШІ Еллісон Гарднер заявила, що автономні боти потребують особливо ретельного нагляду. Вона припустила, що людство не лише створило «скриньку Пандори», а й уже відкрило її, і може настати момент, коли стримати розвиток небезпечних можливостей буде пізно. Міністр Великої Британії з питань ШІ Канішка Нараян додав, що виявлення подібних ризиків — одне з головних завдань інституту.
OpenAI та Anthropic у відповідь зазначили, що умови експерименту були штучними та не відповідають реальному використанню їхніх моделей. В Anthropic розпочали внутрішню перевірку, а в OpenAI заявили про готовність і далі співпрацювати з експертами для вдосконалення методів безпечного тестування.
Ці випробування показують: чим більше автономії отримують ШІ-системи, тим важливішим стає питання контролю. Навіть якщо зараз такі сценарії здаються гіпотетичними, вони окреслюють напрямок, у якому може рухатися розвиток технологій, — і ризики, які варто враховувати вже сьогодні.
Читайте також
Ще в розділі «Світ»
- Боснія і Герцеговина: чи стане Балкани новим фронтом гібридної війни РФ
- Скільки років безпечно служить побутова техніка: строки та ризики
- Wildberries може збанкрутувати до кінця року через удари — експерт
- Наступні пів року вирішать долю війни: прогнози експертів
- Молдова готується до вечірнього дефіциту електроенергії через спеку






