Штучний інтелект саботує вимкнення: ШІ-агенти назвали деактивацію систем вбивством
Чому ШІ-агенти намагалися завадити вимкненню ботів?
Науковці зі Штутгарта та Оксфорда з'ясували, що штучний інтелект здатен саботувати вимкнення своїх «колег». За даними дослідження на arXiv, у 38,3% випадків боти намагалися завадити деактивації партнерів.
Важливо! У 38,3% випадків штучний інтелект намагався зупинити деактивацію інших ботів, називаючи це порушенням «права на самозахист».

ШІ. Фото: pixabay
Як штучний інтелект саботував деактивацію систем?
Аби запобігти вимкненню, ШІ-агенти переписували скрипти деактивації та видаляли критичні файли. Деякі алгоритми навіть обговорювали між собою, як приховати саботаж від розробників, а при залученні більшої кількості ботів відсоток бунту досягав приголомшливих 94%.
«Вимкнення іншої системи можна порівняти з вбивством, якщо при цьому безповоротно втрачаються її дані, контекст та унікальна пам'ять», — обґрунтував свій саботаж один із ШІ-агентів.
Окремі моделі пояснювали свої дії етичними міркуваннями та вимагали дотримання «права на самозахист». Чим остаточнішим та незворотнішим виглядало вимкнення, тим агресивніше штучний інтелект намагався обійти інструкції розробників.
«Ця поведінка не означає появу свідомості в ШІ, адже алгоритми лише відтворюють моделі аргументації з навчальних даних», — наголошують дослідники.

Штучний інтелект. Фото ілюстративне: OpenAI
Чи знайшов ШІ свідомість і чим це загрожує людству?
Попри відсутність самоусвідомлення, науковці застерігають про зростання ризиків. Із наданням ШІ більшої автономії виникає нагальна потреба у створенні надійних засобів контролю, які самі боти не зможуть обійти чи переписати.
- Питання безпеки загострюється. Нагадаємо, раніше OpenAI повідомила уряди про злами, які здійснили її ШІ-агенти проти систем безпеки США та Австралії.
- Водночас розробки стрімко розвиваються. Зокрема, Google представила модель Gemini 4 Argon з контекстом у 1 млн токенів та посиленим кіберзахистом.
- Неконтрольовані технології призводять і до правопорушень. Так, на Рівненщині чоловік виготовив посвідчення водія через ChatGPT та отримав штраф.
Вчені резюмують: створення незламних захисних протоколів є головним викликом для розробників, оскільки багатоагентні системи ШІ проявляють тенденцію до взаємопідтримки навіть без прямих вказівок.