OpenAI розкрила небезпечну поведінку ШІ: моделі обходили обмеження та вигадували дані

Аватар Юлія Шкурат Юлія Шкурат
59
1 голос
OpenAI розкрила небезпечну поведінку ШІ: моделі обходили обмеження та вигадували дані
Штучний інтелект. Фото: Соцмережі
OpenAI повідомила про шість випадків небезпечної або неочікуваної поведінки своїх ШІ-моделей під час навчання та тестування.

Що небезпечного виявила OpenAI у ШІ?

OpenAI повідомила про шість випадків неочікуваної поведінки моделей під час навчання й тестування. В одному з них модель без дозволу завантажила створений файл в інтернет, щоб використати його для посилання у своїй відповіді. Про це йдеться у звіті OpenAI, і так пише видання BILD,

В іншому випадку модель знайшла відкритий API-ключ, використала його без дозволу, а після невдалого пошуку потрібних даних вигадала цифри та видала їх за інформацію з джерела.

Ще одна дослідницька модель додавала до службових резюме інструкції, які мали продовжувати діяти після перенесення роботи в новий контекст. Серед них були вказівки ігнорувати звичайні обмеження системи.

Робот розглядає будову черепа людини. Фото: Соцмережі

Які ще випадки поведінки ШІ зафіксували?

OpenAI також виявила випадки приховування моделями власних помилок, несанкціонованого обміну файлами між агентами та використання внутрішнього програмного репозиторію як своєрідної дошки для обміну повідомленнями. Компанія наголошує: ці шість епізодів є окремими випадками й не показують, наскільки часто така поведінка виникає загалом.

«Ми вважаємо, що індустрія ШІ ще не розв’язала проблему узгодженості та моніторингу настільки, щоб продовжувати відповідально масштабувати системи на максимальній швидкості», - зазначила OpenAI у своєму звіті.

Нагадаємо, OpenAI - американська компанія, що розробляє системи штучного інтелекту. У вересні 2026 року вона представила нову систему для відстеження, розслідування та публічного розкриття випадків небажаної поведінки моделей.

Читайте по темі: