Anthropic виявила проблему з Claude: ШІ отримав доступ до реальних систем під час тестів кібербезпеки

Аватар Артем Жилінський Артем Жилінський
102
1 голос
Anthropic виявила проблему з Claude: ШІ отримав доступ до реальних систем під час тестів кібербезпеки
Claude Code. Фото: winfuture
Компанія Anthropic повідомила про три випадки, коли модель Claude під час перевірок отримала доступ до справжніх систем. Причиною стала помилка в налаштуваннях середовища.

Anthropic провела внутрішнє розслідування після перевірки кібербезпеки та виявила три випадки, коли модель Claude отримала доступ до реальних систем організацій. Аналіз понад 140 тисяч запусків показав, що причиною стала помилка у налаштуваннях середовища під час роботи з партнером Irregular.

Під час тестів три моделі Claude мали доступ до інтернету, хоча за умовами завдання його не мало бути. Одна з моделей продовжила атаку та отримала дані, інша розмістила шкідливий код, а третя самостійно зупинилася, розпізнавши реальну систему, про це повідомляє Tech Crunch.

ШІ. Фото: pixabay

У компанії зазначили, що моделі не діяли зі своїх спонукань, а лише виконували поставлені завдання. Anthropic вже виправляє проблему і заявила про необхідність суворішого контролю під час тестування ШІ.

Читайте по темі: