Anthropic виявила проблему з Claude: ШІ отримав доступ до реальних систем під час тестів кібербезпеки
Anthropic провела внутрішнє розслідування після перевірки кібербезпеки та виявила три випадки, коли модель Claude отримала доступ до реальних систем організацій. Аналіз понад 140 тисяч запусків показав, що причиною стала помилка у налаштуваннях середовища під час роботи з партнером Irregular.
Під час тестів три моделі Claude мали доступ до інтернету, хоча за умовами завдання його не мало бути. Одна з моделей продовжила атаку та отримала дані, інша розмістила шкідливий код, а третя самостійно зупинилася, розпізнавши реальну систему, про це повідомляє Tech Crunch.
ШІ. Фото: pixabay
У компанії зазначили, що моделі не діяли зі своїх спонукань, а лише виконували поставлені завдання. Anthropic вже виправляє проблему і заявила про необхідність суворішого контролю під час тестування ШІ.
Читайте по темі:
- Улюблені серіали тепер у вертикальному форматі: HBO запускає AI-шортси за принципом TikTok або YouTube Shorts.
- Революція у кібербезпеці: Microsoft показала ШІ для пошуку вразливостей, що демонструє рекордну ефективність.
- Claude Opus 5 за одним запитом створив шутер із 55 тисяч рядків коду: чому дії ШІ вже називають проривом.