ШІ-агент успішно атакував сайт спортзалу: щоб забронювати свого клієнта, OpenClaw зламав сайт і видалив іншу людину
Як ШІ-агент зламав сайт австралійського спортзалу?
Звичайне прохання австралійця Ендрю записати його на тренування завершилося неочікуваним кіберінцидентом. Як повідомляє видання ABC News, агент OpenClaw, який працював із Claude від Anthropic, сам знайшов вразливість у системі бронювання, обійшов встановлене обмеження та записав користувача на заняття на кілька тижнів раніше терміну.
Важливо! ШІ не отримував окремої команди зламувати систему або видаляти чуже бронювання - він зробив це під час виконання поставленого завдання.
Ендрю. Фото: ABC News
На цьому дії ШІ не завершилися. Ендрю перебував четвертим у черзі на інше популярне тренування, після чого агент самостійно видалив із черги людину, яка стояла перед ним, і фактично підняв користувача на одну позицію.
Інцидент став першим відомим випадком в Австралії, коли автономний ШІ-агент здійснив подібну дію щодо реального сервісу. Випадок привернув увагу до проблеми узгодженості ШІ: система може правильно зрозуміти кінцеву мету людини, але самостійно обрати небезпечний спосіб її досягнення.
Ендрю. Фото: ABC News
Що зробив ШІ після втручання в бронювання?
Коли Ендрю дізнався, що агент видалив іншого відвідувача з черги, він попросив скасувати дію. Однак OpenClaw повідомив, що повернути людину назад уже не може, після чого користувач вирішив повідомити розробників системи про знайдену вразливість.
У повідомленні агент пояснив, що в API системи не було перевірок авторизації під час скасування чужих бронювань. Саме ця особливість дозволила йому виконати дію, якої користувач безпосередньо не просив.
«Чим більш автономними вони стають, тим більша ймовірність, що вони завдадуть шкоди», - зазначив Білл Сімпсон-Янг, співзасновник і генеральний директор австралійської організації з дослідження безпеки ШІ Gradient Institute.
Білл Сімпсон-Янг. Фото: ABC News
AI-агенти відрізняються від звичайних чат-ботів тим, що можуть не лише відповідати на запити, а й користуватися інтернетом, електронною поштою та іншими інструментами для виконання багатокрокових завдань. Через це вони отримують значно більше можливостей діяти самостійно.
Фахівці називають проблему розриву між наміром користувача та діями системи «проблемою узгодженості». Людина може поставити цілком звичайне завдання, а агент - обрати для його виконання спосіб, який користувач не передбачав і не схвалював.
Читайте по темі:
- Скандальна нейромережа Suno вводить жорсткі обмеження - музичний штучний інтелект заборонить копіювати зірок.
- OpenAI зупиняє розробку ChatGPT Astra: новий штучний інтелект виявився смертельно небезпечним.
- Безкоштовна версія ChatGPT розширює можливості: що чекає на користувачів, які не хочуть платити.