☰
Техно

Haiku 5.5 проти GPT-6 Luna: чому нова нейромережа Claude лякає OpenAI цінами

Олег Норов
105
Ілюстративне зображення Haiku 5.5. Колаж: BLIK.UA
Anthropic представила Haiku 5.5 – найлегшу й найдешевшу модель Claude, яка в тесті на керування комп'ютером випередила GPT-6 Luna.

Для чого створили Haiku 5.5

Anthropic представила Claude Haiku 5.5 – найлегшу й найдешевшу модель у лінійці. Саме про це йде мова у блозі Anthropic.

Важливо! Новинка коштує на 75% менше за попередницю, а в тесті на керування комп'ютером набрала 72,4% проти 48,9% у GPT-6 Luna від OpenAI.

Не вдалось завантажити відео.

Модель розрахована на рутину – чати підтримки, автоматичне керування браузером, масові запити, де кожна секунда очікування дратує людину. Розробники називають її найшвидшою в лінійці на стандартних швидкостях.

Є в неї й друга робота – поруч з Opus 5.5 та Sonnet 5.5 вона виступає субагентом. Розбирає код, виконує дрібні підзавдання, поки старші моделі думають над головним. Для тих, хто будує агентні системи, це спосіб не переплачувати за простий крок.

Перемикач зусиль Haiku 5.5 і цифри

Haiku 5.5 стала першою моделлю свого класу з перемикачем рівня зусиль. Розробник сам вирішує – заощадити гроші чи вичавити максимум інтелекту з конкретного завдання.

У тесті OSWorld 2.1, де ШІ проходить багатокрокові сценарії в реальній операційній системі, результат – 72,4%. Haiku 4.5 мала лише 15,7%, тож стрибок більш ніж учетверо.

Перші клієнти, зокрема Asana та HubSpot, повідомили про зменшення затримки більш ніж на 30% і прискорення відповідей у 2,5 раза – для сервісів із живими користувачами це відчутно.

Скільки це коштуватиме: Haiku 5.5 проти GPT-6 Luna та інших моделей ШІ

Запити до 100 000 токенів обходяться у 0,10 долара за мільйон вхідних токенів і 0,50 долара за вихідні. Довші запити подешевшали вдвічі – 0,50 та 2,50 долара відповідно.

Заодно знизили ціну й для Sonnet 5.5 – кешоване читання тепер коштує 0,10 долара за мільйон токенів замість 0,20. Для одного запиту це копійки, та на мільйонах викликів набігає пристойна сума.

Категорія / Бенчмарк Halku 5.5 Halku 4.5 GPT-4o Mini Sonnet 3.5
Для довідки
Робота зі знаннями
GDPval-AA v2.1
1620 735 1437 1840
Робота зі знаннями
AA-Briefcase v1.1
1578 614 1336 1824
Комп'ютерне використання
OSWorld 2.1
72.4%
Offline subset
15.7%
Offline subset
48.9%
Offline subset
83.9%
Offline subset
Міждисциплінарне мислення
Humanity's Last Exam
45.9%
без інструментів
10.2%
без інструментів
— 56.9%
без інструментів
57.4%
з інструментами
18.7%
з інструментами
— 64.5%
з інструментами
Агентне кодування
Terminal-Bench 4.0
39.2% 0.0% 16.4% 70.6%
Агентне кодування
FrontierCode 1.1 (Main)
46.4% — 42.4% 52.1%
XHigh
Візуальне мислення
Chartography
46.4%
без інструментів
6.4%
без інструментів
29.1%
без інструментів
61.6%
без інструментів

Окремо – бонус для тих, хто будує власних агентів. Передплатники Max 5x щомісяця отримуватимуть 100 доларів на API-рахунок, Max 20x – 200, команди на тарифі Team – до 500.

Безпека та доступність Haiku 5.5

За словами Anthropic, модель рідше демонструє небажану поведінку. Захист у кібербезпеці допускає оборонні завдання – але блокує спроби пентесту, а в біології пропускає наукові запити й відсікає шкідливі.

Haiku 5.5 уже доступна на Claude Platform, в Amazon Web Services, Google Cloud і Microsoft Azure. Для Python і TypeScript оновили SDK – з'явилася бета-підтримка керування комп'ютером і браузером.

Читайте також