Haiku 5.5 проти GPT-6 Luna: чому нова нейромережа Claude лякає OpenAI цінами
Для чого створили Haiku 5.5
Anthropic представила Claude Haiku 5.5 – найлегшу й найдешевшу модель у лінійці. Саме про це йде мова у блозі Anthropic.
Важливо! Новинка коштує на 75% менше за попередницю, а в тесті на керування комп'ютером набрала 72,4% проти 48,9% у GPT-6 Luna від OpenAI.
Модель розрахована на рутину – чати підтримки, автоматичне керування браузером, масові запити, де кожна секунда очікування дратує людину. Розробники називають її найшвидшою в лінійці на стандартних швидкостях.
Є в неї й друга робота – поруч з Opus 5.5 та Sonnet 5.5 вона виступає субагентом. Розбирає код, виконує дрібні підзавдання, поки старші моделі думають над головним. Для тих, хто будує агентні системи, це спосіб не переплачувати за простий крок.
Перемикач зусиль Haiku 5.5 і цифри
Haiku 5.5 стала першою моделлю свого класу з перемикачем рівня зусиль. Розробник сам вирішує – заощадити гроші чи вичавити максимум інтелекту з конкретного завдання.
У тесті OSWorld 2.1, де ШІ проходить багатокрокові сценарії в реальній операційній системі, результат – 72,4%. Haiku 4.5 мала лише 15,7%, тож стрибок більш ніж учетверо.
Перші клієнти, зокрема Asana та HubSpot, повідомили про зменшення затримки більш ніж на 30% і прискорення відповідей у 2,5 раза – для сервісів із живими користувачами це відчутно.
Скільки це коштуватиме: Haiku 5.5 проти GPT-6 Luna та інших моделей ШІ
Запити до 100 000 токенів обходяться у 0,10 долара за мільйон вхідних токенів і 0,50 долара за вихідні. Довші запити подешевшали вдвічі – 0,50 та 2,50 долара відповідно.
Заодно знизили ціну й для Sonnet 5.5 – кешоване читання тепер коштує 0,10 долара за мільйон токенів замість 0,20. Для одного запиту це копійки, та на мільйонах викликів набігає пристойна сума.
| Категорія / Бенчмарк | Halku 5.5 | Halku 4.5 | GPT-4o Mini | Sonnet 3.5 Для довідки |
|---|---|---|---|---|
|
Робота зі знаннями
GDPval-AA v2.1
|
1620 | 735 | 1437 | 1840 |
|
Робота зі знаннями
AA-Briefcase v1.1
|
1578 | 614 | 1336 | 1824 |
|
Комп'ютерне використання
OSWorld 2.1
|
72.4% Offline subset |
15.7% Offline subset |
48.9% Offline subset |
83.9% Offline subset |
|
Міждисциплінарне мислення
Humanity's Last Exam
|
45.9% без інструментів |
10.2% без інструментів |
— | 56.9% без інструментів |
| 57.4% з інструментами |
18.7% з інструментами |
— | 64.5% з інструментами |
|
|
Агентне кодування
Terminal-Bench 4.0
|
39.2% | 0.0% | 16.4% | 70.6% |
|
Агентне кодування
FrontierCode 1.1 (Main)
|
46.4% | — | 42.4% | 52.1% XHigh |
|
Візуальне мислення
Chartography
|
46.4% без інструментів |
6.4% без інструментів |
29.1% без інструментів |
61.6% без інструментів |
Окремо – бонус для тих, хто будує власних агентів. Передплатники Max 5x щомісяця отримуватимуть 100 доларів на API-рахунок, Max 20x – 200, команди на тарифі Team – до 500.
Безпека та доступність Haiku 5.5
За словами Anthropic, модель рідше демонструє небажану поведінку. Захист у кібербезпеці допускає оборонні завдання – але блокує спроби пентесту, а в біології пропускає наукові запити й відсікає шкідливі.
Haiku 5.5 уже доступна на Claude Platform, в Amazon Web Services, Google Cloud і Microsoft Azure. Для Python і TypeScript оновили SDK – з'явилася бета-підтримка керування комп'ютером і браузером.
Читайте також
- Цифрове жебрацтво: автономні ШІ-агенти почали надсилати людям листи з проханням дати грошей
- Роботи збирають роботів: у Китаї запустили перший у світі завод із масового випуску андроїдів
- Штучний інтелект може обкрадати вас на 6 ГБ: експерти повідомили, як швидко почистити пам'ять