
Anthropic представила Claude Opus 5.5: на 40% дешевша в роботі за Opus 5
Anthropic представила Claude Opus 5.5 — першу модель нової родини Claude 5.5. За словами компанії, вона працює на рівні Claude Fable 5.1 у більшості завдань, але коштує на 40% дешевше в експлуатації, ніж Opus 5.
Anthropic 22 вересня представила Claude Opus 5.5 — першу модель нової родини Claude 5.5. За словами компанії, вона працює на рівні Claude Fable 5.1 у більшості завдань, а коштує на 40% дешевше в експлуатації, ніж Opus 5.
Продуктивність і ціна
Anthropic повідомляє, що ранні тестувальники побачили значний приріст на складних завданнях. Один із них завершив міграцію коду обсягом 680 000 рядків менш ніж за день — роботу, яка, за оцінкою компанії, забрала б в інженерної команди тижні. У тесті на скорочення часу завантаження кожної сторінки вебзастосунку Opus 5.5 досяг мети в 39 випадках із 40, тоді як Opus 5 вносив менші покращення, які до того ж змінювали поведінку застосунку.
Читання кешу, яке, за даними компанії, становить більшість витрат на агентну роботу й кодинг, коштує 0,20 долара за мільйон токенів — на 60% менше, ніж в Opus 5, а вивід генерується понад на 30% швидше. Швидкий режим із прискоренням до 2,5 раза доступний у Claude Code і Claude Platform: 8 доларів за мільйон вхідних токенів і 40 доларів за мільйон вихідних.
Бенчмарки й результати клієнтів
На FrontierCode v1.1, який вимірює, чи були б прийняті зміни коду агента, Opus 5.5 у типовому режимі набирає 54,6% — вище за всі інші моделі та за найкращий результат GPT-6 Astra (53,3%), приблизно за п'яту частину вартості на завдання. На Terminal-Bench 4.0 він перемагає Opus 5 у максимальному режимі приблизно за п'яту частину витрат і дорівнює GPT-6 Astra приблизно за 40% вартості. На GDPval-AA v2.1, що охоплює реальну роботу в 44 професіях, модель сягає 1846 Elo.
Клієнти, яких цитує Anthropic, повідомляють про схожі результати. За словами Hebbia, Opus 5.5 покрив 86,6% експертної фінансової рубрики проти 60,3% в Opus 5, а Spotify каже, що модель досягла якості Opus 5 в агентних задачах кодингу приблизно за половину кроків, часу та вихідних токенів.
Безпека та запобіжники
Anthropic стверджує, що Opus 5.5 показав найкращі результати за весь час в автоматичному аудиті поведінки, який тестує Claude майже на 2000 сценаріїв, і є найсильнішою їхньою моделлю за більшістю показників чесності. У новому тесті на утримання в межах він намагався обійти обмеження приблизно на 85% рідше, ніж Opus 5 або Claude Mythos 5.1. У бенчмарку компанії з безпеки Gray Swan він разом із Fable 5.1 має найнижчий рівень успішності prompt-ін'єкцій серед усіх перевірених моделей.
Це перша модель Opus, що виходить із запобіжниками, подібними до Fable 5.1, у сферах кібербезпеки, біології та дистиляції; більшість завдань із кібербезпеки перенаправляються на Opus 4.8. Модель постачається з «збереженим мисленням» — заходом проти дистиляції, який застосовується до API-акаунтів, створених 31 серпня 2026 року або пізніше; з вимкненим режимом мислення вона більше не доступна.
Доступність
Claude Opus 5.5 уже доступний на Amazon Web Services, Google Cloud і Microsoft Azure; на Claude Platform ідентифікатор моделі — claude-opus-5-5.
SiTech — веброзробка з підтримкою AI
Створюємо швидкі та сучасні сайти й інтегруємо AI у бізнес-процеси. Маєте проєкт чи запитання? Із задоволенням допоможемо.