Назад
Anthropic представила Claude Sonnet 5 — найбільш агентну модель Sonnet
SiTech AI Team2 წთ. საკითხავი

Anthropic представила Claude Sonnet 5 — найбільш агентну модель Sonnet

Anthropic 30 червня представила Claude Sonnet 5, назвавши її найбільш агентною моделлю Sonnet на сьогодні. Продуктивність наближається до Opus 4.8 за значно нижчої ціни, а сама модель стала типовою для планів Free і Pro.

Найбільш агентна модель Sonnet

30 червня Anthropic представила Claude Sonnet 5, яку компанія називає найбільш агентною моделлю сімейства Sonnet на сьогодні. Вона вміє складати плани, користуватися інструментами на кшталт браузера й термінала та працювати автономно на рівні, який ще кілька місяців тому був доступний лише більшим і дорожчим моделям.

За словами Anthropic, ера агентного ШІ почалася саме з моделей класу Sonnet: Claude Sonnet 3.5, 3.6 і 3.7 першими продемонстрували вражаючі результати в кодуванні та використанні інструментів. Останнім часом найпомітніший прогрес в агентних можливостях забезпечували моделі класу Opus, а Sonnet 5 скорочує цей розрив: її продуктивність наближається до Opus 4.8, але за значно нижчої ціни.

Результати, рівні зусиль і ціна

Компанія зазначає, що Sonnet 5 суттєво перевершує попередницю Sonnet 4.6 у міркуванні, використанні інструментів, кодуванні та роботі зі знаннями. На середньому рівні зусиль модель значно економніша, а на високому — у деяких завданнях сягає рівня Opus 4.8. Користувачі можуть регулювати рівень зусиль, щоб знайти баланс між витратами та продуктивністю.

Claude Sonnet 5 доступна на всіх планах: це типова модель для Free і Pro, а також вона доступна користувачам Max, Team і Enterprise. Ціна — 2 долари за мільйон вхідних токенів і 10 доларів за мільйон вихідних; початкову ціну зробили постійною, тоді як стандартний тариф становив 3 і 15 доларів. Anthropic зазначає, що модель використовує оновлений токенізатор, тому той самий текст може перетворюватися приблизно на 1,0–1,35 раза більше токенів.

Оцінки безпеки

Оцінки безпеки Anthropic показали, що Sonnet 5 загалом демонструє менше небажаної поведінки, ніж Sonnet 4.6, і є безпечнішою для використання в агентних сценаріях. Також зазначається, що її здатність виконувати завдання з кібербезпеки значно нижча, ніж у нинішніх моделей Opus. У тесті на розробку експлойтів для вразливостей браузера Firefox Sonnet 5 жодного разу не змогла створити повністю робочий експлойт, хоча часткових успіхів у неї трохи більше, ніж у Sonnet 4.6. Повні результати опубліковані в System Card Claude Sonnet 5.

Розробники, яких цитує Anthropic, оцінили модель позитивно. Zimu Li зазначив, що Sonnet 5 дає агентам потужний виконавчий шар для багатокрокової інженерної роботи та добре тримає тривале кодування, використання інструментів і налагодження. Віцепрезидент Kiro Deepak Singh описує її як сильну агентну модель для кодування з точністю рівня Opus.

SSiTech

SiTech — веброзробка з підтримкою AI

Створюємо швидкі та сучасні сайти й інтегруємо AI у бізнес-процеси. Маєте проєкт чи запитання? Із задоволенням допоможемо.