Компанія Anthropic офіційно представила свою нову розробку — оновлену мовну модель Claude Sonnet 5.5. Головними перевагами новинки стали підвищена на 30 відсотків швидкість роботи та суттєве скорочення витрати токенів, що робить процес написання коду та автоматизації завдань значно економічнішим для розробників і корпоративних клієнтів.
Передісторія та еволюція лінійки
Нагадаємо, що попередня ітерація популярної лінійки, модель Sonnet 5, з'явилася на ринку лише близько трьох місяців тому і запам'яталася користувачам своєю здатністю ефективно розгортати автономних агентів. Попри те, що в загальній ієрархії продуктів Anthropic лінійка Sonnet поступається за чистою флагманською потужністю моделям серії Opus, вона традиційно перевершує їх за гнучкістю, швидкістю відгуку та оптимізацією під вузькоспеціалізовані сценарії використання.
Прорив в автономному кодингу
Під час незалежних та внутрішніх бенчмарків автономного кодингу нова модель Sonnet 5.5 продемонструвала видатні результати, в низці тестів обійшовши навіть старші конфігурації завдяки здатності паралельно створювати декілька автономних агентів без виходу за рамки жорстких бюджетних лімітів. Перші великі партнери компанії вже оцінили переваги апгрейду на практиці, відзначивши безпрецедентну стабільність при вирішенні масштабних інженерних завдань.
"Нова модель впоралася з десятками тисяч рядків коду, що стосуються архітектури ігрової системи, забезпечувала миттєві відповіді, виконувала завдання, що тривали кілька годин, і працювала з меншою кількістю жорстких підказок", — поділився досвідом використання нового алгоритму Деніел Фогель, головний операційний директор Epic Games.
Суперечливі дані
Варто зазначити, що в той час як більшість профільних джерел та офіційні представники розробників роблять акцент на виключно вертикальному зростанні продуктивності та зниженні витрат рівно на 30 відсотків, деякі експерти ШІ-ринку вказують на нюанси в методології тестування. На думку низки незалежних аналітиків, реальна економія токенів сильно залежить від специфіки поставленого завдання і може варіюватися від 14% (як підтверджують інженери Slack) до заявлених максимальних показників у сценаріях комплексного програмування.
Оцінки партнерів та ринковий контекст
Своєю думкою про реліз також поділилися ключові технологічні гіганти, що інтегрують рішення Anthropic у свої продукти. "Не змінюючи жодного з наших запитів, Claude Sonnet 5.5 показав кращі результати, ніж Sonnet 5, майже у всіх наших офлайн-оцінках роботи Slackbot, виконавши завдання за меншу кількість кроків і з приблизно на 14% меншою кількістю токенів у вихідних даних", — заявив Кертіс Аллен, головний інженер Slack.
Анонс від Anthropic відбувся на тлі вкрай високої конкурентної активності на ринку генеративного штучного інтелекту. Нагадаємо, що незадовго до цього компанія OpenAI випустила нові версії моделей Sol і Luna, орієнтовані на бюджетний та середній сегменти, а корпорація Meta представила власну технологічну систему для підтримки смарт-окулярів. У найближчі тижні Anthropic має намір продовжити розширення лінійки, представивши оновлену версію своєї найкомпактнішої та найдоступнішої моделі Haiku.