На 30% швидша: Anthropic випустила Claude Sonnet 5.5
Anthropic оновлює Claude Sonnet, замінюючи випущену в червні Sonnet 5 на Sonnet 5.5 як найкращу модель середнього класу. Наразі Anthropic пропонує кілька моделей ШІ під брендом Claude. Три основні моделі — Haiku (найменша та найдешевша), Sonnet (середня за розміром і ціною) та Opus (найбільша й найдорожча з трьох). Також існують Fable/Mythos, які є ще потужнішими та дорожчими й представляють найвищий рівень Anthropic.
Нова модель Claude з’явилася після випуску Opus 5.5 минулого тижня. Тоді Anthropic пообіцяла оновити Sonnet і Haiku “найближчими тижнями”. За словами Anthropic, Sonnet 5.5 найкраще підходить для повсякденних завдань із чіткими межами, зокрема виправлення помилок і створення відшліфованих документів, презентацій та електронних таблиць. Компанія також відзначає її можливості у сфері дизайну — від удосконалення користувацьких інтерфейсів до створення презентацій за шаблонами, які потребують мінімального редагування.
“Перші тестувальники назвали Sonnet 5.5 кращим партнером для роботи, ніж Sonnet 5, відзначивши зрозуміліше написання текстів і швидкість, яка добре підходить для швидких ітерацій над менш складними завданнями”, — повідомляє Anthropic.
/https%3A%2F%2Fs3.eu-central-1.amazonaws.com%2Fmedia.my.ua%2Ffeed%2F137%2F440c8ce19afb15ec71f4b25fb1fd152c.png)
Sonnet 5.5 зберігає ціни Sonnet 5: $2 за мільйон вхідних токенів, $10 за мільйон вихідних токенів і $0,20 за мільйон токенів читання кешу. Anthropic заявляє, що зазвичай модель використовує значно менше токенів для виконання тієї самої роботи, водночас генеруючи результати більш ніж на 30% швидше за Sonnet 5, що робить її найшвидшою моделлю Sonnet на сьогодні.
“За можливостями кібербезпеки, порівнянними з Opus 5, Sonnet 5.5 стала першою моделлю Sonnet, яка під час запуску отримала засоби кіберзахисту та резервні механізми, подібні до тих, що використовуються для найпотужніших моделей Anthropic. Її засоби захисту у сфері біології залишилися без змін порівняно з Sonnet 5”, — пише 9to5Mac.
/https%3A%2F%2Fs3.eu-central-1.amazonaws.com%2Fmedia.my.ua%2Ffeed%2F137%2Fd5109b0afb717f59095c85407d3aa1e4.png)
Anthropic зазначає, що обидві моделі націлені на вузький набір високоризикових запитів, тому звичайна розробка програмного забезпечення та більшість робіт у галузі наук про життя не зазнають впливу. До того ж, окрім заявленого приросту швидкості, Anthropic суттєво переробила ефективність моделі. На тесті Terminal-Bench 4.0 Sonnet 5.5 за середнього рівня зусиль перевершила найкращий результат Sonnet 5, витрачаючи менше ніж десяту частину вартості на виконання завдання. На FrontierCode модель досягає результату GPT-6 Sol за приблизно п’яту частину вартості одного завдання.
“У робочих сценаріях модель також показує приріст. У тесті GDPval-AA, який охоплює реальні завдання з 44 професій і дев’яти галузей, Sonnet 5.5 отримала майже такий самий результат, як Opus 5.5, і приблизно на 400 балів випередила Sonnet 5. В окремому внутрішньому тесті модель підготувала 10-слайдову презентацію на основі фінансових матеріалів компанії, стенограми конференц-дзвінка та готового шаблону — два експерти визнали першу версію придатною до відправлення без редагування.”, — запевняє Anthropic.
/https%3A%2F%2Fs3.eu-central-1.amazonaws.com%2Fmedia.my.ua%2Ffeed%2F137%2F133c8532beb0f9c146ecf0d2fec175cd.png)
Anthropic також змінила підхід до налаштування “рівня зусиль” моделі. У Claude Code та застосунках за замовчуванням використовується середній рівень, тоді як у Claude Platform — високий: нижчі налаштування дають швидші й дешевші відповіді для простих завдань, а вищі змушують модель довше міркувати та ретельніше перевіряти результат. Для захисту від копіювання можливостей моделі Sonnet 5.5 стала першою Sonnet із класифікаторами, які блокують вилучення її внутрішнього процесу міркування.
Джерело: Anthropic

