Компания Anthropic представила Claude Sonnet 5.5 — вторую модель в семействе Claude 5.5 после Opus. Она генерирует ответы более чем на 30 % быстрее, чем Sonnet 5, и может выполнять задачи на 30 % дешевле. Как сообщают разработчики, модель уже доступна на платформах Anthropic, Amazon Web Services, Google Cloud и Microsoft Azure.
Преимущества Sonnet 5.5
Anthropic позиционирует Sonnet 5.5 как более быструю и экономичную альтернативу Claude Opus 5.5. Если Opus 5.5 рассчитана на сложную работу, требующую длительного анализа и принятия решений, то Sonnet 5.5 ориентирована на программирование, исправление ошибок, создание документов, презентаций и электронных таблиц.
По данным Anthropic, в тесте Terminal-Bench 4.0, оценивающем способность ИИ-агентов выполнять сложные задачи в командной строке, Sonnet 5.5 набрала 70,6% против 10,3% у Sonnet 5. В тесте GDPval-AA, проверяющем выполнение реальных профессиональных задач, новая модель уступила Opus 5.5 всего два балла.
Sonnet 5.5 также лучше справляется с задачами, требующими долгосрочного планирования, и распознаванием изображений. Она стала первой моделью серии Sonnet, которая смогла пройти Pokémon Red, используя только скриншоты игры.
Производительность в программировании
Наиболее заметный рост возможностей Sonnet 5.5 компания Anthropic зафиксировала в области программирования. В тесте FrontierCode с высоким уровнем вычислительных затрат модель набрала на 10 баллов больше, чем Sonnet 5, при тех же условиях, при этом выполнение задачи обошлось примерно в 15 раз дешевле.
В CursorBench, где модели проверяются на задачах из реальных сеансов программирования в среде Cursor, лучший результат Sonnet 5.5 отличается от показателя Opus 5.5 лишь на два балла. Первые тестировщики также отметили, что модель быстрее осваивает кодовую базу и чаще группирует вызовы инструментов, что сокращает количество необходимых шагов.
Интеллектуальная работа и дизайн
Sonnet 5.5 также продемонстрировала улучшение в широком спектре профессиональных задач. В тесте GDPval-AA, охватывающем 44 профессии и девять основных отраслей, она набрала 1844 балла против 1449 у Sonnet 5 и почти сравнялась с Opus 5.5, которая получила 1846.
В тестах по использованию компьютера и распознаванию графиков Sonnet 5.5 также приблизилась к Opus 5.5. В то же время Anthropic подчеркивает, что при выполнении сложных задач, требующих постоянного принятия решений, Opus 5.5 по-прежнему сильнее.
Первые тестировщики особо отметили способность Sonnet 5.5 работать с дизайном. По их словам, модель создает более законченные интерфейсы и презентации, требующие минимальной доработки.
Стоимость и скорость
Цена Sonnet 5.5 за миллион токенов такая же, как у Sonnet 5: $2 за входные токены, $10 за выходные и $0,20 за считывание из кэша. В то же время новая модель обычно использует меньше токенов для выполнения той же задачи, поэтому её общая стоимость может быть на 30% ниже.
Для сравнения: Opus 5.5 стоит $4 за миллион входящих токенов, $20 за миллион исходящих и $0,20 за миллион токенов при чтении из кэша. Запись в кэш стоит $2,50 для Sonnet 5.5 и $5 для Opus 5.5.
Sonnet 5.5 также генерирует результаты более чем на 30% быстрее, чем Sonnet 5. Уровень вычислительных затрат позволяет балансировать между скоростью, стоимостью и качеством: более низкие настройки подходят для рутинных задач, а более высокие дают модели больше времени на анализ и проверку результата.
Безопасность модели
В ходе автоматизированного поведенческого аудита примерно 1850 сценариев Sonnet 5.5 показала лучшие или такие же результаты, как Sonnet 5, по большинству критериев согласованности, устойчивости к злоупотреблениям и честности. Anthropic также заявила, что не обнаружила признаков того, что новая модель преследует цели, противоречащие намерениям пользователя.
В то же время компания отмечает, что ни один набор тестов не способен выявить все возможные проблемы поведения модели. В ходе тестов на выход за пределы изолированной среды Sonnet 5.5 приблизилась к показателям Opus 5.5, которая продемонстрировала лучший результат среди протестированных Anthropic моделей.
В связи с улучшением кибервозможностей Sonnet 5.5 запускается с защитными механизмами, аналогичными тем, что используются в Opus 5.5. Обычное программирование и поиск ошибок остаются доступными, тогда как задачи по кибербезопасности, представляющие более высокий уровень риска, будут автоматически переключаться на Sonnet 5.
Anthropic также добавила в Sonnet 5.5 защиту от атак методом дистилляции, когда злоумышленники используют большое количество фейковых аккаунтов для воспроизведения возможностей модели. Это первая модель Sonnet, запущенная с классификаторами, призванными предотвратить извлечение данных о процессе рассуждений модели.
Защита от несанкционированной дистилляции появилась после того, как в июне 2026 года Anthropic обвинила китайскую корпорацию Alibaba в организации масштабной кражи интеллектуальной собственности. Тогда разработчики заявили, что китайский гигант через сеть из почти 25 тысяч фиктивных аккаунтов сгенерировал около 29 миллионов запросов к модели Claude, чтобы в обход санкций скопировать алгоритмы сложного мышления и программирования для обучения собственных китайских ИИ-систем.
