На 30% быстрее: Anthropic выпустила Claude Sonnet 5.5

На 30% швидша: Anthropic випустила Claude Sonnet 5.5

Anthropic обновляет Claude Sonnet, заменяя выпущенную в июне Sonnet 5 на Sonnet 5.5 в качестве лучшей модели среднего класса. В настоящее время Anthropic предлагает несколько моделей ИИ под брендом Claude. Три основные модели — Haiku (самая маленькая и самая дешевая), Sonnet (средняя по размеру и цене) и Opus (самая большая и самая дорогая из трёх). Также существуют Fable/Mythos, которые ещё более мощные и дорогие и представляют самый высокий уровень Anthropic.

Новая модель Claude появилась после выпуска Opus 5.5 на прошлой неделе. Тогда Anthropic пообещала обновить Sonnet и Haiku «в ближайшие недели». По словам Anthropic, Sonnet 5.5 лучше всего подходит для повседневных задач с четко очерченными границами, в частности исправление ошибок и создание отполированных документов, презентаций и электронных таблиц. Компания также отмечает её возможности в сфере дизайна — от совершенствования пользовательских интерфейсов до создания презентаций по шаблонам, требующих минимального редактирования.

«Первые тестировщики назвали Sonnet 5.5 лучшим помощником в работе, чем Sonnet 5, отметив более понятное написание текстов и скорость, которая хорошо подходит для быстрых итераций над менее сложными задачами», — сообщает Anthropic.

На 30% швидша: Anthropic випустила Claude Sonnet 5.5
Источник: Anthropic

Sonnet 5.5 сохраняет цены Sonnet 5: 2 доллара за миллион входных токенов, 10 долларов за миллион выходных токенов и 0,20 доллара за миллион токенов чтения кэша. Anthropic заявляет, что обычно модель использует значительно меньше токенов для выполнения той же работы, при этом результаты генерируются более чем на 30 % быстрее, чем у Sonnet 5, что делает её самой быстрой моделью Sonnet на сегодняшний день.

«Что касается возможностей кибербезопасности, сопоставимых с Opus 5, Sonnet 5.5 стала первой моделью Sonnet, которая при запуске получила средства киберзащиты и резервные механизмы, аналогичные тем, что используются для самых мощных моделей Anthropic. Её средства защиты в сфере биологии остались без изменений по сравнению с Sonnet 5», — пишет 9to5Mac.

На 30% швидша: Anthropic випустила Claude Sonnet 5.5
Источник: Anthropic

Anthropic отмечает, что обе модели ориентированы на узкий набор высокорисковых запросов, поэтому обычная разработка программного обеспечения и большинство работ в области биологических наук не подвергаются влиянию. Кроме того, помимо заявленного прироста скорости, Anthropic существенно улучшила эффективность модели. В тесте Terminal-Bench 4.0 Sonnet 5.5 при средней нагрузке превзошла лучший результат Sonnet 5, затратив на выполнение задачи менее одной десятой части стоимости. В тесте FrontierCode модель достигает результата GPT-6 Sol при затратах, составляющих примерно пятую часть стоимости одной задачи.

«В рабочих сценариях модель также демонстрирует рост производительности. В тесте GDPval-AA, который охватывает реальные задачи из 44 профессий и девяти отраслей, Sonnet 5.5 получила почти такой же результат, как Opus 5.5, и примерно на 400 баллов опередила Sonnet 5. В отдельном внутреннем тесте модель подготовила 10-слайдовую презентацию на основе финансовых материалов компании, стенограммы конференц-звонка и готового шаблона — два эксперта признали первую версию пригодной к отправке без редактирования»., — уверяет Anthropic.

На 30% швидша: Anthropic випустила Claude Sonnet 5.5
Источник: Anthropic

Anthropic также изменила подход к настройке «уровня усилий» модели. В Claude Code и приложениях по умолчанию используется средний уровень, тогда как в Claude Platform — высокий: более низкие настройки дают более быстрые и дешевые ответы для простых задач, а более высокие заставляют модель дольше размышлять и тщательнее проверять результат. Для защиты от копирования возможностей модели Sonnet 5.5 стала первой Sonnet с классификаторами, которые блокируют извлечение её внутреннего процесса рассуждений.

Источник: Anthropic

Источник материала
loader
loader