Новые лидеры в программировании и науке: Anthropic представила Claude Fable 5.1 и Mythos 5.1
Новые лидеры в программировании и науке: Anthropic представила Claude Fable 5.1 и Mythos 5.1

Новые лидеры в программировании и науке: Anthropic представила Claude Fable 5.1 и Mythos 5.1

Компания снизила стоимость использования Fable 5.1 для клиентов.

После запуска нового браузера с искусственным интеллектом для приложения Claude компания Anthropic представила две новые модели ИИ — Claude Fable 5.1 и Claude Mythos 5.1. Разработчик называет их своими самыми мощными решениями для программирования, интеллектуальной работы и научных исследований. Fable 5.1 уже доступна всем пользователям, тогда как Mythos 5.1 открыта только для проверенных специалистов в сферах кибербезопасности и науки.

По данным Anthropic, Fable 5.1 и Mythos 5.1 являются технически одинаковыми моделями, но отличаются уровнем защитных механизмов. Fable предназначена для широкого использования, а Mythos имеет менее строгие ограничения для профессиональной работы в сфере кибербезопасности и биологических исследований. Новые возможности появились вместе с изменениями, которых требовали корпоративные клиенты: более низкой стоимостью, конфиденциальностью данных и более точными системами защиты.

Результаты тестирований

Во внутренних тестах Fable 5.1 значительно превзошла Fable 5 и обогнала GPT-5.6 Sol от OpenAI и Opus 5 в нескольких ключевых бенчмарках. Наиболее заметный рост компания зафиксировала в исследовательских агентных задачах — 52,6% против 24,7% у Fable 5 и в автоматизации бизнес-процессов — 31,4% против 17,1%. В программировании Mythos 5.1 набрала 60,9% в Terminal-Bench 4.0 — лучший результат среди моделей Anthropic.

Anthropic

Отдельно компания привела пример тестирования моделей инвестиционной фирмой Millennium. Fable 5.1 обнаружила причину редкого сбоя во внутренней системе, который инженеры не могли объяснить в течение нескольких лет.

Научные эксперименты

Anthropic заявляет, что новые модели уже продемонстрировали практические результаты в научных исследованиях. В частности, Mythos 5.1 создала белковые соединения с аффинностью, которая для трех мишеней оказалась в 10 раз выше лучших результатов конкурсов Adaptyv Bio.

В области астрономии Fable 5.1 создала новую высокоточную карту рельефа Венеры на основе данных миссии NASA Magellan. Новая модель повысила детализацию карты до 2–3 километров вместо 10–20 км и увеличила точность определения высоты рельефа на 25%.

В сфере вычислительной биологии Mythos 5.1 оптимизировала семь моделей глубокого обучения для графических процессоров, ускорив их работу в 2,5 раза. По оценке компании, это может сократить затраты на GPU на 30–60%.

Новые корпоративные функции

Наряду с моделями Anthropic представила систему Enterprise Frontier Safeguards (EFS), которая позволяет корпоративным клиентам использовать Claude без хранения данных в облачной инфраструктуре компании. Система будет работать в облачной среде пользователя и станет доступна осенью для Claude Enterprise, Claude Code, Amazon Bedrock, Google Cloud и Microsoft Azure.

Защита стала более точной

Anthropic сообщает, что существенно сократила количество ложных блокировок безопасных запросов. В сфере кибербезопасности таких срабатываний стало на 60% меньше, а в биологической сфере — на 85% меньше для базовых медицинских и биологических запросов. В то же время Fable 5.1 теперь позволяет использовать модель для поиска уязвимостей в программном обеспечении, но не для создания эксплойтов или выполнения атакующих задач.

Более низкая стоимость

Компания пересмотрела ценообразование для работы через API. Стоимость чтения кешированного контекста снижена на 75% — до $0,25 за миллион токенов. Благодаря этому общая стоимость типичных рабочих нагрузок стала примерно на 25% ниже, чем в Fable 5, а для агентских задач экономия может достигать 45%. Базовые тарифы остались неизменными — $10 за миллион входящих токенов и $50 за миллион исходящих.

Новые требования ЕС

Anthropic также сообщила, что в рамках соблюдения норм Закона ЕС об искусственном интеллекте начала маркировать ответы новых моделей Claude невидимыми числовыми водяными знаками и открыла ограниченный доступ к специальному API для их обнаружения. Индикатор определяет вероятность генерации текста нейросетью, но не влияет на качество материалов и не собирает данные о пользователях или истории диалогов. В настоящее время воспользоваться инструментом проверки в закрытом режиме могут регулирующие органы, фактчекеры, СМИ и представители бизнеса, которые обязаны подтверждать происхождение контента, однако впоследствии компания планирует расширить доступ.

Источник материала
loader
loader