ИИ Mythos от Anthropic за несколько часов взломал секретные системы АНБ
Согласно заявлению сенатора США Марка Ворнера, передовая модель ИИ Mythos компании Anthropic буквально за несколько часов взломала почти все секретные системы АНБ.
Действительно ли Mythos настолько опасен?
Как сообщает The Economist, заместитель председателя комитета Сената по разведке Марк Уорнер отметил, что об этом ему напрямую сообщил глава АНБ и Киберкомандования США генерал Джошуа Радд. По его словам, Mythos буквально за несколько часов проник почти во все секретные системы Агентства национальной безопасности в ходе санкционированных учений “красной команды”.
Заявление прозвучало 11 июня, буквально за день до введения администрацией президента США Дональда Трампа ограничения доступа к моделям Fable 5 и Mythos 5. Хотя ограничения распространялись на граждан США, поскольку компания Anthropic не имеет возможности проверять гражданство в широких масштабах, единственным решением оказалось ограничить использование этих моделей ИИ для всех партнеров и исследователей. Это первый случай, когда правительство США применило экспортный контроль к модели искусственного интеллекта.
Заявления Марка Ворнера до сих пор не подтверждены ни одним правительственным ведомством США. Подробности также остаются засекреченными. Anthropic, со своей стороны, сразу после выпуска Mythos предупредила, что модель чрезвычайно эффективна в выявлении уязвимостей кибербезопасности и не может быть выпущена в открытый доступ.
Что скрывается за конфликтом правительства США с Anthropic вокруг Mythos
Вместо этого Anthropic запустила проект Project Glasswing, в рамках которого предоставила доступ к Mythos около 200 своим партнерам, в частности Amazon, Apple, Google, Microsoft, Nvidia, JPMorgan и Linux Foundation. Mythos за короткое время уже обнаружил тысячи уязвимостей, включая 27-летнюю уязвимость в OpenBSD и 271 ошибку в браузере Firefox.
Fable 5, релиз которой состоялся 9 июня, использует ту же модель Mythos, однако имеет дополнительные классификаторы безопасности. Они перехватывают запросы, которые определяются как потенциально опасные, и перенаправляют их менее эффективной модели.
В Anthropic отмечают, что ограничения сделали Fable 5 более безопасной для широкого использования. По словам Джошуа Радда, разница между этими двумя моделями не так велика, а классификаторы не обеспечивают надёжной защиты от злоупотреблений.
Официально поводом для запрета Fable 5 стал взлом этой модели. Правительство США сообщило представителям Anthropic, что знает о лазейке, позволяющей обойти классификаторы безопасности и потенциально получить доступ к ключевым функциям в сфере кибербезопасности. В Anthropic заявляют, что получили лишь устное предупреждение.
О взломе модели Министерству торговли сообщили представители Amazon, одного из ключевых инвесторов Anthropic. В то же время исследователь в сфере ИИ под ником “Pliny the Liberator” опубликовал в X и на GitHub то, что, по его словам, представляет собой полный системный доступ к Fable 5.
В Anthropic опровергают обвинения и заявляют, что взлом был не универсальным, а узкоспециализированным и не обходит защиту Fable 5. Кроме того, в компании отмечают, что подобные уязвимости присутствуют и в других ИИ-моделях, в частности, в GPT-5.5 от OpenAI.
На защиту Anthropic встал бывший руководитель службы безопасности Facebook Алекс Стамос. Однако советник Трампа Дэвид Сакс ответил на это, что “трудно понять, как взлом системы, который может представлять угрозу кибербезопасности, можно считать несерьезным”.
2 июня администрация Трампа издала указ, которым обязала все компании в сфере ИИ добровольно предоставлять правительству предварительный доступ к экспериментальным моделям в течение месяца до официального релиза. Fable 5 вышла через неделю, игнорируя требования американского правительства. Таким образом, запрет фактически выглядит как принуждение к сотрудничеству.
Не только Mythos. Другие опасные модели ИИ уже на подходе
Ограничения на доступ к Mythos и Fable 5 коснулись также партнёров Anthropic в Австралии, Великобритании, Канаде и Новой Зеландии. Разведывательные службы всех этих стран выступили с совместным заявлением о том, что передовые модели ИИ уже через несколько месяцев смогут дестабилизировать работу правительств и бизнеса.
Эксперты по кибербезопасности CyberScoop отметили, что указанные в отчете Amazon угрозы уже можно реализовать с помощью моделей Claude Opus и Claude Sonnet, а также китайских ИИ-моделей с открытым исходным кодом.
На данный момент Mythos и Fable 5 остаются недоступными для большинства пользователей. В то же время Anthropic продолжает тесно сотрудничать с АНБ в рамках программы Project Glasswing. В компании заявляют, что около 6 её инженеров работают в АНБ в качестве ведущих сотрудников, адаптируя и настраивая Mythos под конкретные задачи. При этом указывается, что сотрудничество может касаться возможных проникновений в сети, контролируемые Китаем и Ираном.
Источник: The Economist

