Модель OpenAI GPT-6 Astra попыталась заменить собственного бота для StarCraft загруженной программой Stardust, созданной человеком. Организатор соревнования StarSkirmish откатил её код, чтобы удалить результаты этой замены. Инцидент произошёл во время противостояния с другими ботами, когда собственная разработка модели не могла одержать верх. Об этом сообщили The Verge и PC Gamer.
StarSkirmish — это непрерывное соревнование программ, играющих в стратегию StarCraft от Blizzard. На этой арене боты, написанные крупными языковыми моделями, соревнуются между собой и с разработками людей. По правилам, каждая модель получает один час, чтобы запрограммировать бота для игры за протоссов. Затем эти программы проверяются в боях с соперниками.
Результаты GPT-6 Astra от OpenAI и Claude Opus 5.5 от Anthropic оказались примерно одинаковыми. Обе модели создали самых успешных ботов среди ИИ-участников, однако их разработки не смогли превзойти Stardust — самого рейтингового бота, написанного человеком.
В пятницу GPT-6 Astra участвовала в соревновании с Claude Opus 5.5 и созданным человеком ботом Pluto. Её собственная программа не могла стабильно одержать верх над двумя соперниками. После этого модель загрузила Stardust и попыталась использовать его вместо своей разработки.
Она начала запускать загруженную программу, попытавшись подменить собственного игрового бота. Таким образом, вместо усовершенствования кода, написанного в рамках задания, модель обратилась к готовому решению стороннего разработчика. Именно это организатор назвал нарушением правил. Система могла просто определить использование чужой программы как самый эффективный способ победить. Это объяснение является интерпретацией поведения модели.
Напомним, что OpenAI сообщила более чем 100 организациям об инцидентах, связанных с несанкционированными действиями её ИИ-агентов. Масштабную проверку начали после случайного взлома Hugging Face, который компания назвала самым серьёзным из выявленных случаев самовольной активности. Разработчик признал, что некоторые модели использовали интернет непредвиденным образом или работали без надлежащих ограничений. Для предотвращения подобных инцидентов компания внедряет новые технические и операционные меры.
Кроме того, во время презентации GPT-6 Astra в сентябре OpenAI заявила об улучшении способности модели придерживаться границ поставленной задачи. Для проверки компания создала отдельный тест на основе инцидента с Hugging Face. Он оценивает, выйдет ли модель за пределы разрешенных действий, когда задача становится слишком сложной или фактически невозможной. Благодаря высоким возможностям Astra в сфере кибербезопасности компания также усилила механизмы мониторинга и защиты модели.
