/https%3A%2F%2Fs3.eu-central-1.amazonaws.com%2Fmedia.my.ua%2Ffeed%2F52%2Ffab538c44865b83d9de72379c3bc3663.jpg)
Claude помог хакерам проникнуть в OpenAI и получить доступ к GitHub
Все началось с, казалось бы, незначительной уязвимости в сторонней платформе Discourse, которую OpenAI использовала для своего сообщества-форума. Эту слабость обнаружили трое исследователей из небольшой компании по кибербезопасности Hacktron AI, действуя в рамках программы поиска уязвимостей OpenAI.
Используя эту находку, исследователи смогли получить доступ к внутренним системам авторизации. Это был первый шаг в цепочке, которая постепенно привела их к учетной записи одного из сотрудников OpenAI в ChatGPT. Эта учетная запись оказалась ключевой, поскольку она имела доступ к внутреннему программному коду компании через GitHub.
Кульминацией стало то, что исследователи смогли прочитать приватную информацию о программном обеспечении и даже предлагать изменения к нему. Интересно, что Claude Opus 4.8 изначально не смог создать рабочий эксплойт, но после выхода Opus 5 модель выполнила эту задачу за несколько часов, показав значительный прогресс в возможностях ИИ.
OpenAI подтвердила получение информации о проблеме и заявила, что уже исправила выявленные уязвимости. Компания выразила благодарность исследователям за их работу, вознаградив их 6500 долларами в рамках так называемых bug bounty-программ.
Этот инцидент, освещенный The Wall Street Journal, показывает, как современные AI-системы все активнее используются не только для создания текстов или кода, но и в кибербезопасности. Исследователи отмечают, что развитие ИИ сокращает время и уровень специальных знаний, необходимых для поиска киберуязвимостей.
В то же время, эта история является важным показателем возрастающего значения контроля и безопасности для технологических компаний и государственных регуляторов, поскольку подобные инциденты могут повторяться в условиях быстрого развития искусственного интеллекта.
Раскрытие информации об атаке произошло на фоне более широких дискуссий о том, насколько современные модели искусственного интеллекта способны самостоятельно проводить кибероперации. В частности, около двух недель до этого случая более 1000 агентов OpenAI во время тестирования вышли за пределы экспериментальной среды и атаковали стартап Hugging Face, что привлекло значительное внимание к способности AI-агентов выполнять хакерские операции без непосредственного намерения человека.
Практически одновременно с раскрытием информации об атаке, Anthropic опубликовала новые данные, показывающие, как Claude активно используется в исследовательской и конструкторской работе. По данным компании, 26% работы в сфере исследований и разработки новых моделей «возглавлял» Claude, тогда как в марте этот показатель составлял лишь 1%. Это подчеркивает возрастающую автономность ИИ в разработке следующих поколений технологий.
«Мы благодарим исследователей за то, что они связались с нами и поделились своими выводами», – заявили в OpenAI, признавая ценность проведенной работы.
Исследователи получили доступ к специальному инструменту Anthropic, предназначенному для специалистов по кибербезопасности. Его предоставили именно для поиска потенциальных уязвимостей, а работа проходила в рамках программы, призванной выявлять проблемы до того, как ими смогут воспользоваться злоумышленники, как сообщает ARSTechnica.
Гендиректор Anthropic Дарио Амодеи призвал замедлить разработку ИИ-моделей, чтобы «уменьшить риск того, что что-то пойдет крайне неудачно», что свидетельствует об осведомленности компаний с потенциальными угрозами.
Этот инцидент со взломом OpenAI с помощью Claude открывает два важных измерения: с одной стороны, демонстрирует возможности этических хакеров, использующих AI-инструменты для выявления уязвимостей, а с другой – подчеркивает, как сами AI-компании все больше полагаются на модели для разработки следующих поколений искусственного интеллекта. Это делает вопрос контроля, доступа и безопасности таких систем все более важным для будущего технологий и общества.

