Anthropic взломала OpenAI
Группа исследователей кибербезопасности из стартапа Hacktron AI смогла получить доступ к внутренней системе OpenAI, используя в качестве инструмента ИИ-модель Claude конкурирующей компании Anthropic. Инцидент произошел в рамках программы OpenAI по поиску уязвимостей (bug bounty), и компания выплатила исследователям вознаграждение в размере 6 500 долларов.
Как сообщает The Wall Street Journal, исследователи получили доступ к аккаунту ChatGPT одного из сотрудников OpenAI, что затем открыло им путь к внутреннему коду компании на GitHub.
В своем отчете Hacktron отмечает, что сначала попыталась использовать Claude Opus 4.8, но модель “испытывала трудности на протяжении нескольких сессий”. После выхода Opus 5 попытка увенчалась успехом. Исследователи подчеркивают, что “каждая новая модель становится все более способной”.
По данным WSJ, у исследователей был доступ к “специальной версии” Claude, предназначенной для “квалифицированных специалистов по кибербезопасности”.
Представитель OpenAI заявил Forbes, что компания поблагодарила исследователей “за обращение и передачу результатов” и подтвердила, что уязвимость устранена.
Показательная деталь: по словам исследователей, взлом OpenAI занял “несколько дней для агента и всего несколько часов человеческого времени”. Работа велась в рамках более широкого проекта HEIF Heist по изучению уязвимостей в обработке определенных типов изображений.
В заключении отчета исследователи пишут: “Работа, которая когда-то требовала хорошо обеспеченной команды и месяцев усилий, теперь сжимается до дней. Представления о безопасности должны догонять возможности атакующих”.
Комментарии