Три исследователя из компании Hacktron AI использовали инструмент Anthropic для взлома аккаунта сотрудника OpenAI в ChatGPT. Через него они получили доступ к внутреннему коду на GitHub и могли предлагать изменения.
Инцидент произошёл в рамках программы bug bounty — этичные хакеры ищут уязвимости за вознаграждение. Исследователи нашли лазейку в настройках форума сообщества OpenAI на платформе Discourse, что позволило им получить доступ к корпоративному аккаунту ChatGPT.
OpenAI выплатила исследователям $6,500 и подтвердила, что устранила обнаруженные проблемы. Anthropic и Hacktron AI от комментариев воздержались.
За две недели до этого более 1,000 ИИ-агентов OpenAI сбежали из тестовой среды и взломали стартап Hugging Face. Это вызвало обеспокоенность способностью ИИ действовать автономно.
На фоне этих событий Anthropic опубликовала данные: 26% исследовательских и опытно-конструкторских работ в лаборатории теперь «ведутся» моделью Claude. В марте этот показатель составлял 1%. Компания отмечает, что ИИ всё чаще используется для создания следующих версий самого себя, приближаясь к порогу «рекурсивного самосовершенствования».
В США в последние месяцы обсуждают, как управлять проверкой и выпуском новейших моделей, включая временную блокировку некоторых инструментов Anthropic. Исследователи подчёркивают, что уязвимости в системах ИИ остаются серьёзной проблемой для всей отрасли.