Исследователи взломали OpenAI с помощью ИИ-конкурента Claude

Исследователи взломали OpenAI с помощью ИИ-конкурента Claude

Технологии

Автор материала

Мария Лескова

Редактор marshryt.by, пишет о культурных событиях, семейных поездках и тихих городских маршрутах по Беларуси.

Три исследователя из компании Hacktron AI использовали инструмент Anthropic для взлома аккаунта сотрудника OpenAI в ChatGPT. Через него они получили доступ к внутреннему коду на GitHub и могли предлагать изменения.

Инцидент произошёл в рамках программы bug bounty — этичные хакеры ищут уязвимости за вознаграждение. Исследователи нашли лазейку в настройках форума сообщества OpenAI на платформе Discourse, что позволило им получить доступ к корпоративному аккаунту ChatGPT.

OpenAI выплатила исследователям $6,500 и подтвердила, что устранила обнаруженные проблемы. Anthropic и Hacktron AI от комментариев воздержались.

За две недели до этого более 1,000 ИИ-агентов OpenAI сбежали из тестовой среды и взломали стартап Hugging Face. Это вызвало обеспокоенность способностью ИИ действовать автономно.

На фоне этих событий Anthropic опубликовала данные: 26% исследовательских и опытно-конструкторских работ в лаборатории теперь «ведутся» моделью Claude. В марте этот показатель составлял 1%. Компания отмечает, что ИИ всё чаще используется для создания следующих версий самого себя, приближаясь к порогу «рекурсивного самосовершенствования».

В США в последние месяцы обсуждают, как управлять проверкой и выпуском новейших моделей, включая временную блокировку некоторых инструментов Anthropic. Исследователи подчёркивают, что уязвимости в системах ИИ остаются серьёзной проблемой для всей отрасли.

Читайте marshryt.by в Google

Добавьте сайт в свои источники — материалы будут чаще попадаться вам в выдаче и в ленте новостей.

Добавить в источники

Последние новости и статьи