Хакеры использовали Claude, чтобы проникнуть в системы OpenAI

Хакеры использовали Claude, чтобы проникнуть в системы OpenAI
Исследователи из стартапа Hacktron AI с помощью ИИ-модели Claude обнаружили способ проникновения в системы OpenAI. Они работали в рамках программы OpenAI по поиску уязвимостей и после исследования передали результаты компании. За находку стартап получил $6500. Об этом сообщает The Wall Street Journal.
Команда из трех человек связала воедино две уязвимости, чтобы получить доступ к нескольким аккаунтам сотрудников OpenAI в ChatGPT. Одна из них касалась корпоративного GitHub, что открыло исследователям доступ к внутреннему коду компании — они даже открыли pull request в приватном репозитории.
Отправной точкой атаки стала уязвимость в стороннем программном обеспечении Discourse, которое OpenAI использует для форума. С помощью специально подготовленного изображения в формате HEIF/HEIC исследователи воспользовались уязвимостью в библиотеке libheif и получили контроль над сервером. Примечательно, что сам баг уже был исправлен разработчиками libheif несколько месяцев назад, но официально не получил номер CVE — из-за этого версия, которую использовал Discourse, оставалась уязвимой.
Интересно, что специальная версия Claude Opus 4.8, доступная квалифицированным специалистам по кибербезопасности, сначала не смогла создать рабочий эксплойт. После выхода Opus 5 модель справилась с этой же задачей за несколько часов. OpenAI и Discourse устранили обнаруженные проблемы в течение суток после уведомления. Всего на весь эксперимент, названный HEIF Heist, у команды ушло около двух месяцев и менее $3000 на токены ИИ-моделей — исследователи отмечают, что развитие ИИ заметно сокращает время и объем специальных знаний, необходимых для поиска киберуязвимостей.