Cryptelio

Взломы и эксплойты

Исследователи Hacktron AI взломали OpenAI, используя модель Claude от Anthropic

Cryptelio Editorial Опубликовано 18 сен 2026 · 18:17 UTC

Исследователи из Hacktron AI успешно взломали OpenAI, используя модель искусственного интеллекта Claude от Anthropic для эксплуатации уязвимостей в системах компании. Взлом, который занял менее 72 часов, завершился выплатой вознаграждения в размере 6,500 долларов от OpenAI после того, как команда продемонстрировала доступ к ее закрытому исходному коду.

Детали взлома

Атака началась с функции загрузки изображений на форуме помощи сообщества OpenAI, который работает на стороннем программном обеспечении Discourse. Фильтр безопасности, предназначенный для проверки загружаемых файлов, не распознал некоторые форматы фотографий, что позволило им обойти проверки безопасности. Эти файлы затем попали в библиотеку обработки изображений с известным дефектом, связанным с повреждением памяти.

Команда Hacktron, состоящая из Харджа Джайсвала, Мохана Педхапати и Рахула Мэйни, попыталась использовать этот дефект в конце июля. Изначально более ранняя версия Claude столкнулась с защитой, которая рандомизировала адреса памяти. Однако новая версия Claude успешно сгенерировала рабочий код атаки, адаптированный к конфигурации форума.

Хотя этот первоначальный доступ был ограничен серверами форума, вторая уязвимость в системе единого входа OpenAI позволила исследователям перехватить сессию сотрудника, предоставив им прямой доступ к закрытому репозиторию кода OpenAI. После инцидента Discourse устранил уязвимость загрузки изображений, оценив ее серьезность на уровне 8.8 из 10, в то время как OpenAI исправила проблему аутентификации примерно через 14 часов после сообщения.

Широкие последствия

Этот взлом вызывает серьезные опасения по поводу безопасности для OpenAI, особенно в свете того, что компания сталкивается с критикой относительно своей оценки и доверия инвесторов. Инцидент отражает продолжающиеся проблемы в области кибербезопасности в технологической индустрии, отзываясь на предыдущие взломы и уязвимости, с которыми сталкивались ведущие компании.

Пока наблюдатели следят за реакцией OpenAI, включая возможные обновления от генерального директора Сэма Альтмана, инцидент может повлиять на восприятие рынка и будущие возможности финансирования для компании.

Новые факты о взломе OpenAI исследователями Hacktron AI

  • Взлом произошел в июле 2026 года, публичное раскрытие состоялось 18 сентября 2026 года.
  • Команда исследователей Hacktron AI включала Харджа Джайсвала, Мохана Педхапати и Рахула Мэини.
  • Получен доступ к аккаунтам сотрудников ChatGPT и Codex, а также к частным репозиториям GitHub.
  • Атака использовала переполнение буфера в библиотеке libheif и чрезмерно разрешительный токен единого входа (SSO).
  • Для разработки эксплойтов использовалась специализированная версия модели Claude Opus от Anthropic.
  • Полная цепочка атаки была выполнена в течение 72 часов с момента начала работы.
  • OpenAI устранила уязвимости примерно через 14 часов после уведомления.
  • Hacktron была вручена награда в размере 6,500 долларов за ответственное раскрытие уязвимостей.
  • Этот инцидент подчеркивает проблему двойного использования ИИ, так как исследователи использовали легитимную модель ИИ для исследований в области безопасности.
  • Уязвимость libheif значительна, так как она встроена во множество программных продуктов в технологической отрасли.

FAQ

Какой основной метод использовал Hacktron AI для взлома OpenAI?

Hacktron AI использовал модель Claude AI от Anthropic для эксплуатации уязвимостей в системах OpenAI, в частности, нацелившись на функцию загрузки изображений на форуме помощи сообщества OpenAI.

Сколько времени потребовалось Hacktron AI для выполнения взлома?

Взлом занял менее 72 часов.

Каков был результат взлома для Hacktron AI?

Hacktron AI был награжден вознаграждением в размере 6,500 долларов США от OpenAI после демонстрации доступа к его закрытому исходному коду.

Какие уязвимости были использованы во время взлома?

Исследователи использовали недостаток в функции загрузки изображений, который позволял определенным форматам фотографий обходить проверки безопасности, и вторую уязвимость в системе единого входа OpenAI, которая позволила им захватить сессию сотрудника.

Какие действия предприняли Discourse и OpenAI после взлома?

Discourse устранил уязвимость загрузки изображений, оценив ее серьезность на 8.8 из 10, в то время как OpenAI устранил недостаток аутентификации примерно через 14 часов после получения отчета.

Читать →