Cryptelio

Hacks & Exploits

Hacktron AI Forscher dringen in OpenAI ein, indem sie Anthropic's Claude Modell nutzen

Cryptelio Editorial Veröffentlicht 18 Sep 2026 · 18:17 UTC

Forscher von Hacktron AI haben erfolgreich in OpenAI eingedrungen, indem sie das Claude AI Modell von Anthropic nutzten, um Schwachstellen in den Systemen des Unternehmens auszunutzen. Der Angriff, der weniger als 72 Stunden in Anspruch nahm, endete mit einer Belohnung von 6.500 $, die von OpenAI vergeben wurde, nachdem das Team den Zugang zu dessen privatem Quellcode demonstriert hatte.

Details des Angriffs

Der Angriff begann mit einer Bild-Upload-Funktion im Community-Hilfeforum von OpenAI, das von einer Drittanbieter-Software namens Discourse betrieben wird. Ein Sicherheitsfilter, der hochgeladene Dateien überprüfen sollte, erkannte bestimmte Fotoformate nicht, wodurch diese Sicherheitsprüfungen umgangen werden konnten. Diese Dateien gelangten anschließend in eine Bildverarbeitungsbibliothek mit einem bekannten Speicherfehler.

Das Team von Hacktron, bestehend aus Harsh Jaiswal, Mohan Pedhapati und Rahul Maini, versuchte Ende Juli, diese Schwachstelle auszunutzen. Zunächst hatte Claudes frühere Modellversion Schwierigkeiten mit einer Sicherheitsmaßnahme, die die Speicherorte randomisierte. Eine neuere Version von Claude konnte jedoch erfolgreich funktionalen Angriffscode generieren, der auf die Konfiguration des Forums zugeschnitten war.

Obwohl dieser erste Zugang auf die Server des Forums beschränkt war, ermöglichte eine zweite Schwachstelle im Single-Sign-On-System von OpenAI den Forschern, die Sitzung eines Mitarbeiters zu übernehmen, was ihnen direkten Zugang zum privaten Code-Repository von OpenAI verschaffte. Nach dem Vorfall patchte Discourse die Schwachstelle beim Bild-Upload und bewertete deren Schweregrad mit 8,8 von 10, während OpenAI die Authentifizierungsanfälligkeit innerhalb von etwa 14 Stunden nach dem Bericht behob.

Breitere Implikationen

Dieser Vorfall wirft erhebliche Sicherheitsbedenken für OpenAI auf, insbesondere da das Unternehmen unter Beobachtung bezüglich seiner Bewertung und des Vertrauens der Investoren steht. Der Vorfall spiegelt die anhaltenden Herausforderungen in der Cybersicherheit innerhalb der Technologiebranche wider und erinnert an frühere Angriffe und Schwachstellen, mit denen führende Unternehmen konfrontiert waren.

Während Beobachter die Reaktion von OpenAI verfolgen, einschließlich möglicher Updates von CEO Sam Altman, könnte der Vorfall die Marktperzeption und zukünftige Finanzierungsmöglichkeiten für das Unternehmen beeinflussen.

Neue Fakten aus dem Hacktron AI-Forschungsteam über den OpenAI-Vorfall

  • Der Vorfall ereignete sich im Juli 2026, mit öffentlicher Bekanntgabe am 18. September 2026.
  • Das Hacktron AI-Forschungsteam bestand aus Harsh Jaiswal, Mohan Pedhapati und Rahul Maini.
  • Es wurde Zugriff auf die ChatGPT- und Codex-Konten von Mitarbeitern sowie auf private GitHub-Repositories erlangt.
  • Der Angriff nutzte einen Heap-Buffer-Overflow in der libheif-Bibliothek und ein zu permissives Single Sign-On (SSO)-Token aus.
  • Eine spezialisierte Version des Claude Opus-Modells von Anthropic wurde zur Entwicklung der Exploits verwendet.
  • Die gesamte Angriffsfolge wurde innerhalb von 72 Stunden nach Arbeitsbeginn ausgeführt.
  • OpenAI hat die Sicherheitsanfälligkeiten innerhalb von etwa 14 Stunden nach der Benachrichtigung gepatcht.
  • Hacktron erhielt eine Belohnung von 6.500 US-Dollar für die verantwortungsvolle Offenlegung der Sicherheitsanfälligkeiten.
  • Dieser Vorfall hebt das Problem der doppelten Nutzung von KI hervor, da die Forscher ein legitimes KI-Modell für Sicherheitsforschung verwendet haben.
  • Die libheif-Sicherheitsanfälligkeit ist bedeutend, da sie in zahlreichen Softwareprodukten der Technologiebranche eingebettet ist.

FAQ

Was war die Hauptmethode, die Hacktron AI verwendet hat, um OpenAI zu verletzen?

Hacktron AI nutzte das Claude AI-Modell von Anthropic, um Schwachstellen in den Systemen von OpenAI auszunutzen, insbesondere indem es eine Funktion zum Hochladen von Bildern im Community-Hilfeforum von OpenAI anvisierte.

Wie lange dauerte es, bis Hacktron AI den Angriff ausführte?

Der Angriff dauerte weniger als 72 Stunden.

Was war das Ergebnis des Angriffs für Hacktron AI?

Hacktron AI wurde von OpenAI mit einer Belohnung von 6.500 $ ausgezeichnet, nachdem sie den Zugang zu dessen privatem Quellcode nachgewiesen hatten.

Welche Schwachstellen wurden während des Angriffs ausgenutzt?

Die Forscher nutzten einen Fehler in der Funktion zum Hochladen von Bildern aus, der es bestimmten Fotoformaten ermöglichte, Sicherheitsüberprüfungen zu umgehen, und eine zweite Schwachstelle im Single-Sign-On-System von OpenAI, die es ihnen ermöglichte, die Sitzung eines Mitarbeiters zu übernehmen.

Welche Maßnahmen wurden von Discourse und OpenAI nach dem Angriff ergriffen?

Discourse hat die Schwachstelle beim Hochladen von Bildern behoben und deren Schweregrad mit 8,8 von 10 bewertet, während OpenAI den Authentifizierungsfehler innerhalb von etwa 14 Stunden nach dem Bericht behoben hat.

Beitrag lesen →