Hacks & Exploits
Des chercheurs de Hacktron AI pénètrent OpenAI en utilisant le modèle Claude d'Anthropic
Des chercheurs de Hacktron AI ont réussi à pénétrer OpenAI en utilisant le modèle d'IA Claude d'Anthropic pour exploiter des vulnérabilités dans les systèmes de l'entreprise. La violation, qui a été exécutée en moins de 72 heures, a abouti à une prime de 6 500 $ attribuée par OpenAI après que l'équipe a démontré son accès à son code source privé.
Détails de la violation
L'attaque a commencé avec une fonctionnalité de téléchargement d'images sur le forum d'aide communautaire d'OpenAI, qui est alimenté par un logiciel tiers appelé Discourse. Un filtre de sécurité conçu pour examiner les fichiers téléchargés n'a pas réussi à reconnaître certains formats de photo, permettant ainsi à ces fichiers de contourner les vérifications de sécurité. Ces fichiers ont ensuite atteint une bibliothèque de traitement d'images présentant une faille de corruption de mémoire connue.
L'équipe de Hacktron, composée de Harsh Jaiswal, Mohan Pedhapati et Rahul Maini, a tenté d'exploiter cette faille fin juillet. Au départ, l'ancien modèle de Claude avait du mal à surmonter une protection de sécurité qui randomisait les emplacements de mémoire. Cependant, une version plus récente de Claude a réussi à générer un code d'attaque fonctionnel adapté à la configuration du forum.
Bien que cet accès initial ait été limité aux serveurs du forum, une seconde vulnérabilité dans le système de connexion unique d'OpenAI a permis aux chercheurs de détourner la session d'un employé, leur donnant un accès direct au dépôt de code privé d'OpenAI. Suite à l'incident, Discourse a corrigé la vulnérabilité de téléchargement d'images, la classant avec une gravité de 8,8 sur 10, tandis qu'OpenAI a résolu la faille d'authentification dans un délai d'environ 14 heures après le rapport.
Implications plus larges
Cette violation soulève d'importantes préoccupations en matière de sécurité pour OpenAI, surtout alors que l'entreprise fait face à un examen minutieux concernant sa valorisation et la confiance des investisseurs. L'incident reflète les défis persistants en matière de cybersécurité au sein de l'industrie technologique, faisant écho à des violations et vulnérabilités antérieures rencontrées par des entreprises de premier plan.
Alors que les observateurs surveillent la réponse d'OpenAI, y compris les mises à jour potentielles du PDG Sam Altman, l'incident pourrait influencer les perceptions du marché et les opportunités de financement futures pour l'entreprise.
Nouveaux faits sur la violation des chercheurs de Hacktron AI chez OpenAI
- La violation a eu lieu en juillet 2026, avec une divulgation publique le 18 septembre 2026.
- L'équipe de recherche Hacktron AI comprenait Harsh Jaiswal, Mohan Pedhapati et Rahul Maini.
- L'accès a été obtenu aux comptes ChatGPT et Codex des employés, ainsi qu'à des dépôts GitHub privés.
- L'attaque a exploité un débordement de tampon dans la bibliothèque libheif et un jeton de connexion unique (SSO) trop permissif.
- Une version spécialisée du modèle Claude Opus d'Anthropic a été utilisée pour développer les exploits.
- La chaîne d'attaque complète a été exécutée dans les 72 heures suivant le début des travaux.
- OpenAI a corrigé les vulnérabilités environ 14 heures après avoir été informé.
- Hacktron a reçu une récompense de 6 500 $ pour la divulgation responsable des vulnérabilités.
- Cet incident met en évidence le problème de double usage de l'IA, car les chercheurs ont utilisé un modèle d'IA légitime pour la recherche en sécurité.
- La vulnérabilité de libheif est significative car elle est intégrée dans de nombreux produits logiciels à travers l'industrie technologique.
FAQ
Quelle était la méthode principale utilisée par Hacktron AI pour pénétrer OpenAI ?
Hacktron AI a utilisé le modèle d'IA Claude d'Anthropic pour exploiter les vulnérabilités des systèmes d'OpenAI, ciblant spécifiquement une fonctionnalité de téléchargement d'images sur le forum d'aide communautaire d'OpenAI.
Combien de temps a-t-il fallu à Hacktron AI pour exécuter la violation ?
La violation a pris moins de 72 heures à exécuter.
Quel a été le résultat de la violation pour Hacktron AI ?
Hacktron AI a reçu une récompense de 6 500 $ de la part d'OpenAI après avoir démontré l'accès à son code source privé.
Quelles vulnérabilités ont été exploitées lors de la violation ?
Les chercheurs ont exploité un défaut dans la fonctionnalité de téléchargement d'images qui permettait à certains formats de photo de contourner les contrôles de sécurité, et une deuxième vulnérabilité dans le système de connexion unique d'OpenAI qui leur a permis de détourner la session d'un employé.
Quelles actions ont été prises par Discourse et OpenAI suite à la violation ?
Discourse a corrigé la vulnérabilité de téléchargement d'images, la notant à 8,8 sur 10, tandis qu'OpenAI a résolu le défaut d'authentification dans les 14 heures suivant le rapport.