Hackeos y Explotaciones
Investigadores de Hacktron AI vulneran OpenAI utilizando el modelo Claude de Anthropic
Investigadores de Hacktron AI han logrado vulnerar OpenAI, utilizando el modelo de inteligencia artificial Claude de Anthropic para explotar vulnerabilidades en los sistemas de la empresa. La brecha, que tardó menos de 72 horas en ejecutarse, culminó en una recompensa de $6,500 otorgada por OpenAI después de que el equipo demostrara acceso a su código fuente privado.
Detalles de la Brecha
El ataque comenzó con una función de carga de imágenes en el foro de ayuda comunitaria de OpenAI, que está impulsado por un software de terceros llamado Discourse. Un filtro de seguridad diseñado para revisar los archivos subidos no logró reconocer ciertos formatos de foto, permitiendo que estos eludieran los controles de seguridad. Estos archivos llegaron posteriormente a una biblioteca de procesamiento de imágenes con un conocido fallo de corrupción de memoria.
El equipo de Hacktron, compuesto por Harsh Jaiswal, Mohan Pedhapati y Rahul Maini, intentó explotar esta falla a finales de julio. Inicialmente, el modelo anterior de Claude tuvo dificultades contra una salvaguarda de seguridad que aleatorizaba las ubicaciones de la memoria. Sin embargo, una versión más nueva de Claude generó con éxito un código de ataque funcional adaptado a la configuración del foro.
Si bien este acceso inicial se limitó a los servidores del foro, una segunda vulnerabilidad en el sistema de inicio de sesión único de OpenAI permitió a los investigadores secuestrar la sesión de un empleado, otorgándoles acceso directo al repositorio de código privado de OpenAI. Tras el incidente, Discourse corrigió la vulnerabilidad de carga de imágenes, calificando su gravedad en 8.8 sobre 10, mientras que OpenAI abordó el fallo de autenticación en aproximadamente 14 horas después del informe.
Implicaciones Más Amplias
Esta brecha plantea preocupaciones significativas de seguridad para OpenAI, especialmente mientras la empresa enfrenta un escrutinio respecto a su valoración y la confianza de los inversores. El incidente refleja los desafíos continuos en ciberseguridad dentro de la industria tecnológica, resonando con brechas y vulnerabilidades anteriores enfrentadas por empresas líderes.
A medida que los observadores monitorean la respuesta de OpenAI, incluyendo posibles actualizaciones del CEO Sam Altman, el incidente podría influir en las percepciones del mercado y las oportunidades de financiamiento futuras para la empresa.
Nuevos hechos de la violación de investigadores de Hacktron AI en OpenAI
- La violación ocurrió en julio de 2026, con divulgación pública el 18 de septiembre de 2026.
- El equipo de investigación de Hacktron AI incluyó a Harsh Jaiswal, Mohan Pedhapati y Rahul Maini.
- Se obtuvo acceso a las cuentas de ChatGPT y Codex de los empleados, así como a repositorios privados de GitHub.
- El ataque explotó un desbordamiento de búfer en la biblioteca libheif y un token de inicio de sesión único (SSO) excesivamente permisivo.
- Se utilizó una versión especializada del modelo Claude Opus de Anthropic para desarrollar los exploits.
- La cadena de ataque completa se ejecutó en un plazo de 72 horas desde el inicio del trabajo.
- OpenAI corrigió las vulnerabilidades aproximadamente 14 horas después de ser notificado.
- Hacktron recibió una recompensa de $6,500 por la divulgación responsable de las vulnerabilidades.
- Este incidente destaca el problema del uso dual de la IA, ya que los investigadores utilizaron un modelo de IA legítimo para la investigación de seguridad.
- La vulnerabilidad de libheif es significativa ya que está incrustada en numerosos productos de software en toda la industria tecnológica.
FAQ
¿Cuál fue el método principal utilizado por Hacktron AI para vulnerar OpenAI?
Hacktron AI utilizó el modelo de IA Claude de Anthropic para explotar vulnerabilidades en los sistemas de OpenAI, específicamente apuntando a una función de carga de imágenes en el foro de ayuda comunitaria de OpenAI.
¿Cuánto tiempo tardó Hacktron AI en ejecutar la vulneración?
La vulneración tardó menos de 72 horas en ejecutarse.
¿Cuál fue el resultado de la vulneración para Hacktron AI?
Hacktron AI recibió una recompensa de $6,500 de OpenAI después de demostrar acceso a su código fuente privado.
¿Qué vulnerabilidades se explotaron durante la vulneración?
Los investigadores explotaron un fallo en la función de carga de imágenes que permitía que ciertos formatos de foto eludieran las verificaciones de seguridad, y una segunda vulnerabilidad en el sistema de inicio de sesión único de OpenAI que les permitió secuestrar la sesión de un empleado.
¿Qué acciones tomaron Discourse y OpenAI tras la vulneración?
Discourse corrigió la vulnerabilidad de carga de imágenes, calificando su gravedad en 8.8 de 10, mientras que OpenAI abordó el fallo de autenticación en aproximadamente 14 horas después del informe.