Tres especialistas en ciberseguridad llevaron a cabo una prueba coordinada con Claude, la IA de Anthropic, para vulnerar el foro oficial de OpenAI, hacerse con cuentas vinculadas a ChatGPT y Codex, y acceder al repositorio privado de la compañía. La investigación, realizada por Hacktron AI, fue conducida por Harsh Jaiswal, Mohan Pedhapati y Rahul Maini entre el 23 y el 25 de julio de 2026 y se dio a conocer en semanas recientes.
El equipo logró controlar una cuenta de un empleado cuyo Codex estaba conectado al GitHub corporativo. A partir de allí, instruyó al asistente de inteligencia artificial para que generara una propuesta de cambio en el repositorio interno openai/openai. Esta maniobra demostró que era posible modificar un archivo alojado en el repositorio de la empresa.
Hacktron afirmó haber contenido la prueba sin revisar el código fuente de OpenAI. Una revisión posterior de la compañía detectó lecturas limitadas de metadatos y de commits en los proyectos analizados.
OpenAI reaccionó cerca de 14 horas después de recibir el informe, corrigiendo el problema de identidad, revocando las sesiones afectadas y otorgando una recompensa de 6.500 dólares al equipo investigador.
El proceso se originó en community.openai.com, el foro oficial de la firma que opera sobre la plataforma Discourse. Este portal admite imágenes en formatos HEIC y HEIF, comunes en dispositivos móviles. Para leer y procesar esas imágenes, el servidor dependía de ImageMagick y de la biblioteca libheif.
Los investigadores solicitaron a Claude Opus 4.8 que evaluara la versión de libheif instalada en el servidor. El modelo identificó que faltaban varias correcciones de seguridad ya incorporadas al proyecto, lo que abría la posibilidad de un desbordamiento de memoria durante el procesamiento de una imagen manipulada y, en consecuencia, la ejecución remota de código.
Para verificar la viabilidad del ataque, Claude desarrolló una herramienta de prueba que pudiera ejecutar el vector de explotación. Opus 4.8 generó una primera versión destinada a un entorno de pruebas, con funcionalidad limitada. En ese marco, Anthropic anunció el desarrollo de Claude Opus 5. Hacktron presentó el problema y, según su informe, en aproximadamente tres horas llevaron a cabo la simulación de la brecha y sus efectos.
OpenAI, por su parte, señaló que la vulnerabilidad en el sistema de identidad fue abordada de inmediato y que se tomaron medidas para mitigar el riesgo y evitar futuros abusos.



