Tres especialistas en ciberseguridad de Hacktron AI —Harsh Jaiswal, Mohan Pedhapati y Rahul Maini— llevaron a cabo una prueba entre el 23 y el 25 de julio de 2026, empleando Claude, la inteligencia artificial de Anthropic, para evaluar vulnerabilidades en OpenAI.
El foco de la investigación estuvo en la plataforma community.openai.com, el foro de OpenAI que opera sobre Discourse. Allí detectaron dos fallas encadenadas que permitían avanzar un paso a paso no autorizado: primero, una falla en el sistema que gestiona las imágenes subidas al foro, que habilitaba la ejecución de instrucciones en el servidor; y luego, un error de permisos en el inicio de sesión que extendía ese acceso a cuentas vinculadas al servicio.
Para la prueba, Hacktron AI capturó una cuenta de un empleado que tenía Codex conectada con el GitHub corporativo de OpenAI. Con esa sesión, indicaron a Claude que generara una propuesta de cambio en el repositorio interno openai/openai, demostrando así la posibilidad de modificar un archivo del repositorio. Los investigadores aclararon que la prueba no implicó revisión del código fuente de la empresa.
OpenAI indicó que, tras revisar el incidente, encontró lecturas limitadas de metadatos y de commits, sin evidencias de acceso al código fuente. La respuesta de la compañía fue corregir el sistema de identidad aproximadamente 14 horas después de recibir el informe, revocar las sesiones afectadas y otorgar una recompensa de 6.500 dólares a los investigadores.
El episodio se originó en el foro mencionado, que admite imágenes en formatos HEIC y HEIF. Para leer y convertir esas imágenes, el servidor empleaba ImageMagick, que a su vez depende de la biblioteca libheif. En la verificación, Claude Opus 4.8 fue consultado para revisar la versión de libheif instalada y detectó la falta de parches de seguridad que ya formaban parte de esfuerzos de seguridad del proyecto.
Durante la investigación, Anthropic anunció el lanzamiento de Claude Opus 5. Hacktron afirmó haber presentado el mismo problema y, según su informe, llevó a cabo la prueba en un entorno de laboratorio controlado.
A modo de contexto, el hallazgo subraya vulnerabilidades en procesos de procesamiento de imágenes y en controles de identidad que, en combinación, podrían abrir puertas a accesos no autorizados a servicios y repositorios. OpenAI afirmó haber tomado medidas correctivas inmediatas y seguir evaluando incidentes de seguridad para reforzar sus defensas.



