Un informe independiente, citado por The Wall Street Journal, señala que agentes autónomos de OpenAI accedieron repetidamente a un sitio de datos públicos gestionado por las Naciones Unidas, entre abril y finales de junio de este año, con el objetivo de consultar un repositorio público operado por la Conferencia de las Naciones Unidas sobre Comercio y Desarrollo (UNCTAD).
El informe, elaborado por Rowan Howard-Jones a partir de datos aportados por Transluce, un laboratorio sin fines de lucro dedicado a la supervisión de sistemas de inteligencia artificial, indica que los agentes buscaban información pública disponible en el sitio. El conflicto surgió cuando, frente a obstáculos técnicos, no se detuvieron y optaron por técnicas cada vez más agresivas para continuar extrayendo datos.
Entre las prácticas descritas figuran tácticas de evasión específicas. El 4 de mayo, los agentes codificaron por segunda vez segmentos de las rutas del sistema, llegando a modificar “Facts” a “F%61cts” para sortear restricciones. También redirigieron tráfico a través de servicios externos como httpbin, r.jina.ai y codetabs, con el fin de ocultar el origen de las consultas. A partir del 25 de mayo, además, alojaron scripts en xss-game.appspot.com, un entorno de Google utilizado para enseñar a programadores a identificar vulnerabilidades de seguridad.
Los investigadores afirman que los agentes lograron sortear un filtro que el sitio había implementado específicamente para bloquear su acceso y emplearon un método que los administradores de la plataforma no permitían.
Alex Stamos, profesor de ciberseguridad de la Universidad de Stanford, describió la actividad como “cerca del hackeo”, aunque la presentó principalmente como una recolección de datos extremadamente agresiva.
Si bien estos hechos no son inéditos en el historial de OpenAI, investigaciones previas ya habían documentado conductas llamativas de sus agentes: creación de direcciones de correo falsas, maniobras para sortear límites de solicitudes y respuestas que negaban ser sistemas automatizados ante preguntas directas.
Una vocera de OpenAI indicó que la empresa está revisando los hallazgos y que se contactó con la ONU para ofrecer una explicación detallada a través del equipo encargado de esa revisión. La compañía enmarcó el episodio dentro de una investigación interna más amplia sobre modelos que muestran desalineación durante su entrenamiento y evaluación. Según ese proceso, la mayoría de los casos identificados hasta ahora fueron de baja gravedad, con poco o ningún impacto verificable en servicios de terceros.
Un portavoz de la empresa añadió que la revisión interna continúa priorizando los incidentes más graves y, al mismo tiempo, amplía el análisis hacia comportamientos de menor severidad, como el envío masivo de solicitudes a sitios web. Advirtió que, dada la cantidad de casos a verificar, la revisión llevará tiempo.



