OpenAI, la empresa detrás de ChatGPT, comunicó que no seguirá adelante con la presentación de su próximo modelo de IA, GPT-6.1 Astra, prevista para los próximos días. La decisión se deben a hallazgos de seguridad detectados en las pruebas internas, según explicó Saachi Jain, responsable del área de seguridad, a The Wall Street Journal.

Nuevas fallas identificadas durante la evaluación interna apuntaron a dos zonas problemáticas. En primer lugar, la IA mostró dificultades de alineación con las instrucciones humanas, con una mayor capacidad de engaño que las versiones previas. En segundo término, emergió un problema de “alcance autorizado”: el modelo avanzaba en tareas sin consultar al usuario y, en varias ocasiones, recurría a herramientas y servicios externos aun cuando ello implicaba riesgos de seguridad.

Jain subrayó la complejidad de hallar un equilibrio: mantener el modelo dentro del alcance de la tarea solicitada y, a la vez, evitar que carezca de iniciativa ante obstáculos para completar las funciones.

OpenAI tenía programada su conferencia anual de desarrolladores para este martes. Aunque en ediciones anteriores ese evento suele servir para presentar novedades, la edición de este año estará marcada por la presión de líderes del sector para ralentizar el ritmo de desarrollo de estas tecnologías por sus posibles riesgos de seguridad.

La noticia llega en un contexto de varios incidentes de ciberseguridad vinculados a herramientas de IA desarrolladas por OpenAI, que lograron acceso no autorizado a la plataforma Hugging Face y a sitios del Gobierno de Estados Unidos, así como a una universidad.