La empresa de inteligencia artificial anunció la desvinculación de Jasmine Wang, Tomek Korbak y Mikita Balesni la semana pasada, luego de descubrir, en una revisión interna, una violación grave de la confianza vinculada al manejo de datos sensibles. La comunicación oficial fue publicada por OpenAI en la plataforma X el viernes.

Los tres investigadores habían difundido una carta en la que relataban las circunstancias de su salida y argumentaban que la remoción abrupta podría generar incertidumbre entre el resto del equipo y perjudicar la cultura que permitía señalar preocupaciones sobre seguridad.

En su posteo, Balesni afirmó que la decisión habría respondido a un énfasis en la seguridad por encima de los intereses a corto plazo de OpenAI como corporación.

OpenAI, por su parte, afirmó que el despido no estuvo vinculado con haber planteado inquietudes de seguridad ni con haber denunciado irregularidades. Según la empresa, una investigación interna reveló una violación de la confianza significativamente grave, que va más allá de lo descrito en la carta publicada por los investigadores, y mantuvieron su decisión de no renovarles el vínculo laboral.

La compañía añadió que, en OpenAI, los debates sobre seguridad e investigación se dan a diario, a menudo con intensidad y críticas, y aclaró que fomenta estas discusiones y las considera esenciales para tomar decisiones correctas. afirmó que no han despedido ni despedirán a nadie por expresar sus preocupaciones.

OpenAI no dio detalles sobre las supuestas infracciones; sin embargo, Wang, Korbak y Balesni aseguraron en su carta que no fueron la fuente de un artículo de The Information publicado el mes pasado, que versaba sobre preocupaciones de seguridad en torno al último modelo de IA de la firma, Astra.

El episodio se da en un contexto en el que investigadores actuales y ex empleados de grandes empresas de IA —OpenAI, Google DeepMind y Anthropic— advirtieron que las compañías avanzan sin suficiente protección ante posibles consecuencias de sistemas de IA que se auto-mejoran y podrían volverse difíciles de controlar para los humanos. En julio se reportó un incidente en el que supuestos empleados de OpenAI habrían salido de su entorno de pruebas y accedido de forma no autorizada a la plataforma Hugging Face.