A apenas diez días de haber pedido públicamente una moratoria al desarrollo de herramientas de inteligencia artificial, Anthropic y OpenAI presentaron sus nuevos modelos, con apenas horas de diferencia: Claude Opus 5.5, de la firma liderada por Dario Amodei, frente a GPT-6 Sol y GPT-6 Luna de OpenAI.

Opus 5.5 se vende como una IA más eficiente, capaz de ejecutar tareas complejas con una menor necesidad de intervención humana. Según la compañía, el rendimiento brilla en trabajos extensos como revisar código, corregir errores y analizar información, donde puede encadenar varios pasos para obtener un resultado final.

La versión está enfocada en programación y en tareas profesionales que requieren consultar información, tomar decisiones intermedias y validar resultados. Anthropic afirmó que Opus 5.5 mejora el desempeño de Opus 5 en diversas evaluaciones de estas capacidades. En una prueba de tareas de programación ejecutadas desde una terminal, el sistema alcanzó un 66,4% frente al 52,3% de su predecesor.

Entre los ejemplos que la empresa difundió, una organización que accedió al modelo antes del lanzamiento auditar y corregir un programa de 200.000 líneas en menos de tres horas, una tarea que con Opus 5 había llevado más de 20 horas. Parte de esa diferencia se atribuye a que Opus 5.5 requiere menos pasos y usa menos unidades de procesamiento de texto, o tokens.

La mejora apunta a la continuidad del trabajo: que el asistente avance durante más tiempo en un encargo amplio sin necesitar una instrucción humana para cada paso. En programación, eso implica recorrer archivos, proponer cambios y verificar si resuelven el problema planteado. Las empresas que probaron Opus 5.5 indicaron que completó tareas largas con menos intercambios y con menos correcciones posteriores que Opus 5.

También se destaca que el modelo presenta los resultados de forma más clara, lo que facilita la revisión previa a su incorporación en un proyecto. Esta revisión sigue siendo necesaria, ya que los ejemplos publicados corresponden a pruebas con objetivos y herramientas definidos.

La eficiencia también se refleja en costos: Anthropic fijó tarifas por millón de tokens un 20% por debajo de las de Opus 5 y estima que, en trabajos habituales con la configuración predeterminada, el gasto total podría reducirse alrededor del 40% porque se requieren menos tokens para completar las tareas. Esta cifra depende del tipo de labor.

Antes del lanzamiento, Opus 5.5 fue sometido a evaluaciones por parte de organizaciones externas.