En medio de un contexto en el que varios actores pidieron frenar el avance de herramientas de inteligencia artificial, Anthropic y OpenAI anunciaron, con pocas horas de diferencia, sus nuevas propuestas: Claude Opus 5.5 y las variantes GPT-6 Sol y GPT-6 Luna. La firma liderada por Dario Amodei presentó Opus 5.5 como una versión más eficiente, capaz de realizar tareas complejas con menor necesidad de supervisión humana.

Anthropic destacó que el nuevo modelo entrega un rendimiento destacado en trabajos extensos como revisión de programas, depuración y análisis de información, donde puede encadenar múltiples pasos para arribar a un resultado sin requerir instrucciones constantes. Según la compañía, la mejora se traduce en mayor continuidad de trabajo, especialmente en proyectos que antes requerían dividir la labor en varios bloques y supervisión paso a paso.

Opus 5.5 está orientado a programación y a tareas profesionales que implican consultar información, tomar decisiones intermedias y verificar resultados. La firma afirmó que Opus 5.5 supera a Opus 5 en varias evaluaciones de estas capacidades. En una prueba de tareas de programación ejecutadas desde una terminal, el rendimiento fue del 66,4% para Opus 5.5 frente al 52,3% de su predecesor, según los resultados publicados por la empresa.

También se presentaron ejemplos de trabajos completos: una organización que accedió al modelo antes del lanzamiento auditar y corregir un programa de 200.000 líneas en menos de tres horas, una tarea que con Opus 5 había llevado más de 20. Anthropic atribuye parte de esa diferencia a que Opus 5.5 requiere menos pasos y utiliza menos tokens de texto.

La mejora apuntala la continuidad del encargo: el asistente puede avanzar durante más tiempo en un encargo amplio sin necesitar una instrucción humana para cada paso. En el ámbito de la programación, ello implica recorrer archivos, proponer cambios y verificar si resuelven el problema planteado. Empresas que probaron Opus 5.5 indicaron que completó tareas largas con menos intercambios y menos correcciones posteriores que con Opus 5.

Además, la firma sostiene que el modelo entrega resultados con mayor claridad, lo que facilita la revisión antes de incorporarlos a un proyecto. Aunque la revisión sigue siendo necesaria, los ejemplos publicados corresponden a pruebas con objetivos y herramientas definidas.

En cuanto a eficiencia operativa, Anthropic destacó una reducción de costos: las tarifas por millón de tokens para Opus 5.5 son un 20% más bajas que las de Opus 5, y calculan que, para tareas habituales con la configuración por defecto, el costo total podría disminuir alrededor del 40% por el menor consumo de tokens, aunque esa estimación depende del tipo de tarea.

Antes del lanzamiento, Opus 5.5 fue sometido a evaluaciones por diversas organizaciones.