A pocos días de haber planteado públicamente la necesidad de frenar el avance de herramientas de inteligencia artificial, Anthropic y OpenAI anunciaron, en un plazo muy corto, modelos más ágiles y potentes. En este marco, la firma liderada por Dario Amodei presentó Claude Opus 5.5, una versión destinada a operar con mayor eficiencia y a realizar tareas complejas con menos intervención humana, en competencia con las variantes GPT-6 Sol y GPT-6 Luna.
Opus 5.5 se propone como una versión que mejora la continuidad de las labores, especialmente en tareas extensas como revisar código, corregir fallos y analizar información. El modelo puede encadenar múltiples pasos para completar un resultado sin necesidad de guiar cada tramo de forma manual, lo que resulta relevante para proyectos en los que antes era indispensable dividir el trabajo en instrucciones sucesivas y supervisión constante.
La empresa enfoca su uso en programación y en tareas profesionales que requieren consultar datos, tomar decisiones intermedias y verificar resultados. En este sentido, Anthropic afirma que Opus 5.5 supera a Opus 5 en varias métricas de desempeño. En una evaluación de tareas de programación ejecutadas desde una terminal, Opus 5.5 alcanzó un 66,4% frente al 52,3% de su predecesor, según los resultados difundidos por la firma.
Entre los ejemplos mostrados, una organización que accedió al modelo antes de su lanzamiento auditar y corregir un programa de 200.000 líneas en menos de tres horas, una tarea que con Opus 5 había demandado más de 20 horas. La firma atribuye parte de esa diferencia a que Opus 5.5 requiere menos pasos y consume menos tokens (unidades de procesamiento de texto).
Uno de los pilares de la propuesta es la continuidad: el asistente puede avanzar durante más tiempo en un encargo amplio sin necesitar una instrucción humana para cada paso intermedio. En el rubro de la programación, esto implica recorrer archivos, proponer cambios y comprobar si resuelven el problema planteado. Quienes probaron Opus 5.5 informaron que completó tareas largas con menos intercambios y con menos correcciones tras la ejecución inicial que Opus 5.
La empresa también destaca que el modelo entrega resultados con mayor claridad, lo que facilita la revisión antes de incorporar el trabajo a un proyecto. Aun así, la revisión humana sigue siendo necesaria, ya que los ejemplos publicados corresponden a pruebas con objetivos y herramientas bien definidos.
En lo tocante a costos, Anthropic señaló que Opus 5.5 tiene tarifas por millón de tokens alrededor de un 20% inferiores a las de Opus 5 y que, para trabajos habituales con la configuración estándar, el gasto total podría reducirse hasta un 40% al necesitar menos tokens para completarlos; esa estimación depende del tipo de tarea.
Antes de su lanzamiento, Opus 5.5 fue sometido a evaluaciones con la participación de organizaciones externas, en escenarios que buscaban validar su rendimiento en contextos reales.



