En un contexto en el que se discutía la posibilidad de frenar ciertos avances en inteligencia artificial, Anthropic, liderada por Dario Amodei, junto a OpenAI, anunciaron la llegada de modelos más potentes en un lapso breve de tiempo. Claude Opus 5.5 se posiciona como una versión más eficiente, diseñada para ejecutar tareas complejas con menor intervención humana y para competir con los nuevos referentes del mercado, como GPT-6 Sol y GPT-6 Luna.
La firma sostiene que Opus 5.5 destaca especialmente en trabajos prolongados, como la revisión de código, la corrección de fallos y el análisis de información. A diferencia de enfoques en los que cada paso requiere una instrucción explícita, esta versión puede encadenar varios procesos para llegar a un resultado final.
Entre sus aplicaciones principales, la compañía señala la programación y otros proyectos profesionales que requieren consulta de información, toma de decisiones intermedias y verificación de resultados. Según Anthropic, Opus 5.5 mejora el desempeño de Opus 5 en varias pruebas de estas capacidades. En una evaluación de tareas de programación ejecutadas desde una terminal, obtuvo un rendimiento de 66,4% frente al 52,3% de su predecesor.
La empresa compartió ejemplos de proyectos completos realizados con el nuevo modelo. Una organización que tuvo acceso al sistema antes de su lanzamiento audito y corrigió un programa de 200.000 líneas en menos de tres horas, tarea que con Opus 5 había llevado más de 20 horas. Parte de esa ganancia se atribuye a que Opus 5.5 requiere menos pasos y utiliza una menor cantidad de tokens.
Un foco importante de la mejora es la continuidad del trabajo: el asistente puede avanzar durante más tiempo en un encargo amplio sin necesitar una instrucción humana para cada tramo. En el terreno de la programación, esto implica recorrer archivos, proponer cambios y verificar si resuelven el problema planteado. Las empresas que probaron Opus 5.5 indicaron que logró completar tareas largas con menos intercambios y con menos correcciones posteriores que Opus 5.
Además, Anthropic afirma que el modelo entrega resultados de forma más clara, lo que facilita la revisión previa a su incorporación en un proyecto. Aunque la revisión sigue siendo necesaria, los ejemplos publicados corresponden a pruebas con objetivos y herramientas definidas.
En el aspecto de costos, la firma señaló que Opus 5.5 mantiene tarifas por millón de tokens aproximadamente un 20% más bajas que las de Opus 5. Con esa configuración predeterminada, estiman que el gasto total en trabajos habituales podría reducirse en torno al 40%, aunque aclaran que la magnitud depende del tipo de tarea.
Antes de su lanzamiento, Opus 5.5 fue sometido a evaluaciones con la participación de diversas organizaciones, en un proceso destinado a verificar su rendimiento en escenarios reales.



