Apenas diez días después de que Anthropic y OpenAI pidieran públicamente frenar el desarrollo de herramientas de inteligencia artificial, ambas compañías anunciaron sus nuevos modelos, con apenas horas de diferencia. En el caso de la firma liderada por Darío Amodei, su apuesta es Claude Opus 5.5, una IA que se presenta como más eficiente y capaz de realizar tareas complejas con menor intervención humana, frente a las propuestas GPT-6 Sol y GPT-6 Luna.
Según la empresa, Opus 5.5 muestra especial rendimiento en trabajos prolongados, como revisión de código, corrección de errores y análisis de información. El sistema puede encadenar varios pasos para llegar a un resultado sin requerir instrucciones de control en cada etapa, lo que representa una ventaja para proyectos en los que antes era necesario dividir la tarea en múltiples indicaciones y supervisar cada tramo.
La versión disponible está orientada a programación y a tareas profesionales que requieren consultar datos, tomar decisiones intermedias y verificar resultados. Anthropic sostiene que Opus 5.5 mejora el desempeño de Opus 5 en varias pruebas de estas capacidades. En una evaluación de tareas de programación realizadas desde una terminal, el nuevo modelo obtuvo un 66,4%, frente al 52,3% de su predecesor, según los resultados publicados por la empresa.
Entre los ejemplos de uso, una organización que probó el modelo antes de su lanzamiento auditó y corrigió un programa de 200.000 líneas en menos de tres horas, una tarea que con Opus 5 había llevado más de 20. La firma atribuye parte de la diferencia a que Opus 5.5 requiere menos pasos y utiliza menos tokens durante el proceso.
La mejora promovida por Anthropic apunta a la continuidad de la tarea: que el asistente pueda avanzar durante más tiempo en un encargo extenso sin necesitar una instrucción humana para cada paso. En programación, esto implica recorrer archivos, proponer cambios y verificar si resuelven el problema planteado. Quienes probaron Opus 5.5 señalan que completaron trabajos largos con menos intercambios y menos correcciones posteriores que con Opus 5.
La compañía también destaca una mayor claridad en la presentación de resultados, una cualidad útil para quien debe revisar lo ejecutado antes de integrarlo a un proyecto. Sin embargo, la revisión humana sigue siendo necesaria: los ejemplos publicados corresponden a pruebas con objetivos y herramientas definidas.
En cuanto al costo, Anthropic informó que Opus 5.5 tiene tarifas por millón de tokens aproximadamente 20% menores que las de Opus 5 y estimó que, en escenarios habituales con la configuración por defecto, el gasto total podría reducirse alrededor del 40% gracias a un menor consumo de tokens. Estas estimaciones, aclaran, dependen del tipo de tarea.
Antes de su estreno, Opus 5.5 pasó por evaluaciones con la participación de organizaciones externas, según la propia empresa.



