A menos de dos semanas de que Anthropic y OpenAI pidieran públicamente una pausa en el avance de herramientas de inteligencia artificial, ambas compañías presentaron, con pocas horas de diferencia, modelos más veloces y potentes. En el centro de la atención está Claude Opus 5.5, versión mejorada de la familia Opus 5, que la firma califica como más eficiente y capaz de completar tareas complejas con menor intervención humana. Su directorio, encabezado por Dario Amodei, sitúa al modelo como un competidor directo de las variantes GPT-6 Sol y GPT-6 Luna.
Anthropic asegura que Opus 5.5 muestra su mayor fortaleza en trabajos prolongados, como la revisión de código, la corrección de fallas y el análisis de información, donde puede encadenar varios pasos para obtener un resultado sin necesidad de indicaciones constantes. Esa continuidad resulta relevante para proyectos que antes requerían dividir el trabajo en múltiples instrucciones y supervisar cada tramo.
La compañía apunta que la versión está orientada a programación y a tareas profesionales que implican consultar información, tomar decisiones intermedias y verificar resultados. En pruebas comparativas, Opus 5.5 superó a Opus 5 en diversas evaluaciones de estas capacidades. En una prueba de tareas de programación ejecutadas desde una terminal, obtuvo un rendimiento del 66,4% frente al 52,3% de su predecesor, según los datos publicados por la empresa.
Entre los ejemplos de uso que la firma presentó figura una organización que accedió al modelo antes de su lanzamiento, la cual auditó y corrigió un programa de 200.000 líneas en menos de tres horas, una tarea que con Opus 5 había demandado más de 20 horas. Anthropic atribuye parte de la diferencia a que Opus 5.5 requiere menos pasos y consume menos tokens de texto.
La mejora buscada es la continuidad operativa: que el asistente pueda avanzar durante un encargo amplio sin requerir una instrucción humana para cada paso. En programación, esto implica recorrer archivos, proponer cambios y verificar si resuelven el problema planteado. Quienes probaron Opus 5.5 indicaron que, para tareas largas, el modelo completó procesos con menos intercambios y con menos correcciones posteriores que Opus 5.
Otra ventaja señalada es la mayor claridad en la presentación de resultados, lo que facilita la revisión previa a la incorporación de los aportes al proyecto. No obstante, la revisión humana sigue siendo necesaria: los ejemplos publicados corresponden a pruebas con objetivos y herramientas definidos.
En cuanto a costos, Anthropic fijó tarifas por millón de tokens un 20% por debajo de las de Opus 5 y estima que, en escenarios habituales con la configuración predeterminada, el gasto total podría verse reducido en aproximadamente un 40%, sujeto al tipo de tarea.
Antes de su lanzamiento, Opus 5.5 pasó por evaluaciones con la participación de organizaciones externas que probaron el rendimiento del modelo en contextos reales.



