A pocos días de que Anthropic y OpenAI impulsaran un freno público al ritmo de desarrollo de la IA, la dos compañías difundieron, con apenas horas de diferencia, sus modelos más potentes y rápidos. En el caso de Anthropic, la apuesta apunta a Claude Opus 5.5, una IA diseñada para trabajar con menos necesidad de intervención humana y para gestionar procesos complejos con mayor continuidad. Este lanzamiento se da en el marco de la competencia con GPT-6 Sol y GPT-6 Luna.
El nuevo Opus 5.5 se presenta como especialmente eficiente en tareas prolongadas, como revisar código, corregir errores y analizar información. Su capacidad de encadenar múltiples pasos le permite avanzar más allá de instrucciones puntuales y mantener un flujo de trabajo durante un encargo amplio, algo relevante para proyectos que antes requerían dividir la labor en varias instrucciones y supervisión de cada etapa.
La versión está orientada a programación y a trabajos profesionales que exigen consultar información, tomar decisiones intermedias y verificar resultados. Anthropic sostuvo que Opus 5.5 mejora respecto de Opus 5 en diversas pruebas de estas habilidades. En una evaluación de tareas de programación ejecutadas desde una terminal, obtuvo un desempeño del 66,4%, frente al 52,3% de su antecesor, según los datos publicados por la firma.
La empresa también mostró ejemplos de proyectos completos. Una organización que accedió al modelo antes de su lanzamiento auditó y corrigió un programa de 200.000 líneas en menos de tres horas, una tarea que con Opus 5 había llevado más de veinte horas. Parte de esa diferencia se atribuye a que Opus 5.5 requirió menos pasos y utilizó una menor cantidad de tokens o unidades de procesamiento de texto.
Entre los objetivos de Opus 5.5 figura una mayor continuidad en el desarrollo de un encargo: que el asistente pueda avanzar por más tiempo sin necesidad de una instrucción humana para cada tramo. En el ámbito de la programación, esto implica recorrer archivos, proponer cambios y verificar si resuelven el problema planteado. Empresas que probaron la nueva versión indicaron que completó tareas prolongadas con menos intercambios y con menos correcciones posteriores que Opus 5.
Otro aspecto destacado es la claridad de los resultados. Anthropic afirma que el modelo entrega salidas más comprensibles, lo que facilita la revisión previa a la incorporación de los avances en un proyecto. No obstante, la revisión humana sigue siendo necesaria: los ejemplos publicados corresponden a pruebas con objetivos y herramientas definidos.
En cuanto a costos, la firma señaló que Opus 5.5 ofrece tarifas por millón de tokens un 20% más bajas que las de Opus 5. En escenarios habituales con la configuración por defecto, estiman que el gasto total podría reducirse alrededor del 40% debido a que el modelo utiliza menos tokens para completar las tareas, aunque el ahorro depende del tipo de tarea.
Antes de su lanzamiento, Opus 5.5 pasó por evaluaciones en las que participaron diversas organizaciones.



