A poco más de dos semanas desde que representantes del sector pidieron frenar el avance de herramientas de inteligencia artificial, Anthropic y OpenAI anunciaron, con apenas horas de diferencia, sus novedades: modelos más rápidos y potentes. En este marco, la firma liderada por Dario Amodei posiciona a Claude Opus 5.5 como una versión más eficiente que promete realizar tareas complejas con menor intervención humana, en competencia con GPT-6 Sol y GPT-6 Luna.
Opus 5.5 está orientado especialmente a trabajos que requieren procesos largos, como revisar código, corregir fallos y analizar información. El equipo de la empresa sostiene que este modelo puede encadenar múltiples etapas para completar un resultado sin necesidad de instrucciones para cada punto intermedio, lo que representa un avance significativo para proyectos que antes demandaban dividir la tarea en varias instrucciones y supervisiones.
La nueva iteración apunta a ámbitos de programación y a tareas profesionales que implican consultar datos, tomar decisiones parciales y verificar resultados. Anthropic afirmó que Opus 5.5 mejora el rendimiento de Opus 5 en varias evaluaciones de esas capacidades. En una prueba que evaluó tareas de programación ejecutadas desde una terminal, Opus 5.5 promedió 66,4% frente al 52,3% de su predecesor, según los datos publicados por la compañía.
La empresa también brindó ejemplos de proyectos resueltos con el nuevo modelo. Una organización que accedió al sistema antes de su lanzamiento auditó y corrigió un programa de 200.000 líneas en menos de tres horas, una tarea que con Opus 5 había llevado más de 20 horas. Atribuyen parte de la diferencia a que Opus 5.5 requiere menos pasos y utiliza menos tokens, es decir, menos unidades de texto procesadas.
Uno de los ejes centrales de la mejora es la continuidad del trabajo: que el asistente pueda avanzar en un encargo amplio durante más tiempo sin necesitar una instrucción humana para cada paso. En programación, esto implica recorrer archivos, proponer cambios y comprobar si resuelven el problema planteado. Las compañías que evaluaron Opus 5.5 indicaron que completó labores extensas con menos intercambios y con menos correcciones posteriores que Opus 5.
Anthropic también subraya que el modelo entrega resultados de forma más clara, lo cual facilita la revisión antes de incorporar el trabajo a un proyecto. Aun así, señalan que la revisión humana sigue siendo necesaria y que los ejemplos publicados corresponden a pruebas con objetivos y herramientas definidos.
La eficiencia se reflejó además en costos: Opus 5.5 tendría tarifas por millón de tokens un 20% más bajas que Opus 5, y la firma estima que, para tareas habituales con la configuración predeterminada, el gasto total podría recortarse hasta un 40%, aunque advierte que estas estimaciones dependen del tipo de tarea.
Antes del lanzamiento, Opus 5.5 fue sometido a evaluaciones en las que participaron distintas organizaciones externas. La nota de TN recuerda también que especialistas analizaron las advertencias planteadas por un exempleado de Anthropic sobre posibles desvíos en el control de la IA.



