A apenas 10 días de haber pedido públicamente una pausa en el desarrollo de herramientas de inteligencia artificial, Anthropic y OpenAI comunicaron, con pocas horas de diferencia, la llegada de sus modelos más rápidos y potentes. En este contexto, la firma liderada por Darío Amodei presentó Claude Opus 5.5, una IA que se promociona por su mayor eficiencia y capacidad para encadenar tareas complejas con una intervención humana reducida.
El nuevo Opus 5.5 está dirigido especialmente a trabajos que requieren procesos extendidos, como la revisión de código, la corrección de errores y el análisis de información. Según la empresa, la versión puede avanzar varios pasos sin necesitar instrucciones constantes, lo que resulta clave cuando se utilizan asistentes de IA en proyectos que antes obligaban a dividir el trabajo en partes y supervisarlas una a una.
Anthropic señaló que Opus 5.5 mejora las capacidades de su predecesor en pruebas orientadas a programación y a toma de decisiones intermedias, además de la verificación de resultados. En un test de tareas de programación ejecutadas desde una terminal, Opus 5.5 obtuvo un rendimiento de 66,4%, frente al 52,3% de Opus 5, según los resultados difundidos por la compañía.
La firma puso como ejemplo concreto un encargo en el que una organización que probó el modelo antes de su lanzamiento auditaría y corregiría un programa de 200.000 líneas en menos de tres horas; esa tarea, con Opus 5, había demandado más de 20 horas. Parte de la diferencia se atribuye a que Opus 5.5 requiere menos pasos y utiliza una menor cantidad de tokens durante el proceso.
Entre las mejoras destacadas, Anthropic subraya una mayor continuidad en el desarrollo de un encargo amplio: el asistente puede avanzar durante más tiempo sin pedir instrucciones para cada tramo. En el ámbito de la programación, esto implica recorrer archivos, proponer cambios y verificar si resuelven el problema planteado. Usuarios que probaron Opus 5.5 indicaron que completó tareas largas con menos intercambios y con menos correcciones posteriores que Opus 5.
La compañía afirmó también que la presentación de resultados es más clara, lo que facilita la revisión por parte de alguien que debe integrarlos a un proyecto. Aclararon que la revisión sigue siendo necesaria, con ejemplos de pruebas de objetivo y herramientas específicas.
En materia de costos, Anthropic indicó que Opus 5.5 aplica tarifas por cada millón de tokens un 20% por debajo de las de Opus 5. Estiman que, para tareas habituales con la configuración por defecto, el gasto total podría caer alrededor de un 40%, dependiendo del tipo de tarea.
Antes del lanzamiento, Opus 5.5 pasó por evaluaciones con diversas organizaciones y entidades, de las que no se detallaron nombres en la información pública disponible.



