A apenas diez días de haber pedido públicamente una pausa en el desarrollo de herramientas de inteligencia artificial, Anthropic y OpenAI comunicaron, con escasas horas de diferencia, la llegada de modelos más veloces y potentes que sus versiones previas. En el centro de la escena está Claude Opus 5.5, la versión de la casa liderada por Dario Amodei, que se presenta como más eficiente y capaz de ejecutar tareas complejas con menor necesidad de intervención humana.

La compañía señala que el nuevo Opus 5.5 sobresale especialmente en trabajos prolongados, como la revisión de código, la corrección de errores y el análisis de información, donde es capaz de encadenar múltiples pasos para alcanzar un resultado. Esto resulta relevante para usuarios que antes debían dividir las tareas en varias instrucciones y monitorear cada tramo.

Este lanzamiento apunta a usos en programación y en entornos profesionales que requieren consultar información, tomar decisiones intermedias y verificar resultados. Anthropic afirma que Opus 5.5 mejora el rendimiento respecto a Opus 5 en varias pruebas de estas capacidades. En una evaluación de tareas de programación realizadas desde una terminal, el sistema obtuvo un 66,4% frente al 52,3% de su predecesor.

La firma mostró ejemplos de proyectos completos: una organización que accedió al modelo para auditar y corregir un programa de 200.000 líneas en menos de tres horas, una tarea que con Opus 5 había tardado más de 20 horas. Parte de esa diferencia se atribuye a que Opus 5.5 requiere menos pasos y usa menos tokens de procesamiento.

La mejora anunciada apunta a la continuidad del trabajo: que el asistente avance durante más tiempo en una tarea amplia sin necesitar instrucción humana para cada paso. En programación, ello implica recorrer archivos, proponer cambios y verificar si resuelven el problema planteado. Quienes probaron Opus 5.5 indicaron que pudo completar tareas largas con menos intercambios y con menos correcciones posteriores que Opus 5.

Anthropic también sostiene que el modelo entrega resultados de forma más clara, lo cual facilita la revisión antes de incorporar lo hecho a un proyecto. Esa revisión sigue siendo necesaria, ya que los ejemplos publicados se basaron en pruebas con objetivos y herramientas definidos.

En términos de eficiencia, la empresa informó tarifas por millón de tokens un 20% inferiores a las de Opus 5 y estima que, para tareas habituales con la configuración predeterminada, el costo total podría caer alrededor del 40% por menor consumo de tokens, aunque estas cifras dependen del tipo de tarea.

Antes de su lanzamiento, Opus 5.5 fue sometido a evaluaciones con diversas organizaciones y clientes, según la propia Anthropic.