A apenas diez días de haber pedido públicamente una pausa en el desarrollo de herramientas de inteligencia artificial, Anthropic y OpenAI revelaron sus últimos modelos, con diferencias mínimas en el lapso entre anuncios. En el caso de Anthropic, su apuesta se sitúa frente a las versiones GPT-6 Sol y GPT-6 Luna, y se presenta como Claude Opus 5.5, un sistema diseñado para ser más eficiente y capaz de realizar tareas complejas con una menor intervención humana.
La compañía, liderada por Dario Amodei, destacó que Opus 5.5 ofrece ventajas especialmente en trabajos prolongados, como revisar código, corregir errores y analizar información. En estas tareas, el modelo puede encadenar varios pasos para llegar a un resultado, reduciendo la necesidad de instrucciones y supervisión continuas en comparación con versiones anteriores.
El nuevo Opus 5.5 está orientado a programación y a tareas profesionales que requieren consultar datos, tomar decisiones intermedias y validar resultados. Anthropic sostiene que este modelo mejora el desempeño de Opus 5 en diversas pruebas de estas habilidades. En una evaluación de tareas de programación ejecutadas desde una terminal, Opus 5.5 obtuvo un 66,4%, frente al 52,3% de su predecesor.
La empresa mostró ejemplos prácticos de trabajos completos. Una organización que tuvo acceso al modelo antes de su lanzamiento auditar y corregir un programa de 200.000 líneas en menos de tres horas, una tarea que con Opus 5 había requerido más de 20 horas. Parte de esa diferencia se atribuye a que Opus 5.5 necesitó menos pasos y consumió menos tokens (unidades de procesamiento de texto).
Entre las mejoras destacadas, Anthropic mencionó una mayor continuidad en el trabajo: el asistente puede avanzar durante un encargo amplio durante más tiempo sin necesitar una instrucción humana para cada fase. En el ámbito de la programación, esto implica recorrer archivos, proponer cambios y verificar si resuelven el problema planteado. Empresas que probaron Opus 5.5 reportaron completar tareas extensas con menos idas y vueltas y con menos correcciones posteriores frente a Opus 5.
Asimismo, la firma aseguró que el modelo presenta los resultados de manera más clara, lo que facilita la revisión previa antes de incorporar el trabajo a un proyecto. Esa revisión sigue siendo necesaria, ya que los ejemplos difundidos corresponden a pruebas con objetivos y herramientas definidas.
En lo que respecta a costos, Anthropic señaló que Opus 5.5 tiene tarifas por millón de tokens un 20% más bajas que las de Opus 5 y calculó que, para tareas habituales con la configuración por defecto, el costo total podría reducirse en aproximadamente un 40%, sujeto a la naturaleza de cada tarea.



