A inicio de mes, y a apenas 10 días de un pedido público de pausa en el desarrollo de herramientas de inteligencia artificial, Anthropic y OpenAI comunicaron, con pocas horas de diferencia, sus nuevas propuestas: Claude Opus 5.5 y GPT-6 Sol y Luna, respectivamente. El objetivo de la firma liderada por Dario Amodei es posicionar a Opus 5.5 como una IA más veloz y capaz de llevar a cabo tareas complejas con menor intervención humana.
Opus 5.5 se presenta como una versión optimizada para tareas prolongadas y de alto nivel de complejidad, en las que la IA debe revisar código, corregir errores y analizar información, manteniendo un hilo de trabajo más continuo sin necesidad de instrucción para cada paso. Este enfoque resulta especialmente relevante para usuarios que integran asistentes de IA en proyectos que antes requerían dividir la labor en múltiples órdenes y supervisión constante.
La firma señala que la versión está especialmente dirigida a programación y trabajos profesionales que requieren consultar datos, tomar decisiones intermedias y verificar resultados. Según Anthropic, Opus 5.5 mejora el desempeño de Opus 5 en varias pruebas enfocadas en estas capacidades. En una evaluación de tareas de programación ejecutadas desde una terminal, Opus 5.5 alcanzó un rendimiento de 66,4%, frente al 52,3% de su antecesor, de acuerdo con los datos publicados por la empresa.
La compañía también mostró ejemplos de proyectos completos. Una organización que accedió al modelo antes del lanzamiento aud itó y corrigió un programa de 200.000 líneas en menos de tres horas, tarea que con Opus 5 demandaba más de 20 horas. Anthropic atribuye parte de la diferencia a que Opus 5.5 requirió menos pasos y consumió menos tokens de procesamiento de texto.
La mejora, según la firma, apunta a la continuidad del trabajo: que el asistente pueda avanzar durante más tiempo en una tarea amplia sin necesitar una instrucción humana para cada tramo. En programación, eso implica recorrer archivos, proponer cambios y verificar si resuelven el problema planteado. Quienes probaron Opus 5.5 indicaron que completó tareas extensas con menos intercambios y con menos correcciones posteriores que con Opus 5.
Anthropic añade que el modelo entrega sus resultados de manera más comprensible, característica útil cuando alguien debe revisar lo hecho antes de incorporarlo a un proyecto. Sin embargo, la revisión continúa siendo necesaria: los ejemplos publicados corresponden a pruebas con objetivos y herramientas definidos.
La eficiencia también se observa en costos. La empresa fijó tarifas por millón de tokens para Opus 5.5 un 20% por debajo de las de Opus 5 y estima que, en escenarios habituales con la configuración predeterminada, el costo total podría reducirse hasta un 40% gracias a usar menos tokens, though estas cifras dependen del tipo de tarea.
Antes del lanzamiento, Opus 5.5 fue sometido a evaluaciones con la participación de diversas organizaciones, según comunicó la compañía.



