A diez días de haber pedido públicamente un freno al desarrollo de herramientas de inteligencia artificial, Anthropic y OpenAI mostraron, "con apenas horas de diferencia", nuevas propuestas que buscan mover la vara en velocidad y potencia de las soluciones disponibles.

En este marco, Anthropic presentó Claude Opus 5.5, la nueva versión de su línea Opus, que se propone ser más eficiente y capaz de encadenar pasos complejos con una intervención humana reducida. Según la firma, este modelo resulta especialmente ventajoso en tareas largas, como la revisión de programas, la corrección de fallos y el análisis de información, donde puede acumular varios pasos para alcanzar un resultado final.

El foco de Opus 5.5 está puesto en programación y en trabajos profesionales que requieren consultar información, tomar decisiones intermedias y verificar resultados. La empresa señala que Opus 5.5 mejora el rendimiento de Opus 5 en diversas pruebas de estas capacidades. En una evaluación de tareas de programación ejecutadas desde una terminal, obtuvo un puntaje de 66,4% frente al 52,3% de su antecesor, de acuerdo con datos publicados por Anthropic.

La firma compartió ejemplos de trabajos completados con el nuevo modelo. Una organización que accedió al sistema antes de su lanzamiento logró auditar y corregir un programa de 200.000 líneas en menos de tres horas, una tarea que con Opus 5 había demandado más de 20 horas. La compañía atribuye parte de esa mejora a que Opus 5.5 requiere menos pasos y utiliza menos tokens para avanzar.

Entre las mejoras que destacan, la continuidad del trabajo: el asistente puede avanzar en un encargo amplio durante más tiempo sin necesitar una instrucción humana para cada paso intermedio. En el terreno de la programación, ello implica recorrer archivos, proponer cambios y verificar si resuelven el problema planteado. Quienes probaron Opus 5.5 indicaron que completó tareas largas con menos intercambios y con menos correcciones posteriores que Opus 5.

Otra ventaja señalada es la mayor claridad en la presentación de resultados, lo que facilita la revisión previa a la incorporación de los hallazgos en un proyecto. Esta característica resulta particularmente útil cuando se deben verificar objetivos y herramientas antes de avanzar.

En cuanto a costos, Anthropic informó que Opus 5.5 mantiene tarifas por millón de tokens un 20% por debajo de las de Opus 5. Con configuraciones habituales, estiman que el costo total de una tarea podría reducirse hasta en un 40% debido al menor consumo de tokens, aunque señalan que el ahorro depende del tipo de tarea.

Antes de su lanzamiento, Opus 5.5 pasó por evaluaciones con la participación de organizaciones externas. A la espera de más demostraciones y casos de uso, la compañía sostiene que el modelo ofrece mejoras notables en eficiencia y en la continuidad de los procesos para usuarios profesionales.