A apenas 10 días de que se pidió públicamente una pausa en el desarrollo de herramientas de inteligencia artificial, Anthropic y OpenAI difundieron sus nuevos modelos, más veloces y potentes, con apenas unas horas de diferencia.
La propuesta de la empresa liderada por Darío Amodei frente a la competencia de GPT-6 Sol y GPT-6 Luna es Claude Opus 5.5, una IA que se presenta como más eficiente y capaz de efectuar tareas complejas con menor intervención humana.
La firma subrayó que el rendimiento mejora especialmente en trabajos extensos como revisar código, corregir errores y analizar información. En ese tipo de tareas, Opus 5.5 puede encadenar múltiples pasos para completar un resultado, lo que reduce la necesidad de guiar al sistema paso a paso.
Este lanzamiento está orientado tanto a programación como a tareas profesionales que requieren consultar información, tomar decisiones intermedias y verificar resultados. Según Anthropic, Opus 5.5 eleva el rendimiento respecto a Opus 5 en varias evaluaciones de estas capacidades. En una prueba de tareas de programación ejecutadas desde una terminal, Opus 5.5 alcanzó un 66,4% frente al 52,3% de su predecesor.
La compañía mostró ejemplos de proyectos completos: una organización que accedió al modelo antes del lanzamiento logró auditar y corregir un programa de 200.000 líneas en menos de tres horas, una tarea que con Opus 5 había requerido más de 20 horas. Parte de la diferencia, dicen, se debe a que Opus 5.5 necesita menos pasos y usa menos tokens.
La mejora anunciada apunta a la continuidad del trabajo: el asistente debe avanzar durante más tiempo en un encargo amplio sin requerir una instrucción humana para cada etapa. En el ámbito de la programación, ello implica recorrer archivos, proponer cambios y verificar si resuelven el problema planteado. Empresas que probaron Opus 5.5 señalaron que completó tareas largas con menos intercambios y menos correcciones posteriores que con Opus 5.
Entre otros aspectos, Anthropic afirmó que el modelo entrega resultados de forma más clara, una característica útil para quienes deben revisar lo hecho antes de incorporarlo a un proyecto. La revisión sigue siendo necesaria: los ejemplos publicados corresponden a pruebas con objetivos y herramientas definidas.
La eficiencia también se refleja en costos: la firma fijó tarifas por millón de tokens un 20% más bajas que las de Opus 5 y calculó que, en trabajos habituales con la configuración por defecto, el costo total podría reducirse hasta un 40% debido a que se requieren menos tokens para completar las tareas. Esa estimación depende del tipo de tarea.
Antes de su lanzamiento, Opus 5.5 fue sometido a evaluaciones en las que participaron diversas organizaciones, según la propia Anthropic.



