A pocos días de haberse encendido el debate público sobre la necesidad de pausar ciertos avances en inteligencia artificial, Anthropic y OpenAI difundieron sus últimos lanzamientos en paralelo, con pocos horarios de diferencia. En el centro de la atención quedó Claude Opus 5.5, el nuevo modelo de la firma encabezada por Dario Amodei, que busca ser más eficaz y capaz de ejecutar procesos complejos con menos supervisión humana. La rivalidad técnica se da especialmente frente a las variantes GPT-6 Sol y GPT-6 Luna.

Según Anthropic, Opus 5.5 rinde mejor que su predecesor en tareas prolongadas que requieren encadenar múltiples pasos, como revisar código, corregir errores y analizar información. En estas pruebas, el sistema mostró una mayor continuidad en el proceso, permitiendo que el asistente siga avanzando sin instrucción para cada tramo.

En el terreno práctico, la versión nueva está orientada a programación y a labores profesionales que demandan consultar datos, tomar decisiones intermedias y verificar resultados. La empresa indicó que Opus 5.5 mejora el desempeño de Opus 5 en diversas evaluaciones de estas capacidades. En una prueba de tareas de programación desde una terminal, Opus 5.5 alcanzó un 66,4% frente al 52,3% de su antecesor, según los datos publicados por la firma.

La compañía subrayó ejemplos de trabajos completos. Una organización que probó el modelo antes de su lanzamiento auditar y corregir un programa de 200.000 líneas en menos de tres horas, una tarea que con Opus 5 había demandado más de veinte horas. Parte de esa mejora se atribuye a un menor número de pasos necesarios y a una menor cantidad de tokens procesados.

La promesa de Opus 5.5 es mantener el progreso a lo largo de proyectos extensos, reduciendo la necesidad de intervenciones humanas para cada etapa. En programación, esto implica recorrer archivos, proponer cambios y verificar si resuelven el problema planteado. Las empresas que evaluaron la versión señalaron que completó tareas largas con menos intercambios y menos correcciones posteriores en comparación con Opus 5.

También se destacó que Opus 5.5 entrega resultados de forma más clara, lo que facilita la revisión antes de incorporar el trabajo a un proyecto. Aunque la revisión humana sigue siendo necesaria, los ejemplos compartidos reflejan pruebas con objetivos y herramientas definidos.

En cuanto a costos, Anthropic comunicó que Opus 5.5 tiene tarifas por millón de tokens un 20% más bajas que las de Opus 5. En condiciones habituales con la configuración por defecto, estiman que el costo total podría reducirse alrededor del 40% gracias a la menor cantidad de tokens requeridos, aunque esa estimación depende del tipo de tarea.

Antes de su lanzamiento, Opus 5.5 fue evaluado por diversas organizaciones externas. El anuncio llega en un contexto de intensos debates sobre el ritmo y la gobernanza de la IA, con los actores del ecosistema buscando equilibrar innovación y seguridad.