Tecnología

Anthropic lanzó Claude Opus 5.5, el primer modelo tras el llamado a "frenar la carrera de la IA"

Logo de Claude, de Anthropic

Anthropic presentó Claude Opus 5.5, el primer modelo de su nueva familia 5.5 y el primer lanzamiento desde que Dario Amodei publicó su ensayo pidiendo "pacer la frontera" de la IA. Según la empresa, el modelo rinde a la altura de Claude Fable 5.1 en la mayoría de las tareas, pero cuesta 40% menos correrlo que Opus 5.

Más rápido, más barato y con menos pasos

Los tokens de entrada y salida bajan a USD 4 y USD 20 por millón (20% menos que Opus 5), y las lecturas de caché —que representan la mayoría del costo en trabajo agéntico y de programación— caen 60%, a USD 0,20 por millón. Además, Opus 5.5 genera respuestas más de 30% más rápido que su predecesor. Anthropic también subió los límites de uso de cinco horas en los planes Pro, Max, Team y Enterprise, y agregó la posibilidad de guardar un reset de límite para usarlo cuando quieras.

En programación, un tester hizo una migración de 680.000 líneas de código en menos de un día, algo que a un equipo de ingeniería le hubiera tomado semanas. En otra prueba interna, Anthropic le pidió a Opus 5.5 y a Fable 5.1 traducir HAProxy (un software muy usado para balancear tráfico web) de C a Rust: ambos pasaron casi todos los tests de regresión, pero Opus 5.5 terminó en 9,5 horas contra 12 de Fable 5.1, y costó 51% menos.

Salvaguardas más estrictas

Es el primer modelo Opus que sale con el mismo nivel de salvaguardas que Claude Fable 5.1 en ciberseguridad y biología. En ciberseguridad, la mayoría de las tareas se redirigen automáticamente a Claude Opus 4.8, mientras que organizaciones verificadas van a poder acceder a más permisos a través del Programa de Verificación Cyber, que pronto se expande para incluir a Opus 5.5. En biología, Opus 5.5 igualó o superó a Claude Mythos 5.1 en varias áreas de investigación, así que Anthropic exige el mismo Programa de Verificación de Ciencias de la Vida que usa con Fable 5.1 para desbloquear ese uso.

En su test de alineación más exhaustivo, que corre casi 2.000 escenarios simulados, Opus 5.5 obtuvo el mejor puntaje de cualquier modelo probado hasta ahora: intentó saltarse límites de contención un 85% menos que Opus 5 o Mythos 5.1, y todos esos intentos fueron de baja severidad y reportados por el propio modelo.

Un lanzamiento con el contexto puesto

Opus 5.5 llega apenas diez días después de que Amodei publicara "We Must Pace the Frontier", el ensayo que pide bajarle el ritmo al desarrollo de la IA para que las prácticas de seguridad no se queden atrás. Sam Altman (OpenAI), Elon Musk (xAI) y Demis Hassabis (Google DeepMind) coincidieron públicamente casi de inmediato con la idea. Anthropic dice que este es el modelo con mejor desempeño que probaron en esa auditoría de comportamiento, justo cuando la propia empresa pidió frenar un poco la carrera.

El modelo ya está disponible en Claude para Pro, Max, Team y Enterprise, en la Claude Platform y en AWS, Google Cloud y Microsoft Foundry, bajo el ID claude-opus-5-5. Claude Sonnet 5.5 y Claude Haiku 5.5 llegan "en las próximas semanas", según la compañía.