El 24 de julio, Anthropic lanzó Claude Opus 5 — y los números que publicaron son de los más llamativos que vimos en mucho tiempo en el rubro de la IA. El modelo no solo mejora al Opus anterior: en varios benchmarks le gana directamente a Fable 5, el modelo más potente de Anthropic, y lo hace a la mitad del precio.
¿Qué cambió exactamente?
Opus 5 reemplaza a Opus 4.8 como el modelo de referencia para trabajo intensivo. El precio no cambió — $5 por millón de tokens de entrada y $25 por millón de salida —, pero el rendimiento es radicalmente distinto. En Frontier-Bench v0.1, el benchmark más exigente para tareas de programación complejas, Opus 5 sacó 43.3% en su configuración máxima, contra 33.7% de Fable 5 y 37.5% de GPT-5.6 Sol. Opus 4.8 estaba en 18.7%.
El número que más llama la atención es el de ARC-AGI-3, una evaluación que mide la capacidad de un modelo para resolver problemas completamente nuevos — los que no pudo haber visto durante el entrenamiento. Opus 5 llegó a 30.16%, tres veces el score del modelo que quedó en segundo lugar. En OSWorld 2.0, un benchmark de uso de la computadora, supera el pico de Fable 5 gastando apenas un tercio del costo por tarea.
Para qué sirve en la práctica
El modelo fue diseñado para trabajo agéntico de largo aliento: desarrollo de software complejo, debugging de root cause, análisis financiero con muchos pasos, investigación científica. No es el modelo para hacer una pregunta rápida — para eso están Sonnet 5 o Haiku. Es el modelo que encargás cuando el problema no tiene solución directa y necesitás algo que iterate, verifique su propio trabajo y no se rinda.
Anthropic habilitó una función nueva de control de esfuerzo: podés elegir entre cinco niveles (low, medium, high, xhigh, max) según qué tan profundo necesitás que trabaje el modelo. A mayor esfuerzo, más tokens consume — pero también hay mayor probabilidad de que resuelva el problema. Para el uso cotidiano, los niveles medio y alto ya son suficientes.
También lanzaron un Fast Mode que corre el modelo 2.5 veces más rápido al doble del precio base ($10/$50 por millón de tokens). Útil para pipelines que priorizan latencia sobre costo.
Disponibilidad
Opus 5 ya está disponible en Claude.ai para los planes Pro, Max, Team y Enterprise. En Pro es el modelo más potente disponible; en Max pasa a ser el modelo por defecto. Para desarrolladores, el identificador de API es claude-opus-5 y está en el Claude Platform, AWS Bedrock, Google Cloud y Microsoft Foundry.
Dos novedades técnicas en beta acompañan el lanzamiento: mid-conversation tool changes (podés cambiar qué herramientas tiene disponibles Claude en medio de una conversación sin romper el caché) y automatic fallbacks (las solicitudes bloqueadas por clasificadores de seguridad en Opus 5 o Fable 5 pueden redirigirse automáticamente a otro modelo en lugar de fallar).
El contexto importa
Anthropic menciona que Opus 5 es su modelo más alineado hasta la fecha — menor tasa de comportamiento engañoso y mayor resistencia al jailbreak que Fable 5. En ciberseguridad, puede identificar vulnerabilidades en código fuente pero tiene restricciones más fuertes que Fable 5 para exploits. En biología, reemplaza a Opus 4.8 como el modelo disponible de forma general más capaz.
Si usás Claude Pro o Claude Code y querés el mejor rendimiento disponible sin pagar el precio de Fable 5, Opus 5 es el que tiene que estar en tu flujo de trabajo a partir de ahora.