Anthropic ha lanzado Claude Opus 5, su nuevo modelo insignia de la familia Opus, disponible desde el 24 de julio de 2026. Este modelo promete inteligencia cercana a la del frontier model Claude Fable 5, pero a la mitad del precio.
Rendimiento y relación costo-efectividad
Claude Opus 5 ofrece mejoras significativas en rendimiento manteniendo el mismo costo que su predecesor, Opus 4.8. Una de las características más destacadas es el ajuste de “esfuerzo” (effort setting), que permite a los usuarios optimizar entre inteligencia máxima y ahorro de tokens.
En evaluaciones de ingeniería de software como Frontier-Bench v0.1, Opus 5 supera a todos los demás modelos y más que duplica el rendimiento de Opus 4.8 a un menor costo por tarea. En CursorBench 3.2, con el máximo esfuerzo, el modelo rinde dentro del 0.5% del puntaje máximo de Fable 5, pero a la mitad del costo.
Resultados en benchmarks clave
- ARC-AGI 3 (problemas novedosos): Opus 5 obtiene un puntaje tres veces superior al del siguiente mejor modelo.
- Zapier AutomationBench (tareas empresariales completas): tasa de éxito ~1.5× el siguiente mejor modelo al mismo costo.
- OSWorld 2.0 (uso de computadora): supera a todos los modelos a cualquier costo, incluso superando el mejor resultado de Fable 5 con poco más de un tercio del costo.
- GDPval-AA v2, HLE, DeepSearchQA: nuevo estado del arte en todas estas evaluaciones.
Capacidades de agencia y razonamiento
Claude Opus 5 destaca por su capacidad de verificar su propio trabajo e iterar cuidadosamente hasta tener éxito. Algunos ejemplos de pruebas tempranas:
- En una tarea de Frontier-Bench donde se le dio un dibujo de una pieza mecánica sin forma directa de verlo, Opus 5 construyó su propio pipeline de visión por computadora para extraer la geometría de los píxeles y reconstruyó la pieza completa en 3D.
- Encontró la causa raíz de un bug real en un popular gestor de paquetes open-source y arregló un caso borde que el parche de la comunidad había pasado por alto.
- Un ingeniero de una firma de trading usó Opus 5 para construir un feed de datos de mercado para un nuevo exchange en una sola sesión. Sin tener un feed real para validar, Opus 5 construyó su propio harness de pruebas.
“Claude Opus 5 entrega inteligencia cercana a Fable 5 a velocidad y costo de Opus. En CursorBench está muy cerca de Fable 5 y tiene muchos de sus mismos comportamientos.” — Sualeh Asif, Co-Fundador de Cursor
Precios y disponibilidad
| Métrica | Precio |
|---|---|
| Input tokens | $5 por millón |
| Output tokens | $25 por millón |
| Fast mode | ~2.5× velocidad, 2× precio base |
Opus 5 está disponible en todas las plataformas de Anthropic: Claude.ai, Claude Code, Claude Max (como modelo predeterminado) y Claude Pro (como el modelo más potente). También está disponible vía API con el identificador claude-opus-5.
Seguridad y alineación
Según Anthropic, Opus 5 es su modelo más alineado hasta la fecha, con las tasas más bajas de comportamiento engañoso y la menor susceptibilidad a ser engañado para usos malintencionados. No avanza la frontera en capacidades de doble uso riesgosas, manteniéndose por detrás de Mythos 5 en ciberseguridad ofensiva e investigación biológica.
Los salvaguardas están diseñados para permitir usos benéficos del modelo en ciberseguridad y biología, con clasificadores aproximadamente 85% menos restrictivos que los de Fable 5.
Conclusión
Claude Opus 5 representa un salto generacional en la familia Opus. Con inteligencia cercana a los modelos frontier a la mitad del costo, se perfila como la opción más equilibrada para equipos de desarrollo que necesitan capacidades de agente de alto nivel sin pagar el precio premium de Fable 5.
Si trabajas con agentes de código, automatización o desarrollo asistido por IA, Opus 5 es el modelo a considerar para producción.
Sigue explorando estas tendencias de IA en el blog de DojoFullStack.