Claude Opus 5 es el nuevo modelo insignia de Anthropic, lanzado el 24 de julio de 2026. Según el anuncio oficial, es «un modelo reflexivo y proactivo que se acerca a la inteligencia de frontera de Claude Fable 5 a la mitad del precio». En otras palabras: casi el mismo nivel del modelo más potente de Anthropic, pero pensado para usarse todos los días sin que la factura se dispare.
Qué es Claude Opus 5
Es la quinta generación de la línea Opus, la gama «premium» de modelos Claude, disponible desde el mismo día del anuncio en Claude.ai, Claude Code, Claude Cowork y la API (con el identificador claude-opus-5). Se convierte en el modelo por defecto de Claude Max y en el más potente disponible en Claude Pro.
En evaluaciones de código y trabajo de conocimiento como Frontier-Bench y GDPval-AA, Opus 5 es el nuevo estado del arte —aunque, según Anthropic, sigue por detrás de Mythos 5 en tareas de ciberseguridad. Está diseñado para el uso diario: trabaja de forma más eficiente que otros modelos, verificando su propio trabajo e iterando con cuidado hasta lograr el resultado.
Cómo funciona: el dial de esfuerzo
La novedad más práctica de Opus 5 es un control de «esfuerzo» configurable (bajo, alto, xhigh y máximo). En términos simples: tú decides si quieres que el modelo piense poco y responda rápido y barato, o que piense mucho y entregue el resultado más preciso posible, aunque tarde y cueste más tokens.
Esto es útil tanto para quien programa (puede pedir el máximo esfuerzo en un bug difícil y el mínimo en una tarea trivial) como para equipos no técnicos que simplemente quieren controlar el costo de usar IA sin perder calidad en las tareas que realmente lo requieren. De hecho, en Zapier AutomationBench, incluso en su nivel de esfuerzo más bajo, Opus 5 aprueba más tareas que cualquier otro modelo en cualquier nivel.
Ejemplos reales de su capacidad
Más allá de los números, Anthropic compartió casos concretos de cómo se comporta Opus 5 frente a problemas difíciles durante las pruebas de acceso anticipado:
- Reconstrucción 3D sin poder «ver» el dibujo: en una tarea de Frontier-Bench, se le dio a Opus 5 el dibujo de una pieza mecánica y se le pidió recrearla como modelo 3D en FreeCAD —pero, a propósito, sin darle forma de ver directamente el dibujo. El modelo respondió escribiendo su propio pipeline de visión por computadora para extraer la geometría de los píxeles crudos, y reconstruyó la pieza completa. Lo logró de forma repetida; ningún modelo competidor con el mismo reto lo resolvió en cinco intentos.
- Encontrar la causa raíz de un bug, no solo el síntoma: frente a un bug real en un gestor de paquetes open source muy usado, Opus 5 encontró la causa raíz y corrigió un caso límite que el parche de la comunidad había pasado por alto. Un modelo competidor solo arregló el síntoma superficial y reportó el bug como resuelto.
- Un feed de datos de mercado en una sola sesión: un ingeniero de una firma de trading usó Opus 5 para construir, en una sola sesión, un feed de datos de mercado para un exchange nuevo. Modelos anteriores no podían completar esta tarea ni con planes detallados del ingeniero. Sin un feed en vivo contra el cual validar, Opus 5 construyó su propio entorno de pruebas para verificar que su código interpretaba correctamente los datos del exchange.
Características principales
- Verificación propia del trabajo: el modelo revisa y corrige sus propias respuestas antes de entregarlas, en vez de depender de que el usuario detecte el error.
- Mejor generación visual: salidas visuales de mayor calidad —Anthropic mostró, por ejemplo, a Opus 5 visualizando el flujo de aire sobre objetos aerodinámicos en un túnel de viento interactivo generado por el propio modelo.
- Fuerte en ciencia: mejoras notables en tareas de investigación científica, especialmente química orgánica y predicción de secuencias de proteínas.
- Cambio de herramientas a mitad de conversación (beta): en la Claude Platform, los desarrolladores pueden cambiar qué herramientas puede usar Claude dentro de una conversación sin invalidar el caché del prompt.
- Fallbacks automáticos en la API (beta): las solicitudes marcadas por los clasificadores de seguridad pueden enrutarse automáticamente a otro modelo en vez de bloquearse sin más.
- Sin requisitos de retención de datos para el acceso general, igual que sus predecesores Opus.
Benchmarks: los números que publicó Anthropic
| Benchmark | Qué mide | Resultado de Opus 5 |
|---|---|---|
| Frontier-Bench v0.1 | Código e ingeniería de software | Supera a todos los modelos; más del doble que Opus 4.8, a menor costo por tarea |
| CursorBench 3.2 (max effort) | Agentes de código | A 0.5% del pico de Fable 5, a la mitad del costo por tarea |
| ARC-AGI 3 | Razonamiento abstracto | Tres veces el puntaje del siguiente mejor modelo |
| OSWorld 2.0 | Uso de computadora (agentes) | Supera el mejor resultado de Fable 5, a poco más de un tercio del costo |
| Zapier AutomationBench | Automatización de flujos de trabajo | Tasa de aprobación ~1.5x el siguiente mejor modelo, al mismo costo |
| Química orgánica (científico) | Investigación científica | 10.2 puntos porcentuales más que Opus 4.8 |
| Predicción de proteínas | Investigación científica | 7.7 puntos porcentuales más que la versión anterior |
Todos estos números provienen del anuncio oficial de Anthropic; como con cualquier benchmark publicado por el fabricante, conviene tomarlos como punto de partida y confirmarlos con pruebas propias antes de decidir un cambio de modelo en producción.
Precios: cuánto cuesta Claude Opus 5
| Concepto | Precio |
|---|---|
| Tokens de entrada | 5 USD por millón de tokens |
| Tokens de salida | 25 USD por millón de tokens |
| Modo rápido (Fast Mode) | El doble del precio base, ~2.5 veces más rápido |
El precio base es idéntico al de Opus 4.8 —Anthropic no subió el costo por token pese a la mejora de rendimiento, lo que en la práctica significa más capacidad por el mismo dinero.
Seguridad y alineación
Según la auditoría automatizada de comportamiento de Anthropic previa al lanzamiento, Opus 5 es su modelo más alineado hasta la fecha: cumple mejor la Constitución de Claude que Opus 4.8, Sonnet 5 o el propio Fable 5, muestra las tasas más bajas de comportamiento engañoso, y es el menos susceptible a ser engañado para un mal uso. Obtuvo un puntaje de 2.3 en comportamiento no alineado general, el más bajo entre los modelos recientes de la compañía.
En cuanto a capacidades de doble uso, Anthropic es transparente en que Opus 5 no mueve la frontera de riesgo: en evaluaciones conjuntas con socios del sector privado y gobierno, el modelo sigue por detrás de Mythos 5 tanto en investigación biológica como en ciberseguridad ofensiva. En la prueba OSS-Fuzz, Opus 5 identifica vulnerabilidades de software con un éxito similar al de Mythos 5, pero queda considerablemente por detrás al momento de desarrollar exploits a partir de esas vulnerabilidades —justo la diferencia entre encontrar un problema y convertirlo en una amenaza real.
Los clasificadores de ciberseguridad de Opus 5 son proporcionalmente menos restrictivos que los de Fable 5 (Anthropic espera que intervengan un 85% menos), permitiendo buscar vulnerabilidades en código fuente pero bloqueando escaneo binario, pruebas de penetración y generación de exploits. Las solicitudes bloqueadas en Claude.ai, Claude Code y Claude Cowork caen automáticamente a Opus 4.8. Empresas e investigadores que forman parte del Cyber Verification Program (CVP) de Anthropic tienen acceso inmediato a una versión con menos restricciones de seguridad para trabajo legítimo de ciberseguridad.
Ventajas: para quién es Opus 5
- Equipos de desarrollo que quieren calidad cercana al modelo top de Anthropic sin pagar el precio del modelo top.
- Negocios que ya usan IA para atención al cliente, automatización o generación de contenido y quieren más control sobre el balance costo/calidad gracias al dial de esfuerzo.
- Equipos de investigación científica, especialmente en química orgánica y biología computacional —las solicitudes de biología bloqueadas en Fable 5 ahora se enrutan a Opus 5 en vez de a Opus 4.8.
- Cualquiera que use Claude Code o agentes que dependan de verificar su propio trabajo sin supervisión constante.
Limitaciones a tener en cuenta
No es el modelo más potente de Anthropic en términos absolutos —ese lugar sigue siendo de Claude Fable 5—, y no es la opción recomendada para tareas de ciberseguridad ofensiva o investigación biológica autónoma de largo plazo, donde Mythos 5 sigue por delante según la propia Anthropic.
Preguntas frecuentes
¿Claude Opus 5 reemplaza a Claude Fable 5?
No. Fable 5 sigue siendo el modelo más potente de Anthropic en términos absolutos. Opus 5 está pensado para acercarse a ese nivel de inteligencia a una fracción del costo, no para superarlo en todo.
¿Cuánto cuesta usar Claude Opus 5?
5 dólares por millón de tokens de entrada y 25 dólares por millón de tokens de salida, el mismo precio que su antecesor Opus 4.8. El modo rápido cuesta el doble pero responde unas 2.5 veces más rápido.
¿Dónde puedo usar Claude Opus 5?
Está disponible desde el lanzamiento en Claude.ai, Claude Code, Claude Cowork y vía API con el identificador claude-opus-5. Es el modelo por defecto en Claude Max y el más potente disponible en Claude Pro.
¿Es seguro usar Claude Opus 5?
Según las auditorías automatizadas de Anthropic, es su modelo más alineado hasta la fecha, con las tasas más bajas de comportamiento engañoso reportadas. Para tareas sensibles de ciberseguridad o biología, Anthropic mantiene salvaguardas específicas y un programa de verificación (CVP) para uso legítimo.
¿Vale la pena migrar de Opus 4.8 a Opus 5?
Si tu caso de uso involucra código, automatización o razonamiento complejo, los benchmarks publicados muestran una mejora sustancial al mismo precio —lo lógico es probarlo con tus propias tareas antes de migrar producción por completo.
Si estás evaluando integrar agentes de IA (como los que construyo sobre modelos Claude) en tu negocio, mira cómo lo hago con DraVolt o escríbeme directamente y evaluamos tu caso.
Fuente: anuncio oficial de Anthropic, «Introducing Claude Opus 5» (24 de julio de 2026).



