Anthropic lanzó Claude Opus 5 el 24 de julio de 2026, y el titular es sencillo: se sitúa muy cerca de la inteligencia del modelo público más capaz de la compañía, Claude Fable 5, mientras cuesta la mitad por tarea y mantiene sin cambios el precio de Opus en 5 dólares por millón de tokens de entrada y 25 dólares por millón de tokens de salida. Llega como el nuevo modelo predeterminado en Claude Max, el modelo más potente en Claude Pro, y a través de la cadena de API claude-opus-5 en Claude Code, Claude Cowork y la Messages API.
Es un auténtico salto de buque insignia, no una actualización menor. En los benchmarks de codificación agéntica y uso del ordenador, Anthropic califica ahora a Opus 5 como su modelo de vanguardia, y los análisis independientes del día del lanzamiento coinciden con ese enfoque.
¿Qué es Claude Opus 5?
Claude Opus 5 es el modelo de frontera de Anthropic para codificación, agentes autónomos y trabajo de conocimiento complejo, lanzado el 24 de julio de 2026. Mantiene una ventana de contexto de 1 millón de tokens tanto como valor predeterminado como máximo, sin ninguna variante más pequeña, y admite hasta 128,000 tokens de salida síncrona en la Messages API. La propuesta es eficiencia en la gama alta: Anthropic afirma que Opus 5 alcanza una calidad cercana a la de Fable 5 por aproximadamente la mitad del precio de Fable 5, lo que transforma «usar el mejor modelo» de un lujo ocasional en un valor predeterminado para el día a día.
El otro cambio estructural es un control de esfuerzo de cinco niveles. En lugar de un único ajuste, decides cuánto se esfuerza el modelo, desde pasadas más ligeras hasta high, xhigh y max. Un mayor esfuerzo gasta más tokens de salida para obtener mejores resultados en problemas difíciles; un menor esfuerzo reduce la latencia y el coste en tareas rutinarias. Anthropic combina esto con un modo rápido que se ejecuta unas 2.5× más rápido que el predeterminado con aproximadamente el doble de coste, de modo que los equipos pueden cambiar dinero por velocidad cuando una tarea es sensible a la latencia.
Los benchmarks que importan
Anthropic y la cobertura del día del lanzamiento enmarcan las ventajas de Opus 5 como agénticas más que como conocimiento trivial en bruto. Las señales más claras:
| Benchmark | Claude Opus 5 | Contexto |
|---|---|---|
| SWE-bench Verified | ~96.0% (media de 5 pruebas) | correcciones de software del mundo real |
| OSWorld 2.0 (uso del ordenador) | 70.57% | supera el mejor resultado de Fable 5 por ~1/3 del coste |
| ARC-AGI-3 | ~30.2% | ~3× el siguiente mejor modelo |
| Zapier AutomationBench | 26.0% | ~1.5× el siguiente mejor modelo |
| Frontier-Bench v0.1 | 43.3% con esfuerzo máximo (44.4% en xhigh) | sucesor de Terminal-Bench 2.1 con 74 tareas |
En el conjunto agregado de trabajo de conocimiento de Anthropic, Opus 5 obtuvo alrededor de 53.4, prácticamente empatado con Fable 5 en 53.5 y cómodamente por delante de Opus 4.8 con 46.5 y de GPT-5.6 con 47.5. La cifra de SWE-bench Verified cercana al 96% lo coloca a la cabeza del grupo en reparación automatizada de código. La advertencia honesta que el propio Anthropic señala: Opus 5 todavía queda por detrás de Mythos 5 en tareas específicas de ciberseguridad, así que no es un dominio total.
Los benchmarks son orientativos, no dogma. Lo que aquí señalan es coherente: los mayores saltos se dan en tareas donde el modelo tiene que actuar a lo largo de muchos pasos, usar herramientas y comprobar su propio trabajo, en lugar de responder a una sola pregunta.
Qué cambió realmente para quienes desarrollan
Más allá de las puntuaciones, destacan tres cambios prácticos.
Verifica su propio trabajo. Anthropic destaca que Opus 5 es notablemente mejor a la hora de comprobar los resultados e iterar hasta que una tarea realmente se supera, en lugar de detenerse en una respuesta de aspecto plausible. Para los bucles de agentes, eso reduce el número de turnos de supervisión que una persona tiene que dedicar a detectar fallos silenciosos.
Dos nuevas funciones de fiabilidad en beta. Opus 5 introduce reintentos automáticos (fallbacks) y la capacidad de cambiar de herramientas a mitad de conversación. Los fallbacks automáticos permiten que una solicitud de API se degrade con elegancia bajo carga en lugar de fallar por completo, y los cambios de herramientas a mitad de conversación permiten que un agente de larga duración intercambie su conjunto de herramientas sin reiniciar la sesión. Ambas apuntan al mismo punto de dolor: mantener vivas las ejecuciones agénticas prolongadas.
El control de costes ahora es un dial, no una suposición. Entre los cinco niveles de esfuerzo y el modo rápido, los equipos pueden ajustar el gasto por clase de tarea. Las llamadas baratas y de alto volumen se ejecutan con esfuerzo bajo; una refactorización enrevesada se ejecuta en max. Esa granularidad es la historia empresarial silenciosa, y es la razón por la que varios análisis del día del lanzamiento enmarcaron a Opus 5 tanto en torno a la factura como a los benchmarks.
Para cualquiera que ya viva en un flujo de trabajo agéntico, esto importa más que un número en una tabla de clasificación. En nuestra propia automatización headless de Claude Code, el coste por tarea y el comportamiento de autoverificación del modelo subyacente determinan cuánto puedes ejecutar de forma segura sin supervisión, que es exactamente lo que Opus 5 está afinado para mejorar.
Precios y disponibilidad
| Atributo | Detalle |
|---|---|
| Fecha de lanzamiento | 24 de julio de 2026 |
| ID del modelo en la API | claude-opus-5 |
| Precio de entrada | 5 dólares / millón de tokens |
| Precio de salida | 25 dólares / millón de tokens |
| Ventana de contexto | 1,000,000 tokens |
| Salida máxima | 128,000 tokens |
| Dónde | Claude.ai, Claude Code, Claude Cowork, Claude API |
| Planes | Predeterminado en Max, el más potente en Pro |
El punto económico clave es que el precio no subió frente a Opus 4.8 pese al salto de capacidades. El posicionamiento de Anthropic, «inteligencia de frontera a la mitad del precio» de Fable 5, es un movimiento deliberado para convertir el modelo de máxima gama en aquel al que recurres por defecto y no solo para problemas difíciles. Si eliges modelos por coste por tarea resuelta, mira cómo cambian las cuentas en nuestro análisis del mejor modelo de IA para codificar en 2026.
¿Deberías cambiar a Opus 5?
Si ejecutas agentes, escribes código o realizas trabajo de conocimiento en varios pasos, sí: vale la pena dedicarle una hora a probarlo. La combinación de una calidad cercana a la de Fable 5, precios de Opus sin cambios, una autoverificación más fuerte y el control de esfuerzo por tarea lo convierte en el nuevo valor predeterminado sensato para la mayoría de las cargas de trabajo de producción en la plataforma Claude. Las dos razones para esperar: pipelines con fuerte componente de seguridad donde Mythos 5 sigue liderando, y cualquier caso en el que ya hayas validado un modelo concreto frente a una evaluación concreta y cambiarlo introduzca riesgo de regresión.
Preguntas frecuentes
¿Qué tan bueno es Opus 5?
Según las cifras de Anthropic, es lo más avanzado en tareas de codificación agéntica y uso del ordenador, aproximadamente un 96% en SWE-bench Verified y un 70.57% en OSWorld 2.0, y empata con Fable 5 en el conjunto agregado de trabajo de conocimiento de Anthropic (53.4 frente a 53.5). Queda por detrás del especializado Mythos 5 en trabajo de ciberseguridad.
¿Está disponible Opus 5?
Sí. Se lanzó el 24 de julio de 2026 en Claude.ai, Claude Code, Claude Cowork y la Claude API bajo el ID de modelo claude-opus-5. Es el modelo predeterminado en Claude Max y la opción más potente en Claude Pro.
¿Es Opus 5 mejor que Fable 5?
No más capaz, aproximadamente equivalente, por alrededor de la mitad del coste. Anthropic posiciona a Opus 5 como un modelo que se acerca a la inteligencia de frontera de Fable 5 siendo mucho más barato por tarea, lo que para la mayoría de las cargas de trabajo lo convierte en la mejor opción práctica. Fable 5 sigue siendo el techo de la gama alta.
¿Qué tiene de especial Claude Opus?
Opus es el nivel de modelos más capaz de Anthropic, orientado a la codificación, los agentes y el razonamiento difícil. Opus 5 en concreto añade un control de esfuerzo de cinco niveles, un modo rápido a 2.5× de velocidad, una autoverificación más fuerte y un contexto de 1M de tokens, al mismo precio que la generación anterior de Opus.
Fuentes
- Anthropic — Presentamos Claude Opus 5 — anuncio oficial, precios, disponibilidad, control de esfuerzo
- Anthropic — Claude Opus 5 System Card (PDF) — documentación principal de seguridad y capacidades
- VentureBeat — Anthropic lanza Claude Opus 5 — ventana de contexto, límite de salida, comparativas de benchmarks
- MarkTechPost — Conoce el nuevo Claude Opus 5 — detalle de SWE-bench Verified y benchmarks agénticos
- Codersera — Los benchmarks de Claude Opus 5 explicados — Frontier-Bench v0.1, ARC-AGI-3, resultados por nivel de esfuerzo
Waqas Ahmed Waseer
Waqas Ahmed Waseer es desarrollador y creador de automatizaciones con más de 8 años construyendo sistemas en producción que usan más de 100.000 personas. Crea SaaS multiinquilino a medida, automatización con IA (n8n, flujos LLM, bots de WhatsApp) e infraestructura de hosting (WHM/cPanel, CloudLinux), y es el creador de WaSphere, FlowMaticX y la marca de hosting WaseerHost. Más de 100 proyectos entregados para pymes, agencias y startups financiadas.



