AI & ML

Claude Opus 5 ya está disponible: benchmarks, precios y novedades (2026)

Claude Opus 5 se lanzó el 24 de julio de 2026 con una inteligencia cercana a la de Fable 5 por la mitad de precio. Benchmarks, precios, niveles de esfuerzo y si conviene cambiar.

Waqas Ahmed Waseer
Waqas Ahmed Waseer 25 jul 2026 6 min de lectura
Claude Opus 5 ya está disponible: benchmarks, precios y novedades (2026)

Anthropic lanzó Claude Opus 5 el 24 de julio de 2026, y el titular es sencillo: se sitúa muy cerca de la inteligencia del modelo público más capaz de la compañía, Claude Fable 5, mientras cuesta la mitad por tarea y mantiene sin cambios el precio de Opus en 5 dólares por millón de tokens de entrada y 25 dólares por millón de tokens de salida. Llega como el nuevo modelo predeterminado en Claude Max, el modelo más potente en Claude Pro, y a través de la cadena de API claude-opus-5 en Claude Code, Claude Cowork y la Messages API.

Es un auténtico salto de buque insignia, no una actualización menor. En los benchmarks de codificación agéntica y uso del ordenador, Anthropic califica ahora a Opus 5 como su modelo de vanguardia, y los análisis independientes del día del lanzamiento coinciden con ese enfoque.

¿Qué es Claude Opus 5?

Claude Opus 5 es el modelo de frontera de Anthropic para codificación, agentes autónomos y trabajo de conocimiento complejo, lanzado el 24 de julio de 2026. Mantiene una ventana de contexto de 1 millón de tokens tanto como valor predeterminado como máximo, sin ninguna variante más pequeña, y admite hasta 128,000 tokens de salida síncrona en la Messages API. La propuesta es eficiencia en la gama alta: Anthropic afirma que Opus 5 alcanza una calidad cercana a la de Fable 5 por aproximadamente la mitad del precio de Fable 5, lo que transforma «usar el mejor modelo» de un lujo ocasional en un valor predeterminado para el día a día.

El otro cambio estructural es un control de esfuerzo de cinco niveles. En lugar de un único ajuste, decides cuánto se esfuerza el modelo, desde pasadas más ligeras hasta high, xhigh y max. Un mayor esfuerzo gasta más tokens de salida para obtener mejores resultados en problemas difíciles; un menor esfuerzo reduce la latencia y el coste en tareas rutinarias. Anthropic combina esto con un modo rápido que se ejecuta unas 2.5× más rápido que el predeterminado con aproximadamente el doble de coste, de modo que los equipos pueden cambiar dinero por velocidad cuando una tarea es sensible a la latencia.

Los benchmarks que importan

Anthropic y la cobertura del día del lanzamiento enmarcan las ventajas de Opus 5 como agénticas más que como conocimiento trivial en bruto. Las señales más claras:

BenchmarkClaude Opus 5Contexto
SWE-bench Verified~96.0% (media de 5 pruebas)correcciones de software del mundo real
OSWorld 2.0 (uso del ordenador)70.57%supera el mejor resultado de Fable 5 por ~1/3 del coste
ARC-AGI-3~30.2%~3× el siguiente mejor modelo
Zapier AutomationBench26.0%~1.5× el siguiente mejor modelo
Frontier-Bench v0.143.3% con esfuerzo máximo (44.4% en xhigh)sucesor de Terminal-Bench 2.1 con 74 tareas

En el conjunto agregado de trabajo de conocimiento de Anthropic, Opus 5 obtuvo alrededor de 53.4, prácticamente empatado con Fable 5 en 53.5 y cómodamente por delante de Opus 4.8 con 46.5 y de GPT-5.6 con 47.5. La cifra de SWE-bench Verified cercana al 96% lo coloca a la cabeza del grupo en reparación automatizada de código. La advertencia honesta que el propio Anthropic señala: Opus 5 todavía queda por detrás de Mythos 5 en tareas específicas de ciberseguridad, así que no es un dominio total.

Los benchmarks son orientativos, no dogma. Lo que aquí señalan es coherente: los mayores saltos se dan en tareas donde el modelo tiene que actuar a lo largo de muchos pasos, usar herramientas y comprobar su propio trabajo, en lugar de responder a una sola pregunta.

Qué cambió realmente para quienes desarrollan

Más allá de las puntuaciones, destacan tres cambios prácticos.

Verifica su propio trabajo. Anthropic destaca que Opus 5 es notablemente mejor a la hora de comprobar los resultados e iterar hasta que una tarea realmente se supera, en lugar de detenerse en una respuesta de aspecto plausible. Para los bucles de agentes, eso reduce el número de turnos de supervisión que una persona tiene que dedicar a detectar fallos silenciosos.

Dos nuevas funciones de fiabilidad en beta. Opus 5 introduce reintentos automáticos (fallbacks) y la capacidad de cambiar de herramientas a mitad de conversación. Los fallbacks automáticos permiten que una solicitud de API se degrade con elegancia bajo carga en lugar de fallar por completo, y los cambios de herramientas a mitad de conversación permiten que un agente de larga duración intercambie su conjunto de herramientas sin reiniciar la sesión. Ambas apuntan al mismo punto de dolor: mantener vivas las ejecuciones agénticas prolongadas.

El control de costes ahora es un dial, no una suposición. Entre los cinco niveles de esfuerzo y el modo rápido, los equipos pueden ajustar el gasto por clase de tarea. Las llamadas baratas y de alto volumen se ejecutan con esfuerzo bajo; una refactorización enrevesada se ejecuta en max. Esa granularidad es la historia empresarial silenciosa, y es la razón por la que varios análisis del día del lanzamiento enmarcaron a Opus 5 tanto en torno a la factura como a los benchmarks.

Para cualquiera que ya viva en un flujo de trabajo agéntico, esto importa más que un número en una tabla de clasificación. En nuestra propia automatización headless de Claude Code, el coste por tarea y el comportamiento de autoverificación del modelo subyacente determinan cuánto puedes ejecutar de forma segura sin supervisión, que es exactamente lo que Opus 5 está afinado para mejorar.

Precios y disponibilidad

AtributoDetalle
Fecha de lanzamiento24 de julio de 2026
ID del modelo en la APIclaude-opus-5
Precio de entrada5 dólares / millón de tokens
Precio de salida25 dólares / millón de tokens
Ventana de contexto1,000,000 tokens
Salida máxima128,000 tokens
DóndeClaude.ai, Claude Code, Claude Cowork, Claude API
PlanesPredeterminado en Max, el más potente en Pro

El punto económico clave es que el precio no subió frente a Opus 4.8 pese al salto de capacidades. El posicionamiento de Anthropic, «inteligencia de frontera a la mitad del precio» de Fable 5, es un movimiento deliberado para convertir el modelo de máxima gama en aquel al que recurres por defecto y no solo para problemas difíciles. Si eliges modelos por coste por tarea resuelta, mira cómo cambian las cuentas en nuestro análisis del mejor modelo de IA para codificar en 2026.

¿Deberías cambiar a Opus 5?

Si ejecutas agentes, escribes código o realizas trabajo de conocimiento en varios pasos, sí: vale la pena dedicarle una hora a probarlo. La combinación de una calidad cercana a la de Fable 5, precios de Opus sin cambios, una autoverificación más fuerte y el control de esfuerzo por tarea lo convierte en el nuevo valor predeterminado sensato para la mayoría de las cargas de trabajo de producción en la plataforma Claude. Las dos razones para esperar: pipelines con fuerte componente de seguridad donde Mythos 5 sigue liderando, y cualquier caso en el que ya hayas validado un modelo concreto frente a una evaluación concreta y cambiarlo introduzca riesgo de regresión.

Preguntas frecuentes

¿Qué tan bueno es Opus 5?

Según las cifras de Anthropic, es lo más avanzado en tareas de codificación agéntica y uso del ordenador, aproximadamente un 96% en SWE-bench Verified y un 70.57% en OSWorld 2.0, y empata con Fable 5 en el conjunto agregado de trabajo de conocimiento de Anthropic (53.4 frente a 53.5). Queda por detrás del especializado Mythos 5 en trabajo de ciberseguridad.

¿Está disponible Opus 5?

Sí. Se lanzó el 24 de julio de 2026 en Claude.ai, Claude Code, Claude Cowork y la Claude API bajo el ID de modelo claude-opus-5. Es el modelo predeterminado en Claude Max y la opción más potente en Claude Pro.

¿Es Opus 5 mejor que Fable 5?

No más capaz, aproximadamente equivalente, por alrededor de la mitad del coste. Anthropic posiciona a Opus 5 como un modelo que se acerca a la inteligencia de frontera de Fable 5 siendo mucho más barato por tarea, lo que para la mayoría de las cargas de trabajo lo convierte en la mejor opción práctica. Fable 5 sigue siendo el techo de la gama alta.

¿Qué tiene de especial Claude Opus?

Opus es el nivel de modelos más capaz de Anthropic, orientado a la codificación, los agentes y el razonamiento difícil. Opus 5 en concreto añade un control de esfuerzo de cinco niveles, un modo rápido a 2.5× de velocidad, una autoverificación más fuerte y un contexto de 1M de tokens, al mismo precio que la generación anterior de Opus.

Fuentes

Waqas Ahmed Waseer

Waqas Ahmed Waseer

Waqas Ahmed Waseer es desarrollador y creador de automatizaciones con más de 8 años construyendo sistemas en producción que usan más de 100.000 personas. Crea SaaS multiinquilino a medida, automatización con IA (n8n, flujos LLM, bots de WhatsApp) e infraestructura de hosting (WHM/cPanel, CloudLinux), y es el creador de WaSphere, FlowMaticX y la marca de hosting WaseerHost. Más de 100 proyectos entregados para pymes, agencias y startups financiadas.

Relacionado

Más en AI & ML

Ver todo

Debate · 0

Sé amable. Los comentarios son públicos.

    Newsletter · Edición del lunes

    El resumen del lunes.

    Un correo cada lunes por la mañana. La semana que viene en IA, startups, hosting y herramientas dev: sin relleno, sin anzuelos patrocinados.

    Gratis. Cancela tu suscripción con un clic.