Claude Opus 5: benchmarks, precios, niveles de esfuerzo y qué significa para tu empresa

El 24 de julio de 2026, Anthropic lanzó Claude Opus 5, la nueva generación de su familia Opus. Llegó desde el primer día a la API de Claude, Amazon Bedrock, Google Cloud Vertex AI, Microsoft Foundry, claude.ai, Claude Code y Claude Cowork, como modelo por defecto en Claude Max y el modelo más potente incluido en Claude Pro. El titular es tan económico como técnico: inteligencia casi frontier a la mitad de precio que Claude Fable 5. Opus 5 debuta como número uno en el Artificial Analysis Intelligence Index y en SWE-bench Verified, manteniendo el mismo precio de lista de 5 $/25 $ por millón de tokens que Opus 4.8. En esta guía desglosamos los benchmarks, el precio, el nuevo selector de esfuerzo de cinco niveles, dónde encaja Opus 5 en la gama de Anthropic, qué cambia para los desarrolladores y qué significa para las empresas que construyen con IA.

Qué Hay de Nuevo en Claude Opus 5

Claude Opus 5 (model ID claude-opus-5) es un modelo de texto y visión con knowledge cutoff de mayo de 2026, el más reciente de la gama de Anthropic. Lo esencial de un vistazo:

Benchmarks: Cómo se Posiciona Opus 5

Los números oficiales de Anthropic muestran un gran salto sobre Opus 4.8 y ventaja sobre Claude Fable 5 y GPT-5.6 Sol en la mayoría de frentes:

Las evaluaciones de terceros lo respaldan. En el leaderboard SWE-bench Verified de Vals AI (22 de julio), Opus 5 obtiene un 97,0% y se hace con el número uno. Artificial Analysis mide un Intelligence Index de 61 a esfuerzo max, el más alto del mundo, por delante de Claude Fable 5, con un rendimiento de 56,3 tokens por segundo y 64,5 segundos hasta el primer token a esfuerzo max.

Una salvedad sobre la foto completa: LMArena aún no tiene ranking de Opus 5, porque el modelo solo lleva un día publicado. Es de esperar que ese hueco se rellene en las próximas semanas.

Precio, Contexto y Fast Mode

Anthropic mantuvo el precio: Opus 5 cuesta exactamente lo mismo que Opus 4.8 y la mitad que Claude Fable 5 (10 $/50 $).

El Selector de Esfuerzo: Cinco Niveles de Capacidad

La mayor novedad a nivel de API es el nuevo selector de esfuerzo con cinco niveles: low, medium, high, xhigh y max, con high como valor por defecto. Más esfuerzo significa más thinking, más latencia y más capacidad: Artificial Analysis mide un Intelligence Index de 56 a esfuerzo medium, 59 a high y 61 a max.

Hay una restricción que conviene conocer: desactivar el thinking solo es compatible con esfuerzo high o inferior, y combinar thinking desactivado con xhigh o max devuelve un error 400. Recuerda además que el adaptive thinking viene ahora activado por defecto, un breaking change respecto a Opus 4.8.

Para sistemas en producción el selector de esfuerzo es una palanca de coste: ejecuta el grueso de peticiones rutinarias a esfuerzo low o medium, y reserva max para las decisiones que justifican la latencia y el gasto extra.

Dónde Encaja Opus 5 en la Gama de Anthropic

Opus 5 cierra la mayor parte de la distancia con la inteligencia frontier de Claude Fable 5 a mitad de precio. Fable 5 sigue por delante en DeepSWE (69,7% vs 68,8%) y sigue siendo el modelo de referencia para agentes de muy largo recorrido.

En lo más alto de la gama, Claude Mythos 5, disponible solo a través de Project Glasswing, sigue muy por delante en ciberseguridad ofensiva y biología autónoma. Para todo lo demás, Opus 5 es ahora la opción de mejor relación calidad-precio del nivel frontier.

Opus 5 registra además la puntuación de comportamiento desalineado más baja de cualquier modelo Claude hasta la fecha (2,3), un dato relevante para equipos que despliegan agentes en entornos regulados.

Qué Cambia para los Desarrolladores

Si ejecutas Opus 4.8 u otros modelos Opus anteriores en producción, esto es lo que debes planificar:

Qué Significa para las Empresas que Construyen con IA

El cambio práctico es económico. Los agentes de coding y la automatización de knowledge work que necesitaban calidad Fable 5 ahora funcionan a precios Opus: razonamiento casi frontier a 5 $/25 $ por millón de tokens cambia qué automatizaciones merece la pena construir.

El selector de esfuerzo añade una segunda palanca. En lugar de pagar precios máximos por cada petición, ajustas la capacidad por llamada: los pasos rutinarios se ejecutan a esfuerzo low o medium, y solo las decisiones realmente difíciles escalan a max, todo con el mismo modelo y la misma integración.

Como siempre, los benchmarks publicados son un punto de partida, no una decisión. Los números que importan son los de tus propias cargas de trabajo, medidos antes de comprometer una arquitectura con un modelo.

Cómo Ponemos a Trabajar Modelos como Opus 5 en Alher Tech

No construimos demos: llevamos agentes de IA y automatizaciones a producción. Un lanzamiento como Claude Opus 5 mueve la frontera coste-calidad, y lo integramos en arquitecturas diseñadas en torno a las restricciones de privacidad, coste y fiabilidad de cada cliente.

Si estás sopesando Opus 5 frente a Fable 5, GPT-5.6 o un modelo abierto, podemos compararlos sobre tus casos de uso reales y construir la arquitectura de enrutamiento y fallback alrededor del ganador.

Conclusión

Claude Opus 5 aterriza como el nuevo número uno en el Artificial Analysis Intelligence Index y en SWE-bench Verified, al mismo precio que Opus 4.8 y a la mitad que Claude Fable 5, con un selector de esfuerzo de cinco niveles que convierte la capacidad en un dial en lugar de una elección de modelo.

Fable 5 conserva la ventaja en DeepSWE y en ejecuciones de agentes ultralargas, y Mythos 5 sigue siendo el especialista de Project Glasswing, pero para la mayoría de agentes de coding y knowledge work, Opus 5 es ahora el candidato por defecto a evaluar primero.

Si estás planificando un agente de IA o una automatización y quieres saber qué cambia Opus 5 para tu hoja de ruta, podemos ayudarte a evaluarlo y a construir la arquitectura de producción a su alrededor.

Artículos relacionados