| Claude Opus 5 | Claude Fable 5 | |
|---|---|---|
| arenaElo | 1492 | |
| humanEval | 98 | |
| sweBench | 97 | 77 |
| mmlu | 95.1 | |
| gpqa | 92 | |
| aime | 94 | |
| Precio in/out ($/M) | $5 / $25 | $10 / $50 |
Opus 5 toma el liderato general: 43,3% en Frontier-Bench v0.1 frente al 33,7% de Fable 5, Elo de 1861 frente a 1747 en GDPval-AA v2, 70,6% frente a 66,1% en OSWorld 2.0 y un Índice de Inteligencia de Artificial Analysis de 61 a esfuerzo max, el más alto del mundo. Y lo hace a 5$ / 25$ por M tokens, la mitad de los 10$ / 50$ de Fable 5. Fable 5 conserva una ventaja estrecha en DeepSWE v1.1 (69,7% frente a 68,8%), pero para coding, trabajo de conocimiento agéntico y computer use, Opus 5 es el nuevo default. Benchmark-ea ambos con tu carga real antes de decidir.
Claude Opus 5 · Claude Fable 5 · Todas las comparativas de IA