| Claude Mythos | Claude Opus 4.8 | |
|---|---|---|
| arenaElo | 1478 | 1435 |
| humanEval | 98.7 | 94.5 |
| sweBench | 93.9 | 67 |
| mmlu | 94.2 | 93 |
| gpqa | 94.6 | 67.5 |
| aime | 97.6 | 90 |
| Precio in/out ($/M) | $25 / $125 | $5 / $25 |
Mythos marca benchmarks brutos más altos pero sigue siendo un preview cerrado a 5× el precio. Opus 4.8 es la frontera práctica sobre la que sí puedes construir, disponible de forma general en API de Anthropic, Bedrock y Vertex AI a 5$ / 25$ por M tokens, liderando coding agéntico y computer use. Elige Mythos solo si Anthropic ha autorizado tu caso; si no, Opus 4.8 es el default para producción.
Claude Mythos · Claude Opus 4.8 · Todas las comparativas de IA