| Claude Opus 4.8 | Claude Opus 4.7 | |
|---|---|---|
| arenaElo | 1435 | 1420 |
| humanEval | 94.5 | 93.1 |
| sweBench | 67 | 64.3 |
| mmlu | 93 | 92.3 |
| gpqa | 67.5 | 65.2 |
| aime | 90 | 88 |
| Precio in/out ($/M) | $5 / $25 | $5 / $25 |
Opus 4.8 es una mejora limpia al mismo precio de lista, el coding agéntico sube del 64,3% al 69,2% en SWE-Bench Pro, lidera computer use con 84% en Online-Mind2Web, ejecuta de forma autónoma durante más tiempo y reporta su progreso con más honestidad. El fast mode es ahora 3× más barato y el prompt cacheable mínimo baja a 1.024 tokens. No hay razón para empezar un proyecto nuevo en 4.7, ve directo a 4.8.
Claude Opus 4.8 · Claude Opus 4.7 · Todas las comparativas de IA