Claude Opus 4.8
Actualizado: 10 de agosto de 2026
Especificaciones
| Proveedor | Anthropic |
|---|
| Lanzamiento | 28 de mayo de 2026 |
|---|
| Contexto | 1M tokens |
|---|
| Entrada | $5 / M tokens |
|---|
| Salida | $25 / M tokens |
|---|
Benchmarks
| mmlu | 93 |
|---|
| gpqa | 67.5 |
|---|
| humanEval | 94.5 |
|---|
| arenaElo | 1435 |
|---|
| sweBench | 67 |
|---|
| sweBenchPro | 69.2 |
|---|
| liveCodeBench | 78 |
|---|
| aiderPolyglot | 82 |
|---|
| terminalBench | 50 |
|---|
| mmluPro | 87 |
|---|
| hle | 24 |
|---|
| aime | 90 |
|---|
| math500 | 97 |
|---|
| mmmu | 80 |
|---|
Puntos fuertes
- Lidera el coding agéntico: 69,2% SWE-Bench Pro, por delante de Opus 4.7 (64,3%), GPT-5.5 y Gemini 3.1 Pro
- El computer-use / browser-agent más potente probado: 84% en Online-Mind2Web
- Ejecuciones autónomas más largas y auto-reporte más honesto; contexto de 1M tokens con 128K de salida
Debilidades
- Precio de gama frontier. Excesivo para tráfico de alto volumen y sensible a la latencia
- Más lento que Haiku/Sonnet en tareas simples salvo que se use el fast mode
Ideal para
- Agentes de ingeniería autónomos
- Automatización de browser y computer-use
- Investigación larga y análisis documental
Comparaciones 1 vs 1
Comparar con otros modelos de IA