| DeepSeek V4 | Claude Opus 4.6 | |
|---|---|---|
| arenaElo | 1395 | 1402 |
| humanEval | 91 | 91.4 |
| sweBench | 62 | 53.4 |
| mmlu | 91.5 | 90.8 |
| gpqa | 73 | 62.1 |
| aime | 90 | 84 |
| Precio in/out ($/M) | $1.74 / $3.48 | $15 / $75 |
DeepSeek V4 (abril 2026) básicamente cierra el caso de Opus 4.6 como opción frontera económica: V4 iguala o supera a Opus 4.6 en MMLU y GPQA, duplica el contexto (1M vs 500K) y se despliega a ~12% del coste API de Opus 4.6 ($1.74/$3.48 vs $15/$75 por M tokens). Opus 4.6 sigue ganando en Chatbot Arena, fiabilidad de herramientas agente y el ajuste de seguridad de Anthropic. Si puedes autoalojar o aceptas nube de proveedor chino, V4 es el reemplazo racional; para pipelines empresariales regulados ya en Anthropic, conserva Opus 4.6 (o salta directo a 4.7).
DeepSeek V4 · Claude Opus 4.6 · Todas las comparativas de IA