| DeepSeek R1 | Claude Opus 4.7 | |
|---|---|---|
| arenaElo | 1389 | 1420 |
| humanEval | 90.2 | 93.1 |
| sweBench | 49.2 | 64.3 |
| mmlu | 90.8 | 92.3 |
| gpqa | 71.5 | 65.2 |
| aime | 79.8 | 88 |
| Precio in/out ($/M) | $0.7 / $2.5 | $5 / $25 |
DeepSeek R1 supera a Opus 4.7 en GPQA Diamond (71.5 vs 65.2) a una fracción del precio y con open-weight. Opus 4.7 sigue ganando en coding de contexto largo, uso de herramientas y pulido. DeepSeek es la apuesta valor para razonamiento puro.
DeepSeek R1 · Claude Opus 4.7 · Todas las comparativas de IA