| GPT-5.5 | Claude Opus 4.7 | |
|---|---|---|
| arenaElo | 1432 | 1420 |
| humanEval | 94.2 | 93.1 |
| sweBench | 66 | 64.3 |
| mmlu | 93 | 92.3 |
| gpqa | 68.7 | 65.2 |
| aime | 92 | 88 |
| Precio in/out ($/M) | $12 / $48 | $15 / $75 |
GPT-5.5 supera a Opus 4.7 en Arena Elo y HumanEval por un pelo, mientras Opus 4.7 mantiene la corona de 1M de contexto y la estabilidad de agentes de largo recorrido. Para voz + multimodal, GPT-5.5. Para agentes de coding y trabajo legal de documentos largos, Opus 4.7.