| GPT-5 Codex | Codestral | |
|---|---|---|
| arenaElo | 1395 | 1254 |
| humanEval | 94.8 | 89.7 |
| sweBench | 68 | 35 |
| mmlu | 87.2 | 73.2 |
| gpqa | 58.4 | 41 |
| aime | 85 | 30 |
| Precio in/out ($/M) | $8 / $32 | $0.3 / $0.9 |
Codestral es 25× más barato y aún roza el 89% en HumanEval, notable para autocompletado inline y refactors. GPT-5 Codex gana en coding agéntico, edits multi-archivo y razonamiento sobre código ajeno. Mézclalos: Codestral para sugerencias, Codex para agentes.