GPT-5.4 Codex
Actualizado: 22 de abril de 2026
Especificaciones
| Proveedor | OpenAI |
|---|
| Lanzamiento | 20 de febrero de 2026 |
|---|
| Contexto | 500K tokens |
|---|
| Entrada | $9 / M tokens |
|---|
| Salida | $36 / M tokens |
|---|
Benchmarks
| mmlu | 88.6 |
|---|
| gpqa | 60.8 |
|---|
| humanEval | 95.5 |
|---|
| arenaElo | 1408 |
|---|
| sweBench | 70 |
|---|
| sweBenchPro | 64 |
|---|
| liveCodeBench | 84 |
|---|
| aiderPolyglot | 84 |
|---|
| terminalBench | 52 |
|---|
| mmluPro | 82 |
|---|
| hle | 18 |
|---|
| aime | 86 |
|---|
| math500 | 95 |
|---|
Puntos fuertes
- Mejor HumanEval actual de cualquier modelo OpenAI
- Gestiona sesiones de coding de horas sin desviarse
- Fine-tuned para tool-calling vía Codex CLI
Debilidades
- No está orientado a chat general (usa GPT-5.5)
- Sigue por detrás de Opus 4.7 en fiabilidad de agente
- Precio por encima de GPT-5 Codex con mejoras de calidad moderadas
Ideal para
- Factorías automatizadas de PRs
- Runs largos de refactor donde importa la deriva
- Despliegues Codex empresariales en tier 5
Comparar con otros modelos de IA