Grok 4 Heavy
Actualizado: 22 de abril de 2026
Especificaciones
| Proveedor | xAI |
|---|
| Lanzamiento | 9 de julio de 2025 |
|---|
| Contexto | 256K tokens |
|---|
| Entrada | $15 / M tokens |
|---|
| Salida | $60 / M tokens |
|---|
Benchmarks
| mmlu | 89.3 |
|---|
| gpqa | 74.5 |
|---|
| humanEval | 88.4 |
|---|
| arenaElo | 1391 |
|---|
| sweBench | 55 |
|---|
| sweBenchPro | 50 |
|---|
| liveCodeBench | 70 |
|---|
| aiderPolyglot | 66 |
|---|
| terminalBench | 40 |
|---|
| mmluPro | 85 |
|---|
| hle | 24 |
|---|
| aime | 92 |
|---|
| math500 | 96 |
|---|
| mmmu | 74 |
|---|
Puntos fuertes
- Modo razonamiento multi-agente: varias instancias Grok debaten
- Fuerte en Humanity's Last Exam y matemáticas de competición
- Grounding en tiempo real con X (Twitter)
Debilidades
- Caro por respuesta por el debate multi-agente
- Ecosistema de desarrollo menor que OpenAI/Anthropic
- No apto para UX en tiempo real
Ideal para
- Razonamiento difícil puntual con debate en paralelo
- Cargas de investigación apoyadas en datos de X
- Casos límite donde otros modelos rechazan
Comparar con otros modelos de IA