Claude Fable 5 vs OpenAI o4: Agente frontera vs especialista en razonamiento

Claude Fable 5OpenAI o4
arenaElo14921438
humanEval9894
sweBench7772
mmlu95.192.5
gpqa9287.1
aime9494
Precio in/out ($/M)$10 / $50$12 / $48

Nuestro veredicto

o4 es un razonador profundo de respuesta única que piensa de segundos a minutos por respuesta. Fable 5 está construido para trabajo autónomo de largo recorrido (ejecuciones agénticas de horas, entregables de principio a fin y builds que se autoverifican) con razonamiento siempre activo que ajustas vía effort. Para razonamiento difícil puntual, o4 aún compite; para agentes que deben planificar, actuar y entregar a lo largo de una sesión larga, Fable 5 juega en otra categoría.

Claude Fable 5 · OpenAI o4 · Todas las comparativas de IA