Claude Mythos vs DeepSeek V4: Frontera cerrada vs frontera open-weights

Claude MythosDeepSeek V4
arenaElo14781395
humanEval98.791
sweBench93.962
mmlu94.291.5
gpqa94.673
aime97.690
Precio in/out ($/M)$25 / $125$1.74 / $3.48

Nuestro veredicto

DeepSeek V4 es el buque insignia open-weights de 2026: licencia MIT, 1M de contexto, ~14× más barato en entrada que Mythos y autoalojable. Mythos mantiene la ventaja de capacidad por 20+ puntos en GPQA y SWE-bench, además de capacidades de ciberseguridad inigualadas. Elige V4 para cualquier equipo que necesite desplegar razonamiento frontera en su propio hardware o bajo requisitos de residencia de datos. Elige Mythos solo si tienes acceso y tu caso justifica un coste 14× mayor por token.

Claude Mythos · DeepSeek V4 · Todas las comparativas de IA