Claude Mythos vs GPT-5.5: Duelo entre laboratorios frontera

Claude MythosGPT-5.5
arenaElo14781432
humanEval98.794.2
sweBench93.966
mmlu94.293
gpqa94.668.7
aime97.692
Precio in/out ($/M)$25 / $125$12 / $48

Nuestro veredicto

Mythos supera a GPT-5.5 en todos los benchmarks compartidos: SWE-bench Verified (93,9% vs 65,1%), GPQA Diamond (94,6% vs 68,7%) y HumanEval (98,7% vs 94,2%). GPT-5.5 gana en disponibilidad: está disponible para todo el mundo con audio nativo, mientras Mythos está bloqueado tras Project Glasswing. Para productos cara al consumidor o de voz, GPT-5.5 es la única opción realista. Para seguridad defensiva e investigación matemática donde puedas asegurar acceso, Mythos juega en otra categoría.

Claude Mythos · GPT-5.5 · Todas las comparativas de IA