Clasificación LLM

La clasificación
definitiva de LLM

Compare 25+ modelos de lenguaje en 10 benchmarks. Clasificaciones, precios, velocidad y razonamiento — todo en un solo lugar.

GPT-4oGPT-4o Minio3o4-miniClaude 3.5 SonnetClaude 3.5 HaikuClaude Opus 4Claude Sonnet 4Gemini 2.5 ProGemini 2.5 FlashGemini 2.0 FlashLlama 3.1 405BLlama 3.1 70BLlama 3.3 70BLlama 4 MaverickMistral LargeMixtral 8x22BDeepSeek V3DeepSeek R1Qwen 2.5 72BQwen 3 235BCommand R+Grok 2Grok 3Phi-4GPT-4oGPT-4o Minio3o4-miniClaude 3.5 SonnetClaude 3.5 HaikuClaude Opus 4Claude Sonnet 4Gemini 2.5 ProGemini 2.5 FlashGemini 2.0 FlashLlama 3.1 405BLlama 3.1 70BLlama 3.3 70BLlama 4 MaverickMistral LargeMixtral 8x22BDeepSeek V3DeepSeek R1Qwen 2.5 72BQwen 3 235BCommand R+Grok 2Grok 3Phi-4
25+
Modelos rastreados
10
Benchmarks
25+
Proveedores
Semanal
Actualización de datos

Mejores modelos

Ver todos →
#ModeloPuntuación globalELOMMLUSWE-BenchVelocidad
1
Claude Opus 4
Anthropic
97.8138592.1%72.5%45 t/s
297.5139892%63.8%85 t/s
3
o3
OpenAI
97.1138091.2%71.7%58 t/s
4
DeepSeek R1
DeepSeek
92.3135890.8%49.2%32 t/s
5
o4-mini
OpenAI
91.5134588.3%68.1%145 t/s
690.3134090.4%62.3%79 t/s
7
GPT-4o
OpenAI
89.2128788.7%38.4%110 t/s
888.8133089.2%55.2%55 t/s
988.4127288.7%49%82 t/s
1087.5132589.5%47.5%120 t/s
Categorías

Explorar por tarea

FAQ

Preguntas frecuentes

Todas las FAQ
Todas las FAQ