👁️ Multimodal · llm-stats.com

MMMU

Massive Multi-discipline Multimodal Understanding with college-level image reasoning.

5
Modelos testados
Qwen3.6 Plus
Modelo principal
86%
Melhor pontuação
Alibaba
Provedor
#ModeloMMMUProvedorPodium Score
1
86%
Alibaba32.4
2
GPT-5.1
OpenAI
85.4%
OpenAI42.3
3
GPT-5
OpenAI
84.2%
OpenAI23.0
4
83.9%
Alibaba22.0
5
o3
OpenAI
82.9%
OpenAI32.0
Dados de benchmark agregados de llm-stats.com. Saiba mais na metodologia.