👁️ Multimodal · llm-stats.com
MMMU
Massive Multi-discipline Multimodal Understanding with college-level image reasoning.
5
Modelos testados
Qwen3.6 Plus
Modelo principal
86%
Melhor pontuação
Alibaba
Provedor
| # | Modelo | MMMU |
|---|---|---|
| 1 | Qwen3.6 Plus Alibaba | 86% |
| 2 | GPT-5.1 OpenAI | 85.4% |
| 3 | GPT-5 OpenAI | 84.2% |
| 4 | Qwen3.5 122B-A10B Alibaba | 83.9% |
| 5 | o3 OpenAI | 82.9% |
Dados de benchmark agregados de llm-stats.com. Saiba mais na metodologia.