👁️ Multimodal · llm-stats.com

MMMU-Pro

Harder multimodal reasoning successor of MMMU.

17
测试模型数
GPT-5.5
最佳模型
83.2%
最高分
OpenAI
提供商
#模型名称MMMU-Pro提供商Podium 综合得分
1
GPT-5.5
OpenAI
83.2%
OpenAI54.0
2
83%
OpenAI80.8
3
82.3%
Alibaba79.8
4
Kimi K3
Moonshot AI
81.6%
Moonshot AI83.3
5
GPT-5.4
OpenAI
81.2%
OpenAI51.0
6
81.2%
Google42.4
7
81%
Google51.9
8
80.7%
OpenAI66.4
9
80.5%
Google60.6
10
80.4%
Meta47.0
11
Kimi K2.6
Moonshot AI
80.1%
Moonshot AI49.0
12
GPT-5.2
OpenAI
79.5%
OpenAI49.2
13
79%
Alibaba42.2
14
78.8%
Alibaba32.4
15
78.4%
OpenAI49.1
16
77.3%
Anthropic61.2
17
75.6%
Anthropic38.1
基准数据聚合自 llm-stats.com。详见方法论