👁️ Multimodal · llm-stats.com

ScreenSpot-Pro

GUI grounding on high-resolution professional application screens.

8
โมเดลที่ทดสอบ
Claude Opus 4.8
โมเดลเด่น
87.9%
คะแนนสูงสุด
Anthropic
ผู้ให้บริการ
#โมเดลScreenSpot-Proผู้ให้บริการPodium Score
1
87.9%
Anthropic76.0
2
GPT-5.2
OpenAI
86.3%
OpenAI49.2
3
84.5%
Alibaba79.8
4
84.1%
Meta47.0
5
79%
Alibaba42.2
6
72.7%
Google51.9
7
69.1%
Google42.4
8
68.2%
Alibaba32.4
ข้อมูลเบนช์มาร์กรวบรวมจาก llm-stats.com ดู ระเบียบวิธี