🧠 Reasoning · llm-stats.com

ARC-AGI-2

Second-generation abstraction and reasoning tasks measuring fluid intelligence on novel visual patterns.

9
परीक्षित मॉडल
GPT-5.5
शीर्ष मॉडल
85%
सर्वोच्च स्कोर
OpenAI
प्रदाता
#मॉडलARC-AGI-2प्रदाताPodium Score
1
GPT-5.5
OpenAI
85%
OpenAI54.0
2
77.1%
Google60.6
3
GPT-5.4
OpenAI
73.3%
OpenAI51.0
4
68.8%
Anthropic61.2
5
58.3%
Anthropic38.1
6
GPT-5.2
OpenAI
52.9%
OpenAI49.2
7
42.5%
Meta47.0
8
33.6%
Google42.4
9
31.1%
Google51.9
बेंचमार्क डेटा llm-stats.com से संकलित। अधिक जानें कार्यप्रणाली में।