📜 Long Context · llm-stats.com

MRCR v2

Multi-round coreference resolution over needle-in-haystack long contexts.

8
جانچے گئے ماڈلز
GPT-5.6 Sol
سرکردہ ماڈل
91.5%
بہترین اسکور
OpenAI
فراہم کنندہ
#ماڈلMRCR v2فراہم کنندہPodium Score
1
91.5%
OpenAI80.8
2
89.6%
OpenAI66.4
3
76%
Anthropic61.2
4
GPT-5.5
OpenAI
74%
OpenAI54.0
5
41.3%
OpenAI49.1
6
26.3%
Google60.6
7
26.3%
Google51.9
8
22.1%
Google42.4
بینچ مارک ڈیٹا llm-stats.com سے مرتب۔ مزید جانیں طریقہ کار میں۔