📐 Math · llm-stats.com

FrontierMath

Research-grade mathematics problems crafted by professional mathematicians.

6
测试模型数
GPT-5.6 Sol
最佳模型
89%
最高分
OpenAI
提供商
#模型名称FrontierMath提供商Podium 综合得分
1
89%
OpenAI80.8
2
84.9%
OpenAI66.4
3
78.6%
OpenAI49.1
4
GPT-5.4
OpenAI
47.6%
OpenAI51.0
5
GPT-5.2
OpenAI
40.3%
OpenAI49.2
6
GPT-5.5
OpenAI
35.4%
OpenAI54.0
基准数据聚合自 llm-stats.com。详见方法论