🔢 أفضل نماذج الذكاء الاصطناعي للرياضيات
ترتيب النماذج حسب الاستدلال الرياضي. حُدِّث في أغسطس 2026. بناءً على بيانات اختبارات مستقلة.
| # | النموذج | المزوّد | الدرجة | السرعة | السعر (إخراج) |
|---|---|---|---|---|---|
| 1 | Claude Mythos Preview | Anthropic | 100.0 | 80 t/s | $15/M |
| 2 | MiMo V2.5 Pro | Xiaomi | 100.0 | 65 t/s | $0.87/M |
| 3 | Grok 4 Heavy | xAI | 84.6 | 50 t/s | $15/M |
| 4 | Claude Opus 5 | Anthropic | 82.3 | 60 t/s | $25/M |
| 5 | Qwen3.7 Max | Alibaba | 81.6 | 203 t/s | $7.5/M |
| 6 | Claude Fable 5 | Anthropic | 81.0 | 71 t/s | $50/M |
| 7 | Claude Opus 4.6 | Anthropic | 79.6 | 50 t/s | $15/M |
| 8 | Gemini 3.1 Pro | 76.0 | 136 t/s | $12/M | |
| 9 | Gemini 3 Pro | 72.9 | 120 t/s | $5/M | |
| 10 | Claude Mythos 5 | Anthropic | 71.0 | 50 t/s | $50/M |
| 11 | Kimi K3 | Moonshot AI | 70.9 | 37 t/s | $15/M |
| 12 | GPT-5.6 Sol | OpenAI | 70.7 | 72 t/s | $30/M |
| 13 | GLM-5.2 | Z.ai | 69.8 | 164 t/s | $4.29/M |
| 14 | Gemini 3 Flash | 69.6 | 120 t/s | $5/M | |
| 15 | Gemini 3.5 Flash | 66.5 | 267 t/s | $9/M | |
| 16 | DeepSeek V4 Pro | DeepSeek | 66.5 | 66 t/s | $0.87/M |
| 17 | Gemini 3.6 Flash | 65.7 | 233 t/s | $7.5/M | |
| 18 | MiniMax M3 | MiniMax | 64.8 | 93 t/s | $1.2/M |
| 19 | GPT-5.3 Codex | OpenAI | 62.9 | 118 t/s | $14/M |
| 20 | Muse Spark 1.1 | Meta | 62.7 | 208 t/s | $4.25/M |
Top 5 \u2014 مقارنة سريعة
المنهجية
ترتيبات مبنية على تقييمات اختبارات مستقلة. تُحسب الدرجة من عدة اختبارات موحدة وتُسوَّى إلى 0–100.