Grok 4.20 Beta 0309 ReasoningvsKimi K2.5 Thinking

Grok 4.20 Beta 0309 Reasoning memimpin Podium Score keseluruhan dengan 1.0 poin (74.0 vs 73.0). Kemenangan kategori: Grok 4.20 Beta 0309 Reasoning 0 — 0 Kimi K2.5 Thinking. Kimi K2.5 Thinking adalah pilihan lebih murah ($3/M vs $15/M per 1M token output). Grok 4.20 Beta 0309 Reasoning lebih cepat (50 t/s vs 50 t/s).

MetrikGrok 4.20 Beta 0309 ReasoningKimi K2.5 Thinking
Podium Score74.0 ▲73.0
Arena Elo
Intelligence Index
Coding
Matematika
Penalaran
Agen
Pengetahuan
Multimodal
Konteks panjang
Kecepatan output50 t/s50 t/s
Harga output$15/M$3/M ▲
Jendela konteks128K128K