Skip to main content
LLMPodium
Classement
🏆 Overall LeaderboardComposite index across all flagship LLMs💻 Coding & SWE-BenchReal-world programming & software agent benchmark🧠 Deep ReasoningGPQA Diamond, AIME & complex logic🤖 Autonomous AgentsOSWorld, Toolathlon & multi-turn execution🔓 Open WeightsDeepSeek, Qwen, Llama & Mistral
Arène
⚔️ Human Arena BattlesBlind pairwise Elo rankings (700+ models)⚖️ Side-by-Side CompareHead-to-head metric comparison of up to 4 models💰 Cost-per-Task CalculatorEstimate API economics across real workflows🎯 Model RecommenderFind the optimal model for your budget and speed
Modèles
📦 Model DirectoryDetailed profiles, context windows & pricing🏢 AI Labs & ProvidersOpenAI, Anthropic, Google, DeepSeek, Meta📊 Benchmark MatrixEvaluation methodologies and leader tables
nav.resources
📐 Podium MethodologyMathematical aggregation formula explained📰 Changelog & NewsDaily model updates and new evaluations✍️ Research & ArticlesIn-depth AI benchmarking whitepapers❓ Frequently Asked QuestionsCommon questions on scores and ranking📖 LLM GlossaryDefinitions of TTFT, TPS, Elo, MoE & tokens
🇺🇸 EnglishEN🇨🇳 中文ZH🇮🇳 हिन्दीHI🇪🇸 EspañolES🇫🇷 FrançaisFR🇸🇦 العربيةAR🇧🇩 বাংলাBN🇧🇷 PortuguêsPT🇷🇺 РусскийRU🇵🇰 اردوUR🇮🇩 Bahasa IndonesiaID🇩🇪 DeutschDE🇯🇵 日本語JA🇰🇷 한국어KO🇹🇭 ไทยTH🇮🇹 ItalianoIT
Classement
🏆 Classement
Overall Composite LeaderboardCoding & Software AgentsDeep Reasoning & MathAutonomous Agent SwarmsOpen Weights & Self-Hosted
⚔️ Arène & Compare
Human Battle Arena (700+ Models)Side-by-Side Model CompareCost-per-Task CalculatorInteractive Model Finder
📦 Directories & Evals
Model Specifications DirectoryAI Labs & Cloud ProvidersBenchmark Methodologies
📖 Research & Info
Scoring MethodologyResearch Blog & ArticlesChangelog & New ModelsFrequently Asked QuestionsTechnical LLM GlossaryAbout LLMPodium
🌐 Language / Язык / 语言
🇺🇸English🇨🇳中文🇮🇳हिन्दी🇪🇸Español🇫🇷Français🇸🇦العربية🇧🇩বাংলা🇧🇷Português🇷🇺Русский🇵🇰اردو🇮🇩Bahasa Indonesia🇩🇪Deutsch🇯🇵日本語🇰🇷한국어🇹🇭ไทย🇮🇹Italiano
Explore Full Leaderboard →
  1. Accueil
  2. /Fournisseurs d'IA
  3. /Moonshot AI

Moonshot AI

16 modèles de Moonshot AI, classés par Podium Score.

Kimi K3
Modèle phare
83.3
Podium Score
52.1
Score moyen
3
poids ouverts
Kimi K3
83.3
1.0M ctx37 t/s$15/M out
83.3
Ouvert
Kimi K3 Max
74.0
128K ctx50 t/s$3/M out
74.0
Kimi K2.5 Thinking
73.0
128K ctx50 t/s$3/M out
73.0
Kimi K2.5 Instant
72.0
128K ctx50 t/s$3/M out
72.0
Kimi K2 Thinking Turbo
72.0
128K ctx50 t/s$3/M out
72.0
Kimi K2 0905 Preview
71.0
128K ctx50 t/s$3/M out
71.0
Kimi K2 0711 Preview
71.0
128K ctx50 t/s$3/M out
71.0
Kimi K2.6
49.0
262.1K ctx40 t/s$4/M out
49.0
Ouvert
Kimi K3 Low
48.3
131K ctx60 t/s$4/M out
48.3
Kimi K2.7 Code
41.8
262K ctx39 t/s$4/M out
41.8
Ouvert
Kimi K2 5
36.0
131K ctx60 t/s$4/M out
36.0
Kimi K2 6 Non Reasoning
35.4
131K ctx40 t/s$4/M out
35.4
Kimi K2 Thinking
33.5
131K ctx40 t/s$4/M out
33.5
Kimi K2 5 Non Reasoning
30.1
131K ctx40 t/s$4/M out
30.1
Kimi K2 0905
24.0
131K ctx60 t/s$4/M out
24.0
Kimi K2
19.7
131K ctx60 t/s$4/M out
19.7
LLMPodium

The definitive open LLM benchmark aggregator and leaderboard. Continuous evaluations across 719+ models and 25+ benchmarks.

Leaderboards synced daily
Classements
  • Classement
  • 💻 Code
  • 🧠 Raisonnement
  • 📐 Mathématiques
  • 🤖 Agentique
  • 🔓 Poids ouverts
  • ⚡ Vitesse
  • 💰 Qualité-prix
Outils
  • Arène (719+ models)
  • Comparer Side-by-Side
  • Benchmarks Matrix
  • Trouver
  • Modèles Directory
  • Fournisseurs d'IA
  • Cost per Task Calculator
  • #1 Ranked Model Profile
Ressources
  • Actus Feed
  • Blog & Research
  • Best AI Models 2026
  • Enterprise AI Use Cases
  • Méthodologie
  • Glossaire
  • FAQ
  • À propos
© 2026 LLMPodium. Tous droits réservés.·Les données sont régulièrement mises à jour depuis les benchmarks publics.
llms.txtRSS FeedOpen API