Les prix de sortie des modèles suivis en 2026 vont de $0.28/M tokens (DeepSeek V4 Flash) à $50/M (Claude Fable 5) — un écart de 178×. Voici comment le marché se segmente réellement, d’après les données de notre classement prix-performance.
Les trois niveaux de prix
- Niveau utilitaire (< $1/M sortie) : DeepSeek V4 Flash ($0.28), Hunyuan Hy3 ($0.56), DeepSeek V4 Pro et MiMo V2.5 Pro ($0.87). Assez rapides et intelligents pour la classification, l’extraction et les agents à gros volume.
- Niveau de travail ($1–10/M sortie) : GPT-5.6 Luna ($1.2), Kimi K3 et les modèles Gemini de milieu de gamme. C’est là que se logent la plupart des charges de production.
- Niveau frontière ($25–50/M sortie) : Claude Opus 5 ($25), GPT-5.6 Sol ($30), Claude Fable 5 ($50). Vous payez les 10–15 derniers points de benchmark.
Le prix par point d’intelligence
Divisez le prix de sortie par le Podium Score et l’image change : Kimi K3 livre 83.3 points au prix du niveau de travail, tandis que le niveau frontière facture 10–30 fois plus pour des gains à un chiffre. C’est exactement ce que classe le classement valeur — l’intelligence par dollar, combinée aux prix API.
Les tokens d’entrée comptent pour les agents
Les charges agentiques consomment 10–50 fois plus de tokens d’entrée que de sortie. Des modèles comme GPT-5.6 Luna ($0.2/M entrée) et DeepSeek V4 Flash ($0.14/M entrée) sont disproportionnément bon marché pour les agents long-contexte ; vérifiez le classement long-contexte avant de choisir.
Conclusion
Il n’y a pas une seule réponse « pas chère » — il y a un niveau bon marché pour chaque type de tâche. Comparez les prix en direct sur la page de comparaison.