Цены на вывод отслеживаемых моделей в 2026 простираются от $0.28/M токенов (DeepSeek V4 Flash) до $50/M (Claude Fable 5) — разброс 178×. Вот как рынок сегментирован на самом деле, по данным нашего рейтинга цена/качество.
Три ценовых уровня
- Утилитарный (< $1/M вывод): DeepSeek V4 Flash ($0.28), Hunyuan Hy3 ($0.56), DeepSeek V4 Pro и MiMo V2.5 Pro ($0.87). Достаточно быстры и умны для классификации, извлечения данных и массовых агентов.
- Рабочий ($1–10/M вывод): GPT-5.6 Luna ($1.2), Kimi K3 и Gemini среднего сегмента. Здесь живёт большинство продакшн-нагрузок.
- Фронтальный ($25–50/M вывод): Claude Opus 5 ($25), GPT-5.6 Sol ($30), Claude Fable 5 ($50). Вы доплачиваете за последние 10–15 пунктов бенчмарков.
Цена за пункт интеллекта
Разделите цену вывода на Podium Score — и картина меняется: Kimi K3 даёт 83.3 пункта по цене рабочего уровня, тогда как фронтальный уровень берёт в 10–30 раз больше за однозначный прирост. Именно это и упорядочивает рейтинг ценности — интеллект на доллар в сочетании с ценами API.
Для агентов важны входные токены
Агентные нагрузки потребляют в 10–50 раз больше входных токенов, чем выходных. Модели вроде GPT-5.6 Luna ($0.2/M вход) и DeepSeek V4 Flash ($0.14/M вход) непропорционально дёшевы для агентов с длинным контекстом — сверьтесь с рейтингом длинного контекста перед выбором.
Итог
Единого «дешёвого» ответа нет — есть дешёвый уровень для каждого типа задач. Сравнивайте живые цены любых моделей на странице сравнения.