Harga output model yang dipantau pada 2026 membentang dari $0.28/M token (DeepSeek V4 Flash) hingga $50/M (Claude Fable 5) — rentang 178×. Berikut cara pasar benar-benar tersegmentasi, memakai data di balik peringkat harga-kinerja kami.
Tiga tingkat harga
- Tingkat utilitas (< $1/M output): DeepSeek V4 Flash ($0.28), Hunyuan Hy3 ($0.56), DeepSeek V4 Pro dan MiMo V2.5 Pro ($0.87). Cukup cepat dan cerdas untuk klasifikasi, ekstraksi, dan agen volume tinggi.
- Tingkat pekerja ($1–10/M output): GPT-5.6 Luna ($1.2), Kimi K3, dan model Gemini kelas menengah. Sebagian besar beban produksi mendarat di sini.
- Tingkat frontier ($25–50/M output): Claude Opus 5 ($25), GPT-5.6 Sol ($30), Claude Fable 5 ($50). Anda membayar 10–15 poin benchmark terakhir.
Harga per poin intelijensi
Bagi harga output dengan Podium Score dan gambarannya berubah: Kimi K3 memberi 83.3 poin di harga tingkat pekerja, sementara tingkat frontier mematok 10–30× lebih mahal untuk kenaikan satu digit. Itulah persisnya yang diurutkan peringkat nilai — intelijensi per dolar, dipadukan harga API.
Token input penting bagi agen
Beban agentik mengonsumsi token input 10–50× lebih banyak daripada output. Model seperti GPT-5.6 Luna ($0.2/M input) dan DeepSeek V4 Flash ($0.14/M input) murah secara tidak proporsional untuk agen konteks panjang; periksa peringkat konteks panjang sebelum memilih.
Kesimpulan
Tidak ada satu jawaban "murah" — ada tingkat murah untuk setiap jenis tugas. Bandingkan harga live model apa pun di halaman perbandingan.