Perbandingan Harga API AI China 2026
Harga API pay-as-you-go untuk 20+ model AI China — DeepSeek, Kimi, GLM, Qwen, MiniMax, dan lainnya. Bandingkan biaya input/output per juta token, jendela konteks, dan kemampuan.
Bandingkan Harga API AI China 2026: Biaya per Juta Token
Membangun dengan model AI China via API? Kami telah membandingkan 20+ model dari 10 penyedia secara berdampingan — termasuk DeepSeek V4, Kimi K2.6, GLM-5.1, Qwen3.7, MiniMax M3, Doubao, Hunyuan, ERNIE, dan Spark. Semua harga per juta token (input / output), dengan jendela konteks dan tag kemampuan. Diperbarui Juli 2026.
| Model | Penyedia | Input /M | Output /M | Konteks | Kemampuan | Catatan |
|---|---|---|---|---|---|---|
| DeepSeek V4 Pro↗ | DeepSeek | ¥3.00Cache hit ¥0.025/M | ¥6.00 | 1M | TextFunction CallingStructured Output | CNYHarga 2x lipat pada jam sibuk pukul 9–12 dan 14–18 waktu Beijing; ketersediaan umum pada pertengahan Juli |
| DeepSeek V4 Flash↗ | DeepSeek | ¥1.00Cache hit ¥0.02/M | ¥2.00 | 1M | TextFunction CallingStructured Output | CNYHarga 2x lipat pada jam sibuk pukul 9–12 dan 14–18 waktu Beijing |
| MiniMax M3↗ | MiniMax | $0.30 | $1.20 | 1M | TextVisionVideoFunction Calling | USDModel multimodal unggulan MiniMax; mendukung input teks, gambar, dan video. |
| Kimi K3↗ | Kimi (Moonshot AI) | ¥20.00Cache hit ¥2.00/M | ¥100.00 | 1M | TextFunction CallingStructured Output | CNYModel unggulan Kimi untuk pemrograman jangka panjang dan pekerjaan pengetahuan end-to-end. Penalaran selalu aktif (reasoning_effort, saat ini hanya 'max'). Mendukung caching konteks, tool_choice, dan pemuatan tool dinamis. Catatan: web_search sedang ditingkatkan — untuk saat ini tidak disarankan. |
| Kimi K2.6↗ | Kimi (Moonshot AI) | ¥6.50 | ¥27.00 | 262K | TextVisionVideoFunction Calling | CNYModel multimodal Kimi dengan mode thinking dan non-thinking. |
| Kimi K2.5↗ | Kimi (Moonshot AI) | ¥4.00 | ¥21.00 | 262K | TextVisionVideoFunction Calling | CNYModel multimodal Kimi; mendukung input teks, gambar, dan video. |
| Kimi K2.7 Code↗ | Kimi (Moonshot AI) | ¥6.50 | ¥27.00 | 262K | TextFunction Calling | CNYHanya mode reasoning |
| GLM-5.1↗ | Zhipu AI (GLM) | $1.40 | $4.40 | 200K | TextFunction CallingStructured Output | USDModel teks Zhipu dengan harga berjenjang berdasarkan panjang konteks. |
| GLM-5 Turbo↗ | Zhipu AI (GLM) | $1.20 | $4.00 | 200K | TextFunction CallingStructured Output | USDVarian GLM yang hemat biaya, cocok untuk beban kerja teks dengan throughput tinggi. |
| GLM-5V Turbo↗ | Zhipu AI (GLM) | $1.20 | $4.00 | 200K | TextVisionVideoFunction CallingStructured Output | USDVarian multimodal GLM; mendukung input teks, gambar, dan video. |
| GLM-5.2↗ | Zhipu AI (GLM) | ¥8.00Cache hit ¥2.00/M | ¥28.00 | 1M | TextFunction CallingStructured Output | CNYModel unggulan terbaru. Penyimpanan cache gratis untuk waktu terbatas. |
| Qwen3.7 Max↗ | Alibaba Cloud (Qwen) | ¥12.00 | ¥36.00 | 1M | TextVisionFunction CallingStructured Output | CNYModel Qwen3.7 kelas atas dari Alibaba dengan konteks 1M. |
| Qwen3.7 Plus↗ | Alibaba Cloud (Qwen) | ¥2.00 | ¥8.00 | 1M | TextVisionFunction CallingStructured Output | CNYKonteks di atas 256K ditagihkan dengan tarif terpisah |
| MiMo-V2.5-Pro↗ | Xiaomi (MiMo) | $0.435 | $0.87 | 1M | TextFunction CallingStructured Output | USD (≈¥3.00 / ≈¥6.00)Open-source dengan lisensi MIT |
| MiMo-V2.5↗ | Xiaomi (MiMo) | $0.14 | $0.28 | 1M | TextVisionVideoAudioFunction Calling | USD (≈¥1.00 / ≈¥2.00)Mendukung teks, gambar, video, dan audio |
| Doubao-Pro↗ | ByteDance (Volcano Engine) | ¥1.00 | ¥2.00 | 128K | TextFunction Calling | CNYModel Doubao serbaguna dari ByteDance. |
| Doubao-Lite↗ | ByteDance (Volcano Engine) | ¥0.30 | ¥0.60 | 128K | TextFunction Calling | CNYVarian Doubao ringan dengan biaya sangat rendah. |
| Hunyuan-Large↗ | Tencent Cloud (Hunyuan) | ¥4.00 | ¥12.00 | 32K | TextFunction Calling | CNYModel Hunyuan berkapasitas lebih besar dari Tencent. |
| Hunyuan-Standard↗ | Tencent Cloud (Hunyuan) | ¥0.50 | ¥1.00 | 32K | TextFunction Calling | CNYModel Hunyuan standard yang hemat biaya. |
| ERNIE 4.5↗ | Baidu (Qianfan) | ¥8.00 | ¥24.00 | 32K | TextFunction Calling | CNYModel ERNIE unggulan dari Baidu. |
| ERNIE Speed↗ | Baidu (Qianfan) | ¥0.12 | ¥0.12 | 8K | TextFunction Calling | CNYVarian ERNIE dengan biaya sangat rendah dan latensi rendah. |
| Spark 4.0↗ | iFLYTEK (Spark) | ¥3.00 | ¥9.00 | 128K | TextFunction Calling | CNYModel Spark unggulan dari iFLYTEK. |
Legenda kemampuan:TeksVisiVideoAudioFunction CallingStructured Output
📝 Catatan Harga
📌 Catatan Penting
• Semua harga per juta token (1M = 1.000.000 token) pada tarif resmi pay-as-you-go. Mata uang ditampilkan per penyedia: ¥ = CNY (RMB), $ = USD.
• DeepSeek V4 Pro / V4 Flash menggunakan harga peak/off-peak: selama jam peak (09:00–12:00 dan 14:00–18:00, waktu Beijing), baik harga input maupun output naik dua kali lipat. Jam off-peak setengah harga — traffic lintas zona waktu dapat melakukan arbitrase ini. DeepSeek juga mendukung context caching: prefiks prompt yang berulang ditagih pada tarif cache-hit yang jauh lebih rendah (mis. V4 Pro cache hit ¥0.025/M vs. cache miss ¥3.00/M).
• Qwen3.7 Plus: harga input/output di atas berlaku untuk 256K konteks pertama. Penggunaan di atas 256K ditagih secara terpisah pada tarif long-context yang lebih tinggi.
• Harga mengikuti pengumuman resmi setiap platform. Beberapa penyedia menawarkan diskon volume tambahan, paket tingkat, atau kredit uji coba gratis. Selalu verifikasi sebelum integrasi.
🔥Harga saja tidak cukup?Kami menghitung mundur kuota token nyata tiap model — lihat berapa banyak yang benar-benar bisa Anda pakai.Lihat perbandingan kuota nyata →• Semua harga per juta token (1M = 1.000.000 token) pada tarif resmi pay-as-you-go. Mata uang ditampilkan per penyedia: ¥ = CNY (RMB), $ = USD.
• DeepSeek V4 Pro / V4 Flash menggunakan harga peak/off-peak: selama jam peak (09:00–12:00 dan 14:00–18:00, waktu Beijing), baik harga input maupun output naik dua kali lipat. Jam off-peak setengah harga — traffic lintas zona waktu dapat melakukan arbitrase ini. DeepSeek juga mendukung context caching: prefiks prompt yang berulang ditagih pada tarif cache-hit yang jauh lebih rendah (mis. V4 Pro cache hit ¥0.025/M vs. cache miss ¥3.00/M).
• Qwen3.7 Plus: harga input/output di atas berlaku untuk 256K konteks pertama. Penggunaan di atas 256K ditagih secara terpisah pada tarif long-context yang lebih tinggi.
• Harga mengikuti pengumuman resmi setiap platform. Beberapa penyedia menawarkan diskon volume tambahan, paket tingkat, atau kredit uji coba gratis. Selalu verifikasi sebelum integrasi.