Perbandingan Harga API AI China 2026

Harga API pay-as-you-go untuk 20+ model AI China — DeepSeek, Kimi, GLM, Qwen, MiniMax, dan lainnya. Bandingkan biaya input/output per juta token, jendela konteks, dan kemampuan.
📅 Diperbarui Terus-menerus · 2026🏷️ 10 Penyedia · 20 Model📌 Pembaruan terakhir: 4 Juli 2026

Bandingkan Harga API AI China 2026: Biaya per Juta Token

Membangun dengan model AI China via API? Kami telah membandingkan 20+ model dari 10 penyedia secara berdampingan — termasuk DeepSeek V4, Kimi K2.6, GLM-5.1, Qwen3.7, MiniMax M3, Doubao, Hunyuan, ERNIE, dan Spark. Semua harga per juta token (input / output), dengan jendela konteks dan tag kemampuan. Diperbarui Juli 2026.

22 model
ModelPenyediaInput /MOutput /MKonteksKemampuanCatatan
DeepSeek V4 ProDeepSeek¥3.00Cache hit ¥0.025/M¥6.001M
TextFunction CallingStructured Output
CNYHarga 2x lipat pada jam sibuk pukul 9–12 dan 14–18 waktu Beijing; ketersediaan umum pada pertengahan Juli
DeepSeek V4 FlashDeepSeek¥1.00Cache hit ¥0.02/M¥2.001M
TextFunction CallingStructured Output
CNYHarga 2x lipat pada jam sibuk pukul 9–12 dan 14–18 waktu Beijing
MiniMax M3MiniMax$0.30$1.201M
TextVisionVideoFunction Calling
USDModel multimodal unggulan MiniMax; mendukung input teks, gambar, dan video.
Kimi K3Kimi (Moonshot AI)¥20.00Cache hit ¥2.00/M¥100.001M
TextFunction CallingStructured Output
CNYModel unggulan Kimi untuk pemrograman jangka panjang dan pekerjaan pengetahuan end-to-end. Penalaran selalu aktif (reasoning_effort, saat ini hanya 'max'). Mendukung caching konteks, tool_choice, dan pemuatan tool dinamis. Catatan: web_search sedang ditingkatkan — untuk saat ini tidak disarankan.
Kimi K2.6Kimi (Moonshot AI)¥6.50¥27.00262K
TextVisionVideoFunction Calling
CNYModel multimodal Kimi dengan mode thinking dan non-thinking.
Kimi K2.5Kimi (Moonshot AI)¥4.00¥21.00262K
TextVisionVideoFunction Calling
CNYModel multimodal Kimi; mendukung input teks, gambar, dan video.
Kimi K2.7 CodeKimi (Moonshot AI)¥6.50¥27.00262K
TextFunction Calling
CNYHanya mode reasoning
GLM-5.1Zhipu AI (GLM)$1.40$4.40200K
TextFunction CallingStructured Output
USDModel teks Zhipu dengan harga berjenjang berdasarkan panjang konteks.
GLM-5 TurboZhipu AI (GLM)$1.20$4.00200K
TextFunction CallingStructured Output
USDVarian GLM yang hemat biaya, cocok untuk beban kerja teks dengan throughput tinggi.
GLM-5V TurboZhipu AI (GLM)$1.20$4.00200K
TextVisionVideoFunction CallingStructured Output
USDVarian multimodal GLM; mendukung input teks, gambar, dan video.
GLM-5.2Zhipu AI (GLM)¥8.00Cache hit ¥2.00/M¥28.001M
TextFunction CallingStructured Output
CNYModel unggulan terbaru. Penyimpanan cache gratis untuk waktu terbatas.
Qwen3.7 MaxAlibaba Cloud (Qwen)¥12.00¥36.001M
TextVisionFunction CallingStructured Output
CNYModel Qwen3.7 kelas atas dari Alibaba dengan konteks 1M.
Qwen3.7 PlusAlibaba Cloud (Qwen)¥2.00¥8.001M
TextVisionFunction CallingStructured Output
CNYKonteks di atas 256K ditagihkan dengan tarif terpisah
MiMo-V2.5-ProXiaomi (MiMo)$0.435$0.871M
TextFunction CallingStructured Output
USD (≈¥3.00 / ≈¥6.00)Open-source dengan lisensi MIT
MiMo-V2.5Xiaomi (MiMo)$0.14$0.281M
TextVisionVideoAudioFunction Calling
USD (≈¥1.00 / ≈¥2.00)Mendukung teks, gambar, video, dan audio
Doubao-ProByteDance (Volcano Engine)¥1.00¥2.00128K
TextFunction Calling
CNYModel Doubao serbaguna dari ByteDance.
Doubao-LiteByteDance (Volcano Engine)¥0.30¥0.60128K
TextFunction Calling
CNYVarian Doubao ringan dengan biaya sangat rendah.
Hunyuan-LargeTencent Cloud (Hunyuan)¥4.00¥12.0032K
TextFunction Calling
CNYModel Hunyuan berkapasitas lebih besar dari Tencent.
Hunyuan-StandardTencent Cloud (Hunyuan)¥0.50¥1.0032K
TextFunction Calling
CNYModel Hunyuan standard yang hemat biaya.
ERNIE 4.5Baidu (Qianfan)¥8.00¥24.0032K
TextFunction Calling
CNYModel ERNIE unggulan dari Baidu.
ERNIE SpeedBaidu (Qianfan)¥0.12¥0.128K
TextFunction Calling
CNYVarian ERNIE dengan biaya sangat rendah dan latensi rendah.
Spark 4.0iFLYTEK (Spark)¥3.00¥9.00128K
TextFunction Calling
CNYModel Spark unggulan dari iFLYTEK.
Legenda kemampuan:TeksVisiVideoAudioFunction CallingStructured Output

📝 Catatan Harga

📌 Catatan Penting
• Semua harga per juta token (1M = 1.000.000 token) pada tarif resmi pay-as-you-go. Mata uang ditampilkan per penyedia: ¥ = CNY (RMB), $ = USD.
• DeepSeek V4 Pro / V4 Flash menggunakan harga peak/off-peak: selama jam peak (09:00–12:00 dan 14:00–18:00, waktu Beijing), baik harga input maupun output naik dua kali lipat. Jam off-peak setengah harga — traffic lintas zona waktu dapat melakukan arbitrase ini. DeepSeek juga mendukung context caching: prefiks prompt yang berulang ditagih pada tarif cache-hit yang jauh lebih rendah (mis. V4 Pro cache hit ¥0.025/M vs. cache miss ¥3.00/M).
• Qwen3.7 Plus: harga input/output di atas berlaku untuk 256K konteks pertama. Penggunaan di atas 256K ditagih secara terpisah pada tarif long-context yang lebih tinggi.
• Harga mengikuti pengumuman resmi setiap platform. Beberapa penyedia menawarkan diskon volume tambahan, paket tingkat, atau kredit uji coba gratis. Selalu verifikasi sebelum integrasi.
🔥Harga saja tidak cukup?Kami menghitung mundur kuota token nyata tiap model — lihat berapa banyak yang benar-benar bisa Anda pakai.Lihat perbandingan kuota nyata →