Perbandingan Harga API AI China 2026

Harga API bayar-sesuai-penggunaan untuk 20+ model AI China — DeepSeek, Kimi, GLM, Qwen, MiniMax dan lain-lain. Bandingkan kos input/output per juta token, tetingkap konteks dan keupayaan.
📅 Dikemas Kini Berterusan · 2026🏷️ 10 Penyedia · 20 Model📌 Kemas kini terakhir: 4 Julai 2026

Bandingkan Harga API AI China 2026: Kos per Juta Token

Membina dengan model AI China melalui API? Kami telah membandingkan 20+ model daripada 10 penyedia sebelah-menyebelah — termasuk DeepSeek V4, Kimi K2.6, GLM-5.1, Qwen3.7, MiniMax M3, Doubao, Hunyuan, ERNIE dan Spark. Semua harga adalah per juta token (input / output), dengan tetingkap konteks dan tag keupayaan. Dikemas kini Julai 2026.

22 model
ModelPenyediaInput /JOutput /JKonteksKeupayaanNota
DeepSeek V4 ProDeepSeek¥3.00Hit cache ¥0.025/J¥6.001M
TextFunction CallingStructured Output
CNYHarga 2x ganda pada waktu puncak 9–12 dan 14–18 waktu Beijing; ketersediaan umum pada pertengahan Julai
DeepSeek V4 FlashDeepSeek¥1.00Hit cache ¥0.02/J¥2.001M
TextFunction CallingStructured Output
CNYHarga 2x ganda pada waktu puncak 9–12 dan 14–18 waktu Beijing
MiniMax M3MiniMax$0.30$1.201M
TextVisionVideoFunction Calling
USDModel multimodal perdana MiniMax; menyokong input teks, gambar dan video.
Kimi K3Kimi (Moonshot AI)¥20.00Hit cache ¥2.00/J¥100.001M
TextFunction CallingStructured Output
CNYModel perdana Kimi untuk pengaturcaraan jangka panjang dan kerja pengetahuan end-to-end. Penaakulan sentiasa aktif (reasoning_effort, buat masa ini hanya 'max'). Menyokong caching konteks, tool_choice dan pemuatan tool dinamik. Nota: web_search sedang dinaik taraf — tidak disyorkan buat masa ini.
Kimi K2.6Kimi (Moonshot AI)¥6.50¥27.00262K
TextVisionVideoFunction Calling
CNYModel multimodal Kimi dengan mod thinking dan non-thinking.
Kimi K2.5Kimi (Moonshot AI)¥4.00¥21.00262K
TextVisionVideoFunction Calling
CNYModel multimodal Kimi; menyokong input teks, gambar dan video.
Kimi K2.7 CodeKimi (Moonshot AI)¥6.50¥27.00262K
TextFunction Calling
CNYMod reasoning sahaja
GLM-5.1Zhipu AI (GLM)$1.40$4.40200K
TextFunction CallingStructured Output
USDModel teks Zhipu dengan harga berperingkat berdasarkan panjang konteks.
GLM-5 TurboZhipu AI (GLM)$1.20$4.00200K
TextFunction CallingStructured Output
USDVarian GLM yang menjimatkan kos, sesuai untuk beban kerja teks berdaya pemprosesan tinggi.
GLM-5V TurboZhipu AI (GLM)$1.20$4.00200K
TextVisionVideoFunction CallingStructured Output
USDVarian multimodal GLM; menyokong input teks, gambar dan video.
GLM-5.2Zhipu AI (GLM)¥8.00Hit cache ¥2.00/J¥28.001M
TextFunction CallingStructured Output
CNYModel perdana terkini. Penyimpanan cache percuma untuk tempoh terhad.
Qwen3.7 MaxAlibaba Cloud (Qwen)¥12.00¥36.001M
TextVisionFunction CallingStructured Output
CNYModel Qwen3.7 kelas tertinggi dari Alibaba dengan konteks 1M.
Qwen3.7 PlusAlibaba Cloud (Qwen)¥2.00¥8.001M
TextVisionFunction CallingStructured Output
CNYKonteks melebihi 256K dibilkan pada kadar berasingan
MiMo-V2.5-ProXiaomi (MiMo)$0.435$0.871M
TextFunction CallingStructured Output
USD (≈¥3.00 / ≈¥6.00)Sumber terbuka dengan lesen MIT
MiMo-V2.5Xiaomi (MiMo)$0.14$0.281M
TextVisionVideoAudioFunction Calling
USD (≈¥1.00 / ≈¥2.00)Menyokong teks, gambar, video dan audio
Doubao-ProByteDance (Volcano Engine)¥1.00¥2.00128K
TextFunction Calling
CNYModel Doubao serbaguna dari ByteDance.
Doubao-LiteByteDance (Volcano Engine)¥0.30¥0.60128K
TextFunction Calling
CNYVarian Doubao ringan dengan kos sangat rendah.
Hunyuan-LargeTencent Cloud (Hunyuan)¥4.00¥12.0032K
TextFunction Calling
CNYModel Hunyuan berkapasiti lebih besar dari Tencent.
Hunyuan-StandardTencent Cloud (Hunyuan)¥0.50¥1.0032K
TextFunction Calling
CNYModel Hunyuan standard yang menjimatkan kos.
ERNIE 4.5Baidu (Qianfan)¥8.00¥24.0032K
TextFunction Calling
CNYModel ERNIE perdana dari Baidu.
ERNIE SpeedBaidu (Qianfan)¥0.12¥0.128K
TextFunction Calling
CNYVarian ERNIE dengan kos sangat rendah dan latensi rendah.
Spark 4.0iFLYTEK (Spark)¥3.00¥9.00128K
TextFunction Calling
CNYModel Spark perdana dari iFLYTEK.
Legenda keupayaan:TeksPenglihatanVideoAudioPanggilan FungsiOutput Berstruktur

📝 Nota Harga

📌 Nota Penting
• Semua harga adalah per juta token (1M = 1,000,000 token) pada kadar bayar-sesuai-penggunaan rasmi. Mata wang ditunjukkan setiap penyedia: ¥ = CNY (RMB), $ = USD.
• DeepSeek V4 Pro / V4 Flash menggunakan harga puncak/luar-puncak: semasa jam puncak (09:00–12:00 dan 14:00–18:00, waktu Beijing), kedua-dua harga input dan output BERGANDA. Jam luar-puncak adalah separuh harga — trafik lintas-zon masa boleh membuat arbitraj ini. DeepSeek juga menyokong cache konteks: prefiks promppt berulang dibil pada kadar hit-cache jauh lebih rendah (cth., hit cache V4 Pro ¥0.025/J vs. miss cache ¥3.00/J).
• Qwen3.7 Plus: harga input/output di atas terpakai untuk konteks 256K pertama. Penggunaan melebihi 256K dibil secara berasingan pada kadar konteks-panjang lebih tinggi.
• Harga tertakluk kepada pengumuman rasmi setiap platform. Sesetengah penyedia menawarkan diskaun volum tambahan, pakej tahap atau kredit percubaan percuma. Sentiasa sahkan sebelum integrasi.
🔥Harga semata-mata tidak cukup?Kami mengira-undur kuota token sebenar setiap model — lihat berapa banyak yang anda benar-benar boleh gunakan.Lihat perbandingan kuota sebenar →