Perbandingan Harga API AI China 2026
Harga API bayar-sesuai-penggunaan untuk 20+ model AI China — DeepSeek, Kimi, GLM, Qwen, MiniMax dan lain-lain. Bandingkan kos input/output per juta token, tetingkap konteks dan keupayaan.
Bandingkan Harga API AI China 2026: Kos per Juta Token
Membina dengan model AI China melalui API? Kami telah membandingkan 20+ model daripada 10 penyedia sebelah-menyebelah — termasuk DeepSeek V4, Kimi K2.6, GLM-5.1, Qwen3.7, MiniMax M3, Doubao, Hunyuan, ERNIE dan Spark. Semua harga adalah per juta token (input / output), dengan tetingkap konteks dan tag keupayaan. Dikemas kini Julai 2026.
| Model | Penyedia | Input /J | Output /J | Konteks | Keupayaan | Nota |
|---|---|---|---|---|---|---|
| DeepSeek V4 Pro↗ | DeepSeek | ¥3.00Hit cache ¥0.025/J | ¥6.00 | 1M | TextFunction CallingStructured Output | CNYHarga 2x ganda pada waktu puncak 9–12 dan 14–18 waktu Beijing; ketersediaan umum pada pertengahan Julai |
| DeepSeek V4 Flash↗ | DeepSeek | ¥1.00Hit cache ¥0.02/J | ¥2.00 | 1M | TextFunction CallingStructured Output | CNYHarga 2x ganda pada waktu puncak 9–12 dan 14–18 waktu Beijing |
| MiniMax M3↗ | MiniMax | $0.30 | $1.20 | 1M | TextVisionVideoFunction Calling | USDModel multimodal perdana MiniMax; menyokong input teks, gambar dan video. |
| Kimi K3↗ | Kimi (Moonshot AI) | ¥20.00Hit cache ¥2.00/J | ¥100.00 | 1M | TextFunction CallingStructured Output | CNYModel perdana Kimi untuk pengaturcaraan jangka panjang dan kerja pengetahuan end-to-end. Penaakulan sentiasa aktif (reasoning_effort, buat masa ini hanya 'max'). Menyokong caching konteks, tool_choice dan pemuatan tool dinamik. Nota: web_search sedang dinaik taraf — tidak disyorkan buat masa ini. |
| Kimi K2.6↗ | Kimi (Moonshot AI) | ¥6.50 | ¥27.00 | 262K | TextVisionVideoFunction Calling | CNYModel multimodal Kimi dengan mod thinking dan non-thinking. |
| Kimi K2.5↗ | Kimi (Moonshot AI) | ¥4.00 | ¥21.00 | 262K | TextVisionVideoFunction Calling | CNYModel multimodal Kimi; menyokong input teks, gambar dan video. |
| Kimi K2.7 Code↗ | Kimi (Moonshot AI) | ¥6.50 | ¥27.00 | 262K | TextFunction Calling | CNYMod reasoning sahaja |
| GLM-5.1↗ | Zhipu AI (GLM) | $1.40 | $4.40 | 200K | TextFunction CallingStructured Output | USDModel teks Zhipu dengan harga berperingkat berdasarkan panjang konteks. |
| GLM-5 Turbo↗ | Zhipu AI (GLM) | $1.20 | $4.00 | 200K | TextFunction CallingStructured Output | USDVarian GLM yang menjimatkan kos, sesuai untuk beban kerja teks berdaya pemprosesan tinggi. |
| GLM-5V Turbo↗ | Zhipu AI (GLM) | $1.20 | $4.00 | 200K | TextVisionVideoFunction CallingStructured Output | USDVarian multimodal GLM; menyokong input teks, gambar dan video. |
| GLM-5.2↗ | Zhipu AI (GLM) | ¥8.00Hit cache ¥2.00/J | ¥28.00 | 1M | TextFunction CallingStructured Output | CNYModel perdana terkini. Penyimpanan cache percuma untuk tempoh terhad. |
| Qwen3.7 Max↗ | Alibaba Cloud (Qwen) | ¥12.00 | ¥36.00 | 1M | TextVisionFunction CallingStructured Output | CNYModel Qwen3.7 kelas tertinggi dari Alibaba dengan konteks 1M. |
| Qwen3.7 Plus↗ | Alibaba Cloud (Qwen) | ¥2.00 | ¥8.00 | 1M | TextVisionFunction CallingStructured Output | CNYKonteks melebihi 256K dibilkan pada kadar berasingan |
| MiMo-V2.5-Pro↗ | Xiaomi (MiMo) | $0.435 | $0.87 | 1M | TextFunction CallingStructured Output | USD (≈¥3.00 / ≈¥6.00)Sumber terbuka dengan lesen MIT |
| MiMo-V2.5↗ | Xiaomi (MiMo) | $0.14 | $0.28 | 1M | TextVisionVideoAudioFunction Calling | USD (≈¥1.00 / ≈¥2.00)Menyokong teks, gambar, video dan audio |
| Doubao-Pro↗ | ByteDance (Volcano Engine) | ¥1.00 | ¥2.00 | 128K | TextFunction Calling | CNYModel Doubao serbaguna dari ByteDance. |
| Doubao-Lite↗ | ByteDance (Volcano Engine) | ¥0.30 | ¥0.60 | 128K | TextFunction Calling | CNYVarian Doubao ringan dengan kos sangat rendah. |
| Hunyuan-Large↗ | Tencent Cloud (Hunyuan) | ¥4.00 | ¥12.00 | 32K | TextFunction Calling | CNYModel Hunyuan berkapasiti lebih besar dari Tencent. |
| Hunyuan-Standard↗ | Tencent Cloud (Hunyuan) | ¥0.50 | ¥1.00 | 32K | TextFunction Calling | CNYModel Hunyuan standard yang menjimatkan kos. |
| ERNIE 4.5↗ | Baidu (Qianfan) | ¥8.00 | ¥24.00 | 32K | TextFunction Calling | CNYModel ERNIE perdana dari Baidu. |
| ERNIE Speed↗ | Baidu (Qianfan) | ¥0.12 | ¥0.12 | 8K | TextFunction Calling | CNYVarian ERNIE dengan kos sangat rendah dan latensi rendah. |
| Spark 4.0↗ | iFLYTEK (Spark) | ¥3.00 | ¥9.00 | 128K | TextFunction Calling | CNYModel Spark perdana dari iFLYTEK. |
Legenda keupayaan:TeksPenglihatanVideoAudioPanggilan FungsiOutput Berstruktur
📝 Nota Harga
📌 Nota Penting
• Semua harga adalah per juta token (1M = 1,000,000 token) pada kadar bayar-sesuai-penggunaan rasmi. Mata wang ditunjukkan setiap penyedia: ¥ = CNY (RMB), $ = USD.
• DeepSeek V4 Pro / V4 Flash menggunakan harga puncak/luar-puncak: semasa jam puncak (09:00–12:00 dan 14:00–18:00, waktu Beijing), kedua-dua harga input dan output BERGANDA. Jam luar-puncak adalah separuh harga — trafik lintas-zon masa boleh membuat arbitraj ini. DeepSeek juga menyokong cache konteks: prefiks promppt berulang dibil pada kadar hit-cache jauh lebih rendah (cth., hit cache V4 Pro ¥0.025/J vs. miss cache ¥3.00/J).
• Qwen3.7 Plus: harga input/output di atas terpakai untuk konteks 256K pertama. Penggunaan melebihi 256K dibil secara berasingan pada kadar konteks-panjang lebih tinggi.
• Harga tertakluk kepada pengumuman rasmi setiap platform. Sesetengah penyedia menawarkan diskaun volum tambahan, pakej tahap atau kredit percubaan percuma. Sentiasa sahkan sebelum integrasi.
🔥Harga semata-mata tidak cukup?Kami mengira-undur kuota token sebenar setiap model — lihat berapa banyak yang anda benar-benar boleh gunakan.Lihat perbandingan kuota sebenar →• Semua harga adalah per juta token (1M = 1,000,000 token) pada kadar bayar-sesuai-penggunaan rasmi. Mata wang ditunjukkan setiap penyedia: ¥ = CNY (RMB), $ = USD.
• DeepSeek V4 Pro / V4 Flash menggunakan harga puncak/luar-puncak: semasa jam puncak (09:00–12:00 dan 14:00–18:00, waktu Beijing), kedua-dua harga input dan output BERGANDA. Jam luar-puncak adalah separuh harga — trafik lintas-zon masa boleh membuat arbitraj ini. DeepSeek juga menyokong cache konteks: prefiks promppt berulang dibil pada kadar hit-cache jauh lebih rendah (cth., hit cache V4 Pro ¥0.025/J vs. miss cache ¥3.00/J).
• Qwen3.7 Plus: harga input/output di atas terpakai untuk konteks 256K pertama. Penggunaan melebihi 256K dibil secara berasingan pada kadar konteks-panjang lebih tinggi.
• Harga tertakluk kepada pengumuman rasmi setiap platform. Sesetengah penyedia menawarkan diskaun volum tambahan, pakej tahap atau kredit percubaan percuma. Sentiasa sahkan sebelum integrasi.