中國 AI API 定價對比 2026
20+ 中國 AI 模型 API 按量計費對比——DeepSeek、Kimi、GLM、通義千問、MiniMax 等。橫向對比輸入/輸出每百萬 Token 價格、上下文視窗與能力。
對比中國 AI API 定價 2026:每百萬 Token 成本
透過 API 接入中國大模型?我們橫向對比了 10 家廠商的 20+ 個模型——DeepSeek V4、Kimi K2.6、GLM-5.1、通義千問 Qwen3.7、MiniMax M3、豆包、混元、文心 ERNIE、星火 Spark。所有價格均為每百萬 Token(輸入/輸出),附上下文視窗與能力標籤。更新於 2026 年 7 月。
| 模型 | 供應商 | 輸入價 /M | 輸出價 /M | 上下文 | 能力 | 備註 |
|---|---|---|---|---|---|---|
| DeepSeek V4 Pro↗ | 深度求索 | ¥3.00快取命中 ¥0.025/M | ¥6.00 | 1M | TextFunction CallingStructured Output | 人民幣高峰時段(9-12/14-18)價格翻倍;7月中旬正式版 |
| DeepSeek V4 Flash↗ | 深度求索 | ¥1.00快取命中 ¥0.02/M | ¥2.00 | 1M | TextFunction CallingStructured Output | 人民幣高峰時段(9-12/14-18)價格翻倍 |
| MiniMax M3↗ | MiniMax | $0.30 | $1.20 | 1M | TextVisionVideoFunction Calling | 美元MiniMax 旗艦多模態模型,支援文字、圖片、影片輸入。 |
| Kimi K3↗ | Kimi(月之暗面) | ¥20.00快取命中 ¥2.00/M | ¥100.00 | 1M | TextFunction CallingStructured Output | 人民幣Kimi 旗艦模型,面向長程程式設計與端到端知識工作。始終進行推理(reasoning_effort,當前僅 max 檔位),支援上下文快取、工具呼叫約束(tool_choice)與動態載入工具。注意:聯網搜尋(web_search)正在升級中,近期不建議使用。 |
| Kimi K2.6↗ | Kimi(月之暗面) | ¥6.50 | ¥27.00 | 262K | TextVisionVideoFunction Calling | 人民幣Kimi 多模態模型,支援思考/非思考雙模式。 |
| Kimi K2.5↗ | Kimi(月之暗面) | ¥4.00 | ¥21.00 | 262K | TextVisionVideoFunction Calling | 人民幣Kimi 多模態模型,支援文字、圖片、影片輸入。 |
| Kimi K2.7 Code↗ | Kimi(月之暗面) | ¥6.50 | ¥27.00 | 262K | TextFunction Calling | 人民幣僅 thinking 模式 |
| GLM-5.1↗ | 智譜AI(GLM) | $1.40 | $4.40 | 200K | TextFunction CallingStructured Output | 美元智譜文字模型,按上下文長度分段計價。 |
| GLM-5 Turbo↗ | 智譜AI(GLM) | $1.20 | $4.00 | 200K | TextFunction CallingStructured Output | 美元GLM 高性價比變體,適合高吞吐文字任務。 |
| GLM-5V Turbo↗ | 智譜AI(GLM) | $1.20 | $4.00 | 200K | TextVisionVideoFunction CallingStructured Output | 美元GLM 多模態變體,支援文字、圖片、影片輸入。 |
| GLM-5.2↗ | 智譜 AI(GLM) | ¥8.00快取命中 ¥2.00/M | ¥28.00 | 1M | TextFunction CallingStructured Output | 人民幣最新旗艦模型。快取儲存限時免費。 |
| Qwen3.7 Max↗ | 阿里雲百鍊(通義千問) | ¥12.00 | ¥36.00 | 1M | TextVisionFunction CallingStructured Output | 人民幣阿里通義千問 Qwen3.7 旗艦模型,100 萬上下文。 |
| Qwen3.7 Plus↗ | 阿里雲百鍊(通義千問) | ¥2.00 | ¥8.00 | 1M | TextVisionFunction CallingStructured Output | 人民幣上下文 >256K 部分單獨計費 |
| MiMo-V2.5-Pro↗ | 小米(MiMo) | $0.435 | $0.87 | 1M | TextFunction CallingStructured Output | 美元(≈¥3.00 / ≈¥6.00)MIT 開源 |
| MiMo-V2.5↗ | 小米(MiMo) | $0.14 | $0.28 | 1M | TextVisionVideoAudioFunction Calling | 美元(≈¥1.00 / ≈¥2.00)全模態(文/圖/影片/音訊) |
| 豆包 Doubao-Pro↗ | 位元組跳動(火山方舟) | ¥1.00 | ¥2.00 | 128K | TextFunction Calling | 人民幣位元組跳動 Doubao 通用模型。 |
| 豆包 Doubao-Lite↗ | 位元組跳動(火山方舟) | ¥0.30 | ¥0.60 | 128K | TextFunction Calling | 人民幣Doubao 輕量超低價變體。 |
| 混元 Hunyuan-Large↗ | 騰訊雲(混元) | ¥4.00 | ¥12.00 | 32K | TextFunction Calling | 人民幣騰訊混元大引數模型。 |
| 混元 Hunyuan-Standard↗ | 騰訊雲(混元) | ¥0.50 | ¥1.00 | 32K | TextFunction Calling | 人民幣混元高性價比標準版。 |
| ERNIE 4.5↗ | 百度(千帆) | ¥8.00 | ¥24.00 | 32K | TextFunction Calling | 人民幣百度 ERNIE 旗艦模型。 |
| ERNIE Speed↗ | 百度(千帆) | ¥0.12 | ¥0.12 | 8K | TextFunction Calling | 人民幣ERNIE 超低價低延遲變體。 |
| 星火 Spark 4.0↗ | 科大訊飛(星火) | ¥3.00 | ¥9.00 | 128K | TextFunction Calling | 人民幣科大訊飛星火旗艦模型。 |
| Claude Opus 4.1↗ | Anthropic | $15快取命中 $1.50/M | $75 | 200K | TextVisionFunction CallingStructured Output | 美元Anthropic 旗艦推理模型——中國編程模型對標的品質基準。 |
| Claude Sonnet 4↗ | Anthropic | $3快取命中 $0.30/M | $15 | 1M | TextVisionFunction CallingStructured Output | 美元Claude Code 預設所用模型。標準 200K 上下文,長上下文可達 1M(>200K 按 $6/$22.50 計)。支援提示快取。 |
| Claude Haiku 3.5↗ | Anthropic | $0.80快取命中 $0.08/M | $4 | 200K | TextVisionFunction CallingStructured Output | 美元Anthropic 最快、最便宜的檔位,適合高頻、低難度任務。 |
| Gemini 3.6 Flash↗ | $1.50 | $7.50 | 1M | TextVisionVideoAudioFunction CallingStructured Output | 美元Google 最新快速模型,提供免費層(輸入輸出免費)。 | |
| Gemini 3.5 Flash-Lite↗ | $0.30 | $2.50 | 1M | TextVisionVideoAudioFunction CallingStructured Output | 美元Google 性價比最高的正式版模型,價格與中國旗艦模型相當。提供免費層。 | |
| Gemini 3.1 Pro Preview↗ | $2.00 | $12.00 | 1M | TextVisionVideoAudioFunction CallingStructured Output | 美元Google 旗艦 Pro 模型(所示為 ≤200K 價;>200K 按 $4/$18 計)。 | |
| Gemini 2.5 Flash-Lite↗ | $0.10 | $0.40 | 1M | TextVisionVideoAudioFunction CallingStructured Output | 美元Google 最便宜的模型,比部分中國模型更便宜。提供免費層。 |
能力圖例:文字視覺影片音訊函式呼叫結構化輸出
📝 定價說明
📌 注意事項
• 所有價格均為官方按量計費正價,單位為每百萬 Token(1M = 1,000,000 tokens)。幣種按各廠商:¥ = 人民幣,$ = 美元。
• DeepSeek V4 Pro / V4 Flash 採用分時定價:尖峰時段(北京時間 09:00–12:00、14:00–18:00)輸入輸出價格均翻倍;離峰時段半價——跨時區流量可藉此套利。DeepSeek 亦支援上下文快取:重複的提示詞前綴按低得多的快取命中價計費(如 V4 Pro 快取命中 ¥0.025/M,快取未命中 ¥3.00/M)。
• 通義千問 Qwen3.7 Plus:上述輸入輸出價適用於前 256K 上下文,超出 256K 部分按更高的長上下文價單獨計費。
• 價格以各平台官方公告為準。部分廠商另有大客戶量級折扣、套餐包或免費試用額度,接入前請以官網為準。
🔥只看價格不夠?我們實測了各模型的真實 token 額度,看看你實際能用多少。查看 AI 模型真實額度實測對比 →• 所有價格均為官方按量計費正價,單位為每百萬 Token(1M = 1,000,000 tokens)。幣種按各廠商:¥ = 人民幣,$ = 美元。
• DeepSeek V4 Pro / V4 Flash 採用分時定價:尖峰時段(北京時間 09:00–12:00、14:00–18:00)輸入輸出價格均翻倍;離峰時段半價——跨時區流量可藉此套利。DeepSeek 亦支援上下文快取:重複的提示詞前綴按低得多的快取命中價計費(如 V4 Pro 快取命中 ¥0.025/M,快取未命中 ¥3.00/M)。
• 通義千問 Qwen3.7 Plus:上述輸入輸出價適用於前 256K 上下文,超出 256K 部分按更高的長上下文價單獨計費。
• 價格以各平台官方公告為準。部分廠商另有大客戶量級折扣、套餐包或免費試用額度,接入前請以官網為準。