เปรียบเทียบราคา API ของ AI จีน 2026

ราคา API แบบจ่ายตามการใช้งานของ 20+ โมเดล AI จีน — DeepSeek, Kimi, GLM, Qwen, MiniMax และอื่น ๆ เปรียบเทียบค่าใช้จ่าย input/output ต่อล้าน token, context window และความสามารถ
📅 อัปเดตต่อเนื่อง · 2026🏷️ 10 ผู้ให้บริการ · 20 โมเดล📌 อัปเดตล่าสุด: 4 กรกฎาคม 2026

เปรียบเทียบราคา API ของ AI จีน 2026: ราคาต่อล้าน Token

กำลัง build กับโมเดล AI จีนผ่าน API? เราเปรียบเทียบ 20+ โมเดลจาก 10 ผู้ให้บริการแบบเคียงข้าง — รวมถึง DeepSeek V4, Kimi K2.6, GLM-5.1, Qwen3.7, MiniMax M3, Doubao, Hunyuan, ERNIE และ Spark ราคาทั้งหมดเป็นต่อล้าน token (input/output) พร้อม context window และแท็กความสามารถ อัปเดตกรกฎาคม 2026

22 โมเดล
โมเดลผู้ให้บริการInput /MOutput /MContextความสามารถหมายเหตุ
DeepSeek V4 ProDeepSeek¥3.00Cache hit ¥0.025/M¥6.001M
TextFunction CallingStructured Output
CNYราคาเพิ่ม 2x ในช่วงเวลา 9–12 และ 14–18 น. ตามเวลาปักกิ่ง; เปิดให้ใช้งานทั่วไปช่วงกลางเดือนกรกฎาคม
DeepSeek V4 FlashDeepSeek¥1.00Cache hit ¥0.02/M¥2.001M
TextFunction CallingStructured Output
CNYราคาเพิ่ม 2x ในช่วงเวลา 9–12 และ 14–18 น. ตามเวลาปักกิ่ง
MiniMax M3MiniMax$0.30$1.201M
TextVisionVideoFunction Calling
USDโมเดลมัลติโมดอลธงของ MiniMax รองรับอินพุตข้อความ รูปภาพ และวิดีโอ
Kimi K3Kimi (Moonshot AI)¥20.00Cache hit ¥2.00/M¥100.001M
TextFunction CallingStructured Output
CNYโมเดลธงของ Kimi สำหรับการเขียนโค้ดระยะยาวและงานด้านความรู้แบบ end-to-end เปิดใช้ reasoning ตลอดเวลา (reasoning_effort, ปัจจุบันมีเฉพาะระดับ 'max') รองรับการแคชคอนเทกซ์, tool_choice และการโหลด tool แบบไดนามิก หมายเหตุ: web_search กำลังอัปเกรด — ยังไม่แนะนำให้ใช้ในขณะนี้
Kimi K2.6Kimi (Moonshot AI)¥6.50¥27.00262K
TextVisionVideoFunction Calling
CNYโมเดลมัลติโมดอลของ Kimi มีทั้งโหมด thinking และ non-thinking
Kimi K2.5Kimi (Moonshot AI)¥4.00¥21.00262K
TextVisionVideoFunction Calling
CNYโมเดลมัลติโมดอลของ Kimi รองรับอินพุตข้อความ รูปภาพ และวิดีโอ
Kimi K2.7 CodeKimi (Moonshot AI)¥6.50¥27.00262K
TextFunction Calling
CNYใช้ได้เฉพาะโหมด reasoning
GLM-5.1Zhipu AI (GLM)$1.40$4.40200K
TextFunction CallingStructured Output
USDโมเดลข้อความของ Zhipu กำหนดราคาแบบขั้นตามความยาวคอนเทกซ์
GLM-5 TurboZhipu AI (GLM)$1.20$4.00200K
TextFunction CallingStructured Output
USDเวอร์ชัน GLM ที่ปรับเพื่อประหยัดต้นทุน เหมาะกับภาระงานข้อความที่ต้องการ throughput สูง
GLM-5V TurboZhipu AI (GLM)$1.20$4.00200K
TextVisionVideoFunction CallingStructured Output
USDเวอร์ชันมัลติโมดอลของ GLM รองรับอินพุตข้อความ รูปภาพ และวิดีโอ
GLM-5.2Zhipu AI (GLM)¥8.00Cache hit ¥2.00/M¥28.001M
TextFunction CallingStructured Output
CNYโมเดลธงรุ่นใหม่ล่าสุด การจัดเก็บแคชฟรีในช่วงเวลาจำกัด
Qwen3.7 MaxAlibaba Cloud (Qwen)¥12.00¥36.001M
TextVisionFunction CallingStructured Output
CNYโมเดล Qwen3.7 ระดับท็อปของ Alibaba รองรับคอนเทกซ์ 1M
Qwen3.7 PlusAlibaba Cloud (Qwen)¥2.00¥8.001M
TextVisionFunction CallingStructured Output
CNYคอนเทกซ์ส่วนที่เกิน 256K คิดค่าบริการในอัตราแยกต่างหาก
MiMo-V2.5-ProXiaomi (MiMo)$0.435$0.871M
TextFunction CallingStructured Output
USD (≈¥3.00 / ≈¥6.00)โอเพนซอร์สภายใต้ลิขสิทธิ์ MIT
MiMo-V2.5Xiaomi (MiMo)$0.14$0.281M
TextVisionVideoAudioFunction Calling
USD (≈¥1.00 / ≈¥2.00)รองรับอินพุตข้อความ รูปภาพ วิดีโอ และเสียง
Doubao-ProByteDance (Volcano Engine)¥1.00¥2.00128K
TextFunction Calling
CNYโมเดลอเนกประสงค์ Doubao ของ ByteDance
Doubao-LiteByteDance (Volcano Engine)¥0.30¥0.60128K
TextFunction Calling
CNYเวอร์ชัน Doubao ที่เบาและต้นทุนต่ำมาก
Hunyuan-LargeTencent Cloud (Hunyuan)¥4.00¥12.0032K
TextFunction Calling
CNYโมเดล Hunyuan พารามิเตอร์ขนาดใหญ่ของ Tencent
Hunyuan-StandardTencent Cloud (Hunyuan)¥0.50¥1.0032K
TextFunction Calling
CNYโมเดล Hunyuan แบบมาตรฐานที่คุ้มค่า
ERNIE 4.5Baidu (Qianfan)¥8.00¥24.0032K
TextFunction Calling
CNYโมเดล ERNIE ธงของ Baidu
ERNIE SpeedBaidu (Qianfan)¥0.12¥0.128K
TextFunction Calling
CNYเวอร์ชัน ERNIE ราคาประหยัดมาก เวลาตอบสนองต่ำ
Spark 4.0iFLYTEK (Spark)¥3.00¥9.00128K
TextFunction Calling
CNYโมเดล Spark ธงของ iFLYTEK
คำอธิบายความสามารถ:ข้อความVisionVideoAudioFunction CallingStructured Output

📝 หมายเหตุเรื่องราคา

📌 หมายเหตุสำคัญ
• ราคาทั้งหมดเป็นราคาจ่ายตามการใช้งานทางการ ต่อล้าน token (1M = 1,000,000 tokens) สกุลเงินแสดงตามผู้ให้บริการ: ¥ = CNY (RMB), $ = USD
• DeepSeek V4 Pro / V4 Flash ใช้ราคาแบบช่วงเร่ง/นอกช่วง: ในช่วงเร่ง (09:00–12:00 และ 14:00–18:00 เวลาปักกิ่ง) ทั้งราคา input และ output จะเป็น 2 เท่า ช่วงนอกเวลาเร่งราคาครึ่งหนึ่ง — การรับส่งข้อมูลข้ามเขตเวลาสามารถทำ arbitrage ได้ DeepSeek ยังรองรับ context caching: prompt prefix ที่ซ้ำกันจะคิดในอัตรา cache-hit ที่ถูกกว่ามาก (เช่น V4 Pro cache hit ¥0.025/M เทียบกับ cache miss ¥3.00/M)
• Qwen3.7 Plus: ราคา input/output ด้านบนใช้กับ context 256K แรก การใช้งานเกิน 256K จะคิดแยกต่างหากในอัตรา long-context ที่สูงกว่า
• ราคาขึ้นอยู่กับประกาศทางการของแต่ละแพลตฟอร์ม ผู้ให้บริการบางรายมีส่วนลดตามปริมาณ แพ็กเกจระดับ หรือเครดิตทดลองใช้ฟรีเพิ่มเติม โปรดยืนยันก่อนเชื่อมต่อระบบเสมอ
🔥ดูแค่ราคาอย่างเดียวไม่พอ?เราคำนวณย้อนกลับโควต้า token จริงของแต่ละโมเดล — ดูว่าคุณใช้ได้จริงปริมาณเท่าไรดูตารางเปรียบเทียบโควต้าจริง →