สรุปสั้นๆ: DeepSeek ประกาศว่า API ของ V4 จะเปิดใช้ราคาแบบไดนามิกตามช่วงเวลา — ราคาพุ่งเป็นสองเท่าในช่วงเวลาเร่งด่วนของวันทำการ (เวลาปักกิ่ง 9:00–12:00 และ 14:00–18:00) ส่วนนอกช่วงเร่งด่วนยังคงราคาเดิม V4 เวอร์ชันเป็นทางการมีกำหนดเปิดตัวกลางเดือนกรกฎาคม 2026 แม้จะคิดราคาในช่วงเร่งด่วนที่สูงเป็นสองเท้าแล้ว DeepSeek ก็ยังเป็น AI API แนวหน้าที่ถูกที่สุดในโลก แถมถูกกว่าเป็นกอง
⚡ เกิดอะไรขึ้น
วันที่ 29 มิถุนายน DeepSeek ส่งอีเมลแจ้งผู้ใช้ทั้งหมดภายใต้หัวข้อ "DeepSeek V4 แผนเปิดตัวเวอร์ชันเป็นทางการและการปรับการเรียกเก็บเงิน" การเปลี่ยนแปลงใหญ่ที่สุดคือ ราคาแบบไดนามิกตามช่วงเวลา — เป็นครั้งแรกในหมู่ผู้ให้บริการ AI API รายใหญ่
ในช่วงเวลาเร่งด่วนของวันทำการ (เวลาปักกิ่ง 9:00–12:00 และ 14:00–18:00) ราคา API ของ V4 ทุกรายการพุ่งเป็นสองเท่าทันที ส่วนช่วงเวลาอื่นราคาไม่เปลี่ยนแปลง ยังคงอยู่ที่ระดับต่ำผิดปกติอย่างที่เป็นอยู่
เข้าใจง่ายๆ ก็คือเหมือน Surge pricing ของ Uber ในช่วงเร่งด่วน เพียงแต่หน่วยนับเปลี่ยนเป็น AI token ตอนที่ทุกคนกำลังเขียนโค้ดพร้อมกัน คุณต้องจ่ายส่วนต่าง; แต่ถ้าเลื่อนงาน batch ไปรันตอนตี 3 ก็ได้ส่วนลด
📊 ตารางราคา
DeepSeek V4 Pro
| รายการคิดค่าใช้จ่าย | นอกช่วงเร่งด่วน (¥/M tokens) | ช่วงเร่งด่วน (¥/M tokens) |
|---|---|---|
| Input (cache hit) | ¥0.025 | ¥0.05 |
| Input (cache miss) | ¥3.00 | ¥6.00 |
| Output | ¥6.00 | ¥12.00 |
DeepSeek V4 Flash
| รายการคิดค่าใช้จ่าย | นอกช่วงเร่งด่วน (¥/M tokens) | ช่วงเร่งด่วน (¥/M tokens) |
|---|---|---|
| Input (cache hit) | ¥0.02 | ¥0.04 |
| Input (cache miss) | ¥1.00 | ¥2.00 |
| Output | ¥2.00 | ¥4.00 |
📋 ค่าใช้จ่ายจริง
ดูราคาต่อหน่วยอย่างเดียวคงจินตนาการไม่ออก มาดูบิลจริงกัน คุณ青小蛙 จาก Appinn เคยแชร์ตัวเลขการใช้งานจริง: ใช้ DeepSeek V4 Flash อัปเดตปฏิทินฟุตบอลโลกอัตโนมัติ — ดึงคะแนน ประตู ข้อมูลแมตช์ — รันยาวตลอดทั้งเดือน:
- วันปกติ: ประมาณ ¥2 (ราว $0.28)
- วันที่งานหนัก (แก้ bug, รันใหม่): ¥13 (ราว $1.82)
- รวมทั้งเดือน: ¥60 (ราว $8.40)
ไม่ได้อ่านผิด — pipeline อัตโนมัติที่รันทุกวันเป็นเดือน ยังถูกกว่ามื้อเที่ยงวันหนึ่งมื้อในซานฟรานซิสโก
🏆 เทียบกับคู่แข่ง
นี่คือราคา output ของโมเดลหลักๆ (ดอลลาร์ ต่อล้าน tokens):
| โมเดล | Output $/M | หน้าต่างคอนเท็กซ์ |
|---|---|---|
| DeepSeek V4 Flash (นอกเร่งด่วน / เร่งด่วน) | $0.28 / $0.56 | 1,000,000 |
| DeepSeek V4 Pro (นอกเร่งด่วน / เร่งด่วน) | $0.87 / $1.74 | 1,000,000 |
| Xiaomi MiMo V2.5 | $0.28 | 1,000,000 |
| Xiaomi MiMo V2.5 Pro | $0.87 | 1,000,000 |
| MiniMax M3 | $1.20 | 1,000,000 |
| GLM-5.1 (Zhipu) | $4.40 | 200,000 |
| Kimi K2.6 | ¥27 ≈ $3.78 | 262,000 |
| Qwen3.7 Plus | ¥8 ≈ $1.12 | 1,000,000 |
| GPT-5.5 (OpenAI) | $30.00 | 1,100,000 |
| Claude Opus 4.8 (Anthropic) | $25.00 | 1,000,000 |
ในระดับ "คอนเท็กซ์ 1 ล้าน + ถูกมาก" คู่แข่งที่ใกล้ที่สุดคือ Xiaomi MiMo V2.5 — output ที่ $0.28/M เท่ากับราคานอกเร่งด่วนของ DeepSeek V4 Flash แต่ไม่มีราคาเร่งด่วน ถ้าคุณไวต่อต้นทุนและไม่อยากกังวลเรื่องช่วงเวลา MiMo น่าจะเป็นทางเลือกที่ปลอดภัยกว่า
🤔 ทำไมถึงทำแบบนี้
เหตุผลตรงไปตรงมา: การจัดการความจุ เซิร์ฟเวอร์ของ DeepSeek ถูกตอน้ำหนักหนักมากในช่วงเวลาทำการแบบจีน แทนที่จะปฏิเสธผู้ใช้ (หรือปล่อยให้คุณภาพถดถอยเพราะโหลดเกิน) พวกเขาจึงใช้สัญญาณราคาเพื่อปรับความต้องการให้เรียบ
นี่เป็นเศรษฐศาสตร์โครงสร้างพื้นฐานที่ฉลาดจริงๆ AWS, Google Cloud และผู้ให้บริการคลาวด์รายใหญ่ทำแบบนี้มานานแล้ว ผ่าน spot instance และ reserved capacity DeepSeek แค่เป็นผู้ให้บริการ AI API รายแรกที่นำตรรกะเดียวกันมาใช้กับการ inference โมเดลภาษา
คาดว่าจะมีคนตามมา ถ้าโมเดลนี้เวิร์กสำหรับ DeepSeek Kimi และ Qwen ก็แทบจะแน่นอนว่าจะออก tier แบบเร่งด่วน/นอกเร่งด่วนของตัวเอง
🎯 คุณควรทำอย่างไร
- ถ้ารักษาต้นทุน: จัดตารางงานหนักๆ (batch processing, สร้างข้อมูลฝึก, วิเคราะห์จำนวนมาก) ไปไว้นอกเวลาทำการปักกิ่ง (9:00–12:00, 14:00–18:00) กระเป๋าเงินของคุณจะขอบคุณ
- ถ้าต้องการพร้อมใช้ 7×24: ตั้งงบโดยใช้ราคาเร่งด่วน หรือเตรียมสายโซ่สำรองไว้ — โยนปริมาณในช่วงเร่งด่วนไปที่ MiMo V2.5 หรือ Qwen3.7 Plus แล้วสลับกลับมา DeepSeek ตอนนอกเร่งด่วน
- ถ้าใช้ฟรีหรืองบน้อย: V4 Flash ในราคานอกเร่งด่วนถือว่าเกือบฟรี input (cache miss) ¥1/M หมายความว่าคุณประมวลผล input 1 ล้าน token บวก output 1 ล้าน token ในราคาเพียง ¥3 (41 เซนต์) นวนิยายยาวเล่มทั้งเล่ม อ่านเข้า วิเคราะห์ แล้วคายออก ก็แค่นี้
⏳ สรุป
DeepSeek V4 แม้ราคาคูณสอง ก็ยังคงเป็นAI API แนวหน้าที่ถูกที่สุดในโลก เรื่องราคาแบบแบ่งช่วงเวลาเป็น feature ไม่ใช่ bug — มันสะท้อนว่าความต้องการ DeepSeek สูงถึงขนาดต้องจัดการความจุ และทำให้เห็นเรื่องนี้อย่างโปร่งใสในตัวราคา
ถ้าคุณกำลังใช้ AI API ของจีน (ซึ่งตามจริงคุณน่าจะใช้ — ส่วนต่างราคากับผู้ให้บริการอเมริกันได้บ้าไปแล้วจนไม่มีเหตุผล) ตราบใดที่งานไม่ต้องการ input แบบ multimodal DeepSeek V4 Flash ยังคงเป็นตัวเลือกเริ่มต้นอันดับหนึ่ง แค่ย้ายงานหนักไปรันหลังทานข้าวเย็นก็พอ
แหล่งข้อมูล: อีเมลผู้ใช้ DeepSeek (29 มิถุนายน 2026), รายงานของ Appinn, ไดเรกทอรีราคา DevTk.AI ตรวจสอบราคา ณ วันที่ 3 กรกฎาคม 2026