ตารางเปรียบเทียบโควต้า Token จริงของโมเดล AI

โควต้าจริงที่คำนวณย้อนกลับจากการทดสอบของชุมชนและการทดสอบโดยทีมบรรณาธิการ — ไม่ใช่ตัวเลขจำกัดอย่างเป็นทางการ

ไม่มีแพ็กเกจไหนที่ “ดีที่สุด” เพียงตัวเดียว — ขึ้นอยู่กับช่วงเวลาใช้งานของคุณ ถ้าใช้หนักช่วงกลางคืน Qwen 3.8 Max Token Plan ของ Alibaba (~1,500 ล้าน token/เดือน ในราคา ¥39) แทบจะหาคู่แข่งไม่ได้เลย ส่วนการเขียนโค้ดทั้งวัน Kimi K3 Allegretto (¥159/เดือน, ~950 ล้าน token) จะเสถียรกว่า

ตรวจสอบล่าสุด:

ตารางเปรียบเทียบโควต้าแบบเคียงข้าง

โมเดลต่ำสุด/เดือนโควต้ารายเดือนToken/¥กรอบ 5 ชม.ส่วนลดช่วงกลางคืนเหมาะกับรายละเอียด
Kimi K3 (Allegretto)Moonshot AI¥159~950 ล้าน~6 ล้าน~40 ล้านไม่มีเขียนโค้ดทั้งวัน & agentรายละเอียด →
Qwen 3.8 Max Token PlanAlibaba Cloud¥39~1,500 ล้าน (กลางคืน)~38 ล้าน (กลางคืน)700 credits / 5hลด 80% (กลางคืน)กลุ่มผู้ใช้หนักตอนดึกรายละเอียด →
GLM 5.2Zhipu AI

ข้อมูลคำนวณย้อนกลับจากการใช้งานจริงของผู้ใช้ในชุมชน ไม่ใช่จำกัดคงที่จากทางการ ผู้ให้บริการอาจปรับโควต้าแบบไดนามิก คลิกหัวคอลัมน์เพื่อจัดเรียง

แพ็กเกจไหนเหมาะกับคุณ?

ใช้งานหนัก แต่ส่วนใหญ่อยู่ช่วงกลางคืน
Qwen 3.8 Max — ลด 80% ช่วงกลางคืน เลยเป็นราชาเรื่องความคุ้ม
ถามตอบเป็นบางครั้ง / ใช้งานเบา ๆ
เริ่มจากของฟรี — Qoder หรือระดับฟรีของ Kimi อัปเกรดเมื่อชนขีดจำกัด
ต้องใช้ความสามารถเข้าใจภาพ
Qwen 3.8 Max รองรับการส่งภาพเข้าไป (GLM 5.2 ไม่รองรับ)

วิธีที่เราประเมินโควต้า

“การคำนวณย้อนกลับโควต้า” คืออะไร

หน้าเว็บทางการแทบไม่เคยเผยแพร่ขีดจำกัด token ที่ตายตัว เราเลยต้องอนุมานเอา: โควต้ารวม ≈ token ที่ใช้ไปแล้ว ÷ เปอร์เซ็นต์การใช้งานที่แสดงในแถบ ยกตัวอย่างเช่น 15 ล้าน token ที่ 37.3% ของแถบ 5 ชม. หมายความว่าหน้าต่างนั้นมีขนาดประมาณ ~40 ล้าน เราจะตรวจสอบข้ามแถบ 5 ชม., 7 วัน และรายเดือนเพื่อยืนยันความถูกต้อง

ทำไมทางการจึงไม่เผยแพร่ขีดจำกัดที่ตายตัว

ขีดจำกัดเป็นค่าพลวัต: จะเปลี่ยนไปตามเวอร์ชันโมเดล โหลดเซิร์ฟเวอร์ และกลยุทธ์ทางธุรกิจ การเผยแพร่ตัวเลขหนึ่ง ๆ ก็เท่ากับเป็นการให้คำมั่นสัญญา และยังเป็นเป้าหมายให้คนมาฉวยโอกาส ผู้ให้บริการเลยจงใจปล่อยให้ตัวเลขเลือนลาง ขอให้ถือว่าตัวเลขทุกตัวที่นี่เป็นเพียงภาพถ่ายในช่วงเวลาหนึ่ง ไม่ใช่สัญญาผูกมัด

อัตราการเข้าชนแคช (cache hit-rate) เปลี่ยนปริมาณการใช้งานจริงอย่างไร

ในเวิร์กโฟลว์เขียนโค้ด/agent มักจะมีการส่งบริบทเดิมซ้ำ ๆ ผู้ใช้คนหนึ่งบันทึกไว้ว่าอัตราการเข้าชนแคชอยู่ที่ 93.7% — หมายความว่ามีเพียง ~6% ของอินพุตเท่านั้นที่ถูกคิดราคาเต็ม โควต้าที่คุณ “รู้สึก” ว่าได้รับ จึงใหญ่กว่าจำนวน token ดิบที่ตัวเลขบอกมาก

สมัครสมาชิกรายเดือน vs API จ่ายตามการใช้งาน

การสมัครสมาชิกแลกความยืดหยุ่นกับราคาคงที่ภายในกรอบเวลาแบบกลิ้ง API จ่ายตามการใช้งานจะคิดเงินทุก token แต่ไม่มีการจำกัดอัตรา (rate-limit) หากการใช้งานของคุณคงที่และคาดเดาได้ สมัครสมาชิกจะได้เปรียบ แต่ถ้าการใช้งานพุ่งขึ้นลง หรือต้องทำงานหลายอย่างพร้อมกัน API จะได้เปรียบกว่า

ข้อมูลเชิงลึกของอุตสาหกรรม

ทำไมโมเดลจีนถึงผลักดันรูปแบบสมัครสมาชิกมากกว่า API เปล่า ๆ

การสมัครสมาชิกล็อกรายได้รายเดือนไว้ และยังลดแรงเสียดทานในการจ่ายเงินของผู้บริโภคที่ไม่ไว้ใจความไม่แน่นอนของการคิดเงินตาม token นอกจากนี้ยังช่วยให้ผู้ให้บริการกระจายความต้องการผ่านกรอบเวลาโควต้า แทนที่จะปล่อยให้ราคาพุ่งขึ้น

ตรรกะการจัดตารางคอมพิวต์ที่อยู่เบื้องหลังส่วนลดช่วงกลางคืน

คลัสเตอร์อนุมาน (inference) มักจัดสรรเกินขีดเพื่อรองรับพีคช่วงกลางวัน และโล่งในช่วงกลางคืน ส่วนลดกลางคืนที่หนักมาก (Qwen 0.2 折) จึงเป็นการตั้งราคาให้กับกำลังการผลิตที่ว่างอยู่นั่นเอง — ผู้ให้บริการแทบไม่ต้องเสียค่าเพิ่มเลย แต่กลับเติมเต็ม GPU ที่จะปล่อยให้สูญเปล่า

ช่องว่างระหว่าง “ราคาติดป้าย” กับ “คุณค่าที่รู้สึกได้” มาจากไหน

คุณจะได้รับเท่าไหร่จริง ๆ นั้นถูกกำหนดโดยคานงัดที่ซ่อนอยู่สามตัว: อัตราการเข้าชนแคช, สัดส่วนอินพุต/เอาต์พุตของภาระงานของคุณ และส่วนลดตามช่วงเวลา ผู้ใช้สองคนบนแพ็กเกจเดียวกันอาจมีปริมาณงานจริง (throughput) ต่างกันถึง 50× — นี่คือเหตุผลที่เราคำนวณย้อนกลับแทนที่จะเชื่อราคาติดป้าย

การ์ดโมเดลอย่างย่อ

Kimi K3 (Allegretto)ตัวเลือกเด็ดสำหรับโค้ดทั้งวัน

ตัวเลือกที่สมดุลที่สุดสำหรับคนเขียนโค้ดทุกวัน: ~950 ล้าน token/เดือน, หน้าต่าง 5 ชม. ที่ ~40 ล้าน และโควต้า Code แบบ 20× ใช้ได้ตลอดทั้งวัน ไม่มีเงื่อนไข “กลางคืนเท่านั้น”

เริ่มต้น/เดือน
¥159
รายเดือน
~950 ล้าน
กรอบ 5 ชม.
~40 ล้าน
ดูผลทดสอบเต็ม →
Qwen 3.8 Max Token Planคุ้มที่สุด — ในช่วงกลางคืน

คุ้มแทบจะหาที่เปรียบไม่ได้ หากคุณรันงานหนักในช่วงกลางคืน (22:00–08:00): ~1,500 ล้าน token/เดือน ในราคา ¥39 พอกลางวันจะตกลงไปที่ ~300 ล้าน และถ้ายกเลิกโปรโมชั่นก็จะเหลือแค่ ~30 ล้าน

เริ่มต้น/เดือน
¥39
รายเดือน
~1,500 ล้าน (กลางคืน)
กรอบ 5 ชม.
700 credits / 5h
ดูผลทดสอบเต็ม →

คำถามที่พบบ่อย

Kimi K3 กับ Qwen 3.8 Max อันไหนคุ้มกว่ากัน?

ขึ้นอยู่กับช่วงเวลาของคุณ Qwen 3.8 Max ถูกกว่าต่อ token มากหากใช้ช่วงกลางคืน (~38 ล้าน token/หยวน เทียบกับ ~6 ล้าน ของ Kimi) — แต่ช่วงกลางวัน Qwen จะตกลงไปที่ ~300 ล้าน token/เดือน Kimi K3 ให้สเถียรภาพที่ ~950 ล้าน token/เดือนตลอดทั้งวันโดยไม่จำกัดช่วงเวลา คนตื่นดึก: เลือก Qwen คนเขียนโค้ดทั้งวัน: เลือก Kimi

แพ็กเกจ AI ของจีนอันไหนคุ้มค่าที่สุดโดยรวม?

ดูแค่ token ต่อหยวน ช่วงกลางคืนของ Qwen 3.8 Max ไม่มีใครเทียบได้ สำหรับความเสถียรบวกกับชุดเครื่องมือที่เน้นการเขียนโค้ด Kimi K3 Allegretto เป็นตัวเรือธงรอบด้านที่แข็งแกร่งที่สุด ถ้าจะลองก่อน ให้เริ่มจากโควต้าฟรี Qwen 3.8 Max ของ Qoder ก่อนจ่ายเงินสักบาท

จะเกิดอะไรขึ้นเมื่อฉันชนขีดจำกัดโควต้า?

ปกติระบบจะแจ้งเตือนว่าโควต้าหมดแล้ว คุณต้องรอให้กรอบเวลาแบบกลิ้งค่อย ๆ ปล่อยกลับมา (กรอบ 5 ชม. ปล่อยทีละชั่วโมง, กรอบ 7 วัน ปล่อยทีละวัน) หรืออัปเกรด ผู้ให้บริการบางรายอาจลดคุณภาพหรือความเร็วลง แทนที่จะบล็อกเด็ดขาด

อันไหนจะหมดก่อน — โควต้า 5 ชม. หรือรายเดือน?

สำหรับเซสชันหนัก ๆ แบบพุ่ง (การเขียนโค้ดด้วย agent, รีแฟกเตอร์ครั้งใหญ่) แถบ 5 ชม. แทบจะเป็นคอขวดเสมอ — คุณอาจใช้จนหมดได้ก่อนที่แถบรายเดือนจะขยับเท่าไหร่ ส่วนการใช้งานแบบปล่อยยืดยาว แถบรายเดือนต่างหากที่คุณต้องเฝ้าดู

มีโมเดลภาษาขนาดใหญ่ของจีนที่ใช้ได้ฟรีไหม?

มี Qoder มีระดับฟรีที่รัน Qwen 3.8 Max และ Kimi ก็มีระดับฟรี (จำกัด) เหมือนกัน นี่เป็นวิธีที่ดีที่สุดในการวัดการใช้งานจริงของคุณ ก่อนที่จะจ่ายเงินสมัครสมาชิก

บทความที่เกี่ยวข้อง