⚡ สรุปคำเดียวก่อนเลย

หลังจากสองบทความก่อนหน้านี้—เรื่อง CatPaw ของ Meituan กับ QoderWork ของ Alibaba—กล่องข้อความเข้ามาเยอะมาก แต่มีข้อความหนึ่งที่ผมจำได้แม่น สรุปว่า: เครื่องมือพวกนี้ฟรีจริง แต่ล้วนมีลิมิต CatPaw 500 ครั้ง QoderWork 2000 เครดิตใช้ 30 วัน แล้วมีทางเอา API ของ GLM-5.2 มาใช้ฟรีไม่จำกัดจริงไหม

ตอนแรกผมนึกว่า—ขอกันแรงไปไหม การเรียก API ของโมเดลระดับท็อป กำลังคอมพิวต์มันอยู่ตรงนั้น จะมีของฟรีไม่จำกัดจริงๆ เหรอ

แล้วผมไปเช็คดู มีจริง

TL;DR · สรุปบรรทัดเดียว
คนที่เปิดช่องทางนี้ให้ไม่ใช่บริษัทจีน เป็น NVIDIA—บริษัทการ์ดจอที่เป็นชิปค่ายที่แพงที่สุดในโลก มันเปิด endpoint API ฟรีของ GLM-5.2 บนแพลตฟอร์มนักพัฒนาของตัวเองที่ build.nvidia.com รองรับฟอร์แมต OpenAI เสียบเข้า Claude Code ได้เลย สมัครห้านาที ไม่ต้องผูกบัตร

ความเห็นของผม: นี่คือตอนที่คุ้มค่าที่สุดใน "ไตรภาคฟรีของ GLM-5.2"—Meituan อยู่ชั้นผลิตภัณฑ์ Alibaba อยู่ชั้นผลิตภัณฑ์ ส่วน NVIDIA ลงไปถึงชั้นโครงสร้างพื้นฐานเลย ลึกลงไปทีละชั้น

📰 กุญแจฟรีอยู่ที่ไหน: 77 โมเดลบน build.nvidia.com

NVIDIA มีแพลตฟอร์มนักพัฒนาชื่อ build.nvidia.com โฮสต์โมเดล AI อยู่ 141 ตัว ในจำนวนนี้ 77 ตัวเปิดให้ใช้ API endpoint ฟรี ไม่ได้อ่านผิด 77 โมเดลฟรี DeepSeek-V4-Pro อยู่ Kimi-K2.6 อยู่ MiniMax-M2.7 อยู่ Qwen3.5 ก็อยู่

ตลาดโมเดลบน build.nvidia.com จาก 141 โมเดลมี 77 ตัวเปิดให้ใช้ API endpoint ฟรี

GLM-5.2 ก็อยู่ในนั้น แท็กระบุ Free Endpoint และ Downloadable ผู้ให้บริการคือ Z.ai (จี้ผู/Zhipu) ตั้งอยู่อันดับหนึ่งของรายการโมเดลล่าสุด เปิดมาเพียง 1 วัน ดาวน์โหลดทะลุ 2 ล้าน

การ์ดโมเดล GLM-5.2 แท็ก Free Endpoint และ Downloadable ผู้ให้บริการ Z.ai จี้ผู

API ฟรีนี้ต่างจากเครื่องมือในสองบทความก่อนหน้าอย่างพื้นฐาน CatPaw กับ QoderWork เป็นผลิตภัณฑ์สำเร็จรูป ดาวน์โหลดติดตั้งเปิดใช้งานได้เลย แต่โมเดลถูกห่อไว้ในตัวผลิตภัณฑ์ เรียกได้แค่ในอินเตอร์เฟสของมัน NVIDIA ให้คุณแค่ API บริสุทธิ์ มันรองรับฟอร์แมต OpenAI คุณเอาไปเสียบเข้าเครื่องมือไหนที่รองรับฟอร์แมตนี้ก็ได้หมด

เครื่องมือไหนก็ได้ รวมถึง Claude Code

รู้ว่าหลายคนอ่านถึงตรงนี้แล้วคิด: API พวกนี้มันไกลตัวเกินไป ผมไม่ใช่โปรแกรมเมอร์ ใจเย็นๆ เลื่อนลงไปดูก่อน มีเครื่องมือกราฟิกชื่อ CC Switch คลิกไม่กี่ทีก็ตั้งค่าเสร็จ

🧬 พารามิเตอร์สามตัว: base_url, api_key, model

วางรากฐานทางเทคนิคก่อน เปิดหน้าโมเดลของ GLM-5.2 บนแพลตฟอร์ม NVIDIA คุณจะเห็นพารามิเตอร์สำคัญสามตัวนี้

หน้าโมเดล GLM-5.2 ระบุพารามิเตอร์ base_url, api_key, model สามตัวสำหรับเชื่อมต่อ

  • base_url: https://integrate.api.nvidia.com/v1 (ทดสอบจริงแล้ว /v1 ต่อท้ายไม่ใส่ก็ได้)
  • api_key: คือคีย์ที่ขึ้นต้นด้วย nvapi- ที่จะเจนในขั้นถัดไป
  • model: z-ai/glm-5.2

ถ้าคุณเป็นโปรแกรมเมอร์ ถึงตรงนี้ก็จบแล้ว—ถือพารามิเตอร์สามตัวนี้ไปเรียก API ฟอร์แมต OpenAI ได้เลย ตัวอย่างโค้ด Python, Node, Shell หน้าเขามีให้หมด แต่คนส่วนใหญ่ไม่ใช่โปรแกรมเมอร์ และไม่อยากยุ่งกับคอมมานด์ไลน์ สรุปคือ NVIDIA ให้วัตถุดิบ ไม่ใช่ของสำเร็จรูป พอได้ API Key แล้ว คุณจะเสียบเข้า Claude Code ก็ได้ เข้า Cursor ก็ได้ เข้าปลั๊กอิน AI ใน VS Code ตัวไหนก็ได้ หรือแม้แต่โปรแกรมที่คุณเขียนเองก็ได้ เลือกเครื่องมือเอง โมเดลฟรี จะผสมกันยังไงคุณเป็นคนตัดสินใจ

นี่แหละคืออิสระแบบแท้ ต่อไปจะพาไปเอา Key ก่อน แล้วค่อยพาไปเสียบเข้า Claude Code

⚖️ ฟรีสามทาง & ราคาที่ต้องจ่าย

เอาสามช่องทางฟรีมาวางข้างกัน ต่างกันเห็นชัด:

ช่องทางโควต้าฟรีข้อจำกัดรูปแบบโมเดล
CatPaw (Meituan)500 ครั้งหมดแล้วต้องส่งฟอร์มขอรีเซ็ต แล้วรอรีวิวห่อหุ้มใน IDE
QoderWork (Alibaba)2000 เครดิตอายุ 30 วัน หมดอายุหายไป (ในช่องคอมเมนต์บอกใช้ไม่ถึงเดือนก็หมด)ห่อหุ้มในแอปเดสก์ท็อป
NVIDIA NIMKey ไม่จำกัดประมาณ 40 RPM, ช่วงเร่งรัดต้องต่อคิวAPI ล้วน, เสียบเครื่องมือไหนก็ได้

เทียบดูก็ชัด: โควต้า 500 ครั้งของ CatPaw หมดแล้วต้องส่งฟอร์มขอรีเซ็ต แล้วรอรีวิว ส่วนเครดิต 2000 ของ QoderWork มีอายุแค่ 30 วัน หมดอายุหายไปเลย ในช่องคอมเมนต์มีคนบ่นว่าใช้ไม่ถึงเดือนก็หมด NVIDIA ยัดกุญแจใช้ไม่จำกัดมาให้เลย หน้ายืนยันเขียนตรงๆ ว่า Unlimited API requests without daily limits ไม่มีลิมิตคำขอแบบรายวัน

คำอธิบายเทียร์ฟรี: Unlimited API requests without daily limits ไม่มีลิมิตคำขอรายวัน

แน่นอน "ไม่จำกัด" ต้องใส่เครื่องหมายคำถามไว้—ของฟรีมักมีเงื่อนไขซ่อนอยู่ เทียร์ฟรีของ NVIDIA มีปัญหาที่คนรู้กันดี: ช่วงเร่งรัดช้า ไม่ใช่ความรู้สึกของผมคนเดียว ตามฟอรัมนักพัฒนาต่างประเทศ ช่วงเร่งรัดคำขอจะถูกต่อคิว หรือไม่ก็ติด 429 เชื่อมต่อไม่ได้เลย เวลาตอบอาจยืดจากไม่กี่วินาทีเป็นสิบกว่าวินาทีหรือนานกว่านั้น ใน Threads มีคนพูดตรงๆ: Peak hours, you queue up and wait แปลตรงตัวคือ "ช่วงเร่งรัด คุณต่อคิวแล้วรอไป" นอกช่วงเร่งรัดใช้ดีนะ ดึกๆ กับสุดสัปดาห์รันงานเร็วพอใช้ แต่ถ้าหวังจะให้มันยืนการเรียกถี่ๆ ในวันทำงานช่วงกลางวัน ก็น่าจะผิดหวัง

ลิมิตอัตราอยู่ที่ประมาณ 40 คำขอต่อนาที สำหรับนักพัฒนาคนเดียวเขียนโค้ดประจำวันถือว่าพอเพียง แต่ถ้าจะเอาไปรัน batch อัตโนมัติ—เช่นเจนเอกสารเป็นชุด, วิเคราะห์ repo เป็นชุด—อัตรานี้น่าจะเป็นคอขวด

อีกหนึ่งเรื่องต้องพูดให้ชัด: GLM-5.2 ตอนท้ายก็ไม่ใช่ Claude มันไม่มี system prompt แบบ Claude ไม่มีบุคลิกการสนทนาแบบ Claude ไม่มีความเสถียรในงานให้เหตุผลระยะยาวซับซ้อนแบบ Claude พอคุณเอาไปเสียบเข้า Claude Code ผ่าน CC Switch หน้าตาจอเหมือนกันเปะ แต่รสชาติคำตอบไม่เหมือน งานไหนเด่นกว่าที่คาด งานไหนด้อยกว่าที่คาด คุณต้องเอาไปลองในโปรเจกต์จริงของคุณเอง รีวิวของคนอื่นแทนความรู้สึกตัวเองไม่ได้

🛠️ เอา Key ในห้านาที + เสียบเข้า Claude Code

ขั้นที่หนึ่ง: เอา API Key ในห้านาที

เปิด build.nvidia.com แล้วสมัครบัญชี ถ้าคุณมีบัญชี Google หรือ GitHub ล็อกอินผ่าน OAuth ได้เลย ไม่ต้องสมัครใหม่ หลังล็อกอินต้องยืนยันเบอร์มือถือก่อนถึงจะเจน API Key ได้—ประเด็นสำคัญตรงนี้: รองรับเบอร์มือถือจีนแผ่นดินใหญ่ ที่เมนู Location เลือก China กรอกเบอร์ที่ขึ้นต้นด้วย +86 กด Send Code to Phone แล้วเบอร์มือถือจะได้รหัสยืนยัน 6 หลัก กรอกเข้าไป ผ่าน

หน้าสมัคร เลือก Location เป็น China รองรับเบอร์มือถือจีนแผ่นดินใหญ่ +86

มือถือได้รับรหัสยืนยัน 6 หลัก หลังกด Send Code to Phone

หลายคนคิดว่าเบอร์จีนคงใช้ไม่ได้ จริงๆ ใช้ได้สบาย ผมทดสอบเอง SMS มาในไม่กี่วินาที

ยืนยันเบอร์แล้ว ไปที่ศูนย์ส่วนตัวมุมขวาบน เข้าหน้าจัดการ API Keys กด Generate API Key ตั้งชื่อให้คีย์ เช่น freeapi ระบบจะเจนสตริงคีย์ที่ขึ้นต้นด้วย nvapi- ระวัง คีย์นี้โชว์แค่ครั้งเดียว ปิดหน้าไปแล้วหายไปตลอดกาล ต้องคัดลอกเก็บไว้ทันที

หน้าจัดการ API Keys ปุ่ม Generate API Key เจนคีย์ที่ขึ้นต้นด้วย nvapi-

เห็นวันหมดอายุไหม—5 กรกฎาคม 2027 ผมตั้งอายุคีย์นี้ไว้หนึ่งปี มีตัวเลือกไม่หมดอายุด้วยเหมือนกัน แต่ไม่รู้ว่าแคมเปญนี้จะถูกดึงออกเมื่อไหร่ เลยตั้งไว้หนึ่งปีปลอดภัยกว่า endpoint นี้รันอยู่บนโครงสร้างพื้นฐานระดับโลกของ NVIDIA ไม่มีล็อคภูมิภาค ไม่ต้องใช้ VPN นักพัฒนาต่างประเทศ (รวมถึงที่ญี่ปุ่น) สมัครด้วยอีเมลเดียวก็ใช้ได้เลย

ขั้นที่สอง: เอาไปเสียบ Claude Code ผ่าน CC Switch

ได้ Key มาแล้ว ขั้นถัดไปคือขั้นสำคัญ: เอา Key ไปใช้งานยังไง

ถ้าคุณเป็นโปรแกรมเมอร์ ถือพารามิเตอร์สามตัวไปเรียก API ฟอร์แมต OpenAI ได้เลย แต่คนส่วนใหญ่ไม่อยากยุ่งกับคอมมานด์ไลน์—ตรงนี้ CC Switch เข้ามาช่วย เป็นเครื่องมือกราฟิกจัดการผู้ให้บริการโมเดล ใช้สลับโมเดลที่อยู่ใต้ฮู้ดของ Claude Code เปิดขึ้นมาจะเจอรายชื่อผู้ให้บริการเต็มจอ SiliconFlow, OpenRouter, GitHub Copilot, Codex อยู่ในนั้นหมด NVIDIA ก็เป็นหนึ่งในนั้นเหมือนกัน กดปุ่มสีฟ้า Nvidia ในรายชื่อ มันจะเติมที่อยู่คำขอให้คุณอัตโนมัติ คุณแค่วาง API Key ตัวเองลงไป

รายชื่อผู้ให้บริการของ CC Switch กดปุ่มสีฟ้า Nvidia เติมที่อยู่คำขอให้อัตโนมัติ

สี่ประเด็นตั้งค่า CC Switch: API Key, ที่อยู่คำขอ, ฟอร์แมต OpenAI Chat Completions, การแมปโมเดล

การตั้งค่ามีสี่ประเด็น:

  1. API Key: วางคีย์ nvapi- ของคุณ
  2. ที่อยู่คำขอ: ใส่ https://integrate.api.nvidia.com อันนี้ CC Switch เติมให้แล้ว
  3. ฟอร์แมต API: ต้องเลือก OpenAI Chat Completions (ต้องเปิด routing) ไม่เช่นนั้นฟอร์แมตคำขอจะไม่ตรงกัน
  4. การแมปโมเดล (สำคัญที่สุด): เอา Sonnet, Opus, Haiku ทั้งสามบทบาทแมปไปที่ z-ai/glm-5.2 หมด ไม่ว่า Claude Code จะเรียกผ่านบทบาทไหน จริงๆ แล้วรันที่ GLM-5.2 ตัวเดียว

เซฟแล้ว เปิด Claude Code พิมพ์ /model คุณจะเห็นในรายการโมเดล ตำแหน่งที่เคยเขียน Sonnet 4.6 กับ Opus ตอนนี้เปลี่ยนเป็น z-ai/glm-5.2 หมดแล้ว เลือก "Custom Sonnet model" พิมพ์ hi ทดสอบดู

พิมพ์ /model ใน Claude Code ตำแหน่ง Sonnet, Opus เปลี่ยนเป็น z-ai/glm-5.2 แล้ว

ทำงานแล้ว

สิ่งที่คุณได้ตอนนี้คืออินเตอร์เฟสและเวิร์กโฟลว์ Agent ของ Claude Code แบบเต็ม แต่ของที่อยู่ใต้ฮู้ดคือ GLM-5.2 ที่ NVIDIA ให้ฟรี ความสามารถแก้ไขหลายไฟล์ การทำงานอัตโนมัติ การจัดการคอนเท็กซ์ การเรียกใช้ทูลของ Claude Code ยังอยู่ครบ แค่เอนจินอนุมานถูกสลับเป็น GLM-5.2 ถ้าคุณไม่บอก คนนอกมองจากหน้าจอแยกไม่ออกเลย—เทอร์มินัลก็โชว์โลโก้ Claude Code เหมือนเดิม อินเตอร์เฟสเหมือนเดิม คำสั่ง /model เหมือนเดิม แต่ทุกคำขอในบทสนทนาวิ่งไปคลัสเตอร์ GPU ของ NVIDIA และเรียก GLM-5.2 ของจี้ผู

คิดบัญชีกันดู
ใช้ Claude Code แบบปกติ ขั้นต่ำต้องเป็นแพ็กเกจ Max ที่ 100 ดอลลาร์ต่อเดือน หรือไม่ก็ไปทาง API Usage Billing จ่ายตามการใช้งาน ตอนนี้คุณใช้ API ฟรีของ NVIDIA บวกกับ CC Switch อินเตอร์เฟสเดียวกัน เวิร์กโฟลว์เดียวกัน แต่ค่าเรียกโมเดลใต้ฮู้ดคือ ศูนย์ สำหรับคนที่อยากลองเวิร์กโฟลว์ Claude Code แต่งบจำกัด นี่คือทางเลือกที่ใช้ได้จริง

🌍 ธุรกิจที่อยู่ข้างหลังคำว่าฟรี: สามชั้น โมเดลเดียวกัน

เขียนมาสามตอนแล้ว สิ่งที่ผมอยากคุยไม่ใช่แค่ GLM-5.2 ตัวเดียว เอาสามบทความมาวางข้างกัน จะเห็นโครงสร้างสามชั้นที่ชัดเจน:

  • ชั้นที่หนึ่ง ชั้นแอปพลิเคชัน—Meituan กับ Alibaba ทั้งสองค่ายเอา GLM-5.2 ยัดเข้าไปในผลิตภัณฑ์ตัวเอง (CatPaw เป็น IDE, QoderWork เป็นผู้ช่วยบนเดสก์ท็อป) ใช้โมเดลฟรีดึงผู้ใช้ปลายทาง โมเดลจะดีแค่ไหน ส่วนใหญ่ขึ้นอยู่กับว่าตัวผลิตภัณฑ์ทำออกมาดีแค่ไหน
  • ชั้นที่สอง ชั้นโครงสร้างพื้นฐาน—NVIDIA เอา GLM-5.2 ไปไว้บนกลุ่ม GPU คลาวด์ของตัวเอง เปิด endpoint API ฟรี ใช้พลังคอมพิวต์ฟรีดึงนักพัฒนา
  • ชั้นที่สาม ชั้นโมเดล—จี้ผูเอง ปล่อย GLM-5.2 แบบเปิดหมด (สัญญาอนุญาต MIT) ให้ทุกคนเอาไปแจกจ่ายได้

สามชั้น สามตรรกะธุรกิจ สามรูปแบบของคำว่าฟรีที่ต่างกันสิ้นเชิง แต่ข้างใต้มีสิ่งเดียวที่ไหลเหมือนกัน

ทำไม NVIDIA ถึงทำเรื่องนี้? มันจะไปเป็นบริษัทโมเดลได้ยังไง ลองคิดตามดู ธุรกิจของ NVIDIA คืออะไร—มันขาย GPU ชิป AI อย่าง H200, B200 ลูกละเป็นหมื่นดอลลาร์ ลูกค้าใหญ่ที่สุดคือบริษัทที่ต้องการพลังอนุมานขนาดใหญ่ เรื่อง API ฟรีนี่ ภายนอกดูเหมือน NVIDIA เผื่อแผ่เงินให้คนอื่นรันโมเดล จริงๆ มันทำอยู่อย่างเดียว: ดึงให้นักพัฒนาเข้ามาเขียนโค้ด ทดสอบโมเดล สร้างต้นแบบ บนโครงสร้างพื้นฐานของ NVIDIA ให้มากที่สุด พอโปรเจกต์คุณรันผ่านบนแพลตฟอร์มนี้ เมื่อต้องขึ้นโปรดักชัน ทางเลือกที่เป็นธรรมชาติที่สุดคือซื้อ GPU ของ NVIDIA หรือไม่ก็ใช้บริการอนุมานแบบเสียเงินของ NVIDIA

API ฟรีคือเหยื่อล่อ การขาย GPU และบริการอนุมานแบบเสียเงินคือเบ็ดตกปลา ตรรกะนี้คิดตามทีเดียวก็เข้าใจ

เมื่อก่อนเรื่องแบบนี้เป็นไปไม่ได้ โมเดลสมัยก่อนปิดหมด: GPT-4 ใช้ได้แค่บนแพลตฟอร์มของ OpenAI Claude ใช้ได้แค่บนแพลตฟอร์มของ Anthropic จะใช้โมเดลของใคร ก็ต้องเข้าไปอยู่ในระบบนิเวศของคนนั้น ตอนนี้ GLM-5.2 ทำลายกฎเดิม—มันเป็นโอเพนซอร์ส สัญญาอนุญาต MIT ใครจะเอาไปใช้ก็ได้หมด เลยเห็น Meituan เอาไปทำ IDE Alibaba เอาไปทำเครื่องมือออฟฟิศ NVIDIA เอาไปทำ API ฟรีเพื่อดึงคนเข้ามา ทุกค่ายใช้โมเดลตัวเดียวกันแย่งชิงจุดเข้าของผู้ใช้ของตัวเอง แต่ไม่มีค่ายไหนเป็นเจ้าของโมเดลนี้สักค่าย

จี้ผูทำเรื่องที่ฉลาดมาก: ไม่แข่งกับบริษัทใหญ่แย่งผู้ใช้ปลายทาง แต่มาทำหน้าที่แหล่งน้ำ ใครจะเอาน้ำไปรดนาก็ได้ น้ำฟรี แต่ตราบใดที่นาของทุกคนใช้น้ำของฉัน แม่น้ำสายนี้ก็กลายเป็นโครงสร้างพื้นฐานไปแล้ว—อยากข้ามไปก็ต้องเจาะบ่อเอง นี่คือพลังจริงของโมเดลโอเพนซอร์ส: ไม่ใช่เรื่องฟรีในตัวมันเอง แต่เป็นการเปลี่ยนคู่แข่งทุกคนให้กลายเป็นช่องทางจำหน่ายของคุณ ยิ่งเปิดมากเท่าไหร่ คนอื่นยิ่งขาดคุณไม่ได้

ปี 1911 ศาลสูงสหรัฐตัดสินว่า Standard Oil เป็นผูกขาด สั่งบังคับแยกออกเป็น 34 บริษัทอิสระ ตอนนั้นวอลล์สตรีตร้องโวยวัย ทุกคนคิดว่าร็อคกี้เฟลเลอร์จบเกมไปแล้ว แต่เรื่องเหล็กคือ 34 บริษัทนั้นต่างเติบโตเป็นยักษ์ใหญ่ในวงการน้ำมัน—เอ็กซอน, มอบิล, เชฟรอน, อาโมโค ไหนๆ ก็เข้าอันดับโชคห้าร้อยของโลก ร็อคกี้เฟลเลอร์ที่ถือหุ้นตั้งต้นในบริษัทที่ถูกแยกออกไปทุกบริษัท ความมั่งคั่งส่วนตัวกลับพุ่งเป็นหลายเท่าตัวจากก่อนถูกแยก

แยกของสักอย่างออกไปให้คนอื่น บางทีไม่ใช่การสูญเสียการควบคุม แต่เป็นการปล่อยให้มันเติบโตจนกลายเป็นโครงสร้างพื้นฐานที่ทุกคนขาดไม่ได้

📝 ปิดท้าย

รีบไปสมัครที่ build.nvidia.com ก่อนที่แคมเปญจะยังไม่หมด ตอนนี้ยังไม่เสียเงิน ห้านาทีเสร็จ CC Switch ช่วยคลิกส่วนที่เหลือให้หมด

ไตรภาคฟรีของ GLM-5.2—Meituan อยู่ชั้นผลิตภัณฑ์ Alibaba อยู่ชั้นผลิตภัณฑ์ NVIDIA อยู่ชั้นโครงสร้างพื้นฐาน ลึกขึ้นทีละชั้น จะเอาชั้นไหน คุณเลือกเอง


ขั้นตอนและภาพหน้าจอในบทความนี้เป็นการทดสอบจริงโดยผู้เขียน (ข้อมูล ณ เดือนกรกฎาคม 2026); โควต้าฟรี ลิมิตอัตรา และอายุแคมเปญอาจเปลี่ยนแปลงได้ตลอดเวลา โปรดยึดหน้าทางการของ build.nvidia.com เป็นหลัก; ความเห็นในบทความนี้เป็นของผู้เขียนเท่านั้น