⚡ สรุปคำเดียวก่อนเลย
หลังจากสองบทความก่อนหน้านี้—เรื่อง CatPaw ของ Meituan กับ QoderWork ของ Alibaba—กล่องข้อความเข้ามาเยอะมาก แต่มีข้อความหนึ่งที่ผมจำได้แม่น สรุปว่า: เครื่องมือพวกนี้ฟรีจริง แต่ล้วนมีลิมิต CatPaw 500 ครั้ง QoderWork 2000 เครดิตใช้ 30 วัน แล้วมีทางเอา API ของ GLM-5.2 มาใช้ฟรีไม่จำกัดจริงไหม
ตอนแรกผมนึกว่า—ขอกันแรงไปไหม การเรียก API ของโมเดลระดับท็อป กำลังคอมพิวต์มันอยู่ตรงนั้น จะมีของฟรีไม่จำกัดจริงๆ เหรอ
แล้วผมไปเช็คดู มีจริง
คนที่เปิดช่องทางนี้ให้ไม่ใช่บริษัทจีน เป็น NVIDIA—บริษัทการ์ดจอที่เป็นชิปค่ายที่แพงที่สุดในโลก มันเปิด endpoint API ฟรีของ GLM-5.2 บนแพลตฟอร์มนักพัฒนาของตัวเองที่
build.nvidia.com รองรับฟอร์แมต OpenAI เสียบเข้า Claude Code ได้เลย สมัครห้านาที ไม่ต้องผูกบัตรความเห็นของผม: นี่คือตอนที่คุ้มค่าที่สุดใน "ไตรภาคฟรีของ GLM-5.2"—Meituan อยู่ชั้นผลิตภัณฑ์ Alibaba อยู่ชั้นผลิตภัณฑ์ ส่วน NVIDIA ลงไปถึงชั้นโครงสร้างพื้นฐานเลย ลึกลงไปทีละชั้น
📰 กุญแจฟรีอยู่ที่ไหน: 77 โมเดลบน build.nvidia.com
NVIDIA มีแพลตฟอร์มนักพัฒนาชื่อ build.nvidia.com โฮสต์โมเดล AI อยู่ 141 ตัว ในจำนวนนี้ 77 ตัวเปิดให้ใช้ API endpoint ฟรี ไม่ได้อ่านผิด 77 โมเดลฟรี DeepSeek-V4-Pro อยู่ Kimi-K2.6 อยู่ MiniMax-M2.7 อยู่ Qwen3.5 ก็อยู่

GLM-5.2 ก็อยู่ในนั้น แท็กระบุ Free Endpoint และ Downloadable ผู้ให้บริการคือ Z.ai (จี้ผู/Zhipu) ตั้งอยู่อันดับหนึ่งของรายการโมเดลล่าสุด เปิดมาเพียง 1 วัน ดาวน์โหลดทะลุ 2 ล้าน

API ฟรีนี้ต่างจากเครื่องมือในสองบทความก่อนหน้าอย่างพื้นฐาน CatPaw กับ QoderWork เป็นผลิตภัณฑ์สำเร็จรูป ดาวน์โหลดติดตั้งเปิดใช้งานได้เลย แต่โมเดลถูกห่อไว้ในตัวผลิตภัณฑ์ เรียกได้แค่ในอินเตอร์เฟสของมัน NVIDIA ให้คุณแค่ API บริสุทธิ์ มันรองรับฟอร์แมต OpenAI คุณเอาไปเสียบเข้าเครื่องมือไหนที่รองรับฟอร์แมตนี้ก็ได้หมด
เครื่องมือไหนก็ได้ รวมถึง Claude Code
รู้ว่าหลายคนอ่านถึงตรงนี้แล้วคิด: API พวกนี้มันไกลตัวเกินไป ผมไม่ใช่โปรแกรมเมอร์ ใจเย็นๆ เลื่อนลงไปดูก่อน มีเครื่องมือกราฟิกชื่อ CC Switch คลิกไม่กี่ทีก็ตั้งค่าเสร็จ
🧬 พารามิเตอร์สามตัว: base_url, api_key, model
วางรากฐานทางเทคนิคก่อน เปิดหน้าโมเดลของ GLM-5.2 บนแพลตฟอร์ม NVIDIA คุณจะเห็นพารามิเตอร์สำคัญสามตัวนี้

- base_url:
https://integrate.api.nvidia.com/v1(ทดสอบจริงแล้ว/v1ต่อท้ายไม่ใส่ก็ได้) - api_key: คือคีย์ที่ขึ้นต้นด้วย
nvapi-ที่จะเจนในขั้นถัดไป - model:
z-ai/glm-5.2
ถ้าคุณเป็นโปรแกรมเมอร์ ถึงตรงนี้ก็จบแล้ว—ถือพารามิเตอร์สามตัวนี้ไปเรียก API ฟอร์แมต OpenAI ได้เลย ตัวอย่างโค้ด Python, Node, Shell หน้าเขามีให้หมด แต่คนส่วนใหญ่ไม่ใช่โปรแกรมเมอร์ และไม่อยากยุ่งกับคอมมานด์ไลน์ สรุปคือ NVIDIA ให้วัตถุดิบ ไม่ใช่ของสำเร็จรูป พอได้ API Key แล้ว คุณจะเสียบเข้า Claude Code ก็ได้ เข้า Cursor ก็ได้ เข้าปลั๊กอิน AI ใน VS Code ตัวไหนก็ได้ หรือแม้แต่โปรแกรมที่คุณเขียนเองก็ได้ เลือกเครื่องมือเอง โมเดลฟรี จะผสมกันยังไงคุณเป็นคนตัดสินใจ
นี่แหละคืออิสระแบบแท้ ต่อไปจะพาไปเอา Key ก่อน แล้วค่อยพาไปเสียบเข้า Claude Code
⚖️ ฟรีสามทาง & ราคาที่ต้องจ่าย
เอาสามช่องทางฟรีมาวางข้างกัน ต่างกันเห็นชัด:
| ช่องทาง | โควต้าฟรี | ข้อจำกัด | รูปแบบโมเดล |
|---|---|---|---|
| CatPaw (Meituan) | 500 ครั้ง | หมดแล้วต้องส่งฟอร์มขอรีเซ็ต แล้วรอรีวิว | ห่อหุ้มใน IDE |
| QoderWork (Alibaba) | 2000 เครดิต | อายุ 30 วัน หมดอายุหายไป (ในช่องคอมเมนต์บอกใช้ไม่ถึงเดือนก็หมด) | ห่อหุ้มในแอปเดสก์ท็อป |
| NVIDIA NIM | Key ไม่จำกัด | ประมาณ 40 RPM, ช่วงเร่งรัดต้องต่อคิว | API ล้วน, เสียบเครื่องมือไหนก็ได้ |
เทียบดูก็ชัด: โควต้า 500 ครั้งของ CatPaw หมดแล้วต้องส่งฟอร์มขอรีเซ็ต แล้วรอรีวิว ส่วนเครดิต 2000 ของ QoderWork มีอายุแค่ 30 วัน หมดอายุหายไปเลย ในช่องคอมเมนต์มีคนบ่นว่าใช้ไม่ถึงเดือนก็หมด NVIDIA ยัดกุญแจใช้ไม่จำกัดมาให้เลย หน้ายืนยันเขียนตรงๆ ว่า Unlimited API requests without daily limits ไม่มีลิมิตคำขอแบบรายวัน

แน่นอน "ไม่จำกัด" ต้องใส่เครื่องหมายคำถามไว้—ของฟรีมักมีเงื่อนไขซ่อนอยู่ เทียร์ฟรีของ NVIDIA มีปัญหาที่คนรู้กันดี: ช่วงเร่งรัดช้า ไม่ใช่ความรู้สึกของผมคนเดียว ตามฟอรัมนักพัฒนาต่างประเทศ ช่วงเร่งรัดคำขอจะถูกต่อคิว หรือไม่ก็ติด 429 เชื่อมต่อไม่ได้เลย เวลาตอบอาจยืดจากไม่กี่วินาทีเป็นสิบกว่าวินาทีหรือนานกว่านั้น ใน Threads มีคนพูดตรงๆ: Peak hours, you queue up and wait แปลตรงตัวคือ "ช่วงเร่งรัด คุณต่อคิวแล้วรอไป" นอกช่วงเร่งรัดใช้ดีนะ ดึกๆ กับสุดสัปดาห์รันงานเร็วพอใช้ แต่ถ้าหวังจะให้มันยืนการเรียกถี่ๆ ในวันทำงานช่วงกลางวัน ก็น่าจะผิดหวัง
อีกหนึ่งเรื่องต้องพูดให้ชัด: GLM-5.2 ตอนท้ายก็ไม่ใช่ Claude มันไม่มี system prompt แบบ Claude ไม่มีบุคลิกการสนทนาแบบ Claude ไม่มีความเสถียรในงานให้เหตุผลระยะยาวซับซ้อนแบบ Claude พอคุณเอาไปเสียบเข้า Claude Code ผ่าน CC Switch หน้าตาจอเหมือนกันเปะ แต่รสชาติคำตอบไม่เหมือน งานไหนเด่นกว่าที่คาด งานไหนด้อยกว่าที่คาด คุณต้องเอาไปลองในโปรเจกต์จริงของคุณเอง รีวิวของคนอื่นแทนความรู้สึกตัวเองไม่ได้
🛠️ เอา Key ในห้านาที + เสียบเข้า Claude Code
ขั้นที่หนึ่ง: เอา API Key ในห้านาที
เปิด build.nvidia.com แล้วสมัครบัญชี ถ้าคุณมีบัญชี Google หรือ GitHub ล็อกอินผ่าน OAuth ได้เลย ไม่ต้องสมัครใหม่ หลังล็อกอินต้องยืนยันเบอร์มือถือก่อนถึงจะเจน API Key ได้—ประเด็นสำคัญตรงนี้: รองรับเบอร์มือถือจีนแผ่นดินใหญ่ ที่เมนู Location เลือก China กรอกเบอร์ที่ขึ้นต้นด้วย +86 กด Send Code to Phone แล้วเบอร์มือถือจะได้รหัสยืนยัน 6 หลัก กรอกเข้าไป ผ่าน


หลายคนคิดว่าเบอร์จีนคงใช้ไม่ได้ จริงๆ ใช้ได้สบาย ผมทดสอบเอง SMS มาในไม่กี่วินาที
ยืนยันเบอร์แล้ว ไปที่ศูนย์ส่วนตัวมุมขวาบน เข้าหน้าจัดการ API Keys กด Generate API Key ตั้งชื่อให้คีย์ เช่น freeapi ระบบจะเจนสตริงคีย์ที่ขึ้นต้นด้วย nvapi- ระวัง คีย์นี้โชว์แค่ครั้งเดียว ปิดหน้าไปแล้วหายไปตลอดกาล ต้องคัดลอกเก็บไว้ทันที

เห็นวันหมดอายุไหม—5 กรกฎาคม 2027 ผมตั้งอายุคีย์นี้ไว้หนึ่งปี มีตัวเลือกไม่หมดอายุด้วยเหมือนกัน แต่ไม่รู้ว่าแคมเปญนี้จะถูกดึงออกเมื่อไหร่ เลยตั้งไว้หนึ่งปีปลอดภัยกว่า endpoint นี้รันอยู่บนโครงสร้างพื้นฐานระดับโลกของ NVIDIA ไม่มีล็อคภูมิภาค ไม่ต้องใช้ VPN นักพัฒนาต่างประเทศ (รวมถึงที่ญี่ปุ่น) สมัครด้วยอีเมลเดียวก็ใช้ได้เลย
ขั้นที่สอง: เอาไปเสียบ Claude Code ผ่าน CC Switch
ได้ Key มาแล้ว ขั้นถัดไปคือขั้นสำคัญ: เอา Key ไปใช้งานยังไง
ถ้าคุณเป็นโปรแกรมเมอร์ ถือพารามิเตอร์สามตัวไปเรียก API ฟอร์แมต OpenAI ได้เลย แต่คนส่วนใหญ่ไม่อยากยุ่งกับคอมมานด์ไลน์—ตรงนี้ CC Switch เข้ามาช่วย เป็นเครื่องมือกราฟิกจัดการผู้ให้บริการโมเดล ใช้สลับโมเดลที่อยู่ใต้ฮู้ดของ Claude Code เปิดขึ้นมาจะเจอรายชื่อผู้ให้บริการเต็มจอ SiliconFlow, OpenRouter, GitHub Copilot, Codex อยู่ในนั้นหมด NVIDIA ก็เป็นหนึ่งในนั้นเหมือนกัน กดปุ่มสีฟ้า Nvidia ในรายชื่อ มันจะเติมที่อยู่คำขอให้คุณอัตโนมัติ คุณแค่วาง API Key ตัวเองลงไป


การตั้งค่ามีสี่ประเด็น:
- API Key: วางคีย์
nvapi-ของคุณ - ที่อยู่คำขอ: ใส่
https://integrate.api.nvidia.comอันนี้ CC Switch เติมให้แล้ว - ฟอร์แมต API: ต้องเลือก OpenAI Chat Completions (ต้องเปิด routing) ไม่เช่นนั้นฟอร์แมตคำขอจะไม่ตรงกัน
- การแมปโมเดล (สำคัญที่สุด): เอา Sonnet, Opus, Haiku ทั้งสามบทบาทแมปไปที่
z-ai/glm-5.2หมด ไม่ว่า Claude Code จะเรียกผ่านบทบาทไหน จริงๆ แล้วรันที่ GLM-5.2 ตัวเดียว
เซฟแล้ว เปิด Claude Code พิมพ์ /model คุณจะเห็นในรายการโมเดล ตำแหน่งที่เคยเขียน Sonnet 4.6 กับ Opus ตอนนี้เปลี่ยนเป็น z-ai/glm-5.2 หมดแล้ว เลือก "Custom Sonnet model" พิมพ์ hi ทดสอบดู

ทำงานแล้ว
สิ่งที่คุณได้ตอนนี้คืออินเตอร์เฟสและเวิร์กโฟลว์ Agent ของ Claude Code แบบเต็ม แต่ของที่อยู่ใต้ฮู้ดคือ GLM-5.2 ที่ NVIDIA ให้ฟรี ความสามารถแก้ไขหลายไฟล์ การทำงานอัตโนมัติ การจัดการคอนเท็กซ์ การเรียกใช้ทูลของ Claude Code ยังอยู่ครบ แค่เอนจินอนุมานถูกสลับเป็น GLM-5.2 ถ้าคุณไม่บอก คนนอกมองจากหน้าจอแยกไม่ออกเลย—เทอร์มินัลก็โชว์โลโก้ Claude Code เหมือนเดิม อินเตอร์เฟสเหมือนเดิม คำสั่ง /model เหมือนเดิม แต่ทุกคำขอในบทสนทนาวิ่งไปคลัสเตอร์ GPU ของ NVIDIA และเรียก GLM-5.2 ของจี้ผู
ใช้ Claude Code แบบปกติ ขั้นต่ำต้องเป็นแพ็กเกจ Max ที่ 100 ดอลลาร์ต่อเดือน หรือไม่ก็ไปทาง API Usage Billing จ่ายตามการใช้งาน ตอนนี้คุณใช้ API ฟรีของ NVIDIA บวกกับ CC Switch อินเตอร์เฟสเดียวกัน เวิร์กโฟลว์เดียวกัน แต่ค่าเรียกโมเดลใต้ฮู้ดคือ ศูนย์ สำหรับคนที่อยากลองเวิร์กโฟลว์ Claude Code แต่งบจำกัด นี่คือทางเลือกที่ใช้ได้จริง
🌍 ธุรกิจที่อยู่ข้างหลังคำว่าฟรี: สามชั้น โมเดลเดียวกัน
เขียนมาสามตอนแล้ว สิ่งที่ผมอยากคุยไม่ใช่แค่ GLM-5.2 ตัวเดียว เอาสามบทความมาวางข้างกัน จะเห็นโครงสร้างสามชั้นที่ชัดเจน:
- ชั้นที่หนึ่ง ชั้นแอปพลิเคชัน—Meituan กับ Alibaba ทั้งสองค่ายเอา GLM-5.2 ยัดเข้าไปในผลิตภัณฑ์ตัวเอง (CatPaw เป็น IDE, QoderWork เป็นผู้ช่วยบนเดสก์ท็อป) ใช้โมเดลฟรีดึงผู้ใช้ปลายทาง โมเดลจะดีแค่ไหน ส่วนใหญ่ขึ้นอยู่กับว่าตัวผลิตภัณฑ์ทำออกมาดีแค่ไหน
- ชั้นที่สอง ชั้นโครงสร้างพื้นฐาน—NVIDIA เอา GLM-5.2 ไปไว้บนกลุ่ม GPU คลาวด์ของตัวเอง เปิด endpoint API ฟรี ใช้พลังคอมพิวต์ฟรีดึงนักพัฒนา
- ชั้นที่สาม ชั้นโมเดล—จี้ผูเอง ปล่อย GLM-5.2 แบบเปิดหมด (สัญญาอนุญาต MIT) ให้ทุกคนเอาไปแจกจ่ายได้
สามชั้น สามตรรกะธุรกิจ สามรูปแบบของคำว่าฟรีที่ต่างกันสิ้นเชิง แต่ข้างใต้มีสิ่งเดียวที่ไหลเหมือนกัน
ทำไม NVIDIA ถึงทำเรื่องนี้? มันจะไปเป็นบริษัทโมเดลได้ยังไง ลองคิดตามดู ธุรกิจของ NVIDIA คืออะไร—มันขาย GPU ชิป AI อย่าง H200, B200 ลูกละเป็นหมื่นดอลลาร์ ลูกค้าใหญ่ที่สุดคือบริษัทที่ต้องการพลังอนุมานขนาดใหญ่ เรื่อง API ฟรีนี่ ภายนอกดูเหมือน NVIDIA เผื่อแผ่เงินให้คนอื่นรันโมเดล จริงๆ มันทำอยู่อย่างเดียว: ดึงให้นักพัฒนาเข้ามาเขียนโค้ด ทดสอบโมเดล สร้างต้นแบบ บนโครงสร้างพื้นฐานของ NVIDIA ให้มากที่สุด พอโปรเจกต์คุณรันผ่านบนแพลตฟอร์มนี้ เมื่อต้องขึ้นโปรดักชัน ทางเลือกที่เป็นธรรมชาติที่สุดคือซื้อ GPU ของ NVIDIA หรือไม่ก็ใช้บริการอนุมานแบบเสียเงินของ NVIDIA
เมื่อก่อนเรื่องแบบนี้เป็นไปไม่ได้ โมเดลสมัยก่อนปิดหมด: GPT-4 ใช้ได้แค่บนแพลตฟอร์มของ OpenAI Claude ใช้ได้แค่บนแพลตฟอร์มของ Anthropic จะใช้โมเดลของใคร ก็ต้องเข้าไปอยู่ในระบบนิเวศของคนนั้น ตอนนี้ GLM-5.2 ทำลายกฎเดิม—มันเป็นโอเพนซอร์ส สัญญาอนุญาต MIT ใครจะเอาไปใช้ก็ได้หมด เลยเห็น Meituan เอาไปทำ IDE Alibaba เอาไปทำเครื่องมือออฟฟิศ NVIDIA เอาไปทำ API ฟรีเพื่อดึงคนเข้ามา ทุกค่ายใช้โมเดลตัวเดียวกันแย่งชิงจุดเข้าของผู้ใช้ของตัวเอง แต่ไม่มีค่ายไหนเป็นเจ้าของโมเดลนี้สักค่าย
จี้ผูทำเรื่องที่ฉลาดมาก: ไม่แข่งกับบริษัทใหญ่แย่งผู้ใช้ปลายทาง แต่มาทำหน้าที่แหล่งน้ำ ใครจะเอาน้ำไปรดนาก็ได้ น้ำฟรี แต่ตราบใดที่นาของทุกคนใช้น้ำของฉัน แม่น้ำสายนี้ก็กลายเป็นโครงสร้างพื้นฐานไปแล้ว—อยากข้ามไปก็ต้องเจาะบ่อเอง นี่คือพลังจริงของโมเดลโอเพนซอร์ส: ไม่ใช่เรื่องฟรีในตัวมันเอง แต่เป็นการเปลี่ยนคู่แข่งทุกคนให้กลายเป็นช่องทางจำหน่ายของคุณ ยิ่งเปิดมากเท่าไหร่ คนอื่นยิ่งขาดคุณไม่ได้
ปี 1911 ศาลสูงสหรัฐตัดสินว่า Standard Oil เป็นผูกขาด สั่งบังคับแยกออกเป็น 34 บริษัทอิสระ ตอนนั้นวอลล์สตรีตร้องโวยวัย ทุกคนคิดว่าร็อคกี้เฟลเลอร์จบเกมไปแล้ว แต่เรื่องเหล็กคือ 34 บริษัทนั้นต่างเติบโตเป็นยักษ์ใหญ่ในวงการน้ำมัน—เอ็กซอน, มอบิล, เชฟรอน, อาโมโค ไหนๆ ก็เข้าอันดับโชคห้าร้อยของโลก ร็อคกี้เฟลเลอร์ที่ถือหุ้นตั้งต้นในบริษัทที่ถูกแยกออกไปทุกบริษัท ความมั่งคั่งส่วนตัวกลับพุ่งเป็นหลายเท่าตัวจากก่อนถูกแยก
แยกของสักอย่างออกไปให้คนอื่น บางทีไม่ใช่การสูญเสียการควบคุม แต่เป็นการปล่อยให้มันเติบโตจนกลายเป็นโครงสร้างพื้นฐานที่ทุกคนขาดไม่ได้
📝 ปิดท้าย
รีบไปสมัครที่ build.nvidia.com ก่อนที่แคมเปญจะยังไม่หมด ตอนนี้ยังไม่เสียเงิน ห้านาทีเสร็จ CC Switch ช่วยคลิกส่วนที่เหลือให้หมด
ไตรภาคฟรีของ GLM-5.2—Meituan อยู่ชั้นผลิตภัณฑ์ Alibaba อยู่ชั้นผลิตภัณฑ์ NVIDIA อยู่ชั้นโครงสร้างพื้นฐาน ลึกขึ้นทีละชั้น จะเอาชั้นไหน คุณเลือกเอง
ขั้นตอนและภาพหน้าจอในบทความนี้เป็นการทดสอบจริงโดยผู้เขียน (ข้อมูล ณ เดือนกรกฎาคม 2026); โควต้าฟรี ลิมิตอัตรา และอายุแคมเปญอาจเปลี่ยนแปลงได้ตลอดเวลา โปรดยึดหน้าทางการของ build.nvidia.com เป็นหลัก; ความเห็นในบทความนี้เป็นของผู้เขียนเท่านั้น