Z.ai ซึ่งเป็นห้องปฏิบัติการ AI ของจีนที่เดิมรู้จักกันในชื่อ Zhipu AI ได้เปิดตัวรุ่น GLM-5.3 เต็มรูปแบบบน Hugging Face ซึ่งเปลี่ยนหนึ่งในโมเดลการเข้ารหัสและตัวแทนที่แข็งแกร่งที่สุดให้ดาวน์โหลดฟรี การเปิดตัวเผยแพร่เผยแพร่เผยแพร่เมื่อวันที่ 28 สิงหาคม เพียงไม่กี่วันหลังจากที่ห้องปฏิบัติการยืนยันว่าโมเดลการลักลอบของไวรัสที่เรียกว่า "Ox Alpha" แท้จริงแล้วนั้นเป็น GLM-5.3-Flash ของตัวเอง และเป็นไปตามคำสัญญาแบบ open-weights ที่มีชุมชนจับตาดูอย่างใกล้ชิดตลอดทั้งสัปดาห์

หน้าโมเดลรวบรวมยอดไลค์มากกว่า 1,100 ครั้งอย่างรวดเร็ว และกระทู้ Hacker News ที่ประกาศการเปิดตัวพุ่งทะลุ 600 คะแนน ในขณะที่นักพัฒนาแยกแยะสิ่งที่ขณะนี้อยู่ในพื้นที่เก็บข้อมูลสาธารณะ: ไฟล์เซฟเทนเซอร์ 141 ไฟล์ ซึ่งจัดส่งใน FP8 ซึ่งประกอบด้วยโมเดลการเข้ารหัสที่สามารถดาวน์โหลดได้อย่างเปิดเผยที่มีความสามารถมากที่สุดในปัจจุบัน For more context on this story, see our ongoing AI news.

สิ่งที่ Z.ai ส่งมาจริง

GLM-5.3 เป็นโมเดล Mixture-of-Experts ที่สร้างขึ้นบนสถาปัตยกรรมที่ Z.ai เรียกว่า glm_moe_dsa ตามการกำหนดค่าที่เผยแพร่ควบคู่ไปกับน้ำหนัก เครือข่ายจะซ้อนกัน 78 เลเยอร์โดยมีผู้เชี่ยวชาญที่กำหนดเส้นทาง 256 คน โดยเปิดใช้งานผู้เชี่ยวชาญ 8 คนต่อโทเค็น บวกกับผู้เชี่ยวชาญที่แชร์อีกหนึ่งคน หน้าต่างบริบทครอบคลุม 1,048,576 โทเค็น — หนึ่งล้าน — และโมเดลรองรับพารามิเตอร์ "reasoning_effort" ด้วยการตั้งค่าต่ำ สูง และสูงสุด โดยค่าเริ่มต้นเป็นสูงสุด

บางทีข้อความที่น่าสนใจที่สุดในการ์ดโมเดลก็คือความชัดเจนว่าการปรับปรุงมาจากไหน: GLM-5.3 ใช้โมเดลพื้นฐานแบบเดียวกับ GLM-5.2 และประโยชน์ที่ได้รับทั้งหมดมาจากหลังการฝึกอบรม ห้องปฏิบัติการอธิบายผลลัพธ์อย่างชัดเจนว่าเป็น "แบบจำลอง open-weights ที่มีความสามารถมากที่สุดสำหรับการเข้ารหัส"

เกณฑ์มาตรฐาน: SOTA แบบ Open-Weights บน Agentic Coding

ตารางประเมินผลที่เผยแพร่นั้นกว้างขวางและเจาะจงเป็นพิเศษเกี่ยวกับวิธีการ โดยแสดงรายการผลลัพธ์เทียบกับ Kimi K3, DeepSeek-V4 Pro-0813, Qwen3.8-Max, Opus 4.8 ของ Anthropic, Fable 5 ของ Google และ GPT-5.6 Sol ของ OpenAI

บน Terminal Bench 3.0 GLM-5.3 ได้คะแนน 28.3 ซึ่งเป็นโอเพ่นซอร์สที่ทันสมัย ​​และเพิ่มขึ้นจาก 4.6 สำหรับ GLM-5.2 แม้ว่าจะยังตามหลังขอบเขตปิดของ Fable 5 ที่ 33.7 และ GPT-5.6 Sol ที่ 34.6 บน Terminal Bench 2.1 มันโพสต์ 88.2 โดยพื้นฐานแล้วอยู่ในระดับเดียวกับ Kimi K3 และ GPT-5.6 Sol และนำหน้า Opus 4.8's 85.0 ผลลัพธ์ของ DeepSWE เพิ่มขึ้นจาก 46.2 เป็น 66.9 ระหว่างเวอร์ชันต่างๆ และ GLM-5.3 อยู่ในอันดับต้นๆ ของตารางบน AutomationBench ที่ 48.2 และบน GDPval-AA v2 ที่ 1769 ซึ่งอย่างหลังประเมินโดย Artificial Analysis

Z.ai ยังรายงานการปรับปรุง 50% เมื่อเทียบกับ GLM-5.2 บน Code Bench ภายในของบริษัท ควบคู่ไปกับผลลัพธ์ที่ดีที่สุดใน Open Weights บนการวัดประสิทธิภาพ เช่น การสอบครั้งสุดท้ายของตัวแทน

คำถามเกี่ยวกับความสามารถทางไซเบอร์

การ์ดโมเดลนี้ตรงไปตรงมาอย่างน่าทึ่งเกี่ยวกับการพัฒนาที่นักวิจัยด้านความปลอดภัยติดตามมาเป็นเวลาหลายเดือน: "ในขณะที่เราปรับขนาดหลังการฝึกอบรม ความสามารถทางไซเบอร์ก็พัฒนาเร็วกว่าที่เราคาดไว้" การ์ดระบุ GLM-5.3 คือสิ่งล้ำสมัยบน CyberGym สำหรับการค้นพบช่องโหว่ที่ 84.5 ซึ่งเหนือกว่าทุกรุ่นบนโต๊ะ รวมถึง GPT-5.6 Sol และมันมากกว่า GLM-5.2 มากกว่าสองเท่าบนเกณฑ์มาตรฐานการแสวงหาผลประโยชน์ — 54.4 เทียบกับ 24.4 บน ExploitBench และ 105/130 เทียบกับ 29/39 ในงบประมาณสองครั้งของ ExploitGym

AI Buzz Wire ครอบคลุมความสามารถเหล่านี้เมื่อมีการเปิดตัวเฉพาะ API ในช่วงกลางเดือนสิงหาคม สิ่งที่เปลี่ยนแปลงในขณะนี้คือการเผยแพร่: สามารถดาวน์โหลดน้ำหนักได้ การสร้างชุมชนเชิงปริมาณมีแนวโน้มที่จะติดตามอย่างรวดเร็ว และใครก็ตามที่มีหน่วยความจำเพียงพอสามารถเรียกใช้โมเดลในเครื่องได้ ในการสนทนาของ Hacker News ผู้ใช้บางคนตั้งข้อสังเกตว่าโมเดลนี้รู้สึกว่ามีข้อจำกัดน้อยกว่าในงานที่เกี่ยวข้องกับการรักษาความปลอดภัยมากกว่าทางเลือกอื่นที่โฮสต์โดยสหรัฐอเมริกา — การแสดงผลของชุมชนมากกว่าการอ้างนโยบายอย่างเป็นทางการ แต่สะท้อนให้เห็นว่าเหตุใดรุ่นนี้จึงถูกพูดถึงในแวดวงความปลอดภัยมากพอ ๆ กับนักพัฒนา

ใบอนุญาตมุ่งเป้าไปที่ Hyperscalers

ต่างจาก GLM-5.3-Flash ซึ่งจัดส่งภายใต้ใบอนุญาต MIT ที่สะอาด GLM-5.3 มาพร้อมกับ "ใบอนุญาต GLM-5.3" แบบกำหนดเอง New Stack ระบุว่าเป็นการมุ่งเป้าไปที่ไฮเปอร์สเกลเลอร์ และข้อความก็แสดงสิ่งนั้น สำหรับเกือบทุกคน ข้อกำหนดนี้ได้รับอนุญาตอย่างมีประสิทธิภาพ: ใช้ คัดลอก แก้ไข ผสาน เผยแพร่ แจกจ่าย ให้อนุญาตช่วง และขาย โดยมีเพียงข้อกำหนดให้รวมประกาศด้วย

ข้อยกเว้นมุ่งเป้าไปที่โมเดลธุรกิจเฉพาะรูปแบบหนึ่ง หากผู้รับอนุญาตหรือบริษัทในเครือดำเนินธุรกิจ "โมเดลเป็นบริการ" โดยเสนอการอนุมานหรือการเข้าถึงการปรับแต่งโดยบุคคลที่สาม และมีรายได้รวมเกินกว่า 1 หมื่นล้านดอลลาร์ในช่วง 12 เดือนติดต่อกัน พวกเขาจะต้องผ่านการตรวจสอบความปลอดภัยของ Z.ai ก่อนที่จะใช้โมเดลหรืออนุพันธ์ในเชิงพาณิชย์ ข้อดังกล่าวลากวงกลมล้อมรอบผู้ให้บริการคลาวด์รายใหญ่ที่สุด ขณะเดียวกันก็ปล่อยให้สตาร์ทอัพ นักวิจัย องค์กร และโฮสต์ระดับกลางไม่ถูกแตะต้อง

แนวทางแบบสองทางกำลังบอกอยู่ ตัวแปร Flash ซึ่งปัจจุบันเปิดเผยว่าเป็นรุ่น Ox Alpha ที่แพร่ระบาดก่อนที่ TechCrunch จะเปิดเผยต้นกำเนิดของมัน ทำงานบนซิลิคอนของจีนทั้งหมดและมีธง MIT เพื่อการนำไปใช้สูงสุด เรือธงได้รับใบอนุญาตตามความต้องการที่ช่วยให้การใช้งานไฮเปอร์สเกลเลอร์โดยเฉพาะโดยระบบคลาวด์ของอเมริกา อยู่ภายใต้กระบวนการตรวจสอบของ Z.ai

ดำเนินการด้วยตัวคุณเอง

สำหรับผู้ที่อยากลองใช้ การ์ดโมเดลจะแสดงรายการการสนับสนุนการปรับใช้งานใน vLLM, SGLang, KTransformers, Unsloth และ Hugging Face Transformers พร้อมด้วยสูตรตำราอาหารสำหรับหลายๆ สูตร ที่น่าสังเกตคือ การใช้งาน Huawei Ascend NPU ได้รับการบันทึกผ่าน vLLM-Ascend, xLLM และ SGLang ซึ่งเป็นการสานต่อความพยายามของห้องปฏิบัติการเพื่อพิสูจน์ว่าโมเดลระดับแนวหน้าทำงานบนฮาร์ดแวร์ที่ไม่ใช่ NVIDIA ในชุมชน DeepInfra เป็นคนแรกที่เสนอจุดสิ้นสุดของบุคคลที่สามของโมเดลเปิดบน OpenRouter

นอกจากนี้ Z.ai ยังตีพิมพ์รายงานทางเทคนิคเกี่ยวกับ arXiv ในหัวข้อ "GLM-5: จาก Vibe Coding ไปจนถึง Agentic Engineering" ซึ่งครอบคลุมการพัฒนากลุ่มผลิตภัณฑ์โมเดล

ทำไมมันถึงสำคัญ

การเปิดตัวจะบีบอัดช่องว่างระหว่างพรมแดนแบบปิดและพรมแดนแบบเปิดจนเกิดข้อผิดพลาดในการปัดเศษในการวัดประสิทธิภาพการเข้ารหัสเอเจนต์หลายรายการ — สัปดาห์ ไม่ใช่หลายปี เมื่อใช้ร่วมกับ Kimi K3 และ DeepSeek-V4 หมายความว่านักพัฒนาที่อยู่นอกห้องปฏิบัติการที่ใหญ่ที่สุดจะมีทางเลือกที่น่าเชื่อถือที่พวกเขาสามารถเป็นเจ้าของ ตรวจสอบ และปรับแต่งได้

นอกจากนี้ยังส่งสัญญาณถึงการเปลี่ยนแปลงในการควบคุมการเผยแพร่แบบเปิดอีกด้วย การแยกใบอนุญาตของ MIT-vs-custom-license ภายในตระกูลโมเดลเดียว ชี้ให้เห็นว่าห้องปฏิบัติการของจีนกำลังเรียนรู้ที่จะใช้ใบอนุญาตเป็นโครงสร้างพื้นฐานเชิงกลยุทธ์: ความเปิดกว้างที่มันสร้างระบบนิเวศ ใช้ประโยชน์จากจุดที่มันปกป้องตำแหน่ง การทดสอบครั้งต่อไปคือว่าผู้ให้บริการ MaaS ที่มีมูลค่ามากกว่า 1 หมื่นล้านดอลลาร์ส่งเข้ารับการตรวจสอบความปลอดภัยของ Z.ai จริงหรือไม่ หรือข้อกำหนดดังกล่าวจะป้องกันคลาวด์ที่ใหญ่ที่สุดในขณะที่คนอื่นสร้างไว้ด้านบนหรือไม่

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →