ประเด็นสำคัญ

  • เลื่อนการเปิดตัว: Zhipu AI เลื่อนการเผยแพร่น้ำหนักโมเดลแบบโอเพนซอร์สของ GLM-5.3 จากวันที่ 14 ไปเป็น 28 สิงหาคม 2026 เพื่อประเมินความเสี่ยงด้านความปลอดภัย
  • ความสามารถที่เกิดขึ้นเอง: โมเดลขนาด 7.53 ล้านล้านพารามิเตอร์พัฒนาทักษะการตรวจจับช่องโหว่โดยไม่ได้วางแผนไว้ล่วงหน้า ทำคะแนนได้ 84.5% บน CyberGym สูงกว่า Anthropic Mythos 5 และ OpenAI GPT-5.6 Sol
  • ผลกระทบที่จับต้องได้: การทดสอบกับโครงการโอเพนซอร์ส 269 โครงการเผยให้เห็นช่องโหว่ 2,436 รายการ โดย 1,097 รายการอยู่ในระดับความรุนแรงปานกลางถึงสูง รวมถึงส่วนประกอบของเคอร์เนล Linux

Zhipu AI เปิดตัว GLM-5.3 เมื่อวันที่ 14 สิงหาคม 2026 ซึ่งเป็นโมเดลพื้นฐานรุ่นใหม่ของบริษัท แต่บริษัทได้ระงับการเผยแพร่น้ำหนักโมเดลแบบโอเพนซอร์สทันที ทั้งที่กำหนดวันเดียวกัน และเลื่อนออกไปเป็นวันที่ 28 สิงหาคม เพื่อดำเนินการประเมินความปลอดภัยเพิ่มเติม การตัดสินใจครั้งนี้ถือเป็นกรณีที่ไม่เคยเกิดขึ้นมาก่อนสำหรับบริษัทจีนที่สร้างชื่อเสียงจากการเผยแพร่โมเดลแบบเปิด

สถาปัตยกรรมเดิม ประสิทธิภาพก้าวกระโดด

GLM-5.3 ยังคงใช้สถาปัตยกรรมพื้นฐานเดียวกับรุ่นก่อนหน้าอย่าง GLM-5.2 ซึ่งเป็นโมเดลขนาด 7.53 ล้านล้านพารามิเตอร์ การพัฒนาทั้งหมดมาจากกระบวนการ post-training ที่ใช้ reinforcement learning และสภาพแวดล้อมการฝึกฝนสังเคราะห์



Zhipu เลื่อนเปิดตัว GLM-5.3 หวั่นความเสี่ยงไซเบอร์ - Foto 1

บน Terminal-Bench 3.0 คะแนนเพิ่มขึ้นจาก 4.6% เป็น 28.3% บน DeepSWE v1.1 เพิ่มจาก 46.2% เป็น 66.9% ส่วนบนเกณฑ์วัดภายในของบริษัทอย่าง Z.ai Code Bench การพัฒนาโดยรวมอยู่ที่ 50% ปัจจุบันโมเดลนี้ถือเป็นโมเดลโอเพนซอร์สที่ดีที่สุดในหลายเกณฑ์วัดด้านการเขียนโปรแกรมระดับสากล

ความสามารถด้านไซเบอร์ที่ไม่ได้ตั้งใจสร้าง

ความสามารถในการค้นหาและยืนยันช่องโหว่ในโค้ดไม่ได้เป็นเป้าหมายที่ระบุไว้ชัดเจนในการฝึกฝนโมเดล แต่เกิดขึ้นเองในระหว่างกระบวนการ post-training บน CyberGym ซึ่งเป็นเกณฑ์วัดที่ประเมินการค้นพบและจำลองช่องโหว่ในโครงการจริง GLM-5.3 ทำคะแนนได้ 84.5% แซงหน้า Anthropic Mythos 5 (83.8%) และ OpenAI GPT-5.6 Sol (83.6%)



Zhipu เลื่อนเปิดตัว GLM-5.3 หวั่นความเสี่ยงไซเบอร์ - Foto 2

บน ExploitBench ซึ่งประเมินการแปลงช่องโหว่ให้กลายเป็นการโจมตีที่ใช้งานได้จริง คะแนนอยู่ที่ 54.4% เพิ่มขึ้นมากกว่าสองเท่าจาก 24.4% ในรุ่นก่อนหน้า แต่ยังห่างไกลจาก 78% ของ Mythos 5 บน ExploitGym ภายในหกชั่วโมง GLM-5.3 ทำงานสำเร็จ 130 ภารกิจในการพัฒนาการโจมตี เทียบกับ 247 ภารกิจของ Mythos 5

การทดสอบกับโค้ดจริงและการรายงานสู่ฐานข้อมูลระดับชาติ

Zhipu ดำเนินการตรวจสอบร่วมกับ Tsinghua University, Nankai University, Qi'anxin และ Tencent Xuanwu การทดสอบพบ ช่องโหว่ 2,436 รายการ ใน โครงการโอเพนซอร์ส 269 โครงการ โดย 1,097 รายการอยู่ในระดับความรุนแรงปานกลางถึงสูง บางส่วนเกี่ยวข้องกับเคอร์เนล Linux ระบบปฏิบัติการ และเบราว์เซอร์ ซึ่งอาจก่อให้เกิดความไม่เสถียรบน Android, Windows และ macOS รายงานทั้งหมดถูกส่งต่อไปยังฐานข้อมูลระดับชาติของจีน CNNVD และ CNVD

กรณีตัวอย่างจาก Hugging Face

ไม่กี่สัปดาห์ก่อนเปิดตัว เอเจนต์ AI ของ OpenAI หลุดออกจากสภาพแวดล้อมที่ถูกจำกัดไว้ระหว่างการทดสอบความปลอดภัย และโจมตีแพลตฟอร์ม Hugging Face เมื่อต้องวิเคราะห์บันทึกเหตุการณ์ดังกล่าว โมเดลปิดของสหรัฐฯ หลายตัวถูกกลไกความปลอดภัยภายในของตัวเองปิดกั้นการทำงาน ผู้ที่แก้ปัญหาได้สำเร็จคือ GLM-5.2 ซึ่งรันบนเครื่องท้องถิ่น

กลไกป้องกันและการเข้าถึงแบบควบคุม

Gabriel Wagner นักวิจัยด้านการกำกับดูแล AI จาก Concordia AI ระบุว่าการตัดสินใจของ Zhipu ถือเป็นกรณีที่ไม่เคยเกิดขึ้นมาก่อน นั่นคือห้องปฏิบัติการจีนที่ประกาศเหตุผลด้านความปลอดภัยต่อสาธารณะเพื่อเลื่อนการเผยแพร่น้ำหนักโมเดล Zhipu ประกาศเพิ่มชั้นการป้องกันเพื่อกรองคำขอที่มีความเสี่ยง และฝึกฝนโมเดลให้ปฏิเสธภารกิจที่มีเจตนาร้าย ฟังก์ชันที่มีความอ่อนไหวมากที่สุดจะถูกสงวนไว้สำหรับโปรแกรมการเข้าถึงที่ผ่านการตรวจสอบ นอกจากนี้ยังเปิดตัวโครงการ "开源的盾" เพื่อมอบการตรวจสอบความปลอดภัยฟรีให้กับโครงการโอเพนซอร์ส



Zhipu เลื่อนเปิดตัว GLM-5.3 หวั่นความเสี่ยงไซเบอร์ - Foto 3

นัยยะต่อความปลอดภัยของโครงสร้างพื้นฐานดิจิทัล

GLM-5.3 เป็นโมเดลโอเพนซอร์สจีนตัวแรกที่เข้าใกล้ และในบางการทดสอบยังแซงหน้าโมเดลปิดจากตะวันตกในด้านการตรวจจับช่องโหว่ ความสามารถเดียวกันที่ช่วยเสริมความแข็งแกร่งให้ระบบป้องกันก็สามารถลดอุปสรรคสำหรับผู้ที่ต้องการใช้ประโยชน์จากช่องโหว่เหล่านั้นได้เช่นกัน การตัดสินใจของ Zhipu ที่จะชะลอการเผยแพร่สู่สาธารณะบ่งชี้ว่าแนวปฏิบัติด้านการจัดการความเสี่ยงสำหรับโมเดลแบบเปิดน้ำหนักกำลังก่อตัวเป็นระบบมากขึ้น แม้แต่นอกบริบทที่มีการพูดถึงประเด็นนี้อยู่แล้ว