ตามการติดตามของ Beating โมเดลเรือธง MoE ล่าสุดของ Zhipu AI อย่าง GLM-5.2 ทำคะแนนได้ 51 คะแนนในการประเมิน Artificial Analysis Large Model Intelligence Index v4.1 เอาชนะ MiniMax-M3 (44 คะแนน), DeepSeek V4 Pro (max, 44 คะแนน) และ Kimi K2.6 (43 คะแนน) ขึ้นแท่นอันดับหนึ่งของโมเดลโอเพนซอร์สระดับโลก
ในการทดสอบ GDPval-AA v2 ที่จำลองการทำงานด้านความรู้ในโลกจริง GLM-5.2 ได้ 1524 คะแนน (เกณฑ์มาตรฐานมนุษย์ 1000 คะแนน) นำหน้า MiniMax-M3 (1418 คะแนน) และ DeepSeek V4 Pro (max, 1328 คะแนน) เทียบเท่ากับโมเดลปิดชั้นนำอย่าง GPT-5.5 (xhigh reasoning) เมื่อเทียบกับรุ่นก่อนหน้า GLM-5.1 การให้เหตุผลทางวิทยาศาสตร์ CritPt เพิ่มขึ้น 16 จุดเปอร์เซ็นต์เป็น 21%, HLE เพิ่มขึ้น 12 จุดเปอร์เซ็นต์เป็น 40%, TerminalBench v2.1 เพิ่มขึ้น 16 จุดเปอร์เซ็นต์เป็น 78% และ GPQA Diamond ถึง 89%
GLM-5.2 ครองตำแหน่งความคุ้มค่าที่ดีที่สุดในแนวหน้าพาเรโตของ "ความฉลาด - ต้นทุนงาน" เนื่องจากผลลัพธ์เฉลี่ยต่องานอยู่ที่ 43k token (GLM-5.1 อยู่ที่ 26k) ต้นทุนเฉลี่ยต่องานของ GLM-5.2 จึงเพิ่มขึ้นเป็นประมาณ 0.46 ดอลลาร์ สูงกว่า GLM-5.1 (0.25 ดอลลาร์) และ DeepSeek V4 Pro (max, 0.05 ดอลลาร์) แต่ยังคงต่ำกว่าโมเดลปิดในกลุ่มความฉลาดเดียวกันอย่างมาก
GLM-5.2 มีพารามิเตอร์รวม 744B พารามิเตอร์ที่เปิดใช้งาน 40B หน้าต่างบริบทเพิ่มขึ้นจาก 200K ในรุ่นก่อนเป็น 1M เปิดเผยภายใต้สัญญาอนุญาต MIT ปัจจุบัน API อย่างเป็นทางการของ Zhipu (ราคาอินพุต 1.4 เอาต์พุต 4.4 / ต่อล้าน token) และแพลตฟอร์มต่างๆ เช่น SiliconFlow, DeepInfra, Nebius AI ได้เปิดให้บริการแล้ว
