动察 Beating AI ข่าวด่วน,智谱เปิดเผยว่า บริษัทได้บรรลุการอนุมานต้นทุนต่ำในระดับ规模化ด้วยชิปในประเทศจำนวน 100,000 ตัว โดยต้นทุนการอนุมานต่อ Token ลดลง 80% เมื่อเทียบกับต้นปี
พลังประมวลผลในประเทศชุดนี้ผ่านการทดสอบแรงดันด้วยปริมาณการใช้งานจริงมาก่อนหน้านี้แล้ว ก่อนการเปิดตัว GLM-5.3-Flash ได้ถูกนำขึ้นบน OpenRouter และ OpenCode แบบไม่ระบุชื่อภายใต้ชื่อ Ox-Alpha โดยปริมาณการเรียกใช้ Token สูงถึง 62 ล้านล้าน หลังจากการเปิดตัวอย่างเป็นทางการ ปริมาณการใช้งานออนไลน์ทั้งหมดยังคงถูกดำเนินการโดยชิปในประเทศจำนวน 100,000 ตัว
