動察 Beating AI ข่าวด่วน หลังจากการเปิดตัว GLM-5.3 Flash ทาง Zhipu ได้ยืนยันรายละเอียดที่ไม่เคยเปิดเผยมาก่อน: ปริมาณการใช้งานทั้งหมดในช่วงการทดสอบแบบไม่ระบุชื่อของ Ox Alpha นั้นใช้พลังการประมวลผลอนุมานจากชิป AI ที่ผลิตในจีนทั้งหมด
Ox Alpha เปิดให้บริการบน OpenRouter ครบ 6 วันตามธรรมชาติเต็มรูปแบบ และประมวลผล Token ไปแล้ว 23.2 ล้านล้าน Token ซึ่งมากกว่า DeepSeek-V4-Flash ในช่วงเวลาเดียวกันถึง 2 เท่า OpenCode ก่อนหน้านี้ถึงกับกล่าวว่า ระบบเบื้องหลังมีความสามารถในการให้โควตาฟรีสูงถึง 100 ล้านล้าน Token ต่อวัน
Zhipu กล่าวว่า พวกเขาได้ปรับประสิทธิภาพการอนุมานแบบ end-to-end บนฮาร์ดแวร์จีนในประเทศเดียวกันให้ดีขึ้นถึง 3 เท่าจากเดิม และตอนนี้ประสิทธิภาพฮาร์ดแวร์และต้นทุนต่อ Token สามารถใกล้เคียงกับ GPU ของ NVIDIA กระแสหลักได้แล้ว
SemiAnalysis จงใจชี้ให้เห็นประเด็นนี้ ก่อนหน้านี้ภายนอกเห็นความสามารถในการจัดหา Token 100 ล้านล้านต่อวัน และยังคาดเดาว่าขนาดแบบนี้จะมีเพียงห้องปฏิบัติการระดับสูงและ GPU ของ NVIDIA เท่านั้นที่รองรับได้ แต่ผลปรากฏว่าตลอดทั้งกระบวนการใช้ชิปที่ผลิตในจีนล้วนๆ
