动察 Beating ข่าวด่วน AI NaiveAI ซึ่งก่อตั้งโดย Dai Jifeng รองศาสตราจารย์แห่งมหาวิทยาลัยชิงหัว เพิ่งเปิดตัวโมเดลแรก N0.5-Flash บริษัทชูจุดขาย "AI มีส่วนร่วมในการพัฒนา AI" โดยอ้างว่าโมเดลมีส่วนร่วมในการออกแบบสถาปัตยกรรม เขียนโค้ด และปรับแต่งการอนุมาน ทางการเปิดเผยว่าความเร็วสูงสุดของการอนุมานแบบ single-stream อยู่ที่ 2122 tok/s
ต่อมา Yang Xinyu นักวิจัยจาก Moonshot AI ได้ออกมาวิพากษ์วิจารณ์การโฆษณาชุดนี้ต่อสาธารณะ เขาเห็นว่า 2000 tok/s นั้นเป็นไปได้อยู่แล้ว แต่ NaiveAI เลือก baseline เปรียบเทียบที่อ่อนเกินไป มันใช้ SGLang ที่ 300 กว่า tok/s เป็นตัวอ้างอิง ทั้งที่ก่อนหน้านี้ Xiaomi ได้ทำให้ MiMo-V2.5-Pro ที่มีพารามิเตอร์มากกว่าไปถึง 1000 tok/s ขึ้นไปแล้ว เมื่อเลือก baseline ต่ำ อัตราการเพิ่มขึ้นสุดท้ายก็ย่อมดูโดดเด่นกว่า
Yang Xinyu ยังไม่ยอมรับคำอธิบายของ NaiveAI เกี่ยวกับนวัตกรรมสถาปัตยกรรม N0.5-Flash ดัดแปลงจาก Xiaomi MiMo-V2.5 Base โดยเปลี่ยน global attention เดิมเป็น DSA สุดท้าย NaiveAI ใช้ DSA + GQA Yang Xinyu เห็นว่านี่เป็นเพียงการแลกเปลี่ยนเชิงวิศวกรรมบนพื้นฐานของโมเดลฐานที่มีอยู่ อีกทั้งยังสูญเสียอัตราการใช้งาน GPU จึงไม่นับว่าเป็นความก้าวหน้าทางสถาปัตยกรรมครั้งใหญ่
เขาเห็นว่า NaiveAI พิสูจน์แล้วว่าโมเดลสามารถเร็วขึ้นได้ด้วยการฝึกต่อเนื่องและการปรับแต่งเชิงวิศวกรรม แต่ยังไม่ได้พิสูจน์ว่า "AI มีส่วนร่วมในการพัฒนา" นั้นนำมาซึ่งความก้าวหน้าที่ทีมมนุษย์ทำไม่ได้
