动察 Beating ข่าวด่วน AI NaiveAI ซึ่งก่อตั้งโดย Dai Jifeng รองศาสตราจารย์จากมหาวิทยาลัยชิงหัว ได้เปิดตัว Naive-N0.5-Flash และเปิดเผยน้ำหนักโมเดล โมเดลนี้ดัดแปลงจาก Xiaomi MiMo-V2.5 Base และเปิดซอร์สภายใต้สัญญาอนุญาต MIT
NaiveAI ยังคงสถาปัตยกรรม MoE เดิมไว้ โดยเน้นแก้ไขกลไก attention ทีมได้เปลี่ยน global attention เป็น sliding window attention และ DeepSeek sparse attention จากนั้นฝึกต่ออีก 3.25 ล้านล้าน tokens โมเดลที่ดัดแปลงแล้วรองรับ context ขนาด 1 ล้าน token โดยnative ซึ่งช่วยลดปริมาณการคำนวณเมื่อประมวลผลข้อความยาวมาก
AI ยังมีส่วนร่วมในกระบวนการวิจัยและพัฒนาด้วย โดยรับหน้าที่เขียนโค้ด ทำการทดลอง วิเคราะห์ผลลัพธ์ และปรับปรุงอย่างต่อเนื่อง ส่วนนักวิจัยรับผิดชอบกำหนดทิศทางและตัดสินใจในประเด็นสำคัญ ตัวอย่างเช่นระบบ inference NaiveRT ทีมใช้เวลา 6 วันทำการทดลองปรับปรุง 151 รอบ โดย 63 รอบถูกนำมาใช้
ความเร็ว inference สูงสุดที่ทางการประกาศคือ 2122 tok/s แต่เงื่อนไขการทดสอบค่อนข้างพิเศษ ใช้ GPU 8 ตัว ปิดโหมดคิด ไม่นับเวลาในการประมวลผล input และเลือกวินาทีที่ดีที่สุดจาก 41 คำขอ ในโหมดมาตรฐาน ความเร็วที่ทางการระบุอยู่ที่ประมาณ 50 tok/s ต่อผู้ใช้หนึ่งคน
