动察 Beating ข่าวด่วน AI บริษัทสตาร์ทอัพด้าน AI Reflection ที่ได้รับการสนับสนุนจาก NVIDIA เปิดตัวโมเดลน้ำหนักเปิดตัวแรก Beam โดยใช้สถาปัตยกรรม MoE มีพารามิเตอร์รวม 5.01 แสนล้าน เปิดใช้งานเพียง 2.3 หมื่นล้านต่อครั้ง เน้นงานด้านโค้ด การอนุมาน และ Agent
จากผลการทดสอบที่ Reflection เปิดเผยเอง Beam มีประสิทธิภาพโดยรวมใกล้เคียง GLM-5.2 แต่ยังตามหลังโมเดลโอเพนซอร์สชั้นนำล่าสุดของจีนอยู่ ใน DeepSWE Beam ได้คะแนน 44.4 ขณะที่ GLM-5.2 ได้ 44.0 Qwen 3.8-Max ได้ 51.0 ส่วน GLM-5.3, Kimi K3 และ DeepSeek V4.1 Flash ได้ 61.0, 68.0 และ 74.2 ตามลำดับ
ขนาดการฝึกของ Beam ก็ใหญ่มาก การฝึกก่อนกำหนดใช้ NVIDIA GB300 จำนวน 6,144 ตัว ประมวลผล 23.8 ล้านล้านโทเค็นภายในไม่ถึง 4 สัปดาห์ จากนั้นใช้ GB300 จำนวน 10,500 ตัวทำ reinforcement learning ต่อเนื่อง 4 สัปดาห์ สร้างเส้นทางการฝึก (rollout) มากกว่า 100 ล้านรายการ ทางบริษัทกล่าวว่านี่เป็นหนึ่งในการฝึก reinforcement learning ที่มีขนาดใหญ่ที่สุดเท่าที่เคยมีบันทึกสาธารณะ
ปัจจุบัน Beam ยังอยู่ในขั้นตอนการทดสอบความปลอดภัยขั้นสุดท้าย มีเพียงผู้ใช้จำนวนน้อยที่สามารถใช้งานล่วงหน้าได้ Reflection วางแผนจะเผยแพร่น้ำหนักเต็ม รายงานทางเทคนิค และ model card ภายในช่วงปลายเดือนนี้ ภายใต้สัญญาอนุญาต Apache 2.0
