动察 Beating ข่าวด่วน AI ทีมวิจัยของ Google เปิดตัว Dream-RSI ให้ AI Agent หลังจากทำงานครบหนึ่งรอบแล้ว นำความสำเร็จและความล้มเหลวที่ผ่านมามา "ฝัน" ระบบจะบันทึกทุกครั้งที่ลองและผลลัพธ์ จากนั้นใช้บันทึกเก่าเหล่านี้จำลองวิธีการที่แตกต่างออกไป เช่น จะลองเส้นทางไหนก่อน จะยอมแพ้เมื่อไหร่ ควรลองหลายวิธีพร้อมกันหรือไม่ เพราะผลลัพธ์เคยรันมาก่อนแล้ว การจำลองเหล่านี้จึงไม่ต้องรันงานใหม่
ระบบจะเลือกวิธีการที่ได้ผลดีกว่าจากการจำลองนั้น นำไปใช้ในรอบถัดไปโดยตรง รอบใหม่ก็จะทิ้งความสำเร็จและความล้มเหลวเพิ่มขึ้นอีก นำมา "ฝัน" ต่อและปรับกลยุทธ์ไปเรื่อยๆ วนซ้ำแบบนี้ทีละรอบ คือสิ่งที่論文เรียกว่า "การปรับปรุงตนเองแบบเวียนเกิด" ปัจจุบันโมเดลพื้นฐานยังไม่เปลี่ยนแปลง สิ่งที่ถูกปรับปรุงจริงๆ คือวิธีการ "ก้าวต่อไปทำอย่างไร" ของ Agent
論文ทดสอบวิธีนี้บน 8 งาน เช่น อัลกอริทึม การปรับให้เหมาะสมทางคณิตศาสตร์ และ GPU kernel ยกตัวอย่างงานอัลกอริทึมหนึ่งของ Gemini 3.1 Pro เมื่อเทียบกับวิธีแบบคงที่ จำนวนครั้งที่ Agent เรียกใช้ลดจาก 550 ครั้งเหลือ 317 ครั้ง ขณะเดียวกันโปรแกรมที่หาได้ในที่สุดก็รันได้เร็วขึ้น
