動察 Beating AI ข่าวด่วน GitHub เพิ่มระบบจัดเรียงโมเดลหลายตัวชื่อ HydraFusion ให้กับ Copilot โดยระบบจะประเมินก่อนว่างานควรทำอย่างไร แล้วจึงเรียกใช้โมเดลที่แตกต่างกัน
ปัจจุบันมีสามวิธี: งานง่ายส่งให้โมเดลเดียวจัดการโดยตรง งานซับซ้อนให้โมเดลต้นทุนต่ำลองก่อน หากผลไม่ผ่านเกณฑ์จึงอัปเกรดเป็นโมเดลที่แข็งแกร่งขึ้น เมื่อต้องตรวจทานซ้ำ ให้โมเดลหนึ่งทำงานก่อน จากนั้นให้โมเดลอีกตัวจากตระกูลที่ต่างกันทำหน้าที่จับผิดโดยเฉพาะ แล้วให้โมเดลแรกแก้ไข
GitHub นำไปเปรียบเทียบกับ Claude Opus 5 บนเกณฑ์มาตรฐาน Agent ด้านการเขียนโปรแกรมสามชุด TerminalBench 2.1 สูงกว่า 4.9 จุดเปอร์เซ็นต์ DeepSWE ต่ำกว่า 1.5 จุดเปอร์เซ็นต์ CheckpointBench ต่ำกว่าเพียง 0.1 จุดเปอร์เซ็นต์ ถือว่าใกล้เคียงกัน ส่วนต้นทุนลดลง 67%, 36% และ 65% ตามลำดับ
แนวคิดนี้คล้ายกับ Fugu ของ Sakana AI มาก ทั้งคู่เปลี่ยนจาก "เลือกโมเดลตัวไหน" ไปเป็น "จัดระเบียบโมเดลหลายตัวอย่างไร" ความแตกต่างคือ Fugu 本身就是โมเดลผู้บังคับบัญชาที่ผ่านการฝึกฝนมา จะเรียนรู้วิธีเรียกใช้ Agent ต่างๆ และสามารถเรียกใช้ตัวเองแบบวนซ้ำได้ ส่วน HydraFusion ยังคงเลือกจากโหมดการทำงานตายตัวสามแบบคือ Single, Cascade และ Critique 更像是นำการจัดตารางโมเดลหลายตัวใส่เข้าไปใน Copilot โดยตรง
HydraFusion เปิดให้ทดลองวิจัยกับแพ็กเกจ GitHub Copilot ทุกแบบแล้ว ขณะนี้ต้องเปิดใช้งานในฟีเจอร์ทดลองของ Copilot CLI GitHub ยังเตือนว่า ในระยะนี้เหมาะที่สุดสำหรับงานเขียนโปรแกรมแบบครั้งเดียวที่อธิบายได้ชัดเจน ส่วนงานหลายรอบระยะยาวยังอยู่ระหว่างการปรับปรุงต่อเนื่อง
