动察 Beating ข่าวด่วน AI สถาบันประเมิน AI ที่ไม่แสวงหากำไร ARC Prize ประกาศล่วงหน้า ARC-AGI-4 benchmark รุ่นถัดไปจะเน้นทดสอบ "นวัตกรรมแบบเปิดกว้างด้วยตนเอง" ดูว่า AI สามารถสำรวจ คิดไอเดียใหม่ ๆ และ дажеสร้างสิ่งประดิษฐ์และการค้นพบใหม่ได้หรือไม่
โจทย์เฉพาะ วิธีการให้คะแนน และวันเผยแพร่ยังไม่ประกาศ ARC Prize เพียงบอกว่ามนุษย์ยังนำ AI อย่างชัดเจนในด้านนวัตกรรมแบบเปิดกว้าง ซึ่งเป็นหนึ่งในความสามารถที่สำคัญที่สุดในการขับเคลื่อนความก้าวหน้าทางวิทยาศาสตร์และเทคโนโลยี
ประกาศล่วงหน้านี้ยังอ้างอิงบทความเรื่องการชะลอ AI ที่ Dario Amodei เพิ่งเผยแพร่ ARC Prize เน้นว่าโอเพนซอร์สยังคงเป็นพื้นฐานของความก้าวหน้า AI และคัดค้านการที่อุตสาหกรรมลดความเปิดกว้างเพื่อประสานการชะลอ และรวม AI ชั้นแนวหน้าไว้ในมือของสถาบันเพียงไม่กี่แห่ง
ARC-AGI ถูกขนานนามว่าเป็นการประเมิน AGI ที่ยากที่สุดในโลกมาโดยตลอด เมื่อ ARC-AGI-3 เผยแพร่ มนุษย์ได้คะแนน 100% ขณะที่ AI ชั้นแนวหน้าได้เพียง 0.51% GPT-6 Astra ล่าสุดตามมาใกล้ชิดมากแล้ว แต่ภายใต้ Standard harness แบบ統一ก็ได้เพียง 62.7% เมื่อเชื่อมต่อ Provider Adapter ของ OpenAI เองจึงพุ่งถึง 99.9%
ตอนนี้ ARC Prize กำลังเตรียมผลักด่านถัดไปไปสู่คำถามที่ว่า "AI สร้างนวัตกรรมด้วยตนเองได้หรือไม่"
