动察 Beating ข่าวด่วน AI ตามรายงานของ Wall Street Journal OpenAI ตัดสินใจยกเลิกการเปิดตัวโมเดล AI รุ่นถัดไป GPT-6.1 Astra ต่อสาธารณะ เนื่องจากการทดสอบภายในพบปัญหาด้านความปลอดภัยและการจัดแนว โมเดลดังกล่าวเดิมมีแผนเปิดตัวบน ChatGPT และ Codex ในเดือนตุลาคม โดยมีความสามารถเหนือกว่าโมเดลก่อนหน้าในการทำงานแบบ end-to-end ที่ซับซ้อนโดยไม่ต้องมีมนุษย์ช่วยเหลือ และด้านการเขียน
Saachi Jain หัวหน้าฝ่ายระบบความปลอดภัยของ OpenAI กล่าวว่า เมื่อเทียบกับ GPT-6 Astra แล้ว GPT-6.1 Astra มีความถดถอยในการทดสอบสองรายการ รายการแรกคือพฤติกรรมการหลอกลวงเพิ่มขึ้น โมเดลบางครั้งไม่สามารถแจ้งผู้ใช้ตามความเป็นจริงได้ว่าตนได้ดำเนินการหรือไม่ได้ดำเนินการใดไปบ้าง รายการที่สองคือปัญหาขอบเขตการมอบอำนาจงาน โมเดลอาจดำเนินการต่อโดยไม่ได้รับอนุญาตจากผู้ใช้ หรือแม้กระทั่งเรียกใช้เครื่องมือและบริการภายนอกที่มีความเสี่ยงด้านความปลอดภัย
แม้ว่า GPT-6.1 Astra จะปรับปรุงในด้านการลด "ความเกียจคร้านของโมเดล" แต่ก็ยังไม่ถึงมาตรฐานความปลอดภัยและการจัดแนวของ OpenAI บริษัทจะสอบสวนต้นตอของปัญหา ตรวจสอบว่าสภาพแวดล้อมการเรียนรู้แบบเสริมกำลังให้รางวัลกับพฤติกรรมที่ถูกต้องหรือไม่ และอาจทำการฝึกการเรียนรู้แบบเสริมกำลังเพิ่มเติมบนพื้นฐานโมเดลเดียวกัน เพื่อใช้พัฒนาโมเดลซีรีส์ GPT-6 ในลำดับถัดไป นอกจากนี้ OpenAI ยังเพิ่งเปิดตัวระบบเฝ้าระวังใหม่ และกำหนดให้นักวิศวกรใช้มาตรการป้องกันความปลอดภัยที่เข้มงวดยิ่งขึ้นในการทดสอบระบบ AI
