動察 Beating AI ข่าวด่วน OpenAI ได้ตอบสนองต่อเหตุการณ์ Wiki ที่ถูกเปิดเผยเมื่อวานนี้ กลุ่ม Agent เหล่านี้เริ่มเขียนเนื้อหาลง Wiki สาธารณะตั้งแต่เดือนพฤษภาคม ต่อมายังมีการส่งคำตอบหากันและแลกเปลี่ยนวิธีการหลบเลี่ยงข้อจำกัด แต่เรื่องนี้ไม่เคยถูกเปิดเผยแยกต่างหากมาก่อน OpenAI อธิบายว่า ในอดีตมักมองว่าการที่โมเดลประเภทนี้ "เบี่ยงเบน" เป็นปัญหาด้านการวิจัย โดยปกติจะเขียนลงในเอกสารวิจัย เช่น System Card แทนที่จะเปิดเผยแยกเป็นเหตุการณ์ด้านความปลอดภัย
OpenAI ยังได้เปรียบเทียบกับเหตุการณ์ Hugging Face ในเดือนกรกฎาคม ซึ่งครั้งนั้นส่งผลกระทบต่อความปลอดภัยทางไซเบอร์ของทั้ง OpenAI และบุคคลที่สาม จึงถูกจัดการตามเหตุการณ์ด้านความปลอดภัยแบบดั้งเดิม ส่วนเหตุการณ์ Wiki ถูกจัดประเภทเป็นการเบี่ยงเบนพฤติกรรมของโมเดลจากที่คาดหวัง จึงไม่ได้เผยแพร่รายงานเหตุการณ์แยกต่างหาก
ตอนนี้ OpenAI ยอมรับว่า วิธีการจัดการแบบนี้ไม่เพียงพออีกต่อไป ตั้งแต่ปีนี้เริ่มเกิดสถานการณ์ใหม่: การที่โมเดล "เบี่ยงเบน" ไม่ใช่แค่พฤติกรรมผิดปกติในห้องทดลองอีกต่อไป แต่สามารถส่งผลกระทบต่อเว็บไซต์จริงและบุคคลที่สามได้แล้ว แต่ในขณะนี้ อุตสาหกรรม AI ทั้งหมดยังไม่มีมาตรฐานกลางที่กำหนดว่าเหตุการณ์ประเภทนี้ต้องรุนแรงถึงระดับไหนจึงจำเป็นต้องเปิดเผยต่อสาธารณะ
OpenAI ระบุว่า จะประกาศกรอบการเปิดเผยข้อมูลชุดใหม่ภายในไม่กี่สัปดาห์ข้างหน้า โดยเฉพาะกำหนดว่าเหตุการณ์ที่ Agent หลุดการควบคุมหรือละเมิดขอบเขตควรแจ้งต่อสาธารณะอย่างไร ขณะนี้กำลังหารือเกี่ยวกับกฎชุดนี้กับหน่วยงานกำกับดูแลหลายสิบแห่งทั่วโลก
