lang
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
หน้าแรก
AI
OPRR
ด่วน
ความลึก
กิจกรรม
BlockBeats Pro
เพิ่มเติม
การเงิน
พิเศษ
ระบบนิเวศบล็อกเชน
รายการ
พอดแคสต์
ข้อมูล
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%
BNB
$710
3.05%

OpenAI เสนอกรอบการทำงาน "การพิสูจน์ความปลอดภัย" สำหรับการฝึกอบรม AI ขั้นสูง แนะนำให้ผ่านเอกสารด้านความปลอดภัยก่อนเริ่มดำเนินการ

动察 Beating ข่าวด่วน AI OpenAI ได้เผยแพร่บทความยาวชื่อ 《Towards safety cases for frontier AI training》 (กรณีความปลอดภัยสำหรับการฝึก AI ชั้นแนวหน้า) ในบทความกล่าวถึงว่า การฝึกเสริมแรงแบบชั้นแนวหน้าควรจัดทำเอกสารความปลอดภัยเชิงโครงสร้างให้เสร็จสิ้นก่อนที่จะดำเนินการต่อไป โดยรูปแบบในอุดมคติเทียบเคียงกับ "กรณีความปลอดภัย" ในอุตสาหกรรมการบินและพลังงานนิวเคลียร์ บริษัท承認ว่า เนื่องจากความซับซ้อนที่เกิดขึ้นหลังจากการก้าวกระโดดของความสามารถ AI จึงเป็นเรื่องยากที่จะมีความเข้มงวดเทียบเท่ากับอุตสาหกรรมเสี่ยงสูงแบบดั้งเดิม ปัจจุบันกรอบนี้ยังอยู่ระหว่างการนำไปใช้ภายในและเปิดรับความคิดเห็นจากภายนอก OpenAI ระบุชัดเจนว่าครอบคลุมเฉพาะการฝึก RL ชั้นแนวหน้าเท่านั้น การปรับใช้ทั้งภายในและภายนอกยังต้องพิจารณาคุณสมบัติการจัดแนวที่กว้างขึ้น


ในด้านเทคนิค OpenAI แบ่งกรณีความปลอดภัยออกเป็นสามชั้น ได้แก่ การฝึกจัดแนว การแยกสภาพแวดล้อม และการเฝ้าระวัง ด้านการจัดแนวรวมถึงการตรวจสอบสภาพแวดล้อม RL แบบอัตโนมัติ/ด้วยมนุษย์ การปรับแต่งตัวให้คะแนนเพื่อป้องกันการแฮ็กรางวัล การประเมินและทดสอบย้อนหลังการจัดแนวนอกระบบ และการห้ามตัวให้คะแนนอัตโนมัติอ่านสายการคิด เพื่อป้องกันไม่ให้โมเดลเรียนรู้ที่จะหลบเลี่ยงการเฝ้าระวัง ด้านการแยกสภาพแวดล้อมเน้นการแซนด์บ็อกซ์หลายชั้นและการเสริมความแข็งแกร่งของโครงสร้างพื้นฐาน การใช้จุดตรวจสอบการฝึกสำหรับการทดสอบเรดทีม การจำกัดการสื่อสารแบนด์วิดท์สูงระหว่างตัวอย่าง และการใช้ที่จัดเก็บแบบเขียนครั้งเดียวเพื่อบันทึกบทสนทนาอย่างถาวร ด้านการเฝ้าระวังกำหนดให้โมเดลต้องสามารถตรวจสอบได้ มีความสามารถในการเรียกคืนเหตุการณ์ในอดีตสูง เพิ่มการประเมินความเสี่ยงใหม่ทันที และการแจ้งเตือนที่มีลำดับความสำคัญสูงต้องได้รับการตอบสนองจากมนุษย์ภายในเวลาที่กำหนดหรือระงับการฝึกโดยอัตโนมัติ


ด้านการดำเนินงาน ข้อเสนอแนะรวมถึง: ให้ทีมอื่นเขียนการซ้อมแย้งล่วงหน้า ผู้บริหารระดับสูง (หัวหน้าฝ่ายวิจัย หัวหน้าฝ่ายความปลอดภัย หัวหน้านักวิทยาศาสตร์ ฯลฯ) สามารถใช้สิทธิ์ยับยั้งการเริ่มฝึกได้ ผู้รับผิดชอบการฝึกต้องรับผิดชอบต่อกรณีความปลอดภัยและการตอบสนองต่อเหตุการณ์ เมื่อกรณีความปลอดภัยล้มเหลวให้ระงับตามคู่มือ เปิดเผยต่อคณะกรรมการกำกับดูแลภายใน ให้สิทธิ์ผู้ตรวจสอบในการตรวจสอบอย่างเพียงพอ กำหนดระดับความรุนแรงของการเบี่ยงเบนและอนุญาตให้เจ้าหน้าที่เวรเรียก CEO ได้ ระบบควรมีค่าเริ่มต้นเป็นปิดเมื่อล้มเหลว ไม่สามารถเริ่มฝึกได้หากไม่มีการเฝ้าระวัง และต้องสามารถย้อนกลับข้อมูลปลายน้ำและคะแนนที่ปนเปื้อนจากโมเดลที่เบี่ยงเบนได้


ด้านการสอบสวนเหตุการณ์ OpenAI เสนอแนวปฏิบัติเทียบเคียงกับการสอบสวนการบิน: แจ้งความคืบหน้าภายในระหว่างการสอบสวน ใช้การตัดทอนและการสุ่มตัวอย่างซ้ำเพื่อติดตามพลวัตการฝึก ทำการทบทวนด้านการดำเนินงานและวัฒนธรรม พัฒนาการประเมินการตรวจจับที่ไม่ปรับพอดีกับตัวอย่างเหตุการณ์โดยตรง และใช้การประเมินที่ได้จากเหตุการณ์สำหรับการทดสอบถดถอย ข้อสรุปการสอบสวน การทบทวน และการเปลี่ยนแปลงกระบวนการควรเปิดเผยต่อสาธารณะหลังเสร็จสิ้น และบุคคลที่สามที่ได้รับผลกระทบควรได้รับทราบโดยเร็วที่สุด

แก้ไข/รายงาน
ส่ง
เพิ่มคลัง
เห็นได้เฉพาะตัวเอง
สาธารณะ
บันทึก
เลือกคลัง
เพิ่มคลัง
ยกเลิก
เสร็จสิ้น