动察 Beating ข่าวด่วน AI Anthropic เริ่มดำเนินการ "การประเมินแบบฝังตัว" อย่างเป็นทางการแล้ว บริษัท AI ชื่อ Faculty ในเครือ Accenture จะส่งบุคลากรเข้าไปภายใน Anthropic เพื่อประเมินและทดสอบแบบ red team ตัวโมเดล ทำการประเมินด้าน alignment และตรวจสอบมาตรการความปลอดภัย
สิ่งนี้แตกต่างอย่างมากจากการประเมินภายนอกทั่วไป ผู้ประเมินจะได้รับสิทธิ์ใกล้เคียงกับพนักงาน สามารถดูกระบวนการฝึกโมเดล เข้าใจการตัดสินใจด้านการพัฒนาและการนำไปใช้งาน และยังสามารถสื่อสารกับพนักงานภายในได้โดยตรง
ทั้งสองฝ่ายจะลงทุนฝ่ายละอย่างน้อย 1 พันล้านดอลลาร์ในช่วงห้าปีข้างหน้าเพื่อสร้างความสามารถในการประเมินนี้ Anthropic ยังยอมรับว่าปัจจุบันทั้งอุตสาหกรรมยังไม่มีกฎเกณฑ์ที่เป็นเอกภาพ ว่าผู้ประเมินจะดูอะไรได้บ้าง ผลลัพธ์จะเปิดเผยอย่างไร ใครจะเป็นผู้ออกค่าใช้จ่าย ล้วนยังอยู่ระหว่างการกำหนด ปัจจุบันงานประเมินของ Accenture ได้รับเงินจ่ายตรงจาก Anthropic
แต่ Accenture เองก็เป็นพันธมิตรเชิงกลยุทธ์ระยะยาวของ Anthropic และยังได้จัดตั้ง Anthropic Business Group ขึ้นโดยเฉพาะ เพื่อฝึกอบรมคนราว 3 หมื่นคนให้ใช้ Claude หนึ่งในเงื่อนไขขั้นต่ำที่ AI Evaluator Forum เสนอในวันเดียวกัน ก็คือ หน่วยงานประเมินไม่ควรมีความสัมพันธ์ทางธุรกิจที่สำคัญกับบริษัทที่ถูกประเมิน
หลังจากนี้ Anthropic จะนำหน่วยงานประเมินอื่นเข้ามาเพิ่มเติม และกำลังเจรจาทดลองนำร่องกับองค์กรไม่แสวงหากำไรอย่าง METR (ซึ่งก็เป็นพันธมิตรเก่าของ Anthropic เช่นกัน)
