动察 Beating ข่าวด่วน AI เอกสารภายในที่ 404 Media ได้รับแสดงให้เห็นว่า OpenAI กำลังดำเนินโครงการภายใต้ชื่อรหัส «Project Lily» โดยให้พนักงานoutsource หลายร้อยคนอ่านบทสนทนาจริงระหว่างผู้ใช้กับ ChatGPT เพื่อนำไปฝึกและปรับปรุงโมเดล ผู้ตรวจสอบไม่เห็นชื่อผู้ใช้ แต่อาจเห็นบทสนทนาทั้งหมด บางงานยังแนบ «สรุปความจำ» ของผู้ใช้ ซึ่งรวมถึงสิ่งที่เคยคุยกันก่อนหน้าและข้อมูลว่าอาจอาศัยอยู่ที่ไหน
คนเหล่านี้จะสรุปก่อนว่าผู้ใช้ต้องการทำอะไร จากนั้นเปรียบเทียบคำตอบหลายเวอร์ชันที่ ChatGPT สร้างขึ้น และให้คะแนนตั้งแต่ 1 ถึง 7 จุดที่ตรวจสอบเน้นได้แก่ ข้อเท็จจริงถูกต้องหรือไม่ มีการคล้อยตามผู้ใช้มากเกินไปหรือไม่ และ ChatGPT พูดถึงตัวเองเหมือนมนุษย์มากเกินไปหรือไม่
OpenAI จะใช้ Privacy Filter ลบชื่อ ข้อมูลติดต่อ และข้อมูลส่วนบุคคลอื่น ๆ ก่อน แต่ทางบริษัทก็ยอมรับว่าโมเดลนี้อาจพลาดข้อมูลระบุตัวตนที่ไม่常見และข้อมูลส่วนตัวที่คลุมเครือ เนื้อหาที่ละเอียดอ่อนบางส่วนยังอาจปรากฏต่อหน้าผู้ตรวจสอบได้
ไม่ใช่ทุกบทสนทนา ChatGPT จะถูกอ่านโดยมนุษย์ เวอร์ชันส่วนบุคคล Free, Plus และ Pro เปิด «ปรับปรุงโมเดลสำหรับผู้ใช้ทุกคน» เป็นค่าเริ่มต้น เมื่อผู้ใช้ปิด บทสนทนาใหม่จะไม่ถูกนำไปใช้ฝึกอีก ส่วน Business, Enterprise และ Edu ไม่ถูกนำไปใช้ฝึกเป็นค่าเริ่มต้น
