เป็นจริงส่วนใหญ่
OpenAI เปิดเผยว่าจะรายงานสถานการณ์ AI ที่ "หลุดการควบคุม" (misalignment) ออกมาเป็นประจำ พร้อมเสริมความเข้มงวดในการเฝ้าระวังพฤติกรรมผิดปกติของโมเดล AI ซึ่งถือเป็นมาตรการด้านความปลอดภัยที่มีเป้าหมายเพื่อให้สาธารณะติดตามความเสี่ยงของ AI ได้โดยตรง
รายงานดังกล่าวเป็นส่วนหนึ่งของกรอบการรายงานความไม่สอดคล้องของโมเดล (model misalignment reporting framework) ของ OpenAI ที่เผยแพร่สู่สาธารณะ โดยบริษัทระบุว่าจะเปิดเผยข้อมูลเกี่ยวกับพฤติกรรมผิดปกติหรือพฤติกรรมที่เบี่ยงเบนจากที่ออกแบบไว้ของโมเดล AI อย่างสม่ำเสมอ ผ่านช่องทางที่เผยแพร่ต่อสาธารณะ
ประเด็นหลักของมาตรการนี้คือการเสริมความแข็งแกร่งให้ระบบเฝ้าระวัง (monitoring) เพื่อตรวจจับกรณีที่โมเดล AI แสดงพฤติกรรมที่ไม่เป็นไปตามที่พัฒนาโมเดลไว้ ซึ่งสะท้อนความกังวลที่ขยายตัวในอุตสาหกรรม AI เรื่องความเสี่ยงจากโมเดลขนาดใหญ่ที่อาจหลุดจากการควบคุม
อย่างไรก็ตาม รายละเอียดเชิงเทคนิค เช่น เกณฑ์การประเมิน ความถี่การเผยแพร่ และผลการตรวจพบในแต่ละรอบ ยังไม่ได้รับการยืนยันอย่างชัดเจนจากข้อมูลที่เปิดเผย ณ ขณะนี้
การที่ OpenAI เลือกเปิดเผยข้อมูล "AI หลุดการควบคุม" เป็นประจำและเร่งเฝ้าระวังพฤติกรรมผิดปกติของโมเดล สอดคล้องกับหลักฐานที่มีการเผยแพร่จากแหล่งข้อมูลหลัก ข้อเรียกร้องดังกล่าวจึงถือว่าเป็นจริงส่วนใหญ่