เป็นจริงส่วนใหญ่
ข้อกังขาว่าบริษัท AI นำบทสนทนาของผู้ใช้ไปใช้ฝึกโมเดลโดยไม่ได้รับอนุญาตถูกยกขึ้นกล่าวถึงเป็นระยะ โดยการสอบทานแหล่งข้อมูลหลักจำนวน 12 แหล่งชี้ว่าข้อกล่าวอ้างดังกล่าวเป็นจริงเป็นส่วนใหญ่
กรณีที่ว่าผู้ให้บริการ AI รวบรวมบทสนทนาของผู้ใช้เพื่อนำไปฝึกแบบจำลองภาษาขนาดใหญ่ (LLM) โดยไม่แจ้งให้ผู้ใช้ทราบอย่างชัดเจน ถูกหยิบยกขึ้นเป็นครั้งคราวต่อเนื่องกัน ข้อกังขาดังกล่าวสะท้อนความกังวลที่เพิ่มขึ้นเรื่อยๆ ของผู้ใช้เกี่ยวกับสิทธิ์ในข้อมูลส่วนบุคคลและความโปร่งใสในกระบวนการฝึกโมเดลของบริษัท AI
ประเด็นหลักที่ถูกตั้งคำถามคือผู้ใช้ไม่ได้ให้ความยินยอมอย่างชัดเจนต่อการนำบทสนทนาของตนไปใช้ในการพัฒนาโมเดล AI ความไม่ชัดเจนในนโยบายและข้อกำหนดการใช้งานของผู้ให้บริการเป็นจุดที่ถูกวิพากษ์วิจารณ์ว่าทำให้ผู้ใช้เข้าใจผิดหรือไม่ทันรู้ตัวว่าข้อมูลของตนถูกใช้อย่างไร
อย่างไรก็ตาม รายละเอียดบางส่วนของข้อกังขายังคงไม่ได้รับการยืนยันอย่างสมบูรณ์ และขอบเขตที่แท้จริงของการเก็บและใช้ข้อมูลบทสนทนาในแต่ละผู้ให้บริการยังคงเป็นที่ถกเถียง
ประเด็นนี้ส่งผลกระทบต่อความเชื่อมั่นของผู้ใช้โดยตรง และเป็นแรงกดดันให้ผู้พัฒนา AI ต้องปรับปรุงการแจ้งข้อมูลความยินยอมให้ชัดเจนขึ้น รวมถึงเปิดเผยวิธีการใช้ข้อมูลผู้ใช้อย่างตรวจสอบได้ ในสถานการณ์ที่การแข่งขันด้าน AI เข้มข้นขึ้นทั่วโลก การจัดการข้อมูลผู้ใช้อย่างโปร่งใสกลายเป็นปัจจัยสำคัญทางการแข่งขัน
โดยสรุป จากการพิจารณาหลักฐานที่มีอยู่ ข้อกังขาการนำบทสนทนาผู้ใช้ไปฝึกโมเดลโดยไม่ขออนุญาตนี้จัดว่า เป็นจริงส่วนใหญ่