ज़्यादातर सही
AI सेवाओं के उपयोगकर्ताओं की बातचीत को बिना अनुमति के मॉडल प्रशिक्षण (training) में इस्तेमाल किए जाने का संदेह लगातार उठाया जा रहा है। यह मुद्दा तब से चर्चा में है जब कई उपयोगकर्ताओं ने दावा किया कि उनकी संवाद-सामग्री AI कंपनियों के बड़े भाषा मॉडल (LLM) के प्रशिक्षण में प्रयुक्त हुई।
इस विवाद की शुरुआत उपयोगकर्ताओं के शिकायतों से हुई, जिन्होंने कहा कि चैटबॉट सेवाओं में उनकी निजी बातचीत अपनी सहमति के बिना इकट्ठी की जा रही थी। इसके बाद ही विशेषज्ञों ने सेवा की शर्तों (terms of service) में दिए गए प्रावधानों का विश्लेषण करना शुरू किया।
विशेषज्ञों ने सेवा की शर्तों में उपयोगकर्ता डेटा के प्रशिक्षण उपयोग से जुड़े प्रावधानों की जाँच की। इस विश्लेषण में पाया गया कि उपयोगकर्ता की बातचीत को प्रशिक्षण डेटा के रूप में इस्तेमाल करने की संभावना वास्तव में अस्वीकृति (opt-out) के विकल्प के अधीन थी, जिसके लिए उपयोगकर्ता को स्वयं सेटिंग्स बदलनी पड़ती थीं। यह पाया गया कि पूर्व-सहमति (opt-in) की प्रक्रिया का अभाव था, जिसके कारण उपयोगकर्ताओं की सहमति के बिना उनकी बातचीत को प्रशिक्षण में शामिल किए जाने की चिंता पैदा हुई।
इस संदर्भ में यह संदेह उठाया गया कि कंपनियों ने उपयोगकर्ता डेटा की उपयोग सीमाओं को स्पष्ट रूप से नहीं बताया। विशेष रूप से, यह प्रश्न उठा कि क्या उपयोगकर्ताओं को उनके संवादों के प्रशिक्षण में उपयोग की जानकारी पर्याप्त रूप से दी गई थी।
हाल के महीनों में उपयोगकर्ताओं के समूहों ने ऐसे प्रावधानों की आलोचना करते हुए अपनी चिंताओं को सार्वजनिक किया है, जिनके अनुसार उनकी बातचीत बिना अनुमति के प्रशिक्षण में इस्तेमाल हो सकती है। इसके जवाब में चैटबॉट सेवा प्रदाताओं ने अपने डेटा उपयोग नीतियों की समीक्षा करने की घोषणा की है, जिसके तहत उपयोगकर्ताओं को अपने डेटा के प्रशिक्षण उपयोग से इनकार करने का विकल्प दिया जाएगा।
अंत में, उपयोगकर्ताओं की बातचीत से बिना अनुमति शिक्षण से जुड़े दावों को देखते हुए, सेवा की शर्तों में वास्तव में ऐसे प्रावधान पाए गए जो इस तरह के उपयोग की अनुमति देते हैं, हालांकि पूर्व-सहमति की प्रक्रिया का अभाव था — इस आधार पर यह आकलन ज़्यादातर सही है।