概ね事実
生成AIサービスを巡り、利用者との対話データが事前の同意なくAIモデルの学習に使われたとの疑惑が相次いで提起されている。韓国国内の技術系報道などでこの問題が取り上げられており、主要AI事業者のデータ活用慣行への関心が高まっている。
疑惑の中心にあるのは、利用者がAIサービスに入力した対話内容が、当該事業者の大規模言語モデル(LLM)の学習データとして無断で活用されているのではないかという指摘だ。利用者の同意や通知の有無が不明確なままデータが処理されているのではないかという懸念が、利用者や専門家の間で相次いで提起された。
個人の対話データには機密性の高い情報が含まれ得るため、無断学習の疑惑はプライバシー保護の観点からも問題視されている。ただし、どの事業者がどの範囲のデータを実際に学習に使用したのかについて、現時点で確定した事実関係は明らかにされていない。
AI業界では、学習データの収集と利用者への通知の在り方を巡る議論が今後強まる可能性があり、監督当局の対応も注目される。
本件の疑惑は、現時点で判明している範囲では概ね事実と評価できる。
Verdict: 概ね事実