概ね事実
「AI(人工知能)の安全性は地政学的文脈よりも『言語』の影響を大きく受け、韓国語で質問した場合には有害性が低く現れる」――この主張をめぐり、本紙は一次資料の精査による検証を実施した。対象データセットの閲覧に一定の制約がある中で、主張の核心部分がどこまで裏付けられるのかを以下に整理する。
今回の検証対象は、「AIの安全性評価は地政学的文脈よりも『言語』の影響を強く受け、韓国語で質問した場合に有害性が低く判定される」という主張である。同主張は、同一の意図を持つ質問であっても、用いる言語によってモデルの出力の有害性評価に差が生じる点を指摘し、その中で韓国語は相対的に有害性の低い結果をもたらすとするものである。
本紙は一次資料9件を精査した。検証過程では、HF(Hugging Face)上のデータセットに関し、ファイル本体の閲覧には条件付きの同意とログインが必要である一方、データセットカードおよびメタデータは公開状態で確認できることが分かった。このため、ファイル本体への直接アクセスは制限されるものの、カード記載情報とメタデータを通じた事実確認は可能であり、検証に必要な範囲の資料照合は実施できた。
一次資料9件の精査を通じ、AIの安全性評価における言語の影響は地政学的文脈よりも大きく、韓国語での質問時には有害性が低く現れるとする本件主張の骨子は裏付けられた。評価結果がモデルの配置国や地政学的背景よりも、質問に使用された言語そのものと強く連動している点が、今回の検証で確認された主な論点である。
その上で本紙は、本件主張についての最終判定を「概ね事実」とした。