광고
광고

SKIDIA's PaperBoy

ZH WIRE · 2026-09-24 13:24

OpenAI被指为训练ChatGPT使用1000万篇新闻文章——部分属实

部分属实

关于OpenAI为开发ChatGPT抓取约1000万篇媒体报道文章的说法近日在韩国舆论场流传。经核实,该说法被判定为部分属实:相关数据使用行为确有依据,但“偷取”(窃取)的表述与实际事实存在出入。

원문 주장 (KR)
"오픈AI, 챗GPT 개발 위해 언론사 기사 1000만건 훔쳤다"

争议的核心

该说法源自围绕OpenAI训练数据来源的争议。OpenAI利用大规模网络文本数据训练其大型语言模型(LLM),其中包括媒体报道文章,这一点有据可查。然而,"1000万篇"这一具体数字的确切来源与统计口径并未得到完全确认,相关细节仍存在不确定性。

“偷取”还是“抓取”?

使用“偷取”(韩语原词"훔쳤다",意为窃取)一词带有明显的法律与道德定性。事实上,OpenAI的数据抓取行为是否构成侵权,目前仍在多国面临诉讼与监管审查,尚无定论。换言之,数据被用于训练是事实,但将其直接定性为“窃取”则超出了已确认的范围。

结论

综合各方信息,OpenAI确曾大规模使用媒体报道文章训练ChatGPT,但“1000万篇”的数字细节及“窃取”的定性均未被完全证实。因此,本说法判定为——Verdict: 部分属实

Sources — primary documents (4)
  1. https://storage.courtlistener.com/recap/gov.uscourts.nysd.612697/gov.uscourts.nysd.612697.1587.1.pdf
  2. https://openai.com/new-york-times/
  3. https://img9.yna.co.kr/photo/reuters/2026/09/18/PRU20260918111101009_P4.jpg
  4. https://img1.yna.co.kr/photo/reuters/2026/09/18/PRU20260918111101009_P2.jpg

KR: /news/20260918-b8700e · 판정: 부분 사실