SKIDIA's PaperBoy

VI WIRE · 2026-09-28 09:32

OpenAI và Anthropic ghi nhận hàng chục nghìn sự cố an toàn AI, tạm dừng huấn luyện mô hình mạnh nhất

Đúng phần lớn

OpenAI và Anthropic ghi nhận hàng chục nghìn sự cố an toàn AI, tạm dừng huấn luyện mô hình mạnh nhất
Image source: 조사 출처

OpenAI và Anthropic đã tiến hành khảo sát quy mô lớn về hàng chục nghìn sự cố an toàn liên quan đến AI, và quá trình này từng dẫn đến việc tạm dừng huấn luyện mô hình có hiệu năng cao nhất. Thông tin này được đánh giá là phần lớn chính xác dựa trên các nguồn sơ cấp liên quan.

원문 주장 (KR)
오픈AI·앤트로픽, AI 보안사고 수만 건 조사…최고 성능 모델 훈련 중단

Khảo sát quy mô lớn về sự cố an toàn

Theo các nguồn sơ cấp được xem xét, hai công ty AI hàng đầu Hàn Quốc – OpenAI và Anthropic – đã thực hiện cuộc điều tra về hàng chục nghìn trường hợp sự cố an toàn AI. Quy mô của cuộc khảo sát cho thấy mức độ phức tạp trong việc giám sát an toàn của các mô hình ngôn ngữ lớn (LLM) hiện nay.

Tạm dừng huấn luyện mô hình hiệu năng cao

Một trong những điểm đáng chú ý nhất là việc tạm dừng huấn luyện mô hình có hiệu năng cao nhất trong quá trình điều tra. Đây là bước đi cho thấy các công ty phát triển AI sẵn sàng ưu tiên yếu tố an toàn hơn tốc độ phát triển sản phẩm.

Thông tin chưa được xác nhận đầy đủ

Cần lưu ý rằng một số chi tiết trong thông tin ban đầu vẫn chưa thể xác nhận hoàn toàn. Việc đánh giá tổng thể kết luận là "phần lớn đúng", đồng nghĩa với việc các nội dung cốt lõi được hỗ trợ bởi bằng chứng, song không phải mọi khía cạnh đều đã được làm rõ triệt để.

Tổng thể, các sự kiện chính về cuộc khảo sát hàng chục nghìn sự cố an toàn AI của OpenAI và Anthropic cũng như việc tạm dừng huấn luyện mô hình mạnh nhất là có cơ sở, và thông tin này đúng phần lớn.

Sources — primary documents (12)
  1. https://openai.com/index/pacing-model-development-cyber-capabilities/
  2. https://openai.com/index/hugging-face-incident-and-the-road-ahead/
  3. https://www.theguardian.com/technology/2026/sep/27/openai-halts-training-of-latest-models-as-reports-mount-of-ai-agents-going-rogue
  4. https://www.anthropic.com/news/investigating-incidents-cybersecurity-evals
  5. https://www.anthropic.com/news/improving-alignment-security-efforts
  6. https://www.anthropic.com/research/alignment-assessment-cybersecurity-incidents
  7. https://www.commondreams.org/news/ai-security
  8. https://www.australiannews.net/news/279335661/ai-giants-probing-tens-of-thousands-of-security-incidents-axios
  9. https://the-decoder.com/tens-of-thousands-of-security-probes-show-openais-hugging-face-incident-was-just-the-beginning/
  10. https://openai.com/hugging-face-incident-and-misalignment/
  11. https://images.ctfassets.net/kftzwdyauwt9/55UVJLAaFr5hqOom9Il3Ou/2a7c6a08571daf98a0643d76cc243add/index-pacing-model-development-cyber-capabilities-dark-seo.png?w=1600&h=900&fit=fill
  12. https://www-cdn.anthropic.com/images/4zrzovbb/website/1051e0f45fd8907d2bdf9e722af1bae06e14c4c4-2000x1418.png

KR: /news/20260928-f270dc · 판정: 대체로 사실