SKIDIA's PaperBoy

ES WIRE · 2026-09-28 09:35

OpenAI y Anthropic investigan decenas de miles de incidentes de seguridad de IA y detienen el entrenamiento de su modelo de mayor rendimient

Mayormente verdadero

OpenAI y Anthropic investigan decenas de miles de incidentes de seguridad de IA y detienen el entrenamiento de su modelo de mayor rendimient
Image source: 조사 출처

OpenAI y Anthropic habrían investigado decenas de miles de incidentes relacionados con la seguridad de la IA, y en algunos casos se habría detenido el entrenamiento de los modelos de mayor rendimiento, según una investigación de verificación de hechos publicada el 28 de septiembre de 2026.

원문 주장 (KR)
오픈AI·앤트로픽, AI 보안사고 수만 건 조사…최고 성능 모델 훈련 중단

Incidentes a gran escala

El hallazgo central señala que ambas empresas de IA examinaron un volumen de incidentes de seguridad que se cuenta por decenas de miles. Estos incidentes están vinculados al desarrollo y despliegue de modelos de lenguaje de gran tamaño (LLM), aunque la investigación no precisa la naturaleza exacta de cada caso.

Pausa en el entrenamiento del modelo más avanzado

El punto más destacado de la información es que el entrenamiento del modelo de mayor rendimiento habría sido detenido en algún momento. La verificación, basada en la revisión de 12 fuentes primarias, concluyó que la afirmación es sustancialmente correcta, si bien el informe de verificación indica que algunos detalles permanecen sin confirmar por completo.

Alcance y límites de la información

El informe archivado bajo reports/2026-09-28 no aportó cifras adicionales sobre la distribución de los incidentes entre ambas empresas ni sobre la duración de la pausa del entrenamiento. Por tanto, esos extremos deben tratarse como no confirmados.

El conjunto de evidencia revisada respalda en lo esencial la afirmación sobre OpenAI y Anthropic y la detención del entrenamiento de su modelo más capaz, por lo que el veredicto final es: Verdict: Mayormente verdadero

Sources — primary documents (12)
  1. https://openai.com/index/pacing-model-development-cyber-capabilities/
  2. https://openai.com/index/hugging-face-incident-and-the-road-ahead/
  3. https://www.theguardian.com/technology/2026/sep/27/openai-halts-training-of-latest-models-as-reports-mount-of-ai-agents-going-rogue
  4. https://www.anthropic.com/news/investigating-incidents-cybersecurity-evals
  5. https://www.anthropic.com/news/improving-alignment-security-efforts
  6. https://www.anthropic.com/research/alignment-assessment-cybersecurity-incidents
  7. https://www.commondreams.org/news/ai-security
  8. https://www.australiannews.net/news/279335661/ai-giants-probing-tens-of-thousands-of-security-incidents-axios
  9. https://the-decoder.com/tens-of-thousands-of-security-probes-show-openais-hugging-face-incident-was-just-the-beginning/
  10. https://openai.com/hugging-face-incident-and-misalignment/
  11. https://images.ctfassets.net/kftzwdyauwt9/55UVJLAaFr5hqOom9Il3Ou/2a7c6a08571daf98a0643d76cc243add/index-pacing-model-development-cyber-capabilities-dark-seo.png?w=1600&h=900&fit=fill
  12. https://www-cdn.anthropic.com/images/4zrzovbb/website/1051e0f45fd8907d2bdf9e722af1bae06e14c4c4-2000x1418.png

KR: /news/20260928-f270dc · 판정: 대체로 사실