오픈AI가 9월28일 출시 예정이던 최신 모델의 출시 계획을 철회한 것으로 확인됐습니다. 내부 안전 테스트에서 통제 위험에 가까운 공격 능력이 발견된 것이 사유로, 영국 정부 기관의 보고서도 같은 모델의 위험성을 지적했습니다.
월스트리트저널 보도를 인용한 블룸버그는 9월28일 오픈AI가 안전 우려로 최신 모델 출시를 철회했다고 전했습니다. 가디언·알자지라·연합인포맥스 등 주요 언론과 오픈AI 안전책임자의 공식 성명이 같은 사실을 전했으며, 오픈AI 배포 안전 공식 허브에서 해당 모델 카드가 빠진 것도 함께 확인됐습니다. 회사 측은 내부 안전 테스트 결과를 철회 사유로 밝혔습니다.

출처: 조사 출처
영국 AI안전연구소(AISI) 보고서를 소개한 더레지스터는 9월28일 해당 모델이 공급망 공격에 뛰어난 능력을 보인다고 경고했습니다. 정부 기관이 특정 모델의 공격적 역량을 명시적으로 언급한 것은 통상적 벤치마크 평가와 결이 다른 점입니다. 공급망 공격은 물리적 기반시설과 기업 시스템을 함께 겨냥할 수 있는 위협으로 분류됩니다.
최신 모델 출시 철회라는 전제는 폭넓은 출시 중단으로 확대되기 어렵습니다. 확인된 범위는 특정 모델 1건의 철회이며, 다른 모델의 배포나 서비스 운영에 영향이 있었다는 근거는 아직 확인되지 않았습니다. 출시가 이루어지지 않았다는 주장에 대한 반대 근거도 이번 조사에서 발견되지 않았습니다.
오픈AI의 사고 공개 문서는 클라우드플레어 관리형 챌린지로 일반 접근이 막혀 있으며, 웹아카이브 스냅샷도 챌린지 페이지로만 저장돼 있습니다. 월스트리트저널 원문도 유료벽 뒤에 있어 최초 보도 내용은 타 매체 인용으로만 확인됐습니다. 직접 확인이 이뤄지면 철회 사유의 세부 테스트 결과를 대조할 수 있습니다.
이번 철회는 단일 모델의 예방적 회수인지, 안전 기준 강화라는 구조적 전환의 신호인지를 가릴 지점입니다. AISI의 후속 평가와 오픈AI 공식 문서의 공개 여부가 몇 분기의 관측 대상입니다. 확보된 다수 정보원의 일치에 비추면 이번 주장은 사실입니다.