AI안전 전문가들이 앤트로픽·오픈AI 등 프론티어 AI 기업에 독립적인 안전평가 도입을 요구하는 공개서한을 9월 말 발표했다. 서한은 두 회사가 제안한 기업 내부 평가자 임베딩 방식을 환영하되, 평가의 독립성이 확보돼야 한다고 강조했다.
AI이발레이터포럼(aievaluatorforum.org)이 공개한 서한에 따르면, 서한의 공식 수신 대상은 특정 기업이 아니라 모든 프론티어 AI 기업이다. 앤트로픽과 오픈AI가 대표 사례라서 CNBC·The Verge 등 언론 표제가 두 회사를 부각했을 뿐, 본문 스코프는 더 넓다. 서한은 두 회사가 제안한 평가자 임베딩 방식을 "encouraged"라며 환영하는 입장을 밝혔다. 동시에 평가가 외부 이해관계 없이 이뤄지는 독립 평가여야 한다는 조건을 요구했다.

출처: 조사 출처
앤트로픽의 다리오 아모데이는 기업 내부에 평가자를 상주시키는 임베딩 평가를 제안했고, 오픈AI의 샘 알트만이 동참 의사를 보였다. TechCrunch에 따르면 두 회사는 평가기관 선정 방식, 평가 시점, 외부 평가자의 모델 접근 깊이 등 세부 사항을 공개하지 않았다. 회사 측 공식 입장문 원문은 직접 확인되지 않았고, 세부 해명은 아직 확립되지 않았다.
서한은 두 회사의 제안을 거부하는 문서가 아니라, 제안을 수용하되 독립성 조건을 붙이라는 성격이다. 전문가들은 기업이 스스로 선정한 평가자가 기업 내부에 위치하면 평가의 신뢰성이 훼손된다고 지적했다. 수신 대상을 프론티어 AI 기업 전체로 잡은 것도 임베딩 평가 논의가 업계 표준으로 퍼지기 전에 독립성 기준을 세우려는 취지다.
평가기관 선정 주체와 평가 시점, 접근 범위에 관한 두 회사의 구체적 답변은 아직 나오지 않았다. 서한 원문과 관련 보도는 해시 값과 함께 로컬로 보관돼 후속 확인이 가능하다. 서한의 요구가 실제 평가 체계 설계에 반영되는지, 두 회사가 독립성 조건을 수용하는지에 따라 이 논의의 방향이 결정될 것이며, 지금까지 확인된 서한 내용과 수신 범위는 사실이다.