미국 오픈AI의 신모델이 인간 증명과 수능 만점을 동시에 달성했다는 주장이 11월 말 국내외 온라인에서 확산했다. 두 업적 모두 실재하는 기록이지만 공식 인증이나 실제 수능 성적이 아니라는 점에서 제목의 통념과는 거리가 있다.
국제신문 등 외신 보도에 따르면 화제의 시작은 샤리프 샤밈이라는 개발자가 소셜미디어 엑스에 올린 게시물이었다. 게시물에는 AI 모델이 neal.fun의 '아임 낫 어 로봇' 게임에서 인증서를 받은 장면이 담겼다고 전했다. 해당 게임은 실제 보안 인증 기능이 없는 캡차 패러디로, 페이지 자체에 보안 수준 0%를 표시해 둔 놀이용 서비스다. AI가 로봇임을 스스로 넘어섰다는 서사는 이 게임의 인증서 수령을 가리키는 것이었다.
민간 개발자가 운영하는 CSAT 벤치마크 사이트 발표에 따르면 오픈AI의 신규 모델은 해당 벤치마크에서 99.4점을 기록했다. 같은 데이터의 더 엄격한 모드에서는 점수가 448점으로 떨어졌다. 이 벤치마크는 한국교육과정평가원의 공식 수능이 아니라 민간이 수능 기출 문제로 구성한 평가다. 핵심 신기록은 전체 점수보다 탐구 4과목 전부를 정답 처리한 점이며, 원데이터상 이는 유일무이하게 확인된 성적이라 밝혔다.

출처: 조사 출처
뉴욕대 명예교수 개리 마커스는 자신의 서브스택에서 오픈AI 관련 서사가 허풍 심하게 과장됐다고 강조했다. 마커스는 엔비디아 젠슨 황 CEO의 AGI 도달 선언에 대해서도 근거와 정의가 없다는 비판을 전했다. 신모델 성능 자체를 부정한 것은 아니라는 점에서 논쟁은 과장의 정도를 둘러싼 것이다.
두 사건 모두 1차 데이터로 존재가 확인된 실제 기록이다. 다만 인간 증명은 보안 기능이 없는 놀이용 게임의 인증서였고 수능 만점은 공식 시험이 아닌 민간 벤치마크 성적이었다. 제목이 암시하는 'AI가 인간을 넘어섰다'는 통념적 함의는 사실과 과장이 섞인 주장으로, 판정 결과는 부분 사실이다.
오피니언 리더 간 AGI 정의를 둘러싼 이견은 좁혀지지 않은 상태다. 샤밈의 원본 게시물은 엑스 로그인 장벽으로 아직 직접 확인되지 않았으며 내용은 국내외 보도로 전해졌다. 향후 공식 기관의 평가 참여 여부와 더 엄격한 채점 기준의 표준화가 다음 확인 지점이다.