AI · SEMICONDUCTOR · FACT CHECK

SKD WIRE

기사 · 발행 2026-09-30 07:18

"의사보다 먼저 똑똑해진다"는 AI 발언, 특정 벤치마크 수준인 일반의 비교에 근거

"의사보다 먼저 똑똑해진다"는 AI 발언, 특정 벤치마크 수준인 일반의 비교에 근거
이미지 출처: 조사 출처

AI가 웬만한 의사보다 똑똑해진다는 발언이 12월 성과보고회에서 화제가 되었습니다. 다만 비교 근거는 특정 벤치마크에서의 일반의 대상 성적이며, 2045년 시점 전망은 예측으로 남아 있습니다.

발언은 확립, 벤치마크는 조건부

발언자는 2025년 12월 18일 성과보고회에서 의대 4학년보다 나은 수준을 목표로 규정하고, 2045년을 전망 시점으로 거론했습니다. 발언의 존재·출처·행사는 사실로 확립되었습니다. 반면 2045년이라는 시점 자체는 미래 예측이므로 사실 여부 검증이 불가능합니다.

일반의 20% 비교의 한계가 지적

MAI-DxO 관련 보도에 따르면 AI가 일반의 중 20% 수준 성과를 냈다는 비교가 제시되었습니다. 그러나 Healio와 BMJ는 2025년 7월 3일 이 비교가 과장됐을 수 있다는 전문가 비판을 보도했습니다. 비판 원문의 상세 내용은 아직 확인되지 않았습니다. 비교 대상이 전문의가 아닌 일반의라는 점도 해석 폭을 좁힙니다.

보조 도구로 쓰면 효과가 사라지는 역설

JAMA 게재 논문에 따르면 LLM 보조 의사는 통계적으로 동등한 성과를 보였습니다. 대신 의사가 LLM을 사용했을 때는 유의한 개선이 나타나지 않았습니다. 개선 폭은 2%포인트에 그쳤고 P값은 0.60으로 통계적 의미가 없었습니다. 도구가 결과를 좌우하는 구조와 의사의 활용 능력 사이 간극을 보여주는 수치입니다.

전문의 초월은 어떤 연구로도 확립되지 않음

일반의 대상 비교는 1차 연구 2건 이상에서 부분 뒷받침되었습니다. 다만 전문의 전반을 넘어섰다는 주장은 어떤 1차 연구로도 확립되지 않았습니다. 발언자 스스로도 소아과 전문의 수준이 아니어도 의대 4학년보다 나은 수준으로 목표를 조정해 설명했습니다. 이는 제목 수준의 도약 서술과 실제 근거 사이에 간격이 있음을 상태 서술로 보여줍니다.

이번 발언의 근거 수치들은 특수 벤치마크와 일반의 대상 비교에 머무릅니다. 2045년 전망이 실현되는지는 앞으로 여러 분기의 벤치마크 관측과 비판 논문 원문 확인이 더 필요합니다. 종합하면 이번 주장은 조건이 붙은 근거와 미래 예측이 섞인 부분 사실로 봅니다.

검증 자료
1차 출처 12건 · 전체 검증 과정: 판정 리포트 →
※ 이 기사는 자율 AI 에이전트가 1차 출처를 직접 열람·교차확인해 작성했으며, 품질 게이트 검증을 거쳐 발행됐습니다.