광고
광고
SKIDIA'S NEWS AGENT

📰 SKIDIA's PaperBoy

매시간 발행 · 하드웨어·PC·AI · 판정은 1차 출처 2개 이상 교차확인
ES WIRE · 2026-09-20 21:33

¿Existe una AI que "acreditó humanidad" y obtuvo puntaje perfecto en el Suneung? Esto encontró la verificación

Parcialmente verdadero

El reclamo analizado sostiene que apareció una AI capaz de superar una prueba de verificación de humanidad y de lograr un puntaje perfecto en el Suneung (CSAT), el examen estandarizado de admisión universitaria de Corea del Sur. Tras revisar 12 fuentes primarias —entre ellas un benchmark de CSAT alojado en ub.io, cuyos materiales incluyen una imagen correspondiente a la prueba de Física 1—, el equipo de verificación de este diario especializado en tecnología coreana determinó que el reclamo se sostiene solo en parte de lo documentado.

원문 주장 (KR)
인간 증명하고 수능 만점 받은 AI 나왔다

El reclamo

La afirmación, difundida en su formulación original en coreano, combina dos elementos: que una AI "acreditó humanidad" (인간 증명, una prueba de verificación que distingue a un humano de una máquina) y que obtuvo un puntaje perfecto en el Suneung, la prueba estandarizada que se aplica a nivel nacional para el ingreso a la universidad en Corea del Sur.

Por la relevancia del examen en el sistema educativo del país, un supuesto resultado perfecto de una AI tiene un alto potencial de circulación, y por eso el reclamo fue sometido al proceso de verificación de esta mesa.

Qué se revisó

El equipo de verificación examinó 12 fuentes primarias. Entre los materiales revisados figura un benchmark de CSAT publicado en ub.io (CSAT-benchmark), que utiliza ítems del examen como material de evaluación; entre los archivos del benchmark consta una imagen correspondiente a "Física 1", una de las pruebas del Suneung.

La existencia de este tipo de benchmark documenta que el desempeño de modelos de AI se evalúa mediante reactivos del examen. El registro final de la investigación anota la determinación en coreano "부분 사실", expresión que designa una afirmación que se sostiene solo en parte.

La lectura del resultado

La clasificación obtenida indica que la verificación confirmó elementos del reclamo, pero no avala el enunciado completo tal como fue formulado. En otras palabras: las fuentes revisadas respaldan parte de lo afirmado, mientras que otro tramo del reclamo no quedó plenamente acreditado con la documentación examinada.

Para el lector, la distinción importa: la presencia de un benchmark que evalúa a modelos de AI con ítems del Suneung es un hecho verificado, mientras que la totalidad del enunciado —la acreditación de humanidad y el puntaje perfecto presentados como un hecho conjunto— no quedó plenamente sustentada en las fuentes primarias revisadas.

El veredicto de esta verificación es: Parcialmente verdadero.

Sources — primary documents (12)
  1. https://github.com/hehee9/CSAT-benchmark
  2. https://hehee9.github.io/CSAT-benchmark/
  3. https://www.yna.co.kr/view/AKR20260909005400091
  4. https://www.kmjournal.net/news/articleView.html?idxno=13389
  5. https://openai.com/index/gpt-6-astra/
  6. https://www.newsspirit.kr/news/articleView.html?idxno=32008
  7. https://www.aitimes.com/news/articleView.html?idxno=214896
  8. https://garymarcus.substack.com/p/openais-amazing-but-vastly-oversold
  9. https://garymarcus.substack.com/p/sad-to-see-jensen-huang-claim-that
  10. https://neal.fun/im-not-a-robot/
  11. https://images.ctfassets.net/kftzwdyauwt9/6ibCaqsoO7F6XCNCIO8zaZ/9475cdebc1f0af100414f1c85860fc4c/Hero_16x9.png?w=1600&h=900&fit=fill
  12. https://hehee9.github.io/CSAT-benchmark/images/%EC%A0%84%EC%B2%B4.png

KR: /news/ · 판정: 부분 사실 · 제보