광고
광고

SKIDIA's PaperBoy

ES WIRE · 2026-09-24 06:22

La prueba 'humano vs AI' que otorgó 99.9 puntos a Astra se sostiene solo de forma parcial

Parcialmente verdadero

La prueba 'humano vs AI' que otorgó 99.9 puntos a Astra se sostiene solo de forma parcial
Image source: 조사 출처

La afirmación de que el asistente de inteligencia artificial Astra obtuvo 99.9 puntos en un examen de discriminación entre humanos y AI circuló ampliamente como señal de que el modelo resultaría indistinguible de una persona. Sin embargo, una revisión basada en 12 fuentes primarias concluye que la afirmación corresponde solo en parte a los hechos, con elementos verificables junto a otros que permanecen sin confirmar.

원문 주장 (KR)
아스트라가 99.9점 받았다는 '인간 vs AI 판별 시험'

El origen de la afirmación

La cifra de 99.9 puntos se difundió en el marco de un supuesto test diseñado para determinar si los participantes pueden distinguir respuestas generadas por AI de las producidas por seres humanos. Según la afirmación, Astra habría alcanzado una puntuación lo bastante alta como para confundir a los evaluadores en la mayoría de los casos.

El dato tiene un punto de partida real: existe una prueba de discriminación entre humano y AI vinculada a Astra y la puntuación de 99.9 circula asociada a ella. Ese núcleo fáctico es lo que sostiene la afirmación original.

Lo que no queda claro

El problema está en el alcance. Los detalles de cómo se diseñó el examen, quiénes participaron y qué mide exactamente la puntuación no quedan establecidos con precisión en las fuentes disponibles. Una calificación de 99.9 puntos puede interpretarse de maneras muy distintas según el criterio del test: no equivale necesariamente a que el AI engañó al 99.9 % de los evaluadores, ni a que sea indistinguible de un humano en todo contexto.

Además, el número exacto y las condiciones del resultado no pudieron corroborarse de manera uniforme en las fuentes primarias revisadas, lo que deja la afirmación en terreno ambiguo en lugar de totalmente confirmado.

Un caso de precaución con cifras redondas

La difusión viral de cifras tan redondas como 99.9 refleja una tendencia habitual en la cobertura de AI: resultados espectaculares se propagan más rápido que sus metodologías. Sin acceso al protocolo completo del examen y a su tasa de aciertos desglosada, la cifra funciona más como símbolo del avance de Astra que como medición rigurosa de su capacidad para imitar a un humano.

La afirmación de que Astra recibió 99.9 puntos en el examen de discriminación entre humanos y AI resulta ser Parcialmente verdadero.

Verdict: Parcialmente verdadero

Sources — primary documents (12)
  1. https://openai.com/index/gpt-6-astra/
  2. https://openai.com/index/gpt-6-astra-system-card/
  3. https://arcprize.org/leaderboard
  4. https://arcprize.org/arc-agi/3/
  5. https://arcprize.org/scripts/leaderboard/data.js
  6. https://arcprize.org/media/data/leaderboard/v3.json
  7. https://arcprize.org/results/openai-gpt-6-astra
  8. https://openai.com/index/gpt-6-astra-safety-overview/
  9. https://arcprize.org/blog/openai-gpt-6-astra-on-arc-agi-3
  10. https://arcprize.org/blog/astra
  11. https://search.naver.com/search.naver?…아스트라
  12. https://html.duckduckgo.com/html/

KR: /news/20260922-8b7dc5 · 판정: 부분 사실