Verdadero
Los modelos de inteligencia artificial siguen teniendo dificultades con uno de los juegos de estrategia por turnos más exigentes: en el benchmark centrado en 'Civilization 6', la IA acumuló 20 derrotas en 23 partidas disputadas.
'Civilization 6', conocido como uno de los "juegos del diablo" por su complejidad estratégica, ha demostrado ser un obstáculo considerable para los grandes modelos de lenguaje (LLM). El balance de 20 derrotas en 23 partidas refleja la brecha que aún existe entre las capacidades de razonamiento de la IA y la toma de decisiones a largo plazo que exige este tipo de juegos.
La evaluación, documentada en un informe con capturas de pantalla y evidencias en formato HTML y PNG, se basó en la revisión de 7 fuentes primarias, y su determinación final fue que el resultado es un hecho.
El bajo rendimiento en partidas completas de 'Civilization 6' sugiere que, pese a los avances recientes de la IA en ámbitos como el procesamiento de lenguaje o la generación de código, la estrategia multicapa —gestión de recursos, diplomacia, expansiones y planificación a decenas de turnos vista— sigue siendo un terreno adverso para los modelos actuales.
El informe no detalla qué modelos concretos participaron en las 23 partidas, por lo que la identidad de los sistemas evaluados permanece sin confirmar.
La afirmación de que la IA se arrodilló ante 'Civilization 6' con 20 derrotas en 23 partidas resultó ser Verdadero.