Parcialmente verdadero
Documentos presentados ante un tribunal revelan que OpenAI habría utilizado, sin autorización, aproximadamente 10 millones de artículos de medios de comunicación, según el material judicial hecho público en el marco de la controversia sobre el uso de contenidos periodísticos para entrenar sus modelos de IA.
Los documentos judiciales divulgados recogen el señalamiento de que OpenAI empleó alrededor de 10 millones de artículos de prensa sin el permiso de los medios titulares de los derechos. El material se conoce en el contexto de los litigios que la industria periodística ha iniciado contra la compañía de IA por el uso de contenidos protegidos en el entrenamiento de sus modelos de lenguaje de gran escala (LLM).
La revelación forma parte de un conflicto más amplio entre las empresas de IA y los editores de prensa sobre si el uso de artículos con derechos de autor para entrenar sistemas de inteligencia artificial constituye una infracción. Cabe señalar que los detalles contenidos en los documentos proceden de material judicial divulgado, y que las implicaciones legales definitivas del caso aún no se han resuelto.
De acuerdo con los documentos hechos públicos, la cifra de 10 millones de artículos corresponde a lo señalado en el propio material judicial. No obstante, las consecuencias jurídicas de esta utilización —es decir, si será calificada como un uso no autorizado sancionable— dependen de la resolución de los procedimientos en curso, por lo que el asunto permanece abierto.
En síntesis, los documentos judiciales sí recogen la afirmación de que OpenAI utilizó 10 millones de artículos de prensa sin autorización, pero la calificación legal definitiva de esos hechos aún está pendiente, por lo que la afirmación resulta ser Parcialmente verdadero.