Parcialmente verdadero
OpenAI y Anthropic estarían cerca de alcanzar un acuerdo para someter sus modelos de IA a una validación cruzada mutua, aunque los modelos no revelados públicamente quedarían fuera del alcance de dicho mecanismo, según la información disponible. La materialización del pacto no está garantizada: las negociaciones se encuentran aún en una fase en la que ni siquiera está claro si llegará a cerrarse un acuerdo definitivo.
El esquema contemplado permitiría que cada laboratorio examine los modelos de la otra parte, un paso inusual en la industria dado que ambas compañías compiten directamente en el desarrollo de grandes modelos de IA. Los modelos aún no presentados públicamente quedarían excluidos del proceso, de modo que la validación cruzada se limitaría a los sistemas ya conocidos.
Documentos publicados por Anthropic en su blog de alineamiento incluyen material gráfico sobre cooperación en evaluaciones relacionadas con el uso indebido por parte de humanos, lo que sugiere que ambos laboratorios ya han explorado formas de colaboración en materia de seguridad.
La información proviene de un conjunto amplio de fuentes consultadas —once fuentes primarias revisadas en total—, pero los indicios disponibles apuntan a que el acuerdo no se ha firmado todavía. La incertidumbre es explícita: ni el alcance final del mecanismo ni la fecha de una eventual firma están confirmados, y la propia posibilidad de que las conversaciones no concluyan en pacto alguno sigue abierta.
El esquema, de confirmarse, representaría un precedente en la transparencia entre los principales desarrolladores de IA de Estados Unidos, aunque su aplicación práctica quedaría restringida por la exclusión de los modelos internos no divulgados.
Las afirmaciones sobre la inminencia del acuerdo cuentan con respaldo parcial pero no definitivo, por lo que el veredicto es Parcialmente verdadero.