基本属实
据相关方面发布的资料,韩国一场AI安全“挑战赛”活动对国内外共12种大语言模型(LLM)进行了攻击验证,以检验模型在恶意指令下的安全表现。不过,由于该活动官方新闻稿的检索页面存在URL结构问题,报道方未能直接核对原文,相关细节仍有待进一步确认。
根据现有资料,此次活动针对的测试对象共12种大语言模型,覆盖韩国国内外的主流模型。攻击验证的具体方法、得分标准以及各模型的测试结果,目前在可获取的资料中尚未披露。
报道方在核查过程中尝试调取该活动发布的新闻稿原文,但由于搜索页面出现错误——属于URL结构问题而非访问被拦截——未能确认原文内容。因此,除“对12种LLM进行攻击验证”这一核心事实外,活动的主办方、具体时间、参测模型名单及最终评测数据均无法从一手资料中确认。
AI安全攻防测试近年来成为韩国科技界关注的方向,此类挑战赛通常由政府机构或行业组织牵头,用于评估生成式AI对越狱攻击、提示注入等风险的抵抗能力。但就本次活动而言,可确认的信息仅限于测试对象的数量与类别,其余内容在获得原始新闻稿之前应视为未经证实。
总体而言,该报道关于“对国内外12种大语言模型进行攻击验证”的核心说法与可得资料相符,但多项细节尚缺一手来源支撑,判断为:基本属实