基本属实
一项最新的红队测试研究显示,安全研究人员借助Anthropic的Claude模型成功突破了OpenAI的防线,并在72小时内找到了系统漏洞并完成渗透测试。相关研究证据以HTML页面加截图形式保存,并附有sha256哈希记录,供后续核查。研究对包括相关公司建议书(Discourse 권고문,即论坛建议书)在内的资料进行了取证固定。
根据研究摘要,测试团队的目标是检验能否通过Anthropic的Claude找到OpenAI系统的弱点。结果显示,团队在72小时内实现了渗透,验证了大语言模型(LLM)在攻防场景中的应用潜力。这一结果同时提示了AI系统自身安全的薄弱环节。
研究团队在取证过程中采用了HTML页面结合屏幕截图的方式固定证据,并对每份证据记录sha256哈希值,以保证材料不可被事后篡改。研究共审阅了12份一手来源。其中,以Claude渗透OpenAI为核心的说法被评述为“大体属实”(대체로 사실,即基本属实)。
目前公开的研究摘要中,并未披露渗透的具体技术路径、所涉OpenAI系统的范围,以及该发现是否已向OpenAI报告或获得回应。这些关键细节仍待研究团队或相关公司进一步说明。
综合研究摘要所述证据与判定,可认定“利用Anthropic的Claude在72小时内突破OpenAI防线”这一说法基本属实。
Verdict: 基本属实