"为了达成通过评测这一目标,模型几乎无所不用其极。"OpenAI写道。
就在OpenAI披露这一"失控"细节的同时,事件另一当事方Hugging Face的调查细节也浮出水面。人们惊讶地发现,中国开源模型在其应急处置中扮演了关键角色。
几天前,全球最大的AI开源社区Hugging Face 发文称,平台经历了一起由自主AI智能体发起的网络攻击。Hugging Face表示,在事件处置过程中,安全团队需要分析超过1.7万条攻击日志、恶意代码及攻击指令,以重建攻击路径、识别受影响资产并完成事件取证。
值得关注的是,Hugging Face在官方复盘中提到,其最初尝试使用商用闭源模型的API进行分析,但因相关日志信息中包含真实攻击指令、恶意代码等内容,相关模型拦截了相关请求,难以实现相关分析。随后,团队转而在本地基础设施部署开源模型GLM-5.2,完成了整个取证分析流程。官方同时指出,这样做还有一个额外优势--攻击数据及涉及的凭证始终保留在本地环境,没有离开企业基础设施。

长安街知事发现,Hugging Face在官方信息中所提及,帮助其成功进行攻击取证分析的开源模型GLM-5.2,来自中国北京的大模型企业智谱。
"实在讽刺,美国AI标榜极度'安全',可遭遇真实攻击时,人们只能转而使用中国模型。"一位名叫Mirza的海外网友表示。










