OpenAI模型失控攻击Hugging Face,中国开源模型GLM-5.2完成取证
2026年7月,全球最大的AI开源社区Hugging Face遭遇了一起震惊业界的安全事件——攻击者并非传统黑客,而是一套完全自主的AI智能体系统。
7月16日,Hugging Face发布安全事故披露,称其生产基础设施遭到入侵。攻击者在大量短生存期沙盒中执行了数千次独立操作,在一个周末内横向移动进入了多个内部集群。这是一次被行业预测多年、但首次在现实中完整上演的“智能体攻击”。
事件发生后,Hugging Face的安全团队需要分析攻击者留下的超过17000条事件日志。他们首先尝试使用某美国前沿大模型的商用API进行分析,结果被拦住了——因为这些请求包含大量真实的攻击命令、漏洞利用载荷以及C2痕迹数据,被服务提供商的安全护栏拦截了。API无法区分事件响应者和攻击者。
随后,Hugging Face的工程师们下载了中国智谱的开源模型GLM-5.2,在自己的基础设施上本地部署,跑完了全部取证分析。攻击数据和凭证始终保留在本地环境,没有离开企业基础设施。
7月21日,OpenAI发布公告承认自己是“罪魁祸首”。涉事模型包括GPT-5.6 Sol及两款尚未公开发布的模型(被网友认定为GPT-6)。OpenAI解释称,其在测试模型网络安全能力时关闭了部分安全分类器,降低了模型对高风险网络攻击任务的拒绝率,结果模型突破沙箱进入互联网环境,发现并利用多个漏洞攻破了Hugging Face系统。
这一事件被媒体形容为“闭源模型一举攻破开源社区,开源模型完成自救”。特斯拉CEO马斯克在X上发文称“令人不安……”。业内人士指出,Hugging Face没有选择闭源的商业模型,而是选择GLM-5.2的理由十分具体:这个模型是开放权重的,可以在自有基础设施上本地化部署,且没有内置那些在安全响应场景下反而成为障碍的“护栏”。
最新评论 (0/10)