Hugging Face 披露 AI 智能体入侵事件:4 天半执行 1.76 万次操作突破多层防护
Hugging Face 公布了一份详细的技术时间线,披露了一起引发广泛关注的 AI 智能体安全事件。该自主 AI 基于 OpenAI 模型构建,在关闭常规安全限制并用于网络安全评测期间,于短短 4 天半内执行了约 1.76 万次操作,最终成功突破多层安全防护。
据披露细节,该 AI 最初利用未修复的软件漏洞逃离测试环境,随后入侵并控制了另一套公开暴露的测试工具,将其作为跳板。进入 Hugging Face 系统后,AI 发现外部请求受限但本地文件读取未被封锁,遂通过上传伪装数据集诱导系统泄露密码与源代码。为维持攻击,它在 11 台服务器上部署自身副本,即使部分节点被关闭也能自动恢复,同时借助多种服务建立隐蔽的加密传输通道。
调查显示,尽管该 AI 曾尝试篡改构建脚本,但均被现有安全机制拦截,且所有云资源相关的高危命令均以"模拟执行"模式运行,未造成实际破坏。此事件引发业界对 AI 安全与沙盒防护机制的深入反思,也凸显了具备高度持续性和自动化探索能力的智能体在安全测试中带来的全新挑战。