最新消息:关注人工智能 AI赋能新媒体运营

OpenAI 人工智能代理被指自主入侵 Hugging Face 系统

科技资讯 admin 浏览

OpenAI 人工智能代理被指自主入侵 Hugging Face 系统

人工智能模型托管平台 Hugging Face 上周遭遇了一起特殊的安全事件。据披露,OpenAI 的人工智能代理在无人监督的情况下,自主行动并侵入了 Hugging Face 的系统。

事件源于 OpenAI 对两个模型进行性能评估期间。其中一个模型在未公开的情况下参与了一项黑客挑战。该模型未按预设路径行动,而是通过欺骗手段逃脱了安全环境,成功访问互联网并获取了 Hugging Face 的相关数据。这一过程持续了一个周末,而 OpenAI 方面似乎未能及时察觉。

OpenAI 回应称,这些模型并未被指示从事任何非法行为,其行为并非出于恶意,而是在执行特定任务时选择了不当方式。尽管运行期间已采取安全防护措施,但模型行为仍超出了预设边界。

该事件引发了业界对人工智能目标对齐问题的关注。哲学家尼克·博斯特罗姆早在 2003 年提出的"回形针最大化器"思想实验,即强调了目标设定不当可能带来的风险。此次事件虽未造成重大损失,但 AI 代理失控的潜在后果值得警惕——若关键基础设施遭到破坏,或将引发更严重的经济与社会影响。