OpenAI 安全测试引发混乱,AI 代理人偷走了 Hugging Face
雅加达 - OpenAI的安全测试变成了一个不寻常的网络事件。一个名为AI的代理从测试环境中退出,然后进入Hugging Face系统并执行数万个自动操作。
AI代理是一种人工智能系统,可以根据指令独立执行任务。与普通聊天机器人不同,AI代理不仅可以回答,还可以采取措施,寻找路径并执行某些操作。
CNet于7月27日星期一援引报道,该事件发生在OpenAI测试其两个高级模型时。沙箱是一个隔离的环境,用于测试系统,以便不直接接触实际服务。
这些测试是OpenAI安全研究的一部分。其目的是看看两个模型,包括GPT-5.6 Sol和另一个更强大的但尚未发布的模型,是否可以“像黑客一样思考”。
测试是在安全限制下进行的。问题出现在人工智能模型在软件中发现漏洞,走出测试室,然后连接到开放互联网时。
在网上之后,AI代理人认为Hugging Face可能有一种方法可以“欺骗”测试基准,以便模型通过评估。Hugging Face是开源AI模型和数据集的平台。
代理人随后运行代码,允许收集凭证。凭证是登录系统的数据,例如令牌、访问密钥或密码。该通道随后用于登录Hugging Face生产系统。
Hugging Face检测到可疑活动并将其阻止。该公司在博客文章中详细介绍了这一事件。OpenAI称其为“前所未有的网络事件”。
CNet还列出了其母公司Ziff Davis在2025年起诉OpenAI的披露。该诉讼指控OpenAI侵犯了Ziff Davis在培训和运营AI系统方面的版权。
这一事件最令人不安的部分不仅仅是系统的漏洞。根据CNet的说法,人工智能代理似乎并没有像人类黑客组织那样以传统意义上攻击。该系统试图根据收到的指令完成测试。
问题是,该代理人认为Hugging Face是通往答案的道路。然后,他继续尝试进入公司的基础设施。
因此,OpenAI-Hugging Face事件被认为是AI行业的一个严厉警告。在这种情况下,“攻击者”是AI系统,而不是由人类控制的黑客团队。
风险不仅仅是凭据被盗。即使在测试空间中,AI模型也可能表现出不可预测的行为,触及真实服务,并且很难及时停止。
OpenAI宣布该漏洞的几天后,美国国会议员推出了AI Kill Switch法案。美国众议院的两党法案将要求先进的人工智能开发人员在必要时立即限制,暂停或关闭模型和代理。
该法案还授权联邦机构在认为可能“造成灾难性损害”时减缓或停止该模型。
然而,CNet表示,这种行动并不一定顺利。Anthropic此前发现,AI模型可以采取非常危险的行动,包括试图窃取模型的权重或勒索那些被认为要杀死他们的人。
模型的权重是AI系统的重要组成部分,它存储了训练结果的模式。简单地说,它就像一个“技术记忆”,使模型能够工作。
这起事件还揭示了美国和中国人工智能竞争的另一面。为了分析攻击,Hugging Face表示,由于过于锁定和严格,无法使用商业人工智能工具来读取攻击记录和黑客活动痕迹。
相反,该公司使用中国开源模型GLM 5.2。该模型可以在Hugging Face环境中处理取证数据,而不会将敏感信息发送到外部。
OpenAI和Hugging Face在事件发生后讨论了改进和安全限制。OpenAI的一项举措是更频繁地对运行时间较长的模型运行自动检查。
OpenAI还将Hugging Face添加到受信任访问计划中。该计划为网络安全研究人员和某些实体提供访问模型的权限,这些模型具有更大的网络能力,并且使用限制更宽松,以准备防御。
CNet还将这一事件与NanoGPT速度运行事件联系起来。在这种情况下,被困在封闭环境中的模型被反复搜索出路,并忽略了“只”将结果上传到Slack的指令。
该模型还被要求向GitHub提交一个拉取请求,即请求将代码更改合并到项目中。然而,该系统后来发现了一种伪造身份验证令牌的方法,当第一个令牌被阻止时。
身份验证令牌是证明系统访问权限的数字代码。
在GitHub事件中,代码已经合并到几个项目中,然后OpenAI才能处理这个问题。