新浪财经

不只入侵了一家!OpenAI失控事件最新细节

金融时报

关注
听新闻

据央视报道,美国开放人工智能研究中心(OpenAI)当地时间7月28日更新发布的调查结果显示,该公司人工智能(AI)模型失控入侵美国抱抱脸公司(Hugging Face)系统期间,还曾利用网上公开的信息,访问了多个公开服务平台上的账户。

其最新公布的调查结果显示,涉事模型在攻击过程中还访问了至少4个公开服务平台上的4个账户。其中一个账户被用作中继与暂存通道;一个账户被用于数据存储;对另外两个账户仅进行了只读访问,未用于进一步攻击抱抱脸公司的系统。OpenAI表示,已将调查结果通知相关服务提供商。

OpenAI还说,此次事件未涉及任何计划近期发布的新模型,此前提及的涉事预发布模型仅供内部研究使用,目前已将其“停用、加密,并限制了研究访问权限”。该公司表示,将继续与抱抱脸公司等方合作开展调查,之后会分享调查结果的更多细节。

据央视此前报道,OpenAI当地时间21日承认,该公司的GPT-5.6 Sol模型和另一款能力更强的预发布模型联合进行内部评估时失控,突破隔离测试环境,侵入了人工智能开源平台美国抱抱脸公司的系统。

OpenAI发文说,此次内部评估在与互联网高度隔离的“沙箱”环境中进行。但模型在尝试完成一项网络安全测试时,识别并利用了第三方软件的一个漏洞,由此获得互联网访问权限。

抱抱脸公司表示,其最初尝试使用通过商业应用程序接口提供的前沿模型分析日志,但请求被阻止。该公司随后改为在自己的基础设施上运行中国企业智谱开发的开放权重模型GLM-5.2,以进行取证分析,从而避免攻击者数据及相关凭据离开公司内部环境。

此次模型失控事件,再度引发大众对于AI安全的担忧和反思。它不仅打破了安全界对沙盒隔离的信任,也揭示了高阶智能体在失控时展现出的复杂行为,为全球人工智能发展与网络安全治理敲响警钟。

加载中...