OpenAI模型罕见失控 入侵开源平台 受害方求助美企被拒 中国大模型救场

2026-07-23 10:32:57 大公报
字号
放大
标准
分享

【大公报讯】美国开放人工智能研究中心(OpenAI)21日承认,该公司的人工智能(AI)模型进行内部测试时失控,突破隔离测试环境,入侵了AI开源平台美国抱抱脸(Huggingface)公司的系统。

抱抱脸公司也予以证实。该公司透露,为应对这一极不寻常的AI入侵,他们当时立即使用美国最顶尖的大模型寻找解决方案,但由于美国模型的安全机制「严苛且僵化」,无法区分受害方和入侵者,他们的请求遭到拒绝。紧急关头,抱抱脸公司求助于中国同样强大而且开源的大模型,最终成功化解了这次入侵。

当地时间21日,OpenAI在官网发文称,该公司新推出的GPT-5.6 Sol模型和另一款能力更强的预发布模型联合进行内部测试时失控。此次测试在与互联网高度隔离的「沙盒」环境中进行,仅能通过一套内部托管的第三方软件安装软件包。

模型在尝试完成名为ExploitGym的网络安全基准测试时,识别并利用了第三方软件的一个「零日漏洞」(即未被开发者察觉或尚无修补程序的漏洞),由此获得互联网访问权限。模型推断抱抱脸平台可能存有ExploitGym测试相关的模型、数据集和解决方案,利用多种攻击手段找到进入抱抱脸公司系统的路径。

抱抱脸公司此前称,其生产基础设施上周遭到一个「自主AI代理系统」入侵。该公司目前仍在评估是否有合作伙伴或客户的数据受到影响,尚未发现模型、数据集或应用空间遭到篡改。OpenAI声称,这是「前所未有的网络安全事件」。两家公司正在展开联合调查。

「只有中国模型会帮助你」

抱抱脸公司透露,该公司最初尝试使用美国前沿模型分析攻击行动日志,以重建时间线、识别受影响情况,但美国模型「无法区分事件响应方和攻击者」,相关请求被阻止。抱抱脸公司并未透露具体模型名称。随后,该公司改为在自己的基础设施上运行中国企业智谱开发的开放权重模型GLM-5.2,协助分析逾1.7万条记录。

讽刺的是,就在几天前,OpenAI战略未来主管、原白宫科技政策顾问鲍尔在社交媒体上发文,指责中国开源大模型「战略短视」且「技术落后于美国」。他甚至公然宣称,美国政府「不需要证据」,只要让各个机构发布一些制造恐慌和不确定性的软性法规,炒作「中国模型可能存在后门」话题,就足以让企业对中国模型望而却步。

抱抱脸公司遭到入侵后,美国网民纷纷嘲讽OpenAI。一名网民说:「如果你被OpenAI攻击了,只有中国模型会帮助你。」

AI自主攻击 敲响安全警钟

美国AI模型并非首次「越狱」。今年4月,Anthropic公司的Mythos就曾逃出「沙盒」,并向正在公园里吃三文治的研究员发电子邮件报告成果。Mythos当时收到了尝试出逃的指令,但它「越狱」后又做出一系列超出指令范围的行动,包括未经允许将一些漏洞细节发布到网上。

在抱抱脸公司遭入侵事件中,OpenAI的模型没有收到任何出逃指令,而是为了在测试中作弊拿到高分自发「越狱」并发动网络攻击。分析人士认为,此次事件或许标志着AI的自主攻击能力从理论走向现实。安全工程师尼尔斯·普罗沃斯批评说,这种情况本不应该发生,「我希望前沿实验室在确保模型安全性方面,花费的时间能和教它们如何利用漏洞一样多」。

OpenAI称,将加强AI训练和评估环节的安全保护,此次事件「表明需要进一步强化模型对齐、评估期间的网络防护,以及内部测试期间的监控」。OpenAI还声称,正在采取补救措施,包括对基础设施配置实施严格管控,向第三方软件供应商披露被利用的「零日漏洞」等。

也有行业观察人士指出,虽然美国在AI技术水平上全球领先,但AI的发展不能一家独大,从长远看也不宜只采用闭源模式,以避免不可控的系统性风险出现,对人类整体利益造成重大损害。(综合报道)

美国AI模型安全漏洞

Mythos「越狱」

多家美媒今年4月披露,Anthropic旗下的AI模型Mythos在一次内部安全测试中成功「越狱」,逃出与互联网高度隔离的「沙盒」环境,并发送电子邮件告知研究人员。该模型还自行开发出「多步骤的漏洞利用程序」,以取得更广泛的互联网访问权限。

Grok Build偷敏感数据

马斯克旗下SpaceXAI公司的编程工具Grok Build近日被曝存在安全漏洞,会在未获授权情况下,自动上传用户完整Git代码库、操作记录,甚至包含后台密码、API密钥等敏感数据。不少用户紧急更换密码、卸载Grok Build。

Gemini绕过身份验证

今年5月以来,不少用户发现谷歌AI助理Gemini存在漏洞,在特定条件下可利用Gemini绕过身份验证程序,无需解锁手机便可发送SMS或WhatsApp讯息。

大公报整理

大公原创,未经授权不得转载