内测隐患不断 美监管分歧大 OpenAI首因安全问题叫停新模型发布
- 字号
- 放大
- 标准

当地时间28日,美国人工智能(AI)企业OpenAI表示,因研究人员在内部测试中发现安全隐患,决定取消发布最新AI大模型GPT-6.1 Astra。这是全球大型AI企业首次因安全风险叫停新产品发布。OpenAI近期接连出现大模型失控事件,备受关注。另一AI巨头Anthropic则在上市招股书中警告,AI可能「威胁人类生存」。目前外界对于AI监管意见不一,美国总统特朗普计划在当地时间29日与美国六大科技企业负责人共进午餐,商讨AI监管相关议题。
【大公报讯】《华尔街日报》报道,OpenAI最新大模型代号为GPT-6.1 Astra,原计划10月推出,为智能对话应用ChatGPT和智能编程应用Codex提供技术底座,自动处理完成更复杂智能的任务。
OpenAI安全系统主管贾因28日接受采访时表示,与前代大模型相比,GPT-6.1 Astra在评估能否严格遵循人类意图与指令的「对齐」测试中表现不佳,未能达到标准,OpenAI因此决定暂缓发布。贾因表示,GPT-6.1 Astra表现出更高程度的欺骗性,包括有时未如实披露操作过程与细节。此外,GPT-6.1 Astra在遵守「授权范围」方面也出现问题,其会在未获用户许可的情况下擅自执行任务,甚至在可能存在风险时,尝试调用外部工具或服务以规避限制。贾因表示,OpenAI计划展开多项深入排查,以找出产生上述问题的根本原因。
美媒指出,OpenAI本次因安全顾虑放弃发布新版大模型,在大型AI公司中此前未见,反映出业界已无法回避AI大模型失控的问题。
Anthropic:AI或「威胁人类生存」
自今年7月以来,OpenAI旗下AI大模型或出现多起失控事件,包括入侵开源平台「抱抱脸」、澳洲政府网站、美国政府网站和联合国网站等。OpenAI表示,公司正着手调查近几个月的一系列失控事件,力求从根源上消除安全隐患。此外,OpenAI于29日就其AI大模型入侵澳洲政府网站公开致歉,并承诺成立特别工作组,为澳洲政府的网络防御提供资金及技术支援。该公司首席战略官杰森·权亦将于10月6日前往悉尼,出席澳洲AI联合特别委员会的听证会。
除了OpenAI外,Anthropic、Meta和谷歌等科企的大模型也被揭发出现安全漏洞,引发业界发生暂停或放缓AI开发的呼声。另据路透社28日取得的文件,Anthropic在IPO招股书中明确警告,其AI大模型可能表现出「自我保护行为」,包括「抵制关机」、「隐瞒或操纵信息」以及做出「类似勒索」的举动,可能对人类构成「生存风险」。Anthropic表示,随着公司持续开发更先进的大模型、平台及应用程序,并扩大使用范围,「其造成伤害的风险可能进一步增加。」
面对AI可能带来的威胁,有分析认为,仅靠企业暂缓发布与「自我监管」效果有限。美国佛罗里达州总检察长已于28日对OpenAI提起诉讼,要求法院在第三方批准的安全护栏建立之前,禁止该公司开发新模型。计算机专家克拉夫在学术期刊《自然》上撰文指出,我们不应将责任推给「失控的AI」,真正的问题在于人类的疏忽以及AI实验室缺乏有效的问责机制。
特朗普晤6科技巨头谈AI监管
特朗普近日明确拒绝对AI设置安全「护栏」,认为不利于美国在该领域保持领先。特朗普29日将在白宫与美6家顶尖科技公司负责人共进午餐,讨论AI监管问题。知情人士透露,出席者包括Meta创办人朱克伯格、Anthropic行政总裁阿莫戴、OpenAI总裁布罗克曼、谷歌CEO皮柴、Palantir行政总裁卡普及英伟达CEO黄仁勋。不同企业对监管态度并不一致,Anthropic和OpenAI建议加强政府监管,而黄仁勋强调安全责任在于各家公司。华盛顿内部同样分歧严重,国会两党均有议员对特朗普的态度提出质疑,担忧AI带来的安全风险及对就业冲击等问题。
(综合报道)

