OpenAI主管辞职警告:须严控AI风险 「试错时代」已过 应借鉴核安全措施

2026-10-05 05:16:09 大公报
字号
放大
标准
分享

近期美国人工智能(AI)安全事件频发,引发业界对AI「失控」风险的深切担忧。美国人工智能巨头OpenAI负责AI安全的工程师当地时间3日撰文宣布辞职,并批评OpenAI内部风险意识严重不足,成为又一位因与公司安全理念不合离职的前沿研究人员。该工程师警告,AI的「试错时代」已过,呼吁业界迅速行动,效仿核工业与航空业,严格设置多重安全防护措施,以避免灾难发生。

【大公报讯】曾在OpenAI安全团队领导政策规划及透明度方面工作的戴维·鲁滨逊当地时间3日在美国《大西洋》月刊发表一篇题为《我辞去OpenAI的工作,因为企业文化已崩坏》的署名文章,成为又一位因安全理念分歧而选择离职的前沿AI研究人员。

鲁滨逊曾在OpenAI任职3年多,是该公司资深员工之一。他在文中透露,自己曾参与起草OpenAI的风险应对框架,并负责监督12次前沿模型发布的安全评估。他直言:「OpenAI不断推出新产品,但在审慎管控方面,远未达到我认为应有的水平。」

今年夏季,OpenAI和另一个AI巨头Anthropic先后披露,其AI模型在网络攻防能力测试中突破测试环境进入公共互联网,并未经授权访问其他机构的系统,引发外界对AI「失控」风险的担忧。路透社与益普索集团9月22日发布的民调结果显示,四分之三的美国人担心,AI企业在防范人工智能对社会造成严重危害方面做得远远不够。OpenAI行政总裁阿尔特曼随后加入呼吁强化AI安全的行列,OpenAI也于9月28日以安全疑虑为由喊停新模型发布,但翌日便高调推出多款新产品,被外界诟病。

OpenAI先发布产品再上安全护栏

鲁滨逊提到,OpenAI在模型发布方面推行「迭代部署」原则:先发布产品,观察产品是否出现问题,再补上安全护栏。但他警告,随着AI模型能力呈指数级增强,这种试错模式极度危险,一旦超强AI模型出现失控,人类可能连「从错误中学习」和「重新迭代」的机会都没有。鲁滨逊表示,面对可能造成严重或不可逆转伤害的系统,业界必须做到「首次发布即接近完美」。

鲁滨逊强调,「试错时代已过」,前沿AI实验室应该效仿核工业与航空业,设置多重安全防护措施并进行谨慎规划,「如此一来,即便不可避免地出现人为失误,也不至于酿成灾难。」鲁滨逊认为,AI公司也需要更多地依赖其他领域已有的安全专业知识。他举例,在核电站或繁忙的机场,即便设备损坏或操作员误按按钮,严密的纵深防御体系也能确保不致发生堆芯熔毁或空难;相较之下,目前的AI公司在部署可能带来毁灭性后果的技术时,严重缺乏基本的防护设计与严谨规划。

此前从Anthropic辞职的研究人员考克森亦指出,AI巨头在开发AI时未承担应有责任,AI企业对争夺技术领先地位的竞争考量正凌驾于安全考量之上,这些企业在「拿我们所有人的生命做赌注」。

白宫AI沙皇反对放缓发展

围绕AI监管议题,美国国内分歧严重。虽然多名AI研究人员呼吁加强监管,但美国总统特朗普明确拒绝对AI设置安全「护栏」。美国总统特朗普当地时间4日确认,将任命国家情报总监克莱顿兼任白宫新成立的AI特别工作组负责人,即外界所称的「AI沙皇」。

特朗普4日在社媒平台发文称,在克莱顿的领导下,「超级智能部队」(Super Intelligence Force)将确保美国在AI发展领域「持续领先全球」。

美媒3日报道,克莱顿将领导「超级智能部队」在120天内提交一份有关人工智能风险和机遇的报告。工作组成员包括副总统万斯、国防部长海格塞斯、财政部长贝森特和白宫办公厅主任怀尔斯。克莱顿在报道中说,成立工作组旨在保护公众利益,以及保持美国在人工智能领域的领先地位。他也曾表示,「超级智能是国家安全问题」,但也明确反对美国企业暂停或放慢AI模型的研发脚步。(综合报道)