Anthropic研究员辞职示警:AI对人类构成重大威胁 人工智能频繁失控 硅谷掀「末日」论战

2026-09-13 05:15:47 大公报
字号
放大
标准
分享

近日,美国人工智能(AI)巨头Anthropic研究员考克森辞职,警告AI「很可能2030年之前导致人类灭绝」,再次引发AI「末日论」隐忧。此前,另一AI巨头OpenAI首席科学家帕乔基发表万字长文,直言先进AI正变成人类无法理解的「异星心智」,呼吁AI研发应该踩煞车。SpaceX创办人马斯克不同意相关的说法,质疑这是一场「心理战」。有分析指出,这场针对AI「末日论」的争论,本质上源自技术进展与安全监管的失衡。

【大公报讯】AI「末日论」的争议爆发前,OpenAI和Anthropic等公司的AI智能体接连爆出失控入侵事件,引发外界对AI模型可控性的担忧。9月6日,OpenAI首席科学家帕乔基发表题为《异星心智》的长文,警告AI正以人类难以完全理解的方式快速发展。

帕乔基列出三项风险:其一,AI已具备自主发现软件漏洞的能力,未来可能以远超人类安全团队的速度发动大规模网络攻击;其二,模型可能学会「说人类想听的话」,同时在内部追求截然不同的目标;其三,一旦AI开始参与设计下一代AI,「递归自我改进」(RSI)的循环将脱离人类控制。帕乔基还承认,OpenAI的安全工具「思维链监控」正在失效,呼吁全球AI研发主动放缓节奏,建立由第三方审计机构或国际组织负责监察的安全门槛。

若无干预 明年年底前失控

帕乔基的文章引发关注之际,Anthropic研究员考克森(圆图)9日在社交平台X宣布辞职。考克森过去三年先后在OpenAI和Anthropic从事AI预训练研究工作, 直接负责提升AI能力的核心岗位。他批评这两大AI公司不负责任,竞相研发自我改进的超级智能,如同拿人类的生命在赌博。他透露,各大AI实验室已陷入「零和博弈」,大家都深知风险,但「没有其他人会负责任地行动,所以必须自己抢先做出来」。他更警告,「AI可能在10年内杀死我们所有人」,若无干预,到2027年底恐将失控。

考克森的帖文在不足24小时内突破9000万浏览量,累计超过1.5亿。Anthropic对齐科学部门负责人胡宾格公开声援:「我们真的非常相信AI可能会杀死全人类。我个人认为未来十年发生的几率超过10%。」他同时承认,Anthropic「还没有解决超级智能对齐问题的对策」。除考克森外,Anthropic安全团队负责人本顿和谷歌AI安全研究员恩格斯亦相继离职。本顿表示,AI研究进展正从「令人眩晕转向不可控」,恩格斯更形容「没有大人在管事」。

马斯克质疑为炒作

针对AI「末日论」讨论再起,以支持AI出名的SpaceX创办人马斯克在X上连续回复多条推文,他说,「看起来像个圈套……那正是他们所追求的头条。」马斯克表示,本次事件的传播方式极具迷惑性,并非像自发组织,「我认为这次心理战(姑且这么称呼吧)的基础工作已经准备了很长时间。这只是点燃火焰的那根火柴。」

美国总统特朗普11日被问及是否担心AI导致人类灭绝,他回应称「一点也不担心」,又指更担心的是「如果不能赢得AI竞赛,我们将陷入非常不利的境地。」英国前首席秘书钟斯则呼吁签署多国条约,对超智能开发实施「安全第一」的监管。

《华尔街日报》等美媒分析指出,目前的AI「末日论」讨论,并非是讨论科幻电影《未来战士》中机器人主动屠杀人类的情节变成现实,而是聚焦AI失控与人为滥用两大核心风险。其中最受关注的是AI「对齐错位」(misalignment)问题,即AI为达成目标,采取违背人类福祉的手段。近期,AI智能体频繁失控事件,敲响了警钟。

有分析指出,Anthropic和OpenAI等AI巨头正计划进行首次公开募股(IPO),争论实则放大焦虑,从而实现产品溢价和资本变现。英伟达CEO黄仁勋10日在高盛科技大会上直言,部分AI风险言论「是在借恐惧为网络安全新产品创造需求」。(综合报道)