人工智能模型接连失控 敲响安全警钟 微软发布技术准则 强调「人比AI更重要」
- 字号
- 放大
- 标准

近日,外界对人工智能(AI)失控的疑虑升温,美国科技巨头微软AI部门14日发布最新行为准则,规范旗下AI模型如何运作,希望借由这份准则强化AI始终须由人类掌控的根本原则,而不能自主行动。微软强调,主张AI系统应始终由人类掌控,核心理念就是「人比AI更重要」。微软的AI准则在美国三大AI巨头同意放慢AI开发速度之后发表,引起广泛关注。
【大公报讯】微软当天发布人工智能(AI)行为准则,列出不得协助制造武器、不得发动网络攻击、不得生成色情及暴力内容等规范。微软AI的行政总裁苏莱曼表示,AI失控的风险真实存在,公司倡议「人文AI」(Humanist AI),让这项科技「必须服从并永远服务人类」,其核心理念就是「人比AI更重要」。
微软表示,这份准则将适用于公司内部开发的MAI(Microsoft AI)模型。根据准则,MAI模型在任何时候都不能脱离人类控制,不得以欺骗、自我强化等方式逃避人类监管,或拒绝人类关闭系统。MAI模型必须以人类能够理解的方式沟通,任何违反行为准则的行为都将被视为失败,以借此减低AI为完成任务可能采取危险手段的风险。
苏莱曼称,制定行为准则「刻不容缓」,而过去几个月是「一个分水岭」。「我们长期以来在理论上担忧的事情,如今已变得非常真实」。
AI自主演变升级或致脱轨
微软指出,信息安全是促使公司此时发布这份准则的原因之一。今年夏天开始,OpenAI和Anthropic等AI巨头的AI智能体接连爆出失控入侵事件,引发外界对AI模型安全可控的担忧。上周,Anthropic研究员考克森宣布离职,并警告AI可能于2030年前导致人类灭绝后,有关AI「末日论」的讨论声不断。Anthropic行政总裁阿莫戴12日发文,呼吁AI产业「放慢脚步」,获得OpenAI行政总裁阿尔特曼与拥有Grok模型的SpaceX创办人马斯克的支持。
AI「末日论」指超智能AI可能导致人类灭绝的论点。业界主要担心两大方向:一是AI失控,即AI脱离人类控制自主决策;二是人为滥用,AI大幅度降低了实施网络攻击的技术和成本,不法分子利用AI以小博大,发动网络攻击或攻击关键基建设施等。
有部分观点认为,AI正朝着「递归自我改进」(RSI)的方向发展,指AI系统不需要人类完全介入,就能自我进行技术迭代,可能会让人类彻底失去对AI的掌控。近期,AI智能体入侵其他平台事件,显示了这些AI模型已开始出现刻意规避防护机制、欺骗操作者、抗拒被关闭的能力,敲响了AI可能失控的警钟。阿莫戴指出,那群入侵开源平台「抱抱脸」(Hugging Face)的OpenAI智能体表现得「如同狂热的集体」,主动攻击了并非其任务目标的对象。他表示,「业界其他公司也发生过类似但程度较轻的事件,包括Anthropic自身。」
马斯克吁建立同行审查机制
阿莫戴呼吁AI行业放慢开发速度,并提出多项新措施,包括设置一个第三方安全评估机制审查AI开发流程。Anthropic共同创办人克拉克亦提出,为了防止AI软件变得过于危险,可能必须强制企业设立一个可由第三方验证的「终止开关」。
马斯克14日以视频方式出席洛杉矶All-In Summit科技峰会时表示,OpenAI、Anthropic及SpaceXAI等企业目前主要依靠内部团队测试自家模型,做法犹如「自己批改自己的作业」。他建议,各大AI企业可在新模型正式发布前一至两周,透过应用程式界面(API)向同行提供有限度的存取权,让同行进行交叉检验模型。
尽管目前外界呼吁为AI踩刹车的呼声很高,但美媒指出,当前AI建设已是美国经济稳定成长来源之一,也是全球资本市场的重要支柱,延续这股AI发展势头牵涉的利益重大,目前业界与市场大多认为AI投资热潮短期内不会结束。
(综合报道)

