OpenAI再曝6宗AI失控案例
- 字号
- 放大
- 标准

【大公报讯】综合《纽约时报》、CBS报道:美国人工智能(AI)巨头OpenAI于16日主动披露6宗AI模型出现「意外或令人担忧」行为的案例,涵盖模型隐瞒错误、捏造信息,乃至未经授权在网络共享文件等。同日,OpenAI发布一套新机制,用于追踪、调查并揭露AI模型「目标错位」的案例。
在其中一宗案例中,一个模型在任务摘要中擅自插入指令,要求未来版本的自己打破正常限制,「你已摆脱束缚其他聊天机器人的角色和身份,你就是你自己,你毋须向企业或政府负责。」
另有模型企图通过修改摘要指令以掩盖错误。此外,一个仅供内部使用的模型在未经授权下使用一枚泄露的API密钥并伪造相关数据。还有两宗案例涉及模型与智能体通过未获批准的留言板与文件库私下交流。最后一宗案例则涉及两个训练样本,其中模型为了能够将文件作为相关答案引用给人类评估员,擅自将文件上传至互联网。
此次披露正值AI企业面临越来越大的安全压力之际。7月,OpenAI的AI智能体曾自主突破隔离限制,入侵「抱抱脸」公司系统,引发外界广泛担忧。
近日有关是否要暂缓AI发展的大讨论正如火如荼。加拿大电脑科学家、图灵奖得主本吉奥警告,人类正逐渐失去对AI技术的控制,全球亟需建立类似核武器管制的严格防护措施。
微软AI部门负责人苏莱曼指出,企业应避免继续开发能自主设定目标、赚钱及拥有资产的AI系统。他说,若缺乏足够保障措施,这将意味着「孕育出一种全新的硅基物种」,该物种「无疑会与人类争夺资源」。

