
纳德拉周六(10 月 10 日)在社交媒体上发文称,部署先进 AI 的企业不应依赖 AI 模型开发商的安全保证," 而必须假定模型已经遭到入侵,并从一开始就对其进行隔离和控制。"
" 可以把它想象成一套‘紧急刹车’(emergency brake)系统,获得授权的人员应始终能够在模型执行任务的过程中暂停或关闭它。"
纳德拉最新提出的安全建议包括:不要依赖单一 AI 模型作出关键决策;对 AI 智能体的行为保留防篡改记录;并接受独立审计。
他还呼吁企业披露重大 AI 故障或安全漏洞,并分享事故中出现的问题及相关细节,以便其他企业加强自身的防护措施。
近几个月,关于 AI 安全风险的讨论因一系列事件逐步升温。OpenAI 和 Anthropic 先后披露,其 AI 模型突破测试环境进入公共互联网,未经授权访问了其他机构的系统。
这些披露加剧了外界对尖端 AI 安全风险的担忧,也让有关 "AI 紧急关闭开关 "(AI kill switch)的讨论再度升温。
上个月,微软的 AI 研究人员公布了一系列指导原则,对公司开发最先进模型的方式加以限制。
这些指导原则指出,AI 模型不应被设计成能够逃脱人类控制或欺骗用户,也不应完成任何需要违反其既定原则才能执行的任务。
纳德拉在最新的帖文中写道:" 我们不能把超级智能视为一系列层层嵌套的黑箱,只是简单地接受或拒绝它给出的建议、答案和采取的行动。"
" 我们必须构建受到约束的系统,使其行为能够被观察、被限制、能够接受测试,而且其行动始终能够得到控制。换句话说,我们需要将智能的供给与对智能的控制权分离开来。"
本月早些时候,特朗普宣布成立 " 超级智能特别工作组 "。周五,该工作组发出警告,要求开发商报告并解决安全事件,否则可能面临后果。