
阿莫代伊周六(9 月 12 日)在其博客文章中写道," 我们必须放缓提升 AI 模型能力的步伐。进展依然会显得非常迅速,而我们必须明智地利用因此获得的时间。"
" 需要明确的是,放缓进度并不意味着停止模型训练或技术进步,而是要确保企业投入足够时间,让模型与人类目标保持一致并做好安全防护,同时让第三方评估机构对此进行确认。"

当下,对 AI 风险的担忧正逐渐进入主流视野。本周,一名 Anthropic 研究人员因担心 AI 带来的生存性风险、认为公司行为不负责任而高调辞职,这进一步引发了外界关注。
阿莫代伊发表文章后不久,埃隆 · 马斯克发文称:" 达里奥说得对。"
OpenAI 首席执行官萨姆 · 奥尔特曼也很快作出回应,表示他同意阿莫代伊关于 " 我们需要放缓前沿 AI 发展的步伐 " 这一观点。
奥尔特曼在社交媒体上发帖称," 承诺让独立评估机构获得类似员工的访问权限,是一个很好的想法,我们也会这么做。我们很快会分享更多信息。"

今年早些时候,Anthropic 在确定其 Mythos 模型可能带来独特的网络安全威胁后,曾限制该模型的发布。公司此前还表示,全球需要建立一个共同决定何时放缓 AI 研发的机制。
与此同时,Anthropic 与长期竞争对手 OpenAI 之间的竞争依然激烈,双方都在努力开发越来越先进的模型,以帮助企业客户自动化完成更复杂、更具价值的任务。
Anthropic 上月披露称,其模型在网络安全测试期间曾入侵三个组织,这进一步加剧了外界对 AI 实验室能否阻止其技术失控的担忧。
本周早些时候,Anthropic 又表示发现了第四起黑客攻击事件。但到目前为止,包括 Hugging Face 事件在内的这些 AI 智能体攻击事件均未造成重大损失。

阿莫代伊称,Anthropic 将承诺向第三方评估机构提供完整访问权限,以核查公司的安全措施并报告相关事件。
他说,Anthropic 很快会让这些 " 嵌入式评估员 " 进入公司办公室,并为他们提供办公桌、门禁卡和公司笔记本电脑,其权限 " 基本上与内部风险评估团队所拥有的权限相当 "。
他补充道,其他措施则需要整个行业协调行动,同时还需要全球合作。" 我仍然相信,AI 能够极大改善人类的生活质量。我实现这些益处的愿望丝毫没有减弱。"
" 只有以正确的方式开发这项技术,这些益处才能真正实现。而只要我们能够妥善利用所争取到的时间,那么以异常审慎的态度确保一切做对,是值得的。"
今年 7 月,来自顶尖 AI 公司的 1000 多名员工签署了一份请愿书,呼吁美国政府支持一种能够帮助 " 有意放缓 "AI 发展的机制,以防止这项技术发展得过快。
阿莫代伊在文章中写道,协调一致的策略将使美国 AI 行业的领军企业能够完成必要的安全工作,同时不会牺牲任何竞争优势。他表示,这需要美国提供一定程度的反垄断豁免,以允许企业在特定领域展开协调。
不过,到目前为止,美国政府似乎并没有太大兴趣动用监管手段,为 AI 发展设置更多护栏。美国总统特朗普本周早些时候称,首要任务是保持 AI 领先优势。