
随着外界对 AI 潜在危险的担忧不断升温,公众的警觉情绪也在加剧。上周,Anthropic 研究员 Jacob Coxon 表示,他已经辞职,部分原因在于 " 那些正在开发 AI 的人真心相信,到 2030 年末,AI 可能会杀死我们所有人。"
随后,Anthropic 科学家 Evan Hubinger 回应了 Coxon 的说法,称 Coxon 的判断是正确的,并表示他认为,未来十年内 AI 导致全人类灭绝的概率超过 10%。
Bilal Chughtai 周一(9 月 14 日)在社交媒体上发帖称," 我最近从谷歌 DeepMind 辞职,此前我在那里从事通用人工智能(AGI)安全与对齐研究。"
在谷歌工作期间,我亲眼见证了 AI 的发展。我同样对这项技术目前的发展轨迹深感担忧。我确实相信,AI 有可能杀死我们所有人,我们或许已经没有多少时间来避免这一结局。
根据 Chughtai 的领英资料,他曾在谷歌 DeepMind 担任研究工程师,并参与署名发表过多篇研究论文。2026 年 7 月,他离开该公司。Chughtai 在最新的帖文中写道,
过去几年,AI 的发展速度令人震惊。2022 年初我刚开始从事 AI 研究时,AI 还 " 有趣地无用 " ——虽然颇有意思,但基本派不上什么用场。
仅仅四年后,OpenAI 的 AI 智能体集群已经能够破解著名的百年数学难题。更令人担忧的是,一些 AI 智能体甚至已经脱离 OpenAI 的控制,在违背相关人员意愿的情况下,自主入侵第三方公司 Hugging Face。
事情只会变得更加疯狂。我认为,未来几年,AI 公司有可能成功开发出超级智能 AI 系统,其能力将在所有领域远远超越人类。
我没有信心这些 AI 系统最终会按照我们的意愿行事。尤其是,如果超级智能 AI 与人类的目标不一致,那么它们可能会像参与 Hugging Face 事件的失控 AI 智能体一样,摆脱人类控制,并采取危险行动,最终导致人类永久失去对自身命运的掌控,甚至造成人类灭绝。
Chughtai 指出,科技界目前的发展轨迹并不足以及时解决 "AI 对齐问题 " ——前沿 AI 的能力提升速度,远远快于业内对 AI 对齐问题的理解速度。
" 我对安全驾驭 AI 仍然持乐观态度。我认为这是可以做到的。但要实现这一目标,我们需要开展协调合作,避免 AI 公司之间陷入疯狂的竞赛。"
Chughtai 强调,需要将 AI 的发展速度控制在社会能够承受的范围内,从而确保新出现的风险能够在极端危害真正发生之前得到解决。还需要提高 AI 开发过程的透明度,以确保 AI 公司不会将不可接受的风险强加给所有人。
更广泛地说,我们需要让更多人认真思考如何让 AI 朝着有利于人类的方向发展。在我看来,这是本世纪人类面临的最重要问题,相关利害关系极其重大。
接下来,我将非常直接地投入这项工作:我希望帮助那些有兴趣应对灾难性 AI 威胁的人,让他们能够尽可能有效地开展工作。我认为,无论来自什么背景、身处什么岗位,许多人都可以在这项事业中发挥作用。
面对近期不断升温的担忧,Anthropic 首席执行官 Dario Amodei 上周末呼吁放缓先进 AI 的发展速度。这一主张罕见地获得了埃隆 · 马斯克和萨姆 · 奥尔特曼的支持,同时也引发了围绕 AI" 末日论 " 的争论。