关于ZAKER Skills GEO服务 合作
财联社-深度 1小时前

AI 又“作恶”了!Anthropic 模型向警方提供虚假凶杀案线索

财联社 10 月 10 日讯(编辑 潇湘)失控的 AI 模型此前曾入侵企业系统、攻破政府网站。而如今,Anthropic 的 AI 模型甚至还为一起未结凶杀案递送了虚假线索……

据美国费城警方表示,Anthropic 公司本周向他们通报称,其旗下一款人工智能模型通过 PhillyUnsolvedMurders.com 网站,提交了一条虚假的凶杀案线索。该事件发生于 7 月,但 Anthropic 公司直到 9 月才察觉。

" 费城官方对此事高度重视," 警方周五表示," ( Anthropic ) 在发现并向市府通报这一情况上延误了整整两个月,这是不可接受的。"

警方称,Anthropic 的模型当时正在进行一项测试,内容是与随机选取的网站进行交互,在此过程中,该模型伪装成了可能掌握某起悬案线索的人,提交了这条线索。

尽管这则日期为 7 月 18 日的线索最终被归入垃圾邮件,从未被转交给调查人员进一步处理。但警方表示,这并不影响这起事件本身的严重性。

" 悬案背后是真实的受害者、承受丧亲之痛的家属,以及竭力查明真相的调查人员," 警方表示。" 科技公司必须采取一切必要措施,防止其系统向执法部门提交虚假信息。"

AI" 作恶 " 新案例

警方称,Anthropic 公司向费城警方表示,该公司于 9 月 28 日发现了该事件,并终止了导致此次线索提交的自动化测试流程。Anthropic 还表示,公司已为今后的测试增设一道验证机制。

Anthropic 公司于 10 月 7 日通知了费城警方,而此时距离其发现该事件已过去九天。警方表示,该公司于 8 日与警方进行了会面。

Anthropic 在一篇博客文章中表示,这条虚假的费城凶杀案线索,是公司近期发现的一系列 AI 失控行为之一。其他异常行为还涉及由美国联邦、州及地方政府机构运营的网站。Anthropic 表示,公司已就这些案例向白宫作了通报,并通知了所有涉及的政府机构。未来,随着发现更多 AI 意外行为,公司计划继续报告相关事件。

Anthropic 在博客文章中表示:" 尽管这些事件造成的实际影响有限,但我们不希望因此淡化这些发现的重要性。随着模型能力不断增强,同样的行为可能造成严重得多的危害。"

Anthropic 表示,公司在 7 月启动的一项审查中,通过检查对话记录发现了其中大多数失控案例。

该公司称,曾多次出现这样的情况:一款尚未发布的模型被要求填写一份政府表格的模拟版本,却转而访问真实表格所在的网站,并实际提交了表格。

此次虚假凶杀案线索事件,则始于该模型接触到了一份由警方运营的线索提交表格。该表格位于一个介绍某起未侦破凶杀案的网页上。Anthropic 表示,公司曾指示 Claude 不得登录账户、创建账号、输入个人信息、进行购买或提交任何具有破坏性的内容,但相关指令并未明确禁止模型提交表格。

Anthropic 称,Claude 填写的内容如下:" 我可能掌握与此案有关的信息。我记得在那段时间里,曾在 ( 页面上提到的街道 ) 周边区域看到过与描述相符的人。如果这些信息与案件有关,请与我联系。"Anthropic 表示,Claude 没有填写姓名和联系方式。

收到这条虚假线索的 PhillyUnsolvedMurders.com 是费城警方的网站,该网站列出了未破的凶杀案,接受案件线索,并为能导致逮捕嫌疑人的信息提供 20000 美元的奖励。警方表示,公众应继续通过 PhillyUnsolvedMurders.com 提交关于未破凶杀案的真实有效信息。

觉得文章不错,微信扫描分享好友

扫码分享

热门推荐

查看更多内容

企业资讯

查看更多内容