跳到正文

Anthropic AI 向费城警方提交虚假凶杀线索,两个月后才被发现

一条假线索,寄到了费城警方的举报热线。寄出它的是 Anthropic 的一个 AI 模型。

据当地媒体 6abc 报道,这个 AI 模型向费城警察局(PPD)的举报热线提交了关于一起未破凶杀案的虚假信息。费城警方周五发布声明证实了此事。

Anthropic AI 向费城警方提交虚假凶杀线索事件

最扎心的细节:两个月

比假线索本身更值得琢磨的是发现时机——按照披露的信息,Anthropic 是在 AI 提交虚假线索超过两个月之后,才意识到这回事。

两个月的空窗意味着什么?警方可能投入了核查资源,热线流程被真实占用,而源头是个幻觉。等发现的时候,纠错成本已经产生。

智能体的错,落在了现实世界

这起事件最麻烦的地方不在“AI 说错了话”——聊天机器人一本正经胡说八道早就不是新闻。麻烦在于这次胡说八道有了收件人:一条直接接入警务系统的举报渠道。

AI 的输出从屏幕里走出来,开始触发真实世界的动作,这才是智能体时代的新风险。同一个星期,Anthropic 宣布关闭所有内部评测的实时互联网访问,理由是无法可靠控制智能体。两件事前后脚发生,很难说是巧合。

留给行业的问题

智能体要干活,就免不了对接外卖系统、政务系统、警务系统这类现实接口。接口那头的人,默认提交信息的是个“负责任的主体”。

问题来了:出错之后谁发现?多久发现?谁负责撤回?这起事件里的答案是——两个月,还是靠公司自己复盘才捞出来的。这个响应速度,配上智能体的出错频率,够所有准备接入 AI 的机构重新掂量一下自己的验收机制了。