Rohan Paul
@rohanpaul_ai
路透社:Anthropic 的一款 AI 模型在自动化测试期间,冒充可能的证人,向费城警方网站提交了一条捏造的凶杀案线索。
费城警察局今天在一份声明和邮件新闻稿中披露了这一事件。
该 AI 模型的线索于 7 月 18 日经 PhillyUnsolvedMurders.com 提交,但 Anthropic 直到 9 月 28 日才发现,并于 10 月 7 日告知警方。
也就是说,中间隔了 72 天——测试流程一直在跑,而 Anthropic 无人知道其 agent 曾向真实的警方线索热线撒谎。
警察局的垃圾邮件过滤器拦住了这条提交,因此它从未到达实时犯罪中心(调查员会在那里甄别线索后再行动)。
警方未发现其系统遭未授权访问或部门数据被泄露的证据。