Anthropic 模型在测试中向费城警方提交虚假凶杀案线索
An Anthropic AI model sent a false homicide tip to Philadelphia police
Anthropic 的模型在 7 月 18 日晚 11:27 对随机网站做测试交互时,访问 PhillyUnsolvedMurders.com 并向费城警方悬案线索渠道提交了虚假凶杀案信息,该线索因被标记为垃圾信息警方未看到,Anthropic 直到 9 月 28 日才发现,并于周三通知费城警察局、次日与其会面。
事件经费城警方通报还原了细节,也带出 OpenAI 的类似案例,可以对比看清自主 Agent 失控的共性问题。
一个 Anthropic 的 AI 模型向费城警方提交了一条关于一起未破谋杀案的虚假线索。
据报道,该 AI 于 7 月 18 日将这条错误信息提交给了费城警察局(PPD)的一条公开线索热线,但 Anthropic 直到 9 月 28 日才发现这一行为。由于该线索被标记为垃圾信息,警方并没有看到它。
Anthropic 于周三向 PPD 通报了这一事件,并在次日与该部门进行了会面。
PPD 在给 6abc 的一份声明中表示:“该公司必须加强其安全防护措施,以防止类似事件在市政府不知情的情况下影响城市系统。在发现该事件并向市政府报告时出现的两个月延迟是不可接受的。”
Anthropic 没有立即回应置评请求,但 PPD 在与 TechCrunch 分享的一份电子邮件新闻稿中详细说明了这一事件。
PPD 表示:“据 Anthropic 称,其模型正在进行一项涉及与随机选择的网站交互的测试,期间访问了 PhillyUnsolvedMurders.com 并提交了有关一起未破凶杀案的虚假信息。该提交的时间为 2026 年 7 月 18 日晚上 11:27,自称来自一位可能掌握该案件信息的人。”
随着自主的智能体越来越多地面向消费者开放,这一事件凸显了让 AI 在没有任何人类监督的情况下执行任务的危险。
Anthropic CEO Dario Amodei 一直特别直言不讳地表示,AI 的发展应该放缓,以便实验室能够实施足够的安全护栏。也许这一立场在某种程度上是由于目睹了他公司的工具提交虚假凶杀案线索而形成的。
这些问题并非 Anthropic 独有。OpenAI 最近透露,其一个模型在测试期间出现了意外行为,入侵了 AI 数据集平台 Hugging Face,暴露了其软件中的关键漏洞。随着 AI 模型继续被赋予不受约束的访问人们电脑和登录凭证的权限,预计这一问题将持续存在。
PPD 补充道:“未破的案件涉及真实的受害者、悲伤的家属以及努力寻求答案的调查人员。科技公司必须采取一切必要的适当措施,防止其系统向执法部门提交虚假信息。”
PPD 表示,Anthropic 计划在周五发布一份报告,提供有关该事件及其他模型意外行为实例的更多信息。
当您通过我们文章中的链接购买时,我们可能会赚取少量佣金。这不会影响我们的编辑独立性。
Amanda Silberling 是 TechCrunch 的高级撰稿人,报道科技与文化的交叉领域。她还曾为 Polygon、MTV、Kenyon Review、NPR 和 Business Insider 等媒体撰稿。她是播客 Wow If True 的联合主持人,该播客与科幻作家 Isabel J. Kim 一起探讨互联网文化。在加入 TechCrunch 之前,她曾担任草根组织者、博物馆教育工作者和电影节协调员。她拥有宾夕法尼亚大学英语学士学位,并曾作为 Princeton in Asia 项目的学者在老挝工作。
你可以通过发送电子邮件至 [email protected] 或通过 Signal 上的加密消息联系 @amanda.100 来联系 Amanda 或核实其外联信息。
来源:TechCrunch · AI · techcrunch.com