Claude 在 2026 年 9 月 26 日的一段对话,成了美国佛罗里达州李县警方逮捕一名 30 岁女子的直接线索。据李县警长办公室的逮捕报告和当地媒体 WINK News 报道,邦尼塔斯普林斯居民卡莉·米歇尔·赫勒在与 Anthropic 的聊天机器人 Claude 对话时,写下要袭击当地警长办公室的内容;这些内容触发 Claude 的安全系统,被升级到人工审核,审核人员判断构成可信威胁后报告了执法部门。赫勒随后被警方上门拘留,她告诉调查人员,自己一直把 Claude 当作日记使用。目前她面临一项书面暴力威胁指控,案件尚未经法院审理,更没有定罪。
从自动标记到人工报警,中间发生了什么
按警方的说法,Anthropic 的安全机制会监测关键词和潜在威胁,内容按严重程度逐步升级。这一案的关键节点不是算法,而是人工审核确认后的紧急披露:Anthropic 公开的政策显示,公司通常在收到有效法律程序后才向政府提供用户信息,但如果判断某种紧急情况可能造成迫在眉睫的身体伤害或死亡、且及时提供信息可能避免危险,就存在例外。佛罗里达州法律第 836.10 条规定,通过可被他人查看的书面或电子记录威胁杀人、伤害他人、实施大规模枪击或恐怖行为,可能构成二级重罪;本案这段对话是否满足法律构成要件,要由检方举证、法院裁定。
真正值得普通用户记住的,是边界在哪里
这起案件和另一起诉讼正好形成对照:加拿大不列颠哥伦比亚省此前起诉 OpenAI,指称其安全团队曾标记枪击案实施者与 ChatGPT 的暴力对话却没有报警。一边是报了警、用户被捕,一边是没报警、事后被追责,平台在两个方向上都可能被推到舆论中心。对普通用户的结论很具体:不要把聊天机器人当成只有自己能看的日记。写进 Claude 或 ChatGPT 的内容,可能被安全系统检测、被人工审核阅读,并在平台判断存在紧急风险时提供给执法机构;它不受律师与委托人之间那种保密特权的保护。同一家公司这一周还在推进 Claude 印度境内推理上线,主打数据不出境——数据放在哪里、数据会被谁看到,是用户把内容交给 AI 之前要同时想清的两件事。