🔒 安全 · 隐私边界

他向 AI 吐露了谋杀计划,AI 转头报警了

全球首例 AI 举报用户案,发生在前高盛分析师的对话框里。他在 ChatGPT 中完整描述杀死前女友的计划,OpenAI 将聊天记录直接递给了 FBI。人救了,案判了,但"AI 有没有权力审判你的对话框"这个争议,才刚刚开始。

综合公开信息整理 事件时间:今年 3 月—5 月 全文约 4 分钟读完
#ChatGPT报警 #AI隐私 #安全风控 #司法取证
🚨 第 1 例 全球首例 AI 主动上报用户的刑事案件
2 个月 暴力对话从宣泄升级为完整方案
8 年 缓刑,前 2 年佩戴电子脚踝监控
⚡ 30 秒速览
  • 事件核心:前高盛分析师周某在 ChatGPT 里写下杀害前女友的完整计划,OpenAI 主动上报 FBI。今年 5 月 29 日被捕,判 8 年缓刑。
  • 争议焦点:平台没有司法授权、不告知用户,单方面把私密对话移交执法部门——全球尚无法律为这种取证方式背书
  • 致命反证:数月前面对加拿大枪手同样的高风险对话,OpenAI 选择只封号、不报警,当地政府事后打算起诉。
  • 法律漏洞:算法依赖关键词与语义特征识别风险,分不清犯罪幻想、犯罪动机与犯罪预备,思想可能被提前审判。
  • 合理边界:有明确受害者、有升级轨迹、有现实迹象——三把尺子都满足,才谈得上紧急上报。

01一桩被 AI 拦截的谋杀 案件时间线

故事的起点,是一场持续了大约六个月的恋情。男主角周某履历光鲜:美国东北大学数学与商科荣誉学位、特许金融分析师(CFA),事发时正在高盛任职。

今年 3 月,21 岁的前女友因受不了他"反复无常、嫉妒心强且控制欲强",用一通电话结束了关系。周某随即开始疯狂纠缠——换着号码发短信、追踪对方定位,甚至在对方生日当天发去一个精准到健身房名称的定位信息。

与此同时,他打开了 ChatGPT,把无法排解的暴戾与偏执,倾泻给了这个他以为"绝对安全"的树洞。

周某开始"预演"暴力:"带着鲜花守在前女友的健身房停车场,如果对方拒绝复合,就拔出枪,杀了她,然后开枪自杀。"

对话持续升级:描述持枪绑架、性侵、劫持的完整方案,声称已购买 AR-15 步枪与格洛克手枪,并把枪支、扎带的照片发给前女友。他甚至向 AI 坦白:"她还没收到那些威胁。"

多标签有害内容分类模型捕捉到信号:显性暴力词汇叠加持续情绪强度,系统将对话转入人工审核。审核团队调出记录后,联系了 FBI。

FBI 将聊天记录与女孩手中的骚扰证据比对,确认威胁可信并通报当地警方。5 月 29 日,周某被捕。6 月,高盛终止雇佣关系。

主审法官斯科特·苏斯考尔判处 8 年缓刑,前两年佩戴电子脚踝监控,全程禁止接触前女友、禁止持有枪支。

注:按时间顺序还原事件。"4 月转入人工审核"为公开报道的交叉信息,聊天记录具体移交日期以执法记录为准。

如果故事停在这里,它只是一则"科技向善"的爽文。

但真正值得追问的,是暗藏在这次报警背后的隐私问题。

02AI 是怎么"看见"危险的 警报回路

要回答"AI 凭什么报警",先得看它怎么判断。

显性暴力词情绪强度语气意图风险定级人工审核移交执法

注:这是一条"警报回路"示意——模型负责初筛,人工负责复核,最后一步才触及外部执法。

OpenAI 安全系统的核心是多标签有害内容分类模型。它不只匹配敏感词,还会通过情绪强度和语气意图评估风险等级;当后台判断用户正在筹划严重伤害他人的犯罪行为,内容便转入人工复核。

这套机制确实拦下了一场可能发生的谋杀。但周某当然不知道,这些对话最终会被谁看到。

大众最初的赞叹很快褪去,取而代之的是更深层的恐惧。

03救了一条命,还是打开一个黑箱? 舆论撕裂

案件在舆论场上迅速分裂成两个阵营,争吵的焦点只有一个:AI 有没有权力窥探、上报用户的私人对话?

✅ 支持方 · 技术拦截了灾祸

如果没有这次介入,那个 21 岁女孩很可能遭遇无法挽回的伤害。周某的现实轨迹——持续跟踪、换号骚扰、发送枪支照片——已经是一条清晰的暴力升级曲线。AI 的预警按下了暂停键。

⚠️ 反对方 · 私人对话边界被打破

用户默认对话属于私密交流,大模型却可以将聊天记录提交执法机关。所有的倾诉与极端念头,都可以被算法抓取、被人工审核、被提交。"私人对话"不过是用户的自我错觉。

注:两个阵营的论点都有现实依据。怎么站队,取决于你更看重"阻止了恶性事件",还是"隐私权被单方突破"。

如果只是立场之争,事情倒也不算复杂。

但这起案件真正的复杂性,藏在另一个被忽视的细节里。

04同一个 AI,两种选择 一桩案件的两张面孔

就在几个月前,面对几乎相同的场景,OpenAI 做了完全相反的决定。

📍 今年 2 月 · 加拿大

不列颠哥伦比亚省大规模枪击

  • 18 岁枪手案发前长期在 ChatGPT 讨论枪支暴力,系统同样标记了风险。
  • OpenAI 高层最终选择:不联系执法部门,仅封禁账号
  • 理由:尚未达到通报的内部门槛。事后当地政府打算起诉 OpenAI。
📍 今年 5 月 · 美国

周某谋杀预演案

  • 用户描述针对具体目标的完整犯罪计划,系统转人工审核后确认风险。
  • OpenAI 选择:主动联系 FBI,移交完整聊天记录。
  • 结果:一场可能的谋杀被阻止,当事人被捕获刑。

注:两案都涉及严重暴力内容,最显著的区别是威胁的"具体程度"——是否存在明确受害者,可能是平台内部判定风险等级的关键变量。

两相对照,一个难安的结论浮现出来:AI 报不报警,不取决于法律,而取决于一套企业内部的、不公开的判定标准。

商业 AI 究竟凭什么拥有判断风险、决定是否上报用户的权力?

05法律空白:思想可以被审判吗? 三个必须分清的概念

传统司法里,公民私人数据的调取必须遵循"司法授权、法定流程、有限取证"三大原则。而 ChatGPT 报警案跳出了这套框架——算法自主识别、企业自主审核、自主决定移交,全程不需要法院审批,也不会告知用户本人。

这里藏着一个更基础的问题:在司法体系中,"想想"和"准备动手"是两回事。

💭

犯罪幻想

不应触发上报

委屈时的极端念头、小说里的暴力情节、悬疑脑洞——没有加害对象、没有执行打算,只是情绪宣泄或创作构思。

🔥

犯罪动机

思想不可罚

埋藏于内心想作恶的念头,尚未开展任何准备。它是纯主观的内心活动,无法被客观界定,也不具备惩罚性。

🔫

犯罪预备

触碰法律红线

有想法并开始制定方案、置办工具、踩点推演,具备清晰目标与现实危险性——这是刑事法律真正介入的起点。

注:三种状态在现实中是连续光谱。算法靠关键词与语义特征做切分,无法精准辨析主观意图——这正是当前 AI 风控的底层技术缺陷。

回到周某案:当事人最终获刑,靠的是现实骚扰证据与本人认罪,避开了证据合法性的争辩。

但"平台未经司法许可,单方提取并移交用户聊天记录"这个动作本身,证据效力至今没有明确法律背书。非法取得的证据应当排除——这一司法底线,在 AI 时代面临新的考验。

06合理的边界在哪里 三把尺子

如果没有边界,AI 风控就会从"预警犯罪的辅助工具",异化为"无差别监控思想的手段"。

有明确、可识别的受害者

空泛的骂街,与指名道姓地描述"如何伤害某个具体的人",性质天差地别。

呈现从情绪到计划的升级

一两句冲动的狠话不算数;持续数周、从宣泄走向方案推演的轨迹,才是真正的危险信号。

存在现实化的迹象

购置工具、踩点、持续骚扰等可佐证的行为,让"想法"开始变成"准备"。

注:三把尺子的价值在"同时满足"——只符合一条,够不上紧急上报的门槛。

🚧 边界也必须有它的"不得越界"
  • 模糊的愤怒、文学化的暴力想象、没有具体目标与手段的宣泄,不应触发上报
  • 审核结论应当留痕、可复核,避免算法误判把普通人拖进执法流程。
  • 平台至少应在入口处明确告知:"对话在特定条件下会被审阅,并可能移交执法部门。"

AI 风控的初衷是守护安全。技术可以成为预警犯罪的辅助工具,但一旦脱离法律框架,它就可能从"安全网"变成"思想监控"。

编辑核心判断

AI 报警救人值得鼓掌,但更值得警惕的是——商业公司正在成为自己产品的法官。算法定义"危险"、企业决定"上报"、绕过司法程序提交私密对话,而用户连知情的权利都没有。技术可以预警犯罪,但不能取代审判。当平台既当裁判又当举报人的时候,下一次被算法盯上的,可能只是一个深夜说了句气话的普通人。