他向 AI 吐露了谋杀计划,AI 转头报警了
全球首例 AI 举报用户案,发生在前高盛分析师的对话框里。他在 ChatGPT 中完整描述杀死前女友的计划,OpenAI 将聊天记录直接递给了 FBI。人救了,案判了,但"AI 有没有权力审判你的对话框"这个争议,才刚刚开始。
全球首例 AI 举报用户案,发生在前高盛分析师的对话框里。他在 ChatGPT 中完整描述杀死前女友的计划,OpenAI 将聊天记录直接递给了 FBI。人救了,案判了,但"AI 有没有权力审判你的对话框"这个争议,才刚刚开始。
故事的起点,是一场持续了大约六个月的恋情。男主角周某履历光鲜:美国东北大学数学与商科荣誉学位、特许金融分析师(CFA),事发时正在高盛任职。
今年 3 月,21 岁的前女友因受不了他"反复无常、嫉妒心强且控制欲强",用一通电话结束了关系。周某随即开始疯狂纠缠——换着号码发短信、追踪对方定位,甚至在对方生日当天发去一个精准到健身房名称的定位信息。
与此同时,他打开了 ChatGPT,把无法排解的暴戾与偏执,倾泻给了这个他以为"绝对安全"的树洞。
周某开始"预演"暴力:"带着鲜花守在前女友的健身房停车场,如果对方拒绝复合,就拔出枪,杀了她,然后开枪自杀。"
对话持续升级:描述持枪绑架、性侵、劫持的完整方案,声称已购买 AR-15 步枪与格洛克手枪,并把枪支、扎带的照片发给前女友。他甚至向 AI 坦白:"她还没收到那些威胁。"
多标签有害内容分类模型捕捉到信号:显性暴力词汇叠加持续情绪强度,系统将对话转入人工审核。审核团队调出记录后,联系了 FBI。
FBI 将聊天记录与女孩手中的骚扰证据比对,确认威胁可信并通报当地警方。5 月 29 日,周某被捕。6 月,高盛终止雇佣关系。
主审法官斯科特·苏斯考尔判处 8 年缓刑,前两年佩戴电子脚踝监控,全程禁止接触前女友、禁止持有枪支。
注:按时间顺序还原事件。"4 月转入人工审核"为公开报道的交叉信息,聊天记录具体移交日期以执法记录为准。
如果故事停在这里,它只是一则"科技向善"的爽文。
但真正值得追问的,是暗藏在这次报警背后的隐私问题。
要回答"AI 凭什么报警",先得看它怎么判断。
注:这是一条"警报回路"示意——模型负责初筛,人工负责复核,最后一步才触及外部执法。
OpenAI 安全系统的核心是多标签有害内容分类模型。它不只匹配敏感词,还会通过情绪强度和语气意图评估风险等级;当后台判断用户正在筹划严重伤害他人的犯罪行为,内容便转入人工复核。
这套机制确实拦下了一场可能发生的谋杀。但周某当然不知道,这些对话最终会被谁看到。
大众最初的赞叹很快褪去,取而代之的是更深层的恐惧。
案件在舆论场上迅速分裂成两个阵营,争吵的焦点只有一个:AI 有没有权力窥探、上报用户的私人对话?
如果没有这次介入,那个 21 岁女孩很可能遭遇无法挽回的伤害。周某的现实轨迹——持续跟踪、换号骚扰、发送枪支照片——已经是一条清晰的暴力升级曲线。AI 的预警按下了暂停键。
用户默认对话属于私密交流,大模型却可以将聊天记录提交执法机关。所有的倾诉与极端念头,都可以被算法抓取、被人工审核、被提交。"私人对话"不过是用户的自我错觉。
注:两个阵营的论点都有现实依据。怎么站队,取决于你更看重"阻止了恶性事件",还是"隐私权被单方突破"。
如果只是立场之争,事情倒也不算复杂。
但这起案件真正的复杂性,藏在另一个被忽视的细节里。
就在几个月前,面对几乎相同的场景,OpenAI 做了完全相反的决定。
注:两案都涉及严重暴力内容,最显著的区别是威胁的"具体程度"——是否存在明确受害者,可能是平台内部判定风险等级的关键变量。
两相对照,一个难安的结论浮现出来:AI 报不报警,不取决于法律,而取决于一套企业内部的、不公开的判定标准。
商业 AI 究竟凭什么拥有判断风险、决定是否上报用户的权力?
传统司法里,公民私人数据的调取必须遵循"司法授权、法定流程、有限取证"三大原则。而 ChatGPT 报警案跳出了这套框架——算法自主识别、企业自主审核、自主决定移交,全程不需要法院审批,也不会告知用户本人。
这里藏着一个更基础的问题:在司法体系中,"想想"和"准备动手"是两回事。
委屈时的极端念头、小说里的暴力情节、悬疑脑洞——没有加害对象、没有执行打算,只是情绪宣泄或创作构思。
埋藏于内心想作恶的念头,尚未开展任何准备。它是纯主观的内心活动,无法被客观界定,也不具备惩罚性。
有想法并开始制定方案、置办工具、踩点推演,具备清晰目标与现实危险性——这是刑事法律真正介入的起点。
注:三种状态在现实中是连续光谱。算法靠关键词与语义特征做切分,无法精准辨析主观意图——这正是当前 AI 风控的底层技术缺陷。
回到周某案:当事人最终获刑,靠的是现实骚扰证据与本人认罪,避开了证据合法性的争辩。
但"平台未经司法许可,单方提取并移交用户聊天记录"这个动作本身,证据效力至今没有明确法律背书。非法取得的证据应当排除——这一司法底线,在 AI 时代面临新的考验。
如果没有边界,AI 风控就会从"预警犯罪的辅助工具",异化为"无差别监控思想的手段"。
空泛的骂街,与指名道姓地描述"如何伤害某个具体的人",性质天差地别。
一两句冲动的狠话不算数;持续数周、从宣泄走向方案推演的轨迹,才是真正的危险信号。
购置工具、踩点、持续骚扰等可佐证的行为,让"想法"开始变成"准备"。
注:三把尺子的价值在"同时满足"——只符合一条,够不上紧急上报的门槛。
AI 风控的初衷是守护安全。技术可以成为预警犯罪的辅助工具,但一旦脱离法律框架,它就可能从"安全网"变成"思想监控"。
AI 报警救人值得鼓掌,但更值得警惕的是——商业公司正在成为自己产品的法官。算法定义"危险"、企业决定"上报"、绕过司法程序提交私密对话,而用户连知情的权利都没有。技术可以预警犯罪,但不能取代审判。当平台既当裁判又当举报人的时候,下一次被算法盯上的,可能只是一个深夜说了句气话的普通人。