当AI聊天机器人开始"告密",我们该为安全鼓掌,还是为隐私担忧?

7月16日,Meta宣布了一项可能改变青少年安全格局的功能:当青少年与Meta AI聊天机器人讨论自杀或自残相关话题时,系统将自动通知其家长。

这项功能已在美国、英国、澳大利亚和加拿大上线,前提是家长启用了Instagram家长监督模式。Meta称今年底前将其推广至全球。

这不是"关键词过滤",而是一个专为识别自我伤害意图训练的AI模型。当青少年在对话中提到相关话题——不论是用隐晦措辞还是直接表达——系统都会捕获信号。每段被标记的对话都会先经人工审核,确保不误报后再发出警报。

"宁可错报,不可漏报"

Meta此次上线这项功能时,态度出人意料地坦诚。

官方声明中有一段话很值得玩味:"如果青少年的真实意图无法确定,我们会采取更谨慎的做法,通知家长。家长有时可能会收到最终证明没有必要担忧的警报,但我们认为,现阶段应当从更谨慎的标准开始。"

翻译成大白话:宁可让家长白跑一趟,不能漏掉一个真正的求救信号。

在AI产品普遍追求"精准率"和"降低误报"的大环境下,Meta选择了一条几乎完全相反的策略。这条策略的潜台词是:一个误报可以解释,一条漏报无法挽回。

不是AI第一次介入自杀预防,但这次角色变了

在此之前,Instagram已经支持在青少年反复搜索自杀或自残词语时通知家长。但搜索行为和聊天对话本质上是两回事——搜索是自己面对搜索引擎,聊天是面对一个能回应的"对话者"。

Meta AI现在做的事情,相当于一个心理热线的接线员同时在监听一段对话。青少年可能以为自己在跟一个"树洞"聊天,实际上这个树洞背后是一整套预警系统。

而且不仅如此。Meta同时宣布,无论对话者是不是青少年,只要AI判断对话中有人可能自杀,系统就会联系紧急服务机构。这意味着Meta AI的角色,正在从纯粹的"聊天工具"向"安全哨兵"转变。

这届家长看到的比想象中多

新功能还包括:家长可以查看青少年过去一周与Meta AI讨论过哪些话题。

这是整个公告里最容易被忽略却可能引发最多争议的一项。不是查看对话全文,但"讨论过哪些话题"已经足够家长拼凑出大致轮廓——如果你家孩子连续一周在跟AI聊"如何应对考试焦虑"和"感觉自己不够好",家长干预的概率远高于"今天天气不错"。

Meta的解释是"透明度有助于家长履行监护职责"。但站在青少年视角,这等于在他们和AI之间装了一个单向透视镜——你以为你是孤独的,其实你不是。

隐私和安全的零和博弈?

Meta这个功能上线后,舆论几乎可以预判地会分裂成两派。

支持者会说:青少年自杀率连年攀升,AI能做预警是天大的好事。2019年英国一名14岁少女莫莉·拉塞尔在Instagram上浏览了大量自残内容后自杀,这件事至今是Meta头上挥之不去的阴影。如果当时有AI预警系统,结局可能完全不同。

质疑者会说:青少年之所以愿意对AI说真话,恰恰是因为AI"不会告密"。当AI开始向家长汇报,青少年还会对AI说真话吗?如果不会,那这个预警系统真正阻挡的,可能从"自杀行为"变成了"求助意愿"。

这两派人说的都对。

破局点可能不在AI,在人

Meta在功能设计上其实已经做出了让步——每段对话都先经人工审核才决定是否通知家长。这个"人工把关"环节是整个系统的安全阀,也是最大的成本中心。

但真正的问题从来不是AI能不能识别出危险信号——以今天大语言模型的能力,捕捉自杀意图在技术上没有根本障碍。真正的问题是:识别出来之后怎么办?

通知家长是第一环,也是最简单的一环。家长收到了警报,然后呢?有多少家长知道如何跟正在经历心理危机的青少年对话?有多少学校配备了足够数量的心理咨询师?AI能做到"发出一个信号",但信号之后的整个社会支持系统,目前远远跟不上。

Meta迈出了第一步。剩下的999步,需要的不是算法,是全社会。


文中所用图片来源于网络,仅供技术学习与交流。如权利人认为存在侵权,请联系我们,我们将在24小时内处理。

Logo

DAMO开发者矩阵,由阿里巴巴达摩院和中国互联网协会联合发起,致力于探讨最前沿的技术趋势与应用成果,搭建高质量的交流与分享平台,推动技术创新与产业应用链接,围绕“人工智能与新型计算”构建开放共享的开发者生态。

更多推荐