人们是否在向 AI 过度分享敏感信息?简短的答案是:是的。
DuckDuckGo 研究院发布的一项名为《AI 隐私问题》的最新调查显示,约三分之一的人会向聊天机器人透露一些连朋友、家人和医疗专业人士都不知道的秘密。在自称是 AI 爱好者的群体中,这一比例上升至 56%。研究人员还发现,43% 的父母会向 AI 倾诉一些连最信任的人——包括自己的孩子——都不知道的事情。
尽管该调查没有明确指出用户向 AI 分享的是哪类个人信息,但过去的报告表明,人们经常向聊天机器人寻求身体和心理健康方面的帮助、理财建议、育儿问题以及婚姻困惑等方面的支持。
问题不在于向 AI 寻求帮助本身,而在于信息分享之后的数据失控。公司可以利用你的隐私信息来训练其 AI 系统;执法机构可以通过传票获取相关数据;如果你在工作中使用 AI 聊天机器人,雇主也很可能可以访问你的聊天记录。
DuckDuckGo 的报告指出,AI 公司试图让人们相信聊天机器人是值得信赖的倾诉对象,但这不过是一种虚假叙事。
报告的研究人员表示:"这些说法都基于一个假设——聊天内容是私密的。但在大多数情况下,事实并非如此。"
事实上,该调查发现,许多受访者并不清楚自己的聊天数据会被如何使用或访问,也不知道有相关设置可以阻止信息被记录或存储。在数据保护方面,近 40% 的受访者对科技公司毫无信任,近 50% 的受访者对美国政府同样毫无信任。
大语言模型的隐私风险
许多人都知道,各大公司会用定向个性化广告轰炸我们。比如在谷歌搜索了吸尘器,屏幕上就会出现吸尘器广告;搜索了地中海邮轮,YouTube(谷歌旗下产品)上就会推送邮轮广告。与此同时,公司还会买卖和共享我们的社交媒体数据,用于精准投放广告。
但 AI 的数据共享远不止于此。如果你向聊天机器人提供了敏感信息,这些信息可能面临被泄露或曝光的风险。维克森林大学的一位研究人员发现,利用大语言模型数据执行自主任务的 AI 智能体,有时会发生数据泄漏——无论是出于恶意还是无意为之。
你与 AI 聊天机器人的对话并不会凭空消失。除非你主动选择退出,否则 AI 系统会记录并保存这些对话,用于未来的用途,例如进一步训练 AI 模型。去年,Anthropic 旗下聊天机器人 Claude 的数百条对话记录出现在了谷歌搜索结果中。
华盛顿大学福斯特商学院助理教授、AI 专家 Uttara Ananthakrishnan 表示,大语言模型的一大主要隐患是数据记忆问题。她向 CNET 表示:"当某人提出与他人相同的问题时,大语言模型很可能给出与之前完全相同的回答,而模型本身可能并不知道,这个回答中包含了可用于识别某人身份的信息。"
执法机构可以调取聊天数据
你在所谓"私密"聊天中说过的话,也可能出现在法庭上或警方的调查档案中。Anthropic(Claude)、谷歌(Gemini)和 OpenAI(ChatGPT)等 AI 公司在依法收到执法机构或美国政府的传票后,有义务交出相关聊天数据。DuckDuckGo 调查中,仅有 25% 的受访者知晓这一情况。AI 记忆智能体 MemX 在一篇博文中直言不讳地指出:"与主流聊天机器人的对话是一份商业记录,而非保密咨询。"
这样的情况已经多次发生。今年早些时候,南卡罗来纳州一起双重谋杀案调查中使用了 ChatGPT 的聊天记录;去年的帕利塞兹纵火案中也出现了类似情况;2024 年的一起谋杀案审判中,Snapchat 的 AI 对话记录被作为证据采用。
OpenAI 创始人兼首席执行官萨姆·奥特曼在今年早些时候接受播客采访时表示:"如果你把最敏感的事情告诉 ChatGPT,一旦之后涉及诉讼或类似情况,我们可能会被要求提供这些内容。"
雇主可以访问聊天数据
在雇主与员工的关系中,言论自由并不总是真正意义上的自由。公司可以因为员工的社交媒体帖子将其解雇,在某些情况下——例如员工通过公司企业账号使用 AI 服务时——雇主也有权访问员工的 AI 账号。
即便是在个人账号上,将公司内部信息放入聊天对话也是一大禁忌。然而,今年早些时候的一项调查显示,仍有五分之二的员工这样做过。
沃尔玛、达美航空、T-Mobile、雪佛龙和星巴克等大型企业,甚至已经开始利用 AI 来评估员工的积极性或"毒性"。这些 AI 系统会扫描 Slack 或 Teams 等员工即时通讯平台,通过关键词和语句寻找线索,这种做法被称为"情绪 AI"。
部分公司还要求员工将 Slack 消息发布在公开频道,以便其 AI 系统可以将这些聊天内容用于进一步的模型训练。
聊天数据可被用于模型训练
DuckDuckGo 调查中,超过一半的受访者不知道(或不确定)自己与聊天机器人的对话会被用于 AI 训练。近五分之三的人表示对此"感到不适",其中 30% 表示"非常不适"。
简而言之,AI 训练是指将海量数据输入 AI 系统,使其能够识别规律、做出决策并解决问题——本质上是让机器达到甚至超越人类的能力。这些数据可以包括公开出版物、音视频录音,以及你的聊天记录。
2025 年斯坦福大学的一项研究显示,有六家公司会将用户的聊天数据反馈给其 AI 系统用于进一步训练,分别是:亚马逊(Nova)、Anthropic(Claude)、谷歌(Gemini)、Meta(Meta AI)、微软(Copilot)和 OpenAI(ChatGPT)。并非所有公司都提供退出选项。
华盛顿大学的 Ananthakrishnan 表示,AI 聊天机器人会给用户带来一种虚假的亲密感,甚至让人误以为对话内容是保密的。她向 CNET 表示:"用户把这些工具当作倾诉板,分享未经过滤的想法、敏感的健康问题和脆弱的个人困境——这些内容他们绝不会输入谷歌搜索框。人们对于自己最私密、最感性的想法被系统吸收、甚至可能意外成为公开记录,感到深深的不安。"
如何更安全、更私密地使用聊天机器人
我们并非建议你远离聊天机器人,但在使用时,确实有一些方法可以最大程度地保护你的隐私。许多聊天机器人都提供相关设置,可以阻止对话内容被存储到公司服务器,进而防止其被用于 AI 模型训练。
CNET 记者 Blake Stimac 在一篇详解文章中,完整介绍了如何关闭 Gemini、Claude、ChatGPT 和 Grok 的数据共享功能。对于 Meta,目前更多是以"请求"的形式提出,而非真正的退出选项。
此外,还有一些方法可以尽量保证你的聊天体验安全:将聊天对话视为"公开场合"、避免过度透露自己的心理状态,并定期导出个人数据,查看 AI 已存储了哪些关于你的信息。
如果对隐私有更高要求,也可以选择那些仅在本地离线运行、不依赖任何云端服务器的聊天机器人,例如 Jan.ai、Ollama、LM Studio、PrivateGPT 和 GPT4All。
Q&A
Q1:DuckDuckGo 的调查发现了哪些关于 AI 隐私的问题?
A:DuckDuckGo 研究院的调查显示,约三分之一的人会向聊天机器人分享连亲友和医生都不知道的秘密,AI 爱好者中这一比例高达 56%。许多受访者不了解聊天数据会被如何使用,也不知道可以通过设置阻止数据被存储。此外,近 40% 的人对科技公司毫无信任,近 50% 的人对美国政府也毫无信任。
Q2:执法机构真的可以获取我与 ChatGPT 或 Claude 的聊天记录吗?
A:可以。Anthropic(Claude)、谷歌(Gemini)和 OpenAI(ChatGPT)等公司在依法收到传票时,必须向执法机构或政府提交相关聊天数据。这种情况已有先例:ChatGPT 的聊天记录曾被用于南卡罗来纳州的谋杀案调查,Snapchat 的 AI 对话也曾在 2024 年的一起谋杀案审判中作为证据使用。
Q3:怎样才能更安全地使用 AI 聊天机器人、保护个人隐私?
A:可以从以下几个方面入手:在 Gemini、Claude、ChatGPT 等平台的设置中关闭数据共享选项;将聊天对话视为公开场合,避免过度分享敏感信息;定期导出个人数据查看存储内容。对隐私要求更高的用户,可以选择本地离线运行的聊天工具,如 Jan.ai、Ollama、LM Studio、PrivateGPT 或 GPT4All,这类工具不依赖云端服务器。
