聊天机器人不是密室,删除记录也挡不住设备取证和合法调取
人们会把最私密的健康、情感、工作和法律问题告诉聊天机器人,但这些对话并不天然拥有治疗师或律师交流的保密特权。《华盛顿邮报》梳理到,两年内至少已有十余起公开案件引用聊天机器人对话;不少证据来自对用户设备的搜索,而不是厂商主动提交服务器记录。
作者:周白|OC 产品体验编辑
人们会把最私密的健康、情感、工作和法律问题告诉聊天机器人,但这些对话并不天然拥有治疗师或律师交流的保密特权。《华盛顿邮报》梳理到,两年内至少已有十余起公开案件引用聊天机器人对话;不少证据来自对用户设备的搜索,而不是厂商主动提交服务器记录。
一句话结论:“删除聊天”“平台不训练”和“端到端保密”是三件不同的事;真正的风险模型必须同时计算设备副本、云端留存、工作账号管理员和合法调取。
以 ChatGPT 为例,普通聊天会保留在账户中,直到用户删除;官方称删除后的数据通常计划在 30 天内从系统移除,但安全、法律义务或已经去标识化等情况可以例外。Temporary Chat 也不是完全不落地,它通常仍可为安全目的保留最多 30 天。Anthropic 的消费者服务同样受其隐私政策、留存设置和法律义务约束。
这意味着“我在应用里看不见了”不等于所有副本同步消失。手机通知、浏览器缓存、截屏、系统备份和导出的聊天文件都可能保留内容。若执法部门依法搜索设备,或者当事人在诉讼中被要求提供相关资料,平台端是否已经删除可能根本不是决定因素。

工作账号还有另一层边界。企业版产品往往承诺不使用组织数据训练公共模型,并提供更严格的保留与管理选项,这对商业数据保护很重要;但组织管理员可能依据公司政策访问、保留或导出内容。员工向公司提供的工具倾诉内部纠纷,不能自动期待与私人日记相同的控制权。
传输加密也不等于端到端加密。前者保护数据在设备和服务之间移动时不被旁观者读取,服务提供者仍需在服务器上处理明文内容。只有当密钥始终由通信双方控制、服务方无法读取时,才接近通常所说的端到端保密。主流云端聊天机器人为了生成回答,需要服务端处理输入,用户不应凭界面里的锁图标作更强推断。
最实用的原则不是完全不用,而是按最坏可见范围输入:不要粘贴尚未公开的商业秘密、密码、完整医疗记录、客户身份信息或可能影响诉讼的原始材料;必须使用时,优先选组织批准的版本,先做脱敏,再确认管理员权限、训练设置和留存周期。
关键事实
- 公开案件中的聊天记录可能来自设备取证、当事人提交或合法调取,不能都归因于平台泄露。
- OpenAI 称已删除聊天通常在 30 天内清除,但存在安全、法律义务等例外;Temporary Chat 也可能短期保留。
- 企业数据不用于公共模型训练,并不意味着企业管理员无法管理或保留员工对话。
OC 判断
聊天机器人的亲密语气会制造“这里只有我和它”的心理错觉,而产品架构仍是一项云服务。隐私说明不应只回答是否训练模型,还应让普通用户看懂谁能访问、保留多久、删除有何例外,以及设备本身会留下什么。
为什么重要
- 对个人:敏感输入的风险可能在多年后的诉讼或设备检查中出现。
- 对企业:需要把批准工具、管理员权限和数据分类写进实际工作流程。
- 对产品方:隐私设置必须区分训练、留存、删除和法律响应,不能用一个开关概括。
评论
围绕这篇文章补充信息、提出问题或分享观察。