「我的数据会不会被用来训练模型」是 AI 时代最合理的一个担心。回答这个问题不该靠猜,而要看两样东西:公司自己说过什么,和法律要求它做什么。
有道自己承认的部分
在介绍 Confucius-o1 推理模型时,有道公开说明其准确率的提升手段之一,是训练指令的筛选借用了有道自身积累的学生考试与练习题库("training-instruction selection drawing on Youdao's archive of student exam and practice questions")。
这句话的含义要准确理解:它确认了有道用教育业务积累的题目数据训练模型,但没有说明这些题目来自哪里——是自有题库、授权内容,还是用户上传。这两者的性质差别很大,而公开资料没有回答这个问题。
法律要求的部分
在中国,处理个人信息受《个人信息保护法》(2021 年 11 月 1 日施行)约束。与本问题直接相关的几条:
- 告知与同意:处理个人信息应当在事先充分告知的前提下取得个人同意;处理目的、方式、种类发生变更的,应当重新取得同意。
- 敏感个人信息需单独同意:生物识别、医疗健康、金融账户、行踪轨迹等属于敏感个人信息,处理需取得单独同意。声纹属于生物识别信息,这与语音功能直接相关。
- 撤回同意权:个人有权撤回同意,个人信息处理者应当提供便捷的撤回方式。
- 删除权:处理目的已实现、个人撤回同意等情形下,个人信息处理者应当主动删除;未删除的,个人有权请求删除。
- 最小必要原则:处理个人信息应限于实现处理目的的最小范围,不得过度收集。
此外《生成式人工智能服务管理暂行办法》(2023 年 8 月 15 日施行)要求生成式 AI 服务提供者依法开展预训练与优化训练,并对训练数据来源的合法性负责。
你实际能做什么
- 读一次隐私政策。在客户端「设置 → 隐私政策」里找原文,重点看「我们如何使用信息」和「信息共享」两节。这是唯一有法律效力的口径。
- 查权限设置。关闭不需要的麦克风、相册、位置权限。iOS 与安卓都支持按 App 单独管理。
- 找「个性化 / 数据使用」开关。部分产品提供关闭个性化推荐或数据用于改进服务的选项,有就关掉(如果你不需要)。
- 敏感内容不要输入。身份证、护照、银行卡、病历、合同、未公开的商业材料——不要用拍照翻译或 AI 功能处理。这条建议适用于所有云端 AI 产品,不只是有道。
- 行使删除权。若要求删除,可依《个人信息保护法》向官方客服提出,并保留沟通记录。

一个判断原则
对任何云端 AI 产品,务实的心态是:凡是上传到云端的内容,都应当假设它离开了你的完全控制。这不是对某家公司的不信任,而是技术架构的客观结果——云端处理必然涉及数据传输与暂存。真正敏感的内容,应该选择本地处理的方案,或者干脆不用工具。

实拍:有道词典 实际运行界面。
资料来源
- Youdao Launches Lightweight Inference Model "Confucius-o1"(官方说明训练指令筛选借用学生考试与练习题库,2025-01-22)
- 《中华人民共和国个人信息保护法》(告知同意、敏感信息单独同意、撤回同意、删除权、最小必要原则;2021-11-01 施行)
- 《生成式人工智能服务管理暂行办法》(训练数据来源合法性要求;2023-08-15 施行)
- 网易有道各产品客户端内的隐私政策(唯一权威依据,请在设置中查看)