YUZHENG LAW · PLATFORM SERVICE · 内容安全审查

训练数据治理

审查细则

一、服务定位

训练数据治理服务审查 AI 教育产品训练数据的来源、版权与隐私风险,从“数据源头”防止有害、侵权或违规数据流入未成年人教育场景,为产品的内容安全奠定基础。

二、服务对象

  • AI 教育产品企业:需要对其模型训练数据的合规性进行自查与审查。
  • 学校与教育局:了解所采购产品数据来源是否合规。
  • 学生与家长:确保孩子的数据不被滥用、产品不基于有害数据生成内容。

三、核心服务内容

(一)来源合规

核查训练数据的合法来源,禁止使用非法爬取、侵权、未经授权采集的数据。

(二)版权审查

识别训练数据中的版权与知识产权风险,评估潜在的侵权隐患。

(三)隐私风险

审查训练数据是否涉及未成年人个人信息、敏感个人信息及违规采集。

(四)有害内容排查

筛查训练数据中的色情、暴力、歧视、仇恨言论、不当价值观等内容。

(五)数据清洗建议

对识别出的问题数据给出清洗、过滤与替换建议。

四、治理要求

依据《生成式人工智能服务管理暂行办法》等要求,服务提供者应对训练数据来源合法性负责,不得使用非法来源数据训练模型,不得非法处理他人个人信息,不得侵害他人知识产权。

五、服务流程

数据资产摸底 → 来源与版权核查 → 隐私风险评估 → 有害内容筛查 → 出具数据治理报告 → 清洗整改 → 复核。

六、常见问题(FAQ)

Q1:数据治理审查多久做一次?

建议在模型训练前、上线前及数据更新时分别开展,平台也支持定期复检。

Q2:发现侵权数据怎么办?

平台会出具风险提示与整改建议,企业应停止使用并完成数据替换与清洗。

七、服务价值

从数据源头保障教育 AI 的内容安全与合规,守护未成年人数据权益,降低企业合规风险。