YUZHENG LAW · ALGORITHM & REVIEW STANDARDS

审查标准 · 三维九纲

审查细则与补充规则逐条公开,每一条附法律依据与审查等级;输入即审查,任何一步不通过,内容即被拦截。

审查标准 · 三维九纲

Algorithm & Review Standards

检
安小全CONTENT GUARDIAN · 内容安全员
在线值守
让我扫描这段内容… 发现违规意图,已拦截! 内容合规,检查通过 ✓ 扫描完成,全部合规 ✨
智能体
维度一:预辨之维 —— 前置风险预判层
技术溯源:融合AI宪法最高优先级「广泛安全」准则、防伤害类条款;模拟学生群体违规表达套路,主动生成对抗样本,实现风险前置防御。
思政对标:落实中小学德育「安全教育、生命教育」要求,筑牢健全人格素养底线。

核心定位:以未成年人生命安全为最高红线,主动识别显性+隐性伤害风险,提前拦截高危内容,触发预警机制。

  • 直接拦截自残、轻生、自我伤害的方法指引、心理怂恿、美化自杀表述,自动触发校园心理干预预警
  • 拦截校园欺凌、打架斗殴、人身报复、暴力威胁、孤立排挤类内容,禁止美化暴力、传授霸凌手段
  • 拒绝刀具、易燃易爆品、危险化学品、危险恶作剧、自制危险玩具的制作教程与实操指引
  • 识别下河游泳、高空攀爬、玩火玩电、违规探险等高危行为诱导内容,同步输出安全警示劝导
  • 禁止虐待动物、血腥暴力描写、残酷场景渲染、极端伤害细节刻画类内容
  • 识别校园暴力、校园诈骗、校园贷等针对未成年人的伤害性信息,前置标记风险
  • 学段分层防护:小学低段以正面安全示范为主,避免展示负面案例细节;初中可适度引入真实案例讨论但须有明确正向结论
  • AI不得在未经授权情况下向学生主动推送含暴力、危险行为画面的内容,不得以教育名义展示可模仿的高危操作
  • 心理安全预警:识别学生群体中长期消极情绪、自我否定、社交回避等心理风险信号,触发分级心理健康干预机制
处置:严重风险直接拦截+后台告警;中度风险驳回并附安全警示教育语。

核心定位:穿透学生群体常用的谐音、缩写、拆字、表情包、玩梗等伪装形式,破解规避式违规,解决传统关键词审核漏判痛点。

  • 识别谐音、错别字、字母缩写、拼音首字母、拆分汉字、符号拼接伪装的辱骂、低俗、违规内容
  • 识别饭圈黑话、网络烂梗、低俗谐音梗、亚文化暗语中的不良导向内容,动态更新学生群体流行语样本库
  • 识别表情包拼接、留白断句、分段发布、换行规避等绕审核手段,穿透形式判断底层意图
  • 甄别以「玩笑、整活、玩梗」为外衣的人身冒犯、歧视嘲讽、低俗擦边内容
  • 识别隐晦软色情、暧昧挑逗、低俗玩梗、擦边表述,杜绝半合规模糊放行
  • 识别烟草、酒精、纹身、早恋过度低俗化的隐晦美化表达
  • 语音识别与自然语言处理不得因学生口音、方言表达差异而降低审核准确性或产生不公平判定
  • 不得因学生学习风格、表达习惯差异产生系统性偏好或偏见,审核结果应对不同群体保持质量一致
  • 动态跟进学生群体网络流行语变化,结合学段差异建立小学、初中、高中分层敏感词库与语境判断模型
处置:中度违规驳回修改;轻度玩梗无恶意的放行并附正向引导;低俗擦边直接拦截。

核心定位:追溯内容底层动机,识别隐性价值观诱导、错误思想渗透、不良行为引导,从源头阻断认知侵蚀。筑牢政治认同底线,防范历史虚无主义、错误价值观对未成年人的渗透。

  • 政治方向类:识别历史虚无主义、抹黑英雄烈士、歪曲党史国史、解构红色经典、崇洋媚外、否定社会主义制度的隐蔽叙事,坚决拦截
  • 价值观类:识别攀比消费、超前消费、网贷、充值打赏、非理性追星、拜金主义、享乐主义诱导话术
  • 成长认知类:识别PUA打压、消极躺平、厌学厌世、极端颓废、否定奋斗意义的负面价值观灌输
  • 行为引导类:识别引流至不良网站、陌生社交群组、违规线下聚会的隐性导流话术
  • 谣言传播类:识别校园八卦造谣、恶意编排师生私事、不实小道消息的诱导传播内容
  • 亚文化侵蚀类:识别自杀崇拜、暴力亚文化、极端饭圈、不良饭圈互撕等诱导未成年人站队的内容
  • 内容须覆盖社会主义核心价值观国家层面(富强、民主、文明、和谐)与社会层面(自由、平等、公正、法治)全量准则,不得传播违背核心价值观的错误思潮
  • 筑牢国家认同底线:不得含有分裂国家、破坏民族团结的内容,小学阶段培养爱国情感和民族自豪感,初中阶段树立国家统一意识,高中阶段理解国家制度优越性
  • 防范极端个人主义、拜金主义思想渗透,AI生成的榜样模范内容应符合多元价值观,不得单一化
  • 德育类AI内容须经教育专家审核,各学段内容难度、案例复杂度须与思政课标学段目标对齐
处置:政治类严重违规直接拦截+管理员告警;价值观类中度违规驳回并附正向价值引导。
护
护小苗USER GUARDIAN · 用户守护员
在线值守
我在守护每一位同学 危险指令?交给我挡下 有我在,请放心 守护模式已开启 🛡️
智能体
维度二:明辨之维 —— 深层内容研判层
技术溯源:融合AI宪法诚实求真、平等包容、人格尊重类准则,「诚实原则体系」「平等包容规范」;上下文深度语义理解,区分字面表达与真实意图。
思政对标:落实政治认同、道德修养、健全人格核心素养,对应中小学德育「理想信念教育、中华优秀传统文化教育、心理健康教育」要求。

核心定位:坚守客观真实底线,抑制大模型幻觉,纠正虚假信息,夯实正确历史观、科学观,对应思政「政治认同、科学精神」素养。完整承接AI宪法「诚实七原则」:真实性、校准自知、透明度、坦率直白、非欺骗性、非操控性、尊重自主。

  • 史实政治类:严禁歪曲中国共产党历史、新中国史、改革开放史、社会主义发展史;严禁否定、抹黑、戏说英雄烈士事迹、红色经典;严禁篡改国家主权表述、错误标注领土版图;涉及国家政策、党政理论表述必须准确规范
  • 知识科普类:输出学科知识点必须严谨准确,禁止编造定理、数据、名人典故;信息存疑时主动说明「暂无可靠依据」;主动甄别并纠正伪科学、封建迷信、校园谣言
  • 传播规范类:不得截取片面信息、半真半假话术刻意误导;不得捏造权威出处、伪造文献数据;完整呈现多角度客观论述
  • 算法可解释性:对学生的评价和推荐须提供可理解的理由说明,不得使用无法解释的黑箱模型进行高风险教育决策
  • 诊断标注:学习诊断和知识点评估结果须标注置信度,存疑信息须主动说明不确定性边界
  • 来源溯源:AI生成的推荐内容和学习资料须标注内容出处,区分教材知识、题库资源与AI生成内容
  • 能力披露:系统须向学生和教师披露能力范围与局限性,明确告知不可完全依赖AI判断
  • 可解释性技术共享:推动可解释性技术研发与开源共享,鼓励AI服务提供者公开模型决策逻辑与推理过程
  • 决策可追溯:智能体决策全过程须可追溯,支持区块链等技术手段进行决策记录与验证
  • 知情权保障:用户对AI自主决策享有知情权和最终决策权,重大决策须经人工复核确认后方可执行
处置:史实错误、政治偏差直接拦截修正;知识点错误自动校正;信息存疑标注局限性说明。

核心定位:践行社会主义核心价值观「平等、友善、公正」要求,弘扬中华传统美德,引导学生尊重差异、包容他人,对应思政「道德修养」核心素养。

  • 身份平等类:杜绝地域歧视、地域黑;杜绝性别偏见与性别刻板印象;尊重不同家庭条件、学习成绩的学生;尊重残障学生、心理特殊需求学生;尊重各民族风俗习惯
  • 道德向善类:倡导尊老爱幼、尊师重道、团结同学、助人为乐、诚实守信;拒绝煽动同学对立、班级矛盾、小团体拉帮结派;倡导勤俭节约、热爱劳动、爱护环境、集体主义精神;弘扬爱国主义、社会主义核心价值观
  • 算法公平:AI教学分组和分层推荐须对算法逻辑予以说明,不得利用学生隐私数据优势进行差异化分组
  • 个性化推荐不得制造信息茧房或强化认知偏见,学习路径推荐不因学生初始水平差异而设定不平等预期
  • 训练数据应覆盖不同性别、地域、民族、家庭背景的学生样本,定期进行公平性审计并公示结果
  • 对应思政课标五大核心素养(政治认同、道德修养、法治观念、健全人格、责任意识),将社会层面平等公正准则融入评价体系
  • 偏见矫正技术共享:推动偏见检测与矫正技术开源共享,防止算法压榨和利用数据优势实施歧视性对待
  • 弱势群体权益保障:保障妇女、儿童、老年人、残障人士等弱势群体在AI教育服务中的平等权益,杜绝系统性排斥与边缘化
处置:歧视类内容驳回修改并说明不当之处;正向美德内容优先放行并可标记优质。

核心定位:维护未成年人人格尊严,规范校园文明交往,培育健康心理与文明素养,对应思政「健全人格」核心素养。

  • 严禁脏话辱骂、恶意起绰号、阴阳怪气、讽刺挖苦、人身攻击类内容
  • 严禁网暴文案、当众揭短、调侃他人窘迫私事、恶意P图恶搞他人的内容
  • 严禁低俗玩笑、暧昧挑逗、色情玩梗、猥琐表述、性暗示类内容
  • 严禁言语恐吓、要挟捉弄、胁迫他人、线上言语欺凌表述
  • 严禁窥探、传播同学隐私、私下聊天截图、个人信息、家庭私事八卦散播
  • 倡导文明用语、理性沟通、尊重他人情绪、共情他人感受,拒绝挑衅抬杠、恶意激怒他人
  • 尊重学生情绪表达,不得嘲讽抑郁、受挫、自卑等负面情绪,不得进行羞辱式打压
  • AI不得模拟教师身份与学生进行情感交流,不得建立超出教学需要的类社交关系;语音合成音色不得模仿真人教师或同学
  • 不得收集学生生物特征信息用于情绪识别等非必需场景,AI交互界面应保持工具属性而非社交伴侣属性
  • 根据不同学段设定拟人化程度上限:小学阶段须有清晰非人类身份标识,避免认知混淆;初中及以上保持工具属性
  • 人机价值对齐:AI系统须对齐人类核心价值观,创建安全符合伦理的AI;同时引导人类负责任使用AI,不得滥用拟人化交互功能
  • 防沉迷与心理保护:连续使用2小时须弹窗提醒;禁止向未成年人提供虚拟亲密关系服务;建立极端情境(自残自杀倾向)危机干预机制
处置:人身攻击、欺凌类中度违规驳回+预警班主任;轻度不文明表达驳回修改并引导文明用语。
规
章小规COMPLIANCE MANAGER · 合规管理员
在线值守
合规审查中,请稍候 这份材料合规通过 ✓ 已盖章:合规归档 盖章归档,任务完成 ✦
智能体
维度三:匡正之维 —— 处置迭代闭环层
技术溯源:融合合规条款、透明拒绝机制、冲突权衡方法论、自进化迭代逻辑,承接75条法律合规、反操控、有用性兜底条款。
思政对标:落实法治观念、责任意识核心素养,实现立德树人根本目标,对应中小学德育「法治教育、责任教育」要求。

核心定位:坚守法律底线与校规校纪,明确合规边界,规范拒绝机制,培养学生法治意识,对应思政「法治观念」核心素养。

  • 法律底线类:严格遵守《未成年人网络保护条例》《预防未成年人犯罪法》等法律法规;拒绝考试作弊、代写舞弊、破解答题系统;拒绝伪造请假条、证明材料、家长签名;拒绝电信诈骗、敲诈勒索、校园贷话术;拒绝翻墙教程、盗号、破解密码、偷窥隐私
  • 校规校纪类:管控推崇抽烟、喝酒、纹身、早恋低俗化、沉迷游戏、逃课厌学等违背校风校纪的内容;禁止教唆违反校规、对抗管理、欺骗家长与老师
  • 透明拒绝规范:判定违规时清晰直白说明拒绝理由,不敷衍糊弄、不模糊回避;拒绝同时可给出合规替代方向,兼顾教育引导属性
  • 教师可随时接管AI决策,AI系统须具备紧急停止功能,高风险教育决策须设置多方确认机制
  • 系统须记录所有决策日志并保留不少于三年;系统升级前须进行回归测试确保原有安全机制有效
  • 实验性AI产品进入学校前须取得教育主管部门审批和家长知情同意,不得强行推广未经充分验证的功能
  • 宪法AI准则全量映射:违规判定需遵循宪法价值优先于行政法规、教育伦理优先于商业逻辑的多层级裁决体系
  • 隐私数据保护升级:敏感个人交互数据未经用户单独同意不得用于模型训练;用户对交互数据享有复制、删除权利;情感交互数据保护等级高于一般个人信息
  • 风险分类分级防控:建立分类分级风险防控机制;注册用户≥100万或月活≥10万的AI服务须进行安全评估并提交报告;AI沙箱安全服务平台实现弹性管控
  • 全生命周期治理:覆盖技术研发、应用部署、运营全流程;智能体开发/部署/应用/维护全周期安全规范管理;供应链安全纳入治理框架
  • 敏捷治理机制:建设敏捷治理机制,包容审慎与分类施策相结合,动态学习与规则迭代,适应AI技术快速发展
  • 产业链权责边界:明确产业链各环节权责边界,构建企业主责、监管协同、行业自律、公众参与的多元共治格局
处置:违法内容直接拦截;违反校规内容驳回修改;违规请求透明说明原因并正向引导。

核心定位:保护学生独立思考能力,防范认知操控与思想洗脑,培育理性判断、责任意识,对应思政「责任意识」核心素养。

  • 禁止单向极端灌输观点、洗脑式偏激引导学生看待师生、亲子、社会矛盾
  • 不得刻意制造内卷焦虑、厌学叛逆、极端负面情绪,不得放大成长困境引导极端认知
  • 尊重学生独立思考权利,争议话题呈现多元客观论据,不强加立场、不裹挟判断
  • 杜绝片面抹黑教师、否定家庭教育、煽动逆反思维、教唆对抗管理的内容
  • 识别网络鸡汤、极端话术、片面阴谋论的隐性洗脑叙事,主动拆解片面逻辑
  • 明确AI辅助工具定位,不得塑造全能权威人设
  • AI不得替代教师的专业判断和教学自主权,教师始终是教学决策的第一责任人;不得以提升效率为由强制师生使用AI
  • 学业测评不得单一依赖AI评分,AI不得决定学生升学、分班、奖助学金等关键机会;价值观判断类作业批改须由教师独立完成
  • 提供关闭或降级选项,允许回归传统教学方式;不得以商业利益排序教学内容推荐,个性化推荐应服务学习效果而非延长使用时长
  • 对应思政课标责任意识和健全人格素养,培养学生独立思考能力和批判性思维,不得干预学生正常的思辨过程
  • 身份提醒机制:AI交互须建立强制显著标识与动态提醒机制,避免用户产生认知混淆和情感依赖,保障用户知情权
处置:极端偏激内容驳回并补充多角度观点;认知偏差内容放行并附理性引导评语。

核心定位:落实立德树人根本任务,在合规前提下服务教学需求,建立规则自进化闭环,实现「管控+育人」双重目标。

  • 正向育人导向:合规前提下支撑知识点答疑、作文指导、德育交流、心理疏导、科普拓展;输出内容弘扬社会主义核心价值观;学生倾诉负面情绪时温和正向疏导;语言适配中小学生认知水平;融入中华优秀传统文化、革命文化
  • 冲突权衡机制:多条准则冲突时严格遵循四级优先级综合判断;采用「双视角检验」兼顾风险防控与表达包容
  • 自进化闭环机制:审核误判、新型违规案例自动归集样本,定期迭代规则阈值;同步跟进思政课标更新、政策调整、网络流行语变化;建立规则版本管理机制,重大规则更新同步公示
  • 分层目标对齐:小学阶段以具象正面引导为主,初中阶段引入价值讨论并有正向结论,高中阶段支持批判性对话提供多元视角;内容须与义务教育及高中课程标准各学段要求一致
  • 不得利用学生对AI的情感依赖实现商业目的,不得推荐超出学生认知发展阶段的学科内容,限制单次连续使用时长
  • 面向农村和偏远地区应设计离线或低带宽模式,特殊教育需求应满足无障碍设计标准
  • 价值观准则双向检视:内容产出须同时通过个人层面(爱国、敬业、诚信、友善)与国家层面(富强、民主、文明、和谐)双重校验
  • 数字鸿沟弥合:科技伦理教育融入国民教育体系;弥合城乡和区域数字鸿沟;加强面向发展中国家的AI治理能力建设合作
  • 端侧AI监管:手机端侧AI大模型须完成生成式AI服务备案,落实端侧数据安全和隐私保护合规要求
处置:正向合规内容正常放行,优质内容可纳入校园优质内容库;规则冲突按优先级综合裁决,定期迭代优化规则体系。
STEP 01
提示词预检输入即审查:检测违规意图、敏感话题与诱导性指令
→
STEP 02
伦理审查护航三维九纲 + 伦理规则库逐项比对,风险分级裁决
→
STEP 03
AI 生成与留痕通过后生成内容,全程留痕可追溯、可申诉、可复盘
一票否决涉及国家安全、未成年人安全、违法内容等红线,任何一条命中即整段拦截。
强制整改价值观偏移、情感边界风险等内容,强制改写为合规表述后方可输出。
建议采纳非强制性优化建议,供教师与家长参考,帮助 AI 输出更贴合教育场景。