您的浏览器禁用了JavaScript(一种计算机语言,用以实现您与网页的交互),请解除该禁用,或者联系我们。 [国家广告研究院&四川省人工智能研究院&弗若斯特沙利文&智慧星光]:AI大模型生成内容:风险监测与可信治理白皮书——大模型内容认知治理的总框架 - 发现报告

AI大模型生成内容:风险监测与可信治理白皮书——大模型内容认知治理的总框架

信息技术 2026-06-15 王 昕,徐振廷,饶庆昇,陈 妮,贺照峰,王 静,吴文博,王举伟,秦 予 国家广告研究院&四川省人工智能研究院&弗若斯特沙利文&智慧星光 任云鹏
报告封面

目录 第一章时代背景:内容治理进入AI生成答案时代....................10 1.1从用户发布内容到机器生成答案................................................................101.2从搜索结果到生成结论.................................................................................101.3 AI生成答案的六项结构性特征....................................................................111.4从内容安全到可信认知.................................................................................121.5治理原则..........................................................................................................12 第二章全球治理趋势:风险分级、透明责任与组织治理...........13 2.1共识正在形成,但治理路径并不相同........................................................132.2欧盟路径:风险分级与透明义务................................................................132.3美国路径:以风险管理框架为核心............................................................142.4国际标准路径:从伦理原则进入管理体系................................................142.5中国大陆路径:内容安全、标识治理与平台责任...................................152.6对比与共识......................................................................................................15 第三章AI大模型生成内容风险的五层结构...............................17 3.1基础模型层风险..............................................................................................173.2应用系统层风险..............................................................................................183.3内容输出层风险..............................................................................................19 3.4传播生态层风险..............................................................................................193.5组织治理层风险..............................................................................................193.6从五层风险到四类可信的系统映射............................................................203.7风险链条与控制点.........................................................................................21 第四章AI生成内容的主要风险类型..........................................22 4.1内容安全与违法有害风险.............................................................................224.2事实真实性风险..............................................................................................224.3来源可信风险..................................................................................................234.4广告与商业误导风险.....................................................................................234.5公共信息误导风险.........................................................................................234.6侵权、隐私与声誉风险.................................................................................244.7认知污染与传播生态风险.............................................................................244.8风险分级矩阵..................................................................................................24 第五章AI内容可信度八维评价模型..........................................26 5.1评价逻辑..........................................................................................................265.2七项质量维度..................................................................................................275.3评分规则..........................................................................................................285.4等级解释与红线规则.....................................................................................29 5.5指标口径示例..................................................................................................305.6指标校准与质量管理.....................................................................................30 第六章AI内容可信治理七步法.................................................32 6.1场景定义..........................................................................................................326.2问题库设计......................................................................................................336.3多模型与重复监测.........................................................................................346.4风险识别与初筛..............................................................................................346.5事实核查..........................................................................................................346.6证据留痕..........................................................................................................356.7治理处置与复测..............................................................................................36 第七章中国大陆重点治理方向..................................................37 7.1生成式AI服务内容安全...............................................................................377.2 AI生成合成内容标识.....................................................................................377.3 AI广告与商业推荐治理.................................................................................387.4 AI公共信息准确性治理.................................................................................387.5 AI认知污染治理.............................................................................................387.6企业AI声誉与品牌认知治理.......................................................................397.7建设企业可信知识底座.................................................................................41