《生成式人工智能服务安全基本要求》由TC260全国网络安全标准化技术委员会于2024年2月29日发布,旨在为生成式人工智能服务提供安全指导。这份文件涵盖了服务提供者在提供此类服务时应遵循的安全要求,包括但不限于数据安全、风险管理、合规性等方面。
主要内容概览:
范围与适用性
文件适用于对生成式人工智能服务进行安全评估,同时也为监管机构制定政策提供了参考依据。
引用标准与术语定义
引用了一系列相关标准和术语定义,确保了文件的专业性和一致性。
语料安全要求
- 来源安全:强调了在选择语料来源时的安全考虑,包括数据合法性、版权问题、隐私保护等。
- 内容安全:针对服务提供商应确保语料内容的适宜性,防止有害、违规内容的传播。
- 标注安全:要求对语料进行安全标注,包括版权归属、合规性检查等。
服务提供者责任
服务提供者需承担生成式人工智能服务的安全责任,包括但不限于确保服务安全性、遵守国家法律法规、保护个人隐私、维护系统稳定等。
其他要求
- 关键词库:构建全面且有针对性的关键词库,用于提升服务质量和安全性。
- 测试库:设立全面的测试题库,涵盖安全风险评估,包括错误、漏洞等。
- 拒绝回答测试:设计测试以识别潜在的攻击和异常行为。
- 分类模型:对语料和内容进行分类,以便更有效地评估风险。
评估要求
- 评估方法:提供了评估服务安全性的具体方法和步骤。
- 安全评估:包括对服务整体、各个组件的评估,确保服务符合安全标准。
- 评估报告:要求详细的评估报告,包括评估过程、结果和改进措施。
风险评估
- 主要风险:列举了违反社会主义价值观、政治敏感、商业违规、侵犯个人权利等风险类型。
- 安全评估:对生成内容和服务响应进行专门的安全评估,确保无有害输出。
参考文献
文件引用了多个法律和标准作为参考,确保其合规性和权威性。
这份文件为生成式人工智能服务的安全实践提供了全面的指导框架,旨在促进技术创新的同时,保障用户安全和数据隐私。