配套标准2025-11
生成式 AI 安全两项国标实施
GB/T 45654《生成式人工智能服务安全基本要求》与 GB/T 45652 配套标准实施,为生成式 AI 服务的安全评估、备案测评提供了可执行的检查表式依据,语料安全、模型安全、安全措施三大板块逐项可对表。
出台背景
- 《暂行办法》要求上线前安全评估,但此前缺乏统一评估方法
- 两项国标把「安全自评估」变成逐项可勾选的工程动作
核心要点
1
语料安全:来源合规、侵权过滤、个人信息处理记录
2
模型安全:生成内容违法有害信息过滤率要求
3
安全措施:关键词库、投诉举报通道、用户协议条款
企业应对建议
- ✓按国标附录逐项完成安全自评估并留存证据
- ✓建立关键词/违规内容拦截库并持续运营
- ✓备案材料按国标口径重新整理一次
* 以上为培训视角的概要解读,具体条文以官方发布为准