行业垂直 · 熟练
上线前先定级:这份服务该按哪一档管?
生成式 AI 服务的安全,正在从「你自己说做得对」变成「按档位被要求做对」—— 2026-10-08 起实施的《生成式人工智能服务安全分级指南》按「服务场景 · 用户规模 · 内容风险」给服务划等级,不同等级对应不同的评估要求与监管强度。这一页做的是一件事:上线之前先把自己的服务定个级。三步 —— ① 按三类维度自评落档(谁在用、用在什么场景、出问题的内容风险有多高)② 对照档位把四样材料提前备齐(工具调用记录 · 高风险操作清单 · 人工确认与紧急中止 · 评估文档与测试)③ 把评估结论沉淀下来,同类服务复用。关键判据只有一个:你的每一次工具调用,事后能不能回放、能不能审计 —— 那是所有后续合规动作的地基。
方法 · 一图看懂
1
先按三类维度落档 — 服务场景 · 用户规模 · 内容风险,各自定档后取齐;⛔ 不是先写文档再定级
2
把「能回放」当地基 — 每一次工具调用留成记录,事后可回放、可审计;没有这层,后面全落不了地
3
高风险操作清单化 — 逐项写明人工确认点与紧急中止方式,⛔ 不靠「出问题再说」
4
评估材料提前备 — 对照档位把文档与测试备齐;评过一次的结论在同类服务里可复用
原理 · 为什么有效
为什么是「先定级」而不是「先写合规文档」:分级把「安全」从一句口号变成一把可度量的尺子 —— 定级之后,你要满足哪些要求才有确定答案。不定级就直接堆文档,会出现两种浪费:把低风险服务的力气花在高风险档的评审上,或者拿低档的做法去应付高档的要求,检查来了才发现方向错了。第二层原因是资源分配的对称性:监管侧也是按级分配审核资源的,所以档位高的服务会被更细地看;提前定级等于提前知道自己会被问什么。第三层来自同期配套的两条线 —— 分级指南管准入 · 强制国标管运行 · 内容标识规则管溯源:定级是准入那一环,而运行那一环要求的是「可中断 · 可审计 · 可追溯」,落到工程上就是权限收得住 · 过程留得下 · 出事查得清。评估结论可复用这一点也不是安慰:同类服务的评估材料本质上是同一套,评过一次就等于把边际成本压下来了。
适用场景
适用:① 正在把生成式能力做成产品、且要上线对外提供服务的团队(自研应用 · 面向客户的能力接口 · 内部平台对外化);② 已经上线但文件里只有「隐私政策」这一层的服务,需要按档位补齐评估与测试;③ 接了多个上游模型、要在自有产品里二次分发的项目(内容标识义务会随分发链路落到你身上);④ 需要给客户 / 采购方交安全材料的团队(定级结论本身就是可交付物)。⛔ 不适用于纯自用、不对外提供服务的内部试验;⛔ 也不适用于把全部合规动作外包给供应商、自己不接触用户数据的场景。
自测 · 5 问
我能一句话说清这份服务的服务场景、用户规模、内容风险分别落在哪一档吗
每一次工具调用是否都有记录,且事后能复原到「谁让它做的、中间走了哪几步」
高风险操作有没有一份逐项清单,上面写着人工确认点与紧急中止方式
出现问题时,我能不能在动作执行前叫停(而不只是事后回滚)
同类服务已经评过的材料,我这次是复用了还是又从零写了一遍
怎么上手 · 验证步骤
第一周只做两件事:画一张档位表(行 = 服务场景 / 用户规模 / 内容风险,列 = 档位与依据),开一份工具调用日志(先记最危险的那几条动作:写文件 · 调外部接口 · 动账 / 动权限)。第二周把日志接全,并列出高风险操作清单:每一条后面写「谁点确认」「怎么中止」。第三周对照档位补文档与测试,能复用的先复用,复用的部分注明来源。第四周做一次演练:从日志里挑一条历史动作,尝试只凭记录复原全过程 —— 复不出来,说明日志的字段还不够,回去补字段,而不是补说明。
用四个动作自检,全部要能当场做出来:① 打开日志,随手挑一条工具调用,在不问任何人的情况下说出它的时间、发起方、目标、结果;② 在高风险操作清单上任选一条,说出它的人工确认点在哪一步;③ 对一条正在跑的高风险动作,当场把它停下来;④ 说出你所处档位下一条要满足的要求是什么。第四条若答不出,说明定级停在名词上、没落到清单上。