一周之内,监管的两只手都亮出来了
先把 9 月第一周发生的两件事摆在一起看。
第一只手是「数」。 2026 年 9 月 2 日,中央网信办通报「清朗·整治 AI 应用乱象」专项行动第二阶段:累计清理违法违规信息 561 万余条、查处账号 4.9 万余个、处置违规网站与应用程序 2400 余个、平台累计发布治理公告 46 期,并首次集中通报 7 类典型案例。这是运动式的查处数字。
第二只手是「标准」。 2026 年 9 月 1 日,2026 年国家网络安全宣传周新闻发布会宣布:本届网安周将于 9 月 14 日至 20 日在济南举办,主题为「网络安全为人民 网络安全靠人民——智能时代 网安护航」;期间将发布 《人工智能安全治理框架》3.0 版;中央网信办已组织制定发布《生成式人工智能服务安全基本要求》《生成式人工智能预训练和优化训练数据安全规范》《政务大模型应用安全规范》等国家标准,并要求相关主体开展安全评估、准备评估报告。
一只手在查、一只手在建标准。把它们合起来读,结论很清楚:AI 合规已经从「有没有证」走到了「常不常态合规」,而安全评估就是连接这两只手的那道持续关卡。
备案和登记是「准入」,安全评估是「持续义务」
很多团队的认知停在「把备案号挂上、把登记号填好就完事」。这个认知在 2026 年已经不够用了。
依据《生成式人工智能服务管理暂行办法》,具有舆论属性或者社会动员能力的生成式人工智能服务,在上线前应当开展安全评估。备案、登记解决的是「你能不能进这个场」;安全评估解决的是「你进场之后,能不能持续不出事」。
截至 2026 年 7 月底的权威数据是:已备案大模型服务 1028 款、已登记大模型应用 630 余款。备案登记数在涨,但登记完不等于评估完——评估是持续性的:语料更新了要重新看、模型换了要重新看、上线新功能要重新看。框架 3.0 即将发布,其核心方向是风险分级治理,意味着不同风险等级的产品,对应的评估强度和频次还会进一步拉开。
一个常见的误判是:我只调了个 API,模型是上游的,评估该上游做。这话只对了一半。上游模型通过了它自己的评估,不代表你接进自己产品、叠加了你的提示词、你的输出处理逻辑之后,整体仍然合规。输出端的责任,落到的是产品方头上——这一点在清朗第二阶段第 7 类案例里已经写得很清楚。
5 项自查,对照《安全基本要求》
把《生成式人工智能服务安全基本要求》拆开,落到你自己的产品上,可以这样逐项过一遍:
一、语料安全。 训练与优化数据来源是否合法、内容是否经过安全过滤、是否涉及个人信息而未脱敏。如果你用的是第三方中转或聚合通道,要确认对方是否留存、是否拿你的数据去训练——这是最容易踩的雷。
二、模型安全。 模型是否具备基本的拒答与对齐能力、生成内容是否准确可靠、在异常输入下是否稳定。不要假设「上游模型安全,我的产品就安全」。
三、用户个人信息保护。 是否收集了非必要信息、是否留存了用户对话、是否把对话拿去训练。合格的中转站应当做到数据不留存、不用于训练、原样透传并可导出逐笔明细——这是可验证的,不是口号。
四、内容标识。 AIGC 内容是否做了显式标识(如「由 AI 生成」水印/角标)与隐式标识(元数据)。GB 45438-2025 已经把这件事法定化了,9 月之后只会查得更细。
五、投诉举报与应急处置。 有没有畅通的举报入口、发现违规内容能否快速拦截和下线、有没有应急预案。清朗第二阶段通报的 7 类案例里,被二次处置的往往是「拒不改正」的那一方——说明整改通道是真实存在且会被使用的。
中转站能帮你什么,帮不了什么
把话说在前头,照例分两栏。
能给的: Yady API 上游为火山引擎方舟官方授权通道,链路在境内、不出境;数据不留存、不用于训练,逐笔调用明细可导出对账;统一 1.27× 透明倍率、人民币计价、不随调用时段浮动(上游峰谷差价由我们承担);上游若调整分时段结算,提前公告、不做静默变更。
给不了的: 安全评估是你作为应用方自己的义务,我们不代办、不承诺替你承担输出端合规责任;不代你做算法备案或大模型登记;方舟通道当前仅激活 1 个模型(模型广度是本站目前最明显的短板,不掩饰);不承诺全网最低价。
换句话说,我们能给你一条干净、可审计、可出证明的调用链路,但「你的产品安全不安全」这件事,最终要在你自己的评估里闭环。
9 天窗口,可以做的一件小事
网安周 9 月 14 日开幕,框架 3.0 同期发布。对开发者来说,这 9 天不是「等通知」,而是把上面 5 项自查先跑一遍的窗口期——尤其是语料安全和内容标识这两块,是清朗第二阶段点名最密的区域。
别等到通报里出现你所在的赛道才动手。那时面对的,是整改通知书,不是操作指南。