AI 安全合规与数据隐私

AI Safety, Compliance & Data Privacy

AI 安全合规覆盖了模型输出内容安全、用户数据隐私、训练数据产权、跨境数据传输、可解释审计、算法备案、行业监管要求等一整套法律与工程治理体系。

详细解释

AI 合规 & 数据隐私(AI Governance / Safety & Compliance) 在 2023 年以前是”法务姐姐在大会议室里 PPT 上讲的东西”,2024 年开始已经变成”不做就不能上线,甚至会罚款 + 停业整顿”的硬约束。全球三大核心监管框架 2025 年都进入了执行期,对企业 AI 应用提出了强制要求:

  • 中国:《生成式 AI 服务管理暂行办法》(网信办 2023.8)+《个人信息保护法》(PIPL)+《数据安全法》+《互联网信息服务算法推荐管理规定》(算法备案)+《生成式人工智能服务安全基本要求》GB/T 43872-2024 国标
  • 欧盟:EU AI Act(2024 年 5 月生效,分层分级:Unacceptable/High/General/Limited),高风险 AI 要做技术文档、人工审核、用户告知、错误率报告。
  • 美国:NIST AI 100-2e2025 AI RMF(风险管理框架)+ 各州隐私法(加州 CCPA/CPRA、得州 TDPSA 等)+ FTC 针对”AI 虚假宣传/歧视”的 Section 5 执法

一句话概括:只要你面向公众提供 AI 服务(哪怕是用第三方 API 拼一个产品),你就不是”买了 API 就没你事了”——你作为服务提供者对输出内容、对用户数据处理、对算法公平性负有直接法律责任。

企业 AI 应用必做的”九层合规治理塔”

从基础到顶级,按合规成本从低到高、监管要求从强制到推荐排列:

层级治理措施解决什么监管条款未做的典型后果
① 用户告知任何 AI 对话首屏必须显式告知:“内容由 AI 生成,仅供参考,不构成专业建议;医疗/法律/金融请咨询专业人士。”生成式 AI 服务暂行办法 第十一条网信办上门责令整改 + 警告 + 通报名单
② 输入输出内容安全入参用户文本 + 模型输出文本 + 多模态图片全部走两层审核:第一层关键词 + 第二层 BERT/多模态安全分类器 + 第三层人工审核队列(置信度 0.5 至 0.85 区间进入人审)暂行办法第十条”违法有害信息阻断措施” + EU AI Act 高风险传播违法信息 → 罚款营业额 5% 或 5000 万取高 / 停业整顿
③ 个人信息保护 PIPL/GDPR用户输入不直接用于训练(或通过 SDK 默认关闭”允许用于训练”);用户有权删除会话记录(删除权 Right to Erasure);个人信息出境需要做标准合同 SCC / 安全评估PIPL 第 13/47 条 + GDPR 第 17 条PIPL 最高罚款 5% 年营业额;GDPR 罚款 4% 全球营收 / 2000 万欧元取高
④ 数据驻留 & 跨境传输中国境内收集的对话/RAG知识库/SFT训练数据,默认只存在合规中国境内 Region;境外客户数据单独存在境外节点;两类绝不混存(见 Multi-Region 词条)数据安全法第三十一条、PIPL 第三十八条数据出境未评估 → 最高 500 万 / 责任人罚款
⑤ API 密钥最小权限原则后台 API Key 按”产品线 + 白名单 IP / 应用域 + 额度上限 Spend Limit + 模型权限白名单”四维度签发;绝对禁止 1 个 Key 全站全家桶;Key 泄露 10 分钟自动熔断金融 / 医疗行业网络安全等级保护 2.0 三级泄露 Key 被刷 100 万账单,客户起诉你赔偿
⑥ 算法备案与算法公示(中国特有)面向公众提供生成式 AI 服务的,要在网信办”算法备案系统”里做服务备案、算法备案;首页/官网显眼位置放备案号。生成式 AI 暂行办法 第九条 + 互联网信息服务算法推荐规定未备案的不得上线提供服务,违者责令停服 + 罚款
⑦ 审计与可追溯:AI 日志留痕 6 个月每条调用的”用户 ID / 请求时间 / 入参摘要 hash / 出参摘要 hash / 模型 ID / 安全审核结果 / 人工审核人 ID”全部结构化落盘,不可篡改(存到 WORM 存储或区块链存证摘要)EU AI Act 高风险条款 + 金融行业数据留痕要求出了纠纷(AI 写的合同签错了、医疗建议错了)无法举证 → 民事赔偿败诉
⑧ 公平性与歧视性评测(高风险领域)医疗/金融/教育/招聘四大高风险:模型对 10 类受保护属性(性别/年龄/地域/民族/残障/婚姻状况等)的结果分布差异必须 < 80% 四/五分之一原则(Equalized Odds / Demographic Parity)EU AI Act 附件 3 高风险 + 美国 EEOC 招聘 AI 指引招聘/贷款审批 AI 被举报歧视 → 集体诉讼 + 监管处罚
⑨ 第三方合规认证与人工复审通道引入第三方 SOC2 Type II / ISO 27001 + ISO 27701 / 等保 2.0 三级认证;高风险输出(如医疗建议、法律意见书、自动退款审批)必须有 100% 人工审核通道(Human-in-the-loop)等保 2.0 + 金融/医疗行业特别法拿不到大客户的采购订单(甲方都会要求提供认证复印件)

唯元智创 平台作为基础底座的合规承诺:以上 ①~⑤ 与 ⑦、⑨ 全部由平台侧已经落地完成(SOC2 Type II 审计中、等保 2.0 三级已过、算法备案已通过网信办公示、数据驻留支持 Region 锁定);客户自己需要重点做 ⑥⑧ 两项(因为它们取决于你的具体业务形态——你面向公众服务就必须做自己的算法备案,你的模型如果做招聘筛选就要做自己的公平性评测)。

4 条”用了第三方模型 API,但你仍要担责”的法律红线

很多创业团队误区:“我用唯元智创 API 调模型,内容出问题应该厂商负责,和我没关系。“错。2024 年北京互联网法院两起生效判例已经明确了责任链:作为”向终端用户提供 AI 服务的经营者”是第一责任人;API 厂商(你采购的)是你供应链的第二方,你可以事后追偿,但对监管/用户你先赔钱。 四条红线一定不要碰:

  1. 红线 1:不要让 AI 输出”医疗诊断意见 / 法律意见书 / 投资建议”而不加任何声明 + 人工审核——这类专业意见属于高风险领域,EU AI Act 直接划为 High Risk(你要写 100 页技术文档 + 人工复审)。
  2. 红线 2:不要把用户上传的私有知识库不经脱敏就作为”可被用于训练”的数据——PIPL 下如果没有单独授权,你把客服聊天记录作为 SFT 数据训模型,属于非法处理个人信息,1000 条就可以立案。
  3. 红线 3:不要把 AI 生成的内容冒充”真人编辑原创内容”去做新闻/医疗科普/广告——《广告法》《互联网新闻信息服务管理规定》明确 AI 生成要显著标识,违者罚款 10 万以下;虚假宣传 + AI 标识缺失,市场监管可罚广告费用 5 倍。
  4. 红线 4:不要用一个大 Key 写在前端 JS 里——2024 年 12 月一周内全国有 70 家公司把 OpenAI Key 写在 React 打包产物里被盗刷,单家最高损失 ¥46 万。100% 是你客户侧自己担责(因为你泄露了密钥,厂商 SLA 里对此免责)。正确做法:永远走你自己的后端做一层代理 + 独立子账号 Key + Spend Limit 日上限 ¥200 熔断。

常见问题

我只是个内部效率工具(员工用的 AI 助手),不对外服务,要不要做算法备案?
不对外公开、仅本企业内部员工使用的生成式 AI,暂不纳入算法备案的强制要求(暂行办法的适用范围是”面向社会公众提供服务”)。但这不等于你不用做隐私合规:如果内部员工会把个人信息(客户名单、简历、合同、财务数据)喂给 AI,PIPL 仍然适用;如果是处理 100 万人以上个人信息的重要数据处理者,还是要做数据安全评估。实务建议:对内工具走”三步最低合规套餐”:① 入口 AI 生成声明 + 不构成专业建议;② 内容安全自动审核 + 关键词过滤(不能让员工用公司内部 AI 生成违规内容);③ 员工会话默认 180 天自动删除(含知识库版本全删,满足 PIPL 删除权的内部要求)。这三条做了,面对 90% 的日常监管问询都能过。
我可以用爬虫爬公开网页文本作为 SFT 训练数据吗?
合规做法是”三层过滤”:(1)robots.txt 允许抓取 + 没有明确版权声明(如”未经授权不得用于 AI 训练”);(2)对抓取内容做去重 + 版权清洗:新闻/图片/字体/源代码四类要特别小心,优先用明确 CC-BY/CC0 授权的语料;(3)训练结束后提供”版权投诉 / opt-out 权利行使入口”:如果你网站是 X 站的博主,发现我模型里输出和你文章高度相似,给你一个表单 15 天内回复并从训练集中剔除。2024 年《著作权法》第三次修改 + 北京/杭州各 1 起判例的共识是:纯公开网页做 AI 训练可以主张”合理使用”,但要满足”三步检验法”+ opt-out 机制,故意爬取”禁止 AI 训练”的版权内容并商用会被判侵权。最简单稳的办法:直接从 唯元智创 marketplace 买已经经过合规清洗的公开 SFT 数据集(10 万条 ~ ¥199),省下法务和清洗的时间风险。
做 EU AI Act 高风险的”招聘筛选 AI”客户,我应该在模型侧额外做什么合规工程?
高风险 AI 要做 6 件事(比普通应用多 5 件):(1)公平性评测集:针对 EEOC 7 类 + EU 新增的 10 类受保护群体,构造对应的简历/申请样本 5000 条,评测”群体通过率差异 < 20%”;(2)人工审核通道:AI 筛选 Top 10 简历后必须由人类招聘经理看一遍才能发面试邀请,AI 无权自动淘汰任何人;(3)可解释报告:每个候选人给出”被推荐/被淘汰的 3 条主要原因 + 与岗位 JD 匹配点分”,不能黑盒打分;(4)欧盟境内数据不出境:招聘简历 / 联系方式属于 GDPR 个人数据,要落在 EU Region;(5)Technical Dossier 技术文档:按 EU AI Act Annex 4 模板写 100 页系统说明 + 风险评估,在欧盟监管 6 个月内可交付审计;(6)上市后监控系统(PMS):系统上线后每年重新评估一次公平性指标,连续 2 年指标合格才能续用。 2026 年起 EU 高风险不做这套就直接禁止在 EU 境内提供服务,违规按 4% 全球营收罚,门槛是真的高。