AI 数据安全合规调研报告

AI 数据安全合规调研报告

给数据一份合规判定,让 AI 辅助工作更安心

执行摘要

核心结论

1. 数据出境是最高风险点。 在中国现行法律框架(网安法 2026 修订版、数安法、个保法、网络数据安全管理条例)下,个人将含个人信息的文件发送给境外服务器上的 AI 工具(如腾讯云新加坡节点)属于「数据出境」行为,需要按「重要数据 → 安全评估;个人信息 → 按人数阈值选择评估/标准合同/认证/豁免」的路径合规,否则即违法。

2. 三类数据存在绝对禁区:

3. 法律红线有「可操作判定树」。 本报告提供完整的「数据样例 → 判定结论」流程(见第7章),可按四问快速判定:是否涉密?是否重要数据?是否个人信息?数量多少?

4. 违规代价极高。 公司层面最高罚「上一年度营业额5%」(滴滴被罚80.26亿);员工个人是独立责任主体——最高15日行政拘留 + 刑事追诉(侵犯公民个人信息罪最高7年、泄露国家秘密罪最高7年、侵犯商业秘密罪最高10年)。不能以「公司数据」为由免责。

5. 市场空白确认。 市面上不存在「输入数据样例 → 输出合规判定」的现成 skill(最接近的是 ShellWard 项目扫描器和 PIPL 法规知识库)。做成 Hermes 本地 skill 差异化明确、可行性高。

6. 腾讯 skill 商店商业化前景:中等。 元器目前无官方第三方分成政策(协议明确收费是「开发者个人行为」),建议走「免费 skill 引流 + 外部转化」路线,不押注商店内付费。

风险速览表

行为 风险等级 主要法律后果
将含敏感个人信息文件发给境外 AI 🔴 高风险 数据出境违规 + 侵犯公民个人信息罪
将国家秘密/工作秘密输入 AI 🔴 高风险 泄露国家秘密罪(3-7年)
将源代码/客户名单上传公共 AI 🔴 高风险 侵犯商业秘密罪(最高10年)
未脱敏个人信息在境内 AI 流转 🟡 中风险 行政罚款(最高100万/人档)
数据泄露不报告 🟡 中风险 数安法45条加重处罚
脱敏/聚合数据(不含个人信息) 🟢 低风险 一般无义务
经审批的安全评估合规出境 🟢 低风险 合法

一、法规全景:哪些数据不能出境

1.1 核心法律体系

法律 施行时间 与「AI 助手处理工作数据」最相关的条款
《网络安全法》(2025修订) 2026-01-01(修订版) 第37条:CIIO 境内数据原则上境内存储,出境须安全评估
《数据安全法》 2021-09-01 第21条分类分级;第31条重要数据出境;第36条:未经批准不得向外国司法/执法机构提供境内数据
《个人信息保护法》 2021-11-01 第38-40条出境三路径;第51条加密/去标识化义务;第66条罚则
《保守国家秘密法》(2024修订) 2024-05-01 第28条:禁止涉密信息输入非涉密计算机/系统
《密码法》 2020-01-01 第27条:CII 应使用商用密码(SM2/SM3/SM4)保护
《网络数据安全管理条例》 2025-01-01 首部数据安全行政法规;重要数据目录;第24条 AI 训练数据合规
《关键信息基础设施安全保护条例》 2021-09-01 CIIO 认定范围(能源/交通/金融/政务/通信等)

1.2 数据分类分级(数安法第21条 + GB/T 43697-2024)

级别 定义 影响
核心数据 对国家安全、国民经济命脉、重要民生、重大公共利益产生重大危害影响 重点保护,出境管控最严
重要数据 一旦被篡改/破坏/泄露可能危害国家安全、经济运行、社会稳定、公共健康和安全 出境须申报安全评估
一般数据 仅影响单个组织或个人合法权益 无特殊出境义务

关键认知:

1.3 数据出境三路径 + 豁免(2024 现行口径)

必须申报「数据出境安全评估」的情形:

  1. 重要数据出境(任何主体,无豁免)
  2. CIIO 向境外提供个人信息
  3. 当年累计向境外提供 100 万人以上个人信息(不含敏感)

  4. 当年累计向境外提供 1 万人以上敏感个人信息

签订「个人信息出境标准合同」或通过保护认证的情形:

豁免情形(《促进和规范数据跨境流动规定》2024-03-22):

  1. 非个人信息、非重要数据的一般业务数据
  2. 订立/履行合同所必需(跨境购物、汇款、机票酒店预订等)
  3. 跨境人力资源管理所必需(按劳动规章制度向境外提供内部员工信息)
  4. 紧急情况(保护生命健康和财产安全)
  5. 非 CIIO 当年累计向境外提供不满 10 万人个人信息(不含敏感)——免申报、免合同、免认证

  6. 自贸区负面清单外

1.4 人数阈值速查表

情形 所需程序
重要数据出境(任何主体) 必须申报安全评估
CIIO 个人信息出境 必须申报安全评估
非CIIO,当年累计 ≥100万人 个人信息 必须申报安全评估
非CIIO,当年累计 ≥1万人 敏感个人信息 必须申报安全评估
非CIIO,10万 ~ 100万人 个人信息 标准合同备案 或 保护认证
非CIIO,当年累计 <10万人(非敏感) 全部豁免
合同必需 / HR必需 / 紧急避险 豁免
非个人信息、非重要数据 豁免

1.5 2025-2026 最新动态


二、哪些数据不能出本地电脑

数据类别 法定界定 处理要求 法律依据
国家秘密 关系国家安全和利益,分绝密/机密/秘密三级 绝对禁止:离开涉密终端、接入互联网、输入任何 AI 工具 保密法第2、9、28条;实施条例第57条
工作秘密 机关单位公务活动中产生、不属于国家秘密但不宜公开的事项 不应输入外部 AI 工具(违反内部管理规定,存在泄密追责风险) 实施条例第3条
商业秘密 不为公众所知悉、具有商业价值并经权利人采取保密措施的技术/经营信息 未获授权 + 未签数据处理协议时上传 AI = 侵害商业秘密 反不正当竞争法第9条;刑法第219条
未公开科研数据/技术方案 行业重要数据候选 不得上传境外/公有云 数安法第21条
测绘/地理信息 涉密测绘成果管理极严 出境须审批 测绘法
人类遗传资源信息 出境须审批 医院/科研机构场景注意 人类遗传资源管理条例第16条

员工视角的关键点:商业秘密的认定以「权利人采取了合理保密措施」为前提——如果公司有保密协议/管理制度,你上传公司客户名单、源代码、技术文档到公共 AI 工具,即使是无意的,也可能构成「违反保密义务披露商业秘密」。


三、哪些数据不能明文存储

数据类别 加密要求 依据
国家秘密 涉密介质 + 分级保护加密;绝密级一用一销毁 保密法
CII 相关数据 强制使用商用密码(SM2/SM3/SM4),开展密评 密码法第27条
等保三级系统数据 重要数据加密存储/传输 GB/T 22239-2019
个人信息 采取加密、去标识化等安全技术措施——明文存储个人信息本身可能违反个保法第51条(滴滴案即以明文存储身份证号5780万条为违法事实之一) 个保法第51条
一般数据 无强制加密义务

去标识化 vs 匿名化(最核心的法律分界线):

去标识化 匿名化
定义 无法识别特定自然人(需借助额外信息) 无法识别且不能复原
法律属性 仍是个人信息,出境仍受规制 不再是个人信息,可自由处理/出境
标准 GB/T 37964-2019 个保法第73条第4项
实务陷阱 多数企业所谓「脱敏」只是去标识化,法律上不豁免 技术通常需 k-匿名/差分隐私 + 删除原始映射

四、判罚标准与典型案例

4.1 重大案例

① 滴滴出行 80.26 亿元处罚案(2022-07-21)

② 知网 5000 万元处罚案(2023-09)

③ APP 违规收集个人信息批量处罚(2021-2025)

④ 数据泄露类

⑤ 涉密数据泄露(判刑)

⑥ 商业秘密泄露

4.2 法律责任三层次

行政责任(主要罚则):

法律 一般情节 情节严重
个保法第66条 拒不改正处 100万以下;责任人1-10万 5000万 或 营收5%(取高);责任人10-100万
数安法第45条 拒不改正 5-50万;责任人1-10万 50-200万;造成大量泄露 200-1000万
网安法第63条 公安机关可处 5日以下拘留 情节较重 5-15日拘留

刑事责任:

罪名 法条 触发条件 刑期
侵犯公民个人信息罪 刑法253条之一 行踪/征信/财产信息50条以上;住宿/健康/交易500条以上;其他5000条以上;违法所得5000元以上 3年以下;特别严重 3-7年
非法获取计算机信息系统数据罪 刑法285条 违法所得5000元/损失1万元以上 3年以下;特别严重 3-7年
泄露国家秘密罪 刑法398条 违反保密法泄露国家秘密 3年以下;特别严重 3-7年
侵犯商业秘密罪 刑法219条 违反保密义务披露商业秘密 3年以下;特别严重 3-10年

刑行衔接逻辑:「数量巨大 + 牟利/造成损害」是行政转刑事的分水岭。刑法的威慑不在金额而在自由刑。

4.3 判罚逻辑分析

监管裁量的核心因素(滴滴案答记者问官方表述):

  1. 违法性质:是否置国家安全于不顾;责令改正后是否全面深入整改(最关键加重情节)

  2. 持续时长:7年连续违法 → 从重

  3. 危害后果:涉及 CII、严重侵害用户权益
  4. 违法处理数量:647亿条 → 顶格
  5. 违法情形多样性:跨业务线、多形态 → 从重
  6. 主观态度:主动整改从轻;「阳奉阴违、恶意逃避监管」从重

按营收比例罚款的逻辑:个保法66条「5000万 营收5%」——取两者较高者作为上限。超大平台用定额无威慑,必须按营收比例(滴滴80.26亿 ≈ 4.6%,接近顶格但未到顶:表达严厉定性 + 留整改余地)。

4.4 员工个人责任(重点)

4.5 2025-2026 执法趋势


五、风险等级评估框架

5.1 行为分级(「用 AI 助手处理工作数据」场景)

风险 行为示例 后果
🔴 高 含敏感个人信息(身份证/人脸/位置/医疗/金融/行踪)的原始文件发给境外 AI 数据出境违规 + 可能触犯253条之一
🔴 高 国家秘密/未公开政务数据、行业核心数据输入境外 AI 直接刑事(397/398条)
🔴 高 源代码、客户名单、技术配方上传公共 AI 侵犯商业秘密罪(219条)
🔴 高 公司明令禁止后仍批量导出数据 「情节严重」加重项
🟡 中 普通个人信息(员工通讯录、客户联系方式未脱敏)发境外 AI 违法处理个人信息,行政为主
🟡 中 未脱敏数据在境内 AI/云平台流转 告知同意/最小必要违规
🟡 中 数据泄露不报告 数安法45条加重
🟢 低 脱敏/聚合/不含个人信息的数据 一般无义务
🟢 低 经审批的安全评估合规出境 合法
🟢 低 使用已备案的境内 AI 服务 合法

5.2 罚款金额区间速查

量级 情形 金额
轻微 首次违规、及时整改 警告/通报,0-10万
一般 限期未改、APP违规收集 1-100万
较重 数安法「情节严重」档 50-200万,可停业整顿
严重 数据大量泄露 200-1000万 + 吊销许可
极严重 平台巨头「情节严重」 5000万 或 营收5%(取高)
刑事 员工个人 罚金 + 最高10年

六、合规判定方案设计

6.1 判定流程(四问判定树)

输入:数据样例 + 元数据(目的地/处理方式/是否CIIO)
  ↓
Q1 是否国家秘密/工作秘密/内部资料?
  ├─ 是 → ❌ 绝对禁止出境/出本地/AI处理(保密法第28条)
  └─ 否 ↓
Q2 是否重要数据/核心数据?(对照行业目录+GB/T 43697)
  ├─ 是 → ⚠️ 必须申报数据出境安全评估(数安法第31条)
  └─ 否 ↓
Q3 是否个人信息?
  ├─ 否 → ✅ 一般业务数据可自由出境处理(2024跨境流动规定)
  └─ 是 ↓
Q4 是否敏感个人信息?
  ├─ 是 → 当年累计≥1万人:安全评估;<1万人:标准合同/认证
  └─ 否 ↓
Q5 当年累计向境外提供量?
  ├─ ≥100万人 → 安全评估
  ├─ 10万~100万 → 标准合同备案或保护认证
  ├─ <10万人 → ✅ 豁免
  └─ 合同必需/HR必需/紧急避险 → ✅ 豁免

6.2 Skill 规格草案(data-compliance-check)

输入:数据文件样例(CSV/Excel/文本)+ 元数据(目的地、处理方式、是否CIIO) 处理

  1. PII 识别:身份证(GB11643 校验位)、手机号、银行卡(Luhn)、姓名、地址等规则扫描

  2. 数据分类:对照分类分级规则 + 行业目录知识判定(个人信息/敏感/重要/涉密/商业秘密/一般)

  3. 规则引擎匹配:YAML 规则表(出境判定 R1 / 出本地判定 R2 / 明文存储判定 R3 / 责任判定 R4)

  4. 生成判定报告:结论 + 触发条款原文 + 豁免路径 + 建议动作 输出:Markdown 判定报告 + 审计存档(JSON,含判定理由+法条+日期) 护栏:强免责声明(非法律意见);高风险自动标记「建议咨询律师」;输出可审计

6.3 可行性评估


数据合规判定流程(数据样例 → 判定结论)输入数据样例 + 元数据(目的地 / 处理方式 / 是否CIIO)绝对禁止出境/出本地/AI处理依据: 保密法第28条Q1 是否国家秘密或工作秘密?必须申报数据出境安全评估依据: 数安法第31条Q2 是否重要数据或核心数据?一般业务数据可自由出境处理依据: 2024跨境流动规定Q3 是否个人信息?当年累计向境外提供超过1万人?必须申报数据出境安全评估标准合同备案或保护认证Q4 是否敏感个人信息?Q5 当年累计超过100万人?必须申报数据出境安全评估Q6 当年累计超过10万人?标准合同备案或保护认证Q7 是否合同必需或HR必需或紧急避险?豁免豁免 (不足10万非敏感)

七、合规类 skill 生态调研

7.1 核心结论:未发现完全匹配的「数据合规判定器」

现有工具四类缺口:

  1. PII 检测器(Presidio、pii-masker、DataFog)——只回答「数据里有什么敏感信息」,不回答「有什么法律后果」

  2. 法规知识库 skill(mukul975 的 282+ skills、Sushegaad GRC)——只回答「规则是什么」,不接收数据样例

  3. DPIA 工具(cmcmsec/dpia)——人工问卷流程

  4. 运行时防护(DataFog hook、ShellWard)——风险发生时拦截,而非事前判定

7.2 最接近的替代品

工具 星级 定位 相关性
ShellWard(jnMetaCode/shellward) ⭐128 AI 应用合规网关,专为中国监管而生npx shellward scan 扫描项目输出网安法2026/PIPL/等保2.0/数据出境评分卡;支持 MCP、Claude Code、Hermes Agent 高——唯一内置「数据出境」法规语义,但面向项目/代码库而非单个数据样例
Privacy-Data-Protection-Skills(mukul975) ⭐216 282+ 结构化隐私合规 skills(GDPR/CCPA/PIPL等),含 cross-border-data-transfer、china-pipl 中高——法规知识库,可作判定器的「法规引擎」底座
deutsches-recht-mit-claude ⭐41 德国 DSGVO/GDPR 合规 skills:代码审计、数据流映射 中——海外「数据流→合规判定」范例
Claude-Skills-Governance-Risk(Sushegaad) ⭐801 ISO 27001/SOC 2/GDPR 企业合规框架指南 低——制度合规/审计,不接收数据样例

7.3 生态空白


八、腾讯 skill 商店商业价值评估

8.1 腾讯生态现状

腾讯元器(yuanqi.tencent.com):

元器第三方作者盈利政策【官方文档确认】

腾讯云智能体开发平台 ADP(原大模型知识引擎 LKE 升级):企业付费套餐路线(体验版0元直领),客户案例 26 家(海港人寿/国投证券/德邦快递/迈瑞/华住等);Skills 生态是企业私有化/内置技能,非面向第三方的公开开发者商店

8.2 国内竞品平台对比

平台 第三方分发 官方分成政策 备注
腾讯元器 ✅ 免费分发(公众号/QQ/广场) 无官方分成;仅「开发者自行接支付」 API 每月送 100 万 token
字节扣子(coze.cn) ✅ 多形态(智能体/技能/小程序/网页) ⚠️ 用户付费走平台订阅套餐;开发者销售分成未公布 已转型「扣子3.0」职场 AI 伙伴;技能=可复用 AI 能力单元
阿里百炼 ✅ 应用广场 ❌ 未公布 企业服务为主,激励=代金券/天池大赛
百度文心智能体 ✅ 百度搜索分发 ⚠️ 曾推「亿元开发者激励计划」、开发分润,政策多次调整 流量最大但分成口径多变

8.3 海外参照

8.4 商业价值评估

差异化定位:元器商店「法律」类目目前只有通用法律咨询(得理法律咨询、劳动法库等),无一专注数据合规判定。合规判定是专业性强、容错要求高、可自动化程度适中的垂类;企业愿意为「确定性、可追责、可交付报告」的工具付费,不愿为「聊天式建议」付费。

目标客户与付费意愿

客户群 规模 付费意愿 场景
企业法务/合规部 (合规事故罚款极高) 隐私政策审查、数据出境评估
安全团队 中高 数据分类分级、API 合规
个人开发者 上架合规,适合引流
律所/咨询机构 辅助尽调、批量初筛

市场规模:中国网络安全市场约 900-1000 亿元/年;数据安全与合规细分百亿级、20%+ 年增速【估算】;AI 合规工具按合规咨询市场 1-3% 替代率,潜在市场约数亿元/年——「小而美的垂类」

风险

  1. 平台政策风险(高):国内分成政策普遍未落地且多变;元器明确不参与分成
  2. 合规工具自身合规性(中高):输出法律判定涉及责任归属,必须有免责声明 + 人工复核提示
  3. 竞品替代(中):大模型本身具备基础合规问答能力;通用法务智能体可能下探
  4. 监管变化(双向):新规带来增量需求,但法规更新快需持续维护

前景评级:中等。建议路径:

  1. 短期:元器/扣子做免费引流(100万token补贴+微信生态曝光),导流自有网页/企业微信转化;做「合规自查报告生成器」而非「意见咨询」

  2. 中期:平台推出付费插件机制则第一时间入驻;以 MCP 服务形态发布保持资产可迁移

  3. 长期:以「报告交付 + 人工复核服务」的 SaaS/Human-in-the-loop 模式变现,规避纯 AI 判定责任风险


九、员工视角:用工作文件委托 AI

⚠️ 本章为通用法律框架分析。你随后补全公司规章制度后,将按「公司制度 + 法律」双重标准细化判定。

9.1 法律层面

场景 法律判定
用公司提供的、经审批的境内 AI 工具处理非涉密工作数据 一般合法(遵守公司制度前提下)
将公司客户名单/源代码/技术文档上传公共/境外 AI 工具 可能构成侵害商业秘密(未授权+未签DPA)
将含个人信息的员工/客户数据发给境外 AI 数据出境违规(员工独立责任主体)
将涉密文件输入任何 AI 刑事风险(泄露国家秘密罪)

9.2 关键结论

  1. 员工是独立责任主体——不能以「公司让我做的」或「这是公司数据」为由免责;明知违法仍实施 = 个人追责

  2. 授权是关键——公司是否批准使用某 AI 工具、是否签署数据处理协议(DPA)、数据是否脱敏,决定责任归属

  3. 「脱敏」不等于「匿名化」——多数企业脱敏只是去标识化,法律上仍是个人信息

  4. 审计留痕——每次上传前做合规判定并留存记录,既是自我保护也是公司合规义务的体现

9.3 待补制度后的细化项


附录:来源与免责声明

来源 URL 可信度
国家法律法规数据库 https://flk.npc.gov.cn 官方 ✅
数安法详情页 https://flk.npc.gov.cn/detail?id=ff80818179f5e0800179f885c7e70392 官方 ✅
网信办:促进和规范数据跨境流动规定 https://www.cac.gov.cn/2024-03/22/c_1712776610207456.htm 官方 ✅
网信办:数据出境安全评估办法 https://www.cac.gov.cn/2022-07/07/c_1658811536398503.htm 官方 ✅
网信办:个人信息出境标准合同办法 https://www.cac.gov.cn/2023-02/24/c_1678884832808280.htm 官方 ✅
网信办:生成式AI服务管理暂行办法 https://www.cac.gov.cn/2023-07/13/c_1690898327029107.htm 官方 ✅
网信办:滴滴处罚决定 https://www.cac.gov.cn/2022-07/21/c_1660021534306352.htm 官方 ✅
网信办:知网处罚公告 https://www.cac.gov.cn/2023-09/06/c_1695654024248502.htm 官方 ✅
GitHub ShellWard https://github.com/jnMetaCode/shellward 仓库 ✅
GitHub Privacy-Data-Protection-Skills https://github.com/mukul975/Privacy-Data-Protection-Skills 仓库 ✅
腾讯元器 https://yuanqi.tencent.com 已验证 ✅
腾讯云 ADP https://cloud.tencent.com/product/adp 已验证 ✅
扣子 https://www.coze.cn 已验证 ✅
Coze 海外分成政策 媒体报道 ⚠️
市场规模估算 推测/估算 🔶

可信度图例:✅ 官方/一手核实 | ⚠️ 公开报道/合理推断 | 🔶 估算


附录B:免责声明

本报告基于 2026-08-04 时点公开可获得的法律法规文本、监管公告和公开报道整理,用于合规风险辅助分析。不构成法律意见。法律法规可能更新,具体个案请咨询执业律师。判定 skill 的任何输出均需带免责声明,高风险场景建议人工复核。