Lesson 09 · PHI / 涉密数据走公有 GPT → 合规爆雷¶
Problem¶
医院 / 律所 / 央企 / 制造业客户上线 6-12 个月后: - 内部审计发现有员工把患者病历粘贴到 ChatGPT 起草出院小结 - 律师用 Claude 分析客户合同, 合同内容进了公有大模型训练缓存 - 工程师用 Copilot 处理CAD 图纸, 图纸元数据被上传 - 医保 / 律协 / 军工监管介入, 违反 HIPAA / 律师保密义务 / 涉密管理办法 - 客户罚款 / 供应商被剔除白名单 / 项目全废
Root Cause¶
员工个人使用公有 AI + 无统一网关拦截.
三种典型触发: 1. 个人便利: 员工"我就一次帮忙, 试试快不快", 不觉得是问题 2. 系统集成缺 DLP: 内部系统调公有 API 时, 没检测输入敏感度 3. 无统一网关: 各部门用不同 API 密钥, 无法审计
Fix¶
四层防线:
1. 网关层强制统一¶
- 企业统一 LLM 网关, 屏蔽员工直接访问公有 API
- 所有出网流量走网关, 网关记录审计日志
- 未走网关的公有 API 调用技术层面禁止 (防火墙/HTTP代理)
2. DLP (Data Loss Prevention) 敏感度检测¶
- 网关层实时检测:
- PHI 关键词 (病历号 / 药品名 / 诊断代码 / 患者姓名)
- PII (身份证 / 手机号 / 邮箱)
- 合同关键词 (甲方乙方 / 金额 / 保密条款)
- CAD 图纸元数据 / BOM 结构
- 检测到敏感数据 → 拦截并告警
3. 敏感度分级路由¶
- 敏感数据强制走内部私有 LLM (AW36-72B on-prem)
- 非敏感数据可以走公有 API (成本优化)
- 边界模糊数据走中间层 (脱敏后再上公有)
4. 员工培训 + 违规审计¶
- 入职培训明确"哪些数据不能上公有 AI"
- 每季度全员抽查, 违规 → 记录 + 教育
- 严重违规 → 处分, 严重到影响合规资质 → 法务介入
How to Avoid¶
- 架构评审必含 DLP 方案
- 合规评估在项目启动时就介入
- 统一 LLM 网关在项目里作为基础设施, 不作为可选项
- 审计日志保留 ≥ 3 年, 监管随时可查
- 敏感度分级在 Day 1 就定义清楚 (PHI / PII / 涉密 / 商密 / 一般)
Related cases¶
- Case 11 · 医院公私混合路由 — 敏感度分级路由, 零 PHI 出网
- Case 10 · 跨境 SaaS 三网关 — US/EU/CN 数据驻留合规
- Case 03 · 集团多租户 LLM 网关 — 20+ 业务线统一网关
Related industries¶
- 医疗行业 AI GEO — PHI 硬红线
- 律所 / 法商 AI GEO — 客户 NDA
- 政企 / 央企 AI GEO — 涉密管理
- 金融 / Fintech AI GEO — PBoC 合规
避坑成本估算: 合规爆雷 = 罚款 100-1000 万 + 客户白名单被踢 + 供应商信任 3 年恢复.