返回文章列表

发给模型前先脱敏:PII、日志和最小上下文原则

整理 AI 应用接入私有数据前的脱敏策略:字段过滤、最小上下文、日志保留和人工审查。

很多 AI 风险不是模型生成了什么,而是你把什么发给了模型。客服记录、用户资料、内部文档、日志片段都可能包含敏感信息。安全最佳实践和工具边界资料都提醒开发者需要控制输入、权限和外部动作。[pii-001][pii-002]

最小上下文原则

只发送完成任务需要的字段:

  • 不需要手机号就不要传手机号。
  • 不需要完整日志就传错误摘要。
  • 不需要用户真实姓名就用匿名 ID。
  • 不需要历史全量对话就传状态摘要。

脱敏不是上线前的补丁,而应该是上下文构建的一部分。

概念脱敏:

{
  "user_id": "u_anon_123",
  "email": "[redacted]",
  "issue": "无法重置密码"
}

日志也要脱敏

LLM 调用日志常包含 prompt、检索片段和工具结果。生产环境需要访问控制、保留周期和采样策略,避免调试数据变成新的泄露面。

综合安全资料可以推断:AI 隐私保护的第一道门在数据进入 prompt 之前,而不是模型输出之后。

参考资料

  1. [pii-001] OpenAI Developers, “Safety best practices”, https://developers.openai.com/api/docs/guides/safety-best-practices
  2. [pii-002] OpenAI Developers, “Tools”, https://developers.openai.com/api/docs/guides/tools