发给模型前先脱敏:PII、日志和最小上下文原则
整理 AI 应用接入私有数据前的脱敏策略:字段过滤、最小上下文、日志保留和人工审查。
很多 AI 风险不是模型生成了什么,而是你把什么发给了模型。客服记录、用户资料、内部文档、日志片段都可能包含敏感信息。安全最佳实践和工具边界资料都提醒开发者需要控制输入、权限和外部动作。[pii-001][pii-002]
最小上下文原则
只发送完成任务需要的字段:
- 不需要手机号就不要传手机号。
- 不需要完整日志就传错误摘要。
- 不需要用户真实姓名就用匿名 ID。
- 不需要历史全量对话就传状态摘要。
脱敏不是上线前的补丁,而应该是上下文构建的一部分。
概念脱敏:
{
"user_id": "u_anon_123",
"email": "[redacted]",
"issue": "无法重置密码"
}日志也要脱敏
LLM 调用日志常包含 prompt、检索片段和工具结果。生产环境需要访问控制、保留周期和采样策略,避免调试数据变成新的泄露面。
综合安全资料可以推断:AI 隐私保护的第一道门在数据进入 prompt 之前,而不是模型输出之后。
参考资料
- [pii-001] OpenAI Developers, “Safety best practices”, https://developers.openai.com/api/docs/guides/safety-best-practices
- [pii-002] OpenAI Developers, “Tools”, https://developers.openai.com/api/docs/guides/tools