针对大模型应用中的数据隐私泄露隐患,开发者推出了名为 PromptMask 的开源解决方案。该项目旨在解决用户在使用云端大模型(如 ChatGPT、Gemini、文心一言等)或第三方中转 API 时面临的密码、API 密钥、IP 等敏感信息泄露风险。传统的数据脱敏方法存在诸多缺陷:基于正则表达式的方法无法识别无固定格式的密码或密钥;基于 MCP 协议的工具存在“AI 先读取后隐藏”的逻辑漏洞,防护滞后;而 NER(命名实体识别)等基于规则的方法缺乏语义理解,容易误杀或导致 AI 无法理解上下文含义。PromptMask 提出了“本地优先”的隐私层架构,利用本地部署的小参数量模型(如 Qwen2.5-1.5B 或文心一言 0.3B)对用户输入进行语义分析。通过优化的提示词工程,本地模型仅生成敏感数据与掩码(如 `${API_KEY}`)的 JSON 映射关系,大幅降低显存占用和延迟。在应用层面,PromptMask 提供了 Python SDK 和 OpenAI 兼容的 API 网关,实现了请求前自动脱敏和回复后自动去码的无感安全防护,为算力有限的用户提供了一种低成本保障 AI 数据安全的可行路径。
事件分析
💡 核心观点:利用低成本小模型作为隐私守门人,通过混合部署架构,在保障数据绝对安全的同时兼顾云端大模型的智能能力。
原文链接:Linux.do

评论前必须登录!
立即登录 注册