OpenAI 宣布推出开源个人身份信息脱敏模型 Privacy Filter,已通过 Apache 2.0 协议在 Hugging Face 与 GitHub 发布。该模型具备深层语义理解能力,可识别非结构化文本中的八类敏感信息,包括姓名、地址、邮箱、账号、密码及时间等。Privacy Filter 采用混合专家(MoE)架构,总参数 15 亿,但每次推理仅激活约 5000 万参数,可在笔记本或浏览器等边缘设备运行。模型支持 12.8 万 Token 上下文,F1 分数达 97.43%。OpenAI 将其定位为云端大模型的本地预过滤层,帮助用户在数据上传前完成隐私检测与脱敏,降低信息泄露风险。