OpenAI 近日发布并开源全新文本脱敏模型 Privacy Filter,旨在帮助开发者识别和遮盖文本中的个人身份信息(PII)。该模型规模为 1.5 亿参数,采用混合专家(MoE)架构,以 Apache 2.0 协议在 Hugging Face 与 GitHub 平台开放下载和商用。Privacy Filter 可支持 12.8 万个 Token 的上下文窗口,并通过受限维特比算法实现连贯解码,在 PII-Masking-300k 基准测试中 F1 分数达 97.43%。相比传统基于规则的方案,该模型能在保留公开信息的同时精准脱敏,提高隐私数据处理效率。OpenAI 指出,该模型并非完整匿名化工具,仍需结合人工审核与行业合规要求,可在训练管线、日志与数据审核环节中用于构建更安全的隐私保护机制。