OpenAI 正式开源全新 PII 脱敏模型 Privacy Filter
发布时间:2026-04-28 08:42:20 | 责任编辑:张毅 | 浏览量:53 次
近日,OpenAI 发布了一款名为 Privacy Filter 的新模型,旨在帮助开发者有效脱敏文本中的个人身份信息(PII)。该模型的参数规模达到了 1.5 亿,采用了混合专家(MoE)设计,并以 Apache 2.0 协议在 Hugging Face 和 GitHub 平台开源,供开发者下载、定制和商业使用。
Privacy Filter 的核心优势在于其深度语言理解能力,能够通过上下文识别非结构化文本中的敏感信息。与传统的基于规则的隐私过滤工具不同,该模型能够准确保留公开信息的同时,对与特定个体相关的敏感数据进行遮盖或脱敏。这一能力使得开发者在训练管线、索引流程、日志记录和审核环节中,能够构建更为强大的隐私保护机制。
该模型能够支持高达 12.8 万个 Token 的上下文窗口,并通过受限维特比算法解码出连贯的片段。在评估中,Privacy Filter 在 PII-Masking-300k 基准测试中表现出色,F1 分数达到了 96%。经过对评估中发现的标注问题进行修正后,该模型的 F1 分数进一步提升至 97.43%,显示了其在识别个人敏感信息方面的高效性。
OpenAI 表示,Privacy Filter 并不是匿名化工具,无法替代合规认证。在法律、医疗和金融等高敏感性场景中,人工审核及领域特定的评估和微调仍然是必不可少的。此外,Privacy Filter 的设计旨在保护用户的隐私,能够在本地设备上运行,用户在使用 AI 工具时,不必担心个人信息泄露。
本网站(https://aigc.izzi.cn)刊载的所有内容,包括文字、图片、音频、视频等均在网上搜集。
访问者可将本网站提供的内容或服务用于个人学习、研究或欣赏,以及其他非商业性或非盈利性用途,但同时应遵守著作权法及其他相关法律的规定,不得侵犯本网站及相关权利人的合法权利。除此以外,将本网站任何内容或服务用于其他用途时,须征得本网站及相关权利人的书面许可,并支付报酬。
本网站内容原作者如不愿意在本网站刊登内容,请及时通知本站,予以删除。
