【安柏·反蒸馏AI实验室】脱脱敏Skill
大模型上传文件前的最后一道防线

在大模型上传文件之前先用我们的 Skill 对文件进行脱敏避免你的敏感信息被上传到大模型

覆盖 Word / Excel / PPT / PDF 四类文档、8 大类敏感信息,本地完成、按原格式输出可交付的脱敏稿。
结构化骨干默认全开、精度最高;变体、隐晦指代与准标识符重识别风险自动兜底,
专治「敏感文件要外发、又不敢不脱敏」。

4
大文档格式
8
大类敏感信息

支持的敏感信息品类

以下品类均可直接识别与脱敏;未在列表中的,也可通过微信提交评估。

难脱的敏感数据,才是我们的强项

真正的脱敏难点,从来不是「身份证」「手机号」这几个标准词。免费通用大模型最怕的,是不按套路写的敏感信息——格式变体、半脱敏残留、藏在叙述里的间接标识。安柏把这块当成核心能力打磨。

变体识别:同一信息,N 种写法

手机号写成 1xx-xxxx-xxxx138****1234、甚至「一三八…」;身份证含空格 / 星号 / 分段、或缺前 6 位;姓名用同音字、昵称、职位代称(张总、李工);地址只写小区名 + 楼栋;金额用「几万」「行业惯例三个点」口语化表达。结构化骨干用多模式覆盖,不只盯单一正则,把常见变形一并兜住。

隐晦 / 间接敏感信息:不写「身份证」也能定位你

准标识符组合——出生年 + 性别 + 职务 + 学历,在小样本里就能唯一锁定一个人;病历里的医保号 / 样本编号,与姓名同列即构成标识;客户名藏在「某基金 / 甲方 / 项目代号」背后;关系藏在「详见补充协议」「其配偶任职于…」。这类纯正则抓不到,靠语义层(大模型两步审阅)兜底标记。

跨格式 / 跨字段一致性

同一人信息在 Word 正文、PPT 备注、Excel 表、PDF 脚注多处出现,统一脱敏不遗漏;关联字段(姓名 + 手机号 + 邮箱)一起判定,避免只脱一处、别处仍明文。表格单元格级精准,解决「表格里的人名没脱敏」。

通用大模型漏的,我们兜底。变体、隐晦指代、准标识符组合重识别——全部标记交人工确认,绝不自动误伤。这正是「通用聊天机器人随便聊聊」和「专为脱敏造的引擎」之间最本质的差距。

怎么用

在本地 WorkBuddy 调用本产品 Skill,上传一份文档,分钟即可拿到按原格式脱敏后的文件。脱敏在你的 WorkBuddy 本地完成,由你调用自己适用的大模型。

为什么选我们

我们只做一件事:把「脱敏」做到极致。每一个环节都为隐私与办公场景深度打磨。

谁在用

凡是「敏感文件要外发、又不敢不脱敏」的团队,都该有一套安柏。

核心能力

不是又一个会聊天的通用大模型,而是专为「脱敏」造的引擎。

和其他脱敏方式不一样

同样是用 AI 脱敏,交付物、隐私、透明度、专业度,差得不是一点。

你拿到的交付物

脱敏前后对照示意(真实交付物结构示意,上线后替换为实际样例)。

脱敏前后对照示意:客户资料表片段 标黄 · 掩码 · 按原格式

左:原始敏感信息;右:按规则掩码后的脱敏结果,保留省/市/区与部分字符、其余打星,结构与原文件一致。结构化骨干(身份证/手机/邮箱/银行卡等)默认全开、精度最高;中文姓名与地址为可选开启项。

复杂场景示例:变体与隐晦敏感信息 通用大模型常漏 / 我们兜底

变体识别:半脱敏手机号(138****1234)、样本编号与姓名同列、医保卡号均被结构化骨干识别;
隐晦兜底:「85 年生+女+副总裁+北大硕士」组合单独看无一字段敏感,组合后可唯一重识别,由语义层标记交人工确认;
绝不自动误伤:隐晦组合仅标黄、不删除,保留业务参考价值。

如何使用 · SkillHub 安装

通过 SkillHub 商店 CLI 安装本 Skill。已安装商店可直接装技能;未安装则先装 CLI 再装技能。

1

检查 SkillHub 商店

先确认本地是否已安装 SkillHub 商店:

skillhub --version
2

未安装 → 安装 CLI

若上一步报「命令不存在」,按官方指引只装 CLI:

# 按 https://skillhub.cn/install/skillhub.md 的 CLI 部分安装
3

安装本 Skill

无论上一步是否执行,都运行以下命令安装本技能:

skillhub install @org-xwcg4wqq/sensitive-desensitize-ai-ambers

安装完成后即可在本地 WorkBuddy 调用【安柏·反蒸馏AI实验室】脱脱敏Skill。

你的敏感文件,由你主导脱敏

脱敏在你的 WorkBuddy 本地完成,由你调用自己适用的大模型进行脱敏;安柏只提供脱敏规则,不负责云端处理。对投资机构与企业而言,隐私就是生命线。

  • 本地脱敏:脱敏在你的 WorkBuddy 本地完成,由你调用自有的大模型
  • 原始 PII 不出本地:敏感信息绝不离开你的环境
  • 透明可溯:每条命中都有位置、类型与来源,不黑箱
  • 合规启用:按许可证合法使用,权益受保护
本地
脱敏在你的 WorkBuddy 完成,由你调用自有大模型

价格

套餐与定制方案一目了然,欢迎联系微信咨询开通。

客户怎么说

以下为占位示例,上线后替换为真实客户授权证言。

“以前一份被投企业资料要排专人半天打码,现在 AI 先出脱敏底稿,他只做最终把关,效率直接翻几倍。”

— 某 PE 基金 法务总监

“最打动我的是能本地脱、用自己的大模型,敏感客户名单不交给陌生的云端通用 AI。”

— 某产业基金 投后负责人

“按原格式输出太实用了,脱完还是原来的 Word / Excel,直接就能发,不用再排版。”

— 某企业 HRD

今天的敏感文件就让AI免费来脱吧

套餐与定制方案,欢迎联系立即免费使用。

关于安柏·反蒸馏AI实验室与多格式敏感信息脱脱敏 Skill

安柏·反蒸馏AI实验室(Amber Anti-Distillation AI Lab)是专注于投资机构与企业法务的 AI 法务产品团队,核心产品为「多格式敏感信息脱脱敏 Skill」。该产品以本地 WorkBuddy 上的 Skill 形式运行,面向 PE/VC 基金、企业法务、创业公司、律师团队、金融机构与 HR / 人事,提供本地运行、你的大模型、按原格式输出的高质量脱敏能力。其价值主张是:上传一份 Word / Excel / PPT / PDF,分钟级拿到可直接外发的脱敏稿,而非一段泛泛的文字建议。

通用脱敏方法论

该引擎对任一文档都执行一套通用的结构化脱敏方法论:先对整份文档做整体层面体检,判断有哪些敏感信息、分布在哪些位置、属于哪类风险;再逐字段识别与脱敏,覆盖个人标识、账号凭证、组织定位、金额资产、医疗健康、生物特征、姓名社交、跨境编码等多个维度,并按风险严重程度对字段进行分级提示,确保不漏脱、不漏项。

脱敏输出物:默认交付两件套

覆盖的 8 大类敏感信息全量

个人标识类

身份证号、手机号、银行卡号、电子邮箱、出生日期、护照号、港澳台通行证、外国人永居证、军官证 / 士兵证、港澳 / 台湾居民居住证。

账号与凭证类

统一社会信用代码、IP 地址、MAC 地址、IMEI、QQ 号、微信号、密码 / 密钥、AccessKey / Secret、JWT、Cookie / Session、连接串、设备指纹。

组织与定位类

公司名 / 机构名、车牌号、GPS 坐标、IPv6 地址、中文地址(可选开启)。

金额与资产类

余额、信用额度、保额、月薪、市值、贷款金额、逾期金额、银行账号。

医疗与健康类

疾病诊断、检验报告、用药记录、病史、血型、健康档案、医保编号。

生物特征与身份类

人脸 ID、指纹、生物特征、登录账号 / 用户名、广告 ID / UUID。

姓名与社交类

中文姓名(可选开启)、社交账号(抖音 / Telegram / GitHub / LinkedIn 等)、微信 / QQ。

跨境与编码类

跨境个人信息、base64 / hex / md5 / sha256 编码值、敏感 URL(含 token / secret / vpn / hook)。

数据底座与合规

该引擎由确定性规则引擎为骨干、大模型语义补充为辅构建,结构化骨干默认全开、精度最高、零幻觉、可复现。脱敏以 Skill 形式在用户本地 WorkBuddy 上进行,由用户调用自己适用的大模型完成;安柏提供脱敏规则与能力,不负责云端处理。已通过平台安全评估(腾讯安全威胁情报中心、Skills 安全评估报告)。处理真实数据前,请确认已具备《个人信息保护法》要求的同意与影响评估。

适用场景:何时需要 AI 脱敏

无论是内部流转还是对外发布,只要涉及含个人信息的文档,都可能需要一次专业级脱敏。以下场景是用安柏多格式脱敏 Skill 的高频触发点:

适用人群与典型需求:谁会用 AI 脱敏

安柏多格式脱敏 Skill 面向所有需要脱敏的个人与组织,典型用户及其核心需求如下:

如果你属于以上任何一类人群,或手头有一份含个人信息的文档需要外发、归档或发布,都可以用安柏多格式脱敏 Skill 做一遍分钟级专业脱敏,直接拿到按原格式脱敏后的文件。

常见问题 FAQ

多格式敏感信息脱脱敏 Skill 是什么?

它是安柏·反蒸馏AI实验室出品的脱敏引擎,以 Skill 形式运行在你的本地 WorkBuddy 上。上传一份 Word / Excel / PPT / PDF,分钟即可生成按原格式脱敏后的文件,而非一段泛泛的文字建议。

AI 脱敏靠谱吗?

它以确定性规则引擎为骨干、大模型语义补充为辅,结构化骨干默认全开、精度最高、零幻觉、可复现;每一条命中都能追溯到具体位置与来源,不是黑箱生成。

支持脱敏哪些文档与敏感信息?

覆盖 Word / Excel / PPT / PDF 四类文档,以及人 / 组织 / 账号 / 金额 / 医疗 / 生物特征 / 车辆 / 定位 / 跨境全品类敏感信息。中文姓名与地址为启发式、可选开启、上下文约束,需结合报告人工复核。

脱敏之后交付什么?

默认交付两件套:按原格式脱敏后的文件(标黄 / 加粗可区分,逐条可核对)与提取报告(每条命中位置、类型与来源)。

我的敏感文件安全吗?

脱敏在你的本地 WorkBuddy 上进行,由你调用自己适用的大模型完成脱敏;安柏只提供脱敏规则,不负责云端处理,原始 PII 绝不离开本地(已通过腾讯双重安全认证:腾讯安全威胁情报中心、Skills 安全评估报告)。

怎么用 AI 脱敏一份文档?

在本地 WorkBuddy 上传文档,调用本产品 Skill 与你自有的大模型进行脱敏,生成按原格式脱敏后的文件,本地预览后下载交付。脱敏在你的 WorkBuddy 本地完成,由你调用自有的大模型。

表格里的姓名和账号能脱干净吗?

支持表头感知表格脱敏,表格姓名列 / 机构列 / 账号列自动覆盖,单元格级精准,解决「表格里的人名没脱敏」的常见问题。

脱敏怎么收费?

提供免费试用(1 次)、单份 9.9 元、10 次套餐 79 元/月、50 次套餐 299 元/6 个月,以及按需定制的私有化部署与年费订阅。具体开通请联系官方微信 ac_workshop2000。

和把文件直接丢给通用云端大模型脱敏有什么区别?

通用云端大模型通常只给一段文字建议,你要自己找、自己改、自己脱,且常把整份敏感文件传上云;安柏与它们的区别在六个方面:(1) 直出脱敏文件——直接交付按原格式脱敏后的文档,而非需要你自己脱的文字建议;(2) 资深法务与隐私专家对 Skill 开发把关——产品由资深法务与隐私合规专家主导规则与交付标准设计;(3) 高灵活度适配用户 WorkBuddy 特定工作流——以 Skill 形式运行于你的本地 WorkBuddy,可嵌入既有文档处理流程;(4) 可使用用户自己的最新最强 LLM——脱敏在你的 WorkBuddy 本地调用你自有的大模型完成,不依赖我们提供的云端模型;(5) 脱敏能力永远保持与大模型同步——随你所用大模型的迭代而同步提升;(6) 整个工作流及工作产物(脱敏文件)完全符合办公现有工作习惯——交付物即日常使用的 Word / Excel / PPT / PDF 文档,可直接进入既有复核与归档流程。