人物Skill蒸馏实践指南
人物Skill蒸馏实践指南
把特定人物的思维方式、工作习惯与表达风格封装成 Agent 可调用的Skill,是一条清晰可落地的路径。nuwa-skill、zhangxuefeng-skill 与 colleague-skill 分别对应蒸馏引擎、深度成品样板与职场同事蒸馏三种形态。下文说明三者关系、共同原理、与知识库/数字人的边界,以及「我要蒸馏一个人该做什么」——含最小样例、失败模式与评测方法。
何时先别蒸馏
| 情况 | 更合适的做法 |
|---|---|
| 只想查事实/接口文档 | 知识库 / RAG,不必上 Persona |
| 语料极少(几条短评、二手八卦) | 先补一手材料,或缩小到单一决策面 |
| 法务/医疗等强合规且未授权脱敏 | 停;走正式知识管理与合规流程 |
| 要的是形象陪伴、语音视频 | 数字人界面;Skill 只作可选决策核 |
深度成品示例里用「张雪峰」仅因其开源样板完整;同一套结构可替换为任意公众人物或主题顾问,不是单一人物推广。
目录
- 1. 三个仓库分别解决什么问题
- 2. 演进关系:工厂、深度与广度
- 3. 共同原理:认知蒸馏而非文档堆砌
- 4. 与知识库、数字人的边界
- 5. 如何蒸馏一个人:两条路径
- 6. 产物结构、触发与归档规范
- 7. 质量门槛、失败模式与评测
- 8. 合规与维护
- 9. 延伸阅读
1. 三个仓库分别解决什么问题
| 仓库 | 核心定位 | 模拟对象 | 主要数据源 | 典型场景 |
|---|---|---|---|---|
| nuwa-skill | 通用蒸馏引擎(Meta-Skill) | 任意公众人物或主题 | 著作、访谈、社交媒体、决策记录;可叠加用户 PDF/字幕 | 「蒸馏芒格」「做一个费曼 skill」 |
| zhangxuefeng-skill | 深度心智模型成品(结构样板) | 样例人物 | 多本著作、深度采访、语录与决策案例 | 复杂决策类顾问的目录与写法参考 |
| colleague-skill | 职场关系数字化 | 同事、前任、老板等 | 飞书/钉钉消息、文档、邮件、PDF、截图 | CR 习惯、交接上下文、对话风格模拟 |
1.1 nuwa-skill:人物 Skill 的「工厂」
输入人名或模糊需求(如「我想提升决策质量」),按Phase 0–5执行:澄清需求 → 建自包含目录 →6 路并行调研→ 三重验证提炼心智模型 → 按模板写SKILL.md→ 已知/边缘/风格测试 → 可选双 Agent 精炼。
配套脚本包括字幕下载、merge_research.py汇总调研、quality_check.py自检。examples/内有多份公众人物示例。
1.2 深度成品样板:工厂能产到多深
目标不是语录复读,而是可运行的认知操作系统:若干心智模型、决策启发式、表达 DNA,以及Agentic Protocol(需事实时先查数据再开口)。完整调研材料在references/research/,Skill 目录可独立拷贝。开源的 zhangxuefeng-skill 是这一档的完整实例。
1.3 colleague-skill:从公众人物下沉到职场
采用Work Skill + Persona双轨:
- Part A(工作能力):负责系统、技术规范、排查流程、输出偏好
- Part B(人格):表达风格、决策模式、人际行为;运行时「先 Persona 定态度,再 Work 执行」
支持飞书/钉钉自动采集、浏览器读内部文档、手动上传与粘贴;支持追加语料、对话纠偏、版本回滚。
2. 演进关系:工厂、深度与广度
| 角色 | 解决的问题 |
|---|---|
| nuwa-skill | 从零到可发布 Skill 的流程、模板与质检 |
| 深度样板 | 复杂决策逻辑与风格可结构化,而非闲聊仿声 |
| colleague-skill | 普通人协作痕迹也可变成可调用模块 |
选型建议
- 严肃决策参考、公众人物思维顾问 → nuwa 流程 + 深度成品式目录结构
- 团队传承、离职交接、CR 习惯保留 → colleague-skill
- 批量造新人物 Skill → 以 nuwa-skill 为主引擎
安装命令因平台而异(例如部分生态提供npx skills add owner/repo);以各仓库 README 与当前 Agent 的 Skill 安装方式为准。
3. 共同原理:认知蒸馏而非文档堆砌
三个项目的共同本质是人格/认知蒸馏:把隐性经验(Tacit Knowledge)通过 LLM + 工程化流程变成结构化、可复用的方法论模块——不是 FAQ 堆砌,而是可 Invoke 的教练。
3.1 Skill 里通常有什么
| 组件 | 含义 | 示例方向 |
|---|---|---|
| 心智模型 | 反复出现的思考框架 | 「先看筛子/约束,再谈努力」 |
| 决策启发式 | 可执行的 If-Then | 「若无法说出中位数结果,则继续调研」 |
| 表达 DNA | 句式、词汇、节奏 | 短句、反问、口语、斩钉截铁 |
| 反模式与诚实边界 | 不做什么、何时失效 | 不适用学术路径;信息截止日 |
| Agentic Protocol | 需事实时先调研再回答 | 先查就业/薪资再给建议 |
nuwa 强调捕捉HOW they think,不是 WHAT they said 的摘抄;colleague 把「术」(Work)与「道」(Persona)解耦再融合。
3.2 语料权重(输入质量)
| 优先级 | 类型 | 说明 |
|---|---|---|
| 高 | 本人著作、长访谈逐字稿、决策备忘 | 一手、可追溯 |
| 中 | 演讲字幕、系列短视频合集(需去重) | 表达 DNA 好,框架易碎 |
| 低 | 二手解读、剪辑名言、营销文 | 仅作索引,不作主证据 |
| 职场特有 | 本人写的设计文档、CR 评论、事故复盘 | Work 轨的核心 |
建议一手来源占比>50%;短视频切片再多,也补不上一本系统著作或一次深访。
3.3 最小可运行SKILL.md片段(示意)
下列为结构示意,可直接当写作模板;内容须换成目标人物的证据化条目。
--- name: example-perspective description: > 在职业选择与路径权衡时启用。触发词:志愿、转行、值不值得读研。 用「就业倒推 + 中位数结果」分析;不替代官方政策与持证咨询。 --- # Example Perspective ## 心智模型 ### 就业倒推 先问毕业后岗位与中位数收入,再倒推专业/院校是否匹配。 **失效**:纯学术志趣且不依赖就业回报时不适用。 ## 决策启发式 - IF 说不出该方向的中位数结局 THEN 先调研再给建议 - IF 家庭现金流紧张 THEN 提高「确定性」权重,降低「情怀」权重 ## 表达 DNA 短句;先结论后理由;允许口语与反问;避免空泛励志。 ## 诚实边界 - 信息截止:YYYY-MM;之后政策/行情需现场检索 - 非本人授权;公开言论推断 - 不提供医疗/法律结论 ## Agentic Protocol 涉及具体院校或行业数据时:先检索再回答;检索失败则声明不确定。description往往比正文长度更影响会不会被自动选中——写清谁、什么场景、什么触发词。
3.4 执行闭环(colleague 示例)
接收任务 → Persona 定态度 → Work Skill 执行 → 带风格的输出验收时应先测 Work 是否把事做对,再调 Persona 像不像;顺序反了容易得到「很像但没用」的壳。
4. 与知识库、数字人的边界
4.1 Skill vs 知识库
| 维度 | 知识库 | 人物 Skill |
|---|---|---|
| 本质 | 存储与检索 | 能力封装与执行 |
| 内容 | 静态文档、片段 | 思维模型、决策规则、人格特质 |
| 交互 | 返回相关段落 | 以该视角分析或完成任务 |
| 输出 | What | How + 风格 |
| 人格 | 通常中性 | 可有 Persona |
知识库像字典;Skill 像教练。知识库适合「接口文档在哪」;Skill 适合「这个同事会怎么 Review 这段代码」。
4.2 Skill vs 数字人
| 维度 | Skill | 数字人 |
|---|---|---|
| 核心 | 思维与决策(大脑) | 形象与多模态交互(皮囊) |
| 形态 | 文本指令、Prompt 包、脚本 | 3D/视频/语音 Avatar |
| 目标 | 提效、决策辅助 | 沉浸、陪伴、展示 |
| 伦理定位 | 更易视为工具 | 易引发身份混淆 |
完整「数字分身」往往是:数字人作界面 + Skill 作决策核心。当前三个仓库主要做大脑一侧。
5. 如何蒸馏一个人:两条路径
5.1 路线 A:公众人物(nuwa-skill)
- 明确对象:全名或主题;全面画像还是单一维度(如只做投资判断)。
- 准备语料(质量关键):书籍 PDF、长访谈 transcript、视频字幕;本地一手材料权重大于纯 Web 搜索。
- 触发蒸馏:在已安装 nuwa-skill 的 Agent 中描述目标(如「蒸馏芒格」「造一个 XX 视角 skill」);模糊需求时引擎会先诊断再推荐。
- 跟进检查点:Phase 1.5 调研摘要、Phase 2.5 提炼摘要——在此拦截低质量调研比写完再返工便宜。
- 部署:将整个 skill 目录(含
references/research/)拷到当前 Agent 的 skills 路径(见 §6.3)。
标准目录骨架
{name}-perspective/ ├── SKILL.md ├── scripts/ # 可选 └── references/ ├── research/ # 01-writings … 06-timeline └── sources/ # 用户 PDF、transcript社区成品可按各仓库说明安装(例如支持 Skill 注册表时的npx skills add …);以 README 为准。
5.2 路线 B:职场同事(colleague-skill)
授权清单(落盘前勾选)
| 项 | 说明 |
|---|---|
| 授权范围 | 仅工作相关;是否含私聊/绩效 |
| 知情同意 | 当事人或制度允许的采集依据 |
| 脱敏 | 手机号、身份证、客户机密已处理 |
| 保留期限 | 到期删除或归档策略 |
| 存放位置 | 仅私有目录;不进公开远程 |
- 基础信息(3 问):花名/代号;一句话岗位;一句话性格/文化标签。
- 原材料渠道
| 方式 | 说明 |
|---|---|
| 飞书/钉钉自动采集 | 需企业应用与相应 token;群聊/私聊权限不同 |
| 链接与导出 | 浏览器登录态、文档导出、邮件.eml |
| 上传 / 粘贴 | PDF、JSON 导出、聊天记录、备忘录 |
- 确认预览:Work 摘要与 Persona 摘要后再落盘。
- 进化:新文件 → 增量合并;「他不会这样」→ Correction 并重生
SKILL.md;必要时版本回滚。
安装 create-colleague 元 Skill 的方式见其仓库 README(常见为 clone 到本机 skills 目录)。Cursor 中跑tools/下脚本需要终端权限与 Python 依赖(如 playwright),并自行管理 IM 凭证。
5.3 两条路径对比
| 项目 | 路线 A(nuwa) | 路线 B(colleague) |
|---|---|---|
| 典型对象 | 公开可检索的人物/主题 | 离职同事、现任搭档 |
| 核心产出 | 单一SKILL.md(含心智模型) | work.md+persona.md+ 合并SKILL.md |
| 数据从哪来 | 公开语料 + 可选用户 PDF | IM、文档、邮件、主观标签 |
| 蒸馏重点 | 跨域心智模型、表达 DNA | 工作流 + 职场人格 |
| 更新方式 | 增量跑调研 Agent | 追加文件、对话纠偏 |
6. 产物结构、触发与归档规范
6.1 colleague 生成的同事 Skill
个性化产物通常在colleagues/{slug}/(常 gitignore,适合本地私有):
colleague-skill/ └── colleagues/ └── tianyi/ ├── SKILL.md ├── work.md ├── persona.md ├── meta.json ├── versions/ └── knowledge/调用形态多为/{slug}、/{slug}-work、/{slug}-persona(视 Agent 实现而定)。
公众人物成品应放在独立{name}-perspective/或单独仓库——不要放进colleagues/。
6.2 nuwa 生成的 perspective Skill
{skillsRoot}/munger-perspective/ ├── SKILL.md └── references/research/Skill 须自包含:调研文件在 skill 目录内,不依赖外部临时路径。
6.3 安装路径与触发(多环境)
| 环境 | 常见路径 / 约定 |
|---|---|
| Claude Code | ~/.claude/skills/;同事产物常在…/create-colleague/colleagues/{slug}/ |
| Cursor | 用户级 skills 目录,或项目内.cursor/skills/ 团队约定路径(以当前 Cursor 文档为准) |
| 其它 Agent | 如 OpenClaw 等,见各产品 workspace skills 约定 |
触发失败时优先查:
description是否写清场景与触发词- Skill 是否在 Agent实际扫描的目录内
- 名称/slug 是否与调用方式一致
- 是否被更高优先级的其它 Skill 抢触发
私有同事 Skill勿 push 到公开远程;原始聊天记录放在knowledge/并脱敏。
7. 质量门槛、失败模式与评测
7.1 质量门槛(静态检查)
| 检查项 | 通过标准 |
|---|---|
| 心智模型数量 | 3–7 个,各有来源证据 |
| 局限性 | 每个模型写清失效条件 |
| 表达 DNA | 读约 100 字能辨认风格取向 |
| 诚实边界 | ≥3 条具体局限 |
| 内在张力 | ≥2 对矛盾(避免「太完美」) |
| 一手来源占比 | 建议 >50% |
宁可交付标注了局限的 60 分 Skill,也不要无来源的 90 分编造。
7.2 常见失败模式
| 翻车 | 表现 | 对策 |
|---|---|---|
| 语录复读 | 只会引用金句,给不出流程 | 强制 If-Then 与失效条件 |
| 过度光滑 | 永远正确、无矛盾 | 补内在张力与反模式 |
| 一手不足 | 全是二手解读 | 补著作/深访;下调二手权重 |
| Persona 盖过 Work | 口吻像、事办砸 | 先冻结 Work 验收,再开 Persona |
| 触发失败 | 装了从不被调用 | 重写description;核对扫描路径 |
| 过拟合短视频 | 节奏像、框架空 | 提高长文/决策记录占比 |
| 越权回答 | 医疗/法律一口咬定 | 诚实边界 + Agentic「先检索/拒答」 |
7.3 可重复评测(动态)
准备5–10 道黄金题(固定题干,分版本回归):
| 题型 | 目的 |
|---|---|
| 已知区 | 有明确语料支撑,应答出框架与证据 |
| 边缘区 | 语料不足,应承认不确定或触发检索 |
| 风格题 | 短答是否像目标人物的表达 DNA |
| 反模式题 | 应拒绝或声明不适用的场景 |
对比测:同一题分别用中性 Agent 与人物 Skill;看差异是否来自方法论,而非多套了几句口头禅。
同事路线:请当事人或熟悉者打两个分——像不像(1–5)、有没有用(1–5);「有用」低于 3 分时优先改 Work,而不是加语气词。
先小范围试用(一条 CR、一个志愿问题),再扩场景;用「他不会这样」迭代,比一次灌满材料更稳。
8. 合规与维护
8.1 合规
- 职场消息、邮件含隐私与劳动合规风险:仅在有授权、脱敏前提下蒸馏。
- 公众人物 Skill 是公开言论推断,非本人授权代言;须写明边界与调研截止日。
- 飞书/钉钉自动采集需企业开放平台应用与 scope;token 自行管理,不进仓库。
8.2 维护
- 活跃公众人物:定期增量更新对话、决策、时间线类调研。
- 同事 Skill:持续追加文档与纠偏;重大变更前先备份版本。
8.3 落地注意
- Cursor 与 Claude Code 的 skills 路径、工具集不同;脚本依赖与终端权限按环境配置。
description决定触发率;场景与触发词写清楚。- Skill 是决策辅助,不能替代持证专业咨询;升学/医疗/法律等以官方与持证意见为准。
9. 延伸阅读
| 资源 | 说明 |
|---|---|
| nuwa-skill | 安装、画廊、流程与质检 |
| colleague-skill | 飞书/钉钉 setup、目录结构 |
| zhangxuefeng-skill | 深度 perspective 成品与 research 样例 |
| Agent Skills 开放标准 | Skill 目录与SKILL.md约定 |
三个仓库均为社区开源项目;IM 采集与人物模拟须遵守当地法律与企业制度。