如何用WorkBuddy蒸馏一本书,快速掌握核心知识
很多人一年读二十本书,年底只记得"好像读过"。问题不在记性,在读法——把书当文章读完,它就会像文章一样被忘掉。
很多人一年读二十本书,年底只记得"好像读过"。问题不在记性,在读法——把书当文章读完,它就会像文章一样被忘掉。
一本书里真正值钱的只有三类:作者回答的核心问题、他给的可操作方法、以及他承认自己做不到的部分。剩下的铺垫和例子,都是为了让你相信前三类。蒸馏就是把这三类从二十万字里捞出来,变成一个你能随时翻、随时问的文件。
本文 5 步,走完你会拿到一份 核心.md:三个核心问题、五条带原书页码的核心主张、按场景分组的可操作办法、以及这本书的适用边界。不用懂代码,每步都给了可直接复制的提示词。

pexels-pu-ca-adryan-163345030-38817487
第 0 章 · 开始前
你要准备的东西
总览表:这条路一共五步
不适合谁
需要逐字引用的学术写作(蒸馏会丢原文措辞)、靠记忆通过的考试(蒸馏给框架不给记忆)、小说散文(价值在文本本身,拆成框架就毁了)。
第 1 章 · 会用:跑通第一次蒸馏
步骤 1 · 建目录,把书放进去
在哪做:本地新建一个文件夹,路径别带中文空格,比如 D:\distill\book-name\。
输入什么:把原书 PDF 放进去,再新建一个空文件 00-骨架.md。
会看到什么:文件夹里有 PDF 和一个空 md 文件。
看到别的说明什么:如果你把书放在桌面、和几十个其他文件混在一起,下一步 AI 很可能读错文件——这是新手第一步最常见的坑。
步骤 2 · 先读目录和前言,产出全书骨架
不要直接开始读正文。先让 WorkBuddy 读目录、前言、绪论(通常是 PDF 前 20 页),把整本书的骨架拉出来。
复制这段提示词:
``` 读一下这份 PDF 的第 1 页到第 20 页(目录、前言、绪论部分)。
帮我产出一张表格,四列:
| 章节 | 这一章在回答什么问题 | 作者的结论(一句话) | 对我这种【填你的职业】有什么用 |
要求:
只填你在原文里真正读到的信息。
读不到的地方写"原文未提",不要推测、不要补充。
如果这 20 页里没有目录,直接告诉我"未找到目录",不要编。
```
会看到什么:一张章节表,每章回答什么问题一目了然。
看到别的说明什么:如果它开始编造章节名、或者章节数和你的书对不上,通常是两个原因——PDF 是扫描版没做 OCR(跳到排查表),或者页码范围不对(改小范围重试)。
我的判断:这步别省。没有骨架,后面每章都是孤立信息,合并时 AI 拼不出主线。
步骤 3 · 分批精读,一章一个文件
关键原则:一次不要喂超过 50 页。
一本 300 页的书一次性读完,后半段提取质量会明显下降——前面的章节记得清,后面的开始概括、丢细节。这是上下文衰减,不是模型笨。分批就能解决。
做法:一次处理 3–5 章,每章产出一个独立文件。
复制这段提示词(每批改一下页码):
``` 读这份 PDF 的第 A 页到第 B 页(对应第 X 章到第 Y 章)。
按下面四段输出,每一章单独写到 章节-0X.md:
这一章回答的问题(一句话)
作者的核心论证(3–5 句,用作者自己的逻辑讲,不要你的评价)
书里给出的具体方法或步骤(有就逐条列,没有就写"本章无具体方法")
原文里的例子和数字(逐条列出,每条标明页码)
约束:
只能用原文有的信息。
任何一处你推测的内容,前面必须标【推测】。
每章开头写清起止页码。
```
会看到什么:章节-01.md、章节-02.md……每个文件四段结构一致。
看到别的说明什么:如果某一章的四段里出现大量【推测】,说明那一页范围的文字没读干净,单独重读那一章。
用什么能力:这一步可以用 WorkBuddy 的子代理并行处理——开 3–4 个子代理,每个负责一批章节,比串行快得多。不确定该用哪个技能,先用 find-skills 查一下。
步骤 4 · 合并,抽出核心
所有章节文件齐了之后,让 WorkBuddy 通读一遍,产出 核心.md。
复制这段提示词:
`` 我这里有 N 个章节文件(章节-01.md 到 章节-0N.md)。请全部读完,产出一份 核心.md`,包含五部分:
这本书回答的 3 个核心问题(每个不超过 20 字)
作者的 5 条核心主张(每条一句话,后面标【出自第 X 章,第 Y 页】)
书里所有可操作的方法,按"用在什么场景"分组
书里最重要的 10 个数字或案例(带页码)
这本书没解决什么(作者自己承认的局限;如果作者没承认,写"作者未提及局限")
约束:
每一条都要能追溯到具体章节和页码。
提取不到的就写"未提取到",不要用常识补齐。
第 5 部分不许你替作者谦虚,只写原文里有的。
```
会看到什么:一份 核心.md,五个部分,主张后面都带页码。
看到别的说明什么:如果第 5 部分写得很空,不一定是 AI 偷懒——很多书确实没写局限。这时候空着比编一句"本书局限性在于样本不足"要诚实。
步骤 5 · 存进资料库,变成能随时问的底稿
把 核心.md 存进 WorkBuddy 的资料库(用 library 技能),或者固定放在一个你不会删的目录里。
存好之后,你以后每次的问法就变了——不是"怎么看待 XX 问题",而是:
``` 按我资料库里《书名》的框架,帮我看这件事: 【描述你遇到的具体情况】
按三步回答:
在这个框架里,我这件事属于哪一类?
按作者的办法,第一步该做什么?
这个框架对我这件事有哪些地方不适用?(这条必须回答,答不出就直说)
```
为什么必须存起来:不存,你下次问问题时就又得重新读一遍原书;存了,以后每次问的都是同一份底稿,答案才稳定。
⚠️ 这一步最容易卡在哪
扫描版读出来乱码——跳到文末排查表,先做 OCR。
一次喂太多页,后半段质量塌——严格控制在 50 页以内。
章节文件和页码对不上——在提示词里强制要求"每章开头写清起止页码"。
✅ 过关标准
你能用三句话说清这本书回答哪三个问题,并且每句话都能指出在第几章。做不到,回步骤 4 重抽。
第 2 章 · 用对:怎么确认蒸馏出来的没走样
这步最要紧,也最容易被跳过。AI 蒸馏有个天然倾向——它倾向于确认你是对的。所以不能问"我这样对吗",必须让它找反例。
三层核对法
第一层 · 页码回溯
每条主张后面必须有页码。这不是形式主义——能指出页码 = 可被验证;指不出 = 大概率是模型自己补的。步骤 4 提示词里"标【出自第 X 章,第 Y 页】"这句就是为了这个。
第二层 · 反向核对
复制这段提示词:
``` 这是我蒸馏出来的 5 条核心主张。请回到原文逐条核对:
每条主张,原文里真正对应的句子是什么?(给出原文原句 + 页码)
有没有哪条是我过度概括了,原文其实有前提条件或适用范围?
有没有哪条是原文根本没有、我从别处带进来的?
作者自己有没有提出反例或局限?
只回答能在原文里找到依据的部分。找不到的,直接说"原文未找到对应内容"。 ```
第三层 · 换你行业的话重讲
复制这段提示词:
``` 用【填你的行业,比如"我做外贸跟单"】的话,把这本书的第 2 条主张重新讲一遍。
讲完后回答:
这条主张在我的工作里对应哪个具体场景?
如果对应不上,直接说"对应不上",不要硬套。
```
为什么这一层最关键:能被原话复述不叫懂,能被你的行业语言重讲出来才算。讲不通的地方,就是你其实没吃透的地方。
对照表:走样的三种样子
⚠️ 这一步最容易卡在哪
最大的坑不是技术,是心理——花了 60 分钟蒸馏,你不想听见"这条不对"。所以核对必须交给 AI,并明确要求它找反例,而不是问"对不对"。
✅ 过关标准
从 核心.md 里随机抽 3 条主张,你能翻到原书对应页码确认无误。三条全中,这份蒸馏才可以用。
第 3 章 · 用好:把蒸馏结果变成能调用的东西
存进资料库
用 library 技能把 核心.md 存进去。跨设备能调,以后问问题时直接引用,不用每次重新贴。
做一张迁移表
让 WorkBuddy 把书里的框架迁移到你的行业。
复制这段提示词:
``` 这是一份《书名》的核心提取(核心.md)。我做的是【你的行业】。
请产出一张迁移表,四列:
| 书里的办法 | 它原本解决什么问题 | 我的工作里有没有同类问题 | 要用的话,需要改哪一步 |
约束:
第三列如果找不到同类问题,写"无对应",不要硬套。
第四列要具体到"改什么",不要写"需要调整"。
```
需要的时候转成正式文档
如果要拿去给同事看或者存档,用 tencent-docx 技能把 核心.md 转成 Word,排版会规整很多。
⚠️ 这一步最容易卡在哪
迁移表里如果"无对应"超过一半,说明这本书和你的行业其实不匹配——这时候别硬做,换书比硬套划算。
✅ 过关标准
下一次遇到具体问题,你能在 3 分钟内调出这本书的框架,并且说得出它哪一条不适用。
排查表:卡住了看这里
常见问题
扫描版能蒸馏吗? 能,但必须先 OCR(pdf 技能里有)。OCR 质量直接决定蒸馏质量,扫描糊的建议换文字版。
微信读书/得到的笔记能蒸馏吗? 能。导出成 txt 直接读,缺点是丢页码——改用"原文原句比对"代替页码回溯。
一次能读多少页? 50 页以内比较稳。超过之后后半段的提取会开始变概括,宁可多分几批。
英文书可以吗? 可以,建议英文蒸馏、中文输出,提示词里保留英文术语,避免翻译时概念被磨平。300 页的书约 60–90 分钟,核对占三分之一,别省。
会侵权吗? 自己用、不公开传播、不整段复制原文,属于个人学习使用。要公开发布就只发你自己的框架和结论,不要发原文摘录。
今天就能做的(按顺序)
今晚:挑一本读过但已经忘得差不多的书,建专属文件夹,把 PDF 放进去。只做这步,别贪多。
明天:跑步骤 2 和 3,把骨架和前 5 章拆出来。先跑 5 章试手感,别一上来做完整本。
后天:跑步骤 4 和第 2 章的三层核对。核完再决定这本书值不值得存进资料库,不值得就停在这。
资料来源与边界
方法依据:基于 WorkBuddy 现有能力——读取 PDF、子代理并行处理、library 资料库存储、pdf 技能的 OCR、find-skills 查技能、tencent-docx 输出文档。界面和技能名以你打开时的版本为准。
必须说清的边界:
蒸馏给你的是框架,给不了你手感。 书能告诉你往哪想,但"怎么判断、怎么拿捏"这一层书里没有,AI 也蒸馏不出来。手感只能靠自己做过。
"快速"是相对于通读全书,不是相对于什么都不做。60–90 分钟是下限。
带页码仍可能被误读——页码只证明"原文有这句话",不证明"你的概括等于作者的意思"。
不适合靠记忆通过的考试,也不适合需要逐字引用的学术写作。
我的判断:拉开差距的不是步骤 3 的精读,那部分谁做都差不多。拉开差距的是第 2 章的核对,尤其第三层。很多人蒸馏完觉得"我懂了",其实是 AI 写得通顺带来的错觉。判断标准就一条:你能不能用自己工作里的例子,把这条主张讲给同事听。讲得出来才算数。