book-to-skill:把技术书变成 AI Skill 教程
想一起学 AI 视频、自动化工作流和实用工具,可以扫码加微信,我会把你拉进学习交流群。群里会不定期分享免费工具、安装包和实操案例。
做 Codex、Claude Code 或各类 Skill 时,如果需要稳定的模型 API,推荐使用跃云中转站。部分 Skill 调用的模型接口也可以走这里。注册或充值时填写优惠码 DC96236305AA3EA0,可获赠免费体验额度。
经常用 Codex 或 Claude Code 的朋友,应该遇到过这种尴尬:
手里明明有一本四五百页的厚技术书,比如《数据密集型应用系统设计》,想让 AI 把「数据复制」讲清楚,结果要么:
- 把整本 PDF 扔进上下文,一次烧掉接近 20 万 Token,中间细节还记不住,明天再问又得重烧;
- 不扔书,AI 开始乱编章节标题;
- 自己搜 PDF,得到的是一页页原文,不是答案;
- 自己做笔记,做完就再也打不开。
这就是经典的「发现循环税」(Discovery Loop Tax):你每次都在为「重新翻书」付费。
本期对应视频里分享的神器叫 book-to-skill。一句话讲明白:
下面是可直接照着做的笔记版教程:下载、安装、转换、使用、注意事项都写全了。
这个工具是什么
book-to-skill 是巴西 SRE 工程师 Virgilio Junior 开源的工具(MIT 协议)。他自己受够了反复重读同一本技术书、反复烧 Token,于是做了这个提取器并开源。
它做的不是「把书塞进聊天窗口」,而是:
- 你把书指给它;
- 它提取书里的框架、决策规则、技巧、反模式;
- 生成一套标准 Skill 目录;
- 以后在 Claude Code / Codex 等支持 Agent Skills 的环境里,按技能名 + 主题调用;
- AI 只读对应章节,回答基于真实书本结构,而不是凭空编。
关键区别:
| 以前 | 现在 |
|---|---|
| 检索:把原文塞进去,让 AI 临时翻 | 推理:AI 直接用作者花几年建好的命名框架和决策规则工作 |
| 每次对话可能重烧十几万 Token | 一次转换,之后大约加载约 5,000 Token |
| 容易幻觉章节 | 从结构化章节与 cheatsheet 回答 |
官方在真实书籍上测过:相对「整本书丢进上下文」,Token 可降约 24 倍到 51 倍。转换成本大约 每本书 1 美元量级(例如 371 页的 Working Backwards 约 $0.96,视频里按当时汇率约等于 7 元人民币量级)。转换付一次,后续会话不再为整本书重复买单。
它适合谁、能处理什么
适合这些人:
- 经常用 AI 写代码、做架构、学技术;
- 书架上有已经买过但几乎不看的技术书;
- 想让 AI「带着这本书的思维方式」干活,而不是只问一句「书里怎么说」。
不只是书。官方也支持把这些内容变成 Skill:
- 内部文档、架构决策记录、运维手册;
- 品牌与设计系统说明;
- 一叠论文 + 自己的笔记;
- RFC、API 契约、合规规范。
支持的常见格式包括:
- EPUB
- DOCX
- HTML
- RTF
- MOBI / AZW / AZW3
- TXT
- Markdown
- reStructuredText / AsciiDoc
下载入口
项目免费、开源,官方仓库如下。建议直接从 GitHub 获取,保证文件完整(含 scripts/ 提取引擎)。
克隆整个仓库到对应 Agent 的 skills 目录即可。不要只下载单个 SKILL.md,否则提取脚本可能缺失。
安装:三步上手
第 1 步:确认你用的是哪套 Agent
不同工具的 skills 目录不同:
| 工具 | 推荐安装路径 |
|---|---|
| Claude Code | ~/.claude/skills/book-to-skill |
| GitHub Copilot CLI | ~/.copilot/skills/book-to-skill |
| Amp / 跨端通用 | ~/.agents/skills/book-to-skill |
| Codex(若你本地已配置 skills 目录) | 常见为 ~/.codex/skills/ 或 ~/.agents/skills/,以你当前 Codex 实际读取的 skills 路径为准 |
视频里强调:Codex 与 Claude Code 都支持同一套 Skill 格式,克隆到对应技能目录即可。
第 2 步:克隆仓库(推荐做法)
Claude Code:
git clone https://github.com/virgiliojr94/book-to-skill.git ~/.claude/skills/book-to-skill
也可以在 Claude Code 会话里粘贴:
Install book-to-skill: https://raw.githubusercontent.com/virgiliojr94/book-to-skill/master/SKILL.md
但官方更推荐完整 git clone,这样提取脚本与模块文件会齐全。
GitHub Copilot CLI:
git clone https://github.com/virgiliojr94/book-to-skill.git ~/.copilot/skills/book-to-skill
进 copilot 会话后执行:
/skills reload
/skills info book-to-skill
跨端 / Amp 常用路径:
git clone https://github.com/virgiliojr94/book-to-skill.git ~/.agents/skills/book-to-skill
Codex 用户:
先确认自己 Codex 实际读取哪个 skills 目录,再克隆进去,例如:
# 示例 1:跨端通用目录
git clone https://github.com/virgiliojr94/book-to-skill.git ~/.agents/skills/book-to-skill
# 示例 2:若你的 Codex 使用 ~/.codex/skills
git clone https://github.com/virgiliojr94/book-to-skill.git ~/.codex/skills/book-to-skill
克隆后新开一个会话再试,避免旧会话还没刷新 skills 列表。
第 3 步:准备提取依赖(按书的格式装)
book-to-skill 本体是 Skill + 本地 Python 提取脚本。不同格式会尝试不同工具,缺什么它会提示你装什么。
一键检查:
cd ~/.claude/skills/book-to-skill # 改成你的实际安装路径
python3 scripts/extract.py --check
常见建议:
| 书的类型 | 推荐工具 | 安装示例 |
|---|---|---|
| 文字为主、表格少 | pdftotext(poppler) |
macOS: brew install poppler |
| 技术书(代码、表格、公式) | Docling | pip3 install docling |
| EPUB | ebooklib + beautifulsoup4 | pip3 install ebooklib beautifulsoup4 |
| DOCX | python-docx | pip3 install python-docx |
可选:如果你只想要提取引擎 CLI(不会注册 /book-to-skill 斜杠命令),可以:
pip install "book-to-skill[pdf,epub,docx]"
book-to-skill --check
日常给 Agent 用,仍然以 git clone 到 skills 目录为主。
使用:把一本书变成 Skill
基本命令
在 Claude Code / 兼容 Agent 里:
/book-to-skill <书或文档路径> [技能名]
示例:
/book-to-skill ~/books/designing-data-intensive-apps.pdf
或自定义技能名:
/book-to-skill ~/books/ddia.pdf designing-data-intensive-apps
也可以处理文件夹、多文件、通配符:
# 整个文档目录合成一个 Skill
/book-to-skill ~/workspace/project-docs/ project-knowledge
# 多份资料合并
/book-to-skill ~/papers/a.pdf ~/notes/export.txt unified-research
# 把新材料增量并入已有 Skill
/book-to-skill ~/articles/new-paper.pdf ~/.claude/skills/project-knowledge
转换过程中,Skill 通常会先问你:这本书偏「技术向」还是「纯文字向」,再选提取工具。
转换完成后会得到什么
生成结果会落在对应 Agent 的 skills 目录下,大致包括:
| 文件 | 作用 | 体量参考 |
|---|---|---|
SKILL.md |
核心心智模型 + 章节索引 | 约 4,000 Token |
chapters/chXX-*.md |
按章拆分,按需加载 | 每章约 1,000 Token |
glossary.md |
术语表 | 约 1,500 Token |
patterns.md |
技巧、算法、模式 | 约 2,000 Token |
cheatsheet.md |
决策表与速查规则 | 约 1,000 Token |
章节文件默认按需加载:你没问到那一章,就不算进当次上下文预算。
怎么提问才省 Token、答得准
以「数据密集型应用」类书籍为例:
/designing-data-intensive-apps
加载核心模型。
/designing-data-intensive-apps replication
精准读「复制」相关章节。
/designing-data-intensive-apps ch05
直接进入第 5 章。
/designing-data-intensive-apps "what chapters do you have?"
查看已有章节列表。
Copilot CLI 若刚生成完新 Skill,可能需要:
/skills reload
Claude Code / Amp 一般在下一会话自动识别。
为什么它比「整本 PDF 塞进对话」更划算
官方用真实书测过(以回答一个具体问题为例):
| 书籍规模 | 整本丢进上下文 | book-to-skill 约加载 |
|---|---|---|
| 较小 | 约 11.9 万 Token | 约 5,000 Token(约 24×) |
| 中等 | 约 17.5 万 Token | 约 5,000 Token(约 35×) |
| 较大 | 约 25.6 万 Token | 约 5,000 Token(约 51×) |
整本塞进上下文的成本会在每一轮对话重复发生;book-to-skill 把「结构化」的成本前置到转换阶段,后续只加载核心 + 相关章节。
关于隐私:
- 提取与分析默认在本机跑;
- 工具本身不会把你的书上传到 book-to-skill 服务器;
- 如果你的 Agent 模型在云端,那只是你喂给模型的文本会遵循该模型服务商条款——和普通提示词一样。
实操建议(给粉丝和学生的最短路径)
如果你只想今天就试一次,按这个最短路径走:
- 选一本你已经买过、真正会反复查的技术书 PDF;
- 安装 Claude Code 或 Codex,并确认 skills 目录;
git clonebook-to-skill 到对应目录;- 跑
python3 scripts/extract.py --check,缺啥装啥; - 在会话里执行
/book-to-skill 你的书.pdf 技能名; - 转换完成后用
/技能名 主题词提问; - 对比一次「整本丢进上下文」和「Skill 按需加载」的体感与费用。
第一本建议选中等篇幅、结构清晰的书,不要一上来就扫一堆扫描版图片 PDF——扫描件 OCR 效果会拖垮质量。
常见问题
1. 这是免费的吗?
转换工具本身 MIT 开源、免费。你仍需支付自己 Agent / 模型调用费用;转换阶段大约每本书 1 美元量级(视模型与书的长短而定)。
2. 能不能处理中文技术书?
工具本身按文档结构提取,不限制语言。实际效果取决于提取质量、章节标题是否清晰、以及你使用的模型对中文技术内容的理解。
3. 生成后的 Skill 可以发给同学吗?
第三方版权书不建议公开分发生成 Skill。自己写的文档、公司内部有权使用的资料、开源许可内容,按对应许可处理。
4. 和「给 PDF 做向量检索 / RAG」有什么不同?
RAG 更偏检索片段;book-to-skill 更偏把书编译成「命名框架 + 决策规则 + 分章 Skill」,让 Agent 按技能方式工作。两者可互补,但解决的不是同一类痛点。
5. 视频里说评论区留言 book 会发 Skill,和本文有什么关系?
视频是传播入口。本文直接给出官方仓库与安装步骤,你按笔记即可自助完成下载、安装和使用,不必等二次转发。
写在最后
书架上那些已经买过、却几乎不看的技术书,现在可以用一条命令重新变成 AI 工作流里真正能用的专属技能。
结构作者花了几年时间建好;你只需转换一次,之后按需加载。
如果你经常用 AI 写代码、做架构、学技术,book-to-skill 值得收藏并亲手试一本自己真正会用的书。
资料来源
- book-to-skill 官方仓库 — Virgilio Junior
- Install 文档
- Usage 文档
- Performance 文档
- Agent Skills 开放标准
- X 推文介绍 — Alex Veremeyenko
- 本期视频字幕素材:
8月7日.srt(D89 book-to-skill 讲解)