ARTICLE DETAIL

资讯详情

深耕网站建设、视觉设计与SEO优化的一线实战洞察。

book-to-skill 使用教程:3 步把技术书 PDF 变成按需加载的 Agent 技能

book-to-skill 使用教程:3 步把技术书 PDF 变成按需加载的 Agent 技能 book-to-skill 使用教程3 步把技术书 PDF 变成按需加载的 Agent 技能【免费下载链接】book-to-skillTurn any technical book PDF into a Claude Code skill — ready to study, reference, and use while you work.项目地址: https://gitcode.com/GitHub_Trending/bo/book-to-skillbook-to-skill 把 PDF、EPUB、DOCX 等技术书编译成按需加载的结构化 Agent 技能。读完本文你会掌握安装步骤、四种操作模式与 token 节省机制并能动手转换第一本书。读完就忘的好书为什么 Agent 也答不上来你啃完一本技术书三个月后想不起第 7 章讲了什么。搜 PDF 只得到一串页码直接问 Agent它要么一本正经地编要么承认没有这本书。最直接的补救——把全书塞进上下文——代价最高每开一个新会话都要为整本书再付一次 token400 页的书约 200K。它是什么把书编译成技能的编译器book-to-skill 是一个转换器吃进你拥有的书PDF、EPUB、DOCX、TXT、Markdown、HTML、RTF、MOBI/AZW 等十种格式吐出一个标准SKILL.md技能目录——核心框架、章节索引、术语表、模式清单、决策速查表。它不产读书报告而是提取结构把作者的命名框架、决策规则、反模式原样保留下来章节文件只在你问到对应主题时才消耗 token。一份技能在 Claude Code、GitHub Copilot CLI、Amp、Hermes Agent 等多个宿主通用。快速上手三步安装 book-to-skill 并转换第一本 PDF第 1 步克隆进技能目录以 Claude Code 路径为例其他宿主见后文链接git clone https://gitcode.com/GitHub_Trending/bo/book-to-skill ~/.claude/skills/book-to-skill第 2 步预检环境——不需要任何输入文件它报告每种格式的提取器装了哪些、缺什么给什么安装命令python3 scripts/extract.py --check第 3 步第一条转换命令——在 Agent 会话里输入/book-to-skill ~/books/think-python-2.pdfAgent 会先问一个问题书偏technical多代码、表格还是text-heavy以文字为主据此选提取引擎随后给出 token 与耗时预估等你确认才动手。完成后得到一个技能目录默认~/.agents/skills/slug/一份副本多宿主共享SKILL.md核心框架 章节/主题索引约 4,000 tokenschapters/每章一个文件约 1,000 tokens/个按需加载glossary.md、patterns.md、cheatsheet.md三个支持文件之后输入/think-python-2 exceptions或/think-python-2 ch05Agent 会定位正确章节、从真实内容作答。书 → 干净文本 → 技能转换到底怎么发生整条链路是确定性提取 规范驱动生成两段式输入单个文件、文件夹或 glob如~/books/*.epub处理Python 提取器按格式转成干净文本最优工具优先、标准库兜底PDF 默认走 pdftotext代码书可升级 Docling产出带源标记的full_text.txt和含页数、词数、章节检测的metadata.jsonAgent 对大书用 grep/sed 按需拉章节片段不整本读入输出Agent 按 SKILL.md 的 Steps 0–11 生成章节摘要预算随书型 × 深度浮动、术语表、模式、速查表与主 SKILL.md写完后清理临时目录。每次运行使用带进程号的独立临时目录两本书同时转换不会互相覆盖输出。能力速览四种模式与生成物一表看清条目说明完整转换默认走完全流程产出整套技能文件仅分析说 analyze 即可只输出结构分析报告基于已有分析生成跳过提取用现有笔记直接生成技能更新 / Fold-in指向已有技能目录把新素材合并进去输入格式PDF、EPUB、DOCX、RTF、TXT、MD、RST、AsciiDoc、HTML、MOBI/AZW/AZW3宿主兼容Claude Code、Copilot CLI、Amp、Codex、Hermes Agent 共用一份SKILL.md可选 pip CLI只装提取引擎供脚本调用不注册/book-to-skill命令实战走查多文件合并与技能更新场景一把一堆研究材料合并成单一技能——多个文件一次传入末尾跟技能名/book-to-skill ~/papers/paper1.pdf ~/notes/export.txt unified-research结果解读生成的unified-research索引横跨所有来源单个文件损坏时会被跳过并告警不会拖垮整批。场景二fold-in 新素材——把路径指向已有技能目录流程自动切到更新分支/book-to-skill ~/articles/new-paper.pdf ~/.agents/skills/project-knowledge⚠️ 两个常见坑扫描件 PDF纯页面图像、无文本层会在前几页就停下并说明原因——先 OCR 再转换ocrmypdf input.pdf output.pdf章节自动检测依赖显式Chapter N标题用节标题分章的书仍可转换但需要你手动指向分节。实测数据每次查询到底省多少docs/performance.md 里所有数字均用真书实测tiktoken cl100k_base 计数。以回答一个定向问题进入上下文的 token 计书整本塞入上下文发现循环Agent 自查目录book-to-skillThink Python 2119,26412,152~5,000Working Backwards175,25333,444~5,000AI Engineering256,28777,866~5,000相比整本灌入省 24×–51×——这笔钱在每一轮对话都重复发生相比Agent 自己翻目录的发现循环省 2.4×–15.6×。完整转换约1 美元/本按 Claude Sonnet 4.5 费率估算一次付清。提取方式也直接影响技术书质量103 页技术 PDF 上pdftotext 0.1s 完成但表格与代码块全丢Docling 花 164s 却保留 48 张表、36 个代码块——这正是technical / text二选一提问的由来。选型与边界适合谁何时该放弃适合反复查阅的一本书或一组紧密相关材料要在工作时套用作者的框架编程书、内部文档、合规规范不适合几十本书的宽书库、找哪段提到 X式检索——那是 RAG 的主场两者互补而非竞争不适合扫描书先 OCR与图表内嵌文字任何格式都不提取对模型已背过的名著以你自己的副本为准仍能少幻觉对小众参考书、内部文档、新出版物则是独特价值版权红线工具本身不携带任何书的内容、全程本地处理第三方版权书生成的技能务必保持私有。继续深入仓库内 4 个入口docs/install.md——各宿主的安装路径、Hermes 类别目录与 pip 独立 CLI 细节docs/usage.md——全部命令形态示例以及把生成的技能发布成私有仓库的流程docs/architecture.md——提取器/生成器分界、组件映射与分层安全设计含不可见字符净化、DOCX XXE 防护tools/——discovery_tax.py成本实测、validate_skill.py按宿主规则校验、scan_generated_skill.py注入扫描一句话收束book-to-skill 解决的不是找到那段话而是让 Agent 用作者的框架思考——一次编译、按需加载、多宿主通用的知识资产。【免费下载链接】book-to-skillTurn any technical book PDF into a Claude Code skill — ready to study, reference, and use while you work.项目地址: https://gitcode.com/GitHub_Trending/bo/book-to-skill创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表