
book-to-skill技术书 3 分钟转成 AI 代理技能表格代码全保留【免费下载链接】book-to-skillTurn any technical book PDF into a Claude Code skill — ready to study, reference, and use while you work.项目地址: https://gitcode.com/GitHub_Trending/bo/book-to-skill你买的技术书读完后就被锁进 PDF 了。三个月后想找第 7 章讲什么翻目录比重读还累。而 AI 代理只吃 Markdown——你直接问它它只能编。book-to-skill 就是干这个的把整本书转成结构化技能代理按需加载章节回答。书里表格多不多决定选哪个模式动手前只有一个问题值得停下来这本书里有代码块和表格吗有 → 选 technical几乎没有 → 选 text。书里表格/代码选的模式用的提取器多 technicalDocling约 1.5 秒/页几乎没有 textpdftotext → pypdf → pdfminer秒级判断标准很简单数一数目录和正文。代码块密集、参数表成排 → technical纯散文叙述 → text。一本书是怎么变成技能的先把链路过一遍心里有全局图再动手输入一个 PDF、EPUB、DOCX、HTML、RTF 等文件也可以传整个文件夹或 glob转换前代理会问技术型还是文字型你的答案决定提取引擎确定性 Python 提取器把文档变成干净文本中间产物落在 /tmp 工作目录用后即删代理再按 SKILL.md 里的生成规范做结构化分析拆章节、挖框架、整理术语产物是完整技能目录SKILL.md、逐章文件、术语表、模式集、速查表章节文件按需加载——没问到的章节不占上下文慢 3 分钟换来 48 张表格官方用一本 103 页的技术书做过实测纯 CPU 环境提取方式耗时保留表格保留代码块pdftotext0.1s00Docling164s4836pdftotext 确实快得离谱但它把版面压平表格和代码块一个都留不住。Docling 用 164 秒换回 48 张表格和 36 个代码块全部原样落成 Markdown——这些恰恰是技术书里最常被人翻起来查的部分。丢它们的代价是技能文件只剩泛泛的摘要。实现可以看 pdf.pyextract_with_docling()负责版面感知解析extract_with_pdftotext()管文字型书的秒级提取。装好它然后指着你的书先 clone 到技能目录。以 Claude Code 为例Copilot CLI 用~/.copilot/skills/详见 docs/install.mdgit clone https://gitcode.com/GitHub_Trending/bo/book-to-skill.git ~/.claude/skills/book-to-skill执行完目录就出现了没有任何安装报错。technical 模式依赖 Docling装上它再用一条命令体检pip3 install docling python3 scripts/extract.py --check第二条命令会列出各格式提取器的安装状态✓ 表示可用、✗ 表示缺失。看到 PDF 一项是 ✓ 再往下走。打开 Claude Code 会话输入/book-to-skill ~/books/my-technical-book.pdf代理会立刻提问内容类型。选 1Technical后它会回一句 Technical mode selected — using Docling...然后开始提取。103 页的书大约等 3 分钟。等它跑完分析产物会写到~/.agents/skills/技能名/报告里会给出 Workdir 和产物路径。你拿到的是一个技能目录my-technical-book/ ├── SKILL.md # 核心心智模型 章节索引约 4,000 tokens ├── chapters/ # 每章一个文件按需加载各约 1,000 tokens ├── glossary.md # 全部关键术语按字母排序 ├── patterns.md # 技巧、算法与设计模式 └── cheatsheet.md # 决策表速查模式不仅影响提取还影响每个章节文件的预算和板块侧重维度technicaltext每章 token 预算1,200–1,800800–1,200优先板块Code Examples、Reference TablesFrameworks、Mental Modelstechnical 模式会保留精确语法和参考表格text 模式则跳过空的技術板块。转换成本也实打实244 页的《Think Python 2》约 $0.88501 页的《Pro Git》约 $1.23一本的价钱只付一次。装好后日常怎么问/my-technical-book replication # 问某个主题 /my-technical-book ch05 # 深入第 5 章回车后代理会先读 SKILL.md 的章节索引再只加载命中那一个章节文件全程约 5,000 tokens核心 4K 单章约 1K。实测对比把整本书塞进上下文能省24–51 倍token。完整基准和方法都在 docs/performance.md用python3 tools/discovery_tax.py --full-text 提取文本 --target-chapter 5就能复现。这些情况它会罢工替代动作在这扫描版 PDF 提取为空——它只读文本层先跑ocrmypdf input.pdf output.pdf做 OCR再转换章节没被自动切分——自动切分依赖 Chapter N 式编号Pro Git 这种用小节标题的书切不出来需要手动指向具体小节图表里嵌的文字提取不到——任何格式都不行这部分只能自己补笔记Copilot CLI 里新命令不生效——跑完转换后执行/skills reload重新加载103 页要等 164 秒嫌慢——纯文字书别硬选 technical换 text 模式秒级完成技术书选 technical 换完整结构纯文字书选 text 换秒级速度更多参数、批量转换和边界情况直接看 docs/usage.md。【免费下载链接】book-to-skillTurn any technical book PDF into a Claude Code skill — ready to study, reference, and use while you work.项目地址: https://gitcode.com/GitHub_Trending/bo/book-to-skill创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考