项目介绍
book-to-skill 把技术书、PDF、文档目录或多份资料整理成一个可安装的 Agent Skill。它先用本地 Python 提取器获得干净文本和章节信息,再让 Agent 按 Skill 规范生成主 SKILL.md、分章文件、术语表、模式清单与速查表。Codex、Claude Code、GitHub Copilot CLI 和 Amp 可以在需要时只加载相关章节,适合把经常查阅的资料带进日常工作。

核心功能
多格式文档提取
Python 提取器支持 PDF、EPUB、DOCX、HTML、RTF、MOBI、Markdown 和纯文本等格式,并根据文件类型选择可用解析工具。
结构化 Skill 生成
生成内容包括核心 SKILL.md、分章文件、术语表、模式清单和速查表,章节只有在查询相关主题时才加载。
分析、转换与增量补充
Skill 提供完整转换、仅分析、根据已有分析生成、向现有 Skill 合并新资料四种工作路径。
跨 Agent 使用
同一个开放 Agent Skills 结构可以安装到 Codex、Claude Code、GitHub Copilot CLI 与 Amp 的相应目录。

安装与使用
优先使用 skills CLI 安装完整 Agent Skill,再检查 Python 提取环境。安装成功后,把一份有合法使用权限的小型 Markdown 或纯文本文件作为首次转换样本。
让 AI Agent 帮你安装
把这段话发送给 Codex、Claude Code 或其他可以操作本地环境的 AI Agent。
帮我安装并验证 book-to-skill,项目地址是 https://github.com/virgiliojr94/book-to-skill。请先阅读 README.md、docs/install.md、docs/usage.md、SECURITY-NOTICE.md 和 SKILL.md,确认仓库所有者必须是 virgiliojr94。使用 npx skills add virgiliojr94/book-to-skill 安装完整 Agent Skill,并选择我当前使用的 Agent。安装后找到实际安装目录,运行 python3 scripts/extract.py --check,报告 Python 版本和各格式解析器状态。再询问我提供一份有合法使用权限的小型文档,用 /book-to-skill <文档路径> 完成最小转换,检查是否生成 SKILL.md、章节文件和辅助索引。遇到需要安装系统依赖、读取私人资料、调用云端模型、覆盖现有 Skill、使用 gh CLI 或公开发布生成内容时先停下并向我确认。不要安装同名的非官方仓库。- 可运行 Node.js 和 npx
- Python 3.9 或更高版本
- 目标 Agent 允许读取指定文档、运行 Python 并写入 Skills 目录
- 准备一份有权处理的本地文档作为测试输入
npx skills add virgiliojr94/book-to-skill- 1安装完整 Agent Skill
运行下面的官方命令,并在交互列表中选择 Codex、Claude Code、Copilot CLI 或 Amp。 npx skills add virgiliojr94/book-to-skill
- 2检查文档解析环境
进入实际安装目录后运行 python3 scripts/extract.py --check。它会列出每种格式可用的提取器,并提示缺少依赖时应执行的命令。
- 3转换第一份资料
准备一份有合法使用权限的小型 Markdown、TXT 或 PDF 文件,在 Agent 会话中运行 /book-to-skill <文档路径> <可选 Skill 名称>。技术型 PDF 可以选择保留代码、表格与公式的提取方式。
- 4确认生成结构
查看新 Skill 目录,确认主 SKILL.md、chapters 目录、glossary.md、patterns.md 与 cheatsheet.md 已按输入内容生成,再用 /<新 Skill 名称> <主题> 查询一项具体内容。
- 5处理扫描件与版权边界
扫描 PDF 先运行 ocrmypdf input.pdf output.pdf。来源是第三方受版权保护资料时,保留生成 Skill 为私有内容;只有自有、开放许可或明确获得再发布授权的资料才适合公开分享。
进入 book-to-skill 的安装目录运行 python3 scripts/extract.py --check,确认脚本列出各格式解析器状态。随后在 Agent 中对一份小型 Markdown 文件运行 /book-to-skill <文件路径>,看到新 Skill 目录内生成 SKILL.md 和 chapters、glossary.md、patterns.md 或 cheatsheet.md 等文件即可确认主流程可用。
- 只使用 virgiliojr94/book-to-skill 官方仓库
- pip 安装只提供独立提取 CLI,不会注册 /book-to-skill Agent Skill
- 扫描版 PDF 需要先使用 OCR 工具生成文本层
- 第三方受版权保护资料生成的 Skill 应保持私有

使用场景
把技术书放进日常开发流程
把一本经常回看的工程书转换成 Skill,编码时按主题加载相关章节、框架与决策规则。
整理团队文档和运行手册
把 docs 目录、架构决策、入职说明或 runbook 合并成一个团队可查询的 Skill。
合并论文与个人笔记
将论文、导出的笔记和后续补充材料放进同一个知识 Skill,并使用更新模式合并新内容。
转换品牌与设计规范
把有权使用的语气规范、组件原则和设计系统说明整理成 Agent 可查询的规则。
使用评价
这次评价依据仓库 README、安装与使用文档、根目录 Skill、Python 项目配置、许可证、版本记录和安全说明。项目的优势是安装路径清楚,输入格式多,生成结构也方便按需读取。它还把扫描件、云端模型数据条款和版权边界写得比较明白。实际成本会随文档长度、解析方式和模型变化,技术 PDF 可能需要 Docling 等额外依赖,完整转换也要给 Agent 本地文件与命令权限。本次只完成资料核验,没有把公开文档阅读写成亲自完成转换。
值得一试的地方
- 覆盖常见文档格式并提供明确的依赖检查命令
- 生成内容分层保存,章节可以按需加载
- 支持向已有 Skill 合并新资料
- 版权、隐私和公开发布边界写得清楚
使用前要知道
- 扫描版 PDF 必须先做 OCR
- 技术文档的高质量解析可能引入较重依赖
- 完整生成依赖 Agent 模型并消耗相应调用额度
- 用户需要自行判断来源文档的许可与再发布权限
README
book-to-skill
Overview
把技术书、PDF、文档目录和多份资料转换成结构化 Agent Skill,让 Codex、Claude Code、GitHub Copilot CLI 与 Amp 按需读取章节、框架和速查内容。 Turn technical books and PDFs into Claude Code skills that are ready to study, reference, and use during work.
Getting started
- 优先使用 skills CLI 安装完整 Agent Skill,再检查 Python 提取环境。安装成功后,把一份有合法使用权限的小型 Markdown 或纯文本文件作为首次转换样本。
- 我对照了 README、安装文档、使用文档和根目录 SKILL.md。这个项目处理的对象不只限于书籍,PDF、EPUB、DOCX、HTML、Markdown、纯文本、RTF、MOBI 与文档目录都可以作为输入。
- 转换结果按用途分层。主 SKILL.md 保存核心框架和章节索引,chapters 目录存放按需加载的章节内容,glossary.md、patterns.md 与 cheatsheet.md 分别整理术语、方法和快速决策规则。
- 进入 book-to-skill 的安装目录运行 python3 scripts/extract.py --check,确认脚本列出各格式解析器状态。随后在 Agent 中对一份小型 Markdown 文件运行 /book-to-skill <文件路径>,看到新 Skill 目录内生成 SKILL.md 和 chapters、glossary.md、patterns.md 或 cheatsheet.md 等文件即可确认主流程可用。
Configuration
npx skills add virgiliojr94/book-to-skill在 GitHub 阅读完整 README →