最終更新:2026年8月3日。技術仕様は book-to-skill 公式リポジトリ と Agent Skills 標準 に照合済み。
「データ密集型アプリケーション設計」や社内アーキテクチャPDFを読んだときは腑に落ちたのに、三か月後の実装では第七章の議論を思い出せない——そんな経験はありませんか。PDF全文検索はページ番号の羅列、Cursorへ丸ごと貼り付けはコンテキスト枯渇、自作メモは二度と開かない、という三択に陥りがちです。
Book to Skill は別ルートを取ります。PDF(EPUB / DOCX / Markdown フォルダも可)を Agent Skills 準拠の構造化スキルに一度だけ蒸留し、Cursor・Claude Code・GitHub Copilot CLI では関連章だけをオンデマンド読み込み、著者のフレームワークと用語で答えさせます。
本稿は 2026 年版として、価値理解 → 環境構築 → 変換実行 → 日常運用の順で実践手順を示します。チームで技術書ナレッジを共有する前に、ベクトルRAGと何が違うのかを先に整理しておくと導入判断が速くなります。
PDFをAI知識庫にする理由
一般的なRAGはPDFを細片ベクトル化し、類似断片を検索します。FAQや契約条項には有効ですが、技術書では著者が名付けたフレームワーク、意思決定木、アンチパターンこそ価値であり、512トークンの断片では再現できません。
公式ベンチマークでは、実在の技術書への質問で全文投入と比べ 24〜51倍 のトークン削減。変換は Claude Sonnet 換算でおおよそ 1ドル/冊 の一回費用です。
- 書名・著者・章ツリー・コアメンタルモデルを抽出
- 各章に800〜1,200トークンの実務向け要約(コード・表構造を保持)
- 用語集・パターン一覧・意思決定チートシートを追加生成
SKILL.mdは索引のみ、章ファイルは必要時だけロード
Book to Skill とは
book-to-skill は MIT ライセンスの Python プロジェクトです。Agent Skill モード(~/.cursor/skills-cursor/ へ clone し /book-to-skill ./my-book.pdf)を推奨します。CLI のみなら pip install book-to-skill も可能です。
入力は PDF / EPUB / DOCX / TXT / Markdown ほか。フォルダや glob で複数資料を一つのスキルに統合できます。
3つの方式の選び方
| 方式 | 長所 | 短所 | 向く用途 |
|---|---|---|---|
| 全文貼り付け | 設定不要 | トークン爆発 | 一度きりの質問 |
| ベクトルRAG | 大規模・差分更新 | 書全体の骨格が弱い | 社内KB・サポート |
| Book to Skill | 著者フレーム保持・章単位ロード | 一回変換・スキャンPDF弱い | 技術書・Runbook |
同じ技術書を何度も参照し、コーディング中に Cursor へ判断規則を引かせたいなら Book to Skill が最も費用対効果が高いことが多いです。すでに GitHub MCP Server デプロイ手順(Windows / Linux / macOS) でリポジトリと接続しているなら、書の原則と実コードを一つの Agent ワークフローにまとめられます。
環境準備
git clone https://github.com/virgiliojr94/book-to-skill.git
cd book-to-skill
python3 scripts/extract.py --check
Scanned PDFs without a text layer will fail—OCR first or use EPUB.
Book to Skill のインストール
git clone https://github.com/virgiliojr94/book-to-skill.git \
~/.cursor/skills-cursor/book-to-skill
変換フロー(例:ddia.pdf)
/book-to-skill ~/Books/ddia.pdf designing-data-intensive-apps
Pick technical for code-heavy books (Docling). Confirm the ~$1/book cost preview before generation. Run on a host that will not sleep; 300–500 page PDFs may take many minutes.
生成物の構造
~/.cursor/skills-cursor/designing-data-intensive-apps/
├── SKILL.md
├── chapters/ch01-*.md …
├── glossary.md
└── cheatsheet.md
日常の使い方
/designing-data-intensive-apps replication
/designing-data-intensive-apps ch05
実装例:「注文サービスにキャッシュを足す。DDIA の一貫性モデルと失効戦略を照合して」。Agent は cheatsheet.md と該当章を読み、一般論ではなく書に沿って答えます。
With MCP tools, combine book logic with live repo facts—same pattern as OpenShipデプロイ失敗の切り分けガイド.
応用パターン
/book-to-skill ~/papers/*.pdf ~/notes/architecture.md team-knowledge
Skill folders are Markdown—commit to .cursor/skills/ for team sharing. Use analyze-only mode to preview chapter trees before full generation.
トラブルシュート
| Symptom | Cause | Fix |
|---|---|---|
| Zero chapters | No Chapter N headings | EPUB or manual sections |
| Garbled code | text-heavy on technical book | Docling + technical |
/book-to-skill missing | Wrong path | ~/.cursor/skills-cursor/ |
Summary
- すぐ試す:clone →
/book-to-skill your.pdf→ technical + Docling - 長期運用:生成スキルを Git 管理、fold-in で更新
- トークン節約:章のオンデマンド読み込みを徹底
Book to Skill は「読んだが忘れた」を「実装中いつでも著者の枠組みを聞ける」状態に変えます。複数冊の一括変換や並列 Agent 作業には、スリープしないクラウド Mac 上でパイプラインを回すのが安全です。
FAQ
ベクトルRAGとの違いは?
RAGは類似断片検索。Book to Skillは構造化蒸留後、トピックに応じて章要約を丸ごとロードします。
Claude必須?
変換フェーズは Agent 内の Claude。出力 Markdown は任意モデルで利用可能です。
スキャンPDFは?
文字層がないと失敗します。OCR か EPUB を使用してください。
費用は?
おおよそ1ドル/冊(Sonnet)。以降は必要章のみのトークン消費です。
長時間の変換は常時稼働のクラウドMacで
300ページ超の技術PDFでは Docling 抽出と API 生成に30分以上かかることもあります。Mac mini M4 クラウドノードならスリープせず、完成したスキルを Git でチーム共有できます。