Zuletzt aktualisiert: 3. August 2026. Technische Details geprüft anhand des offiziellen book-to-skill-Repos und des Agent-Skills-Standards.
Sie haben Designing Data-Intensive Applications oder ein internes Architektur-PDF gelesen – alles war klar. Drei Monate später fehlt Kapitel 7 im Kopf. PDF-Suche liefert Seitenzahlen, das Einfügen des ganzen Buchs in Cursor frisst Kontext, eigene Notizen öffnen Sie selten wieder.
Book to Skill destilliert PDFs (oder EPUB, DOCX, Markdown-Ordner) einmalig in ein Skill-Paket nach dem Agent-Skills-Standard. In Cursor, Claude Code oder GitHub Copilot CLI lädt der Agent nur relevante Kapitel und antwortet mit den Frameworks des Autors.
Dieser Leitfaden führt 2026 durch Nutzen → Setup → Konvertierung → Alltag. Vergleichen Sie die Ansätze, bevor Sie in Vektordatenbanken investieren, die technische Bücher nicht strukturell abbilden.
Warum PDF in eine KI-Wissensbasis
Klassisches RAG zerlegt PDFs in Vektoren und findet ähnliche Snippets – gut für FAQs, schwach bei Fachbüchern, deren Wert in benannten Frameworks und Anti-Patterns liegt.
Offizielle Benchmarks zeigen 24×–51× weniger Tokens pro Frage gegenüber Volltext. Einmalige Kosten: etwa 1 USD/Buch (Claude Sonnet).
- Titel, Autor, Kapitelbaum und Mentale Modelle extrahieren
- 800–1.200 Token praxisnahe Kapitelzusammenfassungen
- Glossar, Musterliste und Entscheidungs-Spickzettel
SKILL.mdnur als Index, Kapitel on demand
Was ist Book to Skill
book-to-skill (MIT) bietet Agent-Skill-Modus via /book-to-skill oder reines CLI mit pip install book-to-skill.
Unterstützt PDF, EPUB, DOCX, TXT, Markdown u. a.; Ordner und globs für mehrere Quellen.
Welcher Ansatz passt
| Ansatz | Vorteile | Nachteile | Für wen |
|---|---|---|---|
| Ganzes Buch einfügen | Kein Setup | Token-Explosion | Einmalfragen |
| Vektor-RAG | Skalierung | Schwache Buchstruktur | Enterprise-KB |
| Book to Skill | Autor-Frameworks | Einmalkonvertierung | Tech-Bücher |
Wer dasselbe Fachbuch immer wieder braucht, profitiert meist von Book to Skill. Mit GitHub MCP Server installieren: Windows, Linux, macOS verbinden Sie Buchprinzipien mit Live-Repo-Status in einem Workflow.
Umgebung vorbereiten
git clone https://github.com/virgiliojr94/book-to-skill.git
cd book-to-skill
python3 scripts/extract.py --check
Scanned PDFs without a text layer will fail—OCR first or use EPUB.
Book to Skill installieren
git clone https://github.com/virgiliojr94/book-to-skill.git \
~/.cursor/skills-cursor/book-to-skill
Konvertierungsablauf
/book-to-skill ~/Books/ddia.pdf designing-data-intensive-apps
Pick technical for code-heavy books (Docling). Confirm the ~$1/book cost preview before generation. Run on a host that will not sleep; 300–500 page PDFs may take many minutes.
Ergebnisstruktur
~/.cursor/skills-cursor/designing-data-intensive-apps/
├── SKILL.md
├── chapters/ch01-*.md …
├── glossary.md
└── cheatsheet.md
Tägliche Nutzung
/designing-data-intensive-apps replication
/designing-data-intensive-apps ch05
Beispiel: Cache fürs Bestellservice – DDIA-Konsistenzmodelle abgleichen. Der Agent liest cheatsheet.md und passende Kapitel.
With MCP tools, combine book logic with live repo facts—same pattern as OpenShip-Bereitstellung fehlgeschlagen: Fehlerbehebung 2026.
Erweiterte Muster
/book-to-skill ~/papers/*.pdf ~/notes/architecture.md team-knowledge
Skill folders are Markdown—commit to .cursor/skills/ for team sharing. Use analyze-only mode to preview chapter trees before full generation.
Fehlerbehebung
| Symptom | Cause | Fix |
|---|---|---|
| Zero chapters | No Chapter N headings | EPUB or manual sections |
| Garbled code | text-heavy on technical book | Docling + technical |
/book-to-skill missing | Wrong path | ~/.cursor/skills-cursor/ |
Summary
- Schnellstart: clone →
/book-to-skill your.pdf→ Docling - Langfristig: Skill-Ordner in Git
- Tokens sparen: Kapitel on demand
Book to Skill macht aus „gelesen, vergessen“ „Framework beim Coden abrufbar“. Lange Jobs auf einem wachen Cloud-Mac ausführen.
FAQ
Unterschied zu RAG?
RAG: ähnliche Snippets. Book to Skill: Struktur destillieren, Kapitel nach Thema laden.
Claude nötig?
Konvertierung in Agent-Session mit Claude; Markdown danach modellunabhängig.
Scan-PDFs?
Ohne Textlayer scheitert Extraktion – OCR oder EPUB.
Kosten?
Ca. 1 USD/Buch einmalig.
Lange Konvertierungen auf einem wachen Cloud-Mac
Docling-Extraktion und API-Generierung bei 300+ Seiten kann 30+ Minuten dauern. Ein Mac mini M4 in der Cloud bleibt wach; fertige Skills per Git teilen.