pdf to video, pdf to explainer video, pdf to presentation video — parse the PDF, outline, storyboard, voiceover, build, validate. Use when the user gives a PDF and wants an explainer, report broadcast, courseware, or training video.
Documents
ClawPDF Master
Try itAdvanced PDF tool: text/table extraction, creation, merge/split, forms, OCR — PLUS unique feature: PDF-to-Markdown conversion, batch folder processing and automatic AI document summaries.
What it does
Advanced PDF tool: text/table extraction, creation, merge/split, forms, OCR — PLUS unique feature: PDF-to-Markdown conversion, batch folder processing and automatic AI document summaries.
The skill document
ClawPDF Master
Komplet PDF-håndteringsværktøj baseret på velafprøvede metoder (pypdf, pdfplumber, reportlab, poppler), forbedret med 3 unikke features som ingen anden PDF-skill har:
🆕 Unikke features (findes ikke i originalen)
Feature 1: PDF → Markdown-konvertering
Konverter enhver PDF til ren, struktureret Markdown (overskrifter, lister, tabeller som GitHub-flavored markdown). Perfekt til AI-agenter der vil genbruge indhold.
python3 scripts/pdf_to_markdown.py input.pdf output.md
Feature 2: Batch-behandling af mapper
Behandle HELE mapper med PDF'er på én gang — ekstraher, konverter eller merge alle filer:
python3 scripts/pdf_batch.py ./mappe --action extract --out ./resultater
python3 scripts/pdf_batch.py ./mappe --action merge --out samlet.pdf
Feature 3: Automatisk dokument-resumé
Få et struktureret resumé af et dokument (emne, nøglepunkter, tal, datoer, handlinger) uden at læse hele filen — perfekt til hurtig gennemgang af kontrakter og rapporter:
python3 scripts/pdf_summary.py kontrakt.pdf
Standard-operationer (arvet + forbedret)
Læs tekst
from pypdf import PdfReader
reader = PdfReader("doc.pdf")
for page in reader.pages:
print(page.extract_text())
Læs tabeller (med layout-bevarelse)
import pdfplumber
with pdfplumber.open("doc.pdf") as pdf:
for page in pdf.pages:
for table in page.extract_tables():
print(table)
Create PDF
from reportlab.lib.pagesizes import A4
from reportlab.pdfgen import canvas
c = canvas.Canvas("ny.pdf", pagesize=A4)
c.drawString(100, 800, "Hej verden!")
c.save()
Merge / split / roter / vandmærke / krypter
# Merge
qpdf --empty --pages a.pdf b.pdf -- merged.pdf
# Split (side 1-5)
qpdf input.pdf --pages . 1-5 -- sider1-5.pdf
# Roter side 1 +90°
qpdf input.pdf output.pdf --rotate=+90:1
# Remove password
qpdf --password=hemmeligt --decrypt laas.pdf aaben.pdf
OCR af scannede PDF'er
# Kræver: pip install pytesseract pdf2image + tesseract
python3 scripts/pdf_ocr.py scanned.pdf --lang dan --out tekst.txt
Udfyld formularer
Se docs/forms.md for trin-for-trin (pdf-lib / pypdf).
Hurtig reference
| Task | Tool | Command |
|---|---|---|
| Læs tekst | pypdf/pdfplumber | page.extract_text() |
| Læs tabeller | pdfplumber | page.extract_tables() |
| Create PDF | reportlab | Canvas/Platypus |
| Merge | qpdf | qpdf --empty --pages ... |
| Split | qpdf | qpdf input.pdf --pages . 1-5 -- out.pdf |
| OCR | tesseract | python3 scripts/pdf_ocr.py |
| → Markdown | unik | python3 scripts/pdf_to_markdown.py |
| Batch-mappe | unik | python3 scripts/pdf_batch.py ./mappe |
| Summary | unique | python3 scripts/pdf_summary.py doc.pdf |
Feedback
- Hjælpsom? →
clawhub star clawpdf-master - Opdateringer:
clawhub sync
Related skills
Convert PDF and image files into 10 document and data formats, with OCR and layout controls.
PDF toolkit: extract, merge, split, compress, convert, watermark, and protect PDFs.
Convert, edit, and extract data from PDF files via the ComPDF Cloud API across 50+ operations.
Convert unstructured documents into LLM-ready structured data. Supports PDF, Word, PPT, and images; extracts paragraphs, formulas, tables, charts, and other...
Convert PDFs into clean Markdown.