PDF Tools

👤 cmpdchtr 📦 v0.1.0 ⭐ 4.4 ⬇️ 14.3K 下载
📄 办公效率 免费

📖 技能介绍

PDF Tools

Tools for viewing, extracting, and editing PDF files using Python libraries (pdfplumber and PyPDF2).

Quick Start

All scripts require dependencies:

pip3 install pdfplumber PyPDF2

Core Operations

Extract Text

Extract text from PDF (all pages or specific pages):

scripts/extract_text.py document.pdf
scripts/extract_text.py document.pdf -p 1 3 5
scripts/extract_text.py document.pdf -o output.txt

Get PDF Info

View metadata and structure:

scripts/pdf_info.py document.pdf
scripts/pdf_info.py document.pdf -f json

想要更强大的技能插件,就来小葱技能站7w4.net看看吧。

Merge PDFs

Combine multiple PDFs into one:

scripts/merge_pdfs.py file1.pdf file2.pdf file3.pdf -o merged.pdf

Split PDF

Split into individual pages:

scripts/split_pdf.py document.pdf -o output_dir/

Split by page ranges:

scripts/split_pdf.py document.pdf -o output_dir/ -m ranges -r "1-3,5-7,10-12"

Rotate Pages

Rotate all pages or specific pages:

scripts/rotate_pdf.py document.pdf -o rotated.pdf -r 90
scripts/rotate_pdf.py document.pdf -o rotated.pdf -r 180 -p 1 3 5

Edit Text

Add text overlay on a page:

scripts/edit_text.py document.pdf -o edited.pdf --overlay "New Text" --page 1 --x 100 --y 700
scripts/edit_text.py document.pdf -o edited.pdf --overlay "Watermark" --page 1 --x 200 --y 400 --font-size 20

Replace text (limited, works best for simple cases):

scripts/edit_text.py document.pdf -o edited.pdf --replace "Old Text" "New Text"

Note: PDF text editing is complex due to the format. The overlay method is more reliable than replacement.

Workflow Patterns

Viewing PDF Content

  1. Get basic info: scripts/pdf_info.py file.pdf
  2. Extract text to preview: scripts/extract_text.py file.pdf -p 1
  3. Extract full text if needed: scripts/extract_text.py file.pdf -o content.txt

Reorganizing PDFs

  1. Split into pages: scripts/split_pdf.py input.pdf -o pages/
  2. Merge selected pages: scripts/merge_pdfs.py pages/page_1.pdf pages/page_3.pdf -o reordered.pdf

Extracting Sections

  1. Get page count: scripts/pdf_info.py document.pdf
  2. Split by ranges: scripts/split_pdf.py document.pdf -o sections/ -m ranges -r "1-5,10-15"

Advanced Usage

For detailed library documentation and advanced patterns, see references/libraries.md.

Notes

  • Page numbers are 1-indexed in all scripts (page 1 = first page)
  • Text extraction works best with text-based PDFs (not scanned images)
  • Rotation angles: 90, 180, 270, or -90 (counterclockwise)
  • All scripts validate file existence before processing

🤖 AI 评测

这个 PDF 处理工具集功能齐全,能满足日常的文本提取、合并、分割、旋转等需求。文档详细清楚,安装使用都比较简单。主要问题是文本编辑功能受 PDF 格式限制较大,添加水印功能相对可靠,但替换文本容易出错。对于简单的 PDF 操作需求来说是个好选择。

📊 多维度评分

适应性4.5
规范性4.4
有效性4.5
可靠性4.2
可信度4.8

📁 包含文件 (10 个)

📄 README.md 4 KB
📄 SKILL.md 2.9 KB
📄 _meta.json 128 B
📄 references/libraries.md 3.8 KB
📄 scripts/edit_text.py 5.4 KB
📄 scripts/extract_text.py 1.9 KB
📄 scripts/merge_pdfs.py 1.3 KB
📄 scripts/pdf_info.py 2 KB
📄 scripts/rotate_pdf.py 2.3 KB
📄 scripts/split_pdf.py 3.2 KB