经常要处理 PDF?写了个基于 pypdf 的小工具,纯格式处理:
pip install pypdf
python pdf_tool.py merge a.pdf b.pdf out.pdf # 合并
python pdf_tool.py split a.pdf out_dir # 每页拆开
python pdf_tool.py text a.pdf # 提取文本
python pdf_tool.py info a.pdf # 页数/是否加密
附件 pdf_tool.zip 含完整脚本 + requirements。扫描件转图片请用 PyMuPDF 另写。
合规:仅用于你对自己拥有合法权利的文档做格式处理;不涉及破解密码、去除 DRM 或绕过任何版权保护。原创开源。
楼主 · 2026-09-28 07:50 · 浏览 261
· 编辑于 2026-09-28 07:50

