PDF文件切割,无大小限制

前言

公司让学习一个东西,让写一个学习总结,我想这不是AI的拿手好戏,直接把近100M的PDF喂给他,然后他说吃不下,太大了

小事,那么多在线PDF工具网站,分分钟拆开,然后找了半天也都是有大小限制,不是20M就是50M,要不然就是下了软件还要开会员,搞烦的,自己写一个把

准备环境

1.python

2.pdf库 pip install PyPDF2==3.0.1

版本要注意一下,低版本的一些语法和下文代码可能对不上

配置

首先要按章节拆分出来,定义一个配置文件,比如第1章内容是从 第10页到20页拆成一个文件

这里要注意的是页码并不是PDF的右下角的页码,是整个文件第几页的含义,可以用Edge打开PDF,上面就有显示当前是第几页

我拆除下面的三个章节

复制代码
154, 174
175, 205
206, 250

代码

复制代码
import PyPDF2  
import sys  
import os  

def split_specific_pages_to_pdf(input_pdf_path, output_pdf_path, start_page, end_page):  
    # 打开输入的 PDF 文件  
    with open(input_pdf_path, "rb") as input_pdf_file:  
        # 创建一个 PdfReader 对象  
        pdf_reader = PyPDF2.PdfReader(input_pdf_file)  
          
        # 确保请求的页面范围在PDF文件的页数范围内  
        if start_page < 1 or end_page > len(pdf_reader.pages) or start_page > end_page:  
            raise ValueError("无效的页面范围")  
          
        # 创建一个 PdfFileWriter 对象  
        pdf_writer = PyPDF2.PdfWriter()  
          
        # 遍历选定的页面  
        for page_number in range(start_page - 1, end_page):  # 注意这里的range起始值需要调整为start_page - 1  
            # 将当前页添加到 PdfWriter 对象  
            pdf_writer.add_page(pdf_reader.pages[page_number])  
          
        # 将所有选定页面写入新的 PDF 文件  
        with open(output_pdf_path, "wb") as output_pdf_file:  
            pdf_writer.write(output_pdf_file)  
          
        print(f"已保存: {output_pdf_path}")  
  


if len(sys.argv) > 1:  
    input_pdf_path = sys.argv[1]
else:  
	print("没有传入额外的参数")
	sys.exit()

if not os.path.isfile("config.txt"):
	print("配置文件不存在")
	sys.exit()
	
with open('config.txt', 'r') as file: 
	for line in file:  
		start, end = line.strip().split(',')
		start = int(start)
		end = int(end)
		split_specific_pages_to_pdf(input_pdf_path, f"file-{start}-{end}.pdf", start, end)

然后把配置文件、代码、PDF文件放在一个目录就可以了

python main.py xxxx.pdf

打包exe

功能确认的一般我喜欢打包成exe

pyinstaller --clean -w -F -i ico.ico --name=PDF文件切割.exe main.py

只需要把pdf拖到exe上就可以,不想写代码的话可以私信我exe

相关推荐
hhzz3 小时前
基于监控视频的水位尺自动识别技术方案与实现
python·opencv·yolo·图像识别·cv
yongche_shi3 小时前
ragas官方文档中文版(五十)
开发语言·python·ai·ragas·如何评估和改进 rag 应用
weixin_408099674 小时前
OCR批量识别图片方案:从手动处理到自动化API系统(Python/Java/PHP实战)
图像处理·python·ocr·文字识别·api调用·批量识别·石榴智能
AI行业学习4 小时前
Notepad++ 官方下载 + 完整安装 + 全套优化配置(2026最新)
开发语言·人工智能·python·前端框架·html·notepad++
大圣编程5 小时前
Python中continue语句的用法是什么?
开发语言·前端·python
云烟成雨TD5 小时前
LangFlow 1.x 系列【5】可视化编辑页面功能说明
人工智能·python·agent
geovindu7 小时前
python: Functional Options Pattern
开发语言·后端·python·设计模式·惯用法模式·函数式选项模式
tryCbest7 小时前
Python 文件操作
服务器·python
涛声依旧-底层原理研究所8 小时前
Agent 长任务可靠性设计:实现暂停、恢复、续跑与崩溃重启的完整方案
人工智能·python·系统架构
AC赳赳老秦8 小时前
防火墙规则批量配置实战:OpenClaw 自动生成模板、批量下发与合规性校验全解析
java·开发语言·人工智能·python·github·php·openclaw