pdf转图片(利用pdf2image包)

参考: pdf2image

python 复制代码
pip install pdf2image

代码:

python 复制代码
from pdf2image import convert_from_path, convert_from_bytes
import os

output_folder = './xx/'
dpi_value= 600
pdf_start_page = 1 # pdf显示的第一页
start_page = 1 # 真实页码
prex = '' # 图像前缀

def to_image():
    def page_generator():# 定义图像前缀
        while True:
            yield prex
    images = convert_from_path(r'xx.pdf', dpi=600, output_folder=output_folder,
                               first_page=pdf_start_page, fmt='jpg', thread_count=6, output_file=page_generator())
   


 
def image_rename():
    # 文件重命名
    global start_page
    file_list = os.listdir(output_folder)
    for file in file_list:
        start_page_str =  str(start_page)
        if len(start_page_str)==1:
            start_page_str = '00'+start_page_str
        elif len(start_page_str)==2:
            start_page_str = '0'+start_page_str
        else:
            ...
        path = os.path.join(output_folder, file)
        print(os.path.join(output_folder, start_page_str + '.jpg'))
        os.rename(path, os.path.join(output_folder, start_page_str + '.jpg'))
        start_page = start_page + 1
to_image()
image_rename() #文件重命名

效果:非常快

相关推荐
涔溪3 小时前
vue中预览pdf文件
前端·vue.js·pdf
lyx_20164 小时前
PDF文档导出分页功能实现
react.js·typescript·pdf·react
puyaCheer4 小时前
Android 打开 在线 pdf 文件
android·pdf
开开心心_Every7 小时前
专业视频修复软件,简单操作效果好
学习·elasticsearch·pdf·excel·音视频·memcache·1024程序员节
2501_9071368215 小时前
发票识别工具,支持xml、pdf、ofd文件
xml·pdf·软件需求
DreamNotOver15 小时前
批量转换论文正文引用为上标后转PDF保持上标
pdf·word·引用·上标
❀͜͡傀儡师16 小时前
docker一键部署PDF免费工具箱stirling-PDF
docker·容器·pdf
拓端研究室17 小时前
专题:2025中国医疗器械出海现状与趋势创新发展研究报告|附160+份报告PDF、数据、可视化模板汇总下载
大数据·人工智能·pdf
拓端研究室17 小时前
2025人形机器人产业链全景分析报告:核心技术与市场趋势|附130+份报告PDF、数据、可视化模板汇总下载
机器人·pdf
还不秃顶的计科生1 天前
在Visio中保存PDF时去除空白区域
pdf