window电脑上使用python将pdf转换为word文档

1、电脑上安装Python运行环境

一、python官网下载链接

二、下载到电脑后,直接运行安装

三、安装完成后按:win+R键进入window命令控制窗口,输入

powershell 复制代码
	python --version

2、设置python依赖包国内镜像源

powershell 复制代码
pip config set global.index-url https://mirrors.aliyun.com/pypi/simple/

3.以下代码选用一种,在电脑上的某一个目录下新建python代码文件,并在window窗口中安装对应依赖

第一种:pdf2doc_pdf2docx.py(推荐)

powershell 复制代码
pip install pdf2docx
python 复制代码
from pdf2docx import Converter


# 最轻量,效果不错,推荐!!
# 安装依赖命令:pip install pdf2docx

# 转换函数
def pdf_to_word(pdf_file_path, word_file_path):
    # 创建一个 PDF 转换器
    cv = Converter(pdf_file_path)

    # 转换 PDF 文件为 Word 文档
    cv.convert(word_file_path, start=0, end=None)

    # 关闭转换器
    cv.close()

    # 转换完成,docx_file 是生成的word文档
    print(f'pdf转docx成功 {pdf_file_path} to {word_file_path}')


if __name__ == '__main__':
    # 指定 PDF 文件路径
    pdf_file = 'C:\\Users\\kaka\\Desktop\\pdf\\高级Java开发工程师.pdf'
    # 输出 Word 文件路径
    docx_file = 'C:\\Users\\kaka\\Desktop\\Desktop\\pdf\\高级Java开发工程师.docx'

    # 调用函数进行转换
    pdf_to_word(pdf_file, docx_file)

运行示例:

第一步

第二步

powershell 复制代码
python C:\Users\kaka\PycharmProjects\flaskProject\test\pdf2doc_pdf2docx.py

第三步,回车运行就可以了

第二种:pdf2doc_office.py

python 复制代码
import office

# 依赖包较大,但功能比较全;官网:https://www.python-office.com/
# 安装依赖命令:pip install python-office

if __name__ == '__main__':
    # 指定 PDF 文件路径
    pdf_file = 'C:\\Users\\kaka\\Desktop\\pdf\\高级Java开发工程师.pdf'
    # 输出 Word 文件路径,不用写文件名
    docx_file = 'C:\\Users\\kaka\\Desktop\\pdf'

    office.pdf.pdf2docx(file_path=pdf_file, output_path=docx_file)

    print("PDF 转换成功")

第三种:pdf2doc_office.py

python 复制代码
from spire.pdf import PdfDocument
from spire.pdf import FileFormat


# 最轻量,效果不错,推荐!!
# 安装依赖命令:pip install Spire.PDF

def pdf_to_word(pdf_path, path_doc, path_docx):
    # 创建一个 PDF 文档对象
    document = PdfDocument()
    # 加载 PDF 文件
    document.LoadFromFile(pdf_path)

    # 将PDF文件直接转换为Doc文件并保存
    document.SaveToFile(path_doc, FileFormat.DOC)

    # 将PDF文件直接转换为Docx文件并保存
    document.SaveToFile(path_docx, FileFormat.DOCX)

    # 关闭 PDF 文档
    document.Close()

    print("PDF 转换成功")


if __name__ == '__main__':
    # 指定 PDF 文件路径和输出 Word 文件路径
    pdf_file = 'C:\\Users\\kaka\\Desktop\\pdf\\高级Java开发工程师.pdf'
    word_file_doc = 'C:\\Users\\kaka\\Desktop\\pdf\\PDF转DOC.doc'
    word_file_docx = 'C:\\Users\\kaka\\Desktop\\pdf\\PDF转DOCX.docx'

    # 调用函数进行转换
    pdf_to_word(pdf_file, word_file_doc, word_file_docx)
相关推荐
努力的家伙是不讨厌的1 小时前
解析json导出csv或者直接入库
开发语言·python·json
云空1 小时前
《Python 与 SQLite:强大的数据库组合》
数据库·python·sqlite
凤枭香2 小时前
Python OpenCV 傅里叶变换
开发语言·图像处理·python·opencv
测试杂货铺2 小时前
外包干了2年,快要废了。。
自动化测试·软件测试·python·功能测试·测试工具·面试·职场和发展
艾派森2 小时前
大数据分析案例-基于随机森林算法的智能手机价格预测模型
人工智能·python·随机森林·机器学习·数据挖掘
小码的头发丝、3 小时前
Django中ListView 和 DetailView类的区别
数据库·python·django
Chef_Chen3 小时前
从0开始机器学习--Day17--神经网络反向传播作业
python·神经网络·机器学习
千澜空4 小时前
celery在django项目中实现并发任务和定时任务
python·django·celery·定时任务·异步任务
斯凯利.瑞恩4 小时前
Python决策树、随机森林、朴素贝叶斯、KNN(K-最近邻居)分类分析银行拉新活动挖掘潜在贷款客户附数据代码
python·决策树·随机森林
yannan201903134 小时前
【算法】(Python)动态规划
python·算法·动态规划