使用python把图片转为word

工作中有很多场景需要我们把图片转换为word,这里提供一个思路,但是准确率和商用的比不了,只供参考。

步骤:

1.)安装Tesseract OCR,参考如下文章。

https://blog.csdn.net/xhmico/article/details/137671583?fromshare=blogdetail&sharetype=blogdetail&sharerId=137671583&sharerefer=PC&sharesource=qq_36652525&sharefrom=from_link

2.)编写python代码

python 复制代码
import os
import pytesseract
from PIL import Image
from PIL import ImageFile
import docx
from docx.oxml.ns import qn
# pip install opencv-python  -i https://pypi.tuna.tsinghua.edu.cn/simple
# pip install pytesseract  -i https://pypi.tuna.tsinghua.edu.cn/simple

pytesseract.pytesseract.tesseract_cmd = r'D:\swordTool\TesseractOcr\tesseract.exe'
ImageFile.LOAD_TRUNCATED_IMAGES = True
Image.MAX_IMAGE_PIXELS = None
text = pytesseract.image_to_string(Image.open(r"D:/swordTool/devTool/pycharm/pyWorkSpace/PicToWord/test2.png"), lang='chi_sim+eng')
doc = docx.Document()        # 创建一个新的word文档
doc.add_paragraph(text)     # 往文档里添加识别出来的文字
doc.add_page_break()        # 添加分页符,等于在word里按多了一次Ctrl+Enter

# 下面两行设置了文档字体全篇为宋体,缺一行不可
doc.styles['Normal'].font.name = u'宋体'
doc.styles['Normal']._element.rPr.rFonts.set(qn('w:eastAsia'), u'宋体')
doc.save(os.getcwd() + '\\test.docx')  # 保存文档
相关推荐
长安牧笛8 小时前
适老版线上超市,针对老年人的小程序,图片大,字大,主打日常用品+送货上门,还能电话下单,解决老年人不会用普通电商的问题。
python
@#---8 小时前
如何准确判断json文件并且拿到我想要的信息
android·python·json
光羽隹衡8 小时前
Python中的网络爬虫
开发语言·爬虫·python
Vantastic9998 小时前
基于Qwen Agent的多智能体协作系统:实现AI团队协同工作流
人工智能·python
不会写DN8 小时前
fmt 包中的所有 Print 系列函数
开发语言·后端·golang·go
zhongtianhulian8 小时前
陶瓷行业导航网站:景德镇信息大全 — 采购指南与政策解读
人工智能·python
南棱笑笑生8 小时前
20251213给飞凌OK3588-C开发板适配Rockchip原厂的Buildroot【linux-6.1】系统时适配CTP触摸屏FT5X06
linux·c语言·开发语言·rockchip
电子_咸鱼8 小时前
常见面试题——滑动窗口算法
c++·后端·python·算法·leetcode·哈希算法·推荐算法
深圳佛手8 小时前
jupyter notebook如何使用虚拟环境?
人工智能·python