python 提取PDF文字

使用pdfplumber,不能提取扫描的pdf和插入的图片。

python 复制代码
import pdfplumber

file_path = r'D:\UserData\admindesktop\官方文档\1903_Mesh-Models-Overview_FINAL.pdf'
with pdfplumber.open(file_path) as pdf:
    page = pdf.pages[0]
    print(page.extract_text()) # 所以文字
    print([word["text"] for word in page.extract_words()]) # 提取存在的文字
相关推荐
磁场转动100万匹1 小时前
PyTorch 手写数字识别实战:从数据加载到模型训练(零基础详解版)
人工智能·pytorch·python
青 春 记 忆8 小时前
零基础入门python30:Flask个人账本从空目录运行与阶段验收
python·flask·后端开发
l1258658 小时前
# LangGraph Memory机制深度解析:短期记忆与长期记忆的工程实践
前端·人工智能·python·langchain·bootstrap
金銀銅鐵9 小时前
斐波那契数列的个位数出现的周期是多少?
python·数学
whcyhhh11 小时前
头歌实践教学平台:数据科学与大数据技术导论(十二)
大数据·开发语言·python·数据清洗
qq_3164110311 小时前
专业的腹腔镜医疗器械物联网APP开发服务商
python
阿童木写作11 小时前
跨境电商翻译利器,批量图片视频翻译+智能抠图工具
python·音视频
绘梨衣54712 小时前
异步任务队列-学习2
爬虫·python·学习·任务队列
用户83562907805113 小时前
使用 Python 在 Excel 中插入 OLE 对象
后端·python
one31213 小时前
高精度MEMS电容式倾角传感器:原理、结构与Python三维可视化
开发语言·python