从PDF文件中提取数据

笔记

python 复制代码
import pdfplumber
# 打开PDF文件
with pdfplumber.open('数学公式.pdf') as pdf:
    for i in pdf.pages: # 遍历页
        print(i.extract_text()) # extract_text()方法提取内容
        print(f'---------第{i.page_number}页结束---------')
相关推荐
霸道流氓气质19 小时前
Spring AI 技术细节:VectorStore 多库统一抽象
java·人工智能·spring
今天AI了吗19 小时前
Codex 配置自定义 AI API 完整指南:从零到一接入你的专属模型
java·人工智能·python·数据分析·embedding
Tanjia_kiki19 小时前
谷歌浏览器中F12编辑并重发请求
开发语言·前端·javascript
阿童木写作19 小时前
跨境电商批量图片翻译与视频字幕翻译工具推荐
python·音视频
程序猿编码19 小时前
基于GGML的C++17轻量化语音推理引擎:说话人识别与语音分析技术全解析
开发语言·c++·pytorch·深度学习·神经网络·大模型
leihefeng19 小时前
手写数字识别:KNN vs 逻辑回归实战
python·算法·机器学习·逻辑回归·scikit-learn
学长毕业设计19 小时前
基于SpringBoot的健康食谱管理系统的设计与实现(源码+文档+讲解视频)
java·spring boot·后端
珍珠先生19 小时前
P10 · 缺 MySQL 驱动 jar:ClassNotFoundException: com.mysql.cj.jdbc.Driver
java
SunnyDays101119 小时前
如何使用 Python 从 Word 文档中提取图片
python·word
2601_9620973619 小时前
Pathway 实时RAG新方案:抛弃Spark、Flink,生产级数据管道
python·流处理·大数据集群·实时rag·pathway