AI使用小技巧: 用zed和MinerU本地版,同时学习PDF文档的文字和图片

mineru本地版,它不需要配置大模型,它是直接用cpu跑vlm模型的,vlm模型已经内置到mineru软件里了,所以不需要额外配置大模型,转文档给ai用很好,可以用来同时识别图片和文本。(转出来有图片,图片和文档的正文都存在了本地,图片在一个单独的images文件夹下,被转好后的正文引用本地图片路径;然后加一个agent,打开转好文档的目录,里面有转好后的正文文本,和images子文件夹,我这里用zed里面自己的zed agent,加支持图片的模型,我这里用Gemma4 26b a4b,就可以同时识别图片和文字了)

相关推荐
HUIBUR科技14 分钟前
AI中枢:打破数据孤岛与流程孤岛双重困境
开发语言·ai
胖纸不争17 分钟前
嫌桌面 Agent 太重,我“自己”写了一个
ai·c#·net core
宋哥转AI35 分钟前
我的创作纪念日:成为创作者的第 128 天
人工智能·ai
ajassi20001 小时前
AI语音智能体开发日记(十八)智能体服务器xiaozhi-esp32-server源码部署指南
运维·服务器·人工智能·ai·ai编程
梦想的颜色1 小时前
【编程实战】AI 时代 APP 开发全栈硬核指南:技术选型 + AI 架构 + 模型落地全维度决策
python·flutter·react native·react.js·ai·桌面应用·milvus
Solis程序员2 小时前
Stripe 幂等表:把「不确定的重试」变成「查表返回」
前端·安全·bootstrap·php·agent
时空节拍AI数字人2 小时前
数字文旅补贴来了,景区申报要注意什么?
大数据·人工智能·百度·3d·ai·架构·aigc
Martina_03212 小时前
AI生成3D模型导入后只剩一个大网格?用6步完成微缩场景拆分与优化
人工智能·游戏·数学建模·3d·ai·自然语言处理·aigc
浮生望2 小时前
Agentic RAG(中):复杂问题如何拆成多跳检索闭环
agent
小盆女神节奶粉2 小时前
LangChain 中间件
langchain·agent