AI使用小技巧: 用zed和MinerU本地版,同时学习PDF文档的文字和图片

mineru本地版,它不需要配置大模型,它是直接用cpu跑vlm模型的,vlm模型已经内置到mineru软件里了,所以不需要额外配置大模型,转文档给ai用很好,可以用来同时识别图片和文本。(转出来有图片,图片和文档的正文都存在了本地,图片在一个单独的images文件夹下,被转好后的正文引用本地图片路径;然后加一个agent,打开转好文档的目录,里面有转好后的正文文本,和images子文件夹,我这里用zed里面自己的zed agent,加支持图片的模型,我这里用Gemma4 26b a4b,就可以同时识别图片和文字了)

相关推荐
网易云信3 分钟前
立即下载!帝王蟹(ClawHive)桌面客户端正式上线!
人工智能·agent
玉鸯16 分钟前
界面用完即消失:Agent 生成式 UI 的短暂性哲学与前端工程的未来
前端·llm·agent
(轻舟已过万重山)21 分钟前
第27章 框架实操:用 LangChain/LlamaIndex 搭建完整 RAG 系统
人工智能·ai·langchain
组合缺一24 分钟前
SolonCode v2026.8.4 发布:界面字体可调、22 种语言、记忆搜索增强
llm·agent·ai编程·solon·claudecode·opencode
小兔子1 小时前
Agent 一旦能出网、改仓、调工具:对照 AISI 越权事件,把四层控制写进架构
人工智能·agent
用户469368483201 小时前
kimi-code 深度掌握系列文章-Agent 类编排者(四)
llm·agent
牧艺1 小时前
Knowledge Studio 本地开源版:对标百炼 RAG 控制台的架构、重难点与差异
llm·agent·next.js
晨米酱1 小时前
Matt Pocock Skills v1.2:控制从主流程深入到每一步
面试·架构·agent
Smoothcloud润云1 小时前
GPU租赁数据安全怎么做?
人工智能·算法·ai·aigc·gpu算力·gpu
weixin_431600442 小时前
做 Agent 会用到的 Node API(3):异步与流
前端·学习·ai·agent·ai编程