AI使用小技巧: 用zed和MinerU本地版,同时学习PDF文档的文字和图片

mineru本地版,它不需要配置大模型,它是直接用cpu跑vlm模型的,vlm模型已经内置到mineru软件里了,所以不需要额外配置大模型,转文档给ai用很好,可以用来同时识别图片和文本。(转出来有图片,图片和文档的正文都存在了本地,图片在一个单独的images文件夹下,被转好后的正文引用本地图片路径;然后加一个agent,打开转好文档的目录,里面有转好后的正文文本,和images子文件夹,我这里用zed里面自己的zed agent,加支持图片的模型,我这里用Gemma4 26b a4b,就可以同时识别图片和文字了)

相关推荐
像风一样自由20204 小时前
新版ChatGPT (Codex) 桌面版启动失败排查与修复记录
chatgpt·大模型
catoop4 小时前
Agent 流式交互技术选型
ai·agent
喜欢吃豆7 小时前
otes on LLMs 更新:一份更系统的大模型工程学习手册
学习·大模型·agent
谭光志9 小时前
如何从网站提取设计风格:DOM、计算样式与 DESIGN.md
前端·javascript·agent
小七-七牛开发者9 小时前
拆解 dsh 系列:从源码和版本变化看 DeepSeek Harness 的设计取舍
ai·大模型·claude·token·工作流·skill·claudecode·ai coding
小羊4310 小时前
Agent 可观测性实战:从日志、Trace 到 Replay
agent
欧阳立峰10 小时前
你的 Agent 没有崩溃,它只是永远在等——多智能体调度里的静默失败
agent
plainGeekDev10 小时前
Agent的两种玩法:parallel 与 pipeline
agent·ai编程·claude
joinwell5210 小时前
取消了 Agent,子进程真的停了吗?从 Anywhere Agents 看 Agent 运行时的停止证据边界
agent
Ai-_Man10 小时前
千问能否电脑批量导出?深度拆解「AI导出鸭」如何让这件事从“反人性”变成“优雅”
人工智能·ai·小程序