dify 图片提取文字

1.LLM必须支持视觉

LLM必须要本身支持视觉,然后是dify中的设置。

添加LLM的时候必须开启

如果是已经添加的模型,可以修改设置

点击后就可以改了。

工作流编排的时候可以查看

2.编排节点

比较简单。一个LLM节点就行了

LLM节点设置,必须使用支持视觉的LLM

开启LLM节点的视觉功能

可以是多张图片,但是测试的时候不要使用同一张图片,实测发现使用同一张图片的话没有作用,像这样

使用不同的图片就没问题

或者改成迭代的方式。

相关推荐
cfm_29148 分钟前
SpringAI + Ollama 本地大模型
java·开发语言·人工智能·语言模型
147API17 分钟前
蒸馏模型版本升级怎么做,权重、评测器和服务配置一起管
人工智能·深度学习·蒸馏·模型蒸馏
湘美书院--湘美谈教育19 分钟前
湘美书院主理人谈AI文学:提示词与Skill的与时俱进
大数据·人工智能·安全·自动化·生活
漏刻有时29 分钟前
本地部署 Dify + DeepSeek 搭建AI知识问答客服全流程复盘
人工智能
weixin_5498083631 分钟前
人力资源数字化转型:从工具堆叠到AI原生架构的组织级跃迁路径
大数据·人工智能
l00010931 分钟前
图书馆静谧环境构建:主流声学品牌产品与服务梳理
大数据·人工智能·声音
倔强的石头1061 小时前
【机器学习】机器学习三大范式_监督无监督强化学习概览
人工智能·机器学习
DO_Community1 小时前
多模型路由怎么选?2026 年 4 款主流方案对比
人工智能
CypressTel1 小时前
Google发布Gemini 3.7 Flash:企业为何要计算AI智能体的任务总成本——赛柏特AI快讯
人工智能
wujian83111 小时前
怎么用千问生成word文档:从「格式崩」到「一键过」,AI导出鸭打通最后半厘米
人工智能·ai·c#·word·豆包·deepseek·ai导出鸭