介绍下本人开发的OpenCode开源多模态插件——analyze-image

长期以来,我在OpenCode中使用DeepSeek、glm这些开源模型的时候,总有一种深深的无力感,就是这些模型虽然很强,但它是纯文本的,这直接导致AI模型无法解决我的一些包含识图场景的问题。

于是随手给OpenCode开发了一个多模态插件,给当前聊天上下文增加一个tool,当模型识别到要识别图片的时候且当前的模型是需要识图的列表(可以自己配置),就会调用这个tool去调用一个可以识图的模型,并将结果返回到上下文正文里面,从而间接实现识图效果,这个插件已经开源,目前还没通过官方的生态验证,暂时只能下载源码丢进特定的OpenCode文件夹来开启。

说那么多也没用,先给大家端上来吧: github.com/cipherTing/...

遇到问题建议直接在github issues里面发个issues就行了,有什么疑问或者需要讨论的可以在评论区交流

相关推荐
小虎AI生活1 分钟前
Anthropic 把「善待 AI」写进使用政策:模型福利之争与开发者的实际影响
aigc·ai编程
武当王丶也1 小时前
这几年,我是怎么用 AI 写代码的
ai编程
柯南46681 小时前
【AI工程师精讲】涌现能力:能力在连续提升,还是尺子在骗人
人工智能·ai编程
小鹿的周先生1 小时前
第16章-RAG
java·人工智能·ai编程
ZZH_AI项目交付1 小时前
实时字幕负责快,本地录音负责不丢:一个 iOS 录音功能为什么需要两条链路
ios·ai编程
jason.zeng@15022072 小时前
(七)「固化 Rest 接口 + Text-to-SQL 灵活查询」双模式 Agent 架构教程
数据库·python·sql·ai·架构·langchain·ai编程
挖掘狂人2 小时前
AI工具选型误区:别再迷信海外模型,国产工具已完成场景反超
大数据·人工智能·ai编程
网络毒刘2 小时前
Rules 冲突排查:多条规则互相打架时如何用优先级、范围与示例消歧
agent·ai编程·cursor·rules
洞窝技术2 小时前
Jev从入门到实战-读懂System One模型并跑通智能if语句
ai编程
冉冉同学2 小时前
AI Agent 开始操作真实手机:移动端自动化的 3 个新考点
android·ai编程