分享一些实用性的大语言模型(GitHub篇)

1.多模态大模型

GitHub网址:haotian-liu/LLaVA:[NeurIPS'23 Oral] 视觉指令调优 (LLaVA) 构建,旨在实现 GPT-4V 级别及以上的能力。 (github.com)

下面是LLaVA模型的介绍,作者都有一直维护和更新,主张让大家都能体验部分gpt4的功能,目前1月底已出到1.6版本

LLaVA-NeXT:改进的推理、OCR 和世界知识 |LLaVA(拉瓦) (llava-vl.github.io)

部署网站,可直接使用

LLaVA

2.图像字幕

GitHub网址:

GitHub - rmokady/CLIP_prefix_caption: Simple image captioning model

该模型主要预训练CLIP模型来对图像内容进行说明,也可称为图像翻译

部署网站,可直接使用(有点慢)

rmokady/clip_prefix_caption -- 在复制时使用 API 运行 (replicate.com)

3.通义千问大模型

GitHub地址:

GitHub - QwenLM/Qwen-VL: The official repo of Qwen-VL (通义千问-VL) chat & pretrained large vision language model proposed by Alibaba Cloud.

这是阿里云公布的一个大模型,在跑分上超过gpt4的结果,并且对比上面第一个大模型还多了文档输入的功能,试用过,总结得还行

部署网站,可直接使用

通义千问 (aliyun.com)

4.中医大语言模型

GitHub地址:

pariskang/CMLM-ZhongJing: 首个中医大语言模型------"仲景"。受古代中医学巨匠张仲景深邃智慧启迪,专为传统中医领域打造的预训练大语言模型。 The first-ever Traditional Chinese Medicine large language model - "CMLM-ZhongJing". Inspired by the profound wisdom of the ancient Chinese medical master Zhang Zhongjing, it is a pre-trained large language model designed specifically for the field of Traditional Chinese Medicine. (github.com)

这是针对中医药而训练的大模型,是上海的两所大学联合训练的,因为中医药方向涉及的领域比较难,而且非常耗成本,所以这个模型具有很好的参考价值,可以作为以后中医药领域的预训练模型

模型地址:

Suprit/Zhongjing-LLaMA-base at main (huggingface.co)

目前没有部署网站,但作者在google colab上部署了,可以直接登录使用

上面介绍的模型分享都希望让大家能多多了解AI和使用AI,最重要是大佬们的开源意识,可以根据自己的情况进行预训练和部署, 也可以直接通过GitHub上进行论文的学习和源码查看,由于小弟我功力不够,模型和原理上就没有给大家做过多介绍了,如果有遇到其他好的模型会持续分享

希望这篇博文对你有帮助!!!!

相关推荐
科技社12 分钟前
咪咕互娱亮相数字中国峰会:“精品游戏+轻量终端”组合,打开数字娱乐新想象
人工智能
数智化精益手记局1 小时前
拆解物料管理erp系统的核心功能,看物料管理erp系统如何解决库存积压与缺料难题
大数据·网络·人工智能·安全·信息可视化·精益工程
Flying pigs~~1 小时前
RAG 完整面试指南:原理、优化、幻觉解决方案
人工智能·prompt·rag·智能体·检索增强生成·rag优化
博.闻广见1 小时前
AI_概率统计-2.常见分布
人工智能·机器学习
企业架构师老王1 小时前
2026制造业安全生产隐患识别AI方案:从主流产品对比看企业级AI Agent的非侵入式落地路径
人工智能·安全·ai
Aleeeeex2 小时前
RAG 那点事:从 8 份企业文档到能用的问答系统,全过程拆给你看
人工智能·python·ai编程
冬奇Lab2 小时前
一天一个开源项目(第87篇):Tank-OS —— Red Hat 工程师用一个周末,把 AI Agent 塞进了一个可启动的 Linux 镜像
人工智能·开源·资讯
小糖学代码2 小时前
LLM系列:2.pytorch入门:8.神经网络的损失函数(criterion)
人工智能·深度学习·神经网络
Captaincc2 小时前
转发-中央网信办部署开展“清朗·整治AI应用乱象”专项行动
人工智能·vibecoding
AI自动化工坊2 小时前
Late框架技术深度解析:5GB VRAM实现10倍AI编码效率的工程架构
人工智能·5g·架构·ai编程·late