技术栈

cogvlm

Nicolas893
2 个月前
语言模型·大模型·多模态·视觉理解·cogvlm·visionllm·视觉语言预训练模型
【大模型理论篇】CogVLM:多模态预训练语言模型前两天我们在《Skywork R1V: Pioneering Multimodal Reasoning with Chain-of-Thought》中介绍了将ViT与推理模型结合构造多模态推理模型的案例,其中提到了VLM的应用。追溯起来就是两篇前期工作:Vision LLM以及CogVLM。
好评笔记
4 个月前
论文阅读·人工智能·深度学习·机器学习·aigc·transformer·cogvlm
多模态论文笔记——CogVLM和CogVLM2大家好,这里是好评笔记,公主号:Goodnote,专栏文章私信限时Free。本文详细介绍多模态模型的LoRA版本——CogVLM和CogVLM2。在SD 3中使用其作为captioner基准模型的原因和优势。
SpikeKing
8 个月前
人工智能·语言模型·clip·mllm·多模态大语言模型·openclip·cogvlm
LLM - 理解 多模态大语言模型 (MLLM) 的架构与相关技术 (二)欢迎关注我的CSDN:https://spike.blog.csdn.net/ 本文地址:https://spike.blog.csdn.net/article/details/142063880