大模型——LLaVA和LLaMA的介绍和区别

LLaVALLaMA是两个不同的模型架构,它们的设计目的和应用领域有所不同:

LLaMA(Large Language Model Meta AI)

  • 简介:LLaMA是由Meta AI推出的一系列大规模语言模型(Large Language Models, LLMs),LLaMA代表"Large Language Model Meta AI"。它们是基于Transformer架构的语言模型,类似于GPT系列。
  • 版本:目前有LLaMA 1和LLaMA 2版本。LLaMA 2提供了7B、13B和70B三个不同规模的模型。
  • 应用:LLaMA模型专注于自然语言处理任务,如文本生成、翻译、问答、文本摘要等。
  • 代表工作
    • Touvron, H., et al. (2023). "LLaMA: Open and Efficient Foundation Language Models." arXiv:2302.13971
    • Touvron, H., et al. (2023). "LLaMA 2: Open Foundation and Fine-Tuned Chat Models." arXiv:2307.09288

LLaVA(Large Language and Vision Assistant)

  • 简介:LLaVA是一个将大规模语言模型(LLMs)与视觉模型结合的多模态模型,旨在处理图像和文本的联合理解和生成任务。LLaVA的目标是让语言模型理解和处理视觉输入,如图片或视频帧。
  • 工作原理:LLaVA通过结合预训练的语言模型(如GPT-4等)与视觉编码器(如CLIP等)来处理图像和文本的输入,并提供统一的输出。
  • 应用:LLaVA模型可用于视觉问答、图像描述生成、多模态对话等任务。
  • 代表工作

总结

  • LLaMA是一个专注于自然语言处理的大规模语言模型系列。
  • LLaVA是一个将语言模型与视觉模型结合的多模态模型,能够处理图像和文本的联合输入。
相关推荐
Jurio.17 小时前
使用.py脚本下载并加载开源大模型LLMs
python·ai·llama
解局易否结局1 天前
FlashAttention 在昇腾NPU上的实现:从内存墙到IO感知
llama
Soari2 天前
性能压榨的暴力美学:深度拆解 llama.cpp,结合 GGUF 量化实测,看普通人如何用 2GB 内存硬核跑赢 7B 大模型
llama
weixin_446260853 天前
终极工程指南:llama.cpp 本地AI部署手册 (2026)
人工智能·llama
ONE_SIX_MIX4 天前
新版本 llama-cpp 构建/下载 webui 导致build 失败 解决
llama
Wanderer X4 天前
【LLM】LLaMA
llama
落痕的寒假4 天前
[深度学习] 大模型学习8上-推理部署框架llama.cpp与Ollama使用指北
深度学习·学习·llama
网络工程小王5 天前
【大模型vLLM 使用】学习笔记
笔记·学习·llama
TGITCIC5 天前
大模型训练师的炼丹之道 (1)-最新版llama-factory环境搭建和全排错
微调·sft·llama·模型训练·训练·大模型训练·llama-factory
周公6 天前
记一次在双 RTX 3090 工作站上部署 vLLM 与 Qwen3.6-35B-AWQ 的实战记录
python·ai·llama·vllm·ollama