图解LLM,入门大模型必看

9张图解LLM

✅ 1. Transformer vs. Mixture of Experts

  • Transformer 每个解码器块使用固定的前馈网络;
  • Mixture of Experts (MoE) 通过 Router 动态选择部分专家网络,提升模型容量同时减少计算量。

✅ 2. 5种微调大语言模型(LLM)的方法(LoRA系列)

  • LoRA:冻结原始参数,仅训练低秩矩阵 A 和 B;
  • LoRA-FA:输入侧也加入变换,更灵活;
  • VeRA:参数更少,训练共享向量 + 偏置;
  • Delta-LoRA:每层引入多个 LoRA 分支,增强表达;
  • LoRA+:在 B 矩阵上使用更大学习率,加快收敛。

✅ 3. Traditional RAG vs. Agentic RAG

  • 传统RAG:直接用 query 检索向量库,拼接上下文喂给 LLM;
  • Agentic RAG:引入 Agent,迭代重写问题、判断是否信息不足、是否需要用工具或检索源,流程更智能。

✅ 4. 5种 Agentic AI 设计模式

  1. Reflection:先生成再反思输出,迭代优化;
  2. Tool Use:调用外部工具补充信息;
  3. ReAct:推理 + 动作交替进行;
  4. Planning:先拆解任务,逐步执行;
  5. Multi-agent:多个 Agent 协作解决复杂问题。

✅ 5. 5种 RAG 文本切分策略(Chunking)

  1. Fixed-size:定长切分,简单易实现;
  2. Semantic:按语义相似性拼接;
  3. Recursive:大段内容递归再切分;
  4. 结构化切分:按文档结构如标题、章节切分;
  5. LLM生成切分:利用LLM智能划块。

✅ 6. 5级 Agentic AI 系统能力层级

  1. 基础回复者:只用 LLM 输出结果;
  2. Router 模式:路由器 LLM 选择最佳模型;
  3. 工具调用:LLM 能调用 API、数据库等外部资源;
  4. 多智能体:多个子 Agent 协同;
  5. 自主智能体:生成+验证器 Agent 形成闭环反馈优化。

✅ 7. Traditional RAG vs. HyDE

  • RAG:直接将 query 用作向量检索;
  • HyDE:先让 LLM 生成一段"假设文本",用该文本向量检索,提高相关性。

✅ 8. Traditional RAG vs. Graph RAG

  • RAG:依赖向量库检索相关文档;
  • Graph RAG:用 LLM 生成知识图谱(实体+关系),结合图数据库进行图遍历,获取结构化上下文。

✅ 9. KV Caching in LLMs

  • Insight 1:生成新 token 只需最后的 hidden state;
  • Insight 2:最后 hidden state 只依赖最后一个 query 向量和之前所有的 key/value 向量;
  • 结论:将 K/V 向量缓存起来,可避免重复计算,大幅提升推理效率。
相关推荐
GitCode官方1 小时前
小米 MiMo‑V2.5 系列开源,正式入驻 AtomGit!旗舰模型完成全球多家主流芯⽚⼚商深度适配
开源·小米·atomgit
冬奇Lab3 小时前
一天一个开源项目(第87篇):Tank-OS —— Red Hat 工程师用一个周末,把 AI Agent 塞进了一个可启动的 Linux 镜像
人工智能·开源·资讯
a1117767 小时前
MonoGS 在 Jetson Orin Nano 上的部署与性能测试
python·开源·torch·cv
码途漫谈7 小时前
Easy-Vibe开发篇阅读笔记(二)——前端开发之Figma与MasterGo入门
人工智能·笔记·ai·开源·ai编程·figma
迪菲赫尔曼9 小时前
从 0 到 1 打造工业级推理控制台:UltraConsole(Ultralytics + FastAPI + React)开源啦!
前端·yolo·react.js·计算机视觉·开源·fastapi
中微子9 小时前
突然爆火的Warp 终端,开源1天破 4w Stars
linux·人工智能·开源
kobesdu10 小时前
连接大模型与物理机器人-RoboNeuron让机器人真正“听懂人话”
机器人·开源·ros·人形机器人
sitellla11 小时前
MySQL 入门:最流行的开源关系型数据库介绍
数据库·mysql·其他·开源
GEO索引未来12 小时前
国内首部GEO可信传播标准立项通过/DeepSeek-V4 正式上线并开源/Open AI、Google继续推进AI广告标准化
大数据·人工智能·gpt·ai·chatgpt·开源
炸裂狸花猫12 小时前
开源身份认证与访问管理平台 - Keycloak(二)
docker·云原生·容器·kubernetes·开源·keycloak·sso