技术栈

llm 架构

零域码客
2 小时前
大数据·人工智能·机器学习·模型微调·fine-tuning·检索增强生成·llm 架构
RAG 和微调解决的是同一类问题吗?从大模型底层全链路拆解两者的本质与选择逻辑摘要:几乎每个做大模型落地的团队都问过一个问题——"这个需求该用 RAG 还是微调?"但这个问题本身可能就是个错误的问题。微调动的是模型参数,RAG 动的是推理时的输入上下文,二者作用在完全不同的链路上。本文从预训练 → 微调 → 推理的完整链路出发,拆解两种技术各自解决什么问题、知识在模型"脑海"里的两种存在形式,并给出可落地的决策框架。
我是有底线的