微调,在已经成熟的经过了预训练,SFT,RLHF这些操作过后进行的客制化操作。 --模型能不足或者希望固化一些知识省promote的时候

1.全参微调 需要至少80G以上的显存
2.PEFT,LoRA低秩适配

稳定性:微调
新语言新方式:续训。 成本高高高高。
RAG外挂知识库。 成本低一点RAG。

智能体:
1.大语言模型的大脑 2.有记忆 3.会用调用工具 4.可以去进行规划决策 5.可以执行某个操作
工具调用:1.function call 不足:工具实现与服用比较复杂。可能代码没有很多健壮性的考虑禁不起测试。
MCP标准,标准化工程函数。工具统一化
RAG --大模型知识冻结 减少幻觉 类似开卷考试。
检索语义相近的内容