【大模型】大模型微调

参考:

https://juejin.cn/post/7473309339294695460

长文本 & 知识库 & 微调的区别

长文本

知识库

将需要添加的知识转化为向量数据库,用于查找

扩展性强:不需要重新训练模型只需要更新知识库 ,就能让模型回答新的问题

微调

三者对比

相关推荐
Tisfy1 小时前
Codex:通过编辑配置文件添加带Bearer的自定义MCP
数据库·大模型·agent·codex·mcp
dogstarhuang4 小时前
大模型 API 停服怎么办:用 API 网关实现多模型统一接入与可切换架构
人工智能·后端·架构·大模型·api·数字化转型·ai应用
thesky1234565 小时前
27届大模型面试准备(三十二):RAG 进阶——从朴素 RAG 到 Agentic RAG 与多模态检索增强
大模型·rag·agentic rag·graph rag·进阶rag·self-rag·corrective rag
thesky1234567 小时前
27届大模型面试准备(三十一):多模态推理与视觉思维链——从“看见“到“想明白“
大模型·具身推理·空间推理·多模态推理·视觉思维链·visual cot·图表推理
安逸sgr12 小时前
优化器是什么?SGD、Momentum、Adam 有什么区别?
人工智能·ai·大模型·agent·智能体
小田学Python1 天前
重新定义 Agent:为什么大模型不能直接干活,需要一层“壳”
大模型·api·ai agent
白拾1 天前
【arXiv 2026】Nemotron-Labs-Diffusion:三模式语言模型 统一自回归、扩散与自推测解码|从大模型推理加速视角
大模型·推理加速·扩散语言模型·并行解码·自推测解码·arxiv 2026
dozenyaoyida1 天前
AI与大模型新闻日报 | 2026-08-13
人工智能·ai·大模型·新闻
thesky1234561 天前
27届大模型面试准备(二十九):长文本推理与高效注意力——FlashAttention、稀疏/线性注意力与推理侧长度外推
大模型·面试准备·flashattention·推理优化·稀疏注意力·长文本推理·长度外推