技术栈
监督微调
HyperAI超神经
14 天前
人工智能
·
大模型
·
数据集
·
nvidia
·
预训练
·
代码生成
·
监督微调
数据集汇总丨英伟达开源Nemotron系列数据集,超10T tokens+40M 条后训练样本,覆盖数学推理/代码生成/多语言对话
训练数据正在成为大模型竞争的关键变量。当参数量不再是唯一壁垒,数据的质量、结构与任务适配性,开始决定模型在推理、代码、交互等维度上的真实表现。
阿杰学AI
4 个月前
人工智能
·
深度学习
·
ai
·
语言模型
·
aigc
·
sft
·
监督微调
AI核心知识119—大语言模型之 监督微调 (简洁且通俗易懂版)
监督微调 (Supervised Fine-Tuning, 简称 SFT) 是把大语言模型从一个“野生学霸” 变成“全能助理” 的第一道关键工序。
阿杰学AI
8 个月前
人工智能
·
ai
·
语言模型
·
aigc
·
监督微调
AI核心知识19——大语言模型之SFT(简洁且通俗易懂版)
SFT(Supervised Fine-Tuning)的全称是 “监督微调”。它是大语言模型训练的第二阶段,是让 AI 从 “知识储备” 迈向 “实用对话” 的关键一步。
我是有底线的