大模型学习笔记 - 大纲

LLM 大纲

  • [LLM 大纲](#LLM 大纲)
    • [1. LLM 模型架构](#1. LLM 模型架构)
      • [LLM 技术细节 - 注意力机制](#LLM 技术细节 - 注意力机制)
      • [LLM 技术细节 - 位置编码](#LLM 技术细节 - 位置编码)
    • [2. LLM 预训练](#2. LLM 预训练)
    • [3. LLM 指令微调](#3. LLM 指令微调)
      • [LLM 高效微调技术](#LLM 高效微调技术)
    • [4. LLM 人类对齐](#4. LLM 人类对齐)
      • [LLM InstructGPT](#LLM InstructGPT)
      • [LLM PPO算法](#LLM PPO算法)
      • [LLM DPO 算法](#LLM DPO 算法)
    • [5. LLM 解码与部署](#5. LLM 解码与部署)
    • [6. LLM 模型LLaMA 系列](#6. LLM 模型LLaMA 系列)
    • [7. LLM RAG](#7. LLM RAG)

1. LLM 模型架构

大模型学习笔记 - LLM模型架构

LLM 技术细节 - 注意力机制

To Be added

LLM 技术细节 - 位置编码

To Be added

2. LLM 预训练

大模型学习笔记 - LLM 预训练

3. LLM 指令微调

大模型学习笔记 - LLM指令微调

LLM 高效微调技术

TO Be Added

4. LLM 人类对齐

大模型学习笔记 - LLM 之RLHF人类对齐的简单总结

LLM InstructGPT

大模型学习笔记 - InstructGPT中的微调与对齐

LLM PPO算法

To Be added

LLM DPO 算法

To Be added

5. LLM 解码与部署

大模型学习笔记 - LLM 解码与部署

6. LLM 模型LLaMA 系列

To Be added

7. LLM RAG

To Be added

相关推荐
mCell2 小时前
LLM 扫盲:什么是 Tokens?
chatgpt·llm·aigc
海边夕阳20064 小时前
【每天一个AI小知识】:什么是生成对抗网络?
人工智能·经验分享·深度学习·神经网络·机器学习·生成对抗网络
Wise玩转AI4 小时前
Day 27|智能体的 UI 与用户交互层
人工智能·python·ui·ai·chatgpt·ai智能体
摇滚侠4 小时前
零基础小白自学 Git_Github 教程,解决分支合并冲突,笔记14
笔记·git·github
c***21295 小时前
Springboot3学习(5、Druid使用及配置)
android·学习
youcans_5 小时前
【youcans论文精读】VM-UNet:面向医学图像分割的视觉 Mamba UNet 架构
论文阅读·人工智能·计算机视觉·图像分割·状态空间模型
铮铭5 小时前
扩散模型简介:The Annotated Diffusion Model
人工智能·机器人·强化学习·世界模型
CoderJia程序员甲5 小时前
GitHub 热榜项目 - 日榜(2025-12-1)
ai·开源·llm·github·ai教程
轻竹办公PPT5 小时前
轻竹论文:毕业论文AI写作教程
人工智能·ai·ai写作