大模型学习笔记 - 大纲

LLM 大纲

  • [LLM 大纲](#LLM 大纲)
    • [1. LLM 模型架构](#1. LLM 模型架构)
      • [LLM 技术细节 - 注意力机制](#LLM 技术细节 - 注意力机制)
      • [LLM 技术细节 - 位置编码](#LLM 技术细节 - 位置编码)
    • [2. LLM 预训练](#2. LLM 预训练)
    • [3. LLM 指令微调](#3. LLM 指令微调)
      • [LLM 高效微调技术](#LLM 高效微调技术)
    • [4. LLM 人类对齐](#4. LLM 人类对齐)
      • [LLM InstructGPT](#LLM InstructGPT)
      • [LLM PPO算法](#LLM PPO算法)
      • [LLM DPO 算法](#LLM DPO 算法)
    • [5. LLM 解码与部署](#5. LLM 解码与部署)
    • [6. LLM 模型LLaMA 系列](#6. LLM 模型LLaMA 系列)
    • [7. LLM RAG](#7. LLM RAG)

1. LLM 模型架构

大模型学习笔记 - LLM模型架构

LLM 技术细节 - 注意力机制

To Be added

LLM 技术细节 - 位置编码

To Be added

2. LLM 预训练

大模型学习笔记 - LLM 预训练

3. LLM 指令微调

大模型学习笔记 - LLM指令微调

LLM 高效微调技术

TO Be Added

4. LLM 人类对齐

大模型学习笔记 - LLM 之RLHF人类对齐的简单总结

LLM InstructGPT

大模型学习笔记 - InstructGPT中的微调与对齐

LLM PPO算法

To Be added

LLM DPO 算法

To Be added

5. LLM 解码与部署

大模型学习笔记 - LLM 解码与部署

6. LLM 模型LLaMA 系列

To Be added

7. LLM RAG

To Be added

相关推荐
J2虾虾2 分钟前
Spring AI Alibaba文档
java·人工智能·spring
Mr数据杨3 分钟前
【CanMV K210】传感器实验 U 型光电传感器遮挡检测与 LED 提示
人工智能·硬件开发·canmv k210
向量引擎4 分钟前
当搜索开始替人整理答案:我重新理解了向量检索和 API 中间层
人工智能·gpt·aigc·ai编程·ai写作·key·agi
z200509306 分钟前
【Linux学习】Linux中的进程程序替换
linux·服务器·学习
春日见9 分钟前
五分钟入门 强化学习---DQN(Deep Q Net)算法与实现
人工智能·python·深度学习·算法·microsoft·机器学习
小+不通文墨10 分钟前
把树莓派外接的DHT11接收的温湿度发送到emqx上
经验分享·笔记·嵌入式硬件·学习·树莓派
赤龙ERP12 分钟前
赤龙一周观察 · 2026年5月第五周
人工智能
hnult19 分钟前
从AI命题到九重监考体系:考试云一站式竞赛答题平台解决方案
人工智能
完成大叔22 分钟前
模块二,Agent规划模式的四个工具思考
人工智能