大模型学习笔记 - 大纲

LLM 大纲

  • [LLM 大纲](#LLM 大纲)
    • [1. LLM 模型架构](#1. LLM 模型架构)
      • [LLM 技术细节 - 注意力机制](#LLM 技术细节 - 注意力机制)
      • [LLM 技术细节 - 位置编码](#LLM 技术细节 - 位置编码)
    • [2. LLM 预训练](#2. LLM 预训练)
    • [3. LLM 指令微调](#3. LLM 指令微调)
      • [LLM 高效微调技术](#LLM 高效微调技术)
    • [4. LLM 人类对齐](#4. LLM 人类对齐)
      • [LLM InstructGPT](#LLM InstructGPT)
      • [LLM PPO算法](#LLM PPO算法)
      • [LLM DPO 算法](#LLM DPO 算法)
    • [5. LLM 解码与部署](#5. LLM 解码与部署)
    • [6. LLM 模型LLaMA 系列](#6. LLM 模型LLaMA 系列)
    • [7. LLM RAG](#7. LLM RAG)

1. LLM 模型架构

大模型学习笔记 - LLM模型架构

LLM 技术细节 - 注意力机制

To Be added

LLM 技术细节 - 位置编码

To Be added

2. LLM 预训练

大模型学习笔记 - LLM 预训练

3. LLM 指令微调

大模型学习笔记 - LLM指令微调

LLM 高效微调技术

TO Be Added

4. LLM 人类对齐

大模型学习笔记 - LLM 之RLHF人类对齐的简单总结

LLM InstructGPT

大模型学习笔记 - InstructGPT中的微调与对齐

LLM PPO算法

To Be added

LLM DPO 算法

To Be added

5. LLM 解码与部署

大模型学习笔记 - LLM 解码与部署

6. LLM 模型LLaMA 系列

To Be added

7. LLM RAG

To Be added

相关推荐
式5161 分钟前
大模型学习基础(六) 强化学习(Reinforcement Learning,RL)初步1.3
学习
阿恩.7707 分钟前
材料工程科技期刊征稿:快速发表,知网、维普检索!
经验分享·笔记·考研·网络安全·数学建模·能源·制造
UWA8 分钟前
GPM 2.0全新功能发布|GPU精准监测 + 精细化运营,重构游戏性能管控新范式
人工智能·游戏·性能优化·重构·游戏开发·uwa
无心水11 分钟前
【Stable Diffusion 3.5 FP8】1、Stable Diffusion 3.5 FP8 入门指南:为什么它能颠覆文生图效率?
人工智能·python·深度学习·机器学习·stable diffusion·ai镜像开发·ai镜像
Elastic 中国社区官方博客12 分钟前
Elasticsearch:使用 ES|QL 与 dense_vector 字段
大数据·数据库·人工智能·sql·elasticsearch·搜索引擎·全文检索
沉木渡香14 分钟前
AI驱动:我的系统化探索与成长之年(2025)
人工智能·年终总结·2025·ai驱动
关于不上作者榜就原神启动那件事14 分钟前
Redis学习笔记
redis·笔记·学习
OpenCSG15 分钟前
高性能 · 低门槛| i20 & RTX 4090 正式上线 OpenCSG 社区与三峡传神社区!
人工智能·opencsg
IT_陈寒20 分钟前
Redis性能提升50%的7个实战技巧,连官方文档都没讲全!
前端·人工智能·后端
小女孩真可爱21 分钟前
大模型学习记录(九)-------Agent
人工智能·pytorch·深度学习·学习·大模型