大模型学习笔记 - LLM 之 LLaMA系列(待更新)

LLaMA 概述

LLaMA: Open and Efficient Foundation Language Models

Llama 2: Open Foundation and Fine-Tuned Chat Models (LLama2 & LLama2-Chat)

LLama 3 | LLama 3.1

LLaMA-1

涉及到的基础知识点:

  1. pre-normalization. RSMNorm。
  2. SwiGLU activation function [PaLM].
  3. Rotary Embeddings [GPTNeo].Rotary positional embeddings (RoPE),
  4. FlashAttention

LLaMA-2

涉及到的基础知识点:

  1. groupAttention
  2. RLHF(PPO,拒绝采样)

LLama2:

我们还将预训练语料库的大小增加了 40%,增加了模型的上下文长度,并采用分组查询注意力(Ainslie et al., 2023)。我们正在发布具有 7B、13B 和 70B 参数的 Llama 2 变体。

LLama2Chat:

Llama 2-Chat 的训练:这个过程始于使用公开可用的在线源对 Llama 2 进行预训练。接下来,我们通过应用监督微调来创建 Llama 2-Chat 的初始版本。随后,使用带有人类反馈 (RLHF) 方法的强化学习迭代地改进模型,特别是通过拒绝采样近端策略优化 (PPO)。在 RLHF 阶段,迭代奖励建模数据与模型增强并行的累积对于确保奖励模型保持在分布内至关重要。

LLaMA-3

相关推荐
虾球xz15 分钟前
游戏引擎学习第249天:清理调试宏
c++·学习·游戏引擎
flying robot17 分钟前
小结: 接口类型和路由优先级
笔记
FAREWELL0007529 分钟前
C#进阶学习(十七)PriorityQueue<TElement, TPriority>优先级队列的介绍
开发语言·学习·c#·优先级队列
海绵宝宝的月光宝盒1 小时前
[stm32] 4-1 USART(1)
c语言·开发语言·笔记·stm32·单片机
IsPrisoner1 小时前
GoLang基础
笔记·golang
我真不困了1 小时前
类和对象(下)
c++·笔记·学习·其他
LWing6513 小时前
算法基础学习|02归并排序——分治
c++·学习·算法
说码解字8 小时前
如何系统学习音视频
学习·音视频
Lester_11019 小时前
嵌入式学习笔记 - 关于STM32 SPI控制器读取以及写入时,标志位TXE, RXNE的变化
笔记·学习
njsgcs10 小时前
ubuntu我装软件用的命令 flathub使用
笔记