The Llama 3 Herd of Models【论文原文下载】

关注B站可以观看更多实战教学视频:hallo128的个人空间

The Llama 3 Herd of Models【论文原文】

摘要

现代人工智能(AI)系统由基础模型驱动。本文介绍了一组新的基础模型,称为 Llama 3。它是一群原生支持多语言、编码、推理和工具使用的语言模型。我们最大的模型是一个密集型 Transformer,具有 405    B {405}\mathrm{;B}405B 参数和高达 128    K {128}\mathrm{;K}128K 个令牌的上下文窗口。本文对 Llama 3 进行了广泛的实证评估。我们发现 Llama 3 在众多任务上与 GPT-4 等领先语言模型相比质量相当。我们公开发布了 Llama 3,包括 405B 参数语言模型的预训练和后训练版本以及用于输入和输出安全的 Llama Guard 3 模型。本文还展示了通过组合方法将图像、视频和语音功能集成到 Llama 3 中的实验结果。我们观察到这种方法在图像、视频和语音识别任务上与最先进的技术表现竞争。由于这些模型仍在开发中,因此尚未广泛发布。

日期:2024年7月23日

网站:https://llama.meta.com/

相关推荐
zhengdao990619 小时前
【论文笔记】Llama 3 技术报告
论文阅读·llama
橘子在努力2 天前
【橘子大模型】关于PromptTemplate
python·ai·llama
Chaos_Wang_3 天前
NLP高频面试题(三十)——LLama系列模型介绍,包括LLama LLama2和LLama3
人工智能·自然语言处理·llama
艾鹤3 天前
ollama安装与使用
人工智能·llama
清易3 天前
windows大模型llamafactory微调
llama
漠北尘-Gavin4 天前
【Python3.12.9安装llama-cpp-python遇到编译报错问题解决】
python·llama
爱听歌的周童鞋5 天前
理解llama.cpp如何进行LLM推理
llm·llama·llama.cpp·inference
溯源0065 天前
vscode调试python(transformers库的llama为例)
vscode·python·llama
Flying`5 天前
LLaMA-Factory微调实操记录
llama
张飞飞飞飞飞6 天前
通过Llama-Factory对Deepseek-r1:1.5b进行微调
llama