Llama3新一代 Llama模型

最近,Meta 发布了 Llama3 模型,从发布的数据来看,性能已经超越了 Gemini 1.5 和 Claud 3。

Llama 官网说,他们未来是要支持多语言和多模态的,希望那天赶紧到来。

未来 Llama3还将推出一个 400B大模型,目前正在训练中,4000 亿参数,继续卷参数。Llama 3 预训练了超过 15 T Token,为了准备即将到来的多语言用例,Llama 3 的预训练数据集中超过 5% 是覆盖 30 多种语言的高质量非英语数据。然而,非英语性能不如英语好。Llam3 是在 2 个 24K GPU 集群上进行训练的,差不多5 万块 GPU,不是一般公司搞得起的。

我本地安装了 8B,能理解中文,但是回答还不是中文,可以让他翻译成中文。

也可以给他 Promote 让他用中文说,速度挺快的。

Meta 官方也有体验的网页,国内用不了,用 Ollama 下载 8b 的模型先玩玩。

相关推荐
zhengdao990620 小时前
【论文笔记】Llama 3 技术报告
论文阅读·llama
橘子在努力2 天前
【橘子大模型】关于PromptTemplate
python·ai·llama
Chaos_Wang_3 天前
NLP高频面试题(三十)——LLama系列模型介绍,包括LLama LLama2和LLama3
人工智能·自然语言处理·llama
艾鹤3 天前
ollama安装与使用
人工智能·llama
清易4 天前
windows大模型llamafactory微调
llama
漠北尘-Gavin4 天前
【Python3.12.9安装llama-cpp-python遇到编译报错问题解决】
python·llama
爱听歌的周童鞋5 天前
理解llama.cpp如何进行LLM推理
llm·llama·llama.cpp·inference
溯源0065 天前
vscode调试python(transformers库的llama为例)
vscode·python·llama
Flying`5 天前
LLaMA-Factory微调实操记录
llama
张飞飞飞飞飞6 天前
通过Llama-Factory对Deepseek-r1:1.5b进行微调
llama