Llama3新一代 Llama模型

最近,Meta 发布了 Llama3 模型,从发布的数据来看,性能已经超越了 Gemini 1.5 和 Claud 3。

Llama 官网说,他们未来是要支持多语言和多模态的,希望那天赶紧到来。

未来 Llama3还将推出一个 400B大模型,目前正在训练中,4000 亿参数,继续卷参数。Llama 3 预训练了超过 15 T Token,为了准备即将到来的多语言用例,Llama 3 的预训练数据集中超过 5% 是覆盖 30 多种语言的高质量非英语数据。然而,非英语性能不如英语好。Llam3 是在 2 个 24K GPU 集群上进行训练的,差不多5 万块 GPU,不是一般公司搞得起的。

我本地安装了 8B,能理解中文,但是回答还不是中文,可以让他翻译成中文。

也可以给他 Promote 让他用中文说,速度挺快的。

Meta 官方也有体验的网页,国内用不了,用 Ollama 下载 8b 的模型先玩玩。

相关推荐
skywalk816343 分钟前
在星河社区部署大模型unsloth/Llama-3.3-70B-Instruct-GGUF
llama·aistudio
鹿子沐1 小时前
LlamaFactory微调效果与vllm部署效果不一致
人工智能·llama
三千院本院1 天前
LlaMA_Factory实战微调Qwen-LLM大模型
人工智能·python·深度学习·llama
珊珊而川1 天前
MAC-SQL:SQL-Llama 的具体训练流程
sql·macos·llama
共绩算力2 天前
Llama 4 Maverick Scout 多模态MoE新里程碑
人工智能·llama·共绩算力
yanzhilv3 天前
Ollama + Open WebUI
llama
喜欢吃豆4 天前
掌握本地化大语言模型部署:llama.cpp 工作流与 GGUF 转换内核全面技术指南
人工智能·语言模型·架构·大模型·llama·llama.cpp·gguf
illuspas6 天前
Ubuntu 24.04下编译支持ROCm加速的llama.cpp
linux·ubuntu·llama
缘友一世9 天前
LLama3架构原理浅浅学学
人工智能·自然语言处理·nlp·transformer·llama
我们没有完整的家10 天前
批量吞吐量实测:Llama-2-7b 昇腾 NPU 六大场景数据报告
llama