性能直逼GPT4,Llama3的三种在线体验方式

周五凌晨,Meta发布了其最新的开源大语言模型Llama-3,据说性能直逼GPT-4。

前两天百度老板刚刚批了一下开源模型,说开源模型打不过闭源模型,没想到这么快就被打脸了。

自从Sora之后,OpenAI也好久没有发布震撼人心的能力了,可能遇到瓶颈了,GPT-5可能要等到年底了。

Llama3简介

Llama3是一个大型语言模型系列,它们是一组预先训练好的、专为对话场景优化的文本生成模型,目前包含80亿参数和700亿参数两种规格,两个规格均有预训练版和经过指令调优的版本可供选择。Llama3模型仅接收文本输入,模型仅生成文本和代码。

Llama3经过指令调优的模型在常见行业基准测试中,性能超越了许多现有的开源聊天模型。8B参数的性能甚至大幅超越了之前的Llama2-70B的性能,革了自己的命。

Llama 3采用自回归语言模型设计,运用了优化后的Transformer架构。经过调优的版本通过监督微调(SFT)和基于人类反馈的强化学习(RLHF),确保模型在助人与安全方面与人类偏好保持一致。

从目前可见的资料分析,Llama3不是一个混合模型,它的上下文只有8K,相比目前动辄200K的上下文有点上不了台面,不过最重要的还是准确性和精确性,大多数场景也用不上这么长的上下文,而且上下文长度应该可以通过微调或者其它技术来提升的。

线上体验地址

自己部署太麻烦了,对于大多数同学来说也没必要,分享几个在线测试地址,可以实际体验下效果。相信不久,国产大模型们就会遥遥领先了。

英伟达开发者网站

无需特殊网络设置,也不要登录,就能直接访问。

build.nvidia.com/explore/dis...

HuggingFace

huggingface.co/chat/ 需要先注册一个HuggingFace账号。

左侧选择模型,点击 Activate 激活模型,填写AI角色定义。

然后就可以和Llama3愉快的聊天了,不过Llama3的中文能力不太行,虽然看懂了中文,但是使用了英文来回答问题(即使我们要求它使用中文,也可能会随时输出英文),这还需要国内的企业或者社区再努力奋战若干天。

Llama官方

www.llama2.ai/

相关资源

官方Blog: ai.meta.com/blog/meta-l...

Github项目地址: github.com/meta-llama/...

模型下载地址:

相关推荐
我爱cope4 分钟前
【Agent智能体4 | 智能体AI的应用】
数据库·人工智能·职场和发展
song50112 分钟前
Ascend C 算子开发:从入门到上手
c语言·开发语言·图像处理·人工智能·分布式·flutter·交互
yzx99101312 分钟前
超越向量检索:用 Graph RAG 构建具备推理能力的企业知识问答系统
人工智能·自动化
sunneo13 分钟前
02-大模型选型的产品视角(系列四-AI产品战略)
人工智能·产品运营·aigc·产品经理·ai-native
这是谁的博客?20 分钟前
AI Agent 架构设计与实现原理深度解析
人工智能·ai·langchain·agent·架构设计
勾股导航30 分钟前
DQN算法
人工智能·强化学习
贵慜_Derek38 分钟前
《从零实现 Agent 系统》连载 07|记忆系统:短期上下文 vs 长期外部记忆
人工智能·设计模式·架构
星辰AI39 分钟前
LLM 安全与对齐技术:构建可信赖的人工智能
人工智能·ai·语言模型
圣殿骑士-Khtangc42 分钟前
CloakBrowser 深度解析:C++ 源码级反检测浏览器,Playwright 的终极替代品
人工智能
05候补工程师1 小时前
从算法理想向工程现实的跨越:SLAM 核心架构、思维误区与 Nav2 实战避坑指南
人工智能·算法·安全·架构·机器人