性能直逼GPT4,Llama3的三种在线体验方式

周五凌晨,Meta发布了其最新的开源大语言模型Llama-3,据说性能直逼GPT-4。

前两天百度老板刚刚批了一下开源模型,说开源模型打不过闭源模型,没想到这么快就被打脸了。

自从Sora之后,OpenAI也好久没有发布震撼人心的能力了,可能遇到瓶颈了,GPT-5可能要等到年底了。

Llama3简介

Llama3是一个大型语言模型系列,它们是一组预先训练好的、专为对话场景优化的文本生成模型,目前包含80亿参数和700亿参数两种规格,两个规格均有预训练版和经过指令调优的版本可供选择。Llama3模型仅接收文本输入,模型仅生成文本和代码。

Llama3经过指令调优的模型在常见行业基准测试中,性能超越了许多现有的开源聊天模型。8B参数的性能甚至大幅超越了之前的Llama2-70B的性能,革了自己的命。

Llama 3采用自回归语言模型设计,运用了优化后的Transformer架构。经过调优的版本通过监督微调(SFT)和基于人类反馈的强化学习(RLHF),确保模型在助人与安全方面与人类偏好保持一致。

从目前可见的资料分析,Llama3不是一个混合模型,它的上下文只有8K,相比目前动辄200K的上下文有点上不了台面,不过最重要的还是准确性和精确性,大多数场景也用不上这么长的上下文,而且上下文长度应该可以通过微调或者其它技术来提升的。

线上体验地址

自己部署太麻烦了,对于大多数同学来说也没必要,分享几个在线测试地址,可以实际体验下效果。相信不久,国产大模型们就会遥遥领先了。

英伟达开发者网站

无需特殊网络设置,也不要登录,就能直接访问。

build.nvidia.com/explore/dis...

HuggingFace

huggingface.co/chat/ 需要先注册一个HuggingFace账号。

左侧选择模型,点击 Activate 激活模型,填写AI角色定义。

然后就可以和Llama3愉快的聊天了,不过Llama3的中文能力不太行,虽然看懂了中文,但是使用了英文来回答问题(即使我们要求它使用中文,也可能会随时输出英文),这还需要国内的企业或者社区再努力奋战若干天。

Llama官方

www.llama2.ai/

相关资源

官方Blog: ai.meta.com/blog/meta-l...

Github项目地址: github.com/meta-llama/...

模型下载地址:

相关推荐
love_and_hope1 分钟前
Pytorch学习--神经网络--搭建小实战(手撕CIFAR 10 model structure)和 Sequential 的使用
人工智能·pytorch·python·深度学习·学习
2403_8757368717 分钟前
道品科技智慧农业中的自动气象检测站
网络·人工智能·智慧城市
学术头条40 分钟前
AI 的「phone use」竟是这样练成的,清华、智谱团队发布 AutoGLM 技术报告
人工智能·科技·深度学习·语言模型
准橙考典41 分钟前
怎么能更好的通过驾考呢?
人工智能·笔记·自动驾驶·汽车·学习方法
ai_xiaogui44 分钟前
AIStarter教程:快速学会卸载AI项目【AI项目管理平台】
人工智能·ai作画·语音识别·ai写作·ai软件
孙同学要努力1 小时前
《深度学习》——深度学习基础知识(全连接神经网络)
人工智能·深度学习·神经网络
喵~来学编程啦2 小时前
【论文精读】LPT: Long-tailed prompt tuning for image classification
人工智能·深度学习·机器学习·计算机视觉·论文笔记
深圳市青牛科技实业有限公司2 小时前
【青牛科技】应用方案|D2587A高压大电流DC-DC
人工智能·科技·单片机·嵌入式硬件·机器人·安防监控
水豚AI课代表2 小时前
分析报告、调研报告、工作方案等的提示词
大数据·人工智能·学习·chatgpt·aigc
几两春秋梦_2 小时前
符号回归概念
人工智能·数据挖掘·回归