OpenAI的新AI机器人gpt-4o-latest在LMSYS跑分中重新夺回第一名

上周,OpenAI 发布了其最新的前沿模型,正式命名为 gpt-4o-2024-08-06,该新模型在API中支持结构化输出。昨天,OpenAI出人意料地宣布了另一个名为chatgpt-4o-latest的新前沿模型。虽然OpenAI仍建议开发人员将gpt-4o-2024-08-06用于大多数API使用,但chatgpt-4o-latest模型将允许开发人员测试OpenAI在聊天用例方面的最新改进。

根据OpenAI的官方文档页面,chatgpt-4o-latest将是一个动态模型,将不断更新到ChatGPT中GPT-4o的最新版本。新的chatgpt-4o-latest模型支持128000个标记和16384个输出标记的上下文。该模型仅用于研究和评估。

上周,Google在LMSYS聊天机器人跑分系统中上架了一款新的实验性Gemini 1.5 Pro模型,以1297分的成绩夺得第一名。这是自聊天机器人竞技场发布以来,Google首次登顶。凭借最新的聊天gpt-4o模型,OpenAI以1314分的创纪录成绩重新夺回竞技场第一的位置。根据得分,新的ChatGPT-4o在编程、指令执行和硬提示方面都有显著提升。

LMSYS聊天机器人竞技场中新的ChatGPT-4o类别排名:

综合:第一名

数学:第1-2名

编程:第一名

硬提示:第一名

指令遵循:第一名

较长的查询:第一名

多轮:第一名

这款最新的聊天gpt-4o模型自上周以来一直在为OpenAI的ChatGPT提供支持。如果您注意到ChatGPT的响应在过去一周有所改进,可以肯定地说,这是因为有了新的模型。

OpenAI最近宣布了2024年开发者大会(DevDay 2024)的消息,该大会将在全球三个城市举行。在宣布消息时,OpenAI明确表示不会在这些活动中透露他们今年早些时候开始训练的下一个重大前沿模型。相反,这些开发者活动将专注于API和开发工具的改进。

感谢大家花时间阅读我的文章,你们的支持是我不断前进的动力。期望未来能为大家带来更多有价值的内容,请多多关注我的动态!

相关推荐
测试者家园38 分钟前
为什么意图驱动测试是自动化测试的下一站,而不是替代品
自动化测试·软件测试·人工智能·持续测试·ai赋能·智能化测试·软件测试变革
D202020202 小时前
TikTok Shop禁止AI语音直播落地后,跨境卖家如何通过达秘合规调整带货内容
人工智能
像风一样自由20202 小时前
20.Milvus常见问题检索不到维度错误和数据一致性
人工智能·大模型·milvus
现代野蛮人2 小时前
【深度学习实验】—— 基于 LSTM 与 Optuna 调参的丙型肝炎预测
人工智能·深度学习·lstm
支支დ2 小时前
VO by Vercel 前端特定优势:为什么它是构建 AI 应用的新范式
前端·人工智能
ZGIAI3 小时前
ZGI 让那些"等你去处理"的事,真正跑起来
人工智能·架构
ZGIAI3 小时前
ZGI:别再做Agent Demo了,先问问它在业务里能不能撑过下周三
人工智能·架构
香芋芋圆3 小时前
AI 冲击内卷之下,普通前端如何破局?WebGIS—— 低门槛突围赛道
前端·javascript·人工智能·学习·职场发展
m0_614523553 小时前
完整教程|输入一句描述,能不能直接生成一段可以继续剪辑的视频:写结构化描述到生成短样片
人工智能·音视频
stormzhangV3 小时前
AGI 时代终于来了!
人工智能·openai