OpenAI的新AI机器人gpt-4o-latest在LMSYS跑分中重新夺回第一名

上周,OpenAI 发布了其最新的前沿模型,正式命名为 gpt-4o-2024-08-06,该新模型在API中支持结构化输出。昨天,OpenAI出人意料地宣布了另一个名为chatgpt-4o-latest的新前沿模型。虽然OpenAI仍建议开发人员将gpt-4o-2024-08-06用于大多数API使用,但chatgpt-4o-latest模型将允许开发人员测试OpenAI在聊天用例方面的最新改进。

根据OpenAI的官方文档页面,chatgpt-4o-latest将是一个动态模型,将不断更新到ChatGPT中GPT-4o的最新版本。新的chatgpt-4o-latest模型支持128000个标记和16384个输出标记的上下文。该模型仅用于研究和评估。

上周,Google在LMSYS聊天机器人跑分系统中上架了一款新的实验性Gemini 1.5 Pro模型,以1297分的成绩夺得第一名。这是自聊天机器人竞技场发布以来,Google首次登顶。凭借最新的聊天gpt-4o模型,OpenAI以1314分的创纪录成绩重新夺回竞技场第一的位置。根据得分,新的ChatGPT-4o在编程、指令执行和硬提示方面都有显著提升。

LMSYS聊天机器人竞技场中新的ChatGPT-4o类别排名:

综合:第一名

数学:第1-2名

编程:第一名

硬提示:第一名

指令遵循:第一名

较长的查询:第一名

多轮:第一名

这款最新的聊天gpt-4o模型自上周以来一直在为OpenAI的ChatGPT提供支持。如果您注意到ChatGPT的响应在过去一周有所改进,可以肯定地说,这是因为有了新的模型。

OpenAI最近宣布了2024年开发者大会(DevDay 2024)的消息,该大会将在全球三个城市举行。在宣布消息时,OpenAI明确表示不会在这些活动中透露他们今年早些时候开始训练的下一个重大前沿模型。相反,这些开发者活动将专注于API和开发工具的改进。

感谢大家花时间阅读我的文章,你们的支持是我不断前进的动力。期望未来能为大家带来更多有价值的内容,请多多关注我的动态!

相关推荐
美酒没故事°1 天前
Open WebUI安装指南。搭建自己的自托管 AI 平台
人工智能·windows·ai
云烟成雨TD1 天前
Spring AI Alibaba 1.x 系列【6】ReactAgent 同步执行 & 流式执行
java·人工智能·spring
AI攻城狮1 天前
用 Obsidian CLI + LLM 构建本地 RAG:让你的笔记真正「活」起来
人工智能·云原生·aigc
鸿乃江边鸟1 天前
Nanobot 从onboard启动命令来看个人助理Agent的实现
人工智能·ai
lpfasd1231 天前
基于Cloudflare生态的应用部署与开发全解
人工智能·agent·cloudflare
俞凡1 天前
DevOps 2.0:智能体如何接管故障修复和基础设施维护
人工智能
comedate1 天前
[OpenClaw] GLM 5 关于电影 - 人工智能 - 的思考
人工智能·电影评价
财迅通Ai1 天前
6000万吨产能承压 卫星化学迎来战略窗口期
大数据·人工智能·物联网·卫星化学
liliangcsdn1 天前
Agent Memory智能体记忆系统的示例分析
数据库·人工智能·全文检索
GISer_Jing1 天前
Page-agent MCP结构
前端·人工智能