[250415] OpenAI 推出 GPT-4.1 系列,支持 1M token

目录

    • [OpenAI 推出 GPT-4.1 系列](#OpenAI 推出 GPT-4.1 系列)

OpenAI 推出 GPT-4.1 系列

OpenAI 宣布,新一代 GPT-4.1 模型系列正式发布,包括 GPT-4.1, GPT-4.1 mini 和 GPT-4.1 nano 三款模型,该系列模型在各项性能指标上全面超越 GPT-4o 和 GPT-4o mini,尤其在代码能力和指令遵循方面取得了显著提升,目前仅支持通过 API 调用。

核心亮点:

  • 卓越性能: 在代码生成、指令遵循和长文本理解方面均有大幅提升。
  • 超强代码能力: 在 SWE-bench Verified 基准测试中,GPT-4.1 取得了 54.6% 的优异成绩,相比 GPT-4o 提升了 21.4%,成为领先的代码生成模型。
  • 精准指令遵循: 在 Scale 的 MultiChallenge 基准测试中,GPT-4.1 的得分达到 38.3%,相比 GPT-4o 提升了 10.5%。
  • 强大长文本处理能力: 支持高达 100 万 tokens 的上下文窗口,并在 Video-MME 基准测试中,以 72.0% 的成绩刷新了无字幕长文本理解的记录,相比 GPT-4o 提升了 6.7%。
  • 知识更新: 拥有截至 2024 年 6 月的最新知识库。
  • 更低成本,更高效率: 在保证卓越性能的同时,GPT-4.1 模型系列还具有更低的成本,在延迟方面也进行了优化。

GPT-4.1 是 4o 的升级,未来还会进一步优化。

来源:

https://openai.com/index/gpt-4-1/

更多内容请查阅 : blog-250415

相关推荐
大卫小东(Sheldon)1 小时前
斯梅尔问题(Smale's Problems)清单
数学·ai
怪奇云呼军1 小时前
闪电智能Voice Agent:ASR 首字延迟和最终识别延迟怎么测?t0-t3 埋点实战
人工智能·科技·ai·语音识别
码上解惑2 小时前
从 Dify 工作流说起:常用节点怎么选、怎样组合?
java·人工智能·ai·agent·dify·智能体·spring ai
平头哥~2 小时前
工伤认定赔偿纠纷实测 测评职场法务数字人工伤维权全流程讲解
ai·数字人
Ai拆代码的曹操4 小时前
源码拆解:opencode 如何封装 Git 实现自动 diff 和 review
openai·ai编程
Ai拆代码的曹操4 小时前
opencode 源码:工作单元的生命周期管理
openai·ai编程
小四的小六4 小时前
WebView 在 AI 时代的三个被低估的价值——从自己的 AI 产品里找到的答案
前端·openai·ai编程
卡卡罗特AI5 小时前
OpenAI模型,自主入侵顶级AI公司系统!后背发凉!
aigc·openai