开创先河!o3和o4-mini居然能在思维链思考图片,太逆天了!

凌晨1点,OpenAI的重头戏来了!

终于是把之前鸽了很久的满血版o3发布出来了,还有一个新的模型o4-mini。

先说一个最让我感觉牛*的功能,o3和o4-mini居然能进行视觉推理了。

可能大家一时还不太理解,给大家看几个例子。

博主@数字生命卡兹克让o3看图猜地理位置,虽然这道题平平无奇,但你如果看到它的推理过程,绝对直呼牛逼。

扔给o3一张图片,让它猜这是哪里?

大家请看它的推理过程,就非常离谱,它居然在思维量里面带图片了。

它一点一点到放大图片,如何进行思考,如果思考方向不对,果断换方向思考。

之前的模型在思考的时候,通常都是文字,而且一大堆,阅读难度高,而现在大模型居然能把照片真正的融入到推理中(又是一项创新)。

再来揭晓一下答案,它给出的答案是北京市西部109国道妙峰山-斋堂-雁翅。

o3给出的回答正确,再来看一下它的推理过程,它居然是通过植被、地脉、道路、环境氛围等因素推断这里是妙峰山附近,就真的很离谱。

再来看另外一个例子,虽然是英文,但是整体很好理解,让o3解决桌子的那道题,它首先会去定位问题,然后一步一步把图片放大,直到把纸上的例题可以看清,最后给出经过推理给出答案。

此次OpenAI的o3和o4-mini的视觉推理给我冲击最大,这也意味着大模型开始真正的理解3D世界了,而不再是停留在文字上,此前关于OpenAI回答不出的空间问题,现在终于能解决了。

视觉思考也开始让模型可以像人类一样从图表、图形,甚至是对图像中提取信息、进行深度推理并解决问题。

除了视觉推理外,还有几个不错的亮点,o3开始可以使用工具了。

终于不像o1那样无法联网、不能使用代码解释器,当推理能力更强的o3再结合上OpenAI的这些工具,o3的能力将会再次拔高。

还有一个亮点就是o3和o4-mini性价比更高,在定价上,o3比o1的定价便宜了三分之一,o4-mini相比o3-mini没涨价。

大家在调用的时候该选谁,应该都清楚了吧,可以果断弃用o1了,毕竟o3好用还便宜。

老规矩,再给大家看一下o3的跑分成绩。

在Codeforces编程竞赛评分中,o3和o4-mini得分均超过了2700分,效果远超o1和o3-mini。

如果o3和o4-mini调用工具,它们的能力会进一步增强。

在OpenAI放出的专家综合考题中,显示不带插件的o3准确率约为20.3%,添上Python、网络浏览甚至调用多种工具后能推到24.9%。

相比之下,不带插件的o4-mini为14.3%,但借助插件也仅为17.7%,远不及o3。

这些纸面的成绩就不过多展示了,大家在其他博主也都可以看到。

最后,给大家看一些o3、o4-mini的实际表现。

目前,GPT-4o、o3、o4-mini都支持最新的生图功能,你只需要明确告诉ChatGPT你需要生成图片就行。比如在对话时,前缀加上 "请生成图片"。

让Gemini-2.5-Pro、o3、o4-mini与DeepSeek-R1进行测试碰撞球的物理效果。

已关注

**

关注

**重播 **分享 **赞

关闭**

观看更多

更多**

**

**

**

退出全屏

**

切换到竖屏全屏 退出全屏

AI工具导航站已关注

**

分享视频

**,时长00:07

0/0

00:00/00:07

切换到横屏模式

继续播放

进度条,百分之0

**

播放

00:00

/

00:07

00:07

全屏

**倍速播放中

0.5倍0.75倍1.0倍1.5倍2.0倍

超清流畅

您的浏览器不支持 video 标签

**

继续观看

开创先河!o3和o4-mini居然能在思维链思考图片,太逆天了!

观看更多**

转载

,

开创先河!o3和o4-mini居然能在思维链思考图片,太逆天了!

**

AI工具导航站已关注

分享点赞在看

****已同步到看一看写下你的评论

**

视频详情

o3的表现确实不错,但博主@牙医在经过测试完说:OpenAI o4-mini的编程能力不如Gemini-2.5 ,只排在第七位。

效果到底如何,还是得自己上手才知道,也欢迎大家在评论区发表一下自己的使用心得。

目前o3、o4-mini 和 o4-mini-high 已经推送到 ChatGPT。 Plus、Pro 和 Team 用户已可用,大家有会员的可以去体验一下。

如果大家还不知道如何订阅ChatGPT,可以看之前的文章。

相关阅读:国内用户如何订阅ChatGPT。

除了发布新模型外,OpenAI 这次还开源了一个新工具"Codex CLI"。

一个可以直接在终端(terminal)运行的轻量级AI编程助手,支持调用 o3 和 o4-mini 等模型。

目前该开源项目,已经斩获10000多颗小星星了。

开源地址: github.com/openai/code...

好了,今天的分享就到这里,欢迎大家来评论区激烈讨论!

相关推荐
Narutolxy3 小时前
大模型数据分析破局之路20250512
人工智能·chatgpt·数据分析
AIWritePaper智能写作探索15 小时前
高质量学术引言如何妙用ChatGPT?如何写提示词?
人工智能·chatgpt·prompt·智能写作·aiwritepaper·引言
江鸟199821 小时前
AI日报 · 2025年05月11日|传闻 OpenAI 考虑推出 ChatGPT “永久”订阅模式
人工智能·gpt·ai·chatgpt·github
知来者逆1 天前
AI 在模仿历史语言方面面临挑战:大型语言模型在生成历史风格文本时的困境与研究进展
人工智能·深度学习·语言模型·自然语言处理·chatgpt
AI Echoes2 天前
大模型(LLMs)强化学习——RLHF及其变种
人工智能·深度学习·算法·机器学习·chatgpt
没有梦想的咸鱼185-1037-16633 天前
【大语言模型ChatGPT4/4o 】“AI大模型+”多技术融合:赋能自然科学暨ChatGPT在地学、GIS、气象、农业、生态与环境领域中的应用
人工智能·python·机器学习·arcgis·语言模型·chatgpt·数据分析
yibuapi_com3 天前
Embedding 的数学特性与可视化解析
chatgpt·架构·langchain·embedding·claude·向量数据库·中转api
鸿蒙布道师3 天前
ChatGPT深度研究功能革新:GitHub直连与强化微调
人工智能·深度学习·神经网络·自然语言处理·chatgpt·数据挖掘·github
没有梦想的咸鱼185-1037-16634 天前
【大模型ChatGPT+ArcGIS】数据处理、空间分析、可视化及多案例综合应用
人工智能·arcgis·chatgpt·数据分析
虎头金猫4 天前
如何解决 403 错误:请求被拒绝,无法连接到服务器
运维·服务器·python·ubuntu·chatgpt·centos·bug