不错不错!GPT6.1Sol的测试结果来了!

今天,给Codex和GPT用户带来一个好消息! GPT6.1SOL"性价比"确实还可以!

最近,OpenAI 最近各种骚操作啊。

据说要推出 500 美金的套餐,但是配额和 200 美金差不多。而 200 美金自然疯狂缩水了!

自从 GPT-6 推出以来,我的 Plus 也是基本不可用的状态,几句话就用完。

另外能力方面也不如 Anthropic Claude 5.5 系列!

一时间,"真香"Codex 变"臭了"!

但是,我知道用 ChatGPT 的人还是挺多的,包括我自己也一直都是订阅会员。

所以测一下 GPT-6.1 Sol 还是非常有必要的!

看看这个能否成为未来的主力模型。

大家的关注应该聚焦在两个点上: 能力怎么样?配额怎么样?

今天我就来实测一下,来给大家做个参考!

我已经做好清空 Plus 弹夹的准备!

这是我开始前的配额情况!五小时100%,周配额94%!

开始之前,先简单介绍下GPT-6.1 Sol,它主打的就是性价比!

官方的推文是这么描述的:

GPT-6.1 Sol:以五分之一的价格实现近乎 Astra 级别的智能。 它是当今性能最优的性价比最高模型。

这里说的是能力接近 Astra,价格五分之一,最高性价比!

官方想表达的核心关键词就是"性价比"!

它的第二条推文还是在讲性价比:

第三条推文还是在讲性价比:

好吧,它的整个发布报告基本上没有关于能力的基准数据,全是单任务消耗多少钱的图。 主打一个: "性价比" !

好像没必要再介绍其他内容了。

价格已经很清晰了,就是和 Sonnet5.5 差不多,只有 Astra 的五分之一!

重点就是性能了,另外就是套餐的消耗情况了。

下面就来看看具体的效果吧!

赛博清明上河图

我就不长篇大论了,直接上结果:

审美非常在线,细节也非常丰富,线条轮廓都很好,空间感也体现出来了!

这个画面风格和 Astra 很像,GPT 好像都是这个风格。

Astra 当时的结果 3D 感更强,或者说立体感更强。

主要的问题:

风格融合不行,无法体现赛博朋克风格。

另外其实空间感也有点问题,比如它这个桥的摆放方向就很有问题!

还有整个卷轴中不同段落间内容差异并不大,有种千篇一律的感觉!

整体来说,也算是高水准了,可惜有些美中不足!

这个例子用时 17分钟!

天文机械表

我们还是直接上结果:

这个效果只能用一个词来表达:精美!

基本上没啥毛病可以挑哦!

这里写代码的时候遇到了一个小问题,就是我的提示词中有"只输出代码,不要解释的内容,保持单文件"。然后它直接在对话框里输出代码了。

我的意图肯定是说,让它把代码输出到文件中的!

我是在用 Agent,又不是 Chat。

这一部分,可能由于存在歧义,它没有做得很好。之前的测试基本上没遇到过这种情况。

这个例子用时 34分钟!

游戏复刻

创意、空间感、审美、注意力都考了,接下来放松一下。来给我搞个游戏吧。

按照惯例让它复刻一个《超级玛丽》!

最终结果如下:

整体来说还原度很高!地图、角色、道具、玩法、隐藏内容,都做到了高度还原!

唯一的问题就是:逆行的"乌龟" !

一个大屁股朝着我们顶过来。我也用屁股对着他。

这个很搞笑,但是无伤大雅!

然后我看了一下开发过程,节奏很好!

从开发过程中可以清楚地看到,它已经掌握了所有的关键素材!

光这一张图,已经包含了角色相关的所有内容了!

聪明的模型就是思路清晰,有些傻乎乎的模型,让它抄,也找不到关键点!

我发现Claude和GPT6新一代模型,开发节奏都非常好。

自己看截图看效果也很积极,而且定位很精准!

这个例子用时32分钟!

这里多说一句:相比国产模型效率还是很高的,极具性价比!

我测过一些国产模型,动不动就是一个小时,3个小时,甚至6个小时,当然也有例外的,比如龙猫特别快,但是结果没法看。

从这个角度来看:6.1Sol是非常出彩了!既快又好!

甲维斯的车库

下面来看一下网页复刻和 3D 建模这一题!

效果如下:

网页复刻效果自然是没问题的。布局、配色、组件、内容都是 OK 的!

3D 建模部分也不错,感觉好像和 Astra 差别确实不大!

其次车子的建模部分,大致的轮廓都在了,但是细节还有很大的提升空间!

钢铁侠战甲的建模还是比较 "抽象" !

Opus5.5 的建模比较细腻厚重,GPT-6 的整体渲染效果属于轻量级的!

看来这个例子还有很大提升空间,等待新模型来刷新。

这个例子用时39分钟!

落叶模拟

另外我也试了一下一个新例子。

就是直接通过参考视频,制作一个模拟树叶变黄掉落的动态效果。

结果如下:

整体来说,美感是到位的,有点像画的感觉!

但是树的轮廓、落叶效果差点意思,没有把这个重点做得很细腻,很逼真。

它的树叶掉落太慢了,我估计得看好几个小时才能看完,也无法测试那种几百上千片叶子一同飘落的性能表现。 从效果来看,应该是系统消耗较低,也导致拟真度不够。

这个例子用时28分钟!

整体来说,对Codex和GPT用户是个好消息!

6.1Sol的整体感觉确实比较接近Astra,然后Plus套餐里面用起来,也挺经用的。

我本来都准备好2~4个例子直接清空弹夹(五小时配额),没想到搞完5个例子还剩56%!

周配额从94%掉到87%。 从这个消耗来看,应该是能打过Claude Pro套餐的(用Sonnet5.5的情况下)。

我sonnet5.5跑了一批例子,也是50~60%的样子。 Claude一周的五小时周期会比Codex多几个。

好消息,Sonnet5.5和6.1Sol 都是用得起的感觉!比价有性价比。

基础问题都能处理,就是开放性问题不知道差异有多大。

这个我得测一测才知道,慢慢来。现在有一个巨大的问题,就是我的Claude已经接近用完的状态了~~~!

开发"秋名山车神",消耗我太多配额了!

最后我把所有例子都做成了一个视频。大家可以看一下:

视频地址!

所有测试结果很快我也会上传到网站上:

topai.jarvisuni.com/

GPT 6 Astra, Claude5.5 Sonnet5.5 ,相关的例子已经上传了!

相关推荐
threerocks1 小时前
【FDE 实战课|第 02 讲】为什么模型越强,越需要有人进现场
人工智能·aigc·ai编程
木头科技1 小时前
【AI 工程化第五篇】Spring AI Agent 生产治理实战:限流、熔断、降级、灰度、多模型路由和安全边界
人工智能·安全·spring
陆卿之2 小时前
Java对接DeepSeek
java·开发语言·人工智能
Leo.yuan2 小时前
企业可信Data Agent怎么建:可信分析智能体(Traceable Analytic Agent)的分析链路与验证机制
大数据·人工智能·机器学习
u1301302 小时前
AI 日报(2026年9月23日)
人工智能
想带你从多云到转晴2 小时前
LLM/AI应用八股
人工智能·chatgpt
QY_Research_2 小时前
2026-2032年个人安全警报装置市场分析 CAGR4.7% 产业全景报告
大数据·人工智能·安全
AI行业说2 小时前
针织 T 恤、运动套装电脑模板机选型与落地指南
大数据·人工智能·机器人·自动化·智能模板机
数字融合2 小时前
透明化数字孪生智慧养老平台运维服务项目
人工智能·python·virtualenv