今天,给Codex和GPT用户带来一个好消息! GPT6.1SOL"性价比"确实还可以!
最近,OpenAI 最近各种骚操作啊。
据说要推出 500 美金的套餐,但是配额和 200 美金差不多。而 200 美金自然疯狂缩水了!
自从 GPT-6 推出以来,我的 Plus 也是基本不可用的状态,几句话就用完。
另外能力方面也不如 Anthropic Claude 5.5 系列!
一时间,"真香"Codex 变"臭了"!
但是,我知道用 ChatGPT 的人还是挺多的,包括我自己也一直都是订阅会员。
所以测一下 GPT-6.1 Sol 还是非常有必要的!
看看这个能否成为未来的主力模型。
大家的关注应该聚焦在两个点上: 能力怎么样?配额怎么样?
今天我就来实测一下,来给大家做个参考!
我已经做好清空 Plus 弹夹的准备!

这是我开始前的配额情况!五小时100%,周配额94%!
开始之前,先简单介绍下GPT-6.1 Sol,它主打的就是性价比!

官方的推文是这么描述的:
GPT-6.1 Sol:以五分之一的价格实现近乎 Astra 级别的智能。 它是当今性能最优的性价比最高模型。
这里说的是能力接近 Astra,价格五分之一,最高性价比!
官方想表达的核心关键词就是"性价比"!
它的第二条推文还是在讲性价比:

第三条推文还是在讲性价比:

好吧,它的整个发布报告基本上没有关于能力的基准数据,全是单任务消耗多少钱的图。 主打一个: "性价比" !
好像没必要再介绍其他内容了。
价格已经很清晰了,就是和 Sonnet5.5 差不多,只有 Astra 的五分之一!
重点就是性能了,另外就是套餐的消耗情况了。
下面就来看看具体的效果吧!
赛博清明上河图
我就不长篇大论了,直接上结果:

审美非常在线,细节也非常丰富,线条轮廓都很好,空间感也体现出来了!
这个画面风格和 Astra 很像,GPT 好像都是这个风格。
Astra 当时的结果 3D 感更强,或者说立体感更强。
主要的问题:
风格融合不行,无法体现赛博朋克风格。
另外其实空间感也有点问题,比如它这个桥的摆放方向就很有问题!
还有整个卷轴中不同段落间内容差异并不大,有种千篇一律的感觉!
整体来说,也算是高水准了,可惜有些美中不足!
这个例子用时 17分钟!
天文机械表
我们还是直接上结果:

这个效果只能用一个词来表达:精美!
基本上没啥毛病可以挑哦!
这里写代码的时候遇到了一个小问题,就是我的提示词中有"只输出代码,不要解释的内容,保持单文件"。然后它直接在对话框里输出代码了。

我的意图肯定是说,让它把代码输出到文件中的!
我是在用 Agent,又不是 Chat。
这一部分,可能由于存在歧义,它没有做得很好。之前的测试基本上没遇到过这种情况。
这个例子用时 34分钟!
游戏复刻
创意、空间感、审美、注意力都考了,接下来放松一下。来给我搞个游戏吧。
按照惯例让它复刻一个《超级玛丽》!
最终结果如下:

整体来说还原度很高!地图、角色、道具、玩法、隐藏内容,都做到了高度还原!
唯一的问题就是:逆行的"乌龟" !
一个大屁股朝着我们顶过来。我也用屁股对着他。
这个很搞笑,但是无伤大雅!
然后我看了一下开发过程,节奏很好!

从开发过程中可以清楚地看到,它已经掌握了所有的关键素材!

光这一张图,已经包含了角色相关的所有内容了!
聪明的模型就是思路清晰,有些傻乎乎的模型,让它抄,也找不到关键点!
我发现Claude和GPT6新一代模型,开发节奏都非常好。
自己看截图看效果也很积极,而且定位很精准!
这个例子用时32分钟!
这里多说一句:相比国产模型效率还是很高的,极具性价比!
我测过一些国产模型,动不动就是一个小时,3个小时,甚至6个小时,当然也有例外的,比如龙猫特别快,但是结果没法看。
从这个角度来看:6.1Sol是非常出彩了!既快又好!
甲维斯的车库
下面来看一下网页复刻和 3D 建模这一题!
效果如下:

网页复刻效果自然是没问题的。布局、配色、组件、内容都是 OK 的!
3D 建模部分也不错,感觉好像和 Astra 差别确实不大!

其次车子的建模部分,大致的轮廓都在了,但是细节还有很大的提升空间!

钢铁侠战甲的建模还是比较 "抽象" !
Opus5.5 的建模比较细腻厚重,GPT-6 的整体渲染效果属于轻量级的!
看来这个例子还有很大提升空间,等待新模型来刷新。
这个例子用时39分钟!
落叶模拟
另外我也试了一下一个新例子。
就是直接通过参考视频,制作一个模拟树叶变黄掉落的动态效果。
结果如下:

整体来说,美感是到位的,有点像画的感觉!
但是树的轮廓、落叶效果差点意思,没有把这个重点做得很细腻,很逼真。
它的树叶掉落太慢了,我估计得看好几个小时才能看完,也无法测试那种几百上千片叶子一同飘落的性能表现。 从效果来看,应该是系统消耗较低,也导致拟真度不够。
这个例子用时28分钟!
整体来说,对Codex和GPT用户是个好消息!
6.1Sol的整体感觉确实比较接近Astra,然后Plus套餐里面用起来,也挺经用的。

我本来都准备好2~4个例子直接清空弹夹(五小时配额),没想到搞完5个例子还剩56%!
周配额从94%掉到87%。 从这个消耗来看,应该是能打过Claude Pro套餐的(用Sonnet5.5的情况下)。
我sonnet5.5跑了一批例子,也是50~60%的样子。 Claude一周的五小时周期会比Codex多几个。
好消息,Sonnet5.5和6.1Sol 都是用得起的感觉!比价有性价比。
基础问题都能处理,就是开放性问题不知道差异有多大。
这个我得测一测才知道,慢慢来。现在有一个巨大的问题,就是我的Claude已经接近用完的状态了~~~!
开发"秋名山车神",消耗我太多配额了!
最后我把所有例子都做成了一个视频。大家可以看一下:

所有测试结果很快我也会上传到网站上:
GPT 6 Astra, Claude5.5 Sonnet5.5 ,相关的例子已经上传了!