DeepSeek终于上新,GPT大降价,智谱GLM大涨价!

我已经沉迷"AI 游戏"好几天没发文章了,今天周五,有几个事情凑在一起了,我们可以来聊几句!

今天最大的 AI 新闻自然是"DeepSeek Flash 正式版了"!

很多模型的正式版和预览版几乎没啥差别,但是 DeepSeek 这个正式版相比预览版有巨大的提升。

官方描述是:

Agent 能力大幅增强,基准测试远超 V4-Pro-Preview

具体的基准数据如下:

  • Terminal Bench 2.1: 82.7
  • NL2Repo: 54.2
  • Cybergym: 76.7
  • DeepSWE: 54.4
  • Toolathlon verified: 70.3
  • Agent Last Exam: 25.2
  • Automation Bench (Public): 25.1
  • DSBench-FullStack: 68.7
  • DSBench-Hard: 59.6

单看这个数据可能不明显,把预览版、GLM 5.2、Opus 4.8 放在一起就明显了!

从图中可以非常清晰地看到,这次的 Flash 确实非常强!

首先是在多个基准中,全面领先自家的 Pro 和 Flash 预览版。注意是 Flash 比 Pro 还强哦~~离谱!

其次,多项基准都要比 GLM 5.2 强!

最后,和 Opus 4.8 比起来都还差点意思!

通过这几个对比,可以看出正式版的 Flash 提升巨大。

这里还有一个让人很迷惑的事情,前段时间感觉 GLM 5.2 都能和 Fable 5 去掰手腕了,为啥现在一看都不如 Opus 4.8,这到底是哪里出现了问题!

GLM 5.2 发布的时候好像全世界都在聊,然后是 K3,然后很快又没人聊起了。

说实话,各种模型一轮又一轮,其实最终大家还是看"性价比",而不是看"吹牛逼"

说起价格,不得不提另外两家了。几乎在同一时间,它们大幅调整了产品的价格!

一家是国外用户最多的 OpenAI,它们宣布大降价了!

一家是国内非常有名的智谱,它们套餐大涨价了!

OpenAI 的 GPT 5.6 系列价格调整如下:

模型 原价格 新价格 降幅
GPT-5.6 Luna 输入 1/百万Token,输出1 / 百万 Token,输出 1/百万Token,输出6 / 百万 Token 输入 0.20,输出0.20,输出 0.20,输出1.20 ↓80%
GPT-5.6 Terra 输入 2.50,输出2.50,输出 2.50,输出15 / 百万 Token 输入 2,输出2,输出 2,输出12 ↓20%
GPT-5.6 Sol 输入 5,输出5,输出 5,输出30 / 百万 Token 不变 0%

Luna 这一款降价幅度还是很大的,这个价格比不少国产模型都便宜了!

OpenAI 主要是 API 价格降了,理论上订阅套餐月费不变,Tokens 会同步变多,变得更耐用!

然后我们再来看看智谱,智谱是改了 CodingPlan 的规则和价格!

原版价格是这样的:

新版价格是这样的:

算术好的可以来看看,这是涨了多少?不是涨了多少,而是直接涨了多少倍!

而且现在改成了积分制,也不知道这个积分能顶多久,具体是多少 Tokens?

智谱的编程计划已经改过很多次,我的套餐也被动升级过好多次了,现在这个价格是真的有点贵了,续不起了

虽然价格调整是市场行为,但是作为用户,同样的东西,便宜了就很开心,涨了真的是想骂人!

我们花真金白银购买一个套餐,其实有一个默认的契约在那里,动不动调整套餐,收缩配额,涨价,会让人很讨厌。

智谱最早配额方面是对标 Claude,说的都是 Claude 的多少倍。现在直接改成积分制了,也不确定 Tokens 有多少。Claude 最近已经加了好几次配额了,感觉上是不少的。我最近大致算了一下,它 20 美金的 Pro,一周配额应该在 8~10 亿左右。

这个时候我又联系起了另外两款产品。

一个是Trae Pro,当时刚买了一年会员立马就背刺,Cladue3.7没了,然后规则也是改了又改,现在基本上没法用了。

另一个是Kimi,它单纯就是Tokens少的要命!49就的套餐根本没法用,买了99的照样秒没,听说199也不咋滴。只有$199够我用,但是太贵了。

完蛋了,国外的 GPT 和 Claude 越来越有"性价比"了!

美国老太爽了,只要花"20 块钱"就能买这么多。我们花 "20 快钱"已经买不到任何套餐了!

还好,有 DeepSeek!Flash 还是非常有性价比的!

DeepSeek 是直接 API 调用,无任何套路,价格很便宜,东西也还不错。如果我要做一个应用,需求不是太复杂的,我肯定首选 DeepSeek Flash,又快又便宜。这一次性能大幅提升,价格不变,那么用户又赚到了,缺陷是还没有视觉能力

国产模型多少都是有一些问题!

我几乎所有国产模型都支持过了,但是它们所有人都背刺我,各种变套餐;各种问题,要么没有多模态,要么Tokens少的不行,要么能力弱的不行,要么发挥极其不稳定。只有GPT和Claude买了之后就好几年也没变过价格,而且模型发挥稳定,而且也一直在快速升级,能力嘛绝对顶级水平!

综合来看,我个人开发用的话还是GPT和Claude凑合一下吧😄 要性价比的话可以搞个Grok4.5!

相关推荐
爱研究的小梁15 小时前
多链路聚合通信:时延控制与网络波动对抗逻辑梳理
网络·人工智能·信息与通信
IT_陈寒15 小时前
Vite静态资源路径这个坑差点让我加班到凌晨
前端·人工智能·后端
颜酱15 小时前
15 | 安全执行 SQL 并返回查询结果
人工智能
新芒15 小时前
海尔洗衣机智慧洗护:AI赋能洗烘护全面进化
人工智能
掘金酱15 小时前
「TRAE Work 实战帮」征文启动!你沉淀的经验,值得被看见!
前端·人工智能·后端
颜酱15 小时前
14 | 验证并修正 LLM 生成的 SQL
人工智能·python
AI创界者15 小时前
AIGC进阶】Sulphur-2 视频生成大模型离线实战:文生视频/图生视频本地一键部署整合包解压即用与调优指南
人工智能·aigc·音视频
颜酱16 小时前
13 | 使用 LangChain 生成 SQL
人工智能·python·langchain
LDZKKJ16 小时前
OpenAI暂停GPT-6训练:AI行业从“竞速“到“刹车“的分水岭
人工智能·gpt·语言模型·chatgpt·transformer