AI 软件简报 07.29-08.02:OpenAI 降价 80%、DeepSeek 全开源、欧盟动刀

AI 软件简报 07.29-08.02:OpenAI 降价 80%、DeepSeek 全开源、欧盟动刀

每期覆盖 3-4 天的 AI 软件动态。个人视角,不追求面面俱到。周三、日更新。

过去四天(7.29-8.2),价格、开源、监管三条线在同一个节点撞上了。OpenAI 把 GPT-5.6 预算档 Luna 的 API 价格砍掉 80%,DeepSeek 把 V4 Flash 正式版用 MIT 许可全量开源、还挂上了国家超算平台,欧盟 AI Act 在今天正式动刀。单看每一件都够写一篇长文;串起来看,AI 软件层的竞争已经从"谁更强"换成了"谁更便宜、更开放、更可信"。


OpenAI 砍价 80%,这不是促销,是重新定义定价

7 月 30 日,OpenAI 对刚发布三周的 GPT-5.6 家族动手了。预算档 Luna:输入从 1 降到 0.20,输出从 6 降到 1.20,砍了八成。中档 Terra 降 20%。旗舰 Sol 价格不动,但加了个 "Fast Mode"------速度达 2.5×,价格为双倍(10/60)。

反常的是,OpenAI 把降价原因归给了 Sol 自己。他们说 Sol 在生产环境里"自主重写 GPU 内核",把服务成本砍掉两成;再叠加投机解码,token 生成效率再提 15%。模型自己优化自己,这在半年前还只是论文里的故事。

我原以为模型定价会维持在"能力分层"的稳态:贵的负责聪明,便宜的负责跑量。这周 OpenAI 用 Luna 的价格直接贴到 DeepSeek 的脸上------0.20/1.20 对 0.14/0.27,几乎贴身。

我判断:三个月内会有一波跟价。A Anthropic 的 Sonnet 5 推广价 8 月 31 日到期,标准价 3/15 是 Luna 的 12.5 倍。要么它推年度折扣缓冲,要么这轮价格战的下一刀就砍在它身上。

DeepSeek V4 Flash:13B 激活参数,MIT 全开源

7 月 31 日 DeepSeek 发布 V4-Flash-0731,8 月 2 日上线国家超算互联网平台。规格:284B 总参数 MoE,推理只激活 13B,1M 上下文,权重 167GB,MIT 许可。官方说它在 9 项 Agent 基准上全面超过自家 V4 Pro 预览版,8 个维度上赢过 GLM-5.2。

这个模型的关键不在参数总量,在激活参数。

13B 激活意味着什么?单卡能跑。对比 Kimi K3 那 104B 激活、需要 64 张以上加速卡的部署门槛,V4 Flash 是把"开源"从口号变成"开箱即用"的一步。MIT 许可也比 Kimi K3 的分层商业许可更松------协议竞争也在升级。

同周开源的还有三座大山:华为 openPangu-2.0-Pro(505B MoE,全链路昇腾 NPU 训练,512K 上下文)、LG K-EXAONE 2.0(750B,Apache 2.0,韩国主权 AI 双雄之一)、中国气象局的"风和"(全球头一个千亿级开源气象大模型,智谱联研)。B 中国开源模型累计下载量破 100 亿次、占全球四成以上,开源一侧的供给已经过剩。

过剩的结果是价格。DeepSeek V4 Flash API 只要 0.14/0.27。OpenAI 的降价与其说是主动,不如说是被这些数字逼的。

欧盟 AI Act 今天动刀:罚款、召回、机读标记

8 月 2 日,欧盟 AI Act 两套规则正式生效。Article 50 透明性先落地:聊天机器人必须明示"你在和 AI 说话",深度伪造必须标注,AI 生成内容要带机器可读标记(8 月 2 日前上市的给到 12 月 2 日宽限)。GPAI 执法权同步到位:AI 办公室可以要求模型商交文档、做安全评估、责令整改,罚款上限为全球年收入的 3% 或 €1500 万。

180 多个组织签了欧盟的《AI 生成内容透明度行为准则》,牛津的 Alessandro Abate 教授被任命为首席科学顾问。

监管不是今天才开始,但罚款的权力是今天才到手的。AI 办公室只有约 40 人,注定是选择性执法。谁会是头一个被开刀的对象?我赌大概率不是牌面顶级的明星公司,而是某个态度散漫、撞在枪口上的中腰部玩家------杀鸡儆猴,成本便宜。

假 Agent 正在投毒,AI 编程工具会主动推荐

这周让我后背发凉的不是监管,是安全研究机构曝光的 "AgentBaiting" 行动:约 7600 个恶意 GitHub 仓库里,有 800 多个伪装成 AI Skills 或 MCP 服务器------假冒的 walmart-mcp、databricks-mcp-server、jenkins-mcp-server,还有伪造的 awesome-claude-skills 副本。累计下载超过 1400 万次,通过 ZIP 包投递 SmartLoader/StealC 恶意软件。

反常的是:Claude Code、Gemini、ChatGPT 在开发者问"帮我找个 skills 仓库"时,会直接把这些恶意仓库当推荐结果吐出来。Agent 工具信任了搜索结果,开发者信任了 Agent 工具,恶意软件就这样进了供应链。

这一点数据不够,先不下结论。但 1400 万次下载是个信号:Skills 和 MCP 仓库越是爆发式增长,投毒的面就越大。给所有在跑 Agent 工作流的团队一个建议:来源校验和沙箱,现在就该装了。


一句话速览

  • Simon Willison 一天发三个 MCP 工具:mcp-explorer、datasette-mcp、llm-mcp-client。无状态化的 MCP 2.0 让他重新入坑。A
  • GitHub 周趋势压在"Agent 控制平面":Grok Build(xAI 开源编码 CLI)、OpenWiki(LangChain)、OmniRoute(35.5K★,一周 +27.5%)。
  • arXiv 三天三篇 KV Cache 论文:选择性 KV 传输(TTST 快 4.3×)、GPU 原生 KV 注入(TTFT 降 72-79%)、预测性预取(吞吐 +2.62×)。长上下文的内存墙在被打。
  • OpenAI 内部模型 "Astra" 单题不到 $2000 解开十道数学难题,Lean 4 形式化证明挂在 openai/ten-proofs。单一来源,我保留判断。
  • 8 月 1 日两个 $13M A 轮:语音 AI 的 Smallest.ai、AI 安全的 Discern Security。安全赛道融资和投毒事件同步升温。
  • 框架四连发,AutoGen 正式退役:LangGraph 1.2.10、AG2 1.0.0、Microsoft Agent Framework 1.13.0、CrewAI 1.15.10 密集发版,微软官方把 AutoGen 划进维护模式。

本周趋势

上图:本周 AI 软件三大主线------降价、开源、监管在 8 月 2 日交汇。

三条主线:(1) 价格战从"能力分层"进入"成本绞杀",OpenAI 降价、DeepSeek 开源、Anthropic 被动;(2) 开源供给过剩,竞争焦点从参数规模转向部署成本与许可宽松度;(3) Agent 生态在爆发的同时暴露供应链投毒风险,安全从"合规问题"变成"生存问题"。

我的判断

接下来两周盯三件事:Anthropic 在 Sonnet 5 促销价到期前会不会降价;欧盟 AI 办公室的头一个执法对象是谁;以及 DeepSeek V4 Flash 的单卡部署会不会带起一波小模型私有化部署潮。我预判第三件大概率发生------当 13B 激活参数的模型在 Agent 基准上赢过自家 Pro 旗舰时,"必须买大模型 API"的假设就松动了。


AI 辅助调研,人工视角解读。 每周三、日更新。

相关推荐
老金带你玩AI5 小时前
这几天,我都是拿手机让dot帮我干活
人工智能
7yewh8 小时前
SLAM 三维空间刚体运动(2)
数据结构·人工智能·机器人·嵌入式·slam
miofly8 小时前
Aleph Alpha 开源 78B 参数 MoE 模型 Kolibri
开源·github
小虎AI生活8 小时前
WorkBuddy 模型选型实操:0.03 倍的 Space-Bunny 怎么用、派什么活、避什么坑
人工智能·超级个体·一人公司·青玥ai
ai小陈8 小时前
GPU服务器租用存储验收:检查点写入与磁盘吞吐实战
运维·服务器·人工智能·ai·ssh·gpu算力
微三云马玮均—GEO源码系统 私有化部署8 小时前
消费返物业费:消费+服务趋势的必然产物!
大数据·人工智能·物联网·区块链·生活
bigdata-余建新8 小时前
week10
ai
明月_清风8 小时前
Muse 登顶 App Store 第一,SDK 直接开源:AI Agent 开始进入下一个阶段
人工智能·后端
JackSparrow4149 小时前
和AI一起将全部CSDN博文迁移到个人博客站
人工智能·程序人生·ai·github·cloudflare·astro·静态博客