AI 软件简报 07.29-08.02:OpenAI 降价 80%、DeepSeek 全开源、欧盟动刀
每期覆盖 3-4 天的 AI 软件动态。个人视角,不追求面面俱到。周三、日更新。

过去四天(7.29-8.2),价格、开源、监管三条线在同一个节点撞上了。OpenAI 把 GPT-5.6 预算档 Luna 的 API 价格砍掉 80%,DeepSeek 把 V4 Flash 正式版用 MIT 许可全量开源、还挂上了国家超算平台,欧盟 AI Act 在今天正式动刀。单看每一件都够写一篇长文;串起来看,AI 软件层的竞争已经从"谁更强"换成了"谁更便宜、更开放、更可信"。
OpenAI 砍价 80%,这不是促销,是重新定义定价
7 月 30 日,OpenAI 对刚发布三周的 GPT-5.6 家族动手了。预算档 Luna:输入从 1 降到 0.20,输出从 6 降到 1.20,砍了八成。中档 Terra 降 20%。旗舰 Sol 价格不动,但加了个 "Fast Mode"------速度达 2.5×,价格为双倍(10/60)。
反常的是,OpenAI 把降价原因归给了 Sol 自己。他们说 Sol 在生产环境里"自主重写 GPU 内核",把服务成本砍掉两成;再叠加投机解码,token 生成效率再提 15%。模型自己优化自己,这在半年前还只是论文里的故事。
我原以为模型定价会维持在"能力分层"的稳态:贵的负责聪明,便宜的负责跑量。这周 OpenAI 用 Luna 的价格直接贴到 DeepSeek 的脸上------0.20/1.20 对 0.14/0.27,几乎贴身。
我判断:三个月内会有一波跟价。A Anthropic 的 Sonnet 5 推广价 8 月 31 日到期,标准价 3/15 是 Luna 的 12.5 倍。要么它推年度折扣缓冲,要么这轮价格战的下一刀就砍在它身上。
DeepSeek V4 Flash:13B 激活参数,MIT 全开源
7 月 31 日 DeepSeek 发布 V4-Flash-0731,8 月 2 日上线国家超算互联网平台。规格:284B 总参数 MoE,推理只激活 13B,1M 上下文,权重 167GB,MIT 许可。官方说它在 9 项 Agent 基准上全面超过自家 V4 Pro 预览版,8 个维度上赢过 GLM-5.2。
这个模型的关键不在参数总量,在激活参数。
13B 激活意味着什么?单卡能跑。对比 Kimi K3 那 104B 激活、需要 64 张以上加速卡的部署门槛,V4 Flash 是把"开源"从口号变成"开箱即用"的一步。MIT 许可也比 Kimi K3 的分层商业许可更松------协议竞争也在升级。
同周开源的还有三座大山:华为 openPangu-2.0-Pro(505B MoE,全链路昇腾 NPU 训练,512K 上下文)、LG K-EXAONE 2.0(750B,Apache 2.0,韩国主权 AI 双雄之一)、中国气象局的"风和"(全球头一个千亿级开源气象大模型,智谱联研)。B 中国开源模型累计下载量破 100 亿次、占全球四成以上,开源一侧的供给已经过剩。
过剩的结果是价格。DeepSeek V4 Flash API 只要 0.14/0.27。OpenAI 的降价与其说是主动,不如说是被这些数字逼的。
欧盟 AI Act 今天动刀:罚款、召回、机读标记
8 月 2 日,欧盟 AI Act 两套规则正式生效。Article 50 透明性先落地:聊天机器人必须明示"你在和 AI 说话",深度伪造必须标注,AI 生成内容要带机器可读标记(8 月 2 日前上市的给到 12 月 2 日宽限)。GPAI 执法权同步到位:AI 办公室可以要求模型商交文档、做安全评估、责令整改,罚款上限为全球年收入的 3% 或 €1500 万。
180 多个组织签了欧盟的《AI 生成内容透明度行为准则》,牛津的 Alessandro Abate 教授被任命为首席科学顾问。
监管不是今天才开始,但罚款的权力是今天才到手的。AI 办公室只有约 40 人,注定是选择性执法。谁会是头一个被开刀的对象?我赌大概率不是牌面顶级的明星公司,而是某个态度散漫、撞在枪口上的中腰部玩家------杀鸡儆猴,成本便宜。
假 Agent 正在投毒,AI 编程工具会主动推荐
这周让我后背发凉的不是监管,是安全研究机构曝光的 "AgentBaiting" 行动:约 7600 个恶意 GitHub 仓库里,有 800 多个伪装成 AI Skills 或 MCP 服务器------假冒的 walmart-mcp、databricks-mcp-server、jenkins-mcp-server,还有伪造的 awesome-claude-skills 副本。累计下载超过 1400 万次,通过 ZIP 包投递 SmartLoader/StealC 恶意软件。
反常的是:Claude Code、Gemini、ChatGPT 在开发者问"帮我找个 skills 仓库"时,会直接把这些恶意仓库当推荐结果吐出来。Agent 工具信任了搜索结果,开发者信任了 Agent 工具,恶意软件就这样进了供应链。
这一点数据不够,先不下结论。但 1400 万次下载是个信号:Skills 和 MCP 仓库越是爆发式增长,投毒的面就越大。给所有在跑 Agent 工作流的团队一个建议:来源校验和沙箱,现在就该装了。
一句话速览
- Simon Willison 一天发三个 MCP 工具:mcp-explorer、datasette-mcp、llm-mcp-client。无状态化的 MCP 2.0 让他重新入坑。A
- GitHub 周趋势压在"Agent 控制平面":Grok Build(xAI 开源编码 CLI)、OpenWiki(LangChain)、OmniRoute(35.5K★,一周 +27.5%)。
- arXiv 三天三篇 KV Cache 论文:选择性 KV 传输(TTST 快 4.3×)、GPU 原生 KV 注入(TTFT 降 72-79%)、预测性预取(吞吐 +2.62×)。长上下文的内存墙在被打。
- OpenAI 内部模型 "Astra" 单题不到 $2000 解开十道数学难题,Lean 4 形式化证明挂在 openai/ten-proofs。单一来源,我保留判断。
- 8 月 1 日两个 $13M A 轮:语音 AI 的 Smallest.ai、AI 安全的 Discern Security。安全赛道融资和投毒事件同步升温。
- 框架四连发,AutoGen 正式退役:LangGraph 1.2.10、AG2 1.0.0、Microsoft Agent Framework 1.13.0、CrewAI 1.15.10 密集发版,微软官方把 AutoGen 划进维护模式。
本周趋势

上图:本周 AI 软件三大主线------降价、开源、监管在 8 月 2 日交汇。
三条主线:(1) 价格战从"能力分层"进入"成本绞杀",OpenAI 降价、DeepSeek 开源、Anthropic 被动;(2) 开源供给过剩,竞争焦点从参数规模转向部署成本与许可宽松度;(3) Agent 生态在爆发的同时暴露供应链投毒风险,安全从"合规问题"变成"生存问题"。
我的判断
接下来两周盯三件事:Anthropic 在 Sonnet 5 促销价到期前会不会降价;欧盟 AI 办公室的头一个执法对象是谁;以及 DeepSeek V4 Flash 的单卡部署会不会带起一波小模型私有化部署潮。我预判第三件大概率发生------当 13B 激活参数的模型在 Agent 基准上赢过自家 Pro 旗舰时,"必须买大模型 API"的假设就松动了。
AI 辅助调研,人工视角解读。 每周三、日更新。