这周 AI 圈的风向变了:巨头们不再只比谁的模型参数大,而是开始拼「芯片能不能自研、智能体能不能替你干活、推理跑得够不够快」。9 月 8 日一天之内,三条消息同时炸开------亚马逊掏出 600 亿美元押注高通、Meta 发布个人智能体 Muse、DeepSeek 新模型内测跑出 507 tokens/s 的峰值速度。
亚马逊600亿美元联姻高通
亚马逊和高通在 9 月 8 日官宣达成多代际合作,一起开发面向 AI 数据中心的定制化推理芯片,以及最高支持 1.6T 的光互联方案。作为绑定条件,高通向亚马逊发行最多 2500 万股普通股认股权证,行权价定在每股 161.26 美元,归属进度和亚马逊实际采购量直接挂钩------采购规模上限高达 600 亿美元,其中已有 375 万股因首批采购承诺提前归属。
说白了,这桩交易的信号很明确:高通不再甘心只当手机芯片之王,正式把战火烧进云端 AI 算力;亚马逊则借定制芯片和高速光互联,进一步加固自家 AWS 的自研 AI 基础设施。当自研芯片成了云厂商的「军备」,英伟达固然还是老大,但第二、第三梯队的牌桌已经重新洗牌。

▲ 云端 AI 算力与数据中心
Meta 上线个人智能体 Muse
同一天,Meta 向美国用户推出个人 AI 智能体 Muse,能替用户完成网购、购票、预约球课、填表单这些日常琐事,并接入了 Gmail、Google 日历、OpenTable、Instagram 和 WhatsApp 等服务。扎克伯格把它称作「Meta 最大的商业机遇」,希望最终推向 Instagram、Facebook、WhatsApp 上数十亿用户。
Muse 目前有免费版,以及 20 美元、100 美元每月的付费版本,未来还计划接入 Meta AI 眼镜。个人智能体从「聊天的玩具」变成「能真正替人办事的工具」,是这轮 AI 落地的关键一跃------谁先让普通人每天离不开它,谁就抢到了下一张船票。

▲ 个人 AI 智能体
DeepSeek 内测跑出 507 tokens/s
国内这边,DeepSeek 在 9 月 8 日开启 V4.1 Flash 中间版本的内测,采用全新的原生多模态结构,价格和 V4 Flash 持平,网友实测输出速度最高冲到 507 tokens/s,平均也能稳定在 300 tokens/s 以上。
这背后是一个正在形成的新共识:当各家模型的能力差距逐渐收窄,「每秒出多少 token、每美元买多少智能」正在取代参数量,成为选型的第一指标。海外扩散式大模型公司 Inception 同期的 Mercury 2.5 更宣称生产环境跑出超 1100 tokens/s。推理速度,正在成为大模型新的军备竞赛。

▲ AI 推理芯片与算力
落地阶段,拼的是工程与商业化
从亚马逊自研芯片、Meta 个人智能体,到 DeepSeek 的极速推理,三条线其实指向同一件事:AI 正从「能不能做到」进入「多快、多便宜、多好用」的落地阶段。技术叙事退潮,工程和商业化能力上位------这才是接下来真正决定牌局的东西。