Gemini 3.5 Pro疑灰度测试、北京酒吧送DeepSeek算力、谷歌发布第八代TPU | 8月3日 AI日报

💡 今日趋势速览:Gemini 3.5 Pro正灰度测试,谷歌发布第八代TPU首拆训推芯片;DeepSeek算力更接入北京酒吧消费场景,AI算力与模型加速落地。

🎯 今日要点

  1. Gemini 3.5 Pro疑似灰度测试
  2. 北京酒吧消费送DeepSeek算力
  3. Kimi算力底牌曝光获阿里支持

📋 今日内容汇总

🤖 AI动态

  1. Gemini 3.5 Pro疑似灰度测试
  2. 北京酒吧消费送DeepSeek算力
  3. Kimi算力底牌曝光获阿里支持
  4. Grok上线视频分析功能
  5. 微软开源屏幕操作转技能工具
  6. 英伟达发布免训练稀疏注意力
  7. 资本押注AI递归自我改进
  8. Irodori-TTS发布V4小版本
  9. 微软双向语音模型独家预览
  10. YC开源多智能体框架QM
  11. Meta用记忆智能体护航长任务
  12. 长三角Token运营中心启动
  13. 英伟达开源智能体强化学习框架

🧪 芯片半导体

  1. AMD下一代Zen6处理器曝光
  2. AM5平台迎来开源固件首发
  3. 谷歌发布第八代TPU拆分训推

🦾 机器人具身智能

  1. 具身大脑驱动机器人进物流
  2. 浏览器可玩机器人世界模型
  3. Figure机器人展示叠衣能力

📌 模型排行榜

  1. Artificial Analysis AI 模型能力排行榜

🤖 AI动态

1. Gemini 3.5 Pro疑似灰度测试

Gemini 3.5 Pro频繁出现在盲测竞技场中,疑似在正式发布前进行新一轮线上测试。该模型在盲测池被多次发现,相关测试已持续一段时间,部分场景下其生成效果较此前有显著提升,谷歌仅表示合作伙伴测试正在进行,市场预计下周或将发布。

🔗 https://x.com/LuminaXspace/status/2083839188802080777


2. 北京酒吧消费送DeepSeek算力

北京一家酒吧推出消费即送不限量DeepSeek V4 Flash模型接口算力的活动。顾客连接店内Wi-Fi后即可在店内使用期间免费调用该接口,无需订阅也不担心算力消耗,把大模型接口直接接入编码工具使用,成为AI算力线下场景营销的新玩法。

🔗 https://x.com/MaxForAI/status/2083907939811922105


3. Kimi算力底牌曝光获阿里支持

彭博披露月之暗面此前已通过阿里获得约两万张英伟达芯片算力,构成Kimi模型整体算力的重要部分。知情人士称芯片为H200,阿里否认提供H200但未否认两万张芯片的算力合作。彭博称Kimi已在部分关键指标超过阿里千问。

🔗 https://linux.do/t/topic/2691561


4. Grok上线视频分析功能

Grok新增支持分析任意视频的功能,用户可直接对视频内容进行提问与解读。该能力扩展了Grok的多模态处理范围,使其从图文交互走向视频理解,为内容创作者与普通用户提供了更便捷的视频内容分析工具。

🔗 https://x.com/elonmusk/status/2083800942927839307


5. 微软开源屏幕操作转技能工具

微软开源一款可将用户屏幕操作转化为智能体可复用技能的工具。它并非简单重放界面点击,而是利用AI理解操作意图,生成具备泛化能力的原生工具调用。用户本地录制操作与语音后AI自动生成技能,支持苹果与视窗双平台。

🔗 https://x.com/hungryturbo/status/2083858093054861313


6. 英伟达发布免训练稀疏注意力

英伟达发布Sol-Attn免训练稀疏注意力方法,在保持视觉质量的同时将视频生成推理速度最高提升二点一倍。该方法在单次在线softmax过程中统一了动态路由与近似校正,无需重新训练即可加速视频模型推理,对生成式视频应用的落地降本有直接价值。以下是官方给出的 demo

🔗 https://x.com/HuggingPapers/status/2083892246060159321


7. 资本押注AI递归自我改进

资本密集押注AI自主研发AI的下一代范式。Silver创办的公司获十一亿美元融资、估值五十一亿美元,多支团队围绕强化学习构建超级学习者,已披露融资超二十五亿美元。此外,Anthropic称Claude贡献其超八成合入代码,行业从拼规模转向拼自我提升速度。

🔗 https://hub.baai.ac.cn/view/56827


8. Irodori-TTS发布V4小版本

语音合成项目Irodori-TTS更新发布V4小版本,参数量达六百兆并采用软银制作的全新文本编码器,性能全面提升。新版支持最多一百二十秒的多个参考音频以提升克隆精度,并取消普通版与克隆版的区分统一为单一版本,为后续推出大版本埋下伏笔。

🔗 https://x.com/umiyuki_ai/status/2084011315920773333


9. 微软双向语音模型独家预览

有爆料披露微软即将推出双向语音模型MAI-Realtime,体验反馈称其自然度显著优于上一代MAI Voice二版,并能够操作网络搜索等多种工具。该模型定位双向实时语音交互,有望在智能助手与实时对话场景中带来更自然的体验。

🔗 https://x.com/testingcatalog/status/2083928441800261678


10. YC开源多智能体框架QM

YC开源其内部使用的多智能体框架QM。每位员工拥有完全独立的沙盒,记忆与权限互不干扰,支持办公协同或网页端的团队与AI群组协作。核心框架开源通用可随时切换底层大模型,能检索知识库、处理邮件并介入研发提代码跑测试,操作全程审计。

🔗 https://x.com/hungryturbo/status/2083855017883341036


11. Meta用记忆智能体护航长任务

MetaAI提出用第二个独立记忆智能体作为主智能体的记忆教练,维护结构化记忆库并决定何时提醒,防止其在长任务中重复失败步骤。该系统在两项基准测试中将得分提升多达八点三个百分点,提升了长程任务的稳定性。

🔗 https://the-decoder.com/meta-ai-uses-a-second-ai-agent-as-a-memory-coach-to-keep-long-tasks-on-track/


12. 长三角Token运营中心启动

据新华网报道长三角嘉兴Token运营中心正式启动,为企业客户提供AI规模化落地服务,门户网站同步上线。平台具备统一接口入口、统一算力计量、统一费用结算、统一政策抵扣和统一安全审计五大特性,企业接入后可按需调用多款主流大模型。

🔗 https://www.ithome.com/0/984/730.htm


13. 英伟达开源智能体强化学习框架

英伟达发布原生PyTorch的智能体强化学习框架Molt,以约八千六百行代码整合分布式与推理引擎,围绕单一异步循环组织训练。智能体保持普通Python编写、轨迹保持精确token级,吞吐量可与大规模训练栈相当,直击强化学习中算法修改成本高的痛点。

🔗 https://www.marktechpost.com/2026/08/01/nvidia-ai-releases-molt-a-pytorch-native-agentic-reinforcement-learning-framework/


🧪 芯片半导体

14. AMD下一代Zen6处理器曝光

爆料显示AMD即将推出的Zen六架构处理器在性能与能效上或有显著提升,相关规格信息开始流出。作为继Zen五之后的下一代核心架构,Zen六的进展受到关注,其表现将影响桌面与服务器市场的竞争格局。

🔗 https://www.tomshardware.com/pc-components/cpus/amds-upcoming-zen-6-processors-could-fix-microstutters-and-improve-1-percent-lows-in-games-next-gen-cpus-tipped-to-feature-per-core-optimizations-for-thermal-and-power-budgets


15. AM5平台迎来开源固件首发

固件开发公司正式为AMD的AM5平台推出首款开源固件Dasharo零点九点零版,首次将开源统一可扩展固件引入AM5平台,为指定微星主板带来Coreboot与openSIL支持。此举打破了该平台长期依赖闭源固件的局面,为开源固件社区在主流桌面平台扩展迈出关键一步。

🔗 https://www.tomshardware.com/pc-components/motherboards/first-open-source-firmware-for-am5-officially-launches-dasharo-v0-9-0-brings-coreboot-and-opensil-to-zen-4-apus-on-msi-b850


16. 谷歌发布第八代TPU拆分训推

谷歌发布第八代TPU,首次将训练与推理拆分为两颗专用芯片。TPU八代训练款专攻大规模数据吞吐,推理款主打低延迟响应,以适配智能体时代对实时推理的爆发需求。这一架构转向标志着AI算力从通用加速走向训推分离的精细化设计。

🔗 https://x.com/xiaohu/status/2083829267797041580


🦾 机器人具身智能

17. 具身大脑驱动机器人进物流

RobotEra的M7机器人搭载ERA-42具身大脑,已在广州中国邮政物流中心投入包裹分拣作业。该方案曾在世界人工智能大会展出,标志着具身智能从实验室演示走向真实物流场景落地,验证了具身大脑在工业分拣环节的实用性。以下是官方给出的 demo

🔗 https://x.com/CyberRobooo/status/2083945533048238109


18. 浏览器可玩机器人世界模型

DriftWorld发布机器人世界模型的实时演示,用户可在浏览器中选择任务并通过方向键控制机器人夹爪。每一帧画面由单块英伟达L4显卡经单次前向传递生成,在普通硬件上实现实时机器人世界建模,单次体验时长上限两分钟,降低了具身智能的体验门槛。以下是官方给出的demo

🔗 https://x.com/cybernetic_lab/status/2083810026234225106


19. Figure机器人展示叠衣能力

Figure机器人演示了快速精准地叠好一堆皱巴巴衣服的能力,能抚平凌乱布料毫无笨拙感,如同做过上千次。相比常见的后空翻等炫技动作,这种精细的家务操作更接近真实生活场景的实用价值,被视为机器人能力从表演走向家务自动化的标志性演示。以下是官方给出的 demo

🔗 https://x.com/DN_degen/status/2083889125254398078


📌 模型排行榜

20. Artificial Analysis AI 模型能力排行榜

最后是今日的 AI 模型能力排行榜单,Claude Opus 5 (max)以61分领跑智力,并以78.0分、55.3分包揽代码与智能体榜,展现绝对统治力。GPT-5.6 Sol (max)紧随其后,与Claude构成闭源双雄争霸态势。

🔗 https://artificialanalysis.ai/?intelligence=artificial-analysis-intelligence-index#intelligence-tabs

以上是今天的AI 风向标,欢迎在评论区提出建议,我们明天见。

相关推荐
江厌014 小时前
DeepSeek V4本地部署实战:联想ThinkStation P7+商红科技全流程交付解析
大模型部署·deepseek·ai工作站·商红科技·联想thinkstation
AC赳赳老秦15 小时前
企业级合规审计体系:用 OpenClaw 落地采集全链路留痕,自动生成合规审计报告
java·python·django·beautifulsoup·php·deepseek·openclaw
云卷云舒___________15 小时前
Qwen新模型paloma现身Arena、阿里Wan3.0视频模型上线、字节豆包工作开放下载 | 8月25日 AI日报
qwen·阿里·字节跳动·ai日报·豆包工作·paloma·wan30
曦云沐15 小时前
DeepSeek Harness 3 步跑通 Agent 运行时框架(npx 一键启动 Web UI)| 2026 实测
agent·deepseek·harness
a1879272183118 小时前
从一条直线到大模型输出一个token(九):输出矩阵与多层堆叠
深度学习·ai·transformer·token·注意力机制·deepseek·多层堆叠
运维自动化&云计算19 小时前
ubuntu22.04离线跑Unsloth UD‑Q4_K_XL
deepseek
DS随心转插件19 小时前
ChatGPT生成的pdf怎么导出 只要加个“AI导出鸭”
人工智能·chatgpt·pdf·deepseek·ai导出鸭
缘友一世19 小时前
在8×A800上把 DeepSeek-V4-Flash 榨到极限:从5倍提速到TP+EP双实例的完整实测
模型部署·模型推理·deepseek·moe model
YIAN1 天前
端侧大模型:DeepSeek-R1 WebGPU 推理全流程源码深度解析
前端·typescript·deepseek
张忠琳1 天前
【deepseek-harness】DeepSeek Harness (dsh) 系统级架构分析之三
ai·agent·deepseek·harness