Gemini 3.5 Pro疑灰度测试、北京酒吧送DeepSeek算力、谷歌发布第八代TPU | 8月3日 AI日报

💡 今日趋势速览:Gemini 3.5 Pro正灰度测试,谷歌发布第八代TPU首拆训推芯片;DeepSeek算力更接入北京酒吧消费场景,AI算力与模型加速落地。

🎯 今日要点

  1. Gemini 3.5 Pro疑似灰度测试
  2. 北京酒吧消费送DeepSeek算力
  3. Kimi算力底牌曝光获阿里支持

📋 今日内容汇总

🤖 AI动态

  1. Gemini 3.5 Pro疑似灰度测试
  2. 北京酒吧消费送DeepSeek算力
  3. Kimi算力底牌曝光获阿里支持
  4. Grok上线视频分析功能
  5. 微软开源屏幕操作转技能工具
  6. 英伟达发布免训练稀疏注意力
  7. 资本押注AI递归自我改进
  8. Irodori-TTS发布V4小版本
  9. 微软双向语音模型独家预览
  10. YC开源多智能体框架QM
  11. Meta用记忆智能体护航长任务
  12. 长三角Token运营中心启动
  13. 英伟达开源智能体强化学习框架

🧪 芯片半导体

  1. AMD下一代Zen6处理器曝光
  2. AM5平台迎来开源固件首发
  3. 谷歌发布第八代TPU拆分训推

🦾 机器人具身智能

  1. 具身大脑驱动机器人进物流
  2. 浏览器可玩机器人世界模型
  3. Figure机器人展示叠衣能力

📌 模型排行榜

  1. Artificial Analysis AI 模型能力排行榜

🤖 AI动态

1. Gemini 3.5 Pro疑似灰度测试

Gemini 3.5 Pro频繁出现在盲测竞技场中,疑似在正式发布前进行新一轮线上测试。该模型在盲测池被多次发现,相关测试已持续一段时间,部分场景下其生成效果较此前有显著提升,谷歌仅表示合作伙伴测试正在进行,市场预计下周或将发布。

🔗 https://x.com/LuminaXspace/status/2083839188802080777


2. 北京酒吧消费送DeepSeek算力

北京一家酒吧推出消费即送不限量DeepSeek V4 Flash模型接口算力的活动。顾客连接店内Wi-Fi后即可在店内使用期间免费调用该接口,无需订阅也不担心算力消耗,把大模型接口直接接入编码工具使用,成为AI算力线下场景营销的新玩法。

🔗 https://x.com/MaxForAI/status/2083907939811922105


3. Kimi算力底牌曝光获阿里支持

彭博披露月之暗面此前已通过阿里获得约两万张英伟达芯片算力,构成Kimi模型整体算力的重要部分。知情人士称芯片为H200,阿里否认提供H200但未否认两万张芯片的算力合作。彭博称Kimi已在部分关键指标超过阿里千问。

🔗 https://linux.do/t/topic/2691561


4. Grok上线视频分析功能

Grok新增支持分析任意视频的功能,用户可直接对视频内容进行提问与解读。该能力扩展了Grok的多模态处理范围,使其从图文交互走向视频理解,为内容创作者与普通用户提供了更便捷的视频内容分析工具。

🔗 https://x.com/elonmusk/status/2083800942927839307


5. 微软开源屏幕操作转技能工具

微软开源一款可将用户屏幕操作转化为智能体可复用技能的工具。它并非简单重放界面点击,而是利用AI理解操作意图,生成具备泛化能力的原生工具调用。用户本地录制操作与语音后AI自动生成技能,支持苹果与视窗双平台。

🔗 https://x.com/hungryturbo/status/2083858093054861313


6. 英伟达发布免训练稀疏注意力

英伟达发布Sol-Attn免训练稀疏注意力方法,在保持视觉质量的同时将视频生成推理速度最高提升二点一倍。该方法在单次在线softmax过程中统一了动态路由与近似校正,无需重新训练即可加速视频模型推理,对生成式视频应用的落地降本有直接价值。以下是官方给出的 demo

🔗 https://x.com/HuggingPapers/status/2083892246060159321


7. 资本押注AI递归自我改进

资本密集押注AI自主研发AI的下一代范式。Silver创办的公司获十一亿美元融资、估值五十一亿美元,多支团队围绕强化学习构建超级学习者,已披露融资超二十五亿美元。此外,Anthropic称Claude贡献其超八成合入代码,行业从拼规模转向拼自我提升速度。

🔗 https://hub.baai.ac.cn/view/56827


8. Irodori-TTS发布V4小版本

语音合成项目Irodori-TTS更新发布V4小版本,参数量达六百兆并采用软银制作的全新文本编码器,性能全面提升。新版支持最多一百二十秒的多个参考音频以提升克隆精度,并取消普通版与克隆版的区分统一为单一版本,为后续推出大版本埋下伏笔。

🔗 https://x.com/umiyuki_ai/status/2084011315920773333


9. 微软双向语音模型独家预览

有爆料披露微软即将推出双向语音模型MAI-Realtime,体验反馈称其自然度显著优于上一代MAI Voice二版,并能够操作网络搜索等多种工具。该模型定位双向实时语音交互,有望在智能助手与实时对话场景中带来更自然的体验。

🔗 https://x.com/testingcatalog/status/2083928441800261678


10. YC开源多智能体框架QM

YC开源其内部使用的多智能体框架QM。每位员工拥有完全独立的沙盒,记忆与权限互不干扰,支持办公协同或网页端的团队与AI群组协作。核心框架开源通用可随时切换底层大模型,能检索知识库、处理邮件并介入研发提代码跑测试,操作全程审计。

🔗 https://x.com/hungryturbo/status/2083855017883341036


11. Meta用记忆智能体护航长任务

MetaAI提出用第二个独立记忆智能体作为主智能体的记忆教练,维护结构化记忆库并决定何时提醒,防止其在长任务中重复失败步骤。该系统在两项基准测试中将得分提升多达八点三个百分点,提升了长程任务的稳定性。

🔗 https://the-decoder.com/meta-ai-uses-a-second-ai-agent-as-a-memory-coach-to-keep-long-tasks-on-track/


12. 长三角Token运营中心启动

据新华网报道长三角嘉兴Token运营中心正式启动,为企业客户提供AI规模化落地服务,门户网站同步上线。平台具备统一接口入口、统一算力计量、统一费用结算、统一政策抵扣和统一安全审计五大特性,企业接入后可按需调用多款主流大模型。

🔗 https://www.ithome.com/0/984/730.htm


13. 英伟达开源智能体强化学习框架

英伟达发布原生PyTorch的智能体强化学习框架Molt,以约八千六百行代码整合分布式与推理引擎,围绕单一异步循环组织训练。智能体保持普通Python编写、轨迹保持精确token级,吞吐量可与大规模训练栈相当,直击强化学习中算法修改成本高的痛点。

🔗 https://www.marktechpost.com/2026/08/01/nvidia-ai-releases-molt-a-pytorch-native-agentic-reinforcement-learning-framework/


🧪 芯片半导体

14. AMD下一代Zen6处理器曝光

爆料显示AMD即将推出的Zen六架构处理器在性能与能效上或有显著提升,相关规格信息开始流出。作为继Zen五之后的下一代核心架构,Zen六的进展受到关注,其表现将影响桌面与服务器市场的竞争格局。

🔗 https://www.tomshardware.com/pc-components/cpus/amds-upcoming-zen-6-processors-could-fix-microstutters-and-improve-1-percent-lows-in-games-next-gen-cpus-tipped-to-feature-per-core-optimizations-for-thermal-and-power-budgets


15. AM5平台迎来开源固件首发

固件开发公司正式为AMD的AM5平台推出首款开源固件Dasharo零点九点零版,首次将开源统一可扩展固件引入AM5平台,为指定微星主板带来Coreboot与openSIL支持。此举打破了该平台长期依赖闭源固件的局面,为开源固件社区在主流桌面平台扩展迈出关键一步。

🔗 https://www.tomshardware.com/pc-components/motherboards/first-open-source-firmware-for-am5-officially-launches-dasharo-v0-9-0-brings-coreboot-and-opensil-to-zen-4-apus-on-msi-b850


16. 谷歌发布第八代TPU拆分训推

谷歌发布第八代TPU,首次将训练与推理拆分为两颗专用芯片。TPU八代训练款专攻大规模数据吞吐,推理款主打低延迟响应,以适配智能体时代对实时推理的爆发需求。这一架构转向标志着AI算力从通用加速走向训推分离的精细化设计。

🔗 https://x.com/xiaohu/status/2083829267797041580


🦾 机器人具身智能

17. 具身大脑驱动机器人进物流

RobotEra的M7机器人搭载ERA-42具身大脑,已在广州中国邮政物流中心投入包裹分拣作业。该方案曾在世界人工智能大会展出,标志着具身智能从实验室演示走向真实物流场景落地,验证了具身大脑在工业分拣环节的实用性。以下是官方给出的 demo

🔗 https://x.com/CyberRobooo/status/2083945533048238109


18. 浏览器可玩机器人世界模型

DriftWorld发布机器人世界模型的实时演示,用户可在浏览器中选择任务并通过方向键控制机器人夹爪。每一帧画面由单块英伟达L4显卡经单次前向传递生成,在普通硬件上实现实时机器人世界建模,单次体验时长上限两分钟,降低了具身智能的体验门槛。以下是官方给出的demo

🔗 https://x.com/cybernetic_lab/status/2083810026234225106


19. Figure机器人展示叠衣能力

Figure机器人演示了快速精准地叠好一堆皱巴巴衣服的能力,能抚平凌乱布料毫无笨拙感,如同做过上千次。相比常见的后空翻等炫技动作,这种精细的家务操作更接近真实生活场景的实用价值,被视为机器人能力从表演走向家务自动化的标志性演示。以下是官方给出的 demo

🔗 https://x.com/DN_degen/status/2083889125254398078


📌 模型排行榜

20. Artificial Analysis AI 模型能力排行榜

最后是今日的 AI 模型能力排行榜单,Claude Opus 5 (max)以61分领跑智力,并以78.0分、55.3分包揽代码与智能体榜,展现绝对统治力。GPT-5.6 Sol (max)紧随其后,与Claude构成闭源双雄争霸态势。

🔗 https://artificialanalysis.ai/?intelligence=artificial-analysis-intelligence-index#intelligence-tabs

以上是今天的AI 风向标,欢迎在评论区提出建议,我们明天见。

相关推荐
云卷云舒___________6 小时前
MiniMax H3全模态视频模型屠榜、字节跳动Seedance 2.5紧急推出、华为开源盘古2.0 Pro | 8月1日 AI日报
华为·字节跳动·minimax·ai日报·h3·seedance2.5·盘古20pro
天地会珠海分舵21 小时前
DeepSeek v4 flash vs GPT 5.6 Luna 测评报告!
gpt·deepseek·测评报告
还是鼠鼠1 天前
【Spring AI智能体实战 01】Java开发者接入大模型:国内平台、Token与API Key入门
java·大模型·spring ai·deepseek·阿里云百炼
小马9261 天前
2026年8月4日科技热点深度解析:AI大模型群雄逐鹿、卫星互联网组网提速、半导体封装材料革命
人工智能·科技·deepseek
circuitsosk1 天前
知识问答领域大语言模型设计:对标豆包与DeepSeek的工程实践
人工智能·python·语言模型·自然语言处理·llm·豆包·deepseek
ClouGence2 天前
无需 API 配置,DeepSeek-V4-Flash 正式版落地使用指南
agent·ai编程·deepseek
我才是银古3 天前
My OpenCode × DeepSeek Config 项目的最新提示词
deepseek·opencode
DS随心转小程序3 天前
实测评测 AI 导出鸭转化效能,全方位优化 DeepSeek 输出 word 文档落地使用效率
人工智能·aigc·word·豆包·deepseek·ai导出鸭
weixin_468466853 天前
DeepSeek-V4-Flash正式版深度解析:当“轻量模型”用后训练撬动Agent能力革命
人工智能·大模型·agent·deepseek·deepseek-v4