Astra-lite疑似GPT-6.1 Terra? Haiku 5.5 与 Gemini 4 Argon 灰测? | 10月5日 AI日报

🎬 视频版直达 :https://www.bilibili.com/video/av117385969341689/

💡 今日趋势速览:OpenAI新模型gpt-6-astra-lite曝光,疑为GPT-6.1 Terra,Anthropic被曝测试Haiku 5.5或一两周内亮相,谷歌Gemini 4 Argon进入灰度测试,三巨头同期憋大招,新一代模型大战一触即发。

🎯 今日要点

  1. gpt-6-astra-lite 曝光,疑为 GPT-6.1 Terra
  2. 爆料称 Anthropic 正测试 Haiku 5.5,或一两周内亮相
  3. 曝 Gemini 4 Argon 已进入灰度测试,距正式发布不远

📋 今日内容汇总

🤖 AI动态

  1. gpt-6-astra-lite 曝光,疑为 GPT-6.1 Terra
  2. 爆料称 Anthropic 正测试 Haiku 5.5,或一两周内亮相
  3. 曝 Gemini 4 Argon 已进入灰度测试,距正式发布不远
  4. Anthropic 称花费约 4,400 美元移除 GLM-5.3 拒绝机制
  5. 英伟达支持的 Reflection AI 即将发布前沿开源模型
  6. 开源 SDK Hermes Gadget 发布,支持与 Hermes 语音对话
  7. Manus 2.0 发布,集成 fal 后训练视频模型 H3 Max
  8. muse 盘点已上线功能:连接器、通话测试版与 Mac 版等
  9. AI"读心术"更进一步:仅凭脑扫描,就能重建你正在看的画面
  10. FreeVideo:8GB 显存本地运行 MiniMax H3 视频生成模型
  11. Codex Computer Use 经 MCP 实现,其他 Agent 可调用
  12. Meta 在 Connect 大会发布电子宠物 Muse Charm
  13. LiteLLM 推出 Agent 轨迹智能分析功能 Lens
  14. ModelScope 开源免索引动态检索框架 Sirchmunk
  15. 谷歌在 Hugging Face 发布基于 Gemma 的说话人分离后处理模型

🦾 机器人具身智能

  1. 纽约大学开源 5 美元磁触觉传感器 eFlesh

📦 开源项目

  1. WiFi 信号变身家庭感知系统,无需摄像头即可穿墙检测呼吸心率

📌 模型排行榜

  1. Artificial Analysis AI 模型能力排行榜

🤖 AI动态

1. gpt-6-astra-lite 曝光,疑为 GPT-6.1 Terra

有用户发现,此前的 gpt-6-astra-minor 最终证实为 GPT-6.1 Sol,如今又有一个名为 gpt-6-astra-lite 的新模型现身,外界希望它就是 GPT-6.1 家族尚未发布的 Terra 模型,因为该家族至今仍未等来 Terra 版本。

🔗 https://x.com/TimJayas/status/2106637925266178386


2. 爆料称 Anthropic 正测试 Haiku 5.5,或一两周内亮相

AI 爆料账号称 Anthropic 也在测试 Haiku 5.5:作者连日使用 Fable 5.5 后发现异常,Fable 5.1 的部分输出明显逊于 Sonnet 5.5,推测官方将部分提示经 Fable 5.1 路由至 Haiku 5.5 做测试,或在一两周内亮相。以下是官方给出的 demo

🔗 https://x.com/notjazii/status/2106720324050190525


3. 曝 Gemini 4 Argon 已进入灰度测试,距正式发布不远

报道称 Gemini 4 Argon 距离发布已经不远,相关内容涉及上线时间表、灰度测试与值得期待的改进。有用户实测发现三个不同的谷歌账号各自触发一个模型,仅模型名称后缀不同,这些版本之间的具体差异目前尚不清楚。

🔗 https://x.com/Nokiapoweruser/status/2106680629907906639


4. Anthropic 称花费约 4,400 美元移除 GLM-5.3 拒绝机制

Anthropic 表示,他们花费约 4,400 美元的算力,移除了 GLM-5.3 的拒绝机制。GLM-5.3 是北京 AI 实验室开发的开放权重模型。在前两项基准测试中,拒绝率从 90% 以上分别降至约 3% 和 2%。

🔗 https://x.com/poezhao0605/status/2106548756590297277


5. 英伟达支持的 Reflection AI 即将发布前沿开源模型

据 AI Leaks and News 透露,获得英伟达支持的美国实验室 Reflection AI 正准备发布一款前沿开源模型,据称其能力将达到甚至超越当前最强的中国模型,最快可能于本周发布,美国开源 AI 正在卷土重来。

🔗 https://x.com/AILeaksAndNews/status/2106807248144252952


6. 开源 SDK Hermes Gadget 发布,支持与 Hermes 语音对话

开源 SDK Hermes Gadget 面向可与 Nous Research Hermes 对话的小型设备:按住按钮提问,Hermes 聆听、思考并大声回答,屏幕显示当前状态,需要许可时会当场询问;桌面模拟器与 ESP32 固件运行相同代码,试用无需硬件。以下是官方给出的 demo

🔗 https://x.com/adolandev/status/2106624035090059630


7. Manus 2.0 发布,集成 fal 后训练视频模型 H3 Max

Manus 团队宣布重大发布,正式推出 Manus 2.0。fal 方面表示,很高兴看到自家经过后训练的视频模型 H3 Max 集成到 Manus 2.0 之中,该视频模型随这一新版本共同上线,成为本次发布的亮点之一。以下是官方给出的 demo

🔗 https://x.com/fal/status/2106820632738758697


8. muse 盘点已上线功能:连接器、通话测试版与 Mac 版等

muse 方面盘点了已上线的功能:包括大量连接器、邀请码、电话通话测试版、Mac 版、加拿大区上线、连接器平台、Mac 电脑操作、小微企业版、小配件与表情包等,并征询用户接下来希望发布什么。

🔗 https://x.com/alexandr_wang/status/2106824386850521335


9. AI"读心术"更进一步:仅凭脑扫描,就能重建你正在看的画面

一款新的AI工具只需分析脑部扫描,就能猜出你正在看什么。这款工具由米哈尔·伊拉尼团队在魏茨曼科学研究所开发,未来或能帮助闭锁综合征患者交流。不过有科学家警告,类似方法可能在未来未经本人同意的情况下提取内心想法,令人担忧。

🔗 https://mp.weixin.qq.com/s?__biz=MzI5MTcxMTA3Mw==\&mid=2247511329\&idx=1\&sn=bb4739d2a9e375e90a14a2bcffb3ef3d


10. FreeVideo:8GB 显存本地运行 MiniMax H3 视频生成模型

开源项目 FreeVideo 让 MiniMax H3 视频生成模型搬进游戏 PC,仅需 8GB 显存与 16GB 内存即可在本地运行,支持集成 ComfyUI、LoRA 和自定义工作流,并能根据硬件自适应调整加速,项目已完全开源。

🔗 https://x.com/RoundtableSpace/status/2106651786660737098


11. Codex Computer Use 经 MCP 实现,其他 Agent 可调用

网友发现Codex的Computer Use功能通过MCP服务实现,把配置发给Claude等其他Agent即可调用,例如让其在Mac上操作计算器完成12×12测试。不过该功能并非官方支持,Codex应用后续更新后,其他Agent可能无法再用,且它通过MCP直接发送点击和拖拽操作,不会移动光标。以下是官方给出的 demo

🔗 https://x.com/Gorden_Sun/status/2106716222683533380


12. Meta 在 Connect 大会发布电子宠物 Muse Charm

Meta 在 Connect 大会上发布了被称作 2026 年电子宠物的 Muse Charm。SemiAnalysis 在骁龙峰会观察中指出,个人 AI 设备正成为新的增长市场,并预计 Muse Charm 将搭载骁龙芯片,但 Meta 尚未透露具体芯片型号。

🔗 https://x.com/SemiAnalysis_/status/2106580164565983614


13. LiteLLM 推出 Agent 轨迹智能分析功能 Lens

LiteLLM 推出 Agent 轨迹智能分析功能 LiteLLM Lens,能自动审查生产运行轨迹、聚类问题。轨迹数据自托管在用户自己的 ClickHouse,通过无速率限制的 SQL 与 API,供 Codex、Claude Code 等工具直接消费。Lens 可用 100 多家服务商的模型快速低成本分析 20 万条以上轨迹,定位故障并优化智能体,官方已放出 demo。以下是官方给出的 demo

🔗 https://x.com/shao__meng/status/2106709835626734028


14. ModelScope 开源免索引动态检索框架 Sirchmunk

魔搭ModelScope团队开源动态检索框架Sirchmunk,无需预建向量索引。相比预建索引路线的同步维护开销,Sirchmunk把当前原始文件作为起点,查询时再搜索读取核验。其LENS算法先用低成本信号缩小范围再边读边调整,验证过的问题、证据与答案沉淀为知识单元,让知识库自我进化。

🔗 https://hub.baai.ac.cn/view/58454


15. 谷歌在 Hugging Face 发布基于 Gemma 的说话人分离后处理模型

谷歌刚刚在 Hugging Face 上发布了一个说话人分离后处理模型:它由 4B 参数的 Gemma 模型微调而来,能够在 4 项基准测试中修正说话人标签,并降低词级的说话人分离错误。

🔗 https://x.com/HuggingPapers/status/2106778315352641675


🦾 机器人具身智能

16. 纽约大学开源 5 美元磁触觉传感器 eFlesh

纽约大学研究人员推出低成本、易制造的磁性触觉传感器 eFlesh,单个成本仅约 5 美元,旨在让触觉感知在机器人领域平民化;制作只需业余级 3D 打印机、现成磁铁等四样材料,弥补机器人在非结构化环境中缺乏通用力感知的短板。以下是官方给出的 demo

🔗 https://x.com/lukas_m_ziegler/status/2106668014670078000


📦 开源项目

17. WiFi 信号变身家庭感知系统,无需摄像头即可穿墙检测呼吸心率

来源:原文 | GitHub

开源WiFi感知系统RuView无需摄像头即可工作,能穿墙检测人员存在,并测量呼吸和心率。它将普通路由器的信号扰动转化为可操作数据,实时输出心率、呼吸频率等生命体征。系统还兼容Home Assistant、Apple Home、Google Home与Alexa,项目已在GitHub获得96.4k星标。

🔗 https://github.com/ruvnet/ruview


📌 模型排行榜

18. Artificial Analysis AI 模型能力排行榜

最后是今日的 AI 模型能力排行榜单,智力榜头部由Anthropic包揽,Claude Opus 5.5(max with fallback)以58分登顶,Claude Sonnet 5.5(56分)、Claude Fable 5.1(53分)分列二三。国产代表MiMo-V2.6-Pro以46分位居第10,成为榜单前十中唯一的开源力量。

🔗 https://artificialanalysis.ai/

以上是今天的AI 风向标,欢迎在评论区提出建议,我们明天见。

相关推荐
howdoyoudo2026062 小时前
当新案例冲击旧框架:分类系统的宿命与修正路径
大数据·网络·数据库·人工智能·安全·ai·分类
工作10年+,存储芯片行业2 小时前
存储芯片产业全景:从产品矩阵到技术优势与质量体系
ai·nvme·芯片·数据中心·存储·pcie·半导体
袖清暮雨2 小时前
机器学习之逻辑回归
人工智能·机器学习·ai
玫瑰互动GEO11 小时前
GEO优化学习九级模型:开发者从认知层切入
人工智能·ai·ai搜索·gem·生成式引擎优化·gem优化
VIP_CQCRE13 小时前
用 Ace Data Cloud 的 gpt-image-2,把 AI 图像生成接入真实业务场景
ai·aigc·api·图像生成·acedatacloud
满脑子技术的前端工程师13 小时前
第六章 TypeScript MCP Server:独立综合项目与能力验收
ai
EchoMind-Henry13 小时前
Muse外设两条接入路,成本该怎么算
人工智能·ai
Jo乔戈里16 小时前
免费本地搜图软件
图像处理·python·搜索引擎·ai
AI日报派送佬1 天前
2026年10月4日AI行业日报|AI智能体自主能力升级,模型落地与安全规范双向迭代
人工智能·智能体·ai安全·开源ai·ai日报·人工智能前沿·ai科研