独立 AI 浏览器之死与「内嵌化」之生:Atlas 关停、Comet 免费化、豆包虚拟桌面,入口之争的终局

独立 AI 浏览器之死与「内嵌化」之生:Atlas 关停、Comet 免费化、豆包虚拟桌面,入口之争的终局


一、执行摘要

过去四周我把浏览器 Agent(Browser Agent / Computer-Use Agent)拆成四个切面写过:产品格局(8-17)、基础设施与分发层(8-19)、安全信任(8-21)、价值捕获经济学(8-22)。这一期我想正面回答一个被前四期回避的问题:"独立 AI 浏览器"这个品类,到底是被证伪了,还是正在换一种活法?

两个自相矛盾却同框出现的信号,把这个问题逼成了本周最尖锐的命题。

第一个信号是巨头的集体撤退。 OpenAI 在 8 月中旬关停了只活了约九个月的 AI 浏览器 Atlas(8-9 起停用、8-13 官宣作为独立客户端退役,能力并入 ChatGPT 桌面端与 Codex)B。更早,Google 已在 5 月 4 日悄然退休项目 Mariner------那个 2024 年底发布、Pichai 在 I/O 2025 亲自演示、卖 $249.99/月的"截图式"浏览器 Agent,技术被折进 Gemini Agent 与 Chrome Auto Browse B。再叠加 7 月 9 日 Operator 并入 ChatGPT Work,巨头用三个动作写完了同一句话:独立浏览器这一层,不是他们的战场。

第二个信号是入场者依然络绎不绝。 同一周,Polar 官宣拿到 Madrona 领投的 5.7M seed,测试期用户跑了 450 万次真实网页操作;Perplexity Comet 拆掉 200/月门槛转为免费;美团光年之外的 Tabbit 任务成功率三个月从 53.1% 拉到 91.8% B。中国侧同样密集:8-21 新浪实测豆包"虚拟桌面+云电脑",8-11 Manus 宣布恢复独立运营并上线浏览器操作插件,8-20 腾讯开源 BrowserSkill------中国玩家把浏览器 Agent 做成了"云机+桌面智能体",而不是西方的"agent-native 内核"。

我判断 :独立 AI 浏览器正在被"两头挤压"------巨头撤退证明"入口不在浏览器",创业者和中国大厂进场证明"执行需求是真的"。最终收敛的方向,不是某个独立的 AI 浏览器赢下入口,而是浏览器 Agent 能力被吸进主产品(ChatGPT、Chrome、钉钉、豆包),独立的"AI 浏览器"只剩少数垂直玩家。这场战争的终局,取决于一个更本质的问题:Agent 到底住在浏览器里,还是住在工作流里?


二、巨头的撤退:Atlas 与 Mariner 的九个月

2.1 Atlas:从发布到关停,只有九个月

OpenAI 的 Atlas 浏览器 2025 年 10 月发布,内置 ChatGPT 与记忆能力,被视为"OpenAI 要做浏览器"的宣言。到 2026 年 8 月 9 日用户发现它停止工作,8 月 13 日官方确认作为独立客户端退役,能力并入 ChatGPT 桌面应用与 Codex B。多家分析把它和 7 月 9 日 Operator 并入 ChatGPT Work 连起来读:OpenAI 在用六周时间收缩所有"独立 Agent 界面",把执行能力统一收进 ChatGPT 这一个超级应用。 甚至有分析把这串收缩解读为 IPO 前的报表整理------砍掉烧钱且不增留存的独立客户端。

2.2 Mariner:更早,更安静

Google 的动作比 OpenAI 更早也更决绝。Mariner 从 2024 年 12 月发布到 2026 年 5 月 4 日退休,只有约一年半,其中大量时间挂着 $249.99/月的 AI Ultra 付费墙且仅限美国。退休时 Google 没有大张旗鼓,只是把截图+计算机视觉的技术折进 Gemini Agent、Chrome Auto Browse 与 Gemini 2.5 Computer Use API BMariner 的死法说明了巨头眼中浏览器 Agent 的正确位置:不在一个独立的浏览器产品里,而在 Chrome 的地址栏、Gemini 的 Agent Mode 和系统层。

2.3 为什么巨头撤退:浏览器不是入口,主产品才是

把 Atlas、Mariner、Operator 三个撤退放在一起,能提炼出一个结构判断:独立 AI 浏览器要同时承担"渲染引擎+登录态管理+身份授权+分发",太重了;而它的留存靠的是任务完成,不是浏览习惯------用户没有理由为一个"能帮你做事"的浏览器更换默认浏览器。 分发不成、留存不稳、成本又高,巨头当然选择把能力内嵌进已有十亿级用户的主产品 D

上图:从 Mariner 发布到 Atlas 关停,巨头用"发布独立浏览器再并入主产品"的循环证明------入口不在浏览器这一层。


三、为什么还有人在进场:Polar、Hark、Comet、Tabbit

巨头撤退的同时,新钱仍在涌入,这构成了"独立 AI 浏览器是伪命题"最有力的反证。

  • Polar(7-29 官宣,8 月持续发酵):$5.7M seed,Madrona 领投,天使包括前 GitHub CEO Thomas Dohmke 与 Modal 创始人 Erik Bernhardsson;三位创始人来自 MIT/Perplexity/量化背景,做 macOS 上的 Chromium 系 AI 浏览器,主打"多步知识工作",自称测试期用户跑了 450 万次网页操作 B
  • Hark(Figure AI 创始人 Brett Adcock):$700M A 轮,8 月 5 日上线第一款产品 Handoff------一个刻意"非企业级"的平价计算机使用 Agent,宣称在 Online-Mind2Web 上超过 Operator、Gemini 与 Claude B
  • Perplexity Comet:2026 年初拆掉 $200/月付费墙转免费,MAU 估算 300-500 万,支持 Claude/GPT/Gemini 多模型切换。
  • 美团 Tabbit(光年之外):任务成功率从 3 月的 53.1% 提到 91.8%,5 月人均 token 消耗 853 万/月,超 60% 活跃用户会切换底层模型。

新玩家赌的不是"再做一个浏览器",而是三件事:垂直知识工作的工作台(Polar)、极低的任务成本(Hark)、Agent 与浏览器的原生耦合体验(Tabbit)。它们和巨头最大的区别是没有十亿级主产品要保护,敢把整个产品形态押在"Agent 即浏览器"上 D

上图:同一周内巨头在撤退、新玩家在进场------他们赌的不是同一件事:巨头赌主产品内嵌,新玩家赌 Agent 原生工作台。


四、中西分野:西方赌内核,中国赌云机

浏览器 Agent 的入口之争,8 月出现了一条比"谁能做"更清晰的分界线:路线之争

4.1 西方:把浏览器本身变成 Agent 运行时

Cloudflare 在 8 月初推出 Kitesurf------一个完全跑在 Workers V8 隔离区里的"agent-native 浏览器",砍掉标签页、主题、扩展等人性功能,只输出机器可读的页面;宣称比 Chromium 省 3-7 倍 CPU/内存,通过 21.5 万个 Web Platform Tests,兼容 CDP(Puppeteer/Playwright/MCP)。同期 Cloudflare 还发布 WebMCP 开发者预览:网站可以主动向浏览器 Agent 暴露函数,让 Agent 直接调用页面能力,而不是"截图+点击" B。这是一条"谁拥有 Agent 的运行时,谁就拥有分发"的赌注,与 8-19 那期的判断一致。

4.2 中国:给 Agent 配一台云电脑

中国主流玩家没有跟进 agent-native 内核,而是走了更务实的路:给 Agent 配一台云电脑/云手机,绕开浏览器的登录墙与风控墙。

  • 豆包(8-21 新浪/国是直通车实测):上线"虚拟桌面"(AI 在隔离的 Windows 桌面会话里干活,用户在自己桌面并行工作)与"云电脑模式"(定时任务在合上笔记本后继续跑,实测定时淘宝下单成功);策略自称"接口优先、GUI 兜底" B
  • 千问办公(8-3 公测):整合 QoderWork、悟空、MuleRun 为一个产品,深度绑定钉钉;杰富瑞 8-19 的 8 款 Agent 实测中综合第一,并引入了"Cost per Task"这个采购指标。
  • Manus(8-11 恢复独立运营):上线 Browser Operator 插件与"Preferred Browser"(保持已登录 Chrome),把真实登录态直接交给 Agent。
  • 腾讯(8-20 开源 BrowserSkill):CLI+浏览器扩展驱动真实浏览器,复用登录态,CAPTCHA/OTP 走人工接管 C

为什么中国不抄 Kitesurf 的作业?CSDN 的深度文章点破了关键:agent-native 浏览器过不了"403 墙"------极验 Geetest、TLS 指纹、滑块验证码会让无人值守的浏览器内核寸步难行 C。中国互联网的对抗性风控生态,决定了"干净的内核引擎"在中国不如"云机+人工接管"可靠。这是生态约束,不是技术能力高下。

上图:西方把浏览器本身改造成 Agent 运行时,中国给 Agent 配云电脑并靠人工接管绕开风控墙------两条路线背后是截然不同的生态约束。


五、企业侧的检验:Cost per Task 与「工作助手」合规

路线之争终归要落到"谁付钱"。8 月企业侧的两个信号值得注意。

第一个信号是采购指标从"席位"转向"任务成本"。 杰富瑞在 8 款 Agent 实测中直接引入"Cost per Task"作为对比维度,并指出千问办公的底模 Qwen 3.8 Max 定价显著低于海外头部队列 B。这与 8-22 那期"每步任务都算钱"的价值捕获判断同频------当成本塌缩到可忽略,采购方关心的是"一个任务花多少钱",而不是"一个席位多少钱"。成本数据也在验证这一转向:Operator 2.0 处理 5 万任务/月约 60K,自托管 Skyvern 约 35K;行业经验法则是月任务量 <1 万用托管、>10 万果断自托管开源方案 C

第二个信号是"Agent 身份"成为全球监管的第一块基石。 8 月发生了三件互相呼应的标志性事件:美国第九巡回上诉法院推翻了针对 Perplexity Comet 购物功能的 CFAA 禁令,认定"助手是工具,不是人",首次在联邦上诉层级判定 Agent 访问网站的合法性 A;欧盟 AI Act 第 50 条生效,要求机器人与 Agent 与人交互时自证 AI 身份 A;中国《人工智能拟人化互动服务管理暂行办法》7-15 生效,明确豁免"任务型服务"(客服、知识问答、工作助手),广州互联网法院则以"双重授权"裁决,要求第三方 Agent 同时取得平台授权与用户自主授权 A。三条规则拼起来指向同一结论:合规的 Agent 是可以做事的,但它必须"带着身份、可溯源、可接管"。

这也解释了为什么中国的商业出口集中在金融与政务:2026 上半年公开的金融智能体招标达 97 个、银行占 48.5%、合计金额超 1.55 亿元;政务采购把"数据不出域、信创全栈、操作可回放审计"列为一票否决 B合规能力本身,成了浏览器 Agent 在中国的第一竞争力------这比任何基准分数都更决定订单。


六、未来展望:三个判断

判断一:独立 AI 浏览器在西方向"内嵌"收敛,只剩垂直玩家。 Atlas 关停、Mariner 退休、Operator 并入 ChatGPT 是三份尸检报告:通用入口不在独立浏览器。Polar、Hark 这类新玩家要么做垂直知识工作,要么做极低成本的任务引擎,不会去复制"通用 AI 浏览器"。

判断二:中国的"云电脑+桌面智能体"路线会比"agent-native 内核"跑得快。 豆包虚拟桌面、千问办公、Manus Browser Operator、腾讯 BrowserSkill 在同一个月密集上线,背后是同一个判断------中国 Agent 的对手不是浏览器内核,是风控墙与合规。谁的云机+接管体验更好、谁的审计日志更全,谁就吃掉办公与政务订单。

判断三(最大不确定性):监管对"Agent 身份与授权"的界定,决定两条路的生死。 美国"助手不是人"、欧盟"自证身份"、中国"双重授权+任务型豁免",三方框架现在互不相同。如果美国把 Agent 视为"工具",独立浏览器可以放开手脚访问任何站点;如果监管转向"Agent 是独立主体",登录态复用(BrowserSkill、Manus Browser Operator 这条路)会第一个被收紧 D。我原以为浏览器 Agent 的终局由技术决定,现在看,更可能由监管和风控生态共同决定。先不下结论的是:中西方两条路线,哪条会先被监管"扶正"。


七、投资与研究展望

值得看多

  • 云机/桌面智能体:豆包、千问办公、Manus、腾讯 WorkBuddy------中国办公+政务付费段最实的主线,"任务成本+合规"双指标都受益。
  • Agent 身份/安全中间件:EU AI Act 第 50 条与"双重授权"判例生效后,"Agent 身份标识、可回放审计、人工接管"会从加分项变成硬准入。
  • 极低成本任务引擎:Hark、开源自托管方案(Skyvern 等)------月任务量 >10 万的场景里成本优势是碾压级的。

值得警惕

  • 独立 AI 浏览器的通用型产品(无垂直、无合规叙事)会加速分化,参照 Operator/Mariner 的命运。
  • 新玩家的关键数字(Polar 450 万次操作、Hark OM2W 第一、Tabbit 91.8%)多为厂商自报或单源转载,引用需交叉核实 B→C
  • 中国"云电脑"路线的安全边界(登录态复用、定时任务无人值守)正在成为下一个安全争论点,8-21 那期的"逃逸防御"叙事会在此复现。

关键监测指标(下期起)

  1. Atlas 关停后,OpenAI 是否把 Computer Use 全面内嵌 ChatGPT 并开放 DOM/结构化读取------直接验证"内嵌化"终局。
  2. Polar 公测的留存与付费转化------它是"垂直工作台成立"还是"独立浏览器伪命题"的最新试纸。
  3. 豆包虚拟桌面/云电脑能否收敛"2 亿 DAU 但日收入 <¥100 万 vs 日算力成本数千万"的缺口。
  4. 美国 CFAA 判例之后,是否有针对"登录态复用"类 Agent(BrowserSkill、Manus)的新诉讼或规制。
  5. 中国金融/政务招标是否把"Agent 身份可审计"写进硬性条款。

证据等级A 官方/一手 B 2+可靠来源 C 单一来源 D 个人判断
AI 辅助深度研究,人工视角解读。 每日更新。


参考来源

  1. 163.com --- OpenAI 关停 Atlas 浏览器分析 (2026-08)
  2. presenc.ai --- Agentic Browser Wars 2026 追踪
  3. CSDN --- Atlas 关停、Kitesurf、Hark 与云机路线深度 (2026-08-22)
  4. forkast.news --- Cloudflare Kitesurf: agent-native browser runtime (2026-08-07)
  5. TheBlockBeats --- Cloudflare WebMCP Developer Preview (2026-08-06)
  6. pulse2.com --- Polar AI Browser raises $5.7M (2026-07-29)
  7. 量子位 --- 杰富瑞实测 8 款 Agent:千问办公第一 (2026-08-20)
  8. 新浪科技/国是直通车 --- 豆包虚拟桌面+云电脑实测 (2026-08-21)
  9. 36氪 --- Manus 重回独立:这只蝴蝶还能再掀风暴吗 (2026-08-11)
  10. aitop100.cn --- 腾讯开源 BrowserSkill (2026-08-20)
  11. 每日经济新闻 --- 美团 Tabbit 百日:任务成功率 91.8% (2026-06-10)
  12. dev.to --- Google 悄然退休 Mariner (2026-05)
  13. coasty.ai --- OSWorld 基准:浏览器/桌面 Agent 差距 (2026-04)
相关推荐
淳悦qiqi1 小时前
2026依托技术优势高准确率语音识别软件多场景让信息整理更省事更清晰
人工智能·语音识别
云浪1 小时前
给大模型装上"手":三分钟看懂 AI Agent 的 Tool 工具调用
javascript·人工智能·node.js
YHHLAI1 小时前
实战 Vibe Coding:用 AI 从零搭一个 React 待办清单
前端·人工智能·react.js
狂师1 小时前
AI 测试 | 把 UI 自动化测试执行固化成五步流程,这套AI Skill 思路可以直接抄
人工智能·agent·测试
调试到凌晨1 小时前
2026年配音工具避坑实测:免费额度、长文本稳定性与API集成能力全记录
人工智能·经验分享·实时音视频
cxr8281 小时前
deepseek harness能否指挥Claude code和codex来协同开发
人工智能·智能体
数据智研1 小时前
【数据分享】中国农产品价格调查年鉴(2004-2025)
大数据·人工智能·数据分析·可视化·数据可视化
阿图灵1 小时前
OpenCV 图像操作六件套:读取、裁剪、缩放、旋转、通道分割与保存
图像处理·人工智能·python·深度学习·opencv·计算机视觉
小小帅呀1 小时前
学习 VLA 第 1 天:VLA 概述与学习路线
人工智能