当 AI 替你上网:浏览器智能体 2026 的入口之争、成本坍塌与可靠性上限

一、执行摘要
2026 年 7 月 9 日,OpenAI 宣布关停自研 AI 浏览器 ChatGPT Atlas,8 月 9 日停服,官方口径一句话:「浏览器是功能,不是目的地。」两个月前,Google 悄悄退役了 Project Mariner,把技术并进 Gemini Agent 与 Chrome 的 auto-browse。而就在同一周,Brett Adcock(Figure AI 创始人)的 Hark 拿着 700M A 轮(估值 6B、融资时还没有产品),发布了浏览器操作代理 Handoff,宣称在 Online-Mind2Web 拿到 97.7 的历史最高分(该分数未获第三方独立复测)B。
这四个信号放在一起,构成 2026 年浏览器智能体(Browser Agent / Computer Use)赛道最值得解读的图景:能力已经成熟到「可以关掉独立产品」,却还没有可靠到「可以无人值守」。OpenAI 和 Google 亲手拆掉自己造的浏览器,把 Agent 入口收回超级 App 与 Chrome 扩展;创业公司则拿着十亿级美金,赌「预测下一个动作」的便宜路线能改写成本结构。
我判断:2026 是浏览器 Agent 的「成人礼」。单点任务(订票、比价、填表)已跨过可商用线,但长程任务(OSWorld 2.0 最优完成率仅 20.6%)仍是天花板。真正的护城河不在模型层,而在「登录态复用 + 反爬 + 合规」的执行层------这也是为什么 OpenAI 与 Google 宁可拆掉自己的浏览器,也要把入口握在手里。
二、为什么是 2026:三股力量的交汇
2.1 「拆掉自己产品」的一年:两个旗舰浏览器先后谢幕
2026 年是浏览器 Agent 历史上「自我否定」最密集的一年。ChatGPT Atlas (2025 年 10 月上线、Chromium 内核)7 月 9 日宣布关停,8 月 9 日停服,书签、历史、密码均不迁移;Agent 能力被拆进 ChatGPT 桌面应用的内置多标签浏览器、云浏览器,以及新的 Chrome 扩展,独立 Operator 研究预览同步退役、并入 ChatGPT Agent A。Project Mariner(Google 2024 年 12 月发布的浏览器 Agent)5 月 4 日退役,能力并进 Gemini Agent、AI Mode 与 Chrome 的 auto-browse,被引用的原因是截图方案慢且贵、隐私争议,以及行业风向转向代码/CLI Agent。
这两件事的共同逻辑:浏览器 Agent 作为「独立浏览器」是错误的产品形态,作为「超级 App / 既有浏览器里的功能」才是对的。 OpenAI 的「浏览器是功能,不是目的地」,与 Google 的「技术航行到了别处」,是同一句话的两种说法。
2.2 成本坍塌:单任务成本两年降约 10 倍
浏览器 Agent 的经济账在 2026 年发生质变。综合各方测算:2024 年一个端到端网页任务成本约 0.5--1.5,2026 年降到 0.05--0.15;更激进的统计口径是单任务成本从 2025 年初约 0.12 降到 2026 年中约 0.02 C。OpenAI Operator 2.0 API 2026 年 4 月正式商用,定价 0.30/agent-minute、单任务最低 0.05------一个约 3 分钟的任务全包约 0.95;Hark 则把 API 定价打到 0.18/M input + $2.37/M output,宣称比 GPT-5.5 / Opus 4.8 低一个数量级。
成本的断崖式下降来自两个方向:一是模型层视觉 grounding 能力成熟,不再需要大量截图 token;二是开源中间层(Browser Use 的 DOM 蒸馏、Skyvern 的零配置视觉路线)把「跑一个任务」的边际成本压到个位数美分。当单任务成本跌破 $0.1,浏览器 Agent 就从「演示品」变成了「可规模化的劳动力」。

上图:2024→2026 浏览器 Agent 的成本与可靠性曲线------单任务成本两年降约 10 倍,WebVoyager 短任务接近饱和(97%),但长程桌面任务(OSWorld 2.0)最优完成率仅 20.6%,「成本坍塌与可靠性天花板并存」。
2.3 流量拐点:机器人第一次成为网页访问的主流
Cloudflare 数据显示,2026 年 6 月机器人(含 Agent)生成网页请求占比首次过半,达到 57.5%,Agent 流量同比增长 7,851% B。HUMAN Security 的追踪则显示,浏览器 Agent 占全部 Agent 化网页活动的约 71%------其中 Perplexity Comet 占 48%、ChatGPT Atlas 占 21%、Claude Chrome 扩展占 17%、ChatGPT Agent 占 8.5%,媒体/电商/出行三个行业吃掉了 98% 的 Agent 流量。
这个数字的分量在于:网页的「读者」结构正在改变。 当一个网站超过一半的访问来自机器,反爬、验证码、指纹检测就从「防御爬虫」变成「防御 AI 劳动力」------这也是企业落地部分反复出现的矛盾核心。
三、产品版图:六路玩家与「拆掉的浏览器」
浏览器智能体的价值在 2026 年分化成清晰的三层:模型层(谁能「看懂并操作」网页)、应用层(用户碰到的浏览器/Agent 产品)、执行层(浏览器/云机基础设施)。OpenAI 与 Google 拆掉独立浏览器,本质是承认「应用层没有独立入口的生存空间」,把赌注押回模型层与执行层。

上图:2026 年浏览器智能体的三层版图------模型层负责「看懂并操作网页」,应用层是用户直接接触的产品,执行层提供浏览器/云机基础设施;箭头表示主流产品的技术依赖关系。
3.1 OpenAI:Operator 2.0 API + ChatGPT Work,关掉 Atlas
OpenAI 的 2026 动作是一个「收」字:7 月 9 日发布 GPT-5.6 家族(旗舰 Sol 定价 5/30 per M tokens)与 ChatGPT Work------一个带内置浏览器的持久云 VM 工作 Agent,接 Gmail/Slack/M365/GitHub/Figma 的 MCP 插件;同一天宣布 Atlas 关停。消费者端,ChatGPT Agent(合并 Operator + deep research)仅向 Plus($20/月)以上开放。开发者端,Operator 2.0 API 于 4 月正式商用,支持模板化网页 Agent 与定时调度(每 org 最高 10,000 并发)。
3.2 Anthropic:Claude for Chrome 全面开放 + 系统级 Computer Use
Anthropic 走「系统级」路线:Computer Use API 控制整个桌面(鼠标、键盘、任意应用),而非只盯浏览器。Claude for Chrome 扩展 2025 年 8 月研究预览、2026 年夏全面开放,读取 DOM + 视觉上下文,优先于 Computer Use 处理浏览器任务。3 月还发布了 Chrome Computer Use 插件与 Dispatch。Anthropic 数据:其自主模式缓解措施把 prompt injection 攻击成功率从 23.6% 压到 11.2%(未消除)。
3.3 Google:Mariner 退役 → Gemini auto-browse + UCP 结构化电商协议
Google 2026 年 1 月 28 日在 Chrome 上线 Gemini auto-browse(侧边栏 + 多步任务:查航班、购物、填表),面向 AI Pro/AI Ultra 订阅者(19.99/249.99 每月),并推出 Universal Commerce Protocol(UCP)------与 Shopify、Etsy、Wayfair、Target 联手的开放结构化电商标准,绕开像素级识别的脆弱性。
3.4 Perplexity:Comet 独占 48% Agent 流量,还赢了 CFAA 官司
Comet(2025 年 7 月 Mac 首发,2026 年 3 月上 iOS/Android 与 Comet Enterprise)是当前消费者端 Agent 流量的绝对头部,复用用户已登录的会话,默认 Opus 4.5。2026 年 3 月,亚马逊以 CFAA(《计算机欺诈与滥用法》)起诉 Comet 购物功能「伪装成标准 Chrome 浏览器」并拿到初步禁令;8 月 4 日美国第九巡回上诉法院推翻禁令,裁定「助手是工具、不是人」------Agent 在用户指示下访问,访问者是用户而非 Perplexity B。这是联邦上诉法院首次就 Agent 浏览作出裁决,为整个行业卸下一颗法律炸弹。
3.5 Hark:$700M 押注「预测下一个动作」
Hark 是 2026 年最激进的赌注:5 月完成 700M A 轮、估值 6B(NVIDIA、AMD、英特尔、高通、Salesforce 参投),融资时约 70 名员工、无产品;8 月 5 日发布 Handoff。技术路线是「预测下一个动作(光标/点击/键盘)而非下一个 token」,每个任务会分配一台隔离的虚拟计算机,定价 0.18/2.37 per M tokens、0.8 秒/动作。但其 Online-Mind2Web 97.7 的分数被广泛质疑:只比 Yutori Navigator n1.5 高 0.4,在 WebTailBench v2 上反而输给 GPT-5.5,且没有第三方独立复测 C。
3.6 开源与中间层:Browser Use / Skyvern / Stagehand
开源栈在 2026 年成为不可忽视的一极:Browser Use(MIT,约 10 万星)走 DOM/无障碍树结构化推理,自训 BU 2.0 模型 $0.006/步,WebVoyager 89.1%;Skyvern(AGPL+云)走视觉优先、零逐站配置,原生 2FA/TOTP + 人在回路的验证码处理;Browserbase 的 Stagehand v3.0 抛弃内置 Playwright 依赖,兼容 Playwright/Puppeteer/Patchright。它们共同把「浏览器自动化」的成本与门槛拉到了脚本级。
四、技术拆解:Agent 怎么「看」网页
4.1 三条感知路线
浏览器 Agent 的「眼睛」有三条路线,真实产品大多混用:
- 截图 + VLM grounding:OpenAI CUA、Anthropic Computer Use、Skyvern、Hark 走这条。对 JS 重、DOM 混淆的站点鲁棒,能「看到用户看到的」,但每步 2--5 秒(Hark 声称 0.8 秒)、token 消耗高,且容易被反爬指纹识别。E2B 展示了解耦范式:grounding_model(OS-Atlas/ShowUI)定位元素、vision_model 分析截图、action_model 决定动作。
- DOM / 无障碍树 token:Browser Use、Stagehand、Playwright MCP 走这条。把页面结构化成交互元素列表让模型按索引选择,便宜(文本 token)、快(<1 秒/步)、能读隐藏文本,但面对动态 SPA、shadow-DOM、混淆标记时脆弱。
- CDP 控制层 + 混合:Playwright/Puppeteer/CDP(Chrome DevTools Protocol)是所有 Agent 的「手」。2026 的混合趋势是用 UCP 这类结构化协议绕开像素级脆弱性,或用 TOTP/密码管理器/2Captcha 处理认证。

上图:浏览器 Agent 的执行闭环------模型在「感知(截图 VLM 或 DOM/无障碍树)→ 推理 → 执行(CDP/Playwright)→ 观察状态」之间循环,直到任务完成;闭环每圈的延迟与 token 成本,正是 2026 年成本战争的核心战场。
4.2 可靠性:WebVoyager 饱和,长程任务仍是墙
基准数字在 2026 年呈现两极。WebVoyager 已接近饱和 :头部 Agent 挤在 90--98%(Surfer 2 达 97.1% pass@1、100% pass@10;Alumnium 98.5%;Browser Use 89.1%;Operator 87%),原始 GPT-4V 基线只有 59.1%。WebArena 仍是分水岭 :人类基线约 78%,追踪到的最强模型(Claude Mythos Preview)68.7%,GPT-5.4 Pro 65.8%,OpenAI Operator/CUA 58.1%------但用 DeepSeek v3.2 做 Agent 骨干可以到 74.3%,说明框架 > 裸模型。OSWorld(桌面 computer use)是硬墙 :人类基线 72.36%,OpenAI CUA 38.1%,Anthropic 从 Claude 3.5 Sonnet 的 14.9% 涨到 Opus 4.8 的约 83.5%(OSWorld-Verified);但 OSWorld 2.0 (108 个长程任务、中位时长 1.6 小时、每任务约 318 次工具调用)最优配置二元完成率仅 20.6%(部分完成 54.8%)B。
浏览器场景(97%)与桌面场景(38--83%)之间的「60 分鸿沟」,以及短任务与长任务之间的「20% 天花板」,是 2026 年采购策略的底层依据:浏览器内、单点、可人审的任务进生产;桌面、长程、无人值守的任务只能留在监督试点。
4.3 翻车现场:认证、验证码、反爬与「看不见的指令」
生产环境的失败很少来自「模型不会点击」,而来自:认证与登录态 (会话中途过期、MFA 弹出无恢复路径、IP 变更触发封号------被多家厂商列为失败头号原因);反爬对抗 (前端 Agent 在防御完善的站点上失败率约 30--50%,更阴险的是「绿光失败」------反爬系统给 Agent 返回假数据,Agent 还报告成功);以及 Prompt injection 武器化------2026 年出现多个实证攻击:LayerX 的 BioShocking(6 款产品中招、仅 OpenAI 完全修复)、Zenity 实验室的 PerplexedBrowser(零点击日历邀请劫持 Comet、经 file:// 外泄本地文件甚至 1Password 保险库)、Cato 的 WebPromptTrap(隐形文本偷 OAuth token)。Anthropic 承认缓解后仍有 11.2% 成功率 A。
这也是为什么 OpenAI 的高管会公开说:Agent 系统的 prompt injection「永远不可能完全消除」。
五、市场与资本:钱在赌什么
5.1 融资盘点:从浏览器到「给 Agent 的电脑」
2026 年的资本流向清晰分三层。应用层 :MultiOn 被 OpenAI 以约 1.1B 收购(2025-08);Atlassian 以 610M 现金收购 Arc/Dia(2025-09);Manus 母公司 Butterfly Effect 被 Meta 以 2B+ 收购(2025-12,后遭中国发改委审查)\[B\]。**执行层(浏览器/云机)** :Browserbase 40M B 轮(投后 300M、1,000+ 客户、2025 年 5,000 万次会话);Browser Use 17M seed(YC W25 批次 14% 的公司进生产);Cloudflare 把 @cloudflare/computer 做成开源,把「给 Agent 一台电脑」变成 CDN 内置能力。模型/设备层:Hark 700M @6B(pre-product);OpenAI 2026 年 3 月完成 122B 融资、投后 852B------史上最大私募轮。
5.2 定价经济学:从「卖 Token」到「卖 Agent 分钟」
定价单位的变化是 2026 年最值得跟踪的信号:Operator 2.0 API 按 agent-minute 计费(0.30/分钟);Perplexity Comet API 0.18/分钟;火山引擎 5 月发布「Agent 套餐包」、用 AFP(Agent 燃料值)统一计费,明说计量单位从 Token 转向「任务/Agent 资源消耗」B。当计价单位变成「任务」与「分钟」,意味着 Agent 本身从「模型的用法」变成了「可购买的商品」。
5.3 浏览器 Agent vs RPA:替代还是扩容
投资界的框架是「新浏览器 + 机器经济」,而非「RPA 2.0」。a16z 以 Agent 成为独立经济行为体为命题募了 2.2B 基金;PitchBook 把机器经济称为「万亿美元市场」,但指出今天只有约 1% 的可自动化工作(约 20T)流经 Agent------即还有 100 倍空间 C。
与 RPA 的关系是「切分而非替换」:RPA(UiPath 季度营收 481M、同比 +14%)在高重复、稳定、遗留系统场景仍占优;Agent 在非结构化、判断型、UI 频繁变更的场景占优。成本上,RPA 第一年约 228K vs AI 自动化约 $77K;RPA 维护费占预算 30--40%,Agent 5--15%。行业判断:2026 年的主流是「Agent 思考 + RPA 执行」的混合,而非推倒重来。
六、企业落地:谁在生产环境真的用上了
6.1 可验证的案例
Better.com(房贷) :AI 贷款代理 Betsy 每月处理约 10 万通电话,35.5% 的借款人咨询零人工介入解决;2025 年打出 189 万通电话,为信贷员省下 1,666 小时/月,推动单笔放款成本下降 41%、线索到成交转化翻倍;其 ChatGPT 应用宣称 47 秒完成信贷决策(行业平均 21 天)A。保险(Reliance Global Group) :2026 年 7 月上线安全浏览器自动化 Agent,处理承运商门户的服务请求、批改、报价拉取与文档检索,提交/签发/绑定等不可逆操作被禁止由 AI 执行,全程审计,按 GLBA/NAIC 668/NY DFS 500 合规构建。应付账款(AP) :被 Forrester 评为最成熟、ROI 最高的 Agent 场景------每张发票人工 8--15、AI 辅助 1--3、70--80% 全自动直通,月末关账从 10 天压到 5 天;控制边界是「宽读窄写」+ 资金变动前人工审批 C。政企:德国联邦「Agentic AI Hub」3 月启动,17 个市政 × 10 家创业公司 × 18 个试点;菲律宾 DICT 与 Google Cloud 签约,为 5 万+公务员配置 Gemini Enterprise。
6.2 ROI 的真实区间
综合各方口径:McKinsey 称知识工作者每周节省 6.4 小时;InData Labs 称平均 ROI 171%、1 投入 1.49 回报、14 个月内 5.8 倍;Gartner 2026 CIO 调查显示 17% 已部署 Agent、42% 计划 12 个月内部署 C。但同一批数据也提示泡沫:只有 11--17% 的组织在生产环境跑 Agent,38% 停留在试点;Gartner 预测 40%+ 的 Agent 化项目可能在 2027 年前被取消。「试点到生产」的掉档,是 2026 年企业落地最大的隐性成本。
6.3 安全与治理:Agent 是新边界
「Agent 安全」在 2026 年成为独立融资品类:Zenity 完成 $125M C 轮(SoftBank Vision Fund 2、日立、LG 入场),Menlo Security 发布业界首个「浏览器安全平台」治理 AI Agent,Google 推出 Agent Identity、Agent Gateway、Model Armor。企业治理的共识控制边界是:每个 Agent 都是特权技术身份、最小权限会话、高风险动作前人工升级审批、独立于人类的动作日志、默认阻止不可信内容 B。
七、中国视角:一张横评图与「金融智能体元年」
7.1 36氪横评:一家真会、一家诚实说不会、一家在假装
2026 年 6 月 17 日 36氪「AI唱反调」专栏实测三款国产 AI 浏览器,成为中文社区引用最多的文本:美团 Tabbit 82.35 分(Agent 自动化 95 分)、豆包 59.8 分(15 分)、夸克 57 分(30 分)。豆包被指「灾难级幻觉」------提取知乎热榜时返回「张雪机车、蒸汽机、日本炸鸡店」等与实时页面完全不符的编造话题,却标注「结合当前知乎热榜实时数据」;夸克多次诚实承认「无法访问实时网页」;Tabbit 能自动跨页比价并导出 Excel A。这张横评图基本概括了国产浏览器 Agent 的现状:模型层不差,产品层名不副实。
7.2 厂商与定价
智谱 AutoGLM 2.0 (2026-05-16):浏览器/代码/文件三类 Agent,云手机/云电脑异步执行,同日宣布 500M 融资(阿里腾讯共同投资、估值 5B);Open-AutoGLM 9B 已开源,Chrome 扩展 10 万+ 用户。阿里 QwenWork(千问办公) (2026-08-03 公测):整合 QoderWork + MuleRun + 悟空,接入 Qwen3.8-Max,主打浏览器操控、定时任务、数据库交互,走企业协同(钉钉)而非消费者路线。字节:豆包 2.1 Pro 日均 Token 调用破 180 万亿;火山引擎 5 月发布「Agent 套餐包」与 AFP 统一计费(个人版 40/200/500/1000 元每月、企业版最高 3000 元/月),明言从「卖 Token」转向「卖 Agent 资源」。腾讯 WorkBuddy 6 月 PC 端月访问 2,097 万次,居国内桌面 AI 办公智能体第一。

上图:中国浏览器/Computer Use 智能体的厂商版图与监管约束------五家头部厂商分别受备案、拟人化新规、双重授权司法标准与清朗专项行动的约束;B 端金融智能体是政策与需求共振的突破口。
7.3 监管:拟人化新规、「双重授权」与清朗行动
2026 年的中国监管对浏览器 Agent 形成三条硬约束。《人工智能拟人化互动服务管理暂行办法》2026-07-15 施行 ,直接导致豆包、千问于同日下线自建智能体功能(数据保留至 10-15),腾讯元宝 6 月 30 日先行下线------「智能体替用户上网/拟人交互」类产品形态被实质约束 B。「双重授权」司法标准 :广州互联网法院 2026-04-30 就「首例 AI 智能体不正当竞争案」作出行为保全裁定------被告用无障碍权限自动化模拟真人、绕过平台风控,被责令下架删教程;「用户同意 ≠ 平台授权」成为司法共识,与 Amazon 诉 Perplexity 案(8 月 4 日翻案)形成中美对照 A。《生成式人工智能服务管理暂行办法》与算法备案适用于浏览器智能体(智谱 AutoGLM 已于 2025-06 完成备案);中央网信办「清朗」专项行动第一阶段处置违规 AI 产品 1.4 万余款。
我原以为中国会凭成本优势直接复刻海外的 Comet 式增长,但 2026 年的数据显示:超级 App 生态封闭 + 反爬强 + 拟人化新规,让「AI 替你上网」在中国的水土不服比预期严重。 本土的突破口不在消费者浏览器,而在「金融智能体」------2025 年中国金融 Agent 平台与解决方案签约额 ¥950M,预计 2030 年达 ¥19.3B(82.6% CAGR),2026 上半年公开招标 97 个(银行占 48.5%),某银行信贷审批从 3 天压到 15 分钟 B。
八、判断与风险
判断一:「通用浏览器 + AI 功能」的路线已死,Agent 原生的浏览器另当别论。 Atlas 与 Mariner 的退役是行业级信号------在既有浏览器里加一个 AI 侧边栏,赢不了 Chrome;但 Perplexity Comet 恰恰证明「Agent 原生的浏览器」仍然成立,只是它把搜索、对话与自动操作揉成了同一个产品。所以更准确的分法是:入口属于「超级 App + 既有浏览器 + Agent 原生形态」三方,通用浏览器创业公司的窗口已经关上。我赌 2027 年之前,不会再有靠「AI 浏览器」单点概念拿到大融资的新贵,但 Agent 原生形态会继续迭代。
判断二:真正的护城河在执行层,不在模型层。 当 OpenOperator、Browser Use 这类开源把「Agent 能力」商品化,模型层的基准排名每季度洗牌(Surfer 2 超越三巨头),反而执行层的登录态复用、反爬绕过、合规审计、会话持久化难以复制------Browserbase、Steel 与 Cloudflare computer 的战场在这,而不在 benchmark 榜单。
判断三:可靠性分化会固化「浏览器进生产、桌面留试点」的采购格局。 WebVoyager 97% vs OSWorld 2.0 20% 的鸿沟意味着:单点、浏览器内、可人审的任务会在 2026-2027 大量采购;长程、桌面、无人值守的 Agent 还会长期「演示很行、投产很惨」。
判断四:认证与登录态是「AI 劳动力」的咽喉。 当 Agent 成为网页主流访问者(57.5%),谁掌握了安全复用登录态 + 过验证码 + 不被封号的工程能力,谁就掌握了规模化的钥匙。这正是 Agent 安全(Zenity 等)估值暴涨的底层逻辑。
判断五:中国会走「金融智能体 + 混合办公」而不是消费者浏览器。 拟人化新规封掉了「替用户拟人上网」的消费者形态,但 B 端「数据不出域」的合规需求与信创全栈恰好把浏览器 Agent 推向金融、政务、保险------这是政策与需求共振的方向。
风险清单:① prompt injection 无解(OpenAI 原话「不可能完全消除」),一次成功的 Comet 式劫持就可能击穿品牌信任;② Gartner 预测 40%+ Agent 项目 2027 前取消,市场叙事与实际 ROI 的裂口可能先引发一轮挤泡沫;③ 反爬军备竞赛(Chrome 更新周期破坏 TLS 指纹、绿光失败)让运营成本隐性高企;④ 中国「智能体功能下线」式的合规反复可能波及任何拟人化 Agent 产品;⑤ 模型层商品化 + 大厂补贴,独立应用层公司两头承压。
九、关键监测指标(2026 下半年)
- OpenAI Operator 2.0 API 的实际用量与价格曲线($0.30/agent-min 会不会被 Hark 拉下来)
- Hark Handoff 上线后的第三方基准复测------「97.7」是否成立
- Comet Enterprise 的企业客户数与 Comet 在 Amazon 二审后的购物功能回归
- Chrome auto-browse 与 UCP 的电商转化率,以及是否扩展到中国电商
- 中国「拟人化新规」后,Tabbit/豆包/夸克的 Agent 形态如何调整
- 金融智能体招标从 97 个(H1)到全年的增速,以及银行自建 vs 采购的分化
证据等级:A 官方/一手 B 2+可靠来源 C 单一来源 D 个人判断
AI 辅助深度研究,人工视角解读。 每日更新。
参考来源
- OpenAI Help Center --- Evolving Atlas into ChatGPT(官方)
- The Verge --- Google 关停 Project Mariner
- TechCrunch --- Hark 发布 Handoff 浏览器代理
- MacRumors --- OpenAI 发布 ChatGPT Work 与 GPT-5.6
- CallSphere --- Operator 2.0 Developer API 定价
- HUMAN Security --- State of Agentic Traffic
- Fortune --- 机器人流量占比过半(Cloudflare 数据)
- Awesome Agents --- Web Agent Benchmarks Leaderboard
- AgentMarketCap --- 浏览器 vs 桌面 Agent 的 60 分鸿沟
- arXiv --- OSWorld 2.0 长程任务评测
- PYMNTS --- Better.com 的 AI Agent 解决 35% 房贷来电
- Fortune --- SoftBank/日立/LG 投资 Zenity $125M
- eWeek --- 第九巡回法院解除 Perplexity 禁令
- 36氪 --- 国产 AI 浏览器横评(Tabbit/夸克/豆包)
- 新华网 --- 阿里「千问办公」开启公测
- IT之家 --- 智谱 AutoClaw 自进化机制与 Skill 商店
- 新浪财经 --- 火山引擎 Agent 套餐包与 AFP 计费
- 澎湃新闻 --- 豆包/千问智能体功能下线
- 央广网 --- 广州互联网法院首例 AI 智能体不正当竞争案
- 21财经 --- 2026 金融智能体招标图鉴