9 月 29 日,OpenAI 发布 Dots,让一个个人 Agent 持续跟进你的工作。10 月 7 日,GPT-6 的智能界面开始推送,回答里可以出现按钮、表单和可交互的小工具。
把这两条新闻放在一起,会有一个挺有意思的问题:既然 AI 已经开始替人操作软件,为什么还要给人做更多界面?
我把几份官方公告和使用说明放在一起读了一遍。我的理解是,OpenAI 正在尝试让我们少花时间指挥每一步,同时保留查看、调整和决定的机会。Dots、智能界面,以及可以制作网站的 Sites,分别处理了这件事的不同部分。
🔹 Dots 想接走的,是反复交代和持续跟进
先把 Dots 理解成一个能持续工作的个人助手。按官方介绍1,它使用 GPT-6 Astra,有自己的云端电脑和浏览器,能够使用你授权连接的应用。
官方举了一个很具体的例子:一位早期测试者忘记向一家出版机构开票,Dot 发现这件事,准备好发票,在获得他的批准后发出。这是 OpenAI 提供的案例。
这个例子里值得留意的是「发现」和「批准」。前者意味着用户不必每次先提出一个完整问题,后者保留了人对实际操作的决定权。
如果这类工作能稳定完成,我们交给 AI 的东西就会发生变化。过去是一条条动作,比如查找材料、整理内容、写一封邮件;以后可以交代一件需要持续关注的事,以及什么结果算做好。
但持续关注也需要边界。官方说明,Dots 的后台主动研究使用只读工具;涉及账户或信息分享的操作另有审查机制,用户也可以设置允许、需要批准或禁止的行为。不能把「常驻助手」理解成「默认什么都能做」。
对普通使用者来说,交代清楚哪些事情必须停下来问自己,可能会和写清任务一样重要。
🔹 GPT-6 的界面,留住了人想亲手调整的部分
有些事情适合委托,有些事情,我们本来就想参与。
比如看一条旅行路线。知道每个地点的文字介绍之后,你可能还想看它们离得多远、哪一站可以顺路去。地图能让这些关系同时出现在眼前,省去几轮来回追问。这也是 GPT-6 智能界面官方公告2展示的场景之一。
这次更新允许模型根据问题组合文字、图形和交互元素。官方展示了可以探索的自行车结构图,以及分账、计算等小工具;简单问题仍然可以直接用文字回答。
这次值得留意的,是模型可以根据当前问题组织一个能直接操作的回答。
想改一个数字,就改那个数字;想比较几个选项,就让它们摆在一起。一个输入已经很明确的动作,没有必要每次都重新组织成一段话。

截图来自 OpenAI 的官方演示3:通过加减按钮调整聚餐人数,查看对应采购量。
这也不意味着聊天失去价值。需求还模糊、条件需要商量时,对话很自然。等对象和选项已经明确,界面可以接过其中一部分操作。至于涉及外部系统的执行,又要看工具连接和授权,不能因为回答里出现了按钮,就认定事情已经办成。
聊天、界面和 Agent 可以出现在同一件事里,分别让人表达需求、调整选择,再把确定的工作交出去。

图示为本文分析。三种方式按任务需要组合,不要求每项任务都经过全部步骤。
🔹 Sites 回答的是另一个问题:下次还要重新来吗
当次回答里有一个好用的小工具,和下周还能打开、还能发给别人用,是两种需求。
ChatGPT Sites 处理的是后者。官方帮助文档4把它定义为创建、预览、发布和分享网站及轻量应用的能力。项目跟踪、发布日历、内部入口和报告,都在建议用途里。目前它仍处于公开测试阶段。
沿着这个用途看,临时问一次「这个项目怎么样」,得到回答就够了。如果团队隔几天就需要查看进度,一个能反复打开的页面会更合适。创建时可以用对话说明需求,日常查看时就沿用已经确定的界面。
这里需要分清:GPT-6 在聊天里生成交互回答,并不能直接推出它已经变成一个可长期维护、可分享的 Site。保存什么、谁能访问、怎样更新,都是应用要另外处理的问题。
Sites 的文档就专门区分了访问权限与数据权限。别人拿到页面链接,不等于拿到了你的连接账户。目前,连接应用用于 Business 和 Enterprise 工作区内的私有 Site;访问者使用时,只能读取其已授权的数据,不能借此修改连接应用或在后台访问这些数据。
界面留下来以后,省下的是重复交代的工夫,增加的是维护责任。内容过期了谁更新,分享范围有没有选错,修改以后有没有实际检查,这些事情不会因为网站由 AI 生成就消失。
🔹 OpenAI 想改变的,可能是我们交代工作的方式
把这几次发布串起来,我更倾向于这样理解它们的共同方向:用户交代目标后,可以在需要的时候回来查看和调整;经常使用的东西,则留下一个稳定入口。
Dots 尝试减少持续跟进的负担,智能界面尝试减少反复描述局部操作的负担,Sites 让值得反复使用的工具有机会保存下来。这是我根据产品分工做出的判断。
也不用因此把所有事情都改造成 Agent 任务。翻译一句话,直接得到一句话就很好。只是想了解一个概念,也未必需要专门做个网站。多一个界面、多一次授权,都应该真的省下某种麻烦。
我比较在意的是,新的使用方式会把人的注意力放在哪里。AI 查完资料、列好选项以后,我们是否更容易看出它漏掉了什么;它准备执行时,我们是否知道这一步会改变什么;任务结束后,我们是否拿到了能继续使用的结果。
OpenAI 自己也承认,智能界面的设计判断仍有改进空间,Dots 仍然可能出错。一个按钮摆得再漂亮,也不能替它背后的数据和动作作保证。
尝试这些产品时,我会先挑一件每周都在重复的小事,看它能否在减少我操作的同时,让我更容易检查结果。 如果只是把一段聊天变成了一张需要重新学习的页面,那还谈不上省事。
💡
/ 作者:kakarot / 投稿、合作或交流,欢迎在公众号后台留言
参考资料
1 官方介绍:https://openai.com/index/introducing-dots/
2 智能界面官方公告:https://openai.com/index/gpt-6-for-everyone/
3 官方演示:https://openai.com/index/gpt-6-for-everyone/
4 官方帮助文档:https://help.openai.com/en/articles/20001339-creating-and-using-chatgpt-sites