从 Dots 到 GPT-6,OpenAI 想让你怎样使用 AI?

9 月 29 日,OpenAI 发布 Dots,让一个个人 Agent 持续跟进你的工作。10 月 7 日,GPT-6 的智能界面开始推送,回答里可以出现按钮、表单和可交互的小工具。

把这两条新闻放在一起,会有一个挺有意思的问题:既然 AI 已经开始替人操作软件,为什么还要给人做更多界面?

我把几份官方公告和使用说明放在一起读了一遍。我的理解是,OpenAI 正在尝试让我们少花时间指挥每一步,同时保留查看、调整和决定的机会。Dots、智能界面,以及可以制作网站的 Sites,分别处理了这件事的不同部分。

🔹 Dots 想接走的,是反复交代和持续跟进

先把 Dots 理解成一个能持续工作的个人助手。按官方介绍1,它使用 GPT-6 Astra,有自己的云端电脑和浏览器,能够使用你授权连接的应用。

官方举了一个很具体的例子:一位早期测试者忘记向一家出版机构开票,Dot 发现这件事,准备好发票,在获得他的批准后发出。这是 OpenAI 提供的案例。

这个例子里值得留意的是「发现」和「批准」。前者意味着用户不必每次先提出一个完整问题,后者保留了人对实际操作的决定权。

如果这类工作能稳定完成,我们交给 AI 的东西就会发生变化。过去是一条条动作,比如查找材料、整理内容、写一封邮件;以后可以交代一件需要持续关注的事,以及什么结果算做好。

但持续关注也需要边界。官方说明,Dots 的后台主动研究使用只读工具;涉及账户或信息分享的操作另有审查机制,用户也可以设置允许、需要批准或禁止的行为。不能把「常驻助手」理解成「默认什么都能做」。

对普通使用者来说,交代清楚哪些事情必须停下来问自己,可能会和写清任务一样重要。

🔹 GPT-6 的界面,留住了人想亲手调整的部分

有些事情适合委托,有些事情,我们本来就想参与。

比如看一条旅行路线。知道每个地点的文字介绍之后,你可能还想看它们离得多远、哪一站可以顺路去。地图能让这些关系同时出现在眼前,省去几轮来回追问。这也是 GPT-6 智能界面官方公告2展示的场景之一。

这次更新允许模型根据问题组合文字、图形和交互元素。官方展示了可以探索的自行车结构图,以及分账、计算等小工具;简单问题仍然可以直接用文字回答。

这次值得留意的,是模型可以根据当前问题组织一个能直接操作的回答。

想改一个数字,就改那个数字;想比较几个选项,就让它们摆在一起。一个输入已经很明确的动作,没有必要每次都重新组织成一段话。

截图来自 OpenAI 的官方演示3:通过加减按钮调整聚餐人数,查看对应采购量。

这也不意味着聊天失去价值。需求还模糊、条件需要商量时,对话很自然。等对象和选项已经明确,界面可以接过其中一部分操作。至于涉及外部系统的执行,又要看工具连接和授权,不能因为回答里出现了按钮,就认定事情已经办成。

聊天、界面和 Agent 可以出现在同一件事里,分别让人表达需求、调整选择,再把确定的工作交出去。

图示为本文分析。三种方式按任务需要组合,不要求每项任务都经过全部步骤。

🔹 Sites 回答的是另一个问题:下次还要重新来吗

当次回答里有一个好用的小工具,和下周还能打开、还能发给别人用,是两种需求。

ChatGPT Sites 处理的是后者。官方帮助文档4把它定义为创建、预览、发布和分享网站及轻量应用的能力。项目跟踪、发布日历、内部入口和报告,都在建议用途里。目前它仍处于公开测试阶段。

沿着这个用途看,临时问一次「这个项目怎么样」,得到回答就够了。如果团队隔几天就需要查看进度,一个能反复打开的页面会更合适。创建时可以用对话说明需求,日常查看时就沿用已经确定的界面。

这里需要分清:GPT-6 在聊天里生成交互回答,并不能直接推出它已经变成一个可长期维护、可分享的 Site。保存什么、谁能访问、怎样更新,都是应用要另外处理的问题。

Sites 的文档就专门区分了访问权限与数据权限。别人拿到页面链接,不等于拿到了你的连接账户。目前,连接应用用于 Business 和 Enterprise 工作区内的私有 Site;访问者使用时,只能读取其已授权的数据,不能借此修改连接应用或在后台访问这些数据。

界面留下来以后,省下的是重复交代的工夫,增加的是维护责任。内容过期了谁更新,分享范围有没有选错,修改以后有没有实际检查,这些事情不会因为网站由 AI 生成就消失。

🔹 OpenAI 想改变的,可能是我们交代工作的方式

把这几次发布串起来,我更倾向于这样理解它们的共同方向:用户交代目标后,可以在需要的时候回来查看和调整;经常使用的东西,则留下一个稳定入口。

Dots 尝试减少持续跟进的负担,智能界面尝试减少反复描述局部操作的负担,Sites 让值得反复使用的工具有机会保存下来。这是我根据产品分工做出的判断。

也不用因此把所有事情都改造成 Agent 任务。翻译一句话,直接得到一句话就很好。只是想了解一个概念,也未必需要专门做个网站。多一个界面、多一次授权,都应该真的省下某种麻烦。

我比较在意的是,新的使用方式会把人的注意力放在哪里。AI 查完资料、列好选项以后,我们是否更容易看出它漏掉了什么;它准备执行时,我们是否知道这一步会改变什么;任务结束后,我们是否拿到了能继续使用的结果。

OpenAI 自己也承认,智能界面的设计判断仍有改进空间,Dots 仍然可能出错。一个按钮摆得再漂亮,也不能替它背后的数据和动作作保证。

尝试这些产品时,我会先挑一件每周都在重复的小事,看它能否在减少我操作的同时,让我更容易检查结果。 如果只是把一段聊天变成了一张需要重新学习的页面,那还谈不上省事。

💡

/ 作者:kakarot / 投稿、合作或交流,欢迎在公众号后台留言

参考资料

1 官方介绍:https://openai.com/index/introducing-dots/

2 智能界面官方公告:https://openai.com/index/gpt-6-for-everyone/

3 官方演示:https://openai.com/index/gpt-6-for-everyone/

4 官方帮助文档:https://help.openai.com/en/articles/20001339-creating-and-using-chatgpt-sites

相关推荐
沛东的认知和实践2 分钟前
能增、能删,但不幂等:拆开 WeKnora 的LLMWiki知识编译——彻底搞懂LLM Wiki第二篇
人工智能
两万五千个小时4 分钟前
DeepSeek Harness 从 0 开始:20 goal模式
人工智能·程序员·架构
QuZhengRong4 分钟前
【周报】2026-10-02~10-08 AI 科技周报
人工智能·科技·新闻
云沛科技5 分钟前
在实验室复刻暴风雪:低温雨雪冰雾耦合试验室解锁极端环境 “实景仿真”
人工智能·功能测试·科技
程序员大狐狸5 分钟前
Ultra X7 358H 笔记本电脑,本地部署当红炸子鸡 Qwen3.8-27B-Q4,实测生成速度 5.6 tok/s
人工智能
styshoo6 分钟前
NVIDIA Dynamo Snapshot 介绍
人工智能
用户8314550980316 分钟前
如一 Agent 架构解读(一):数字分身的执行模型——Run、Turn 与四个时间尺度
人工智能
Kyops6 分钟前
GPT-6 把地图和交互组件带进 ChatGPT,答案终于可以直接操作了
人工智能
布吉岛的石头10 分钟前
Java 程序员第 49 阶段11:Java 接 BERT:用 ONNX Runtime 做句向量推理
java·人工智能·python·深度学习·bert·transformer
OCR_1337162127511 分钟前
智能交通底层逻辑:国内车牌分类规范与AI识别适配技术解析
大数据·人工智能·分类