这两天,老金我一直在用OpenAI刚推出的个人助手dot,真的是越用越喜欢啊。
原因是啥呢?对于我这种懒人来说,它简直有点贾维斯那意思了。想到什么,拿手机跟它说说,它就去忙。我不用一直坐在电脑面前守着,也不用等一个项目彻底做完,才开始说下一件。
而且它能用的电脑,还不止一台。
它自己有一台云电脑,也能连上我的本地电脑,两边可以同时干活。像查资料、找社区里的帖子、处理GitHub里的代码,这些可以交给云端。我的数字人项目要用到本机的5090,那就放在自己的电脑上跑。
我这边还是拿着手机,跟同一个dot说话。需要改什么,接着告诉它就行了。
GrokBot和Muse也在往个人助手的方向做,手机聊天、云端干活,这几家都有。GrokBot可以让几个分工不同的Bot在群里协作,Muse则方便你查看和修改它记住的内容,也会围绕你的目标主动提建议。
不过老金更喜欢dot的一点,是原来在ChatGPT、Codex里做的项目,它能接着干。OpenAI给它定的目标也很明确:你暂时没来找它,之前交代的事情还要继续跟进,需要你拿主意的时候,再回来问你。
云端和本机怎么配合?我这几天就修了一个小工具
举个例子吧,我给Codex做了个小工具,用来集中查看项目里的任务和进度,原来能从侧栏打开。后来Codex更新了界面,这个入口就不显示了,需要重新改一下。
这份代码在我自己的电脑上,本机里还有之前改过、没上传的新内容。所以得先把这些东西检查好,让云端拿到最新的版本,不能两边各改各的。
我就让dot先检查本机的改动,把代码传到GitHub。GitHub可以用来存放代码、记录每次修改,两台电脑都能从这里拿到同一份东西。
接下来,dot在云端取回这份代码,检查新界面为什么不显示入口,再继续修改。改完以后,又交回我的Windows电脑上测试。检查通过的改动,最后合并进了项目。
你看,本机原来的工作没有丢,云端能接着改,改完还能回到本机上试。 我只需要跟dot说,我想修好什么、最后要在哪台电脑上用。
下面就是现在打开的项目总览,每个项目这轮已识别的任务,能看到哪些还没开始、哪些正在做、哪些已经完成。历史对话还有没识别的,界面上也写出来了。
点进项目,还能按未开始、进行中、已完成三列看任务。下面这张里,9项任务分在三列,图里还有历史识别、待确认的标记,自动识别任务的开关还没打开。哪些是已有记录、哪些还要我确认,就能分开看。
工作流这一页,则把做事的步骤连起来。比如这张目标与边界澄清的配置画布,先接收目标,再澄清范围,最后形成任务简报。每一步需要什么、往哪一步走,能直接在图上看见。
我自己维护的另一套工具Kim_Service,是给AI助手用的,能帮着写文章、检查代码。它的V1.4今天已经发出来了,下面就是GitHub上的发布记录。
我自己还在维护Meta_Kim,主要帮AI助手拆任务、安排协作、检查结果。它今天也发了v3.3.2,修的是一个具体问题:本来只该读文件的检查流程,遇到某类文件链接时,可能会改到原文件。
对我来说,省事就省在这些地方。修一个问题,后面还跟着测试、同步代码、检查结果,事情没停在给我一段建议那里。
云电脑也能装工具,文章、资料可以放在这边做
它的云电脑里可以安装要用的工具。我这边已经装了飞书工具,让它处理课程稿,查社区里的内容也用过Grok网页,代码这边则有Codex。
比如我最近让它检查飞书里的一份课程。它读了文字,也看了里面的图片和附带资料,然后把需要调整的地方用红字标出来,要删的内容加上删除线,原文仍然保留着。
这样我就能直接对着课程稿看,它建议改哪儿,哪些可以接受,哪些还得再聊。
还有一份我整理的AI编程教程,叫AI Coding Guide,里面讲安装、登录和各种工具怎么用。工具一更新,旧教程里的入口和命令就可能跟着变。今天发布的v5.3,已经更新了47篇教程和一张速查卡,下面就是这次的发布记录。
这边课程在处理,另一边的代码也能继续做。我在手机上补充要求就行,不用因为它正在忙,就憋着下一件事不敢说。
哪个地方自己也没想清楚,就先跟它聊聊。 不用上来就给它一份写得特别完整的需求。
比如你想改个课程,拿不准是补案例还是重排章节,就让它把两种做法说一说。补案例能解决什么,重排以后读起来会有什么不同,各自要花多少时间,你听明白了再选。
我会这样交代,你也可以换成自己的材料:
帮我看看这份方案,哪里讲得不清楚,哪里可能做不成。先别改原文,把你觉得最要紧的几个问题告诉我,最好指出具体在哪一段。要是有些地方需要我选,你就把两种做法讲清楚,各自能做到什么程度,大概要花多少时间。咱们先聊明白,再开始改
把文档传给它,或者连上存放文档的应用,就可以开始了。拿到检查意见以后,你再看看它说的地方是不是真有问题。如果建议太泛,就让它拿其中一段改给你看,和原文放在一起比一比。
别人是怎么用的?有位老师让它一起看视频和代码
我还看到一个挺实用的例子,尤其适合平时要看作业、看方案的人。
开发者Antonio Leiva参加了dot的早期体验。北京时间9月30日,他分享过一次审阅学生作业的经历。学生交来的是AI课程里的练习,有演示视频,也有代码,需要对着看。
这种活儿你自己做,得先看学生在视频里讲了什么,再去翻代码,看看他说的功能到底有没有做出来,然后才能写反馈。
dot开始查看这份作业后,Antonio又让它在云电脑上装了Whisper。这是一个把语音转成文字的工具,装好以后,它先把视频里的话转成文字,再通过GitHub连接器查看学生的代码,最后给他一份初步检查意见。
dot先整理出一份检查意见,老师再去核对重要的地方。 这样他就不用从空白开始,可以对着这份意见,决定最后怎么给学生反馈。
这个用法我觉得挺值得借鉴。你要是经常审产品演示,或者看别人交来的项目,也可以把视频和实际材料一起给它。这样它看到的就不只是对方怎么介绍,还能对着材料看看,事情是不是那样。
开始之前,记得把要看的文件和代码交给它,或连上存放资料的应用。
做视频的时候,也能先让它拿个版本出来
还有人把dot用在了做视频上。
Hugo想给Space做一支产品发布视频,就把这件事交给了dot。9月30日,他晒出了一条30秒的成品,里面已经有开场介绍、界面动画和结尾了。下面这段就是从他发的视频里截出来的,画面里的界面是宣传片用来介绍产品的示意。
后来他还让另一个模型重新做了一版,觉得效果更好。所以拿到初稿以后,照样可以继续改。不过有了画面,讨论就具体多了,哪一段太慢、哪个地方不好看,直接指出来就行。
另一位用户Adem做得更随意一些,他让dot自由做点东西。按他10月1日分享的说法,dot就在它自己的云电脑上,用Blender做了一段大约40秒的三维短片。
你看下面这段,一只机器人在温室里照料植物,它的胸口也装着一株小苗,最后花慢慢开了。这是他晒出来的作品片段。
如果你也想给课程做个开场,或者给自己的产品做个小演示,可以先跟它聊聊这个视频准备放在哪里,手头有哪些素材,大概想要什么感觉。
先让它做一版出来,你再看着结果说哪里要改。 很多要求光靠嘴说,自己也讲不清楚,等东西摆在眼前了,反而知道该怎么调整。
想试的话,先在电脑上把dot建好
第一次创建dot,要用 ChatGPT桌面App或者电脑浏览器。我这次用网页版的时候,是先点左边的首页,展开侧栏以后,就能看到你的dot这个入口了。
你也可以直接打开dot主页。
进去以后跟着引导创建就行。它会让你连接一些应用,这一步不用急着全配好,等你要处理邮箱、日历或者文档时,再连需要用的那个。
电脑上创建好以后,手机App里就能接着聊。 记得把App更新到支持dots的版本,手机浏览器目前还不支持。
如果你找不到入口,也先别急。截至10月3日,它还在逐步向符合条件的Pro、Business Premium和Enterprise账号开放,所在地区、企业管理员的设置也会有影响。先看看自己的账号和版本有没有开放,比到处找安装包靠谱。
还有件事,老金我刚弄清楚:dot把改项目的活儿交给Codex时,会在后台启动任务。有些任务跑在本机上,桌面上看不到窗口,但它确实在干活,也照样用你的Codex额度。
所以老金我比较建议选GPT-6.1 Sol,推理强度用high或者xhigh。我自己用下来,感觉非常耐用。
和dot聊天本身不计入普通ChatGPT用量,深度工作仍然有自己的限额,Work任务也照常使用对应额度。想长时间跑任务,开工前看一眼剩余用量就行。
它的云电脑在哪里?打开资料就能找到
前面说的云电脑,就是dot自己用的那台电脑。你让它查资料、做文档或者处理数据,可以把这些事情放在那里做。你自己的电脑关机了,云端的任务也可以继续。
想看看它正在干什么,就打开dot的资料,在电脑这一栏里,点你的dot的电脑。下面红框标出来的就是入口。
打开以后,你先看到的是它的电脑画面。如果需要自己操作鼠标和键盘,就点 Take over,也就是接管。比如网站要登录,你就可以自己进去处理。
下面两张是OpenAI官方文档里的示意。第一张是接管,自己处理完以后,再点第二张里的 Return control,把电脑交还给它,它才能接着做。
它的云浏览器和你平时用的浏览器是分开的。你在自己电脑上登录过的网站,到了云电脑里,可能还得再登一次。需要密码时,用它提供的安全登录表单,或者自己接管网页完成,别直接把密码发到聊天里。
要处理本机文件,就把自己的电脑连上
有些文件只放在自己的硬盘里,这时候就得让dot连上本机了。比如我之前让它修一个小工具,代码就在我电脑上,它要读这些文件,才能接着处理。
在电脑端点dot的头像和名字,再打开 Computers,就能看到电脑列表。我的界面里,一台是dot的云电脑,另一台是自己的本机。
第一次连接,要在你准备让它用的那台电脑上,打开ChatGPT桌面App。按官方现在的步骤,顺着下面做就行:
-
打开dot的资料,在Computers里找到 Your computer,也就是你自己的电脑
-
点 Allow access,看完弹出的确认说明,再点一次Allow access
-
连好以后,回到聊天里问问dot能不能用这台电脑,再告诉它文件放在哪儿、你想让它做什么
之后你在手机上,也能选要用哪台电脑。下面是我手机里的实际画面,上面那项是dot的云电脑,下面带设备名的,就是已经连接的本机。
这里最需要记住的是,让它用本机干活,本机就得开着、联网,ChatGPT App也要保持打开。手机只是你跟它说话的地方,家里的电脑关了,它也没法继续读那台机器上的文件。
已经在本机开始的任务,也不会因为你在菜单里选了云电脑,就自己搬过去继续做。所以交代任务时,顺便说清楚让它用哪台电脑,后面就少一点误会。
第一次连上,不妨拿一个小文件夹试试。让它帮你读里面的文档,整理一份文件清单,说清每份文档主要讲什么,先不要改名、搬动或者删除。你看看它有没有找对文件,再决定接着做哪些事。
至于做到什么程度,也可以用平时说话的方式交代。比如帮我修代码,就把改好的内容和测试结果拿回来。帮我检查课程,就把有问题的段落指出来。如果最后还要发布或者发给别人,就先把成品给我看一下。
想看进度,可以在电脑端的dot资料里打开 Activity,也可以直接问它:现在什么做完了,什么还在做,有没有哪一步需要我处理。等它说做完了,记得把文件或网页打开看一看,有问题就在原来的对话里接着改。
写在最后
一开始说它像贾维斯,是因为拿手机交代几句,事情就有人接着做了,确实方便。
但用着用着,我又觉得,省下来的还不只是坐在电脑前的时间。
有些事情,以前一想到后面要查资料、改代码、反复测试,就容易说算了,等有空再弄吧。倒也不是不想做,就是眼下实在腾不出手。
现在我会先拿手机跟dot说说,看看这件事能怎么做。哪儿没想明白,就先聊一聊,它把几种做法摆出来,我再选。
我不用等自己把每一步都学会了,才开始做这件事。 先把想要的结果聊清楚,后面那些具体的活儿,就可以让它接着往下做了。
这么想的话,以前放在一边的那些小念头,好像也可以再拿出来看看。
谢谢你读我的文章。
如果觉得不错,随手点个赞、在看、转发三连吧🙂
如果想第一时间收到推送,也可以给我个星标⭐~谢谢你看我的文章。