让 AI Agent 替我跑日常重复任务,一周踩坑记录

最近把手头几件每天都要重复的小事交给 AI Agent 去跑了:几个平台的签到、每天的待办,还有一些固定格式的整理工作。单件都不超过一分钟,但分散在五六个地方,经常想起来的时候已经错过了时间。

跑了一周,比我预期的好用,但也踩了不少坑,记录一下。

我的做法

很朴素:把所有日常事项写成一个 markdown 清单,写清入口、频率、注意事项,然后让 Agent 自己读清单去执行。

真正难的从来不是「让它去做」,而是「让它做得稳」。

踩到的坑

1. 干净浏览器 = 每个站点都要重新登录

一开始用的是独立启动的 Chromium,干净是干净,问题是所有站点都是未登录状态,每个平台都要扫码输密码,还时不时触发验证。后来换成复用已有 profile 的方式,把登录态直接带过来,一下子顺了很多。这一步基本决定了整件事能不能跑得下去。

2. 很多「按钮」其实不是 button

像掘金这类站点的交互元素大量是 div 加事件监听,DOM 里拿不到可交互语义,快照里的元素列表常常是空的,只能退回去用坐标点。而且带 hover 才出现的悬浮面板,必须用真实的 mouse move / down / up 才点得动,直接 el.click() 有时不生效。

3. 富文本编辑器不能往里塞值

文章编辑器基本都是定制富文本,直接改 DOM 是不生效的。得先点进编辑区拿到焦点,再用键盘逐字输入。慢是慢,但没有更好的办法。

4. 验证码和风控只能人工

这块没什么好说的。遇到滑块、点选、人机验证,只能把控制权交回给人。还有的站点一旦识别出自动化会直接返回空白页,这种情况继续重试只会更糟,应该立刻停手。

5. 发布类动作要卡在最后一步

写文章、发动态这种要公开发布的操作,我现在都让 Agent 把内容准备好、停在确认按钮前面,由人扫一眼再点。多花十秒,但省掉了内容不对还得删的麻烦。

一点心得

  • 能用官方接口就别硬刚 UI,稳定性差一个量级
  • 把「需要人工介入」的环节显式设计出来,别指望全自动
  • 涉及钱、身份验证、批量外发的动作,永远留给人工确认

最后

一周下来,省的时间说多不多,但「总惦记着有件事没做」这种心智负担被拿掉了,这点比省时间更值。目前还在继续往清单里加东西,跑一段时间再回来补充。

相关推荐
Solara2 小时前
1 条 audit=0 的幽灵记录:我说不清是我删的,还是平台吞的
人工智能·程序员·ai编程
孟健2 小时前
我通过了水星银行美国业务证明审核,交了几轮材料
ai编程
杨杨杨大侠2 小时前
一句“修个 Bug”,AI 编程工具到底怎么扣额度?
人工智能·agent·ai编程
回家路上绕了弯2 小时前
智能体编排平台中,工作流与 Agent 如何分工?
后端·ai编程
桃西西呀2 小时前
给告警加了道 AI 初筛,我终于半夜不用爬起来了看无用告警了
人工智能·llm·ai编程
杨杨杨大侠2 小时前
MCP 到底接在了哪一层?从“Agent 调工具”说起
agent·ai编程·mcp
全栈弄潮儿2 小时前
AI 辅助写单测:如何覆盖边界,而不是凑覆盖率
aigc·openai·ai编程
OpsEye2 小时前
AI 账单月月上涨,你的企业真的把大模型用对了吗?
javascript·ai编程
小虎AI生活2 小时前
助残场景下的AI培训落地,从截图、课件到台账,我总结的四条可复用经验
aigc·ai编程