我开源了一个 Codex Desktop ↔ Claude Desktop 双向调用工具

最近我同时在用 Codex Desktop 和 Claude Desktop 写代码,经常遇到一个很具体的问题:

Agent A 已经完成了技术方案和代码实现,我想让 Agent B 独立 review 一遍。但代码虽然在同一个项目里,方案取舍、产品规则和前面讨论过的 Context,仍然留在 Agent A 的对话中。

以前只能手动复制 Context、重新描述任务、创建另一个会话,再把 review 结果复制回来。

所以我做了一个开源工具:Desktop Agent Bridge(DAB)

它能做什么?

DAB 目前支持两条双向流程:

text 复制代码
Codex Desktop
  → 新建 Claude Desktop session
  → Claude 独立 review
  → 结果返回原 Codex 对话

Claude Desktop
  → 新建 Codex Desktop task
  → Codex 独立 review
  → 结果返回原 Claude 对话

目标 Agent 创建的不是一个隐藏进程,而是原生 Desktop 应用中真实、可见、可以继续追问的新会话。

review 完成后,结果会自动回到 Agent A 的原始对话,不需要再手动复制粘贴。

怎么使用?

安装:

bash 复制代码
npm install -g desktop-agent-bridge
dab install

安装后重启 Codex Desktop 和 Claude Desktop。

在 Codex Desktop 当前项目对话里:

text 复制代码
$peer-review Ask Claude to review the current changes for correctness and regressions.

DAB 会在同一个项目下创建新的 Claude Desktop session,Claude 读取当前工作区和源会话 Context,完成只读 review,再把结论返回 Codex。

反方向,在 Claude Desktop 中:

text 复制代码
/peer-review Ask Codex to review the current changes against the intended design.

DAB 会创建一个新的、可持久化的 Codex Desktop task,完成 review 后把结论返回 Claude。

Context 是怎么传过去的?

DAB 不会假装"复制模型的隐藏状态"。它传递的是可审计的源会话历史,并让目标 Agent 重新读取当前工作区。

Claude Desktop → Codex Desktop

Claude 插件记录当前会话对应的 transcript JSONL。DAB 使用 Codex 的外部会话导入能力,把历史转换为新的原生 Codex task,然后带着 review 请求继续执行。

Codex Desktop → Claude Desktop

DAB 根据当前 Codex task 找到本地 rollout,提取用户消息、Assistant 回复和必要的工具活动说明,生成规范化 transcript。新的 Claude Desktop session 会读取这份 transcript 和当前仓库。

系统指令、隐藏推理、宿主元数据等不会被伪装成可迁移的 Context。

目前提供四种 Context 模式:

  • auto:能原生导入时使用原生导入,否则生成规范化完整 transcript;
  • full:始终生成规范化完整 transcript;
  • raw:传递原始 JSONL 路径和 SHA-256;
  • bounded:只传显式指定的 Context,适合敏感项目。

和已有的多 Agent 工具有何不同?

市面上已经有不少 Agent 协作方案,例如 Codex CLI 与 Claude Code 互调、终端中的多个 Agent 通信,以及由 IDE 统一托管多个 Agent session。

它们解决的是 CLI、终端或共享宿主里的协作。

DAB 只解决一个更窄的边界:

保留 Codex Desktop 和 Claude Desktop 两个官方应用,让原生 Desktop 会话能够双向创建、传递 Context,并把结果带回来。

它不是新的 IDE,不是共享聊天室,也不是通用多 Agent 调度平台。

Skill 可以扩展吗?

可以。DAB 把"工作流语义"和"Desktop 传输"分开:

text 复制代码
你的 Skill / Plugin
  → 决定什么时候调用、让 Agent B 做什么、结果格式是什么
  → dab handoff
  → 负责 Context、原生 session 创建、等待和结果返回

除了内置的 peer-review,还可以独立发布:

  • 安全审查;
  • 架构质疑;
  • 测试方案 review;
  • API 兼容性检查;
  • 其他只读工作流。

Skill 可以放在独立 GitHub 仓库、npm 包或用户级目录中,不需要写进业务项目源码。

当前限制

这个项目还处于早期阶段,目前有几个明确限制:

  • 只支持 macOS;
  • 需要 Node.js 20+;
  • 需要同时安装 Codex Desktop 和 Claude Desktop;
  • Claude 侧的目标项目需要已出现在 Code sidebar;
  • 部分能力依赖 macOS Accessibility 和 Desktop 当前暴露的本地能力,应用升级可能需要兼容适配;
  • Context 可能跨模型供应商传递,敏感项目应使用 bounded 模式。

项目 MIT 开源,欢迎试用:

github.com/WarrenJones...

我现在最想验证两个问题:

  1. 真实项目里的 Context 是否足够?
  2. 除了 code review,你最希望增加什么只读 workflow?
相关推荐
漂流瓶jz1 小时前
【AI】大模型本地部署与量化:Ollama、transformers、llama.cpp实践
人工智能·llm·ai编程
飞哥数智坊2 小时前
AI时代,我们到底该学什么、用什么,为什么还没提效?
人工智能
飞哥数智坊3 小时前
GPT 做架构,国内模型写代码:这条 AI 开发路线能跑通吗?
人工智能·ai编程
AI_AGENT_DEV_AI3 小时前
AI 智能体的开发与上线
人工智能
VL——MOESR3 小时前
【具身智能】VLA论文阅读随笔
论文阅读·人工智能·机器学习·具身智能·vla
OCR_133716212753 小时前
从模板匹配到AI泛化识别:文本抽取如何重构护照阅读器落地生态
人工智能·重构
大唐荣华3 小时前
从OpenAI关停Sora看世界模型、AI视频与国内具身智能赛道路线分化
人工智能·openai·sora·内容生成
DevOps老兵3 小时前
AI Infra实战02:GPU监控实战,用DCGM+Prometheus+Grafana看清每一张卡
人工智能·grafana·prometheus·ai infra·gpu监控·dcgm
旧日之血_Hayter4 小时前
Antigravity 工作流的实践记录
人工智能
dozenyaoyida4 小时前
AI与大模型新闻日报 | 2026-09-01
人工智能·ai·大模型·新闻