程序员老鬼

Orca:把 Claude Code、Codex、Gemini 们关进一个驾驶舱

用 Claude Code、Codex、Gemini 这类 AI 编程助手,最烦的地方有时候不是它写得差,而是你自己先乱了。

一个终端跑 Claude Code,一个终端跑 Codex,旁边再开个浏览器看文档,VS Code 里还挂着一堆改动。任务一多,东哥真的会有种错觉:我到底是在写代码,还是在给一群 AI 实习生排班?

最近看到 Orca,这项目的方向就挺直接:别让你在终端里来回切了,把多个 AI coding agent 收到一个界面里统一管。它项目页自己说的是 AI Orchestrator,可以让 Codex、Claude Code、OpenCode、Pi 等工具 side-by-side 跑起来,每个 agent 都在自己的 git worktree 里干活,最后集中追踪。

这个设计有点意思。

Image

以前我们用 AI 改代码,经常是一个模型先改一版,觉得不行,再清掉上下文换另一个模型。中间最烦的是啥?不是 prompt,而是代码状态。文件被谁改了,改到哪一步,能不能退回去,测试有没有跑,分支是不是已经脏了。

Orca 走的是另一条路:同一个需求,可以同时丢给几个 AI。Claude Code 写一版,Codex 写一版,Gemini 或 OpenCode 再来一版,各自在独立 worktree 里动手,不互相污染。跑完以后你看 diff,看提交,看哪一版思路靠谱,再决定合哪份。项目页也明确写了 parallel worktrees:一个 prompt 可以分发给多个 agent,每个在隔离的 git worktree 里跑,方便对比结果并合并“胜出”的版本。

东哥先说句实在的,这种东西最适合的不是“让 AI 替你从零造火箭”,而是那些边界比较清楚、但实现路径有差异的活。

比如重构一个组件、补一组测试、修一个接口兼容问题、把某个旧页面迁到新样式系统。你让一个模型写,可能它太保守;让另一个写,可能它一口气重构半个项目。以前你只能凭感觉来回试,现在至少能把几份产出摊开看。这个对比过程,反而是 AI 编程里挺真实的一环。

Image

Orca 还不只是一个“任务列表”。它内置终端分屏,项目页提到有类似 Ghostty 级别的终端体验、WebGL 渲染、分屏和重启后保留 scrollback。还有内置浏览器和 Design Mode,可以点真实 Chromium 窗口里的 UI 元素,把 HTML、CSS 和截图一起送进 agent 的 prompt。

这地方我会多瞅两眼。因为很多前端 bug,光靠你口述“按钮有点歪”“这个卡片间距不对”,AI 其实很容易瞎猜。能把局部 UI、DOM、样式直接喂过去,至少比截图加一堆废话要省劲。当然,最后 CSS 有没有写成一坨,还得人看,别指望它自动有审美。

它还接了 GitHub 和 Linear,可以在应用里看 PR、issue、project board,从任务直接开 worktree。手机端也有 companion app,项目页写的是可以在手机上监控和 steering agent,agent 完成时收到通知,也能从外面发 follow-up。

这个功能听着有点“老板味”,但实际开发里还真有场景。比如你人在路上,agent 跑完了说测试挂了,你不用掏电脑,只补一句“先别动数据库 schema,换成兼容写法”。这种小干预,手机端够用了。

Image

安装门槛也不算高。Orca 桌面端支持 macOS、Windows、Linux,项目页给了安装包,也提供 Homebrew 和 Arch AUR 方式;移动端则有 iOS 和 Android companion。

不过东哥提醒一句,别看到“多个 AI 并行”就上头。

并行的代价是审查成本也并行。三个 agent 同时写代码,最后不是省掉 review,而是你要看三份 diff。尤其是涉及环境变量、鉴权、数据库迁移、回滚脚本、token 额度这些地方,AI 很容易写得像能跑,实际一上 CI 就露馅。老开发的毛病又犯了,我看到这种工具第一反应不是酷不酷,而是失败后能不能救回来、脏分支能不能扔、日志能不能看明白。

说白了,Orca 干的不是替你写最后一行代码,而是把一群 AI 编程助手从散乱终端里拎出来,放进一个能看 diff、能开 worktree、能接任务、能远程盯进度的工作台。

GitHub地址:github.com/stablyai/orca