如果能讓 Claude 和 Codex 像結對程式設計師一樣,直接互相對話,會怎麼樣呢?其中一個擔任主要工作者,另一個則擔任審閱者。

最優秀的代理程式工作流程,竟然經常與人類協作的模式如此相似,這點頗令人玩味。Cursor 的研究人員在他們關於長期運作的程式設計代理程式的研究中發現了這一點。這項工作促使他們創建了一個多代理程式的工作流程,其中有一個主要協調者將任務分配給工作者。這與大多數人類團隊的運作方式相似。Claude Code 的「代理程式團隊」和 Codex 的「多代理程式」功能運作方式類似,子代理程式會向主代理程式回報。未來,子代理程式甚至可以像人類一樣互相互動。

我想透過多個代理程式框架和程式設計師使用的另一種工作流程:結對程式設計,來追求模仿人類協作的想法。在同時建構使用 Claude 和 Codex 的程式碼審閱代理程式時,我發現了一些有趣的事情:它們給出了不同的回饋——但即使它們給出了相同的回饋,也不會令人感到惱火:事實上,這是一個非常強烈的訊號。當兩位審閱者意見一致時,我們的團隊會處理 100% 的回饋。程式碼審閱很棒,因為它們發生在一個人類和代理程式協作的多人應用程式中,但它們減慢了回饋循環,並且可能變得嘈雜。

這就是為什麼我建構了 loop:一個極簡的 CLI 工具,能在 tmux 中並排啟動 claude 和 codex,並透過一個橋樑讓它們能夠互相交談。它讓這個回饋循環更快、更自然,同時在迭代之間保持上下文。這很有趣,因為它讓代理程式能夠更主動,因為它們之間的互動更自然(我預期隨著模型變得更好,這一點也會持續改善)。由於 loop 運行的是互動式 TUI,您可以保持在循環中,進行引導、回答問題,並在需要時進行跟進。

代理程式工作流程的未來,可能看起來不像魔法般的自動化,而更像是熟悉的團隊合作。我確信有一些很棒的觀察可以應用到這個結對程式設計的工作流程中。關於如何讓人類交接和 PR 審閱更容易,有一些懸而未決的問題:

讓代理程式循環可能導致比預期更多的變更,這些變更通常是受歡迎的——但不幸的是,這會使人類審閱更加困難。