Recursive Coding Agents - Raymond Weitekamp, OpenProse
三句話摘要
如何通過遞迴結構與代理編程範式,將編碼代理轉變為可靠、自主的系統。 遞迴編碼代理透過統一工具調用與推理、讓代理自主決定問題分解策略,將AI系統從聰明但不可靠的工具轉變為可信賴的協作者。 可靠性是信任的基礎:演講者指出模型本身智能足夠,但代理無法可靠交付成果,導致無法被信任。解決方案不是追求更高智能,而是改進行為協調與工作管理機制。
重點整理
重點- 1
可靠性是信任的基礎:演講者指出模型本身智能足夠,但代理無法可靠交付成果,導致無法被信任。解決方案不是追求更高智能,而是改進行為協調與工作管理機制。
- 2
RLM本質上是工具調用與推理的融合:不同於單純的鏈式思維,RLM讓代理在REPL環境中符號性地操作上下文,可以調用子代理遞迴處理問題,從而處理遠超上下文窗口的信息量(數千萬tokens)。
- 3
編碼代理需滿足特定條件才能成為RLM:可執行環境、外部化提示詞、代碼驅動模型、模型決定問題分解方式、符號狀態保持。不是所有有工具調用的系統都是RLM。
- 4
多個平台已實現遞迴編碼代理:Claude Code動態工作流、OpenPros語言、Pi(支援遞迴擴展)、Acts(TypeScript實現)等都提供了實踐路徑,開發者可根據需求選擇。
實用技巧與重點
乾貨- 關鍵基準成果:
- Qwen 3.5 9B在長COT推理任務上超越Opus、GPT-5.4等頂級模型
- Symbolica團隊的agentica RLM在ArcAGI 3發佈數小時內達到30%+準確率(對比基準2-3%)
- RLM作為記憶系統可媲美或超越專門設計的記憶系統
- 實現工具與框架:
- DSPy.RLM(官方實現,適合基準測試)
- Y Pi(基於Lambda演算Y組合子,完全遞迴)
- Acts(TypeScript變體,支援代理間遞迴調用)
- Unix RLM(純Bash + Linux文件系統)
- OpenPros語言(支援任何編碼代理、Markdown規範、邏輯英語)
- Claude Code動態工作流(最近發佈)
- RLM vs其他系統的判別依據:
- ✓ 需要:可執行環境、外部化提示詞、代碼驅動、代理決定分解策略、符號狀態
- ✗ 不符合:純LLM、RAG(缺代碼/子代理/遞迴)、硬編碼MapReduce(代理不決定分解)
- 應用場景與模式:
- 規模遷移(Scale migrations)
- 大規模重構(並行分解+合併)
- 遞迴目錄深度分析
- 審計與bug掃描
- 對抗性驗證(懷疑代理、紅隊並行)
- 黃金會話捕獲與重用(將成功工作流轉化為可重複的Pros程序)
- Claude Code相關:
- 官方部落格文章:《A Harness for Every Task》介紹6種工作流模式
- 命令:`pros write` 讓Claude Code生成.pros.md文件
- 類似:`code review ultra` 命令結構
- 技術細節:
- OpenPros可顯式聲明子代理工作、驗證工作品質
- 支援在Pros中宣告技能、工具作為顯式依賴項
結論
結論“遞迴編碼代理透過統一工具調用與推理、讓代理自主決定問題分解策略,將AI系統從聰明但不可靠的工具轉變為可信賴的協作者。”
完整解析
詳細代理技術的核心困境在於可靠性而非智能。Raymond Whitecamp在OpenPros的工作中發現,現代AI代理就像「被誤管的天才」——它們具備充分的知識和能力,卻無法可靠地交付成果。他親身經歷過的矛盾最好地說明了這點:同一套系統某天能生成幾乎完整的SaaS應用,隔天卻會清空整個Solana錢包。這種不穩定性摧毀了信任,而信任恰恰是將AI代理用於生產環境的前提。
解決方案源於遞迴語言模型(RLM)的概念。RLM的核心洞察是,上下文本身就是計算對象。不同於傳統的鏈式思維直接在模型內部展開,RLM將代理放入一個可執行環境(如Python REPL),代理可以符號性地操作上下文——不是一次性讀入所有內容,而是選擇性地探索、調用工具、或派遣其他子代理去處理特定子問題。這種方式統一了工具調用和推理,使模型能在推理時「思考」如何分解問題。結果是驚人的:Qwen 3.5 9B這樣的小模型,在作為RLM運行時,竟能在長推理任務上超越Opus和GPT-5.4。Symbolica團隊更在ArcAGI 3發佈後數小時內,用RLM代理將準確率從2-3%推升到30%以上。
將RLM原則應用到編碼代理上就產生了遞迴編碼代理。這需要滿足五個條件:可執行環境、外部化提示詞、代碼驅動模型、模型決定問題分解方式、符號狀態保持。當前有多個實現路徑。Claude Code的動態工作流(Dynamic Workflows,剛發佈)使其成為RLM——代理現在可以編寫定義其他工作流的代碼,形成完整的遞迴結構。OpenPros則提供了更通用的方案:它是一種由編碼代理編譯而非傳統編譯器編譯的Markdown規範語言。使用者可以用`pros write`命令讓代理自動生成.pros.md文件,在其中顯式聲明子代理的職責、驗證標準,甚至依賴的技能或CLI工具。Y Pi、Acts等項目則展示了其他可行的架構。
實踐中的應用包括:大規模代碼遷移(並行分解任務,最後合併結果)、遞迴目錄分析、系統審計、bug掃描、甚至對抗性測試(多個懷疑代理並行驗證)。更創新的是「黃金會話捕獲」——當開發者獲得一次理想的代理表現時,可以用OpenPros將其自動分解為一個可重複的工作流,下次執行時就能穩定地達到相同品質。
關鍵時刻
Pipeline v2帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。
事實查核
Pipeline v2說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。


