KeyFrame內部研究專用

SEE CMUX SOLVE Multi-Agent Orchestration (Claude Code and Pi Agent)

IndyDevDan·7月6日週一·30 min英文

三句話摘要

使用 CMUX 進行多代理編程:如何透過程序化訪問和可視化監控實現大規模代理協調與優化。 ## 代理編程的勝負手在於可視化監控與程序化訪問——你無法改進你看不見的代理,工程師應透過 CMUX 等現代工具實現 agentic speed 的真正協調,而非陷入「vibe coding」的陷阱。 --- 補註:如果你對此內容感興趣,我可以幫你保存成項目記憶,以供後續參考。 1. 代理編程三大核心問題

重點整理

重點
  • 1

    1. 代理編程三大核心問題

  • 2

    講者開篇即指出 multi-agent orchestration 的三個普遍痛點:缺乏程序化訪問導致人類成為瓶頸、無法監控代理導致無法改進、手動建置代理隊伍消耗時間。CMUX 透過 API 與工作區(workspace)機制解決這些問題,讓代理能以「agentic speed」而非「human speed」運作。

  • 3

    2. 可視化是提升能力的前提

  • 4

    與「vibe coding」(放任代理自行運作)不同,講者強調「agentic engineering」必須每時每刻掌握代理狀況。工作區的顏色、圖標、標籤、通知事件等視覺機制,讓工程師能快速跳入任何代理進行調整,基於「core four」(上文脈絡、模型、提示、工具系統提示)強化成功行為或糾正錯誤。

  • 5

    3. 三層架構實現可擴展的平面溝通

  • 6

    講者採用編排者(orchestrator)→隊長(lead)→工作者(worker)的三層結構。相異於傳統的自上而下指揮鏈,這裡任意代理可以向任意其他代理發送提示,透過 CMUX skill 實現跨工具(Cloud Code、Codex、Pi)的雙向通訊,既保持組織性又保留靈活性。

  • 7

    4. 並行代理競速是高效求解的終極武器

  • 8

    當生產環境出現緊急問題需要快速修復時,講者展示如何同時啟動 8 個代理進行「競速」求解(needle-in-haystack search),利用不同模型與工具的獨特優勢,第一個抵達解決方案的代理贏。這充分體現「scale your compute to scale your impact」的核心理念。

  • 9

    ##

實用技巧與重點

乾貨
  • CMUX 結構與控制方式
  • 窗口(Window):用 Ctrl+Shift+N 新建
  • 工作區(Workspace):用 Command+N 新建,用於組織代理隊伍
  • 窗格(Pane):工作區內的單個終端窗口
  • 標籤(Tab):Command+T 在現有窗格內打開新標籤
  • 控制 API:send key → read screen → open/close surface → 迴圈
  • 三層代理協調架構實踐
  • 層級:編排者(Orchestrator,推送指令)→ 隊長(Lead,GLM 5.2,GLM 7B 等)→ 工作者(Worker,plan agent、build agent、test agent)
  • 每層都擁有獨立的上文脈絡(claimed: ~100 萬 token per agent,5 層代理組 = 500 萬 token 總可用)
  • 跨工具通訊:透過 CMUX skill 實現 Cloud Code ↔ Pi ↔ Codex 的雙向提示傳遞
  • 快速啟動命令
  • Just 檔案內置:`just fast CC SSC`(SSC 代表 Server-Sent Events 用例)
  • 一鍵生成預置的工作區配置與代理隊伍
  • 代理競速場景案例
  • 8 個代理平行競速求解:Opus 4.8、Sonnet、Codex、Cloud Code、Pi Minimax M3、Pi GLM 5.2 等同時啟動
  • 通知事件(notification events):工作完成時自動觸發編排者讀取結果並進入待命模式
  • 結果:第一個找到答案的代理模型贏得競速,結果傳回編排者決策
  • CMUX vs TMUX 對比
  • TMUX:跨平台(Linux/Windows/Mac),成熟穩定,但可客製化程度有限
  • CMUX:Mac 專用,年輕新興,but agentic access(可編程的 API)是差異化賣點,內建主題、自訂按鈕、瀏覽器整合等
  • 代理編程五大支柱(講者長期關注重點)
  • Agentic access(程序化訪問)
  • 監控與改進迴路
  • 快速啟動能力
  • 上下文規模化
  • 平面且可視的通訊架構
  • ##

結論

結論

代理編程的勝負手在於可視化監控與程序化訪問——你無法改進你看不見的代理,工程師應透過 CMUX 等現代工具實現 agentic speed 的真正協調,而非陷入「vibe coding」的陷阱。 --- 補註:如果你對此內容感興趣,我可以幫你保存成項目記憶,以供後續參考。

完整解析

詳細

代理編程時代已來臨,但工程師普遍面臨一個難題:當代理數量從個位數擴展到十、百、千位時,如何有效協調與監控?講者指出了三個核心瓶頸。

首先是程序化訪問的缺失。傳統的終端環境中,工程師必須手動操作每一個代理,成為協調的瓶頸,代理永遠無法以其真正速度運作。其次是可視化監控的缺陷。許多工程師採取「vibe coding」策略——放任代理自行運作,不加過問——這導致無法發現代理的成功模式或失誤,進而無法優化。第三是啟動成本過高。手動建置一個代理隊伍需要大量時間,不符合「agentic speed」的要求。

CMUX(一個 Mac 專用的現代終端多路複用工具)透過 API 層級的程序化控制、視覺化組織機制、以及預設配置檔案系統,直接解決了這三個問題。講者透過實際示例展示了 CMUX 的核心能力:工作區內可同時管理多個終端窗格,每個窗格執行不同代理(Cloud Code、Pi、Codex 等),編排者可透過 send-read-loop 模式與每個窗格通訊,彷彿與真實的開發者交談。

在組織結構上,講者採取了三層架構。編排者位於頂層,負責整體決策和通訊路由;隊長(team lead)層使用較輕量的模型(如 GLM 5.2),管理特定功能面向(如前端、後端、測試、計畫)的工作者代理。關鍵創新是,這不是傳統的自上而下指揮鏈——任何代理都可直接與任何其他代理通訊,透過 CMUX skill 跨越不同的工具邊界。例如,Pi agent 可以直接向 Cloud Code agent 提問,無需經過編排者中轉。這種架構既保留了組織性,又保留了靈活性。

在高需求場景中,講者展示了代理競速模式。當生產環境故障需要緊急修復時,同時啟動 8 個代理(各自使用不同的模型和工具),讓它們並行搜尋解決方案,第一個找到答案的代理贏。相比單個代理的線性執行,這可將問題求解時間從數分鐘縮短到數十秒。通知事件系統確保編排者在任何代理完成時立即收到回饋,進而做出下一步決策(例如轉移給部署代理)。

講者也坦誠 CMUX 作為年輕工具仍有改進空間。與成熟的 TMUX(跨平台、穩定但可客製化程度低)相比,CMUX 的優勢在於原生為代理時代設計的 API 和生態,但代價是偶爾會遇到邊緣情況的 bug。他的最終建議是:任何不提供程序化訪問的工具都值得忽視。agentic access 是代理工程的必要條件,沒有它,工程師仍然是瓶頸。

##

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Everything Goldman Sachs Taught Me About AI (In 10 minutes)
AI 技術英文8月24日

Everything Goldman Sachs Taught Me About AI (In 10 minutes)

Nate Herk

  • 驗證優於相信:看起來完整的AI輸出不等於正確答案,需在提示中要求模型重新檢查數字、引用來源,並對無把握的部分標記。
  • 區分AI與自動化:確定步驟且答案已知的任務用傳統自動化更便宜快速;只在需要判斷力、靈活性或處理複雜資訊時才用AI,兩者結合效果最佳。
  • 以問題驅動選型:先寫清楚「要解決的問題是什麼、成功的樣子是什麼」,再決定用什麼工具,許多失敗項目是從技術而非問題出發。
Mu: a self-hosted personal agent where the interface is an email address you can write to
AI 技術英文8月23日

Mu: a self-hosted personal agent where the interface is an email address you can write to

GitHub Awesome

  • Mu 是自主代理人系統,具有實際網址與獨立伺服器,用戶可透過多種方式與其互動——網頁應用、電子郵件或程式化介面。
  • 架構完整覆蓋日常工作流程的多個層面,整合郵件收發(SMTP/IMAP)、檔案管理、行事曆、新聞聚合、市場數據與搜尋功能於一個 Go 伺服器內。
  • 支援自帶模型與多種通訊協定,用戶可選擇不同的 AI 模型,並透過 MCP、HTTP API 或命令列工具整合到其他系統。