KeyFrame內部研究專用

Your Attention Is the Bottleneck, Not Your Agents — Zack Proser, WorkOS

AI Engineer·6月11日週四·25 min英文

三句話摘要

在AI編碼代理時代,如何通過架構設計與工作流創新避免過度疲勞,維持可持續的開發生涯。 AI代理已成為超能力,但人類的注意力與神經系統才是真正瓶頸——設計正確的架構與工作流,讓代理做細節,人類做判斷,才是可持續高效開發的唯一路徑。 人類注意力是真正瓶頸,而非工具能力:隨著Opus 4.6等模型能力提升,代理可無限循環執行直到達成標準,但開發者的神經系統和注意力在負載下會衰減。演講者親身實驗發現,即使給代理足夠的驗證標準和工具,也無法簡單地線性擴展產出——若真的每天修150個bug,開發者會在午前11點徹底精疲力竭。

重點整理

重點
  • 1

    人類注意力是真正瓶頸,而非工具能力:隨著Opus 4.6等模型能力提升,代理可無限循環執行直到達成標準,但開發者的神經系統和注意力在負載下會衰減。演講者親身實驗發現,即使給代理足夠的驗證標準和工具,也無法簡單地線性擴展產出——若真的每天修150個bug,開發者會在午前11點徹底精疲力竭。

  • 2

    多層信號整合與自動去噪:通過MCP連接Slack和Linear,讓Claude Code充當智能秘書自動過濾任務。演講者的實驗發現,自己瀏覽Slack五分鐘幾乎100%會被其他話題分散,所以将這個高成本的上下文切換點交由代理自動監測、去重複、提煉高優先度項目——這個簡單的介面層讓人類開發者能保持深度專注。

  • 3

    語音優先流程的倍增效應:從打字90詞/分鐘升級到語音184詞/分鐘,不只是速度提升,而是能同時向三個不同的編輯器/代理發起任務。當傳統開發者還在打第一個提示詞時,語音流已啟動多個並行工作。隨著時間複利,這種效率差異在一年、三年內會呈指數級擴大。

  • 4

    遠程控制打破辦公室與工作的二分法:淋浴原理證實人類最好的想法出現在離開電腦時,但過去這意味著停止工作。遠程控制(開發環境仍在本機運行,通過手機/任何網路訪問)讓開發者可以去散步、運動、玩耍,既享受擴散思維帶來的創意,又能實時指導代理、回饋新想法,避免遺忘。這同時解決了久坐引發的RSI和心理疲勞。

實用技巧與重點

乾貨
  • 數字與效能指標
  • 語音速度:打字90詞/分鐘 vs 語音184詞/分鐘(超過2倍)
  • 週工作效率衰減曲線:週一高效 → 週五完全耗盡
  • 預測:留在Linear的「代理準備」任務標籤,代理每15分鐘循環執行一次
  • 工具與技術棧
  • MCP連接:Slack、Linear tickets、Oura Ring(睡眠監測)
  • Claude Code遠程控制旗標啟用跨網路存取
  • 內建skill builder:構建、評估、改進客製化skills
  • 對話存儲格式:JSONL(被代理可分析)
  • 四層驗證架構
  • Gate 1:Lint、Build、單元測試自動驗證
  • Gate 2:瀏覽器驗證(點擊確保登入、UI完整性未破壞)
  • Gate 3:憲法AI模式(另一代理驗證執行標準,否則回饋修正)
  • 啟用方式:Claude Code傳入`--chrome`旗標
  • 系統自我改進循環
  • 每週末運行分析:找出花費過多思考tokens的地方、反覆溝通釐清歧義的地方、缺失的skills
  • Oura Ring實時反饋:睡眠不足時代理主動勸阻過勞
  • 夜班自動化:開源Ghost Pepper(本地Whisper+Flows)、Open Claw via Twilio非同步對話
  • 工作日流程重新設計
  • 早上:深度專注模式,加載一天的工作、啟動代理執行
  • 白天:離開辦公室,使用手機遠程控制指導工作、審閱PR
  • 驗證:Opus 4.6 足夠可靠,可用自然語言評論GitHub PR請Claude修正

結論

結論

AI代理已成為超能力,但人類的注意力與神經系統才是真正瓶頸——設計正確的架構與工作流,讓代理做細節,人類做判斷,才是可持續高效開發的唯一路徑。

完整解析

詳細

Zach在演講開頭拋出核心困境:AI編碼代理帶來前所未有的生產力,卻同時引發更嚴重的精力衰竭。這不是個人問題,而是行業普遍現象。即使是Simon Willison這樣的知名開發者也坦言,啟動四個並行代理後就在上午11點完全耗盡。根本原因不在工具,而在於人類的生物系統限制。

Zach在WorkOS的Applied AI團隊遇到一個具體案例:Slack部落格生成機器人損傷句子大小寫在處理縮寫詞(SSO、SKIM)時的正確性。傳統做法會陷入典型的「視窗地獄」——在IDE、Slack、Linear間不斷切換。他的創新是賦予Claude Code讀寫Slack和存取Linear的能力(通過MCP),然後簡潔地指令:「修復句子大小寫問題,驗證工作,確認完全修復前不要停止。」結果是Claude自動完成修復→測試→驗證的完整閉環。開發者回到電腦時,工作已完成。

這個成功同時觸發了他的擔憂:既然代理能這樣做,為什麼不一天修150個bug?答案揭示了新時代的根本轉移。代理可以無限循環執行直到達成你設定的標準,因為它們沒有注意力和神經疲勞的限制。但人類的注意力、判斷力和身心狀況才是真正的瓶頸。過去軟體工程的瓶頸是工具能力;現在是人類能力和可持續性。

基於這個認知,Zach提出一個四層架構。第一層「信號層」通過MCP將Slack和Linear整合到首選工作環境,讓Claude Code充當智能秘書自動過濾、去重複、監測高優先度提及。他的觀察是,即使瀏覽Slack五分鐘,也有80%機率被其他話題分散。自動化這個高成本的上下文切換點,開發者得以保持專注於核心工作。

第二層是「語音優先流程」,他已實踐一年半。從打字的90詞/分鐘升級到語音的184詞/分鐘,看似簡單的速度提升實則開啟了並行工作流。想像開發者同時對著三個Cursor窗口和多個Claude標籤頁講述任務,以語音速度,他已啟動三個代理工作,而傳統開發者還在打第一個提示詞。隨著時間複利,這種差異在一年、三年內會呈指數級擴大。

第三層「遠程控制」最具革命性。傳統淋浴原理告訴我們最好的想法出現在離開電腦時,但這過去意味著停止工作。遠程控制改變了規則:開發環境仍在本機運行,具備所有檔案系統和工具權限,但開發者可從手機、戶外、任何網路訪問並對話。演講者去年甚至拍了32分鐘的影片證明可以在森林裡用手機審閱PR。這意味著開發者可以離開辦公室散步、減少久坐引發的RSI、享受擴散思維的創意優勢,同時當新想法閃現時立即回饋給代理,避免遺忘。既產生了創意,工作進度也持續推進。

第四層「系統自我改進」利用Claude Code將所有對話存儲為JSONL格式。每週末,開發者讓代理分析整週的交互記錄,找出哪些地方花費了過多思考tokens、哪些地方與代理反覆溝通才釐清歧義、缺失的skills是什麼。然後用Claude Code內建的skill builder建立客製化工具,下週的工作流自動變得更高效。此外,連接生物監測工具如Oura Ring,代理可監測睡眠品質,當偵測到睡眠不足時主動建議調整工作計畫。

演講者強調的核心洞察是:如果不主動設計平衡,默認路徑就是加速版本的過勞。最終目標不是簡單地做更多工作,而是在代理處理細節工作的同時,人類保持品質控制、方向指導的責任,同時享受更少的辦公室時間、更少的身體傷害、更多的創意和家庭時間。這需要刻意設計多層驗證(Lint/Test→瀏覽器→憲法AI)、整合MCP工具減少噪音、採用語音優先優化並行度、利用遠程控制結合淋浴原理、持續從對話歷史學習改進系統。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Everything Goldman Sachs Taught Me About AI (In 10 minutes)
AI 技術英文8月24日

Everything Goldman Sachs Taught Me About AI (In 10 minutes)

Nate Herk

  • 驗證優於相信:看起來完整的AI輸出不等於正確答案,需在提示中要求模型重新檢查數字、引用來源,並對無把握的部分標記。
  • 區分AI與自動化:確定步驟且答案已知的任務用傳統自動化更便宜快速;只在需要判斷力、靈活性或處理複雜資訊時才用AI,兩者結合效果最佳。
  • 以問題驅動選型:先寫清楚「要解決的問題是什麼、成功的樣子是什麼」,再決定用什麼工具,許多失敗項目是從技術而非問題出發。
Mu: a self-hosted personal agent where the interface is an email address you can write to
AI 技術英文8月23日

Mu: a self-hosted personal agent where the interface is an email address you can write to

GitHub Awesome

  • Mu 是自主代理人系統,具有實際網址與獨立伺服器,用戶可透過多種方式與其互動——網頁應用、電子郵件或程式化介面。
  • 架構完整覆蓋日常工作流程的多個層面,整合郵件收發(SMTP/IMAP)、檔案管理、行事曆、新聞聚合、市場數據與搜尋功能於一個 Go 伺服器內。
  • 支援自帶模型與多種通訊協定,用戶可選擇不同的 AI 模型,並透過 MCP、HTTP API 或命令列工具整合到其他系統。