KeyFrame內部研究專用

Claude Code's NEW Open Source Repo Builds Effective AI Agents in MINUTES!

Duncan Rogoff | Learn Claude Code·6月19日週五·15 min英文

三句話摘要

Anthropic 推出免費開源的 Claude Code 技巧「Launch Your Agent」,讓任何人都能在幾分鐘內建立並部署自我改善的 AI 代理人。 「寫 Loop 給 Claude 一個目標」比「給 Claude 一個任務」更強大——而 Launch Your Agent 讓這件事變成任何人都能在幾分鐘內完成的事,代價只是 API 費用與一次正確的需求訪談。 代理人(Agent)與聊天(Chat)的本質差異:一般 Chat 只有語言能力,而 Agent 擁有工具(搜尋網路、執行程式、呼叫 API),能自主選擇每步驟使用哪個工具,真正實現無人介入的自動化執行。

重點整理

重點
  • 1

    代理人(Agent)與聊天(Chat)的本質差異:一般 Chat 只有語言能力,而 Agent 擁有工具(搜尋網路、執行程式、呼叫 API),能自主選擇每步驟使用哪個工具,真正實現無人介入的自動化執行。

  • 2

    Loop 是新一代 AI 協作模式:與其給 Claude 一個明確任務,不如給它一個目標讓它自己規劃。Claude Code 創建者 Boris Czerny 說,他現在的工作不是「幫 Claude」,而是「寫 Loop 讓 Claude 幫自己」,因為 Claude 往往比人更清楚達成目標的最佳路徑。

  • 3

    CMA 讓代理人永遠在線且自我改善:過去需要自建伺服器、處理錯誤、管理工具;CMA 讓 Anthropic 替你託管這些 Loop,代理人連接 Memory Store 後,每次執行都能從過去的經驗學習,逐漸變得更好。

  • 4

    訪談式建立流程降低門檻:Launch Your Agent 技巧會透過問答方式採集「你已知的資訊、想達成的目標、成功的定義」,並自動生成 API 呼叫、建立代理人、設定排程,使用者不需手動處理任何後端設定。

實用技巧與重點

乾貨
  • 工具名稱:Launch Your Agent(Claude Code 技巧,開源免費)
  • 平台:Claude Code、platform.anthropic.com(CMA 託管平台)
  • 模型:示範中原設定 Opus 4.8,後改為 Sonnet 以節省成本
  • Loop 的三個必要輸入:Context(已知資訊)、Goal(目標)、Success Criteria(成功標準)
  • CMA(Claude Managed Agent):由 Anthropic 伺服器運行,無額外平台費,只需付 API 費用
  • Memory Store:跨設備、跨執行留存記憶,讓代理人越跑越好
  • 安裝方式:複製 GitHub 連結 → 在 Claude 中全域安裝 → 重啟後輸入 `/launch` 啟用
  • 實測成本:首次執行 28 分鐘,消耗約 2,700 萬 tokens,花費約 $12 美元
  • 失敗原因:CMA 環境無法直接存取 Reddit,導致連結驗證失敗
  • 建議做法:正式部署前先逐一驗證各資料來源是否可存取,避免在雲端浪費大量 tokens

結論

結論

「寫 Loop 給 Claude 一個目標」比「給 Claude 一個任務」更強大——而 Launch Your Agent 讓這件事變成任何人都能在幾分鐘內完成的事,代價只是 API 費用與一次正確的需求訪談。

完整解析

詳細

AI 代理人的建立門檻一直是個痛點——你得自己架伺服器、處理錯誤、串接工具,還要花大量時間等待結果。Anthropic 針對這個問題推出了 Launch Your Agent,一個免費開源的 Claude Code 技巧,目標是讓任何人都能在幾分鐘內從想法到部署一個自動運行的 AI 代理人。

影片首先釐清了兩個核心概念。第一是「代理人」與「聊天」的差異:一般的 Claude Chat 只是語言模型,而代理人擁有工具——它能搜尋網路、寫入並執行檔案、呼叫外部 API,並自主決定每個步驟要用哪個工具,整個流程完全不需要人介入。第二個概念是「Loop」,這是 Claude Code 創建者 Boris Czerny 所提出的新協作典範。他說,一年前他是「幫 Claude 寫程式」,後來進步到同時跑 5-10 個平行工作階段,而現在他的工作已完全轉變為「寫 Loop」——給 Claude 一個目標,讓它自己規劃、執行、自我檢查、反覆改善,直到達成為止。這個轉變的核心邏輯是:Claude 通常比人更清楚達成目標的最佳路徑,給目標比給步驟更有效。

Launch Your Agent 的關鍵創新在於 CMA(Claude Managed Agent):你不再需要自己架設伺服器,Anthropic 會直接在雲端替你託管這些 Loop,讓代理人永遠在線、按排程自動執行,且只需付 API 費用,沒有額外的平台收費。此外,代理人還可以連接 Memory Store,讓它跨執行週期累積學習,理論上每跑一次就會變得更好。安裝上極其簡單:複製 GitHub 連結貼給 Claude,讓它自行讀取並全域安裝,重啟後輸入 `/launch` 指令即可啟用。啟動後,工具會以訪談方式引導你定義三件事:你已知的背景資訊、想達成的目標,以及成功的標準。

影片最後示範了一個真實案例:建立一個每日早晨自動從 Reddit 抓取 AI 相關熱門文章、整理成含有 hook 角度與受眾洞察的 Markdown 摘要的代理人。過程中 Claude 主動提問、細化需求、擬定成功評估標準,並自動選用 Sonnet 模型部署。然而首次執行遇到問題——CMA 環境無法直接存取 Reddit,系統因此反覆嘗試修復,最終跑了 28 分鐘、消耗約 2,700 萬 tokens、花費約 12 美元,且由於無法取得真實 Reddit 連結而判定為執行失敗。講者坦承這部分是可以避免的,建議在正式部署雲端代理人之前,先在本地逐一驗證每個資料來源是否可存取,確認理論成立後再移至 CMA 環境。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing
編輯精選
83 min
AI 技術英文PODCAST8月26日

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing

Latent Space

  • 加速傳統物理模擬的典範轉移:氣象科學家原本認為 AI 無法匹敵數十年的物理建模工作,但傅里葉神經算子不僅達到同等精度,還快了一萬多倍。原本需要超級計算機的計算現在用消費級 GPU 就能完成,這改變了整個領域的思維方式。
  • 傅里葉域的非局部現象捕捉:傅里葉域能有效表示非局部現象(如大氣河流跨越千里的影響),且計算複雜度為準線性,遠優於完全連接的全局模型。這特別適合流體動力學、量子化學等自然現象中普遍存在的非局部相互作用。
  • 多解析度連續函數表示:神經算子將輸入輸出視為連續函數而非固定維度向量,可在推論時以任意解析度查詢,並能在更高解析度上疊加物理約束或額外數據,克服了固定解析度神經網路的限制。
Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Why the Next AI Breakthrough May Come from Physics with Max Welling - #774
55 min
AI 技術英文PODCAST8月25日

Why the Next AI Breakthrough May Come from Physics with Max Welling - #774

TWIML AI

  • 多層篩選的材料設計流程:先搜尋文獻資料庫找現有材料,若無合適的就用生成模型產生數十萬個候選分子,用機器學習力場進行分子動力學模擬篩選,再進行實驗驗證。這套流程相比傳統量子力學計算能加速效率數個數量級。
  • 生成AI與熱力學的數學等價性:資訊論是兩個領域的共同基礎,生成模型的擴散過程與非平衡統計力學描述資訊損失的過程在數學上完全對應,許多開發出來的方法工具在兩領域都有精確對應的形式。
  • 基礎模型的遷移學習策略:先在廣泛材料資料集上訓練基礎力場表示,再針對特定材料類別進行蒸餾微調,既能保持計算效率也能獲得專一性。