KeyFrame內部研究專用

How to Build Your First Claude Agent Team in 14 Minutes

Jake One Page·7月21日週二·21 min英文

三句話摘要

14 分鐘內建立第一個 AI 代理,讓它在 Google Calendar、Sheets、Docs 中自主完成工作,從被動回答轉變為主動執行任務。 AI 的未來不是更聰明的聊天機器人,而是自主代理——24 小時無休、記住你的工作方式、直接在你的工具中代為完成任務,讓你專注於真正需要創意和判斷的工作。 自主執行而非建議生成:Super Agents 不像傳統 AI 工具只告訴你怎麼做,而是直接連接工具、代表你執行實際操作(建立日曆、更新試算表、撰寫文檔),使用者感受像是與專業助手對話。

重點整理

重點
  • 1

    自主執行而非建議生成:Super Agents 不像傳統 AI 工具只告訴你怎麼做,而是直接連接工具、代表你執行實際操作(建立日曆、更新試算表、撰寫文檔),使用者感受像是與專業助手對話。

  • 2

    Claude 模型的優勢:Anthropic 開發的 Claude 擅長複雜推理、指令遵循、多步驟工作流,特別在涉及多個連接工具、需要保持上下文的生產力任務中比預設模型更可靠。

  • 3

    持久記憶打造個人化助手:代理記住你的工作偏好、日常任務、工作時間、進行中的專案,未來對話中自動應用,無需重複說明,隨著使用效率持續提升。

  • 4

    相比傳統自動化的靈活性:Zapier 等工具需預先設定觸發器和工作流,Super Agents 則自然接收口頭需求,用即時推理決定如何利用可用工具和權限完成任務,適應性強。

實用技巧與重點

乾貨
  • 設定時間:14 分鐘內可完成首個代理建置
  • 整合數量:開箱支援 200+ 整合
  • 核心整合:Google Calendar、Gmail、Google Drive、Google Sheets、Google Docs、Slack、Discord、CRM
  • 模型選擇:Claude(由 Anthropic 開發)
  • 配置步驟
  • 選擇 Claude 模型並確認啟動
  • 撰寫代理角色描述和職責
  • 連接需要的工具(Google Sheets、Google Docs、Google Calendar)
  • 授權各項服務
  • 在指導原則中定義角色、語氣、工作方式
  • 配置持久記憶指令(記住工作時間、重複任務、偏好等)
  • 實測功能
  • 安排會議(含提醒時間)
  • 建立試算表、新增行、追蹤進度
  • 建立文檔、撰寫內容
  • 每個操作後自動確認
  • 課程定價:Master Class 通常 499 美元,看影片者免費
  • 開發建議:具體指導原則優於模糊描述;積極利用記憶功能;逐步擴展整合和職責

結論

結論

AI 的未來不是更聰明的聊天機器人,而是自主代理——24 小時無休、記住你的工作方式、直接在你的工具中代為完成任務,讓你專注於真正需要創意和判斷的工作。

完整解析

詳細

傳統 AI 工具通常作用於「回答層」——你提問、它生成建議、任務仍需你手動完成。Base44 的 Super Agents 打破了這個範式,變成真正的自主工作者,24 小時在後台運行,跨越多個平台執行實際操作。

影片的核心是展示如何在短短 14 分鐘內建置這樣一個代理。過程從模型選擇開始:講者強調選擇 Claude 而非預設模型的重要性。Claude 由 Anthropic 開發,在複雜推理和多步驟指令執行上表現突出。當代理需要同時操作 Google Sheets、Google Docs 和 Google Calendar,並在對話中保持上下文時,這優勢尤為明顯。表面上的簡單請求背後可能涉及多個平台協調,Claude 在理解意圖、追蹤上下文、按正確順序執行操作方面比大多數模型更可靠。

配置階段包括三個核心部分。首先,撰寫清晰的代理角色描述,讓它理解自己負責哪些平台、何時採取行動、任務後應確認。其次,連接工具——Google Sheets、Google Docs、Google Calendar 各執行一次授權,之後代理獲得讀寫權限。最後,配置指導原則和持久記憶,這是提升代理效能的關鍵。指導原則決定了代理的語調和職責邊界;持久記憶讓代理記住你的工作時間、週期任務、組織偏好,未來對話中自動套用,無需重複說明。

實際演示中,代理處理三類任務。第一,安排會議:使用者說「安排明天下午 2 點開 1 小時策略會議,提前 30 分鐘提醒」,代理理解後直接在 Google Calendar 建立事件並加入提醒——整個過程不超過幾秒,且任務完成後自動確認。第二,管理試算表:要求「建立任務清單、新增進度檢查欄」,代理建檔並輸入資訊,無需使用者打開 Google Sheets。第三,撰寫文檔:「建立第三季策略簡報,寫開場段落」,代理新建 Google Doc、產生內容並直接填入。每個操作都以確認訊息結束,讓使用者清楚知道發生了什麼。

相比傳統自動化工具(如 Zapier),Super Agents 的優勢在於靈活性和漸進性。Zapier 要求預先定義觸發器、操作和工作流,所有場景必須提前規劃。Super Agents 則自然多了——你只需描述當下需求,代理利用可用工具和權限自主決定如何完成,隨著更多整合接入,處理能力持續擴展。一次對話可管理涉及日曆、電子表格、文件、郵件的多平台任務。許多細碎行政工作每次只省幾分鐘,但一週執行數十次就迅速累積,這對創業者、經理、專業人士尤其有價值。

影片最後強調,Super Agents 的關鍵不在設定過程,而在 AI 正在從「回答問題」轉向「幫人完成工作」。日曆更新、試算表編輯、文檔草稿單獨看似小事,但它們填滿日常生活。透過簡單對話委託給跨工具代理,徹底改變了生產力軟體的運作方式。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing
編輯精選
83 min
AI 技術英文PODCAST8月26日

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing

Latent Space

  • 加速傳統物理模擬的典範轉移:氣象科學家原本認為 AI 無法匹敵數十年的物理建模工作,但傅里葉神經算子不僅達到同等精度,還快了一萬多倍。原本需要超級計算機的計算現在用消費級 GPU 就能完成,這改變了整個領域的思維方式。
  • 傅里葉域的非局部現象捕捉:傅里葉域能有效表示非局部現象(如大氣河流跨越千里的影響),且計算複雜度為準線性,遠優於完全連接的全局模型。這特別適合流體動力學、量子化學等自然現象中普遍存在的非局部相互作用。
  • 多解析度連續函數表示:神經算子將輸入輸出視為連續函數而非固定維度向量,可在推論時以任意解析度查詢,並能在更高解析度上疊加物理約束或額外數據,克服了固定解析度神經網路的限制。
Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Why the Next AI Breakthrough May Come from Physics with Max Welling - #774
55 min
AI 技術英文PODCAST8月25日

Why the Next AI Breakthrough May Come from Physics with Max Welling - #774

TWIML AI

  • 多層篩選的材料設計流程:先搜尋文獻資料庫找現有材料,若無合適的就用生成模型產生數十萬個候選分子,用機器學習力場進行分子動力學模擬篩選,再進行實驗驗證。這套流程相比傳統量子力學計算能加速效率數個數量級。
  • 生成AI與熱力學的數學等價性:資訊論是兩個領域的共同基礎,生成模型的擴散過程與非平衡統計力學描述資訊損失的過程在數學上完全對應,許多開發出來的方法工具在兩領域都有精確對應的形式。
  • 基礎模型的遷移學習策略:先在廣泛材料資料集上訓練基礎力場表示,再針對特定材料類別進行蒸餾微調,既能保持計算效率也能獲得專一性。