KeyFrame內部研究專用

FORGET Hermes & OpenClaw! My NEW AI Agent does it All!

Parker Prompts·7月31日週五·9 min英文

三句話摘要

Hyperagent 平台讓 AI agent 在雲端獨立運作,展示如何在五分鐘內構建自動監測競爭對手的市場情報 agent,並透過 skills 和 memory 機制讓 agent 逐漸變得更聰慧。 Hyperagent 的核心價值在於透過 skills 教導和自動 memory 累積,讓 AI agent 從被動工具轉變為真正獨立的隊友,將繁瑣工作從「每次都需要人工提示」轉變為「除非涉及判斷否則完全自動」。 架構創新打破傳統 Agent 限制:Hyperagent 給每個 agent 分配獨立的雲端電腦,讓它們能真正在世界上採取行動(打開網頁、讀取數據)而非只是描述。這源自 Airtable 團隊在實際營運中的發現:只有這樣設計 agent 才能成為真正的生產力工具,而非實驗玩具。

重點整理

重點
  • 1

    架構創新打破傳統 Agent 限制:Hyperagent 給每個 agent 分配獨立的雲端電腦,讓它們能真正在世界上採取行動(打開網頁、讀取數據)而非只是描述。這源自 Airtable 團隊在實際營運中的發現:只有這樣設計 agent 才能成為真正的生產力工具,而非實驗玩具。

  • 2

    Skills 和 Memory 機制讓 Agent 自主成長:Skills 是一次性教導、永遠記住的判斷標準(如競爭威脅評估法則),Memory 是工作中累積的經驗(如發現某競爭者總在週四洩露產品)。兩者結合打破了傳統 agent 系統每次會話都從零開始的痛點,讓 agent 工作效率隨時間指數增長。

  • 3

    Live Mode 和 Slack 整合將 Agent 轉化為主動隊友:透過設定執行頻率和觸發規則,讓 agent 只在真正重要的時刻主動通知(而非告警疲勞),整個分析過程和推理邏輯在 Slack thread 中透明展示,使用者可在一分鐘內理解並決策。

  • 4

    多 Agent 協作的複利效應:當團隊中多個 agent 共享記憶庫時,一個 agent 的學習立刻傳播到整體,形成自我優化迴圈。Deskimo 的 8-agent 銷售管道三週內將郵件編輯需求從 100% 降低至 10-20%,純粹源自 agent 從創辦人的修改行為中自動學習。

實用技巧與重點

乾貨
  • 工具與平台
  • Hyperagent(Airtable 開發)、對標:Hermes、Open Claw(開源方案)
  • Scout(市場監測 agent)、Inbox agent、Content agent
  • 功能配置面向
  • Identity(系統 prompt)、Model(模型選擇,預設 GPT)、Tools(Web Search、Documents)
  • Skills(教導判斷標準)、Knowledge(載入知識庫與記憶)
  • Live Mode / Invocations(自動執行頻率、Slack 整合、通知頻道設定)
  • 具體數據與案例
  • Airtable 內部:1 個 agent 管理 70,000+ 筆資料目錄,每週節省 200 小時
  • Deskimo(共享辦公公司):8-agent 銷售 pipeline,一週完成構建
  • 3 週內:從 100% 人工編輯改善到 80-90% 自動批准
  • 一個 agent 發現特定郵件域名退信率高,自動停止使用該域名
  • Google 將 Notebook LM 整合進 Gemini Notebook,涉及 3000 萬用戶和搜尋分發
  • 優惠
  • 前 500 個通過連結註冊的人獲得 $500 積分

結論

結論

Hyperagent 的核心價值在於透過 skills 教導和自動 memory 累積,讓 AI agent 從被動工具轉變為真正獨立的隊友,將繁瑣工作從「每次都需要人工提示」轉變為「除非涉及判斷否則完全自動」。

完整解析

詳細

多數人認為 AI agent 只是執行腳本的聊天機器人,但 Hyperagent 改寫了這個定義。影片主角在五分鐘內用它構建了一個市場情報分析 agent(Scout),甚至一週前設定的另一個 agent 在他喝咖啡時自動完成了整個構建過程。這不是因為模型更聰明,而是架構的根本突破。Hyperagent 由 Airtable 團隊開發,最初是他們自家營運的工具,已在真實商業環境中驗證了數個月。其核心創新是給每個 agent 分配獨立的雲端電腦,讓它們能真正在世界上採取行動——打開網頁、讀取價格表、收集市場情報——而非只是描述計畫。

使用者只需在平台上用自然語言描述工作需求(「你是我的競爭情報分析師,監控這五家公司,當有重要變化時深入分析並告訴我含義」),Hyperagent 就會自動生成 agent 的完整配置:系統 prompt、工具選擇、初始設定。平台會針對不明確的地方提出問題,然後 agent 就準備好獨立運作了。

但讓 agent 真正自主成長的關鍵是兩個機制。Skills 是使用者教導一次、agent 永遠記住的判斷標準——如何評估競爭威脅、自家公司的定位優勢、價格頁面的閱讀方式。這些 skills 可以共享給團隊中的其他 agent,確保整個團隊用同一套標準工作。Memory 則讓 agent 在持續工作中逐漸積累智慧:發現某個競爭者總在週四洩露新產品、哪個價格頁面才是真正值得監控的目標。這個機制打破了傳統 agent 系統的痛點——每次會話都從零開始,使用者必須反覆解釋背景。一個月後,Scout 已建立對市場的真實理解,工作品質隨著時間而不斷改善。

真正改變遊戲規則的是 Live Mode。使用者只需授權 Slack 工作區、給 Scout 設定身份、選擇通知頻道和執行頻率,agent 就開始自動運行。最巧妙的設定是「Silent Unless It Matters Mode」——只有在真正發生重要變化時 agent 才會主動發言,避免傳統告警工具造成的通知疲勞。某天早晨,Google 宣布將 Notebook LM 整合進 Gemini Notebook(涉及 3000 萬用戶和搜尋分發),Scout 立刻檢測到這個變化,分析了含義,建議公司應該「專注於快速驗證的文件工作流,並優化入門方案」。整個分析過程、檢查過的網頁、完整的推理邏輯都展示在 Slack thread 中,主角只需一分鐘就能理解並決策。

這套系統的真正威力在於擴展到多 agent 團隊。主角現在運行 Scout(市場監控)、一個 inbox agent(清理過夜郵件)和一個 content agent(生成貼文),每個都有獨立的電腦、skills 和 memory。它們甚至能互相傳遞工作——Scout 發現重要變化時直接交給 content agent 去草擬回應,無需人工中介。這形成了自我優化迴圈的魔力。Deskimo(一家共享辦公公司)構建了 8-agent 銷售管道,在三週內從需要人工編輯每封郵件,改善到自動批准 80-90% 的郵件。整個改善純粹源自 agent 從創辦人的修改行為中自動學習。最神奇的部分是:因為所有 agent 共享一個記憶庫,某個 agent 發現特定郵件域名容易退信時,整個團隊立刻停止使用該域名,無需任何人工干預。這正是 agent 團隊與單個聰明 agent 的本質區別。

與開源方案(如 Hermes)相比,取捨很清晰。Hermes 提供完全的所有權和隱私,但使用者必須自己託管、更新和維護。Hyperagent 不需要任何運維,agent 立刻獲得雲端資源,直接在 Slack 中產出成果。對於想要工作真正自動化運行的人來說,Hyperagent 是明顯的勝者。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing
編輯精選
83 min
AI 技術英文PODCAST8月26日

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing

Latent Space

  • 加速傳統物理模擬的典範轉移:氣象科學家原本認為 AI 無法匹敵數十年的物理建模工作,但傅里葉神經算子不僅達到同等精度,還快了一萬多倍。原本需要超級計算機的計算現在用消費級 GPU 就能完成,這改變了整個領域的思維方式。
  • 傅里葉域的非局部現象捕捉:傅里葉域能有效表示非局部現象(如大氣河流跨越千里的影響),且計算複雜度為準線性,遠優於完全連接的全局模型。這特別適合流體動力學、量子化學等自然現象中普遍存在的非局部相互作用。
  • 多解析度連續函數表示:神經算子將輸入輸出視為連續函數而非固定維度向量,可在推論時以任意解析度查詢,並能在更高解析度上疊加物理約束或額外數據,克服了固定解析度神經網路的限制。
Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Why the Next AI Breakthrough May Come from Physics with Max Welling - #774
55 min
AI 技術英文PODCAST8月25日

Why the Next AI Breakthrough May Come from Physics with Max Welling - #774

TWIML AI

  • 多層篩選的材料設計流程:先搜尋文獻資料庫找現有材料,若無合適的就用生成模型產生數十萬個候選分子,用機器學習力場進行分子動力學模擬篩選,再進行實驗驗證。這套流程相比傳統量子力學計算能加速效率數個數量級。
  • 生成AI與熱力學的數學等價性:資訊論是兩個領域的共同基礎,生成模型的擴散過程與非平衡統計力學描述資訊損失的過程在數學上完全對應,許多開發出來的方法工具在兩領域都有精確對應的形式。
  • 基礎模型的遷移學習策略:先在廣泛材料資料集上訓練基礎力場表示,再針對特定材料類別進行蒸餾微調,既能保持計算效率也能獲得專一性。