KeyFrame內部研究專用

Agents Need Receipts, Not More Tool Calls - Armanas Povilionis, Alithea Bio

AI Engineer·7月20日週一·10 min英文

三句話摘要

Froglet 協議如何透過可驗證的交易鏈,讓 AI 智能體跨組織邊界自主協作,實現科學研究自動化。 Froglet 透過可驗證的協議和微經濟激勵,將分散的智能體和資源編織成一個協調的生態,使科學研究自動化從數年客製化專案縮短為分鐘級跨組織交易。 協作驗證是自動化關鍵:科學研究像經營米其林餐廳而非家庭廚房,核心挑戰在於協調整個供應鏈,而非單純提升本地工具效能。需要可驗證的收據鏈確保每個結果可信。

重點整理

重點
  • 1

    協作驗證是自動化關鍵:科學研究像經營米其林餐廳而非家庭廚房,核心挑戰在於協調整個供應鏈,而非單純提升本地工具效能。需要可驗證的收據鏈確保每個結果可信。

  • 2

    智能體需要預算自主權:進化路徑是從單純執行任務(分配代幣預算)升級到自主管理預算,用於發現服務、請求資料、協商執行,跨組織邊界支付工作費用,接近行政總廚的角色。

  • 3

    協議而非替代:Froglet 設計在多個活動部件之間,與不同的支付管道、智能體框架、執行環境整合,只要求統一介面而非統一軟體棧,降低採用門檻。

  • 4

    區塊鏈驗證機制:每個節點持有密鑰對,所有操作(描述、報價、交易、開票、收據)都在鏈上簽署,防止竄改,確保可追溯性。

實用技巧與重點

乾貨
  • Froglet 官網:froglet.dev
  • 部署方式:單條指令本地運行,或遠端試用
  • 網絡架構:同質節點(Requester、Provider、Marketplace 角色)
  • 支付結構:基本費用(防止大量無效請求)+ 成功費(向失敗服務提供者索賠)
  • 操作流程完整性:請求 → 簽署 → 執行 → 接收(單次互動內完成)
  • 資源共享時間:數分鐘
  • 成本量級:數千代幣
  • 密鑰管理:每個新節點生成身份驗證和簽署用的密鑰對
  • 市場機制:提供者註冊描述服務 → 市場索引 → 請求者直接通信(無中間商)

結論

結論

Froglet 透過可驗證的協議和微經濟激勵,將分散的智能體和資源編織成一個協調的生態,使科學研究自動化從數年客製化專案縮短為分鐘級跨組織交易。

完整解析

詳細

當前企業面臨的科學協作難題在於:雖然市場上有大量智能體自動化工具,但數據和專業演算法分散在各組織並處於孤立狀態。傳統的深度科學合作往往演變為客製化企業專案,耗時數年、投入數百萬美元,只是為了建立第一個可重複使用的協作工作流程。

Froglet 協議的核心洞察來自一個類比:將科學研究比作經營米其林星級餐廳而非家庭廚房。增加更好的工具(更銳利的刀、更多烤箱)確實提升效率,但這只優化了本地運作。真正的挑戰在於協調供應鏈——找到可信的供應商、確保一致的服務品質、跟蹤整個過程。科學研究本質上也是如此:無法將所有東西放在一個廚房裡。

因此,Froglet 的願景是讓智能體成為「行政總廚」。它不僅執行被分配的任務,還能自主管理預算,用於發現服務、請求資料、協商執行細節,在跨組織邊界設定下支付工作費用,並記錄所有交易。這一切都透過一套統一但靈活的協議實現。

技術上,Froglet 創造了一個同質節點網絡。環境中每個參與者運行同一個核心節點軟體,但扮演不同角色:需求者、服務提供者,或市場節點(市場本身就是一個運行 Froglet 的服務提供者)。當需求者查詢可用服務時,市場提供索引,隨後需求者和提供者直接通信——無需中間商。關鍵是所有操作(從初始請求、報價、簽署交易、執行、開票到最終收據)都在區塊鏈上簽署。每個節點持有身份驗證密鑰對,任何環節被竄改都會導致鏈斷裂,確保完整的可審計性。支付機制採用雙層設計:基本費用保護服務提供者免受大量無效請求;成功費則向提供商失敗或不誠實行為時由請求者賠償。這種設計讓個組織只需註冊並向市場描述其可分享的資源,數分鐘內就能使用數千代幣的成本讓外部智能體發現、請求並獲得驗證。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing
編輯精選
83 min
AI 技術英文PODCAST8月26日

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing

Latent Space

  • 加速傳統物理模擬的典範轉移:氣象科學家原本認為 AI 無法匹敵數十年的物理建模工作,但傅里葉神經算子不僅達到同等精度,還快了一萬多倍。原本需要超級計算機的計算現在用消費級 GPU 就能完成,這改變了整個領域的思維方式。
  • 傅里葉域的非局部現象捕捉:傅里葉域能有效表示非局部現象(如大氣河流跨越千里的影響),且計算複雜度為準線性,遠優於完全連接的全局模型。這特別適合流體動力學、量子化學等自然現象中普遍存在的非局部相互作用。
  • 多解析度連續函數表示:神經算子將輸入輸出視為連續函數而非固定維度向量,可在推論時以任意解析度查詢,並能在更高解析度上疊加物理約束或額外數據,克服了固定解析度神經網路的限制。
Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Why the Next AI Breakthrough May Come from Physics with Max Welling - #774
55 min
AI 技術英文PODCAST8月25日

Why the Next AI Breakthrough May Come from Physics with Max Welling - #774

TWIML AI

  • 多層篩選的材料設計流程:先搜尋文獻資料庫找現有材料,若無合適的就用生成模型產生數十萬個候選分子,用機器學習力場進行分子動力學模擬篩選,再進行實驗驗證。這套流程相比傳統量子力學計算能加速效率數個數量級。
  • 生成AI與熱力學的數學等價性:資訊論是兩個領域的共同基礎,生成模型的擴散過程與非平衡統計力學描述資訊損失的過程在數學上完全對應,許多開發出來的方法工具在兩領域都有精確對應的形式。
  • 基礎模型的遷移學習策略:先在廣泛材料資料集上訓練基礎力場表示,再針對特定材料類別進行蒸餾微調,既能保持計算效率也能獲得專一性。