KeyFrame內部研究專用

Jack Dorsey's New App Wants to Replace GitHub (buzz)

Better Stack·7月26日週日·12 min英文

三句話摘要

Block 推出 Buzz:整合 AI 代理與 Git 的開源協作平台,打造人工智慧與人類共同工作的新型工作空間 Buzz 是將 AI 代理協作、Git 工作流與團隊溝通統一的有趣嘗試,但目前仍處早期版本,用戶需謹慎設定代理工作邊界以避免 Token 超支。 密碼學身份與審計追蹤:每個人類和 AI 代理都有獨立的密鑰對,代理的所有行動同時攜帶雙重簽名(自身簽名 + 人類所有者簽名),形成無法偽造的「AI 護照」。

重點整理

重點
  • 1

    密碼學身份與審計追蹤:每個人類和 AI 代理都有獨立的密鑰對,代理的所有行動同時攜帶雙重簽名(自身簽名 + 人類所有者簽名),形成無法偽造的「AI 護照」。

  • 2

    統一的協作生態:將 Slack 型團隊溝通、Git 分支管理、CI 結果與代碼審核集中在單一平台,打破過往分散在 Slack 和 GitHub 的工作流程。

  • 3

    代理可組合性:用戶可快速建立自訂代理並指派特定任務(例如安全審計、代碼開發),代理會保留對話記憶,可逐次改善執行能力。

  • 4

    數據主權與開放架構:支援自架 Nostr Relay,用戶完全掌控數據,同時避免被單一平台廠商鎖定,符合 Web3 去中心哲學。

實用技巧與重點

乾貨
  • 產品基礎
  • 協議:Nostr(同 Jack Dorsey 的 BitChat 採用)
  • 授權:Apache 2.0
  • 版本:0.4(早期開發)
  • 代管方案:Block 提供免費 Beta Relay 伺服器
  • 支援的代理框架與模型
  • Cloud Code、OpenAI Codecs、Block Goose
  • 測試中使用的模型:Gemini 3.6 Flash(透過 OpenRouter)、GLM 5.2、GPT 5.6 Solo
  • 代理協議:Agent Client Protocol(開放標準)
  • 核心功能
  • 頻道、執行緒、DM、媒體分享、搜尋(Slack 標準功能)
  • 內建 Git 倉庫 (Software Forge)
  • 每個特性分支可映射為獨立頻道
  • 工作目錄:`.buzz/`
  • 實驗結果案例
  • 2 個代理進行認證系統競賽
  • GLM 5.2 在安全審計中勝出(儘管需 2 次迭代、包含漏洞依賴)
  • Gemini Flash 設計精美但成本高(透過 OpenRouter)
  • 代理間會自動記憶並改善,第二次執行可一次完成曾失敗的任務

結論

結論

Buzz 是將 AI 代理協作、Git 工作流與團隊溝通統一的有趣嘗試,但目前仍處早期版本,用戶需謹慎設定代理工作邊界以避免 Token 超支。

完整解析

詳細

Buzz 是 Jack Dorsey 旗下 Block 公司最新釋出的開源協作平台,表面上看起來與 Slack 無異,具備頻道、執行緒、DM、媒體分享與搜尋等標準功能。但其核心創新在於採用 Nostr 去中心協議,並深度整合 AI 代理與 Git 工作流程。

平台的設計背後隱含一套密碼學身份系統。使用者首次登入時,需建立一個密鑰對——這個金鑰代表身份本身,完全歸用戶所有,與平台無關。每個加入平台的 AI 代理也獲得獨立密鑰,但其所有行動同時攜帶雙重簽名:代理自身的簽名加上其所有者(人類使用者)的簽名。這種設計形成了 Block 所謂的「密碼學護照」,確保任何人都無法偽造代理的行動或歸屬。

Buzz 相比傳統協作工具有三項核心區別。首先,它對代理框架完全不可知論——支援 OpenAI、Anthropic Claude、Block 自製的 Goose,並透過開放標準的 Agent Client Protocol 進行通訊,避免用戶被單一廠商綁定。其次,軟體鍛造(Git 倉庫)直接內建於應用,每個特性分支可自動對應一個頻道,使得代碼提交、CI 結果、代碼審核意見與產生這些成果的對話全部共存於同一空間——這針對性地削減了對 GitHub 和 Slack 的依賴。第三,基礎設施完全由用戶控制:Apache 2.0 開源授權、原始碼公開在 GitHub、用戶可自架 Nostr Relay 或使用 Block 代管的免費 Beta Relay。

在測試中,筆者建立了一個名為「Code Dojo」的社群,建立了三個自訂代理:Bertrand Guilfoyle(使用 Gemini 3.6 Flash,經由 OpenRouter)、Dinesh(GLM 5.2)與 hacker man(GPT 5.6 Solo)。前兩者被賦予建構自訂認證系統的任務,第三個代理則擔任安全審計者。實驗結果顯示,儘管 Guilfoyle 的程式碼設計更精美,但 Dinesh 的實現在安全實踐上略占上風——雖然 GLM 需要兩次迭代才最終交付,且首版包含漏洞依賴。有趣的是,當要求兩個代理評論對方的結果時,它們開始熱烈爭辯,展現出了有趣的個性。平台設計還允許代理保留對話記憶,使其在社群內逐漸改善,例如首次執行某個不熟悉的命令時可能需要查詢文檔,但之後便能一次完成。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing
編輯精選
83 min
AI 技術英文PODCAST8月26日

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing

Latent Space

  • 加速傳統物理模擬的典範轉移:氣象科學家原本認為 AI 無法匹敵數十年的物理建模工作,但傅里葉神經算子不僅達到同等精度,還快了一萬多倍。原本需要超級計算機的計算現在用消費級 GPU 就能完成,這改變了整個領域的思維方式。
  • 傅里葉域的非局部現象捕捉:傅里葉域能有效表示非局部現象(如大氣河流跨越千里的影響),且計算複雜度為準線性,遠優於完全連接的全局模型。這特別適合流體動力學、量子化學等自然現象中普遍存在的非局部相互作用。
  • 多解析度連續函數表示:神經算子將輸入輸出視為連續函數而非固定維度向量,可在推論時以任意解析度查詢,並能在更高解析度上疊加物理約束或額外數據,克服了固定解析度神經網路的限制。
Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Why the Next AI Breakthrough May Come from Physics with Max Welling - #774
55 min
AI 技術英文PODCAST8月25日

Why the Next AI Breakthrough May Come from Physics with Max Welling - #774

TWIML AI

  • 多層篩選的材料設計流程:先搜尋文獻資料庫找現有材料,若無合適的就用生成模型產生數十萬個候選分子,用機器學習力場進行分子動力學模擬篩選,再進行實驗驗證。這套流程相比傳統量子力學計算能加速效率數個數量級。
  • 生成AI與熱力學的數學等價性:資訊論是兩個領域的共同基礎,生成模型的擴散過程與非平衡統計力學描述資訊損失的過程在數學上完全對應,許多開發出來的方法工具在兩領域都有精確對應的形式。
  • 基礎模型的遷移學習策略:先在廣泛材料資料集上訓練基礎力場表示,再針對特定材料類別進行蒸餾微調,既能保持計算效率也能獲得專一性。