KeyFrame內部研究專用

Why I switched to Pi...

AI Jason·7月14日週二·15 min中文

三句話摘要

Pi Agent:一個開源編碼代理框架,通過靈活的擴展系統讓硬件完全適應用戶需求。 Pi Agent 通過開放的擴展系統實現了對代理硬件的完全控制,相比閉源代理提供了真正的定制自由,是構建複雜代理系統的最靈活選擇。 相比閉源代理的本質差異:Claude Code 和 Codex 等主流編碼代理是閉源的,用戶無法修改內部邏輯,只能通過有限的 Hook 系統進行定制。Pi Agent 打破這一限制,採用開放式扩展系統,允許用戶完全控制代理硬件的行為。

重點整理

重點
  • 1

    相比閉源代理的本質差異:Claude Code 和 Codex 等主流編碼代理是閉源的,用戶無法修改內部邏輯,只能通過有限的 Hook 系統進行定制。Pi Agent 打破這一限制,採用開放式扩展系統,允許用戶完全控制代理硬件的行為。

  • 2

    扩展系統是核心優勢:用戶可在項目中的 `.py/extensions/` 文件夾編寫 Python 擴展,修改代理上下文(如注入 Git 信息)、添加新工具、定制 UI,甚至代理自身也可生成需要的擴展。這使得之前無法實現的功能優化(如清理 PR 評論減少 80-90% token 成本)成為可能。

  • 3

    模組化生態設計:Pi 生態包含 Coding Agent(編碼代理)、AI Package(LLM 接口)、OS Package(任務調度)等專用模組,用戶可按需組合,避免承載不必要的功能。

  • 4

    權限控制與安全機制:通過編寫擴展實現輕量級權限檢查,使用小模型驗證操作合法性。檢測到敏感操作時可立即停止會話,這種細粒度控制在閉源代理中難以實現。

實用技巧與重點

乾貨
  • 核心工具與概念:
  • Pi Agent 基礎配置:4 個關鍵工具,無預設子代理、代理團隊或 MCP
  • 擴展編寫方法:`py.on_before_agent_start()` 修改啟動前邏輯;`py.register_tool()` 註冊新工具
  • 生態包組成:
  • Py Coding Agent:編碼代理主體
  • Py Core:會話管理、窗口管理等基礎功能
  • Py AI Package:支援連接多種大語言模型
  • Py OS Package:任務調度與代理間協作(實驗階段)
  • 部署方式:
  • 本地代理:完全訪問文件系統,支援自定義編輯器 UI、會話分享(二維碼/URL)
  • Web 部署:沙盒隔離、多租戶支援、資源加載器、權限級別定制
  • 優化成果:
  • PR 評論清理擴展:減少 token 消耗 80-90%
  • 權限檢查扩展:用輕量化模型驗證操作合法性
  • 相關資源:
  • CloudCode Playbook(HubSpot 贊助的免費資源):涵蓋提示模式、CLAUDE.md 設置、Hook 配置、任務管理等

結論

結論

Pi Agent 通過開放的擴展系統實現了對代理硬件的完全控制,相比閉源代理提供了真正的定制自由,是構建複雜代理系統的最靈活選擇。

完整解析

詳細

Pi Agent 是一個開源編碼代理框架,其設計理念與 Claude Code、Codex 等主流編碼代理有根本區別。雖然這些工具在基本編碼能力上已趨近相同,但 Pi Agent 被 OpenClawed 選中作為基礎框架的關鍵在於其開放的架構。

傳統編碼代理採用閉源設計,用戶只能通過公開的 SDK 和 CLI 構建新系統,但無法修改代理的內部邏輯。即使它們提供 Hook 系統允許在特定事件(如代理啟動、工具調用前)定義行為,這種定制仍受到本質限制——用戶無法真正改變硬件的工作方式。相比之下,Pi Agent 的設計哲學是讓硬件適應用戶。為了實現這一點,Pi Agent 採用最小化基礎設計(只包含 4 個關鍵工具),但提供了極其靈活的擴展系統。用戶可以編寫 Python 擴展來修改代理上下文、添加新工具、定制 UI,甚至代理本身可以自動生成所需的擴展——用戶只需說「我需要一個天氣小部件」,代理就會自動生成相應的擴展。

擴展系統的威力體現在實際應用中。開發者可以在代理啟動前注入最新的 Git 信息,使代理始終感知項目狀態;可以讀取剪貼板內容;可以實現權限控制——通過輕量化模型驗證請求的安全性,在檢測到危險操作時立即停止。最令人印象深刻的是成本優化案例:通過編寫一個清理 PR 評論的擴展,開發者成功將 token 消耗降低了 80-90%,因為擴展只展示關鍵信息。這種級別的優化在 Claude Code 或 Codex 中幾乎無法實現。

Pi 生態由多個模組組成。Py Coding Agent 是核心編碼代理,Py Core 提供會話管理和基礎功能,Py AI Package 提供大語言模型接口(支援多種 LLM),Py OS Package 提供任務調度和代理間協作(仍在實驗階段)。這種模組化設計允許用戶按需組合,避免加載不需要的功能。

從部署角度,Pi Agent 支援兩種方式。本地代理運行在用戶電腦上,完全訪問文件系統,可自定義 UI、發佈會話供他人訪問。Web 部署的代理運行在共享基礎設施上,需要對文件操作進行沙盒隔離,以確保多租戶安全。在 Web 部署中,系統可通過資源加載器定制每個代理會話的工具集和訪問權限。OpenClawed 利用 Pi Agent 的這些特性構建了 Postia——一個專門用於啟動和運營企業的代理系統,展示了 Pi Agent 遠超單純編碼代理功能的潛力。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Everything Goldman Sachs Taught Me About AI (In 10 minutes)
AI 技術英文8月24日

Everything Goldman Sachs Taught Me About AI (In 10 minutes)

Nate Herk

  • 驗證優於相信:看起來完整的AI輸出不等於正確答案,需在提示中要求模型重新檢查數字、引用來源,並對無把握的部分標記。
  • 區分AI與自動化:確定步驟且答案已知的任務用傳統自動化更便宜快速;只在需要判斷力、靈活性或處理複雜資訊時才用AI,兩者結合效果最佳。
  • 以問題驅動選型:先寫清楚「要解決的問題是什麼、成功的樣子是什麼」,再決定用什麼工具,許多失敗項目是從技術而非問題出發。
Mu: a self-hosted personal agent where the interface is an email address you can write to
AI 技術英文8月23日

Mu: a self-hosted personal agent where the interface is an email address you can write to

GitHub Awesome

  • Mu 是自主代理人系統,具有實際網址與獨立伺服器,用戶可透過多種方式與其互動——網頁應用、電子郵件或程式化介面。
  • 架構完整覆蓋日常工作流程的多個層面,整合郵件收發(SMTP/IMAP)、檔案管理、行事曆、新聞聚合、市場數據與搜尋功能於一個 Go 伺服器內。
  • 支援自帶模型與多種通訊協定,用戶可選擇不同的 AI 模型,並透過 MCP、HTTP API 或命令列工具整合到其他系統。