KeyFrame內部研究專用

一週狂斬 17 萬星!GitHub 史上最速 AI 黑馬,免寫程式碼、用嘴巴就能讓 AI 「自我進化」

李哈利AI·8月23日週日·14 min中文

三句話摘要

介紹 Deep Seek 開源 Harness 框架的功能設計、優勢與實踐考量。 Deep Seek Harness 理念創新且完全開源,但穩定性與安全性尚需觀察,現階段可視為前景看好的未來選擇而非立即遷移目標。 核心架構優勢:相比 Claude Code 或 Codex 只能透過 Skills/MCP 等外層擴展,Deep Seek Harness 允許直接編寫和修改系統底層邏輯。這打破了既有工具的結構限制,使用者可完整控制 Agent 與工具的調度方式,甚至實現自我進化功能。

重點整理

重點
  • 1

    核心架構優勢:相比 Claude Code 或 Codex 只能透過 Skills/MCP 等外層擴展,Deep Seek Harness 允許直接編寫和修改系統底層邏輯。這打破了既有工具的結構限制,使用者可完整控制 Agent 與工具的調度方式,甚至實現自我進化功能。

  • 2

    四層工作模式應用:標準模式逐步調用工具如同傳統 Claude Code;PTC 並行模式讓 AI 在後台同時執行多個工具調用,大幅減少上下文膨脹和 Token 消耗,適合複雜多步驟操作;簡化模式處理無需工具的簡單任務;創造模式是獨特賣點,用自然語言描述需求後 AI 自動編寫程式碼並部署插件。

  • 3

    創造模式的實踐展示:講者示範「建立蜘蛛俠主題前端插件」,僅用一句描述就讓系統自動思考設計、調用工具、編寫程式碼並部署。整個過程完全透明,顯示思考軌跡、使用的 Skill、Token 消耗等詳細數據。

  • 4

    務實風險評估:儘管功能強大且免費開源,但工具剛推出穩定性不如成熟工具;從 GitHub 引入插件有安全隱患;日常開發很少需要重複修改底層邏輯。現階段觀望待時較為恰當。

實用技巧與重點

乾貨
  • 發布成績與特性
  • GitHub 星數:一週內 173,000 顆星
  • 開源成本:完全免費、100% 開源
  • 支援模型:任何大模型(Deep Seek、OpenRouter 等)
  • 四種工作模式
  • 標準模式:逐步調用工具執行任務
  • PTC 並行模式:同時執行多個工具,減少上下文膨脹
  • 簡化模式:處理簡單問題無需工具調用
  • 創造模式:自然語言生成並部署新插件
  • 系統設定與監控
  • 並行工具調用數:可自訂
  • 推理等級:Off、Low、High、Max
  • 權限層級:Read only、Workspace write、Full access
  • Token 監控:顯示 LM 執行時間、當前步驟、首個 token 延遲、Token 速度、快取命中率、輸入/輸出 Token 數
  • 語言:中文、英文
  • 介面主題:淺色、深色
  • 繁忙時期模式:排隊發送、插隊發送
  • 高階配置選項
  • 中端循環、Azure 循環等進階設定
  • 網頁搜尋、第三方 API 插件整合
  • 自訂 Agent 預設(內建四個標準模式可擴充)

結論

結論

Deep Seek Harness 理念創新且完全開源,但穩定性與安全性尚需觀察,現階段可視為前景看好的未來選擇而非立即遷移目標。

完整解析

詳細

Deep Seek 最近推出的開源 Harness 框架在開發者社群掀起熱潮,一週內破 173,000 GitHub 星。這套工具的核心理念「一切皆插件」完全顛覆了既有 AI 開發框架的設計思路。

相比 Claude Code 或 Codex 的 Harness,Deep Seek Harness 最本質的差異是可控性的深度。傳統工具只允許透過 Skills 或 MCP 等外層擴展來增加功能,但無法碰觸核心底層邏輯。Deep Seek Harness 則完全打破這個限制,使用者可以直接編寫和修改系統最底層的運作邏輯,自訂 Agent 與工具的調度方式。更令人興奮的是,整個系統 100% 開源免費,還內建了自我進化的潛力,允許 AI 自行編寫和部署插件。

系統提供四種工作模式應對不同場景。標準模式運作方式與傳統 Claude Code 相仿,逐步調用工具執行任務;PTC 並行模式是創新亮點,AI 在後台同時生成並執行多個工具調用,這能大幅減少上下文膨脹並節省 Token 消耗,特別適合需要調用十次以上工具的複雜多步驟操作;簡化模式處理無需工具調用的簡單問題;創造模式是整個系統的精華,允許使用者用自然語言描述需求,AI 自動編寫程式碼、完成實現並將功能部署為插件。

講者以建立蜘蛛俠主題前端為例展示創造模式的威力。他只需說「幫我做個蜘蛛俠主題的前端插件」,系統即自動思考設計方案、調用多個工具、編寫程式碼並部署成可用插件。整個過程完全透明,系統會顯示每一步的思考軌跡、使用哪些 Skill 和 Tool、執行耗時、Token 消耗、快取命中率等詳細數據。這種能力遠超過現有工具的預設功能和 Skill 系統。

然而,講者也坦誠指出實踐考量。儘管功能強大,但 Deep Seek Harness 剛推出不久,穩定性尚不如經過驗證的 Claude Code 或 Codex。從 GitHub 引入的插件存在安全隱患,需要謹慎檢查或用其他工具代讀驗證。最關鍵的是,日常開發中很少真正需要重複修改底層邏輯,大多數設置初始化後就保持不變。因此,講者建議現階段不必急著轉換,不如等待工具更加成熟穩定後再採用,也完全來得及。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Everything Goldman Sachs Taught Me About AI (In 10 minutes)
AI 技術英文8月24日

Everything Goldman Sachs Taught Me About AI (In 10 minutes)

Nate Herk

  • 驗證優於相信:看起來完整的AI輸出不等於正確答案,需在提示中要求模型重新檢查數字、引用來源,並對無把握的部分標記。
  • 區分AI與自動化:確定步驟且答案已知的任務用傳統自動化更便宜快速;只在需要判斷力、靈活性或處理複雜資訊時才用AI,兩者結合效果最佳。
  • 以問題驅動選型:先寫清楚「要解決的問題是什麼、成功的樣子是什麼」,再決定用什麼工具,許多失敗項目是從技術而非問題出發。
Mu: a self-hosted personal agent where the interface is an email address you can write to
AI 技術英文8月23日

Mu: a self-hosted personal agent where the interface is an email address you can write to

GitHub Awesome

  • Mu 是自主代理人系統,具有實際網址與獨立伺服器,用戶可透過多種方式與其互動——網頁應用、電子郵件或程式化介面。
  • 架構完整覆蓋日常工作流程的多個層面,整合郵件收發(SMTP/IMAP)、檔案管理、行事曆、新聞聚合、市場數據與搜尋功能於一個 Go 伺服器內。
  • 支援自帶模型與多種通訊協定,用戶可選擇不同的 AI 模型,並透過 MCP、HTTP API 或命令列工具整合到其他系統。