KeyFrame內部研究專用

DeepSeek Harness 首发实测 + 入门教程,夯爆了!梁神我错了

程序员鱼皮·8月14日週五·16 min中文

三句話摘要

DeepSeek Harness 是國產開源 AI 編程工具,透過「一切皆插件」的架構提供高度可定制的 Agent 運行環境,對標 Cursor/Cline 但開放性更強。 DeepSeek Harness 通過開源和極致的插件化設計,讓每個人都能按需定制屬於自己的 AI 編程工具,其實測能力和性價比已可與 Claude Opus 5 媲美。 核心架構設計:Agent = Model + Harness。模型負責思考和生成,Harness 負責把 AI 能力接入文件系統、終端、網頁和工具鏈,讓 AI 真正在現實環境中工作。官方理念是「一切皆插件」——模型、工具、技能、UI 甚至 Agent 運行循環都可替換或擴展,無需改動框架核心。

重點整理

重點
  • 1

    核心架構設計:Agent = Model + Harness。模型負責思考和生成,Harness 負責把 AI 能力接入文件系統、終端、網頁和工具鏈,讓 AI 真正在現實環境中工作。官方理念是「一切皆插件」——模型、工具、技能、UI 甚至 Agent 運行循環都可替換或擴展,無需改動框架核心。

  • 2

    四層模式滿足不同場景:基礎模式(Bash + 文件編輯)用於模型基準測試;標準模式提供完整工具組合適合日常開發;PTC 模式支持程序化工具調用串聯,適合步驟多但邏輯清晰的批量任務;創造模式讓 AI 可檢查和改裝插件配置,用於開發新工具和定制預設。

  • 3

    極高的成本效益:四個實測任務的緩存命中率均達 99% 以上,總花費不到 5 元。即使 DeepSeek 在 8 月 17 號宣布漲價,與 Claude/OpenAI 相比仍具競爭力,且緩存機制讓實際成本進一步降低。

  • 4

    開放的插件生態:社區插件涵蓋主題皮膚、交互優化、代碼增強、圖像理解等。用戶可通過 AI 自動安裝卸載;開發新插件在創造模式下讓 AI 輔助編寫後分享到 GitHub(標記 DSS-Plange 標籤),完全降低定制門檻。

實用技巧與重點

乾貨
  • 安裝步驟
  • 前提條件:Node.js 已安裝
  • 執行官網提供的命令行指令
  • 填入 DeepSeek 開放平台生成的 API Key
  • 進入 Web UI 選擇項目文件夾即可使用
  • 四種運行模式
  • 基礎模式:Bash + 文件編輯(模型基準測試)
  • 標準模式:完整工具組(文件編輯、命令行、網頁搜索、代碼檢查等)
  • PTC 模式:程序化工具調用,支持多工具串聯一次執行
  • 創造模式:可檢查/改裝當前插件配置和實驗新組合
  • 實測任務數據
  • | 任務 | 耗時 | 內容 | 緩存命中率 |
  • |------|------|------|----------|
  • | 1 | 數分鐘 | 源碼分析 + 架構圖生成 (Mermaid) | 99% |
  • | 2 | 20 分鐘 | 交互式知識講解網站含動畫 | 99% |
  • | 3 | 40 分鐘 | 3D 網頁遊戲含手勢識別 | ~100% |
  • | 4 | 30 分鐘 | AI 網頁 PPT 生成器 | 99%+ |
  • | 總計 | 4 任務 | 總花費 < 5 元 | 平均 99%+ |
  • 插件管理
  • 社區插件:GitHub 上標記「DSS-Plange」的項目
  • 皮膚類:主題、終端風格、廣告風格等
  • 功能類:代碼欄交互優化、Markdown 快速引用、圖像視覺理解
  • 安裝:Web UI 中提供 Git 地址給 AI 自動安裝
  • 開發:創造模式 → AI 編寫 → 人工審批 → Git 推送 + 標籤分享

結論

結論

DeepSeek Harness 通過開源和極致的插件化設計,讓每個人都能按需定制屬於自己的 AI 編程工具,其實測能力和性價比已可與 Claude Opus 5 媲美。

完整解析

詳細

DeepSeek 在一天內發布了兩項重量級公告:V4 Pro 正式版上線和 Harness 開源。後者在 GitHub 上線不到 24 小時就斬獲 8 萬多 star,足見業界期待。

Harness 一詞的含意是「驾驭」。若把 AI 模型比作一匹馬,Harness 就是驾驭這匹馬所需的全套装備——項目規則文件、工具配置、任務拆分、測試流程等。官方的精妙定義是:Agent = Model + Harness。模型負責思考和生成,Harness 負責把這些能力接入文件系統、終端、網頁和工具鏈,讓 AI 真正在現實環境中工作。之前 DeepSeek 只開放了模型部分,Harness 一直沒有動作,這次終於補全了拼圖。

安裝過程簡單到不可思議。確保電腦裝好 Node.js 後,執行官網提供的一行命令,然後填入 DeepSeek API Key 即可。Web UI 界面與 Cursor 神似,支持選擇模型、調整推理等級、設置 Agent 對文件系統和終端的操作權限等。

Harness 的架構設計圍繞「一切皆插件」展開,提供四種運行模式應對不同場景。基礎模式仅保留 Bash 和文件編輯,用於模型基準測試;標準模式是日常開發的首選,加載完整工具組包括代碼編輯、命令行、網頁搜索、代碼檢查等;PTC 模式支持程序化工具調用,模型可直接生成代碼把多部工具串聯起來一次性執行,特別適合步驟多但邏輯清晰的批量自動化任務;創造模式繼承標準模式的全部能力,還讓 AI 可以檢查當前插件配置、試驗新組合,用於開發新工具或定制 Agent 預設。

實測中用標準模式完成了四個複雜度遞進的任務。首先是分析 DeepSeek Harness 自身源碼並繪製架構圖,AI 快速讀取文件、分析項目結構,數分鐘內生成完整的 Mermaid 圖表語法。其次是開發交互式知識講解網站,AI 從零開始設計頁面、編寫動畫效果、集成測驗功能,20 分鐘完成的網站效果媲美專業產品,緩存命中率 99%。再次是開發 3D 網頁小遊戲,支持鼠標拖拽旋轉和手勢識別控制,耗時 40 分鐘,緩存命中率接近 100%,成品質量令人驚艷。最後是開發 AI 網頁 PPT 生成器,用戶粘貼文案後前端調用 DeepSeek 大模型拆解為多頁 PPT 並渲染為可全屏展示的網頁,30 分鐘完成,交互體驗流暢。四個任務的總花費不到 5 元,這得益於 99% 以上的緩存命中率讓實際調用成本極低。

Harness 最獨特的地方是「一切皆插件」架構。模型、工具、技能、UI 框架甚至 Agent 運行循環本身都是插件,可以隨時替換或擴展,無需觸及框架核心。社區已開發出豐富的插件生態,包括各種主題皮膚美化、代碼編輯欄交互優化、Markdown 快速引用、圖像視覺理解等。安裝插件簡單得令人發指,只需在 Web UI 中提供插件的 Git 地址給 AI,AI 就能自動完成安裝卸載。開發新插件也不複雜,切換到創造模式後讓 AI 輔助編寫,完成時 AI 會請求人工審批,確認無誤後正式安裝。最後通過 Git 推送代碼並打上「DSS-Plange」標籤,就能分享給整個社區。

相比 Cursor、Cline 等商業工具,Harness 的開放性遠勝一籌。每個人都可根據自己的需求自由組裝工具鏈和插件預設,最終每個人手中的 AI 編程工具都能長得完全不一樣。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing
編輯精選
83 min
AI 技術英文PODCAST8月26日

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing

Latent Space

  • 加速傳統物理模擬的典範轉移:氣象科學家原本認為 AI 無法匹敵數十年的物理建模工作,但傅里葉神經算子不僅達到同等精度,還快了一萬多倍。原本需要超級計算機的計算現在用消費級 GPU 就能完成,這改變了整個領域的思維方式。
  • 傅里葉域的非局部現象捕捉:傅里葉域能有效表示非局部現象(如大氣河流跨越千里的影響),且計算複雜度為準線性,遠優於完全連接的全局模型。這特別適合流體動力學、量子化學等自然現象中普遍存在的非局部相互作用。
  • 多解析度連續函數表示:神經算子將輸入輸出視為連續函數而非固定維度向量,可在推論時以任意解析度查詢,並能在更高解析度上疊加物理約束或額外數據,克服了固定解析度神經網路的限制。
Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Why the Next AI Breakthrough May Come from Physics with Max Welling - #774
55 min
AI 技術英文PODCAST8月25日

Why the Next AI Breakthrough May Come from Physics with Max Welling - #774

TWIML AI

  • 多層篩選的材料設計流程:先搜尋文獻資料庫找現有材料,若無合適的就用生成模型產生數十萬個候選分子,用機器學習力場進行分子動力學模擬篩選,再進行實驗驗證。這套流程相比傳統量子力學計算能加速效率數個數量級。
  • 生成AI與熱力學的數學等價性:資訊論是兩個領域的共同基礎,生成模型的擴散過程與非平衡統計力學描述資訊損失的過程在數學上完全對應,許多開發出來的方法工具在兩領域都有精確對應的形式。
  • 基礎模型的遷移學習策略:先在廣泛材料資料集上訓練基礎力場表示,再針對特定材料類別進行蒸餾微調,既能保持計算效率也能獲得專一性。