KeyFrame內部研究專用

AI tools for Forward Deployed Engineering — Vasuman Moza, Varick Agents

AI Engineer·7月28日週二·20 min英文

三句話摘要

前沿部署工程師如何通過 AI 代理實現企業部門級轉型 下一代 AI 部署的真正瓶頸不是機器的執行力,而是理解業務和圍繞 AI 重新設計流程的能力——通過 FDE Agent 等工具,可讓少數頂尖工程師以可擴展的方式完成這項工作。 執行力不再是瓶頸,認知能力成為新限制。AI 模型已能完成端到端任務,但每家企業的業務流程差異巨大。前沿部署工程師必須深入理解客戶特定的運作方式,而非應用通用 AI 工具。

重點整理

重點
  • 1

    執行力不再是瓶頸,認知能力成為新限制。AI 模型已能完成端到端任務,但每家企業的業務流程差異巨大。前沿部署工程師必須深入理解客戶特定的運作方式,而非應用通用 AI 工具。

  • 2

    流程重新設計決定投資回報率。生硬將 AI 套用於已有缺陷的流程是失敗根本原因。需評估每個步驟哪些自動化、哪些需人工干預,在保持用戶習慣的前提下實現真正價值。

  • 3

    基於現有系統構建代理,而非要求遷移。企業已投入巨資(如五百萬美元五年)在現有系統,不會為 AI 推翻基礎架構。在 Salesforce、NetSuite 等系統之上構建,是 AI 最有用武之地。

  • 4

    工程師缺口需 AI 助手彌補。兼具頂尖技術和優秀溝通能力的 FDE 人才稀缺,FDE Agent 充當他們的助手,管理客戶互動、整理資訊、自動執行流程更新,讓少數工程師高效服務多客戶。

實用技巧與重點

乾貨
  • 統計數據:
  • MIT 研究:95% 的生成式 AI 試點未能投入生產
  • 87% 的 AI 試點未產生可衡量投資回報率
  • 真實案例:某客戶耗資五百萬美元及五年時間遷移至 NetSuite
  • 工具與平台:
  • Claude、Cursor、Codex、Factory
  • Salesforce、NetSuite、Dynamics、SAP
  • Varick OS(內建治理與評估套件)
  • 技術細節:
  • 改善前:上傳 150 頁文檔到 Claude,等待 2 分鐘,得冗長且錯誤結果
  • FDE Agent 三階段:互動(客戶交互助手)、驗證(流程設計檢查)、自主(自動執行流程更新)
  • 投資回報率對比:
  • 局部解決方案(如僅優化銷售拓展或應付賬款):5-10%
  • 部門級轉型:25-50-75%

結論

結論

下一代 AI 部署的真正瓶頸不是機器的執行力,而是理解業務和圍繞 AI 重新設計流程的能力——通過 FDE Agent 等工具,可讓少數頂尖工程師以可擴展的方式完成這項工作。

完整解析

詳細

當前的 AI 浪潮創造了全新的瓶頸。雖然模型和工具已能出色完成端到端任務,但真正的挑戰在於:如何在不增加人員的情況下,深入理解每個客戶的獨特業務需求?這正是 Varick Agents 的核心工作所在。

目前大多數企業運營仍以人為中心,但未來應以 AI 為中心。這種轉變需要前沿部署工程師完成三項關鍵任務。首先是理解客戶現狀。看似簡單的「應付賬款流程」實則包含多層細節:常規情況由 Sarah 處理,但異常情況需轉給 Chris,而 Chris 需要四天才能核對採購訂單和發票。這種現實在每家公司都不同,文檔記錄永遠無法完整捕捉。其次是圍繞 AI 重新設計流程。許多 AI 項目失敗的根本原因是生硬套用於已經有缺陷的流程——MIT 研究顯示 95% 的試點未能投入生產,87% 未產生可衡量投資回報率。重新設計需評估每個步驟:四個步驟完全自動化、三個步驟需人工干預、一個步驟完全由人處理(因風險過高或價值不足)。新流程必須足夠創新以創造真實價值,但不能太陌生以至於用戶無法適應。

第三是整合到現有系統。大多數企業已在 NetSuite、Salesforce、Dynamics 或 SAP 投入巨資(某客戶花了五百萬美元和五年)。要求他們遷移到新系統無異於自我否定。Varick 的哲學是在客戶現有系統之上構建代理,其 Varick OS 平台內建治理和評估套件,確保不改變企業基礎設施。

為解決 FDE 團隊的可擴展性問題,Varick 開發了 FDE Agent。曾經,工程師需手動上傳 150 頁文檔到 Claude,等待二分鐘,得到冗長且錯誤的結果。現在 FDE Agent 分三階段運作:互動階段作為助手幫助整理客戶信息,驗證階段確保設計的流程正確反映業務邏輯,自主階段能自動執行客戶請求(如郵件變更),無需人工介入。這讓少數工程師能服務多個客戶,避免了傳統咨詢公司的人員指數增長,同時保持面對面咨詢的價值。

通過部門級而非局部轉型,Varick 實現了 25-50-75% 的投資回報率,遠高於僅優化單一流程的 5-10%。真正的價值來自整體重新想象一個部門的運作方式,這需要深入理解、巧妙重新設計和可靠平台的完美結合。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing
編輯精選
83 min
AI 技術英文PODCAST8月26日

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing

Latent Space

  • 加速傳統物理模擬的典範轉移:氣象科學家原本認為 AI 無法匹敵數十年的物理建模工作,但傅里葉神經算子不僅達到同等精度,還快了一萬多倍。原本需要超級計算機的計算現在用消費級 GPU 就能完成,這改變了整個領域的思維方式。
  • 傅里葉域的非局部現象捕捉:傅里葉域能有效表示非局部現象(如大氣河流跨越千里的影響),且計算複雜度為準線性,遠優於完全連接的全局模型。這特別適合流體動力學、量子化學等自然現象中普遍存在的非局部相互作用。
  • 多解析度連續函數表示:神經算子將輸入輸出視為連續函數而非固定維度向量,可在推論時以任意解析度查詢,並能在更高解析度上疊加物理約束或額外數據,克服了固定解析度神經網路的限制。
Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Why the Next AI Breakthrough May Come from Physics with Max Welling - #774
55 min
AI 技術英文PODCAST8月25日

Why the Next AI Breakthrough May Come from Physics with Max Welling - #774

TWIML AI

  • 多層篩選的材料設計流程:先搜尋文獻資料庫找現有材料,若無合適的就用生成模型產生數十萬個候選分子,用機器學習力場進行分子動力學模擬篩選,再進行實驗驗證。這套流程相比傳統量子力學計算能加速效率數個數量級。
  • 生成AI與熱力學的數學等價性:資訊論是兩個領域的共同基礎,生成模型的擴散過程與非平衡統計力學描述資訊損失的過程在數學上完全對應,許多開發出來的方法工具在兩領域都有精確對應的形式。
  • 基礎模型的遷移學習策略:先在廣泛材料資料集上訓練基礎力場表示,再針對特定材料類別進行蒸餾微調,既能保持計算效率也能獲得專一性。