KeyFrame內部研究專用

如果你還在靠一個最強 AI 做萬能打雜工,你要學學「多工具工作流」了

Gary Chen·5月13日週三·15 min中文

三句話摘要

停止盲目追求「最強AI工具」,建立多工具工作流讓每個AI工具各展所長。 未來高效工作的核心競爭力,不是追最新工具,而是掌握多工具分工邏輯、精準判斷任務應該交給誰。 工具選擇的核心不是排名,是匹配度 — 就像公司團隊分工,不是問哪個員工最強,而是這件事派誰做最合適。用錯工具會遇到Context不齊(AI看不到完整資料)或「只有腦沒有手」(無法實際操作系統)的問題。

重點整理

重點
  • 1

    工具選擇的核心不是排名,是匹配度 — 就像公司團隊分工,不是問哪個員工最強,而是這件事派誰做最合適。用錯工具會遇到Context不齊(AI看不到完整資料)或「只有腦沒有手」(無法實際操作系統)的問題。

  • 2

    資料位置決定工具選擇 — AI應在資料所在地工作。如果資料在Microsoft生態用Copilot、Google生態用Gemini Workspace、檔案系統用Coding Agent,比起反覆複製貼貼資料的外部工具更有效率。

  • 3

    各類任務有其最適工具 — 查資料用Perplexity(RAG検索型)、寫作推理用GPT/Opus、內部文件用Copilot/Gemini、程式自動化用Claude Code/Cursor、業務流程用原系統內建AI。

  • 4

    操作能力會逐漸比回答能力更重要 — Coding Agent能直接修改檔案、跑測試、串API,價值已超過單純對話工具,未來AI會從「回答問題」演進到「完成工作」。

實用技巧與重點

乾貨
  • 五類任務分工地圖:
  • 查資料、研究、比較 → Perplexity、Deep Research(RAG設計確保時效性、精確標註來源)
  • 深度思考、寫作、策略推演 → GPT 5.5、Claude Opus 4.7(強推理、強語言能力)
  • 公司內部文件、郵件、會議、權限資料 → Copilot(Microsoft 365生態)、Gemini Workspace(Google生態)
  • 程式、自動化、Agent工作流 → Cursor、Codex、Claude Code(能讀檔、改檔、跑測試、自主修復)
  • CRM、客服、業務流程 → Salesforce、Shopify、Shopline原系統內建AI或深度串接方案
  • 三個判斷公式:
  • 這個任務需要什麼資料?
  • 這個資料在哪裡?
  • 哪個AI能直接讀取或操作那個地方?
  • 具體案例工作流:
  • AI Agent趨勢影片製作:Perplexity找資料 → Claude理出主軸 → ChatGPT打磨口播稿
  • 自動化郵件到Notion流程:Coding Agent直接實作(串Gmail API、Notion API、Slack webhook)
  • 網站功能修改:Cursor進專案、讀架構、改檔案、跑測試(比ChatGPT貼程式碼更完整)

結論

結論

未來高效工作的核心競爭力,不是追最新工具,而是掌握多工具分工邏輯、精準判斷任務應該交給誰。

完整解析

詳細

過去兩年AI工具爆炸成長,從ChatGPT、Claude到Agentic工具如Claude Code、Codex,許多人陷入「工具焦慮」——不斷追問哪個最強。但這個問題本身就問錯了。講者的核心觀點是:真正的差距不在工具排名,而在於你是否能判斷「這個任務應該交給哪一種工具」。

這個轉變就像公司從單一英雄員工模式,進化到分工協作模式。你不會問公司裡誰最強,而是問這件事派誰做。每個部門負責不同領域——財務報表不會找設計師做,客戶訪談不會找工程師負責。AI工具也是如此,它們背後的能力邊界完全不同:有些強在搜尋、有些強在推理、有些強在寫程式。如果把所有任務硬塞進同一個ChatGPT窗口,不是因為AI不夠強,而是你對工具本身的理解有誤。

講者將日常任務分為五類,提出對應的工具分工。第一類「查資料、研究」,核心價值是檢索——用Perplexity這類RAG設計的工具,它會先去搜尋、再整理成答案,並精確標註來源,降低AI幻覺風險。第二類「深度思考、寫作」,需要強推理能力——交給GPT或Opus,它們能把混亂的筆記變清晰、把草稿變論證、把想法變決策。第三類「公司內部文件」最常被低估——不是看工具本身多聰明,而是看它能否直接觸及你的資料。如果公司用Microsoft 365,Copilot能看Gmail、Teams、OneDrive;用Google Workspace則Gemini更適合。這不是品牌信仰,而是一個簡單事實:資料在哪裡,AI就應該在哪裡工作。反覆複製貼貼資料的外部工具,根本不是真正的workflow。

第四類「程式、自動化」就需要Coding Agent如Cursor或Claude Code——它們不只是建議code,而是能直接進你的專案、讀架構、修檔案、跑測試、自主修復錯誤,這已經接近真正委派給工程師一個任務。第五類「業務流程、客服」最重要的同樣不是聊天機器人本身,而是它是否連接到真實資料——訂單、客戶紀錄、退貨政策。一個看得到CRM的普通Agent,遠勝一個看不到數據的超強模型。許多公司導入客服AI失敗,根本不是工具問題,而是沒有先整理資料權限、流程歸屬、error handling責任。

所以選工具前應該先問三個問題:這個任務需要什麼資料?資料在哪裡?哪個AI能直接操作那個地方?過去的競爭是模型之間的benchmark對決,但實際工作裡最重要的是你的「routing judgment」——能否判斷這個任務需要搜尋、推理、權限、操作還是記憶,並交給最適合的工具。這成為新的AI literacy。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Everything Goldman Sachs Taught Me About AI (In 10 minutes)
AI 技術英文8月24日

Everything Goldman Sachs Taught Me About AI (In 10 minutes)

Nate Herk

  • 驗證優於相信:看起來完整的AI輸出不等於正確答案,需在提示中要求模型重新檢查數字、引用來源,並對無把握的部分標記。
  • 區分AI與自動化:確定步驟且答案已知的任務用傳統自動化更便宜快速;只在需要判斷力、靈活性或處理複雜資訊時才用AI,兩者結合效果最佳。
  • 以問題驅動選型:先寫清楚「要解決的問題是什麼、成功的樣子是什麼」,再決定用什麼工具,許多失敗項目是從技術而非問題出發。
Mu: a self-hosted personal agent where the interface is an email address you can write to
AI 技術英文8月23日

Mu: a self-hosted personal agent where the interface is an email address you can write to

GitHub Awesome

  • Mu 是自主代理人系統,具有實際網址與獨立伺服器,用戶可透過多種方式與其互動——網頁應用、電子郵件或程式化介面。
  • 架構完整覆蓋日常工作流程的多個層面,整合郵件收發(SMTP/IMAP)、檔案管理、行事曆、新聞聚合、市場數據與搜尋功能於一個 Go 伺服器內。
  • 支援自帶模型與多種通訊協定,用戶可選擇不同的 AI 模型,並透過 MCP、HTTP API 或命令列工具整合到其他系統。