KeyFrame內部研究專用

AI 和 AI Agent 到底怎麼學?三年 AI 創業經驗告訴你只需要懂20%(2026版本)

漢克蔡 | Ai 集·8月16日週日·16 min中文

三句話摘要

2026 年如何選擇和實踐 AI 工具的三大核心準則與脈絡工程框架。 從糾結「用哪個 AI」轉變為「如何用好 AI」,透過脈絡工程和自動化系統持續優化人機協作,是在 AI 時代保持競爭力的核心能力。 工具選擇的三大準則:投資金額決定模型品質,付費版遠優於免費版,選擇美國三家標杆企業(OpenAI、Anthropic、Google)的工具不會差很多。

重點整理

重點
  • 1

    工具選擇的三大準則:投資金額決定模型品質,付費版遠優於免費版,選擇美國三家標杆企業(OpenAI、Anthropic、Google)的工具不會差很多。

  • 2

    三大工具各自優勢:ChatGPT 因發布最早教學資源最豐富且中文表現最精確;Claude 最擅長程式撰寫除錯和數據分析;Gemini 在多模態整合(文字、聲音、影像)領先,適合複合媒體任務。

  • 3

    從提示詞工程升級到脈絡工程:ORC 框架包含 Outcome(明確預期結果)、Reference(提供參考範例)、Connector(連接外部工具)。AI 現已能透過 Memory.MD 檔案高度精準預測用戶預期,提示詞的重要性相應下降。

  • 4

    AI 自動化系統的三大支柱:Instruction(設定規則偏好)、Files(放入參考資料)、Memory(系統自動累積記憶)。透過 Connectors 連接現有工具,形成統一的工作流工廠。

實用技巧與重點

乾貨
  • 主流工具:ChatGPT(OpenAI)、Claude(Anthropic)、Gemini(Google)
  • 工具中的 Project 功能名稱:Claude 和 ChatGPT 稱「Project」,Gemini 稱「Gemini Gem」
  • 模型選擇規則:數字越大越好(4.8 > 4.6),一般版 > Lite 版,設定為「高」或「最大」努力程度
  • Claude 核心功能:Cowork(自動化介面)、Connectors(連接工具)、Skills.MD(技能定義)
  • Gemini 核心功能:Extended Thinking(最高思考模式)、Spark(多模態整合)、記憶匯入介面
  • ORC 脈絡工程框架
  • O(Outcome):清楚說明預期結果(如「200 字專業語氣的會議摘要」)
  • R(Reference):提供過去的高品質範例讓 AI 參考結構
  • C(Connector):連接 Gmail、Google Drive、企業系統等工具
  • 最佳檔案格式:.MD 檔案 TOKEN 消耗最少,避免 PDF 和 Word
  • Project 內部架構
  • Instruction:字數限制、不用 emoji、語氣要求等規則
  • Files:公司視覺設計、策略文件、品牌指南等參考資料
  • Memory:系統自動更新,也可手動補充關鍵資訊
  • 講者背景:漢克蔡,AI 創業家,前數據分析師,曾在友達光電和 IMAG-Global 泰國總部授課
  • 資源:AI 升格創業學院(免費加入,涵蓋 Claude 進階操作和 AI Agent 概念)

結論

結論

從糾結「用哪個 AI」轉變為「如何用好 AI」,透過脈絡工程和自動化系統持續優化人機協作,是在 AI 時代保持競爭力的核心能力。

完整解析

詳細

AI 工具市場已進入成熟期。講者觀察到美國主流的三大模型(ChatGPT、Claude、Gemini)彼此競爭導致功能與效能差距逐漸縮小,各家在應用層面的設計趨勢開始相互模仿。Claude 推出自動化界面 Cowork 並支援 Skills.MD 後,OpenAI 和 Google 也陸續推出類似功能,這表示掌握其中一款工具的用戶未來轉換工具的門檻變得很低。因此對大多數人而言,選擇哪個工具不如選擇如何用好它更重要。

選擇 AI 工具有三個核心準則。首先,投資金額直接反映模型品質——越願意投入開發語言模型的公司,其模型通常越好。其次,必須選擇付費版本而非免費版本。講者強調付費版本的表現遠優於免費版本,且能避免 TOKEN 快速耗盡的困擾。若公司提供 Gemini 訂閱但你使用免費 ChatGPT,應直接改用付費 Gemini。第三個準則是根據各工具的獨特優勢做選擇:ChatGPT 因發布最早,教學資源最豐富,中文表現也最精確;Claude 最擅長程式撰寫、除錯和圖表化;Gemini 則在多模態整合(文字、聲音、影像)方面最強。

從「提示詞工程」向「脈絡工程」的轉變是關鍵認知升級。隨著 AI 模型進步,模型已能透過歷史互動記錄和 Memory.MD 檔案高度精準預測用戶預期,提示詞的重要性相應下降。脈絡工程框架稱為 ORC,包含三要素:Outcome 明確定義預期結果(而非模糊的「200 字、專業語氣」),Reference 提供高品質參考範例讓 AI 參考結構,Connector 連接現有工具系統。當用戶提供過去的高品質輸出範例時,AI 就能理解用戶的期望,後續輸出會自動符合需求。此外,許多人仍把 AI 當聊天機器人使用,重複進行複製貼上。實際上應該透過 Connectors 直接連接 Gmail、Google Drive 等既有系統,讓 AI 自行查找所需資訊。

建立 AI 自動化系統是實現高效工作流的關鍵。無論是 Claude 的 Project、ChatGPT 的 Project 或 Gemini 的 Gem,概念相同——將工作流程視為一個工廠。Project 由三大支柱組成:Instruction 設定每次執行時的規則和偏好(如字數限制、不用 emoji、所需語氣),Files 放入參考資料如公司視覺設計、策略文件、目標定位,Memory 系統自動累積和更新的記憶(AI 會自主判斷哪些細節值得保存,用戶也可手動補充)。透過 Connectors 連接 Gmail、Google Workspace 等工具,AI 就能跨系統整合資訊形成統一系統。講者發現 .MD 檔案格式最節省 TOKEN,應盡量避免 PDF 和 Word 檔案,若需轉換可直接請 AI 幫忙。最後,持續優化使用流程至關重要——越了解你、越了解你的需求和偏好,AI 的輸出品質就越符合預期。講者強調品質優先於 TOKEN 成本,寧願多花 TOKEN 換取高品質輸出,因為低品質的輸出只是浪費已消耗的 TOKEN。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing
編輯精選
83 min
AI 技術英文PODCAST8月26日

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing

Latent Space

  • 加速傳統物理模擬的典範轉移:氣象科學家原本認為 AI 無法匹敵數十年的物理建模工作,但傅里葉神經算子不僅達到同等精度,還快了一萬多倍。原本需要超級計算機的計算現在用消費級 GPU 就能完成,這改變了整個領域的思維方式。
  • 傅里葉域的非局部現象捕捉:傅里葉域能有效表示非局部現象(如大氣河流跨越千里的影響),且計算複雜度為準線性,遠優於完全連接的全局模型。這特別適合流體動力學、量子化學等自然現象中普遍存在的非局部相互作用。
  • 多解析度連續函數表示:神經算子將輸入輸出視為連續函數而非固定維度向量,可在推論時以任意解析度查詢,並能在更高解析度上疊加物理約束或額外數據,克服了固定解析度神經網路的限制。
Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Why the Next AI Breakthrough May Come from Physics with Max Welling - #774
55 min
AI 技術英文PODCAST8月25日

Why the Next AI Breakthrough May Come from Physics with Max Welling - #774

TWIML AI

  • 多層篩選的材料設計流程:先搜尋文獻資料庫找現有材料,若無合適的就用生成模型產生數十萬個候選分子,用機器學習力場進行分子動力學模擬篩選,再進行實驗驗證。這套流程相比傳統量子力學計算能加速效率數個數量級。
  • 生成AI與熱力學的數學等價性:資訊論是兩個領域的共同基礎,生成模型的擴散過程與非平衡統計力學描述資訊損失的過程在數學上完全對應,許多開發出來的方法工具在兩領域都有精確對應的形式。
  • 基礎模型的遷移學習策略:先在廣泛材料資料集上訓練基礎力場表示,再針對特定材料類別進行蒸餾微調,既能保持計算效率也能獲得專一性。