KeyFrame內部研究專用

【2026 必看】AI Agent 終極實戰:從原理拆解到「萬能 Skill 製造機」自製!全網最全 SOP 帶你零代碼手搓數位特工,打造自動化流水線

九姨小課堂·3月23日週一·13 min中文

三句話摘要

透過結構化的 Skill 說明書,將 AI 從只會對話的聊天機器人升級為能執行實質任務的自動化數位員工。 Skill 不是玄學,就是一份結構化的執行說明書;學會用 Skill Creator 造 Skill,等於在 AI 大腦裡裝上了自動化生產流水線,把任何模糊想法轉化為可反覆調用的數位員工。 1. Skill 的本質是結構化執行說明書,而非提示詞

重點整理

重點
  • 1

    1. Skill 的本質是結構化執行說明書,而非提示詞

  • 2

    提示詞是一次性對話,AI 只回應當下內容;Skill 是可反覆調用的數位員工規格書,讓 AI 跨越軟體限制直接產出成品,使用者從「求 AI 辦事」變成「指揮 AI 生產」。

  • 3

    2. 大模型負責思考,Skill 負責執行,兩者缺一不可

  • 4

    AI 接到指令後後台執行三步:識別需求→從技能庫匹配工具→自動完成運算並交付成果。沒有 Skill,AI 的能力被鎖在語言層;有了 Skill,AI 才能觸及外部系統與檔案。

  • 5

    3. Skill Creator 是所有 Skill 的母體,能從模糊想法自動造出新技能

  • 6

    在 `.cursor/skills/skill-creator/skill.md` 建立一份元技能說明書後,只需用自然語言描述需求,AI 即自動生成符合規範的新 Skill 文件,實現「用 Skill 造 Skill」的自動化開發流水線。

  • 7

    4. 使用第三方 Skill 前必須先做安全審查

  • 8

    公開倉庫的 Skill 品質參差不齊,建議先讓 AI 分析該 Skill 是否存在資訊洩漏風險,確認資料安全後再部署,或以開源 Skill 為範本針對自身業務邏輯微調。

實用技巧與重點

乾貨
  • 工具與平台
  • Cursor(新手友好,有免費額度,本影片主要演示環境)
  • Claude Code、GPT Codex(需訂閱)
  • Cursor、Trae(整合式編輯器)
  • Open Code(免費開源,自由度最高)
  • Remotion(動畫製作 Skill,來自 GitHub)
  • Skill 的五段結構
  • 基礎資訊:定義 Skill 名稱與功能,決定 AI 能否精準召喚
  • 角色語義層:給 AI 注入職業人設(如「20 年廚齡大廚」)
  • 觸發條件:關鍵詞列表,對話中出現即自動喚醒 Skill
  • 核心指令:AI 的辦事規範,限制發揮範圍避免答非所問
  • 輸出模板:定義成品格式(網頁/PDF/Markdown)、配色、排版
  • Skill 安裝方式(以 Cursor 為例)
  • 方法一:GitHub 下載壓縮包 → 解壓 → 拖入 Cursor → 輸入檢查指令讓 AI 完成部署
  • 方法二:設定 → Rules → Skills → New Skill → 貼上 GitHub 倉庫連結 → AI 引導完成安裝
  • 方法三:Cursor 終端機貼上安裝指令
  • Skill Creator 目錄結構
  • ```
  • 系統碟/用戶/.cursor/skills/skill-creator/skill.md
  • ```
  • (使用 Claude Code 則為 `.claude`;Open Code 為 `.opencode`;Trae 為 `.trae`)
  • Skill 資源倉庫
  • Anthropic 官方 GitHub 倉庫
  • Awesome Agent Skills(開源專案)
  • 多個第三方網頁倉庫
  • 冰箱清道夫 Skill 關鍵輸出設定
  • 輸入:剩餘食材清單
  • 輸出:有食慾感的菜名 + 詳細食材與步驟 + 靜態 HTML 網頁(含配色與可點擊連結)
  • 邊界處理:遇到無法搭配的食材時的應對邏輯
  • 結尾固定格式:「大廚敲門」

結論

結論

Skill 不是玄學,就是一份結構化的執行說明書;學會用 Skill Creator 造 Skill,等於在 AI 大腦裡裝上了自動化生產流水線,把任何模糊想法轉化為可反覆調用的數位員工。

完整解析

詳細

現代人使用 AI 最常見的誤區,是把它當成只會陪聊的復讀機。影片提出的核心問題是:AI 明明是「被關在房間裡的超級大腦」,無所不知,但沒有手腳,夠不到外面的世界。Skill 就是那雙手——它讓 AI 從純語言層跨越到實質執行層,能製作動畫、生成圖表、搭建資訊收集系統,直接交付成品而非只給建議。

講者首先從原理拆解 Skill 的底層邏輯。使用者發出指令後,AI 後台執行三步協同:識別需求、從技能庫精準匹配工具、自動完成運算並跨越軟體限制輸出成果。Skill 本身的結構像一份說明書,分為五個區塊:基礎資訊(定義身份)、角色語義層(注入職業人設)、觸發條件(關鍵詞喚醒機制)、核心指令(限定 AI 行為邊界)、輸出模板(規範成品格式)。這與一般提示詞最大的差異在於:提示詞是一次性對話,而 Skill 是可反覆調用的數位員工規格書,使用者角色從「求 AI 辦事」升級為「指揮 AI 生產」。

在部署演示環節,講者以新手友好的 Cursor 為容器,示範了 Remotion 動畫 Skill 的兩種安裝方式:直接下載 GitHub 壓縮包拖入 Cursor,或透過設定介面貼上倉庫連結讓 AI 自動引導完成安裝。部署完成後,只需拖入一張數據截圖並輸入自然語言指令,Skill 即可生成帶有漸層背景的動態圖表動畫影片。遇到缺少依賴等報錯,直接把錯誤訊息發給 AI 即可自動修復。

影片的高潮是「Skill Creator」的介紹與實作——一個能造出其他 Skill 的元技能。講者手動在 `.cursor/skills/skill-creator/skill.md` 建立目錄與文件,貼入預先撰寫的說明書後,Skill Creator 即告激活。隨後,講者用它在對話中以自然語言需求描述,60 秒內自動生成「冰箱清道夫」Skill:使用者輸入冰箱裡的剩餘食材,AI 自動策劃菜名、列出步驟、生成靜態 HTML 網頁(含配色與可點擊連結)輸出完整食譜。整個過程零手寫代碼,從模糊想法到落地可用的自動化工具,完全由 Skill Creator 驅動。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing
編輯精選
83 min
AI 技術英文PODCAST8月26日

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing

Latent Space

  • 加速傳統物理模擬的典範轉移:氣象科學家原本認為 AI 無法匹敵數十年的物理建模工作,但傅里葉神經算子不僅達到同等精度,還快了一萬多倍。原本需要超級計算機的計算現在用消費級 GPU 就能完成,這改變了整個領域的思維方式。
  • 傅里葉域的非局部現象捕捉:傅里葉域能有效表示非局部現象(如大氣河流跨越千里的影響),且計算複雜度為準線性,遠優於完全連接的全局模型。這特別適合流體動力學、量子化學等自然現象中普遍存在的非局部相互作用。
  • 多解析度連續函數表示:神經算子將輸入輸出視為連續函數而非固定維度向量,可在推論時以任意解析度查詢,並能在更高解析度上疊加物理約束或額外數據,克服了固定解析度神經網路的限制。
Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Why the Next AI Breakthrough May Come from Physics with Max Welling - #774
55 min
AI 技術英文PODCAST8月25日

Why the Next AI Breakthrough May Come from Physics with Max Welling - #774

TWIML AI

  • 多層篩選的材料設計流程:先搜尋文獻資料庫找現有材料,若無合適的就用生成模型產生數十萬個候選分子,用機器學習力場進行分子動力學模擬篩選,再進行實驗驗證。這套流程相比傳統量子力學計算能加速效率數個數量級。
  • 生成AI與熱力學的數學等價性:資訊論是兩個領域的共同基礎,生成模型的擴散過程與非平衡統計力學描述資訊損失的過程在數學上完全對應,許多開發出來的方法工具在兩領域都有精確對應的形式。
  • 基礎模型的遷移學習策略:先在廣泛材料資料集上訓練基礎力場表示,再針對特定材料類別進行蒸餾微調,既能保持計算效率也能獲得專一性。