KeyFrame內部研究專用

團隊生產力爆表!Gemini Spark 商業 AI Agent 自動化完整教學

漢克蔡 | Ai 集·8月13日週四·20 min中文

三句話摘要

Google Gemini Spark:從AI助理升級到自動化AI代理的實踐指南。 建立由總管AI代理協調的多層級Skill系統,才是中小企業真正發揮AI力量、自動化日常工作流程的關鍵。 AI的三層應用與Spark的位置:生成式AI是語言模型底層,AI助理需要用戶主動提問並處理單次任務,而AI代理能主動執行重複性工作並操作各系統。Spark的核心差異是它直接整合Google Workspace,AI可自動將結果寫入Gmail、Sheets、Drive,不再需要用戶手工複製貼上。

重點整理

重點
  • 1

    AI的三層應用與Spark的位置:生成式AI是語言模型底層,AI助理需要用戶主動提問並處理單次任務,而AI代理能主動執行重複性工作並操作各系統。Spark的核心差異是它直接整合Google Workspace,AI可自動將結果寫入Gmail、Sheets、Drive,不再需要用戶手工複製貼上。

  • 2

    Personal Intelligence是Spark的發動引擎:啟用Memory讓AI學習用戶特性與期望,開啟Connected Apps讓代理存取各系統,在Instructions中設定輸出規則(如禁止emoji)。這三項設定使Spark逐次改進其產出,最終形成穩定的個人化AI助手。

  • 3

    通過Skill和Template穩定品質:每個Skill需明確定義目的、執行步驟和產出規則。重點是提供標準模板給AI,讓它每次都按同一格式輸出。例如會議記錄應包含會議資訊、目的、重點摘要、決策、後續追蹤等欄位,AI就能一致性地整理所有會議。

  • 4

    自動化觸發方式選擇工作流:時間點觸發(定時運行,如每週日晚上生成週報)適合非即時資訊;事件觸發(滿足條件立即執行,如客戶來信即刻回應)適合需快速反應的工作。事件觸發能把客戶回應時間從小時級降到分鐘級,顯著提高轉化率。

實用技巧與重點

乾貨
  • Gemini vs Spark核心差異
  • Gemini:收集→處理→總結(需用戶手動操作應用)
  • Spark:直接自動寫入Gmail、Google Sheets、Google Docs、Google Drive
  • Personal Intelligence三項必設
  • Memory:打開,讓AI學習用戶特性
  • Connected Apps:開啟Gmail、Drive、Sheets、Docs、YouTube等
  • Instructions:輸入規則(如「禁止使用emoji」)
  • Skill的三大元素
  • Purpose(目的):技能要做什麼
  • Steps(步驟):執行流程
  • Rules(規則):輸出格式要求
  • 自動化觸發設定
  • 時間點觸發:Schedules → Create manually(設週幾、時間、頻率),或Create with Gemini(讓AI建議最佳時機)
  • 事件觸發:監控特定條件(如特定發件者的郵件),滿足立即執行
  • 示範數據
  • 客戶5分鐘內回答能提高2倍成交率
  • 航班整理任務:自動搜尋Gmail預訂、Google搜尋米其林餐廳、生成Google Sheet、寫入指定Drive資料夾
  • 會議模板:會議資訊→目的→重點摘要→確認決策→後續執行追蹤
  • Skill分享機制
  • 下載為.zip檔(含.MD檔)
  • 上傳時系統自動偵測同名Skill防重複
  • Spark.MD系統架構
  • 作為總管AI agent設定全局規則
  • 規則範例:溝通規則、產出地點規則
  • 協調多個子代理執行不同任務
  • --

結論

結論

建立由總管AI代理協調的多層級Skill系統,才是中小企業真正發揮AI力量、自動化日常工作流程的關鍵。

完整解析

詳細

Google Gemini Spark是Google推出的AI代理工具,針對中小企業和個體戶設計,比Claude Code或OpenAI方案更易上手。其核心價值在於將AI應用從被動助理升級為主動代理,真正節省工作時間。傳統Gemini雖能收集、處理和總結資訊,卻無法直接操作Google應用,最後仍需用戶手動複製貼到Gmail、Sheets等工具。而Spark直接整合Google Workspace全套應用,AI代理可自動將產出結果寫入相應系統,形成一條龍的自動化工作流。此外,Gemini採被動互動模式需用戶提問,Spark則支持主動工作模式,用戶可設定固定時間或觸發條件讓AI自動執行。

在講者示範中,用戶僅需告訴Spark「整理我Gmail中2026年所有航班預訂,並為每個目的地找評價最佳的米其林四人餐廳」,Spark即自動搜尋Gmail預訂記錄、Google搜尋餐廳資訊,並在Google Sheet中生成完整資料表(包含日期、地點、餐廳名稱、星級評分、推薦原因),最後自動存放到指定Google Drive資料夾。這整個過程不需人工介入,體現了AI代理相較AI助理的根本優勢。要發揮Spark的威力,首先需進行三項關鍵設定:啟用Personal Intelligence中的Memory記憶功能讓AI學習用戶特性,開啟所有Connected Apps連接以便AI操作各系統,以及在Instructions中設定輸出規則(如禁止使用emoji)。

接下來,通過Skill技能創建可重複執行的工作流程。每個Skill需清楚定義目的、執行步驟和產出規則。為了穩定產出品質,應將工作的標準模板提供給AI,讓它每次都按同一格式輸出。例如會議記錄應包含會議資訊、目的、重點摘要、確認決策、後續執行追蹤等欄位,AI就能一致性地整理所有會議。Spark支持兩種自動化觸發方式:時間點觸發適合不需及時反應的定期工作(如每週生成週報),用戶在Schedules中設定執行週期和時間,或使用「Create with Gemini」讓AI建議最佳時機;事件觸發適合需要快速響應的場景(如客戶詢問),系統持續監控信箱並在滿足條件時立即執行任務。講者提到客戶詢問若在5分鐘內回答可提高2倍成交率,這正是事件觸發的優勢所在。

最高階應用是建立AI agent系統架構,即創建Spark.MD檔案作為總管AI agent,定義溝通規則、產出位置等系統規則。當用戶提交新任務時,總管代理分析任務性質,將其分配給相應的子代理和Skill執行,最終自動產出並存放到指定位置。多個子代理可共享同一個Skill(如圖表視覺化Skill),形成高度協調的自動化體系。這種架構使講者經營的AI公司能大幅降低各類工作的完成時間(Cycle Time),是中小企業快速擴大生產力的實用路徑。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing
編輯精選
83 min
AI 技術英文PODCAST8月26日

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing

Latent Space

  • 加速傳統物理模擬的典範轉移:氣象科學家原本認為 AI 無法匹敵數十年的物理建模工作,但傅里葉神經算子不僅達到同等精度,還快了一萬多倍。原本需要超級計算機的計算現在用消費級 GPU 就能完成,這改變了整個領域的思維方式。
  • 傅里葉域的非局部現象捕捉:傅里葉域能有效表示非局部現象(如大氣河流跨越千里的影響),且計算複雜度為準線性,遠優於完全連接的全局模型。這特別適合流體動力學、量子化學等自然現象中普遍存在的非局部相互作用。
  • 多解析度連續函數表示:神經算子將輸入輸出視為連續函數而非固定維度向量,可在推論時以任意解析度查詢,並能在更高解析度上疊加物理約束或額外數據,克服了固定解析度神經網路的限制。
Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Why the Next AI Breakthrough May Come from Physics with Max Welling - #774
55 min
AI 技術英文PODCAST8月25日

Why the Next AI Breakthrough May Come from Physics with Max Welling - #774

TWIML AI

  • 多層篩選的材料設計流程:先搜尋文獻資料庫找現有材料,若無合適的就用生成模型產生數十萬個候選分子,用機器學習力場進行分子動力學模擬篩選,再進行實驗驗證。這套流程相比傳統量子力學計算能加速效率數個數量級。
  • 生成AI與熱力學的數學等價性:資訊論是兩個領域的共同基礎,生成模型的擴散過程與非平衡統計力學描述資訊損失的過程在數學上完全對應,許多開發出來的方法工具在兩領域都有精確對應的形式。
  • 基礎模型的遷移學習策略:先在廣泛材料資料集上訓練基礎力場表示,再針對特定材料類別進行蒸餾微調,既能保持計算效率也能獲得專一性。