KeyFrame內部研究專用

Google AI Agent 登陸香港!Gemini Spark 自動化可以做甚麼?自動記支出、追美股、排日本行程全紀錄!比較 OpenClaw

GadgetGang HK·7月31日週五·16 min中文

三句話摘要

Google Gemini Spark在香港開通:一個與Google Workspace深度整合的AI代理入門方案 Gemini Spark是AI Agent領域一個優秀的"入門橋樑",用零程式設計知識即可體驗自動化工作流,但智慧水平有限且價格較高,最佳時機應該是等待Google AI Pro支援。 Spark是"一體機"而非"需要組裝的零件"——開源Agent如OpenAI Call需要使用者手動配置LLM API、部署程式碼、連線第三方應用,而Spark預裝了所有必需元件,使用者透過對話介面即可完整工作,大幅降低了AI Agent的使用門檻。

重點整理

重點
  • 1

    Spark是"一體機"而非"需要組裝的零件"——開源Agent如OpenAI Call需要使用者手動配置LLM API、部署程式碼、連線第三方應用,而Spark預裝了所有必需元件,使用者透過對話介面即可完整工作,大幅降低了AI Agent的使用門檻。

  • 2

    Google Workspace深度融合是獨特優勢——Spark持續監控使用者的Gmail、Drive等服務,當收到發票或預訂確認時自動更新相關文件,並能跨Google Document、Sheet、PDF無縫同步內容。當使用者手動編輯文件時,Spark也能自動檢測並更新其他關聯檔案。這種生態內閉環的協作模式是開源Agent很難做到的。

  • 3

    定時任務穩定可靠,事件觸發需精準指令——講者每天上午9點、中午12點、下午4點的股票報告和新聞更新都按時執行無誤,但依賴郵件觸發的支出表更新會有數小時延遲,說明明確的時間指令比模糊的事件監聽更有效。

  • 4

    智慧水平與標準Gemini相當,適合作為Agent入門橋樑——Spark能處理複雜多步驟任務(如根據使用者喜好自動規劃行程、發現特定興趣活動),但也受上下文限制影響(生成內容量可能較少),且需要Google AI Ultra訂閱,價格較高,建議普通使用者等待Pro層級支援。

實用技巧與重點

乾貨
  • 可用性與價格:
  • 現已在香港、臺灣等亞太地區開通
  • 需Google AI Ultra訂閱(非免費)
  • 預計將開放給Google AI Pro使用者
  • 核心自動化應用:
  • 每日上午9點:掃描trusted科技網站,更新"Everyday News"文件(已成功追蹤4-5條新聞)
  • 每日下午12點、4點:推送美股、港股、韓國股市分析(準時執行)
  • 每週五上午:搜尋本地活動,如CowA展覽、Hong Kong Food Festival、李笑芝巡演
  • 支出追蹤:掃描Gmail收據,自動更新月度支出表格(延遲可能數小時)
  • 行程規劃:自動識別機票/酒店預訂日期,推薦當地活動和景點
  • 與其他Agent對比:
  • | 對比項 | Gemini Spark | OpenAI Call/Hermes Agent |
  • |------|-------------|------------------------|
  • | 配置難度 | 開箱即用 | 需配置API、部署程式碼 |
  • | 生態整合 | Google Workspace原生深度融合 | 需手動連線第三方API |
  • | 學習門檻 | 零技術基礎可用 | 需開發基礎 |
  • | 靈活性 | 侷限於Google生態 | 高度自定義 |
  • 實測資料:
  • 新聞追蹤:每日更新中英文多來源新聞
  • 股票報告:100%準時推送(上午9點、中午12點、下午4點)
  • 本地活動識別準確,可提供連結和活動描述
  • 行程自動同步:使用者手動修改日期後,Spark在Google Sheet中自動檢測並更新
  • 事件觸發延遲:郵件監聽最多延遲10小時(講者凌晨購票,上午8:01分識別)
  • 支援的輸出格式:Google Document(段落式)、Google Sheet(表格式)、PDF(快照式)

結論

結論

Gemini Spark是AI Agent領域一個優秀的"入門橋樑",用零程式設計知識即可體驗自動化工作流,但智慧水平有限且價格較高,最佳時機應該是等待Google AI Pro支援。

完整解析

詳細

Google Gemini Spark是Google於今年5月Google I/O大會發布的新產品,近日在香港等亞太地區正式開通。講者Vincent作為Gadget Gang科技頻道創辦人,用兩天時間深度體驗了這款服務。從本質上看,Spark與傳統ChatBot有根本區別:ChatBot是被動響應式的(你問我答),而Spark是主動代理式的(你設目標,它自動執行)。

與開源的AI Agent框架相比,Spark的最大優勢是"開箱即用"。OpenAI Call或Hermes等框架雖然功能強大,但需要開發者手動配置LLM API、編寫程式碼、部署服務、連線各類第三方應用——這就像買電腦主機板後還要自己裝CPU、裝記憶體。而Spark則是Google預裝好的完整電腦,拿來即用,省去了大量的配置煩惱。當然代價是靈活性會有限制,主要侷限在Google Workspace生態內。

Spark最令人驚豔的是與Google服務的深度融合。講者建立的科技新聞追蹤系統,每天上午9點會自動訪問預設的trusted網站,並持續更新"Everyday News"文件。股票監控則在中午和下午各推送一次美股、港股、韓國股市的分析,甚至提示Microsoft的買入機會。這些定時任務的執行精準度達到100%。更高階的是事件觸發功能——講者設定"收到郵件收據時自動更新支出表",系統雖然存在數小時的延遲,但最終確實能檢測並同步新增的酒店預訂。

最複雜的應用場景是日本旅程規劃。講者只需告訴Spark"我8月8日和17日去東京和札幌",系統就自動識別了行程框架。當講者提及喜歡動漫時,Spark立即在搜尋中加入了Eva第三新東京市展示(一個與新世界廣場合作的沉浸式展覽)和Comic Market 1008(全球最大的同人誌展銷會)。更強大的是,Spark能跨Google Document、Sheet、PDF三種格式無縫同步內容——使用者在Document中手動改動日期,Sheet和PDF中的對應資料會自動更新。這種多文件協作能力幾乎是開源Agent無法實現的。

不過Spark也有明顯侷限。講者發現其智慧水平與標準Gemini大模型相當,會受上下文視窗的約束——當要求生成日文N3學習材料時,生成的詞彙表只有25個詞。郵件觸發的自動化也不如時間觸發穩定。更現實的問題是價格,目前僅Google AI Ultra使用者可用,這在香港並不便宜。講者建議等Spark開放到更便宜的Google AI Pro層級後,再根據個人需求判斷是否值得訂閱。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing
編輯精選
83 min
AI 技術英文PODCAST8月26日

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing

Latent Space

  • 加速傳統物理模擬的典範轉移:氣象科學家原本認為 AI 無法匹敵數十年的物理建模工作,但傅里葉神經算子不僅達到同等精度,還快了一萬多倍。原本需要超級計算機的計算現在用消費級 GPU 就能完成,這改變了整個領域的思維方式。
  • 傅里葉域的非局部現象捕捉:傅里葉域能有效表示非局部現象(如大氣河流跨越千里的影響),且計算複雜度為準線性,遠優於完全連接的全局模型。這特別適合流體動力學、量子化學等自然現象中普遍存在的非局部相互作用。
  • 多解析度連續函數表示:神經算子將輸入輸出視為連續函數而非固定維度向量,可在推論時以任意解析度查詢,並能在更高解析度上疊加物理約束或額外數據,克服了固定解析度神經網路的限制。
Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Why the Next AI Breakthrough May Come from Physics with Max Welling - #774
55 min
AI 技術英文PODCAST8月25日

Why the Next AI Breakthrough May Come from Physics with Max Welling - #774

TWIML AI

  • 多層篩選的材料設計流程:先搜尋文獻資料庫找現有材料,若無合適的就用生成模型產生數十萬個候選分子,用機器學習力場進行分子動力學模擬篩選,再進行實驗驗證。這套流程相比傳統量子力學計算能加速效率數個數量級。
  • 生成AI與熱力學的數學等價性:資訊論是兩個領域的共同基礎,生成模型的擴散過程與非平衡統計力學描述資訊損失的過程在數學上完全對應,許多開發出來的方法工具在兩領域都有精確對應的形式。
  • 基礎模型的遷移學習策略:先在廣泛材料資料集上訓練基礎力場表示,再針對特定材料類別進行蒸餾微調,既能保持計算效率也能獲得專一性。