KeyFrame內部研究專用

WWDC 2026: Did Apple Do Enough With Siri AI?

The Technologists·6月17日週三·19 min中文

三句話摘要

Apple 在 WWDC 26 重新推出 Apple Intelligence,以 Google Gemini 為前端、搭配本地基礎模型,試圖讓 Siri 真正實用化。 Apple 用 Gemini 換來了「必須成功」的保險,但真正的勝負將取決於能否在兩三年內把知識圖譜型個人助理落地,並在本地端運算成熟後收回主導權。 Apple 選擇 Gemini 是務實而非理想解:蘋果偏好垂直整合,但此次引入 Gemini 是承認內部模型尚未成熟,寧可借力外部可靠方案也不能讓 Siri 再次失敗,這是一次以「能用、穩定」為優先的策略選擇。

重點整理

重點
  • 1

    Apple 選擇 Gemini 是務實而非理想解:蘋果偏好垂直整合,但此次引入 Gemini 是承認內部模型尚未成熟,寧可借力外部可靠方案也不能讓 Siri 再次失敗,這是一次以「能用、穩定」為優先的策略選擇。

  • 2

    隱私架構是核心差異化:所有 AI 請求必須通過 Apple 自建的私有通道(Private Cloud Compute),確保用戶資料不外洩,但也因此帶來數秒延遲;分析師認為只要延遲不過長,用戶可以接受。

  • 3

    Siri 能深度操作 Apple 原生功能,是其競爭優勢:相較於 Gemini 獨立 App 無法跨應用操控手機,新版 Siri 可直接存取訊息、文件、語音信箱,並串接所有 Apple 原生 App,打造「知識圖譜」型個人助理。

  • 4

    綁定 Gemini 的長期風險被點名:DeepSeek、OpenClaw 等新模型快速崛起,AI 模型每代提升 10 倍效能、以 30 倍以上效率縮小,單押一家供應商存在策略風險;分析師預期未來隨本地運算能力增強,Apple 將逐步收回主導權。

實用技巧與重點

乾貨
  • 合作模型:Google Gemini(前端)+ Apple 本地基礎模型(後端)
  • 隱私機制:Apple Private Cloud Compute,所有請求過蘋果伺服器才出雲端
  • 延遲:示範中顯示數秒(seconds of latency),分析師認為可接受
  • Siri 定位:官方仍稱「Assistant(助理)」,非「Agent(代理人)」
  • 競品比較:Gemini 獨立 App 無法跨 App 操控手機;Siri 可操控所有 Apple 原生功能
  • iOS 27 開發者版本:已含支援更大螢幕的程式碼,暗示折疊 iPhone
  • 折疊機螢幕供應商預測:Samsung(供應鏈難隱藏)
  • 預估時間點:折疊 iPhone 可能於 2026 年假日購物季前後發表,售價約 $2,000
  • AI 效能趨勢:模型每代縮小 10 倍、雲端模型每代提升 30 倍以上
  • 近期重要活動:Advancing AI with AMD(七月)、Hot Chips、Snapdragon Summit

結論

結論

Apple 用 Gemini 換來了「必須成功」的保險,但真正的勝負將取決於能否在兩三年內把知識圖譜型個人助理落地,並在本地端運算成熟後收回主導權。

完整解析

詳細

Apple 在 WWDC 26 的核心任務只有一件事:讓 Siri 重新站起來。兩年前 Apple 承諾 AI 將全面進入 iOS,去年的 WWDC 卻以公開道歉收場,坦承未能兌現。這次帶著 Google Gemini 的加持再度出場,外界自然以更嚴格的眼光審視。本集 Tech Stack podcast 邀集三位分析師——Mark Vena(Smartech Research)、Jim Riggall 與 Mark Giuppert(Ardent Tech)——從架構設計、競爭策略與長期風險三個維度深入拆解這場發布會。

新版 Apple Intelligence 的架構可分為三層:Google Gemini 扮演前端介面,負責自然語言理解與使用者互動;Apple 自研基礎模型部署於裝置端,負責個人化與隱私敏感任務;Apple 則控制本地與雲端之間的切換邏輯,確保資料先通過其私有通道(Private Cloud Compute)再上雲端。這個設計的代價是數秒延遲,但分析師普遍認為,只要延遲不超過用戶心理閾值,且整體體驗夠自然流暢,這個取捨是可接受的。蘋果在發布示範中刻意呈現了完整的回應秒數,顯示他們不想藉剪輯掩飾現實,此舉被視為誠意的表現。

Siri 此次最具競爭力的地方,在於它能深度串接所有 Apple 原生 App,包括訊息、文件、語音信箱,而非只是在 App 上層浮動的對話框。相較之下,Gemini 獨立 App 即便是 Google 自家 App 也無法跨應用操控,Siri 的深度整合優勢在此凸顯。分析師以一個生動比喻說明潛力:如果配偶早上傳訊說要買某口味冰淇淋,Siri 不只能在稍後提醒你,還能根據 GPS 找到最近的商店,甚至即時查詢該門市是否有庫存——這種「知識圖譜型個人助理」的想像空間,才是 Apple 這次真正押注的長期賽道。

然而,單押 Gemini 的長期風險也被點名。Jim 指出,DeepSeek、OpenClaw 等新模型快速崛起,AI 能力每代以 10 倍以上的幅度躍進,單一供應商綁定在技術快速演進的環境下存在策略脆弱性。對此,Mark Vena 的回應頗具洞見:Apple 選擇 Gemini 並非不知道這個風險,而是在當前時間點「不能再失敗」的壓力下,選擇了一個可靠的大廠而非靈活但不穩定的策略。他預期隨著裝置端算力持續增強,未來兩三年內,更多 AI 工作負載將轉移至本地運算,屆時 Apple 很可能逐步減少對 Gemini 的依賴,收回主導權。另一個值得關注的細節是:蘋果官方在所有說明中仍將 Siri 定位為「Assistant(助理)」,而非「Agent(代理人)」,顯示他們刻意管控期望值,避免再次過度承諾。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing
編輯精選
83 min
AI 技術英文PODCAST8月26日

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing

Latent Space

  • 加速傳統物理模擬的典範轉移:氣象科學家原本認為 AI 無法匹敵數十年的物理建模工作,但傅里葉神經算子不僅達到同等精度,還快了一萬多倍。原本需要超級計算機的計算現在用消費級 GPU 就能完成,這改變了整個領域的思維方式。
  • 傅里葉域的非局部現象捕捉:傅里葉域能有效表示非局部現象(如大氣河流跨越千里的影響),且計算複雜度為準線性,遠優於完全連接的全局模型。這特別適合流體動力學、量子化學等自然現象中普遍存在的非局部相互作用。
  • 多解析度連續函數表示:神經算子將輸入輸出視為連續函數而非固定維度向量,可在推論時以任意解析度查詢,並能在更高解析度上疊加物理約束或額外數據,克服了固定解析度神經網路的限制。
Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Why the Next AI Breakthrough May Come from Physics with Max Welling - #774
55 min
AI 技術英文PODCAST8月25日

Why the Next AI Breakthrough May Come from Physics with Max Welling - #774

TWIML AI

  • 多層篩選的材料設計流程:先搜尋文獻資料庫找現有材料,若無合適的就用生成模型產生數十萬個候選分子,用機器學習力場進行分子動力學模擬篩選,再進行實驗驗證。這套流程相比傳統量子力學計算能加速效率數個數量級。
  • 生成AI與熱力學的數學等價性:資訊論是兩個領域的共同基礎,生成模型的擴散過程與非平衡統計力學描述資訊損失的過程在數學上完全對應,許多開發出來的方法工具在兩領域都有精確對應的形式。
  • 基礎模型的遷移學習策略:先在廣泛材料資料集上訓練基礎力場表示,再針對特定材料類別進行蒸餾微調,既能保持計算效率也能獲得專一性。