KeyFrame內部研究專用

Everything Google AI This Week: 4 Agent Standards, Antigravity CLI, Kaggle, AMIE

AI with Surya·6月20日週六·13 min英文

三句話摘要

Google AI 本週集中推出四大開放標準更新(A2A、MCP×A2UI 架構模式、ARD、OKF),並同步涵蓋 Gemini CLI 遷移、醫療 AI 突破及 DeepMind 真實落地案例。 --- Google 本週以四項開放標準集中落地,正在系統性地構建多 Agent 協作的基礎設施,是所有 Agentic AI 開發者不可忽視的架構基準。 Google 在同一週密集釋出四項開放標準(A2A、架構模式、ARD、OKF),並與超過 150 個合作夥伴共同推進,顯示 Google 正在系統性地主導 AI Agent 互聯基礎設施的標準制定。

重點整理

重點
  • 1

    Google 在同一週密集釋出四項開放標準(A2A、架構模式、ARD、OKF),並與超過 150 個合作夥伴共同推進,顯示 Google 正在系統性地主導 AI Agent 互聯基礎設施的標準制定。

  • 2

    三種 MCP × A2UI 架構模式解決了 Agentic App 開發者的核心選擇困境——MCP 負責工具呼叫、A2UI 負責用戶介面互動,兩者原本服務不同層次,三種模式讓開發者可以按需混合使用,無需非此即彼。

  • 3

    AMIE 醫療 AI 在疾病管理計劃制定與詳細程度上超越 21 位真實醫生,成果發表於《Nature》,是醫療 AI 能力邊界的重要里程碑,但目前仍屬研究性質,非公開產品。

  • 4

    DeepMind 與英國政府合作的住宅規劃 AI 工具取得 50% 效率提升,是 AI 從實驗室落地真實基礎設施建設的具體驗證案例,具有政策與產業參考價值。

  • 5

    --

實用技巧與重點

乾貨
  • A2A 協議
  • 2025 年 6 月 18 日滿一週年,已捐贈至 Linux 基金會
  • 150+ 組織已投入生產使用
  • foldrun:A2A 在生物科學的實際應用(多專業 Agent 協作預測組織成分)
  • 三種 MCP × A2UI 架構模式
  • 透過 MCP 服務提供 A2UI:MCP 直接返回 UI 元件(範例:食譜卡介面,可選烹飪風格並獲得卡片回傳)
  • 在 A2UI 中運行 MCP 服務:元素由 MCP 控制、規則由 A2UI 掌管(範例:Pong 遊戲,球與板在 MCP,遊戲規則在 A2UI)
  • 在 MCP 服務中運行 A2UI:已有 MCP 服務直接嵌入 UI(範例:文件編輯器,點擊取得詳細回應)
  • ARD(Agentic Resource Discovery)
  • 讓 Agent 主動發現並匹配工具與資源的機制
  • 10 個業務合作夥伴共同發布
  • OKF(Open Knowledge Framework)
  • 解決跨知識庫資源存取的開放框架
  • ARD 的知識層補充
  • Gemini CLI
  • 停止個人帳號獨立版本,完成整合遷移
  • 自動複製:MCP 配置、記憶能力、工具設定、工作流程
  • Kaggle 5-Day Gen AI Intensive
  • 免費課程,共 5 份白皮書
  • 涵蓋主題:Gen AI 開發生命週期、Agentic 工程、資料工程、部署與生產測試
  • 白皮書核心論點:生產環境中 Verification、Security、Architectural Judgment 是新的核心挑戰
  • AMIE 醫療模型
  • 與 21 位醫生在疾病管理計劃制定上進行比較測試
  • 在計劃詳細性與覆蓋度上超越醫生
  • 發表於《Nature》;研究用途,非公開產品
  • DeepMind × 英國政府
  • 目標:協助地方醫院加速住宅規劃決策
  • 成果:規劃時間縮短 50%
  • Google Earth 飛行模式
  • 網址:earth.google.com
  • 免安裝、免下載,純網頁版
  • 操作:選城市或地標 → 點選飛行模式 → 用滑鼠或觸控板控制飛行
  • --

結論

結論

Google 本週以四項開放標準集中落地,正在系統性地構建多 Agent 協作的基礎設施,是所有 Agentic AI 開發者不可忽視的架構基準。

完整解析

詳細

這週 Google AI 生態圈異常熱鬧,核心焦點集中在四項開放標準的集中推出。首先,A2A(Agent-to-Agent Protocol)在 6 月 18 日迎來一週年——這個讓不同公司 AI Agent 互相通訊的協議由 Google 創立後即捐贈給 Linux 基金會,目前已有超過 150 個組織投入生產環境使用。Google 同時展示了名為 foldrun 的真實應用範例,說明科學家如何透過 A2A 讓多個專業 Agent 協作完成生物科學中的組織成分預測任務,充分說明 A2A 在複雜多 Agent 場景下的實用性。

第二項更新聚焦在 MCP 與 A2UI 的架構整合。MCP 負責提供 Agent 呼叫的工具,A2UI 則處理 Agent 與用戶介面的互動,兩者本來服務不同層次的需求。Google 這次提出三種混合架構模式:第一種讓 MCP 服務直接回傳 UI 元件(如食譜卡),前端框架不論是 React、Flutter 還是 Angular 均可自行渲染;第二種是將 MCP 服務嵌入 A2UI 中運行,以 Pong 遊戲為例,遊戲元素由 MCP 提供、遊戲規則由 A2UI 掌控,兩者相互連接;第三種則是在 MCP 服務中直接嵌入 A2UI,適合已有 MCP 後端但需要添加 UI 的情境,以文件編輯器為範例。這三種模式讓開發者在建構 Agentic 應用時不再需要被迫在 UI 層與邏輯層之間做非此即彼的取捨。

同週,Google 還推出 ARD(Agentic Resource Discovery,代理資源探索)與 OKF(Open Knowledge Framework,開放知識框架)。ARD 解決的問題是:當系統擁有大量工具與資源時,Agent 如何主動發現並匹配最合適的資源,這在小規模系統不明顯,但在生產環境工具數量龐大時至關重要;OKF 則進一步解決跨知識庫的資源存取問題,是 ARD 的知識層補充。這四項標準合在一起,代表 Google 正在系統性地搭建多 Agent 協作的基礎設施生態,且均以開放協議形式推進,並有多家重要合作夥伴共同背書。

在產品面,Gemini CLI 完成整合遷移,停止獨立個人帳號服務,原有用戶的 MCP 配置、記憶能力與工具設定均會自動保留。Kaggle 5 天生成式 AI 密集課程同期結束,釋出 5 份免費白皮書,其中明確指出 Generative AI 進入生產部署後,驗證(Verification)、安全性(Security)與架構判斷(Architectural Judgment)已成為最新的核心挑戰,具有實際工程參考價值。醫療領域方面,Google 的 AMIE 模型在疾病管理計劃的制定詳細度上超越了 21 位受測醫生,研究成果發表於《Nature》,雖然目前仍屬純研究性質不對外開放,但代表醫療 AI 的能力正在突破新基準。最後,DeepMind 宣布與英國政府合作開發 AI 工具協助地方醫院加速住宅規劃決策,初步成果顯示規劃時間縮短 50%,是 AI 落地真實基礎設施建設的具體佐證。影片末尾,講者順帶示範了 Google Earth 新推出的免安裝網頁版飛行模式,用戶在 earth.google.com 選擇任意城市或地標即可自由飛行,作為這忙碌一週的輕鬆收尾。

---

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing
編輯精選
83 min
AI 技術英文PODCAST8月26日

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing

Latent Space

  • 加速傳統物理模擬的典範轉移:氣象科學家原本認為 AI 無法匹敵數十年的物理建模工作,但傅里葉神經算子不僅達到同等精度,還快了一萬多倍。原本需要超級計算機的計算現在用消費級 GPU 就能完成,這改變了整個領域的思維方式。
  • 傅里葉域的非局部現象捕捉:傅里葉域能有效表示非局部現象(如大氣河流跨越千里的影響),且計算複雜度為準線性,遠優於完全連接的全局模型。這特別適合流體動力學、量子化學等自然現象中普遍存在的非局部相互作用。
  • 多解析度連續函數表示:神經算子將輸入輸出視為連續函數而非固定維度向量,可在推論時以任意解析度查詢,並能在更高解析度上疊加物理約束或額外數據,克服了固定解析度神經網路的限制。
Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Why the Next AI Breakthrough May Come from Physics with Max Welling - #774
55 min
AI 技術英文PODCAST8月25日

Why the Next AI Breakthrough May Come from Physics with Max Welling - #774

TWIML AI

  • 多層篩選的材料設計流程:先搜尋文獻資料庫找現有材料,若無合適的就用生成模型產生數十萬個候選分子,用機器學習力場進行分子動力學模擬篩選,再進行實驗驗證。這套流程相比傳統量子力學計算能加速效率數個數量級。
  • 生成AI與熱力學的數學等價性:資訊論是兩個領域的共同基礎,生成模型的擴散過程與非平衡統計力學描述資訊損失的過程在數學上完全對應,許多開發出來的方法工具在兩領域都有精確對應的形式。
  • 基礎模型的遷移學習策略:先在廣泛材料資料集上訓練基礎力場表示,再針對特定材料類別進行蒸餾微調,既能保持計算效率也能獲得專一性。