KeyFrame內部研究專用

Spring AI + X's New MCP Servers

Dan Vega·7月1日週三·24 min英文

三句話摘要

X 推出 MCP 伺服器,開發者可用 Spring AI 建立客戶端直接整合 X API 文檔和搜尋功能。 MCP 伺服器讓 AI 模型能存取實時資訊並自動選擇合適工具,Spring AI 的優雅整合使得開發者能輕鬆在應用中使用這些能力,是構建真正智慧 AI 代理的關鍵基礎。 上下文工程勝過提示工程:MCP 協議解決 LLM 的知識過時問題,讓模型能存取最新的 API 文檔和即時資料,確保回答的正確性和相關性。

重點整理

重點
  • 1

    上下文工程勝過提示工程:MCP 協議解決 LLM 的知識過時問題,讓模型能存取最新的 API 文檔和即時資料,確保回答的正確性和相關性。

  • 2

    X 的雙伺服器設計:文檔伺服器用於查詢 API 文檔(無認證需求),API 伺服器用於調用實際端點(需 Bearer Token 認證)。兩者配合讓模型既能查閱文檔又能執行操作。

  • 3

    模型自動工具選擇:Spring AI 透過 ToolCallbackProvider 將 MCP 工具暴露給模型,模型根據問題描述自動判斷需要哪個工具並調用,開發者無需手動路由。

  • 4

    簡化的整合開發:只需在 YAML 定義伺服器連接、建立 ChatClient Bean、在控制器注入使用即可,無複雜配置。

實用技巧與重點

乾貨
  • 技術棧:
  • Spring Boot 4.1.0、Spring AI 2.0、JDK 26(最低要求 JDK 17)
  • LLM 選擇:Anthropic Claude Opus 4.8(可切換任何 Spring AI 支援的模型)
  • MCP 伺服器配置:
  • 文檔伺服器 URL:`docs.x.com`
  • API 伺服器 URL:`api.x.com`(Spring AI 自動補 `/mcp` 路徑)
  • 伺服器類型:`streamable-http`(遠端端點)
  • 認證方式:
  • 文檔伺服器:無認證
  • API 伺服器:X Bearer Token(放在 Authorization Header)
  • Spring AI 配置項:
  • `spring.ai.mcp.enabled=true`
  • 日誌級別:
  • `dev.danvega`: info
  • `org.springframework.ai`: info
  • `org.springframework.ai.model.tool.DefaultToolCallManager`: debug(查看工具調用)
  • 環境變數:
  • `ANTHROPIC_API_KEY`:Anthropic API 密鑰
  • `X_BEARER_TOKEN`:X 開發者控制台申請的 Bearer Token
  • 核心類與概念:
  • `ChatClient`:與 LLM 通訊的抽象介面
  • `ToolCallbackProvider`:提供 MCP 伺服器暴露的工具
  • `MCP ClientCustomizer` Bean:為特定主機添加認證頭

結論

結論

MCP 伺服器讓 AI 模型能存取實時資訊並自動選擇合適工具,Spring AI 的優雅整合使得開發者能輕鬆在應用中使用這些能力,是構建真正智慧 AI 代理的關鍵基礎。

完整解析

詳細

X 最近推出了 MCP 伺服器,這是一個重要的開發工具。MCP(Model Context Protocol)協議的核心價值在於解決大型語言模型的知識過時問題。傳統方式下,模型依賴訓練資料或網路搜尋,容易給出過時或錯誤的資訊。而 MCP 伺服器讓模型能存取實時、準確的資訊來源。講者強調,開發方式已經從「提示工程」進化到「上下文工程」——即提供儘可能多的相關上下文給模型,而不是靠精心設計的提示詞。

X 推出的兩個 MCP 伺服器各司其職。第一個是文檔伺服器,它讓模型能搜尋並讀取 X API 的最新官方文檔,無需任何認證。第二個是 API 伺服器,它允許模型直接調用 X 的 API 端點,執行搜尋貼文、查詢用戶、檢視書籤、查看趨勢等任務,但需要用 Bearer Token 認證。

在技術實現方面,講者使用 Spring Boot 4.1 和 Spring AI 2.0 構建一個 MCP 客戶端。首先在 Spring 初始化器配置專案,選擇 Spring Web、Model Context Protocol Client 依賴以及 Anthropic 作為 LLM 提供商。Spring AI 的優勢在於對 LLM 提供商進行了抽象,切換模型提供商時程式碼無需改動。

配置階段需要在 application.yaml 中定義 MCP 伺服器。文檔伺服器配置簡單,只需提供 URL。API 伺服器則需在配置中指定 Bearer Token,並透過建立 MCP ClientCustomizer Bean 來為發往 api.x.com 的請求自動附加 Authorization 頭。這種方式既保護了密鑰,也保證了認證的安全性。

講者展示了兩個實際例子。第一個控制器查詢文檔伺服器:用戶向應用提問「如何透過 X API 查詢用戶粉絲數」,ChatClient 自動調用 MCP 文檔伺服器的搜尋工具,模型解析結果後回傳端點和查詢參數。第二個控制器使用 API 伺服器:當詢問「最近有哪些關於 Spring Boot 4.1 的討論」時,模型自動選擇 `search_posts` 工具,調用 X 的真實 API 取得即時結果,然後總結當前社群討論的主題和要點。

整個流程的妙處在於模型的自主性。開發者無需在代碼中硬編碼工具調用邏輯,模型會根據工具的名稱和描述自動判斷何時使用哪個工具。透過將日誌級別設為 DEBUG,開發者可以看見完整的工具調用流程,驗證模型的決策過程。這種設計徹底解放了開發者,讓他們能專注於商業邏輯,而不是工具整合細節。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing
編輯精選
83 min
AI 技術英文PODCAST8月26日

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing

Latent Space

  • 加速傳統物理模擬的典範轉移:氣象科學家原本認為 AI 無法匹敵數十年的物理建模工作,但傅里葉神經算子不僅達到同等精度,還快了一萬多倍。原本需要超級計算機的計算現在用消費級 GPU 就能完成,這改變了整個領域的思維方式。
  • 傅里葉域的非局部現象捕捉:傅里葉域能有效表示非局部現象(如大氣河流跨越千里的影響),且計算複雜度為準線性,遠優於完全連接的全局模型。這特別適合流體動力學、量子化學等自然現象中普遍存在的非局部相互作用。
  • 多解析度連續函數表示:神經算子將輸入輸出視為連續函數而非固定維度向量,可在推論時以任意解析度查詢,並能在更高解析度上疊加物理約束或額外數據,克服了固定解析度神經網路的限制。
Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Why the Next AI Breakthrough May Come from Physics with Max Welling - #774
55 min
AI 技術英文PODCAST8月25日

Why the Next AI Breakthrough May Come from Physics with Max Welling - #774

TWIML AI

  • 多層篩選的材料設計流程:先搜尋文獻資料庫找現有材料,若無合適的就用生成模型產生數十萬個候選分子,用機器學習力場進行分子動力學模擬篩選,再進行實驗驗證。這套流程相比傳統量子力學計算能加速效率數個數量級。
  • 生成AI與熱力學的數學等價性:資訊論是兩個領域的共同基礎,生成模型的擴散過程與非平衡統計力學描述資訊損失的過程在數學上完全對應,許多開發出來的方法工具在兩領域都有精確對應的形式。
  • 基礎模型的遷移學習策略:先在廣泛材料資料集上訓練基礎力場表示,再針對特定材料類別進行蒸餾微調,既能保持計算效率也能獲得專一性。