KeyFrame內部研究專用

Model Context Protocol (MCP) explained for beginners

Google Cloud Tech·6月24日週三·7 min英文

三句話摘要

Model Context Protocol(MCP)是開放標準協議,為AI模型與工具/資料的交互提供統一的結構化語言。 MCP將成為AI開發的基礎設施,如同HTTP之於網際網路,統一模型與工具的互動方式,開發者現在應開始學習並採用。 解決AI開發痛點:傳統API設計給確定性程式,模型需要探索與推理的不確定環境。MCP提供結構化方式讓模型安全且可靠地使用外部資源,無需事先硬編碼每個API實現細節。

重點整理

重點
  • 1

    解決AI開發痛點:傳統API設計給確定性程式,模型需要探索與推理的不確定環境。MCP提供結構化方式讓模型安全且可靠地使用外部資源,無需事先硬編碼每個API實現細節。

  • 2

    統一的Client-Server架構:Client是語言模型或代理系統,Server是資料庫、檔案系統或內部工具。Server主動廣告其功能與資源,Client動態發現而非預先編程,通過結構化JSON schema溝通。

  • 3

    四層資源模型:Tools(可調用的動作)、Resources(資料與狀態)、Prompts(可重用行為模板)、Context(外部資訊)共同形成模型的視野。每個資源都帶有元數據,描述其功能、所需輸入、預期輸出。

  • 4

    抽象層設計:MCP是API之上的抽象層。MCP Server底層仍可呼叫REST或GraphQL API,但模型只與結構化MCP schema互動。這讓系統無需客製化整合即可暴露給任何符合規範的模型。

實用技巧與重點

乾貨
  • 四種資源類型:Tools、Resources、Prompts、Context
  • 通訊方式:結構化JSON schema
  • 兩端角色:Client(語言模型/代理系統,如Claude、Gemini)、Server(資料庫、檔案系統、內部工具、文件搜引擎)
  • 實際例子流程:個人助理代理 → 日曆server、筆記server、郵件server → 模型自動看到可用tools(列出事件、取得會議摘要、發送郵件)
  • 舊方式:Google Calendar API + Notion API + Gmail API + 多重客製代碼 + 複雜系統提示
  • 新方式:安裝對應MCP servers → 模型自動發現 → 推理使用順序與資料流

結論

結論

MCP將成為AI開發的基礎設施,如同HTTP之於網際網路,統一模型與工具的互動方式,開發者現在應開始學習並採用。

完整解析

詳細

模型與工具的整合向來是AI開發的痛點所在。傳統API設計給人類編寫的程式,這些程式通常知道自己確切需要什麼,能發出精確且確定的請求。但語言模型工作邏輯截然不同——它機率性地生成文本,面對不確定的輸入時需要推理、提問與探索,往往不知道該做什麼。這場不匹配催生了Model Context Protocol。

MCP的核心想法很簡潔:定義Client和Server兩方的通訊方式。Client通常是語言模型或代理系統(如Claude、Gemini),Server是暴露資源的環境(資料庫、檔案系統、公司內部工具)。當Client連接到Server時,Server不只被動回應資料,而是主動廣告自己的能力——能做什麼、有什麼資源、需要什麼輸入。這樣模型就能動態發現這些資源,無需開發者事先硬編碼每個API或endpoint。兩方之間的溝通透過簡單且明確的schema進行,Client發送「列出可用資源」、「執行此動作」、「擷取此資料」的請求,Server以結構化JSON回應。

MCP的設計將資源分為四層:Tools是模型可調用的動作(例如搜尋資料庫、發送郵件、分析檔案),Resources是資料與狀態(文檔、資料庫行、圖片),Prompts是可重用的行為模板,Context是外部資訊(聊天紀錄、公司資料、使用者偏好)。每個資源都附帶元數據描述其功能與預期輸入輸出,這使得模型能夠智慧地互動。關鍵在於協議跨所有工具強制一致的schema——無論模型使用GitHub server、CRM server或行事曆server,它說的都是同一種語言。

既然已有API,為何還需MCP?答案在於消費者的身分。API為人類編寫的程式設計,MCP為進行類人推理的模型設計。你可以把MCP看作API之上的抽象層。底層的MCP server可能仍在呼叫現有的REST或GraphQL API,但模型永遠看不見。它只透過結構化MCP schema互動,由協議統一處理發現、驗證與執行。這就是MCP的力量所在。

以實際應用為例,假設你要建一個個人助理代理,能檢查日曆、拉取會議記錄、起草追蹤郵件。舊方式得整合Google Calendar、Notion、Gmail API,為每個服務寫程式碼、處理認證與速率限制,教模型如何透過冗長脆弱的系統提示使用這些endpoint。新方式只需為各系統建立或安裝MCP server——日曆server、筆記server、郵件server。每個server廣告自己的功能,模型自動看到可用工具如「列出事件」、「取得會議摘要」、「發送郵件」,可推理使用順序與資料流。開發者無需為每個新工具寫膠水代碼,因為協議本身就確保一致性。

這場轉變已在進行。如同HTTP統一了網際網路,MCP正開始統一模型與工具的通訊方式。對開發者而言,現在學習MCP至關重要,因為在不久的將來,每個認真的AI開發者都需要知道如何讓自己的系統MCP-aware。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Everything Goldman Sachs Taught Me About AI (In 10 minutes)
AI 技術英文8月24日

Everything Goldman Sachs Taught Me About AI (In 10 minutes)

Nate Herk

  • 驗證優於相信:看起來完整的AI輸出不等於正確答案,需在提示中要求模型重新檢查數字、引用來源,並對無把握的部分標記。
  • 區分AI與自動化:確定步驟且答案已知的任務用傳統自動化更便宜快速;只在需要判斷力、靈活性或處理複雜資訊時才用AI,兩者結合效果最佳。
  • 以問題驅動選型:先寫清楚「要解決的問題是什麼、成功的樣子是什麼」,再決定用什麼工具,許多失敗項目是從技術而非問題出發。
Mu: a self-hosted personal agent where the interface is an email address you can write to
AI 技術英文8月23日

Mu: a self-hosted personal agent where the interface is an email address you can write to

GitHub Awesome

  • Mu 是自主代理人系統,具有實際網址與獨立伺服器,用戶可透過多種方式與其互動——網頁應用、電子郵件或程式化介面。
  • 架構完整覆蓋日常工作流程的多個層面,整合郵件收發(SMTP/IMAP)、檔案管理、行事曆、新聞聚合、市場數據與搜尋功能於一個 Go 伺服器內。
  • 支援自帶模型與多種通訊協定,用戶可選擇不同的 AI 模型,並透過 MCP、HTTP API 或命令列工具整合到其他系統。