KeyFrame內部研究專用

I Made an AI Agent That Reverses CVEs While I Sleep

NahamSec·7月6日週一·16 min英文

三句話摘要

使用 Claude Code 和 Zapier MCP 構建自動化 CVE 逆向工程系統,每日自動從補丁中識別漏洞、生成 PoC 和 Nuclei 模板。 透過 Claude Code 和 Zapier MCP 的結合,一個人可以用自動化工廠的方式每日處理數十個 CVE,把漏洞逆向工程從手工活變成流水線生產,大幅降低安全研究的門檻。 補丁逆向比漏洞發現更易行:每天數百個 CVE 公開發佈,補丁也同時開源。比起從零發現漏洞,直接閱讀補丁的改動就能理解漏洞、寫出 PoC,門檻遠低。

重點整理

重點
  • 1

    補丁逆向比漏洞發現更易行:每天數百個 CVE 公開發佈,補丁也同時開源。比起從零發現漏洞,直接閱讀補丁的改動就能理解漏洞、寫出 PoC,門檻遠低。

  • 2

    架構設計:腦與手的分工:Claude Code 負責邏輯推理和漏洞分析,Zapier MCP 則作為執行層,連接 GitHub(存儲 PoC)、Google Sheets(備份數據)等服務,無需複雜程式碼即可整合。

  • 3

    完整自動化流程:從 Patch Stack 資料庫拉取 WordPress 高危 CVE(CVSS ≥6)→ 下載漏洞版本和修復版本 → diff 對比找出改動 → 識別漏洞原因 → 生成可執行 PoC → 建立 Nuclei 掃描模板 → 全部提交到 GitHub。

  • 4

    可規模化的監控能力:不限於 WordPress,可擴展到 Drupal、其他開源軟體;並可透過 Discord webhook 實時通知新漏洞,形成持續的漏洞監控和逆向工廠。

實用技巧與重點

乾貨
  • 工具與平台:
  • Claude Code(自動化引擎)
  • Zapier MCP(連接器)
  • Patch Stack(漏洞資料庫,patch-db.com)
  • GitHub API(儲存與版本控制)
  • Google Sheets(數據備份)
  • Nuclei(漏洞掃描模板)
  • Patch Stack 篩選條件:
  • 平台:WordPress 外掛
  • 嚴重程度:CVSS 6-10
  • 排除:管理員專用漏洞
  • 生成的文件結構:
  • `README.md`:漏洞基本資訊、Patch Stack 連結、可信度
  • `report.md`:詳細的漏洞分析、受影響代碼、修復方案
  • `poc.md`:可執行的 PoC(含 HTTP 方法、端點、必要參數、curl 命令)
  • `nuclei.yaml`:自動生成的漏洞掃描模板
  • CVE 資料夾結構:
  • 年份/CVE ID 為目錄名稱
  • 具體例子(漏洞:WP Meta SEO SSRF):
  • 漏洞類型:未認證 SSRF,可反射內部服務響應
  • PoC:調用特定端點,設置特定 Header 和 Cookie
  • 驗證方式:發送 HTTP 請求,檢查是否返回內部服務內容

結論

結論

透過 Claude Code 和 Zapier MCP 的結合,一個人可以用自動化工廠的方式每日處理數十個 CVE,把漏洞逆向工程從手工活變成流水線生產,大幅降低安全研究的門檻。

完整解析

詳細

這支影片展示了一個革命性的漏洞研究工作流。傳統上,安全研究人員要發現漏洞要麼需要深入審計代碼,要麼需要投入大量時間進行黑盒測試。但講者提出了一個關鍵洞察:每天有數百個 CVE 被公開發佈,同時補丁也開源公開,這意味著漏洞的「前後對比」就直接擺在眼前。只要會讀補丁,就能理解漏洞原理,寫出工作中的 PoC。這種方法叫「CVE 逆向工程」,難度遠低於傳統漏洞發現。

講者利用 Claude Code 和 Zapier MCP 打造了一個完全自動化的系統。整個架構很清晰:Claude Code 是「大腦」,負責邏輯推理、diff 分析、漏洞識別;Zapier MCP 是「雙手」,負責連接各種服務——GitHub 用來存儲和管理 PoC、Google Sheets 用來備份數據、Slack/Discord 用來發送警報。這樣的分工讓整個系統無需複雜的自定義代碼,純粹靠 Claude 的 Skill 和 MCP 的連接器就能運作。

具體流程是這樣的:系統每日從 Patch Stack 漏洞資料庫拉取 WordPress 外掛的高危 CVE(CVSS 分數 6 分以上)。對於每個 CVE,Claude 會自動下載漏洞版本和修復版本的源代碼,進行 diff 對比,識別出具體改動了什麼。然後它分析代碼邏輯,推斷出漏洞原理,自動生成可運行的 PoC(包含 HTTP 方法、端點、必要參數、curl 命令),同時生成詳細的技術報告說明漏洞細節,最後還會創建 Nuclei 掃描模板,方便後續批量檢測。所有這些文件都自動提交到 GitHub 倉庫,形成一個不斷增長的 CVE 資料庫。

講者展示的實例中,系統成功逆向了一個 WordPress 外掛的 SSRF 漏洞。生成的 PoC 可以直接在測試環境中驗證,確實能成功觸發漏洞。更強大的是,這個系統可以輕易擴展——不限於 WordPress,還可以監控 Drupal、其他開源專案的補丁;可以設置 Cron 任務讓系統每天自動運行;可以透過 Discord webhook 實時通知新漏洞。這樣就形成了一個「CVE 工廠」,源源不斷地生產高質量的漏洞分析和 PoC,既可用於學習研究,也可以幫助 bug bounty 獵人快速定位目標。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing
編輯精選
83 min
AI 技術英文PODCAST8月26日

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing

Latent Space

  • 加速傳統物理模擬的典範轉移:氣象科學家原本認為 AI 無法匹敵數十年的物理建模工作,但傅里葉神經算子不僅達到同等精度,還快了一萬多倍。原本需要超級計算機的計算現在用消費級 GPU 就能完成,這改變了整個領域的思維方式。
  • 傅里葉域的非局部現象捕捉:傅里葉域能有效表示非局部現象(如大氣河流跨越千里的影響),且計算複雜度為準線性,遠優於完全連接的全局模型。這特別適合流體動力學、量子化學等自然現象中普遍存在的非局部相互作用。
  • 多解析度連續函數表示:神經算子將輸入輸出視為連續函數而非固定維度向量,可在推論時以任意解析度查詢,並能在更高解析度上疊加物理約束或額外數據,克服了固定解析度神經網路的限制。
Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Why the Next AI Breakthrough May Come from Physics with Max Welling - #774
55 min
AI 技術英文PODCAST8月25日

Why the Next AI Breakthrough May Come from Physics with Max Welling - #774

TWIML AI

  • 多層篩選的材料設計流程:先搜尋文獻資料庫找現有材料,若無合適的就用生成模型產生數十萬個候選分子,用機器學習力場進行分子動力學模擬篩選,再進行實驗驗證。這套流程相比傳統量子力學計算能加速效率數個數量級。
  • 生成AI與熱力學的數學等價性:資訊論是兩個領域的共同基礎,生成模型的擴散過程與非平衡統計力學描述資訊損失的過程在數學上完全對應,許多開發出來的方法工具在兩領域都有精確對應的形式。
  • 基礎模型的遷移學習策略:先在廣泛材料資料集上訓練基礎力場表示,再針對特定材料類別進行蒸餾微調,既能保持計算效率也能獲得專一性。