KeyFrame內部研究專用

Off-Chain But Not Off Radar - DeFi Security Summit 2025

DeFi Security Summit - DSS·11月23日週日·18 min英文

三句話摘要

Runtime Verification CEO 分享加密基礎設施審計(編譯器、節點、VM、共識協議)的實戰技術與最佳實踐。 --- 基礎設施審計的核心是「分層擴展」:用短週期人工審計聚焦關鍵代碼,用 AI 補足覆蓋盲區,用差分模糊測試捕捉實作分歧,再選擇性地以形式化驗證提供最高安全保證——而一份清晰的規格說明,是貫穿所有環節的最重要加速器。 基礎設施審計與智能合約審計的核心差異是規模。智能合約幾千行即為完整專案,但 Ethereum/Solana 客戶端動輒數十萬行,加上語言差異(Rust/Go/C++)和不同的威胁模型(鏈分裂、DoS、記憶體耗盡),需要完全不同的審計策略。

重點整理

重點
  • 1

    基礎設施審計與智能合約審計的核心差異是規模。智能合約幾千行即為完整專案,但 Ethereum/Solana 客戶端動輒數十萬行,加上語言差異(Rust/Go/C++)和不同的威胁模型(鏈分裂、DoS、記憶體耗盡),需要完全不同的審計策略。

  • 2

    採用「短週期輪迴審計」比一次性長期審計更有效。6-8 週一輪的集中審計可避免審計員疲勞,同時給開發團隊時間修復上一輪問題,再進入下一輪,形成正向循環。

  • 3

    差分模糊測試是發現客戶端實作分歧的高效手段。同時運行同一條鏈的不同客戶端實作,比對所有輸入下的行為是否一致,能識別出若任一節點拒絕有效交易就可能導致鏈分裂的高危漏洞。

  • 4

    提供具體規格說明能大幅提升 AI 輔助審計的效果。若只讓 AI 自行尋找漏洞,效果有限;但若同時要求 AI 比對代碼與規格之間的差異,則能發現人工審計容易遺漏的隱性假設錯誤。

  • 5

    --

實用技巧與重點

乾貨
  • 規模數字:
  • Reth(Ethereum Rust 客戶端):97,000 行 Rust
  • Lighthouse(共識客戶端):150,000 行 Rust(不含測試)
  • FireDancer(Solana 客戶端):340,000 行 C/C++
  • Ethereum 2.0 存款合約現存約 2,000 億美元,2019 年由 RV 進行形式化驗證
  • 工具名稱:
  • `cargo audit`:掃描 Rust 專案依賴項(供應鏈攻擊防護)
  • `Almanax`:用於智能合約與基礎設施的 AI 安全審計工具
  • `Deep Wiki`:專案初期快速理解代碼庫架構
  • `arbitrary`(Rust crate):生成結構化模糊測試輸入
  • `KVM`(K language):EVM 的形式化模型
  • `Certora Prover`、`Halmos`:生產級形式化驗證工具
  • `cloc`:程式碼行數統計工具
  • 方法與流程:
  • 設計評審(數天至一週)→ 理解系統、定義規格與不變式
  • 集中人工審查高優先級代碼(新代碼、`unsafe` 區塊、關鍵交互點)
  • AI 輔助審查(帶規格說明)覆蓋人工無法觸及區域
  • Panic-focused 模糊測試 → 基於屬性的模糊測試 → 差分模糊測試
  • 選擇性形式化驗證(小型關鍵組件、橋接合約、數據結構)
  • 真實案例:
  • Cloudflare 事故原因:Rust 中 `unwrap()` 因錯誤輸入引發 panic,導致半數互聯網癱瘓
  • 發現 Solana 部分節點實作拒絕空交易而其他節點不拒絕的分歧漏洞
  • 形式化驗證 Nethermind EVM Yul 與 KVM 的操作碼等價性,發現若干實作差異
  • 在 Viper 編譯器中因形式化驗證以太坊 2.0 存款合約而發現編譯器漏洞
  • --

結論

結論

基礎設施審計的核心是「分層擴展」:用短週期人工審計聚焦關鍵代碼,用 AI 補足覆蓋盲區,用差分模糊測試捕捉實作分歧,再選擇性地以形式化驗證提供最高安全保證——而一份清晰的規格說明,是貫穿所有環節的最重要加速器。

完整解析

詳細

加密基礎設施是指智能合約與用戶之間整個執行堆疊——從編譯器、JSON-RPC 節點、記憶體池,到虛拟機指令執行,再到共識協議。Runtime Verification CEO 寶琳娜在演講中指出,業界過去幾年的安全焦點集中在智能合約,但近來基礎設施審計的需求正快速增加,成為新的行業趨勢。她坦言,這類審計在方法論上面臨根本性挑戰:程式碼規模大到難以想像——Ethereum Rust 客戶端 Reth 約 97,000 行,共識客戶端 Lighthouse 超過 150,000 行,而 Solana 的 FireDancer 更達 340,000 行 C/C++ 代碼。傳統的逐行人工審計在這種規模下根本不可行,加之威胁模型也截然不同,需要面對鏈分裂、DoS、記憶體耗盡、領導人選舉操控等智能合約審計幾乎不涉及的問題。

針對規模問題,寶琳娜分享了 RV 採用的核心策略:以 6-8 週為單位進行輪迴式短週期審計,每輪聚焦於高優先級代碼——包括較新的代碼、Rust `unsafe` 關鍵字出現的所有位置、EVM 兼容鏈與參考實作之間的差異點(例如 gas 定價差異可能引發 DoS),以及組件之間的交互邊界。每輪審計前先進行設計評審,用數天時間理解系統架構、定義規格與不變式,這份規格不僅指導人工審查的方向,也成為 AI 工具的輸入依據。她特別強調,使用 Almanax 進行 AI 輔助審計時,若僅要求它自行發現漏洞,效果有限;但若同時要求它找出代碼與規格之間的偏差,則能發現人工容易忽略的隱性假設錯誤——例如某個函數假設上層調用者會進行某項驗證,但實際上並沒有。

在工具擴展覆蓋範圍方面,模糊測試是另一支柱。RV 採用三層次的模糊測試:首先是 Panic-focused 測試,輸入偽隨機數據讓程式崩潰(Cloudflare 那次導致半數互聯網癱瘓的事故,正是 Rust `unwrap()` 因錯誤輸入 panic 所致,這類問題模糊測試能有效捕捉);其次是基於屬性的模糊測試,不只檢查是否崩潰,還斷言函數的實際行為,例如類型轉換往返一致性、序列化反序列化的幂等性;最進階的是差分模糊測試,同時運行同一系統的不同實作(如 Rust 客戶端與 Geth),比對所有輸入下的行為,藉此發現客戶端分歧——RV 即以此發現 Solana 部分節點實作拒絕空交易而其他節點不拒絕的高危問題。Rust 項目的結構化輸入生成使用 `arbitrary` crate,不同語言有各自對應的工具生態。

最後在形式化驗證方面,寶琳娜建議選擇性應用:聚焦於小型關鍵組件(橋接合約的事件發送、數據結構操作)、EVM 不同實作的操作碼等價性驗證,以及存款合約等高價值目標。RV 在 2019 年形式化驗證以太坊 2.0 存款合約(現存約 2,000 億美元資產)時,正是因此發現了 Viper 編譯器漏洞——這類編譯器級漏洞幾乎只有形式化驗證才能識別。她建議最好在開發早期就引入形式化驗證,而非在系統成熟後才補做。

---

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「Web3 安全」的內容

IF YOU OWN XRP YOU NEED TO SEE THIS PRICE MANIPULATION! ⚠️
8 min
Web3 安全英文8月14日

IF YOU OWN XRP YOU NEED TO SEE THIS PRICE MANIPULATION! ⚠️

Zach Humphries

  • 機構支撐的積極意義:價格操縱常被視為負面,但Ripple掌握大量XRP供應與escrow,在熊市期間提高價格下限,實際上替零售投資者鎖定了低風險的積累區間,這不是剝削而是市場穩定機制。
  • 歷史模式驗證:2024年7月至11月XRP在50美分附近橫盤整理,低點觸及42美分(wick),高點65美分;隨後11月5日至12月5日單月上漲456%,年底到2025年初累計漲幅534%,這個歷史周期正在1美元價位重演。
  • 比特幣聯動邏輯:講者在4-5月就預測「如果比特幣跌至60k以下,XRP會跌至1美元或更低」,此預測精準應驗,反映出熊市中兩者的明確連動關係。
Minimmit, Multimmit and the New Consensus Frontier with Patrick O'Grady
72 min
Web3 安全英文PODCAST8月5日

Minimmit, Multimmit and the New Consensus Frontier with Patrick O'Grady

Zero Knowledge

  • 反向 Linux 架構:Commonware 刻意暴露棧各層級控制,讓開發者自訂執行環境、共識機制、密碼學實現,而非像 Cosmos SDK 只允許應用層以上定制。2-3 個月能組裝一條定製鏈,代價是額外深度但回報是長期維護成本降低及效能優化彈性。
  • 容錯假設的典範轉移:Alpine Glow(Solana 2025)實現單輪投票定終的關鍵是將容錯預算分離為獨立的 Byzantine 和 Crash 容限。傳統系統把 33% 當一個整體預算;新模型允許 20% 惡意加 20% 崩潰,打破了 PBFT 理論界線,釋放單輪設計空間。
  • Minimet 與 Multimet 的遞進:Minimet 是 5F+1 設定下的乾淨構造,實現更短視圖延遲;Multimet(剛發布)進一步允許並行 mini-commits 且驗證者可推翻領導者審查,使用者交易在全球分布式網路達到 200-300 毫秒端到端定終。
Private Information Retrieval (PIR) with Alex Hoover
64 min
Web3 安全英文PODCAST7月29日

Private Information Retrieval (PIR) with Alex Hoover

Zero Knowledge

  • PIR 保護的是訪問模式,不是資料本身
  • PIR 與加密不同,它關注的是隱藏「客戶端查詢了什麼」,而非「資料是否加密」。在公開資料庫(如區塊鏈)上,客戶端可以在不洩露查詢對象給伺服器的情況下檢索特定條目,解決了輕量級客戶端的隱私和防審查問題。
  • 客戶端預處理方案是突破瓶頸的關鍵