KeyFrame內部研究專用

Enhancing Large Language Models for Smart Contract Security - DeFi Security Summit 2025

DeFi Security Summit - DSS·11月24日週一·4 min英文

三句話摘要

透過依賴感知上下文、審計標注語料庫與參數高效微調,打造能自動偵測智能合約業務邏輯漏洞的 LLM 審計員。 把調用圖縮小上下文、正負樣本標注語料、LoRA 參數高效微調三件事做對,就能在可接受成本內打造出真正理解業務邏輯的智能合約 LLM 審計員。 傳統算法檢測器已過時:業務邏輯漏洞需要上下文感知能力,算法無法理解跨函式的意圖與狀態流,必須引入 LLM。

重點整理

重點
  • 1

    傳統算法檢測器已過時:業務邏輯漏洞需要上下文感知能力,算法無法理解跨函式的意圖與狀態流,必須引入 LLM。

  • 2

    縮小上下文是減少幻覺的核心手段:與其把整份程式碼餵給 LLM,不如透過調用圖與繼承關係樹,只傳入與待查問題相關的函式,讓 LLM 得到精確輸入,才能給出精確輸出。

  • 3

    負樣本同樣重要:語料庫不只要標注「什麼是漏洞」,也必須標注「什麼不是漏洞」,這對壓低誤報率有顯著效果。

  • 4

    參數高效微調讓訓練成本可控:Supervised Fine-Tuning 搭配 LoRA/QLoRA 只需更新 1-3% 的參數,再加上偏好優化(DPO/ORDPO),可在有限預算內顯著提升模型對漏洞語境的理解能力。

實用技巧與重點

乾貨
  • 損失規模:每年因惡意黑客損失近 20 億美元
  • 主要漏洞類型:訪問控制(Access Control)、代理升級(Proxy Upgrade)、業務邏輯(Business Logic)
  • 訓練數據來源:審計競賽(Audit Competitions)、事後分析(Post-Mortems)、公開審計報告
  • 架構:RAG + 向量數據庫,搭配負樣本標注
  • 訓練方法
  • Supervised Fine-Tuning(SFT,監督式微調)
  • LoRA / QLoRA(參數高效微調,僅訓練 1%-3% 參數)
  • DPO / ORDPO(偏好優化)
  • 上下文技術:Call Graph(調用圖)+ 繼承關係樹 + Storage Slot 分析

結論

結論

把調用圖縮小上下文、正負樣本標注語料、LoRA 參數高效微調三件事做對,就能在可接受成本內打造出真正理解業務邏輯的智能合約 LLM 審計員。

完整解析

詳細

Web3 安全領域每年因惡意黑客攻擊損失接近 20 億美元,其中訪問控制漏洞、代理升級漏洞與業務邏輯漏洞佔大宗。面對如此規模的威脅,手動審計根本無法擴展,業界早期嘗試用算法檢測器自動化這個流程,但算法只能識別固定模式,對於依賴上下文的業務邏輯漏洞幾乎無能為力。

演講者 Shashank 提出的解法是把 LLM 塑造成一位「初級智能合約審計員」。他指出,開箱即用的 LLM 有兩個根本問題:一是容易產生漏洞幻覺,誤報浪費審計員時間;二是無法理解業務邏輯的深層上下文,導致真正的漏洞被遺漏。要解決這兩個問題,需要從三個維度同時下手。

第一是依賴感知上下文。人工審計員不會逐行閱讀程式碼,而是沿著調用圖追蹤函式呼叫關係、理解繼承層次與儲存槽的值傳遞路徑。Shashank 的團隊將這個邏輯複製到 LLM 的輸入管線中:先建立樹狀調用圖,再針對特定查詢(如「誰在呼叫誰」)只抽取相關函式片段提供給 LLM,而非餵入整份代碼庫。精確的輸入直接帶來精確的輸出,幻覺率因此大幅下降。

第二是標注語料庫的品質。他們從審計競賽、事後分析報告、公開審計報告中收集資料,並在 RAG 架構的向量數據庫中同時標注正樣本(這是漏洞)與負樣本(這不是漏洞),讓模型學會區分邊界,從而有效降低誤報率。

第三是成本可控的訓練流程。LLM 全量訓練費用高昂,團隊採用監督式微調(SFT)作為起點,再以 LoRA 與 QLoRA 進行參數高效微調——這兩種方法只需更新模型 1% 到 3% 的參數,成本遠低於全量訓練。最後再加上偏好優化(DPO / ORDPO),強化模型對「好答案」與「壞答案」的辨別能力。三者疊加後,模型在業務邏輯漏洞的偵測準確率與上下文理解能力均有顯著提升。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「Web3 安全」的內容

IF YOU OWN XRP YOU NEED TO SEE THIS PRICE MANIPULATION! ⚠️
8 min
Web3 安全英文8月14日

IF YOU OWN XRP YOU NEED TO SEE THIS PRICE MANIPULATION! ⚠️

Zach Humphries

  • 機構支撐的積極意義:價格操縱常被視為負面,但Ripple掌握大量XRP供應與escrow,在熊市期間提高價格下限,實際上替零售投資者鎖定了低風險的積累區間,這不是剝削而是市場穩定機制。
  • 歷史模式驗證:2024年7月至11月XRP在50美分附近橫盤整理,低點觸及42美分(wick),高點65美分;隨後11月5日至12月5日單月上漲456%,年底到2025年初累計漲幅534%,這個歷史周期正在1美元價位重演。
  • 比特幣聯動邏輯:講者在4-5月就預測「如果比特幣跌至60k以下,XRP會跌至1美元或更低」,此預測精準應驗,反映出熊市中兩者的明確連動關係。
Minimmit, Multimmit and the New Consensus Frontier with Patrick O'Grady
72 min
Web3 安全英文PODCAST8月5日

Minimmit, Multimmit and the New Consensus Frontier with Patrick O'Grady

Zero Knowledge

  • 反向 Linux 架構:Commonware 刻意暴露棧各層級控制,讓開發者自訂執行環境、共識機制、密碼學實現,而非像 Cosmos SDK 只允許應用層以上定制。2-3 個月能組裝一條定製鏈,代價是額外深度但回報是長期維護成本降低及效能優化彈性。
  • 容錯假設的典範轉移:Alpine Glow(Solana 2025)實現單輪投票定終的關鍵是將容錯預算分離為獨立的 Byzantine 和 Crash 容限。傳統系統把 33% 當一個整體預算;新模型允許 20% 惡意加 20% 崩潰,打破了 PBFT 理論界線,釋放單輪設計空間。
  • Minimet 與 Multimet 的遞進:Minimet 是 5F+1 設定下的乾淨構造,實現更短視圖延遲;Multimet(剛發布)進一步允許並行 mini-commits 且驗證者可推翻領導者審查,使用者交易在全球分布式網路達到 200-300 毫秒端到端定終。
Private Information Retrieval (PIR) with Alex Hoover
64 min
Web3 安全英文PODCAST7月29日

Private Information Retrieval (PIR) with Alex Hoover

Zero Knowledge

  • PIR 保護的是訪問模式,不是資料本身
  • PIR 與加密不同,它關注的是隱藏「客戶端查詢了什麼」,而非「資料是否加密」。在公開資料庫(如區塊鏈)上,客戶端可以在不洩露查詢對象給伺服器的情況下檢索特定條目,解決了輕量級客戶端的隱私和防審查問題。
  • 客戶端預處理方案是突破瓶頸的關鍵