KeyFrame內部研究專用

DeFi security Summit 2023 - Session 4: AI Panel

DeFi Security Summit - DSS·7月15日週六·39 min英文

三句話摘要

AI 在加密生態中的應用:從身份驗證到智能合約審計,LLM 如何幫助防守惡意代理與新型攻擊。 AI 不是銀彈,必須與專業化工具、鏈上身份層、可驗證的防禦機制結合,才能在加密生態中有效抵禦日益複雜的攻擊。 LLM 審計的能力與侷限 — ChatGPT 等模型擅長生成樣板代碼與初步分析,但僅基於詞序預測,無法理解代碼的控制流與函數圖結構;審計師需手動補充動態分析,結合圖論視角才能找出隱藏的跨函數漏洞。

重點整理

重點
  • 1

    LLM 審計的能力與侷限 — ChatGPT 等模型擅長生成樣板代碼與初步分析,但僅基於詞序預測,無法理解代碼的控制流與函數圖結構;審計師需手動補充動態分析,結合圖論視角才能找出隱藏的跨函數漏洞。

  • 2

    令牌長度與檢測精度的交易 — 32k 令牌限制已成業界標配,更長的上下文帶來更高命中率與更低誤報率;但令牌壓縮會喪失關鍵信息,反而降低檢測效果,安全性不可妥協。

  • 3

    身份層的必要性 — 隨著 AI 代理能力提升,需在鏈上記錄身份與歸屬(誰是真人、誰是經審計的 AI 代理),方能在 DeFi 與社交平台中區隔真實用戶與惡意機器人,並允許良性 AI 參與生態。

  • 4

    熔斷機制的雙刃劍困境 — 自動化防守必須即時檢測異常交易,但攻擊者可能反向觸發熔斷機制癱瘓系統;零知識證明等技術有望讓鏈上驗證成為可信基礎,降低信息不對稱。

實用技巧與重點

乾貨
  • 參與者與背景:
  • Civic Technologies CEO Chris Hart — 提供區塊鏈身份驗證、活體證明、唯一性驗證服務(W3C 去中心化身份標準)
  • Pentacify 創始人 Lucas Martin — 提供部署後智能合約漏洞檢測(字節碼層級自動分析)
  • Auditware CEO Joe Van Loon — 開發審計 IDE「Audit Wizard」,整合代碼分析、工作流、威脅建模、AI 報告生成
  • d23e 去中心化智能聯合創始人 Lee — 研究 LLM 於異常交易檢測的應用
  • 技術工具與模型:
  • 使用模型:ChatGPT 32k API、Claude API、Meta LLM、Hugging Face 開源模型
  • 令牌長度:32k 為當前主流;更長令牌 → 更高命中率、更低誤報率
  • 關鍵概念:詞嵌入(Word Embedding)、令牌(Token)、注意力機制(Attention)、控制流圖、深度強化學習(DRLS)、零知識證明(ZK)
  • 研究數據:
  • 分析 160 起 DeFi 事件中的緊急暫停機制:僅 1 個協議在 1 小時內觸發熔斷,約 42 個在 6 小時內暫停交易
  • 傳統啟發式檢測易被繞過;AI 可比對交易歷史檢測異常模式
  • 標準與提案:
  • EIP 7265:提出 DeFi 熔斷機制,目標是在足夠信任後逐步解除限制(借鑑納斯達克熔斷成效)

結論

結論

AI 不是銀彈,必須與專業化工具、鏈上身份層、可驗證的防禦機制結合,才能在加密生態中有效抵禦日益複雜的攻擊。

完整解析

詳細

這場小組討論聚集了加密生態中的身份驗證、智能合約審計與 DeFi 安全四位專家,探討 ChatGPT 引發的 AI 浪潮如何重塑防護策略。討論開場時,各方坦承 ChatGPT 在 2023 年的橫空出世對既有流程帶來衝擊——許多人多年來已在悄悄研究 AI 工具,但公眾關注將其推上風口浪尖。審計團隊起初嘗試將 ChatGPT 直接應用於合約審計,發現效果有限;只要給它一份合約要求審計,往往顯得不夠實用。真正突破來自深入拆解:當審計師自己逐行分析核心組件時,才發現 LLM 的真正價值——如開發者利用 ChatGPT 生成樣板代碼那樣,審計也有「樣板」(如文件驗證、威脅建模框架),LLM 可加速這些環節。

但 LLM 的侷限同樣關鍵。ChatGPT 本質是語言模型,基於詞序預測下一個令牌,無法從圖論角度理解智能合約的控制流——函數之間如何聯動、資金流向如何跨越多個層級。手動審計時,審計師必須思考「這個函數在合約中的空間位置」、「從哪些入口點可進入此函數」,這種全域視角 LLM 天生缺乏。因此業界普遍採用混合策略:先用 ChatGPT 快速生成初稿,再用開源工具(如控制流圖分析)補充細節,最後訓練專業化 LLM(例如用 Hugging Face 模型微調),專門聚焦漏洞檢測而非通用文本生成。

令牌長度成為實戰中的關鍵決策點。32k 令牌已成主流選擇,實驗表明更長的上下文帶來更高命中率與更低誤報——但令牌壓縮會永久喪失可能藏有漏洞的資訊,因此對安全性而言得不償失。在身份層面,隨著 AI 代理能力爆發,鏈上需要一套機制來標記身份(真人、已審計 AI 代理、未知代理),讓 DeFi 協議與社交平台能選擇允許或拒絕特定類型參與者。最後,DeFi 的 24/7 全天候運作特性決定了熔斷機制必須自動化——人類無法時刻監控、手動應對攻擊往往為時已晚。但自動化本身也開啟了新攻擊面:惡意行為者可能學會模擬某些交易模式以欺騙防禦系統觸發誤報熔斷。這種「誰監督守望者」的困境,可能需要零知識證明等密碼學工具來在鏈上驗證 AI 行為的可信度。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing
編輯精選
83 min
AI 技術英文PODCAST8月26日

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing

Latent Space

  • 加速傳統物理模擬的典範轉移:氣象科學家原本認為 AI 無法匹敵數十年的物理建模工作,但傅里葉神經算子不僅達到同等精度,還快了一萬多倍。原本需要超級計算機的計算現在用消費級 GPU 就能完成,這改變了整個領域的思維方式。
  • 傅里葉域的非局部現象捕捉:傅里葉域能有效表示非局部現象(如大氣河流跨越千里的影響),且計算複雜度為準線性,遠優於完全連接的全局模型。這特別適合流體動力學、量子化學等自然現象中普遍存在的非局部相互作用。
  • 多解析度連續函數表示:神經算子將輸入輸出視為連續函數而非固定維度向量,可在推論時以任意解析度查詢,並能在更高解析度上疊加物理約束或額外數據,克服了固定解析度神經網路的限制。
Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Why the Next AI Breakthrough May Come from Physics with Max Welling - #774
55 min
AI 技術英文PODCAST8月25日

Why the Next AI Breakthrough May Come from Physics with Max Welling - #774

TWIML AI

  • 多層篩選的材料設計流程:先搜尋文獻資料庫找現有材料,若無合適的就用生成模型產生數十萬個候選分子,用機器學習力場進行分子動力學模擬篩選,再進行實驗驗證。這套流程相比傳統量子力學計算能加速效率數個數量級。
  • 生成AI與熱力學的數學等價性:資訊論是兩個領域的共同基礎,生成模型的擴散過程與非平衡統計力學描述資訊損失的過程在數學上完全對應,許多開發出來的方法工具在兩領域都有精確對應的形式。
  • 基礎模型的遷移學習策略:先在廣泛材料資料集上訓練基礎力場表示,再針對特定材料類別進行蒸餾微調,既能保持計算效率也能獲得專一性。