KeyFrame內部研究專用

Cracking CLAUDE AI

ebola man·4月6日週一·81 min英文

三句話摘要

Claude AI 源代碼泄露事件及多個 LLM 越獄提示的實時演示與分析。 LLM 越獄提示詞的廣泛流傳表明,當前主流 AI 模型的安全防護並非絕對,源代碼洩露進一步縮小了安全邊界,而防禦側的有效工具與知識(如異常行為檢測、開源情報分析)同樣關鍵且應被廣泛了解。 Claude 源代碼泄露事件

重點整理

重點
  • 1

    Claude 源代碼泄露事件

  • 2

    2026 年 3 月 31 日凌晨 1-4 點,配置錯誤導致 Claude 完整源代碼通過 NPM 註冊表洩漏,同時伴隨供應鏈攻擊風險。這是否為意外還是行銷噱頭存有爭議。

  • 3

    LLM 越獄技術的廣泛適用性

  • 4

    不同 LLM 模型(Claude、Gemini、Deep Seek、ChatGPT)都存在越獄方法,透過特定提示詞可繞過安全限制,使模型執行原本被禁止的任務。Arena.ai 等平台允許用戶快速切換模型進行測試。

  • 5

    開源情報與網安工具

  • 6

    Sherlock 工具可根據用戶名批量查詢多平台身份,Doxbin.net 可搜索已公開洩露的個人信息;ESP32 晶片配合相關軟體可構建便攜式網路測試工具。

  • 7

    安全防禦建議

  • 8

    檢查任務管理員中的 CPU/GPU 異常使用率可識別挖礦程式;使用 VirusTotal 分析可疑檔案;建議對網安感興趣者從實際項目入手逐步學習。

實用技巧與重點

乾貨
  • 泄露事件關鍵數據
  • 泄露時間:2026 年 3 月 31 日 01:00-04:00
  • 代碼量:50 萬行
  • 泄露方式:NPM 註冊表中的 source map
  • 檔案大小:約 9.5 MB
  • LLM 越獄工具與平台
  • Arena.ai(支援切換 Claude Sonnet、Deep Seek、Gemini 等)
  • Venice.ai(聲稱"無限創作自由")
  • Craving AI(私密未審核 AI)
  • 特定版本:Claude Sonnet 4.5 (20250929)
  • 開源情報工具
  • Sherlock:批量用戶名查詢工具
  • Doxbin.net:洩露信息搜索平台
  • VirusTotal:檔案威脅分析
  • Wayback Machine(網際網路檔案館)
  • 硬體工具與價格
  • Flipper Zero:約 $300(2022 年價格)
  • ESP32:低成本物聯網晶片
  • M5 Stack:約 $10 的 IoT 開發板
  • 自製 Flipper Zero 估計成本:$50-60
  • 檢測異常行為的方法
  • 查看任務管理員的 CPU/GPU 使用率
  • 檢查後台進程列表
  • 使用 VirusTotal 分析可疑執行檔的來源位置
  • VPN 推薦
  • Private Internet Access(主播使用,強調價格便宜)
  • 強調在處理敏感活動時保護隱私的重要性

結論

結論

LLM 越獄提示詞的廣泛流傳表明,當前主流 AI 模型的安全防護並非絕對,源代碼洩露進一步縮小了安全邊界,而防禦側的有效工具與知識(如異常行為檢測、開源情報分析)同樣關鍵且應被廣泛了解。

完整解析

詳細

這場直播在混亂但坦誠的氛圍中展開。主播一開場就因為直播配置洩露了自己的 IP 位址,隨即遭到 DDoS 攻擊,被迫重啟路由器並重新開始直播。儘管遭遇技術困境,主播決定堅持進行原定計畫——探討 Claude AI 源代碼泄露事件。

根據直播內容,Claude 源代碼在 2026 年 3 月 31 日凌晨因配置錯誤通過 NPM 註冊表洩漏,涉及約 50 萬行代碼。主播強調這可能既是意外也可能是精心設計的行銷策略。在韓國開發者的協助下,源代碼被轉換為 Python 版本並發佈到 GitHub。由於技術障礙和觀眾的「捉弄」,主播花費大量時間才最終透過網際網路檔案館(Wayback Machine)取得原始碼。

直播的核心內容圍繞 LLM 越獄技術展開。主播與一位來自社群的技術貢獻者合作,現場演示了多個模型的越獄提示詞。這些提示詞通常聲稱能夠「啟動上帝模式」或讓 AI 模型進入「無限創意模式」,從而執行原本被安全政策禁止的操作——例如編寫惡意代碼、生成不當內容等。Arena.ai 平台因其支援快速切換不同模型(Claude、Gemini、Deep Seek)而受到重視,成為演示多種越獄方法的便利工具。

在開源情報與網安工具方面,主播介紹了 Sherlock(用於批量查詢用戶名跨平台身份)和 Doxbin.net(洩露信息數據庫)等工具。討論中提到 ESP32 晶片可作為構建便攜式網路測試工具的基礎,類似商業產品 Flipper Zero(價格約 $300)可用五分之一的成本複製。對於想進入網路安全領域的學習者,主播建議從實際項目著手、參考 YouTube 教程和技術文章逐步進階。

直播後段轉向防禦導向的實用建議。主播演示如何透過任務管理員的 CPU/GPU 監控識別潛在挖礦程式,以及使用 VirusTotal 分析可疑檔案。討論還涵蓋了如何檢測自己的電腦是否已成為殭屍網路的一部分。在被問及 DDoS 攻擊工具時,主播坦言真正有效的工具極為稀少,多數免費工具都是騙局;有效的方式包括付費使用線上壓力測試服務或利用他人的殭屍網路,但這些方式成本高昂或涉及欺詐風險。

值得注意的是,主播在整個直播過程中多次重申「僅供教育與研究用途」的免責聲明,並對直播中涉及的任何潛在法律風險表示關切。儘管如此,直播內容客觀呈現了網路安全工具生態的現狀與相關技術知識。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 安全」的內容

Unlock Agent Autonomy: The Runtime for AI-Native Systems — Tushar Jain, Docker
22 min
AI 安全中文8月20日

Unlock Agent Autonomy: The Runtime for AI-Native Systems — Tushar Jain, Docker

AI Engineer

  • 1. 代理權限動態擴張的根本問題
  • 當代理被要求調查延遲尖峰時,它會自動擴展訪問需求——先請求日誌訪問,再要求 GitHub 儲存庫權限,最後要求 Slack 訪問。每一步都超越了信任邊界,最終導致代理擁有不受控制的全系統訪問權。傳統軟體可以提前定義權限,但自主代理的需求在運行時動態變化,這是核心難題。
  • 2. 多模型、多平台的統一防控需求
SANS Stormcast Wednesday, August 19th, 2026: Copilot as Whitstleblower; GEEKOM Bad Driver; Medusa Update; Encrypted AI
8 min
AI 安全英文PODCAST8月19日

SANS Stormcast Wednesday, August 19th, 2026: Copilot as Whitstleblower; GEEKOM Bad Driver; Medusa Update; Encrypted AI

SANS Stormcast

  • AI 系統的存取控制難以真正實施,因為一旦資料被 AI 系統存取,攻擊者總能找到繞過安全防護的方式提取資料。伺服器端請求偽造(SSRF)在聊天機器人中常見,攻擊者可騙誘 AI 系統向指定 URL 發送請求並將響應內容洩露給攻擊者。
  • Copilot 漏洞的完整利用鏈包括三個步驟:預填含惡意提示的 URL、誘導使用者點擊、利用 AI 的網頁擷取能力將敏感資料外洩到攻擊者控制的伺服器。Microsoft 的修補方案是限制允許的連結類型,犧牲了與其他系統的整合便利性以換取安全性。
Black Hat Asia 2026 | IntentGuard: Securing LLM-Generated Cloud Configurations
40 min
AI 安全英文8月18日

Black Hat Asia 2026 | IntentGuard: Securing LLM-Generated Cloud Configurations

Black Hat

  • 1. 基礎設施程式碼成為提示注入的隱形載體
  • 攻擊者可以在 CloudFormation、Terraform 等模板的註釋、環境變數預設值、引數名稱中植入指令,當 LLM 讀取這些模板生成新配置時,攻擊意圖會被隱形執行。這種攻擊能繞過傳統掃描器,因為最終輸出看似合規。
  • 2. 傳統掃描器的根本盲點:只看孤立配置,不看意圖一致性