KeyFrame內部研究專用

🎯Anthropic 發布 Claude Mythos Preview,因為太危險而不公開:從零到 181 次成功攻擊!|Anthropic 最危險的模型 !! 27 年的漏洞被 AI 找出 !!

AI 論文白話文·4月11日週六·8 min中文

三句話摘要

新一代 AI 模型(Methos Preview)已能自動發現並利用軟體零日漏洞,徹底打破攻防時間平衡,迫使科技巨頭聯手組建史無前例的 AI 防禦聯盟。 AI 已能在幾分鐘內將零日漏洞武器化,攻防時間差幾近消失,防守方別無選擇,只能以 AI 對抗 AI。 能力躍升是質變而非量變:新模型不只是更快找漏洞,而是從「幾乎做不到」直接跳到「成功 181 次」,代表 AI 輔助攻擊已跨越實用門檻,進入全新威脅等級。

重點整理

重點
  • 1

    能力躍升是質變而非量變:新模型不只是更快找漏洞,而是從「幾乎做不到」直接跳到「成功 181 次」,代表 AI 輔助攻擊已跨越實用門檻,進入全新威脅等級。

  • 2

    多階段攻擊鏈已可自動生成:模型能像頂尖駭客一樣將多個漏洞串接——繞過 KASLR 記憶體防護、讀取機密資料、寫入惡意核心程式碼,三步拿下完整系統控制權,這種複雜度以往只有人類精英駭客才辦得到。

  • 3

    N-Day 漏洞的威脅性暴增:官方補丁本身就是漏洞路線圖,AI 能即時根據補丁逆推出攻擊武器,對數百萬台尚未更新的設備發動攻擊,讓「發布更新」這件事本身變成一種風險訊號。

  • 4

    防守方必須以 AI 對抗 AI:業界判斷已無退路,唯一可行策略是先將這把武器交給防守方,在攻擊者之前搶先掃描並修復關鍵系統,這也是玻璃翼計畫(Glass Wing Project)的核心邏輯。

實用技巧與重點

乾貨
  • 模型對比:Opus 4.6 利用 Firefox 漏洞成功率 ≈ 0;Methos Preview 同測試成功 181 次
  • 具體漏洞案例:OpenBSD 存在 27 年的 bug;FFmpeg(FFPack)存在 16 年的漏洞
  • 攻擊時間壓縮:漏洞武器化從數個月 → 幾分鐘(CrowdStrike 技術長數據)
  • Linux 核心攻擊鏈三步驟:① 繞過 KASLR ② 讀取機密資料 ③ 寫入惡意核心程式碼 → 完整控制權
  • 聯盟成員:Apple、Google、Microsoft、AWS、Cisco、Nvidia、JP Morgan Chase + The Linux Foundation
  • Anthropic 投入:承諾提供 1 億美元模型使用額度
  • 防禦者四條新規則:① 縮短修補周期(更新 = 緊急應變)② 全面自動化警報分類 ③ 現在就用 AI 工具主動找漏洞 ④ 重新檢視漏洞揭露政策
  • 計畫名稱:玻璃翼計畫(Glass Wing Project)

結論

結論

AI 已能在幾分鐘內將零日漏洞武器化,攻防時間差幾近消失,防守方別無選擇,只能以 AI 對抗 AI。

完整解析

詳細

網路安全的遊戲規則正在被一個名為 Methos Preview 的新 AI 模型徹底改寫。這個模型的核心突破不在於找漏洞的速度更快,而在於它找到的都是人類專家看過成千上萬遍卻視而不見的深層缺陷——例如號稱超高安全性的 OpenBSD 中一個潛伏了整整 27 年的 bug,以及幾乎所有影音軟體都依賴的 FFmpeg 中一個 16 年前種下的問題。這說明一件令人不安的事:即便是經過大量人工審查的程式碼,仍然藏著連人類都看不見的弱點。

能力的真正跳躍從一組對比數據看得最清楚。同樣面對一個已知的 Firefox 漏洞,前代模型 Opus 4.6 嘗試了數百次、成功率幾乎為零;換上 Methos Preview,同樣的測試成功了 181 次。這不是漸進式改良,而是從「不可用」直接跳到「高度可用」的質變。更值得警惕的是,這個模型還能模仿頂尖駭客的思維模式,將多個獨立漏洞串接成完整攻擊鏈——以 Linux 核心為例,它先繞過防止記憶體位置被猜測的 KASLR 機制,再讀取系統機密資料,最後將惡意程式碼植入核心,三步拿下整台電腦的完整控制權。這種複雜度的多階段攻擊,過去只有人類精英駭客才有能力執行。

這帶來的最直接衝擊是攻防時間比的崩潰。CrowdStrike 技術長指出,過去從漏洞被發現到被攻擊者武器化,中間有數個月的緩衝時間讓防守方修補;現在 AI 能在幾分鐘內完成這整個流程。這讓「N-Day 漏洞」的危險性急速上升——官方補丁本身就像一張藏寶圖,AI 能立即根據補丁內容推算出攻擊手法,對數百萬台尚未更新的設備發動精準打擊。整個業界正瀰漫著一種深層恐懼:攻擊者製造武器的速度,已經遠遠快過防守方修補系統的速度。

面對這個現實,業界的回應是組建一個史無前例的防禦聯盟——玻璃翼計畫(Glass Wing Project)。加入的名單幾乎就是全球科技與金融業的點名冊:Apple、Google、Microsoft、AWS、Cisco、Nvidia,以及金融龍頭 JP Morgan Chase,全部聯手 The Linux Foundation。Anthropic 更承諾提供價值 1 億美元的模型使用額度,武裝這個防禦陣線。思科的 Anthony Grieco 總結得很精準:「已經沒有回頭路了」。這個聯盟的策略邏輯很直接——既然超級攻擊能力已經存在,唯一的出路就是讓防守方先拿到這把武器,在惡意行為者動手之前,搶先掃描並修復關鍵基礎設施中的漏洞。對所有網路防禦者來說,新的行動準則也隨之確立:把更新週期當成緊急應變而非例行作業、用 AI 自動化警報分類、現在就部署 AI 漏洞掃描工具,並重新制定漏洞揭露政策以因應未來更高頻率的漏洞發現節奏。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Everything Goldman Sachs Taught Me About AI (In 10 minutes)
AI 技術英文8月24日

Everything Goldman Sachs Taught Me About AI (In 10 minutes)

Nate Herk

  • 驗證優於相信:看起來完整的AI輸出不等於正確答案,需在提示中要求模型重新檢查數字、引用來源,並對無把握的部分標記。
  • 區分AI與自動化:確定步驟且答案已知的任務用傳統自動化更便宜快速;只在需要判斷力、靈活性或處理複雜資訊時才用AI,兩者結合效果最佳。
  • 以問題驅動選型:先寫清楚「要解決的問題是什麼、成功的樣子是什麼」,再決定用什麼工具,許多失敗項目是從技術而非問題出發。
Mu: a self-hosted personal agent where the interface is an email address you can write to
AI 技術英文8月23日

Mu: a self-hosted personal agent where the interface is an email address you can write to

GitHub Awesome

  • Mu 是自主代理人系統,具有實際網址與獨立伺服器,用戶可透過多種方式與其互動——網頁應用、電子郵件或程式化介面。
  • 架構完整覆蓋日常工作流程的多個層面,整合郵件收發(SMTP/IMAP)、檔案管理、行事曆、新聞聚合、市場數據與搜尋功能於一個 Go 伺服器內。
  • 支援自帶模型與多種通訊協定,用戶可選擇不同的 AI 模型,並透過 MCP、HTTP API 或命令列工具整合到其他系統。