KeyFrame內部研究專用

Claude Fable 5 使用心得,上線 72 小時就被政府緊急停用?

Gary Chen·6月18日週四·14 min中文

三句話摘要

Anthropic 發布的頂級模型 Claude Fable,在 72 小時內遭美國政府以國家安全為由強制下架,本片記錄其能力、使用心得與下架真相分析。 --- 再強的 AI 工具都可能一夜消失,讓任何單一模型成為工作流瓶頸是最大的風險——永遠準備好可替換的備案。 Fable 是史上第一個被政府命令下架的商用 AI 模型。 它的核心是 Mythos——Anthropic 曾因其找漏洞能力太強而僅限量開放給資安防禦機構的模型——此次加上安全護欄後對外公開,讓政府視之為「人手一把的網路攻擊武器」。

重點整理

重點
  • 1

    Fable 是史上第一個被政府命令下架的商用 AI 模型。 它的核心是 Mythos——Anthropic 曾因其找漏洞能力太強而僅限量開放給資安防禦機構的模型——此次加上安全護欄後對外公開,讓政府視之為「人手一把的網路攻擊武器」。

  • 2

    讀程式、修 bug 與挖安全漏洞在技術上是同一個動作,護欄無法分辨意圖。 這是政府最核心的擔憂,也是 Anthropic 無法反駁的結構性問題,即便政府提出的繞過案例只是普通的 code review 操作。

  • 3

    Fable 極度偏科:在結構化工程任務上是降維打擊,但在無人監管的複雜自動化流程中成功率僅 17%。 它更像一個能力爆表但需要人類把關方向的夥伴,而非自主代理人。

  • 4

    對使用者最重要的教訓是:不要讓工作流程死在單一模型上。 任何模型都可能因為太貴、算力不足、或政府一紙命令而消失,手邊永遠需要可替換方案,開源模型的價值因此上升。

  • 5

    --

實用技巧與重點

乾貨
  • SWE-bench Pro:Fable 80.3%、GPT-5.5 58.6%
  • Automation Bench(模擬真實商業流程):Fable 17%(全場最高)、Gemini 3.5 Flash 14%(差三分,價格四分之一)
  • Stripe 案例:5000 萬行程式碼系統遷移,原估兩個月,Fable 一天完成
  • 五張 Apple 健身 App 截圖 → 七分鐘生成可執行 App
  • 定價:比前代旗艦 Opus 貴兩倍;Pro / Max / Team 訂閱含額度使用至 6/22
  • Mythos 曾挖出開源程式庫中藏了 16 年、從未被發現的安全漏洞
  • 下架命令依據:美國國家安全法規,禁對象含 Anthropic 外籍員工
  • Anthropic 公開反駁:政府僅有口頭證據,無公開技術依據
  • 三大下架猜測:①資安(官方說法)②算力吃緊(Fable 問世前 Opus 已頻繁降智)③行銷策略
  • 使用技巧:①拿掉舊模型的手把手指令補丁,只給目標;②先討論任務定義再執行;③Fable 當指揮官規劃,雜活交便宜模型
  • --

結論

結論

再強的 AI 工具都可能一夜消失,讓任何單一模型成為工作流瓶頸是最大的風險——永遠準備好可替換的備案。

完整解析

詳細

2026 年 6 月 9 日,Anthropic 發布了 Claude Fable。要理解 Fable 是什麼,得先從它的前身 Mythos 說起。Mythos 是 Anthropic 訓練出的一個「令人害怕」(官方文件用詞:frightening)等級模型,強到能在一個被全球工程師審視十幾年的開源程式庫中,挖出一個藏了十六年的安全漏洞。正因如此,Mythos 從未對外公開,只限量給少數資安防禦機構使用。Fable 的本質就是 Mythos,差別在於 Anthropic 為其加上了一層安全護欄,試圖鎖住最危險的攻擊性能力,做成一般用戶可以使用的公開版本。

Fable 的能力在多個測試上創下紀錄。SWE-bench Pro(業界標準的程式能力測驗)中,Fable 得分 80.3%,而 GPT-5.5 僅 58.6%,在模型世界中屬於碾壓級差距。Stripe 將其用於五千萬行程式碼的系統遷移,原本工程師估計需要兩個月的工作,Fable 一天就完成。然而 Fable 並非天下無敵,在 Automation Bench(模擬完全無人監管的真實商業流程)中,它的成功率只有 17%——這個數字雖然是全場最高,卻也揭示了它的根本限制:它無法從頭到尾獨立完成跨工具的複雜任務,仍然需要人類在旁邊把關。加上定價約為前代 Opus 的兩倍,而性能相近的 Gemini 3.5 Flash 價格只需四分之一,Fable 的性價比在大多數日常任務上是輸的。

影片作者在 Fable 存活的 72 小時內將其投入真實工作流——影片研究、寫稿、視覺編排全流程——並在 24 小時內燒掉了一整週 Claude Code 額度的 70%。他最有感的是 Fable 的視覺編排能力:過去用舊模型做影片畫面排版,排版跑位、間距錯亂的問題需要來回修多次,Fable 幾乎一次就到位,省去大量來回修改的時間成本。他也分享了三個使用技巧:第一,拿掉過去為舊模型寫的細節指令補丁,只給目標;第二,先餵 context 討論任務定義,確認方向後才讓模型執行;第三,把 Fable 當指揮官用於規劃拆解,瑣碎雜活交給較便宜的模型,最大化其判斷力的價值。

6 月 12 日禮拜五,Anthropic 收到美國政府依國家安全法規發出的命令:禁止所有外國人使用 Fable 與 Mythos,連 Anthropic 自己的外籍員工都不例外。由於 Anthropic 的員工、客戶、供應鏈遍布全球,要做到一個外國人都不能用,唯一辦法就是對所有人關閉。政府的核心理由是:有人找到方法繞過護欄——方法其實就是叫 Fable 讀 code base 然後找問題修問題,這和全世界工程師每天做的事毫無二致。護欄的結構性尷尬在此:它無法分辨你是在修自己的程式,還是在挖別人的漏洞,因為這本質上是同一個動作。Anthropic 公開反駁,指政府僅有口頭證據、無公開技術依據,且此能力是所有 coding 模型(包含 GPT)都具備的普遍功能,並非 Fable 獨有問題,但命令還是當下執行,模型立即下線。社群對下架真相的主流猜測有三:資安(官方說法)、算力吃緊(Fable 問世前 Opus 就已頻繁因算力不足降智,而政府命令恰好給了 Anthropic 一個體面台階)、以及行銷策略(「強到被政府查禁」本身就是最強廣告)。三個原因,作者認為可以同時成立。

---

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing
編輯精選
83 min
AI 技術英文PODCAST8月26日

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing

Latent Space

  • 加速傳統物理模擬的典範轉移:氣象科學家原本認為 AI 無法匹敵數十年的物理建模工作,但傅里葉神經算子不僅達到同等精度,還快了一萬多倍。原本需要超級計算機的計算現在用消費級 GPU 就能完成,這改變了整個領域的思維方式。
  • 傅里葉域的非局部現象捕捉:傅里葉域能有效表示非局部現象(如大氣河流跨越千里的影響),且計算複雜度為準線性,遠優於完全連接的全局模型。這特別適合流體動力學、量子化學等自然現象中普遍存在的非局部相互作用。
  • 多解析度連續函數表示:神經算子將輸入輸出視為連續函數而非固定維度向量,可在推論時以任意解析度查詢,並能在更高解析度上疊加物理約束或額外數據,克服了固定解析度神經網路的限制。
Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Why the Next AI Breakthrough May Come from Physics with Max Welling - #774
55 min
AI 技術英文PODCAST8月25日

Why the Next AI Breakthrough May Come from Physics with Max Welling - #774

TWIML AI

  • 多層篩選的材料設計流程:先搜尋文獻資料庫找現有材料,若無合適的就用生成模型產生數十萬個候選分子,用機器學習力場進行分子動力學模擬篩選,再進行實驗驗證。這套流程相比傳統量子力學計算能加速效率數個數量級。
  • 生成AI與熱力學的數學等價性:資訊論是兩個領域的共同基礎,生成模型的擴散過程與非平衡統計力學描述資訊損失的過程在數學上完全對應,許多開發出來的方法工具在兩領域都有精確對應的形式。
  • 基礎模型的遷移學習策略:先在廣泛材料資料集上訓練基礎力場表示,再針對特定材料類別進行蒸餾微調,既能保持計算效率也能獲得專一性。