KeyFrame內部研究專用

全美最強AI模型被政府一鍵「賜死」,Claude Fable 5 到底觸碰了什麼國家安全底線? ⚡ | Why the US Government Shut Down the Strongest AI

狗蛋與流光·6月14日週日·8 min中文

三句話摘要

美國政府以國家安全為由,在 72 小時內強制關停 Anthropic 最強 AI 模型 Fable 5,揭示 AI 已從商業產品演變為國家戰略武器。 當一個商業 AI 產品可以被政府一封信從全球下架,它從來就不是商業產品,而是以服務形式存在的戰略武器——沒有自主 AI 能力的國家,在這場主權戰中將永遠處於被動。 Fable 5 強制下線事件本質是主權宣示,不只是技術管控。 美國政府無需提供詳細理由,一封信即可讓全球最強商業 AI 從億級用戶手中消失,說明頂尖 AI 能力從未真正屬於商業市場,而是國家掌控的戰略資產。

重點整理

重點
  • 1

    Fable 5 強制下線事件本質是主權宣示,不只是技術管控。 美國政府無需提供詳細理由,一封信即可讓全球最強商業 AI 從億級用戶手中消失,說明頂尖 AI 能力從未真正屬於商業市場,而是國家掌控的戰略資產。

  • 2

    越狱漏洞成為政府介入的導火線,但真實動機更深層。 Pliny the Liberator 使用字符混淆與長上下文拆解兩種技術成功破解 Fable 5,Anthropic 卻明確表示這些漏洞並不獨特,GPT 5.5 同樣有類似問題——政府選擇性關停,暗示有更大的戰略盤算。

  • 3

    AI 軍事化已非推測,有預算與部署數據為證。 五角大廈 2026 財年首次單獨列出 AI 預算線 134 億美元;Claude 早在 2024 年 6 月已被部署於五角大廈機密網路,商業 AI 與軍事 AI 之間的邊界早已模糊。

  • 4

    技術壟斷的歷史邏輯正在 AI 時代重演。 如同火藥、蒸汽機,核心技術掌握者掌控時代話語權;美國透過出口管制鎖住最強 AI 能力,被排除在外的是全球其餘數十億人,這是芯片禁令邏輯的 AI 版延伸。

實用技巧與重點

乾貨
  • 時間線
  • 2026 年 6 月 9 日:Anthropic 發布 Fable 5(無公開發布會)
  • 2026 年 6 月 12 日 17:21(美東時間):美國商務部長 Howard Lutnick 發函要求立即停用
  • 關閉窗口:收到命令後數小時內完成全面關停
  • 模型資訊
  • Fable 5:Anthropic 史上最強模型,定位於 Opus 系列之上,支援長任務深度推理與高度自主代理
  • Mysos 5(Mysosyn):移除所有安全防護的「滿血版」,僅對極少數受信任機構開放
  • 越獄技術(Pliny the Liberator)
  • 手法一:用視覺相似但編碼不同的字符(如以希列爾字母替換拉丁字母)混淆安全過濾器
  • 手法二:將危險請求拆碎嵌入超長對話歷史,使安全分類器顧此失彼
  • 關鍵數據
  • 五角大廈 2026 財年 AI 獨立預算:134 億美元(美國國防史上最大單年度 AI 投資)
  • Claude 部署五角大廈機密網路時間:2024 年 6 月(首個進入機密網路的商業大語言模型)
  • Fable 5 禁用範圍:所有外國用戶,含 Anthropic 外籍員工,無國別例外
  • 同期事件
  • 2026 年 6 月 5 日前後:OpenAI Codex 大規模封號,無預警、無理由,針對批量註冊與繞過地區限制用戶
  • 引述來源
  • 高志凱(國際戰略觀察家):「美國已把 AI 武器化、軍事化,把最高機密數據交給指定八大 AI 公司」

結論

結論

當一個商業 AI 產品可以被政府一封信從全球下架,它從來就不是商業產品,而是以服務形式存在的戰略武器——沒有自主 AI 能力的國家,在這場主權戰中將永遠處於被動。

完整解析

詳細

2026 年 6 月 9 日,Anthropic 沒有任何儀式感地推送了一個名為 Fable 5 的模型。沒有發布會,沒有倒計時,模型直接上線。官方描述它能完成「極度複雜的長任務、深度推理與高度自主的智能代理作業」——白話說,就是給它一個目標,它能自己規劃、自己執行、幾乎不需要人類介入。更關鍵的細節是,Fable 5 之上還存在一個叫 Mysos 5 的版本,那是移除所有安全防護的完整版,只對極少數受信任機構開放。一個 AI 強大到必須套上枷鎖才敢給普通人用,這本身就是一個信號。

然而全球用戶還沒玩夠 72 小時,事情就急轉直下。越獄研究者 Pliny the Liberator 幾乎在 Fable 5 發布當天就找到了突破口。他的手法並不複雜卻極為精妙:第一是用視覺上相似但底層編碼完全不同的字符替換關鍵詞,讓安全過濾器識別不出危險指令;第二是把危險請求拆解成碎片,分散藏入超長的對話歷史中,讓分類器顧此失彼、漏掉關鍵信號。這個越獄演示傳到華盛頓後,6 月 12 日下午 5 點 21 分,美國商務部長 Howard Lutnick 的信函送達 Anthropic,理由只有四個字:「國家安全」。從收到命令到全面關停,只有數小時,沒有商量,沒有緩衝。值得注意的是,Anthropic 公開表示不同意政府的判斷——他們審查了那份越獄演示後認為,這些漏洞並不新穎,也不致命,GPT 5.5 同樣能達到類似效果。但一家公司對抗不了一個國家,這就是現實。

這場關停事件的深層邏輯,要放進更大的座標系裡才能看清楚。國際戰略觀察家高志凱早已在論壇上多次示警:美國政府已明確宣告將最高機密的情報、軍事數據全部交給指定的八大 AI 公司,AI 的武器化與軍事化並非推測,而是公開宣示的戰略現實。數據也支撐這個判斷:美國五角大廈在 2026 財年首次為 AI 和自主系統設立獨立預算線,金額高達 134 億美元,是美國國防史上最大規模的單年度 AI 投資;更早在 2024 年 6 月,Anthropic 的 Claude 就已成為第一個被部署在五角大廈機密網路上的商業大語言模型。與此同時,OpenAI 的 Codex 在同一時期爆發大規模封號潮,批量清洗使用規則灰色地帶的用戶,整套工作流對商業用戶而言一夕歸零。兩件事合在一起,顯示的是同一個方向性收緊:美國正在全方位鞏固對頂尖 AI 能力的主權控制。

Fable 5 的禁用範圍沒有國別例外——不是中國用戶不能用,而是所有外國用戶都被一刀切,連 Anthropic 自家的外籍員工也被踢出門外。這說明這次管控的邏輯本質上和芯片禁令是同一套:核心技術是戰略資產,不是商品,美國隨時可以掐斷供應。高志凱的那句話或許是整件事最精準的注腳:「中國在 AI 競爭中只能成功不能失敗」——不是喊口號,是因為那扇門隨時可能再被關上,而沒有自己的門,就只能永遠等別人來開鎖。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing
編輯精選
83 min
AI 技術英文PODCAST8月26日

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing

Latent Space

  • 加速傳統物理模擬的典範轉移:氣象科學家原本認為 AI 無法匹敵數十年的物理建模工作,但傅里葉神經算子不僅達到同等精度,還快了一萬多倍。原本需要超級計算機的計算現在用消費級 GPU 就能完成,這改變了整個領域的思維方式。
  • 傅里葉域的非局部現象捕捉:傅里葉域能有效表示非局部現象(如大氣河流跨越千里的影響),且計算複雜度為準線性,遠優於完全連接的全局模型。這特別適合流體動力學、量子化學等自然現象中普遍存在的非局部相互作用。
  • 多解析度連續函數表示:神經算子將輸入輸出視為連續函數而非固定維度向量,可在推論時以任意解析度查詢,並能在更高解析度上疊加物理約束或額外數據,克服了固定解析度神經網路的限制。
Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Why the Next AI Breakthrough May Come from Physics with Max Welling - #774
55 min
AI 技術英文PODCAST8月25日

Why the Next AI Breakthrough May Come from Physics with Max Welling - #774

TWIML AI

  • 多層篩選的材料設計流程:先搜尋文獻資料庫找現有材料,若無合適的就用生成模型產生數十萬個候選分子,用機器學習力場進行分子動力學模擬篩選,再進行實驗驗證。這套流程相比傳統量子力學計算能加速效率數個數量級。
  • 生成AI與熱力學的數學等價性:資訊論是兩個領域的共同基礎,生成模型的擴散過程與非平衡統計力學描述資訊損失的過程在數學上完全對應,許多開發出來的方法工具在兩領域都有精確對應的形式。
  • 基礎模型的遷移學習策略:先在廣泛材料資料集上訓練基礎力場表示,再針對特定材料類別進行蒸餾微調,既能保持計算效率也能獲得專一性。