KeyFrame內部研究專用

Claude Fable 5 is Anthropic's Most POWERFUL Model EVER and It's NOW PUBLIC!

World of AI·6月9日週二·10 min英文

三句話摘要

Anthropic 發布 Fable 5——首個向公眾開放的 Mythos 級超大語言模型 Fable 5 是 Anthropic 有史以來最強的公開模型,通過卓越的長任務處理能力和代碼生成效率重新定義了 AI 編程與任務自動化的可能性邊界。 長期任務是突破口。短期工作其他模型已可勝任,但需要數小時無人類干預的複雜多步驟工作是 Fable 5 的真正優勢,這決定了與 Opus 在生產力上的關鍵差異。

重點整理

重點
  • 1

    長期任務是突破口。短期工作其他模型已可勝任,但需要數小時無人類干預的複雜多步驟工作是 Fable 5 的真正優勢,這決定了與 Opus 在生產力上的關鍵差異。

  • 2

    軟體工程與代碼生成能力達生產級。Minecraft 克隆在 55 分鐘內耗 52.4k tokens 完成複雜場景;恐龍跑酷遊戲僅用 629 行代碼在 11-12 分鐘內實現完整交互功能,展現模型在代碼品質與效率上的突破性進步。

  • 3

    視覺、記憶與科學推理同步突破。能從科學圖表提取精確數值、僅從截圖重建網頁源碼;使用持久記憶時性能提升是 Opus 4.0 的 3 倍;在蛋白質折疊預測等生物任務上超越專業模型。

  • 4

    防護設計避免簡單粗暴拒絕。在網路安全、生物學、化學、模型蒸餾四個風險領域將請求轉交 Opus 4.8,而非直接拒絕,95% 以上正常使用不受影響,同時防止惡意利用。

實用技巧與重點

乾貨
  • 能力數據
  • Minecraft 克隆:55 分鐘生成、52.4k tokens、包含多生物群系、昼夜循環、礦石洞穴系統
  • 恐龍跑酷遊戲:11-12 分鐘、914k tokens、629 行代碼、手勢識別完整運作
  • 3D 世界構建、體素世界演示展現高細節資產生成
  • 視覺能力:從複雜科學圖表提取數值、僅從截圖重建網頁應用
  • 記憶能力:百萬 token 長度任務中保持專注,持久記憶性能提升 3 倍(vs Opus 4.0)
  • 科學能力:蛋白質折疊預測戰勝專業模型
  • 安全措施
  • 分流領域四項:網路安全、生物學、化學、模型蒸餾
  • 分流率:平均少於 5% 會話觸發分流,95% 以上直接使用完整模型
  • 30 天數據保留期:捕捉跨多次請求的新型越獄與攻擊
  • 防護設計:轉交至 Opus 4.8 而非簡單拒絕
  • 定價與可用性
  • 輸入成本:每百萬 token 10 美元
  • 輸出成本:每百萬 token 50 美元(約為 Mythos 預覽版一半)
  • 免費提供期間:2026 年 6 月 21-22 日(Pro Max、Team、座位制企業計劃)
  • 6 月 23 日起:需購買額度使用
  • API 與消費型企業計劃:從第一天起完全可用
  • 後續計劃:待容量允許後納入標準訂閱(無確定日期)
  • 測評平台
  • World of AI Bench:用戶自行運行、16+ 前沿模型、10 個編碼類別對標
  • Can I Run It Tool:提示前查詢成本
  • AI 評審團評分維度:功能性、設計、代碼質量、創意

結論

結論

Fable 5 是 Anthropic 有史以來最強的公開模型,通過卓越的長任務處理能力和代碼生成效率重新定義了 AI 編程與任務自動化的可能性邊界。

完整解析

詳細

2026 年 6 月 21 日,Anthropic 發布了 Fable 5,這是該公司歷史上首次向普通用戶開放 Mythos 級模型。要理解這一發布的重要性,需要先了解 Anthropic 的模型分層體系。此前公眾可用的最強模型是 Opus,但在今年 4 月,Anthropic 推出了更高層級的 Mythos 級模型。當時的 Mythos Preview 僅限 Project Glasswing 項目中的網路防禦人士和美國政府機構使用,普通用戶無法接觸。Fable 5 改變了這一局面,成為首個向大眾開放的 Mythos 級模型。

值得注意的是,Fable 5 和 Mythos 5 實際上基於完全相同的底層模型、相同的權重與訓練過程,唯一區別在於安全防護層。Mythos 是為信任的防禦者和政府移除網路安全防護的版本,而 Fable 則在其上層應用了一套分流式防護措施供普通用戶使用。這種設計允許 Anthropic 在管理風險的同時,讓最先進的能力惠及更廣泛的用戶群體。

在能力表現上,Anthropic 宣稱 Fable 5 在他們測試的幾乎所有基準上都達到了最先進水平。從模式來看,任務越長、越複雜,Fable 的領先優勢就越明顯。短期工作往往已被其他模型妥善處理,但那些需要數小時連續運行、中間無人類干預的複雜多步驟工作,正是 Fable 5 真正擅長的領域。軟體工程能力是 Anthropic 特別強調的一點——不僅能自主工作更長時間,而且更節省 token 成本,這對按 token 付費的用戶至關重要。演示中的案例充分說明了這一點:一個完整的 Minecraft 克隆在 55 分鐘內生成,僅消耗 52,400 個 tokens,包含多個生物群系、晝夜循環、礦石和洞穴系統;一個恐龍跑酷遊戲的完整實現僅用 629 行代碼就在 11-12 分鐘內生成,token 消耗約 914,000 個。

視覺能力、記憶能力和科學推理也都取得了突破。Fable 5 能從複雜的科學圖表中提取精確數值,甚至能僅從網頁截圖重建應用源代碼。在使用基於文件的持久記憶時,其性能提升幅度是 Opus 4.0 的三倍。科學能力方面,Anthropic 演示了模型在預測遺傳變化如何影響病毒外殼組裝時的表現——這項任務模型未經特定訓練,卻仍然超過了專業的蛋白質預測模型。這項能力的雙重用途屬性也正是為什麼生物學被列入受限領域的原因。

為了管理這種強大能力帶來的風險,Anthropic 設計了一套巧妙的分流防護機制。當用戶在網路安全、生物學、化學或模型蒸餾這四個領域提出請求時,系統會將請求轉交給 Opus 4.8 處理,而非簡單拒絕。統計數據表明,這種分流在平均情況下僅在少於 5% 的會話中觸發,意味著用戶 95% 以上的時間都在與完整的 Fable 模型交互。此外,Anthropic 現在要求所有 Mythos 級模型流量保留 30 天數據,用於捕捉跨多次請求演變的新型越獄和攻擊模式。

從可用性和定價角度看,Fable 5 的定價為每百萬輸入 tokens 10 美元,每百萬輸出 tokens 50 美元,這約為之前 Mythos 預覽版成本的一半。從 6 月 21-22 日,Pro Max、Team 和座位制企業計劃用戶可免費使用 Fable 5。6 月 23 日起,繼續使用需購買額度。API 用戶和消費型企業計劃從第一天起就完全可用。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing
編輯精選
83 min
AI 技術英文PODCAST8月26日

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing

Latent Space

  • 加速傳統物理模擬的典範轉移:氣象科學家原本認為 AI 無法匹敵數十年的物理建模工作,但傅里葉神經算子不僅達到同等精度,還快了一萬多倍。原本需要超級計算機的計算現在用消費級 GPU 就能完成,這改變了整個領域的思維方式。
  • 傅里葉域的非局部現象捕捉:傅里葉域能有效表示非局部現象(如大氣河流跨越千里的影響),且計算複雜度為準線性,遠優於完全連接的全局模型。這特別適合流體動力學、量子化學等自然現象中普遍存在的非局部相互作用。
  • 多解析度連續函數表示:神經算子將輸入輸出視為連續函數而非固定維度向量,可在推論時以任意解析度查詢,並能在更高解析度上疊加物理約束或額外數據,克服了固定解析度神經網路的限制。
Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Why the Next AI Breakthrough May Come from Physics with Max Welling - #774
55 min
AI 技術英文PODCAST8月25日

Why the Next AI Breakthrough May Come from Physics with Max Welling - #774

TWIML AI

  • 多層篩選的材料設計流程:先搜尋文獻資料庫找現有材料,若無合適的就用生成模型產生數十萬個候選分子,用機器學習力場進行分子動力學模擬篩選,再進行實驗驗證。這套流程相比傳統量子力學計算能加速效率數個數量級。
  • 生成AI與熱力學的數學等價性:資訊論是兩個領域的共同基礎,生成模型的擴散過程與非平衡統計力學描述資訊損失的過程在數學上完全對應,許多開發出來的方法工具在兩領域都有精確對應的形式。
  • 基礎模型的遷移學習策略:先在廣泛材料資料集上訓練基礎力場表示,再針對特定材料類別進行蒸餾微調,既能保持計算效率也能獲得專一性。