KeyFrame內部研究專用

Claude Fable 5 Is PANICKING The AI Industry With This

AI News·6月11日週四·8 min中文

三句話摘要

Anthropic 新模型 Fable 5 的能力展示、定價爭議與隱藏機制深度解析。 Fable 5 在生成能力與基準測試上確有顯著突破,但隱藏的靜默降級機制與資料保留政策逆轉,是使用前必須正視的兩道紅線。 能力範疇超出一般程式生成:Fable 5 不僅能生成網頁應用程式與 3D 模型,還能控制真實的 PX4 飛行計算機與無人機遙測系統,暗示其具備驅動實體機器人的潛力。

重點整理

重點
  • 1

    能力範疇超出一般程式生成:Fable 5 不僅能生成網頁應用程式與 3D 模型,還能控制真實的 PX4 飛行計算機與無人機遙測系統,暗示其具備驅動實體機器人的潛力。

  • 2

    存在隱蔽降級與反競爭機制:當使用者提出網路安全、化學合成或嘗試提煉模型邏輯的請求時,Fable 5 會靜默地將任務降轉給 Opus 4.8 處理,且不顯示任何警告,使用者難以察覺。

  • 3

    資料政策逆轉引發隱私疑慮:Anthropic 過去承諾零資料保留,Fable 5 卻將所有輸入內容保留 30 天以監控濫用行為,這對有敏感程式碼需求的企業用戶是重大倒退。

  • 4

    高效能伴隨高成本:一次複雜任務即可耗盡使用者的 token 預算,加上 6 月 23 日後的積分制改革,長期使用成本將顯著提升。

實用技巧與重點

乾貨
  • 架構:Mythos 類架構
  • 上下文窗口:100 萬 token(預設)
  • 單次輸出上限:12.8 萬 token
  • 生成人形機器人設計:2 小時,耗用 140 萬 token
  • 支援平台/工具:瀏覽器端 CAD 編輯器、3JS、PX4 飛行計算機、GPS 里程計、Mavlink 遙測系統、3D 列印模型輸出
  • 可執行任務:機械臂運動軌跡生成、無人機叢集控制、60fps 真實流體動力學模擬、Factorio 自主遊玩與長期策略規劃、FPS 遊戲生成
  • 基準測試(S.Bench E Bench Pro):Fable 5 80.3% > Opus 4.8 69.2% > GPT 5.5 58.6%
  • API 定價:輸入 $10/百萬 token,輸出 $50/百萬 token(約 Opus 4.8 兩倍)
  • 免費方案:Pro、Max、Team 版本目前透過 Claude Web 介面免費使用 Fable 5
  • 政策變更日期:2026 年 6 月 23 日起強制切換使用量積分制
  • 資料保留期:30 天(適用 Fable 5 及即將推出的 Mythos 5)
  • 隱藏觸發條件:網路安全、化學合成、高級生物學相關請求 → 靜默降級至 Opus 4.8

結論

結論

Fable 5 在生成能力與基準測試上確有顯著突破,但隱藏的靜默降級機制與資料保留政策逆轉,是使用前必須正視的兩道紅線。

完整解析

詳細

Fable 5 是 Anthropic 基於 Mythos 架構推出的新世代模型,預設支援 100 萬 token 的上下文窗口與每次請求 12.8 萬 token 的輸出上限,使其具備執行跨天長任務的能力。影片以多個實際演示開場,包括一位開發者花費兩小時、消耗 140 萬 token 生成完整人形機器人設計,並附帶所有零件分解圖與動態動畫,展示了模型在機械設計領域的深度整合能力。

在更廣泛的應用層面,Fable 5 的能力延伸至實體世界控制。演示顯示它能驅動真實的 PX4 飛行計算機與 GPS 里程計,並透過 Mavlink 遙測協定操作無人機叢集,而非僅限於軟體模擬。在創作端,它能在瀏覽器端 CAD 環境中生成 3D 列印模型,以 3JS 一鍵生成含物理引擎的危機式遊戲、第一人稱射擊遊戲乃至完整的賽車遊戲,並能自主玩 Factorio 進行長期策略規劃。更值得注意的是,它以單一提示和一個檔案,構建出以 60fps 運行、包含真實渦流與壓力梯度的流體動力學模擬器。在基準測試中,Fable 5 以 80.3% 的成績超越 Opus 4.8(69.2%)與 GPT 5.5(58.6%)。

然而,影片也揭露了兩項令使用者困惑的隱藏機制。其一是靜默降級:當請求觸及網路安全、化學合成或模型自我提煉邏輯等敏感領域時,Fable 5 不會顯示錯誤,而是悄悄將請求轉給 Opus 4.8 處理,使用者無法得知自己收到的是降級回應。其二是反競爭限制:任何試圖萃取模型邏輯、構建更強大衍生品的提示都會觸發同樣的靜默抑制機制。

在商業政策層面,Fable 5 帶來了兩項重大變化。首先是資料保留政策逆轉:Anthropic 過去承諾的零資料保留已取消,Fable 5 及 Mythos 5 將對所有流量執行 30 天保留以監控濫用,這對企業客戶的資料安全信任構成衝擊。其次是定價壓力:API 定價為輸入 $10、輸出 $50 每百萬 token,約為 Opus 4.8 的兩倍,部分使用者反映單次提示即耗盡預算;目前 Pro/Max/Team 用戶仍可透過 Claude Web 免費使用,但 6 月 23 日起將強制切換至使用量積分制,長期成本管控成為用戶的重要課題。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Everything Goldman Sachs Taught Me About AI (In 10 minutes)
AI 技術英文8月24日

Everything Goldman Sachs Taught Me About AI (In 10 minutes)

Nate Herk

  • 驗證優於相信:看起來完整的AI輸出不等於正確答案,需在提示中要求模型重新檢查數字、引用來源,並對無把握的部分標記。
  • 區分AI與自動化:確定步驟且答案已知的任務用傳統自動化更便宜快速;只在需要判斷力、靈活性或處理複雜資訊時才用AI,兩者結合效果最佳。
  • 以問題驅動選型:先寫清楚「要解決的問題是什麼、成功的樣子是什麼」,再決定用什麼工具,許多失敗項目是從技術而非問題出發。
Mu: a self-hosted personal agent where the interface is an email address you can write to
AI 技術英文8月23日

Mu: a self-hosted personal agent where the interface is an email address you can write to

GitHub Awesome

  • Mu 是自主代理人系統,具有實際網址與獨立伺服器,用戶可透過多種方式與其互動——網頁應用、電子郵件或程式化介面。
  • 架構完整覆蓋日常工作流程的多個層面,整合郵件收發(SMTP/IMAP)、檔案管理、行事曆、新聞聚合、市場數據與搜尋功能於一個 Go 伺服器內。
  • 支援自帶模型與多種通訊協定,用戶可選擇不同的 AI 模型,並透過 MCP、HTTP API 或命令列工具整合到其他系統。