KeyFrame內部研究專用

Claude 最強模型來了?Mythos 5 與 Fable 5 到底有多誇張

李哈利AI·6月10日週三·8 min中文

三句話摘要

Anthropic發佈Claude Mythos5和Fable5,前者因安全考量未開放大眾,後者搭載防護機制成為最強公開模型。 Fable5以透明防護機制和突破性性能帶來了AI能力的真正躍升,但其高昂定價、隱私數據30天保留政策和訂閱免費期限設置,要求用戶在性能收益與成本隱私間做出審慎權衡。 Mythos5與Fable5的安全折衝:Mythos5因過強而能破解軟體與銀行系統,存在黑客濫用風險,故Anthropic在相同底層模型上加入guardrails(防護欄)形成大眾版Fable5,這反映了AI安全責任與能力開放間的務實平衡。

重點整理

重點
  • 1

    Mythos5與Fable5的安全折衝:Mythos5因過強而能破解軟體與銀行系統,存在黑客濫用風險,故Anthropic在相同底層模型上加入guardrails(防護欄)形成大眾版Fable5,這反映了AI安全責任與能力開放間的務實平衡。

  • 2

    防護機制的透明設計:系統內置分類器自動識別網路安全、生化等敏感領域提問並主動降級至Opus4.8,不會偷偷降級而是明確告知用戶,官方稱95%對話不被攔截,在安全與易用性間找到可行方案。

  • 3

    性能突破的生產力價值:Fable5在編碼、長文本理解等關鍵指標大幅超越現有模型,實際應用中Stripe用其在數天內完成需時兩個月的500萬行Ruby代碼遷移,展現了技術進步的實質商業價值。

  • 4

    隱私與成本的雙重代價:使用Mythos級模型意味著所有交互數據被強制保留30天用於安全監控,定價為市場最高,6月23日後失去訂閱免費額度改為按量計費,要求用戶審慎權衡性能收益與成本隱私成本。

實用技巧與重點

乾貨
  • 性能指標:agented coding從Opus4.8的69%提升到80%
  • 實際案例:Stripe用Fable5完成500萬行Ruby代碼庫的數據庫遷移,從原需2個月縮短到數天
  • 長文本能力:可跨越數百萬TOKEN並保持專注
  • 遊戲表現:Pokémon FireRed測試中比4.8提高三倍表現
  • 安全數據:1000小時漏洞獎賞測試零越獄;Mythos未保護版本網路安全攻擊成功率88.4%
  • 定價:輸入百萬TOKEN 10美元、輸出50美元(約為Opus4.8的1.5倍)
  • 時間表:6月22日前Pro/Max/Team訂閱免費使用;6月23日起僅API按量計費
  • 隱私保留:所有Mythos級模型使用數據強制保留30天,30天後銷毀,官方承諾不用於訓練新模型

結論

結論

Fable5以透明防護機制和突破性性能帶來了AI能力的真正躍升,但其高昂定價、隱私數據30天保留政策和訂閱免費期限設置,要求用戶在性能收益與成本隱私間做出審慎權衡。

完整解析

詳細

Anthropic近日發佈了兩款新模型Claude Mythos5和Fable5,但背後隱藏著複雜的安全與商業考量。Mythos5是Anthropic開發的真正超強模型,其能力足以破解各類軟體系統、銀行系統等敏感基礎設施,因此存在被黑客濫用的嚴重風險。基於這個考量,Anthropic只將Mythos5開放給網路安全機構和供應商使用,普通用戶則無法接觸。而普通用戶能夠使用的是Fable5,它在底層模型完全相同的基礎上,加入了名為「guardrails」的防護欄機制。

Fable5的防護設計相當精妙且透明。系統內置了一個分類器,能自動偵測涉及網路安全、生物化學等敏感領域的提問。一旦發現這類問題,系統不是直接拒絕回答,而是將其轉給上一代的Opus4.8模型來處理。關鍵是這個降級過程完全透明——系統會明確告知用戶發生了降級,而非暗中偷偷進行。官方數據顯示95%以上的日常對話根本不會被攔截,用戶能充分體驗到Mythos級別的強大性能。

Fable5在性能上的提升相當驚人。在編碼能力這一關鍵指標上,agented coding的評分從Opus4.8的69%躍升至80%。更有說服力的是來自Stripe的實測案例——他們用Fable5完成了一個包含500萬行Ruby代碼的大型數據庫遷移項目,這個本應耗時兩個月的工作量被模型在短短數天內完成。除了編碼能力,Fable5在長文本理解上也有飛躍進步,能夠跨越數百萬個TOKEN並始終保持專注。即使在Pokémon遊戲測試這類複雜交互場景中,其表現也比Opus4.8提高了三倍。

然而,這種能力升級伴隨著高昂的成本代價。Fable5的定價為每百萬輸入TOKEN 10美元、輸出50美元,這使其成為目前市場上最昂貴的語言模型,約為Opus4.8的1.5倍。更重要的是有時間限制的設置——6月22日之前,Pro、Max和Team訂閱用戶可以免費使用Fable5;但從6月23日起,Fable5將僅通過API按量計費方式提供,訂閱用戶將無法再享受免費額度。這意味著想要持續使用這個模型的用戶,必須為每次使用付費。

隱私方面也面臨重大變化。為了防止Mythos級模型被濫用,Anthropic強制保留所有使用此級別模型的交互數據30天,用於安全監控和防範惡意使用。官方承諾這些數據會在30天後完全銷毀,且不會用於訓練新模型,純粹是為了安全追踪。但對於重視隱私的用戶而言,這仍是需要認真考慮的隱性成本。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Everything Goldman Sachs Taught Me About AI (In 10 minutes)
AI 技術英文8月24日

Everything Goldman Sachs Taught Me About AI (In 10 minutes)

Nate Herk

  • 驗證優於相信:看起來完整的AI輸出不等於正確答案,需在提示中要求模型重新檢查數字、引用來源,並對無把握的部分標記。
  • 區分AI與自動化:確定步驟且答案已知的任務用傳統自動化更便宜快速;只在需要判斷力、靈活性或處理複雜資訊時才用AI,兩者結合效果最佳。
  • 以問題驅動選型:先寫清楚「要解決的問題是什麼、成功的樣子是什麼」,再決定用什麼工具,許多失敗項目是從技術而非問題出發。
Mu: a self-hosted personal agent where the interface is an email address you can write to
AI 技術英文8月23日

Mu: a self-hosted personal agent where the interface is an email address you can write to

GitHub Awesome

  • Mu 是自主代理人系統,具有實際網址與獨立伺服器,用戶可透過多種方式與其互動——網頁應用、電子郵件或程式化介面。
  • 架構完整覆蓋日常工作流程的多個層面,整合郵件收發(SMTP/IMAP)、檔案管理、行事曆、新聞聚合、市場數據與搜尋功能於一個 Go 伺服器內。
  • 支援自帶模型與多種通訊協定,用戶可選擇不同的 AI 模型,並透過 MCP、HTTP API 或命令列工具整合到其他系統。