KeyFrame內部研究專用

Fable 5 vs GPT 5.6 Sol: The Early Results

AI Explained·7月2日週四·18 min英文

三句話摘要

GPT 5.6 Sol、Fable 5、Claude Sonic 5 三大模型交鋒下,算力競賽、監管介入與市場集中如何改變 AI 產業格局。 在美國政府監管介入、知識蒸餾成為新戰場、定價策略分化的當下,市場優勢正從絕對性能轉向性能/成本比與政治關係,頭部廠商的權力反而在政府把控下持續強化。 安全分類器的過度敏感困境:Fable 5 在修復亞馬遜發現的漏洞後,安全掃描標準大幅提高(確實 GPT 5.5 也能檢出),但代價是將常規編碼和除錯任務也誤判為恐怖主義協助,實際可用性因此下降。這反映了在政府壓力下,對齊與實用性的直接衝突。

重點整理

重點
  • 1

    安全分類器的過度敏感困境:Fable 5 在修復亞馬遜發現的漏洞後,安全掃描標準大幅提高(確實 GPT 5.5 也能檢出),但代價是將常規編碼和除錯任務也誤判為恐怖主義協助,實際可用性因此下降。這反映了在政府壓力下,對齊與實用性的直接衝突。

  • 2

    定價策略與性能折衷:Sol 雖在 TerminalBench 2.1 略勝 Mythos 5(92% 對 88%),但在網路安全(Exploit Bench)和專科知識(健康、病毒學)基準上略遜,然而成本優勢懸殊——性能/美元比成為新的競爭維度,可能引發市場重新洗牌。

  • 3

    政府監管與市場集中的悖論:OpenAI 向政府提議 5% 股權以換取優先政策待遇,同時 Sol 採用分階段預覽期(政府逐客戶審批)。這與 OpenAI 自身聲稱要「防止企業權力過度集中」的宗旨相悖,實則強化了頭部廠商的門檻。

  • 4

    知識蒸餾戰爭升級:Anthropic 指控的 2,900 萬次 Claude 對話蒸餾案例顯示,境外競爭者規模化竊取美國投資成果。這可能促使各廠商改變策略——延長模型獨占期(3-4 個月)、只向政府與認可企業提供,進一步集中權力。

實用技巧與重點

乾貨
  • 模型版本與定價
  • Fable 5:API 輸入價格基準(Mythos 5 替代品,安全加強版)
  • GPT 5.6 Sol:API 輸入和輸出價格均為 Fable 5 的約 50%
  • Claude Sonic 5:API 價格至 9 月回調前缺乏競爭力
  • 性能基準對比
  • | 基準 | Mythos 5 / Fable 5 | GPT 5.6 Sol | GPT 5.5 |
  • |------|---|---|---|
  • | TerminalBench 2.1 | 88% | 92% (Ultra) | — |
  • | HealthBench Professional | 66.0% | 60.5% | — |
  • | Exploit Bench (網路安全) | 78% | 76% | 48% |
  • | Exploit Bench 輸出 token | 350,000 | 120,000-130,000 | — |
  • | 病毒學 Multiple Choice | 56% | 55.5% | — |
  • Claude Sonic 5 提示注入防守
  • 無防守版本提示注入成功率:<1%
  • Mythos 5:~30%
  • Opus 4.8:32%
  • Sonic 4.6:>50%
  • 監管與市場
  • Anthropic 檢出阿里巴巴/通義模型蒸餾:2,900 萬次對話交換
  • OpenAI 向美政府提議股權:5%
  • Intel 先例(Trump 政府):10% 股權
  • GPT 5.6 Sol 通用發布預期:紀錄時間後 1-2 週內
  • 預覽期政府審批:客戶逐個批准制
  • 研究論文發現(Stanford/MIT/Harvard/Anthropic 聯合)
  • 較大模型因參數優勢可學習稀有任務,不被迫遺忘常見任務特徵
  • 小模型在相同數據下無法習得罕見分佈,預示 US frontier labs 的永久優勢

結論

結論

在美國政府監管介入、知識蒸餾成為新戰場、定價策略分化的當下,市場優勢正從絕對性能轉向性能/成本比與政治關係,頭部廠商的權力反而在政府把控下持續強化。

完整解析

詳細

過去幾週 AI 領域風雲變幻。Fable 5 的重新發布看似簡單,其實另有隱情。亞馬遜先前標記的安全漏洞不只 Anthropic 能檢測,GPT 5.5 甚至中國開源模型也能捕捉。為了不尷尬地承認這一點,美國政府要求 Anthropic 提高安全門檻。結果是什麼?Fable 5 的安全分類器現在過度敏感,連編碼除錯這類日常任務都被誤判為恐怖主義協助。這折射出一個深刻的張力:對齊與可用性的直接衝突。

同時,OpenAI 推出了 GPT 5.6 Sol 作為對標 Fable 系列的回應。定價策略耐人尋味——Sol 的 API 價格僅為 Fable 5 的一半,正是對成本敏感用戶的致命吸引力。但性能如何?講者通過逆向工程兩家廠商的系統卡(system card),找到了少數共同基準點。在健康知識領域,Mythos 5 達 66%,Sol 只有 60.5%;在網路安全的 Exploit Bench 上,Mythos 5 是 78%,Sol 是 76%——數毫厘的差距。更重要的是,Sol 的輸出 token 消耗僅 12-13 萬,不到 Mythos 的三分之一,而 Sol 的 token 本已更便宜。換句話說,性能/美元比上 Sol 成為最優選擇,儘管絕對性能略遜。

政治層面更值關注。OpenAI 向美政府提議給予公司 5% 股權,類似 Intel 年前向 Trump 政府割讓 10% 的先例。這背後是什麼邏輯?講者提出三個理論:其一,搶先獲得政府好感以避免被強硬要求;其二,政府若有股權,為了分紅就有動力快速放開市場、支持 OpenAI 市場佔有率增長;其三,最陰暗的理論是 OpenAI 賭 Anthropic 不會接受此提議,因此能在政府監管下獲得優先地位。值得注意的是,Sol 採分階段預覽發布——政府客戶逐個審批,這進一步強化了頭部廠商的權力。

然而最驚人的新聞或許是 Anthropic 指控阿里巴巴通過 2,900 萬次對話蒸餾 Claude,藉此訓練通義模型。這是迄今最大規模的知識竊取案例。講者推測這可能改變各廠商策略:不再快速開放模型,而是向政府與認可企業獨家供應 3-4 個月,待內部更新後才向公眾發布。結合地緣政治考量,Anthropic 本身的說法最直白——「蒸餾攻擊將美國數千億美元投資轉為對地緣政治競爭對手的巨大補貼」。

權力在流轉。一方面,大模型的參數優勢使美國頭部廠商永遠能學習更多任務模式(這是 Stanford、MIT、Harvard 聯合論文的核心發現);另一方面,政府介入正在集中權力。有時權力落在 Anthropic(最佳模型品質),有時落在 OpenAI(最佳成本效益),有時又飄向開源世界。這個格局在未來幾週將變得更加清晰。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Everything Goldman Sachs Taught Me About AI (In 10 minutes)
AI 技術英文8月24日

Everything Goldman Sachs Taught Me About AI (In 10 minutes)

Nate Herk

  • 驗證優於相信:看起來完整的AI輸出不等於正確答案,需在提示中要求模型重新檢查數字、引用來源,並對無把握的部分標記。
  • 區分AI與自動化:確定步驟且答案已知的任務用傳統自動化更便宜快速;只在需要判斷力、靈活性或處理複雜資訊時才用AI,兩者結合效果最佳。
  • 以問題驅動選型:先寫清楚「要解決的問題是什麼、成功的樣子是什麼」,再決定用什麼工具,許多失敗項目是從技術而非問題出發。
Mu: a self-hosted personal agent where the interface is an email address you can write to
AI 技術英文8月23日

Mu: a self-hosted personal agent where the interface is an email address you can write to

GitHub Awesome

  • Mu 是自主代理人系統,具有實際網址與獨立伺服器,用戶可透過多種方式與其互動——網頁應用、電子郵件或程式化介面。
  • 架構完整覆蓋日常工作流程的多個層面,整合郵件收發(SMTP/IMAP)、檔案管理、行事曆、新聞聚合、市場數據與搜尋功能於一個 Go 伺服器內。
  • 支援自帶模型與多種通訊協定,用戶可選擇不同的 AI 模型,並透過 MCP、HTTP API 或命令列工具整合到其他系統。