KeyFrame內部研究專用

Claude Fable 5 + GPT-5.5 = GOD MODE

World of AI·6月12日週五·13 min英文

三句話摘要

如何結合 Claude Fable 5 和 GPT-5.5 建立高效能 AI 應用開發工作流程,在規劃與執行之間取得平衡,避免成本和速率限制。 Fable 5 與 GPT-5.5 的混合策略(前者負責規劃與架構、後者負責執行)是在保持頂級品質的同時規避高成本與速率限制的最明智方法,能讓開發者以最優性價比完成複雜的 AI 應用開發工作。 Fable 5 的能力與成本困境

重點整理

重點
  • 1

    Fable 5 的能力與成本困境

  • 2

    Fable 5 在前端設計、遊戲創作、系統設計等複雜任務中表現出色,能在數分鐘內完成通常需數千美元或數月的工程。但其定價(輸入 $10/M tokens、輸出 $50/M tokens)與嚴格的速率限制,使得即使付費用戶也容易快速耗盡額度,從 6 月 23 日起更將從订阅套餐中移除。

  • 3

    Deep Suite 基準測試的關鍵發現

  • 4

    Fable 5 和 GPT-5.5 在同一基準測試上的成功率相同(均 70%),但成本差異明顯:Fable 5 每任務 $10.30、GPT-5.5 每任務 $6.60。這表明可以根據任務性質選擇模型,而非盲目使用更昂貴的選項。

  • 5

    架構師與建造者的分工策略

  • 6

    用 Fable 5 進行深度思考與架構設計(提供項目需求、系統設計、複雜邏輯、高層決策),再用 GPT-5.5 執行編碼、文檔生成、錯誤修復等重工作。Fable 5 的優勢在於對複雜結構的理解,GPT-5.5 擅長跟隨指令與高效執行。

  • 7

    實際工作流程與工具選擇

  • 8

    展示透過 Claude Code 的 Plan Mode(用 Fable 5)與 Execute Mode 切換,或使用開源 Kilo Code 工具直接在一個介面中整合兩種模型,同時支援引入自有 API 金鑰,降低成本與技術門檻。

實用技巧與重點

乾貨
  • 定價與費率限制(Fable 5)
  • 輸入代幣:每百萬 $10
  • 輸出代幣:每百萬 $50
  • 免費期限:6 月 21 日至 6 月 22 日(包含於 Pro、Max、Team、Seatbased Enterprise 套餐)
  • 6 月 23 日起:從訂閱套餐移除,需額外使用積分
  • Deep Suite 基準測試結果
  • | 模型 | 成功率 | 每任務成本 |
  • |------|-------|---------|
  • | Claude Fable 5 | 70% | $10.30 |
  • | GPT-5.5 | 70% | $6.60 |
  • | Claude Opus 4.8 | 58% | $12.60 |
  • 推薦工作流程工具
  • Claude Code(需 Claude 專業計畫)— Plan Mode 與 Execute Mode
  • Kilo Code(開源)— 在一個介面整合 Plan 與 Execute,支援自有 API 金鑰
  • Flova(視頻創意平台)— 整合圖像生成、視頻製作、音樂編輯、資產管理
  • 展示案例中的具體功能
  • Windows 風格作業系統模擬(含副駕駛 AI 克隆、SVG 圖示、應用、遊戲、互動視窗)
  • Minecraft 風格克隆遊戲(含製作系統、水體物理、多生物群落、晝夜循環、地形生成、怪物、遊戲系統)
  • AI 新聞研究代理(含前端界面、多主題新聞彙編、掃描與更新功能)

結論

結論

Fable 5 與 GPT-5.5 的混合策略(前者負責規劃與架構、後者負責執行)是在保持頂級品質的同時規避高成本與速率限制的最明智方法,能讓開發者以最優性價比完成複雜的 AI 應用開發工作。

完整解析

詳細

Claude Fable 5 自發佈以來展現了令人矚目的能力——從網頁開發到遊戲創作、3D 世界構建再到複雜智能體編碼,它能在數分鐘內完成通常耗資數千美元或數月的工程工作。演示中的 Windows 風格作業系統與 Minecraft 克隆遊戲充分展現了其深度思考與設計能力,整個體驗不僅有精美界面,更包含真實的功能邏輯與系統行為。然而,這種強大能力伴隨著實際的成本困境:定價為每百萬輸出代幣 50 美元,遠高於競品,且速率限制極為嚴格——僅用兩個詳細提示就能達到使用上限。

講者提出的解決方案是建立「架構師與建造者」的分工模式。根據 Deep Suite 基準測試的洩露數據,Fable 5 與 GPT-5.5 的成功率相同(均 70%),但成本差異明顯:Fable 5 每任務 $10.30、GPT-5.5 每任務 $6.60。關鍵洞察在於,Fable 5 的最大優勢不在執行,而在於複雜的系統設計與深度思考——它能更好地理解項目結構、進行高層決策與架構規劃。因此,最聰明的策略是用 Fable 5 進行規劃與架構(這正是它的強項),再用 GPT-5.5 進行編碼、文檔生成、錯誤修復等執行工作(既經濟又高效)。

實現這個工作流程有多種方式。對於擁有 Claude 專業計畫的用戶,可直接在 Claude Code 中切換 Plan Mode(使用 Fable 5)與 Execute Mode(使用 GPT-5.5)。若無訂閱,可使用開源工具 Kilo Code,直接在單一介面整合兩種模型,並支援引入自有 API 金鑰。演示中,講者在 Plan Mode 中詳細描述需求(建立供 YouTube 創作者使用的 AI 新聞研究代理),Fable 5 生成完整的架構與實現計劃,隨後在 Execute Mode 中將其交給 GPT-5.5,後者在數分鐘內完成了包括精美前端界面在內的全棧實現。最終產品包含多主題新聞彙編、掃描功能、新聞源管理等完整功能。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Everything Goldman Sachs Taught Me About AI (In 10 minutes)
AI 技術英文8月24日

Everything Goldman Sachs Taught Me About AI (In 10 minutes)

Nate Herk

  • 驗證優於相信:看起來完整的AI輸出不等於正確答案,需在提示中要求模型重新檢查數字、引用來源,並對無把握的部分標記。
  • 區分AI與自動化:確定步驟且答案已知的任務用傳統自動化更便宜快速;只在需要判斷力、靈活性或處理複雜資訊時才用AI,兩者結合效果最佳。
  • 以問題驅動選型:先寫清楚「要解決的問題是什麼、成功的樣子是什麼」,再決定用什麼工具,許多失敗項目是從技術而非問題出發。
Mu: a self-hosted personal agent where the interface is an email address you can write to
AI 技術英文8月23日

Mu: a self-hosted personal agent where the interface is an email address you can write to

GitHub Awesome

  • Mu 是自主代理人系統,具有實際網址與獨立伺服器,用戶可透過多種方式與其互動——網頁應用、電子郵件或程式化介面。
  • 架構完整覆蓋日常工作流程的多個層面,整合郵件收發(SMTP/IMAP)、檔案管理、行事曆、新聞聚合、市場數據與搜尋功能於一個 Go 伺服器內。
  • 支援自帶模型與多種通訊協定,用戶可選擇不同的 AI 模型,並透過 MCP、HTTP API 或命令列工具整合到其他系統。