KeyFrame內部研究專用

Anthropic vs OpenAI: Inside the August 2026 AI Update War

NextByte Tech··3 min英文

三句話摘要

8月份AI業界加速迭代:Anthropic推出推理升級、企業自託管與生態工具整合。 Anthropic透過推理優化、企業級基礎設施與MCP生態擴張,建構了一個更靈活、更安全、更易整合的AI開發平台。 推理能力的自適應機制取代了過去的固定budget模式,Fable 5與Mythos 5將思考永遠開啟,但只展示摘要而非完整思路鏈,平衡了深度思考與使用效率。

重點整理

重點
  • 1

    推理能力的自適應機制取代了過去的固定budget模式,Fable 5與Mythos 5將思考永遠開啟,但只展示摘要而非完整思路鏈,平衡了深度思考與使用效率。

  • 2

    企業基礎設施邁入新階段,自託管Claude Code讓公司完全掌控AI執行環境,AI可存取內部系統同時確保敏感資料不出網,解決了許多企業的隱私顧慮。

  • 3

    Managed Agents功能引入細粒度存取控管,管理員可限制代理能操作的網站與工具清單,防止無預期的權限濫用,提升了代理部署的安全性與可控性。

  • 4

    MCP已成為業界標準,跨越Anthropic與OpenAI等對手的陣營,新版本簡化架構設計大幅降低開發門檻,推動了AI模型與外部系統整合的普及化。

實用技巧與重點

乾貨
  • 發布規模:11個重大模型、5家公司、20天
  • Anthropic新模型:Fable 5、Mythos 5
  • 推理努力等級:standard、high、x-high、max
  • 新上線工具:Files API、Agent Skills、Admin API 使用者管理
  • Claude Code 自託管選項:公開測試版
  • Managed Agents:限制代理存取的網站與AI工具範圍
  • MCP 指標:4億月下載、4倍年增長
  • MCP 升級:無狀態設計(降低開發與部署成本)
  • 新服務:Claude Academy(免費線上學習中心)
  • 未確認傳聞:Claude Opus 5、Mythos 6

結論

結論

Anthropic透過推理優化、企業級基礎設施與MCP生態擴張,建構了一個更靈活、更安全、更易整合的AI開發平台。

完整解析

詳細

8月份的AI業界迎來了前所未有的發布密度——20天內有11個重大模型從5家不同廠商相繼推出。這不是年度盛況,而是過去三週發生的常態。這種加速節奏反映出Anthropic和OpenAI每週都在推送更新,背景是市場上的基準模型在6個月內就從領先跌到中等水準。

Anthropic的推理系統迎來了關鍵升級。過去開發者必須為Claude的思考過程預設一個固定的token預算,限制了靈活性。新版本引入了自適應推理,讓開發者只需選擇一個努力等級(standard、high、x-high或max),Claude會根據任務複雜度內部自動決定需要多少推理時間。在最新的Fable 5和Mythos 5模型上,思考過程始終處於開啟狀態,但使用者只會看到推理的摘要而非完整的思路鏈,這既保護了思考細節的細膩性,也使最終輸出更加簡潔有力。

企業級平台也在大幅升級。Files API、Agent Skills和Admin API的使用者管理等多項工具已從測試版畢業,成為正式功能。更具重大意義的是,Claude Code推出了自託管選項(目前為公開測試版),讓企業能夠在自己的基礎設施上運行Claude Code的所有雲端會話。這對需要處理敏感資料的組織而言是一個突破——AI助手可以直接存取公司內部的系統與工具,同時確保資料完全不離開企業網路。與此同時,Managed Agents功能為代理增加了精細的存取控管,讓管理員明確指定代理可以操作哪些網站和AI工具,防止代理無意間進入不該進入的區域。

在生態層面,MCP(Model Context Protocol)實現了爆發式增長。MCP是一個通用協議,使AI模型能連接外部應用程式和資料源。它的月下載量已達4億次,相較去年增長了4倍。更值得注意的是,連OpenAI等競爭對手也採用了MCP,證明它已成為事實上的業界標準。MCP本身也進行了重大升級,改為無狀態架構設計,這大幅簡化了開發實現,降低了部署成本。此外,Anthropic還推出了Claude Academy,一個免費的學習中心,提供課程和教程,目標是教會人們如何真正有效地使用AI,而不僅是簡單地存取它。

需要澄清的是,網路上確實流傳著Claude Opus 5和Mythos 6等新模型的傳言,但這些訊息並未獲得Anthropic的官方確認。在正式公告前,應將這些視為發展中的故事而非已板釘的事實。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing
編輯精選
83 min
AI 技術英文PODCAST8月26日

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing

Latent Space

  • 加速傳統物理模擬的典範轉移:氣象科學家原本認為 AI 無法匹敵數十年的物理建模工作,但傅里葉神經算子不僅達到同等精度,還快了一萬多倍。原本需要超級計算機的計算現在用消費級 GPU 就能完成,這改變了整個領域的思維方式。
  • 傅里葉域的非局部現象捕捉:傅里葉域能有效表示非局部現象(如大氣河流跨越千里的影響),且計算複雜度為準線性,遠優於完全連接的全局模型。這特別適合流體動力學、量子化學等自然現象中普遍存在的非局部相互作用。
  • 多解析度連續函數表示:神經算子將輸入輸出視為連續函數而非固定維度向量,可在推論時以任意解析度查詢,並能在更高解析度上疊加物理約束或額外數據,克服了固定解析度神經網路的限制。
Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Why the Next AI Breakthrough May Come from Physics with Max Welling - #774
55 min
AI 技術英文PODCAST8月25日

Why the Next AI Breakthrough May Come from Physics with Max Welling - #774

TWIML AI

  • 多層篩選的材料設計流程:先搜尋文獻資料庫找現有材料,若無合適的就用生成模型產生數十萬個候選分子,用機器學習力場進行分子動力學模擬篩選,再進行實驗驗證。這套流程相比傳統量子力學計算能加速效率數個數量級。
  • 生成AI與熱力學的數學等價性:資訊論是兩個領域的共同基礎,生成模型的擴散過程與非平衡統計力學描述資訊損失的過程在數學上完全對應,許多開發出來的方法工具在兩領域都有精確對應的形式。
  • 基礎模型的遷移學習策略:先在廣泛材料資料集上訓練基礎力場表示,再針對特定材料類別進行蒸餾微調,既能保持計算效率也能獲得專一性。