KeyFrame內部研究專用

Exciting AI Updates Weekly - June 19, 2026

Lev Selector·6月19日週五·23 min英文

三句話摘要

2025年6月19日每週AI速報:涵蓋Claude Fable 5下架風波、GLM 5.2、模型融合(Fusion)、DeepSeek融資、Cursor被收購等十餘項重大更新。 模型Fusion(多模型融合)與Agent Loop架構正在重塑AI應用的成本與能力邊界——用組合取代旗艦、用迴圈取代單次問答,是當前最值得工程師跟進的兩條技術路線。 Claude Fable 5 的政治困局:模型發布後因Amazon CEO Andy Jassy向川普政府示警稱其可能遭越獄利用,行政命令要求Anthropic封鎖外國存取,最終連美國境內使用也被暫停,顯示AI模型已進入地緣政治管制範疇。

重點整理

重點
  • 1

    Claude Fable 5 的政治困局:模型發布後因Amazon CEO Andy Jassy向川普政府示警稱其可能遭越獄利用,行政命令要求Anthropic封鎖外國存取,最終連美國境內使用也被暫停,顯示AI模型已進入地緣政治管制範疇。

  • 2

    模型融合(Fusion)是降本提效的關鍵路徑:Fusion技術允許同時調用多個便宜模型(如Gemini Flash、Kimi、DeepSeek),將其輸出合併為單一高品質回應,實測成本比Claude Fable 5更低且準確率更高,代表「用組合取代旗艦」成為可行策略。

  • 3

    Agentic/Loop工程是現代AI應用的核心架構:現代LLM不再只是單次預測Token,內部已內建「理解→規劃→執行→驗證→輸出」的迴圈邏輯;Agent Engineering作為新興職能,涵蓋目標定義、流程控制、工具整合、LLM-as-Judge品質驗證及可觀測性設計。

  • 4

    記憶系統是Agent能否落地生產的分水嶺:文章定義五種記憶類型(Policy、Preference、Fact、Episodic、Trace),警告不能將所有資料塞入單一向量索引,持久記憶必須存於真實資料庫,並由中央記憶管理器統一調度。

實用技巧與重點

乾貨
  • 數字與成本
  • GLM 5.2:744億參數,1億Token上下文,MIT授權開源
  • DeepSeek融資:74億美元,估值500億美元,梁文鋒個人出資30億美元,政府基金出資1.5億美元
  • SpaceX收購Cursor:60億美元
  • TCS與Anthropic合作:計劃擴充至5萬名AI增強員工
  • DeepSeek + Claude Code組合:成本降低5至10倍
  • Lean向量資料庫:同樣資料從200GB壓縮至6GB
  • MedJourney超音波掃描儀:比MRI便宜10倍、快60倍,解析度達次毫米級
  • 工具與平台
  • 模型:GLM 5.2、Kimi K2.7、Claude Opus、Gemini 3 Flash、DeepSeek V4 Pro
  • 平台:Fusion(模型融合)、Perplexity Brain Memory(Max Pro訂閱)、Databricks(含Delta Lake、MLflow、Unity Catalog、LakeBase)、ARD(Agentic Resource Discovery,agenticresourcediscovery.org)
  • 開發工具:Cursor(AI代碼編輯器)、Claude Code、Ollama、Hugging Face、Lean向量資料庫(Python模組)
  • 晶片:Amazon Trainium(計劃對外銷售,挑戰NVIDIA)
  • 方法與架構
  • Fusion流程:輸入 → 分發給多個模型 → 各自生成回應 → 聚合為統一輸出
  • Loop Engineering:需求理解 → 分步規劃 → 執行 → 自我驗證 → 最終輸出
  • 五種Agent記憶類型:Policy / Preference / Fact / Episodic / Trace
  • Claude Opus作為Orchestrator + DeepSeek處理簡單編碼任務的混合部署模式
  • ARD規格:Apache開源授權,允許發布者暴露AI工具、技能、MCP Server供客戶端發現
  • 新縮寫
  • MANGOS = Meta、Anthropic、Nvidia、Google、OpenAI、SpaceX(取代FAANG)

結論

結論

模型Fusion(多模型融合)與Agent Loop架構正在重塑AI應用的成本與能力邊界——用組合取代旗艦、用迴圈取代單次問答,是當前最值得工程師跟進的兩條技術路線。

完整解析

詳細

本期週報發布於2025年6月19日(美國聯邦假日),講者照常整理了過去一週內最值得關注的AI與科技動態,範圍橫跨模型政策、開源生態、商業融資與架構設計。

最受矚目的事件是 Claude Fable 5 的強制下架。Anthropic 發布該模型僅四天後,Amazon CEO Andy Jassy 向川普政府示警,稱模型可能遭越獄並被用於對美國不利的用途。行政當局隨即發出出口管制指令,要求Anthropic封鎖外國存取;Anthropic起初拒絕(理由是每個模型都有同樣風險),但最終選擇全面停用,連美國境內的企業與政府客戶也受影響。Anthropic目前正與川普政府談判部分或完整恢復存取的條件,結果未定。同期,Anthropic原本計劃於6月15日取消SDK月訂閱方案,最終暫緩執行;但此事促使部分開發者提前評估以DeepSeek等替代模型作為備援。

在開源模型方面,GLM 5.2(智譜AI)以MIT授權發布,744億參數,支援1億Token超長上下文,在編碼任務上的表現獲得大量關注;Kimi K2.7(Moonshot)同樣開源,聚焦研究用途,支援多工具與多代理協作。更值得注意的是Fusion(模型融合)技術的興起:透過將輸入分發給多個便宜模型(如Gemini 3 Flash、Kimi、DeepSeek),再聚合輸出,實際成本比使用單一Claude旗艦模型更低,準確率卻可媲美甚至超越。Mini PC等硬體裝置也開始支援本地Fusion,可混用最多19個模型並以Claude Opus作為仲裁者提升輸出品質。

商業面,DeepSeek 完成74億美元融資,估值500億美元,創辦人梁文鋒個人貢獻30億,政府基金僅出資1.5億,顯示私人資本仍是主力;DeepSeek計劃將資金用於研究與算力擴張,且目前尚未被列入美國政府黑名單。SpaceX 於NASDAQ掛牌(代號SPCX),市值突破一兆美元,成為全球首家達此規模的私人航太公司;掛牌前夕,SpaceX已完成與AI代碼編輯器 Cursor 的收購協議,金額60億美元,代表科技巨頭搶入AI開發工具賽道的趨勢加速。塔塔顧問服務(TCS) 宣布與Anthropic大規模合作,計劃用Claude將5萬名員工的工作產能擴充,是企業級AI落地的標誌性案例。

架構與工程層面,Agentic/Loop Engineering 成為本週反覆出現的核心概念:現代LLM並非單次Token預測,而是內建「規劃→執行→驗證」迴圈的自主系統;Agent Engineering作為新職能,涵蓋目標設定、流程控制、工具整合、可觀測性與安全設計。記憶系統設計方面,一篇被多次引用的文章定義了五種記憶類型(Policy、Preference、Fact、Episodic、Trace),明確警告不能將所有資料倒進單一向量索引,持久記憶必須依賴真實資料庫與中央記憶管理器。此外,ARD(Agentic Resource Discovery) 由Google、Microsoft、Salesforce、Databricks、Snowflake等聯合發布,採Apache開源授權,讓AI工具、技能與MCP Server能被標準化發現,值得注意的是OpenAI與Anthropic並未加入初始陣營。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing
編輯精選
83 min
AI 技術英文PODCAST8月26日

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing

Latent Space

  • 加速傳統物理模擬的典範轉移:氣象科學家原本認為 AI 無法匹敵數十年的物理建模工作,但傅里葉神經算子不僅達到同等精度,還快了一萬多倍。原本需要超級計算機的計算現在用消費級 GPU 就能完成,這改變了整個領域的思維方式。
  • 傅里葉域的非局部現象捕捉:傅里葉域能有效表示非局部現象(如大氣河流跨越千里的影響),且計算複雜度為準線性,遠優於完全連接的全局模型。這特別適合流體動力學、量子化學等自然現象中普遍存在的非局部相互作用。
  • 多解析度連續函數表示:神經算子將輸入輸出視為連續函數而非固定維度向量,可在推論時以任意解析度查詢,並能在更高解析度上疊加物理約束或額外數據,克服了固定解析度神經網路的限制。
Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Why the Next AI Breakthrough May Come from Physics with Max Welling - #774
55 min
AI 技術英文PODCAST8月25日

Why the Next AI Breakthrough May Come from Physics with Max Welling - #774

TWIML AI

  • 多層篩選的材料設計流程:先搜尋文獻資料庫找現有材料,若無合適的就用生成模型產生數十萬個候選分子,用機器學習力場進行分子動力學模擬篩選,再進行實驗驗證。這套流程相比傳統量子力學計算能加速效率數個數量級。
  • 生成AI與熱力學的數學等價性:資訊論是兩個領域的共同基礎,生成模型的擴散過程與非平衡統計力學描述資訊損失的過程在數學上完全對應,許多開發出來的方法工具在兩領域都有精確對應的形式。
  • 基礎模型的遷移學習策略:先在廣泛材料資料集上訓練基礎力場表示,再針對特定材料類別進行蒸餾微調,既能保持計算效率也能獲得專一性。