KeyFrame內部研究專用

AI News: Fable Banned, New Open-Source Leader, Midjourney Shocker

Matt Wolfe·6月19日週五·35 min英文

三句話摘要

美國政府強制 Anthropic 下架 Claude 旗艦模型,同週 AI 圈爆出開源新模型崛起、MidJourney 跨足醫療等多項重大動態。 --- 美國政府對 Anthropic 的強制下架事件,標誌著 AI 監管已從政策倡議進入實際執法,所有依賴單一前沿模型的開發者與投資人,都必須將政府干預納入核心風險評估。 1. Anthropic 自食其果的監管困局

重點整理

重點
  • 1

    1. Anthropic 自食其果的監管困局

  • 2

    Dario Amodei 曾多次公開主張 AI 模型具有危險性、政府應有權暫停模型發布;美國政府隨後以出口管制為由要求下架 Fable 5 與 Mithos 5,Anthropic 因無法精準分離地區用戶,被迫對全體用戶一律下架——自己的倡議反過來約束了自己,同時也揭示了 AI 公司面臨政府干預的新型系統性風險。

  • 3

    2. 開源模型在性能與成本雙線追趕閉源前沿

  • 4

    GLM 5.2 在 SWE-Bench Pro 超越 GPT-5.5,在 WebDev Arena 盲測排名僅次於 Claude Sonnet,且定價約為 Claude Opus 的五分之一;此格局說明開源生態已不再只是「夠用就好」,而是以顯著的成本優勢對商業模型形成真實競爭壓力。

  • 5

    3. MidJourney 以 AI 圖像獲利反哺醫療硬體,背後藏數據佈局

  • 6

    公司無外部投資人、完全自籌資金,將 Midjourney 平台收益投入全身超音波掃描器研發;計畫打造結合水療與定期健康掃描的 MidJourney Medical 中心,表面是普惠醫療,但大規模收集人體掃描數據用於訓練醫療 AI 模型,才可能是更深遠的戰略意圖。

  • 7

    4. AI 工具鏈在一週內全面補全創作工作流程

  • 8

    OpenAI Codex 推出錄製重播自動化、Perplexity Agent 引入夜間自我學習記憶、Claude Design 支援 GitHub 匯入並直接生成程式碼、Adobe 在 Premiere/Illustrator/InDesign 嵌入 AI 助理——顯示 AI 正從單點功能快速演化為完整創作流程的整合底層。

  • 9

    --

實用技巧與重點

乾貨
  • 具體數字與成本
  • GLM 5.2:753 億參數,100 萬 token 上下文,輸入 $1.40/輸出 $4.40(每百萬 token)
  • Claude Sonnet(Fable 5):$10 輸入/$50 輸出;Claude Opus 4.8:約 $5 輸入/$25 輸出
  • MidJourney Medical 掃描器:約 9,000 個換能器,可辨識 25 種組織類型,目標成本為傳統 MRI 的 1/10
  • 第一間 MidJourney Medical 中心預計 2027 年在新加坡開幕
  • Pew Research:2024 年 33% 美國人使用 AI chatbot → 2026 年 49%;ChatGPT 獨佔 44%
  • BOX 報告:96% 企業認為 AI 需接入公司內部數據,但實際完成接入者僅 36%、68% 企業擔憂供應商鎖定
  • Palmere 影片剪輯:$29–49/月;高階方案 $5,000 可生成 3–7 分鐘創作影片
  • 工具、模型、平台名稱
  • GLM 5.2:chat.z.ai(目前免費)、Hugging Face 可下載,MIT 授權
  • BOX:BOX Extract、BOX Agent、BOX Automate;支援 OpenAI、Anthropic、Google 模型
  • OpenAI Codex:Record & Replay(錄製屏幕操作 → 自動化重現)
  • Perplexity Computer:Agent 自我改進記憶系統,需 Max 或 Enterprise 訂閱
  • Palmere:Claude 驅動的 AI 影片剪輯平台
  • Adobe:AI 助理整合 Premiere、Illustrator、InDesign
  • Google:Ask Ad Manager(類似 YouTube Ask Studio 的廣告優化 AI)
  • Claude Design:支援 GitHub、設計文件、RAW 上傳,並可匯出至 Adobe、Canva、Figma、Lovable、Vercel 等
  • WebDev Arena 排名(盲測)
  • Claude Sonnet(Fable 5)
  • GLM 5.2
  • (Claude Opus 4.8 > GPT-5.5 > 各 Google 模型)
  • --

結論

結論

美國政府對 Anthropic 的強制下架事件,標誌著 AI 監管已從政策倡議進入實際執法,所有依賴單一前沿模型的開發者與投資人,都必須將政府干預納入核心風險評估。

完整解析

詳細

本週 AI 圈最震撼的消息,來自美國政府對 Anthropic 的直接強制干預。政府以出口管制為由,要求 Anthropic 停止向所有非美國用戶提供 Fable 5 與 Mithos 5 兩款 Claude 模型。由於 Anthropic 難以在技術上精確分離用戶地區,最終被迫對全體用戶一律下架,兩款剛發布的旗艦模型一夜消失。事件最弔詭之處在於,Anthropic 執行長 Dario Amodei 此前曾撰文主張政府應有如 FAA 監管飛機般的權限來審查、暫停 AI 模型發布,並多次公開強調模型具潛在危險性;這次政府行動,恰恰是 Dario 自己倡議的監管邏輯付諸實踐。另據 David Sacks 透露,政府曾向 Anthropic 提供豁免路徑但遭拒;更耐人尋味的是,Anthropic 最大投資人 Amazon 的執行長 Andy Jassy 據報曾向美國政府官員警示 Anthropic 模型的安全風險——一個投資人主動推動被投資公司的模型下架,邏輯上令人費解。對 AI 投資人而言,此事件傳遞出一個新的警訊:政府可以在一夜之間命令某款估值逾 965 億美元的模型下線。

開源陣營本週迎來強勁選手。Zhipu AI 發布 GLM 5.2,753 億參數、MIT 授權、100 萬 token 上下文視窗,規格比肩前沿閉源模型,但定價卻僅有 Claude Opus 的約五分之一。在 SWE-Bench Pro 代碼評測上,GLM 5.2 超越 GPT-5.5;WebDev Arena 盲測排名中,僅次於 Claude Sonnet 位居第二。作者親自測試,要求 GLM 5.2 複刻 Megabonk 遊戲,模型在三輪迭代後成功讓遊戲可運行,配色表現不俗,但遊戲邏輯與原版仍有明顯差距——整體未達 Claude Sonnet 水準,但就開源、低成本模型而言,表現已屬相當突出。

MidJourney 本週宣布跨足醫療領域,其核心硬體是配備約 9,000 個超音波換能器的全身掃描裝置:受試者進入水槽,換能器在周圍旋轉發出聲波,以遠低於傳統 MRI 的成本生成人體斷層影像,可辨識 25 種組織類型。MidJourney 的計畫並非進駐醫院,而是打造名為「MidJourney Medical」的高端健康水療中心,首間預計 2027 年在新加坡開幕,主打舒適的定期健檢體驗,鼓勵民眾追蹤身體長期變化。由於公司完全無外部投資人、靠 Midjourney 平台獲利自籌,此舉被視為難得的社會回饋;但也有醫學評論者指出,超音波在肺部、骨骼等含氣組織的影像上有先天限制,不應與 MRI 或 CT 直接類比。作者則推測,大規模收集人體掃描數據以訓練醫療 AI,或許才是更深遠的商業圖謀。

本週其他值得關注的更新密集爆發:OpenAI Codex 新增「錄製重播」功能,錄下操作流程後即可一鍵重現自動化;Perplexity 為 Computer Agent 引入夜間自學機制,根據過往操作持續優化決策;Claude Design 支援從 GitHub 直接匯入設計文件並生成程式碼;Adobe 在 Premiere、Illustrator、InDesign 中嵌入 AI 助理;Palmere 以 Claude 為核心推出 AI 影片剪輯平台。Pew Research 的調查數據則揭示一個矛盾現象:2026 年已有 49% 美國人使用 AI chatbot(兩年前僅 33%),但與此同時,越來越多年輕人預期 AI 將對社會帶來負面影響——使用率上升與負面感受共存,反映的是大眾對不同類型 AI 應用截然不同的評價,而非對 AI 整體態度的簡單二元化。

---

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing
編輯精選
83 min
AI 技術英文PODCAST8月26日

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing

Latent Space

  • 加速傳統物理模擬的典範轉移:氣象科學家原本認為 AI 無法匹敵數十年的物理建模工作,但傅里葉神經算子不僅達到同等精度,還快了一萬多倍。原本需要超級計算機的計算現在用消費級 GPU 就能完成,這改變了整個領域的思維方式。
  • 傅里葉域的非局部現象捕捉:傅里葉域能有效表示非局部現象(如大氣河流跨越千里的影響),且計算複雜度為準線性,遠優於完全連接的全局模型。這特別適合流體動力學、量子化學等自然現象中普遍存在的非局部相互作用。
  • 多解析度連續函數表示:神經算子將輸入輸出視為連續函數而非固定維度向量,可在推論時以任意解析度查詢,並能在更高解析度上疊加物理約束或額外數據,克服了固定解析度神經網路的限制。
Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Why the Next AI Breakthrough May Come from Physics with Max Welling - #774
55 min
AI 技術英文PODCAST8月25日

Why the Next AI Breakthrough May Come from Physics with Max Welling - #774

TWIML AI

  • 多層篩選的材料設計流程:先搜尋文獻資料庫找現有材料,若無合適的就用生成模型產生數十萬個候選分子,用機器學習力場進行分子動力學模擬篩選,再進行實驗驗證。這套流程相比傳統量子力學計算能加速效率數個數量級。
  • 生成AI與熱力學的數學等價性:資訊論是兩個領域的共同基礎,生成模型的擴散過程與非平衡統計力學描述資訊損失的過程在數學上完全對應,許多開發出來的方法工具在兩領域都有精確對應的形式。
  • 基礎模型的遷移學習策略:先在廣泛材料資料集上訓練基礎力場表示,再針對特定材料類別進行蒸餾微調,既能保持計算效率也能獲得專一性。