KeyFrame內部研究專用

Gemini 4 Is Coming, 3.5 Pro Is Being Left Behind!

World of AI·7月26日週日·9 min英文

三句話摘要

2026年7月AI模型發展現況:Google DeepMind延遲Gemini 3.5 Pro、轉向Gemini 4,而Opus 5在遊戲開發領域取得突破。 Google放棄Gemini 3.5 Pro轉向Gemini 4,反映出新一代模型競爭已不在迭代速度而在絕對能力,同時Opus 5在遊戲開發領域的突破預示AI創意工程應用即將進入商業化階段。 Google策略轉向:原訂6月發布的Gemini 3.5 Pro至今延期,官方團隊成員在X平台上對此隻字未提直到被追問,反而大力宣傳Gemini 4預訓練進展,明確反映Google已判定3.5 Pro無法與競品抗衡,決定集中資源賭Gemini 4。

重點整理

重點
  • 1

    Google策略轉向:原訂6月發布的Gemini 3.5 Pro至今延期,官方團隊成員在X平台上對此隻字未提直到被追問,反而大力宣傳Gemini 4預訓練進展,明確反映Google已判定3.5 Pro無法與競品抗衡,決定集中資源賭Gemini 4。

  • 2

    競品壓力加劇:Kimmy K3、Opus 5、GPT 5.6等模型陸續發布,推高了業界性能基準,迫使Google重新評估發布策略,寧可承受短期聲譽受損也要聚焦長期競爭力。

  • 3

    遊戲開發成為新戰場:Opus 5展示出單次生成完整、無外部資源依賴的遊戲代碼能力(包括第一人稱射擊遊戲、五對五多人競技等),其他模型在複雜地圖設計上還在掙扎,反映出當前模型在創意工程領域的差距。

  • 4

    3D模型創建技術躍進:各家實驗室都在優化3D生成,Gemini 3.5 Pro測試版本在直升機、飛機等3D物體生成上表現出可見進步,成為衡量前沿模型的新指標。

實用技巧與重點

乾貨
  • 2026年7月發布/預期模型
  • Kimmy K3(Moonshot AI開源模型)
  • GPT 5.6、Luna、Terra(OpenAI)
  • Claude Opus 5(Anthropic)
  • Gemini 3.6 Flash(Google DeepMind)
  • Gemini 3.5 Pro(延期中,最後公開信息日期:2026年7月21日,預計發布時間待定)
  • Gemini 4(在預訓練階段)
  • 具體成果案例
  • Opus 5單次生成的第一人稱射擊遊戲(100%自訂代碼,零外部資源)
  • Opus 5生成的五對五Call of Duty風格多人競技遊戲(約半小時生成)
  • Gemini 3.5 Pro測試版生成的直升機、空巴飛機3D模型
  • 2D/3D遊戲範例(雪橇滑行遊戲等)
  • 延遲信息
  • Gemini 3.5 Pro原定6月發布,至7月26日仍未正式推出
  • 官方說法(7月21日):正在與夥伴測試,計畫近期發布
  • 內部原因:編碼性能不達預期、基礎模型被整個拆掉重做
  • 官方公開表態
  • Logan(Google AI Studio負責人、Google DeepMind核心成員)確認Gemini 4在預訓練中
  • Google優先方向:編碼與自主代理
  • Gemini 3.5 Pro不再被定位為「大復出模型」

結論

結論

Google放棄Gemini 3.5 Pro轉向Gemini 4,反映出新一代模型競爭已不在迭代速度而在絕對能力,同時Opus 5在遊戲開發領域的突破預示AI創意工程應用即將進入商業化階段。

完整解析

詳細

2026年7月對生成式AI產業而言是模型密集發布期。先是Moonshot AI推出開源模型Kimmy K3,以成本優勢短暫領先;隨後OpenAI連發GPT 5.6、Luna、Terra;Anthropic也推出Claude Opus 5。這波新品潮改寫了競爭格局,原本預期領導者的Google DeepMind卻意外沉寂。

預定6月發布的Gemini 3.5 Pro遲未現身。分析其延期原因,演講者指出該模型開發過程中編碼性能未達內部預期,Google甚至重做了基礎模型。更值得觀察的是官方態度轉變——Google DeepMind員工、Gemini技術負責人在社群媒體上對Gemini 4語氣熱烈(「我們啟動了有史以來最雄心勃勃的預訓練」),卻對Gemini 3.5 Pro隻字未提,直到被追問才在留言中輕描淡寫回應「正與夥伴測試,計畫近期發布」。這種輕重顛倒的溝通策略強烈暗示:Google已判定Gemini 3.5 Pro無法與新一代競品對抗,決定放棄中期收復失地的計畫,全力賭注Gemini 4。

技術層面,Opus 5在遊戲開發領域展現出領先優勢。演講者展示的案例包括一次提示生成的完整第一人稱射擊遊戲(100%自訂代碼無外部資源)、五對五多人競技遊戲(用時約半小時)。相較之下,Kimmy K3和其他競品在複雜地圖設計、多人邏輯上仍存困難。3D模型生成也成為新的競爭維度——Gemini 3.5 Pro測試版在直升機、民航機等物體生成上較3.6 Flash有明顯改善,反映各家實驗室都在優化視覺生成能力。

儘管短期看起來Google陷入被動,但這個策略轉向也反映出AI競賽已進入新階段:不是拼發布速度,而是拼模型天花板。若Gemini 4如預期表現強勢,Google仍有翻盤機會。對產業而言,這輪競品的遊戲開發能力躍進更值得關注——演講者預測2026年底前可能出現由AI輔助開發、商業可行的遊戲作品,這將是模型應用從演示邁向實用的里程碑。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing
編輯精選
83 min
AI 技術英文PODCAST8月26日

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing

Latent Space

  • 加速傳統物理模擬的典範轉移:氣象科學家原本認為 AI 無法匹敵數十年的物理建模工作,但傅里葉神經算子不僅達到同等精度,還快了一萬多倍。原本需要超級計算機的計算現在用消費級 GPU 就能完成,這改變了整個領域的思維方式。
  • 傅里葉域的非局部現象捕捉:傅里葉域能有效表示非局部現象(如大氣河流跨越千里的影響),且計算複雜度為準線性,遠優於完全連接的全局模型。這特別適合流體動力學、量子化學等自然現象中普遍存在的非局部相互作用。
  • 多解析度連續函數表示:神經算子將輸入輸出視為連續函數而非固定維度向量,可在推論時以任意解析度查詢,並能在更高解析度上疊加物理約束或額外數據,克服了固定解析度神經網路的限制。
Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Why the Next AI Breakthrough May Come from Physics with Max Welling - #774
55 min
AI 技術英文PODCAST8月25日

Why the Next AI Breakthrough May Come from Physics with Max Welling - #774

TWIML AI

  • 多層篩選的材料設計流程:先搜尋文獻資料庫找現有材料,若無合適的就用生成模型產生數十萬個候選分子,用機器學習力場進行分子動力學模擬篩選,再進行實驗驗證。這套流程相比傳統量子力學計算能加速效率數個數量級。
  • 生成AI與熱力學的數學等價性:資訊論是兩個領域的共同基礎,生成模型的擴散過程與非平衡統計力學描述資訊損失的過程在數學上完全對應,許多開發出來的方法工具在兩領域都有精確對應的形式。
  • 基礎模型的遷移學習策略:先在廣泛材料資料集上訓練基礎力場表示,再針對特定材料類別進行蒸餾微調,既能保持計算效率也能獲得專一性。