KeyFrame內部研究專用

AI取代人類夢碎?微軟、Uber緊急「拔掉網線」!背後真相嚇死人:原來我們比AI更便宜!😱

商業本質·7月4日週六·24 min中文

三句話摘要

科技巨頭因AI工具成本爆炸而被迫削減使用,人類員工因價效比反而成為最划算的選擇。 冷冰冰的Excel財務表格擊敗了資本對AI取代人類的夢想,人類員工因為價效比最高而成為這個時代最硬派的贏家。 成本結構失衡:AI代理不是簡單的聊天工具,它會自動拉取程式碼庫、編寫方案、執行測試、失敗重試,每一步都在計費。一個稍複雜的bug修復任務可能需要5-10次完整迴圈,失敗的嘗試和成功的嘗試一樣全價收費,這導致單次任務成本可輕易達到人工月薪的幾倍。

重點整理

重點
  • 1

    成本結構失衡:AI代理不是簡單的聊天工具,它會自動拉取程式碼庫、編寫方案、執行測試、失敗重試,每一步都在計費。一個稍複雜的bug修復任務可能需要5-10次完整迴圈,失敗的嘗試和成功的嘗試一樣全價收費,這導致單次任務成本可輕易達到人工月薪的幾倍。

  • 2

    規模化的自我摧毀:當公司透過排位賽、KPI掛鉤等激勵機制強制員工使用AI工具時,員工為了業績評分而瘋狂呼叫,造成預算池短期內枯竭。Uber四個月就燒光了全年AI預算,微軟在財政年度結束前被迫緊急撤回許可權。

  • 3

    摩爾定律的陷阱:雖然晶片成本在下降,但AI代理會自動呼叫更多token來完成更復雜的任務,透過傑文斯悖論抵消掉硬體省下的成本。高盛預測2030年token單價下跌90%,但企業整體AI支出不會便宜。

  • 4

    人類的商業復興:不是資本家心慈手軟,而是冷酷的財務報表保護了人類員工。完全自動化的系統會陷入失控的成本死迴圈,維持"人在環路"反而成為公司不破產的必要條件。

實用技巧與重點

乾貨
  • 具體資料:
  • 微軟工程師獲得Claude程式碼完整訪問許可權後,2026年5月被強制撤回
  • Uber員工AI工具使用率:2月32% → 3月84%,年度預算四個月用完
  • 普通Uber工程師月度API賬單:150-250美元;重度使用者:500-2,000美元;CTO兩小時演示消耗:1,200美元
  • GitHub Copilot:微軟每個使用者每月平均倒貼20美元,重度使用者倒貼80美元(售價僅10美元)
  • AI特工任務token消耗:普通聊天的5-30倍;極端情況可達1,000倍以上
  • SWEbench測試標準:目前最頂尖AI特工解決率不到50%
  • 高盛預測:若代理型AI全面鋪開,2030年全球月度token消耗將達120兆次(比2025年增長24倍)
  • 工具與平臺:
  • Claude Code(Anthropic)- 微軟曾開放給員工的頂級AI程式設計工具
  • GitHub Copilot CLI - 微軟推薦的廉價替代品
  • Duolingo - 嘗試AI替代人工後又向回找補的企業案例
  • Azure 200晶片 - 微軟自研晶片,token產出效率提升30%以上
  • 關鍵概念:
  • Agentic AI(代理型AI) - 自主完成任務的AI系統
  • Human in the Loop - 保持人類在工作流程中的必要性
  • 傑文斯悖論(Jevons Paradox) - 效率提升反而導致總消耗增加
  • Tokenmax - 亞馬遜內部鼓勵員工瘋狂消耗token的黑話
  • 驗證專家(Verification Expert) - 新興崗位,防止AI失控消耗預算

結論

結論

冷冰冰的Excel財務表格擊敗了資本對AI取代人類的夢想,人類員工因為價效比最高而成為這個時代最硬派的贏家。

完整解析

詳細

2025年底,微軟做了一個激進決定:給數千名工程師、產品經理和設計師開放了Claude程式碼的完整訪問許可權。這不僅僅是程式碼補全外掛,而是當時市面上最頂尖的AI程式設計工具。微軟的算盤很精——用AI全面接手底層工作,極致壓榨開發效率。一開始效果立竿見影,各大核心團隊迅速把AI融入日常工作流程。但到了2026年5月,風向突變。微軟開始大規模撤回高階AI的許可證,重災區恰恰是Windows和Microsoft 365這些核心印鈔機部門。

官方說法是"常規工具鏈清理",但真正原因只有一個字:貴。這工具實在太好用了,工程師越依賴它,賬單滾得越大。微軟最終被迫在財政年度結束前強制鎖定員工,防止暴增的賬單吃掉利潤率。

同樣踩到這顆地雷的還有Uber。2026年4月,Uber技術長承認公司四個月內燒光了全年AI預算。原因是管理層搞了個排位賽系統,按AI使用量對團隊排名,把工作變成了打榜遊戲。採納率從2月的32%直線飆升到3月的84%。普通工程師月度API賬單150-250美元,重度使用者能燒500-2,000美元,CTO僅兩小時演示就花掉1,200美元。而最諷刺的是,CEO後來透露AI特工雖然能寫出約10%的程式碼,但公司賬面上根本看不到任何實質成本節約。運營長的評價是"腦袋都要炸了"。

問題的根本在於,AI代理不是簡單的聊天工具。你給它一個任務,它會在後臺自動拉取整個程式碼庫、閱讀程式碼、起草方案、修改程式碼、執行測試,如果失敗就重新來過。這個閉環會持續到任務完成或達到迭代上限。每走一步都在燒錢,因此單次任務吞噬的算力可比簡單問答高出幾個甚至十幾個數量級。更糟的是,即使在SWEbench這樣的行業標準測試中(包含真實程式碼庫中需要人工修復的bug),目前最頂尖的AI特工解決率也不到50%。這意味著一個稍複雜的bug可能引發5-10次完整失敗迴圈,每次失敗的成本和成功一樣,最後還要人類工程師收拾爛攤子。

英偉達副總裁Brian Catanzaro無意中暴露了真相:他們團隊跑大模型的算力成本已經遠超給頂級工程師發的薪水。硬體確實在進步——微軟新推出的Azure 200晶片提升了每美元token產出30%以上。但高盛的預測戳破了幻想:即使2030年token單價暴跌90%,企業整體AI支出也不會便宜,因為AI代理會理直氣壯地呼叫更多token處理更復雜的任務。這就是傑文斯悖論。

正因為成本無法解決,那些吹噓AI全自動取代人工的宏大敘事逐漸崩盤。Duolingo曾激進地用AI替代翻譯人員並裁員,甚至強制掛鉤AI使用頻率到員工KPI,結果CEO最終承認技術根本接不住人類的工作量,被迫撤銷規定。現在科技業正在進行心照不宣的調整:AI不會消失,但只會像精準手術刀一樣用在成本可控、回報清晰的邊緣環節。真正的職場形態已經變成了人機混合體,其中主動權牢牢掌握在人類手中——不是因為資本家突然仁慈,而是因為這是公司不破產的唯一途徑。

一個新的高含金量崗位應運而生:驗證專家。他們不寫程式碼,而是死死盯住AI代理,在其陷入昂貴無腦的失敗死迴圈前果斷停止,像防火牆一樣橫在公司銀行賬戶和無底洞算力賬單之間。甚至黃仁勳本人在描繪未來時也暴露了底牌——每位員工身邊跟100個AI特工"協同"工作,而非"替代"工作。一旦把中間那個吃死工資的人類抽走,整個系統馬上失控。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing
編輯精選
83 min
AI 技術英文PODCAST8月26日

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing

Latent Space

  • 加速傳統物理模擬的典範轉移:氣象科學家原本認為 AI 無法匹敵數十年的物理建模工作,但傅里葉神經算子不僅達到同等精度,還快了一萬多倍。原本需要超級計算機的計算現在用消費級 GPU 就能完成,這改變了整個領域的思維方式。
  • 傅里葉域的非局部現象捕捉:傅里葉域能有效表示非局部現象(如大氣河流跨越千里的影響),且計算複雜度為準線性,遠優於完全連接的全局模型。這特別適合流體動力學、量子化學等自然現象中普遍存在的非局部相互作用。
  • 多解析度連續函數表示:神經算子將輸入輸出視為連續函數而非固定維度向量,可在推論時以任意解析度查詢,並能在更高解析度上疊加物理約束或額外數據,克服了固定解析度神經網路的限制。
Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Why the Next AI Breakthrough May Come from Physics with Max Welling - #774
55 min
AI 技術英文PODCAST8月25日

Why the Next AI Breakthrough May Come from Physics with Max Welling - #774

TWIML AI

  • 多層篩選的材料設計流程:先搜尋文獻資料庫找現有材料,若無合適的就用生成模型產生數十萬個候選分子,用機器學習力場進行分子動力學模擬篩選,再進行實驗驗證。這套流程相比傳統量子力學計算能加速效率數個數量級。
  • 生成AI與熱力學的數學等價性:資訊論是兩個領域的共同基礎,生成模型的擴散過程與非平衡統計力學描述資訊損失的過程在數學上完全對應,許多開發出來的方法工具在兩領域都有精確對應的形式。
  • 基礎模型的遷移學習策略:先在廣泛材料資料集上訓練基礎力場表示,再針對特定材料類別進行蒸餾微調,既能保持計算效率也能獲得專一性。