KeyFrame內部研究專用

Anthropic 2024年的承諾,2026年兌現了多少?OpenAI叛將的預言全中了!2026年矽谷AI大洗牌,Anthropic如何靠「良心」賺走幾百億?🤫

商業本質·5月30日週六·26 min中文

三句話摘要

從 2026 年回望 Anthropic 2024 年創辦人內部對談,檢視其安全理念在商業、技術與社會層面的兌現與落差。 Anthropic 成功把安全變成了一門極度性感的超級大生意,在商業策略與合規布局上贏得徹底,但對技術社會學效應的控制權、對組織純粹性的維繫,以及對醫療與民主普惠的宏大願景,都在算力通膨、能源枯竭與資本邏輯面前遭遇了冰冷的現實回敬。 安全即商業護城河: Anthropic 將「負責任擴展政策(RSP)」刻入公司運作核心,當各國監管法規收緊時,其他初創因合規成本被淘汰,而 Anthropic 早已是免檢優等生,直接接管了高敏感客戶的業務鏈路。

重點整理

重點
  • 1

    安全即商業護城河: Anthropic 將「負責任擴展政策(RSP)」刻入公司運作核心,當各國監管法規收緊時,其他初創因合規成本被淘汰,而 Anthropic 早已是免檢優等生,直接接管了高敏感客戶的業務鏈路。

  • 2

    宪法 AI 的真實價值: 讓模型自我對照原則糾錯的做法,在 B2B 落地中降低了幻覺與輸出失控率,這在競爭對手接連爆出客服端粗口、捏造財務數據的醜聞後,成為市場最稀缺的資產,代價是耗費數千張高端顯卡算力持續微調安全閾值。

  • 3

    生醫預言一半成真: 大型藥廠確實將模型接入藥物靶點篩選與蛋白質折疊分析,早期研發周期大幅壓縮;但進入濕實驗室合成與 FDA 三期臨床後,物理節奏無法快進,Anthropic 最終成為製藥巨頭手中最昂貴的 SaaS 工具,而非終結癌症的救世主。

  • 4

    規模化打碎烏托邦文化: 2024 年圓桌上引以為傲的零內耗信任文化,在估值暴增、員工數千人後難以維繫——商業化操盤手的變現狼性、產品團隊降低安全攔截率的壓力,與合規團隊死守 RSP 條款的張力,成為組織日常的底層裂痕。

實用技巧與重點

乾貨
  • 具體數字與比例:
  • 2024 年知名孵化器中 95% 的初創團隊使用 Claude 進行代碼編寫
  • 公司員工規模從創立時擴張超過 10 倍,突破數千人
  • 耗費數千張高端顯卡算力微調安全閾值
  • 工具、模型、平台:
  • Claude 系列模型(Anthropic)
  • RSP(Responsible Scaling Policy,責任擴展政策)
  • 宪法 AI(Constitutional AI)
  • 前沿紅隊測試機制(Frontier Red-teaming)
  • AlphaFold(獲諾貝爾獎的蛋白質折疊模型,作為對比)
  • Project Stargate(十幾瓦級超大型數據中心計畫)
  • Nvidia 頂級芯片、台積電、三星、ASML(供應鏈關鍵節點)
  • 方法與流程:
  • RSP 流程:模型能力突破危險臨界 → 強制暫停研發 → 安全審查與防禦升級
  • 宪法 AI 訓練流程:給模型一套宪法原則 → 訓練中自我對照糾錯
  • 紅隊對抗測試:內部找茬極客團隊 → 現已成全球頂級 AI 實驗室標配
  • 政府游說策略:將 RSP 打包成政策建議 → 嵌入立法者公文包 → 掌握規則制定權
  • 可解釋性技術突破:
  • 成功在千億至兆級參數模型中提取負責欺騙、諂媚或特定偏見的神經元回路
  • 以外科手術式方式切除危險回路
  • 憑此能力拿下軍方、金融清算中心、頂級情報機構訂單
  • 生醫落地現實:
  • 輝瑞、諾華等製藥巨頭已將大模型接入文獻檢索、蛋白質折疊預測、小分子藥物靶點結合力模擬
  • 早期發現階段從數年壓縮至數月甚至數週
  • 瓶頸在濕實驗室合成、小鼠毒理測試、FDA 一期/二期/三期臨床——物理節奏無法快進
  • 能源與供應鏈約束(2026 年新增現實):
  • 可解釋性運算 + 實時紅隊測試的算力損耗達天文數字
  • 需競逐 Nvidia 頂級芯片、三星封裝產能、ASML 光刻機產能
  • 能源牆:大型數據中心若無核電站或電網定向配額,安全防禦機制連啟動資格都沒有

結論

結論

Anthropic 成功把安全變成了一門極度性感的超級大生意,在商業策略與合規布局上贏得徹底,但對技術社會學效應的控制權、對組織純粹性的維繫,以及對醫療與民主普惠的宏大願景,都在算力通膨、能源枯竭與資本邏輯面前遭遇了冰冷的現實回敬。

完整解析

詳細

2024 年底,Anthropic 創辦人 Dario Amodei、Daniela Amodei 與 Jack Clark 進行了一場內部對談。彼時這家公司仍被外界調侃為「用道德情懷給離職行為找藉口的烏托邦」,創辦人們在桌旁反覆咀嚼責任、安全與造福人類,口吻與同期硅谷瘋狂堆算力的競爭氛圍格格不入。然而站在 2026 年的節點回望,這場談話更像一份充滿預言與迷失的科技啟示錄——有些判斷精準踩中了商業現實,有些宏大願景則在物理摩擦力與資本邏輯面前被迫變形。

在商業策略上,Anthropic 的「安全優先」定位兌現得最為徹底。他們將 RSP 責任擴展政策刻入公司運作齒輪——一旦模型能力突破危險臨界,所有研發流程強制暫停,進行新一輪安全審查。當各國政府的監管大刀在 2025 到 2026 年間接連落下,合規門槛被無限拉高,大量初創團隊被卡死在半路,而 Anthropic 早已是免檢優等生,順理成章接管了那些對安全性要求苛刻的核心業務鏈路。更精妙的是,他們主動將 RSP 打包成政策建議遞進立法者的公文包,實質上讓行業的準入門檻按照自家技術邏輯來劃定,競爭對手在合規戰役中吃盡了苦頭。宪法 AI 的路線同樣得到了市場驗證:讓模型自我對照原則糾錯,使 Claude 在輸出長文本與複雜代碼時呈現出更少幻覺與更強邏輯連貫性。2025 年競爭對手接連爆出客服端粗口、捏造財務報告、被幾句提示詞誘導出系統底層代碼等醜聞,讓 Anthropic 那種「克制、冰冷、甚至死板」的輸出風格成為市場上最稀缺的商業資產。

然而技術野心的另一面並不如視頻中描繪得那般從容。創辦人當初對可解釋性研究寄予厚望,相信拆解神經網絡的運作邏輯能反哺精神疾病治療。2026 年的現實是:他們確實成功從千億至兆級參數模型中提取出負責欺騙或特定偏見的神經元回路並加以切除,憑此拿下了軍方與頂級情報機構的超級訂單;但理解硅基權重矩陣與治癒碳基人類的腦部疾病之間,隔著一條深不見底的生物學鴻溝。人類大腦的運作受神經遞質、內分泌系統反饋與基因表達環境的複雜交織影響,無法用同一套數學邏輯加以解釋。在生醫賽道上,大型藥廠確實將模型全面接入早期藥物發現流程,研發周期從數年壓縮至數月;但一旦進入濕實驗室合成、小鼠毒理測試與 FDA 三期臨床,整個進度條瞬間被拉回物理節奏,代碼可以每秒迭代百萬次,但人類細胞的代謝周期無法快進。Anthropic 最終成功變成全球醫藥巨頭手中最昂貴的 SaaS 工具提供商,賺取了海量 API 調用費,卻並未如當初設想般成為直接終結癌症的救世主。

組織層面的張力同樣在 2026 年全面顯現。2024 年圓桌上,Daniela 無比自豪地描述團隊的零內耗信任文化——幾十個頂尖大腦圍繞同一安全願景高效運轉,不存在政治內耗。但當公司估值暴增十倍以上、員工突破數千人、華爾街資本按季度考核營收轉化率時,這種純粹的理想主義文化已難以為繼。商業化操盤手帶著變現狼性衝進體系,產品團隊天天逼著研究團隊降低安全攔截率,合規團隊則死守 RSP 條款卡住發布節點,算力分配上的研究與商業化之爭無休無止。更宏觀的社會學效應也令人清醒:Anthropic 的安全圍欄讓 Claude 絕對不生成選舉假新聞,但他們管不住被剝離安全限制的開源模型在暗網上疯狂傾泻深度偽造與垃圾信息。頂級安全大模型最終成為了一種昂貴的數字特權——華爾街量化基金花重金調用高級接口收割散戶,而第三世界底層醫療與教育因無法提供數據變現閉環,技術滲透依然舉步維艱。能源牆是另一個被完全忽略的致命約束:可解釋性運算加上實時紅隊測試的算力消耗是天文數字,而如果拿不到核電站或電網的定向供電配額,再完美的宪法設計連啟動資格都沒有,這迫使一群原本只關心代碼的學者,在 2026 年硬生生成為了需要在全球供應鏈與能源版圖上縱橫捭閤的政客。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing
編輯精選
83 min
AI 技術英文PODCAST8月26日

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing

Latent Space

  • 加速傳統物理模擬的典範轉移:氣象科學家原本認為 AI 無法匹敵數十年的物理建模工作,但傅里葉神經算子不僅達到同等精度,還快了一萬多倍。原本需要超級計算機的計算現在用消費級 GPU 就能完成,這改變了整個領域的思維方式。
  • 傅里葉域的非局部現象捕捉:傅里葉域能有效表示非局部現象(如大氣河流跨越千里的影響),且計算複雜度為準線性,遠優於完全連接的全局模型。這特別適合流體動力學、量子化學等自然現象中普遍存在的非局部相互作用。
  • 多解析度連續函數表示:神經算子將輸入輸出視為連續函數而非固定維度向量,可在推論時以任意解析度查詢,並能在更高解析度上疊加物理約束或額外數據,克服了固定解析度神經網路的限制。
Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Why the Next AI Breakthrough May Come from Physics with Max Welling - #774
55 min
AI 技術英文PODCAST8月25日

Why the Next AI Breakthrough May Come from Physics with Max Welling - #774

TWIML AI

  • 多層篩選的材料設計流程:先搜尋文獻資料庫找現有材料,若無合適的就用生成模型產生數十萬個候選分子,用機器學習力場進行分子動力學模擬篩選,再進行實驗驗證。這套流程相比傳統量子力學計算能加速效率數個數量級。
  • 生成AI與熱力學的數學等價性:資訊論是兩個領域的共同基礎,生成模型的擴散過程與非平衡統計力學描述資訊損失的過程在數學上完全對應,許多開發出來的方法工具在兩領域都有精確對應的形式。
  • 基礎模型的遷移學習策略:先在廣泛材料資料集上訓練基礎力場表示,再針對特定材料類別進行蒸餾微調,既能保持計算效率也能獲得專一性。