KeyFrame內部研究專用

How to Actually Use AI Tools in 2026 (Full Guide)

Parker Prompts·6月25日週四·12 min英文

三句話摘要

如何透過五個核心 AI 工具類別搭建完整專案,以一個購物決策輔助網站為例,展示如何將生成、程式碼、研究、設計、動畫整合成實用產品。 與其追趕層出不窮的新 AI 工具,不如深度掌握這五個不變的核心類別,就能搭建任何想要的產品。 改變 AI 的使用方式 — 多數人用 AI 像用搜尋引擎,只問問題。應該讓 AI 自己寫提示詞、規劃流程,然後執行構建,你只需要創意和批准。

重點整理

重點
  • 1

    改變 AI 的使用方式 — 多數人用 AI 像用搜尋引擎,只問問題。應該讓 AI 自己寫提示詞、規劃流程,然後執行構建,你只需要創意和批准。

  • 2

    選擇正確的程式碼工具省錢 — 描述式工具(Lovable、Bolt)按月額度計費,頻繁迭代會超支;代理工具(Claude Code、Cursor)在本地執行,關聯訂閱,迭代無限制,通常更便宜。構建前必須啟用 plan mode,讓 AI 先思考再寫程式碼,減少返工。

  • 3

    用研究工具保證事實準確 — 通用 AI 會編造,當答案必須真實、最新或具體時,必須用 Perplexity(返回實時源)、Deep Research 或 NotebookLM(僅從上傳文件回答)。Worth It 網站整合 Perplexity API 查詢真實商品價格,而不是猜測。

  • 4

    影象和影片工具代替設計投入 — 提示詞要具體("flat minimalist logo, one accent color, lots of negative space"優於"logo for my app");用參考影象和編輯功能迭代;影片從靜態影象生成而非零起點,保持動作小而短,顯得專業且逼真。

實用技巧與重點

乾貨
  • 工具清單
  • 思考工具:Claude、ChatGPT、Gemini、Grok
  • 程式碼工具(描述式):Lovable、Bolt、Base
  • 程式碼工具(代理式):Claude Code、Cursor、Codex
  • 研究工具:Perplexity、Deep Research、NotebookLM
  • 影象工具:Gemini(免費)、AI Studio(付費)
  • 影片工具:Gemini Video(需訂閱)
  • 成本與計費
  • 描述式程式碼工具:按月額度計費,額度用盡需續費
  • 代理式程式碼工具:按 AI 訂閱計費,迭代無額外成本
  • 大多數情況下代理式工具成本更低
  • 關鍵流程與資料
  • Master prompt 需要經過 4-5 個階段:規劃 → 程式碼構建 → 研究整合 → 影象資產 → 影片動畫
  • Plan mode:啟用後 AI 先輸出完整計劃再執行,減少錯誤
  • Project context 檔案:用 Claude.md/Gemini.md 儲存專案資訊,避免重複解釋
  • Perplexity API:整合到程式碼中查詢實時資料(示例:實時商品價格)
  • 影象提示詞結構:具體修飾詞 + 風格 + 限制(如"flat minimalist, one accent color, no text")
  • 影片生成引數:使用高階模型(Gemini 3.1 Pro)、extended thinking、16:9 landscape
  • 安全管理:不在提示中貼上真實 API 金鑰;代理工具需在迴圈中審批命令

結論

結論

與其追趕層出不窮的新 AI 工具,不如深度掌握這五個不變的核心類別,就能搭建任何想要的產品。

完整解析

詳細

每天都有新 AI 工具問世,但仔細觀察會發現它們本質上只歸納為五個不變的類別。講者以構建「Worth It」——一個購物決策輔助網站——為例項,完整演示了這五類工具如何協作。

第一步:思考工具與規劃 講者選用 Claude,要求它為「Worth It」這個工具寫完整的產品規劃。這裡的關鍵是不讓 AI 回答問題,而是讓它設計自己的提示詞和流程。AI 理解自己的需求勝過人工設計,它會自動規劃產品應該問哪些問題、給出什麼判斷、如何展現。講者審視了規劃後覺得合理就推進。

第二步:程式碼工具與構建 講者指出程式碼工具有兩種。描述式工具如 Lovable 和 Bolt 讓你用自然語言描述想要什麼,幾分鐘後就有網頁;但它們按月額度計費,一次迭代可能消耗大量額度。代理式工具如 Claude Code 和 Cursor 在你的機器上執行,改動真實檔案,雖然需要安全審視,但成本極低——只要付訂閱費就能無限迭代。講者選了 Claude Code。關鍵步驟是啟用「plan mode」,讓 AI 先輸出完整計劃再執行程式碼,這樣出錯率大幅降低。此外,他在專案資料夾裡儲存了 Claude.md,存放專案背景和要求,這樣 AI 每次都能看到完整上下文,不用反覆解釋。幾分鐘後,一個可用的網站骨架就完成了。

第三步:研究工具與資料真實性 現在網站能跑,但它不知道任何真實的產品或價格——如果問它價格,它只會編造。這違反了核心原則:當答案必須真實、最新或具體時,必須用研究工具。講者把 Claude 的指令推進到第三階段,要求整合 Perplexity API。Perplexity 是一個搜尋引擎,能返回實時答案和源連結,完全不同於通用 AI。整合後,「Worth It」現在能查詢真實商品價格、對比折扣、給出可信的建議,而不是瞎猜。

第四步:影象工具與視覺設計 網站功能完整但介面平凡。講者轉向 Gemini 的免費影象生成功能。大多數人用 AI 影象工具得不到好結果,因為他們的提示詞太模糊("logo for my app")。講者演示瞭如何寫具體的提示:"flat minimalist logo, one accent color, lots of negative space, no text"——每一個詞都增加了 AI 的理解精度。他生成了幾張圖片資產,把它們放到專案資料夾,再告訴 Claude Code 如何在網站中使用這些圖片。幾分鐘後,網站有了精緻的視覺外觀。

第五步:影片工具與動畫增強 最後一個工具是影片生成。講者用 Gemini Video(付費)把網站的 header 圖片製作成迴圈動畫,給整個頁面增加了專業感。關鍵建議是:從現有的靜態影象生成影片而不是零起點,這樣能保持控制和一致性;動作要小而短,大幅晃動會讓 AI 表現糟糕。完成後,他把影片檔案放入專案,讓 Claude Code 整合。最終網站既有完整功能、真實資料、專業設計又有精緻動畫。

講者的核心觀點是,這五個類別雖各有用途,但組合使用就能快速構建任何想要的產品——而這正是他的「AI Fluency」課程要傳授的。掌握這五類,就不必每天追趕新工具,反而能用現有工具創造想象的東西。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing
編輯精選
83 min
AI 技術英文PODCAST8月26日

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing

Latent Space

  • 加速傳統物理模擬的典範轉移:氣象科學家原本認為 AI 無法匹敵數十年的物理建模工作,但傅里葉神經算子不僅達到同等精度,還快了一萬多倍。原本需要超級計算機的計算現在用消費級 GPU 就能完成,這改變了整個領域的思維方式。
  • 傅里葉域的非局部現象捕捉:傅里葉域能有效表示非局部現象(如大氣河流跨越千里的影響),且計算複雜度為準線性,遠優於完全連接的全局模型。這特別適合流體動力學、量子化學等自然現象中普遍存在的非局部相互作用。
  • 多解析度連續函數表示:神經算子將輸入輸出視為連續函數而非固定維度向量,可在推論時以任意解析度查詢,並能在更高解析度上疊加物理約束或額外數據,克服了固定解析度神經網路的限制。
Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Why the Next AI Breakthrough May Come from Physics with Max Welling - #774
55 min
AI 技術英文PODCAST8月25日

Why the Next AI Breakthrough May Come from Physics with Max Welling - #774

TWIML AI

  • 多層篩選的材料設計流程:先搜尋文獻資料庫找現有材料,若無合適的就用生成模型產生數十萬個候選分子,用機器學習力場進行分子動力學模擬篩選,再進行實驗驗證。這套流程相比傳統量子力學計算能加速效率數個數量級。
  • 生成AI與熱力學的數學等價性:資訊論是兩個領域的共同基礎,生成模型的擴散過程與非平衡統計力學描述資訊損失的過程在數學上完全對應,許多開發出來的方法工具在兩領域都有精確對應的形式。
  • 基礎模型的遷移學習策略:先在廣泛材料資料集上訓練基礎力場表示,再針對特定材料類別進行蒸餾微調,既能保持計算效率也能獲得專一性。