KeyFrame內部研究專用

零基礎30分鐘學會Codex 95%功能!【福利贈送】

李厂长来了·6月13日週六·24 min中文

三句話摘要

OpenAI Codex 桌面版 AI Agent 的 9 大核心功能完整教學,適合零基礎白領快速上手。 Codex 的核心價值在於:設定好 agents.md 加上串接常用插件,就能把電腦桌面變成一個自動執行日常辦公任務的 AI 工作站,零基礎用戶 $20/月即可大幅提升工作效率。 Codex 與 Claude Code 的本質差異:兩者都是通用 AI Agent,但 Codex 僅支援 GPT 系列模型、介面更適合零基礎使用者;Claude Code 模型可替換、自由度更高、偏向專業開發者。講者建議複雜寫作用 Claude Code,日常辦公執行類任務用 Codex,有條件時兩者並用。

重點整理

重點
  • 1

    Codex 與 Claude Code 的本質差異:兩者都是通用 AI Agent,但 Codex 僅支援 GPT 系列模型、介面更適合零基礎使用者;Claude Code 模型可替換、自由度更高、偏向專業開發者。講者建議複雜寫作用 Claude Code,日常辦公執行類任務用 Codex,有條件時兩者並用。

  • 2

    agents.md 是影響輸出品質的核心:這份文件相當於 AI 員工入職指南,Codex 每次開始任務前都會先讀取它。只要設定好個人背景、輸出語言、格式要求與工作原則,所有後續對話都會自動遵守,是一次設定、長期受益的關鍵步驟。

  • 3

    插件生態系讓 Codex 成為工作中樞:透過插件,Codex 可直接讀取收據照片整理成 Excel、掃描 Gmail 篩選指定主題郵件、操作 Canva 設計,連接的外部工具越多,Codex 能替你做的事就越多。

  • 4

    Skills 與自動化工作流解放重複性工作:Skills 是可重複呼叫的指令包,用斜線(`/`)觸發;自動化工作流則可設定排程(如每週五早上 9 點掃描 Gmail),讓 AI 在無人值守狀態下持續更新資料。

實用技巧與重點

乾貨
  • 工具與模型
  • 平台:OpenAI Codex 桌面版(支援 Mac / Windows)
  • 圖像模型:GPT Image 2(內建,無需額外開啟)
  • 插件支援:Computer Use、GitHub、Canva、Figma、Gmail、Google Calendar、Google Drive、Notion 等
  • 價格
  • 免費方案:有額度限制
  • Plus 方案:$20/月,適合日常使用
  • Claude Code Max 方案:$100/月,適合高頻複雜任務
  • 速度與 Token 消耗
  • 快速模式:標準速度 × 1.5,Token 消耗 × 2
  • 實測快速與標準模式體感差異不大,Token 不充裕時建議用標準
  • 具體操作案例
  • 60 張收據照片 → Codex 自動分類整理成 Excel,含趨勢圖表與品類匯總
  • Gmail 掃描指令:「最近 7 天 AI 相關郵件整理成表格附備注」,自動標注強/弱相關
  • 自動化排程:每週五早上 9 點掃描 Gmail,更新 AI 市場週報 Excel
  • 圖片生成指令:5 張夾克商品圖,不同國籍模特,1/1/1/3/5 人構圖
  • Skills 觸發方式:對話框輸入 `/` + 前幾個字
  • 插件呼叫方式:對話框輸入 `@` 符號
  • 推薦資源
  • Andrej Karpathy(前 OpenAI 聯合創始人)的 agents.md 模板(中英文版,頻道描述欄免費領取)
  • 介面功能位置
  • 剩餘額度:左下角設定 → 剩餘額度(顯示 5 小時內 / 本週用量及刷新時間)
  • 計劃模式:左側夾號 → 計劃模式(先規劃後執行)
  • 記憶設定:設定 → 記憶(開啟自動記憶)
  • agents.md:設定 → agents.md

結論

結論

Codex 的核心價值在於:設定好 agents.md 加上串接常用插件,就能把電腦桌面變成一個自動執行日常辦公任務的 AI 工作站,零基礎用戶 $20/月即可大幅提升工作效率。

完整解析

詳細

Codex 是 OpenAI 推出的桌面端 AI Agent 工具,與 Claude Code 同屬新一代通用智能體,但定位略有不同。Codex 僅支援 OpenAI 的 GPT 系列模型,介面設計以白領工作者為核心用戶,強調操作門檻低、易上手;Claude Code 則支援模型替換,具備更高的自由度,適合進階開發者。價格上,Codex 的 $20/月 Plus 方案對大多數日常用戶已足夠,而 Claude Code 的 Max 方案則需 $100/月。講者個人的使用習慣是:寫作與複雜規劃交給 Claude Code,執行類日常辦公任務交給 Codex,編程時則兩者並用。

設定好工具之後,最關鍵的一步是設計 agents.md 文件。這份文件的地位相當於給 AI 員工的入職手冊,Codex 每次開始工作前都會讀取它,依此決定輸出語言、回覆風格與工作流程。講者建議在 ChatGPT 或 Claude 裡先生成這份文件,填入個人背景、輸出語言(如繁體或簡體中文)、風格要求(如「務實客觀、直言不諱」)以及工作原則(如「執行前先列計劃,完成後告知生成了哪些檔案」)。agents.md 是動態文件,可隨時補充新的格式偏好或模板要求,成為 Codex 的「手動記憶」。與此搭配的是自動記憶功能,開啟後 Codex 會在對話結束後自動整理重點存為記憶片段,隨任務累積越來越了解使用者。

插件(Plugin)是 Codex 功能擴展的核心,讓 Codex 從一個對話工具升級為工作中樞。以 Computer Use 插件為例,講者上傳了 60 多張購物收據照片,只需一句指令,Codex 便自動讀取每張收據上的文字、分類整理,輸出含品類匯總與趨勢圖表的 Excel 檔案。Gmail 插件的展示同樣直觀:輸入「整理最近 7 天 AI 相關郵件,附相關度標注與內容備注」,Codex 便掃描信箱輸出結構化表格,並可直接點擊鏈結跳轉原信、讓 AI 代為回覆。在此基礎上,配合自動化工作流功能,講者進一步設定「每週五早上 9 點掃描 Gmail、更新 AI 市場週報 Excel」,實現完全無人值守的資訊追蹤。

在內容生產方面,Codex 內建 GPT Image 2 圖像生成能力,講者以一件夾克衫為素材,生成 5 張不同國籍模特、不同人數構圖的商品照,完全符合指定要求,可直接導入 Canva 進行後續設計編排。網頁生成功能則支援在 Codex 內建瀏覽器中直接預覽效果,並透過「批注」工具在頁面上點選元素寫下修改意見,免去截圖描述的繁瑣步驟。另一個實用的 ForkChat(派生)功能,允許從同一段對話中分出多個獨立的子對話,繼承完整上下文卻不互相干擾,特別適合在同一個研究基礎上同時推進多個方向的任務。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing
編輯精選
83 min
AI 技術英文PODCAST8月26日

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing

Latent Space

  • 加速傳統物理模擬的典範轉移:氣象科學家原本認為 AI 無法匹敵數十年的物理建模工作,但傅里葉神經算子不僅達到同等精度,還快了一萬多倍。原本需要超級計算機的計算現在用消費級 GPU 就能完成,這改變了整個領域的思維方式。
  • 傅里葉域的非局部現象捕捉:傅里葉域能有效表示非局部現象(如大氣河流跨越千里的影響),且計算複雜度為準線性,遠優於完全連接的全局模型。這特別適合流體動力學、量子化學等自然現象中普遍存在的非局部相互作用。
  • 多解析度連續函數表示:神經算子將輸入輸出視為連續函數而非固定維度向量,可在推論時以任意解析度查詢,並能在更高解析度上疊加物理約束或額外數據,克服了固定解析度神經網路的限制。
Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Why the Next AI Breakthrough May Come from Physics with Max Welling - #774
55 min
AI 技術英文PODCAST8月25日

Why the Next AI Breakthrough May Come from Physics with Max Welling - #774

TWIML AI

  • 多層篩選的材料設計流程:先搜尋文獻資料庫找現有材料,若無合適的就用生成模型產生數十萬個候選分子,用機器學習力場進行分子動力學模擬篩選,再進行實驗驗證。這套流程相比傳統量子力學計算能加速效率數個數量級。
  • 生成AI與熱力學的數學等價性:資訊論是兩個領域的共同基礎,生成模型的擴散過程與非平衡統計力學描述資訊損失的過程在數學上完全對應,許多開發出來的方法工具在兩領域都有精確對應的形式。
  • 基礎模型的遷移學習策略:先在廣泛材料資料集上訓練基礎力場表示,再針對特定材料類別進行蒸餾微調,既能保持計算效率也能獲得專一性。