KeyFrame內部研究專用

I Turned ONE Photo Into a Paid Ad Using Claude AI (Full Tutorial)

蘋果妹·7月4日週六·15 min中文

三句話摘要

使用Claude + Tesfield MCP整合多模型進行AI圖片與影片生成,從角色創建到產品廣告全流程實戰。 Claude + Tesfield MCP整合讓非專業創作者能用簡單Prompt快速生成一致的AI角色視頻與產品廣告,關鍵是理解各模型專精領域與Widget上傳的必要性。 多模型聯動策略:Tesfield整合了Nano Banana Pro、GPT Image 2.0、Seed Dance、Canvas等多個專精模型,同一個對話框內可直接切換,避免在不同平台之間切換的繁瑣。

重點整理

重點
  • 1

    多模型聯動策略:Tesfield整合了Nano Banana Pro、GPT Image 2.0、Seed Dance、Canvas等多個專精模型,同一個對話框內可直接切換,避免在不同平台之間切換的繁瑣。

  • 2

    角色創建的成功率限制:Soul 2.0只能使用單一參考來源,無法同時參考多張圖片,因此需要分步驟處理——先生成人物,再用其他模型修改背景或道具。

  • 3

    Widget上傳介面的必要性:Claude無法直接讀取Tesfield上傳的圖片(直接按加號無效),必須在Prompt中明確要求「開啟Widget」才能彈出上傳介面,這是許多使用者容易踩坑的地方。

  • 4

    Prompt設計的精細化:描述時要簡單明確,避免過度複雜導致AI生成不可用的片段;要特別強調細節(如螢幕尺寸比例、人物表情不動等),這些需求都是經試錯後的精華。

實用技巧與重點

乾貨
  • 工具與模型:
  • Tesfield MCP連接方式:進tesfield.com → 複製連結 → Claude設定 → Add Custom Connector
  • 圖片生成:GPT Image 2.0(成功率最高)、Nano Banana Pro(次選)、Soul 2.0(角色一致性)
  • 影片生成:Seed Dance 2.0(對嘴專用)、Canvas 3.0(一般片花推薦)
  • 角色訓練:上傳5-20張照片(建議滿20張效果最好)
  • 關鍵參數與比例:
  • 影片格式:9比16(直式)
  • 角色複製成功率:60-70%
  • Widget上傳圖片建議:去背、背景乾淨、無其他物品
  • iPhone Fold預期售價:美金$196(台幣約6萬)
  • 操作流程步驟:
  • 設定MCP連接器 → 登入Tesfield帳號 → 確認Connectors顯示啟用
  • 提示詞列出Tesfield所有功能與模型
  • 設定角色:送出Prompt → 點Continue → 上傳20張照片 → 再送出一次對話才執行
  • 生成圖片:指定模型與角色名稱 → 直接送出
  • 上傳參考圖片:Prompt要說「開啟Widget讓我上傳」 → 點加號上傳 → Continue → 送出對話
  • 生成影片:指定模型與簡單的畫面指示 → 送出 → 等待(時間隨影片長度增加)

結論

結論

Claude + Tesfield MCP整合讓非專業創作者能用簡單Prompt快速生成一致的AI角色視頻與產品廣告,關鍵是理解各模型專精領域與Widget上傳的必要性。

完整解析

詳細

Claude本身沒有圖片與影片生成功能,但透過Tesfield的MCP整合,成為一個多模型中樞。設置時先進入tesfield.com複製該平台的連結,再進入Claude的Connectors設定,新增Custom Connector並貼上連結,登入Tesfield帳號後即可授權。設置完成後,你可以在Claude的同一個對話框內直接調用Tesfield旗下所有模型。

在實務應用上,最強大的功能是角色一致性。透過Soul 2.0模型,上傳20張自己的照片進行訓練,系統會自動建立一個以你的臉部特徵為基礎的角色。之後任何涉及你的臉的生成需求,只要在Prompt中指定角色名稱,就能保持臉部的一致性。實測成功率約60-70%,因此有時需要調整Prompt或重新生成。

不過Soul 2.0有個重要限制:它只能參考單一圖片來源,無法同時參考多張圖片。當你想要生成「手持iPhone 4的自己」這類複合需求時,就必須分步驟處理。第一步先生成人物加上類似iPhone的東西(因為現實中沒有iPhone Fold的參考資料,AI難以精確還原),第二步再用GPT Image 2.0或Nano Banana Pro這類擅長物體編修的模型,將手機換成更符合要求的版本。

操作時有個關鍵陷阱:上傳參考圖片不能像一般AI工具一樣直接點加號附件。Claude無法直接將圖片傳遞給Tesfield,必須在Prompt中明確寫「開啟Widget讓我上傳」,才會彈出Tesfield的上傳介面。許多使用者初期都會困在這裡,瘋狂點加號卻無法上傳。另外,上傳的圖片最好去背且背景乾淨,否則會影響生成結果。

對於影片生成,若要做對嘴效果(錄音配合人物嘴形),只有Seed Dance 2.0能勝任,需要先上傳音檔讓系統對應。一般的產品片花或風景片花則推薦Canvas 3.0,穩定性較佳。Prompt要簡潔,避免過度描述導致AI生成出無法用的片段。比如產品廣告就單純寫「畫面平衡,右邊螢幕解鎖出現iOS桌面」,勝過長篇大論。

整個workflow的優勢在於Claude會自動調整和優化你的Prompt,然後才送到Tesfield執行,使用體驗比直接進Tesfield官網親切很多。所有Prompt和連結資訊講者都會放在影片資訊欄供下載參考。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing
編輯精選
83 min
AI 技術英文PODCAST8月26日

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing

Latent Space

  • 加速傳統物理模擬的典範轉移:氣象科學家原本認為 AI 無法匹敵數十年的物理建模工作,但傅里葉神經算子不僅達到同等精度,還快了一萬多倍。原本需要超級計算機的計算現在用消費級 GPU 就能完成,這改變了整個領域的思維方式。
  • 傅里葉域的非局部現象捕捉:傅里葉域能有效表示非局部現象(如大氣河流跨越千里的影響),且計算複雜度為準線性,遠優於完全連接的全局模型。這特別適合流體動力學、量子化學等自然現象中普遍存在的非局部相互作用。
  • 多解析度連續函數表示:神經算子將輸入輸出視為連續函數而非固定維度向量,可在推論時以任意解析度查詢,並能在更高解析度上疊加物理約束或額外數據,克服了固定解析度神經網路的限制。
Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Why the Next AI Breakthrough May Come from Physics with Max Welling - #774
55 min
AI 技術英文PODCAST8月25日

Why the Next AI Breakthrough May Come from Physics with Max Welling - #774

TWIML AI

  • 多層篩選的材料設計流程:先搜尋文獻資料庫找現有材料,若無合適的就用生成模型產生數十萬個候選分子,用機器學習力場進行分子動力學模擬篩選,再進行實驗驗證。這套流程相比傳統量子力學計算能加速效率數個數量級。
  • 生成AI與熱力學的數學等價性:資訊論是兩個領域的共同基礎,生成模型的擴散過程與非平衡統計力學描述資訊損失的過程在數學上完全對應,許多開發出來的方法工具在兩領域都有精確對應的形式。
  • 基礎模型的遷移學習策略:先在廣泛材料資料集上訓練基礎力場表示,再針對特定材料類別進行蒸餾微調,既能保持計算效率也能獲得專一性。