KeyFrame內部研究專用

【AI廣告營利】不用請攝影師也能做電商廣告!AI繪畫|圖像轉影片|AI字幕|Filmora 教學 #AI廣告 #AI廣告教學 #商品廣告 #AI繪畫 #AI商品圖 #GPTImage #圖像轉影片

攝影筆記·7月2日週四·25 min中文

三句話摘要

用 Ferumona AI 工具自己製作高質感商品廣告影片,成本從數千到數百元可完成。 只要掌握提示詞迭代、參數調整和軟體工作流,個人就能用 AI 工具製作出媲美專業團隊的商品廣告,成本和時間投入降至十分之一以下。 AI 工具降低製作門檻:傳統商品廣告需要導演、演員、攝影師和工作團隊,成本高昂。現在只需透過 Ferumona 的 AI 功能,單人就能完成整個製作流程,成本降至數百到數千元。

重點整理

重點
  • 1

    AI 工具降低製作門檻:傳統商品廣告需要導演、演員、攝影師和工作團隊,成本高昂。現在只需透過 Ferumona 的 AI 功能,單人就能完成整個製作流程,成本降至數百到數千元。

  • 2

    提示詞的反覆迭代是關鍵:從初次生成到最終滿意需要多輪調整。講者示範了多次修改提示詞來控制人物表情、燈光、產品細節、鏡頭運動等,最後才得到理想成果;不是一次生成就完美,而是在製作中持續優化。

  • 3

    建立「地圖照片」提高效率:製作多場景廣告時,先用細節詳實的提示詞生成第一張「地圖照片」,之後的場景就可複用這份提示詞,只修改該場景的具體動作,大幅提升製作速度。

  • 4

    完整工作流整合:從 AI 繪圖 → 圖像轉視頻 → 視頻編輯 → 字幕添加 → AI 音樂生成,全在同一平台完成,減少軟體間的銜接成本。

實用技巧與重點

乾貨
  • 工具與模型
  • 軟體:Ferumona(一站式剪輯軟體,整合多項 AI 模型)
  • AI 繪圖模型:GPT Image 2
  • 圖像轉視頻模型:Google Vio3
  • AI 音樂生成:內建音樂生成工具
  • 製作流程
  • 金工產品案例:4 張生成照片 → 4 段視頻 → 字幕 + LOGO + 音樂
  • 吐司面包案例:7 張生成照片 → 7 段視頻 → 同樣完整包裝
  • 具體設定參數
  • 解析度:1080p
  • 視頻時長:單段 4 秒(字幕段可 8 秒)
  • 框架比:16:9
  • 字幕動畫:打字機向上、自創模糊、淡入淡出
  • 提示詞核心要素
  • 人物:臉型五官不變、衣服設定、表情(專注、微笑)、視線方向
  • 環境:工作室背景、燈光強度、光影效果
  • 產品:尺寸、位置、細節保持(如「戒指需移除」、「100% 不變」)
  • 鏡頭:「鏡頭慢慢拉遠」、「鏡頭慢慢拉近」、「焦點在...」
  • 字幕優化功能
  • 批量套用格式:「套用字幕前軌道」(只改當前軌道)、「全部套用」(改所有軌道)
  • 屬性面板集中化:字幕、標題、動畫、文字樣式、重力效果一面搞定

結論

結論

只要掌握提示詞迭代、參數調整和軟體工作流,個人就能用 AI 工具製作出媲美專業團隊的商品廣告,成本和時間投入降至十分之一以下。

完整解析

詳細

講者潘水是攝影師,開場就點出現實:AI 短劇搶走了部分工作機會,但他的立場是「AI 不會取代你,只會淘汰跟不上時代的你」。傳統商品廣告製作動輒需要導演、演員、攝影師、工作團隊,成本與時間投入都很高。現在有更好的方案——用 Ferumona 這類整合 AI 的剪輯軟體,成本只需數百到數千元。

他用兩個實例展示完整流程。第一個案例是金工產品廣告。首先在 Ferumona 的素材庫裡用 GPT Image 2 生成照片。他先上傳自己拍的金工照片作為參考,寫出精細的提示詞——例如「生動的金工圖片,照片中產品維持不變,凸顯細節及光影」。系統生成後,他對比原圖與 AI 生成版,發現 AI 確實強化了光影與細節。

但一張照片不夠做廣告,他又生成了第二張。這次加入了自己的工作照,提示詞要求「人物臉型五官不變、衣服更換為工作服、環境為工作室、手拿產品展示」。生成後,他發現臉部太亮,於是複製提示詞,加入「調整亮度色調隨周圍環境」,再次生成。第三、四張照片分別是拍打和拋光動作,每次遇到問題——如產品位置不對、人物沒看著焦點——就微調提示詞並重新生成。

有了四張照片後,進入「圖像轉視頻」階段。他用 Google Vio3 將每張照片轉成 4 秒的視頻。系統會自動生成提示詞描述動作,但講者發現需要手工調整。例如第一張照片,系統原本設定「固定鏡頭」,他改成「鏡頭慢慢拉遠」;又發現系統誤認產品為「女性頭像」,改正為「獅子頭像」。有的視頻生成後帶了講話聲音和不符合預期的敲擊動作,他就在提示詞後加「不加其他動作」或「確保小物件一直存在不會消失」來修正。

五段視頻完成後進入編輯階段。他在 Ferumona 的時間線裡拖放視頻,加入片頭標題(選用電影雜誌海報風格的字體),輸入工作室 LOGO,設定打字機動畫。最後加上黑幕過渡和 AI 生成的音樂(他選了「適合工藝產品展示的廣告音樂」,融合氛圍、管弦樂、鋼琴)。整支金工廣告就完成了。

第二個案例是吐司面包廣告,流程幾乎相同但更複雜——他規劃了七個場景。關鍵技巧是第一張照片當「地圖」,提示詞設定得極詳細(工作室環境、不鏽鋼設備、人物動作、燈光),之後的場景都複用這份提示詞,只改動作敘述部分。例如第二場景就只把「動作」改成「將吐司面團整形放入模具」,保留環境和人物設定。這樣大幅加快製作速度,七場景視頻生成後,重複加字幕、LOGO、音樂的流程,整支廣告成片。

最後他介紹了 Ferumona 最新的字幕優化功能。時間線上有兩個字幕軌道,右邊屬性面板新增「批量套用」按鈕。選擇「套用字幕前軌道」只改當前軌道,選「全部套用」則把格式複製到所有軌道。此外,所有編輯功能(字幕、標題、動畫、文字樣式、重力效果等)都集中在屬性面板,不用跑去高級編輯頁面,大幅提升編輯效率。

關鍵時刻

Pipeline v2

帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。

事實查核

Pipeline v2

說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。

更多「AI 技術」的內容

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing
編輯精選
83 min
AI 技術英文PODCAST8月26日

🔬“We have foundation models for language, not for physics” — Anima Anandkumar, Bren Professor of Computing

Latent Space

  • 加速傳統物理模擬的典範轉移:氣象科學家原本認為 AI 無法匹敵數十年的物理建模工作,但傅里葉神經算子不僅達到同等精度,還快了一萬多倍。原本需要超級計算機的計算現在用消費級 GPU 就能完成,這改變了整個領域的思維方式。
  • 傅里葉域的非局部現象捕捉:傅里葉域能有效表示非局部現象(如大氣河流跨越千里的影響),且計算複雜度為準線性,遠優於完全連接的全局模型。這特別適合流體動力學、量子化學等自然現象中普遍存在的非局部相互作用。
  • 多解析度連續函數表示:神經算子將輸入輸出視為連續函數而非固定維度向量,可在推論時以任意解析度查詢,並能在更高解析度上疊加物理約束或額外數據,克服了固定解析度神經網路的限制。
Between Two Nerds: Attribution is dead, long live attribution
32 min
AI 技術英文PODCAST8月25日

Between Two Nerds: Attribution is dead, long live attribution

Risky Business

  • 工具成本的破壞性下降 — 傳統上,攻擊者必須重複使用昂貴自製的惡意軟體或工具組,因為開發和維護成本極高。這種成本結構使得安全研究人員可以通過工具特徵和程式碼簽名來追蹤攻擊者。LLM 自動化了代碼生成與維護工作流,使得攻擊者可以輕易為每個目標生成新工具,或改用通用系統工具,導致傳統的工具特徵分析失效。
  • 所有取證證據都在攻擊者掌控之中 — 無論是使用的 IP 位址、惡意軟體類型或戰術流程,這些都是攻擊者的主動選擇。即使看似是隨機巧合,攻擊者仍有能力在事前決定留下什麼痕跡。因此,所有可恢復的取證證據本質上都是攻擊者願意暴露的信息。
  • LLM 削弱工具簽名但保留高階行為特徵 — LLM 經過公開駭客技術訓練,使不同使用者產生相似的攻擊模式。然而,勒索軟體集團、國家級行為者的受害者選擇、贖金要求方式或目標模式等高階特徵仍具有識別價值。例如,鎖定加密交易所的攻擊幾乎只能指向朝鮮。
Why the Next AI Breakthrough May Come from Physics with Max Welling - #774
55 min
AI 技術英文PODCAST8月25日

Why the Next AI Breakthrough May Come from Physics with Max Welling - #774

TWIML AI

  • 多層篩選的材料設計流程:先搜尋文獻資料庫找現有材料,若無合適的就用生成模型產生數十萬個候選分子,用機器學習力場進行分子動力學模擬篩選,再進行實驗驗證。這套流程相比傳統量子力學計算能加速效率數個數量級。
  • 生成AI與熱力學的數學等價性:資訊論是兩個領域的共同基礎,生成模型的擴散過程與非平衡統計力學描述資訊損失的過程在數學上完全對應,許多開發出來的方法工具在兩領域都有精確對應的形式。
  • 基礎模型的遷移學習策略:先在廣泛材料資料集上訓練基礎力場表示,再針對特定材料類別進行蒸餾微調,既能保持計算效率也能獲得專一性。