將一張產品照片轉換成動態影像很容易。將它製作成包含吸引人的開場、流程、轉變,以及最終產品展示的廣告,則難得多。
我用一張洗衣精圖片測試了這個方法。我的第一次嘗試使用產品照片和一段很長的電影感提示詞。生成的影片看起來很精緻,但整體像是一次連續的視覺轉變:一名女子躺在床上,花朵逐漸填滿場景,而洗衣精瓶身在接近結尾時才出現。影片雖然營造出了氛圍,但提示詞中描述的洗衣動作幾乎都沒有呈現在影片裡。
第二種方法不是單純把提示詞寫得更長,而是改變輸入內容。我使用 GPT Image 2 將這個想法轉換成八格分鏡,接著把產品圖片和分鏡一同提供給 Seedance 2.5,作為一次 25 秒生成的視覺參考。
結果是一套實用的分鏡轉影片工作流程:
一張產品圖片 → 一份八格分鏡 → 一支多鏡頭廣告
它可以在不需要分別生成八段影片、不需要終端機,也不需要手動組裝鏡頭時間軸的情況下,產出完整的初稿。

工作流程概覽
| 階段 |
輸入 |
模型或任務 |
輸出 |
| 產品鎖定 |
原始產品照片 |
參考圖片 |
包裝識別錨點 |
| 故事規劃 |
25 秒概念 |
八個定時故事節拍 |
鏡頭清單 |
| 前期製作 |
產品圖片+分鏡提示詞 |
GPT Image 2 圖像編輯 |
一張 2×4 分鏡圖 |
| 影片製作 |
產品圖片+分鏡圖+定時動態提示詞 |
Seedance 2.5 參考圖轉影片 |
一支 25 秒廣告 |
| 品質控管 |
生成的影片 |
人工審查 |
保留、修改或重新生成 |
重要的改變在於分鏡圖。影像模型會先決定每個鏡頭應呈現的樣貌,之後影片模型才需要同時處理動作、攝影機方向、時間安排、角色連貫性與產品一致性。
為什麼純提示詞版本沒有呈現故事
原始提示詞已經包含臥室、洗衣機、倒入洗衣精、晾乾的床單、香氣反應、花田,以及最後的產品鏡頭。問題並不是描述性文字不足。
問題在於,一張產品圖片只提供了一個強烈的視覺錨點給影片模型。模型仍然必須自行創造:
出現在不同場景中的同一位女性;
屬於同一視覺世界的臥室與洗衣間;
八個不同鏡頭的構圖;
洗滌與倒入的動作;
每次剪接的時間與類型;
轉入受香氣啟發的幻想場景;以及
穩定一致的產品包裝。
沒有視覺計畫時,模型會將要求簡化成較容易維持連貫的內容:一位女性、一個房間、逐漸綻放的花朵變化,以及產品展示。
這也說明了為什麼加入「電影感」、「奢華」或「情感」等更多形容詞,無法解決真正的問題。這些詞描述的是風格,並沒有定義八個構圖,也無法強制產生八次編輯剪接。
步驟 1:使用產品照片作為識別錨點
對品牌產品製作而言,起始圖片不只是靈感來源,也是產品的視覺識別。
參考圖片應盡可能清楚呈現包裝:
瓶身輪廓與比例;
瓶蓋形狀與顏色;
提把位置;
標籤位置;
主要品牌名稱;
可見材質與表面質感;以及
希望保留的光線與色彩系列。
在這次測試中,來源圖片呈現一瓶位於陽光照耀臥室中的暖黃色 MAISON LIN 洗衣精。這使它同時適合作為包裝參考與風格參考。
請在圖像編輯或參考圖片模式中使用 GPT Image 2,而不要單靠文字生成洗衣精瓶身。GPT Image 2 能以高保真度處理圖片參考,但它仍然是生成式模型。分鏡圖與最終主視覺鏡頭都應再次檢查細小的標籤文字、標誌、提把與瓶蓋幾何形狀。
步驟 2:將想法轉化為八個可見的故事節拍
25 秒廣告不需要複雜的劇本,只需要一段觀眾無須解釋也能理解的流程。
在這支廣告中,我將故事分成八個節拍:
| 時間 |
故事節拍 |
視覺目的 |
攝影機方向 |
| 0–3 秒 |
女性觸摸已不再感覺新鮮的床單 |
建立需求 |
緩慢推近 |
| 3–6 秒 |
她將床單放入洗衣機 |
開始流程 |
側面跟拍 |
| 6–9 秒 |
她打開並倒入洗衣精 |
展示產品使用情境 |
微距特寫 |
| 9–12 秒 |
床單在水與泡沫中翻滾 |
將清潔過程視覺化 |
洗衣機門特寫 |
| 12–15 秒 |
潔淨的床單在陽光中飄動 |
呈現可見的新鮮感 |
寬幅橫向移動 |
| 15–18 秒 |
她聞著床單並閉上雙眼 |
將效益連結至情感 |
中近景特寫 |
| 18–22 秒 |
房間延伸成洋甘菊與薰衣草花田 |
將香氣轉化為視覺回饋 |
廣角揭示 |
| 22–25 秒 |
瓶身在最後的主視覺鏡頭中回歸 |
以品牌識別作結 |
緩慢推近產品並停留 |
這份鏡頭清單也能避免常見的 AI 影片錯誤:太早引入最終回饋。花朵不應在開頭幾秒就佔據臥室,而應在洗滌與香氣反應之後出現。
步驟 3:使用 GPT Image 2 生成分鏡圖
分別生成八個場景,可能導致女性、服裝、光線與居家環境在不同圖片間改變。相反地,我請 GPT Image 2 在同一張分鏡表上建立全部八個面板。
這同時完成兩項工作:
為影片模型提供完整故事的視覺地圖。
讓影像模型在同一畫布上共同設計反覆出現的女性、色彩調色盤與環境。
這並不能保證完美的一致性。生成式影像模型仍可能改變重複出現的臉孔或品牌細節。不過,一張共同製作的分鏡圖通常比八個互不相關的文字轉圖片要求更適合作為起點。
GPT Image 2 分鏡提示詞
建立一份專業的八面板電影感分鏡圖,用於 25 秒的奢華洗衣精廣告。
使用上傳的產品圖片作為精確的包裝參考。保留原始的淡暖黃色瓶身、米色瓶蓋、符合人體工學的側邊提把、瓶身比例、MAISON LIN 標籤位置、字體與包裝設計。不要重新設計瓶身,也不要創造不同品牌。
建立剛好八個獨立的直式 9:16 構圖,排列成兩列四欄。面板之間使用整齊的間隔。故事必須先在上排由左至右閱讀,再在下排由左至右閱讀。面板編號只能放在外側邊界。不要加入說明文字、廣告文案或浮水印。
在面板 1 中確立女性的精確身份,並在後續每個面板中重複使用完全相同的角色。將她視為一個鎖定的角色,而不是八位相似的女性。所有面板都要保持相同的臉部幾何、眼型、鼻子、嘴唇、膚色、及肩栗棕色頭髮、年齡、身體比例、奶油色亞麻上衣與象牙色長褲。
視覺方向:寫實的高級生活風格廣告、溫暖的晨間陽光、象牙色與米色調色盤、淡色橡木室內空間、寫實的白色亞麻布料、自然肌理、柔和膠片顆粒、內斂奢華,以及可信的布料物理效果。香氣意象必須使用白色洋甘菊與柔和的紫色薰衣草。不要使用紅色罌粟、玫瑰或隨機的彩色花朵。
面板 1:在溫暖、陽光充足的臥室中,女性坐在床沿,觸摸略微皺褶的白色床單,表情沉思且略感不滿。不要出現產品或花朵。
面板 2:在精緻的米色洗衣區中,同一位女性將白色床單放入現代前置式洗衣機。捕捉動作進行到一半的瞬間。
面板 3:開啟的洗衣機旁的高級微距鏡頭。她的手拿著完全相同的洗衣精瓶,將淡色液體洗衣精倒入量杯蓋中。包裝必須與參考圖片一致。
面板 4:透過洗衣機門的極近距離特寫。白色床單在清澈的水與細緻泡沫中翻滾。不要出現女性、產品或幻想花朵。
面板 5:戶外露臺的廣角鏡頭。潔淨的床單在溫暖陽光中於極簡曬衣繩上飄動,同一位女性固定其中一角。暫時不要出現魔法花朵。
面板 6:臥室中的情感中近景特寫。女性將潔淨的床單靠近臉部,吸入氣味並閉上雙眼,呈現細微的舒適表情。遠處背景可以開始出現少量淡淡的洋甘菊花瓣。
面板 7:電影感幻想廣角鏡頭。同一位女性披著白色床單,走過一片金色的白色洋甘菊與柔和紫色薰衣草花田。花朵須寫實,並採用內斂的魔幻寫實風格。
面板 8:臥室中的奢華最終產品鏡頭。完全相同的洗衣精瓶直立放置在摺疊的象牙色亞麻布上,並以清晰焦點呈現,旁邊有小束洋甘菊與薰衣草。背景中的同一位女性以柔和失焦方式呈現,正擁抱潔淨的床單。保留負空間,以便選擇性加入標語。
每個面板都必須是為硬切剪輯準備的獨立鏡頭,而不是同一個連續變形過程的八個階段。不要在面板之間合併場景。避免包裝變形、瓶身重複、臉孔不一致、手部扭曲、多餘手指、變形的家電、塑膠感皮膚或人工 CGI 花朵。

進入影片製作前的檢查項目
不要因為細小的裝飾差異而否決分鏡圖。請檢查會影響影片的細節:
如果某個面板失敗,請使用該面板的個別鏡頭提示詞,並搭配完整分鏡圖與產品照片作為參考來修復。除非需要精確的逐鏡頭製作控制,否則不要重新開始八次獨立生成。
步驟 4:將分鏡圖與產品參考提供給 Seedance 2.5
分鏡圖應被視為製作參考,而不是普通的第一幀。
上傳:
原始洗衣精圖片,作為產品識別參考;以及
完整分鏡圖,作為序列與構圖參考。
如果介面提供全能參考、多圖片、Multiframes 或參考圖轉影片模式,請使用該模式。標準的第一幀圖片轉影片欄位可能會將整個分鏡網格視為開場畫面,並嘗試讓網格本身動起來或變形。
若要取得最大控制力,可以將分鏡面板分配到個別參考欄位。對於本文最簡單、無需編輯的實驗,完整分鏡圖會作為一張有順序的製作地圖,而提示詞則會精確說明如何閱讀它。
Seedance 2.5 影片提示詞
建立一支完整的 25 秒直式 9:16 電影感洗衣精廣告,並搭配同步的自然音訊。
@Image1 是精確的產品識別參考。產品出現時,請保留瓶身輪廓、淡暖黃色、米色瓶蓋、提把位置、比例、MAISON LIN 標籤位置,以及可見的包裝設計。
@Image2 是完整的八面板分鏡圖。先由左至右閱讀上排,再由左至右閱讀下排。將每個面板視為獨立的鏡頭構圖。遵循分鏡圖中呈現的同一位女性、服裝、環境、光線與產品設計。
00:00–00:03 — 鏡頭 1。溫暖的臥室。女性觸摸白色床單,發現它不再感覺新鮮,攝影機緩慢推近。
00:03–00:06 — 硬切至鏡頭 2。她將床單放入前置式洗衣機時,採用側面跟拍。
00:06–00:09 — 硬切至鏡頭 3。產品微距特寫。她打開完全相同的洗衣精瓶,將淡色液體倒入量杯蓋中。手部動作自然,液體物理效果寫實。
00:09–00:12 — 硬切至鏡頭 4。透過洗衣機門特寫白色床單在清澈水流與細緻泡沫中翻滾。
00:12–00:15 — 硬切至鏡頭 5。露臺廣角鏡頭。潔淨床單在溫暖陽光與微風中飄動,女性固定其中一角。
00:15–00:18 — 硬切至鏡頭 6。回到臥室,她將床單靠近臉部,吸氣、閉上雙眼並放鬆。停留足夠時間,讓表情清楚傳達出來。
00:18–00:22 — 轉入鏡頭 7。香氣延伸成一片寫實的白色洋甘菊與柔和紫色薰衣草花田。女性披著床單走過花田。不要出現紅色花朵。
00:22–00:25 — 乾淨硬切至鏡頭 8。回到溫暖的臥室,呈現最終產品主視覺鏡頭。完全相同的瓶身直立放置在摺疊的象牙色亞麻布上,並以清晰焦點呈現。讓包裝保持穩定且清晰可讀,持續最後三秒。
在指定的時間界線使用乾淨的編輯剪接。不要將完整廣告變成一個持續變形的場景。不要跳過放入、倒入、洗滌、晾乾或聞香的動作。不要在香氣反應前引入魔法花朵。
音訊方向:柔和的晨間室內環境音、細微布料摩擦聲、清晰的瓶蓋聲、輕柔倒液聲、低沉的洗衣機旋轉聲、戶外微風,以及內斂溫暖的鋼琴聲。不要對話、旁白、字幕、隨機歌詞或生成的廣告文字。
寫實的高級生活風格廣告、自然膚質、寫實手部、可信的身體動作、寫實液體與布料物理效果、柔和膠片顆粒、穩定的暖色光線,以及一致的角色識別。不要出現重複人物、多餘產品、變形包裝、扭曲手部、塑膠感皮膚、過多泡沫、隨機文字或浮水印。
建議的生成設定
| 設定 |
本次測試的值 |
| 模式 |
參考圖轉影片或多模態參考模式 |
| 時長 |
25 秒 |
| 長寬比 |
9:16 |
| 解析度 |
以較低的可用解析度製作草稿;選定最終版本後再使用較高設定 |
| 音訊 | 開啟
|
| 固定攝影機 | 關閉
|
| Seed |
如果想重現或比較不同版本,請記錄 seed |
GPT Proto 目前列出 Seedance 2.5 可生成 4–30 秒的影音內容,因此完整的 25 秒序列可在單一任務中完成,不需要拆成數個短片段。
步驟 5:比較兩種結果
純提示詞與分鏡圖引導的方法可能使用相同的產品與整體概念,但它們提供給影片模型的指引程度截然不同。
| 評估項目 |
產品圖片+長提示詞 |
產品圖片+分鏡圖 |
| 視覺氛圍 |
溫暖且具電影感 |
溫暖且具電影感 |
| 清晰故事節拍數 |
低 |
規劃為八個節拍 |
| 洗滌動作 |
經常被跳過 |
在生成前以視覺方式錨定 |
| 攝影機構圖 |
由模型推測 |
事先定義 |
| 角色連貫性 |
主要依據文字 |
由一張共用分鏡圖強化 |
| 產品連貫性 |
依據原始圖片 |
由產品圖片與分鏡圖共同強化 |
| 轉場 |
傾向持續變形 |
以剪接與一次刻意安排的幻想轉場引導 |
| 手動片段組裝 |
不需要,但故事可能不完整 |
若單次輸出遵循分鏡圖,則不需要 |
第一次測試持續約 30 秒,但大致維持在同一個臥室構圖中。花朵逐漸蔓延到女性周圍,產品在接近結尾時出現。它看起來更像一支氛圍影片,而不是洗衣流程。
分鏡圖引導的版本具有更清晰的廣告結構:鋪陳、產品使用、洗滌證明、新鮮感、情感回饋、香氣視覺化,以及產品定格鏡頭。觀眾不再需要自行推測瓶身為何出現。
這不代表每個細節都會變得完美。包裝文字可能在動態過程中變得模糊,花田可能偏向錯誤的花種,手部也可能短暫遮住標籤。這些都是品質控管問題,而不是放棄工作流程的理由。
這會完全消除影片編輯嗎?
它可以消除鏡頭組裝,但不會消除審查與收尾.
如果生成的序列遵循八個節拍,就不需要建立八個影片檔案、將它們排列在時間軸上、匹配色彩,或掩飾片段之間的連貫性差異。Seedance 2.5 會將整個序列作為一項影片任務生成。
你仍然可以選擇加入:
經過確認的品牌標語;
標誌片尾卡;
授權音樂;
字幕或旁白;
法律或產品宣稱文字;或
修正後的最終產品定格鏡頭。
這與從八個互不相關的片段重新組建廣告不同。
分鏡圖轉影片與逐鏡頭生成
| 方法 |
一次完成分鏡圖轉影片 |
分別生成八個片段 |
| 準備時間 |
較低 |
較高 |
| 手動編輯 |
選用 |
通常需要 |
| 場景層級控制 |
中等 |
高 |
| 角色連貫性 |
共用的一次生成可能有所幫助 |
需要每個片段都使用嚴格的參考 |
| 修正單一薄弱鏡頭 |
可能需要選擇性編輯或重新生成 |
只替換該片段 |
| 最佳用途 |
快速廣告草稿、創意測試、社群內容 |
需要精確控制每次剪接的客戶最終版本 |
單次完成的方法不一定是最容易控制的製作方法。當目標是將一張產品圖片轉化為連貫的短篇廣告,而不必建立完整的編輯流程時,它是更有效率的方法。
常見問題與解決方法
影片仍然變成一個連續變形
加入明確的時間界線,並重複使用「硬切」、「獨立鏡頭」與「不要連續變形」等詞語。請確認使用的是參考或分鏡模式,而不是普通的第一幀動畫模式。
女性在場景之間發生變化
將完整分鏡圖生成在一張圖片中,而不要分別建立每個場景。如果臉孔仍然改變,請建立獨立的角色表,並與產品圖片和分鏡圖一起上傳。
瓶身或標籤發生變化
在影片步驟中再次上傳原始產品照片。不要只依賴分鏡圖中的小瓶身作為唯一產品參考。讓最終產品定格鏡頭相對靜止,並在發布前檢查。
花朵在洗滌流程前出現
說明圖案何時可以出現:香氣反應前不要出現魔法花朵。在影像與影片提示詞中都重複這項限制。
最終產品鏡頭太短
為產品定格鏡頭保留最後三秒,並明確要求攝影機停留。快速揭示會讓觀眾沒有足夠時間辨識產品。
模型跳過某個動作
減少該時間範圍內的同時動作數量。每個三秒節拍應只有一個主要主體動作與一個主要攝影機指示。
這是自動化工作流程嗎?
這個範例是創意工作流程,而不是完全自動化的製作管線。
它包含兩項模型任務:
GPT Image 2 根據產品參考與創意簡報建立分鏡圖。
Seedance 2.5 根據產品參考、分鏡圖與定時影片提示詞建立完整廣告。
創作者可以在 GPT Proto 瀏覽器介面中手動完成兩項任務。開發者之後可以透過 API 呼叫串接相同階段、儲存分鏡圖與影片 URL、加入重試機制,並在多個產品上執行這項工作流程。
這就是工作流程轉化為自動化的地方:創意邏輯維持不變,但軟體會處理重複提交、結果擷取、儲存與品質檢查佇列。
由於 GPT Proto 透過同一個平台提供影像與影片模型,團隊可以在兩個階段使用同一個帳戶、同一筆餘額與同一組 API 金鑰,而不必維護分開的供應商整合。
這套工作流程最適合的情況
這種方法適合:
從一張已核准產品照片開始的電商品牌;
測試多個活動概念的小型團隊;
為客戶快速製作預視內容的代理商;
需要 15–30 秒敘事內容的社群廣告;
能透過簡單流程展示產品效益的產品;以及
建立可重複產品轉影片工具的開發者。
當每個標籤、手部位置、產品宣稱、台詞或剪接都必須個別核准時,請使用更受控的逐鏡頭流程。
最終結論
失敗的版本並不是因為視覺風格薄弱,而是因為影片模型只收到一張產品圖片,以及一個完全以文字撰寫的故事。
分鏡圖在動態生成開始前,先將不可見的指示轉換為可見的鏡頭參考,從而改變了整個工作流程。這讓我們能要求 Seedance 2.5 生成一支完整的 25 秒廣告,而不是八個獨立片段。
可重複使用的方法很簡單:
使用參考圖片鎖定真實產品。
將廣告分成定時故事節拍。
使用 GPT Image 2 生成一致的分鏡圖。
將分鏡圖與原始產品提供給 Seedance 2.5。
一次生成完整序列,然後檢查產品、角色、動作與最終產品定格鏡頭。
你可以使用 GPT Image 2、Seedance 2.5 測試相同方法,或探索 GPT Proto 的 AI 影像 與 AI 影片 系列中的其他模型。