Schuyler Stacy2026-06-16

如何製作能正確呈現標題的 AI 電影海報(2026)

如何製作 AI 電影海報:可直接貼上的類型提示詞、正確的 2:3 尺寸,以及讓標題清晰的兩步驟修正方法 — 另附可批次生成的 API 程式碼。

如何製作能正確呈現標題的 AI 電影海報(2026)

AI 電影海報最困難的地方不是圖片。任何影像模型大約二十秒就能生成一張充滿情緒的主角畫面。真正困難的是所有讓它看起來像海報的元素:沒有融化成胡言亂語的標題、真正看得清楚的標語、底部的演職員名單,以及像標準電影海報而不是正方形的畫面比例。我花了一個週末在五種類型中生成海報,幾乎每一次失敗都能追溯到三件事之一 — 比例錯誤、沒有留下文字空間,或是要求模型在繪製作品的同一個步驟中,同時畫出一整段排版文字。

本指南會解決這三個問題。你會獲得依類型分類、可直接複製貼上的提示詞,一組能把你自己的照片變成海報的提示詞,讓標題變清晰的兩步驟技巧,以及 — 如果你想製作五十張而不是五張 — 可以直接執行的 API 呼叫。整個流程由兩個模型完成:gpt-image-2 用於精確、多語言的文字,以及 Gemini 3 Pro Image (許多人稱它為 Nano Banana Pro)用於風格與 4K 輸出。兩者都能透過 GPTProto 執行,因此切換模型只需修改一行。

 

目錄

海報提示詞的結構

海報必須在大約一秒內抓住注意力,因此有效的提示詞只需描述四件事:一個主體、一種類型與情緒、光線,以及文字要放在哪裡。最後一點是人們最常忽略的。如果你沒有告訴模型要留下空間,它會把畫面填得滿滿的,最後你會找不到不遮住臉部的地方來放標題。

一個可靠的結構是:[主體 + 動作] + [類型與情緒] + [光線與鏡頭] + [色彩分級] + [明確指定標題與演職員名單的留白] + [長寬比]。控制在幾個句子內。更長的提示詞不會讓海報更好 — 只會給模型更多把文字弄亂的機會。

請記住這句話:先描述畫面,再告訴模型要在哪裡留下空白畫布。

依類型分類的可直接複製提示詞

以下每一段都是文字生成影像提示詞。它們刻意為標題保留空間,並要求使用 2:3 畫面比例 — 這是真實電影海報的形狀。在 Gemini 3 Pro Image 上執行可獲得最豐富的風格;如果你已經知道標題文字會很多,則可使用 gpt-image-2。

動作

一名孤獨的特種部隊行動人員在黃金時刻衝過正在崩塌的屋頂,塵土與碎屑凝結在半空,直升機在充滿煙霧的天空中盤旋,以 35mm 變形寬銀幕鏡頭拍攝,強烈的輪廓光,青綠與橙色調,超高細節且具電影感。頂部三分之一保持乾淨,留給醒目的金屬質感標題;底部 15% 加深,留給演職員名單。直式電影海報,2:3。

恐怖

夜晚從門口望向一條昏暗的農舍走廊,遠處盡頭站著一個失焦的人影,微弱的月光,強烈的電影顆粒感,低飽和的綠色與病態的黃色,深沉陰影吞沒邊緣,50mm 鏡頭,令人不安的負空間。上方保持空白,留給纖細的襯線標題與簡短標語。直式電影海報,2:3。

科幻

夜晚,一個孤獨的人影站在屋頂上俯瞰霓虹巨型城市,高聳的全息廣告看板,飛行載具拖曳著光跡,體積霧,青色與洋紅色調,濕潤的反光表面,超廣角電影構圖。頂部中央保留清晰空間,留給寬幅未來感標題;底部邊緣留給演職員名單。直式電影海報,2:3。

愛情

黃昏時分,兩個人在雨水映亮的城市街道上、串燈下靠近站立,溫暖柔和的散景,柔和的逆光,淺景深,電影攝影色彩,親密而安靜。頂部留下大量空曠天空,留給優雅的手寫體標題;底部留出空間放置單行標語。直式電影海報,2:3。

動畫

一名勇敢的年輕發明家和一個小巧圓潤的機器人夥伴,在日出時站在綠草如茵的山頂上,充滿風格化的 3D 動畫電影質感,柔和的全域照明,溫暖且飽和的色彩,富有表情的臉部,家庭冒險氛圍。天空頂部保持開闊,留給大型圓潤標題;底部留給上映日期欄。直式電影海報,2:3。

如上所示,保持通用的動畫風格。要求使用特定工作室的獨有風格,或直接指定其角色名稱,會讓你陷入商標問題,而你不會希望商業海報建立在這種風險之上。

把你自己的照片變成海報

人們最常搜尋的版本是「把我放上海報」。這屬於影像編輯工作:你提供一張照片作為參考,模型會在保留相貌特徵的同時,圍繞照片構成海報。使用你自己的照片,或是你擁有相關權利的虛構角色 — 不要使用真實名人,也不要使用商標角色。未經同意把別人的臉放上海報,是這裡唯一可能真的讓你惹上麻煩的捷徑。

將以下提示詞貼到附有你照片的影像編輯模型中:

動作主角

以我上傳的照片作為主角,製作一張電影感動作海報:中央採用低角度英雄姿勢,黃金時刻的輪廓光,身後有煙霧與火星,青綠與橙色調。保持我的臉部與相貌特徵不變。頂部三分之一保持空白,留給標題。直式,2:3。

愛情,兩位主角(附上兩張照片)

以兩張上傳的照片作為兩位主角,構成一張愛情海報:兩人的臉靠得很近,身後是黃昏城市街道的溫暖光線與柔和散景。保留兩人的相貌特徵。頂部留出空間放置手寫體標題,底部放置標語。直式,2:3。

恐怖獨角戲

將上傳的肖像照變成恐怖電影海報的主角:半張臉隱沒在陰影中,冰冷月光,低飽和色調,強烈顆粒感,身後是一條空蕩走廊。保留相貌特徵。上方保留空間,留給纖細標題。直式,2:3。

想在不撰寫程式碼的情況下試試這些提示詞嗎?在 gpt-image-2 影像編輯頁面Gemini 3 Pro Image 影像編輯頁面上執行,或直接跳到完成品 AI Movie Poster Maker

如何選擇模型:文字或風格

兩個模型正好沿著一條界線分工 — 文字精準度與其他一切。

在我測試的所有模型中,gpt-image-2 生成影像內文字的準確度最高,包括密集的演職員名單與非拉丁文字。如果你的標題是日文或中文,就應該選它。它按 token 計費(GPT Proto 上每 1M 輸入 token 為 $6.4,每 1M 輸出 token 為 $24),因此單張高品質大型海報的費用會高於按張計費的模型,而且尺寸與品質越高,費用也會增加。

Gemini 3 Pro Image 則偏向另一端:更強的寫實風格、更好的系列角色一致性、最高可輸出 4K,以及每張固定 $0.0804。當你執行批次任務時,這種可預測性正是它的價值所在。

  gpt-image-2 Gemini 3 Pro Image(Nano Banana Pro)
最擅長 精確、多語言的影像內文字;複雜版面 寫實風格、系列中的角色一致性
最高解析度 最長邊最高 3840px 最高 4K(2:3 時為 3392×5056)
GPT Proto 上的定價 按 token 計費:每 1M 輸入 $6.4,每 1M 輸出 $24 每張固定 $0.0804
適合使用的情況 標題文字密集或使用非拉丁文字,而且必須完全正確 你想要藝術效果、4K 輸出或大量批次生成

實際操作上:先在 Gemini 3 Pro Image 中製作藝術效果與風格;如果標題無法清楚呈現 — 或你需要第二種語言 — 再使用 gpt-image-2 進行精確文字處理。這項取捨確實存在。gpt-image-2 的準確度意味著每張圖片成本更高,因此只有在文字確實需要它時,才選用這個模型。

設定正確的比例

影院電影海報的尺寸是 27×40 英吋,也就是 2:3 比例。大多數提示詞指南都會給你正方形圖片,因為那是模型的預設值;但當你把正方形海報放在真正的電影海報旁邊時,立刻就會顯得不對。請明確設定形狀。

在 gpt-image-2 中,以像素傳入 size:快速生成 2:3 圖片可使用 "1024x1536",若要用於印刷則可選擇更大的尺寸 — 最長邊最高 3840px,兩邊皆須為 16 的倍數,長寬比不得寬於 3:1。

在 Gemini 3 Pro Image 中,將 aspect_ratio 設為 "2:3",並將 size 設為 "4K",即可得到 3392×5056 的圖片,尺寸足以印刷。社群媒體可使用 9:16,適合限時動態;4:5 則適合動態消息。

真正的難點:讓標題文字清晰

這是我最常遇到的失敗。要求一個提示詞同時繪製複雜場景、長標題、標語與演職員名單時,文字會最先出問題 — 字母融化、單字拼錯、字距崩潰。兩個模型生成文字的能力都比去年的擴散模型好得多,但要在詳細的藝術作品中一次生成密集的排版文字,仍然是它們最容易失敗的地方。

解決方法是拆成兩個步驟。

第一步:生成藝術作品,並讓標題區域保持空白(上面的每個提示詞都已經這樣做)。第二步:將該圖片透過影像編輯呼叫再次送回模型,只要求它加入文字 — 標題、標語與演職員名單,並明確說明字型與位置。由於模型現在是在編輯,而不是從頭創造整個畫面,因此文字更常能清楚地呈現。

以下是一個第二步驟的影像編輯呼叫,使用第一步驟生成的圖片作為輸入:

titled = generate(
    "openai/gpt-image-2/image-edit",
    {
        "prompt": (
            'Add the title "MIDNIGHT SIGNAL" in a bold condensed sans-serif '
            "across the empty top third, a smaller tagline just below it, and a "
            "credits block along the bottom edge. Do not change the rest of the image."
        ),
        "images": [poster["outputs"][0]],   # the pass-one image URL
        "size": "1024x1536",
        "quality": "high",
        "response_format": "url",
    },
)
print(titled["outputs"])

如果是非拉丁文字標題,請在 gpt-image-2 上執行第二步 — 它的多語言文字生成能力,正是值得支付較高單張費用的原因。請記住這句話:不要讓模型在同一個步驟中既畫圖又寫標題。

應避免的錯誤

  • 在一個提示詞中塞入複雜場景、長標題和多個角色。文字會最先出問題 — 將流程拆成兩個步驟。
  • 沒有留下空白空間。沒有預留位置時,標題就會壓在臉上。
  • 生成正方形圖片。海報應為 2:3;在 gpt-image-2 上將 size 設為 1024x1536,或在 Gemini 3 Pro Image 上將 aspect_ratio 設為 2:3。
  • 忘記解析度。預設值約為 1K — 若要印刷,請明確傳入更大的尺寸。
  • 讓 URL 過期。GPT Proto 回傳的是暫時性圖片 URL,因此請立即下載,或改為請求 b64_json
  • 在提示詞中放入真實演員的臉或商標角色。請使用自己的照片或原創角色;承擔法律風險並不值得。

透過 API 執行:製作五十張,而不是五張

以上所有方法都能在網頁工具中一次生成一張海報。使用 API 的理由在於大量生成:為片單中的每部電影使用不同標題、每張海報生成五種長寬比,或同一張海報製作三種語言版本。GPT Proto 透過同一種非同步模式執行兩個模型 — 提交請求、取得 prediction id,然後輪詢直到完成。請先將金鑰設為環境變數(export GPTPROTO_API_KEY=sk-...),絕對不要將其硬編碼。

以下是一個提交工作並等待結果的小型輔助程式:

import os, time, requests

API_KEY = os.environ["GPTPROTO_API_KEY"]
BASE = "https://gptproto.com/api/v3"
HEADERS = {"Authorization": API_KEY, "Content-Type": "application/json"}

def generate(path, body):
    # submit the job
    r = requests.post(f"{BASE}/{path}", headers=HEADERS, json=body)
    r.raise_for_status()
    get_url = r.json()["data"]["urls"]["get"]
    # poll until the prediction finishes
    while True:
        data = requests.get(get_url, headers=HEADERS).json()["data"]
        if data["status"] in ("completed", "failed"):
            return data        # data["outputs"] holds the image URL(s)
        time.sleep(2)

使用每個模型生成海報 — 呼叫方式相同,只需使用不同的 body:

# gpt-image-2: pixel sizes + a quality level
poster = generate(
    "openai/gpt-image-2/text-to-image",
    {"prompt": PROMPT, "size": "1024x1536", "quality": "high", "response_format": "url"},
)

# Gemini 3 Pro Image: a size tier + an aspect ratio
poster = generate(
    "google/gemini-3-pro-image-preview/text-to-image",
    {"prompt": PROMPT, "size": "4K", "aspect_ratio": "2:3", "output_format": "png"},
)
print(poster["outputs"])

透過遍歷提示詞,一次批次處理整個片單:

genres = {"action": ACTION_PROMPT, "horror": HORROR_PROMPT, "scifi": SCIFI_PROMPT}

for name, prompt in genres.items():
    out = generate(
        "google/gemini-3-pro-image-preview/text-to-image",
        {"prompt": prompt, "size": "4K", "aspect_ratio": "2:3", "output_format": "png"},
    )
    print(name, out["outputs"])

想快速測試的話,也可以使用 cURL:

curl --location 'https://gptproto.com/api/v3/openai/gpt-image-2/text-to-image' \
  --header 'Authorization: GPTPROTO_API_KEY' \
  --header 'Content-Type: application/json' \
  --data '{"prompt":"<your poster prompt>","size":"1024x1536","quality":"high","response_format":"url"}'

唯一需要注意的是:兩個模型在同一個端點上使用不同的尺寸參數。gpt-image-2 需要像素尺寸與品質等級;Gemini 3 Pro Image 需要尺寸級別(1K/2K/4K)以及 aspect_ratio。驗證方式相同、輪詢方式相同,但 body 不同。(這些呼叫方式比照 GPT Proto 文件記載的請求格式;正式執行前,請查看模型頁面以確認目前的參數清單。)

立即試用

想在撰寫程式碼前先看看效果嗎?開啟 AI Movie Poster Maker,或在 gpt-image-2Gemini 3 Pro Image 模型頁面的 Playground 中執行提示詞。準備好批次生成後,上面的呼叫方式可以擴展到你需要的任何海報數量 — 而 定價頁面會清楚顯示每次執行的費用。

創意工作室

使用生產級 API 生成圖像、影片及更多內容。

開始創作
創意工作室
相關模型
全部模型
OpenAI
20% OFF
Google
40% OFF
Claude
20% OFF
Google
40% OFF

常見問題

免費嗎?

沒有固定的免費方案 — 兩個模型都按使用量計費。gpt-image-2 按 token 計費;Gemini 3 Pro Image 每張 $0.0804。目前費率請查看 Model 頁面。

哪個模型最擅長處理標題文字?

gpt-image-2,尤其適合密集或非拉丁文字。

印刷時應使用什麼尺寸?

在你能取得的最高解析度下使用 2:3 — Gemini 3 Pro Image 可達 4K(3392×5056),gpt-image-2 的最長邊則最高可達 3840px。

如何加入精確標題,又不讓文字看起來融化?

先生成標題區域留白的藝術作品,再於第二次影像編輯中加入文字。

可以製作自己的海報嗎?

可以 — 將自己的照片上傳到影像編輯呼叫中。不要未經同意使用其他真實人物的照片,也不要使用名人照片。

可以製作其他語言的海報嗎?

可以;使用 gpt-image-2 進行文字處理。

相關文章

更多部落格
wan.2.2:生成式影片的標準

wan.2.2:生成式影片的標準

重點摘要 wan.2.2 模型將視覺完整性與嚴格的提示詞遵循度置於原始生成速度之上。它需要相當強大的硬體,但能以可靠、無瑕疵的 AI 影片輸出回饋創作者。 生成式影片模型通常會以視覺連貫性為代價來追求速度。你輸入詳細的場景描述,等待幾分鐘後,得到的片段卻充滿變形的臉孔與不自然的動作。wan.2.2 背後的創作者採取了不同的方法。他們打造出一套尊重來源素材美學細節的系統,並仔細計算動態向量,以防止像素漂移。 原生運行這套架構需要強大的運算能力。你需要頂級 GPU 才能有效處理這些參數,這也是許多專業人士將繁重工作交給高效能 API 的原因。擺脫本地硬體限制後,你可以整合 ComfyUI、SVI Pro 與 PainterI2V 等工具,迫使模型完全按照你的構想運作。 要取得電影級成果,就不能只看最初五秒的輸出限制。串接多個片段並運用原生影格插值,你便能建構連貫的高解析度序列,真正符合最初的文字提示。

Schuyler Stacy | 2026-03-02

Veo 3 價格:2026 年 Google AI 影片生成器費用完整指南

Veo 3 價格:2026 年 Google AI 影片生成器費用完整指南

TL;DR Google Veo 3 的 Pro 方案每月 19.99 美元(生成次數有限),Ultra 方案每月 249.99 美元(大量創作)。API 價格則依模型版本和音訊功能而異,每秒約 0.10 至 0.40 美元。

Tiffany Layne | 2026-02-03

Qwen Image Edit:在任何 GPU 上最佳化模型

Qwen Image Edit:在任何 GPU 上最佳化模型

重點摘要 qwen image edit 生態系正透過精準、基於指令的修改,革新視覺 AI,而不只是進行基本的局部重繪。這項強大工具將自然語言指令與精確的像素操控結合,讓影像能夠無縫維持一致性。 然而,在本機執行這些進階模型需要大量硬體資源,尤其是 GPU VRAM。使用低階顯示卡的使用者必須依賴專門的 GGUF 量化流程,或將處理工作卸載至強大的雲端 API,以避免系統不斷發生記憶體不足崩潰。 無論你是安裝自訂 ComfyUI 節點以進行本機執行,還是使用 GPTProto 統一 API 等可擴展的企業級解決方案,最佳化設定對於穩定且專業級的影像編輯都至關重要。

Schuyler Stacy | 2026-04-02

Gemini 3 影像生成器:AI 藝術的未來

Gemini 3 影像生成器:AI 藝術的未來

重點摘要: 人工智慧領域正迅速從新奇實驗轉向專業應用。隨著創作者要求更高的影像保真度與更深入的情境理解,備受期待的 Gemini 3 影像生成器 將有望重新定義整個產業。這個新一代模型預計能解決 AI 長期存在的挑戰,提供超寫實視覺效果、完美的文字排版,以及直覺式的多模態協作。透過建立在前代模型穩健架構之上,Gemini 3 影像生成器很可能改變我們進行數位設計、行銷與內容創作的方式,讓每個人都能接觸進階藝術創作。

Michael Johnson | 2026-03-02