什麼是 Dreamina Seedance 2.0?
Dreamina Seedance 2.0 是 ByteDance 第二代文字轉影片模型,由其 Seed 研究團隊打造。同一個 Seedance 2.0 引擎也為 ByteDance 的消費者應用程式 — CapCut 和 Dreamina(前稱 Jimeng AI)— 提供支援,並透過 GPTProto 等 API 轉售商向開發者開放。在此頁面中,模型以 text-to-video 模式運作:你提交提示詞,它會在同一個生成流程中回傳一段已完成且包含音訊的影片。
Seedance 2.0 與 1.x 系列的最大差異,在於一次完成視聽生成。對白、音效、環境噪音和音樂會與畫面在單次生成中一同產生 — 不需要額外的音訊步驟,也不需要後製拼接。模型能在不同鏡頭之間維持角色的身分、特徵和風格一致,這正是大多數短影音製作流程最難處理的部分。
在 GPTProto 上,你只需使用一個模型字串和現有餘額即可存取 dreamina-seedance-2-0-260128,因此可以在 Dreamina Seedance 2.0、Doubao Seedance 2.0、Sora 2 和 Veo 3 之間進行路由,不需要分別註冊帳戶或受地區註冊限制。
規格
| 欄位 | 值 |
|---|---|
| 供應商 | ByteDance(Seed 團隊);BytePlus / Volcano Engine 技術堆疊 |
| 網頁模型 ID | dreamina-seedance-2-0-260128 |
| 輸入模式 | 文字轉影片、圖片轉影片、參考素材轉影片 |
| 接受的輸入 | 文字、圖片、影片、音訊(取決於模式) |
| 輸出 | 包含原生同步音訊的影片(單次生成) |
| 時長 | 4–15 秒 |
| 解析度 | 480p / 720p / 1080p |
| 長寬比 | 請參閱頁面上的比例表(預設為 16:9) |
| 音訊 | generate_audio 切換開關 |
| 來源資訊 | C2PA 中繼資料 + 隱形浮水印,透過 API 強制套用,與應用程式中的方式相同 |
三種使用方式:文字、圖片與參考素材
Dreamina Seedance 2.0 在同一個模型 ID 下提供三個生成端點。每個端點都採用相同的核心控制項 — aspect_ratio、duration、resolution、generate_audio、camera_fixed、seed — 唯一差異在於你提供給它的輸入內容。
文字轉影片 — 輸入提示詞,輸出影片。端點:POST /api/v3/doubao/dreamina-seedance-2-0-260128/text-to-video
圖片轉影片 — 將靜態圖片製作成動畫;也可以選擇設定 last_image 來控制結尾畫面。端點:POST /api/v3/doubao/dreamina-seedance-2-0-260128/image-to-video
參考素材轉影片 — 傳入 images、videos 和 audios 陣列,作為維持角色與風格連貫性的參考素材。端點:POST /api/v3/doubao/dreamina-seedance-2-0-260128/reference-to-video
三者都使用相同的 bearer 驗證,以及下方展示的相同提交並輪詢流程 — 只有輸入欄位會變更。
Dreamina Seedance 2.0 與 Sora 2、Veo 3 及 Doubao Seedance 2.0 的比較
四者都能在 GPTProto 上共用一個餘額執行,因此真正要考慮的是每項工作應該路由至哪個模型。以下價格為網站上的每次執行價格。
| Dreamina Seedance 2.0 | Doubao Seedance 2.0 | Sora 2 | Veo 3 | |
|---|---|---|---|---|
| 製作者 | ByteDance | ByteDance | OpenAI | Google DeepMind |
| 相同的核心引擎? | — | 是(Doubao 路由) | 否 | 否 |
| 原生音訊 | 是,單次生成 | 是 | 是 | 是 |
| 輸入模式 | 文字 / 圖片 / 參考素材 | 文字 / 圖片 / 參考素材 | 文字 / 圖片 | 文字 / 圖片 / 參考素材 |
| 最長時長 | 15 秒 | 15 秒 | 12 秒 | 8 秒 |
| GPTProto 價格/次 | 最低 $0.2957 | $0.2957 | $0.40 | $0.48 |
| 適合使用的情境 | 每次執行成本最低;3 種輸入模式 | 相同引擎,Doubao 預設值 | OpenAI 原生生成 | 4K + 電影級控制 |
客觀來看: Dreamina Seedance 2.0 和 Doubao Seedance 2.0 是透過兩種品牌路由提供的相同 ByteDance 生成技術 — 每次執行價格同為 $0.2957,差異在平台預設值,而非輸出上限。在這四者之中,Seedance 的單次執行成本最低,也是此處唯一提供三種不同輸入模式(文字、圖片、多模態參考素材)的模型。 Veo 3 ($0.48/次)適合需要 4K 和精細電影級控制的情況;Sora 2($0.40/次)則適合 OpenAI 原生生成。常見做法是先使用 Seedance 製作草稿,再將選定的版本交由價格較高的模型重新渲染。
如需半價草稿,dreamina-seedance-2-0-fast-260128每次執行價格為 $0.2365。
從 CapCut / Dreamina 切換至 API
如果你一直在 CapCut 或 Dreamina 應用程式內生成內容,API 不僅免除了每個應用程式的註冊和地區推出限制,也不需要學習新的 SDK。將用戶端指向 https://gptproto.com/api/v3,以 bearer token 傳送你的金鑰,並對 dreamina-seedance-2-0-260128 任務端點發送 POST 請求。之後一個餘額即可涵蓋其他所有模型,因此你可以在同一個工作執行器中對 Seedance 與 Sora 2 或 Veo 3 進行 A/B 測試。
提示詞範例
Seedance 2.0 對明確且有順序的指示回應良好:先描述風格,再描述主體,接著是攝影機、光線,最後是動態。
- 產品主視覺(鎖定攝影機):
電影感;濕潤石板上的霧黑色無線耳機,水滴;固定不動的靜態鏡頭;左側柔和的攝影棚主光;水氣緩慢凝結— 設定camera_fixed: true. - 角色短片(推進鏡頭):
動漫風格;一名快遞員在夜晚穿越下著雨的霓虹小巷騎車;緩慢推進;道路上的倒影;環境雨聲與遠處車流聲— 保持generate_audio: true以生成環境音軌。 - 以參考素材維持連貫性: 在
images[]中傳入兩張角色靜態圖片,並提示同一角色,新鏡頭:在早市中行走,手持攝影跟拍— 與全新的文字提示詞相比,參考模式能更好地在剪接處維持角色身分。
請以字面方式描述攝影機運動(「slow push in」、「tracking shot」、「locked off」),並直接說明光線。模糊的提示詞容易產生偏移;具體的提示詞則能維持效果。
預期效果:速度、音訊與長寬比
生成時間。 由於影片會以非同步方式渲染,請預留等待時間,而不要期待即時回應。標準短片的回傳速度最快;包含多個參考素材的 15 秒長片所需時間最長 — 請據此調整輪詢間隔和任何進度介面。
音訊。 使用 generate_audio: true 時,模型會在同一個生成流程中,根據畫面產生對白、音效、環境聲和音樂。若你要混入自己的音軌,請將其設為 false,以生成無聲影片 — 這常用於音樂影片或具有固定音訊底床的品牌內容。
長寬比。 請在提交時選擇目標比例,而不是事後裁切;模型會針對提供給它的畫布構圖。預設為 16:9;完整比例清單請參閱頁面上的表格。







