Dreamina Seedance 2.0이란 무엇인가요?
Dreamina Seedance 2.0은 ByteDance의 2세대 텍스트-투-비디오 모델로, Seed 연구팀이 만들었습니다. 동일한 Seedance 2.0 엔진이 ByteDance의 소비자 앱(CapCut 및 Dreamina, 구 Jimeng AI)을 구동하며, 개발자에게는 GPTProto 같은 API 리셀러를 통해 공개됩니다. 이 페이지에서 이 모델은 text-to-video 모드로 실행됩니다. 즉, 프롬프트를 보내면 같은 패스에서 생성된 오디오가 포함된 완성된 클립이 반환됩니다.
Seedance 2.0과 1.x 라인의 차이는 원패스(one-pass) 시청각 생성입니다. 대사, 음향 효과, 주변 소음, 음악이 별도의 오디오 단계나 이어붙이기 없이 단일 생성에서 화면과 함께 만들어집니다. 이 모델은 캐릭터의 정체성, 특징, 스타일을 여러 컷에 걸쳐 일관되게 유지하는데, 이는 대부분의 숏폼 파이프라인이 실제로 어려워하는 부분입니다.
GPTProto에서는 하나의 모델 문자열과 기존 잔액으로 dreamina-seedance-2-0-260128에 접근할 수 있습니다. 따라서 별도의 계정이나 지역별 가입 제한 없이 Dreamina Seedance 2.0, Doubao Seedance 2.0, Sora 2, Veo 3 사이를 라우팅할 수 있습니다.
사양
| 필드 | 값 |
|---|---|
| 공급자 | ByteDance (Seed 팀); BytePlus / Volcano Engine 스택 |
| 웹 모델 ID | dreamina-seedance-2-0-260128 |
| 입력 모드 | 텍스트-투-비디오, 이미지-투-비디오, 레퍼런스-투-비디오 |
| 허용 입력 | 텍스트, 이미지, 비디오, 오디오(모드에 따라 다름) |
| 출력 | 네이티브 동기화 오디오가 포함된 비디오(단일 패스) |
| 재생 시간 | 4–15초 |
| 해상도 | 480p / 720p / 1080p |
| 화면 비율 | 페이지의 비율 표 참조(기본 16:9) |
| 오디오 | generate_audio 토글 |
| 출처 | C2PA 메타데이터 + 비가시 워터마크, 앱과 동일하게 API를 통해 적용됨 |
세 가지 구동 방식: 텍스트, 이미지 & 레퍼런스
Dreamina Seedance 2.0은 동일한 모델 ID 아래 세 가지 생성 엔드포인트를 제공합니다. 각각은 동일한 핵심 제어 옵션인 aspect_ratio, duration, resolution, generate_audio, camera_fixed, seed을 사용하며, 입력 내용만 다릅니다.
텍스트-투-비디오 — 프롬프트 입력, 클립 출력. 엔드포인트: POST /api/v3/doubao/dreamina-seedance-2-0-260128/text-to-video
이미지-투-비디오 — 정지 이미지에 애니메이션을 적용합니다. 선택적으로 last_image을 지정해 마지막 프레임을 제어할 수 있습니다. 엔드포인트: POST /api/v3/doubao/dreamina-seedance-2-0-260128/image-to-video
레퍼런스-투-비디오 — images, videos, audios 배열을 전달하여 캐릭터와 스타일 연속성을 위한 레퍼런스로 사용합니다. 엔드포인트: POST /api/v3/doubao/dreamina-seedance-2-0-260128/reference-to-video
세 가지 모두 동일한 Bearer 인증과 아래에 표시된 동일한 제출-후-폴링(submit-and-poll) 흐름을 사용합니다. 입력 필드만 달라집니다.
Dreamina Seedance 2.0 vs Sora 2, Veo 3 & Doubao Seedance 2.0
네 가지 모두 하나의 잔액으로 GPTProto에서 실행되므로, 실제 질문은 각 작업을 어디로 라우팅할지입니다. 아래 가격은 이 사이트 기준 실행당 가격입니다.
| Dreamina Seedance 2.0 | Doubao Seedance 2.0 | Sora 2 | Veo 3 | |
|---|---|---|---|---|
| 개발사 | ByteDance | ByteDance | OpenAI | Google DeepMind |
| 동일한 핵심 엔진? | — | 예(Doubao 경유) | 아니요 | 아니요 |
| 네이티브 오디오 | 예, 단일 패스 | 예 | 예 | 예 |
| 입력 모드 | 텍스트 / 이미지 / 레퍼런스 | 텍스트 / 이미지 / 레퍼런스 | 텍스트 / 이미지 | 텍스트 / 이미지 / 레퍼런스 |
| 최대 재생 시간 | 15초 | 15초 | 12초 | 8초 |
| GPTProto 실행당 가격 | $0.2957부터 | $0.2957 | $0.40 | $0.48 |
| 이런 작업에 적합 | 가장 낮은 실행당 비용, 3가지 입력 모드 | 동일한 엔진, Doubao 기본 설정 | OpenAI 네이티브 생성 | 4K + 시네마틱 제어 |
솔직한 평가: Dreamina Seedance 2.0과 Doubao Seedance 2.0은 두 브랜드 경로를 통한 동일한 ByteDance 생성입니다. 실행당 $0.2957로 동일하며, 플랫폼 기본값만 다르고 출력 상한은 다르지 않습니다. 이 네 가지 중 Seedance는 실행당 비용이 가장 낮고, 여기서 유일하게 세 가지 뚜렷한 입력 모드(텍스트, 이미지, 멀티모달 레퍼런스)를 제공합니다. Veo 3 ($0.48/회)는 4K와 정밀한 시네마틱 제어가 필요할 때 선택하고, Sora 2($0.40/회)는 OpenAI 네이티브 생성에 적합합니다. 일반적인 패턴은 Seedance로 초안을 만든 다음, 선택한 테이크를 더 비싼 모델로 다시 렌더링하는 것입니다.
절반 비용의 초안용으로는 dreamina-seedance-2-0-fast-260128을 실행당 $0.2365에 이용할 수 있습니다.
CapCut / Dreamina에서 API로 전환하기
CapCut 또는 Dreamina 앱에서 생성해 왔다면, API를 사용하면 앱별 가입과 지역별 출시 제한이 사라지고 새 SDK를 배울 필요도 없습니다. 클라이언트를 https://gptproto.com/api/v3로 지정하고, 키를 Bearer 토큰으로 보낸 다음 dreamina-seedance-2-0-260128 작업 엔드포인트로 POST하세요. 하나의 잔액으로 모든 다른 모델도 사용할 수 있으므로, 동일한 작업 실행기에서 Seedance를 Sora 2나 Veo 3와 A/B 테스트할 수 있습니다.
프롬프트 레시피
Seedance 2.0은 명시적이고 순서가 있는 지시에 잘 반응합니다. 스타일, 그다음 피사체, 그다음 카메라, 그다음 조명, 그다음 모션 순으로 입력하세요.
- 제품 히어로(고정 카메라):
시네마틱; 젖은 슬레이트 위 무광 블랙 무선 이어버드, 물방울; 고정된 정적 숏; 왼쪽에서 들어오는 부드러운 스튜디오 키 라이트; 천천히 맺히는 결로—camera_fixed: true로 설정하세요. - 캐릭터 숏(푸시인):
애니메이션 스타일; 비 오는 네온 골목을 밤에 자전거로 통과하는 택배 기사; 느린 푸시인; 도로의 반사; 주변 빗소리와 먼 교통 소음— 배경 사운드를 위해generate_audio: true를 유지하세요. - 레퍼런스 기반 연속성: 캐릭터 스틸 이미지 두 장을
images[]에 전달하고같은 캐릭터, 새로운 컷: 아침 시장을 걸어가는 장면, 핸드헬드 추적이라고 프롬프트를 입력하세요. — 레퍼런스 모드는 새 텍스트 프롬프트보다 컷 전환에서 정체성을 더 잘 유지합니다.
카메라 무브를 문자 그대로 지정하세요("slow push in", "tracking shot", "locked off"). 조명도 직접적으로 명명하세요. 모호한 프롬프트는 흐트러지고, 구체적인 프롬프트는 유지됩니다.
기대할 사항: 속도, 오디오 & 화면 비율
생성 시간. 클립이 비동기적으로 렌더링되므로 즉각적인 응답이 아닌 대기 시간을 계획하세요. 일반적인 숏 클립이 가장 빠르고, 여러 레퍼런스가 포함된 15초 길이의 클립이 가장 오래 걸립니다. 폴링 간격과 진행률 UI를 이에 맞게 조정하세요.
오디오. generate_audio: true로 설정하면 모델이 대사, 효과음, 주변음, 음악을 같은 패스에서 화면에 맞게 생성합니다. 자체 트랙을 믹싱할 예정이라면 false로 설정해 무음 클립을 만들 수 있습니다. 음악 비디오나 고정 오디오 베드를 사용하는 브랜드 콘텐츠에서 흔한 방식입니다.
화면 비율. 이후에 크롭하지 말고 제출 시 대상 비율을 선택하세요. 모델은 주어진 캔버스에 맞게 액션을 프레이밍합니다. 기본값은 16:9이며, 전체 비율 목록은 페이지의 표에 있습니다.







