¿Qué es Dreamina Seedance 2.0?
Dreamina Seedance 2.0 es el modelo de texto a video de segunda generación de ByteDance, desarrollado por su equipo de investigación Seed. El mismo motor Seedance 2.0 impulsa las aplicaciones de consumo de ByteDance — CapCut y Dreamina (antes Jimeng AI) — y está disponible para desarrolladores a través de revendedores de API como GPTProto. En esta página, el modelo funciona en modo text-to-video: envías un prompt y devuelve un clip terminado con audio generado en la misma pasada.
Lo que diferencia a Seedance 2.0 de la línea 1.x es la generación audiovisual en una sola pasada. El diálogo, los efectos de sonido, el ruido ambiental y la música se producen junto con la imagen en una única generación — sin un paso de audio separado ni montaje. El modelo mantiene constantes la identidad, los rasgos y el estilo de un personaje entre tomas, que es precisamente la parte con la que más dificultades tienen los flujos de trabajo de contenido corto.
En GPTProto accedes a dreamina-seedance-2-0-260128 con una cadena de modelo y tu saldo existente, de modo que puedes alternar entre Dreamina Seedance 2.0, Doubao Seedance 2.0, Sora 2 y Veo 3 sin cuentas separadas ni restricciones de registro regional.
Especificaciones
| Campo | Valor |
|---|---|
| Proveedor | ByteDance (equipo Seed); stack de BytePlus / Volcano Engine |
| ID del modelo web | dreamina-seedance-2-0-260128 |
| Modos de entrada | Texto a video, imagen a video, referencia a video |
| Entradas aceptadas | Texto, imagen, video, audio (según el modo) |
| Salida | Video con audio sincronizado nativo (una sola pasada) |
| Duración | 4–15 s |
| Resolución | 480p / 720p / 1080p |
| Relación de aspecto | Consulta la tabla de relaciones de aspecto en la página (16:9 predeterminada) |
| Audio | generate_audio alternancia |
| Procedencia | Metadatos C2PA + marca de agua invisible, aplicados mediante la API igual que en las aplicaciones |
Tres formas de usarlo: texto, imagen y referencia
Dreamina Seedance 2.0 ofrece tres endpoints de generación bajo el mismo ID de modelo. Cada uno acepta los mismos controles principales — aspect_ratio, duration, resolution, generate_audio, camera_fixed, seed — y solo se diferencia en lo que le proporcionas.
Texto a video — introduces un prompt y obtienes un clip. Endpoint: POST /api/v3/doubao/dreamina-seedance-2-0-260128/text-to-video
Imagen a video — anima una imagen fija; opcionalmente fija un last_image para controlar el fotograma final. Endpoint: POST /api/v3/doubao/dreamina-seedance-2-0-260128/image-to-video
Referencia a video — proporciona arrays de images, videos y audios como referencias para mantener la continuidad del personaje y el estilo. Endpoint: POST /api/v3/doubao/dreamina-seedance-2-0-260128/reference-to-video
Los tres usan la misma autenticación bearer y el mismo flujo de envío y consulta que se muestra a continuación — solo cambian los campos de entrada.
Dreamina Seedance 2.0 frente a Sora 2, Veo 3 y Doubao Seedance 2.0
Los cuatro funcionan en GPTProto con un solo saldo, así que la verdadera cuestión es a cuál dirigir cada tarea. Los precios siguientes son los del sitio, por ejecución.
| Dreamina Seedance 2.0 | Doubao Seedance 2.0 | Sora 2 | Veo 3 | |
|---|---|---|---|---|
| Fabricante | ByteDance | ByteDance | OpenAI | Google DeepMind |
| ¿Mismo motor principal? | — | Sí (ruta Doubao) | No | No |
| Audio nativo | Sí, una sola pasada | Sí | Sí | Sí |
| Modos de entrada | texto / imagen / referencia | texto / imagen / referencia | texto / imagen | texto / imagen / referencia |
| Duración máxima | 15 s | 15 s | 12 s | 8 s |
| Precio de GPTProto por ejecución | desde $0.2957 | $0.2957 | $0.40 | $0.48 |
| Elígelo cuando | menor coste por ejecución; 3 modos de entrada | mismo motor, valores predeterminados de Doubao | generación nativa de OpenAI | 4K + control cinematográfico |
Lectura honesta: Dreamina Seedance 2.0 y Doubao Seedance 2.0 son la misma generación de ByteDance mediante dos rutas de marca — el mismo precio de $0.2957 por ejecución, con diferencias en los valores predeterminados de la plataforma, no en el límite de calidad de salida. De estos cuatro, Seedance es la opción de menor coste por ejecución y la única aquí con tres modos de entrada distintos (texto, imagen y referencia multimodal). Veo 3 ($0.48 por ejecución) es la opción cuando necesitas 4K y un control cinematográfico preciso; Sora 2 ($0.40 por ejecución) es la opción para la generación nativa de OpenAI. Un patrón habitual es crear los borradores en Seedance y luego volver a renderizar la toma elegida en un modelo más caro.
Para borradores a mitad de precio, dreamina-seedance-2-0-fast-260128 cuesta $0.2365 por ejecución.
Pasar de CapCut / Dreamina a la API
Si has estado generando contenido dentro de CapCut o la aplicación Dreamina, la API elimina el registro específico de cada aplicación y las limitaciones de disponibilidad regional, sin necesidad de aprender un SDK nuevo. Apunta tu cliente a https://gptproto.com/api/v3, envía tu clave como token bearer y realiza un POST al endpoint de tareas dreamina-seedance-2-0-260128. Un solo saldo cubre todos los demás modelos, así que puedes comparar Seedance con Sora 2 o Veo 3 en el mismo ejecutor de trabajos.
Recetas de prompts
Seedance 2.0 responde a instrucciones explícitas y ordenadas: estilo, luego sujeto, después cámara, iluminación y movimiento.
- Producto estrella (cámara fija):
cinematográfico; auriculares inalámbricos negros mate sobre pizarra mojada, gotas de agua; toma estática sin movimiento de cámara; luz principal de estudio suave desde la izquierda; condensación formándose lentamente— establececamera_fixed: true. - Corto de personaje (acercamiento):
estilo anime; un repartidor recorre en bicicleta un callejón de neón lluvioso por la noche; acercamiento lento; reflejos en la carretera; lluvia ambiental y tráfico lejano— manténgenerate_audio: truepara la base ambiental. - Continuidad basada en referencias: proporciona dos imágenes fijas del personaje en
images[]y usa el promptmismo personaje, toma nueva: caminando por un mercado matutino, seguimiento cámara en mano— el modo de referencia mantiene mejor la identidad entre cortes que un prompt de texto nuevo.
Describe literalmente los movimientos de cámara ("acercamiento lento", "toma de seguimiento", "cámara fija") y nombra directamente la iluminación. Los prompts vagos se desvían; los específicos se mantienen.
Qué esperar: velocidad, audio y relaciones de aspecto
Tiempo de generación. Como los clips se renderizan de forma asíncrona, debes contar con una espera, no con una respuesta instantánea. Los cortos estándar son los que regresan más rápido; los clips largos de 15 segundos con varias referencias tardan más — ajusta en consecuencia el intervalo de consulta y cualquier interfaz de progreso.
Audio. Con generate_audio: true, el modelo crea el diálogo, los efectos, el sonido ambiental y la música para que coincidan con la imagen en la misma pasada. Establécelo en false para obtener un clip silencioso cuando vayas a mezclar tu propia pista — algo habitual en videoclips musicales o contenido de marca con una base de audio fija.
Relación de aspecto. Elige la relación objetivo al enviar la solicitud en lugar de recortar después; el modelo encuadra la acción para el lienzo que recibe. 16:9 es la opción predeterminada; la lista completa de relaciones está en la tabla de la página.







