Что такое Dreamina Seedance 2.0?
Dreamina Seedance 2.0 — это текстово-видеомодель второго поколения ByteDance, созданная исследовательской командой Seed. Этот же движок Seedance 2.0 используется в потребительских приложениях ByteDance — CapCut и Dreamina (ранее Jimeng AI) — и доступен разработчикам через реселлеров API, таких как GPTProto. На этой странице модель работает в режиме text-to-video: вы отправляете промпт и получаете готовый клип со звуком, сгенерированным за один проход.
Главное отличие Seedance 2.0 от линейки 1.x — генерация аудио и видео за один проход. Диалоги, звуковые эффекты, фоновые шумы и музыка создаются одновременно с изображением в рамках одной генерации — без отдельного этапа работы со звуком и последующего монтажа. Модель сохраняет идентичность, особенности и стиль персонажа между кадрами, а именно с этим чаще всего возникают проблемы в пайплайнах создания коротких видео.
В GPTProto вы обращаетесь к dreamina-seedance-2-0-260128 с помощью одной строки модели и используете существующий баланс, поэтому можете переключаться между Dreamina Seedance 2.0, Doubao Seedance 2.0, Sora 2 и Veo 3 без отдельных аккаунтов и региональных ограничений при регистрации.
Технические характеристики
| Поле | Значение |
|---|---|
| Провайдер | ByteDance (команда Seed); стек BytePlus / Volcano Engine |
| Идентификатор веб-модели | dreamina-seedance-2-0-260128 |
| Режимы ввода | Текст-в-видео, изображение-в-видео, референс-в-видео |
| Поддерживаемые входные данные | Текст, изображение, видео, аудио (зависит от режима) |
| Результат | Видео с нативно синхронизированным звуком (один проход) |
| Длительность | 4–15 с |
| Разрешение | 480p / 720p / 1080p |
| Соотношение сторон | См. таблицу соотношений на странице (по умолчанию 16:9) |
| Аудио | Переключатель generate_audio |
| Происхождение контента | Метаданные C2PA + невидимый водяной знак, обязательные через API так же, как в приложениях |
Три способа работы: текст, изображение и референс
Dreamina Seedance 2.0 предоставляет три конечные точки генерации с одним и тем же идентификатором модели. Все они используют одинаковые основные параметры — aspect_ratio, duration, resolution, generate_audio, camera_fixed, seed — и отличаются только типом передаваемых данных.
Text-to-video — промпт на входе, клип на выходе. Конечная точка: POST /api/v3/doubao/dreamina-seedance-2-0-260128/text-to-video
Image-to-video — анимация статичного изображения; при необходимости можно указать last_image, чтобы управлять конечным кадром. Конечная точка: POST /api/v3/doubao/dreamina-seedance-2-0-260128/image-to-video
Reference-to-video — передача массивов images, videos и audios в качестве референсов для сохранения непрерывности персонажа и стиля. Конечная точка: POST /api/v3/doubao/dreamina-seedance-2-0-260128/reference-to-video
Все три режима используют одинаковую bearer-аутентификацию и описанный ниже процесс отправки и опроса статуса — меняются только входные поля.
Dreamina Seedance 2.0 и Sora 2, Veo 3 и Doubao Seedance 2.0
Все четыре модели работают в GPTProto с единым балансом, поэтому настоящий вопрос заключается в том, какую модель выбрать для каждой задачи. Указанные ниже цены действуют на сайте и приведены за один запуск.
| Dreamina Seedance 2.0 | Doubao Seedance 2.0 | Sora 2 | Veo 3 | |
|---|---|---|---|---|
| Разработчик | ByteDance | ByteDance | OpenAI | Google DeepMind |
| Тот же основной движок? | — | Да (маршрут Doubao) | Нет | Нет |
| Нативное аудио | Да, один проход | Да | Да | Да |
| Режимы ввода | текст / изображение / референс | текст / изображение / референс | текст / изображение | текст / изображение / референс |
| Максимальная длительность | 15 с | 15 с | 12 с | 8 с |
| Цена GPTProto за запуск | от $0.2957 | $0.2957 | $0.40 | $0.48 |
| Выбирайте, когда | минимальная стоимость запуска; 3 режима ввода | нужен тот же движок и настройки Doubao по умолчанию | нужна генерация на базе OpenAI | нужны 4K и кинематографичный контроль |
Если говорить честно: Dreamina Seedance 2.0 и Doubao Seedance 2.0 — это одна и та же генерация ByteDance, доступная через два брендированных маршрута — одинаковая цена $0.2957 за запуск, различия касаются настроек платформы, а не максимального качества результата. Среди этих четырёх моделей Seedance предлагает самую низкую стоимость запуска и единственная поддерживает здесь три разных режима ввода (текст, изображение и мультимодальный референс). Veo 3 ($0.48 за запуск) стоит выбрать, если нужны 4K и точный кинематографичный контроль; Sora 2 ($0.40 за запуск) — для генерации на базе OpenAI. Распространённый подход — создавать черновики в Seedance, а затем перерендеривать выбранный вариант в более дорогой модели.
Для черновиков за половину стоимости dreamina-seedance-2-0-fast-260128 выполняет запуск за $0.2365.
Переход с CapCut / Dreamina на API
Если вы создавали видео в CapCut или приложении Dreamina, API снимает ограничения на регистрацию внутри приложения и региональное развертывание, не требуя изучения нового SDK. Направьте клиент на https://gptproto.com/api/v3, передайте ключ как bearer-токен и отправьте POST-запрос к конечной точке задачи dreamina-seedance-2-0-260128. Один баланс покрывает работу со всеми остальными моделями, поэтому вы можете сравнивать Seedance с Sora 2 или Veo 3 в рамках одного обработчика задач.
Рецепты промптов
Seedance 2.0 лучше всего реагирует на чёткие указания в заданном порядке: стиль, затем объект, камера, освещение и движение.
- Главный кадр продукта (зафиксированная камера):
cinematic; matte-black wireless earbuds on wet slate, water droplets; locked-off static shot; soft studio key light from left; slow condensation forming— установитеcamera_fixed: true. - Короткая сцена с персонажем (наезд):
anime style; a courier cycling through a rainy neon alley at night; slow push in; reflections on the road; ambient rain and distant traffic— оставьтеgenerate_audio: true, чтобы добавить атмосферный звуковой фон. - Непрерывность на основе референсов: Передайте два изображения персонажа в
images[]и используйте промптsame character, new shot: walking through a morning market, handheld follow— референсный режим лучше сохраняет идентичность между сценами, чем новый текстовый промпт.
Описывайте движения камеры буквально ("slow push in", "tracking shot", "locked off") и прямо указывайте освещение. Расплывчатые промпты приводят к отклонениям; конкретные помогают сохранить замысел.
Чего ожидать: скорость, аудио и соотношения сторон
Время генерации. Поскольку клипы рендерятся асинхронно, рассчитывайте на ожидание, а не на мгновенный ответ. Стандартные короткие видео возвращаются быстрее всего; длинные 15-секундные клипы с несколькими референсами требуют больше времени — соответственно настройте интервал опроса и интерфейс отображения прогресса.
Аудио. При использовании generate_audio: true модель создаёт диалоги, эффекты, фоновые звуки и музыку в соответствии с изображением за один проход. Установите значение false для беззвучного клипа, если вы планируете самостоятельно добавить аудиодорожку — это часто используется для музыкальных видео или брендированного контента с фиксированным звуковым фоном.
Соотношение сторон. Выбирайте целевое соотношение при отправке запроса, а не обрезайте видео после генерации: модель выстраивает действие под заданный холст. По умолчанию используется 16:9; полный список соотношений приведён в таблице на странице.







