Wan 3.0 vs Seedance 2.5: Veredito rápido
| Decisão |
Melhor escolha |
Por quê |
| Valor geral |
Wan 3.0 |
Cada teste de 15 segundos em 720p custou $1.35 em vez de $3.81 |
| Atmosfera cinematográfica e narrativa |
Seedance 2.5 |
Suspense mais forte, progressão de iluminação, performance e direção de áudio |
| Produção de ecommerce |
Wan 3.0 |
Execução de tomada mais literal e menor custo de iteração nos nossos testes |
| Publicidade de marca premium |
Seedance 2.5 |
Ritmo mais contido, pausas mais limpas e um tom comercial menos genérico |
| Documento ou página web para vídeo |
Wan 3.0 |
Seu fluxo de trabalho oficial aceita arquivos e páginas web públicas |
| Grandes conjuntos de referências |
Seedance 2.5 |
A ByteDance documenta até 30 imagens, 10 vídeos e 10 clipes de áudio |
| Maior resolução documentada do GPT Proto |
Wan 3.0 |
Até 1080P, comparado com 480p e 720p no caminho testado do Seedance 2.5 |
Minha recomendação final é condicional, mas não neutra: comece com o Wan 3.0, a menos que o projeto precise especificamente do gosto cinematográfico mais forte do Seedance 2.5 ou de um fluxo de trabalho de edição com muitas referências. O Wan dá à maioria das equipes mais espaço para testar, falhar e regenerar sem transformar cada rascunho em uma decisão orçamentária.
O que são Wan 3.0 e Seedance 2.5?
Wan 3.0 é o modelo de geração audiovisual tudo-em-um da Alibaba. De acordo com o guia oficial do Wan 3.0 da Alibaba Cloud, um modelo cobre texto para vídeo, imagem para vídeo a partir do primeiro quadro, controle de primeiro e último quadro, geração com referências multimodais, edição de vídeo e extensão. Ele pode gerar clipes de 2 a 30 segundos em 480P, 720P ou 1080P e 30 fps. O áudio pode incluir diálogo, ambiente, efeitos sonoros e música.
Sua característica distintiva é o Wan 3.0 Omni-Reference. O Wan pode aceitar até 10 imagens de referência, cinco clipes de vídeo e cinco clipes de áudio. Ele também aceita um documento ou página web pública, o que o torna útil quando o material de origem é uma apresentação de produto, relatório, documento de treinamento ou página de campanha, em vez de um mood board convencional.
Seedance 2.5 é o modelo de áudio e vídeo de formato longo da ByteDance. o lançamento oficial da ByteDance descreve geração de passagem única de 30 segundos, extensão em várias rodadas e uma cota muito maior de referências de mídia: até 30 imagens, 10 vídeos e 10 clipes de áudio. Ele também enfatiza edição em nível de carimbo de data/hora, trabalho com tela verde, edição de perspectiva de câmera e alterações direcionadas em personagens, ações, áudio ou elementos de enredo.
Portanto, ambos os modelos alcançam 30 segundos, geram áudio com vídeo e suportam fluxos de trabalho de texto para vídeo e liderados por imagem. Suas prioridades são diferentes. O Wan aceita uma variedade maior de materiais de origem. O Seedance aceita uma biblioteca de mídia maior e oferece edição criativa mais granular.
Comparação de recursos e API
| Recurso |
Alibaba Wan 3.0 |
ByteDance Seedance 2.5 |
| Máximo oficial em geração única |
Até 30 segundos |
Até 30 segundos |
| Duração usada nos nossos testes |
15 segundos |
15 segundos |
| Resoluções do GPT Proto usadas |
720p |
720p |
| Maior resolução documentada do GPT Proto |
1080P |
720p nos caminhos testados |
| Taxa de quadros nos nossos arquivos de teste baixados |
30 fps |
24 fps |
| Áudio gerado nativo |
Sim |
Sim |
| Texto para vídeo |
Sim |
Sim |
| Imagem para vídeo |
Sim |
Sim |
| Controle de primeiro e último quadro |
Sim |
Disponível por meio de um fluxo de trabalho de imagem para vídeo |
| Capacidade publicada de referências de mídia |
10 imagens, 5 vídeos, 5 clipes de áudio |
30 imagens, 10 vídeos, 10 clipes de áudio |
| Entrada de documento |
Sim |
Não listado como entrada principal na visão geral oficial de lançamento |
| Entrada de página web pública |
Sim |
Não listado como entrada principal na visão geral oficial de lançamento |
| Ênfase em edição |
Fluxos de trabalho visuais, de enredo, diálogo e extensão |
Edições por carimbo de data/hora, tela verde, mudanças de perspectiva e edição com referências |
| String de modelo do GPT Proto |
wan-3.0 |
dreamina-seedance-2-5-260628 |
As especificações não dizem se um personagem manterá uma cicatriz, se o rótulo de uma garrafa continuará legível ou se uma faixa de áudio soará como um comercial genérico. É por isso que executamos os mesmos prompts.
Como testamos Wan 3.0 vs Seedance 2.5
Executamos três comparações controladas pelo GPT Proto:
Uma sequência cinematográfica de texto para vídeo em 16:9 com um personagem, batidas de história cronometradas, uma passagem de objeto, diálogo gerado e uma revelação final.
Um anúncio de perfume de texto para vídeo em 9:16 testando geometria da garrafa, texto legível, interação manual, iluminação e direção de som.
Um anúncio de protetor solar de imagem para vídeo em 9:16 testando preservação de referência, texto do produto, movimento das mãos, estabilidade do fundo e formato de entrega.
Cada modelo recebeu o mesmo prompt para esse teste. Todo vídeo foi solicitado em 720p e 15 segundos com áudio gerado. Fizemos uma geração por modelo por prompt e não refizemos o resultado mais fraco. Isso importa: seis vídeos são suficientes para uma comparação de produção útil, mas não são um benchmark estatístico de todas as seeds ou prompts possíveis.
Avaliamos aderência ao prompt, consistência de sujeito e produto, movimento, comportamento de câmera, preservação de texto, direção de áudio, formato de saída e cobrança real. Preço refere-se ao valor cobrado por essas execuções específicas do GPT Proto em 28 de agosto de 2026 e pode mudar.
Teste 1: Narração cinematográfica e consistência de personagem
O primeiro prompt pedia uma sequência de mercado noturno encharcado de chuva. A mesma jovem tinha que acender um fósforo, atravessar o mercado com uma mala prateada, entregar uma moeda a um vendedor idoso, abrir a mala sob uma placa azul e dizer “Antes da meia-noite.” O prompt também especificava cabelo preto curto, uma cicatriz acima da sobrancelha esquerda, uma capa de chuva vermelho-escura, batidas de história cronometradas e uma tomada final de grua subindo.
Saída do Wan 3.0
Saída do Seedance 2.5
O Seedance 2.5 produziu o filme mais forte. Ele preservou a cicatriz na sobrancelha, manteve uma performance séria e usou iluminação mais escura e uma base de áudio mais urgente para sustentar o perigo. A luz quente da mala também criou um desfecho final mais claro. Seu som não era apenas mais alto ou mais movimentado; ele entendeu que era uma cena de suspense.
O Wan 3.0 retornou uma imagem mais brilhante e limpa e preservou a mala prateada com mais precisão. O rosto da mulher, o cabelo curto e a capa de chuva vermelha permaneceram estáveis. Seu áudio era mais claro, mas também mais plano e monótono. A expressão da personagem ficou mais leve perto do fim, enfraquecendo a tensão em torno da fala “Antes da meia-noite”.
Nenhum modelo completou todas as instruções. O Wan basicamente pulou a corrida solicitada pelo mercado e omitiu a cicatriz. O Seedance mudou a mala prateada para uma cor muito mais escura. Ambos terminaram em um plano médio de frente, em vez de realizar o movimento final de grua subindo.
Para cinema, o Seedance 2.5 venceu esta rodada. A exposição mais limpa e a precisão de objetos do Wan não compensaram a direção emocional ausente.
Teste 2: Texto para vídeo para um anúncio de perfume de ecommerce
O segundo prompt descrevia uma garrafa de perfume fictícia com líquido âmbar pálido, tampa preta fosca e um rótulo exato NOIR 03. Ele solicitava uma abertura macro coberta de condensação, uma mão levantando e girando a garrafa, e uma tomada hero final com névoa e uma luz quente em movimento.
Saída do Wan 3.0
Saída do Seedance 2.5
O Wan 3.0 seguiu mais da lista de tomadas solicitada. Ele abriu com gotas de água, passou para uma rotação feita com a mão e terminou com névoa visível, iluminação quente e uma garrafa centralizada. O resultado parecia pronto para um formato convencional de anúncio de produto.
Sua falha mais importante foi o rótulo. A câmera de abertura via o rótulo através do fundo do vidro, então NOIR 03 apareceu invertido. O texto ficou correto depois, mas uma marca não pode usar uma abertura hero que exibe seu nome ao contrário.
O Seedance 2.5 foi menos literal. Ele basicamente pulou o tratamento macro solicitado, mostrou menos condensação e usou uma passagem de iluminação contida em vez do acabamento óbvio de fumaça e holofote do Wan. O rótulo branco também ficou maior do que o solicitado. No entanto, NOIR 03 permaneceu legível e a composição mais simples pareceu mais deliberada.
O áudio ampliou a diferença estilística. O Wan soou como um comercial normal: claro, direto e cheio. O Seedance soou mais nítido e mais premium, com pausas que deixavam o produto ocupar o quadro sem pressão sonora contínua.
O Wan venceu em cobertura de prompt e custo. O Seedance venceu em direção de marca de luxo. Para um anúncio de performance que precisa comunicar rapidamente, eu escolheria o Wan e corrigiria a abertura espelhada. Para uma campanha de fragrância de alto padrão, a contenção do Seedance pode justificar o gasto extra.
Teste 3: Preservação de produto em imagem para vídeo
Nossa comparação final partiu da mesma imagem de produto de protetor solar. O briefing pedia que ambos os modelos preservassem a embalagem exata, o rótulo, as cores, as proporções, o cenário de praia e os pequenos detalhes de design, enquanto adicionavam uma interação manual e um movimento de câmera controlado.
Saída do Wan 3.0
Saída do Seedance 2.5
Ambos os modelos mantiveram o produto reconhecível. O logotipo da marca, a tampa laranja, o texto sun, SPF 50+, e Light Gel permaneceram visíveis durante a maior parte de cada vídeo. O texto menor da embalagem ficou mais suave e menos estável, então nenhuma saída deve carregar alegações legalmente importantes sem uma sobreposição separada na pós-produção.
O Wan seguiu a instrução de movimento mais de perto. A mão levantou o tubo, mudou seu ângulo e o devolveu a um plano de produto centralizado. A praia, o oceano, a estrela-do-mar e as conchas também permaneceram estáveis. Seu áudio usou um tratamento comercial alegre e adicionou cantos de pássaros que faziam sentido para o cenário de praia, embora essa energia extra seria errada para uma campanha de cuidados com a pele mais silenciosa.
O Seedance preservou o produto principal, mas realizou menos da rotação solicitada. Sua luz difusa, ritmo mais lento e áudio mais calmo criaram um clima de cuidados com a pele mais suave. Foi o melhor ajuste emocional para um spot de estilo de vida relaxado, mas o ajuste mais fraco para o movimento solicitado.
O Wan venceu o teste de imagem para vídeo em seguimento de instruções e valor. O som mais calmo do Seedance era atraente, mas não compensou a rotação mais fraca do produto.
Preços de Wan 3.0 vs Seedance 2.5: Quanto realmente pagamos
A cobrança permaneceu inalterada nos três testes correspondentes.
| Teste |
Configurações |
Wan 3.0 |
Seedance 2.5 |
Diferença |
| História cinematográfica |
15s, 720p, 16:9, áudio |
$1.35 |
$3.81 |
$2.46 |
| Anúncio de perfume |
15s, 720p, 9:16, áudio |
$1.35 |
$3.81 |
$2.46 |
| Imagem de produto para vídeo |
15s, 720p, 9:16 selecionado, áudio |
$1.35 |
$3.81 |
$2.46 |
| Total para três gerações |
45 segundos por modelo |
$4.05 |
$11.43 |
$7.38 |
Para essas execuções, o custo efetivo foi de $0.09 por segundo gerado para o Wan e $0.254 por segundo gerado para o Seedance. O conteúdo do prompt e o formato horizontal versus vertical não mudaram a cobrança quando modelo, duração e resolução permaneceram fixos.
O Wan é a escolha mais econômica se uma equipe produz vários conceitos por SKU, localiza anúncios ou espera várias revisões. O Seedance ainda pode ser mais barato por ativo hero aprovado se sua direção de arte evitar uma regravação cara ou uma passagem manual de som. Nossos três testes únicos não podem provar uma taxa de rejeição menor, então isso continua sendo um julgamento dependente do fluxo de trabalho, e não um fato medido.
Wan 3.0 vs Seedance 2.5 para ecommerce
Escolha o Wan 3.0 para a maior parte da produção de ecommerce. Ele custou menos, completou mais dos movimentos de produto solicitados e oferece um caminho documentado de 1080P. Suas entradas de arquivo e página web também são úteis quando uma campanha começa com uma apresentação de produto ou página pública de produto.
O trade-off é o gosto. O Wan tende a preencher o quadro e a trilha sonora como um anúncio convencional. Ele adicionou névoa e iluminação óbvias ao vídeo de fragrância, depois escolheu áudio animado e pássaros para a cena de protetor solar. Isso é útil para criação social de ritmo rápido, mas pode parecer genérico quando a marca exige contenção.
Escolha o Seedance 2.5 para um anúncio hero premium quando iluminação, pausas, atmosfera e valor de marca percebido importam mais do que o custo de cada execução. Não presuma que um vídeo de melhor gosto seja automaticamente mais preciso: seu rótulo de perfume ampliado e proporção incorreta do protetor solar ainda exigiram revisão.
Para qualquer um dos modelos, renderize textos legais, preços, ingredientes e pequenas alegações de produto como sobreposições de pós-produção. Vídeo generativo pode preservar grandes elementos de marca surpreendentemente bem, mas textos minúsculos continuam frágeis demais para um arquivo mestre de ecommerce aprovado.
Wan 3.0 vs Seedance 2.5 para cinema
Escolha o Seedance 2.5 para cinema, pré-visualização, cenas lideradas por personagem e trabalhos narrativos premium. No nosso teste cinematográfico, ele lidou com suspense, performance, progressão de iluminação e som como partes da mesma cena. O Wan reproduziu objetos e rostos, mas não os moldou no mesmo arco emocional.
O design oficial de referência e edição do Seedance reforça esse resultado. Um cineasta pode fornecer um conjunto maior de referências de personagem, cenário, movimento e áudio, e então mirar momentos específicos por meio de edições baseadas em carimbo de data/hora. Controles de tela verde e perspectiva também são mais relevantes para um pipeline de produção do que entrada de documento.
O Wan continua útil para equipes de cinema que precisam de 1080P, saída de 30 fps, pré-visualização liderada por documento ou rascunhos mais acessíveis. Ele não é um modelo cinematográfico ruim. É simplesmente menos consistentemente dirigido artisticamente do que o Seedance no nosso prompt correspondente.
Wan 3.0 Omni-Reference vs referências do Seedance 2.5
A comparação de contagem de referências pode ser enganosa porque esses modelos definem amplitude de formas diferentes.
O Wan 3.0 aceita menos ativos de mídia — até 10 imagens, cinco vídeos e cinco clipes de áudio — mas também lê um documento ou página web pública. Isso torna o Omni-Reference valioso para marketing de produto, treinamento, educação e explicadores. Uma apresentação de produto pode carregar recursos e sequência; uma página web pode carregar posicionamento e contexto visual.
O Seedance 2.5 aceita referências criativas mais convencionais: até 30 imagens, 10 vídeos e 10 clipes de áudio. Isso é melhor para um filme com vários personagens, locações, referências de figurino, amostras de movimento, direção de voz e indicações musicais.
Use o Wan quando a fonte da verdade for informação estruturada. Use o Seedance quando a fonte da verdade for uma grande biblioteca de referências criativas.
Como testar ambos os modelos com uma conta GPT Proto
Ambos os modelos podem ser testados com o mesmo saldo do GPT Proto, mas seus campos de requisição e caminhos de provedor diferem. Copie o código ativo de cada página de modelo antes de implantar, porque esquemas de vídeo mudam com mais frequência do que endpoints de texto compatíveis com OpenAI.
Requisição de texto para vídeo do Wan 3.0
export GPTPROTO_API_KEY="your-api-key"
curl --request POST \
"https://gptproto.com/api/v3/alibaba/wan-3.0/text-to-video" \
--header "Authorization: Bearer $GPTPROTO_API_KEY" \
--header "Content-Type: application/json" \
--data '{
"prompt": "Um filme de produto vertical premium com movimento de câmera contido e som ambiente natural",
"negative_prompt": "",
"resolution": "720P",
"ratio": "9:16",
"duration": 15,
"generate_audio": true,
"audio": "",
"shot_type": "single",
"watermark": false,
"seed": 1
}'
Requisição de texto para vídeo do Seedance 2.5
export GPTPROTO_API_KEY="your-api-key"
curl --request POST \
"https://gptproto.com/api/v3/doubao/dreamina-seedance-2-5-260628/text-to-video" \
--header "Authorization: Bearer $GPTPROTO_API_KEY" \
--header "Content-Type: application/json" \
--data '{
"prompt": "Um filme de produto vertical premium com movimento de câmera contido e som ambiente natural",
"aspect_ratio": "9:16",
"duration": 15,
"resolution": "720p",
"generate_audio": true,
"camera_fixed": false,
"seed": -1
}'
Essas requisições enviam tarefas assíncronas de geração de vídeo. Armazene o identificador de tarefa retornado, consulte o método de status mostrado no painel da API ativa e salve o vídeo concluído prontamente. Não presuma que o campo ratio do Wan possa ser renomeado para aspect_ratio do Seedance, ou que a capitalização de 720P e 720p seja intercambiável.
Veredito final: qual é melhor?
O Wan 3.0 é a melhor escolha padrão. Nas nossas três comparações com o mesmo prompt, ele foi menos caro, mais literal e mais adequado à produção repetida de ecommerce. Sua opção de 1080P e entradas de documento ou página web também cobrem mais fluxos de trabalho empresariais.
O Seedance 2.5 é o melhor especialista criativo. Ele venceu o teste cinematográfico e entregou repetidamente um som mais ponderado — urgente quando a história precisava de tensão, nítido e espaçoso para fragrância, depois calmo para cuidados com a pele. Ele não apenas adiciona áudio; mostrou um instinto melhor para quando a trilha sonora deve pressionar e quando deve deixar espaço.
Escolha o Wan 3.0 quando volume, custo, formato e cobertura de instruções decidem se um fluxo de trabalho terá sucesso. Escolha o Seedance 2.5 quando um vídeo hero precisa parecer dirigido, e não apenas gerado.
Para a maioria das equipes, comece com Wan 3.0 no GPT Proto. Mova as tomadas hero para Seedance 2.5 quando o primeiro rascunho do Wan revelar que atmosfera e som — não precisão de produto ou orçamento — são os verdadeiros gargalos.