Seedance 2.5 já está disponível — Primeiro na Atlas Cloud

Análise do Wan 3.0: Realizamos 49 testes com mesma semente contra Seedance 2.0 e Wan 2.7

Análise do Wan 3.0 baseada em 49 casos de conversão de imagem para vídeo com semente fixa e 720p, comparado com Seedance 2.0 e Wan 2.7 nas mesmas entradas. Onde vence, onde falha.

A maioria das primeiras impressões do Wan 3.0 são clipes isolados selecionados a dedo. Este é o outro tipo de análise: 49 casos de imagem-para-vídeo em 10 dimensões de capacidade, cada caso executado com uma semente fixa, em 720p, e depois reexecutado no Seedance 2.0 e no Wan 2.7 com o mesmo primeiro quadro, o mesmo prompt e a mesma semente. Cada afirmação abaixo tem um clipe por trás, e os importantes estão embutidos para que você possa discordar de mim quadro a quadro.

O veredito em um parágrafo: O Wan 3.0 é um avanço amplo e visível em relação ao Wan 2.7, e contra o Seedance 2.0 ele se situa no mesmo nível com uma divisão clara de personalidades. O Wan 3.0 vence em fidelidade e estabilidade, ou seja, fidelidade ao primeiro quadro, consistência de identidade ao longo do movimento, física e uma duração exclusiva de 30 segundos. O Seedance 2.0 vence em imaginação, ou seja, cenas com múltiplos sujeitos, instruções surreais e conteúdo estilizado. E um bug aparece com frequência suficiente para encabeçar a seção de riscos: o Wan 3.0 insiste em cortar para um novo ângulo de câmera que ninguém pediu.

Principais conclusões

  • Fiel vs. ousado é a verdadeira divisão. Dado um prompt que contradiz a imagem de entrada, o Wan 3.0 protege a imagem e suaviza a instrução; o Seedance 2.0 executa a instrução e reconstrói a imagem em torno dela. Escolha com base em qual falha você pode arcar.
  • A física é o ponto mais forte do Wan 3.0: um copo quebrando e uma tacada de sinuca superam tanto o Wan 2.7 quanto o Seedance 2.0 com a mesma semente, com padrões de fratura mais limpos e transferência de colisão.
  • A identidade se mantém. Em todas as nove execuções de 30 segundos, nenhum personagem trocou de rosto, roupa ou cenário. A consistência ao longo do movimento também superou o Seedance 2.0 em comparação direta.
  • O defeito de bloqueio são cortes de câmera não comandados: mudanças de plano abruptas e não solicitadas, às vezes com efeito fantasma, reproduzidas em execuções padrão e repetidamente dentro de clipes de 30 segundos.
  • 30 segundos em uma única geração é atualmente exclusivo neste confronto. Tanto o Seedance 2.0 quanto o Wan 2.7 param em 15.

Como esta análise do Wan 3.0 foi construída: mesma semente, mesmo quadro, mesmo prompt

Comparações entre modelos de vídeo geralmente falham antes de começar, porque cada modelo recebe uma imagem inicial diferente, um prompt reescrito ou uma segunda tentativa de sorte. Este teste elimina todas as três variáveis. Cada um dos 49 casos fixa um primeiro quadro, um prompt e uma semente, e esse trio exato é executado nos três modelos. Ninguém ganha uma segunda chance. O que mudou entre os clipes é o modelo, e nada mais.

As 10 dimensões cobrem movimento do sujeito, movimentos de câmera, física, interação entre múltiplos sujeitos, mudança de ambiente, paradas estáticas, texto e interface na tela, conteúdo estilizado, conflitos entre imagem e prompt, e gerações longas de 30 segundos. Os resultados foram pontuados por revisão humana de cada clipe, não por uma métrica.

Aqui está o sabor disso. Um copo de água cai de uma mesa. Mesmo quadro, mesma semente 3001, três modelos:

Três painéis idênticos de um copo de água com gás

Comparação tripla do teste do copo caindo: Wan 2.7 à esquerda, Wan 3.0 ao centro, Seedance 2.0 à direita, mesmo primeiro quadro, prompt e semente

Prompt: um copo cai da borda da mesa, a água derrama, o copo se quebra no chão. Da esquerda para a direita: Wan 2.7, Wan 3.0, Seedance 2.0. Observe o arco da queda e a fratura: a quebra do Wan 3.0 parece vidro, não uma troca de textura.

Esse clipe resume toda a análise em miniatura. O Wan 2.7 está claramente uma geração atrás. O Wan 3.0 e o Seedance 2.0 estão trocando golpes no mesmo nível, e qual é "melhor" depende inteiramente de em qual dimensão seu plano se encontra.

Onde o Wan 3.0 vence na análise: identidade, física e um sujeito com câmera fixa

Identidade ao longo do movimento. No teste do jornal (semente 1004), um idoso abaixa o jornal, olha para cima, sorri e acena. Simples, exceto que o movimento humano contínuo é exatamente onde os modelos de vídeo trocam rostos silenciosamente. O Wan 3.0 mantém o rosto do homem, a roupa e os detalhes do quarto travados em toda a cadeia de gestos. O Seedance 2.0, com a entrada idêntica, deixa o sujeito desviar.

Homem de boné lendo um jornal vietnamita em um banco de parque

Comparação lado a lado do teste do aceno com jornal, Wan 3.0 à esquerda mantendo a identidade, Seedance 2.0 à direita desviando

Semente 1004, 5 segundos: o homem abaixa o jornal, sorri, acena. Esquerda Wan 3.0, direita Seedance 2.0. Verifique o rosto antes e depois do aceno.

Lógica de movimento contra a geração anterior. O teste do balé (semente 1005) pede um giro elegante no lugar com a saia acompanhando. O Wan 3.0 completa o giro como um movimento contínuo e fisicamente coerente, e a dançarina é a mesma pessoa dos dois lados. A tentativa do Wan 2.7 torna a melhoria óbvia.

Uma bailarina de tutu branco sob um holofote de palco

Comparação do giro do balé empilhada verticalmente, Wan 3.0 acima completando um giro limpo, Wan 2.7 abaixo perdendo o movimento

Semente 1005, 5 segundos: um giro, saia esvoaçante. Topo Wan 3.0, fundo Wan 2.7. É isso que "lógica de movimento" significa na prática.

Mudar o ambiente sem tocar no sujeito. O teste da aurora (semente 5004) pede que o céu dance do verde ao roxo sobre uma montanha nevada. A armadilha é que a maioria dos modelos deixa a montanha balançar junto com o céu. O Wan 3.0 mantém a montanha parada enquanto a aurora anima; a montanha do Seedance 2.0 muda visivelmente. Se o seu trabalho é com fotos de produtos, imóveis ou qualquer cena com sujeito fixo, esta é a dimensão para se preocupar.

Picos de montanhas nevadas sob um céu estrelado noturno

Aurora sobre uma montanha nevada, Wan 3.0 à esquerda com a montanha fixa, Seedance 2.0 à direita com desvio do sujeito

Semente 5004, 6 segundos: aurora muda de verde para roxo, a montanha não deve se mover. Esquerda Wan 3.0, direita Seedance 2.0.

A física você já viu na queda do copo em três vias. O caso da tacada de sinuca (semente 3003) repete o padrão: a bola branca atinge, as bolas coloridas se espalham com transferência de momento crível e continuam rolando umas nas outras, e ambos os concorrentes ficam atrás com as mesmas entradas.

Onde o Wan 3.0 perde: cortes não comandados e surrealismo tímido

Uma análise honesta do Wan 3.0 tem que gastar um tempo real aqui, porque ambas as fraquezas são estruturais, não cosméticas.

A câmera corta sozinha. Peça um movimento contínuo de câmera e o Wan 3.0 tem o hábito de inserir uma mudança de plano brusca e não solicitada. O teste da torre (semente 2004) pede uma inclinação lenta da base ao topo, depois um recuo para uma visão completa. Por volta de 3,5 segundos o modelo simplesmente corta para uma configuração diferente, com um salto visível na gradação de cor através do corte.

Uma pagode de pedra de vários níveis em uma crista de montanha ao pôr do sol

Teste da torre do Wan 3.0 mostrando um corte brusco não comandado por volta de 3,5 segundos em vez de uma inclinação contínua

Semente 2004, 8 segundos, o prompt pede uma inclinação e revelação contínuas. Observe os 3,5s: esse corte nunca foi solicitado.

Para ser justo, o controle de câmera é o ponto fraco de todo o campo agora: o Seedance 2.0 também falhou em uma órbita completa neste teste, e o Wan 2.7 não oferece vantagem. O que torna pior no Wan 3.0 é que o mesmo comportamento de corte se repete dentro de execuções de 30 segundos, que é exatamente onde um único plano ininterrupto é mais importante. Mais sobre isso abaixo.

Instruções surreais são negociadas para baixo. A dimensão de conflito alimenta o modelo com um prompt que contradiz a imagem de entrada, que é a espinha dorsal de todo conceito de anúncio surreal. Entrada: uma sala de estar normal. Prompt: uma chuva forte começa a cair dentro de casa, encharcando os móveis.

Sala de estar minimalista

Quadro de entrada para o teste de conflito de chuva interna: um interior de sala de estar comum

O quadro de entrada que ambos os modelos receberam. O prompt pede chuva interna nesta cena, semente 10001.

Sala de estar bege minimalista com sofá curvo e pintura de retrato abstrata

Teste de conflito de chuva interna, Wan 3.0 à esquerda mal mudando a sala, Seedance 2.0 à direita comprometendo-se com chuva interna total

Esquerda Wan 3.0: mudança de iluminação e um respingo local perto da planta, sem chuva. Direita Seedance 2.0: chuva interna real, integrada de forma coerente. Esta foi a maior lacuna em todo o teste.

O Wan 3.0 responde com uma mudança de iluminação e um respingo simbólico perto da planta de casa. O Seedance 2.0 se compromete: chuva real, dentro de casa, e a sala permanece coerente enquanto se molha. Um segundo caso de conflito, uma baleia deslizando sobre uma sala de conferências (semente 10003), falha de forma diferente, mas pela mesma razão, com o Wan 3.0 tingindo todo o escritório de azul em vez de integrar a baleia. O padrão é consistente: quando a imagem e o prompt discordam, o Wan 3.0 fica do lado da imagem. Para trabalho fiel de produto, esse instinto é uma característica. Para briefs movidos pela imaginação, é a razão para usar outra coisa.

O exclusivo de 30 segundos do Wan 3.0, e o corte que o prejudica

Trinta segundos em uma única geração é a capacidade principal do Wan 3.0, e neste confronto nada mais alcança: tanto o Seedance 2.0 quanto o Wan 2.7 limitam em 15. O teste deu a ele seis casos dedicados mais escadas de duração, e o risco central de gerações longas, colapso de identidade, não aconteceu. Em nove clipes de 30 segundos, ninguém se transformou em uma pessoa diferente e nenhum cenário se tornou silenciosamente uma sala diferente.

O seguimento de instruções ao longo de uma linha do tempo longa também se manteve. O caso do futebol (semente 11006) roteiriza quatro batidas sequenciais: uma criança recua para abrir distância, os dois passam três vezes, um chuta longe, o outro comemora. Todas as quatro acontecem, em ordem:

Semente 11006, 30 segundos, uma geração: recuar, três passes, chute longo, comemoração. Encenação de múltiplos estágios em um único prompt, executada em sequência.

Então o mesmo defeito da seção de câmera volta. O caso da placa (semente 11004) pede um avanço e recuo extremamente lentos com o texto da placa permanecendo legível. Por volta de 4 a 5 segundos, o clipe se dissolve através de uma dupla exposição fantasma em uma composição diferente:

Semente 11004, 30 segundos: o prompt pede um avanço-recúo contínuo na placa. Observe 4 a 5 segundos: uma dissolução não comandada, com breve efeito fantasma, em um novo enquadramento.

Um terceiro caso longo, um retrato falante de 30 segundos (semente 11002), repete isso por volta de 15 a 17 segundos com uma dissolução mais uma mudança de postura e enquadramento. O modelo se comporta como se estivesse dirigindo um curta-metragem de múltiplos planos quando o briefing era uma única tomada. Quanto mais longo o clipe, mais chances ele toma. Até que isso seja domado, trate a saída de 30 segundos como uma sequência que você pode precisar cortar, em vez de uma tomada única garantida, e mantenha o exclusivo em perspectiva: é real, mantém a identidade e atualmente vem com um editor embutido que você não contratou.

Wan 3.0 vs Seedance 2.0: qual modelo para qual trabalho

O placar completo de 10 dimensões, condensado. "Empate" significa que nenhum lado teve uma vantagem reproduzível neste teste.

Dimensãovs Wan 2.7vs Seedance 2.0
Movimento do sujeitoMelhor lógica de movimentoWan 3.0 mantém melhor a identidade
Movimentos de câmeraEmpate, ambos fracosEmpate, ambos fracos, Wan 3.0 adiciona cortes não comandados
FísicaGrande avançoWan 3.0 à frente, mais fiel ao primeiro quadro
Interação multi-sujeitoEmpateSeedance 2.0 claramente à frente
Mudança de ambienteÀ frenteÀ frente, sujeito permanece fixo
Parada estáticaÀ frenteCenário/props ligeiramente atrás, pessoas reais à frente
Texto e interfaceÀ frenteDividido, interação de interface ruim em ambos
Conteúdo estilizadoÀ frenteSeedance 2.0 claramente à frente na semântica de estilo
Conflito imagem-promptEmpateSeedance 2.0 muito à frente, maior lacuna no teste
Geração de 30 segundosExclusivoExclusivo, Seedance 2.0 para em 15s

Lógica de seleção em duas linhas. Fidelidade estrita imagem-para-vídeo, sujeitos fixos, eventos físicos, material com pessoas reais, ou qualquer coisa com mais de 15 segundos: Wan 3.0. Cenas com vários personagens, criatividade surreal ou orientada a conflitos, formatos estilizados: Seedance 2.0.

Você pode testar metade desta tabela hoje sem esperar por nada. Seedance 2.0 imagem-para-vídeo e Wan 2.7 imagem-para-vídeo estão ambos ao vivo no Atlas Cloud com uma chave, e o custo por execução aparece no botão antes de você se comprometer. Fixe sua própria semente, reutilize um primeiro quadro e execute o prompt de queda do copo ou chuva interna deste artigo literalmente. Quando o Wan 3.0 for lançado, e esta família tem um histórico de chegar ao Atlas no Dia 0, seu teste é transferido inalterado e seus prompts já estão calibrados. Se você quiser o lado do prompt dessa preparação, o guia de prompts do Wan 3.0 detalha a estrutura do manual oficial caso a caso.

Perguntas frequentes

O Wan 3.0 é melhor que o Seedance 2.0?

Nenhum domina; eles se dividem por temperamento no teste de mesma semente. O Wan 3.0 vence em fidelidade: identidade ao longo do movimento, física, separação ambiente-vs-sujeito, fidelidade ao primeiro quadro, além da saída exclusiva de 30 segundos. O Seedance 2.0 vence em imaginação: interação multi-sujeito, seguimento de instruções surreais e conteúdo estilizado, com a dimensão de conflito sendo sua maior vantagem. Escolha por plano, não por marca.

Qual é o maior problema nesta análise do Wan 3.0?

Cortes de câmera não comandados. Prompts pedindo um movimento contínuo receberam repetidamente uma mudança de plano brusca e não solicitada, às vezes com efeito fantasma: aos 3,5s em uma inclinação de 8 segundos (semente 2004), aos 4-5s e 15-17s dentro de execuções de 30 segundos (sementes 11004, 11002). Reproduz-se facilmente e limita diretamente a usabilidade de tomada única.

O Wan 3.0 realmente gera vídeos de 30 segundos?

Sim, em uma geração, e a identidade se manteve em todas as nove execuções de teste de 30 segundos, com uma sequência roteirizada de quatro batidas (semente 11006) executada em ordem. A ressalva é o mesmo defeito de corte: execuções longas tendem a incluir pelo menos uma dissolução ou mudança de plano não comandada, então planeje cortar em vez de esperar uma tomada única garantida.

Como esta análise do Wan 3.0 foi testada?

49 casos de imagem-para-vídeo em 10 dimensões, cada caso em 720p com uma semente fixa, e o mesmo primeiro quadro, prompt e semente reexecutados no Seedance 2.0 e no Wan 2.7. Todos os resultados foram revisados por humanos, clipe por clipe, sem repetições para nenhum modelo. Os clipes embutidos são as saídas reais do teste, sementes incluídas, para que as comparações possam ser verificadas diretamente.

Posso reproduzir este teste antes do lançamento do Wan 3.0?

O método é transferível hoje: fixe uma semente, trave um primeiro quadro e prompt, e execute o mesmo trio nos modelos ao vivo. O Seedance 2.0 e toda a família Wan 2.7 estão no Atlas Cloud agora, que também tem o hábito de ter acesso no Dia 0 quando esta família de modelos é atualizada, então o mesmo teste deve se estender ao Wan 3.0 no dia em que for aberto.

Conclusão

O Wan 3.0 parece um modelo construído por pessoas que prezam a imagem de entrada: o que você dá a ele, ele protege, através do movimento, da física e de 30 segundos completos. Essa disciplina é exatamente o que o trabalho fiel de imagem-para-vídeo comercial precisa, e também é a razão pela qual o modelo hesita com prompts que pedem que a imagem se torne algo que não é. Combine-o com um modelo de imaginação ousada em vez de substituir um, e observe um número quando for lançado publicamente: se a taxa de cortes não comandados diminui. Essa única correção decide se o exclusivo de 30 segundos é uma manchete ou uma ressalva.

Modelos recentes

Uma API para toda a IA de mídia.

Explorar Todos os Modelos