
Última atualização: Wan 3.0 está ativo desde 24 de agosto de 2026.
Dois monitores de edição lado a lado, o esquerdo mostrando um monstro marinho emergindo de uma tempestade, o direito mostrando a mesma tempestade interrompida
Assista ao clipe de 30 segundos do monstro marinho que a Alibaba enviou com a versão beta do Wan 3.0. Barco de pesca, chuva torrencial, relâmpagos, então o oceano explode para cima. Dez planos distintos. Sem um único corte. A trilha orquestral que o acompanha foi escrita pelo modelo.
Sua primeira reação não é "uau". É "o que exatamente está faltando no meu Wan 2.7?"
Então fui procurar a resposta e a primeira coisa que descobri foi que a maior parte da internet está respondendo errado. Pesquise wan 3.0 vs wan 2.7 e os principais resultados afirmam confiantemente que o Wan 3.0 renderiza 4K nativo e que os pesos estão no Hugging Face. Nenhum dos dois é verdade. Baixei os arquivos de demonstração oficiais em um laptop e os li com ffmpeg, depois verifiquei os registros do modelo e os níveis de preço publicados. A atualização real é grande. Só não é a atualização que as pessoas estão descrevendo.
Wan 3.0 vs Wan 2.7: principais conclusões
- A duração é o destaque. O Wan 3.0 gera 30 segundos em uma única passagem com uma recomendação automática de "duração inteligente". O Wan 2.7 tem limite de 15 segundos para texto para vídeo e imagem para vídeo, e 10 segundos para referência para vídeo e edição de vídeo.
- As referências saltam de algumas para uma multidão. O Wan 2.7 aceita até 5 itens de referência. O Wan 3.0 aceita até 20 e, pela primeira vez, aceita arquivos doc, xls, ppt, pdf e md, além de páginas da web, como entradas de geração.
- Não há 4K. A própria lista de preços da API da Alibaba tem exatamente três níveis: 480P, 720P e 1080P. No Atlas Cloud, o Wan 2.7 oferece um teto maior através de suas opções de super-resolução 1080P-SR e 1440P-SR.
- Os pesos não são abertos. A organização Wan-AI no Hugging Face ainda termina no Wan 2.2. Não há repositório 3.0, nem 2.7, nem 2.5.
- Wan 3.0 é apenas beta e apenas de primeira parte. Ele roda no Alibaba Cloud Bailian, no site Wanxiang, no aplicativo de desktop Qianwen Creation e em alguns produtos similares. Se você precisa de uma API que possa chamar em produção esta semana, o Wan 2.7 ainda é a geração que responde.
- Quer ver o formato antes de aprender a gramática do prompt? O Atlas Cloud tem um gerador gratuito de esquetes de anúncios com IA que transforma uma descrição de produto em um anúncio de comédia de 15 segundos com dois personagens e diálogo falado. Uma geração gratuita, sem marca d'água.
A sequência completa de kaiju de 30 segundos, gerada pela Alibaba no Wan 3.0 durante o beta público e publicada no manual oficial do criador do Wan 3.0. Não geramos este clipe. Ligue o som: a trilha sonora faz parte da saída, não é uma base musical adicionada depois. Arquivo conforme entregue: 1920x1072, 24fps, 30,07s, AAC estéreo 44,1kHz.
Aqui está a primeira coisa que as fichas técnicas ignoram. Esse arquivo é 1920x1072, não 1920x1080. Cada demonstração "1080p" no manual oficial chega a 1072 pixels de altura, e várias outras demonstrações publicadas são simplesmente 1280x720. Doze dos dezenove clipes no manual duram de 30,05 a 30,07 segundos, o que mostra que o limite de 30 segundos é uma parada real e não um número redondo de marketing.
Por que a pergunta Wan 3.0 vs Wan 2.7 é mais difícil do que parece
A resposta honesta é que quase ninguém executou ambos os modelos no mesmo prompt, porque quase ninguém consegue. O Wan 3.0 foi aberto para beta público em 6 de agosto de 2026 e vive nas próprias superfícies da Alibaba (QbitAI, agosto de 2026). Plataformas de inferência de terceiros não o adotaram. Portanto, o conteúdo de comparação que existe é de ficha técnica para ficha técnica, e as fichas técnicas foram copiadas lateralmente até que os erros se calcificaram.
Três "fatos" sobre Wan 3.0 vs Wan 2.7 que estão simplesmente errados
"Wan 3.0 é 4K nativo." Não é. A lista de preços da API publicada tem 480P, 720P e 1080P a ¥0,3, ¥0,6 e ¥1,2 por segundo. Três níveis, sem quarto. Enquanto isso, o Atlas Cloud expõe 1080P-SR e 1440P-SR no Wan 2.7, então, em termos de teto de pixels puro, a geração mais antiga atualmente vence.
"Os pesos do Wan 3.0 são abertos." Não são. Navegue pelo Hugging Face e a família mais recente lançada pela organização Wan-AI é a Wan 2.2, incluindo as variantes Animate e S2V. A linha principal de vídeo não lança pesos desde a 2.2. Se você quer algo para um gráfico ComfyUI local, 2.1 e 2.2 são suas opções e isso não mudou.
"A gramática do prompt é transferida diretamente." Esta é meia verdade de uma forma que vai te queimar. As palavras são transferidas. A estrutura não. Os prompts oficiais do Wan 3.0 são scripts de múltiplos planos com carimbo de data/hora: o prompt do kaiju são dez planos numerados, o prompt do outdoor são quatro batidas nomeadas com faixas de segundos explícitas. Cole um script de dez planos em um modelo de 15 segundos e ele não escolhe graciosamente seis planos. Ele comprime.
Por que você não pode simplesmente trocar prompts entre Wan 3.0 e Wan 2.7
Há uma segunda armadilha abaixo dessa, e é a razão pela qual "apenas junte dois clipes" não te salva.
O Wan 2.7 tem um modo de continuação de vídeo. Parece um caminho para 30 segundos. Não é. O clipe de origem que você alimenta precisa ter de 2 a 10 segundos, então uma geração de 15 segundos não pode ser a semente. A saída recodifica a origem, o que come a cauda do clipe que você forneceu. E encadear continuações tende a voltar para a batida de abertura, em vez de mover a história para frente. Quinze segundos é o teto duro para um único arquivo contínuo do Wan 2.7. Qualquer coisa mais longa é uma edição, não uma geração.
Esse é o verdadeiro custo de migração entre essas duas gerações, e nenhuma tabela de comparação vai te mostrar isso.
Ficha técnica Wan 3.0 vs Wan 2.7, e onde realmente executá-lo
Para testar qualquer coisa disso, você precisa de algum lugar que execute texto para vídeo, referência para vídeo e edição de vídeo na mesma conta, com cobrança por segundo, para que uma tentativa falha custe segundos em vez de uma assinatura. Tudo do lado Wan 2.7 deste artigo roda no Atlas Cloud, que hospeda os quatro endpoints do Wan 2.7 e o modelo de imagem usado para o teste de referência. O Wan 3.0 não está no Atlas Cloud nem em nenhuma outra plataforma de terceiros ainda, que é exatamente a razão pela qual o material do Wan 3.0 neste artigo vem das próprias publicações beta da Alibaba.
Tabela 1: Wan 3.0 vs Wan 2.7, geração a geração
| Wan 3.0 (beta público) | Wan 2.7 (produção) | |
|---|---|---|
| Duração máxima, uma passagem | 30s, com duração inteligente | 15s (t2v, i2v), 10s (r2v, edição de vídeo) |
| Itens de referência | Até 20 | Até 5 (1 imagem por assunto, até 3 vídeos) |
| Modalidades de entrada | Texto, imagem, vídeo, áudio, doc/xls/ppt/pdf/md, páginas da web | Texto, imagem, vídeo, áudio |
| Entrada de documento | Arquivo único ou link, até 100MB e 50 páginas | Não suportado |
| Níveis de resolução | 480P / 720P / 1080P | 720P / 1080P / 1080P-SR / 1440P-SR |
| Áudio nativo | Sim | Sim |
| Edição de vídeo | Edição por instrução e referência | Endpoint dedicado de edição de vídeo |
| Pesos abertos | Não | Não |
| Onde você pode executar | Apenas superfícies de primeira parte da Alibaba | APIs de terceiros, incluindo Atlas Cloud |
| Preço listado | ¥0,3 / ¥0,6 / ¥1,2 por segundo por nível | $0,1 por segundo, linha de base 720P |
Tabela 2: os endpoints Wan 2.7 usados neste artigo
| Endpoint | Duração máxima | Resoluções | Limite de referência | Preço listado |
|---|---|---|---|---|
| Texto para vídeo | 2-15s | 720P, 1080P, 1080P-SR, 1440P-SR | n/a | $0,1 / s |
| Referência para vídeo | 2-10s | 720P, 1080P, 1080P-SR, 1440P-SR | 5 itens | $0,1 / s |
| Imagem para vídeo | 2-15s | 720P, 1080P, 1080P-SR, 1440P-SR | clipe de origem 2-10s | $0,1 / s |
| Edição de vídeo | 2-10s saída, 2-10s entrada | 720P (1,0x), 1080P (1,5x) | 3 imagens | $0,1 / s |
Um detalhe de preço que vale a pena internalizar antes de executar qualquer coisa: o título "$0,1 por segundo" é a linha de base 720P. A página de edição de vídeo documenta um multiplicador de 1,5x para 1080P diretamente, e o botão Executar cotação o valor real para o nível que você selecionou. Leia o botão, não o cabeçalho.
Para uma execução hospedada atual, abra Wan 3.0 no Atlas Cloud e teste um prompt como o abaixo antes de publicar o fluxo de trabalho.

Captura de tela de prompt para resultado do Wan 3.0: Comparação de modelo correspondente.
Execute você mesmo o teste Wan 3.0 vs Wan 2.7
Quatro passos. Dois deles usam o material publicado da Alibaba como ponto de referência fixo, dois deles são execuções que você mesmo faz. Nada aqui requer acesso ao beta do Wan 3.0.
Passo 1: Pegue o clipe do Wan 3.0 e seu prompt original
O lado Wan 3.0 deste teste não é algo que você gera. É algo que você lê. O prompt completo do kaiju está publicado no manual oficial do criador do Wan 3.0, junto com o clipe finalizado, sob o exemplo "灾难电影". É um script em chinês com dez planos numerados e um parágrafo separado descrevendo a trilha sonora.
Leia uma vez antes de fazer qualquer outra coisa. A estrutura é a lição: dez planos, cada um com sua própria câmera, assunto e nota de iluminação, terminando com um resumo da trilha sonora. É assim que se parece um prompt de geração de passagem única de 30 segundos.
Passo 2: Execute o mesmo prompt através do Wan 2.7 texto para vídeo
Abra o playground de texto para vídeo do Wan 2.7 e cole a tradução em inglês desse mesmo script. Não encurte ainda. Você quer ver o que o modelo faz quando a intenção ultrapassa o limite.
Plain1A 30-second, photoreal cinematic sequence: a deep-sea kaiju emerges at night in a raging storm. Open on a small, battered fishing trawler with the white letters "WAN" on its hull, fighting through enormous waves under torrential rain; lightning briefly lights the whole ocean. Push to a mid-close shot on the deck: waves smash over the bow, ropes, nets and metal railings whip in the wind, rain streaks the lens. Then the sea ahead swells unnaturally, an enormous vortex forms, and a vast dark shape passes beneath the boat, lifting it. A crewman in a soaked rain jacket grips the rail, terrified, and turns toward the water. Finally the surface explodes upward and a colossal Pacific-Rim-style sea monster breaches: wet, scarred, ridged skin, huge jaws, tens of meters of spray. Close on its head roaring in the lightning. The trawler is nearly swallowed. End on a wide shot: the kaiju towering over the churning sea, the boat tiny in the foreground, one final lightning strike. Hollywood disaster-movie scoring: low sub-bass rumble and sparse strings building to brass and heavy percussion at the breach, ending on an oppressive sustained low chord. Photoreal scale, volumetric water, high-contrast storm lighting. 2
Configurações: Resolução 1080P, Duração 15s (o máximo), Proporção de aspecto 16:9, áudio ligado para que o modelo faça a trilha sonora sozinho. Deixe o slot de áudio de referência vazio.

Playground de texto para vídeo do Wan 2.7 no Atlas Cloud com o prompt do kaiju carregado e o clipe finalizado de 15 segundos no painel OUTPUT
Playground de texto para vídeo do Wan 2.7 no Atlas Cloud, prompt colado, 1080P e 16:9 selecionados. O botão Executar cotação $0,75 para esta curta tentativa de teste, o que equivale a $0,15 por segundo: o multiplicador 1,5x 1080P à vista, em uma página de modelo cujo número principal é $0,1.
Em seguida, execute uma segunda vez com uma linha anexada ao prompt:
Plain1Single continuous take, no cuts. Prioritize the breach moment; compress the setup. 2
Essa única linha é o trabalho de migração em miniatura. Um script de 30 segundos precisa ser reescrito como uma intenção de 15 segundos, e você é quem decide quais sete planos morrem.
Esquerda: a saída oficial do Wan 3.0, 30 segundos. Direita: Wan 2.7 no Atlas Cloud executando o mesmo prompt, parando em seu limite de 15 segundos.
Passo 3: Construa as imagens de referência para o teste de identidade Wan 3.0 vs Wan 2.7
A duração é a atualização mais barulhenta. A consistência em nível de pixel é a que realmente muda o trabalho de produção, e você pode testá-la com dois gatos.
O manual da Alibaba inclui uma imitação de Wes Anderson na qual o mesmo gato ragdoll e o mesmo gato preto têm que sobreviver a cinco ambientes radicalmente diferentes: um corredor de hotel simétrico, uma vista lateral em corte, um tambor de máquina de lavar, uma esteira de bagagem de aeroporto e uma cabine telefônica vermelha. Ambos os gatos são fixados com tags de referência @Image1 e @Image2.
Gere suas próprias duas referências primeiro. Use o GPT Image 2 com qualidade definida como alta e um quadro 16:9, e execute duas vezes.
Plain1A studio portrait of a fluffy ragdoll cat with blue eyes and a dark mask, sitting upright facing the camera, evenly lit against a plain pale pink background, sharp fur detail, full body visible, clean reference-sheet framing. 2
Plain1A studio portrait of a small sleek black cat with bright amber eyes, standing in profile facing right, evenly lit against a plain pale pink background, sharp fur detail, full body visible, clean reference-sheet framing. 2

Playground do GPT Image 2 no Atlas Cloud com qualidade definida como alta e a folha de referência do gato ragdoll renderizada no painel OUTPUT
GPT Image 2 com qualidade alta, 16:9. Execute o segundo prompt da mesma forma para obter o gato preto.
Passo 4: Execute o teste de identidade no endpoint de referência para vídeo do Wan 2.7
Carregue ambos os gatos no endpoint de referência para vídeo do Wan 2.7. Resolução 1080P, proporção de aspecto 16:9, duração 10 segundos, que é o máximo deste endpoint. O prompt abaixo é a lista de planos do manual comprimida de cinco batidas para três, porque dez segundos não comportam cinco.
Plain1Wes Anderson style, perfectly symmetrical, flat frontal compositions, pastel palette. Reference image 1 is the ragdoll cat, reference image 2 is the black cat; keep both cats identical in every shot. Shot 1: an endless symmetrical hotel corridor, the ragdoll cat running straight toward the camera with a solemn expression, the black cat sprinting away in the background with its head twisted back 180 degrees. Shot 2: a cutaway side view of the corridor, pink patterned wallpaper and gold picture frames, the ragdoll walking left to right and the black cat crossing right to left. Shot 3: frontal macro on a mint-green vintage washing machine door, both cats floating stiffly inside the drum among suds, eyes blank, rainbow-ordered detergent bottles lined up behind. Rigid horizontals and verticals, no camera tilt, deadpan absurd humor. 2

Playground de referência para vídeo do Wan 2.7 no Atlas Cloud com ambas as referências de gato carregadas e o clipe finalizado no painel OUTPUT
Referência para vídeo do Wan 2.7: ambos os gatos carregados nos slots de imagem de referência, resolução definida como 1080P e o botão Executar cotando a tentativa antes de começar. Duas referências já é uma parte significativa do que este endpoint aceita. O Wan 3.0 aceita 20 itens de referência.
Agora coloque os dois lado a lado.

O clipe oficial de bloqueio de identidade do Wan 3.0: o mesmo ragdoll e gato preto mantidos consistentes em um corredor de hotel, uma parede em corte, um tambor de máquina de lavar, uma esteira de bagagem e uma cabine telefônica vermelha
Gerado pela Alibaba no Wan 3.0 durante o beta público e publicado no manual oficial do criador. Cinco ambientes, 19,9 segundos, ambos os gatos fixados por tag de referência. Mostrado aqui como um GIF silencioso; o arquivo entregue carrega áudio estéreo de 44,1kHz.

O resultado da referência para vídeo do Wan 2.7 na mesma descrição, três planos dentro do limite de 10 segundos
Referência para vídeo do Wan 2.7 no Atlas Cloud, as mesmas duas referências, mostrado aqui como um GIF silencioso. Esta é a tentativa padrão de 5 segundos do endpoint, em vez dos 10 completos: vale a pena saber que o controle de duração nem sempre confirma o que você define, então leia a cotação do botão Executar antes de pressioná-lo. Observe as marcações dos gatos e a máscara do ragdoll; essa é a dimensão sobre a qual a afirmação de "consistência em nível de pixel" se trata.
Mais quatro prompts Wan 3.0 vs Wan 2.7 que valem a pena reexecutar
O clipe do kaiju enfatiza duração e física. Estes três enfatizam coisas diferentes, e cada um colide com um limite diferente do Wan 2.7. Todos os três são saídas beta oficiais da Alibaba do manual.
Wan 3.0, saída beta oficial: um único push-back contínuo de 30 segundos por um corredor de hospital iluminado por fluorescentes, gradação monocromática verde pálida, com a atriz gritando por ajuda. Som ligado. A performance, os passos e o zumbido do equipamento são todos gerados pelo modelo.
Tabela 3: o que cada prompt exige e onde o Wan 2.7 o limita
| Prompt | O que o script pede | Limite publicado do Wan 2.7 | A dimensão sendo testada |
|---|---|---|---|
| Abertura do kaiju | 10 planos numerados em 30s, mais um resumo da trilha sonora | 15s máx. em texto para vídeo | Duração e narrativa multi-plano |
| Corredor de hospital | Uma tomada contínua de 30s com diálogo falado | 15s máx., áudio nativo disponível | Performance e diálogo em tomadas longas |
| Vaqueira do posto de gasolina | Arco de comédia de 30s em quatro atos cronometrados | 15s máx., então dois atos precisam ir | Tempo cômico que precisa de tempo de execução |
| Outdoor em uma tomada | Quatro batidas com faixas de segundos explícitas, sem cortes | 15s máx., então as faixas precisam ser reescritas | Física da câmera em um movimento longo |
| Dois gatos, cinco cômodos | 2 assuntos marcados mantidos em 5 ambientes | 10s máx., 5 slots de referência | Consistência de identidade |
Uma versão gratuita de 15 segundos da mesma ideia
Olhe para o clipe do posto de gasolina novamente. Esse formato, um esboço de comédia curto com dois personagens, uma reviravolta e uma piada final, é onde o tempo extra de execução do Wan 3.0 compensa mais. É também o formato com maior probabilidade de vender algo.
O problema é o prompt. Os exemplos de comédia do manual têm 800 palavras com carimbos de data/hora e blocking explícitos. Isso é uma habilidade real e leva um fim de semana para aprender.
Se você só quer descobrir se o formato funciona para o seu produto antes de investir esse fim de semana, o Atlas Cloud tem uma ferramenta gratuita que pula a engenharia de prompt completamente. Você descreve o produto, opcionalmente envia até quatro fotos do produto com 8MB cada, escolhe um de seis tons (meme engraçado, reviravolta, sitcom, emocionante, luxo ou venda agressiva), e ela escreve o script de dois personagens, seleciona as vozes, gera o diálogo e efeitos sonoros, e retorna um anúncio finalizado de 15 segundos como uma cena contínua. Os downloads são limpos, sem marca d'água. Você precisa estar logado e tem uma geração gratuita antes de adicionar créditos.

Uma linha de cópia do produto entra, um anúncio de comédia de 15 segundos finalizado sai: Gerador gratuito de esquetes de anúncios com IA do Atlas Cloud
O Gerador gratuito de esquetes de anúncios com IA : uma descrição de produto entra, um anúncio de 15 segundos com dois personagens sai.

Uma saída real do gerador gratuito. Som ligado: o script, as duas vozes e os efeitos sonoros saem todos de uma única execução.
Quanto custa executar uma comparação Wan 3.0 vs Wan 2.7
Por segundo, as duas gerações estão no mesmo bairro no nível 720P. A diferença de custo é estrutural: um clipe que costumava ter 15 segundos agora tem 30, então uma peça finalizada aproximadamente dobra.
Tabela 4: a mesma sequência do kaiju, quatro maneiras
| Execução | Taxa | Total |
|---|---|---|
| Wan 3.0, 30s a 720P | ¥0,6 / s | ¥18, aproximadamente $2,50 |
| Wan 3.0, 30s a 1080P | ¥1,2 / s | ¥36, aproximadamente $5,00 |
| Wan 2.7, 15s a 720P | $0,10 / s | $1,50 |
| Wan 2.7, 15s a 1080P | $0,10 / s com o multiplicador de nível 1,5x | $2,25 |
| Wan 2.7, 15s a 1440P-SR | cotado ao vivo no botão Executar | cotado ao vivo |
| Esquete de anúncio com IA gratuito, 15s | gratuito, 1 geração por conta | $0,00 |
Duas ressalvas. O preço beta não é o preço de disponibilidade geral, e a Alibaba disse que a API será aberta mais amplamente em breve, então trate os valores em ¥ como um instantâneo do beta público, não uma taxa comprometida. E no lado do Atlas Cloud, leia sempre a cotação ao vivo no botão Executar antes de confirmar, porque o multiplicador de resolução é aplicado lá e não no preço principal.
A Alibaba também foi excepcionalmente direta sobre onde o Wan 3.0 ainda é fraco, dizendo que o modelo "ainda tem espaço para melhoria na qualidade do som e precisão do texto". Isso coincide com o que os arquivos mostram: o áudio nas demonstrações oficiais é estéreo 44,1kHz, mas codificado a uma modesta taxa de 32 kb/s, o que é bom para uma prévia e fino para um master de entrega.
Licenciamento Wan 3.0 vs Wan 2.7: o que você pode realmente enviar
Versão curta, e por favor, verifique você mesmo os termos atuais antes de colocar qualquer coisa na frente de um cliente.
O Wan 3.0 está em beta público e seus termos comerciais não estão definidos. Como os pesos não são lançados, não há caminho auto-hospedado; qualquer coisa que você fizer passa pela API da Alibaba ou suas superfícies de consumo, e você está vinculado ao que esses termos disserem no dia em que você gerar. O Wan 2.7 é a mesma história em relação aos pesos, mas está em produção há tempo suficiente para que os termos da API da plataforma estejam estáveis. Se você está executando através de uma plataforma de terceiros, seus direitos comerciais vêm dos termos de serviço dessa plataforma, então leia os que realmente se aplicam à sua conta. Nenhum desses parágrafos é aconselhamento jurídico.
FAQ Wan 3.0 vs Wan 2.7
Wan 3.0 é open source? Posso executá-lo no ComfyUI?
Não. Em agosto de 2026, não há repositório Wan 3.0 sob a organização Wan-AI no Hugging Face, e nenhum no GitHub Wan-Video também. A família Wan mais recente com pesos lançados é a Wan 2.2, incluindo as variantes Animate e S2V. Para um gráfico ComfyUI local, você ainda está na 2.1 ou 2.2. O Wan 3.0 é apenas API e web.
Wan 3.0 vs Wan 2.7 resolução: o Wan 3.0 realmente gera 4K?
Não. A lista de preços da API publicada tem três níveis de resolução: 480P, 720P e 1080P. Vários posts de comparação amplamente compartilhados afirmam 4K nativo e estão errados. No teto de saída bruto, o Wan 2.7 no Atlas Cloud na verdade vai mais alto através de suas opções de super-resolução 1080P-SR e 1440P-SR.
Posso obter 30 segundos do Wan 2.7 estendendo clipes?
Não como um arquivo contínuo. O modo de continuação requer um clipe de origem de 2 a 10 segundos, então uma geração completa de 15 segundos não pode ser a semente. A saída recodifica e corta a cauda do que você fornecer, e continuações encadeadas tendem a voltar para a batida de abertura. Após 15 segundos, você está editando, não gerando.
Wan 3.0 vs Wan 2.7: onde posso realmente executar cada um hoje?
O Wan 3.0 está em beta público nas próprias superfícies da Alibaba: Alibaba Cloud Bailian, Wanjing Yike, o site Wanxiang, o cliente de desktop Qianwen Creation, IF STUDIO e Duiyou, com acesso em escala de cinza no aplicativo Qianwen. Nenhuma plataforma de inferência de terceiros o hospeda ainda. O Wan 2.7 é a geração que você ainda pode chamar diretamente, através de endpoints de texto para vídeo, imagem para vídeo, referência para vídeo e edição de vídeo.
Wan 3.0 vs Wan 2.7 preços: qual custa mais por clipe finalizado?
Por segundo no nível 720P, eles são próximos. Por clipe finalizado, espere aproximadamente o dobro, porque o comprimento natural da saída passou de 15 segundos para 30. Faça um orçamento para a mudança no tempo de execução, em vez da mudança na taxa, e lembre-se de que o preço beta pode não sobreviver à disponibilidade geral.
Preciso reescrever meus prompts do Wan 2.7 para o Wan 3.0?
Sim, e a reescrita é estrutural, não lexical. Os prompts do Wan 2.7 descrevem um único plano contínuo em detalhes ricos. Os prompts do Wan 3.0 são listas de planos com carimbo de data/hora, às vezes com um parágrafo de trilha sonora separado, e o modelo também lerá um pdf ou uma apresentação como entrada. Regra prática: para o Wan 2.7, escreva um parágrafo sobre um plano; para o Wan 3.0, escreva um detalhamento de cena numerado com faixas de segundos.






