Seedance 2.5 já está disponível — Primeiro na Atlas Cloud

Wan 3.0 API is Coming to Atlas Cloud Soon

A Wan 3.0 API é a próxima geração da família de vídeos Wan da Alibaba, desenvolvida para elevar a geração de formatos longos, o controle de múltiplas referências e a qualidade audiovisual a novos patamares. A Atlas Cloud já hospeda Wan 2.7, 2.6 e 2.5, portanto, a Wan 3.0 usará a mesma chave unificada e funcionará sem configurações separadas. Obtenha acesso antecipado no dia do lançamento. Role para baixo até a vitrine para conferir uma prévia do que a Wan 3.0 pode criar.

Wan 3.0 foi desenvolvido pela Alibaba. A Atlas Cloud (operada pela Atlas Cloud AI LLC) fornece acesso ao modelo, mas não é sua proprietária. Todas as marcas registradas pertencem aos seus respectivos titulares.

Em Breve

Modelos em Breve

Estamos a dar os retoques finais a esta coleção — entretanto, explore coleções semelhantes abaixo.

Explorar Mais Séries

Seedance 2.5

A API do Seedance 2.5 já está disponível no Atlas Cloud! Ela oferece aos desenvolvedores o mais novo modelo de vídeo da ByteDance. Ele gera até 30 segundos de vídeo nativo em uma única passagem a partir de texto, uma única imagem ou até 50 referências multimodais, com áudio sincronizado e texto multilíngue no quadro. No Atlas Cloud, você o acessa por meio de uma única chave, com consistência de sujeito e física aprimorada mantendo a coerência em tomadas longas.

Ver Série

MiniMax H3

A MiniMax H3 API disponibiliza o modelo de vídeo multimodal de uso geral da MiniMax, que processa texto, imagens, vídeo e áudio como um único contexto, em vez de uma tarefa de cada vez. Os clipes têm de 5 a 15 segundos a 24 FPS, em proporções de 21:9 a 9:16, e um único prompt pode trocar personagens, substituir fundos, reescrever diálogos ou clonar uma voz a partir de um clipe de referência. A Atlas Cloud disponibiliza tudo isto através de um único endpoint compatível com OpenAI. Comece a criar hoje mesmo.

Ver Série

Seedream 5.0 Pro

A API do Seedream 5.0 Pro fornece aos desenvolvedores o modelo de edição de imagens controlável da ByteDance no Atlas Cloud. Ela posiciona as edições com precisão usando âncoras e coordenadas, separa as imagens em camadas editáveis, funde múltiplas referências e combina cores e materiais exatos, com texto multilíngue em 2K e 3K. No Atlas Cloud, você pode acessá-lo por meio de uma única chave!

Ver Série

Seedance 2.0

A API do Seedance 2.0 oferece acesso de produção ao modelo de vídeo multimodal da ByteDance — entradas quadrimodais (texto, imagem, vídeo, áudio) e um sistema "Universal Reference" líder do setor que fixa a composição, o movimento da câmera e as ações dos personagens entre as cenas. Integre um controle de nível de diretor com uma única chamada de API, uma taxa fixa de $0,09/s, chave instantânea e sem lista de espera — respaldado por tempo de atividade e conformidade de nível corporativo. O Seedance 2.0 Native 4K já está no ar!

Ver Série

GPT Image 2

A API do GPT Image 2 dá aos desenvolvedores acesso ao mais recente modelo de imagem da OpenAI, o sucessor do GPT Image 1.5. Ele gera e edita imagens com renderização de texto precisa em caracteres latinos e CJK, além de uma forte composição para pôsteres, mockups e infográficos. Na Atlas Cloud, você o acessa através de uma API unificada junto a mais de 300 modelos, com créditos gratuitos, 99,99% de tempo de atividade e sem a necessidade de verificação de organização da OpenAI.

Ver Série

Gemini Omni Flash

A Gemini Omni API traz para o seu stack o modelo multimodal de geração e edição de vídeo do Google DeepMind, apresentado no Google I/O 2026. O Gemini Omni funde o motor de raciocínio do Gemini com mídia generativa, aceitando qualquer combinação de texto, imagens, vídeo e áudio para produzir resultados consistentes e fundamentados em conhecimento. Refine os resultados por meio de conversas naturais — troque objetos, reescreva cenas e mude estilos, enquanto a física, os personagens e a continuidade permanecem intactos. A Atlas Cloud oferece toda a linha Gemini Omni Flash — texto para vídeo, imagem para vídeo com até 7 imagens de referência e referência para vídeo — por meio de uma única API unificada, com preços transparentes por segundo a partir de $0.112 e sem assinatura. Comece a construir hoje mesmo.

Ver Série

Grok Imagine

A API Grok Imagine cobre os modelos de imagem, vídeo e fala da xAI, desde Image 2.0 até Video 1.5 e xAI TTS v1. Renderize imagens estáticas em 1K ou 2K em 14 proporções de aspecto, estenda uma cena para 15 segundos de movimento em 1080p, controle os planos com até 7 imagens de referência ou narre-os em 20 idiomas. O Atlas Cloud executa todos os modos em um único endpoint, com preço por uso a partir de $0.02 por imagem e $0.05 por segundo. Comece a construir hoje.

Ver Série

Google

Os modelos criativos mais poderosos do Google estão todos disponíveis na Atlas Cloud. O Veo 3.1 oferece geração de vídeo cinematográfico, o Nano Banana 2 impulsiona a criação de imagens de alta fidelidade e o Gemini traz inteligência multimodal para cada fluxo de trabalho. Acesse o pacote completo de modelos do Google por meio de uma única API key com disponibilidade Day-0 e preços de pagamento conforme o uso (pay-as-you-go).

Ver Série

Seedance 2.0 Mini

O Seedance 2.0 Mini leva a geração de vídeo multimodal da ByteDance para fluxos de trabalho onde a velocidade e o custo são essenciais. Ele oferece os principais recursos do Seedance 2.0 com menor impacto — geração mais rápida, menor custo por vídeo e a mesma integração de API que você já usa. Para equipes que executam pipelines de alto volume ou prototipagem em escala, o Mini é a opção padrão prática.

Ver Série

ByteDance

Da geração de vídeo cinematográfico à criação de imagens de alta fidelidade, os modelos mais poderosos da ByteDance estão disponíveis no Atlas Cloud. Execute o Seedance e o Seedream em grande escala com os preços de inferência mais baixos e zero custos indiretos de infraestrutura.

Ver Série

Alibaba

O Atlas Cloud reúne toda a linha de modelos da Alibaba sob uma única API: Qwen para tarefas de linguagem e imagem, e Wan para geração de vídeo em até 1080p. Acesse cada modelo no formato pré-pago (pay-as-you-go) sem necessidade de assinaturas. A API da Alibaba está disponível por meio de uma única URL base usando seu cliente compatível com OpenAI existente.

Ver Série

OpenAI

O Atlas Cloud oferece acesso a toda a linha da API da OpenAI, desde o GPT Image 2 para geração de imagens até o Sora 2 para vídeo. Todos os modelos estão disponíveis na modalidade de pagamento conforme o uso, sem compromisso mensal. Integre-se trocando apenas uma URL base usando a API compatível com a OpenAI.

Ver Série

Wan 3.0 em ação

6 principais capacidades que mostram o que uma única solicitação ao Wan 3.0 pode produzir, desde filmes de marca com múltiplas referências até planos-sequência de 30 segundos.

Filmes de marca multirreferência

O modo Omni ingere até 20 materiais de referência, 10 imagens, 5 clipes e 5 faixas de áudio, além de um documento ou página da web de origem, para que um kit de marca completo se transforme em um único vídeo alinhado à marca em apenas uma passagem.

Histórias em take único de 30 segundos

A saída nativa de 30 segundos dá espaço para a narrativa se desenvolver, suportando movimentos contínuos de câmera e sequências de plano-sequência que clipes mais curtos não conseguem comportar. A duração inteligente permite que o modelo dite o ritmo de cada cena por conta própria.

Consistência de Referência em Nível de Pixel

Rostos, produtos e detalhes finos são reproduzidos com fidelidade em nível de pixel em cada quadro. As equipes de produção obtêm a certeza de entrega que personagens recorrentes e ativos de marca exatos exigem.

Som Imersivo e Realismo

O realismo, a textura da imagem e o áudio nativo melhoram simultaneamente, de modo que uma cena gerada é apresentada com o som correspondente em vez de filmagens silenciosas. O resultado proporciona um verdadeiro impacto audiovisual.

Edição de Instruções e Referências

A edição precisa reformula a filmagem existente a partir de uma instrução por escrito ou de um clipe de referência, alterando um assunto, estilo ou momento sem regenerar o vídeo inteiro.

Documentos e páginas web para vídeo

Além de texto, imagem, áudio e vídeo, o Wan 3.0 lê arquivos doc, xls, ppt, pdf e md, bem como páginas da web ao vivo, transformando um relatório ou apresentação de slides diretamente em um clipe finalizado.

Comparações de vídeo no mesmo prompt

Veja a apresentação em vídeo gerada pelos modelos Wan 3.0, Seedance 2.5 e Wan 2.7.

Prompt

Generating a 30-second, 16:9 widescreen adult sci-fi war animated short film. Visual style: Ultra-photorealistic CGI Biomechanical structures Fusion of gray-white bone and black metal Insect-like joints Extremely fine bone texturing Dried blood streaks, ceramic cracks, and industrial oil grime Abandoned futuristic city Cold gray skylight Sparse toxic-green organisms High-contrast cinematic lighting Low-saturation cool color palette Minimal orange-red used only for flames and alarms Realistic physical destruction Oppressive, heavy, unheroic tone Characters no longer have complete flesh bodies. They are composed primarily of: Human spine Ribs Skull Black hydraulic muscle Metal joints Neural fiber optics Weapon interface ports The skeletons are not zombies — they are "legacy hardware" still being operated by military-industrial systems. Narrative & Dynamic Timeline 0–4 sec | Still Fighting After Death The shot opens on a soldier's dog tag lying in a pool of standing water. Want me to continue translating the rest of the timeline if you have more seconds/beats written out? This looks like it's cut off after the 0-4 second beat.

Generated by Wan 3.0

Generated by Seedance 2.5 on Altas Cloud

Generated by Wan 2.7 on Altas Cloud

Prompt

Generating a 15-second, 16:9 ultra-widescreen plush-universe adventure clip. A spaceship made of plush fabric, buttons, zippers, and stuffing cotton is fleeing at high speed through a universe made of giant yarn planets, fuzzy nebulae, and rag-doll megafauna. The ship is piloted by three small plush animals: a rabbit, a fox, and a crow. A giant interstellar whale-beast covered in deep-blue long plush fur, with eyes like two glass buttons, chases the ship out of the nebula. Overall style: ultra-fine plush textures, cinematic space scale, a strong contrast between cute appearance and intense action, exaggerated FPV camera work, and realistic soft-body physics. **15-Second Dynamic Timeline** **0–3 sec | Zipper Ship Ejection Launch** The shot is inside the plush ship, with a cockpit made of stitching, buttons, and fabric instrument panels. A red warning button flashes rapidly. The rabbit pulls down a giant zipper-lever control, and the ship's forward hatch splits open like a cloth sack. The camera pulls back rapidly from the cockpit, passes through the zipper hatch, and emerges outside the ship. The ship ejects and launches out of the knitted crater of a yarn planet. **3–6 sec | High-Speed Orbit Skimming the Yarn Planet** The camera hugs the ship's tail, flying low over the planet's surface. The ground is woven from giant strands of yarn: - Knitted mountain ranges streak past below at high speed - Loose thread-ends sway like a forest - The ship dodges sharply left and right - The camera continuously banks and rolls - The thrusters emit a trailing wake of white cotton fluff **6–8.5 sec | The Giant Plush Whale Appears** The fuzzy nebula suddenly parts to either side as a giant deep-blue plush whale bursts out from behind. The long fur on the whale's body is blown backward by the high-speed airflow, and its glass-button eyes reflect the planet's light. The camera whips halfway around the ship, switching to a rear-facing (reverse) view, so the whale continuously grows larger in the frame behind the ship.

Generated by Wan 3.0

Generated by Seedance 2.5 on Altas Cloud

Generated by Wan 2.7 on Altas Cloud

Wan 3.0 API - Desenvolvido para fluxos de trabalho criativos reais

As atualizações do Wan 3.0 remontam às reais demandas da indústria, integrando-se diretamente aos fluxos de trabalho de produção abaixo, desde dramas curtos até vídeos corporativos.

Cinema, TV, Dramas Curtos e MV

As tomadas nativas de 30 segundos e a restauração de cenas reais permitem que filmes, minisséries e videoclipes de IA dispensem grande parte das filmagens físicas. A consistência de pixels mantém os protagonistas recorrentes, e o áudio nativo já chega sincronizado a cada corte.

Animação, Marca e IP

O controle total de estilos vai do realista ao anime dentro de um único modelo, enquanto a consistência de pixels fixa um mascote, logotipo ou personagem de IP em cada quadro. Animações completas de marca são renderizadas sem a tediosa cadeia de produção.

Publicidade e Promoção Corporativa

A criação Omni ultrapassa os limites de texto e imagem para marcas de eletrodomésticos, beleza, automóveis, bens de grande consumo (FMCG) e vestuário. Insira diretamente uma página de produto ou um relatório da empresa para criar tudo, desde demonstrações de produtos até filmes de marca corporativa.

Design de Software e Produtos

Forneça um passo a passo da interface de usuário de um produto, uma animação de recurso ou uma visualização de dados, e o Wan 3.0 manterá a estética original enquanto o transforma em uma peça de animação guiada por uma história. A etapa tediosa de animação desaparece.

Educação

A entrada de documentos lê diretamente um PDF, PPT ou página da web, de modo que uma aula ou relatório de pesquisa se transforma em um vídeo explicativo claro sem a necessidade de um roteiro separado. O material complexo torna-se visual em um único passo.

Turismo Cultural

A restauração de cenas reais recria paisagens, locais de patrimônio e culinária local sem a necessidade de filmagens em grande escala, permitindo que vídeos urbanos e a digitalização cultural sejam concluídos a baixo custo. Lugares distantes chegam diretamente diante dos espectadores.

Como Usar Wan 3.0 no Atlas Cloud

Comece em minutos — siga estes passos simples para integrar e implantar modelos pela plataforma da Atlas Cloud.

Crie uma Conta no Atlas Cloud

Cadastre-se em atlascloud.ai e conclua a verificação. Novos usuários recebem créditos gratuitos para explorar a plataforma e testar modelos.

Por Que Usar Wan 3.0 no Atlas Cloud

Combine modelos avançados de Wan 3.0 com a plataforma acelerada por GPU do Atlas Cloud, fornecendo desempenho, escalabilidade e experiência de desenvolvimento incomparáveis.

Desempenho e Flexibilidade

Baixa Latência:
Inferência otimizada por GPU para respostas em tempo real.

API Unificada:
Uma única integração para acessar Wan 3.0, GPT, Gemini e DeepSeek.

Preços Transparentes:
Faturamento por Token, suporta modo Serverless.

Empresa e Escala

Experiência do Desenvolvedor:
SDK, análise de dados, ferramentas de ajuste fino e modelos tudo em um.

Confiabilidade:
99.99% de disponibilidade, controle de permissões RBAC, logs de conformidade.

Segurança e Conformidade:
Certificação SOC 2 Type II, conformidade HIPAA, soberania de dados nos EUA.

Perguntas frequentes sobre a API Wan 3.0

O Wan 3.0 é o modelo de vídeo multifuncional de próxima geração da Alibaba, agora em beta público. Uma única solicitação pode transformar texto, imagens, vídeo, áudio, documentos ou páginas da web em um vídeo de até 30 segundos de duração, e o modelo combina essa ampla entrada com consistência em nível de pixel, edição precisa e áudio gerado nativamente.

A Atlas Cloud planeja adicionar a API do Wan 3.0 assim que a Alibaba a lançar, com o objetivo de oferecer acesso Day-0. Inscreva-se e seja notificado no dia em que for ao ar.

Wan 3.0 é o lançamento mais abrangente da linha. Ele aumenta a duração nativa para 30 segundos, aceita até 20 materiais de referência mistos, além de documentos e páginas da web no modo de referência omni, adiciona um modo de primeiro e último quadro, e avança em direção à consistência em nível de pixel com áudio nativo. As versões anteriores do Wan no Atlas Cloud continuam sendo escolhas sólidas para trabalhos mais curtos e focados de texto para vídeo e imagem para vídeo.

O Wan 3.0 processa muito mais do que apenas um prompt como material de origem. Uma única solicitação pode extrair dados de até 20 referências mistas, 10 imagens, 5 clipes de vídeo totalizando 15 segundos e 5 clipes de áudio totalizando 15 segundos, juntamente com um único documento (doc, xls, ppt, pdf ou md) ou página da web, sendo que o próprio prompt de texto pode ter até 20.000 caracteres.

Os clipes são executados nativamente em até 30 segundos. Uma solicitação de texto ou imagem pode durar de 2 a 30 segundos, enquanto uma solicitação que inclui vídeo mantém a entrada e a saída dentro de um limite combinado de 30 segundos, e a duração inteligente pode definir o comprimento para você. A resolução abrange 480p, 720p e 1080p, com proporções de 16:9, 9:16, 4:3, 3:4, 1:1 e proporções inteligentes disponíveis.

A consistência é processada ao nível do pixel, de modo a que um rosto, um traje, um produto ou um detalhe de referência minucioso mantenha a sua aparência à medida que as cenas mudam e os sujeitos se movem. Para os ciclos de produção que reutilizam a mesma personagem ou um ativo de marca exato, essa estabilidade é o que torna cada entrega previsível.

Sim, tanto por instrução quanto por referência. Uma nota escrita ou um clipe de amostra pode reestilizar um sujeito, alterar a iluminação ou substituir um único segmento, e os elementos que você deseja manter intactos permanecem no lugar durante toda a edição.

Sim. O Atlas Cloud já oferece o Wan 2.7, 2.6 e 2.5 sob uma chave unificada, e o Wan 3.0 se juntará a essa mesma chave sem a necessidade de uma nova conta, sem reorganização de endpoints e sem configuração separada. As equipes que já fazem chamadas para a família Wan poderão acessar o Wan 3.0 bastando trocar o nome do modelo assim que ele for lançado.

Uma API para toda a IA de mídia.

Explorar Todos os Modelos