Kling v2.6 Cinematic Video Creation

Kling v2.6 Cinematic Video Creation

Kling v2.6 é a família de modelos de vídeo da Kuaishou para criação cinematográfica de texto para vídeo e imagem para vídeo, avatares de IA e transferência de movimento orientada por referências. Ele oferece suporte a proporções de aspecto flexíveis, dinâmica aprimorada, identidade estável e consistência temporal em fluxos de trabalho especializados. A Atlas Cloud disponibiliza opções Pro e Standard por meio de endpoints consistentes, com preços transparentes de pagamento conforme o uso. Comece a criar hoje.

Kling 2.6 foi desenvolvido pela Kuaishou. A Atlas Cloud (operada pela Atlas Cloud AI LLC) fornece acesso ao modelo, mas não é sua proprietária. Todas as marcas registradas pertencem aos seus respectivos titulares.

Explorar Modelos Líderes(6)

Compare os endpoints de geração de vídeo do Kling v2.6

Associe cada endpoint do Kling v2.6 ao fluxo de entrada compatível, aos seus pontos fortes em produção e aos casos de uso de vídeo previstos.

ModalidadeDescrição
Kling v2.6 Pro Avatar API (Avatar To Video)Criado para a geração de avatares premium, este endpoint produz vídeos de alta qualidade, com detalhes nítidos, movimento estável e forte consistência de identidade. É indicado para vídeos de perfil bem acabados, apresentações e conteúdo para redes sociais.
Kling v2.6 Std Avatar API (Avatar To Video)Selecione o endpoint Standard Avatar para criar vídeos de avatares de IA com detalhes nítidos, movimento cinematográfico e boa aderência aos prompts. Seus recursos atendem a perfis, apresentações curtas e produção recorrente para redes sociais.
Kling v2.6 Pro Motion Control API (Reference Motion To Video)Clipes de movimento de referência transferem dança, ação ou gestos para uma imagem de personagem ou vídeo de origem, preservando a identidade e a consistência temporal. Use-o para criar animações fluidas de personagens que sigam movimentos específicos gravados.
Kling v2.6 Std Motion Control API (Image And Motion To Video)Anime uma imagem estática de personagem fornecendo um clipe de movimento que contenha uma dança, ação ou gesto. O endpoint extrai esse movimento e gera um vídeo suave e realista para fluxos acessíveis de transferência de movimento.
Kling v2.6 Pro API (Text To Video)Os prompts de texto se transformam em vídeos cinematográficos com geração de som e proporções de aspecto flexíveis por meio deste modelo da Kuaishou. Ele é compatível com desenvolvimento de conceitos, cenas narrativas, anúncios e outros projetos de vídeo orientados por prompts.
Kling v2.6 Pro API (Image To Video)A partir de uma imagem, este endpoint cria um vídeo cinematográfico com geração de som e dinâmica aprimorada. Dê vida a imagens de produtos, ilustrações ou imagens estáticas criativas quando a continuidade visual controlada for importante.

Kling v2.6 em Som, Movimento e Identidade

Kling v2.6 combina geração audiovisual nativa, fluxos de trabalho com texto e imagem, controle de movimento orientado por referências, avatares orientados por áudio, parâmetros flexíveis e acesso pay as you go nos endpoints Standard e Pro.

Geração Audiovisual Nativa do Kling v2.6

Kling v2.6 Pro pode gerar vídeo e som juntos a partir de um prompt de texto ou de uma imagem de origem. A opção de som vem ativada por padrão nos endpoints de text to video e image to video da Atlas Cloud. Assim, diálogos, efeitos e ambiência podem acompanhar a cena à medida que ela se desenvolve. É uma excelente opção para clipes narrativos curtos que precisam de um resultado audiovisual coerente sem uma etapa separada de sonorização.

Fluxos de Geração por Texto e Imagem

Comece com uma cena escrita ou anime uma imagem estática usando os endpoints de geração Pro. Os prompts de texto são compatíveis com saídas 1:1, 9:16 e 16:9, enquanto ambos os fluxos oferecem durações de 5 ou 10 segundos, controle de som, prompts negativos e controle de CFG de 0 a 1. As entradas de imagem aceitam arquivos JPG, JPEG ou PNG de até 10 MB, oferecendo aos desenvolvedores controle prático sobre assets para redes sociais, produtos e produções cinematográficas.

Controle de Transferência de Movimento do Kling v2.6

Forneça uma imagem de personagem e um clipe de movimento de referência ao Kling v2.6 Motion Control, que transfere sequências completas de dança, ação ou gestos, preservando a identidade e a consistência temporal. Os vídeos de referência podem ter de 3 a 30 segundos. Escolha se a composição deve seguir a imagem ou o vídeo de movimento e decida se o áudio de origem deve ser mantido. O resultado é adequado para performances contínuas, animação de personagens e campanhas orientadas por ação.

Vídeos de Avatar Orientados por Áudio

Uma imagem e uma faixa de áudio são as entradas obrigatórias para os endpoints Standard e Pro Avatar, com um prompt opcional para orientar o resultado. O Pro prioriza detalhes nítidos, movimento estável e forte consistência de identidade, enquanto o Standard combina movimento cinematográfico com adesão confiável ao prompt. Use este fluxo quando um sujeito reconhecível precisar reproduzir um áudio preparado em vídeos de perfil, introduções de marca ou conteúdo recorrente para redes sociais.

Escolha de Modelo com Pay as You Go

Escolha os endpoints Standard ou Pro de acordo com a carga de trabalho e pague apenas pelas chamadas realizadas por meio da Atlas Cloud. O Standard Avatar começa em $0.056 por chamada, o Standard Motion Control em $0.07, o Pro Text to Video e Image to Video em $0.07, e o Pro Avatar ou Motion Control em $0.112. Uma única conta cobre todos os seis endpoints, ajudando os desenvolvedores a equilibrar qualidade visual, necessidades de movimento e custo de produção sem compromisso com uma assinatura.

Kling v2.6 em foco: um prompt, três modelos de vídeo

Veja como o Kling v2.6 e duas alternativas do Atlas Cloud interpretam prompts idênticos em cenas de ação realistas e narrativas estilizadas.

Prompt

Um filme publicitário de moda hiper-realista, com duração de 8–10 segundos, ambientado ao meio-dia em um vasto lago de sal branco: seis patinadores de alta velocidade, usando capas espelhadas iridescentes, formam uma precisa “equipe geométrica de colheita de sal em formato de pipa”, cada um puxando linhas azul-cobalto e laranja fluorescente esticadas, conectadas a uma gigantesca pipa em formato de arraia-manta. Comece com uma tomada aérea vertical de drone, de cima para baixo, enquanto a formação sincronizada traça padrões extremamente nítidos na crosta de sal; o drone mergulha repentinamente e se estabiliza a poucos centímetros do solo, acelerando atrás do líder enquanto a equipe faz slalom por portões de bandeiras tremulantes, com as capas estalando e as cordas flexionando sob uma tensão realista. Faça uma panorâmica rápida para uma órbita de 360 graus quando um redemoinho de poeira surge de repente ao lado deles, espiralando cristais de sal soltos no ar; os seis patinadores reagem em perfeita unissonância, recolhem bruscamente suas linhas, e a pipa em forma de arraia-manta mergulha com força de maneira dramática, atravessando o vórtice de cristais e espalhando sal cintilante como uma deslumbrante nevasca sobre a equipe em alta velocidade. Ação coordenada contínua do início ao fim, identidades e formação coerentes em todas as tomadas, impulso de patinação convincente, tensão das cordas fisicamente precisa, movimento aerodinâmico dos tecidos, partículas granulares de sal, turbulência do vento e sombras projetadas no solo. Luz solar intensa vinda de cima, iluminação superior nítida e de alto contraste, reflexos prismáticos do arco-íris nas capas espelhadas e na superfície de sal, composição em camadas de branco-neve, azul-cobalto e laranja fluorescente, estética premium de publicidade surrealista de alta moda, detalhes cinematográficos extremamente nítidos, percussão energética sincronizada com cada curva e transição de câmera, vento uivante, lâminas raspando, tecido estalando, cordas se retesando e, no final, um brilho sonoro cristalino. Sem câmera lenta, sem tomadas estáticas de preenchimento, sem cortes que quebrem a continuidade espacial, sem corpos deformados, sem pessoas duplicadas, sem cordas emaranhadas ou desconectadas, sem figurinos inconsistentes, sem objetos flutuando, sem telas, sem interfaces de software, sem painéis, sem barras de progresso, sem gráficos, sem legendas, sem logotipos, sem marcas-d’água, sem texto legível. Proporção de tela 16:9.

Generated with Kling v2.6 Pro Text-to-Video on Atlas Cloud

Generated with Seedance 2.0 Text-to-Video on Atlas Cloud

Generated with Seedance 2.0 Fast Text-to-Video on Atlas Cloud

Prompt

Uma perseguição cinematográfica contínua em alto-mar, com duração de 8–10 segundos, dentro do salão de baile fortemente inclinado de um naufrágio em decomposição: comece com uma tomada macro extrema de um tentáculo de polvo-mímico semitransparente brilhando através dos cristais rachados de um lustre enquanto agarra uma “pérola” luminosa; faça rapidamente um dolly zoom para trás, revelando o polvo balançando-se em uma grade corroída sobre mesas de jantar viradas, enquanto moreias serpenteiam entre as cadeiras e o perseguem, com talheres, estilhaços de vidro, sedimentos e cadeias de bolhas subindo e colidindo sob uma física subaquática convincente. Transicione para uma tomada de perseguição em órbita fechada de 360 graus enquanto o polvo altera continuamente a textura e a translucidez da pele para combinar com cortinas de veludo, latão manchado e madeira coberta de cracas; em seguida, ele dispara uma densa nuvem de tinta que se enrola formando um chamariz convincente em formato de polvo; as moreias atacam a silhueta falsa enquanto o polvo real passa por elas. Faça uma panorâmica rápida e incline a câmera até uma visão dramaticamente inclinada de cima para baixo: a “pérola” roubada de repente abre um pequeno olho, seu brilho âmbar se intensifica, e o enorme rosto camuflado de um peixe-pescador surge sob a mesa do banquete — a pérola é sua isca; o polvo congela por um instante cômico enquanto o peixe-pescador avança em direção à câmera. Realismo cinematográfico fotorrealista de alto-mar, luz ambiente ciano fria contrastando com bioluminescência âmbar quente, água volumétrica, partículas à deriva, movimento de tentáculos de corpo mole em alta densidade, simulação de fluidos, colisões entre objetos flutuantes, continuidade perfeita dos sujeitos, impulso fisicamente crível, ação nítida e legível, sem câmera lenta. Áudio imersivo sincronizado: rangidos abafados do casco, tilintar de cristais, bolhas correndo, estalos das moreias, percussão pulsante de perseguição, uma explosão úmida de tinta e, em seguida, uma súbita nota grave no momento da revelação. Sem telas, interfaces, painéis, barras de progresso, gráficos, legendas, subtítulos, logotipos, marcas-d’água ou texto explicativo. Proporção de tela 16:9.

Generated with Kling v2.6 Pro Text-to-Video on Atlas Cloud

Generated with Seedance 2.0 Text-to-Video on Atlas Cloud

Generated with Seedance 2.0 Fast Text-to-Video on Atlas Cloud

Kling v2.6 em Histórias, Personagens e Movimento

De prompts cinematográficos e imagens estáticas de campanhas animadas a avatares consistentes e performances guiadas por movimento, o Kling v2.6 ajuda desenvolvedores a criar filmes, anúncios, conteúdo para redes sociais e personagens de marca.

Conceitos cinematográficos com Kling v2.6

Transforme conceitos escritos em vídeos cinematográficos com o Kling v2.6 Pro Text to Video, usando proporções flexíveis e som gerado. Cineastas podem prototipar trailers, momentos dramáticos e propostas visuais a partir de um único prompt.

Campanhas de produtos animadas

Dê vida a uma imagem de produto ou peça estática de campanha com dinâmica aprimorada, qualidade cinematográfica e som gerado. Equipes de marketing podem criar teasers de lançamento, demonstrações visuais e promoções para redes sociais a partir de artes existentes.

Apresentadores avatar do Kling v2.6

Crie vídeos de avatar refinados, com detalhes nítidos, movimento estável e forte consistência de identidade usando o modelo Pro Avatar. Use-os em apresentações de perfil, segmentos com apresentadores e personalidades recorrentes de marca nas redes sociais.

Coreografias guiadas por referência

Mapeie cenas de dança, ação ou gestos em uma imagem de personagem, preservando a identidade e a consistência temporal. Criadores podem produzir testes de coreografia, mascotes animados e clipes sociais de performances a partir de movimentos gravados.

Reformulação de personagens com Kling v2.6

Transfira o movimento de um clipe de referência para uma imagem de personagem ou vídeo de origem usando o Pro Motion Control. Equipes de produção podem explorar intérpretes alternativos, sequências de ação estilizadas e animações consistentes de personagens.

Pipelines automatizados de vídeo para redes sociais

Comece com um prompt de texto e gere vídeos cinematográficos com som em proporções flexíveis. Desenvolvedores podem automatizar conceitos curtos de campanhas, conteúdo de criadores e visuais específicos para cada plataforma sem fornecer uma imagem inicial.

Kling v2.6 em comparação com APIs de vídeo para produção

Compare o Kling v2.6 com os principais modelos de texto para vídeo em termos de provedor, duração do clipe, áudio nativo e preço base padrão.

ModeloProvedorDuração da saídaÁudio nativoPreço base padrão
Kling v2.6 Pro Text-to-VideoKuaishou5 ou 10 segundos√$0.07/segundo
Seedance 2.0 Text-to-VideoByteDance4 a 15 segundos√$0.112/segundo
Wan-2.7 Text-to-videoQwen2 a 15 segundos√$0.10/segundo
Veo 3.1 Lite Text-to-videoGoogle4, 6 ou 8 segundos√$0.05/segundo

Como Usar Kling 2.6 no Atlas Cloud

Comece em minutos — siga estes passos simples para integrar e implantar modelos pela plataforma da Atlas Cloud.

Crie uma Conta no Atlas Cloud

Cadastre-se em atlascloud.ai e conclua a verificação. Novos usuários recebem créditos gratuitos para explorar a plataforma e testar modelos.

Por Que Usar Kling 2.6 no Atlas Cloud

Combine modelos avançados de Kling 2.6 com a plataforma acelerada por GPU do Atlas Cloud, fornecendo desempenho, escalabilidade e experiência de desenvolvimento incomparáveis.

Desempenho e Flexibilidade

Baixa Latência:
Inferência otimizada por GPU para respostas em tempo real.

API Unificada:
Uma única integração para acessar Kling 2.6, GPT, Gemini e DeepSeek.

Preços Transparentes:
Faturamento por Token, suporta modo Serverless.

Empresa e Escala

Experiência do Desenvolvedor:
SDK, análise de dados, ferramentas de ajuste fino e modelos tudo em um.

Confiabilidade:
99.99% de disponibilidade, controle de permissões RBAC, logs de conformidade.

Segurança e Conformidade:
Certificação SOC 2 Type II, conformidade HIPAA, soberania de dados nos EUA.

Perguntas sobre a API do Kling v2.6 para desenvolvedores

Kling v2.6 é uma família de modelos de vídeo de IA da Kuaishou disponível através da Atlas Cloud. Inclui geração Pro de texto para vídeo e de imagem para vídeo, além de endpoints Standard e Pro para avatares e controlo de movimento.

Pode criar vídeos a partir de prompts, animar imagens de origem, produzir vídeos de avatares a partir de uma imagem e áudio ou transferir sequências de dança, ações e gestos de vídeos de referência. Os endpoints Pro Text-to-Video e Pro Image-to-Video podem gerar som juntamente com os elementos visuais.

Escolha Text-to-Video quando partir de um prompt e Image-to-Video quando quiser animar uma imagem estática. Os endpoints Avatar combinam uma imagem com o áudio fornecido, enquanto Motion Control aplica a um personagem os movimentos de um vídeo de referência.

Envie uma solicitação POST para `/api/v1/model/generateVideo` com a sua chave de API da Atlas Cloud, o ID exato do modelo e os parâmetros de entrada específicos do endpoint. A resposta assíncrona fornece um ID de previsão que pode consultar através de `/api/v1/model/prediction/{id}` até a tarefa ser concluída.

Os controlos variam consoante o endpoint. Text-to-Video suporta prompts, prompts negativos, proporções de 1:1, 9:16 e 16:9, durações de 5 ou 10 segundos, som e escala de orientação, enquanto os outros fluxos adicionam entradas de imagem, áudio, vídeo de movimento, orientação ou retenção de som, conforme aplicável.

No Pro Text-to-Video e no Pro Image-to-Video, o parâmetro `sound` controla a geração simultânea de som. Os modelos Avatar exigem, em vez disso, uma entrada de áudio juntamente com a imagem do personagem, enquanto Motion Control pode manter o som original do vídeo de referência.

A Atlas Cloud apresenta tarifas padrão de $0.07 por segundo para Pro Text-to-Video, Pro Image-to-Video e Standard Motion Control. Standard Avatar custa $0.056 por segundo, enquanto Pro Avatar e Pro Motion Control custam $0.112 por segundo, utilizando as tarifas originais em vez de preços promocionais.

Prepare uma imagem de personagem em JPG, JPEG ou PNG e um vídeo de movimento em MP4 ou MOV. Cada ficheiro não pode ter mais de 10 MB, deve medir pelo menos 300 pixels em ambas as dimensões e utilizar uma proporção entre 1:2.5 e 2.5:1.

Primeiro, verifique o ID do modelo, a autenticação Bearer, os campos obrigatórios e as restrições de multimédia específicas do endpoint. Se a tarefa tiver sido aceite, consulte o respetivo ID de previsão até ser concluída ou falhar e analise o erro devolvido. Em caso de inconsistências visuais, simplifique a cena e utilize multimédia de origem nítida, especialmente ao transferir movimentos faciais ou interações com objetos complexos.

Explorar Mais Séries

Seedance 2.5

A API do Seedance 2.5 já está disponível no Atlas Cloud! Ela oferece aos desenvolvedores o mais novo modelo de vídeo da ByteDance. Ele gera até 30 segundos de vídeo nativo em uma única passagem a partir de texto, uma única imagem ou até 50 referências multimodais, com áudio sincronizado e texto multilíngue no quadro. No Atlas Cloud, você o acessa por meio de uma única chave, com consistência de sujeito e física aprimorada mantendo a coerência em tomadas longas.

Ver Série

Wan 3.0

A API Wan 3.0 é a próxima geração da família de vídeos Wan da Alibaba, desenvolvida para elevar a geração de formato longo, o controle de múltiplas referências e a qualidade audiovisual a novos patamares. O Atlas Cloud já hospeda o Wan 2.7, 2.6 e 2.5, e o Wan 3.0 funciona com a mesma chave unificada, sem necessidade de configuração separada. Comece a construir hoje mesmo. Role a tela para baixo até a vitrine para ver o que o Wan 3.0 pode criar.

Ver Série

MiniMax H3

MiniMax H3 é a família de vídeo multimodal da MiniMax para criação guiada por texto, imagem e referências. Nas rotas compatíveis, preserva os elementos das mídias de referência, oferece proporções flexíveis e combina som gerado com elementos visuais por meio do H3 Developer, com perfis de saída selecionados por endpoint. O Atlas Cloud unifica a família com uma única chave compatível com a OpenAI e preços transparentes de pagamento conforme o uso, a partir da tarifa padrão de $0.038 por segundo. Comece a criar hoje.

Ver Série

Seedream 5.0 Pro

A API do Seedream 5.0 Pro fornece aos desenvolvedores o modelo de edição de imagens controlável da ByteDance no Atlas Cloud. Ela posiciona as edições com precisão usando âncoras e coordenadas, separa as imagens em camadas editáveis, funde múltiplas referências e combina cores e materiais exatos, com texto multilíngue em 2K e 3K. No Atlas Cloud, você pode acessá-lo por meio de uma única chave!

Ver Série

Seedance 2.0

Seedance 2.0 é o modelo de vídeo para produção da ByteDance, desenvolvido para a criação precisa de planos. Transforme prompts em vídeo, anime uma imagem do primeiro quadro com orientação opcional do último quadro ou defina os resultados com mídia de referência e pesquisa opcional na web. O Atlas Cloud reúne esses fluxos de trabalho em uma única API, com preços transparentes conforme o uso e uma única chave compatível com OpenAI. Comece a desenvolver hoje.

Ver Série

GPT Image 2.5

A família gpt-image-2.5 da OpenAI oferece aos desenvolvedores a opção entre Flare e Sunburst para fluxos de trabalho de imagens em produção. Renderize em resoluções arbitrárias de até 3840x2160 e escolha entre cinco níveis de qualidade, incluindo xhigh e max, para atender a requisitos específicos de saída. A Atlas Cloud oferece inferência REST pronta para uso, sem cold starts, com preços padrão a partir de US$ 0,004 por geração. Comece a criar hoje.

Ver Série

GPT Image 2

A API do GPT Image 2 dá aos desenvolvedores acesso ao mais recente modelo de imagem da OpenAI, o sucessor do GPT Image 1.5. Ele gera e edita imagens com renderização de texto precisa em caracteres latinos e CJK, além de uma forte composição para pôsteres, mockups e infográficos. Na Atlas Cloud, você o acessa através de uma API unificada junto a mais de 300 modelos, com créditos gratuitos, 99,99% de tempo de atividade e sem a necessidade de verificação de organização da OpenAI.

Ver Série

Gemini Omni Flash

A API gemini omni oferece aos desenvolvedores a família Gemini Omni Flash nativamente multimodal do Google DeepMind, incluindo o Gemini Omni 1.1 Flash. Crie vídeos cinematográficos com áudio nativo sincronizado, anime imagens estáticas com controle preciso dos frames inicial e final ou edite vídeos existentes por meio de edições guiadas por texto que preservam o conteúdo não alterado. A Atlas Cloud fornece uma única chave compatível com OpenAI, acesso unificado e preços transparentes conforme o uso. Comece a desenvolver hoje.

Ver Série

Grok Imagine

A API Grok Imagine cobre os modelos de imagem, vídeo e fala da xAI, desde Image 2.0 até Video 1.5 e xAI TTS v1. Renderize imagens estáticas em 1K ou 2K em 14 proporções de aspecto, estenda uma cena para 15 segundos de movimento em 1080p, controle os planos com até 7 imagens de referência ou narre-os em 20 idiomas. O Atlas Cloud executa todos os modos em um único endpoint, com preço por uso a partir de $0.02 por imagem e $0.05 por segundo. Comece a construir hoje.

Ver Série

Google

Os modelos criativos mais poderosos do Google estão todos disponíveis na Atlas Cloud. O Veo 3.1 oferece geração de vídeo cinematográfico, o Nano Banana 2 impulsiona a criação de imagens de alta fidelidade e o Gemini traz inteligência multimodal para cada fluxo de trabalho. Acesse o pacote completo de modelos do Google por meio de uma única API key com disponibilidade Day-0 e preços de pagamento conforme o uso (pay-as-you-go).

Ver Série

Seedance 2.0 Mini

O Seedance 2.0 Mini leva a geração de vídeo multimodal da ByteDance para fluxos de trabalho onde a velocidade e o custo são essenciais. Ele oferece os principais recursos do Seedance 2.0 com menor impacto — geração mais rápida, menor custo por vídeo e a mesma integração de API que você já usa. Para equipes que executam pipelines de alto volume ou prototipagem em escala, o Mini é a opção padrão prática.

Ver Série

ByteDance

Da geração de vídeo cinematográfico à criação de imagens de alta fidelidade, os modelos mais poderosos da ByteDance estão disponíveis no Atlas Cloud. Execute o Seedance e o Seedream em grande escala com os preços de inferência mais baixos e zero custos indiretos de infraestrutura.

Ver Série

Uma API para toda a IA de mídia.

Explorar Todos os Modelos