
Kling 2.0 é a família de modelos de geração de vídeo da Kuaishou para criação de texto para vídeo e imagem para vídeo. Seus modelos Master combinam visuais de alta fidelidade com iluminação refinada e realismo de câmera, oferecendo aos desenvolvedores dois fluxos de trabalho focados para transformar prompts ou imagens de origem em clipes refinados. No Atlas Cloud, acesse ambos os modelos com uma única chave compatível com a OpenAI, disponibilidade no Day-0 e integração simples. Comece a criar hoje.
Kling 2.0 foi desenvolvido pela Kuaishou. A Atlas Cloud (operada pela Atlas Cloud AI LLC) fornece acesso ao modelo, mas não é sua proprietária. Todas as marcas registradas pertencem aos seus respectivos titulares.
Escolha o endpoint do Kling 2.0 que corresponde ao seu material de origem e aos seus objetivos de produção.
| Modalidade | Descrição |
|---|---|
| Kling 2.0 I2V Master API (Image To Video) | Transforme uma imagem de origem em um vídeo cinematográfico em 1080p, com iluminação refinada, comportamento realista de câmera e personagens consistentes entre os quadros. Este endpoint é ideal para publicidade centrada em personagens, cenas de marca e narrativas visuais que precisam preservar a imagem de origem. |
| Kling 2.0 T2V Master API (Text To Video) | A partir de um prompt de texto, o Kling 2.0 T2V Master produz vídeos cinematográficos com visuais de alta fidelidade e movimentos humanos realistas. Use-o para criar imagens conceituais, sequências narrativas, conteúdo promocional ou cenas guiadas por movimento sem fornecer uma imagem inicial. |
O Kling 2.0 combina saída cinematográfica em 1080p, movimento estável de personagens, fluxos de criação por texto e imagem, controle dos frames inicial e final, configurações flexíveis de clipes e acesso unificado à API com cobrança conforme o uso no Atlas Cloud.
O Kling 2.0 renderiza clipes cinematográficos em 1080p, com iluminação refinada e realismo de câmera nos dois modelos da família. Detalhes precisos e imagens de alta fidelidade ajudam as cenas a manterem sua qualidade em planos fechados, revelações em plano aberto e mudanças de iluminação. Use-o quando filmes de produto, prévias narrativas ou sequências de marca precisarem de um acabamento refinado, pronto para exibição, na revisão criativa e na montagem final.
O movimento humano natural dá aos personagens peso, ritmo e fluidez física convincentes. A estabilidade entre frames ajuda a manter o mesmo personagem reconhecível enquanto expressões, gestos, roupas e ângulos de câmera evoluem ao longo do clipe. Para coreografias, performances ou narrativas guiadas por ação, essa combinação proporciona movimentos energéticos sem sacrificar a continuidade visual que mantém a cena verossímil do início ao fim.
Escolha um prompt de texto quando a cena começar como uma ideia ou forneça uma imagem quando uma composição estabelecida deve conduzir o movimento. Os dois endpoints Kling 2.0 Master compartilham o mesmo fluxo de geração de vídeo no Atlas Cloud. Esse acesso combinado permite que desenvolvedores criem protótipos de tomadas originais, animem artes de campanhas e alternem entre modos de criação sem reconstruir a experiência de produto ao redor.
Oriente a animação de imagens do Kling 2.0 com um frame inicial obrigatório e um frame final opcional que define onde o movimento deve terminar. O endpoint de imagem aceita durações de 5 ou 10 segundos, além de uma escala de orientação de 0 a 1 para equilibrar a direção do prompt. Transições controladas são ideais para revelações, transformações, match cuts e sequências visuais com uma composição final planejada.
Defina o enquadramento de clipes gerados por texto para formatos widescreen, vertical ou quadrado, com proporções de 16:9, 9:16 e 1:1. Selecione uma duração de 5 ou 10 segundos e use um prompt negativo para desencorajar elementos visuais indesejados. Esses controles tornam um único fluxo de geração prático para prévias cinematográficas, publicações em redes sociais e histórias compactas de produtos em diferentes formatos de publicação, sem alterar o modelo principal.
Acesse os modelos de texto e imagem por meio de uma única API do Atlas Cloud, com cobrança transparente conforme o uso. Cada endpoint tem um preço base padrão verificado de $0.28, enquanto o processamento assíncrono de predições se adapta a backends de aplicações e fluxos de mídia em fila. Desenvolva com uma única chave de API do Atlas Cloud quando seu produto precisar de vídeo orientado por prompts e animação guiada por referências, sem integrações separadas com provedores.
Compare como os principais modelos de vídeo interpretam o mesmo prompt orientado por ação, desde o movimento da câmera e a continuidade física até a consistência dos personagens e a composição cinematográfica.
Uma aventura em miniatura de 8–10 segundos sobre um pouso lunar, em uma bancada de trabalho desorganizada de um artesão durante a noite: um astronauta de corda de latão, do tamanho de um polegar, gira a própria chave, ganha vida num estalo e dispara pela madeira riscada sem parar. Plano macro extremo de acompanhamento lateral enquanto ele pisa em uma gangorra feita de régua, lançando uma esfera de aço em uma reação em cadeia precisa — frascos de tinta tilintam e oscilam, engrenagens cobertas de verdete giram e uma pista de origami azul-cobalto se desdobra logo à frente da esfera em movimento. Whip-pan para uma vista de cima enquanto o astronauta corre ao lado dela, agarra um pincel pendular, salta pelo ar e aterrissa dentro de uma nave espacial feita de caixa de fósforos, marcada com uma minúscula faixa vermelha de advertência. Orbite suavemente a nave em aceleração enquanto ela atravessa uma lupa; a refração realista distorce a oficina, transformando-a em um vasto horizonte lunar azul-frio, com reflexos ondulando pelo vidro e pelo metal. A nave parece decolar em direção a uma lua cheia brilhante — então faça um rápido travelling para trás no plano final: a “lua” é, na verdade, um abajur redondo pendurado sobre a borda da mesa, enquanto o minúsculo astronauta faz uma saudação orgulhosa de dentro da caixa de fósforos suspensa no ar. Fotografia prática de miniaturas combinada com animação stop-motion vintage e tátil, escala consistente das miniaturas, colisões físicas detalhadas, movimento contínuo e cheio de energia, profundidade de campo rasa controlada com mudanças de foco precisas, luz de trabalho âmbar quente em contraste com a luz lunar azul-fria, tons de madeira, pátina cobre-esverdeada, azul-cobalto e vermelho de advertência usado com moderação. Design de som nítido e sincronizado: mola fazendo tique-taque, pequenos passos metálicos, estalo da régua, cliques da esfera, tilintar do vidro, conversa das engrenagens, farfalhar do papel, zunido do pincel, zumbido do motor da caixa de fósforos e um crescendo orquestral divertido que termina no zumbido elétrico do abajur. Sem telas, interfaces de software, painéis, barras de progresso, gráficos, legendas, subtítulos, logotipos ou textos explicativos. Proporção de aspecto 16:9.
Generated with Kling Video O3 4K Text-to-Video on Atlas Cloud
Generated with Seedance 2.5 Text-to-Video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Uma comédia cinematográfica vibrante de 9 segundos, em live action, ao pôr do sol, em um gigantesco campo de lavanderia ao ar livre: um garoto adolescente usando botas de chuva amarelo-limão se equilibra sobre um cesto de roupa de vime que rola, correndo atrás de um avestruz que roubou uma meia vermelha chamativa e a carrega no bico. Comece com um plano de acompanhamento rente ao chão, ao lado das rodas barulhentas do cesto, enquanto o garoto bombeia os braços e avança cambaleando; atravesse fileiras de enormes lençóis brancos ondulando e formando arcadas translúcidas, com o tecido passando repetidamente diante da lente como transições naturais contínuas, preservando as roupas, o rosto, as botas e o cesto do garoto, além do mesmo avestruz. Whip-pan para o passo elástico e fisicamente preciso do avestruz, depois orbite rapidamente os dois personagens enquanto eles ziguezagueiam, abaixam-se, colidem com tecidos macios suspensos e continuam a perseguição sem interromper o movimento. O avestruz de repente faz uma curva fechada e mergulha por entre varais densos; camisas, vestidos e toalhas coloridos viram e se enrolam em sequência como dominós, com cada colisão do tecido propagando-se de forma realista ao longo da linha. No clímax cômico, a meia vermelha é lançada para o alto e pousa perfeitamente sobre a cabeça do avestruz; o avestruz e o garoto param exatamente no mesmo instante e encaram-se em um silêncio atônito. Corte abrupto para um plano de grua alto, revelando os varais emaranhados espiralando ao redor deles como um vórtice colorido. Realismo cinematográfico prático de alta saturação, comédia física divertida, contraluz laranja-avermelhada quente delineando o tecido semitransparente, sombras verde-azuladas intensas, vento vigoroso, detalhes nítidos dos tecidos, desfoque de movimento natural, anatomia coerente, ação contínua, física realista dos tecidos e continuidade consistente de oclusão. Áudio sincronizado: rodas do cesto chacoalhando, botas batendo, passadas do avestruz, lençóis estalando, tecidos batendo em cascata, seguido de uma parada musical repentina e de um único pio cômico e seco. Sem câmera lenta, preenchimento estático, subtítulos, legendas, logotipos, marcas-d’água, telas, interfaces de software, painéis, barras de progresso, gráficos, diagramas ou textos explicativos. Proporção de aspecto 16:9.
Generated with Kling Video O3 4K Text-to-Video on Atlas Cloud
Generated with Seedance 2.5 Text-to-Video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
De conceitos de campanha e visuais de produtos a narrativas centradas em personagens, o Kling 2.0 transforma prompts de texto ou imagens estáticas em clipes cinematográficos em 1080p, com movimento realista, iluminação refinada e personagens estáveis entre os frames.
Transforme ideias de cenas descritas por escrito em clipes cinematográficos com visuais de alta fidelidade e movimento humano realista. Diretores e equipes criativas podem usá-los para pré-visualizar enquadramentos, performances e direção visual antes da produção.
Anime uma imagem de produto em um clipe em 1080p, com iluminação refinada e tratamento de câmera realista. As equipes de marketing obtêm ativos visuais sofisticados para lançamentos, landing pages e campanhas pagas, sem precisar filmar cada conceito.
Crie vídeos cinematográficos em 1080p a partir de prompts ou imagens estáticas, preservando personagens estáveis entre os frames. As equipes de redes sociais podem desenvolver posts sofisticados, teasers de campanhas e histórias visuais prontas para as plataformas, integradas a calendários recorrentes de conteúdo.
Desenvolva sequências focadas em personagens, com movimento humano realista e continuidade entre os frames. Cineastas, animadores e equipes de jogos podem explorar momentos dramáticos, escolhas de movimento e momentos cinematográficos durante o desenvolvimento narrativo inicial.
Teste conceitos de cenas com visuais de alta fidelidade, iluminação refinada e comportamento de câmera realista antes de se comprometer com a produção. As equipes criativas podem comparar direções visuais e comunicar com mais clareza a atmosfera, o movimento e o enquadramento pretendidos.
Dê movimento a ilustrações ou fotografias estáticas, transformando-as em clipes cinematográficos em 1080p com iluminação refinada. Editoras, designers e equipes de mídia podem criar complementos visuais para matérias digitais, portfólios e pacotes editoriais de marca.
Compare os endpoints do Kling 2.0 com o Seedance 2.0 e o Wan 2.7 em relação ao fluxo de entrada, à duração do clipe, ao áudio nativo e ao preço padrão.
| Modelo | Fluxo de entrada | Duração do clipe | Áudio nativo | Preço padrão |
|---|---|---|---|---|
| kling v2.0 i2v Master | Imagem, quadro final opcional | 5 ou 10 sec | - | $0.28/sec |
| Kling v2.0 t2v Master | Texto | 5 ou 10 sec | - | $0.28/sec |
| Seedance 2.0 Text-to-Video | Prompts de texto | 4 a 15 sec | √ | $0.112/sec |
| Seedance 2.0 Image-to-Video | Primeiro quadro, último quadro opcional | 4 a 15 sec | √ | $0.112/sec |
| Wan-2.7 Text-to-video | Instrução de texto | 2 a 15 sec | √ | $0.10/sec |
Comece em minutos — siga estes passos simples para integrar e implantar modelos pela plataforma da Atlas Cloud.
Cadastre-se em atlascloud.ai e conclua a verificação. Novos usuários recebem créditos gratuitos para explorar a plataforma e testar modelos.
Combine modelos avançados de Kling 2.0 com a plataforma acelerada por GPU do Atlas Cloud, fornecendo desempenho, escalabilidade e experiência de desenvolvimento incomparáveis.
Baixa Latência:
Inferência otimizada por GPU para respostas em tempo real.
API Unificada:
Uma única integração para acessar Kling 2.0, GPT, Gemini e DeepSeek.
Preços Transparentes:
Faturamento por Token, suporta modo Serverless.
Experiência do Desenvolvedor:
SDK, análise de dados, ferramentas de ajuste fino e modelos tudo em um.
Confiabilidade:
99.99% de disponibilidade, controle de permissões RBAC, logs de conformidade.
Segurança e Conformidade:
Certificação SOC 2 Type II, conformidade HIPAA, soberania de dados nos EUA.
Kling 2.0 é uma família de modelos de geração de vídeo desenvolvida pela Kuaishou. A Atlas Cloud oferece endpoints Master dedicados para gerar vídeos cinematográficos a partir de prompts de texto ou imagens de origem.
Use o T2V Master para transformar descrições de cenas escritas em vídeos cinematográficos ou escolha o I2V Master para animar uma imagem de origem. A família é voltada para visuais de alta fidelidade e movimentos realistas, enquanto o I2V Master oferece saída em 1080p, iluminação refinada, realismo de câmera e estabilidade de personagens entre os frames.
Escolha o endpoint T2V Master ou I2V Master de acordo com sua entrada e use uma chave de API da Atlas Cloud para enviar as solicitações. Siga o schema do playground do modelo selecionado para consultar a estrutura atual das solicitações e os valores compatíveis.
Selecione o T2V Master quando sua cena começar com uma descrição escrita e você quiser que o modelo componha os visuais. Escolha o I2V Master quando já tiver uma imagem de origem cuja composição, assunto ou identidade visual deverá orientar o clipe.
O T2V Master começa com um prompt de texto, enquanto o I2V Master combina uma imagem de origem com instruções que descrevem a ação pretendida ou o comportamento da câmera. Consulte o schema correspondente do playground da Atlas Cloud antes da implementação, pois os controles disponíveis e os valores aceitos são específicos de cada endpoint.
Sim. O perfil verificado da Atlas Cloud para o endpoint I2V Master especifica clipes cinematográficos em 1080p, com iluminação refinada, comportamento realista da câmera e estabilidade de personagens entre os frames.
O preço base padrão é de $0.28 para o endpoint T2V Master ou I2V Master. A Atlas Cloud utiliza cobrança conforme o uso, permitindo que os desenvolvedores escolham o fluxo de trabalho adequado sem compromisso com uma assinatura.
Simplifique cenas muito carregadas, descreva as ações em uma sequência clara e indique diretamente o movimento de câmera pretendido. Para solicitações de imagem para vídeo, comece com uma imagem de origem limpa e mantenha o prompt focado no movimento que deve ocorrer.
Guias, tutoriais e novidades de produto para você aproveitar ao máximo a Atlas Cloud.