
Kling 1.6 é o modelo de geração de vídeo da Kuaishou, criado para transformar prompts e imagens de referência em vídeos curtos coerentes. O modelo melhora a capacidade de resposta a movimentos, ações temporais e movimentos de câmera, além de reforçar a consistência dos elementos principais, a precisão das cores, a dinâmica da iluminação e a renderização detalhada. Aceda à família através do Atlas Cloud com uma única chave compatível com a OpenAI e preços transparentes conforme o uso. Comece a desenvolver hoje.
Kling 1.6 foi desenvolvido pela Kuaishou. A Atlas Cloud (operada pela Atlas Cloud AI LLC) fornece acesso ao modelo, mas não é sua proprietária. Todas as marcas registradas pertencem aos seus respectivos titulares.
Veja como cada endpoint do Kling 1.6 lida com entradas de texto ou imagem e em quais cenários seus pontos fortes comprovados — movimento, coerência, nível de detalhe e eficiência — se destacam.
| Modalidade | Descrição |
|---|---|
| Kling 1.6 Multi I2V Pro API (Multi Image To Video) | Converta imagens em vídeos com múltiplos sujeitos, obtendo maior coerência e precisão avançada no rastreamento de movimentos. Este endpoint Pro é adequado para cenas complexas em que o movimento coordenado dos sujeitos e a consistência visual são importantes. |
| Kling 1.6 Multi I2V Standard API (Multi Image To Video) | Para gerar múltiplos sujeitos com bom custo-benefício, este endpoint transforma imagens em vídeos equilibrando velocidade e nível de detalhe. É indicado para animações básicas de cenas e produção rotineira de conteúdo com múltiplos sujeitos. |
| Kling 1.6 T2V Standard API (Text To Video) | Os prompts de texto são transformados em vídeos curtos com movimento estável e boa aderência às instruções. Use este endpoint básico para visualização de conceitos, conteúdo para redes sociais e sequências simples orientadas por prompts. |
| Kling 1.6 I2V Pro API (Image To Video) | A partir de uma imagem estática, o endpoint Pro produz vídeos com transições de movimento mais suaves e realismo aprimorado nas texturas. Ele funciona bem para visuais refinados de produtos, cenas com personagens e animação cinematográfica de imagens. |
| Kling 1.6 I2V Standard API (Image To Video) | Escolha este endpoint leve para transformar imagens em vídeos por meio de um fluxo de geração básico. Seu posicionamento de baixo custo o torna adequado para animações simples, testes criativos iniciais e produção em maior volume. |
O Kling 1.6 combina fluxos de trabalho de texto, imagem única e até quatro imagens de referência, com saídas de 5 ou 10 segundos, controle da aderência ao prompt, prompts negativos opcionais, proporções selecionadas e acesso Standard ou Pro por meio de uma única API da Atlas Cloud.
O Kling 1.6 oferece geração de texto para vídeo e imagem para vídeo por meio de variantes dedicadas. Comece com uma cena escrita ou anime uma imagem de origem e, em seguida, oriente a ação com prompts de até 2.500 caracteres. Os modelos Standard priorizam a eficiência de custos, enquanto a variante de imagem Pro enfatiza uma combinação de movimentos mais suave e texturas mais realistas. Essa variedade atende a testes de conceitos, clipes para redes sociais e sequências visuais refinadas.
Envie de uma a quatro imagens de referência com a variante Multi I2V Standard ou Pro. O modelo as utiliza como referências visuais, enquanto um prompt orienta os sujeitos, os movimentos e o desenvolvimento da cena. A versão Pro é ajustada para oferecer maior coerência entre vários sujeitos e rastreamento de movimento mais preciso. Ela é adequada para interações entre personagens, combinações de produtos e cenas que reúnem vários elementos visuais.
Defina uma primeira imagem e uma imagem final opcional com a variante I2V Pro para determinar como o clipe começa e termina. Cada imagem pode estar nos formatos JPG, JPEG ou PNG, ter até 10 MB e pelo menos 300 por 300 pixels. Adicione instruções de movimento entre essas referências visuais. Esse controle é especialmente útil para transições planejadas, mudanças de pose e revelações de produtos.
O movimento suave é um dos principais focos da variante de imagem Pro, com combinação aprimorada e realismo de textura melhorado, conforme registrado em seu perfil da Atlas Cloud. Uma escala de orientação de 0 a 1 ajusta a aderência ao prompt, enquanto os prompts negativos ajudam a evitar elementos indesejados. Use esses controles para equilibrar movimentos naturais e ações rigorosamente direcionadas. Essa combinação é adequada para movimentos exigentes de personagens, tecidos e câmeras.
Escolha saídas de 5 ou 10 segundos em toda a família Kling 1.6. As variantes de texto e de múltiplas imagens também oferecem as proporções 16:9, 9:16 e 1:1, permitindo que um único fluxo de trabalho produza conteúdo para formatos widescreen, vertical ou quadrado. O limite de 2.500 caracteres por prompt deixa espaço para descrever o sujeito, a ação, a iluminação e a direção da câmera. Essas opções ajudam as equipes a planejar materiais específicos para cada plataforma sem trocar de família de modelos.
Execute todas as variantes listadas do Kling 1.6 por meio de uma única API de geração de vídeo da Atlas Cloud, com cobrança conforme o uso. As variantes Standard usam um preço-base original verificado de US$ 0,056 por execução, enquanto as variantes Pro usam US$ 0,098 por execução. Escolha o nível que corresponda ao equilíbrio necessário entre custo, detalhes e qualidade do movimento. Essa configuração viabiliza experimentos rápidos e pipelines de produção sem integrações separadas com provedores.
Veja como o Kling 1.6 e dois modelos de vídeo alternativos interpretam prompts idênticos em cenas de ação realistas e narrativas estilizadas.
Uma sequência cinematográfica de live-action em miniatura, com 8–10 segundos, dentro de uma oficina de sopro de vidro à meia-noite: um jovem artesão gira continuamente um canudo de sopro enquanto uma bolha de vidro branco-incandescente se expande rapidamente, com sua forma perfeitamente redonda ancorando a composição. Comece com uma órbita macro extrema ao redor do vidro fundido em rotação, capturando filamentos âmbar transparentes se esticando, tensão superficial viscosa, tremulação térmica, pequenas faíscas e refração interna realista. A bolha em expansão escapa repentinamente do canudo, atinge a mesa metálica cinza-prateada e começa a rolar rapidamente; desça para um plano de acompanhamento em alta velocidade ao nível da mesa, acompanhando-a enquanto oscila, se deforma, desprende fios incandescentes e reflete a luz azul-cobalto da lua contra o brilho laranja do forno. Faça uma panorâmica rápida até o artesão alarmado, que se lança sobre a bancada e captura o vidro desgovernado com uma pá de madeira molhada no último instante — um chiado explosivo faz o vapor fisicamente preciso rodopiar pelo enquadramento. Quando o vapor se dissipa, revele o vidro milagrosamente congelado na forma de um pequeno baiacu transparente, com delicadas nadadeiras de vidro e bolhas internas consistentes; ele infla suavemente as bochechas uma vez, criando um desfecho divertido. Movimento contínuo e uniforme, transformação coerente do sujeito, viscosidade realista do vidro, colisões, brilho térmico, faíscas, refração, cáusticas, distorção térmica e física do vapor; paleta em camadas de âmbar, azul-cobalto e cinza-prateado; luz principal laranja do forno, luz de recorte azul-fria da lua, profundidade de campo reduzida, produção prática de miniaturas de alto nível com textura tátil, textura cinematográfica fotorrealista, sem câmera lenta, sem preenchimento estático, sem telas, interfaces de software, painéis, barras de progresso, gráficos, legendas, texto, logotipos ou marcas d’água. Áudio sincronizado: forno rugindo, atrito do canudo em rotação, tilintar metálico agudo, chocalho do vidro rolando, uma passada urgente, chiado alto e úmido, seguido por um minúsculo sopro cristalino; ritmo percussivo tenso terminando em um tilintar de vidro caprichoso. Proporção 16:9.
Generated with Kling v1.6 Multi i2v Pro on Atlas Cloud
Generated with Seedance 2.0 Image-to-Video on Atlas Cloud
Generated with Kling v1.6 i2v Standard on Atlas Cloud
Uma micro-história tensa de 9 segundos na apertada cozinha dos fundos de uma loja de noodles de Hong Kong aberta até tarde da noite: um jovem chef resgata urgentemente um pedido de ramen, movendo-se continuamente com uma coreografia precisa e convincente das mãos. Comece com um plano de acompanhamento lateral em ângulo extremamente baixo, deslizando pela tábua de corte coberta de farinha enquanto ele estala os pulsos e lança um longo feixe de noodles bem alto no ar; persiga os fios retorcidos através do vapor denso, com cada noodle se flexionando, se esticando e naturalmente ocultando suas mãos e os utensílios pendurados. Faça uma panorâmica rápida até um ângulo fechado ao lado do fogão, enquanto o feixe de noodles quase cai sobre uma chama de gás; no último instante, ele se lança para a frente e o captura com precisão em uma escumadeira de arame, cuja malha se curva sob o peso, depois gira em um movimento fluido e mergulha os noodles no caldo em ebulição violenta, espalhando gotas, bolhas e ondulações oleosas realistas pela panela. Corte rapidamente para um plano superior visto de cima, enquanto os noodles se desenrolam formando uma espiral organizada e florescente na sopa; através do passa-pratos, os clientes que aguardam se inclinam e irrompem em aplausos encantados enquanto o chef exibe um sorriso ofegante. Mantenha a continuidade exata do mesmo chef, roupas, utensílios, feixe de noodles, geografia da cozinha e movimento em todos os cortes. Encenação em profundidade e enquadramento fechado coordenando constantemente o chef, os noodles, as chamas, as panelas e os utensílios em primeiro plano; camadas táteis de farinha suspensa no ar, reflexos em azulejos molhados, óleo reluzente, condensação e vapor ondulante. Estética fotorrealista do cinema de Hong Kong, energia cinética de câmera na mão, desfoque de movimento natural e nítido, luzes práticas quentes em laranja-tungstênio contrastando com azulejos cerâmicos em ciano-frio, contraste rico, granulação sutil de filme 35 mm, textura realista da pele e dos alimentos. Som sincronizado: batidas da faca contra a tábua, rugido da chama de gás, vapor correndo, clangue da escumadeira, respingos do caldo fervente e, em seguida, uma explosão aguda de aplausos; ritmo percussivo rápido de cozinha, sem diálogos. Sem câmera lenta, poses congeladas, planos gerais vazios, lacunas de montagem, continuidade instável, dedos extras, mãos deformadas, membros duplicados, utensílios quebrados, sobreposição indevida, noodles se teleportando, movimentos borrachudos, comportamento impossível de fluidos, objetos flutuantes, UI, telas, painéis, barras de progresso, gráficos, legendas, subtítulos, logotipos ou texto visível. Proporção 16:9.
Generated with Kling v1.6 Multi i2v Pro on Atlas Cloud
Generated with Seedance 2.0 Image-to-Video on Atlas Cloud
Generated with Kling v1.6 i2v Standard on Atlas Cloud
O Kling 1.6 transforma prompts e imagens de origem em conceitos de vídeos curtos para storyboards, campanhas de produtos, cenas com vários sujeitos, ilustrações animadas, variações para redes sociais e narrativas com personagens.
Transforme conceitos escritos em rascunhos de vídeos curtos com movimento estável e alinhamento confiável com o prompt. Diretores, agências e equipes de produto podem pré-visualizar o ritmo, a ação e a direção visual antes de investir na produção completa.
Anime imagens estáticas de produtos com transições de movimento mais suaves e texturas mais realistas. As equipes de marketing podem transformar imagens de catálogo em clipes de lançamento refinados, revelações de recursos e materiais de campanha sem precisar organizar uma nova sessão fotográfica.
Combine sujeitos de imagens separadas, preservando uma maior coerência da cena e acompanhando os movimentos com precisão. Crie interações entre personagens, momentos com grupos ou narrativas de estilo de vida para conteúdo de marca e campanhas em redes sociais em escala.
Anime obras estáticas com a transição de movimento mais suave e o realismo aprimorado de texturas da variante Pro image-to-video. Artistas e equipes de jogos podem criar conceitos animados, momentos de personagens ou estudos de cenas atmosféricas a partir de imagens existentes.
Comece com um prompt ou uma imagem de origem para produzir conceitos de vídeos curtos com movimento estável ou suavemente combinado. Criadores podem desenvolver múltiplos ganchos, tratamentos visuais e direções de campanha para canais sociais.
Quando vários sujeitos precisam compartilhar uma mesma cena, as variantes Multi priorizam a coerência e o rastreamento avançado de movimento. Use-as para duplas de personagens, interações entre animais de estimação, momentos em grupo ou testes narrativos criados a partir de imagens.
Compare as variantes do Kling 1.6 com outros modelos de vídeo disponíveis no Atlas Cloud em termos de fluxos de entrada, duração dos clipes, áudio nativo e preços padrão.
| Modelo | Fluxo de entrada | Duração da saída | Áudio nativo | Preço padrão |
|---|---|---|---|---|
| Kling v1.6 Multi i2v Pro | Prompt + 1 a 4 imagens | 5 ou 10 segundos | - | $0.098/execução |
| Kling v1.6 Multi i2v Standard | Prompt + 1 a 4 imagens | 5 ou 10 segundos | - | $0.056/execução |
| Kling v1.6 t2v Standard | Prompt de texto | 5 ou 10 segundos | - | $0.056/execução |
| Kling v1.6 i2v Pro | Prompt + frame inicial + frame final opcional | 5 ou 10 segundos | - | $0.098/execução |
| Kling v1.6 i2v Standard | Prompt + frame inicial | 5 ou 10 segundos | - | $0.056/execução |
| Wan-3.0 Image-to-video | Prompt + frame inicial + frame final opcional | 2 a 30 segundos | √ | $0.05/segundo |
| MiniMax H3 Image-to-Video | Prompt + frame inicial + frame final opcional | 4 a 15 segundos | √ | $0.038/segundo |
Comece em minutos — siga estes passos simples para integrar e implantar modelos pela plataforma da Atlas Cloud.
Cadastre-se em atlascloud.ai e conclua a verificação. Novos usuários recebem créditos gratuitos para explorar a plataforma e testar modelos.
Combine modelos avançados de Kling 1.6 com a plataforma acelerada por GPU do Atlas Cloud, fornecendo desempenho, escalabilidade e experiência de desenvolvimento incomparáveis.
Baixa Latência:
Inferência otimizada por GPU para respostas em tempo real.
API Unificada:
Uma única integração para acessar Kling 1.6, GPT, Gemini e DeepSeek.
Preços Transparentes:
Faturamento por Token, suporta modo Serverless.
Experiência do Desenvolvedor:
SDK, análise de dados, ferramentas de ajuste fino e modelos tudo em um.
Confiabilidade:
99.99% de disponibilidade, controle de permissões RBAC, logs de conformidade.
Segurança e Conformidade:
Certificação SOC 2 Type II, conformidade HIPAA, soberania de dados nos EUA.
Kling 1.6 é uma família de modelos de geração de vídeo desenvolvida pela Kuaishou. No Atlas Cloud, ela oferece geração de texto para vídeo, de uma única imagem para vídeo e de várias imagens para vídeo por meio de cinco endpoints Standard e Pro. Suas variantes oferecem movimento estável, fidelidade ao prompt, transições de movimento mais suaves, realismo de textura e coerência entre vários sujeitos.
Transforme prompts de texto em cenas de vídeo originais, anime uma única imagem inicial ou combine várias imagens de referência em uma composição com vários sujeitos. Dependendo do endpoint, você pode gerar clipes com duração de 5 ou 10 segundos.
Escolha T2V Standard para geração orientada por texto e I2V Standard para animação econômica a partir de uma imagem. I2V Pro prioriza transições de movimento mais suaves e texturas mais realistas. Para vários sujeitos ou imagens de referência, selecione Multi I2V Standard ou Multi I2V Pro de acordo com seus requisitos de custo e coerência.
Crie uma chave de API no painel do Atlas Cloud e envie uma solicitação JSON para POST /api/v1/model/generateVideo com seu token Bearer. Inclua o identificador exato do modelo, um prompt e a imagem ou as imagens necessárias para endpoints baseados em imagem. Salve o ID de previsão retornado e use-o para obter o resultado assíncrono.
Todos os endpoints exigem um identificador de modelo e um prompt com até 2.500 caracteres. A geração de texto para vídeo é compatível com proporção de aspecto, duração, escala de orientação e prompts negativos, enquanto os endpoints de uma única imagem exigem uma imagem inicial em JPG, JPEG ou PNG. Os endpoints de várias imagens aceitam de uma a quatro imagens de referência e também oferecem controles de duração, proporção de aspecto e prompt negativo.
Todos os cinco endpoints do Atlas Cloud são compatíveis com geração de 5 ou 10 segundos, sendo 5 segundos o padrão documentado. Os endpoints de texto para vídeo e de várias imagens aceitam 16:9, 9:16 ou 1:1. Os fluxos de trabalho com uma única imagem definem o enquadramento com base na imagem de origem fornecida, em vez de expor o mesmo parâmetro de proporção de aspecto.
Na tabela de preços padrão, os endpoints T2V Standard, I2V Standard e Multi I2V Standard custam $0.056 por segundo de vídeo gerado. I2V Pro e Multi I2V Pro custam $0.098 por segundo de vídeo gerado, com cobrança conforme o uso.
Primeiro, verifique o token Bearer, o identificador exato do modelo, o prompt obrigatório e todos os campos de imagem necessários. Confira o limite documentado de caracteres do prompt, o formato da imagem, o tamanho do arquivo, a resolução, a duração e os intervalos de parâmetros antes de reenviar uma solicitação inválida. Como a geração é assíncrona, mantenha o ID de previsão e continue consultando o endpoint de resultados enquanto o status estiver processing.
Guias, tutoriais e novidades de produto para você aproveitar ao máximo a Atlas Cloud.