Kling 1.6 Multi-Image Subject Consistency

Kling 1.6 Multi-Image Subject Consistency

Kling 1.6 är Kuaishous videogenereringsmodell, utvecklad för att omvandla promptar och referensbilder till sammanhängande korta videor. Den förbättrar responsen på rörelser, tidsmässiga händelser och kamerarörelser, samtidigt som den stärker motivets konsekvens, färgåtergivning, ljusdynamik och detaljrika rendering. Få åtkomst till modellfamiljen via Atlas Cloud med en enda OpenAI-kompatibel nyckel och transparent prissättning enligt användning. Börja bygga redan idag.

Kling 1.6 är utvecklad av Kuaishou. Atlas Cloud (som drivs av Atlas Cloud AI LLC) tillhandahåller åtkomst till modellen men äger den inte. Alla varumärken tillhör sina respektive ägare.

Jämför Kling 1.6-endpoints efter videomodalitet

Se hur varje Kling 1.6-endpoint hanterar text- eller bildindata och var dess verifierade styrkor inom rörelse, koherens, detaljrikedom och effektivitet kommer till sin rätt.

ModalitetBeskrivning
Kling 1.6 Multi I2V Pro API (Multi Image To Video)Omvandla bilder till video med flera motiv, förbättrad koherens och avancerad precision i rörelsespårningen. Denna Pro-endpoint passar komplexa scener där samordnade motivrörelser och visuell konsekvens är viktiga.
Kling 1.6 Multi I2V Standard API (Multi Image To Video)För kostnadseffektiv generering med flera motiv omvandlar denna endpoint bilder till video samtidigt som den balanserar hastighet och detaljrikedom. Den passar för enkel scenanimering och återkommande innehållsproduktion med flera motiv.
Kling 1.6 T2V Standard API (Text To Video)Textprompter blir korta videor med stabil rörelse och tillförlitlig överensstämmelse med prompten. Använd denna endpoint på instegsnivå för visualisering av koncept, innehåll för sociala medier och enkla promptstyrda sekvenser.
Kling 1.6 I2V Pro API (Image To Video)Med utgångspunkt i en stillbild skapar Pro-endpointen video med mjukare rörelseövergångar och förbättrad texturrealism. Den fungerar väl för polerade produktbilder, karaktärsbilder och filmisk bildanimering.
Kling 1.6 I2V Standard API (Image To Video)Välj denna lättviktiga endpoint för att omvandla bilder till video genom ett grundläggande genereringsflöde. Den låga kostnadsnivån gör den lämplig för enkla animationer, tidiga kreativa tester och produktion i större volymer.

Kling 1.6 direkt från prompt till rörelse

Kling 1.6 kombinerar arbetsflöden för text, enstaka bilder och upp till fyra bildreferenser, med utdata på 5 eller 10 sekunder, styrbar följsamhet mot prompten, valfria negativa promptar, utvalda bildformat samt Standard- eller Pro-åtkomst via ett enda Atlas Cloud API.

Kling 1.6 från text eller bild

Kling 1.6 stöder generering från text till video och från bild till video genom dedikerade varianter. Börja med en beskriven scen eller animera en källbild och styr sedan händelseförloppet med promptar på upp till 2 500 tecken. Standard-modellerna prioriterar kostnadseffektivitet, medan Pro-bildvarianten fokuserar på mjukare rörelseövergångar och mer realistiska texturer. Det här spannet passar koncepttestning, klipp för sociala medier och genomarbetade visuella sekvenser.

Fyra referensbilder

Ladda upp mellan en och fyra referensbilder med varianten Multi I2V Standard eller Pro. Modellen använder dem som visuella referenser medan en prompt styr motiv, rörelser och scenens utveckling. Pro är optimerad för bättre samstämmighet mellan flera motiv och mer exakt rörelsespårning. Den passar för karaktärsinteraktioner, produktkombinationer och scener där flera visuella element förs samman.

Kontroll över första och sista bildrutan

Ange både en första bild och en valfri slutbild med varianten I2V Pro för att forma var ett klipp börjar och slutar. Varje bild kan vara JPG, JPEG eller PNG, på upp till 10 MB och minst 300 gånger 300 pixlar. Lägg till rörelseinstruktioner mellan dessa visuella ankare. Den här kontrollen är särskilt användbar för planerade övergångar, ändringar av poser och produktpresentationer.

Kling 1.6-rörelse med styrning

Mjuk rörelse är ett centralt fokus för Pro-bildvarianten, med förbättrad blandning och bättre texturrealism enligt dess Atlas Cloud-profil. En vägledningsskala från 0 till 1 justerar följsamheten mot prompten, medan negativa promptar hjälper till att undvika oönskade element. Använd dessa kontroller för att balansera naturliga rörelser mot strikt styrda handlingar. Kombinationen passar krävande arbete med karaktärer, tyg och kamerarörelser.

Längder och format som passar

Välj utdata på 5 eller 10 sekunder i hela Kling 1.6-familjen. Text- och multibildvarianterna erbjuder även bildformaten 16:9, 9:16 och 1:1, så att ett och samma arbetsflöde kan användas för liggande, stående eller kvadratiska placeringar. En gräns på 2 500 tecken för prompten ger utrymme för motiv, handling, ljussättning och kamerastyrning. Dessa alternativ hjälper team att planera plattformsspecifika tillgångar utan att byta modellfamilj.

Kling 1.6-nivåer via ett enda API

Kör alla listade Kling 1.6-varianter via ett enda Atlas Cloud API för videogenerering med betalning efter användning. Standard-varianter använder ett verifierat ursprungligt baspris på $0.056 per körning, medan Pro-varianter använder $0.098 per körning. Välj den nivå som motsvarar den önskade balansen mellan kostnad, detaljrikedom och rörelsekvalitet. Den här lösningen stöder snabba experiment och produktionspipelines utan separata leverantörsintegrationer.

Kling 1.6 under en enda prompt: tre videomodeller jämförda

Se hur Kling 1.6 och två alternativa videomodeller tolkar identiska prompter i realistisk action och stiliserat berättande.

Prompt

En filmisk 8–10 sekunder lång miniatyrsekvens i live-action inne i en glasblåsarverkstad vid midnatt: en ung hantverkare roterar oavbrutet ett blåsrör medan en vitglödande glasbubbla snabbt expanderar, vars perfekt runda form förankrar bildkompositionen. Börja med en extrem makroåkning i en bana runt det snurrande smälta glaset och fånga transparenta bärnstensfärgade trådar som sträcks ut, viskös ytspänning, värmedaller, små gnistor och realistisk intern ljusbrytning. Den svällande bubblan glider plötsligt av röret, slår i det silvergrå metallbordet och rullar snabbt; växla ner till en höghastighetsbild på bordsnivå som följer den medan den vinglar, deformeras, avger glödande trådar och reflekterar koboltblått månsken mot det ugnsorange skenet. Gör en snabb panorering till den skräckslagna hantverkaren som kastar sig över arbetsbänken och fångar det skenande glaset med en våt träpaddel i sista ögonblicket – ett explosivt fräsande skickar fysikaliskt korrekta ångvirvlar genom bilden. När ångan skingras avslöjas glaset mirakulöst förvandlat till en liten transparent blåsfisk med skira glasfenor och jämna inre bubblor; den blåser upp kinderna en gång, som ett lekfullt avslutande ögonblick. Sömlös kontinuerlig rörelse, sammanhängande förvandling av motivet, realistisk glasviskositet, kollisioner, termiskt sken, gnistor, ljusbrytning, kaustik, värmeförvrängning och ångfysik; lager på lager av bärnstensgult, koboltblått och silvergrått; orange huvudljus från ugnen, kallt månblått kantljus, kort skärpedjup, taktil påkostad praktisk miniatyrfilmning, fotorealistisk filmisk textur, ingen slow motion, ingen statisk utfyllnad, inga skärmar, programvarugränssnitt, instrumentpaneler, förloppsindikatorer, diagram, bildtexter, text, logotyper eller vattenstämplar. Synkroniserat ljud: dånande ugn, skrapljud från det roterande röret, skarpt metalliskt klirr, rassel från rullande glas, snabba fotsteg, högt vått fräsande och därefter ett litet kristallint puff; spänd perkussiv rytm som avslutas med ett lekfullt glaskling. Bildformat 16:9.

Generated with Kling v1.6 Multi i2v Pro on Atlas Cloud

Generated with Seedance 2.0 Image-to-Video on Atlas Cloud

Generated with Kling v1.6 i2v Standard on Atlas Cloud

Prompt

En spänd 9 sekunder lång mikroberättelse i köket längst bak i en nudelrestaurang i Hongkong sent på kvällen: en ung kock skyndar sig att rädda en ramenbeställning och rör sig oavbrutet med exakt, trovärdig handkoreografi. Börja med en extrem lateral följningsbild från låg vinkel som sveper tätt över den mjöldammiga skärbrädan medan han knäpper till med handlederna och kastar ett långt knippe nudlar högt upp i luften; följ de tvinnade trådarna genom tät ånga, där enskilda nudlar böjs, sträcks och naturligt skymmer hans händer och hängande köksredskap. Gör en snabb panorering till en tät vinkel från spisen när nudelknippet nästan faller ner i en slickande gaslåga; i sista ögonblicket kastar han sig fram och fångar det rent i en trådsil, vars nät böjs under vikten, svänger sedan runt i en enda flytande rörelse och sänker ner nudlarna i häftigt kokande buljong, vilket skickar realistiska droppar, bubblor och oljiga krusningar över kastrullen. Klipp snabbt till en översiktsbild rakt uppifrån när nudlarna vecklar ut sig till en prydlig blommande spiral i soppan; genom serveringsluckan lutar sig väntande gäster fram och brister ut i förtjusta applåder medan kocken visar ett andfått leende. Bevara exakt kontinuitet för samma kock, kläder, redskap, nudelknippe, köksgeografi och rörelse genom varje klipp. Tät scenografi med stort djup samordnar hela tiden kocken, nudlarna, lågorna, kastrullerna och redskapen i förgrunden; taktila lager av luftburet mjöl, våta kakelreflexer, glittrande olja, kondens och rullande ånga. Fotorealistisk Hongkong-filmestetik, handhållen kinetisk energi, skarp naturlig rörelseoskärpa, varma volframorange praktiska ljus som kontrasterar mot kalla cyanblå keramikkakel, rik kontrast, subtilt 35mm-filmkorn, realistisk hud- och mattextur. Synkroniserat ljud: klapper från kniv mot skärbräda, dånande gaslåga, forsande ånga, klang från trådsilen, stänk från kokande buljong och därefter en skarp applådexplosion; snabb perkussiv köksrytm, ingen dialog. Ingen slow motion, inga frusna poser, inga tomma etableringsbilder, inga luckor i montaget, ingen ryckig kontinuitet, inga extra fingrar, inga missformade händer, inga dubblerade lemmar, inga trasiga redskap, inget clipping, inga teleporterande nudlar, ingen gummiartad rörelse, inget omöjligt vätskebeteende, inga svävande objekt, inget UI, inga skärmar, instrumentpaneler, förloppsindikatorer, diagram, bildtexter, undertexter, logotyper eller synlig text. Bildformat 16:9.

Generated with Kling v1.6 Multi i2v Pro on Atlas Cloud

Generated with Seedance 2.0 Image-to-Video on Atlas Cloud

Generated with Kling v1.6 i2v Standard on Atlas Cloud

Där Kling 1.6 förvandlar idéer till rörelse

Kling 1.6 omvandlar prompts och källbilder till korta videokoncept för storyboards, produktkampanjer, scener med flera motiv, animerade illustrationer, sociala medievarianter och karaktärsberättelser.

Storyboard-prototyper med Kling 1.6

Förvandla skrivna koncept till korta videoutkast med stabil rörelse och god överensstämmelse med prompten. Regissörer, byråer och produktteam kan förhandsgranska tempo, handling och visuell riktning innan de satsar på fullskalig produktion.

Produktanimation med Kling 1.6

Animera produktbilder med mjukare rörelseövergångar och mer realistiska texturer. Marknadsteam kan omvandla katalogbilder till polerade lanseringsklipp, funktionspresentationer och kampanjmaterial utan att behöva ordna en ny fotografering.

Varumärkesberättelser med flera motiv

Kombinera motiv från separata bilder samtidigt som du bevarar en starkare scenkoherens och spårar deras rörelser korrekt. Skapa karaktärsinteraktioner, gruppscener eller livsstilsberättelser för varumärkesinnehåll och sociala kampanjer i stor skala.

Animering av illustrationer

Animera statiska konstverk med Pro image-to-video-variantens mjukare rörelseövergångar och förbättrade texturrealism. Konstnärer och spelteam kan skapa animerade koncept, karaktärssekvenser eller atmosfäriska scenstudier från befintligt visuellt material.

Kling 1.6-videovarianter för sociala medier

Börja med en prompt eller källbild för att skapa korta videokoncept med stabil rörelse eller mjukare rörelseövergångar. Kreatörer kan utveckla flera öppningar, visuella uttryck och kampanjinriktningar för sociala kanaler.

Klipp med karaktärsinteraktioner

När flera motiv måste dela samma scen prioriterar Multi-varianterna koherens och avancerad rörelsespårning. Använd dem för karaktärspar, interaktioner mellan husdjur, gruppscener eller narrativa tester som bygger på bilder.

Jämförelse av Kling 1.6-modeller och konkurrenter

Jämför Kling 1.6-varianter med andra videomodeller som finns tillgängliga på Atlas Cloud utifrån indataflöden, klippens längd, inbyggt ljud och standardpriser.

ModellIndataflödeUtdata­längdInbyggt ljudStandardpris
Kling v1.6 Multi i2v ProPrompt + 1 till 4 bilder5 eller 10 sekunder-$0.098/körning
Kling v1.6 Multi i2v StandardPrompt + 1 till 4 bilder5 eller 10 sekunder-$0.056/körning
Kling v1.6 t2v StandardTextprompt5 eller 10 sekunder-$0.056/körning
Kling v1.6 i2v ProPrompt + startbild + valfri slutbild5 eller 10 sekunder-$0.098/körning
Kling v1.6 i2v StandardPrompt + startbild5 eller 10 sekunder-$0.056/körning
Wan-3.0 Image-to-videoPrompt + startbild + valfri slutbild2 till 30 sekunder√$0.05/sekund
MiniMax H3 Image-to-VideoPrompt + startbild + valfri slutbild4 till 15 sekunder√$0.038/sekund

Hur man använder Kling 1.6 på Atlas Cloud

Get started in minutes — follow these simple steps to integrate and deploy models through Atlas Cloud’s platform.

Skapa ett Atlas Cloud-konto

Registrera dig på atlascloud.ai och slutför verifieringen. Nya användare får gratis krediter för att utforska plattformen och testa modeller.

Varför Använda Kling 1.6 på Atlas Cloud

Att kombinera de avancerade Kling 1.6-modellerna med Atlas Clouds GPU-accelererade plattform ger oöverträffad prestanda, skalbarhet och utvecklarupplevelse.

Prestanda & flexibilitet

Låg Latens:
GPU-optimerad inferens för realtidsresonemang.

Enhetligt API:
Kör Kling 1.6, GPT, Gemini och DeepSeek med en integration.

Transparent Prissättning:
Förutsägbar fakturering per token med serverlösa alternativ.

Företag & Skala

Utvecklarupplevelse:
SDK:er, analys, finjusteringsverktyg och mallar.

Tillförlitlighet:
99.99% drifttid, RBAC och efterlevnadsredo loggning.

Säkerhet & Efterlevnad:
SOC 2 Type II, HIPAA-anpassning, datasuveränitet i USA.

Kling 1.6 API-frågor för utvecklare

Kling 1.6 är en familj av videogenereringsmodeller som utvecklats av Kuaishou. På Atlas Cloud omfattar den text till video, en bild till video och flera bilder till video via fem Standard- och Pro-endpoints. Varianterna erbjuder stabila rörelser, god promptöverensstämmelse, mjukare rörelseövergångar, realistiska texturer och samstämmighet mellan flera motiv.

Förvandla textprompter till originella videoscener, animera en enskild startbild eller kombinera flera referensbilder i en komposition med flera motiv. Beroende på endpoint kan du generera klipp på 5 eller 10 sekunder.

Välj T2V Standard för textstyrd generering och I2V Standard för kostnadseffektiv animering från en bild. I2V Pro prioriterar mjukare rörelseövergångar och mer realistiska texturer. För flera motiv eller referensbilder väljer du Multi I2V Standard eller Multi I2V Pro utifrån dina krav på kostnad och samstämmighet.

Skapa en API-nyckel i Atlas Cloud-instrumentpanelen och skicka sedan en JSON-begäran till POST /api/v1/model/generateVideo med din Bearer-token. Inkludera den exakta modellidentifieraren, en prompt och de obligatoriska bilderna för bildbaserade endpoints. Spara det returnerade prediktions-ID:t och använd det för att hämta det asynkrona resultatet.

Varje endpoint kräver en modellidentifierare och en prompt på högst 2,500 tecken. Text till video stöder bildförhållande, varaktighet, guidance scale och negativa prompter, medan endpoints för enskilda bilder kräver en JPG-, JPEG- eller PNG-startbild. Endpoints för flera bilder tar emot en till fyra referensbilder och erbjuder även inställningar för varaktighet, bildförhållande och negativ prompt.

Alla fem Atlas Cloud-endpoints stöder generering på 5 eller 10 sekunder, där 5 sekunder är det dokumenterade standardvärdet. Text till video- och endpoints för flera bilder accepterar 16:9, 9:16 eller 1:1. Arbetsflöden med en enskild bild hämtar bildutsnittet från den angivna källbilden i stället för att exponera samma parameter för bildförhållande.

Vid standardiserad listprissättning kostar T2V Standard, I2V Standard och Multi I2V Standard $0.056 per genererad videosekund. I2V Pro och Multi I2V Pro kostar $0.098 per genererad videosekund, med användningsbaserad fakturering.

Kontrollera först Bearer-token, den exakta modellidentifieraren, den obligatoriska prompten och eventuella obligatoriska bildfält. Kontrollera den dokumenterade promptlängden, bildformatet, filstorleken, upplösningen, varaktigheten och parameterintervallen innan du skickar om en ogiltig begäran. Eftersom genereringen sker asynkront bör du spara prediktions-ID:t och fortsätta fråga resultat-endpointen medan statusen är processing.

Utforska Fler Familjer

Seedance 2.5

Seedance 2.5 API är nu tillgängligt på Atlas Cloud! Det ger utvecklare ByteDances nyaste videomodell. Den genererar upp till 30 sekunder inbyggd video i en enda körning från text, en enskild bild eller upp till 50 multimodala referenser, med synkroniserat ljud och flerspråkig text i bildrutan. På Atlas Cloud når du den genom en enda nyckel, med motivkonsekvens och förbättrad fysik som håller långa tagningar sammanhängande.

Visa Familj

Wan 3.0

Wan 3.0 API är nästa generation av Alibabas Wan-videofamilj, byggd för att ta långformatsgenerering, multireferenskontroll och audiovisuell kvalitet till nya höjder. Atlas Cloud är redan värd för Wan 2.7, 2.6 och 2.5, och Wan 3.0 körs på samma enhetliga nyckel utan separat konfiguration. Börja bygga idag. Rulla ner till uppvisningen för att se vad Wan 3.0 kan skapa.

Visa Familj

MiniMax H3

MiniMax H3 är MiniMax multimodala videofamilj för att skapa med text, bilder och referenser. Via de rutter som stöds bevarar den motiv från referensmedia, erbjuder flexibla bildformat och kombinerar genererat ljud med bild genom H3 Developer, med utdataprofiler som väljs per endpoint. Atlas Cloud samlar hela familjen bakom en enda OpenAI-kompatibel nyckel, med transparent användningsbaserad prissättning från standardpriset $0.038 per sekund. Börja bygga redan idag.

Visa Familj

Seedream 5.0 Pro

Seedream 5.0 Pro API ger utvecklare ByteDances kontrollerbara bildredigeringsmodell på Atlas Cloud. Den placerar redigeringar exakt med ankare och koordinater, separerar bilder i redigerbara lager, slår samman flera referenser och matchar exakta färger och material, med flerspråkig text i 2K och 3K. På Atlas Cloud når du den via en enda nyckel!

Visa Familj

Seedance 2.0

Seedance 2.0 är ByteDance:s produktionsmodell för video och möjliggör exakt skapande av videoklipp. Omvandla prompts till video, animera en bild för första bildrutan med valfri vägledning från sista bildrutan eller forma resultaten med referensmedia och valfri webbsökning. Atlas Cloud samlar dessa arbetsflöden i ett enhetligt API med transparent prissättning enligt användning och en OpenAI-kompatibel nyckel. Börja bygga idag.

Visa Familj

GPT Image 2.5

gpt-image-2.5-familjen från OpenAI ger utvecklare möjlighet att välja mellan Flare och Sunburst för produktionsarbetsflöden för bilder. Rendera med valfria upplösningar upp till 3840x2160 och välj mellan fem kvalitetsnivåer, däribland xhigh och max, för att uppfylla specifika krav på utdata. Atlas Cloud erbjuder färdig REST-inferens utan cold starts och med standardpriser från $0.004 per generering. Börja bygga idag.

Visa Familj

GPT Image 2

GPT Image 2 API ger utvecklare tillgång till OpenAI:s senaste bildmodell, uppföljaren till GPT Image 1.5. Den genererar och redigerar bilder med exakt textåtergivning i latinska och CJK-tecken, plus en stark komposition för affischer, mockups och infografik. På Atlas Cloud når du den via ett enhetligt API tillsammans med över 300 modeller, med gratis krediter, 99,99 % upptid och utan krav på OpenAI-organisationsverifiering.

Visa Familj

Gemini Omni Flash

gemini omni API ger utvecklare tillgång till Google DeepMinds nativt multimodala Gemini Omni Flash-familj, inklusive Gemini Omni 1.1 Flash. Skapa filmiska videor med synkroniserat inbyggt ljud, animera stillbilder med exakt kontroll över start- och slutbild eller redigera befintligt videomaterial med textstyrda ändringar som bevarar innehåll som inte berörs. Atlas Cloud erbjuder en OpenAI-kompatibel nyckel, samlad åtkomst och transparent prissättning med betalning efter användning. Börja bygga redan i dag.

Visa Familj

Grok Imagine

Grok Imagine API täcker xAI:s bild-, video- och talmodeller – från Image 2.0 till Video 1.5 och xAI TTS v1. Rendera 1K eller 2K stillbilder över 14 bildformat, skapa upp till 15 sekunders 1080p-video, styr resultatet med upp till 7 referensbilder, eller lägg till röst på 20 språk. Atlas Cloud kör alla lägen på en enda slutpunkt, prissatt per användning från $0.02 per bild och $0.05 per sekund. Börja bygga idag.

Visa Familj

Google

Googles mest kraftfulla kreativa modeller är alla tillgängliga på Atlas Cloud. Veo 3.1 levererar filmisk videogenerering, Nano Banana 2 driver skapandet av högupplösta bilder, och Gemini tillför multimodal intelligens till varje arbetsflöde. Få tillgång till hela Googles modellsvit via en enda API key med Day-0-tillgänglighet och pay-as-you-go-prissättning.

Visa Familj

Seedance 2.0 Mini

Seedance 2.0 Mini tar ByteDances multimodala videogenerering till arbetsflöden där hastighet och kostnad är avgörande. Det levererar kärnfunktionerna i Seedance 2.0 med ett lättare fotavtryck – snabbare generering, lägre kostnad per video och samma API-integration som du redan använder. För team som kör pipelines med hög volym eller gör prototyper i stor skala är Mini den praktiska standarden.

Visa Familj

ByteDance

Från filmisk videogenerering till skapande av högupplösta bilder, ByteDances kraftfullaste modeller är live på Atlas Cloud. Kör Seedance och Seedream i stor skala med de lägsta inferenspriserna och noll infrastrukturkostnader.

Visa Familj

Ett API för all media-AI.

Utforska alla modeller