
Kling O1 är Kuaishous videomodellfamilj, byggd med multimodal visuell språkmodellsteknik. Arbetsflödena för text-till-video och bild-till-video kopplar samman språklig och visuell kontext för att skapa sömlösa scenförlopp utifrån prompts eller källbilder. Atlas Cloud tillhandahåller båda lägena via ett färdigt REST API utan cold starts och med transparent pay-as-you-go-prissättning. Börja bygga idag.
Kling o1 är utvecklad av Kuaishou. Atlas Cloud (som drivs av Atlas Cloud AI LLC) tillhandahåller åtkomst till modellen men äger den inte. Alla varumärken tillhör sina respektive ägare.
Jämför Kling O1:s text- och bildarbetsflöden för att välja rätt videogenereringsendpoint för ditt projekt.
| Modalitet | Beskrivning |
|---|---|
| Kling O1 T2V API (Text To Video) | Förvandla textprompter till filmiska videor med Kling O1 Text to Video-endpointen. MVL-tekniken stöder exakt semantisk förståelse, konsekventa motiv och naturlig fysiksimulering. Använd den för berättelsekoncept, produktnarrativ och scener som regisseras med text. |
| Kling O1 I2V API (Image To Video) | Med utgångspunkt i en stillbild skapar Kling O1 Image to Video-endpointen en dynamisk, filmisk video. Den bevarar motivets konsekvens samtidigt som den lägger till naturliga rörelser, fysiksimulering och sömlös scendynamik. Detta arbetsflöde passar för bildanimering, visuellt berättande och utveckling av filmiska scener. |
Kling O1 kombinerar text-till-video- och bild-till-video-generering med konsekvent motividentitet, naturlig fysik, exakt promptförståelse, kontroll över första och sista bildrutan, flexibla tidslängder på 5 eller 10 sekunder, tre bildformat och färdig Atlas Cloud REST-åtkomst till transparenta, användningsbaserade priser.
Kling O1 omvandlar textprompter eller en källbild till filmisk video via Atlas Clouds dedikerade text-to-video- och image-to-video-endpoints. MVL-arkitekturen tolkar scenens avsikt utifrån både språkliga och visuella indata. Välj det läge som passar ditt startmaterial utan att ändra den underliggande modellfamiljen. Denna flexibilitet passar team som går från tidiga koncept till animerade kampanj- eller berättelsescener.
Modellen håller motiven igenkännliga medan handlingen utvecklas, även när kameran rör sig och scenen förändras. Bild-till-video-generering för källbildens visuella identitet vidare in i rörelsen, medan text-till-video bygger sammanhängande figurer utifrån prompten. Stabil motividentitet minskar distraherande skiftningar mellan bildrutor. Använd denna styrka för karaktärsdrivna berättelser, produktbilder och sekvenser där visuell kontinuitet är viktig.
Naturlig fysiksimulering ger rörelsen tyngd, rörelsemängd och trovärdiga interaktioner med den omgivande scenen. Kling O1 animerar människor, objekt och miljöelement med dynamik som känns sammanhängande i stället för påklistrad. Kombinera uttryckliga handlingsanvisningar med kamerainstruktioner i prompten. Resultatet passar sport-, mat-, natur- och actionmaterial där rörelsekvaliteten bär upp bilden.
Börja med en bild eller ange en valfri sista bild för att definiera var rörelsen ska avslutas. Atlas Clouds image-to-video-schema stöder klipp på 5 eller 10 sekunder, vilket ger tydliga val för tempo i både korta sekvenser och längre övergångar. Modellen syntetiserar rörelsen mellan visuella tillstånd under promptens vägledning. Denna kontroll passar särskilt bra för produktpresentationer, förvandlingar och kompakta berättelseförlopp.
Exakt semantisk förståelse gör att Kling O1 kan omvandla detaljerade prompter till motiv, handlingar, scenförlopp och filmiska kamerarörelser. Ange bildutsnittet med utdata i 16:9, 9:16 eller 1:1 och beskriv sedan rörelse och stämning på naturligt språk. Komplex regi blir en strukturerad genereringsförfrågan i stället för manuell animering. Det gör modellen användbar för sociala klipp, storyboards och genomarbetade visuella koncept.
Bygg med Atlas Clouds enhetliga REST API för både text-till-video- och bild-till-video-generering. Atlas Cloud har inga kallstarter och tar ut standardpriset $0.112 per utdatasekund, baserat på den genererade videolängden. Skicka in prompter, källbildrutor, tidslängd och bildformat som strukturerade parametrar. Denna lösning ger utvecklare förutsägbara kostnader och direkt integration för produktionsklara videoflöden.
Se hur Kling O1, Seedance 2.0 och Kling V3.0 Turbo tolkar samma två promptar utifrån filmisk realism, rörelsekontinuitet, fysisk interaktion och stiliserat berättande.
Skapa en 10 sekunder lång fotorealistisk filmisk video av en golden retriever som bär en bukett genom en fullsatt blomstermarknad i gryningen. Börja med en följningsbild från låg vinkel när hunden rusar över våta kullerstenar, sprider blomblad och väjer mellan rörliga vagnar. Gör en snabb panorering till blomsterförsäljaren som jagar efter bakifrån, och cirkla sedan runt hunden när den hoppar över en vält korg och landar naturligt. Avsluta med en snabb inåkning när hunden stannar bredvid ett barn, erbjuder buketten och den skrattande försäljaren hinner ikapp. Varmt motljus, realistisk fysik för päls, tyg och blomblad, kontinuerlig energisk rörelse, bildformat 16:9.
Generated with Kling Video O1 Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Skapa en 8 sekunder lång stiliserad leranimerad stop motion-video inne i ett månupplyst bageri där en liten rävkock tillagar ett magiskt bakverk. Inled med en överliggande kranbild när räven snurrar degen, kastar bär och väjer för studsande köksredskap. Klipp till en följningsbild över köksbänken medan bakverket rusar in i ugnen och börjar glöda. Cirkla snabbt runt räven när ugnen öppnas med en smäll och en liten bakverksdrake flyger ut, gör loopar genom svävande mjöl och landar på kockens hatt. Handgjorda lertexturer, uttrycksfulla rörelser, lekfull blå och bärnstensfärgad belysning, sömlös rörelsekontinuitet, bildformat 16:9.
Generated with Kling Video O1 Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Från promptstyrda filmiska koncept till animerade produktbilder erbjuder Kling O1 filmskapare, marknadsförare, e-handelsteam och apputvecklare praktiska vägar från text eller stillbilder till konsekvent, fysikmedveten video.
Förvandla detaljerade promptar till filmiska sekvenser med exakt semantisk förståelse och naturlig fysik. Filmskapare och förvisualiseringsteam kan utforska stämning, handling och kameravinklar innan de lägger resurser på kostsam liveinspelning.
Animera en statisk produktbild samtidigt som motivet bevaras och sömlös scenisk dynamik tillförs. E-handelsteam kan förvandla katalogbilder till polerat rörligt material för lanseringar, webbutiker och kampanjer.
Börja med ett skriftligt koncept och generera sedan filmiska videor vars rörelser följer naturlig fysik. Sociala medier-team får nya visuella riktningar för annonseringar, säsongskampanjer och snabb kanalspecifik kreativ testning.
Översätt narrativa promptar till sammanhängande rörliga scener genom exakt semantisk förståelse. Regissörer, byråer och spelstudior kan visualisera karaktärers handlingar, miljörörelser och filmisk atmosfär under den tidiga kreativa utvecklingen och planeringen.
Ge ett stilla porträtt naturliga rörelser samtidigt som Kling O1:s bildläge bevarar motivets konsekvens. Kreatörer kan skapa uttrycksfulla profilvideor, karaktärspresentationer och material för visuellt berättande från befintliga illustrationer.
När en prompt beskriver komplexa rörelser tillämpar Kling O1 naturlig fysiksimulering och exakt semantisk förståelse. Actiondesigners och konceptteam kan förhandsgranska dynamiska scener med trovärdiga rörelser innan produktionen börjar.
Jämför Kling O1 med andra Atlas Cloud-videomodeller efter leverantör, genereringsläge, modell-ID och angivet katalogpris.
| Modell | Leverantör | Genereringsläge | Atlas-modell-ID | Angivet grundpris |
|---|---|---|---|---|
| Kling Video O1 Text-to-video | Kuaishou | Text till video | kwaivgi/kling-video-o1/text-to-video | $0.112, enhet ej angiven |
| Kling Video O1 Image-to-video | Kuaishou | Bild till video | kwaivgi/kling-video-o1/image-to-video | $0.112, enhet ej angiven |
| Seedance 2.0 Text-to-Video | ByteDance | Text till video | bytedance/seedance-2.0/text-to-video | $0.112, enhet ej angiven |
| Wan-2.7 Image-to-video | Qwen | Bild till video | alibaba/wan-2.7/image-to-video | $0.10, enhet ej angiven |
| Veo 3.1 Lite Text-to-video | Text till video | google/veo3.1-lite/text-to-video | $0.05, enhet ej angiven | |
| MiniMax H3 Image-to-Video | MiniMax | Bild till video | minimax/h3/image-to-video | $0.038 per sekund |
Get started in minutes — follow these simple steps to integrate and deploy models through Atlas Cloud’s platform.
Registrera dig på atlascloud.ai och slutför verifieringen. Nya användare får gratis krediter för att utforska plattformen och testa modeller.
Att kombinera de avancerade Kling o1-modellerna med Atlas Clouds GPU-accelererade plattform ger oöverträffad prestanda, skalbarhet och utvecklarupplevelse.
Låg Latens:
GPU-optimerad inferens för realtidsresonemang.
Enhetligt API:
Kör Kling o1, GPT, Gemini och DeepSeek med en integration.
Transparent Prissättning:
Förutsägbar fakturering per token med serverlösa alternativ.
Utvecklarupplevelse:
SDK:er, analys, finjusteringsverktyg och mallar.
Tillförlitlighet:
99.99% drifttid, RBAC och efterlevnadsredo loggning.
Säkerhet & Efterlevnad:
SOC 2 Type II, HIPAA-anpassning, datasuveränitet i USA.
Kling O1 är Kuaishous enhetliga multimodala videomodell, byggd med teknik för multimodalt visuellt språk. På Atlas Cloud omfattar den verifierade modellfamiljen endpoints för text-till-video och bild-till-video. Den fokuserar på semantisk promptförståelse, konsekvent motivåtergivning och naturlig fysiksimulering.
Använd text-till-video för att omvandla skrivna scenanvisningar till filmiska klipp, eller animera en källbild med bild-till-video-läget. Båda endpointsen stöder arbetsflöden som drar nytta av konsekventa motiv, kontrollerade rörelser och realistisk scendynamik.
Välj text-till-video när projektet börjar med en skriven scenbeskrivning. Välj bild-till-video när en befintlig bild ska fastställa motivet, kompositionen eller den första bildrutan innan rörelse läggs till.
Skicka en autentiserad POST-begäran till https://api.atlascloud.ai/api/v1/model/generateVideo med valt modell-ID och indata. Använd kwaivgi/kling-video-o1/text-to-video eller kwaivgi/kling-video-o1/image-to-video och hämta sedan resultatet med det returnerade prediktions-ID:t.
För text-till-video anger du en prompt och använder de dokumenterade kontrollerna för bildförhållande och varaktighet. Bild-till-video kräver prompt och bild, medan last_image är valfritt. De verifierade bildförhållandena är 16:9, 9:16 och 1:1, med varaktigheter på 5 eller 10 sekunder.
Atlas Cloud anger ett standardpris på $0.112 per sekund för båda verifierade video-endpointsen. Debiteringen skalar med den begärda utmatningens varaktighet, så en 10 sekunder lång generering kostar dubbelt så mycket som en 5 sekunder lång generering enligt standardpriset.
Genereringen börjar med en POST-begäran som returnerar ett prediktions-ID och en bearbetningsstatus. Fråga https://api.atlascloud.ai/api/v1/model/prediction/{prediction_id} upprepade gånger tills uppgiften slutförs eller misslyckas. Vid ett lyckat svar placeras URL:en till den genererade videon i outputs-arrayen.
Motivets konsekvens är en dokumenterad funktion i båda de tillgängliga lägena, och bild-till-video använder källbilden för att förankra visuell identitet och komposition. Resultaten kan fortfarande variera beroende på indatakvalitet och promptens komplexitet, så tydliga källbilder och uttryckliga rörelseanvisningar rekommenderas.
Inte bland de två Atlas Cloud-endpoints som har verifierats för den här familjesidan. Det aktuella urvalet omfattar text-till-video och bild-till-video, så Elements, referensvideo och redigeringsparametrar bör inte skickas in om inte Atlas Cloud publicerar en kompatibel endpoint och ett kompatibelt schema.
Guider, handledningar och produktnyheter som hjälper dig att få ut mesta möjliga av Atlas Cloud.