Seedance 2.0 Mini & Fast API till världens lägsta priser — upp till 68 % rabatt på det officiella priset
Grok Imagine Video 1.5 Motion Prompting

Grok Imagine Video 1.5 Motion Prompting

Grok Imagine Video 1.5 är xAI:s videogenereringsfamilj för utvecklare som behöver styrd rörelse utifrån prompter och visuella indata. Animera en startbild med rörelseinstruktioner på naturligt språk, välj 480p eller 720p för referensarbetsflöden och lägg till en valfri referensröst som styr resultatet. Få åtkomst till stödda lägen via en enda OpenAI-kompatibel Atlas Cloud-nyckel med transparent betalning efter användning. Börja bygga idag.

Grok Imagine Video 1.5 är utvecklad av xAI. Atlas Cloud (som drivs av Atlas Cloud AI LLC) tillhandahåller åtkomst till modellen men äger den inte. Alla varumärken tillhör sina respektive ägare.

Jämför inmatningsmodaliteter för Grok Imagine Video 1.5

Utforska sex endpoints som omvandlar text, startbilder eller referenstillgångar till video för utvecklar- och standardarbetsflöden.

ModalitetBeskrivning
Grok Imagine Video 1.5 Developer Reference-to-Video APIOmvandla 1 till 7 referensbilder och en valfri referensröst till video med inbyggt synkroniserat ljud. Utdata kan vara upp till 15 sekunder lång i 480p eller 720p. Den här endpointen passar referensstyrda scener och visuella koncept som kräver flera källbilder.
Grok Imagine Video 1.5 Reference-to-Video APIMed vägledning av 1 till 7 referensbilder genererar den här endpointen videor med inbyggt synkroniserat ljud och kan även ta emot en valfri referensröst. Den stöder längder på upp till 15 sekunder i 480p eller 720p. Välj den för videoproduktion med flera referenser och röststyrda sekvenser.
Grok Imagine Video 1.5 Developer Text-to-Video APIDet räcker med en textprompt för att generera video med inbyggt synkroniserat ljud via den här utvecklarendpointen. Skapa klipp på upp till 15 sekunder i 480p, 720p eller 1080p. Den passar promptdrivna koncept, storyboards och produktion av kortformatvideo.
Grok Imagine Video 1.5 Text-to-Video APISkapa video direkt från en textprompt samtidigt som synkroniserat ljud genereras inbyggt. Tillgängliga utdataalternativ är 480p, 720p och 1080p, med en maximal längd på 15 sekunder. Använd den för manusbaserade scener, kampanjkoncept eller sociala videoassets.
Grok Imagine Video 1.5 Developer Image-to-Video APIMed utgångspunkt i en bild tillämpar den här utvecklarendpointen rörelseinstruktioner på naturligt språk för att skapa en animerad video. Upplösningsalternativen omfattar 480p, 720p och 1080p. Den lämpar sig för att animera konstverk, produktbilder och förberedda öppningsbilder.
Grok Imagine Video 1.5 Image-to-Video APIAnimera en startbild genom att beskriva den önskade rörelsen på naturligt språk. Den resulterande videon kan genereras i 480p, 720p eller 1080p. Det här arbetsflödet stöder rörelsestudier, visuellt berättande och bilddriven kreativ produktion.

Inblick i den kreativa motorn Grok Imagine Video 1.5

Grok Imagine Video 1.5 samlar arbetsflöden för text, startbild och en till sju referensbilder med inbyggt synkroniserat ljud, upp till 1080p-utdata och klipp på upp till 15 sekunder i text- eller referensläge, medan Atlas Cloud tillhandahåller ett API och transparent prissättning enligt betala-efter-användning.

Grok Imagine Video 1.5 från text

Börja med en textprompt och generera klipp på upp till 15 sekunder i 480p, 720p eller 1080p. Inbyggt synkroniserat ljud levereras tillsammans med videon i samma generering. Utforma scenen och handlingen helt genom skriftliga instruktioner när ingen källbild finns. Det här arbetsflödet passar konceptfilmer, filmiska experiment och promptdrivna innehållsflöden.

Bildstyrd rörelse

En enda startbild blir en rörlig sekvens genom rörelsepromptar på naturligt språk. Välj utdata i 480p, 720p eller 1080p medan bilden etablerar den inledande kompositionen. Beskriv motivets och scenens rörelser i prompten och låt sedan modellen animera vidare från den visuella utgångspunkten. Det passar produktbilder, karaktärsögonblick och konstnärligt regisserade stillbilder som behöver rörelse.

Grok Imagine Video 1.5 med referensstyrning

Styr Grok Imagine Video 1.5 med en till sju referensbilder och en valfri referensröst. Referensläget producerar klipp på upp till 15 sekunder i 480p eller 720p, med inbyggt synkroniserat ljud. Använd dessa indata för att styra den genererade scenen mot en etablerad visuell riktning. Det här arbetsflödet passar kampanjer och berättelser som bygger på befintliga kreativa referenser.

Inbyggt synkroniserat ljud

Video och ljud genereras tillsammans, så varje klipp kan innehålla inbyggt synkroniserat ljud utan ett separat ljudsteg. Bygg scener kring synliga handlingar vars timing kan förstärkas av det medföljande ljudspåret. När synkronisering är viktig minskar detta kombinerade genereringsflöde överlämningen mellan visuellt skapande och ljudproduktion. Det är särskilt användbart för material med mycket framträdanden och atmosfär.

Berättelsebågar på 15 sekunder

Sträck ut ett komplett visuellt moment över text- eller referensklipp på upp till 15 sekunder i stället för att stanna vid en kort loop. Den tillgängliga längden ger utrymme för anslag, rörelse och en tydlig upplösning i en enda genererad sekvens. Kombinera den tiden med varierande kameraperspektiv och kontinuerlig handling för att skapa ett mer utvecklat ögonblick. Den här längden passar bra för korta annonser, narrativa avslöjanden och scener för sociala videor.

Ett API, sex endpoints

Växla mellan generering från text, startbilder och referenser via ett enda Atlas Cloud API, med transparent prissättning enligt betala-efter-användning. Välj det arbetsflöde som passar varje tillgång i stället för att tvinga varje idé genom en enda indatatyp. Samma integration ger utvecklare tillgång till alla sex listade Grok Imagine Video v1.5-endpoints, inklusive standard- och Developer-rutter. Det förenklar experimenterande och produktionsplanering för varierande videouppgifter.

Grok Imagine Video 1.5 i en modelluppgörelse med en enda prompt

Se hur Grok Imagine Video 1.5 och två Atlas Cloud-alternativ tolkar identiska prompts inom filmisk action och stiliserad fantasy.

Prompt

En 9 sekunder lång barock fantasyfilm i en enda tagning, under vattnet och inne i ett övergivet, helt översvämmat operahus: en graciös fridykare med böljande hår och en självlysande pärlmask jagar en intensivt korallröd bläckfisk som bär på en utsmyckad mässingsnyckel genom svävande sammetsgardiner. Börja inifrån ett sprucket scengolv med en dramatisk uppåtriktad grodperspektivbild när hon rullar och dyker med huvudet först genom sprickan; övergå till en tät lateral följning när hon slingrar sig mellan kullvälta teaterstolar, medan hår och dräkt reagerar naturligt på strömmarna och gardiner böljar samt bubblor stiger genom lager av valvbågar; kretsa sedan runt henne och höj kameran med en kranrörelse när vattentrycket sliter loss en kristallkrona ovanför. I klimax vrider hon sig åt sidan i sista ögonblicket för att undvika den fallande kristallkronan, vars kristaller kolliderar och sprids realistiskt, medan bläckfisken skickligt fångar den tumlande nyckeln med sina komplexa, slingrande tentakler, pausar med högtidlig ceremoni och lägger tillbaka den i hennes öppna hand. Kontinuerlig flytande rörelse, tydlig början–jakt–upplösning, konsekvent karaktär och pärlmask, fysikaliskt korrekt vattenmotstånd, flytkraft, tyg, hår, bubblor, tentakeldeformation, stötar och kollisionsundvikande. Kalla cyanblå ljusstrålar från krossade takfönster skär genom den mörka, nedsänkta salongen; korallrött är den enda starkt mättade färgen och leder blicken genom djupa lager av valvbågar, gardiner, svävande bråte och bubblor. Fotorealistisk filmisk undervattensfotografering med en subtil oljemålad textur, elegant barock storslagenhet, volymetriska kaustiska ljuseffekter, hög detaljrikedom, ingen text, inget gränssnitt, inga klipp förklädda som stillbilder. Omslutande ljud: dova undervattensmuller, strömmande vatten, prasslande tyg, bubblor, kristallina stötar och en spänd orkesterpuls som upplöses i en enda delikat harpton när nyckeln lämnas tillbaka. Bildformat 16:9.

Generated with Grok Imagine Video v1.5 Text-to-Video on Atlas Cloud

Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud

Generated with Grok Imagine Video v1.5 Developer Text-to-Video on Atlas Cloud

Prompt

En absurd actionkomedireklam på 9 sekunder, förlagd till en minutiöst detaljerad frisersalong från 1950-talet i gryningen. En butter, raggig Old English Sheepdog, dränkt i ett tjockt lager vitt tvålskum, rusar genom dörren och far över salongen medan den skakar skum överallt; en förskräckt barberare hoppar upp på en snurrstol och åker efter, samtidigt som han klipper snabbt i hundens flygande päls, där varje skarpt saxknäpp är exakt synkroniserat med slagkraftiga jazztrummor. Börja med en extremt marknära följning som rusar bredvid våta tassar när de slirar över blanka svartvita schackrutiga klinkers och skickar realistiska droppar och skumstänk mot objektivet; svep kameran uppåt i en snabb cirkulär följning som använder tre stora speglar för att kontinuerligt visa och bevara hundens och barberarens skiftande positioner genom komplexa, korrekta reflektioner; utför sedan en snabb dolly-in när de sista luftburna pälsklippen tumlar, virvlar och landar perfekt på hundens huvud och formar en osannolikt hög pompadour. Hunden stannar och poserar självgott i ett heroiskt, fryst ögonblick på en sekund, men nyser sedan plötsligt med en explosiv puff av skum och hår när jazzen avslutas med ett skarpt komiskt virveltrumsslag. Varma praktiska volframljus skär genom den svala turkosa morgondimman utanför fönstren; en fyllig vintagepalett med bordeauxrött, crème, polerad mässing och mörkt trä; exklusiv live-action-reklamfilmografi, sömlös kontinuerlig koreografi i hög hastighet, konsekventa karaktärer och rumslig kontinuitet, fysikaliskt korrekt våt päls, tvålskum, löst hår, reflektioner, stolens rotation, tröghet och kollisioner, taktil fotorealistisk detaljrikedom, skarp rörelseåtergivning, ingen slow motion, inga tomma etableringsbilder, inga skärmar, inga programvarugränssnitt, inga dashboards, inga förloppsindikatorer, inga diagram, inga bildtexter, ingen förklarande text, inga logotyper, inga vattenstämplar, bildformat 16:9.

Generated with Grok Imagine Video v1.5 Text-to-Video on Atlas Cloud

Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud

Generated with Grok Imagine Video v1.5 Developer Text-to-Video on Atlas Cloud

Grok Imagine Video 1.5 genom hela den kreativa processen

Grok Imagine Video 1.5 omvandlar promptar, källbilder och upp till sju referensbilder till korta videor med synkroniserat ljud för kampanjer, produktpresentationer, karaktärsberättelser, innehåll för sociala medier och snabb visuell prototypframtagning.

Produktfilmer med Grok Imagine Video 1.5

Animera en produktbild med rörelsepromptar på naturligt språk och synkroniserat ljud. Skapa korta presentationsklipp för butiker, kampanjsidor, lanseringsmaterial eller betalda placeringar i sociala medier i upp till 1080p.

Karaktärsberättelser med referensstyrning

Styr en scen med en till sju karaktärsreferenser och en valfri referensröst. Den här konfigurationen stöder återkommande rollbesättningar, dialogscener och korta berättande klipp med inbyggt synkroniserat ljud.

Kampanjkoncept med prompten i centrum

Börja med en textprompt för att generera en komplett video med inbyggt synkroniserat ljud. Marknadsföringsteam kan utforska kampanjkoncept, stämningsfilmer och lanseringsteasers utan att förbereda en källbild.

Sociala klipp med Grok Imagine Video 1.5

Förvandla en enda startbild till rörelse med instruktioner på naturligt språk i upp till 1080p. Skapa kortfattat kampanjmaterial för flöden, lanseringssidor, evenemangsannonser, produktuppdateringar och kreatörsdrivna inlägg.

Animering av storyboardbilder

Ge en godkänd storyboardbild liv med promptstyrda rörelser samtidigt som den behålls som startbild. Regissörer och designers kan skapa korta previz-klipp med synkroniserat ljud för granskning.

Varumärkeskampanjer med Grok Imagine Video 1.5

Kombinera produktvyer, karaktärsporträtt, kläddetaljer och scenreferenser från upp till sju bilder. Varumärkesteam kan styra korta reklamscener med synkroniserat ljud och samtidigt förankra varje förfrågan i tillhandahållet visuellt material.

Grok Imagine Video 1.5 inom det multimodala videoområdet

Jämför Grok Imagine Video 1.5 med ledande referens-till-video-modeller vad gäller accepterade indata, klipplängd, upplösning, synkroniserat ljud och standardpris per sekund.

ModellIndatatyperKlipplängdMaximal upplösningInbyggt ljudStandardpris
Grok Imagine Video v1.5Text, bild, referensbilder, röstUpp till 15 sekunder1080p√$0.08/sekund
Seedance 2.0 Reference-to-VideoText, bild, video, ljud4 till 15 sekunder4K√$0.112/sekund
MiniMax H3 Reference-to-VideoText, bild, video, ljud4 till 15 sekunder2K√$0.038/sekund
Wan-2.7 Reference-to-videoText, bild, video, ljud2 till 10 sekunder1080p√$0.10/sekund

Hur man använder Grok Imagine Video 1.5 på Atlas Cloud

Get started in minutes — follow these simple steps to integrate and deploy models through Atlas Cloud’s platform.

Skapa ett Atlas Cloud-konto

Registrera dig på atlascloud.ai och slutför verifieringen. Nya användare får gratis krediter för att utforska plattformen och testa modeller.

Varför Använda Grok Imagine Video 1.5 på Atlas Cloud

Att kombinera de avancerade Grok Imagine Video 1.5-modellerna med Atlas Clouds GPU-accelererade plattform ger oöverträffad prestanda, skalbarhet och utvecklarupplevelse.

Prestanda & flexibilitet

Låg Latens:
GPU-optimerad inferens för realtidsresonemang.

Enhetligt API:
Kör Grok Imagine Video 1.5, GPT, Gemini och DeepSeek med en integration.

Transparent Prissättning:
Förutsägbar fakturering per token med serverlösa alternativ.

Företag & Skala

Utvecklarupplevelse:
SDK:er, analys, finjusteringsverktyg och mallar.

Tillförlitlighet:
99.99% drifttid, RBAC och efterlevnadsredo loggning.

Säkerhet & Efterlevnad:
SOC 2 Type II, HIPAA-anpassning, datasuveränitet i USA.

Vanliga frågor om Grok Imagine Video 1.5 API

Grok Imagine Video 1.5 är xAI:s modellfamilj för videogenerering, som skapar videoklipp från text, en startbild eller flera referensbilder. Genom Atlas Cloud kan utvecklare använda separata endpoints för varje genereringsläge.

Tre lägen är tillgängliga: text-to-video, image-to-video och reference-to-video. Välj text för att skapa en scen från grunden, image för att animera en startbildruta eller reference mode för att styra motiv, objekt och stil med flera bilder.

Skapa en Atlas Cloud API-nyckel och skicka en autentiserad begäran till endpointen för videogenerering med lämpligt modell-ID. Använd det returnerade uppgifts-ID:t för att kontrollera genereringsstatusen och hämta URL:en till den färdiga videon.

Text-to-video kräver en prompt på naturligt språk, medan image-to-video dessutom kräver en bild av startbildrutan. Reference-to-video tar emot en prompt och 1 till 7 referensbilder, med valfria förinställda röst-ID:n för genererad dialog.

De tillgängliga Atlas Cloud-schemana stöder klipp på 1 till 15 sekunder. Text-to-video och image-to-video erbjuder utdata i 480p, 720p eller 1080p, medan reference-to-video stöder 480p eller 720p.

Ja. Text-to-video genererar inbyggt synkroniserat ljud från prompten, och reference-to-video kan kombinera genererat ljud med en valfri förinställd röst för dialog.

Atlas Cloud anger ett standardbaspris på $0.08 för varje endpoint som omfattas av den här familjesidan. Granska det valda endpointets aktuella debiteringsuppgifter före driftsättning, eftersom den angivna prisposten inte specificerar debiteringsenheten.

Tillhandahåll mellan 1 och 7 bilder via reference-to-video-endpointen. Identifiera specifika resurser i prompten med taggar som <IMAGE_0> och <IMAGE_1>, så att modellen kan koppla varje referens till det avsedda motivet eller scenelementet.

De tillgängliga Atlas Cloud-schemana innehåller ingen särskild parameter för sista bildrutan. Image-to-video använder en bild som startbildruta, medan reference-to-video använder 1 till 7 bilder som visuell vägledning snarare än som garanterade första och sista bildrutor.

Välj reference-to-video när flera bilder behöver styra personerna, objekten eller den visuella stilen i en ny scen. Använd image-to-video när en befintlig bild ska bli den inledande bildrutan och rörelsen ska följa en prompt på naturligt språk.

Utforska Fler Familjer

Seedance 2.5

Seedance 2.5 API är nu tillgängligt på Atlas Cloud! Det ger utvecklare ByteDances nyaste videomodell. Den genererar upp till 30 sekunder inbyggd video i en enda körning från text, en enskild bild eller upp till 50 multimodala referenser, med synkroniserat ljud och flerspråkig text i bildrutan. På Atlas Cloud når du den genom en enda nyckel, med motivkonsekvens och förbättrad fysik som håller långa tagningar sammanhängande.

Visa Familj

Wan 3.0

Wan 3.0 API är nästa generation av Alibabas Wan-videofamilj, byggd för att ta långformatsgenerering, multireferenskontroll och audiovisuell kvalitet till nya höjder. Atlas Cloud är redan värd för Wan 2.7, 2.6 och 2.5, och Wan 3.0 körs på samma enhetliga nyckel utan separat konfiguration. Börja bygga idag. Rulla ner till uppvisningen för att se vad Wan 3.0 kan skapa.

Visa Familj

MiniMax H3

MiniMax H3 är MiniMax multimodala videofamilj för att skapa med text, bilder och referenser. Via de rutter som stöds bevarar den motiv från referensmedia, erbjuder flexibla bildformat och kombinerar genererat ljud med bild genom H3 Developer, med utdataprofiler som väljs per endpoint. Atlas Cloud samlar hela familjen bakom en enda OpenAI-kompatibel nyckel, med transparent användningsbaserad prissättning från standardpriset $0.038 per sekund. Börja bygga redan idag.

Visa Familj

Seedream 5.0 Pro

Seedream 5.0 Pro API ger utvecklare ByteDances kontrollerbara bildredigeringsmodell på Atlas Cloud. Den placerar redigeringar exakt med ankare och koordinater, separerar bilder i redigerbara lager, slår samman flera referenser och matchar exakta färger och material, med flerspråkig text i 2K och 3K. På Atlas Cloud når du den via en enda nyckel!

Visa Familj

Seedance 2.0

Seedance 2.0 är ByteDance:s produktionsmodell för video och möjliggör exakt skapande av videoklipp. Omvandla prompts till video, animera en bild för första bildrutan med valfri vägledning från sista bildrutan eller forma resultaten med referensmedia och valfri webbsökning. Atlas Cloud samlar dessa arbetsflöden i ett enhetligt API med transparent prissättning enligt användning och en OpenAI-kompatibel nyckel. Börja bygga idag.

Visa Familj

GPT Image 2.5

gpt-image-2.5-familjen från OpenAI ger utvecklare möjlighet att välja mellan Flare och Sunburst för produktionsarbetsflöden för bilder. Rendera med valfria upplösningar upp till 3840x2160 och välj mellan fem kvalitetsnivåer, däribland xhigh och max, för att uppfylla specifika krav på utdata. Atlas Cloud erbjuder färdig REST-inferens utan cold starts och med standardpriser från $0.004 per generering. Börja bygga idag.

Visa Familj

GPT Image 2

GPT Image 2 API ger utvecklare tillgång till OpenAI:s senaste bildmodell, uppföljaren till GPT Image 1.5. Den genererar och redigerar bilder med exakt textåtergivning i latinska och CJK-tecken, plus en stark komposition för affischer, mockups och infografik. På Atlas Cloud når du den via ett enhetligt API tillsammans med över 300 modeller, med gratis krediter, 99,99 % upptid och utan krav på OpenAI-organisationsverifiering.

Visa Familj

Gemini Omni Flash

gemini omni API ger utvecklare tillgång till Google DeepMinds nativt multimodala Gemini Omni Flash-familj, inklusive Gemini Omni 1.1 Flash. Skapa filmiska videor med synkroniserat inbyggt ljud, animera stillbilder med exakt kontroll över start- och slutbild eller redigera befintligt videomaterial med textstyrda ändringar som bevarar innehåll som inte berörs. Atlas Cloud erbjuder en OpenAI-kompatibel nyckel, samlad åtkomst och transparent prissättning med betalning efter användning. Börja bygga redan i dag.

Visa Familj

Grok Imagine

Grok Imagine API täcker xAI:s bild-, video- och talmodeller – från Image 2.0 till Video 1.5 och xAI TTS v1. Rendera 1K eller 2K stillbilder över 14 bildformat, skapa upp till 15 sekunders 1080p-video, styr resultatet med upp till 7 referensbilder, eller lägg till röst på 20 språk. Atlas Cloud kör alla lägen på en enda slutpunkt, prissatt per användning från $0.02 per bild och $0.05 per sekund. Börja bygga idag.

Visa Familj

Google

Googles mest kraftfulla kreativa modeller är alla tillgängliga på Atlas Cloud. Veo 3.1 levererar filmisk videogenerering, Nano Banana 2 driver skapandet av högupplösta bilder, och Gemini tillför multimodal intelligens till varje arbetsflöde. Få tillgång till hela Googles modellsvit via en enda API key med Day-0-tillgänglighet och pay-as-you-go-prissättning.

Visa Familj

Seedance 2.0 Mini

Seedance 2.0 Mini tar ByteDances multimodala videogenerering till arbetsflöden där hastighet och kostnad är avgörande. Det levererar kärnfunktionerna i Seedance 2.0 med ett lättare fotavtryck – snabbare generering, lägre kostnad per video och samma API-integration som du redan använder. För team som kör pipelines med hög volym eller gör prototyper i stor skala är Mini den praktiska standarden.

Visa Familj

ByteDance

Från filmisk videogenerering till skapande av högupplösta bilder, ByteDances kraftfullaste modeller är live på Atlas Cloud. Kör Seedance och Seedream i stor skala med de lägsta inferenspriserna och noll infrastrukturkostnader.

Visa Familj

Ett API för all media-AI.

Utforska alla modeller