
Grok Imagine Video 1.5 is xAI's videogeneratiefamilie voor ontwikkelaars die gecontroleerde beweging nodig hebben op basis van prompts en visuele invoer. Animeer een beginframe met bewegingsinstructies in natuurlijke taal, selecteer 480p of 720p voor referentieworkflows en voeg optioneel een referentiestem toe om het resultaat te sturen. Gebruik ondersteunde modi via één OpenAI-compatibele Atlas Cloud-sleutel met transparante pay-as-you-go-prijzen. Begin vandaag nog met bouwen.
Grok Imagine Video 1.5 is ontwikkeld door xAI. Atlas Cloud (geëxploiteerd door Atlas Cloud AI LLC) biedt toegang tot het model maar is niet de eigenaar ervan. Alle handelsmerken zijn eigendom van hun respectieve eigenaren.
Ontdek zes endpoints die tekst, startframes of referentie-assets omzetten in video voor ontwikkelaars- en standaardworkflows.
| Modaliteit | Beschrijving |
|---|---|
| Grok Imagine Video 1.5 Developer Reference-to-Video API | Zet 1 tot 7 referentieafbeeldingen en optioneel een referentiestem om in video met native gesynchroniseerde audio. De uitvoer kan maximaal 15 seconden duren in 480p of 720p. Dit endpoint is geschikt voor door referenties gestuurde scènes en visuele concepten waarvoor meerdere bronafbeeldingen nodig zijn. |
| Grok Imagine Video 1.5 Reference-to-Video API | Dit endpoint genereert op basis van 1 tot 7 referentieafbeeldingen video's met native gesynchroniseerde audio en accepteert ook optioneel een referentiestem. Het ondersteunt lengtes tot 15 seconden in 480p of 720p. Kies dit voor videoproductie met meerdere referenties en door stem gestuurde sequenties. |
| Grok Imagine Video 1.5 Developer Text-to-Video API | Met dit developer-endpoint volstaat een tekstprompt om video met native gesynchroniseerde audio te genereren. Maak clips van maximaal 15 seconden in 480p, 720p of 1080p. Het is geschikt voor promptgestuurde concepten, storyboards en korte videoproducties. |
| Grok Imagine Video 1.5 Text-to-Video API | Maak rechtstreeks vanuit een tekstprompt video terwijl native gesynchroniseerde audio wordt gegenereerd. Beschikbare uitvoeropties zijn 480p, 720p en 1080p, met een maximale duur van 15 seconden. Gebruik dit voor gescripte scènes, campagneconcepten of videocontent voor sociale media. |
| Grok Imagine Video 1.5 Developer Image-to-Video API | Dit developer-endpoint vertrekt vanuit één afbeelding en past bewegingsinstructies in natuurlijke taal toe om een geanimeerde video te maken. De resolutieopties omvatten 480p, 720p en 1080p. Het is geschikt voor het animeren van artwork, productvisuals en voorbereide openingsframes. |
| Grok Imagine Video 1.5 Image-to-Video API | Animeer een afbeelding als startframe door de gewenste beweging in natuurlijke taal te beschrijven. De resulterende video kan worden gegenereerd in 480p, 720p of 1080p. Deze workflow ondersteunt bewegingsstudies, visuele storytelling en beeldgestuurde creatieve producties. |
Grok Imagine Video 1.5 brengt workflows voor tekst, een startafbeelding en één tot zeven referentieafbeeldingen samen met native gesynchroniseerde audio, uitvoer tot 1080p en clips tot 15 seconden in tekst- of referentiemodus, terwijl Atlas Cloud één API en transparante betaling naar gebruik biedt.
Begin met een tekstprompt en genereer clips tot 15 seconden in 480p, 720p of 1080p. Native gesynchroniseerde audio wordt samen met de video in dezelfde generatie toegevoegd. Bepaal de scène en actie volledig met geschreven instructies wanneer er geen bronafbeelding is. Deze route is geschikt voor conceptfilms, cinematografische experimenten en contentpijplijnen die door prompts worden aangestuurd.
Een enkel startframe wordt via bewegingsprompts in natuurlijke taal omgezet in een bewegende sequentie. Kies uitvoer in 480p, 720p of 1080p, terwijl de afbeelding de openingscompositie bepaalt. Beschrijf de beweging van het onderwerp en de scène in de prompt en laat het model vanuit dat visuele anker verder animeren. Dit is geschikt voor productshots, karakteristieke momenten en artistiek geregisseerde stilstaande beelden die beweging nodig hebben.
Stuur Grok Imagine Video 1.5 aan met één tot zeven referentieafbeeldingen en een optionele referentiestem. De referentiemodus genereert clips tot 15 seconden in 480p of 720p, met native gesynchroniseerde audio. Gebruik deze invoer om de gegenereerde scène in de richting van een vastgelegde visuele stijl te sturen. Deze route is geschikt voor campagnes en verhalen die zijn opgebouwd rond bestaande creatieve referenties.
Video en geluid worden samen gegenereerd, zodat elke clip native gesynchroniseerde audio kan bevatten zonder een aparte audiobewerking. Bouw scènes rond zichtbare acties waarvan de timing kan worden versterkt door de bijbehorende audiotrack. Voor momenten waarop synchronisatie belangrijk is, verkleint deze gecombineerde generatieroute de overdracht tussen visuele creatie en geluidsproductie. Dit is vooral nuttig voor beeldmateriaal met veel performance en sfeer.
Werk een complete visuele beat uit in tekst- of referentieclips tot 15 seconden, in plaats van te stoppen bij een korte lus. De beschikbare duur biedt ruimte voor opbouw, beweging en een duidelijke ontknoping binnen één gegenereerde sequentie. Combineer die speelruimte met wisselende cameraperspectieven en doorlopende actie om een verder uitgewerkt moment te creëren. Deze lengte werkt goed voor korte advertenties, narratieve onthullingen en videoscènes voor sociale media.
Wissel via één Atlas Cloud API tussen generatie vanuit tekst, startafbeeldingen en referenties, met transparante betaling naar gebruik. Selecteer de workflow die bij elk asset past, in plaats van elk idee door hetzelfde invoertype te dwingen. Dankzij dezelfde integratie krijgen ontwikkelaars toegang tot alle zes vermelde Grok Imagine Video v1.5-endpoints, waaronder de standaardroutes en Developer-routes. Dit vereenvoudigt experimenten en productieplanning voor uiteenlopende videoprojecten.
Bekijk hoe Grok Imagine Video 1.5 en twee Atlas Cloud-alternatieven identieke prompts interpreteren in filmische actie en gestileerde fantasy.
Een 9 seconden durende barokke fantasyfilm onder water, opgenomen in één ononderbroken take, in een verlaten, volledig ondergelopen operahuis: een sierlijke freediver met golvend haar en een lichtgevend parelmasker achtervolgt een fel koraalrode octopus die een sierlijke koperen sleutel draagt, dwars door zwevende fluwelen gordijnen. Begin vanuit een gebarsten toneelvloer met een dramatische omhooggerichte opname vanuit een laag standpunt, terwijl ze rolt en met haar hoofd vooruit door de spleet duikt; ga over in een krappe laterale trackingbeweging terwijl ze tussen omgevallen theaterstoelen door manoeuvreert, waarbij haar haar en kostuum natuurlijk reageren op de stroming, terwijl gordijnen opbollen en bellen door gelaagde bogen opstijgen; cirkel vervolgens om haar heen en beweeg de camera omhoog terwijl de waterdruk boven haar een kristallen kroonluchter losrukt. Op het hoogtepunt draait ze zich op het laatste moment zijwaarts om de vallende kroonluchter te ontwijken, waarbij kristallen realistisch tegen elkaar botsen en uiteenspatten, terwijl de octopus de tuimelende sleutel behendig opvangt met zijn complex krullende tentakels, plechtig pauzeert en hem terug in haar geopende hand legt. Continue vloeiende beweging, een duidelijke opbouw–achtervolging–ontknoping, consistente personages en parelmasker, fysiek accurate waterweerstand, drijfvermogen, stof, haar, bellen, tentakeldeformatie, inslagen en het vermijden van botsingen. Koude cyaankleurige lichtbundels uit verbrijzelde dakramen snijden door het donkere onderwaterauditorium; koraalrood is de enige sterk verzadigde kleur en leidt het oog door diepe lagen van bogen, gordijnen, zwevend puin en bellen. Fotorealistische filmische onderwaterfotografie met een subtiele olieverftextuur, elegante barokke grandeur, volumetrische caustics, veel detail, geen tekst, geen interface, geen cuts die als stilstaande beelden zijn vermomd. Meeslepende audio: gedempte onderwaterdreunen, aanzwellende stromingen, wapperende stof, bellen, kristalinslagen en een gespannen orkestrale puls die oplost in één delicate harpnoot wanneer de sleutel wordt teruggegeven. Beeldverhouding 16:9.
Generated with Grok Imagine Video v1.5 Text-to-Video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Generated with Grok Imagine Video v1.5 Developer Text-to-Video on Atlas Cloud
Een absurde actiekomediecommercial die zich bij zonsopgang afspeelt in een tot in detail uitgewerkte barbershop uit de jaren 50. Een humeurige, ruige Old English Sheepdog, doorweekt met dik wit zeepschuim, stormt door de deur en rent door de zaak terwijl hij overal schuim rondschudt; een geschrokken kapper springt op een ronddraaiende stoel en zet de achtervolging in, terwijl hij razendsnel in de vliegende vacht van de hond knipt, waarbij elke scherpe knipslag exact synchroon loopt met de krachtige jazzdrumbeats. Begin met een extreem laag tracking-shot dat naast natte poten voortsnelt terwijl ze over glanzende zwart-witte dambordtegels uitglijden en realistische druppels en schuimspatten naar de lens sturen; maak een snelle whip-pan omhoog naar een snelle cirkelende tracking-opname waarin drie grote spiegels voortdurend de veranderende posities van de hond en de kapper onthullen en behouden via complexe, nauwkeurige reflecties; voer vervolgens een snelle dolly-in uit terwijl de laatste rondvliegende haarplukken tuimelen, wervelen en perfect op het hoofd van de hond landen, waar ze een buitengewoon hoge kuif vormen. De hond stopt en poseert één seconde lang zelfvoldaan in een bijna stilstaand heldenmoment, waarna hij plotseling niest met een explosieve wolk van schuim en haar terwijl de jazz eindigt met een scherpe komische rimshot. Warme praktische wolfraamlampen snijden door de koele teal ochtendmist buiten de ramen; een rijk vintagepalet van bordeauxrood, crème, gepolijst messing en donker hout; hoogwaardige live-actionreclamecinematografie, naadloze doorlopende choreografie op hoge snelheid, consistente personages en ruimtelijke continuïteit, fysiek accurate natte vacht, zeepschuim, losse haren, reflecties, stoelrotatie, traagheid en botsingen, tastbare fotorealistische details, haarscherpe bewegingsweergave, geen slow motion, geen lege establishing shots, geen schermen, geen software-interfaces, geen dashboards, geen voortgangsbalken, geen grafieken, geen bijschriften, geen verklarende tekst, geen logo’s, geen watermerken, beeldverhouding 16:9.
Generated with Grok Imagine Video v1.5 Text-to-Video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Generated with Grok Imagine Video v1.5 Developer Text-to-Video on Atlas Cloud
Grok Imagine Video 1.5 zet prompts, bronframes en maximaal zeven referentieafbeeldingen om in korte video’s met gesynchroniseerde audio voor campagnes, productpresentaties, karakterverhalen, socialmedia-content en snelle visuele prototyping.
Animeer een productstill met bewegingsprompts in natuurlijke taal en gesynchroniseerde audio. Maak korte showcaseclips voor webwinkels, campagnepagina’s, lanceringen of betaalde socialmedia-plaatsingen tot 1080p.
Geef een scène vorm met één tot zeven karakterreferenties en een optionele referentiestem. Deze opzet ondersteunt terugkerende personages, dialoogmomenten en korte narratieve clips met native gesynchroniseerde audio.
Begin met een tekstprompt om een volledige video met native gesynchroniseerde audio te genereren. Marketingteams kunnen campagneconcepten, sfeerbeelden en teasers voor lanceringen verkennen zonder eerst een bronafbeelding voor te bereiden.
Zet één startframe met aanwijzingen in natuurlijke taal om in beweging, tot 1080p. Produceer beknopte campagne-assets voor feeds, lanceerpagina’s, evenementaankondigingen, productupdates en door creators aangestuurde posts.
Breng een goedgekeurd storyboardframe tot leven met door prompts aangestuurde beweging, terwijl het frame behouden blijft als startafbeelding. Regisseurs en designers kunnen korte previz-opnamen met gesynchroniseerde audio maken voor review.
Combineer productaanzichten, karakterportretten, kledingdetails en scènereferenties uit maximaal zeven afbeeldingen. Merkenteams kunnen korte promotiescènes met gesynchroniseerd geluid regisseren en elke opdracht baseren op aangeleverde visuele assets.
Vergelijk Grok Imagine Video 1.5 met toonaangevende reference-to-video-modellen op het gebied van ondersteunde invoer, clipduur, resolutie, gesynchroniseerde audio en de standaardprijs per seconde.
| Model | Invoertypen | Clipduur | Maximale resolutie | Native audio | Standaardprijs |
|---|---|---|---|---|---|
| Grok Imagine Video v1.5 | Tekst, afbeelding, referentieafbeeldingen, stem | Tot 15 seconden | 1080p | √ | $0.08/second |
| Seedance 2.0 Reference-to-Video | Tekst, afbeelding, video, audio | 4 tot 15 seconden | 4K | √ | $0.112/second |
| MiniMax H3 Reference-to-Video | Tekst, afbeelding, video, audio | 4 tot 15 seconden | 2K | √ | $0.038/second |
| Wan-2.7 Reference-to-video | Tekst, afbeelding, video, audio | 2 tot 10 seconden | 1080p | √ | $0.10/second |
Binnen enkele minuten aan de slag — volg deze eenvoudige stappen om modellen te integreren en uit te rollen via het platform van Atlas Cloud.
Registreer bij atlascloud.ai en voltooi de verificatie. Nieuwe gebruikers ontvangen gratis credits om het platform te verkennen en modellen te testen.
De combinatie van Grok Imagine Video 1.5's geavanceerde modellen met het GPU-versnelde platform van Atlas Cloud biedt ongeëvenaarde prestaties, schaalbaarheid en ontwikkelaarservaring.
Lage Latentie:
GPU-geoptimaliseerde inferentie voor realtime reasoning.
Uniforme API:
Voer Grok Imagine Video 1.5, GPT, Gemini en DeepSeek uit met één integratie.
Transparante Prijzen:
Voorspelbare op tokens gebaseerde facturering met serverloze opties.
Ontwikkelaarservaring:
SDK's, analytics, fine-tuning tools en sjablonen.
Betrouwbaarheid:
99,99% beschikbaarheid, RBAC en compliance-ready logging.
Beveiliging & Compliance:
SOC 2 Type II, HIPAA-afstemming, gegevenssoevereiniteit in VS.
Grok Imagine Video 1.5 is de videogenereermodellenfamilie van xAI voor het maken van clips op basis van tekst, een startafbeelding of meerdere referentieafbeeldingen. Via Atlas Cloud hebben ontwikkelaars toegang tot afzonderlijke endpoints voor elke generatiemodus.
Er zijn drie modi beschikbaar: text-to-video, image-to-video en reference-to-video. Kies text-to-video om vanaf nul een scène te maken, image-to-video om een startframe te animeren, of reference-to-video om onderwerpen, objecten en stijlen met meerdere afbeeldingen te sturen.
Maak een Atlas Cloud API-sleutel aan en stuur een geauthenticeerd verzoek naar het video generation-endpoint met de juiste model-ID. Gebruik de geretourneerde task-ID om de generatiestatus te controleren en de URL van de voltooide video op te halen.
Text-to-video vereist een prompt in natuurlijke taal, terwijl image-to-video één afbeelding van het startframe toevoegt. Reference-to-video accepteert een prompt en 1 tot 7 referentieafbeeldingen, met optionele vooraf ingestelde voice-ID's voor gegenereerde dialogen.
De beschikbare Atlas Cloud-schema's ondersteunen clips van 1 tot 15 seconden. Text-to-video en image-to-video bieden uitvoer in 480p, 720p of 1080p, terwijl reference-to-video 480p of 720p ondersteunt.
Ja. Text-to-video genereert native gesynchroniseerde audio op basis van de prompt, en reference-to-video kan gegenereerde audio combineren met een optionele vooraf ingestelde voice voor dialogen.
Atlas Cloud vermeldt een standaardbasisprijs van $0.08 voor elk endpoint dat op deze familiepagina wordt beschreven. Controleer vóór de implementatie de actuele factureringsgegevens van het geselecteerde endpoint, omdat de aangeleverde prijsinformatie de factureringseenheid niet specificeert.
Lever via het reference-to-video-endpoint tussen 1 en 7 afbeeldingen aan. Verwijs in de prompt naar specifieke assets met tags zoals <IMAGE_0> en <IMAGE_1>, zodat het model elke referentie kan koppelen aan het beoogde onderwerp of scèneelement.
De beschikbare Atlas Cloud-schema's bevatten geen specifieke parameter voor het laatste frame. Image-to-video gebruikt één afbeelding als startframe, terwijl reference-to-video 1 tot 7 afbeeldingen gebruikt als visuele begeleiding en niet als gegarandeerde eerste en laatste frames.
Kies reference-to-video wanneer meerdere afbeeldingen de mensen, objecten of visuele stijl in een nieuwe scène moeten sturen. Gebruik image-to-video wanneer één bestaande afbeelding het openingsframe moet worden en de beweging ervan een prompt in natuurlijke taal moet volgen.
Handleidingen, tutorials en productupdates om het meeste uit Atlas Cloud te halen.