


FLUX 3 API tar Black Forest Labs senaste grundmodell till din stack: en enhetlig Self-Flow-arkitektur som tränats gemensamt på bilder, video och ljud. Generera klipp på upp till 20 sekunder med flerspråkig dialog, ljudeffekter och miljöljud i ett enda pass, eller rendera text-till-bild-arbeten med korrekt typografi. Atlas Cloud tillhandahåller den med en enda OpenAI-kompatibel nyckel, pay-as-you-go-prissättning per anrop och Day-0-åtkomst.
Atlas Cloud förser dig med de senaste branschledande kreativa modellerna.
Fem videoendpoints ligger bakom ett och samma FLUX 3 API-gränssnitt, och tabellen nedan visar vad var och en tar emot, vad den skickar tillbaka och vad den kostar per sekund.
| Modalitet | Beskrivning |
|---|---|
| FLUX 3 T2V API (text till video) | Textprompter blir klipp på 5 till 20 sekunder med ljud som genereras i samma körning, eftersom generate_audio är aktiverat som standard. Resultatet levereras i 720p eller 1080p över sju fasta bildförhållanden från 21:9 till 9:16 plus ett automatiskt alternativ, och ett seed-värde gör alla resultat reproducerbara. Priset är $0.17 per sekund genererad video. |
| FLUX 3 I2V API (bild till video) | Skicka in en enda PNG-, JPEG- eller WebP-bild så animerar modellen vidare från den bildrutan, med rörelse och tempo hämtade från prompten. Längden kan väljas fritt från 5 till 20 sekunder, vilket passar produktbilder, karaktärsintroduktioner och sociala nedklipp baserade på material du redan äger. Debiteringen är $0.17 per sekund genererad video. |
| FLUX 3 Keyframes API (keyframes till video) | När en tagning måste träffa specifika beats kan upp till 10 keyframe-bilder låsas till exakta bildrutepositioner längs en 24 fps-tidslinje. Varje frame_index måste ligga inom duration multiplicerat med 24, vilket ger storyboard- och previz-team direkt kontroll över vad som visas och när. Priset matchar de andra genereringsendpointsen med $0.17 per sekund genererad video. |
| FLUX 3 FLF API (första och sista bildruta till video) | Behöver ett klipp landa på en exakt slutbild? Genom att skicka start_image_url och end_image_url låses båda ändarna av tagningen medan modellen fyller i rörelsen däremellan. Logorevealer, transformationssekvenser och scenövergångar som måste matcha omgivande material passar alla här, till $0.17 per sekund genererad video. |
| FLUX 3 Extend API (videoförlängning) | Befintligt material för berättelsen vidare i denna endpoint: en MP4 under 50 MB och kortare än 15 sekunder fortsätts från sina sista bildrutor enligt prompten. Ljud fortsätter att genereras tillsammans med bilden, och samma utdata i 720p eller 1080p samt spannet 5 till 20 sekunder gäller fortfarande. Förlängning kostar $0.41 per sekund genererad video. |
Byggd av Black Forest Labs ovanpå en enda multimodal kärna returnerar FLUX 3 API upp till tjugo sekunder HD- eller Full HD-video med dialog, ljudeffekter och atmosfär som genereras i samma körning, och den tar emot styrning för tagningar, keyframes, språk och text i bild under resans gång.
Ett enda anrop returnerar 5 till 20 sekunder video med ljud som genereras i samma körning, aldrig dubbad i efterhand. Dialog, ljudeffekter och ambiens landar på exakt den bildruta där händelsen inträffar, och utdata levereras i 720p HD eller 1080p Full HD. Den tajmingen är det som gör att en wok som flammar upp eller en dörr som slås igen uppfattas som filmat snarare än ihopklippt.
Be om ett klippbyte och modellen levererar det. Scener och kameravinklar ändras inom en enda generering medan samma karaktär, kostym och ljuslogik följer med genom varje tagning. Längre delar byggs med agentic clip chaining, som länkar samman separata genereringar till sekvenser som rullar i minuter. Storyboards som förr krävde fyra renderingar och en redigerare kommer nu tillbaka som ett enda sammanhängande stycke.
Text ensam, en enda stillbild, ett par av första och sista bildruta, keyframes placerade över tidslinjen, eller ett befintligt klipp att fortsätta från: alla fem ingångar stöds. Keyframes låser vad som händer och när, medan continuation plockar upp från material du redan har. Studior som sitter på varumärkesbilder eller halvfärdiga klipp kan utgå från de tillgångarna i stället för att beskriva varje tagning från grunden.
Inbyggd dialog omfattar engelska dialekter, kinesiska, spanska, franska, tyska, japanska, portugisiska, ryska, italienska, indonesiska, turkiska, hindi, punjabi och fler, med läpprörelser som matchas mot det språk du begär. Typografi renderas också som en del av scenen, så skyltar och titlar ligger inne i bilden i stället för att kompositeras i efterhand. En enda prompt kan alltså leverera en lokaliserad spot med sin text redan på plats.
Atlas Cloud levererar FLUX 3 via samma enhetliga endpoint som frontar resten av katalogen, så en nyckel räcker till video-, bild- och språkmodeller utan en andra integration. Faktureringen förblir betala per användning utan abonnemang och utan platsavgifter, och du betalar bara för de genereringar du faktiskt kör. Att byta modell innebär att ändra en sträng. Börja bygga i dag.
Varje rad nedan kör en och samma prompt genom FLUX 3 API och två andra videomodeller på Atlas Cloud, så att rörelsekontinuitet, klippbyten och inbyggt ljud kan bedömas utifrån samma brief i stället för utvalda demoklipp.
Cinematic live action, regnvåt bakgata i Tokyo på natten. En Shiba Inu i en liten gul regnjacka åker skateboard nedför gränden och sicksackar mellan vattenpölar och ångventiler. Öppna med en låg tracking shot som sveper över den våta asfalten precis bakom brädan, med neonreflexer som stryker förbi. Hunden snuddar vid en stapel papperslyktor som exploderar upp i luften, och en whip pan följer en snurrande lykta när den tumlar mot ett ramenstånd. Klipp till en drone shot som drar uppåt och bakåt medan Shiban slår ned en tass, snurrar brädan till ett tvärstopp och skäller en gång mot den skrattande ramenkocken, som snärtar iväg en skiva chashu som hunden fångar i luften. Varmt ståndljus mot kall neon, vattenstänk belyst bakifrån. Audio: väsande regn, uretanhjul som mullrar över sten, en fräsande wok, ett skarpt skall, ett tåg som passerar någonstans ovanför. 16:9 aspect ratio.
Generated with BLACKFORESTLABS FLUX 3 on Atlas Cloud
Generated with Veo3.1 on Atlas Cloud
Generated with Kling v3.0 on Atlas Cloud
Hand painted anime style, klar middagssol ovanför ett ändlöst hav av moln. En tonårig himmelsfiskare tar spjärn på däcket till ett luftskepp av trä och kastar en lång lina ned i molnhavet. Börja med ett first person POV över relingen när linan piskas ut och försvinner in i det vita. Spöet rycker spänt, och kameran klipper till en snabb orbit runt däcket medan hon dras över plankorna, repet ryker genom hennes handskar och en känga hakar fast i en ring av rigg. Hon sätter en fot på relingen och drar bakåt precis när en koi stor som en val bryter upp genom molnen bakom henne, med fjäll som kastar regnbågsljus över seglen. Avsluta med en hero shot ur låg vinkel när besättningen brister ut i jubel och molnstänk driver genom bilden. Målerisk cel shading, varmt kantljus, synlig penseltextur. Audio: vinande vind, knarrande rep, en stigande orkestersvällning, en djup vattenartad smäll när den bryter ytan. 16:9 aspect ratio.
Generated with BLACKFORESTLABS FLUX 3 on Atlas Cloud
Generated with Seedance 2.0 on Atlas Cloud
Generated with Kling v3.0 on Atlas Cloud
Oavsett om jobbet är ett klipp för sociala medier på tjugo sekunder med inbyggt ljud, en keyframe-baserad storyboard, en lokaliserad annonsversion eller en snabb utkastvända före slutrenderingen, täcker FLUX 3 API det på Atlas Cloud med pay-as-you-go-prissättning och Day-0-åtkomst.
Generera upp till tjugo sekunder video från en enda textprompt, med tal, effekter och miljöljud producerade tillsammans med bildrutorna. Sociala team får ett färdigt klipp utan ett separat ljudpass.
Ordnade keyframes låter FLUX 3 API föra en scen genom definierade ögonblick, med skiftande kameravinklar och miljöer inom en enda generering. Storyboard-artister kan förhandsgranska en hel sekvens innan någon inspelning bokas.
Typografi renderas korrekt i genererade scener, och hantering av flerspråkig text förbättras jämfört med vad tidigare FLUX-generationer levererade. Förpackningsmockuper, titelkort och lokaliserade banners kommer ut ur ett enda anrop redo för granskning.
Behöver du samma spot på sex marknader? FLUX 3 API genererar synkroniserad flerspråkig dialog tillsammans med videon, så varje version får sitt eget lokaliserade röstspår utan ett dubbningssteg.
Befintligt material kan föras in i nya sammanhang, förlängas med matchande ljud eller omformas medan de centrala elementen förblir intakta. Byråer återupplivar gamla kampanjtillgångar i stället för att beställa ännu en inspelning.
Utkastläge returnerar en snabb HD-förhandsvisning till lägre kostnad, och godkända tagningar renderas igen i HD eller FHD via FLUX 3 API. Iteration förblir prisvärd när ett koncept behöver tjugo försök.
Väg in klipplängd, utdataupplösning, inbyggt ljud och kostnad per sekund för att se var FLUX 3 API drar ifrån och var en annan Atlas Cloud-modell kan passa din pipeline bättre.
| Modell | Maximal klipplängd | Maximal utdataupplösning | Inbyggt ljud | Pris per sekund |
|---|---|---|---|---|
| FLUX 3 Video (Text-to-Video) | 20 s | FHD, up to 2 MP per frame | √ dialog, SFX, miljöljud | $0.17 HD / $0.29 FHD |
| FLUX 3 Video (Video-to-Video) | 20 s | FHD, up to 2 MP per frame | √ dialog, SFX, miljöljud | $0.41 HD / $0.53 FHD |
| Seedance 2.0 Text-to-Video | 15 s | 4K (3840 x 2160) | √ på som standard | $0.112 |
| Kling V3.0 Turbo Text-to-Video | 15 s | 1080p | √ valfritt, av som standard | $0.112 |
| Wan-2.7 Text-to-video | 15 s | 1080p native, 1440p-SR | √ SFX, musik, miljöljud | $0.10 |
| Veo3.1 Text-to-video | 8 s | 1080p | √ synkroniserat ljud | $0.20 |
Get started in minutes — follow these simple steps to integrate and deploy models through Atlas Cloud’s platform.
Registrera dig på atlascloud.ai och slutför verifieringen. Nya användare får gratis krediter för att utforska plattformen och testa modeller.
Att kombinera de avancerade FLUX 3-modellerna med Atlas Clouds GPU-accelererade plattform ger oöverträffad prestanda, skalbarhet och utvecklarupplevelse.
Låg Latens:
GPU-optimerad inferens för realtidsresonemang.
Enhetligt API:
Kör FLUX 3, GPT, Gemini och DeepSeek med en integration.
Transparent Prissättning:
Förutsägbar fakturering per token med serverlösa alternativ.
Utvecklarupplevelse:
SDK:er, analys, finjusteringsverktyg och mallar.
Tillförlitlighet:
99.99% drifttid, RBAC och efterlevnadsredo loggning.
Säkerhet & Efterlevnad:
SOC 2 Type II, HIPAA-anpassning, datasuveränitet i USA.
FLUX 3 är Black Forest Labs multimodala foundation model, tränad gemensamt över bild, video, ljud och handlingsprediktion i stället för att sys ihop av separata system. FLUX 3 API exponerar modellen via Atlas Cloud, så en enda begäran returnerar video med synkroniserat ljud. En OpenAI-kompatibel nyckel täcker den tillsammans med alla andra modeller i katalogen, med debitering per användning.
Video är den funktion som är allmänt tillgänglig och omfattar text till video, bild till video, keyframe-styrda tagningar och fortsättning av ett befintligt klipp, alla med valfritt inbyggt ljud. Black Forest Labs släpper familjen i faser, så FLUX 3 Image och FLUX 3 Action kommer efter video-endpoints i stället för att lanseras samtidigt med dem.
Skapa ett konto, generera en API-nyckel och peka din befintliga klient mot FLUX 3 API-endpoint. Begäranden följer samma OpenAI-kompatibla mönster som används i hela Atlas Cloud-katalogen, så det finns inget separat SDK att lära sig och ingen vendor lock-in att reda ut senare. Debiteringen är pay-as-you-go per generering, utan någon prenumeration att teckna först. Börja bygga i dag.
Ja, och det sker i samma genereringspass i stället för via en andra modell, vilket håller dialog, ljudeffekter och miljöljud synkade med bilden. FLUX 3 hanterar tal med lip sync på fler än ett dussin språk, inklusive engelska, kinesiska, spanska, japanska och hindi. Ljud kan stängas av per begäran när du bara behöver tyst material.
Genereringar kan vara från 5 till 20 sekunder och matas ut i HD 720p, med Full HD 1080p tillgängligt när detaljrikedom är viktigare än kostnad. Bredbild, kvadratiskt och vertikalt format stöds alla, så samma prompt kan riktas mot en hero-yta på en landningssida eller ett mobilflöde. Längre berättelser byggs bäst av flera kontrollerade klipp i stället för en överdimensionerad begäran.
Skicka med en startbild så animerar modellen den, eller lås keyframes när en tagning måste träffa specifika ögonblick i en bestämd ordning. Befintligt material kan också fortsättas, med rörelse och bildutsnitt som förs vidare från slutet av indataklippet. Kedja fortsättningar sparsamt, eftersom den visuella konsekvensen driver iväg när varje förlängning bygger på den föregående.
Draft mode returnerar en billigare HD-förhandsvisning så att komposition, tempo och ljud kan bedömas innan en slutlig render betalas. Iterera på prompts där och kör sedan om den vinnande prompten i standard-HD eller Full HD utan att ändra begärans struktur. Team som levererar många varianter får mest värde av den här loopen.
Video debiteras per sekund utdata, så ett kort klipp kostar en bråkdel av ett långt och du betalar bara för det du faktiskt genererar. Upplösningen sätter prisnivån, med Full HD över standard-HD och Draft mode under båda. Atlas Cloud lägger inte på någon prenumeration, användaravgift eller minimikostnad. Börja i dag.
Inte än. FLUX 3 Video är den del av familjen som har släppts, medan FLUX 3 Image rullas ut stegvis och en open weights-variant, FLUX 3 Dev, har aviserats till senare. Atlas Cloud lägger till varje ny FLUX 3-endpoint när den släpps, så samma nyckel fortsätter att fungera när bildgenerering kommer.
En gemensam modell tar bort ihopsömnadssteget: det behövs inget andra pass för att tajma röst mot munrörelser eller lägga miljöljud under en färdig klippning. Det spelar störst roll för dialogscener, där glidning mellan spår direkt syns för tittarna. Pipelines krymper från flera tjänster till ett enda anrop, vilket ger färre felpunkter att övervaka.
Guider, handledningar och produktnyheter som hjälper dig att få ut mesta möjliga av Atlas Cloud.