TYLKO DWA TYGODNIE | 20% ZNIŻKI na Seedream 5.0 Pro!
LTX-2 API for Synchronized Audio and Video

LTX-2 API for Synchronized Audio and Video

LTX-2 API wprowadza do produkcji rodzinę modeli wideo Lightricks z otwartymi wagami, generując wideo i zsynchronizowany dźwięk w jednym przebiegu. Twórz na podstawie tekstu, animuj nieruchomy obraz lub wydłuż istniejący klip — każdy wynik zawiera dopasowaną synchronizację ruchu ust, efekty foley i dźwięk otoczenia. W Atlas Cloud korzystasz z niego za pomocą jednego klucza zgodnego z OpenAI, z przejrzystym cennikiem pay-as-you-go i dostępem Day-0. Zacznij budować już dziś.

Poznaj Wiodące Modele

Atlas Cloud zapewnia najnowsze, wiodące w branży modele kreatywne.

Endpointy Ltx-2 API obok siebie: tekst, obraz i rozszerzanie wideo

Porównaj wszystkie tryby Ltx-2 API w jednym widoku — od generowania na podstawie promptu, przez animowanie nieruchomych obrazów, po kontynuowanie istniejących klipów, każdy z opcjonalnym zsynchronizowanym audio.

TrybOpis
Ltx-2 T2V API (tekst na wideo)Prześlij prompt tekstowy o długości do 2,000 znaków, a Ltx-2 API zwróci w pełni wyrenderowane wideo, z opcjonalnym zsynchronizowanym audio po włączeniu generate_audio. Długość klipu skaluje się od 25 do 257 klatek, a sześć presetów rozdzielczości obejmuje wyjścia kwadratowe, pionowe 9:16 i poziome 16:9. Ten endpoint sprawdza się w koncepcjach reklam, krótkich materiałach do mediów społecznościowych i podglądach storyboardów tworzonych wyłącznie na podstawie opisu tekstowego, w standardowej cenie bazowej $0.002.
Ltx-2 I2V API (obraz na wideo)Prześlij nieruchomy obraz w formacie jpg, png, webp, gif lub avif wraz z promptem ruchu, a ten endpoint zanimuje go w ruchomy klip z opcjonalnym generowaniem audio. Obowiązuje ten sam zakres od 25 do 257 klatek oraz sześć presetów proporcji obrazu, więc pojedyncza klatka źródłowa może stać się wideo poziomym lub pionowym. Naturalnymi materiałami wejściowymi są zdjęcia produktowe, portrety postaci i concept arty, wszystko w standardowej cenie bazowej $0.002.
Ltx-2 Extend Video APIGdy istniejący klip wymaga wydłużenia, ten endpoint kontynuuje go do przodu albo do tyłu na podstawie dostarczonego źródła mp4, mov, webm, m4v lub gif. Rozciąga sekwencje do 481 klatek, zachowuje oryginalne tempo dzięki match_input_fps i może dodać warstwę wygenerowanego audio. Użyj go do wydłużania b-rolli, zapętlania scen lub łączenia cięć; rozliczany jest według tej samej stawki bazowej $0.002.

Audio i wideo generowane razem przez Ltx-2 API

Ltx-2 API łączy tryby generowania z tekstu, obrazu oraz rozszerzania z natywnym, zsynchronizowanym audio, kontrolowaną liczbą klatek i sześcioma presetami proporcji obrazu — wszystko dostępne przez jeden klucz zgodny z OpenAI, w przejrzystym modelu płatności pay-as-you-go.

Od tekstu do gotowej sceny z Ltx-2 API

Opisz scenę w maksymalnie 2,000 znaków, a Ltx-2 API zamieni sam tekst w ruchomy klip z dźwiękiem, bez potrzeby dostarczania materiału referencyjnego. Prompt steruje tematem, ruchem, oświetleniem i zachowaniem kamery, a opcjonalny seed blokuje wynik, umożliwiając powtarzalne iteracje. Ponieważ wszystko zaczyna się od języka, świetnie sprawdza się przy storyboardach, prezentacjach koncepcji i szybkim eksplorowaniu pomysłów, gdy masz ideę, ale nie masz jeszcze materiału wideo.

Ożyw dowolny nieruchomy obraz

Przekaż pojedynczy obraz w formacie jpg, png, webp, gif lub avif, a model animuje go do wideo z dopasowanym audio. Prompt wskazuje, jak kadr ma się poruszać — od powolnego najazdu po pełną scenę akcji — przy zachowaniu oryginalnej kompozycji. Fotografowie, projektanci i zespoły produktowe wykorzystują to, aby zamienić jedno hero image w udostępnialny materiał w ruchu bez ponownego nagrywania czegokolwiek.

Płynnie rozszerzaj klipy przez Ltx-2 API

Prześlij istniejący klip, a Ltx-2 API będzie kontynuować go do przodu lub do tyłu, generując do 481 dodatkowych klatek, które dziedziczą oryginalny styl i tempo. Opcja match_input_fps utrzymuje nowy materiał wideo przy tej samej liczbie klatek na sekundę co źródło, dzięki czemu łączenia pozostają niewidoczne. W ten sposób krótkie ujęcia rosną do dłuższych sekwencji, a scenę zakończoną o uderzenie za wcześnie można uratować.

Liczba klatek i proporcje obrazu na Twoich zasadach

Liczba klatek jest w pełni kontrolowana od 25 do 257 klatek w trybach tekstu i obrazu, zawsze ustawiana jako wielokrotność ośmiu plus jeden, aby zapewnić czyste próbkowanie. Sześć presetów rozdzielczości obejmuje kwadratowe HD 1024 na 1024, kwadrat 512, pionowe 3:4, pionowe 9:16, poziome 4:3 i poziome 16:9, dzięki czemu jeden model obsługuje kino, social media i feedy wertykalne. Najpierw wybierz format, a potem pozwól, by jedno żądanie zwróciło właściwy kadr.

Jeden klucz i powtarzalne uruchomienia w Ltx-2 API

Każde żądanie przechodzi przez jeden klucz zgodny z OpenAI w Atlas Cloud, z przejrzystymi cenami pay-as-you-go i bez subskrypcji. Przekaż stały seed razem z tym samym promptem, a model zwróci ten sam klip, zmieniając nieprzewidywalne generowanie w kontrolowany, wersjonowalny etap. Dostęp Day-0 oznacza, że nowe wydania Ltx-2 API można wywoływać w chwili ich udostępnienia, dzięki czemu zespoły mogą standaryzować pipeline wideo i skalować go bez zarządzania GPU.

Jedna podpowiedź, trzy silniki: porównaj Ltx-2 API łeb w łeb

Wyślij jedną identyczną podpowiedź do Ltx-2 API oraz dwóch najpopularniejszych modeli wideo na Atlas Cloud, a następnie porównaj, jak każdy z nich radzi sobie z ruchem, zsynchronizowanym dźwiękiem i filmowym detalem na podstawie dokładnie tych samych instrukcji.

Prompt

Ciekawska makaka przemyka przez zatłoczony targ z przyprawami w Marrakeszu o złotej godzinie i zrywa ze stoiska jaskrawoczerwony fez handlarza. Przeskakuje przez otwarte worki z szafranem i papryką, wzbijając wirujące pomarańczowe obłoki pyłu, po czym zastyga na szczycie słupa baldachimu i zerka za siebie dokładnie w chwili, gdy roześmiany handlarz rusza za nią w pościg. Zacznij od niskiego ujęcia śledzącego, prowadzonego za małpą przez tłum, wykonaj gwałtowny whip pan na zaskoczoną twarz handlarza, a następnie wznieś kamerę w szerokim ujęciu z kranu wysoko ponad stragany, gdy pył skrzy się w ciepłym świetle. Realistyczny styl filmowy, płytka głębia ostrości, bogata ziemista kolorystyka. Dźwięk: żywy gwar targu, brzęk mosiądzu i rytmiczna perkusja na bębnach ręcznych narastająca wraz z pościgiem. Proporcje obrazu 16:9.

Generated with Ltx 2.3 Quality on Atlas Cloud

Generated with Veo3.1 on Atlas Cloud

Generated with Seedance 2.0 on Atlas Cloud

Prompt

Młoda powietrzna kurierka w powiewającym karmazynowym płaszczu skacze z krawędzi unoszącej się kamiennej świątyni i dosiada mechanicznego papierowego żurawia, mknąc przez kanionowe chmury i lawirując między dryfującymi, świecącymi lampionami. Ostro zakręca wokół poszarpanej skalnej iglicy, chwyta w locie połyskujący list, po czym składa się do stromego nurkowania, gdy tuż za nią z mgły wyłania się rywal na lotni. Zacznij od ujęcia z perspektywy pierwszej osoby znad jej ramienia, gdy żuraw startuje, przejdź do ujęcia z drona pędzącego obok podczas nurkowania, a następnie zejdź do niskiego ujęcia w górę, gdy wychodzi z nurkowania prosto w oślepiające światło słońca. Żywy styl anime, cel-shading, świetlista paleta magic-hour. Dźwięk: świst wiatru, trzepot papierowych skrzydeł i wzniosłe orkiestrowe narastanie smyczków zsynchronizowane z wyprowadzeniem z nurkowania. Proporcje obrazu 16:9.

Generated with Ltx 2.3 Quality on Atlas Cloud

Generated with Veo3.1 on Atlas Cloud

Generated with Seedance 2.0 on Atlas Cloud

Twórz produkcyjne wideo i audio za pomocą Ltx-2 API

Od promptów tekstowych i obrazowych po dłuższe montaże i zsynchronizowany dźwięk — Ltx-2 API obejmuje cały proces od pierwszej wersji po dostawę w 4K dla marketingu, e-commerce i produkcji kreatywnej.

Prompt-to-Video z Ltx-2 API

Pojedynczy prompt tekstowy pozwala Ltx-2 API wygenerować natywne wideo 4K z audio tworzonym w tym samym przebiegu. Studia i zespoły reklamowe zamieniają briefy kampanii w gotowe spoty do mediów społecznościowych bez kamer i ręcznego montażu.

Animuj statyczne obrazy

Prześlij pojedynczy obraz, a generowanie image-to-video wprawi go w ruch, zachowując kompozycję źródłową i dodając realistyczny ruch kamery. Sprzedawcy e-commerce i ilustratorzy ożywiają statyczne katalogi oraz portfolio, tworząc materiały, które zatrzymują uwagę podczas przewijania.

Wydłużaj klipy do dłuższych scen

Potrzebujesz dłuższego ujęcia? Endpoint extend-video dodaje nowe klatki do istniejącego klipu, zachowując ciągłość ruchu, stylu i audio. Twórcy łączą krótkie generacje w płynne narracje wykraczające poza pojedyncze żądanie.

Zsynchronizowany dźwięk przez Ltx-2 API

Gdy dźwięk ma znaczenie, Ltx-2 API syntetyzuje dialogi, foley i audio tła w jednym przebiegu z obrazem, zsynchronizowane z ruchem. Sprawdza się w filmach instruktażowych, zwiastunach i scenach wymagających dźwięku dokładnie na cue.

Mastery 4K z Ltx-2 API

Na potrzeby finalnej dostawy Ltx-2 API renderuje natywne klatki 4K z płynnym ruchem i ostrymi teksturami, zamiast przeskalowanych podglądów. Agencje i studia eksportują gotowe do emisji mastery bezpośrednio z endpointu do swoich pipeline’ów montażowych.

Skaluj generowanie wsadowe w rozsądnej cenie

Ponieważ LTX-2 to wydajny otwarty model, zadania o dużej skali działają w przejrzystym modelu pay-as-you-go, a tryby wydajności można przełączać dla każdego żądania. Zespoły produktowe tanio prototypują, a następnie zwiększają jakość na potrzeby wydania.

Ltx-2 API na tle innych produkcyjnych modeli wideo

Porównaj Ltx-2 API z podobnymi modelami wideo generowanymi z tekstu i obrazu w Atlas Cloud pod kątem trybów generowania, rozdzielczości, natywnego audio, długości klipu i ceny początkowej.

ModelTryby generowaniaMaks. rozdzielczośćZsynchronizowane audioMaks. długość klipuCena od
LTX-2.3 Quality Text-to-VideoTekst na wideoPresety 1024×1024 (domyślnie 16:9)√ (opcjonalny przełącznik)Do 257 klatek$0.002
LTX-2.3 Quality Image-to-VideoObraz na wideo, rozszerzaniePresety 1024×1024 (domyślnie 16:9)√ (opcjonalny przełącznik)Do 257 klatek$0.002
Seedance 2.0 Text-to-VideoTekst na wideoDo 2K√ natywneOd 4 do 15 s$0.112
Veo 3.1 Text-to-VideoTekst na wideoDo 4K√ natywne8 s (z możliwością wydłużenia)$0.2
Kling Video O3 4K Text-to-VideoTekst i obraz na wideoNatywne 4K (3840×2160)√ natywneOd 3 do 15 s$0.42

Jak używać Ltx-2 na Atlas Cloud

Zacznij w kilka minut — wykonaj te proste kroki, aby zintegrować i wdrożyć modele za pośrednictwem platformy Atlas Cloud.

Utwórz konto Atlas Cloud

Zarejestruj się na atlascloud.ai i ukończ weryfikację. Nowi użytkownicy otrzymują bezpłatne kredyty do eksploracji platformy i testowania modeli.

Dlaczego Używać Ltx-2 na Atlas Cloud

Połączenie zaawansowanych modeli Ltx-2 z platformą GPU-akcelerowaną Atlas Cloud zapewnia niezrównaną wydajność, skalowalność i doświadczenie deweloperskie.

Wydajność i Elastyczność

Niska Latencja:
Inferencja zoptymalizowana pod GPU dla rozumowania w czasie rzeczywistym.

Zunifikowane API:
Uruchamiaj Ltx-2, GPT, Gemini i DeepSeek za pomocą jednej integracji.

Przejrzysta Wycena:
Przewidywalne rozliczenia za token z opcjami serverless.

Przedsiębiorstwo i Skala

Doświadczenie Dewelopera:
SDK, analityka, narzędzia dostrajania i szablony.

Niezawodność:
99,99% dostępności, RBAC i logowanie gotowe na zgodność.

Bezpieczeństwo i Zgodność:
SOC 2 Type II, zgodność z HIPAA, suwerenność danych w USA.

Ltx-2 API: odpowiedzi na najczęstsze pytania deweloperów

Ltx-2 API daje deweloperom programistyczny dostęp do LTX-2, modelu bazowego audio-wideo z otwartymi wagami od Lightricks. Przekształca prompty tekstowe lub obrazowe w zsynchronizowane wideo i audio w jednym przebiegu generowania, a w Atlas Cloud korzystasz z niego przez jeden endpoint zgodny z OpenAI, z rozliczeniem pay-as-you-go.

LTX-2 obsługuje text-to-video, image-to-video oraz wydłużanie klipów, więc możesz zamienić opis sceny w ruch, animować statyczny obraz albo przedłużyć ujęcie, które już masz. Każdy tryb może renderować towarzyszące audio, dzięki czemu model sprawdza się w krótkich filmach, reklamach, demonstracjach produktów i treściach społecznościowych.

Tak. Audio i wideo powstają w jednym zsynchronizowanym przebiegu, zamiast być łączone dopiero później, obejmując synchronizację ruchu ust z dialogiem, efekty dźwiękowe i dźwięk tła. W Atlas Cloud włączasz to parametrem generate_audio, który domyślnie jest wyłączony.

Model LTX-2 natywnie osiąga rozdzielczość do 4K przy maksymalnie 50 fps, z klipami o długości do 20 sekund dla liczby klatek 24, 25, 48 i 50. W Atlas Cloud endpointy quality pozwalają wybrać aspect ratio i ustawić długość klipu przez liczbę klatek od 25 do 257 frames.

Wyślij standardowe żądanie do endpointu Atlas Cloud z promptem, modelem takim jak ltx-2.3-quality/text-to-video, aspect ratio, liczbą klatek oraz opcjonalnym seedem dla powtarzalnych wyników. Ponieważ endpoint jest zgodny z OpenAI, jeden klucz działa zarówno z Ltx-2 API, jak i ze wszystkimi innymi modelami na platformie, więc integracja zwykle zajmuje kilka minut.

Oczywiście. Model ltx-2.3-quality/extend-video kontynuuje istniejący klip LTX-2, zachowując spójność ruchu i audio poza pierwotną długością. Pomaga to wtedy, gdy pojedyncze generowanie jest krótsze niż czas trwania, którego faktycznie wymaga scena.

LTX-2 jest udostępniany z otwartymi wagami i jest na tyle wydajny, że może działać na konsumenckich GPU, więc self-hosting to realna opcja. Jeśli wolisz pominąć provisioning GPU, zarządzanie kolejkami i skalowanie, hostowane API dostarcza ten sam model bez infrastruktury do utrzymania.

Atlas Cloud rozlicza Ltx-2 API w modelu pay-as-you-go, z przejrzystymi cenami za wywołanie, bez subskrypcji i minimalnego zobowiązania. Płacisz tylko za to, co wygenerujesz, a ten sam klucz daje Ci dostęp Day-0 do nowych wydań modeli. Zacznij budować już dziś.

LTX-2.3 to aktualna iteracja rodziny LTX-2 i wersja, którą Atlas Cloud udostępnia przez swoje endpointy quality text-to-video, image-to-video oraz extend-video. Udoskonala pierwotne wydanie, zachowując to samo podejście do zsynchronizowanego audio-wideo, dzięki czemu otrzymujesz najnowszą jakość bez zmiany sposobu wywoływania modelu.

Poznaj Więcej Rodzin

Seedance 2.0

API Seedance 2.0 zapewnia produkcyjny dostęp do multimodalnego modelu wideo ByteDance — czteromodalne dane wejściowe (tekst, obraz, wideo, dźwięk) oraz wiodący w branży system „Universal Reference”, który blokuje kompozycję, ruchy kamery i działania postaci w różnych ujęciach. Zintegruj kontrolę na poziomie reżysera za pomocą jednego wywołania API, stałej stawki 0,09 USD/s, natychmiastowego klucza i braku listy oczekujących — wszystko to przy wsparciu czasu sprawności i zgodności klasy korporacyjnej. Seedance 2.0 Native 4K jest już dostępne!

Zobacz Rodzinę

Grok Imagine

Grok Imagine API zapewnia programistom możliwość generowania obrazów, wideo i dźwięku od xAI w jednym pakiecie. Tworzy obrazy w rozdzielczości do 2K z wielojęzycznym renderowaniem tekstu, a także filmy do 15 sekund z natywnym, zsynchronizowanym dźwiękiem i edycją opartą na referencjach. W Atlas Cloud jeden klucz uruchamia każdy tryb Grok Imagine, dzięki czemu można przełączać się między obrazem, wideo i dźwiękiem bez osobnych konfiguracji, już od 0,02 USD za obraz i 0,05 USD za sekundę.

Zobacz Rodzinę

Gemini Omni Flash

Gemini Omni API wprowadza do Twojego stacku multimodalny model generowania i edycji wideo od Google DeepMind, zaprezentowany na Google I/O 2026. Gemini Omni łączy silnik rozumowania Gemini z mediami generatywnymi, przyjmując dowolną kombinację tekstu, obrazów, wideo i dźwięku, aby tworzyć spójne, oparte na wiedzy wyniki. Dopracowuj rezultaty w naturalnej rozmowie — podmieniaj obiekty, przepisuj sceny i zmieniaj style, podczas gdy fizyka, postacie i ciągłość pozostają nienaruszone. Atlas Cloud udostępnia pełną gamę Gemini Omni Flash — tekst na wideo, obraz na wideo z maksymalnie 7 obrazami referencyjnymi oraz referencję na wideo — poprzez jedno ujednolicone API z przejrzystym rozliczaniem za sekundę już od $0.112 i bez subskrypcji. Zacznij tworzyć już dziś.

Zobacz Rodzinę

GPT Image 2

API GPT Image 2 daje programistom dostęp do najnowszego modelu obrazów firmy OpenAI, następcy GPT Image 1.5. Generuje i edytuje on obrazy z dokładnym renderowaniem tekstu w skryptach łacińskich i CJK, a także zapewnia silną kompozycję dla plakatów, makiet i infografik. W Atlas Cloud można uzyskać do niego dostęp za pośrednictwem jednego zunifikowanego API wraz z ponad 300 modelami, z darmowymi kredytami, gwarantowanym czasem pracy (uptime) na poziomie 99,99% i bez wymogu weryfikacji organizacji OpenAI.

Zobacz Rodzinę

Google

Najpotężniejsze modele kreatywne Google są w pełni dostępne na platformie Atlas Cloud. Veo 3.1 zapewnia kinową generację wideo, Nano Banana 2 umożliwia tworzenie obrazów o wysokiej wierności, a Gemini wprowadza wielomodalną inteligencję do każdego przepływu pracy. Uzyskaj dostęp do pełnego pakietu modeli Google za pomocą jednego klucza API key z dostępnością Day-0 i cennikiem pay-as-you-go.

Zobacz Rodzinę

Seedance 2.0 Mini

Seedance 2.0 Mini wprowadza multimodalne generowanie wideo firmy ByteDance do przepływów pracy, w których szybkość i koszty mają największe znaczenie. Zapewnia podstawowe możliwości Seedance 2.0 przy mniejszym zużyciu zasobów — szybsze generowanie, niższy koszt na wideo i tę samą integrację API, z której już korzystasz. Dla zespołów obsługujących potoki o dużej objętości lub tworzących prototypy na dużą skalę, Mini jest praktycznym wyborem domyślnym.

Zobacz Rodzinę

ByteDance

Od generowania kinowych filmów po tworzenie obrazów o wysokiej wierności, najpotężniejsze modele ByteDance są dostępne w Atlas Cloud. Uruchamiaj Seedance i Seedream na dużą skalę z najniższymi cenami wnioskowania i zerowymi kosztami ogólnymi infrastruktury.

Zobacz Rodzinę

Alibaba

Atlas Cloud łączy pełną gamę modeli Alibaba w ramach jednego API: Qwen do zadań związanych z językiem i obrazem oraz Wan do generowania wideo w rozdzielczości do 1080p. Uzyskaj dostęp do każdego modelu w modelu płatności zgodnie z rzeczywistym użyciem (pay-as-you-go) bez subskrypcji. Alibaba API jest dostępne poprzez pojedynczy bazowy adres URL (base URL) przy użyciu istniejącego klienta kompatybilnego z OpenAI.

Zobacz Rodzinę

OpenAI

Atlas Cloud zapewnia dostęp do pełnej linii API OpenAI, od GPT Image 2 do generowania obrazów po Sora 2 do wideo. Każdy model jest dostępny w modelu płatności za użycie (pay-as-you-go) bez miesięcznych zobowiązań. Zintegruj się za pomocą jednej zmiany bazowego adresu URL, korzystając z API kompatybilnego z OpenAI.

Zobacz Rodzinę

xAI

Zbuduj kompletne potoki przetwarzania obrazów i wideo za pomocą xAI API w Atlas Cloud. Generuj w rozdzielczości 2K, edytuj za pomocą obrazów referencyjnych i animuj obrazy w klipy zsynchronizowane z dźwiękiem.

Zobacz Rodzinę

Kwaivgi

API Kwaivgi o 15% poniżej standardowej ceny. Atlas Cloud zapewnia dostęp od pierwszego dnia (Day-0) do nowych wydań Kling z modelem płatności zgodnie z użyciem (pay-as-you-go) i bez limitów stanowisk. Jedno konto, jeden klucz, każdy model Kling od poziomu standardowego po poziom master.

Zobacz Rodzinę

Seedream 5.0 Pro

Seedream 5.0 Pro API udostępnia programistom sterowalny model edycji obrazów firmy ByteDance w Atlas Cloud. Precyzyjnie rozmieszcza edycje za pomocą kotwic i współrzędnych, dzieli obrazy na edytowalne warstwy, łączy wiele odniesień oraz dopasowuje dokładne kolory i materiały, z wielojęzycznym tekstem w rozdzielczościach 2K i 3K. W Atlas Cloud można uzyskać do niego dostęp za pomocą jednego klucza!

Zobacz Rodzinę

Jedno API do całej multimedialnej AI.

Przeglądaj wszystkie modele