
Kling v2.6 to rodzina modeli wideo firmy Kuaishou przeznaczona do kinowego generowania wideo na podstawie tekstu i obrazu, tworzenia awatarów AI oraz transferu ruchu sterowanego obrazem referencyjnym. Obsługuje elastyczne proporcje obrazu, ulepszoną dynamikę, stabilną tożsamość oraz spójność czasową w ramach wyspecjalizowanych przepływów pracy. Atlas Cloud udostępnia opcje Pro i Standard za pośrednictwem spójnych endpointów, z przejrzystym cennikiem pay-as-you-go. Zacznij tworzyć już dziś.
Kling 2.6 został opracowany przez Kuaishou. Atlas Cloud (prowadzona przez Atlas Cloud AI LLC) zapewnia dostęp do modelu, ale nie jest jego właścicielem. Wszystkie znaki towarowe należą do ich odpowiednich właścicieli.
Dopasuj każdy endpoint Kling v2.6 do obsługiwanego przepływu wejściowego, jego mocnych stron produkcyjnych oraz docelowych zastosowań wideo.
| Modalność | Opis |
|---|---|
| Kling v2.6 Pro Avatar API (Avatar To Video) | Ten endpoint został zaprojektowany z myślą o generowaniu awatarów klasy premium. Tworzy wysokiej jakości wideo z wyraźnymi detalami, stabilnym ruchem i wysoką spójnością tożsamości. Sprawdza się w dopracowanych filmach profilowych, materiałach powitalnych i treściach do mediów społecznościowych. |
| Kling v2.6 Std Avatar API (Avatar To Video) | Wybierz Standard Avatar endpoint, aby tworzyć wideo z awatarami AI, wyraźnymi detalami, filmowym ruchem i niezawodną zgodnością z promptami. Jego możliwości sprawdzą się w profilach, krótkich materiałach powitalnych i regularnej produkcji treści do mediów społecznościowych. |
| Kling v2.6 Pro Motion Control API (Reference Motion To Video) | Referencyjne klipy ruchu przenoszą taniec, akcję lub gesty na obraz postaci albo wideo źródłowe, zachowując tożsamość i spójność w czasie. Wykorzystaj je do tworzenia płynnych animacji postaci zgodnych z konkretnymi nagranymi ruchami. |
| Kling v2.6 Std Motion Control API (Image And Motion To Video) | Animuj statyczny obraz postaci, dostarczając klip ruchu zawierający taniec, akcję lub gest. Endpoint wyodrębnia ten ruch i generuje płynne, realistyczne wideo na potrzeby łatwo dostępnych przepływów transferu ruchu. |
| Kling v2.6 Pro API (Text To Video) | Za pomocą tego modelu Kuaishou prompty tekstowe zamieniają się w filmowe wideo z generowanym dźwiękiem i elastycznymi proporcjami obrazu. Obsługuje opracowywanie koncepcji, sceny narracyjne, reklamy i inne projekty wideo sterowane promptami. |
| Kling v2.6 Pro API (Image To Video) | Na podstawie obrazu ten endpoint tworzy filmowe wideo z generowaniem dźwięku i wzbogaconą dynamiką. Ożywiaj wizualizacje produktów, ilustracje lub kreatywne obrazy statyczne, gdy istotne jest zachowanie kontrolowanej ciągłości wizualnej. |
Kling v2.6 łączy natywną generację audiowizualną, przepływy pracy oparte na tekście i obrazach, sterowanie ruchem na podstawie materiału referencyjnego, awatary sterowane dźwiękiem, elastyczne parametry oraz dostęp w modelu pay as you go do endpointów Standard i Pro.
Kling v2.6 Pro może generować jednocześnie obraz i dźwięk na podstawie promptu tekstowego lub obrazu źródłowego. Przełącznik dźwięku jest domyślnie włączony w endpointach Atlas Cloud Text to Video i Image to Video. Dzięki temu dialogi, efekty i atmosfera mogą podążać za rozwojem sceny. To doskonałe rozwiązanie do krótkich klipów narracyjnych, które wymagają spójnego rezultatu audiowizualnego bez osobnego etapu opracowywania dźwięku.
Rozpocznij od opisu sceny lub animuj statyczny obraz za pomocą endpointów generowania Pro. Prompty tekstowe obsługują wyjścia w proporcjach 1:1, 9:16 i 16:9, a obie ścieżki oferują długość 5 lub 10 sekund, przełącznik dźwięku, prompty negatywne oraz sterowanie CFG w zakresie od 0 do 1. Dane obrazowe mogą być plikami JPG, JPEG lub PNG o rozmiarze do 10 MB, zapewniając programistom praktyczną kontrolę nad materiałami do mediów społecznościowych, produktowymi i filmowymi.
Przekaż obraz postaci oraz klip referencyjny z ruchem do Kling v2.6 Motion Control, który przenosi pełne sekwencje tańca, akcji lub gestów, zachowując tożsamość i spójność w czasie. Filmy referencyjne mogą trwać od 3 do 30 sekund. Wybierz, czy kompozycja ma podążać za obrazem, czy za filmem z ruchem, oraz zdecyduj, czy zachować dźwięk źródłowy. Rezultat sprawdzi się w przypadku ciągłych występów, animacji postaci i kampanii opartych na dynamicznej akcji.
Obraz i ścieżka audio to wymagane dane wejściowe dla endpointów Standard i Pro Avatar, a opcjonalny prompt może dodatkowo ukierunkować rezultat. Pro zapewnia wyraźne detale, stabilny ruch i wysoką spójność tożsamości, podczas gdy Standard łączy filmowy ruch z niezawodnym trzymaniem się promptu. Wybierz tę ścieżkę, gdy rozpoznawalna postać ma odtworzyć przygotowany dźwięk w filmach profilowych, prezentacjach marki lub regularnie publikowanych treściach w mediach społecznościowych.
Dobierz endpointy Standard lub Pro do charakteru obciążenia, a następnie płać wyłącznie za wywołania realizowane za pośrednictwem Atlas Cloud. Standard Avatar zaczyna się od $0.056 za wywołanie, Standard Motion Control od $0.07, Pro Text to Video i Image to Video od $0.07, a Pro Avatar lub Motion Control od $0.112. Jedno konto obejmuje wszystkie sześć endpointów, pomagając programistom równoważyć jakość obrazu, wymagania dotyczące ruchu i koszty produkcji bez konieczności wykupywania subskrypcji.
Zobacz, jak Kling v2.6 i dwie alternatywy Atlas Cloud interpretują identyczne prompty w realistycznej akcji i stylizowanej narracji.
8–10-sekundowy hiperrealistyczny film reklamowy o modzie, rozgrywający się w południe na rozległym białym jeziorze solnym: sześciu szybkich łyżwiarzy w opalizujących, lustrzanych pelerynach tworzy precyzyjny geometryczny „zespół do zbioru soli w kształcie latawca”, z których każdy ciągnie napięte kobaltowoniebieskie i fluorescencyjnopomarańczowe linki połączone z gigantycznym latawcem w kształcie płaszczki. Rozpocznij od pionowego ujęcia dronem z góry, gdy zsynchronizowana formacja wycina ostre jak brzytwa wzory w skorupie solnej; dron nagle nurkuje i wyrównuje lot kilka centymetrów nad ziemią, przyspieszając za liderem, gdy zespół slalomem pokonuje trzepoczące bramki z flag, a peleryny trzaskają i liny naprężają się z realistyczną siłą. Gwałtowne przesunięcie panoramy w szybki obrót 360 stopni, gdy nagle obok nich pojawia się diabeł pyłowy, wprawiając luźne kryształki soli w spiralny wir; sześciu zawodników reaguje idealnie synchronicznie, gwałtownie nawija linki, a latawiec-płaszczka składa się w dramatyczne nurkowanie z dużą siłą, przebija się przez wir kryształów i rozrzuca lśniącą sól niczym olśniewający śnieg nad pędzącym zespołem. Ciągła, skoordynowana akcja od początku do końca, spójne tożsamości i formacja w każdym ujęciu, przekonująca dynamika jazdy, fizycznie poprawne napięcie lin, aerodynamiczny ruch tkaniny, ziarniste cząsteczki soli, turbulencje powietrza i realistyczne cienie na podłożu. Ostre, bezlitosne światło z góry, wyraziste oświetlenie z wysokim kontrastem, pryzmatyczne tęczowe refleksy na lustrzanych pelerynach i powierzchni soli, warstwowa kompozycja w odcieniach śnieżnej bieli, kobaltowego błękitu i fluorescencyjnej pomarańczy, ekskluzywna, surrealistyczna estetyka reklamy haute couture, niezwykle ostry kinowy detal, energetyczna perkusja zsynchronizowana z każdym cięciem i przejściem kamery, pędzący wiatr, zgrzyt ostrzy, trzaskająca tkanina, napinające się liny, a na koniec jasny, krystaliczny syk. Bez zwolnionego tempa, bez statycznych ujęć wypełniających, bez cięć przerywających ciągłość przestrzenną, bez zdeformowanych ciał, bez zduplikowanych osób, bez splątanych lub odłączonych lin, bez niespójnych kostiumów, bez unoszących się obiektów, bez ekranów, interfejsów oprogramowania, pulpitów, pasków postępu, wykresów, podpisów, logotypów, znaków wodnych ani czytelnego tekstu. Proporcje obrazu 16:9.
Generated with Kling v2.6 Pro Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Fast Text-to-Video on Atlas Cloud
8–10-sekundowy, ciągły, kinowy pościg głębinowy wewnątrz stromo przechylonej sali balowej niszczejącego wraku statku: rozpocznij od ekstremalnego ujęcia makro półprzezroczystej macki ośmiornicy mimetycznej, migoczącej wśród popękanych kryształów żyrandola podczas chwytania świecącej „perły”; szybko wykonaj najazd z odjazdem kamery, aby ukazać ośmiornicę huśtającą się na skorodowanej balustradzie nad przewróconymi stołami jadalnymi, podczas gdy węgorze murenowate wiją się między krzesłami i ruszają za nią w pościg, a sztućce, odłamki szkła, osad i łańcuchy bąbli unoszą się oraz zderzają zgodnie z wiarygodnymi prawami fizyki pod wodą. Przejdź do ciasnego ujęcia pościgowego z ciągłym obrotem 360 stopni, gdy ośmiornica nieustannie zmienia fakturę i przezroczystość skóry, dopasowując je do aksamitnych zasłon, spatynowanego mosiądzu i porośniętego pąklami drewna, po czym wypuszcza gęstą chmurę atramentu, która zwija się w przekonującą przynętę w kształcie ośmiornicy; węgorze atakują fałszywą sylwetkę, a prawdziwa ośmiornica wymyka się obok nich. Gwałtownie przesuń panoramę i przechyl kamerę do dramatycznie skośnego ujęcia z góry: skradziona „perła” nagle otwiera maleńkie oko, jej bursztynowa poświata się nasila, a pod stołem bankietowym wyłania się ogromna, zakamuflowana twarz żabnicy — perła jest jej przynętą; ośmiornica zastyga na jeden komiczny moment, gdy żabnica rzuca się w stronę kamery. Fotorealistyczny kinowy realizm głębinowy, zimne cyjanowe światło otoczenia skontrastowane z ciepłą bursztynową bioluminescencją, wolumetryczna woda, dryfujące cząsteczki, bogaty w detale ruch macek o miękkiej strukturze, symulacja płynów, zderzenia unoszących się obiektów, płynna ciągłość postaci, fizycznie wiarygodna dynamika, wyraźna i czytelna akcja, bez zwolnionego tempa. Immersyjny, zsynchronizowany dźwięk: stłumione skrzypienie kadłuba, brzęk kryształów, pędzące bąble, kłapnięcia węgorzy, pulsująca perkusja pościgu, mokry wybuch atramentu, a następnie nagły basowy akcent przy ujawnieniu. Bez ekranów, interfejsów, pulpitów, pasków postępu, wykresów, podpisów, napisów, logotypów, znaków wodnych ani tekstu objaśniającego. Proporcje obrazu 16:9.
Generated with Kling v2.6 Pro Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Fast Text-to-Video on Atlas Cloud
Od filmowych promptów i animowanych materiałów kampanii po spójne awatary i występy z ruchem sterowanym referencją — Kling v2.6 wspiera deweloperów tworzących filmy, reklamy, treści do mediów społecznościowych i markowe postacie.
Przekształcaj opisane koncepcje w filmowe wideo za pomocą Kling v2.6 Pro Text to Video, korzystając z elastycznych proporcji obrazu i generowanego dźwięku. Twórcy filmowi mogą prototypować zwiastuny, dramatyczne sceny i prezentacje wizualne na podstawie pojedynczego promptu.
Ożywiaj zdjęcie produktu lub materiał kampanii dzięki większej dynamice, filmowej jakości i generowanemu dźwiękowi. Zespoły marketingowe mogą tworzyć zajawki premierowe, demonstracje wizualne i promocje w mediach społecznościowych na bazie istniejących materiałów graficznych.
Twórz dopracowane filmy z awatarami, oferujące wyraźne detale, stabilny ruch i spójną tożsamość dzięki modelowi Pro Avatar. Wykorzystuj je do przedstawiania profili, segmentów prezenterskich i powracających, markowych osobowości w mediach społecznościowych.
Przenoś nagrania tańca, akcji lub gestów na obraz postaci, zachowując jej tożsamość i spójność w czasie. Twórcy mogą przygotowywać testy choreografii, animowane maskotki i klipy występów do mediów społecznościowych na podstawie zarejestrowanego ruchu.
Nadaj obrazowi postaci lub wideo źródłowemu ruch z klipu referencyjnego za pomocą Pro Motion Control. Zespoły produkcyjne mogą testować alternatywnych wykonawców, stylizowane sekwencje akcji i spójną animację postaci.
Zacznij od promptu tekstowego i generuj filmowe wideo z dźwiękiem w elastycznych proporcjach obrazu. Deweloperzy mogą automatyzować koncepcje krótkich kampanii, treści twórców i materiały wizualne dopasowane do konkretnych platform bez dostarczania obrazu początkowego.
Porównaj Kling v2.6 z wiodącymi modelami text-to-video pod kątem dostawcy, długości klipu, natywnego dźwięku i standardowej ceny bazowej.
| Model | Dostawca | Długość wyjściowa | Natywny dźwięk | Standardowa cena bazowa |
|---|---|---|---|---|
| Kling v2.6 Pro Text-to-Video | Kuaishou | 5 lub 10 sekund | √ | $0.07/sekundę |
| Seedance 2.0 Text-to-Video | ByteDance | od 4 do 15 sekund | √ | $0.112/sekundę |
| Wan-2.7 Text-to-video | Qwen | od 2 do 15 sekund | √ | $0.10/sekundę |
| Veo 3.1 Lite Text-to-video | 4, 6 lub 8 sekund | √ | $0.05/sekundę |
Zacznij w kilka minut — wykonaj te proste kroki, aby zintegrować i wdrożyć modele za pośrednictwem platformy Atlas Cloud.
Zarejestruj się na atlascloud.ai i ukończ weryfikację. Nowi użytkownicy otrzymują bezpłatne kredyty do eksploracji platformy i testowania modeli.
Połączenie zaawansowanych modeli Kling 2.6 z platformą GPU-akcelerowaną Atlas Cloud zapewnia niezrównaną wydajność, skalowalność i doświadczenie deweloperskie.
Niska Latencja:
Inferencja zoptymalizowana pod GPU dla rozumowania w czasie rzeczywistym.
Zunifikowane API:
Uruchamiaj Kling 2.6, GPT, Gemini i DeepSeek za pomocą jednej integracji.
Przejrzysta Wycena:
Przewidywalne rozliczenia za token z opcjami serverless.
Doświadczenie Dewelopera:
SDK, analityka, narzędzia dostrajania i szablony.
Niezawodność:
99,99% dostępności, RBAC i logowanie gotowe na zgodność.
Bezpieczeństwo i Zgodność:
SOC 2 Type II, zgodność z HIPAA, suwerenność danych w USA.
Kling v2.6 to rodzina modeli wideo AI firmy Kuaishou dostępna za pośrednictwem Atlas Cloud. Obejmuje generowanie Pro text-to-video i image-to-video, a także endpointy Standard i Pro do tworzenia awatarów i sterowania ruchem.
Możesz tworzyć filmy na podstawie promptów, animować obrazy źródłowe, generować filmy z awatarami na podstawie obrazu i dźwięku albo przenosić sekwencje tańca, ruchów i gestów z klipów referencyjnych. Endpointy Pro text-to-video i image-to-video mogą generować dźwięk jednocześnie z obrazem.
Wybierz Text-to-Video, jeśli zaczynasz od promptu, oraz Image-to-Video, jeśli chcesz animować nieruchomy obraz. Endpointy Avatar łączą obraz z dostarczonym dźwiękiem, natomiast Motion Control przenosi ruch z referencyjnego filmu na postać.
Wyślij żądanie POST do `/api/v1/model/generateVideo` z kluczem API Atlas Cloud, dokładnym identyfikatorem modelu i danymi wejściowymi właściwymi dla danego endpointu. Odpowiedź asynchroniczna zawiera identyfikator predykcji, który możesz sprawdzać za pośrednictwem `/api/v1/model/prediction/{id}` aż do zakończenia zadania.
Dostępne opcje zależą od endpointu. Text-to-video obsługuje prompty, negatywne prompty, proporcje obrazu 1:1, 9:16 i 16:9, czas trwania 5 lub 10 sekund, dźwięk oraz guidance scale, podczas gdy pozostałe przepływy pracy mogą dodatkowo wymagać obrazu, dźwięku, filmu z ruchem, orientacji lub ustawień zachowania dźwięku — zależnie od przypadku.
W przypadku Pro text-to-video i image-to-video parametr `sound` steruje jednoczesnym generowaniem dźwięku. Modele Avatar wymagają natomiast danych audio wraz z obrazem postaci, a Motion Control może zachować oryginalny dźwięk z filmu referencyjnego.
Atlas Cloud podaje standardowe stawki w wysokości $0.07 za sekundę dla Pro Text-to-Video, Pro Image-to-Video i Standard Motion Control. Standard Avatar kosztuje $0.056 za sekundę, natomiast Pro Avatar i Pro Motion Control — $0.112 za sekundę; są to stawki podstawowe, a nie promocyjne.
Przygotuj obraz postaci w formacie JPG, JPEG lub PNG oraz film z ruchem w formacie MP4 lub MOV. Każdy plik może mieć maksymalnie 10 MB, musi mieć co najmniej 300 pikseli w obu wymiarach i proporcje obrazu między 1:2.5 a 2.5:1.
Najpierw sprawdź identyfikator modelu, uwierzytelnianie Bearer, wymagane pola oraz ograniczenia dotyczące multimediów właściwe dla danego endpointu. Jeśli zadanie zostało zaakceptowane, sprawdzaj jego identyfikator predykcji aż do zakończenia lub niepowodzenia i przeanalizuj zwrócony błąd. W przypadku niespójności wizualnych uprość scenę i użyj wyraźnych materiałów źródłowych, szczególnie podczas przenoszenia ruchów twarzy lub interakcji ze złożonymi obiektami.
Poradniki, samouczki i nowości produktowe, dzięki którym w pełni wykorzystasz Atlas Cloud.