
Kling 1.6 to model generowania wideo firmy Kuaishou, stworzony do przekształcania promptów i obrazów referencyjnych w spójne krótkie materiały wideo. Zapewnia lepszą reakcję na ruch, działania w czasie i ruchy kamery, jednocześnie zwiększając spójność obiektów, dokładność kolorów, dynamikę oświetlenia oraz szczegółowość renderowania. Uzyskaj dostęp do całej rodziny modeli za pośrednictwem Atlas Cloud, korzystając z jednego klucza zgodnego z OpenAI i przejrzystego rozliczenia według zużycia. Zacznij tworzyć już dziś.
Kling 1.6 został opracowany przez Kuaishou. Atlas Cloud (prowadzona przez Atlas Cloud AI LLC) zapewnia dostęp do modelu, ale nie jest jego właścicielem. Wszystkie znaki towarowe należą do ich odpowiednich właścicieli.
Sprawdź, jak każdy endpoint Kling 1.6 obsługuje dane wejściowe w postaci tekstu lub obrazu oraz gdzie najlepiej sprawdzają się jego zweryfikowane możliwości w zakresie ruchu, spójności, szczegółowości i wydajności.
| Modalność | Opis |
|---|---|
| Kling 1.6 Multi I2V Pro API (Multi Image To Video) | Przekształcaj obrazy w wideo z wieloma obiektami, korzystając z lepszej spójności i zaawansowanej dokładności śledzenia ruchu. Ten endpoint Pro sprawdza się w złożonych scenach, w których istotne są skoordynowane ruchy obiektów i spójność wizualna. |
| Kling 1.6 Multi I2V Standard API (Multi Image To Video) | Ten endpoint jest przeznaczony do ekonomicznego generowania wideo z wieloma obiektami — przekształca obrazy w wideo, zachowując równowagę między szybkością a szczegółowością. Sprawdza się przy podstawowej animacji scen i rutynowej produkcji treści z wieloma obiektami. |
| Kling 1.6 T2V Standard API (Text To Video) | Monity tekstowe są przekształcane w krótkie filmy ze stabilnym ruchem i niezawodną zgodnością z monitem. Ten podstawowy endpoint służy do wizualizacji koncepcji, tworzenia treści do mediów społecznościowych i prostych sekwencji sterowanych monitem. |
| Kling 1.6 I2V Pro API (Image To Video) | Na podstawie nieruchomego obrazu endpoint Pro tworzy wideo z płynniejszym łączeniem ruchu i lepszym realizmem tekstur. Dobrze sprawdza się przy dopracowanych wizualizacjach produktów, ujęciach postaci i kinowej animacji obrazów. |
| Kling 1.6 I2V Standard API (Image To Video) | Wybierz ten lekki endpoint, aby przekształcać obrazy w wideo w ramach podstawowego procesu generowania. Niski koszt sprawia, że nadaje się do prostych animacji, wczesnych testów kreatywnych i produkcji na większą skalę. |
Kling 1.6 łączy generowanie na podstawie tekstu, pojedynczego obrazu oraz maksymalnie czterech obrazów referencyjnych, oferując materiały o długości 5 lub 10 sekund, kontrolę zgodności z promptem, opcjonalne negatywne prompty, wybrane proporcje obrazu oraz dostęp do wersji Standard lub Pro przez jedno API Atlas Cloud.
Kling 1.6 obsługuje generowanie tekstu do wideo i obrazu do wideo za pomocą dedykowanych wariantów. Zacznij od opisu sceny albo animuj obraz źródłowy, a następnie steruj akcją za pomocą promptów o długości do 2,500 znaków. Modele Standard kładą nacisk na efektywność kosztową, natomiast wariant obrazu Pro zapewnia płynniejsze łączenie ruchu i bardziej realistyczne tekstury. Ten zakres możliwości sprawdza się przy testowaniu koncepcji, tworzeniu klipów do mediów społecznościowych i dopracowanych sekwencji wizualnych.
Prześlij od jednego do czterech obrazów referencyjnych za pomocą wariantu Multi I2V Standard lub Pro. Model wykorzystuje je jako odniesienia wizualne, podczas gdy prompt określa obiekty, ruch i rozwój sceny. Wersja Pro została dostrojona pod kątem lepszej spójności wielu obiektów i dokładniejszego śledzenia ruchu. Sprawdza się przy interakcjach postaci, łączeniu produktów oraz scenach zestawiających wiele elementów wizualnych.
Ustaw obraz początkowy oraz opcjonalny obraz końcowy za pomocą wariantu I2V Pro, aby określić początek i zakończenie klipu. Każdy obraz może być w formacie JPG, JPEG lub PNG, mieć maksymalnie 10 MB i co najmniej 300 na 300 pikseli. Dodaj instrukcje ruchu między tymi wizualnymi punktami odniesienia. Ta funkcja jest szczególnie przydatna przy planowaniu przejść, zmian pozy i prezentacji produktów.
Płynny ruch to jeden z kluczowych atutów wariantu obrazu Pro, który oferuje ulepszone łączenie ruchu i bardziej realistyczne tekstury zgodnie z profilem w Atlas Cloud. Skala sterowania od 0 do 1 reguluje zgodność z promptem, a negatywne prompty pomagają unikać niepożądanych elementów. Użyj tych ustawień, aby zrównoważyć naturalny ruch z precyzyjnie kierowaną akcją. To połączenie sprawdza się przy wymagającym ruchu postaci, tkanin i kamery.
W całej rodzinie Kling 1.6 możesz wybrać materiał wyjściowy o długości 5 lub 10 sekund. Warianty tekstowe i wieloobrazowe obsługują również proporcje obrazu 16:9, 9:16 i 1:1, dzięki czemu jeden workflow może być przeznaczony do formatów panoramicznych, pionowych lub kwadratowych. Limit promptu wynoszący 2,500 znaków pozostawia miejsce na opis obiektu, akcji, oświetlenia i ruchu kamery. Te opcje pomagają zespołom planować materiały dopasowane do konkretnych platform bez zmiany rodziny modeli.
Uruchamiaj każdy wymieniony wariant Kling 1.6 za pośrednictwem jednego API generowania wideo Atlas Cloud, z rozliczeniem za każde użycie. Warianty Standard mają zweryfikowaną pierwotną cenę bazową $0.056 za uruchomienie, a warianty Pro — $0.098 za uruchomienie. Wybierz poziom odpowiadający wymaganemu kompromisowi między kosztem, szczegółowością i jakością ruchu. Taka konfiguracja wspiera szybkie eksperymenty i potoki produkcyjne bez osobnych integracji z dostawcami.
Zobacz, jak Kling 1.6 i dwa alternatywne modele wideo interpretują identyczne prompty w realistycznych scenach akcji i stylizowanej narracji.
Kinowa, trwająca 8–10 sekund miniaturowa sekwencja aktorska we wnętrzu pracowni szklarskiej o północy: młody rzemieślnik nieprzerwanie obraca piszczel szklarską, podczas gdy biało rozgrzana szklana bańka szybko się powiększa, a jej idealnie okrągły kształt stanowi wizualną oś kompozycji. Rozpocznij od ekstremalnego makro-ujęcia orbitalnego wokół wirującego stopionego szkła, rejestrując rozciągające się przezroczyste bursztynowe włókna, lepkie napięcie powierzchniowe, migotanie rozgrzanego powietrza, drobne iskry i realistyczne załamania światła wewnątrz szkła. Nabrzmiała bańka nagle zsuwa się z piszczeli, uderza w srebrzystoszary metalowy stół i szybko się toczy; przejdź do ujęcia śledzącego z poziomu stołu, rejestrowanego w wysokiej prędkości, podążającego tuż obok niej, gdy chwieje się, odkształca, zrzuca świecące włókna i odbija kobaltowoniebieskie światło księżyca na tle pomarańczowej poświaty pieca. Wykonaj gwałtowne panoramowanie w stronę zaniepokojonego rzemieślnika, który rzuca się przez stół i w ostatniej chwili łapie uciekające szkło mokrą drewnianą łopatką — wybuchowy syk wprawia w fizycznie wiarygodny wir pary w całym kadrze. Gdy para się rozwieje, ujawnij, że szkło cudownie zamarzło w postaci małej, przezroczystej rozdymki z delikatnymi szklanymi płetwami i równomiernie rozmieszczonymi pęcherzykami wewnątrz; rybka raz delikatnie nadyma policzki — zabawny finałowy akcent. Płynny, ciągły ruch, spójna transformacja obiektu, realistyczna lepkość szkła, zderzenia, żar termiczny, iskry, załamania światła, kaustyka, deformacja cieplna i fizyka pary; warstwowa paleta bursztynu, kobaltu i srebrzystej szarości; pomarańczowe światło główne z pieca, chłodne księżycowo-niebieskie światło konturowe, mała głębia ostrości, dotykowa estetyka wysokobudżetowego filmowania praktycznych miniatur, fotorealistyczna faktura kinowa, bez slow motion, bez statycznych wypełniaczy, ekranów, interfejsów oprogramowania, pulpitów, pasków postępu, wykresów, podpisów, tekstu, logotypów ani znaków wodnych. Zsynchronizowany dźwięk: ryczący piec, szuranie obracanej piszczeli, ostry metaliczny brzęk, grzechot toczącego się szkła, pospieszny krok, głośny mokry syk, a następnie cichutkie krystaliczne puffnięcie; napięty rytm perkusyjny zakończony figlarnym szklanym brzmieniem. Proporcje obrazu 16:9.
Generated with Kling v1.6 Multi i2v Pro on Atlas Cloud
Generated with Seedance 2.0 Image-to-Video on Atlas Cloud
Generated with Kling v1.6 i2v Standard on Atlas Cloud
Napięta, trwająca 9 sekund mikroopowieść w ciasnej kuchni na zapleczu nocnego hongkońskiego baru z makaronem: młody kucharz pilnie ratuje zamówienie ramenu, poruszając się bez przerwy i wykonując precyzyjną, wiarygodną choreografię dłoni. Rozpocznij od ekstremalnie niskiego, bocznego ujęcia śledzącego, sunącego nad deską do krojenia oprószoną mąką, gdy kucharz gwałtownie wykonuje ruch nadgarstkami i wyrzuca długi kłąb makaronu wysoko w powietrze; podążaj za skręcającymi się nitkami przez gęstą parę, pokazując, jak poszczególne nitki wyginają się, rozciągają i naturalnie zasłaniają jego dłonie oraz wiszące naczynia. Wykonaj gwałtowne panoramowanie do ciasnego ujęcia od strony kuchenki, gdy kłąb makaronu niemal wpada w liżący go płomień gazu; w ostatniej chwili kucharz rzuca się do przodu i czysto łapie go do drucianego cedzaka, którego siatka ugina się pod ciężarem, po czym jednym płynnym ruchem obraca się i zanurza makaron w gwałtownie wrzącym bulionie, rozpryskując realistyczne krople, bąble i tłuste zmarszczki na powierzchni garnka. Przejdź do ujęcia z góry, dokładnie pionowego, gdy makaron rozwija się w zgrabną, kwitnącą spiralę w zupie; przez okienko wydawcze oczekujący goście pochylają się i wybuchają zachwyconymi oklaskami, a kucharz posyła im zdyszany uśmiech. Zachowaj idealną ciągłość tego samego kucharza, ubrania, przyborów, kłębu makaronu, układu kuchni i ruchu we wszystkich cięciach. Ścisła, wieloplanowa inscenizacja stale koordynuje kucharza, makaron, płomienie, garnki i przybory na pierwszym planie; dotykowe warstwy unoszącej się mąki, odbić na mokrych płytkach, lśniącego oleju, skroplin i kłębiącej się pary. Fotorealistyczna estetyka kina hongkońskiego, kinetyczna energia ujęć z ręki, wyraźne naturalne rozmycie ruchu, ciepłe praktyczne światła w odcieniu pomarańczowego wolframu kontrastujące z chłodnymi cyjanowymi płytkami ceramicznymi, bogaty kontrast, subtelne ziarno filmu 35mm, realistyczna faktura skóry i jedzenia. Zsynchronizowany dźwięk: stukot noża o deskę, ryk płomienia gazowego, pędząca para, brzęk cedzaka, chlupot wrzącego bulionu, a następnie ostry wybuch oklasków; szybki perkusyjny rytm kuchni, bez dialogów. Bez slow motion, zamrożonych póz, pustych ujęć ustanawiających, luk montażowych, skokowej ciągłości, dodatkowych palców, zdeformowanych dłoni, zdublowanych kończyn, uszkodzonych przyborów, przenikania geometrii, teleportującego się makaronu, gumowatego ruchu, niemożliwego zachowania płynów, unoszących się obiektów, UI, ekranów, pulpitów, pasków postępu, wykresów, podpisów, napisów, logotypów ani widocznego tekstu. Proporcje obrazu 16:9.
Generated with Kling v1.6 Multi i2v Pro on Atlas Cloud
Generated with Seedance 2.0 Image-to-Video on Atlas Cloud
Generated with Kling v1.6 i2v Standard on Atlas Cloud
Kling 1.6 zamienia prompty i obrazy źródłowe w krótkie koncepcje wideo na potrzeby storyboardów, kampanii produktowych, scen z wieloma obiektami, animowanych grafik, wariantów do mediów społecznościowych i narracji z udziałem postaci.
Przekształcaj opisane pomysły w krótkie szkice wideo ze stabilnym ruchem i niezawodną zgodnością z promptami. Reżyserzy, agencje i zespoły produktowe mogą ocenić tempo, akcję i kierunek wizualny przed rozpoczęciem pełnej produkcji.
Animuj statyczne ujęcia produktów, korzystając z płynniejszego łączenia ruchu i bardziej realistycznych tekstur. Zespoły marketingowe mogą przekształcać zdjęcia katalogowe w dopracowane klipy premierowe, prezentacje funkcji i materiały kampanii bez organizowania nowej sesji zdjęciowej.
Łącz obiekty z osobnych obrazów, zachowując większą spójność sceny i dokładnie śledząc ich ruch. Twórz interakcje postaci, ujęcia zespołowe lub narracje lifestyle’owe na potrzeby treści brandowych i kampanii w mediach społecznościowych — na dużą skalę.
Animuj statyczne grafiki, korzystając z płynniejszego łączenia ruchu i większego realizmu tekstur w wariancie Pro image-to-video. Artyści i zespoły tworzące gry mogą generować animowane koncepcje, sceny z postaciami lub nastrojowe studia scen na podstawie istniejących materiałów wizualnych.
Zacznij od promptu lub obrazu źródłowego, aby tworzyć krótkie koncepcje wideo ze stabilnym lub płynnie łączonym ruchem. Twórcy mogą opracowywać wiele mocnych otwarć, opraw wizualnych i kierunków kampanii na potrzeby kanałów społecznościowych.
Gdy kilka obiektów musi współdzielić jedną scenę, warianty Multi stawiają na spójność i zaawansowane śledzenie ruchu. Używaj ich do tworzenia par postaci, interakcji ze zwierzętami domowymi, scen grupowych lub testów narracyjnych na podstawie obrazów.
Porównaj warianty Kling 1.6 z innymi modelami wideo dostępnymi w Atlas Cloud pod kątem przepływów wejściowych, czasu trwania klipu, natywnego dźwięku i standardowych cen.
| Model | Sposób wprowadzania | Czas trwania wyniku | Natywny dźwięk | Cena standardowa |
|---|---|---|---|---|
| Kling v1.6 Multi i2v Pro | Prompt + od 1 do 4 obrazów | 5 lub 10 sekund | - | $0.098/uruchomienie |
| Kling v1.6 Multi i2v Standard | Prompt + od 1 do 4 obrazów | 5 lub 10 sekund | - | $0.056/uruchomienie |
| Kling v1.6 t2v Standard | Prompt tekstowy | 5 lub 10 sekund | - | $0.056/uruchomienie |
| Kling v1.6 i2v Pro | Prompt + klatka początkowa + opcjonalna klatka końcowa | 5 lub 10 sekund | - | $0.098/uruchomienie |
| Kling v1.6 i2v Standard | Prompt + klatka początkowa | 5 lub 10 sekund | - | $0.056/uruchomienie |
| Wan-3.0 Image-to-video | Prompt + klatka początkowa + opcjonalna klatka końcowa | od 2 do 30 sekund | √ | $0.05/sekundę |
| MiniMax H3 Image-to-Video | Prompt + klatka początkowa + opcjonalna klatka końcowa | od 4 do 15 sekund | √ | $0.038/sekundę |
Zacznij w kilka minut — wykonaj te proste kroki, aby zintegrować i wdrożyć modele za pośrednictwem platformy Atlas Cloud.
Zarejestruj się na atlascloud.ai i ukończ weryfikację. Nowi użytkownicy otrzymują bezpłatne kredyty do eksploracji platformy i testowania modeli.
Połączenie zaawansowanych modeli Kling 1.6 z platformą GPU-akcelerowaną Atlas Cloud zapewnia niezrównaną wydajność, skalowalność i doświadczenie deweloperskie.
Niska Latencja:
Inferencja zoptymalizowana pod GPU dla rozumowania w czasie rzeczywistym.
Zunifikowane API:
Uruchamiaj Kling 1.6, GPT, Gemini i DeepSeek za pomocą jednej integracji.
Przejrzysta Wycena:
Przewidywalne rozliczenia za token z opcjami serverless.
Doświadczenie Dewelopera:
SDK, analityka, narzędzia dostrajania i szablony.
Niezawodność:
99,99% dostępności, RBAC i logowanie gotowe na zgodność.
Bezpieczeństwo i Zgodność:
SOC 2 Type II, zgodność z HIPAA, suwerenność danych w USA.
Kling 1.6 to rodzina modeli do generowania wideo opracowana przez Kuaishou. W Atlas Cloud obsługuje generowanie tekstu na wideo, pojedynczego obrazu na wideo oraz wielu obrazów na wideo za pośrednictwem pięciu endpointów Standard i Pro. Poszczególne warianty oferują stabilny ruch, zgodność z promptem, płynniejsze łączenie ruchu, realistyczne tekstury oraz spójność wielu obiektów.
Zamieniaj prompty tekstowe w oryginalne sceny wideo, animuj pojedynczy obraz początkowy lub łącz wiele obrazów referencyjnych w kompozycji obejmującej wiele obiektów. W zależności od endpointu możesz generować klipy trwające 5 lub 10 sekund.
Wybierz T2V Standard do generowania na podstawie tekstu oraz I2V Standard do ekonomicznej animacji jednego obrazu. I2V Pro zapewnia płynniejsze łączenie ruchu i bardziej realistyczne tekstury. W przypadku kilku obiektów lub obrazów referencyjnych wybierz Multi I2V Standard albo Multi I2V Pro, zależnie od wymagań dotyczących kosztów i spójności.
Utwórz klucz API w panelu Atlas Cloud, a następnie wyślij żądanie JSON do POST /api/v1/model/generateVideo, używając tokenu Bearer. Uwzględnij dokładny identyfikator modelu, prompt oraz wymagany obraz lub obrazy dla endpointów opartych na obrazach. Zapisz zwrócony identyfikator predykcji i użyj go do pobrania wyniku asynchronicznego.
Każdy endpoint wymaga identyfikatora modelu oraz promptu o długości do 2,500 znaków. Generowanie tekstu na wideo obsługuje proporcje obrazu, czas trwania, skalę zgodności oraz negatywne prompty, natomiast endpointy dla pojedynczego obrazu wymagają obrazu początkowego w formacie JPG, JPEG lub PNG. Endpointy dla wielu obrazów akceptują od jednego do czterech obrazów referencyjnych i oferują również ustawienia czasu trwania, proporcji obrazu oraz negatywnego promptu.
Wszystkie pięć endpointów Atlas Cloud obsługuje generowanie trwające 5 lub 10 sekund, przy czym udokumentowaną wartością domyślną jest 5 sekund. Endpointy generowania tekstu na wideo oraz wielu obrazów akceptują proporcje 16:9, 9:16 lub 1:1. Procesy dla pojedynczego obrazu określają kadrowanie na podstawie dostarczonego obrazu źródłowego, zamiast udostępniać ten sam parametr proporcji obrazu.
Przy standardowych cenach katalogowych endpointy T2V Standard, I2V Standard i Multi I2V Standard kosztują $0.056 za każdą wygenerowaną sekundę wideo. I2V Pro i Multi I2V Pro kosztują $0.098 za każdą wygenerowaną sekundę wideo, a rozliczenie odbywa się według zużycia.
Najpierw sprawdź token Bearer, dokładny identyfikator modelu, wymagany prompt oraz wszystkie wymagane pola obrazu. Przed ponownym wysłaniem nieprawidłowego żądania sprawdź udokumentowane ograniczenia dotyczące długości promptu, formatu obrazu, rozmiaru pliku, rozdzielczości, czasu trwania i zakresów parametrów. Ponieważ generowanie jest asynchroniczne, zachowaj identyfikator predykcji i kontynuuj odpytywanie endpointu wyników, dopóki jego status pozostaje processing.
Poradniki, samouczki i nowości produktowe, dzięki którym w pełni wykorzystasz Atlas Cloud.