
Kling v2.1 to rodzina modeli AI do generowania wideo firmy Kuaishou, przeznaczona dla deweloperów tworzących produkcyjne przepływy pracy związane z wideo. Rodzina obsługuje szybkie tworzenie wersji roboczych w rozdzielczości 720p, ostrą i płynną animację obrazów, profesjonalną głębię wizualną, interpretację złożonych promptów, zaawansowaną logikę ruchu oraz ulepszone renderowanie dynamicznych ujęć kamery. Uzyskaj dostęp do tych możliwości za pośrednictwem ujednoliconego API Atlas Cloud, korzystając z jednego klucza zgodnego z OpenAI i dostępu do modeli od dnia ich premiery. Zacznij tworzyć już dziś.
Kling 2.1 został opracowany przez Kuaishou. Atlas Cloud (prowadzona przez Atlas Cloud AI LLC) zapewnia dostęp do modelu, ale nie jest jego właścicielem. Wszystkie znaki towarowe należą do ich odpowiednich właścicieli.
Wybierz endpoint Kling v2.1 dopasowany do materiału źródłowego, wymagań dotyczących ruchu i przepływu pracy w produkcji.
| Modalność | Opis |
|---|---|
| Kling v2.1 I2V Pro Start End Frame API | Podaj klatkę początkową i końcową, aby wygenerować wideo z kontrolowaną ciągłością ruchu między obiema klatkami. Płynniejsze przejścia między scenami sprawiają, że ten endpoint sprawdza się przy planowanych zmianach ujęć, sekwencjach wizualnych i jasno określonych punktach fabuły. |
| Kling v2.1 T2V Master API (Text To Video) | Złożone prompty tekstowe są przekształcane w wideo z zaawansowaną logiką ruchu i ulepszonym dynamicznym renderowaniem kamery. Wybierz ten endpoint do szczegółowych wytycznych dotyczących sceny, ekspresyjnego ruchu i koncepcji zależnych od przemyślanego zachowania kamery. |
| Kling v2.1 I2V Master API (Image To Video) | Ten endpoint, przeznaczony do profesjonalnego generowania wideo na podstawie obrazu, animuje obraz źródłowy z precyzyjną ciągłością ruchu i głębią wizualną. Sprawdza się przy dopracowanych projektach kreatywnych, w których priorytetem są spójny ruch i przestrzenna prezentacja. |
| Kling v2.1 I2V Pro API (Image To Video) | Zachowaj równowagę między szybkością generowania a wiernością obrazu, przekształcając obrazy źródłowe w ostre i płynne wideo. Używaj tego endpointu do ogólnych zastosowań kreatywnych wymagających niezawodnej jakości wizualnej bez korzystania z endpointu Master. |
| Kling v2.1 I2V Standard API (Image To Video) | Ten endpoint, przeznaczony do szybkiej iteracji, przekształca obrazy źródłowe w niezawodne wideo 720p. Jego profil ukierunkowany na szybkość umożliwia szybkie tworzenie szkiców wizualnych, wstępne przeglądy koncepcji i sprawne prototypowanie wideo. |
Kling v2.1 łączy generowanie wideo z tekstu i obrazu, sterowanie pierwszą i ostatnią klatką, klipy trwające 5 lub 10 sekund, regulowaną siłę wskazówek oraz poziomy Standard, Pro i Master za pośrednictwem jednego interfejsu Atlas Cloud API.
Kling v2.1 Pro przyjmuje zarówno pierwszą, jak i końcową klatkę, przy czym każdy obraz musi być w formacie JPEG lub PNG, mieć maksymalnie 10 MB i co najmniej 300 na 300 pikseli. Model generuje ruch między tymi punktami odniesienia, zachowując ciągłość przejścia. Wybierz 5 lub 10 sekund materiału, aby kształtować ujawnienia, transformacje i precyzyjnie reżyserowane momenty narracyjne.
Warianty Master zapewniają zaawansowaną logikę ruchu, dynamiczne ujęcia kamery, precyzyjną ciągłość i głębię obrazu w wymagających scenach. Niezależnie od tego, czy prompt opisuje szybką pogoń, wielowarstwowy ruch postaci czy szeroki ruch kamery, model został zaprojektowany tak, aby utrzymywać spójność akcji. Wybierz Master, gdy profesjonalne generowanie obrazu do wideo lub złożone generowanie tekstu do wideo wymaga najbardziej zaawansowanego poziomu w tej rodzinie modeli.
Twórz na podstawie opisu tekstowego lub animuj istniejącą klatkę, korzystając z oddzielnych modeli do generowania tekstu do wideo i obrazu do wideo. Rodzina obejmuje opcje Standard, Pro i Master oparte na obrazie, a Master obsługuje także prompty tekstowe z wyborem proporcji 16:9, 9:16 lub 1:1. Taki zakres pozwala jednej integracji obsługiwać szybkie szkice, standardową produkcję kreatywną i bardziej wymagające koncepcje filmowe.
Ustaw każdy obsługiwany model tak, aby generował klip trwający 5 lub 10 sekund. Krótkie przebiegi sprawdzają się przy szybkich testach wizualnych, natomiast dłuższa opcja daje ruchowi, zmianom kamery i przejściom więcej przestrzeni na rozwój bez zmiany endpointu generowania. Standard jest zoptymalizowany pod kątem szybkich szkiców w 720p, dzięki czemu stanowi praktyczny punkt wyjścia przed przeniesieniem koncepcji do Pro lub Master.
Kształtuj wyniki Kling v2.1 za pomocą wymaganego promptu pozytywnego, opcjonalnego promptu negatywnego oraz kontroli siły wskazówek w zakresie od 0 do 1. Zwiększaj lub zmniejszaj wartość siły wskazówek, aby dostosować zgodność z promptem, a za pomocą promptów negatywnych określaj elementy, których model ma unikać. Wspólnie te mechanizmy pozwalają precyzyjniej kształtować język kamery, uzyskiwać czystsze kompozycje i powtarzalnie iterować nad kreatywnymi wariantami.
Uzyskaj dostęp do wszystkich pięciu wariantów za pośrednictwem jednego interfejsu Atlas Cloud API, ze standardowymi cenami bazowymi wynoszącymi $0.056 dla Standard, $0.098 dla każdej opcji Pro oraz $0.28 dla każdej opcji Master. Płacisz tylko za wykonane wywołania modeli i możesz zmieniać poziomy wraz ze zmianą potrzeb produkcyjnych. Jeden klucz zgodny z OpenAI pozwala prowadzić eksperymenty i wdrażać rozwiązania w ramach jednej integracji.
Uruchom dwa identyczne filmowe prompty w Kling v2.1, Seedance 2.0 i Kling V3.0 Turbo, aby porównać ciągłość ruchu, zgodność z promptem, sterowanie kamerą i wizualne opowiadanie historii.
8–10-sekundowy, pełen energii pościg ratunkowy w samo południe nad rozległym słonym jeziorem pokrytym taflą wody cienką jak lustro: nastoletnia dziewczyna w kobaltowoniebieskim kombinezonie wyścigowym pilotuje trójkołowy jacht lądowy z pełną prędkością, ścigając koralowoczerwoną torbę ratunkową porwaną przez gwałtowny podmuch wiatru. Rozpocznij od ekstremalnego makro z poziomu podłoża, pokazującego ostre jak brzytwa srebrzystobiałe kryształki soli, gdy przednie koło przelatuje obok, rozpryskując lśniącą wodę na obiektyw; następnie przyspiesz do bocznego ujęcia śledzącego, pędzącego równolegle do jachtu, gdy jego napięty płócienny żagiel trzaska na wietrze, a dziewczyna opuszcza maszt, by przemknąć pod stadem flamingów wzbijających się do lotu. Wykonaj gwałtowny obrót kamery wokół pojazdu i przejdź do dynamicznej orbity 360 stopni, gdy jedno z bocznych kół na moment unosi się nad wodą pod wpływem realistycznej siły odśrodkowej; dziewczyna wychyla się, nie tracąc kontroli, zaczepia jedną ręką pasek torby i wciąga ją na pokład. Zakończ szybkim wznoszeniem kamery do wysokiego ujęcia lotniczego, ukazującym długi, zakrzywiony ślad na wodzie — po czym z otwartej torby niespodziewanie wychyla się głowa przemokniętego pingwina i rozlega się jego ćwierkanie, gdy dziewczyna reaguje zaskoczoną radością. Zachowaj idealną ciągłość postaci, pojazdu, torby i relacji przestrzennych przy każdej zmianie kamery; fizycznie poprawne napięcie żagla, dynamikę kół, rozpryski płytkiej wody, odbicia, unikanie flamingów, opór wiatru i pęd. Twarde, wyraziste południowe światło na tle odległych chmur burzowych w kolorze indygo, kontrolowana paleta srebrzystej bieli, kobaltowego błękitu i koralowej czerwieni, wysokiej klasy fotorealistyczne kino reklamowe, dotykowe detale, ostry naturalny efekt rozmycia ruchu, płynna, nieprzerwana akcja, bez zwolnionego tempa i pustych ujęć ustanawiających. Immersyjny, zsynchronizowany dźwięk: ryk wiatru, trzepot płótna, ślizgające się opony, rytmiczne pluski, trzepot skrzydeł, narastająca perkusyjna ścieżka muzyczna i jedno wyraźne ćwierknięcie pingwina w momencie ujawnienia. Bez ekranów, interfejsów programów, pulpitów nawigacyjnych, pasków postępu, wykresów, napisów, etykiet, logotypów, znaków wodnych ani tekstu na ekranie; bez błędów anatomicznych, zduplikowanych postaci, skoków ciągłości, zniekształconej geometrii pojazdu, unoszących się przedmiotów, nienaturalnej fizyki ani drgań kamery. Proporcje obrazu 16:9.
Generated with Kling v2.1 t2v Master on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
8–10-sekundowy, ciągły animowany pościg po smaganych wiatrem białych dachach śródziemnomorskiego miasteczka o chłodnym, cyjanowym zmierzchu: starsza kobieta w fartuchu w kolorze indygo pędzi za pojedynczym, intensywnie szkarłatnym długim szalikiem, przeskakując nad sznurami z praniem i zjeżdżając po pochyłych dachówkach z terakoty, gdy materiał naturalnie trzepocze, skręca się i faluje pod wpływem nagłego morskiego wiatru. Rozpocznij od niskiego, szybkiego ujęcia śledzącego, sunącego wzdłuż wąskiego kalenicy obok jej biegnących stóp; przejdź przez gwałtownie trzepoczące białe prześcieradła, tworząc płynne przejście przez przesłonięcie, a następnie zanurkuj z góry do ciasnej orbity wokół kobiety, gdy szalik owija się wokół wiatrowskazu i delikatnie unosi zaskoczonego pomarańczowego kota prosto w jej ramiona. Kobieta łapie kota, nie przerywając biegu; wiatrowskaz obraca się, kot miauczy, a ona śmieje się, gdy kamera gwałtownie wycofuje się do tyłu, odsłaniając warstwowo ułożone nadmorskie miasteczko opadające ku lśniącemu morzu. Zachowaj dokładną ciągłość postaci, ubioru, kota i dachów przy każdym przesłonięciu i każdej zmianie kamery; płynne, nieprzerwane bieganie, skakanie, zjeżdżanie i łapanie, złożoną fizykę tkaniny napędzaną wiatrem, silny paralaksowy efekt od pierwszego planu po tło, ekspresyjną ręcznie rysowaną animację celową z delikatnymi akwarelowymi tłami, chłodny turkusowy zmierzch skontrastowany z ciepłym bursztynowym światłem okien, przy czym szkarłatny szalik jest jedynym silnie nasyconym wizualnym przewodnikiem w całej kompozycji. Rytmiczne podmuchy, trzaskające pranie, szybkie kroki na dachówkach, cichy metaliczny obrót wiatrowskazu, jedno zaskoczone miauknięcie, odległy szum fal i żywe śródziemnomorskie smyczki narastające aż do komicznego złapania. Bez zwolnionego tempa, statycznych ujęć, tekstu, logotypów, obramowań ani elementów interfejsu. Proporcje obrazu 16:9.
Generated with Kling v2.1 t2v Master on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Od opisów koncepcji i obrazów źródłowych po filmową prewizualizację, animację produktów, kontrolowane przejścia między klatkami, szybkie wersje robocze do mediów społecznościowych, animowane ilustracje i planowanie scen gier — Kling v2.1 obsługuje te zastosowania w wariantach tekst-do-wideo i obraz-do-wideo.
Kling v2.1 t2v Master interpretuje złożone prompty dzięki zaawansowanej logice ruchu i dynamicznemu renderowaniu kamery. Reżyserzy i zespoły kreatywne mogą przekształcać opisane koncepcje w filmowe szkice scen jeszcze przed zaangażowaniem zasobów w produkcję.
Animuj obraz produktu za pomocą wyraźnego, płynnego ruchu, zachowując równowagę między szybkością generowania a wiernością dzięki endpointowi Pro. Zespoły marketingowe mogą tworzyć klipy premierowe, wizualizacje do sklepów internetowych i warianty kampanii na podstawie istniejących materiałów statycznych.
Użyj klatek początkowej i końcowej, aby kierować ciągłością ruchu i tworzyć płynniejsze przejścia między dwoma stanami wizualnymi. Umożliwia to prezentacje typu „przed i po”, łączniki między scenami oraz zaplanowane transformacje ze zdefiniowanymi punktami początkowym i końcowym.
Gdy liczy się szybkość, model Standard tworzy niezawodne wersje robocze obraz-do-wideo w rozdzielczości 720p, umożliwiając szybką iterację. Zespoły social media i twórcy indywidualni mogą testować pomysły na ruch, przyciągające uwagę elementy wizualne i kierunki rozwoju treści przed rozpoczęciem produkcji o wyższej wierności.
Ożyw ilustracje lub statyczne ujęcia postaci, wykorzystując ciągłość ruchu i głębię wizualną zapewnianą przez i2v Master. Artyści mogą opracowywać sekwencje, atmosferyczne pętle lub elementy portfolio, zachowując obraz źródłowy jako wizualną podstawę.
Potrzebujesz ruchomej sceny gry na podstawie opisu? Master text to video obsługuje złożone prompty i dynamiczne renderowanie kamery, pomagając deweloperom tworzyć podglądy środowisk, kluczowych momentów fabuły i filmowych sekwencji na potrzeby gier.
Porównaj warianty Kling v2.1 z innymi modelami wideo dostępnymi w Atlas Cloud według trybu generowania, długości klipu, kontroli klatki końcowej i standardowej ceny bazowej.
| Model | Tryb generowania | Długość klipu | Kontrola klatki końcowej | Standardowa cena bazowa |
|---|---|---|---|---|
| Kling v2.1 i2v Pro Start-end-frame | Klatka początkowa i końcowa do wideo | 5 lub 10 s | √ | $0.098 |
| Kling v2.1 t2v Master | Tekst na wideo | 5 lub 10 s | - | $0.28 |
| Kling v2.1 i2v Master | Obraz na wideo | 5 lub 10 s | - | $0.28 |
| Kling v2.1 i2v Pro | Obraz na wideo | 5 lub 10 s | - | $0.098 |
| Kling v2.1 i2v Standard | Obraz na wideo | 5 lub 10 s | - | $0.056 |
| Veo 3.1 Lite Start-End Frame to Video | Klatka początkowa i końcowa do wideo | 4, 6 lub 8 s | √ | $0.05 |
| Seedance 2.0 Image-to-Video | Obraz na wideo | Od 4 do 15 s lub automatycznie | √ | $0.112 |
| Wan-2.7 Image-to-video | Obraz na wideo | Od 2 do 15 s | √ | $0.10 |
Zacznij w kilka minut — wykonaj te proste kroki, aby zintegrować i wdrożyć modele za pośrednictwem platformy Atlas Cloud.
Zarejestruj się na atlascloud.ai i ukończ weryfikację. Nowi użytkownicy otrzymują bezpłatne kredyty do eksploracji platformy i testowania modeli.
Połączenie zaawansowanych modeli Kling 2.1 z platformą GPU-akcelerowaną Atlas Cloud zapewnia niezrównaną wydajność, skalowalność i doświadczenie deweloperskie.
Niska Latencja:
Inferencja zoptymalizowana pod GPU dla rozumowania w czasie rzeczywistym.
Zunifikowane API:
Uruchamiaj Kling 2.1, GPT, Gemini i DeepSeek za pomocą jednej integracji.
Przejrzysta Wycena:
Przewidywalne rozliczenia za token z opcjami serverless.
Doświadczenie Dewelopera:
SDK, analityka, narzędzia dostrajania i szablony.
Niezawodność:
99,99% dostępności, RBAC i logowanie gotowe na zgodność.
Bezpieczeństwo i Zgodność:
SOC 2 Type II, zgodność z HIPAA, suwerenność danych w USA.
Kling v2.1 to rodzina modeli Kuaishou do generowania wideo na podstawie tekstu i obrazu. Atlas Cloud udostępnia endpointy Standard, Pro, Master oraz start/end-frame, odpowiadające różnym wymaganiom dotyczącym jakości i kontroli.
Za pomocą T2V Master możesz przekształcać prompty tekstowe w wideo, a endpointy I2V Standard, Pro i Master pozwalają animować obrazy źródłowe. Wariant start/end-frame zapewnia kontrolowaną ciągłość ruchu i płynniejsze przejścia między dwiema dostarczonymi klatkami.
Utwórz klucz API Atlas Cloud, przechowuj go w bezpiecznym środowisku po stronie serwera i wyślij uwierzytelnione żądanie POST do /api/v1/model/generateVideo. Użyj zwróconego identyfikatora predykcji, aby monitorować zadanie i po jego zakończeniu pobrać URL wideo z pola outputs.
Wybierz T2V Master, gdy głównym wejściem jest prompt tekstowy, a kluczowe znaczenie ma złożona logika ruchu lub dynamiczne renderowanie kamery. W przypadku animacji obrazu Standard jest przeznaczony do szybkich szkiców w 720p, Pro równoważy szybkość i wierność, Master zapewnia ciągłość ruchu i głębię wizualną, natomiast start/end Pro pozwala kontrolować obie klatki graniczne.
Dostępne elementy sterujące obejmują prompty, negatywne prompty, czas trwania wynoszący 5 lub 10 sekund oraz skalę guidance. T2V Master udostępnia również proporcje obrazu 16:9, 9:16 i 1:1, natomiast dane obrazowe mogą być zapisane w formacie JPG, JPEG lub PNG, mieć rozmiar do 10 MB i minimalną rozdzielczość 300 na 300 pikseli. Endpoint start/end wymaga dodatkowo obrazu końcowego.
Zweryfikowane standardowe ceny bazowe wynoszą $0.056 dla I2V Standard, $0.098 dla I2V Pro i start/end Pro oraz $0.28 dla każdego z endpointów Master. Są to pierwotnie opublikowane stawki, a nie tymczasowe ceny promocyjne, dlatego przed wysłaniem żądania sprawdź aktualny szacowany koszt.
Najpierw wyślij żądanie generowania, a Atlas Cloud zwróci identyfikator predykcji zamiast gotowego wideo. Odpytywanie endpointu /api/v1/model/prediction/{prediction_id} powtarzaj do momentu, aż status zmieni się na completed lub succeeded, a następnie odczytaj wygenerowany URL z pola outputs.
Przekaż zarówno image, jak i end_image do endpointu start/end-frame wraz z promptem. Te klatki graniczne wyznaczają ciągłość ruchu i przejście w całej wygenerowanej sekwencji. Każdy obraz musi spełniać wymagania dotyczące formatu, rozmiaru pliku i rozdzielczości określone w dokumentacji.
Nie. Funkcję widoczną w konsumenckiej aplikacji Kling uznaj za niedostępną w tej rodzinie Atlas Cloud, chyba że pojawia się ona w schemacie wybranego endpointu. Na przykład opublikowane schematy tych pięciu endpointów nie udostępniają elementów sterujących Multi-Elements.
Najpierw upewnij się, że zgadzają się identyfikator modelu, obraz źródłowy, prompt, negatywny prompt, czas trwania, skala guidance oraz proporcje obrazu, jeśli mają zastosowanie. Opublikowane schematy Atlas Cloud nie udostępniają parametru seed dla tych endpointów, dlatego za pomocą wymienionych elementów sterujących nie można skonfigurować dokładnego deterministycznego odtworzenia.
Poradniki, samouczki i nowości produktowe, dzięki którym w pełni wykorzystasz Atlas Cloud.