
Kling v2.6 ist die Videomodellfamilie von Kuaishou für die filmische Erstellung von Text-zu-Video- und Bild-zu-Video-Inhalten, KI-Avatare und referenzgesteuerte Bewegungsübertragung. Sie unterstützt flexible Seitenverhältnisse, verbesserte Dynamik, stabile Identität und zeitliche Konsistenz in spezialisierten Workflows. Atlas Cloud bietet Pro- und Standard-Optionen über konsistente Endpunkte mit transparenter nutzungsbasierter Abrechnung. Beginnen Sie noch heute mit der Entwicklung.
Kling 2.6 wurde von Kuaishou entwickelt. Atlas Cloud (betrieben von Atlas Cloud AI LLC) stellt lediglich den Zugang bereit und ist nicht Eigentümerin des Modells. Alle Marken sind Eigentum ihrer jeweiligen Inhaber.
Ordnen Sie jeden Kling v2.6-Endpunkt dem unterstützten Eingabeworkflow, den jeweiligen Stärken in der Produktion und den vorgesehenen Video-Anwendungsfällen zu.
| Modalität | Beschreibung |
|---|---|
| Kling v2.6 Pro Avatar API (Avatar To Video) | Dieser Endpunkt wurde für die hochwertige Avatar-Generierung entwickelt und erzeugt Videos mit klaren Details, stabilen Bewegungen und hoher Identitätskonsistenz. Er eignet sich für professionell gestaltete Profilvideos, Vorstellungen und Social-Media-Inhalte. |
| Kling v2.6 Std Avatar API (Avatar To Video) | Wählen Sie den Standard-Avatar-Endpunkt, um KI-Avatar-Videos mit klaren Details, filmischer Bewegung und zuverlässiger Prompt-Befolgung zu erstellen. Seine Funktionen eignen sich für Profile, kurze Vorstellungen und die regelmäßige Produktion von Social-Media-Inhalten. |
| Kling v2.6 Pro Motion Control API (Reference Motion To Video) | Referenzbewegungsclips übertragen Tänze, Aktionen oder Gesten auf ein Charakterbild oder Quellvideo und bewahren dabei Identität und zeitliche Konsistenz. Verwenden Sie den Endpunkt für flüssige Charakteranimationen, die bestimmten aufgezeichneten Bewegungen folgen. |
| Kling v2.6 Std Motion Control API (Image And Motion To Video) | Animieren Sie ein statisches Charakterbild, indem Sie einen Bewegungsclip mit einem Tanz, einer Aktion oder einer Geste bereitstellen. Der Endpunkt extrahiert diese Bewegung und erzeugt flüssige, realistische Videos für zugängliche Workflows zur Bewegungsübertragung. |
| Kling v2.6 Pro API (Text To Video) | Text-Prompts werden mit diesem Kuaishou-Modell in filmische Videos mit generiertem Ton und flexiblen Seitenverhältnissen umgewandelt. Es unterstützt die Konzeptentwicklung, narrative Szenen, Werbeanzeigen und andere promptgesteuerte Videoprojekte. |
| Kling v2.6 Pro API (Image To Video) | Ausgehend von einem Bild erstellt dieser Endpunkt filmische Videos mit generiertem Ton und dynamischeren Bewegungen. Erwecken Sie Produktvisualisierungen, Illustrationen oder kreative Einzelbilder zum Leben, wenn eine kontrollierte visuelle Kontinuität wichtig ist. |
Kling v2.6 kombiniert native audiovisuelle Generierung, Text- und Bild-Workflows, referenzgesteuerte Bewegungskontrolle, audiogesteuerte Avatare, flexible Parameter und nutzungsbasierten Zugriff auf Standard- und Pro-Endpunkte.
Kling v2.6 Pro kann aus einem Text-Prompt oder einem Ausgangsbild gemeinsam Video und Ton generieren. Der Audio-Schalter ist bei den Text to Video- und Image to Video-Endpunkten von Atlas Cloud standardmäßig aktiviert. Dialoge, Effekte und Umgebungsgeräusche können dadurch der Szene folgen, während sie sich entwickelt. Das eignet sich besonders für kurze narrative Clips, die ein stimmiges audiovisuelles Ergebnis ohne separate Tonbearbeitung benötigen.
Beginne mit einer beschriebenen Szene oder animiere ein Standbild über die Pro-Generierungsendpunkte. Text-Prompts unterstützen Ausgaben im Format 1:1, 9:16 und 16:9. Beide Wege bieten außerdem Laufzeiten von 5 oder 10 Sekunden, einen Audio-Schalter, negative Prompts und CFG-Steuerung von 0 bis 1. Als Bildeingaben werden JPG-, JPEG- oder PNG-Dateien bis 10 MB akzeptiert, sodass Entwickler praktische Kontrolle über Social-, Produkt- und filmische Assets erhalten.
Übergib Kling v2.6 Motion Control ein Charakterbild und einen Referenzclip. Das Modell überträgt Ganzkörper-Tanz-, Aktions- oder Gestenfolgen und bewahrt dabei Identität und zeitliche Konsistenz. Referenzvideos können 3 bis 30 Sekunden lang sein. Lege fest, ob die Komposition dem Bild oder dem Bewegungsvideo folgen soll, und entscheide, ob der Originalton beibehalten wird. Das Ergebnis eignet sich für kontinuierliche Performances, Charakteranimationen und aktionsorientierte Kampagnen.
Für die Standard- und Pro-Avatar-Endpunkte sind ein Bild und eine Audiospur erforderlich; optional kann ein Prompt das Ergebnis steuern. Pro legt den Schwerpunkt auf klare Details, stabile Bewegungen und eine hohe Identitätskonsistenz, während Standard filmische Bewegungen mit zuverlässiger Prompt-Befolgung kombiniert. Verwende diesen Weg, wenn ein wiedererkennbares Motiv vorbereitete Audiodateien in Profilvideos, gebrandeten Intros oder regelmäßig erscheinenden Social-Inhalten präsentieren soll.
Wähle je nach Aufgabe Standard- oder Pro-Endpunkte und zahle über Atlas Cloud nur für die von dir ausgeführten Aufrufe. Standard Avatar beginnt bei $0.056 pro Aufruf, Standard Motion Control bei $0.07, Pro Text to Video und Image to Video bei $0.07 und Pro Avatar oder Motion Control bei $0.112. Ein Konto deckt alle sechs Endpunkte ab und hilft Entwicklern, Bildqualität, Bewegungsanforderungen und Produktionskosten ohne Abonnement ausgewogen zu steuern.
Erfahre, wie Kling v2.6 und zwei Alternativen von Atlas Cloud identische Prompts für realistische Action und stilisiertes Storytelling interpretieren.
Ein 8–10 Sekunden langer hyperrealistischer Modewerbefilm, der mittags auf einem riesigen weißen Salzsee spielt: Sechs Hochgeschwindigkeitsskater in schillernden Spieg||||
Generated with Kling v2.6 Pro Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Fast Text-to-Video on Atlas Cloud
An 8–10 second continuous cinematic deep-sea chase inside the steeply tilted ballroom of a decaying shipwreck: begin with an extreme macro shot of a semi-transparent mimic octopus tentacle shimmering through cracked chandelier crystals as it snatches a glowing “pearl”; rapidly dolly-zoom backward to reveal the octopus swinging from a corroded railing over overturned dining tables while moray eels weave through chairs and pursue it, silverware, glass shards, sediment, and chains of bubbles rising and colliding with believable underwater physics. Transition into a tight 360-degree orbiting chase shot as the octopus continuously shifts its skin texture and translucency to match velvet curtains, tarnished brass, and barnacled wood, then blasts a dense ink cloud that curls into a convincing octopus-shaped decoy; the eels strike the false silhouette as the real octopus slips past them. Whip-pan and roll the camera into a dramatically canted top-down view: the stolen “pearl” suddenly opens a tiny eye, its amber glow intensifies, and the enormous camouflaged face of an anglerfish emerges beneath the banquet table—the pearl is its lure; the octopus freezes for one comic beat as the anglerfish lunges toward camera. Photorealistic deep-sea cinematic realism, cold cyan ambient light contrasted with warm amber bioluminescence, volumetric water, drifting particles, high-density soft-body tentacle motion, fluid simulation, floating-object collisions, seamless subject continuity, physically credible momentum, sharp readable action, no slow motion. Immersive synchronized audio: muffled hull groans, crystal clinks, rushing bubbles, eel snaps, pulsing chase percussion, a wet ink burst, then a sudden bass sting at the reveal. No screens, interfaces, dashboards, progress bars, charts, captions, subtitles, logos, watermarks, or explanatory text. 16:9 aspect ratio
Generated with Kling v2.6 Pro Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Fast Text-to-Video on Atlas Cloud
Von filmischen Prompts und animierten Kampagnenmotiven bis hin zu konsistenten Avataren und bewegungsgeführten Performances unterstützt Kling v2.6 Entwickler bei der Erstellung von Filmen, Werbeanzeigen, Social-Media-Inhalten und Markencharakteren.
Verwandle schriftliche Konzepte mit Kling v2.6 Pro Text to Video in filmische Videos – mit flexiblen Seitenverhältnissen und generiertem Sound. Filmschaffende können Trailer, dramatische Szenen und visuelle Präsentationen mit nur einem Prompt prototypisch umsetzen.
Erwecke ein Produktbild oder Kampagnenmotiv mit verbesserter Dynamik, filmischer Qualität und generiertem Sound zum Leben. Marketingteams können aus bestehendem Artwork Teaser zum Produktstart, visuelle Demonstrationen und Social-Media-Promotions erstellen.
Erstelle mit dem Pro Avatar-Modell hochwertige Avat603are-Videos mit klaren Details, stabilen Bewegungen und konsistenter Identität. Setze sie für Profilvorstellungen, Präsentationssegmente und wiederkehrende Markenpersönlichkeiten in sozialen Medien ein.
Übertrage Tanz-, Action- oder Gestenaufnahmen auf ein Charakterbild und bewahre dabei Identität und zeitliche Konsistenz. Kreative können aus aufgezeichneten Bewegungen Choreografie-Tests, animierte Maskottchen und Social-Media-Clips mit Performance-Fokus erstellen.
Verleihe einem Charakterbild oder Quellvideo mit Pro Motion Control die Bewegung eines Referenzclips. Produktionsteams können alternative Darsteller, stilisierte Actionszenen und konsistente Charakteranimationen erkunden.
Starte mit einem Text-Prompt und generiere filmische Videos mit Sound und flexiblen Seitenverhältnissen. Entwickler können kurze Kampagnenkonzepte, Creator-Inhalte und plattformspezifische Visuals automatisieren, ohne ein Startbild bereitzustellen.
Vergleich von Kling v2.6 mit führenden Text-to-Video-Modellen hinsichtlich Anbieter, Clip-Dauer, nativem Audio und standardmäßigem Basispreis.
| Modell | Anbieter | Ausgabedauer | Natives Audio | Standard-Basispreis |
|---|---|---|---|---|
| Kling v2.6 Pro Text-to-Video | Kuaishou | 5 oder 10 Sekunden | √ | $0.07/second |
| Seedance 2.0 Text-to-Video | ByteDance | 4 bis 15 Sekunden | √ | $0.112/second |
| Wan-2.7 Text-to-video | Qwen | 2 bis 15 Sekunden | √ | $0.10/second |
| Veo 3.1 Lite Text-to-video | 4, 6 oder 8 Sekunden | √ | $0.05/second |
In wenigen Minuten startklar — folgen Sie diesen einfachen Schritten, um Modelle über die Plattform von Atlas Cloud zu integrieren und bereitzustellen.
Registrieren Sie sich auf atlascloud.ai und schließen Sie die Verifizierung ab. Neue Nutzer erhalten kostenlose Credits zum Erkunden der Plattform und Testen von Modellen.
Die Kombination der fortschrittlichen Kling 2.6-Modelle mit der GPU-beschleunigten Plattform von Atlas Cloud bietet unübertroffene Leistung, Skalierbarkeit und Entwicklererfahrung.
Niedrige Latenz:
GPU-optimierte Inferenz für Echtzeit-Reasoning.
Einheitliche API:
Führen Sie Kling 2.6, GPT, Gemini und DeepSeek mit einer Integration aus.
Transparente Preisgestaltung:
Vorhersehbare Token-basierte Abrechnung mit serverlosen Optionen.
Entwicklererfahrung:
SDKs, Analysen, Fine-Tuning-Tools und Vorlagen.
Zuverlässigkeit:
99,99% Verfügbarkeit, RBAC und compliance-bereite Protokollierung.
Sicherheit & Compliance:
SOC 2 Type II, HIPAA-Ausrichtung, Datensouveränität in den USA.
Kling v2.6 ist eine Familie von Kuaishou-KI-Videomodellen, die über Atlas Cloud verfügbar ist. Sie umfasst Pro-Generierung von Text-zu-Video und Bild-zu-Video sowie Standard- und Pro-Endpunkte für Avatare und Bewegungssteuerung.
Erstelle Videos aus Prompts, animiere Quellbilder, produziere Avatारvideos aus einem Bild und Audio oder übertrage Tanz-, Aktions- und Gestenabläufe aus Referenzclips. Die Pro-Endpunkte für Text-zu-Video und Bild-zu-Video können gleichzeitig mit den visuellen Inhalten auch Ton erzeugen.
Wähle Text-to-Video, wenn du mit einem Prompt beginnst, und Image-to-Video, wenn du ein Standbild animieren möchtest. Avatar-Endpunkte kombinieren ein Bild mit bereitgestelltem Audio, während Motion Control Bewegungen aus einem Referenzvideo auf eine Figur überträgt.
Sende eine POST-Anfrage an `/api/v1/model/generateVideo` mit deinem Atlas-Cloud-API-Schlüssel, der exakten Modell-ID und den für den jeweiligen Endpunkt erforderlichen Eingaben. Die asynchrone Antwort enthält eine Prediction-ID, die du über `/api/v1/model/prediction/{id}` abfragen kannst, bis der Task abgeschlossen ist.
Die Steuerungsmöglichkeiten variieren je nach Endpunkt. Text-to-video unterstützt Prompts, negative Prompts, die Seitenverhältnisse 1:1, 9:16 und 16:9, Dauern von 5 oder 10 Sekunden, Ton und die Guidance Scale. Die anderen Workflows ergänzen je nach Anwendungsfall Eingaben für Bild, Audio, Bewegungsvideo, Ausrichtung oder die Beibehaltung des Tons.
Bei Pro Text-to-Video und Image-to-Video steuert der Parameter `sound` die gleichzeitige Tonerzeugung. Avatar-Modelle benötigen dagegen zusammen mit dem Charakterbild eine Audioeingabe, während Motion Control den Originalton des Referenzvideos beibehalten kann.
Atlas Cloud führt Standardtarife von $0.07 pro Sekunde für Pro Text-to-Video, Pro Image-to-Video und Standard Motion Control auf. Standard Avatar kostet $0.056 pro Sekunde, während Pro Avatar und Pro Motion Control $0.112 pro Sekunde kosten. Dabei werden die Originaltarife und keine Aktionspreise verwendet.
Bereite ein JPG-, JPEG- oder PNG-Charakterbild sowie ein MP4- oder MOV-Bewegungsvideo vor. Jede Datei darf höchstens 10 MB groß sein, muss in beiden Dimensionen mindestens 300 Pixel messen und ein Seitenverhältnis zwischen 1:2.5 und 2.5:1 aufweisen.
Überprüfe zunächst die Modell-ID, die Bearer-Authentifizierung, die erforderlichen Felder und die medienbezogenen Einschränkungen des jeweiligen Endpunkts. Wenn der Task angenommen wurde, frage seine Prediction-ID ab, bis er abgeschlossen ist oder fehlschlägt, und prüfe den zurückgegebenen Fehler. Bei visuellen Inkonsistenzen solltest du die Szene vereinfachen und eindeutige Quellmedien verwenden, insbesondere bei der Übertragung von Gesichtsbewegungen oder Interaktionen mit komplexen Objekten.
Anleitungen, Tutorials und Produkt-Updates, mit denen Sie das Beste aus Atlas Cloud herausholen.