
Kling v2.6 è la famiglia di modelli video di Kuaishou per la creazione cinematografica da testo a video e da immagine a video, avatar AI e trasferimento del movimento basato su riferimenti. Supporta proporzioni flessibili, dinamiche migliorate, identità stabile e coerenza temporale in flussi di lavoro specializzati. Atlas Cloud offre opzioni Pro e Standard tramite endpoint coerenti, con prezzi trasparenti a consumo. Inizia a creare oggi stesso.
Kling 2.6 è sviluppato da Kuaishou. Atlas Cloud (gestita da Atlas Cloud AI LLC) ne fornisce l’accesso ma non ne è proprietaria. Tutti i marchi appartengono ai rispettivi titolari.
Abbina ogni endpoint Kling v2.6 al flusso di input supportato, ai suoi punti di forza in produzione e ai casi d’uso video previsti.
| Modalità | Descrizione |
|---|---|
| Kling v2.6 Pro Avatar API (Avatar To Video) | Progettato per la generazione di avatar premium, questo endpoint produce video di alta qualità con dettagli nitidi, movimenti stabili e forte coerenza dell’identità. È ideale per video profilo curati, presentazioni e contenuti per i social. |
| Kling v2.6 Std Avatar API (Avatar To Video) | Scegli l’endpoint Standard Avatar per creare video con avatar IA, dettagli nitidi, movimenti cinematografici e un’aderenza affidabile ai prompt. Le sue funzionalità sono adatte a profili, brevi presentazioni e produzioni ricorrenti per i social media. |
| Kling v2.6 Pro Motion Control API (Reference Motion To Video) | Le clip di movimento di riferimento trasferiscono danze, azioni o gesti a un’immagine del personaggio o a un video sorgente, preservando l’identità e la coerenza temporale. Usalo per animazioni fluide dei personaggi che seguono movimenti registrati specifici. |
| Kling v2.6 Std Motion Control API (Image And Motion To Video) | Anima un’immagine statica del personaggio fornendo una clip di movimento contenente una danza, un’azione o un gesto. L’endpoint estrae quel movimento e genera un video fluido e realistico per flussi di trasferimento del movimento accessibili. |
| Kling v2.6 Pro API (Text To Video) | Grazie a questo modello Kuaishou, i prompt testuali diventano video cinematografici con audio generato e proporzioni flessibili. Supporta lo sviluppo di concept, scene narrative, pubblicità e altri progetti video basati su prompt. |
| Kling v2.6 Pro API (Image To Video) | Partendo da un’immagine, questo endpoint crea video cinematografici con generazione dell’audio e dinamiche migliorate. Dai vita a immagini di prodotti, illustrazioni o still creativi quando la continuità visiva controllata è importante. |
Kling v2.6 combina la generazione audiovisiva nativa, flussi di lavoro basati su testo e immagini, controllo del movimento guidato da riferimenti, avatar guidati dall'audio, parametri flessibili e accesso con pagamento a consumo tramite endpoint Standard e Pro.
Kling v2.6 Pro può generare video e audio simultaneamente a partire da un prompt testuale o da un'immagine sorgente. L'opzione audio è abilitata per impostazione predefinita sugli endpoint Text to Video e Image to Video di Atlas Cloud. Dialoghi, effetti e atmosfera possono quindi seguire lo sviluppo della scena. È una soluzione particolarmente adatta a brevi clip narrative che richiedono un risultato audiovisivo coerente senza una fase separata di aggiunta del sonoro.
Parti da una scena descritta per iscritto oppure anima un'immagine fissa con gli endpoint di generazione Pro. I prompt testuali supportano output 1:1, 9:16 e 16:9, mentre entrambi i flussi offrono durate di 5 o 10 secondi, attivazione o disattivazione dell'audio, prompt negativi e controllo CFG da 0 a 1. Gli input immagine accettano file JPG, JPEG o PNG fino a 10 MB, offrendo agli sviluppatori un controllo pratico sugli asset per social, prodotti e contenuti cinematografici.
Fornisci un'immagine del personaggio e una clip di movimento di riferimento a Kling v2.6 Motion Control: il modello trasferisce sequenze complete di danza, azioni o gesti preservando l'identità e la coerenza temporale. I video di riferimento possono durare da 3 a 30 secondi. Scegli se la composizione deve seguire l'immagine o il video di movimento e decidi se mantenere l'audio sorgente. Il risultato è adatto a performance continue, animazioni di personaggi e campagne incentrate sull'azione.
Un'immagine e una traccia audio sono gli input richiesti dagli endpoint Standard Avatar e Pro Avatar, con un prompt opzionale per guidare il risultato. Pro dà priorità a dettagli nitidi, movimento stabile e forte coerenza dell'identità, mentre Standard combina un movimento cinematografico con una solida aderenza al prompt. Usa questo flusso quando un soggetto riconoscibile deve riprodurre un audio preparato in video di profilo, presentazioni di brand o contenuti social ricorrenti.
Scegli gli endpoint Standard o Pro in base al carico di lavoro e paga solo le chiamate effettuate tramite Atlas Cloud. Standard Avatar parte da $0.056 per chiamata, Standard Motion Control da $0.07, Pro Text to Video e Image to Video da $0.07, mentre Pro Avatar o Motion Control partono da $0.112. Un unico account copre tutti e sei gli endpoint, aiutando gli sviluppatori a bilanciare qualità visiva, esigenze di movimento e costi di produzione senza vincoli di abbonamento.
Scopri come Kling v2.6 e due alternative di Atlas Cloud interpretano prompt identici tra azioni realistiche e narrazione stilizzata.
Un filmato pubblicitario di moda iperrealistico di 8–10 secondi, ambientato a mezzogiorno su un vasto lago salato bianco: sei pattinatori ad alta velocità con mantelli iridescenti a specchio formano un preciso “team geometrico per la raccolta del sale a forma di aquilone”, ciascuno trainando cavi tesi color blu cobalto e arancione fluorescente collegati a un gigantesco aquilone a forma di manta. Inizia con una ripresa verticale dall’alto effettuata da un drone, mentre la formazione sincronizzata traccia motivi affilati come rasoi attraverso la crosta di sale; il drone si tuffa improvvisamente e si stabilizza a pochi centimetri dal suolo, accelerando dietro al leader mentre il team affronta uno slalom tra porte di bandiere svolazzanti, con i mantelli che schioccano e le funi che si flettono sotto una tensione realistica. Transizione con una rapida panoramica a frusta verso un’orbita a 360 gradi quando un improvviso diavolo di polvere si forma accanto a loro, sollevando in una spirale cristalli di sale sparsi nell’aria; i sei pattinatori reagiscono all’unisono, recuperano bruscamente le funi e l’aquilone a manta si ripiega in una spettacolare picchiata, attraversando a tutta velocità il vortice di cristalli e spargendo sale scintillante come una nevicata abbagliante sopra il team in corsa. Azione coordinata e continua dall’inizio alla fine, identità e formazione coerenti in ogni inquadratura, slancio realistico del pattinaggio, tensione delle funi fisicamente accurata, movimento aerodinamico dei tessuti, particelle di sale granulari, turbolenza del vento e ombre ben ancorate al suolo. Luce solare verticale spietata, illuminazione superiore nitida e ad alto contrasto, riflessi prismatici arcobaleno sui mantelli a specchio e sulla superficie salina, composizione stratificata di bianco neve, blu cobalto e arancione fluorescente, estetica pubblicitaria premium di alta moda surreale, dettaglio cinematografico estremamente nitido, percussioni energiche sincronizzate con ogni curva e transizione della videocamera, vento impetuoso, lame che raschiano, tessuto che schiocca, funi che si tendono, poi un brillante sibilo cristallino nel finale. Niente rallenty, niente inquadrature statiche di riempimento, niente stacchi che interrompano la continuità spaziale, niente corpi deformi, niente persone duplicate, niente funi aggrovigliate o scollegate, niente costumi incoerenti, niente oggetti fluttuanti, niente schermi, niente interfacce software, niente dashboard, niente barre di avanzamento, niente grafici, niente didascalie, niente loghi, niente filigrane, niente testo leggibile. Rapporto d’aspetto 16:9.
Generated with Kling v2.6 Pro Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Fast Text-to-Video on Atlas Cloud
Un inseguimento cinematografico continuo di 8–10 secondi nelle profondità marine, all’interno della sala da ballo fortemente inclinata di un relitto in decomposizione: inizia con una macro inquadratura estrema del tentacolo di un polpo mimetico semitrasparente che scintilla attraverso i cristalli incrinati di un lampadario mentre afferra una “perla” luminosa; arretra rapidamente con uno zoom carrellato all’indietro per rivelare il polpo che oscilla da una ringhiera corrosa sopra tavoli da pranzo rovesciati, mentre murene si insinuano tra le sedie e lo inseguono, con posate, frammenti di vetro, sedimenti e catene di bolle che salgono e si scontrano secondo una fisica subacquea credibile. Passa a un’inquadratura ravvicinata d’inseguimento con orbita a 360 gradi, mentre il polpo modifica continuamente la texture e la traslucenza della pelle per adattarle a tende di velluto, ottone ossidato e legno incrostato di cirripedi, poi emette una densa nube d’inchiostro che si arriccia formando un convincente diversivo a forma di polpo; le murene colpiscono la sagoma falsa mentre il vero polpo scivola oltre di loro. La videocamera esegue una panoramica a frusta e una rotazione, entrando in una spettacolare visuale dall’alto fortemente inclinata: la “perla” rubata apre improvvisamente un piccolo occhio, la sua luce ambrata si intensifica e sotto il tavolo del banchetto emerge l’enorme volto mimetizzato di una rana pescatrice: la perla è la sua esca; il polpo si immobilizza per un istante comico mentre la rana pescatrice si lancia verso la videocamera. Realismo cinematografico fotorealistico degli abissi marini, luce ambientale ciano fredda in contrasto con una bioluminescenza ambrata calda, acqua volumetrica, particelle sospese, movimento dei tentacoli ad alta densità con comportamento da corpo molle, simulazione dei fluidi, collisioni tra oggetti galleggianti, continuità impeccabile dei soggetti, slancio fisicamente credibile, azione nitida e leggibile, niente rallenty. Audio immersivo sincronizzato: scricchiolii soffocati dello scafo, tintinnii dei cristalli, bolle impetuose, scatti delle murene, percussioni pulsanti da inseguimento, un’esplosione umida d’inchiostro, poi un improvviso colpo di basso alla rivelazione. Niente schermi, interfacce, dashboard, barre di avanzamento, grafici, didascalie, sottotitoli, loghi, filigrane o testo esplicativo. Rapporto d’aspetto 16:9
Generated with Kling v2.6 Pro Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Fast Text-to-Video on Atlas Cloud
Da prompt cinematografici e immagini animate per campagne a avatar coerenti e performance guidate dal movimento, Kling v2.6 supporta gli sviluppatori nella creazione di film, pubblicità, contenuti social e personaggi di brand.
Trasforma concept scritti in video cinematografici con Kling v2.6 Pro Text to Video, utilizzando rapporti d'aspetto flessibili e audio generato. I filmmaker possono creare prototipi di trailer, momenti drammatici e presentazioni visive partendo da un unico prompt.
Dai vita a un'immagine di prodotto o a un'immagine della campagna con dinamiche migliorate, qualità cinematografica e audio generato. I team marketing possono creare teaser di lancio, dimostrazioni visive e promozioni social a partire da materiali grafici esistenti.
Crea video avatar curati nei dettagli, con movimento stabile e una forte coerenza dell'identità grazie al modello Pro Avatar. Usali per presentazioni del profilo, segmenti con presentatori e personaggi social ricorrenti associati al brand.
Applica movimenti di danza, azioni o gesti ripresi in video all'immagine di un personaggio, preservandone l'identità e la coerenza temporale. I creator possono produrre test di coreografie, mascotte animate e clip social basate su performance a partire da movimenti registrati.
Trasferisci il movimento di una clip di riferimento a un'immagine del personaggio o a un video sorgente tramite Pro Motion Control. I team di produzione possono esplorare interpreti alternativi, sequenze d'azione stilizzate e animazioni coerenti dei personaggi.
Parti da un prompt testuale e genera video cinematografici con audio e rapporti d'aspetto flessibili. Gli sviluppatori possono automatizzare concept per campagne brevi, contenuti dei creator e visual specifici per le piattaforme senza fornire un'immagine iniziale.
Confronta Kling v2.6 con i principali modelli da testo a video per provider, durata delle clip, audio nativo e prezzo base standard.
| Modello | Provider | Durata dell'output | Audio nativo | Prezzo base standard |
|---|---|---|---|---|
| Kling v2.6 Pro Text-to-Video | Kuaishou | 5 o 10 secondi | √ | $0.07/secondo |
| Seedance 2.0 Text-to-Video | ByteDance | da 4 a 15 secondi | √ | $0.112/secondo |
| Wan-2.7 Text-to-video | Qwen | da 2 a 15 secondi | √ | $0.10/secondo |
| Veo 3.1 Lite Text-to-video | 4, 6 o 8 secondi | √ | $0.05/secondo |
Inizia in pochi minuti — segui questi semplici passaggi per integrare e distribuire i modelli tramite la piattaforma Atlas Cloud.
Registrati su atlascloud.ai e completa la verifica. I nuovi utenti ricevono crediti gratuiti per esplorare la piattaforma e testare i modelli.
Combinando i modelli avanzati di Kling 2.6 con la piattaforma GPU-accelerata di Atlas Cloud, ottieni prestazioni, scalabilità ed esperienza di sviluppo senza pari.
Bassa Latenza:
Inferenza ottimizzata su GPU per elaborazione in tempo reale.
API Unificata:
Esegui Kling 2.6, GPT, Gemini e DeepSeek con un'unica integrazione.
Prezzi Trasparenti:
Fatturazione prevedibile per token con opzioni Serverless.
Esperienza Sviluppatore:
SDK, analytics, strumenti di fine-tuning e template.
Affidabilità:
99,99% di uptime, RBAC e logging conforme alle normative.
Sicurezza e Conformità:
SOC 2 Type II, allineamento HIPAA, sovranità dei dati negli USA.
Kling v2.6 è una famiglia di modelli video AI di Kuaishou disponibile tramite Atlas Cloud. Include la generazione Pro da testo a video e da immagine a video, oltre agli endpoint Standard e Pro per avatar e controllo del movimento.
Puoi creare video a partire da prompt, animare immagini sorgente, produrre video di avatar da un'immagine e un audio oppure trasferire sequenze di danza, azioni e gesti da clip di riferimento. Gli endpoint Pro da testo a video e da immagine a video possono generare l'audio insieme alle immagini.
Scegli Text-to-Video quando parti da un prompt e Image-to-Video quando vuoi animare un'immagine fissa. Gli endpoint Avatar combinano un'immagine con l'audio fornito, mentre Motion Control applica a un personaggio i movimenti di un video di riferimento.
Invia una richiesta POST a `/api/v1/model/generateVideo` con la tua chiave API di Atlas Cloud, l'ID esatto del modello e gli input specifici dell'endpoint. La risposta asincrona fornisce un ID di predizione che puoi verificare tramite `/api/v1/model/prediction/{id}` finché l'attività non viene completata.
I controlli variano in base all'endpoint. Text-to-video supporta prompt, prompt negativi, proporzioni 1:1, 9:16 e 16:9, durate di 5 o 10 secondi, audio e guidance scale, mentre gli altri flussi aggiungono, quando applicabile, input per immagini, audio, video di movimento, orientamento o conservazione dell'audio.
Per Text-to-Video Pro e Image-to-Video Pro, il parametro `sound` controlla la generazione simultanea dell'audio. I modelli Avatar richiedono invece un input audio insieme all'immagine del personaggio, mentre Motion Control può conservare l'audio originale del video di riferimento.
Atlas Cloud indica tariffe standard di $0.07 al secondo per Pro Text-to-Video, Pro Image-to-Video e Standard Motion Control. Standard Avatar costa $0.056 al secondo, mentre Pro Avatar e Pro Motion Control costano $0.112 al secondo, applicando le tariffe originali anziché i prezzi promozionali.
Prepara un'immagine del personaggio in formato JPG, JPEG o PNG e un video di movimento in formato MP4 o MOV. Ogni file non deve superare 10 MB, deve avere almeno 300 pixel per ciascuna dimensione e deve utilizzare una proporzione compresa tra 1:2.5 e 2.5:1.
Per prima cosa, verifica l'ID del modello, l'autenticazione Bearer, i campi obbligatori e i vincoli sui contenuti multimediali specifici dell'endpoint. Se l'attività è stata accettata, interroga il relativo ID di predizione finché non viene completata o restituisce un errore, quindi esamina l'errore ricevuto. In caso di incoerenze visive, semplifica la scena e usa contenuti sorgente chiari, soprattutto quando trasferisci movimenti facciali o interazioni con oggetti complessi.
Guide, tutorial e novità di prodotto per sfruttare al meglio Atlas Cloud.