Seedance 2.5 è ora live — In anteprima su Atlas Cloud

Wan 3.0 API is Coming to Atlas Cloud Soon

L'API Wan 3.0 è la generazione successiva della famiglia di video Wan di Alibaba, costruita per spingere la generazione di formati lunghi, il controllo multi-riferimento e la qualità audiovisiva verso nuove vette. Atlas Cloud ospita già Wan 2.7, 2.6 e 2.5, pertanto Wan 3.0 utilizzerà la stessa chiave unificata e funzionerà senza alcuna configurazione separata. Ottieni l'accesso anticipato il giorno del lancio. Scorri verso il basso fino alla vetrina per dare una prima occhiata a ciò che Wan 3.0 può creare.

Wan 3.0 è sviluppato da Alibaba. Atlas Cloud (gestita da Atlas Cloud AI LLC) ne fornisce l’accesso ma non ne è proprietaria. Tutti i marchi appartengono ai rispettivi titolari.

Prossimamente

Modelli in arrivo

Stiamo dando gli ultimi ritocchi a questa collezione — nel frattempo, esplora le collezioni simili qui sotto.

Esplora Altre Famiglie

Seedance 2.5

L'API Seedance 2.5 è ora disponibile su Atlas Cloud! Offre agli sviluppatori il più recente modello video di ByteDance. Genera fino a 30 secondi di video nativo in un unico passaggio da testo, una singola immagine o fino a 50 riferimenti multimodali, con audio sincronizzato e testo multilingue nell'inquadratura. Su Atlas Cloud vi si accede tramite un'unica chiave, con la coerenza del soggetto e la fisica migliorata che mantengono coerenti le riprese lunghe.

Visualizza Famiglia

MiniMax H3

L’API MiniMax H3 rende disponibile il modello video multimodale generico di MiniMax, che interpreta testo, immagini, video e audio come un unico contesto, anziché come attività separate. I clip durano da 5 a 15 secondi a 24 FPS, con rapporti d’aspetto da 21:9 a 9:16, e un singolo prompt può sostituire personaggi, cambiare sfondi, riscrivere dialoghi o clonare una voce da una clip di riferimento. Atlas Cloud offre tutto tramite un unico endpoint compatibile con OpenAI. Inizia a sviluppare oggi stesso.

Visualizza Famiglia

Seedream 5.0 Pro

L'API Seedream 5.0 Pro offre agli sviluppatori il modello di editing delle immagini controllabile di ByteDance su Atlas Cloud. Posiziona le modifiche con precisione tramite ancore e coordinate, separa le immagini in livelli modificabili, fonde più riferimenti e abbina colori e materiali esatti, con testo multilingue a 2K e 3K. Su Atlas Cloud puoi accedervi tramite una sola chiave!

Visualizza Famiglia

Seedance 2.0

L'API Seedance 2.0 ti offre l'accesso in produzione al modello video multimodale di ByteDance: input quadrimodali (testo, immagine, video, audio) e un sistema "Universal Reference" leader del settore che blocca la composizione, i movimenti di macchina e le azioni dei personaggi tra le diverse inquadrature. Integra un controllo di livello registico con una sola chiamata API, una tariffa fissa di $0,09/s, chiave istantanea e nessuna lista d'attesa, il tutto supportato da uptime e conformità di livello enterprise. Seedance 2.0 Native 4K è ora disponibile!

Visualizza Famiglia

GPT Image 2

L'API GPT Image 2 offre agli sviluppatori l'accesso all'ultimo modello di immagini di OpenAI, il successore di GPT Image 1.5. Genera e modifica immagini con un rendering accurato del testo nei caratteri latini e CJK, oltre a una solida composizione per poster, mockup e infografiche. Su Atlas Cloud puoi accedervi tramite un'unica API unificata insieme a oltre 300 modelli, con crediti gratuiti, un tempo di attività del 99,99% e nessuna verifica dell'organizzazione OpenAI richiesta.

Visualizza Famiglia

Gemini Omni Flash

La Gemini Omni API porta nel tuo stack il modello multimodale di generazione ed editing video di Google DeepMind, presentato a Google I/O 2026. Gemini Omni fonde il motore di ragionamento di Gemini con i media generativi, accettando qualsiasi combinazione di testo, immagini, video e audio per produrre output coerenti e fondati sulla conoscenza. Perfeziona i risultati con una conversazione naturale: sostituisci oggetti, riscrivi scene e cambia stile, mentre fisica, personaggi e continuità restano intatti. Atlas Cloud offre l'intera gamma Gemini Omni Flash — text-to-video, image-to-video con fino a 7 immagini di riferimento e reference-to-video — tramite un'unica API unificata, con prezzi trasparenti al secondo a partire da $0.112 e senza abbonamento. Inizia a sviluppare oggi stesso.

Visualizza Famiglia

Grok Imagine

L'API Grok Imagine supporta i modelli di immagine, video e sintesi vocale di xAI, da Image 2.0 a Video 1.5 e xAI TTS v1. Genera immagini statiche 1K o 2K su 14 proporzioni d'aspetto, crea scene fino a 15 secondi di movimento 1080p, guida gli scatti con fino a 7 immagini di riferimento, o narrarli in 20 lingue. Atlas Cloud esegue ogni modalità su un singolo endpoint, con prezzi pay-as-you-go da $0,02 per immagine e $0,05 al secondo. Inizia a sviluppare oggi.

Visualizza Famiglia

Google

I modelli creativi più potenti di Google sono tutti disponibili su Atlas Cloud. Veo 3.1 offre la generazione di video cinematografici, Nano Banana 2 alimenta la creazione di immagini ad alta fedeltà e Gemini porta l'intelligenza multimodale in ogni flusso di lavoro. Accedi alla suite completa di modelli Google tramite una singola API key con disponibilità Day-0 e prezzi a consumo (pay-as-you-go).

Visualizza Famiglia

Seedance 2.0 Mini

Seedance 2.0 Mini porta la generazione video multimodale di ByteDance nei flussi di lavoro in cui velocità e costi sono fondamentali. Offre le capacità principali di Seedance 2.0 con un impatto minore: generazione più rapida, costi inferiori per video e la stessa integrazione API che utilizzi già. Per i team che gestiscono pipeline ad alto volume o prototipazione su larga scala, Mini è l'opzione predefinita pratica.

Visualizza Famiglia

ByteDance

Dalla generazione di video cinematografici alla creazione di immagini ad alta fedeltà, i modelli più potenti di ByteDance sono disponibili su Atlas Cloud. Esegui Seedance e Seedream su larga scala con i prezzi di inferenza più bassi e zero costi generali di infrastruttura.

Visualizza Famiglia

Alibaba

Atlas Cloud riunisce l'intera linea di modelli di Alibaba in un'unica API: Qwen per attività linguistiche e di immagine, Wan per la generazione di video fino a 1080p. Accedi a ogni modello in modalità pay-as-you-go senza abbonamenti. L'API di Alibaba è disponibile tramite una singola base URL utilizzando il tuo attuale client compatibile con OpenAI.

Visualizza Famiglia

OpenAI

Atlas Cloud ti offre l'accesso all'intera linea di API di OpenAI, da GPT Image 2 per la generazione di immagini a Sora 2 per i video. Ogni modello è disponibile in modalità pay-as-you-go senza alcun impegno mensile. Integralo con una semplice sostituzione dell'URL di base utilizzando l'API compatibile con OpenAI.

Visualizza Famiglia

Wan 3.0 in azione

6 funzionalità di punta che mostrano cosa può produrre una singola richiesta a Wan 3.0, dai filmati di marca multi-referenza ai piani sequenza di 30 secondi.

Film di marca multiriferimento

La modalità Omni acquisisce fino a 20 materiali di riferimento, 10 immagini, 5 clip e 5 tracce audio, oltre a un documento o una pagina web di origine, in modo che un intero brand kit diventi un unico video in linea con il marchio in un solo passaggio.

Storie in un'unica ripresa da 30 secondi

L'output nativo di 30 secondi dà alla narrazione respiro per svilupparsi, supportando movimenti continui della telecamera e piani sequenza che le clip più brevi non possono contenere. La durata intelligente consente al modello di gestire il ritmo di ogni scena in autonomia.

Coerenza di Riferimento a Livello di Pixel

Volti, prodotti e dettagli fini vengono riprodotti con una fedeltà a livello di pixel in ogni fotogramma. I team di produzione ottengono la certezza di consegna richiesta dai personaggi ricorrenti e dalle precise risorse del brand.

Suono Immersivo e Realismo

Il realismo, la consistenza dell'immagine e l'audio nativo migliorano simultaneamente, cosicché una scena generata si presenta con il suono corrispondente anziché come filmato silenzioso. Il risultato offre un vero impatto audiovisivo.

Modifica di istruzioni e riferimenti

L'editing preciso rielabora i filmati esistenti partendo da un'istruzione scritta o da una clip di riferimento, modificando un soggetto, uno stile o un momento senza rigenerare l'intero video.

Documenti e pagine web in video

Oltre a testo, immagini, audio e video, Wan 3.0 legge file doc, xls, ppt, pdf e md, nonché pagine web dal vivo, trasformando un rapporto o una presentazione direttamente in una clip finita.

Confronti video nello stesso prompt

Guarda la presentazione video generata dai modelli Wan 3.0, Seedance 2.5 e Wan 2.7.

Prompt

Generating a 30-second, 16:9 widescreen adult sci-fi war animated short film. Visual style: Ultra-photorealistic CGI Biomechanical structures Fusion of gray-white bone and black metal Insect-like joints Extremely fine bone texturing Dried blood streaks, ceramic cracks, and industrial oil grime Abandoned futuristic city Cold gray skylight Sparse toxic-green organisms High-contrast cinematic lighting Low-saturation cool color palette Minimal orange-red used only for flames and alarms Realistic physical destruction Oppressive, heavy, unheroic tone Characters no longer have complete flesh bodies. They are composed primarily of: Human spine Ribs Skull Black hydraulic muscle Metal joints Neural fiber optics Weapon interface ports The skeletons are not zombies — they are "legacy hardware" still being operated by military-industrial systems. Narrative & Dynamic Timeline 0–4 sec | Still Fighting After Death The shot opens on a soldier's dog tag lying in a pool of standing water. Want me to continue translating the rest of the timeline if you have more seconds/beats written out? This looks like it's cut off after the 0-4 second beat.

Generated by Wan 3.0

Generated by Seedance 2.5 on Altas Cloud

Generated by Wan 2.7 on Altas Cloud

Prompt

Generating a 15-second, 16:9 ultra-widescreen plush-universe adventure clip. A spaceship made of plush fabric, buttons, zippers, and stuffing cotton is fleeing at high speed through a universe made of giant yarn planets, fuzzy nebulae, and rag-doll megafauna. The ship is piloted by three small plush animals: a rabbit, a fox, and a crow. A giant interstellar whale-beast covered in deep-blue long plush fur, with eyes like two glass buttons, chases the ship out of the nebula. Overall style: ultra-fine plush textures, cinematic space scale, a strong contrast between cute appearance and intense action, exaggerated FPV camera work, and realistic soft-body physics. **15-Second Dynamic Timeline** **0–3 sec | Zipper Ship Ejection Launch** The shot is inside the plush ship, with a cockpit made of stitching, buttons, and fabric instrument panels. A red warning button flashes rapidly. The rabbit pulls down a giant zipper-lever control, and the ship's forward hatch splits open like a cloth sack. The camera pulls back rapidly from the cockpit, passes through the zipper hatch, and emerges outside the ship. The ship ejects and launches out of the knitted crater of a yarn planet. **3–6 sec | High-Speed Orbit Skimming the Yarn Planet** The camera hugs the ship's tail, flying low over the planet's surface. The ground is woven from giant strands of yarn: - Knitted mountain ranges streak past below at high speed - Loose thread-ends sway like a forest - The ship dodges sharply left and right - The camera continuously banks and rolls - The thrusters emit a trailing wake of white cotton fluff **6–8.5 sec | The Giant Plush Whale Appears** The fuzzy nebula suddenly parts to either side as a giant deep-blue plush whale bursts out from behind. The long fur on the whale's body is blown backward by the high-speed airflow, and its glass-button eyes reflect the planet's light. The camera whips halfway around the ship, switching to a rear-facing (reverse) view, so the whale continuously grows larger in the frame behind the ship.

Generated by Wan 3.0

Generated by Seedance 2.5 on Altas Cloud

Generated by Wan 2.7 on Altas Cloud

Wan 3.0 API - Progettato per vere pipeline creative

Gli aggiornamenti di Wan 3.0 derivano dalle reali esigenze del settore, integrandonsi direttamente nei flussi di lavoro di produzione sottostanti, dai cortometraggi ai filmati aziendali.

Cinema, TV, Serie Brevi e MV

Le riprese native di 30 secondi e il ripristino delle scene reali consentono ai film, ai cortometraggi e ai video musicali basati sull'IA di saltare gran parte delle riprese fisiche. La coerenza dei pixel mantiene i protagonisti ricorrenti e l'audio nativo arriva già sincronizzato con ogni taglio.

Animazione, Brand e IP

Il controllo totale dello stile passa dal realistico all'anime all'interno di un unico modello, mentre la coerenza dei pixel fissa una mascotte, un logo o un personaggio IP in ogni fotogramma. Le animazioni complete del brand vengono renderizzate senza la noiosa catena di produzione.

Pubblicità e Promozione Aziendale

La creazione Omni supera i limiti di testo e immagine per i marchi di elettrodomestici, bellezza, auto, beni di largo consumo (FMCG) e abbigliamento. Inserisci direttamente una pagina di prodotto o un rapporto aziendale per creare di tutto, dalle dimostrazioni dei prodotti ai filmati del marchio aziendale.

Design di Software e Prodotti

Inserisci una presentazione dell'interfaccia utente di un prodotto, un'animazione di una funzionalità o una visualizzazione dei dati: Wan 3.0 manterrà l'estetica originale trasformandola in un'opera di motion design narrativa. La noiosa fase di animazione scompare.

Istruzione

L'inserimento dei documenti legge direttamente un PDF, un PPT o una pagina web, cosicché una lezione o un rapporto di ricerca diventa un chiaro video esplicativo senza copione separato. Il materiale complesso diventa visivo in un solo passaggio.

Turismo Culturale

La ricostruzione di scene reali ricrea paesaggi, siti storici e cucina locale senza riprese su larga scala, consentendo di realizzare filmati urbani e la digitalizzazione culturale a basso costo. Luoghi lontani si materializzano direttamente davanti agli spettatori.

Come Utilizzare Wan 3.0 su Atlas Cloud

Inizia in pochi minuti — segui questi semplici passaggi per integrare e distribuire i modelli tramite la piattaforma Atlas Cloud.

Crea un Account Atlas Cloud

Registrati su atlascloud.ai e completa la verifica. I nuovi utenti ricevono crediti gratuiti per esplorare la piattaforma e testare i modelli.

Perché Usare Wan 3.0 su Atlas Cloud

Combinando i modelli avanzati di Wan 3.0 con la piattaforma GPU-accelerata di Atlas Cloud, ottieni prestazioni, scalabilità ed esperienza di sviluppo senza pari.

Prestazioni e Flessibilità

Bassa Latenza:
Inferenza ottimizzata su GPU per elaborazione in tempo reale.

API Unificata:
Esegui Wan 3.0, GPT, Gemini e DeepSeek con un'unica integrazione.

Prezzi Trasparenti:
Fatturazione prevedibile per token con opzioni Serverless.

Enterprise e Scalabilità

Esperienza Sviluppatore:
SDK, analytics, strumenti di fine-tuning e template.

Affidabilità:
99,99% di uptime, RBAC e logging conforme alle normative.

Sicurezza e Conformità:
SOC 2 Type II, allineamento HIPAA, sovranità dei dati negli USA.

Domande frequenti sull'API Wan 3.0

Wan 3.0 è il modello video all-in-one di nuova generazione di Alibaba, ora in beta pubblica. Una sola richiesta può trasformare testo, immagini, video, audio, documenti o pagine web in un video lungo fino a 30 secondi, e il modello abbina questo ampio input a una coerenza a livello di pixel, un editing preciso e un audio generato in modo nativo.

Atlas Cloud prevede di aggiungere l'API Wan 3.0 non appena Alibaba la rilascerà, con l'obiettivo di offrire un accesso Day-0. Registrati e ricevi una notifica il giorno in cui sarà online.

Wan 3.0 è la release più ampia della linea. Aumenta la durata nativa a 30 secondi, accetta fino a 20 materiali di riferimento misti oltre a documenti e pagine web in modalità omni-reference, aggiunge una modalità primo-e-ultimo-frame e punta alla coerenza a livello di pixel con audio nativo. Le versioni precedenti di Wan su Atlas Cloud rimangono scelte valide per lavori di text-to-video e image-to-video più brevi e mirati.

Wan 3.0 elabora molto più di un semplice prompt come materiale di origine. Una singola richiesta può attingere a un massimo di 20 riferimenti misti, 10 immagini, 5 clip video per un totale di 15 secondi e 5 clip audio per un totale di 15 secondi, insieme a un singolo documento (doc, xls, ppt, pdf o md) o pagina web, mentre il prompt testuale stesso può raggiungere i 20.000 caratteri.

Le clip durano nativamente fino a 30 secondi. Una richiesta testuale o di immagine può variare da 2 a 30 secondi, mentre una richiesta che include un video mantiene l'input e l'output entro un totale combinato di 30 secondi e la durata intelligente può impostare la lunghezza automaticamente. La risoluzione comprende 480p, 720p e 1080p, con proporzioni 16:9, 9:16, 4:3, 3:4, 1:1 e proporzioni intelligenti disponibili.

La coerenza viene gestita a livello di pixel, in modo che un volto, un abito, un prodotto o un minimo dettaglio di riferimento mantenga il suo aspetto al cambio delle scene e al movimento dei soggetti. Per i cicli di produzione che riutilizzano lo stesso personaggio o un preciso asset di marca, questa stabilità è ciò che rende prevedibile ogni consegna.

Sì, sia tramite istruzioni che tramite riferimenti. Una nota scritta o una clip di esempio possono modificare lo stile di un soggetto, cambiare l'illuminazione o sostituire un singolo segmento, e gli elementi che si desidera lasciare intatti rimangono al loro posto per tutto il montaggio.

Sì. Atlas Cloud offre già Wan 2.7, 2.6 e 2.5 con un'unica chiave unificata e Wan 3.0 si aggiungerà alla stessa chiave senza bisogno di un nuovo account, senza riorganizzazione degli endpoint e senza configurazioni separate. I team che già effettuano chiamate alla famiglia Wan potranno accedere a Wan 3.0 semplicemente cambiando il nome del modello non appena sarà disponibile.

Un'unica API per tutta l'IA multimediale.

Esplora tutti i modelli