MiniMax H3 Developer è ora disponibile — 60% di sconto, a partire da 0,02 $ al secondo

Alibaba Models on Atlas Cloud | Wan & Qwen

Atlas Cloud riunisce l'intera linea di modelli di Alibaba in un'unica API: Qwen per attività linguistiche e di immagine, Wan per la generazione di video fino a 1080p. Accedi a ogni modello in modalità pay-as-you-go senza abbonamenti. L'API di Alibaba è disponibile tramite una singola base URL utilizzando il tuo attuale client compatibile con OpenAI.

Alibaba è sviluppato da Alibaba. Atlas Cloud (gestita da Atlas Cloud AI LLC) ne fornisce l’accesso ma non ne è proprietaria. Tutti i marchi appartengono ai rispettivi titolari.

AI Video Models by Alibaba

Genera video cinematografici ad alta fedeltà da testo e immagini con i più recenti modelli di IA per la generazione video su Atlas Cloud.

Vedi tutti i modelli
Wan 3.0
testo-in-video
immagine-in-video
video-in-video

Wan 3.0

L'API Wan 3.0 è la generazione successiva della famiglia di video Wan di Alibaba, creata per spingere la generazione di formati lunghi, il controllo multi-riferimento e la qualità audiovisiva a nuovi livelli. Atlas Cloud ospita già Wan 2.7, 2.6 e 2.5, e Wan 3.0 funziona sulla stessa chiave unificata senza alcuna configurazione separata. Inizia a costruire oggi stesso. Scorri verso il basso fino alla vetrina per vedere cosa è in grado di creare Wan 3.0.

6 modelliEsplora Wan 3.0
Wan 2.7
immagine-in-video
testo-in-video
video-in-video
immagine-in-immagine

Wan 2.7

L'API Wan 2.7 offre agli sviluppatori la suite video all-in-one di Alibaba, che copre text-to-video, image-to-video, reference-to-video e l'editing video, oltre alla generazione di immagini. Produce clip native a 1080p fino a 15 secondi con audio sincronizzato, controllo dal primo all'ultimo fotogramma e fino a 5 riferimenti di personaggi. (Consulta la pagina più recente dell'[API Wan 3.0](https://www.atlascloud.ai/models/wan-3.0) per video nativi di 30 secondi e fino a 20 riferimenti misti).

8 modelliEsplora Wan 2.7
Happy Horse
LLM
immagine-in-video
testo-in-video
video-in-video

Happy Horse

L'API HappyHorse su Atlas Cloud connette la tua applicazione ai modelli di generazione video HappyHorse 1.0 e 1.1 di Alibaba. Genera clip da 3 a 15 secondi a 720p o 1080p, guida i risultati con fino a nove immagini di riferimento, e scegli il rapporto di aspetto più adatto al tuo prodotto. Atlas Cloud offre disponibilità Day-0 dei modelli, uptime affidabile, e una semplice integrazione REST asincrona. Inizia a sviluppare oggi.

7 modelliEsplora Happy Horse
Wan 2.6
immagine-in-video
immagine-in-immagine
video-in-video
testo-in-video

Wan 2.6

L'API Wan 2.6 costruisce una storia multi-inquadratura da un singolo prompt, anziché una singola clip. Il motore narrativo di Alibaba stacca tra le inquadrature con transizioni coerenti mantenendo stabili l'identità del personaggio, la voce e lo stile per l'intera scena. Copre testo, immagine e riferimento a video in 1080p, con audio sincronizzato e sincronizzazione labiale multilingue. Raggiungila con una sola chiave su Atlas Cloud, accanto a oltre 300 modelli.

6 modelliEsplora Wan 2.6
Van
testo-in-video
immagine-in-video

Van

Van è una serie di video AI di punta realizzata sui framework Wan 2.5 e 2.6, e l'API Van unifica la sua completa gamma text-to-video e image-to-video su Atlas Cloud. Renderizza clip cinematografiche fino a 1080p, quindi scegli i modelli 2.6 ottimizzati per la velocità per un'iterazione rapida o le varianti 2.5 economiche per lotti di grandi dimensioni. Ogni modello viene distribuito il Day-0 dietro una singola chiave compatibile con OpenAI con prezzi a consumo trasparenti. Inizia a sviluppare oggi.

4 modelliEsplora Van
Wan 2.5
testo-in-video
immagine-in-video
immagine-in-immagine
testo-in-immagine

Wan 2.5

L'API di Wan 2.5 produce video e audio in un unico passaggio, consentendo di allineare voce, suono e sincronizzazione labiale senza passaggi separati. Basata sull'architettura Diffusion Transformer di Alibaba, copre la conversione da testo e immagine a video da 480p a 1080p a 5 o 10 secondi, con una sincronizzazione affidabile anche per i prompt in cinese. Accedici tramite un'unica chiave su Atlas Cloud, insieme a oltre 300 modelli.

6 modelliEsplora Wan 2.5
Wan
immagine-in-video

Wan

La Wan API porta i modelli video Wan aperti di Alibaba su Atlas Cloud tramite un'unica chiave unificata. Wan 2.2 è stato pioniere di un'architettura Mixture-of-Experts per la diffusione video, aumentando la capacità e il controllo del movimento a parità di costo di inferenza. Gestisce il text-to-video, l'image-to-video e il video-to-video, con controllo dal primo all'ultimo fotogramma, estensione e upscaling, tutti accessibili insieme a oltre 300 modelli.

2 modelliEsplora Wan

AI Image Models by Alibaba

Crea immagini straordinarie e pronte per la produzione a partire da prompt e riferimenti con i più avanzati modelli di IA per la generazione di immagini su Atlas Cloud.

Vedi tutti i modelli
Wan 2.7
immagine-in-video
testo-in-video
video-in-video
immagine-in-immagine

Wan 2.7

L'API Wan 2.7 offre agli sviluppatori la suite video all-in-one di Alibaba, che copre text-to-video, image-to-video, reference-to-video e l'editing video, oltre alla generazione di immagini. Produce clip native a 1080p fino a 15 secondi con audio sincronizzato, controllo dal primo all'ultimo fotogramma e fino a 5 riferimenti di personaggi. (Consulta la pagina più recente dell'[API Wan 3.0](https://www.atlascloud.ai/models/wan-3.0) per video nativi di 30 secondi e fino a 20 riferimenti misti).

8 modelliEsplora Wan 2.7
Qwen Image
immagine-in-immagine
testo-in-immagine

Qwen Image

La Qwen Image API integra la famiglia di immagini Tongyi Qianwen di Alibaba nel tuo prodotto, dai modelli text-to-image Standard e Professional all’editing guidato da istruzioni. Offre testo in inglese e cinese riprodotto fedelmente, composizione affidabile anche in layout complessi e output ad alta risoluzione fino a 2K. Atlas Cloud mette a disposizione l’intera famiglia tramite un’unica API unificata, con prezzi pay-as-you-go trasparenti a partire da $0.035 per immagine e accesso Day-0 alle nuove release. Inizia a creare oggi stesso.

16 modelliEsplora Qwen Image
Wan 2.6
immagine-in-video
immagine-in-immagine
video-in-video
testo-in-video

Wan 2.6

L'API Wan 2.6 costruisce una storia multi-inquadratura da un singolo prompt, anziché una singola clip. Il motore narrativo di Alibaba stacca tra le inquadrature con transizioni coerenti mantenendo stabili l'identità del personaggio, la voce e lo stile per l'intera scena. Copre testo, immagine e riferimento a video in 1080p, con audio sincronizzato e sincronizzazione labiale multilingue. Raggiungila con una sola chiave su Atlas Cloud, accanto a oltre 300 modelli.

6 modelliEsplora Wan 2.6
Wan 2.5
testo-in-video
immagine-in-video
immagine-in-immagine
testo-in-immagine

Wan 2.5

L'API di Wan 2.5 produce video e audio in un unico passaggio, consentendo di allineare voce, suono e sincronizzazione labiale senza passaggi separati. Basata sull'architettura Diffusion Transformer di Alibaba, copre la conversione da testo e immagine a video da 480p a 1080p a 5 o 10 secondi, con una sincronizzazione affidabile anche per i prompt in cinese. Accedici tramite un'unica chiave su Atlas Cloud, insieme a oltre 300 modelli.

6 modelliEsplora Wan 2.5

Large Language Models by Alibaba

Alimenta chat, ragionamento e agenti su larga scala con i migliori modelli linguistici di grandi dimensioni, erogati in modo rapido ed economico su Atlas Cloud.

Vedi tutti i modelli

Alibaba Models API Pricing Details

Compare standard vs. our pricing across every Alibaba model.

ModelStandard Price (USD)Our Price (USD)Discount
Qwen3.6 Plus
$0.5/$3per 1M tokens1000K context
$0.325/$1.95M in/outper 1M tokens1000K context
-35%View
Qwen-Image Edit Plus 20251215$0.03/pic
Start from$0.021/pic
-30%View
Qwen Image Edit$0.045/pic
Start from$0.032/pic
-30%View
Qwen-Image Text-to-image Max$0.075/pic
Start from$0.052/pic
-30%View
Qwen-Image Text-to-image Plus$0.03/pic
Start from$0.021/pic
-30%View
Qwen-Image Edit$0.045/pic
Start from$0.032/pic
-30%View

Explore models from other providers

Instantly explore and experiment with 400+ production-ready models in the Atlas Playground. Start customizing with one click.

Casi d'uso dell'API di Alibaba che è possibile sviluppare su Atlas Cloud

Qwen e Wan coprono l'intera gamma della produzione multimediale tramite IA: attività linguistiche, generazione di immagini e creazione di video da una singola API. Sviluppatori e team li usano insieme per creare pipeline che vanno dal prompt di testo al video finito senza cambiare fornitore.

Video di Prodotti E-commerce

I team di e-commerce animano immagini statiche dei prodotti in brevi clip video per le pagine dei prodotti e gli annunci social. L'endpoint image-to-video di Wan 2.7 acquisisce una foto del prodotto e un prompt di testo che descrive il movimento, quindi produce una clip a 1080p con audio sincronizzato. A 0,10 $ per esecuzione su Atlas Cloud, i team possono generare varianti video per ogni SKU senza un budget di produzione dedicato.

Pipeline di produzione da immagine a video

Gli sviluppatori creano pipeline end-to-end che generano un'immagine di scena con Qwen Image 2.0, per poi passarla direttamente all'endpoint da immagine a video di Wan 2.7 per l'animazione. Entrambi i modelli funzionano con la stessa chiave API di Atlas Cloud, quindi non è necessaria alcuna autenticazione separata o cambio di provider. Il controllo del primo e dell'ultimo fotogramma in Wan 2.7 consente di definire esattamente come si apre e si chiude ogni clip animata.

Elaborazione Multilingue di Documenti

I team aziendali utilizzano Qwen LLM per elaborare documenti, contratti e appunti scansionati in 32 lingue con una singola chiamata API. Il modello gestisce accuratamente le scritture non latine, rendendolo pratico per le operazioni nel mercato asiatico in cui altri LLM risultano inadeguati. Atlas Cloud offre l'accesso a Qwen LLM con un modello pay-as-you-go, senza licenze per singolo utente.

Generazione di Codice Agenziale

I team di sviluppo utilizzano Qwen 3.6-Plus per attività di codifica complesse: scomporre problemi a livello di repository, scrivere codice, eseguire test e iterare fino al completamento. Il modello gestisce flussi di lavoro di programmazione in più fasi senza intervento manuale tra una fase e l'altra. L'accesso tramite l'API compatibile con OpenAI su Atlas Cloud consente l'integrazione nei framework di agenti esistenti senza lavori di integrazione personalizzati.

Video Breve Diretto dalla Scena

Il controllo del primo e dell'ultimo fotogramma di Wan 2.7 consente ai creatori di impostare il fotogramma di apertura e di chiusura di una clip, mentre il modello gestisce il movimento intermedio. Ciò offre ai team video un controllo ripetibile sul ritmo e sulla composizione che i prompt di solo testo non possono eguagliare. L'output raggiunge i 1080p fino a 15 secondi per clip, risultando adatto per i social media e i formati pubblicitari.

Sintesi Automatizzata di Notizie Video

I team multimediali costruiscono pipeline che convertono gli articoli di testo quotidiani in brevi segmenti video utilizzando l'endpoint text-to-video di Wan 2.7. Ogni articolo diventa una clip indipendente con immagini e audio generati, assemblata in un riassunto senza montaggio manuale. La tariffa fissa per esecuzione su Atlas Cloud mantiene i costi prevedibili quando si generano grandi volumi di clip con una programmazione giornaliera.

Trasforma la visione della tua azienda in realtà con Atlas Cloud AI.

Contatta il commerciale

Frequently Asked Questions about Alibaba Models API

Atlas Cloud ospita l'intera gamma di modelli Qwen e Wan sotto un'unica API. Ciò include Wan 2.7, Wan 2.6, Wan 2.5 e Wan 2.2 per la generazione di video, Qwen Image 2.0 per la generazione di immagini e i modelli Qwen LLM per le attività linguistiche. Tutti i modelli sono disponibili in modalità pay-as-you-go con una singola API key.

Yes. Atlas Cloud adds new Qwen and Wan versions as they launch. Wan 2.7, released in March 2026, was available on Atlas Cloud from day one. Check the Qwen and Wan collection page for the latest model versions as they go live.

Wan 2.7 accetta prompt testuali per la generazione da testo a video e immagini di riferimento per quella da immagine a video. L'input del primo e dell'ultimo fotogramma è disponibile quando è necessario un controllo preciso su come inizia e finisce una scena. È supportato anche l'editing video basato su istruzioni per modificare le clip esistenti tramite l'API.

Wan 2.7 genera video con una risoluzione fino a 1080p e una durata della clip da 2 a 15 secondi. Le proporzioni e la durata sono configurabili per ogni chiamata API. L'output include l'audio sincronizzato generato insieme al video in una singola richiesta.

Sì. Qwen Image 2.0 produce immagini con una risoluzione fino a 2K, che possono essere passate direttamente all'endpoint image-to-video di Wan 2.7. Entrambi i modelli funzionano con la stessa chiave API di Atlas Cloud. Ciò rende pratico costruire una pipeline image-to-video completa senza dover cambiare fornitore.

Sì. Atlas Cloud fornisce un'API compatibile con OpenAI su api.atlascloud.ai/v1. Sostituisci l'URL di base nella tua configurazione esistente dell'SDK di OpenAI e tutte le chiamate a Qwen LLM funzioneranno senza ulteriori modifiche. Gli endpoint dei modelli video e immagine seguono lo stesso pattern di autenticazione.

Wan 2.7 supporta l'output a 1080p, gli input multi-riferimento e l'editing basato su istruzioni in una singola chiamata API, coprendo la maggior parte dei requisiti di produzione. La tariffa fissa per esecuzione su Atlas Cloud rende i costi prevedibili su larga scala. L'accesso a consumo (pay-as-you-go) significa che non sono necessari impegni di capacità per scalare.

La generazione di video con Wan 2.7 prevede un costo fisso di 0,10 $ per esecuzione, senza tariffe basate sulla durata. I modelli Qwen Image hanno un prezzo fino al 30% inferiore rispetto alla tariffa ufficiale dell'API di Alibaba. Tutti i modelli sono disponibili con pagamento a consumo (pay-as-you-go), senza minimi mensili.

Esplora Altre Famiglie

Seedance 2.5

L'API Seedance 2.5 è ora disponibile su Atlas Cloud! Offre agli sviluppatori il più recente modello video di ByteDance. Genera fino a 30 secondi di video nativo in un unico passaggio da testo, una singola immagine o fino a 50 riferimenti multimodali, con audio sincronizzato e testo multilingue nell'inquadratura. Su Atlas Cloud vi si accede tramite un'unica chiave, con la coerenza del soggetto e la fisica migliorata che mantengono coerenti le riprese lunghe.

Visualizza Famiglia

Wan 3.0

L'API Wan 3.0 è la generazione successiva della famiglia di video Wan di Alibaba, creata per spingere la generazione di formati lunghi, il controllo multi-riferimento e la qualità audiovisiva a nuovi livelli. Atlas Cloud ospita già Wan 2.7, 2.6 e 2.5, e Wan 3.0 funziona sulla stessa chiave unificata senza alcuna configurazione separata. Inizia a costruire oggi stesso. Scorri verso il basso fino alla vetrina per vedere cosa è in grado di creare Wan 3.0.

Visualizza Famiglia

MiniMax H3

L’API MiniMax H3 rende disponibile il modello video multimodale generico di MiniMax, che interpreta testo, immagini, video e audio come un unico contesto, anziché come attività separate. I clip durano da 5 a 15 secondi a 24 FPS, con rapporti d’aspetto da 21:9 a 9:16, e un singolo prompt può sostituire personaggi, cambiare sfondi, riscrivere dialoghi o clonare una voce da una clip di riferimento. Atlas Cloud offre tutto tramite un unico endpoint compatibile con OpenAI. Inizia a sviluppare oggi stesso.

Visualizza Famiglia

Seedream 5.0 Pro

L'API Seedream 5.0 Pro offre agli sviluppatori il modello di editing delle immagini controllabile di ByteDance su Atlas Cloud. Posiziona le modifiche con precisione tramite ancore e coordinate, separa le immagini in livelli modificabili, fonde più riferimenti e abbina colori e materiali esatti, con testo multilingue a 2K e 3K. Su Atlas Cloud puoi accedervi tramite una sola chiave!

Visualizza Famiglia

Seedance 2.0

L'API Seedance 2.0 ti offre l'accesso in produzione al modello video multimodale di ByteDance: input quadrimodali (testo, immagine, video, audio) e un sistema "Universal Reference" leader del settore che blocca la composizione, i movimenti di macchina e le azioni dei personaggi tra le diverse inquadrature. Integra un controllo di livello registico con una sola chiamata API, una tariffa fissa di $0,09/s, chiave istantanea e nessuna lista d'attesa, il tutto supportato da uptime e conformità di livello enterprise. Seedance 2.0 Native 4K è ora disponibile!

Visualizza Famiglia

GPT Image 2

L'API GPT Image 2 offre agli sviluppatori l'accesso all'ultimo modello di immagini di OpenAI, il successore di GPT Image 1.5. Genera e modifica immagini con un rendering accurato del testo nei caratteri latini e CJK, oltre a una solida composizione per poster, mockup e infografiche. Su Atlas Cloud puoi accedervi tramite un'unica API unificata insieme a oltre 300 modelli, con crediti gratuiti, un tempo di attività del 99,99% e nessuna verifica dell'organizzazione OpenAI richiesta.

Visualizza Famiglia

Gemini Omni Flash

La Gemini Omni API porta nel tuo stack il modello multimodale di generazione ed editing video di Google DeepMind, presentato a Google I/O 2026. Gemini Omni fonde il motore di ragionamento di Gemini con i media generativi, accettando qualsiasi combinazione di testo, immagini, video e audio per produrre output coerenti e fondati sulla conoscenza. Perfeziona i risultati con una conversazione naturale: sostituisci oggetti, riscrivi scene e cambia stile, mentre fisica, personaggi e continuità restano intatti. Atlas Cloud offre l'intera gamma Gemini Omni Flash — text-to-video, image-to-video con fino a 7 immagini di riferimento e reference-to-video — tramite un'unica API unificata, con prezzi trasparenti al secondo a partire da $0.112 e senza abbonamento. Inizia a sviluppare oggi stesso.

Visualizza Famiglia

Grok Imagine

L'API Grok Imagine supporta i modelli di immagine, video e sintesi vocale di xAI, da Image 2.0 a Video 1.5 e xAI TTS v1. Genera immagini statiche 1K o 2K su 14 proporzioni d'aspetto, crea scene fino a 15 secondi di movimento 1080p, guida gli scatti con fino a 7 immagini di riferimento, o narrarli in 20 lingue. Atlas Cloud esegue ogni modalità su un singolo endpoint, con prezzi pay-as-you-go da $0,02 per immagine e $0,05 al secondo. Inizia a sviluppare oggi.

Visualizza Famiglia

Google

I modelli creativi più potenti di Google sono tutti disponibili su Atlas Cloud. Veo 3.1 offre la generazione di video cinematografici, Nano Banana 2 alimenta la creazione di immagini ad alta fedeltà e Gemini porta l'intelligenza multimodale in ogni flusso di lavoro. Accedi alla suite completa di modelli Google tramite una singola API key con disponibilità Day-0 e prezzi a consumo (pay-as-you-go).

Visualizza Famiglia

Seedance 2.0 Mini

Seedance 2.0 Mini porta la generazione video multimodale di ByteDance nei flussi di lavoro in cui velocità e costi sono fondamentali. Offre le capacità principali di Seedance 2.0 con un impatto minore: generazione più rapida, costi inferiori per video e la stessa integrazione API che utilizzi già. Per i team che gestiscono pipeline ad alto volume o prototipazione su larga scala, Mini è l'opzione predefinita pratica.

Visualizza Famiglia

ByteDance

Dalla generazione di video cinematografici alla creazione di immagini ad alta fedeltà, i modelli più potenti di ByteDance sono disponibili su Atlas Cloud. Esegui Seedance e Seedream su larga scala con i prezzi di inferenza più bassi e zero costi generali di infrastruttura.

Visualizza Famiglia

Alibaba

Atlas Cloud riunisce l'intera linea di modelli di Alibaba in un'unica API: Qwen per attività linguistiche e di immagine, Wan per la generazione di video fino a 1080p. Accedi a ogni modello in modalità pay-as-you-go senza abbonamenti. L'API di Alibaba è disponibile tramite una singola base URL utilizzando il tuo attuale client compatibile con OpenAI.

Visualizza Famiglia

Articoli consigliati

Guide, tutorial e novità di prodotto per sfruttare al meglio Atlas Cloud.