


Qwen Image 2.0 est le modèle d’image de nouvelle génération de l’équipe Qwen d’Alibaba Cloud. Conçu pour les entrées textuelles et les images, il offre une sortie native en 2K, une meilleure fidélité sémantique, des détails réalistes et un suivi précis des instructions pour les workflows de création et de révision. Atlas Cloud fournit des endpoints REST prêts à l’emploi pour les deux modes, sans démarrage à froid, au tarif standard de $0.035 par image. Commencez à développer dès aujourd’hui.
Qwen Image 2.0 est développé par Alibaba. Atlas Cloud (exploité par Atlas Cloud AI LLC) en fournit l’accès mais n’en est pas propriétaire. Toutes les marques appartiennent à leurs détenteurs respectifs.
Atlas Cloud vous offre les derniers modèles créatifs de pointe de l'industrie.
Comparez deux endpoints Qwen Image 2.0 pour créer et affiner des images dans des résolutions allant jusqu’à 2K.
| Modalité | Description |
|---|---|
| Qwen Image 2.0 Text to Image API | Transformez des prompts textuels en images dans des résolutions allant jusqu’à 2K, avec une meilleure compréhension des prompts et une qualité d’image accrue. Utilisez cet endpoint pour les concept arts, les visuels de produits, les supports marketing et autres workflows visuels basés sur des prompts. |
| Qwen Image 2.0 Edit API | Conçu pour l’édition d’images, cet endpoint applique des instructions écrites à des visuels existants et produit des résultats dans des résolutions allant jusqu’à 2K. Il convient à l’affinage de ressources, aux variations créatives, aux modifications visuelles ciblées et aux workflows de production itératifs. |
Qwen Image 2.0 combine une sortie jusqu’à 2K, une meilleure compréhension des prompts, le rendu de texte bilingue, l’édition guidée par référence, des seeds reproductibles et un accès REST à Atlas Cloud avec une tarification transparente à l’usage.

Qwen Image 2.0 génère des images de 512 à 2048 pixels par dimension, avec une sortie jusqu’à 2K. Sa qualité d’image améliorée préserve les surfaces détaillées, les paysages en profondeur et les petits accents visuels sur l’ensemble du cadre. Choisissez les dimensions adaptées à votre format de diffusion. Le modèle convient ainsi parfaitement aux visuels produits, à la photographie éditoriale et aux concepts artistiques détaillés.

Les briefs structurés restent faciles à gérer avec des prompts de 800 caractères maximum en anglais ou en chinois. Décrivez le sujet, l’éclairage, la composition, les matériaux et l’action dans une seule instruction, puis utilisez un seed fixe lorsque vous avez besoin d’itérations reproductibles. Une meilleure compréhension des prompts aide à préserver les relations entre les différents éléments demandés. Les concepts complexes deviennent plus prévisibles pour les campagnes, les scènes architecturales et les workflows créatifs dirigés.

Du texte anglais et chinois lisible peut apparaître dans des visuels denses et soigneusement composés. Le modèle associe un rendu multilingue fiable à une composition maîtrisée, afin que les libellés, panneaux, titres et éléments graphiques complémentaires restent alignés sur la scène environnante. Les indications bilingues peuvent rester intégrées à l’image plutôt que d’être ajoutées en superposition. Utilisez cette fonctionnalité pour les visuels promotionnels grand format, les présentations, les menus et les créations riches en informations qui nécessiteraient autrement un important travail de retouche manuelle.

Commencez avec une à trois images de référence, puis décrivez la modification souhaitée en langage naturel. L’endpoint d’édition accepte des instructions de 800 caractères maximum et peut renvoyer des images jusqu’à 2K tout en utilisant un seed pour des exécutions reproductibles. Ce workflow contrôlé convient aux révisions de produits, au restylage visuel et au développement créatif itératif, sans devoir reconstruire la composition source à partir de zéro.

Les dimensions de sortie peuvent aller de 512 à 2048 pixels par côté, et les seeds acceptent des valeurs de 0 à 2147483647. Un seed aléatoire reste disponible avec la valeur par défaut negative one. Adaptez le canevas aux besoins carrés, paysage ou portrait tout en conservant un point de départ reproductible. Ces contrôles simplifient les tests systématiques et la production cohérente de ressources pour plusieurs emplacements.

Atlas Cloud fournit la génération texte vers image et l’édition d’images via des endpoints REST au tarif standard de $0.035 par image. L’inférence prête à l’emploi, l’absence de démarrages à froid et l’accès Day 0 éliminent le travail d’hébergement du modèle, tandis qu’une API unifiée garantit une intégration cohérente dans toute la famille. Cette configuration prend en charge les prototypes, les outils de production et les pipelines d’images évolutifs, avec une facturation transparente à l’usage.
Découvrez comment Qwen Image 2.0 et deux modèles d’image comparables interprètent des prompts identiques, entre conception graphique précise et photographie documentaire de mouvement prise sur le vif.
Un film catastrophe cinématographique en coulisses, tourné sur une table, capturé à l’instant décisif : la main réaliste d’un jeune maquettiste entre dans le cadre pour stabiliser un phare miniature renversé par une immense vague surgissant soudainement d’une tasse à thé blanc crème, tandis que plusieurs figurines minuscules de l’équipe de tournage fuient paniquées en emportant une caméra bleu marine, un trépied, des câbles et du matériel d’éclairage ; une petite ardoise de cinéma parfaitement lisible affiche exactement « LA DERNIÈRE TASSE DE THÉ » et « PRISE 07 », dans une typographie nette et correctement orthographiée. Tactilité de l’animation en stop-motion artisanale mêlée à une photographie macro photoréaliste, soulignant le télescopage humoristique entre les échelles humaine et miniature. Position de caméra basse, au ras de la table ; des câbles électriques emmêlés et des traînées d’eau scintillantes forment de puissantes lignes directrices vers le phare incliné et la tasse à thé ; une vis métallique floue masque partiellement l’extrême premier plan, créant une profondeur en couches et une confusion d’échelle. Un soleil dur et directionnel de midi traverse des stores vénitiens, projetant des ombres rayées nettes sur le décor, avec des gouttelettes en suspension scintillantes et un léger flou de mouvement sur l’équipe en fuite. Palette strictement limitée au blanc crème, au bleu marine et à l’orange de sécurité. Grain du vieux bois très convaincant, pâte à papier détrempée et gondolée, peinture miniature écaillée, métal rayé, tissu humide, eau transparente avec réfraction physiquement exacte, tension superficielle, éclaboussures et relations spatiales réalistes. Action dense autour de la catastrophe centrale, équilibrée par un espace négatif plus calme près des bords du cadre, imperfections artisanales, grain de pellicule fin et maîtrisé, faible profondeur de champ, objectif macro, mise au point rapprochée, dégradé optique réaliste, photographie d’effets pratiques haut de gamme, sans sur-rendu huileux, sans détail uniforme façon HDR, sans peau à l’aspect plastique, sans dominante boueuse ou sale, sans halo omniprésent, sans éclairage de fantasy épique bon marché, sans esthétique sombre de ruines sous-marines ou spatiales, format horizontal large 16:9, pleine image.

Generated with Qwen Image 2.0 Text-to-image on Atlas Cloud

Generated with Seedream v4.7 Text-to-Image on Atlas Cloud

Generated with Wan-2.7 Text-to-image on Atlas Cloud
Une évasion miniature se déroule sur l’établi d’un fabricant de figurines, à l’instant décisif où le créateur vient de s’éloigner : une équipe de minuscules figurines en argile blanche non peinte a ingénieusement plié une étiquette d’inspection en papier — portant les mots petits, nets et parfaitement lisibles « INSPECTION FINALE » — pour en faire une montgolfière improvisée ; l’une des figurines vient de trancher le dernier lien, le ballon de papier bondissant vers le haut avec une légère trace de flou de mouvement tandis que ses compagnons reculent, acclament l’évasion et lèvent les yeux, stupéfaits. Un pot de peinture renversé déverse une rivière bleu outremer sinueuse à travers la scène, bordée de petites empreintes vermillon et de ponts improvisés. Narration spatiale miniature précise, chaque personnage accomplissant une action distincte. Le râtelier à outils en bois crée un cadre dans le cadre très marqué ; des brucelles, des outils de modelage et des cutters forment des lignes directrices radiales vers le ballon qui s’élève ; préserver un espace négatif propre et dégagé dans le coin supérieur droit. Une lumière directionnelle venant de la fenêtre entre diagonalement par la gauche, produisant des ombres allongées aux contours doux et révélant les empreintes digitales imprimées dans l’argile brute, le grain du bois usé, les fibres du papier plié, les outils métalliques rayés et la peau collante de la peinture à moitié sèche. Palette strictement limitée à trois couleurs : blanc argile, bleu outremer et rouge vermillon, avec de subtiles variations naturelles de tonalité — aucune couleur d’accent supplémentaire. Animation en stop-motion exquise mêlée à une cinématographie macro photoréaliste, imperfections tactiles faites main, faible profondeur de champ sélective, outils du premier plan doucement floutés, action centrale parfaitement définie, léger grain de pellicule analogique, objectif macro 100mm, rendu cinématographique mais intime, réalisme sophistiqué des effets pratiques, sans surfaces en plastique brillant, sans sur-rendu gras, sans HDR, sans couleurs boueuses, sans halo omniprésent, sans style de fantasy épique bon marché, sans atmosphère sombre sous-marine ou de ruines spatiales, composition horizontale large 16:9, cadre pleine image bord à bord.

Generated with Qwen Image 2.0 Text-to-image on Atlas Cloud

Generated with Seedream v4.7 Text-to-Image on Atlas Cloud

Generated with Wan-2.7 Text-to-image on Atlas Cloud
Qwen Image 2.0 transforme des prompts détaillés et des images existantes en visuels de présentation, supports de campagne, scènes produit, storyboards, visuels localisés et retouches précises, avec des résolutions allant jusqu'à 2K.
Transformez des prompts détaillés en visuels de présentation soignés, avec des mises en page structurées et du texte intégré à l'image parfaitement lisible. Les équipes produit peuvent créer des diapositives conceptuelles, des contenus explicatifs et des supports de présentation internes avec des résolutions allant jusqu'à 2K.
Une typographie rendue avec précision apporte de la clarté aux affiches, visuels pour les réseaux sociaux et concepts de campagne créés à partir de prompts détaillés. Les équipes marketing disposent de directions visuelles adaptables pour les lancements, promotions et communications de marque, sans devoir reconstruire manuellement chaque composition.
Lorsque les scènes produit exigent un haut niveau de détail, générez-les à partir de prompts descriptifs avec des résolutions allant jusqu'à 2K. Les distributeurs et studios créatifs peuvent affiner les arrière-plans, les objets environnants ou le contexte de campagne grâce à des instructions d'édition claires, pour une grande variété de placements.
Besoin de modifier un visuel existant sans repartir de zéro ? Donnez à l'endpoint d'édition des instructions claires pour mettre à jour le texte, les objets, les poses ou le style, afin de gérer les retours clients et les workflows de production itératifs à grande échelle.
Les affiches et guides riches en texte peuvent associer narration visuelle et typographie multilingue. Les équipes de contenu internationales peuvent créer des supports de voyage localisés, des visuels événementiels et des concepts de campagne régionaux au sein d'une même image composée.
Des prompts détaillés peuvent structurer des récits sous forme de bandes dessinées, calendriers ou panneaux de storyboard, avec une composition visuelle structurée. Les créateurs peuvent explorer des séquences, des contenus explicatifs pédagogiques et des concepts de campagne avant de mobiliser des ressources pour une production complète.
Comparez les endpoints Qwen Image 2.0 aux alternatives de Microsoft selon la tâche, la résolution de sortie maximale et le prix standard par image.
| Modèle | Tâche | Résolution maximale | Prix standard |
|---|---|---|---|
| Qwen Image 2.0 Text-to-image | Texte vers image | 2048 × 2048 | $0.035/image |
| Qwen Image 2.0 Edit | Édition d’image | 2048 × 2048 | $0.035/image |
| MAI-Image-2.6-Flash Text-to-image | Texte vers image | 2.36 MP maximum, équivalent à 1536 × 1536 | $0.044/image |
| MAI-Image-2.6-Flash Edit | Édition d’image | 2.36 MP maximum, équivalent à 1536 × 1536 | $0.047/image |
Soyez opérationnel en quelques minutes — suivez ces étapes simples pour intégrer et déployer des modèles via la plateforme Atlas Cloud.
Inscrivez-vous sur atlascloud.ai et complétez la vérification. Les nouveaux utilisateurs reçoivent des crédits gratuits pour explorer la plateforme et tester les modèles.
Combiner les modèles Qwen Image 2.0 avancés avec la plateforme accélérée par GPU d'Atlas Cloud offre des performances, une évolutivité et une expérience développeur inégalées.
Faible Latence :
Inférence optimisée par GPU pour un raisonnement en temps réel.
API Unifiée :
Exécutez Qwen Image 2.0, GPT, Gemini et DeepSeek avec une seule intégration.
Tarification Transparente :
Facturation prévisible par token avec options serverless.
Expérience Développeur :
SDK, analytiques, outils de fine-tuning et modèles.
Fiabilité :
99,99% de disponibilité, RBAC et journalisation conforme.
Sécurité et Conformité :
SOC 2 Type II, alignement HIPAA, souveraineté des données aux États-Unis.
Qwen Image 2.0 est un modèle d’image de l’équipe Qwen d’Alibaba, conçu pour générer des visuels à partir de texte et modifier des images existantes à l’aide d’instructions. Atlas Cloud fournit des endpoints REST dédiés pour ces deux tâches, avec des résolutions de sortie allant jusqu’à 2K.
Utilisez le modèle pour générer des images à partir de descriptions détaillées ou modifier des visuels existants au moyen d’instructions en langage naturel. Sa meilleure compréhension des prompts prend en charge des workflows tels que les visuels marketing, les concept arts, les images de produits, les infographies et le design visuel.
Oui. Atlas Cloud met en avant la lisibilité du texte intégré aux images et la prise en charge des prompts complexes, ce qui rend le modèle adapté aux infographies, affiches, supports marketing et autres mises en page structurées. Formulez explicitement les instructions relatives au texte et à la mise en page dans la limite de 800 caractères du prompt de l’API.
Créez une clé API dans le tableau de bord Atlas Cloud, choisissez l’ID du modèle de génération ou de modification, puis envoyez une requête REST. L’inférence hébergée vous évite de configurer un GPU local ou de déployer les poids du modèle.
Envoyez une requête POST authentifiée à https://api.atlascloud.ai/api/v1/model/generateImage avec votre ID de modèle et vos entrées dans le corps JSON. La requête asynchrone renvoie un ID de prédiction, que vous pouvez interroger via l’endpoint de prédiction jusqu’à la fin du traitement.
Choisissez qwen/qwen-image-2.0/text-to-image pour créer une nouvelle image à partir d’un prompt. Pour modifier des images de référence à l’aide d’instructions, sélectionnez plutôt qwen/qwen-image-2.0/edit.
La génération à partir de texte nécessite un prompt et accepte des valeurs facultatives pour size et seed. La modification nécessite également un tableau images, tandis que size et seed restent facultatifs. Les deux endpoints acceptent des prompts en chinois et en anglais de 800 caractères maximum.
L’endpoint de modification accepte une à trois URLs d’images de référence, chaque image mesurant entre 384 et 3072 pixels par dimension. Les dimensions de sortie peuvent aller de 512 à 2048 pixels, et la fiche du modèle indique la prise en charge de résolutions allant jusqu’à 2K.
Atlas Cloud indique un tarif de base standard de $0.035 par requête pour les endpoints de génération à partir de texte et de modification. Il s’agit du tarif initial à l’usage, hors remises temporaires.
Définissez seed sur un entier précis compris entre 0 et 2147483647 lorsque vous avez besoin de tests reproductibles, tandis que la valeur par défaut -1 sélectionne une valeur aléatoire. Conservez l’ID du modèle, le prompt et size inchangés lorsque vous comparez les sorties ou cherchez la cause d’une variation inattendue.
Guides, tutoriels et actualités produit pour tirer le meilleur d'Atlas Cloud.