दुनिया भर में सबसे कम कीमतों पर Seedance 2.0 Mini & Fast API — आधिकारिक कीमत पर 68% तक की छूट
Hero background 1Hero background 2Hero background 3

Qwen Image 3.0 pro Identity Preserving Edits

Qwen Image 3.0 pro, उत्पादन-स्तरीय विज़ुअल वर्कफ़्लो बनाने वाले डेवलपर्स के लिए Qwen का इमेज जनरेशन और एडिटिंग मॉडल परिवार है। यह 2048×2048 तक की इमेज बनाता है, प्रॉम्प्ट को अपने आप दोबारा लिखता है, प्रॉम्प्ट के आशय के आधार पर रिज़ॉल्यूशन चुनता है और चेहरे की विशेषताओं व पहचान को बनाए रखते हुए प्राकृतिक भाषा में दिए गए एडिटिंग निर्देशों का पालन करता है। Atlas Cloud के ज़रिए दोनों मॉडलों का उपयोग एक ही OpenAI संगत कुंजी और प्रति कॉल $0.04 के मानक पे-ऐज़-यू-गो मूल्य निर्धारण के साथ करें। आज ही निर्माण शुरू करें।

Qwen Image 3.0 Pro को Alibaba द्वारा विकसित किया गया है। Atlas Cloud (Atlas Cloud AI LLC द्वारा संचालित) इस तक पहुँच प्रदान करता है, इसका स्वामी नहीं है। सभी ट्रेडमार्क उनके संबंधित स्वामियों की संपत्ति हैं।

अग्रणी मॉडल एक्सप्लोर करें

Atlas Cloud आपको उद्योग में अग्रणी नवीनतम रचनात्मक मॉडल प्रदान करता है।

Qwen Image 3.0 pro के जनरेशन और एडिटिंग मोड

Qwen Image 3.0 pro के लिए उपलब्ध टेक्स्ट-टू-इमेज और रेफ़रेंस-आधारित एडिटिंग एंडपॉइंट की तुलना करें।

मोडैलिटीविवरण
Qwen Image 3.0 Pro API (Text to Image)टेक्स्ट प्रॉम्प्ट को 2048×2048 तक के रिज़ॉल्यूशन वाली इमेज में बदलें, जिसमें स्वचालित प्रॉम्प्ट री-राइटिंग और प्रॉम्प्ट-निर्देशित रिज़ॉल्यूशन चयन शामिल है। जटिल टेक्स्ट की बेहतरीन रेंडरिंग और प्रॉम्प्ट का सटीक अनुपालन पोस्टर, उत्पाद विज़ुअल, इलस्ट्रेशन और संरचना-संवेदनशील अन्य एसेट के लिए उपयोगी है।
Qwen Image 3.0 Pro API (Image Editing)एक से तीन रेफ़रेंस इमेज और प्राकृतिक-भाषा निर्देश देकर एडिट की गई इमेज तैयार करें। चेहरे की विशेषताओं और पहचान जैसे प्रमुख विवरण सुरक्षित रहते हैं, जबकि अनुरोधित बदलाव लागू किए जाते हैं। इसलिए यह एंडपॉइंट पोर्ट्रेट सुधार, विज़ुअल वैरिएशन और नियंत्रित एसेट अपडेट के लिए उपयुक्त है।

Qwen Image 3.0 pro के अंदर: टाइप, विवरण और नियंत्रण

Qwen Image 3.0 pro जटिल टेक्स्ट रेंडरिंग, सटीक प्रॉम्प्ट अनुपालन, 2048 × 2048 तक जनरेशन, स्वचालित प्रॉम्प्ट री-राइटिंग और एक से तीन रेफरेंस के ज़रिए पहचान बरकरार रखने वाले संपादनों को Atlas Cloud के एकीकृत pay as you go API में संयोजित करता है।

Qwen Image 3.0 pro टाइपोग्राफी

Qwen Image 3.0 pro टाइपोग्राफी

Qwen Image 3.0 pro अंग्रेज़ी और चीनी में जटिल टेक्स्ट रेंडरिंग संभालते हुए विस्तृत प्रॉम्प्ट का पालन करता है। यह टाइप को दृश्य से अलग किए बिना घने क्रिएटिव लेआउट को व्यवस्थित कर सकता है। एक ही अनुरोध में कॉपी, पदानुक्रम, कंपोज़िशन और विज़ुअल शैली निर्दिष्ट करें, फिर प्रकाशित करने से पहले नामों और संख्याओं की प्रूफरीडिंग करें। इससे यह बैनर, संपादकीय ग्राफ़िक्स, पैकेजिंग कॉन्सेप्ट और जानकारी-समृद्ध कलाकृतियों के लिए व्यावहारिक बनता है।

2048 × 2048 विवरण

2048 × 2048 विवरण

जब सूक्ष्म टेक्सचर और पढ़ने योग्य विवरण महत्वपूर्ण हों, तब 2048 × 2048 तक के रिज़ॉल्यूशन पर इमेज जनरेट करें। प्रॉम्प्ट-निर्देशित आकार चयन आउटपुट रिज़ॉल्यूशन को स्वचालित रूप से चुन सकता है, जबकि स्पष्ट आकार आपको किसी ज्ञात कैनवास को लक्षित करने देता है। प्रोडक्ट फ़ोटोग्राफ़ी से लेकर संपादकीय पोर्ट्रेट तक, अतिरिक्त पिक्सेल बजट अधिक बारीकी से निरीक्षण, लचीली डाउनस्ट्रीम क्रॉपिंग और बेहतर प्रोडक्शन एसेट्स को सक्षम करता है।

दो प्रॉम्प्ट री-राइट मोड

दो प्रॉम्प्ट री-राइट मोड

जनरेशन से पहले छोटे प्रॉम्प्ट अपने-आप विस्तृत किए जा सकते हैं और री-राइटिंग डिफ़ॉल्ट रूप से सक्षम रहती है। टेक्स्ट जनरेशन endpoint पर Direct मोड एक बार में री-राइट करता है, जबकि Agent मोड ब्रीफ़ को समृद्ध करने के लिए एजेंट-आधारित पाइपलाइन का उपयोग करता है। खोजपरक कॉन्सेप्ट के लिए री-राइटिंग चालू रखें या प्रोडक्शन में सटीक शब्दावली और कड़ाई से नियंत्रित निर्देश अधिक महत्वपूर्ण होने पर इसे बंद कर दें।

एक से तीन रेफरेंस संपादन

एक से तीन रेफरेंस संपादन

एक से तीन रेफरेंस इमेज को संपादन में शामिल करें और प्राकृतिक भाषा में बदलाव का वर्णन करें। मॉडल इन स्रोतों का उपयोग विषय, संदर्भ या विज़ुअल मार्गदर्शन के लिए कर सकता है, साथ ही चेहरे की प्रमुख विशेषताओं और पहचान को बनाए रखता है। स्वीकृत विषय को शुरू से दोबारा बनाए बिना नया परिवेश, स्टाइलिंग या कंपोज़िशन माँगें। यह कैंपेन वैरिएंट, कैरेक्टर निरंतरता और रेफरेंस-आधारित प्रोडक्ट दृश्यों के लिए उपयुक्त है।

पुनरुत्पाद्य बैच नियंत्रण

पुनरुत्पाद्य बैच नियंत्रण

दोहराए जा सकने वाले प्रयोग चाहिए? 0 से 2147483647 तक एक निश्चित seed सेट करें, negative prompt जोड़ें और एक ही जनरेशन कॉल में अधिकतम चार आउटपुट का अनुरोध करें। ये नियंत्रण प्रॉम्प्ट संशोधनों की तुलना करना, अनचाही सामग्री को बाहर रखना और समान परिस्थितियों में विकल्पों के छोटे सेट की समीक्षा करना आसान बनाते हैं। इनका उपयोग एकबारगी अनुमान-आधारित काम के बजाय संरचित क्रिएटिव परीक्षण के लिए करें।

एक प्रॉम्प्ट, तीन दृष्टिकोण: Qwen Image 3.0 pro की तुलना

देखें कि Qwen Image 3.0 pro, एक प्रमुख बाहरी प्रतिस्पर्धी और इसी श्रृंखला के उसके पूर्ववर्ती मॉडल, टाइपोग्राफी-समृद्ध डिज़ाइन और डॉक्यूमेंट्री फ़ोटोग्राफ़ी में समान प्रॉम्प्ट की व्याख्या कैसे करते हैं।

प्रॉम्प्ट

दोपहर के ठीक बीच एक चहल-पहल भरे मसाला बाज़ार में वह निर्णायक, हास्यपूर्ण क्षण कैद करें जब एक युवा पुरुष विक्रेता केसर से भरे खुरदरे बोरे को हवा में उछालता है और उसी समय गति-धुंधला हुआ कबूतर हल्दी के ढेर से टकरा जाता है, जिससे सुनहरे चूर्ण का चमकीला बादल पूरे दृश्य में हवा में ठहरा हुआ दिखाई देता है; चौंके हुए ग्राहक स्वाभाविक और हास्यपूर्ण ढंग से प्रतिक्रिया दें—एक व्यक्ति दोनों हाथों से कई चमकदार लाल अनारों को स्पष्ट रूप से ढँक रहा हो, जबकि दूसरा उसी समय मुड़े हुए कागज़ी मसाला-पैकेट अपनी छाती से लगाए हो। हर बाँह, हाथ, उँगली, वस्तु और पारस्परिक क्रिया शारीरिक रूप से सही, अलग-अलग और आसानी से समझ आने योग्य हो। मज़बूत फ्रेम-के-अंदर-फ्रेम संरचना के लिए बाज़ार को परतदार पत्थर की मेहराबों के बीच से दिखाएँ और थोड़ा ऊँचा डच-एंगल दृष्टिकोण अपनाएँ; गहरी लाल मिर्चों के दोहराते हुए ब्लॉक, गहरे नील-रंगे चीनी मिट्टी के कटोरे और चमकीले पीले हल्दी के ढेर केवल लाल, पीले और नीले रंगों की अनुशासित प्राथमिक-रंग योजना बनाएँ। दोपहर की कठोर दिशात्मक आकाशीय रोशनी दुकानों, चेहरों और घिसे हुए पत्थर के फ़र्श पर तीखी ज्यामितीय छायाएँ डाले। हवा में तैरते चूर्ण-कणों, बुने हुए बोरे के रेशों, कागज़ जैसे केसर-तंतुओं, धूल भरे मसाला-ढेरों, हथौड़े से गढ़े तांबे के तराज़ू, चमकदार मिट्टी के बर्तनों, मौसम से घिसी लकड़ी की बनावट, सिकुड़े हुए कागज़ी पैकेटों, प्राकृतिक युवा त्वचा और हल्के एनालॉग फ़िल्म-ग्रेन में स्पर्शनीय यथार्थ बनाए रखें। एक चौड़ा क्षैतिज हाथ से रंगा हुआ दुकान का बोर्ड शामिल करें, जिस पर बड़े और पूरी तरह पठनीय अक्षरों में ठीक यही लिखा हो: “SPICE, SUN & SURPRISE”; साथ ही अलग-अलग हाथ से लिखे मूल्य-टैग शामिल करें, जिन पर ठीक यही लिखा हो: “SAFFRON 12”, “TURMERIC 4”, “CHILIES 6” और “POMEGRANATES 3”। सभी शब्द सही वर्तनी के साथ, साफ़-सुथरे और दुकान के दृश्य में स्वाभाविक रूप से एकीकृत हों। 1970s की विंटेज यात्रा-पत्रिका शैली की डॉक्यूमेंट्री फ़ोटोग्राफ़ी, सहज मानवीय गर्माहट, संयमित यथार्थवाद, 28mm पर्यावरणीय लेंस, मुलायम ढंग से आंशिक रूप से ढके अग्रभूमि-किनारे के साथ गहरी परतदार फ़ोकस, कबूतर में हल्की गति-धुंध, चेहरों और हाथों पर तीक्ष्णता, प्रामाणिक एक्सपोज़र, कोई बनावटी पोज़ नहीं, अत्यधिक चिकना रेंडरिंग नहीं, HDR जैसा रूप नहीं, प्लास्टिक जैसी त्वचा नहीं, धुंधले रंग नहीं, अत्यधिक चमक नहीं, काल्पनिक महाकाव्यात्मक प्रकाश नहीं, बेतरतीब इंद्रधनुषी रंग-पैलेट नहीं, विकृत हाथ नहीं, अतिरिक्त उँगलियाँ नहीं, दोहराए हुए लोग नहीं, अस्पष्ट या बिगड़ा हुआ पाठ नहीं, बॉर्डर नहीं, मॉकअप नहीं, चौड़ा लैंडस्केप 16:9 आस्पेक्ट रेशियो, पूरे कैनवास तक।

Generated with Qwen Image 3.0 Pro Text-to-Image on Atlas Cloud

Generated with Qwen Image 3.0 Pro Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Qwen Image 3.0 Text-to-Image on Atlas Cloud

Generated with Qwen Image 3.0 Text-to-Image on Atlas Cloud

प्रॉम्प्ट

बारिश भरी रात में सेल्फ़-सर्विस लॉन्ड्रोमैट के भीतर की सिनेमाई डॉक्यूमेंट्री फ़ोटोग्राफ़ी, जिसमें वह निर्णायक क्षण कैद हो जब सामने से खुलने वाली वॉशिंग मशीन अचानक सफ़ेद झाग का विशाल झरना उगल देती है; चमकीले पीले रेनकोट में एक युवा महिला सहजता से हँसते हुए लाल प्लास्टिक की टब से बहाव को पकड़ रही हो, उसके हाथ किनारे को स्वाभाविक रूप से थामे हों और उँगलियाँ शारीरिक रूप से सही हों। उसकी सहेली धुंधले काँच के बाहर खड़ी होकर अपनी उँगली से ठीक यही दर्पण-उलटा पाठ लिख रही हो: “LAST WASH 11:30”, जो लॉन्ड्रोमैट के भीतर से स्पष्ट रूप से पढ़ा जा सके; उसी क्षण एक गीला मोज़ा काँच से टकराकर उस पर चिपका हुआ हो। गोलाकार वॉशर-दरवाज़ों की कतारें गहरी जगह की ओर जाती हुई सशक्त दोहराती ज्यामिति और प्रमुख दिशारेखाएँ बनाएँ, जबकि खिड़की में परतदार प्रतिबिंब भीतर की चंचल गतिविधि और बाहर बारिश से भीगी नीयॉन सड़क—दोनों को दिखाएँ और एक सुसंगत दोहरी कथा रचें। दिशात्मक ठंडी-सफ़ेद फ़्लोरोसेंट छत-रोशनी चेहरों, रेनकोट, हाथों, झाग और क्रोम पर तीखी आकृतियाँ और साफ़ सीमाएँ उकेरे; संयमित मैजेंटा नीयॉन खिड़की से छनकर आए और फ़र्श के पानी भरे गड्ढों में प्रतिबिंबित हो, जिसमें सियान-नीला, चमकीला पीला और मैजेंटा—इन तीन रंगों की अनुशासित योजना हो। काँच पर फ़ोटोरियलिस्टिक पानी की बूँदें, पारदर्शी बुलबुले, नम बुना हुआ कपड़ा, ब्रश की हुई धातु, रबर के दरवाज़ा-सील, संघनन, पानी भरे गड्ढों के प्रतिबिंब, उड़ते झाग में हल्की गति-धुंध, कोमल हाई-ISO फ़िल्म-ग्रेन, प्राकृतिक युवा त्वचा की बनावट, सहज भाव-भंगिमाएँ, जटिल लेकिन स्थानिक रूप से सुसंगत प्रतिबिंब और पारदर्शी सतहें। आँखों के स्तर से पर्यावरणीय रिपोर्ताज शैली, 35mm लेंस, मध्यम डेप्थ ऑफ़ फ़ील्ड, सिनेमाई यथार्थवाद, सूक्ष्म अपूर्णताएँ, कोई बनावटी पोज़ नहीं, अत्यधिक चिकना रेंडरिंग नहीं, HDR जैसा रूप नहीं, प्लास्टिक जैसी त्वचा नहीं, धुंधले रंग नहीं, अत्यधिक चमक नहीं, सस्ता महाकाव्यात्मक प्रकाश नहीं, चौड़ा क्षैतिज 16:9 आस्पेक्ट रेशियो, पूरे कैनवास तक।

Generated with Qwen Image 3.0 Pro Text-to-Image on Atlas Cloud

Generated with Qwen Image 3.0 Pro Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Qwen Image 3.0 Text-to-Image on Atlas Cloud

Generated with Qwen Image 3.0 Text-to-Image on Atlas Cloud

Qwen Image 3.0 Pro के साथ विज़ुअल सिस्टम बनाएँ

Qwen Image 3.0 Pro सटीक प्रॉम्प्ट पालन, जटिल टेक्स्ट रेंडरिंग, 2048×2048 तक का आउटपुट और एक से तीन रेफ़रेंस इमेज के ज़रिए कैंपेन ग्राफ़िक्स, प्रोडक्ट विज़ुअल्स, इंटरफ़ेस कॉन्सेप्ट, स्टोरीबोर्ड और पहचान बरकरार रखने वाले एडिट्स को सपोर्ट करता है।

Qwen Image 3.0 Pro के साथ कैंपेन पोस्टर

जटिल टेक्स्ट रेंडरिंग और सटीक प्रॉम्प्ट पालन में Qwen की क्षमता का उपयोग करके कठिन प्रॉम्प्ट्स को कैंपेन पोस्टर, बैनर और सोशल ग्राफ़िक्स में बदलें। लॉन्च, इवेंट और प्रमोशन के लिए 2048×2048 तक के ब्रांड एसेट बनाएँ।

Qwen Image 3.0 Pro के प्रोडक्ट विज़ुअल्स

टेक्स्ट से प्रोडक्ट सीन जनरेट करें, जबकि ऑटोमैटिक प्रॉम्प्ट री-राइटिंग संक्षिप्त विचारों को विस्तार देती है और प्रॉम्प्ट-निर्देशित साइज़िंग उपयुक्त कैनवस चुनती है। इससे कैटलॉग इमेज, ईकॉमर्स प्रमोशन और छोटी टीमों के लिए तेज़ कॉन्सेप्ट टेस्टिंग संभव होती है।

पहचान बरकरार रखने वाले पोर्ट्रेट एडिट्स

नेचुरल-लैंग्वेज एडिट्स के ज़रिए पहनावा, परिवेश, रोशनी या विज़ुअल स्टाइल बदलते हुए चेहरे की विशेषताओं और पहचान को बरकरार रखें। पोर्ट्रेट स्टूडियो और क्रिएटर ऐप्स एक से तीन रेफ़रेंस इमेज से पहचानने योग्य कैंपेन वैरिएशन तैयार कर सकते हैं।

इंटरफ़ेस और इन्फ़ोग्राफ़िक कॉन्सेप्ट

क्या आपको विस्तृत निर्देशों से जानकारी-समृद्ध विज़ुअल्स चाहिए? प्रोडक्ट या लर्निंग टीमों के लिए इंटरफ़ेस कॉन्सेप्ट, शैक्षिक डायग्राम, एनोटेटेड एक्सप्लेनर और प्रेज़ेंटेशन ग्राफ़िक्स का प्रोटोटाइप बनाने हेतु सटीक प्रॉम्प्ट पालन और जटिल टेक्स्ट रेंडरिंग का उपयोग करें।

मल्टी-रेफ़रेंस कंपोज़िशन

एक ही एडिटिंग रिक्वेस्ट में अधिकतम तीन रेफ़रेंस इमेज शामिल करें, फिर नेचुरल लैंग्वेज में बदलाव निर्देशित करें, जबकि मुख्य विवरण जस के तस बने रहें। यह कंपोज़िट, मर्चेंडाइज़ वैरिएशन और कैरेक्टर-केंद्रित क्रिएटिव वर्कफ़्लो के लिए उपयुक्त है।

Qwen Image 3.0 Pro के साथ स्टोरीबोर्ड

ध्यानपूर्वक लिखे गए प्रॉम्प्ट्स से क्रमिक सीन का खाका तैयार करें, जहाँ प्रॉम्प्ट पालन हर फ़्रेम में अनुरोधित विषयों, परिवेश और विज़ुअल दिशा का अनुसरण सुनिश्चित करता है। फ़िल्म निर्माता, एजेंसियाँ और गेम टीमें शुरुआती विचारों को स्टोरीबोर्ड पैनलों में बदल सकती हैं।

Qwen Image 3.0 pro बनाम प्रमुख Image APIs

वर्कफ़्लो, अधिकतम आउटपुट आकार, संदर्भ क्षमता, प्रॉम्प्ट टूल और Atlas Cloud की मानक कीमत के आधार पर Qwen Image 3.0 pro की Seedream और Nano Banana एंडपॉइंट्स से तुलना करें।

मॉडलवर्कफ़्लोअधिकतम आउटपुट आकारअधिकतम संदर्भ इमेजप्रॉम्प्ट टूलमानक कीमत
Qwen Image 3.0 Pro Text-to-Imageटेक्स्ट से इमेज2048×2048-स्वचालित प्रॉम्प्ट पुनर्लेखन$0.04/image
Qwen Image 3.0 Pro Editइमेज संपादन1440×14403स्वचालित प्रॉम्प्ट पुनर्लेखन$0.04/image
Seedream v5.0 Pro Text-to-Imageटेक्स्ट से इमेज4.19 MP तक-थिंकिंग और प्रॉम्प्ट ऑप्टिमाइज़ेशन$0.045/image
Seedream v5.0 Pro Editइमेज संपादन4.19 MP तक10थिंकिंग और प्रॉम्प्ट ऑप्टिमाइज़ेशन$0.045/image
Nano Banana 2 Text-to-Imageटेक्स्ट से इमेज4K-थिंकिंग और खोज-आधारित ग्राउंडिंग$0.08/image
Nano Banana 2 Editइमेज संपादन4K14थिंकिंग और खोज-आधारित ग्राउंडिंग$0.08/image

Atlas Cloud पर Qwen Image 3.0 Pro का उपयोग कैसे करें

कुछ ही मिनटों में शुरू करें — इन सरल चरणों का पालन करके Atlas Cloud प्लेटफ़ॉर्म के ज़रिए मॉडल इंटीग्रेट और डिप्लॉय करें।

Atlas Cloud अकाउंट बनाएं

atlascloud.ai पर साइन अप करें और वेरिफिकेशन पूरा करें। नए यूज़र्स को प्लेटफ़ॉर्म एक्सप्लोर करने और मॉडल टेस्ट करने के लिए फ्री क्रेडिट मिलते हैं।

Atlas Cloud पर Qwen Image 3.0 Pro का उपयोग क्यों करें

बेजोड़ प्रदर्शन, स्केलेबिलिटी और विकास अनुभव के लिए उन्नत Qwen Image 3.0 Pro मॉडल को Atlas Cloud के GPU त्वरण प्लेटफ़ॉर्म के साथ संयोजित करें।

प्रदर्शन और लचीलापन

कम विलंबता:
रियल-टाइम प्रतिक्रिया के लिए GPU-अनुकूलित इंफरेंसिंग।

एकीकृत API:
Qwen Image 3.0 Pro, GPT, Gemini और DeepSeek के लिए एक इंटीग्रेशन।

पारदर्शी मूल्य निर्धारण:
प्रति token बिलिंग, Serverless मोड का समर्थन।

एंटरप्राइज और स्केल

डेवलपर अनुभव:
SDK, डेटा एनालिटिक्स, फाइन-ट्यूनिंग टूल और टेम्पलेट पूरी तरह से उपलब्ध हैं।

विश्वसनीयता:
99.99% उपलब्धता, RBAC अनुमति नियंत्रण, अनुपालन लॉगिंग।

सुरक्षा और अनुपालन:
SOC 2 Type II प्रमाणन, HIPAA अनुपालन, US डेटा संप्रभुता।

Qwen Image 3.0 Pro API से जुड़े सवालों के जवाब

Qwen Image 3.0 Pro, Alibaba का इमेज जनरेशन और एडिटिंग मॉडल है, जो टेक्स्ट से इमेज बनाने या प्राकृतिक भाषा के निर्देशों से मौजूदा विज़ुअल्स में बदलाव करने के लिए उपयोग होता है। Atlas Cloud पर यह 2048×2048 तक के आउटपुट और 1 से 3 रेफ़रेंस इमेज के साथ एडिटिंग को सपोर्ट करता है।

इसका उपयोग ऐसे इमेज बनाने के लिए करें जिनमें विस्तृत प्रॉम्प्ट का सटीक पालन, जटिल टेक्स्ट रेंडरिंग या हाई-रिज़ॉल्यूशन आउटपुट आवश्यक हो। एडिटिंग वर्कफ़्लो में, प्राकृतिक भाषा के निर्देश चेहरे की विशेषताओं और पहचान जैसे महत्वपूर्ण विवरणों को बनाए रखते हुए इमेज में बदलाव कर सकते हैं।

टेक्स्ट-टू-इमेज या एडिट रूट चुनें, फिर संबंधित मॉडल ID के साथ Atlas Cloud के OpenAI-compatible API के माध्यम से कॉल करें। अपना अनुरोध तैयार और सत्यापित करते समय लिंक किए गए Playground पैरामीटर स्कीमा को अंतिम और विश्वसनीय स्रोत मानें।

प्रॉम्प्ट से इमेज बनाने के लिए qwen-image-3.0-pro/text-to-image चुनें, या रेफ़रेंस इमेज में बदलाव करने के लिए qwen-image-3.0-pro/edit चुनें। दोनों रूट के Playground स्कीमा अलग-अलग हैं, इसलिए अपने चुने हुए वर्कफ़्लो से संबंधित स्कीमा का उपयोग करें।

टेक्स्ट-टू-इमेज जनरेशन 2048×2048 तक के रिज़ॉल्यूशन को सपोर्ट करता है। रिज़ॉल्यूशन को मैन्युअली चुनने पर मॉडल प्रॉम्प्ट के आधार पर रिज़ॉल्यूशन तय कर सकता है।

प्राकृतिक भाषा में दिए गए एडिटिंग निर्देश के साथ 1 से 3 रेफ़रेंस इमेज दें। एडिट मॉडल इन इनपुट्स का उपयोग चेहरे की विशेषताओं और पहचान सहित महत्वपूर्ण विज़ुअल विवरणों को बनाए रखते हुए अनुरोधित बदलाव लागू करने के लिए करता है।

हाँ। टेक्स्ट-टू-इमेज मॉडल में प्रॉम्प्ट के आधार पर रिज़ॉल्यूशन चुनने के साथ-साथ स्वचालित प्रॉम्प्ट री-राइटिंग भी शामिल है। जब सटीक शब्दावली, लेआउट या एम्बेडेड टेक्स्ट महत्वपूर्ण हो, तो आउटपुट की अपने मूल निर्देशों से तुलना करें।

Atlas Cloud टेक्स्ट-टू-इमेज और एडिट, दोनों मॉडल के लिए प्रति इमेज $0.04 की मानक बेस कीमत सूचीबद्ध करता है। बिलिंग पे-एज़-यू-गो मॉडल के अनुसार होती है, जिससे डेवलपर बिना सब्सक्रिप्शन प्रतिबद्धता के दोनों में से किसी भी वर्कफ़्लो का उपयोग कर सकते हैं।

दोनों वर्ज़न टेक्स्ट-टू-इमेज जनरेशन और इमेज एडिटिंग को सपोर्ट करते हैं। Alibaba के आधिकारिक अवलोकन में standard model को क्वालिटी और स्पीड के बीच संतुलन बनाने वाला बताया गया है, लेकिन यहाँ समीक्षा किए गए सत्यापित स्रोत Pro के साथ कोई मात्रात्मक तुलना उपलब्ध नहीं कराते। प्रोडक्शन डिफ़ॉल्ट चुनने से पहले दोनों वर्ज़न पर प्रतिनिधि प्रॉम्प्ट चलाएँ।

एक स्पष्ट रेफ़रेंस इमेज से शुरुआत करें और स्पष्ट रूप से बताएं कि चेहरे या पहचान से जुड़े कौन-से विवरण अपरिवर्तित रहने चाहिए। एडिट endpoint अधिकतम 3 रेफ़रेंस स्वीकार करता है और इन विवरणों को सुरक्षित रखने के लिए डिज़ाइन किया गया है। यदि बदलाव जारी रहता है, तो अनुरोधित रूपांतरण को सरल करें और दूसरा जनरेशन परिणाम जाँचें।

अधिक सीरीज़ एक्सप्लोर करें

Seedance 2.5

Seedance 2.5 API अब Atlas Cloud पर उपलब्ध है! यह डेवलपर्स को ByteDance का नवीनतम वीडियो मॉडल प्रदान करता है। यह टेक्स्ट, एकल छवि, या 50 मल्टीमोडल संदर्भों से एक ही बार में 30 सेकंड तक का नेटिव वीडियो उत्पन्न करता है, जिसमें सिंक्रनाइज़ ऑडियो और इन-फ्रेम बहुभाषी टेक्स्ट शामिल है। Atlas Cloud पर आप इसे एक कुंजी के माध्यम से एक्सेस कर सकते हैं, जिसमें विषय की निरंतरता और बेहतर भौतिकी लंबे शॉट्स को सुसंगत रखती है।

सीरीज़ देखें

Wan 3.0

Wan 3.0 API अलीबाबा (Alibaba) के Wan वीडियो परिवार की अगली पीढ़ी है, जिसे लॉन्ग-फॉर्म जनरेशन, मल्टी-रेफरेंस कंट्रोल और ऑडियो-विज़ुअल क्वालिटी को नई ऊंचाइयों पर ले जाने के लिए बनाया गया है। Atlas Cloud पहले से ही Wan 2.7, 2.6 और 2.5 को होस्ट करता है, और Wan 3.0 बिना किसी अलग सेटअप के उसी यूनिफाइड की पर चलता है। आज ही निर्माण शुरू करें। Wan 3.0 क्या बना सकता है, यह देखने के लिए नीचे शोकेस पर स्क्रॉल करें।

सीरीज़ देखें

MiniMax H3

MiniMax H3, टेक्स्ट, इमेज और संदर्भ-निर्देशित सृजन के लिए MiniMax का मल्टीमॉडल वीडियो परिवार है। समर्थित रूट्स में यह संदर्भ मीडिया के विषयों को बनाए रखता है, लचीले आस्पेक्ट रेशियो उपलब्ध कराता है और H3 Developer के ज़रिए जनरेटेड साउंड को विज़ुअल्स के साथ संयोजित करता है; आउटपुट प्रोफ़ाइल endpoint के अनुसार चुनी जाती हैं। Atlas Cloud इस परिवार को एक OpenAI-compatible key के पीछे एकीकृत करता है और $0.038 प्रति सेकंड की मानक दर से शुरू होने वाली पारदर्शी pay-as-you-go pricing प्रदान करता है। आज ही निर्माण शुरू करें।

सीरीज़ देखें

Seedream 5.0 Pro

Seedream 5.0 Pro API डेवलपर्स को Atlas Cloud पर ByteDance का नियंत्रणीय छवि संपादन मॉडल प्रदान करता है। यह एंकर और निर्देशांकों के साथ संपादनों को सटीक रूप से रखता है, छवियों को संपादन योग्य परतों में अलग करता है, कई संदर्भों को मिलाता है, और 2K और 3K पर बहुभाषी पाठ के साथ सटीक रंगों और सामग्रियों का मिलान करता है। Atlas Cloud पर आप एक कुंजी के माध्यम से इस तक पहुँच सकते हैं!

सीरीज़ देखें

Seedance 2.0

Seedance 2.0 ByteDance का प्रोडक्शन-ग्रेड वीडियो मॉडल है, जो सटीक शॉट निर्माण के लिए बनाया गया है। प्रॉम्प्ट्स को वीडियो में बदलें, वैकल्पिक अंतिम-फ़्रेम मार्गदर्शन के साथ प्रथम-फ़्रेम छवि को एनिमेट करें, या संदर्भ मीडिया और वैकल्पिक वेब खोज की मदद से परिणामों को आकार दें। Atlas Cloud इन वर्कफ़्लो को पारदर्शी उपयोग-आधारित मूल्य निर्धारण और एक OpenAI-संगत कुंजी वाली एकीकृत API में लाता है। आज ही निर्माण शुरू करें।

सीरीज़ देखें

GPT Image 2.5

OpenAI का gpt-image-2.5 परिवार डेवलपर्स को प्रोडक्शन इमेज वर्कफ़्लो के लिए Flare और Sunburst में से चुनने की सुविधा देता है। 3840x2160 तक के मनचाहे रिज़ॉल्यूशन पर रेंडर करें और विशिष्ट आउटपुट आवश्यकताओं के अनुरूप xhigh और max समेत पाँच गुणवत्ता स्तरों में से चुनें। Atlas Cloud बिना कोल्ड स्टार्ट और प्रति जनरेशन $0.004 से शुरू होने वाले मानक मूल्य निर्धारण के साथ उपयोग के लिए तैयार REST inference उपलब्ध कराता है। आज से निर्माण शुरू करें।

सीरीज़ देखें

GPT Image 2

GPT Image 2 API डेवलपर्स को OpenAI के नवीनतम इमेज मॉडल तक पहुंच प्रदान करता है, जो GPT Image 1.5 का उत्तराधिकारी है। यह लैटिन और CJK लिपियों में सटीक टेक्स्ट रेंडरिंग के साथ चित्र बनाता और संपादित करता है, साथ ही पोस्टर, मॉकअप और इन्फोग्राफिक्स के लिए मजबूत संयोजन (कंपोजिशन) प्रदान करता है। Atlas Cloud पर आप इसे 300+ मॉडलों के साथ एक एकीकृत API के माध्यम से एक्सेस कर सकते हैं, जिसमें मुफ्त क्रेडिट, 99.99% अपटाइम और OpenAI संगठन सत्यापन की कोई आवश्यकता नहीं है।

सीरीज़ देखें

Gemini Omni Flash

Gemini Omni API Google DeepMind के मूल रूप से मल्टीमॉडल Gemini Omni Flash परिवार, जिसमें Gemini Omni 1.1 Flash भी शामिल है, को डेवलपर्स तक पहुंचाता है। सिंक्रोनाइज़्ड नेटिव ऑडियो के साथ सिनेमैटिक वीडियो बनाएं, सटीक आरंभिक और अंतिम फ़्रेम नियंत्रण के साथ स्थिर छवियों को एनिमेट करें, या टेक्स्ट-निर्देशित संपादनों के ज़रिए मौजूदा फ़ुटेज को संशोधित करें—इस तरह कि अपरिवर्तित सामग्री सुरक्षित रहे। Atlas Cloud एक OpenAI-compatible key, एकीकृत एक्सेस और पारदर्शी pay-as-you-go मूल्य निर्धारण प्रदान करता है। आज ही निर्माण शुरू करें।

सीरीज़ देखें

Grok Imagine

Grok Imagine API xAI की छवि, वीडियो और भाषण मॉडलों को शामिल करता है, Image 2.0 से Video 1.5 और xAI TTS v1 तक। 14 पहलू अनुपातों में 1K या 2K स्थिर छवियां उत्पन्न करें, एक दृश्य को 1080p में 15 सेकंड की गति तक बढ़ाएं, 7 संदर्भ छवियों के साथ शॉट्स को निर्देशित करें, या उन्हें 20 भाषाओं में सुनाएं। Atlas Cloud सभी मोड को एक endpoint पर चलाता है, प्रति उपयोग भुगतान मूल्य निर्धारण $0.02 प्रति छवि और $0.05 प्रति सेकंड से। आज ही निर्माण शुरू करें।

सीरीज़ देखें

Google

Google के सबसे शक्तिशाली क्रिएटिव मॉडल अब Atlas Cloud पर उपलब्ध हैं। Veo 3.1 सिनेमैटिक वीडियो जनरेशन प्रदान करता है, Nano Banana 2 हाई-फिडेलिटी इमेज क्रिएशन को शक्ति देता है, और Gemini हर वर्कफ़्लो में मल्टीमॉडल इंटेलिजेंस लाता है। Day-0 उपलब्धता और पे-एज़-यू-गो (pay-as-you-go) प्राइसिंग के साथ एक ही API key के माध्यम से संपूर्ण Google मॉडल सूट तक पहुंचें।

सीरीज़ देखें

Seedance 2.0 Mini

Seedance 2.0 Mini, ByteDance के मल्टीमोडल वीडियो जनरेशन को उन वर्कफ़्लो में लाता है जहाँ गति और लागत सबसे अधिक मायने रखते हैं। यह एक हल्के फुटप्रिंट पर Seedance 2.0 की मुख्य क्षमताएँ प्रदान करता है — तेज़ जनरेशन, प्रति वीडियो कम लागत, और वही API एकीकरण जिसका आप पहले से उपयोग करते हैं। उच्च-मात्रा वाले पाइपलाइन चलाने या बड़े पैमाने पर प्रोटोटाइपिंग करने वाली टीमों के लिए, Mini व्यावहारिक डिफ़ॉल्ट विकल्प है।

सीरीज़ देखें

ByteDance

सिनेमैटिक वीडियो जनरेशन से लेकर हाई-फिडेलिटी इमेज क्रिएशन तक, ByteDance के सबसे शक्तिशाली मॉडल Atlas Cloud पर लाइव हैं। सबसे कम इन्फ्रेंस प्राइसिंग और शून्य इन्फ्रास्ट्रक्चर ओवरहेड के साथ बड़े पैमाने पर Seedance और Seedream को रन करें।

सीरीज़ देखें

हर मीडिया AI के लिए एक ही API।

सभी मॉडल एक्सप्लोर करें