Seedance 2.5 अब लाइव है — सबसे पहले Atlas Cloud पर

xAI Models on Atlas Cloud | Grok Imagine Models

Atlas Cloud पर xAI API का उपयोग करके संपूर्ण इमेज और वीडियो पाइपलाइन बनाएं। 2K रिज़ॉल्यूशन पर जनरेट करें, संदर्भ छवियों के साथ संपादित करें, और छवियों को ऑडियो-सिंक किए गए क्लिप में एनिमेट करें।

AI Video Models by xAI

Atlas Cloud पर नवीनतम AI वीडियो जनरेशन मॉडल के साथ टेक्स्ट और इमेज से सिनेमाई, उच्च-गुणवत्ता वाले वीडियो बनाएं।

सभी मॉडल देखें

AI Image Models by xAI

Atlas Cloud पर अत्याधुनिक AI इमेज जनरेशन मॉडल का उपयोग करके प्रॉम्प्ट और रेफरेंस से शानदार, प्रोडक्शन-रेडी विज़ुअल तैयार करें।

सभी मॉडल देखें

Large Language Models by xAI

Atlas Cloud पर तेज़ और किफ़ायती ढंग से उपलब्ध अग्रणी बड़े भाषा मॉडल के साथ चैट, रीज़निंग और एजेंट को बड़े पैमाने पर सशक्त बनाएं।

सभी मॉडल देखें
Grok
LLM
टेक्स्ट-से-ऑडियो
ऑडियो-से-टेक्स्ट

Grok

xAI द्वारा विकसित Grok, रियल-टाइम अवेयरनेस और फ्रंटियर-लेवल रीजनिंग के इर्द-गिर्द बने बड़े लैंग्वेज मॉडल की एक श्रृंखला है। Grok 4.3 xAI का उन्नत कन्वर्सेशनल मॉडल है, जिसे 1,000,000-टोकन कॉन्टेक्स्ट विंडो में प्राकृतिक संवाद, ज्ञान की खोज और मल्टी-स्टेप रीजनिंग के लिए अनुकूलित किया गया है। Grok Build 0.1 एक अलग दिशा लेता है — यह विशेष रूप से सॉफ्टवेयर विकास के लिए बनाया गया है, जिसकी क्षमताएं जटिल डेवलपर वर्कफ्लो में कोड जनरेशन, डिबगिंग और रिफैक्टरिंग पर केंद्रित हैं। दोनों मॉडल OpenAI-संगत API एंडपॉइंट्स के माध्यम से Atlas Cloud पर उपलब्ध हैं, जिनकी कीमत $1 प्रति मिलियन टोकन से शुरू होती है।

5 मॉडलGrok एक्सप्लोर करें

xAI Models API Pricing Details

Compare standard vs. our pricing across every xAI model.

ModelStandard Price (USD)Our Price (USD)Discount
xAI TTS v1$0.015/K chars
Start from$0.015/K chars
View
Grok Imagine Video v1.5 Reference-to-Video$0.08
Start from$0.08/s video
View
Grok Imagine Video v1.5 Text-to-Video$0.08
Start from$0.08/s video
View
Grok Imagine Video v1.5 Image-to-Video$0.08
Start from$0.08/s video
View
Grok Imagine Image Quality Text-to-Image$0.05/pic
Start from$0.05/pic
View
Grok Imagine Image Quality Edit$0.05/pic
Start from$0.05/pic
View

Explore models from other providers

Instantly explore and experiment with 400+ production-ready models in the Atlas Playground. Start customizing with one click.

xAI API के उपयोग के मामले जिन्हें आप Atlas Cloud पर विकसित कर सकते हैं

Grok Imagine के इमेज और वीडियो एंडपॉइंट्स एक ही API से जेनरेशन, एडिटिंग और एनीमेशन को संभालते हैं। टीमें इनका उपयोग स्थिर एसेट्स को साउंड-ऑन वीडियो कंटेंट में बदलने और विज़ुअल क्रिएटिव्स को उस गति और लागत पर बनाने के लिए करती हैं जो पहले व्यावहारिक नहीं थी।

स्वचालित ई-कॉमर्स उत्पाद वीडियो

ई-कॉमर्स टीमें ऐसे पाइपलाइन बनाती हैं जो Grok Imagine Video v1.5 का उपयोग करके उत्पाद छवियों को छोटे वीडियो क्लिप में एनिमेट करते हैं, जिसमें एम्बिएंट साउंड और उत्पाद-संदर्भ ऑडियो एक ही कॉल में उत्पन्न होते हैं। एक एकल उत्पाद फोटो बिना किसी वीडियो शूट या ऑडियो संपादन के विज्ञापनों और उत्पाद पृष्ठों के लिए तैयार ध्वनि-युक्त क्लिप बन जाता है। Atlas Cloud पर $0.096 प्रति सेकंड की दर से, 10-सेकंड के उत्पाद वीडियो की कीमत एक डॉलर से भी कम होती है।

स्थिर एसेट्स से ब्रांड विज्ञापन क्रिएटिव

ब्रांड टीमें स्वीकृत अभियान फ़ोटोग्राफ़ी को मूल रूप से जेनरेट किए गए ऑडियो वाले एनिमेटेड सोशल विज्ञापनों में बदलने के लिए Grok Imagine Video v1.5 का उपयोग करती हैं। क्योंकि ऑडियो और वीडियो टोकन एक ही इन्फ़्रेंस पास (inference pass) में उत्पन्न होते हैं, इसलिए संवाद, ध्वनि प्रभाव और एम्बिएंट संगीत बिना पोस्ट-प्रोडक्शन कार्य के विज़ुअल के साथ सिंक्रोनाइज़ हो जाते हैं। यह विज्ञापन क्रिएटिव वर्कफ़्लो से ऑडियो प्रोडक्शन चरण को पूरी तरह से हटा देता है।

फ़िल्म प्री-प्रोडक्शन स्टोरीबोर्डिंग

निर्देशक और सिनेमैटोग्राफर उत्पादन शुरू होने से पहले शॉट संयोजन, कैमरा एंगल और प्रकाश व्यवस्था दिखाने वाले दृश्य स्टोरीबोर्ड बनाने के लिए Grok Imagine Image का उपयोग करते हैं। 2K रिज़ॉल्यूशन आउटपुट इतना विस्तृत है कि इसे प्रत्येक दृश्य के लिए एक दृश्य संक्षिप्त विवरण के रूप में क्रू के साथ साझा किया जा सकता है। प्रति छवि $0.06 की दर से, कई शॉट विकल्पों के माध्यम से पुनरावृत्ति करने में उत्पादन समय के एक घंटे से भी कम का खर्च आता है।

रियल एस्टेट लाइफस्टाइल वीडियो

रियल एस्टेट डेवलपर्स आर्किटेक्चरल रेंडर या इंटीरियर तस्वीरों से सिनेमैटिक लाइफस्टाइल क्लिप बनाने के लिए Grok Imagine Video v1.5 का उपयोग करते हैं। एक बालकनी रेंडर एम्बिएंट ऑडियो के साथ सनसेट-व्यू क्लिप बन जाता है, रसोई की तस्वीर प्राकृतिक ध्वनि के साथ सुबह के दृश्य में बदल जाती है। यह लिस्टिंग और प्री-सेल मार्केटिंग सामग्री के लिए महंगे लाइफस्टाइल फोटोग्राफी शूट की जगह लेता है।

बहु-संदर्भ छवि संयोजन

रचनात्मक टीमें Grok Imagine Image Edit के 3-सोर्स इनपुट का उपयोग करके कई संदर्भ छवियों के तत्वों को एक सिंगल आउटपुट में संयोजित करती हैं — एक API कॉल में उत्पाद शॉट, पृष्ठभूमि और प्रकाश संदर्भ का संयोजन करती हैं। यह विभिन्न दृश्य सेटिंग्स में ब्रांड की एकरूपता बनाए रखने वाले अभियान वेरिएंट के उत्पादन को व्यावहारिक बनाता है। Atlas Cloud पर प्रत्येक कंपोजिट की कीमत $0.06 प्रति छवि है।

इंडी गेम कॉन्सेप्ट आर्ट और ट्रेलर्स

छोटे गेम स्टूडियो प्री-प्रोडक्शन के दौरान कॉन्सेप्ट आर्ट तैयार करने के लिए Grok Imagine Image का उपयोग करते हैं, फिर एनिमेटेड ट्रेलर अनुक्रम बनाने के लिए की-फ्रेम्स को Grok Imagine Video v1.5 में भेजते हैं। वीडियो एक्सटेंशन सुविधा टीमों को प्रति-कॉल 15-सेकंड की सीमा से परे लंबे सिनेमाई अनुक्रम बनाने के लिए एक ही शुरुआती फ्रेम से क्लिप को जोड़ने की अनुमति देती है। यह वर्कफ़्लो प्रारंभिक चरण की मार्केटिंग सामग्री के लिए बाहरी एनीमेशन ठेकेदारों की जगह लेता है।

Atlas Cloud AI ि

सेल्स से संपर्क करें

Xai मॉडल के बारे में अक्सर पूछे जाने वाले प्रश्न

xAI Atlas Cloud पर दो इमेज एंडपॉइंट प्रदान करता है: टेक्स्ट-टू-इमेज जनरेशन के लिए Grok Imagine Image Quality और मौजूदा इमेजेज को एडिट करने के लिए Grok Imagine Image Quality Edit। दोनों 2K रिज़ॉल्यूशन तक का आउटपुट देते हैं और इनकी कीमत $0.06 प्रति इमेज है। सभी एंडपॉइंट एक ही API कुंजी के तहत पे-ऐज़-यू-गो (pay-as-you-go) आधार पर उपलब्ध हैं।

हाँ। Atlas Cloud चार xAI वीडियो एंडपॉइंट्स होस्ट करता है: टेक्स्ट-टू-वीडियो, इमेज-टू-वीडियो, रेफरेंस-टू-वीडियो, और नेटिव ऑडियो के साथ इमेज-टू-वीडियो के लिए नया Grok Imagine Video v1.5। सभी मानक वीडियो एंडपॉइंट्स की कीमत $0.06 प्रति सेकंड है। Video v1.5 की कीमत $0.096 प्रति सेकंड है।

हाँ, Grok Imagine Video v1.5 एक ही इंफरेंस पास में ऑडियो और वीडियो जेनरेट करता है। संवाद, लिप-सिंक, ध्वनि प्रभाव और परिवेशी संगीत को पोस्ट-प्रोसेसिंग में जोड़ने के बजाय वीडियो फ्रेम के साथ संयुक्त रूप से तैयार किया जाता है। इसका अर्थ है कि ऑडियो और दृश्य घटनाएँ एक अलग संरेखण (अलाइनमेंट) चरण के बिना सिंक्रोनाइज़ हो जाती हैं।

हाँ। Grok Imagine Image Quality Edit एंडपॉइंट एक मौजूदा छवि और एक टेक्स्ट निर्देश को स्वीकार करता है, फिर एक संशोधित संस्करण तैयार करता है। आप बहु-संदर्भ संपादन के लिए प्रति कॉल अधिकतम 3 स्रोत छवियां प्रदान कर सकते हैं। Atlas Cloud पर इसकी कीमत $0.06 प्रति छवि है।

Grok Imagine Image 1K और 2K रिज़ॉल्यूशन आउटपुट को सपोर्ट करता है। 2K विकल्प स्टूडियो-ग्रेड छवि गुणवत्ता प्रदान करता है और यह प्रति छवि $0.06 की समान दर पर उपलब्ध है। रिज़ॉल्यूशन को प्रत्येक API कॉल में एक पैरामीटर के रूप में सेट किया जाता है।

प्रत्येक व्यक्तिगत कॉल 15 सेकंड तक के क्लिप उत्पन्न करती है। लंबे दृश्यों के लिए, आप पिछले क्लिप के अंतिम फ्रेम से एक नया क्लिप जारी रखने और शॉट्स को एक साथ जोड़ने के लिए वीडियो एक्सटेंशन सुविधा का उपयोग कर सकते हैं। यह सिंगल-क्लिप सीमा से परे मल्टी-शॉट दृश्यों की अनुमति देता है।

हाँ। Atlas Cloud द्वारा Grok Imagine Image को कई भाषाओं में सर्वश्रेष्ठ-इन-क्लास टेक्स्ट रेंडरिंग के रूप में वर्णित किया गया है। आप अपने प्रॉम्प्ट में गैर-अंग्रेजी टेक्स्ट शामिल कर सकते हैं और इसे जेनरेट की गई छवि के भीतर सटीक रूप से रेंडर करवा सकते हैं। विशिष्ट भाषा कवरेज विवरण Atlas Cloud Grok Imagine मॉडल पृष्ठ पर उपलब्ध हैं।

इमेज जेनरेशन और इमेज एडिटिंग दोनों की कीमत $0.06 प्रति इमेज है। स्टैंडर्ड वीडियो जेनरेशन की दर $0.06 प्रति सेकंड है। नेटिव ऑडियो के साथ Grok Imagine Video v1.5 की कीमत $0.096 प्रति सेकंड है। सभी मॉडल पे-एज़-यू-गो (उपयोग के अनुसार भुगतान) आधार पर उपलब्ध हैं, जिनमें कोई मासिक न्यूनतम सीमा नहीं है।

अधिक सीरीज़ एक्सप्लोर करें

Seedance 2.5

Seedance 2.5 API अब Atlas Cloud पर उपलब्ध है! यह डेवलपर्स को ByteDance का नवीनतम वीडियो मॉडल प्रदान करता है। यह टेक्स्ट, एकल छवि, या 50 मल्टीमोडल संदर्भों से एक ही बार में 30 सेकंड तक का नेटिव वीडियो उत्पन्न करता है, जिसमें सिंक्रनाइज़ ऑडियो और इन-फ्रेम बहुभाषी टेक्स्ट शामिल है। Atlas Cloud पर आप इसे एक कुंजी के माध्यम से एक्सेस कर सकते हैं, जिसमें विषय की निरंतरता और बेहतर भौतिकी लंबे शॉट्स को सुसंगत रखती है।

सीरीज़ देखें

MiniMax H3

MiniMax H3 API, MiniMax के सामान्य-उद्देश्य वाले multimodal video model को उपलब्ध कराता है, जो text, images, video और audio को एक बार में एक task के बजाय एक ही context के रूप में पढ़ता है। Clips 24 FPS पर 21:9 से 9:16 तक के aspect ratios में 5 से 15 seconds तक चलते हैं, और एक prompt characters बदल सकता है, backgrounds replace कर सकता है, dialogue rewrite कर सकता है या किसी reference clip से voice clone कर सकता है। Atlas Cloud यह सब एक OpenAI-compatible endpoint के ज़रिए उपलब्ध कराता है। आज ही बनाना शुरू करें।

सीरीज़ देखें

Seedream 5.0 Pro

Seedream 5.0 Pro API डेवलपर्स को Atlas Cloud पर ByteDance का नियंत्रणीय छवि संपादन मॉडल प्रदान करता है। यह एंकर और निर्देशांकों के साथ संपादनों को सटीक रूप से रखता है, छवियों को संपादन योग्य परतों में अलग करता है, कई संदर्भों को मिलाता है, और 2K और 3K पर बहुभाषी पाठ के साथ सटीक रंगों और सामग्रियों का मिलान करता है। Atlas Cloud पर आप एक कुंजी के माध्यम से इस तक पहुँच सकते हैं!

सीरीज़ देखें

Seedance 2.0

Seedance 2.0 API आपको ByteDance के मल्टीमॉडल वीडियो मॉडल तक प्रोडक्शन एक्सेस देता है — क्वाड-मॉडल इनपुट्स (टेक्स्ट, इमेज, वीडियो, ऑडियो) और एक उद्योग-अग्रणी "Universal Reference" सिस्टम जो शॉट्स के बीच कंपोजिशन, कैमरा मूवमेंट और कैरेक्टर एक्शन्स को लॉक करता है। एक API कॉल के साथ डायरेक्टर-लेवल कंट्रोल को इंटीग्रेट करें, $0.09/s की फ्लैट दर, इंस्टेंट की और बिना किसी वेटलिस्ट के — जिसे एंटरप्राइज़-ग्रेड अपटाइम और कंप्लायंस का समर्थन प्राप्त है। Seedance 2.0 Native 4K अब लाइव है!

सीरीज़ देखें

GPT Image 2

GPT Image 2 API डेवलपर्स को OpenAI के नवीनतम इमेज मॉडल तक पहुंच प्रदान करता है, जो GPT Image 1.5 का उत्तराधिकारी है। यह लैटिन और CJK लिपियों में सटीक टेक्स्ट रेंडरिंग के साथ चित्र बनाता और संपादित करता है, साथ ही पोस्टर, मॉकअप और इन्फोग्राफिक्स के लिए मजबूत संयोजन (कंपोजिशन) प्रदान करता है। Atlas Cloud पर आप इसे 300+ मॉडलों के साथ एक एकीकृत API के माध्यम से एक्सेस कर सकते हैं, जिसमें मुफ्त क्रेडिट, 99.99% अपटाइम और OpenAI संगठन सत्यापन की कोई आवश्यकता नहीं है।

सीरीज़ देखें

Gemini Omni Flash

Gemini Omni API, Google I/O 2026 में पेश किए गए Google DeepMind के मल्टीमोडल वीडियो जेनरेशन और एडिटिंग मॉडल को आपके स्टैक तक लाता है। Gemini Omni, Gemini के रीज़निंग इंजन को जेनरेटिव मीडिया के साथ जोड़ता है और टेक्स्ट, इमेज, वीडियो तथा ऑडियो के किसी भी संयोजन को स्वीकार कर सुसंगत, ज्ञान-आधारित आउटपुट तैयार करता है। स्वाभाविक बातचीत के ज़रिए परिणामों को निखारें — ऑब्जेक्ट बदलें, सीन दोबारा लिखें और स्टाइल बदलें, जबकि फ़िज़िक्स, किरदार और निरंतरता ज्यों की त्यों बनी रहती है। Atlas Cloud पूरी Gemini Omni Flash सीरीज़ — टेक्स्ट-टू-वीडियो, 7 रेफ़रेंस इमेज तक के साथ इमेज-टू-वीडियो, और रेफ़रेंस-टू-वीडियो — एक एकीकृत API के माध्यम से उपलब्ध कराता है, जिसमें $0.112 से शुरू होने वाली पारदर्शी प्रति-सेकंड कीमत है और कोई सब्सक्रिप्शन नहीं। आज ही बनाना शुरू करें।

सीरीज़ देखें

Grok Imagine

Grok Imagine API xAI की छवि, वीडियो और भाषण मॉडलों को शामिल करता है, Image 2.0 से Video 1.5 और xAI TTS v1 तक। 14 पहलू अनुपातों में 1K या 2K स्थिर छवियां उत्पन्न करें, एक दृश्य को 1080p में 15 सेकंड की गति तक बढ़ाएं, 7 संदर्भ छवियों के साथ शॉट्स को निर्देशित करें, या उन्हें 20 भाषाओं में सुनाएं। Atlas Cloud सभी मोड को एक endpoint पर चलाता है, प्रति उपयोग भुगतान मूल्य निर्धारण $0.02 प्रति छवि और $0.05 प्रति सेकंड से। आज ही निर्माण शुरू करें।

सीरीज़ देखें

Google

Google के सबसे शक्तिशाली क्रिएटिव मॉडल अब Atlas Cloud पर उपलब्ध हैं। Veo 3.1 सिनेमैटिक वीडियो जनरेशन प्रदान करता है, Nano Banana 2 हाई-फिडेलिटी इमेज क्रिएशन को शक्ति देता है, और Gemini हर वर्कफ़्लो में मल्टीमॉडल इंटेलिजेंस लाता है। Day-0 उपलब्धता और पे-एज़-यू-गो (pay-as-you-go) प्राइसिंग के साथ एक ही API key के माध्यम से संपूर्ण Google मॉडल सूट तक पहुंचें।

सीरीज़ देखें

Seedance 2.0 Mini

Seedance 2.0 Mini, ByteDance के मल्टीमोडल वीडियो जनरेशन को उन वर्कफ़्लो में लाता है जहाँ गति और लागत सबसे अधिक मायने रखते हैं। यह एक हल्के फुटप्रिंट पर Seedance 2.0 की मुख्य क्षमताएँ प्रदान करता है — तेज़ जनरेशन, प्रति वीडियो कम लागत, और वही API एकीकरण जिसका आप पहले से उपयोग करते हैं। उच्च-मात्रा वाले पाइपलाइन चलाने या बड़े पैमाने पर प्रोटोटाइपिंग करने वाली टीमों के लिए, Mini व्यावहारिक डिफ़ॉल्ट विकल्प है।

सीरीज़ देखें

ByteDance

सिनेमैटिक वीडियो जनरेशन से लेकर हाई-फिडेलिटी इमेज क्रिएशन तक, ByteDance के सबसे शक्तिशाली मॉडल Atlas Cloud पर लाइव हैं। सबसे कम इन्फ्रेंस प्राइसिंग और शून्य इन्फ्रास्ट्रक्चर ओवरहेड के साथ बड़े पैमाने पर Seedance और Seedream को रन करें।

सीरीज़ देखें

Alibaba

Atlas Cloud एक ही API के तहत Alibaba के पूरे मॉडल लाइनअप को एक साथ लाता है: भाषा और छवि कार्यों के लिए Qwen, और 1080p तक के वीडियो निर्माण के लिए Wan। बिना किसी सब्सक्रिप्शन के पे-एज़-यू-गो (pay-as-you-go) के आधार पर प्रत्येक मॉडल तक पहुँच प्राप्त करें। Alibaba API आपके मौजूदा OpenAI-संगत क्लाइंट का उपयोग करके एकल बेस URL के माध्यम से उपलब्ध है।

सीरीज़ देखें

OpenAI

Atlas Cloud आपको पूर्ण OpenAI API लाइनअप तक पहुंच प्रदान करता है, छवि निर्माण के लिए GPT Image 2 से लेकर वीडियो के लिए Sora 2 तक। हर मॉडल बिना किसी मासिक प्रतिबद्धता के 'पे-ऐज़-यू-गो' (pay-as-you-go) आधार पर उपलब्ध है। OpenAI-संगत API का उपयोग करके एकल बेस URL स्वैप के साथ प्लग इन करें।

सीरीज़ देखें

अनुशंसित लेख

Atlas Cloud का भरपूर लाभ उठाने में मदद करने वाली गाइड, ट्यूटोरियल और प्रोडक्ट अपडेट।