Kling 1.6 Multi-Image Subject Consistency

Kling 1.6 Multi-Image Subject Consistency

Kling 1.6, Kuaishou का वीडियो जनरेशन मॉडल है, जिसे प्रॉम्प्ट और संदर्भ इमेज को सुसंगत शॉर्ट-फॉर्म वीडियो में बदलने के लिए बनाया गया है। यह गति, समय-आधारित क्रियाओं और कैमरा मूवमेंट के प्रति प्रतिक्रिया को बेहतर बनाता है, साथ ही विषय की एकरूपता, रंगों की सटीकता, प्रकाश व्यवस्था की गतिशीलता और विस्तृत रेंडरिंग को सशक्त करता है। Atlas Cloud के माध्यम से एक OpenAI-संगत कुंजी और पारदर्शी पे-ऐज़-यू-गो मूल्य निर्धारण के साथ इस मॉडल परिवार का उपयोग करें। आज ही निर्माण शुरू करें।

Kling 1.6 को Kuaishou द्वारा विकसित किया गया है। Atlas Cloud (Atlas Cloud AI LLC द्वारा संचालित) इस तक पहुँच प्रदान करता है, इसका स्वामी नहीं है। सभी ट्रेडमार्क उनके संबंधित स्वामियों की संपत्ति हैं।

मोडैलिटी के आधार पर Kling 1.6 Endpoints की तुलना

देखें कि प्रत्येक Kling 1.6 endpoint टेक्स्ट या इमेज इनपुट को कैसे संभालता है और गति, सुसंगति, विवरण व दक्षता में उसकी सत्यापित खूबियाँ कहाँ उपयोगी हैं।

मोडैलिटीविवरण
Kling 1.6 Multi I2V Pro API (Multi Image To Video)बेहतर सुसंगति और उन्नत गति-ट्रैकिंग सटीकता के साथ कई विषयों वाले वीडियो बनाने के लिए इमेज को वीडियो में बदलें। यह Pro endpoint उन जटिल दृश्यों के लिए उपयुक्त है जहाँ विषयों की समन्वित गति और दृश्य एकरूपता महत्वपूर्ण होती है।
Kling 1.6 Multi I2V Standard API (Multi Image To Video)कम लागत में कई विषयों वाले वीडियो बनाने के लिए यह endpoint गति और विवरण के बीच संतुलन रखते हुए इमेज को वीडियो में बदलता है। यह बुनियादी दृश्य एनीमेशन और कई विषयों वाले नियमित कंटेंट निर्माण के लिए उपयुक्त है।
Kling 1.6 T2V Standard API (Text To Video)टेक्स्ट प्रॉम्प्ट स्थिर गति और विश्वसनीय प्रॉम्प्ट-अनुरूपता वाले छोटे वीडियो में बदल जाते हैं। कॉन्सेप्ट विज़ुअलाइज़ेशन, सोशल कंटेंट और सरल प्रॉम्प्ट-आधारित सीक्वेंस के लिए इस शुरुआती स्तर के endpoint का उपयोग करें।
Kling 1.6 I2V Pro API (Image To Video)एक स्थिर इमेज से शुरुआत करते हुए, यह Pro endpoint अधिक सहज गति-मिश्रण और बेहतर टेक्सचर यथार्थता वाला वीडियो तैयार करता है। यह परिष्कृत उत्पाद दृश्यों, कैरेक्टर शॉट्स और सिनेमाई इमेज एनीमेशन के लिए अच्छी तरह काम करता है।
Kling 1.6 I2V Standard API (Image To Video)बुनियादी जनरेशन वर्कफ़्लो के माध्यम से इमेज को वीडियो में बदलने के लिए इस कम संसाधन वाले endpoint को चुनें। इसकी कम लागत इसे सरल एनीमेशन, शुरुआती क्रिएटिव परीक्षण और बड़े पैमाने के उत्पादन के लिए उपयुक्त बनाती है।

प्रॉम्प्ट से मोशन तक सीधे Kling 1.6

Kling 1.6 टेक्स्ट, एकल इमेज और अधिकतम चार इमेज रेफ़रेंस वर्कफ़्लो को 5 या 10 सेकंड के आउटपुट, नियंत्रित प्रॉम्प्ट अनुपालन, वैकल्पिक नेगेटिव प्रॉम्प्ट, चुने गए आस्पेक्ट रेशियो और एक ही Atlas Cloud API के ज़रिए Standard या Pro एक्सेस के साथ संयोजित करता है।

टेक्स्ट या इमेज से Kling 1.6

Kling 1.6 समर्पित वैरिएंट के ज़रिए टेक्स्ट-टू-वीडियो और इमेज-टू-वीडियो जनरेशन उपलब्ध कराता है। लिखे हुए दृश्य से शुरुआत करें या किसी स्रोत इमेज को एनिमेट करें, फिर अधिकतम 2,500 अक्षरों वाले प्रॉम्प्ट से कार्रवाई को निर्देशित करें। Standard मॉडल लागत-कुशलता को प्राथमिकता देते हैं, जबकि Pro इमेज वैरिएंट अधिक सहज मोशन ब्लेंडिंग और ज़्यादा वास्तविक टेक्सचर पर ज़ोर देता है। यह रेंज कॉन्सेप्ट टेस्टिंग, सोशल क्लिप्स और परिष्कृत विज़ुअल सीक्वेंस के लिए उपयुक्त है।

चार रेफ़रेंस इमेज

Multi I2V Standard या Pro वैरिएंट के साथ एक से चार रेफ़रेंस इमेज अपलोड करें। प्रॉम्प्ट सब्जेक्ट, मूवमेंट और दृश्य के विकास को निर्देशित करते समय मॉडल इनका उपयोग विज़ुअल रेफ़रेंस के रूप में करता है। Pro को बेहतर मल्टी-सब्जेक्ट सामंजस्य और अधिक सटीक मोशन ट्रैकिंग के लिए ट्यून किया गया है। यह कैरेक्टर इंटरैक्शन, प्रोडक्ट संयोजन और कई विज़ुअल तत्वों को एक साथ लाने वाले दृश्यों के लिए उपयुक्त है।

पहले और अंतिम फ़्रेम का नियंत्रण

I2V Pro वैरिएंट के साथ एक शुरुआती इमेज और वैकल्पिक अंतिम इमेज सेट करके तय करें कि क्लिप कहाँ से शुरू हो और कहाँ समाप्त हो। हर इमेज JPG, JPEG या PNG हो सकती है, जिसका आकार अधिकतम 10 MB और रिज़ॉल्यूशन कम से कम 300 x 300 पिक्सेल हो। इन दोनों विज़ुअल एंकर के बीच मोशन निर्देश जोड़ें। यह नियंत्रण योजनाबद्ध ट्रांज़िशन, पोज़ बदलाव और प्रोडक्ट रिवील के लिए विशेष रूप से उपयोगी है।

दिशा-निर्देशों के साथ Kling 1.6 मोशन

Pro इमेज वैरिएंट का प्रमुख फ़ोकस सहज मोशन है, जिसमें इसके Atlas Cloud प्रोफ़ाइल में अपग्रेडेड ब्लेंडिंग और बेहतर टेक्सचर रियलिज़्म दर्ज है। 0 से 1 तक का गाइडेंस स्केल प्रॉम्प्ट अनुपालन को समायोजित करता है, जबकि नेगेटिव प्रॉम्प्ट अवांछित तत्वों से दूर रहने में मदद करते हैं। प्राकृतिक मूवमेंट और कड़ाई से निर्देशित कार्रवाई के बीच संतुलन बनाने के लिए इन नियंत्रणों का उपयोग करें। यह संयोजन चुनौतीपूर्ण कैरेक्टर, फ़ैब्रिक और कैमरा मूवमेंट के लिए उपयुक्त है।

उपयुक्त अवधि और फ़ॉर्मैट

पूरे Kling 1.6 परिवार में 5 या 10 सेकंड का आउटपुट चुनें। टेक्स्ट और मल्टी-इमेज वैरिएंट 16:9, 9:16 और 1:1 आस्पेक्ट रेशियो भी उपलब्ध कराते हैं, जिससे एक ही वर्कफ़्लो वाइडस्क्रीन, वर्टिकल या स्क्वायर प्लेसमेंट के लिए लक्षित किया जा सकता है। 2,500 अक्षरों की प्रॉम्प्ट सीमा सब्जेक्ट, एक्शन, लाइटिंग और कैमरा निर्देशन के लिए पर्याप्त जगह देती है। ये विकल्प टीमों को मॉडल परिवार बदले बिना प्लेटफ़ॉर्म-विशिष्ट एसेट की योजना बनाने में मदद करते हैं।

एक ही API के ज़रिए Kling 1.6 टियर

सभी सूचीबद्ध Kling 1.6 वैरिएंट को एक ही Atlas Cloud वीडियो जनरेशन API के ज़रिए pay as you go बिलिंग के साथ चलाएँ। Standard वैरिएंट प्रति रन $0.056 की सत्यापित मूल कीमत का उपयोग करते हैं, जबकि Pro वैरिएंट प्रति रन $0.098 की कीमत पर चलते हैं। लागत, विवरण और मोशन क्वालिटी के आवश्यक संतुलन के अनुसार टियर चुनें। यह सेटअप अलग-अलग प्रोवाइडर इंटीग्रेशन के बिना तेज़ प्रयोगों और प्रोडक्शन पाइपलाइन का समर्थन करता है।

एक प्रॉम्प्ट में Kling 1.6: तीन वीडियो मॉडल की तुलना

देखें कि Kling 1.6 और दो वैकल्पिक वीडियो मॉडल यथार्थपरक एक्शन और शैलीबद्ध कहानी-वाचन में एक जैसे प्रॉम्प्ट को कैसे समझते हैं।

प्रॉम्प्ट

आधी रात में काँच फूँकने वाली कार्यशाला के भीतर 8–10 सेकंड का सिनेमाई लघु लाइव-एक्शन दृश्य: एक युवा कारीगर लगातार ब्लोपाइप घुमाता है, जबकि सफेद-तप्त काँच का बुलबुला तेज़ी से फैलता है और उसका पूर्णतः गोल आकार पूरे संयोजन का केंद्र बना रहता है। घूमते हुए पिघले काँच के चारों ओर एक अत्यंत मैक्रो ऑर्बिट शॉट से शुरुआत करें, जिसमें पारदर्शी एम्बर तंतु खिंचते हुए, चिपचिपा सतही तनाव, गर्मी की झिलमिलाहट, छोटी-छोटी चिंगारियाँ और भीतर का यथार्थपरक अपवर्तन कैद हो। फूलता हुआ बुलबुला अचानक पाइप से फिसलकर चाँदी-धूसर धातु की मेज़ से टकराता है और तेज़ी से लुढ़कता है; कैमरा मेज़ की ऊँचाई पर आकर उसके साथ हाई-स्पीड ट्रैकिंग शॉट में चले, जहाँ वह डगमगाता, विकृत होता, चमकते धागे छोड़ता और भट्ठी की नारंगी आभा के सामने कोबाल्ट-नीली चाँदनी प्रतिबिंबित करता है। व्हिप-पैन करते हुए घबराए कारीगर को बेंच पर झपटते और आखिरी क्षण में गीले लकड़ी के पैडल से भागते हुए काँच को पकड़ते दिखाएँ—एक विस्फोटक फुफकार भौतिक रूप से सटीक भाप को पूरे फ्रेम में घुमा देती है। भाप छँटने पर दिखाएँ कि काँच चमत्कारिक रूप से एक छोटी पारदर्शी पफरफिश में जम गया है, जिसके नाज़ुक काँच के पंख और भीतर समान रूप से मौजूद बुलबुले हैं; वह खेलपूर्ण अंतिम क्षण में एक बार धीरे से अपने गाल फुलाती है। निर्बाध निरंतर गति, विषय का सुसंगत रूपांतरण, काँच की यथार्थपरक श्यानता, टकराव, तापीय चमक, चिंगारियाँ, अपवर्तन, कैस्टिक्स, गर्मी से होने वाली विकृति और भाप की भौतिकी; एम्बर, कोबाल्ट नीले और चाँदी-धूसर रंगों की परतदार पैलेट; भट्ठी की नारंगी मुख्य रोशनी, ठंडी चाँद-नीली किनारी रोशनी, कम डेप्थ ऑफ फील्ड, स्पर्शनीय उच्च-स्तरीय प्रैक्टिकल मिनिएचर फिल्मनिर्माण, फोटोरियल सिनेमाई टेक्सचर, कोई स्लो मोशन नहीं, कोई स्थिर भराव दृश्य नहीं, कोई स्क्रीन, सॉफ़्टवेयर इंटरफ़ेस, डैशबोर्ड, प्रोग्रेस बार, चार्ट, कैप्शन, टेक्स्ट, लोगो या वॉटरमार्क नहीं। समकालिक ऑडियो: गरजती भट्ठी, घूमते पाइप की घिसने की आवाज़, तीखी धात्विक खनक, लुढ़कते काँच की खड़खड़ाहट, जल्दबाज़ कदमों की आहट, तेज़ गीली फुफकार, फिर एक छोटी क्रिस्टलीय फुसफुसाहट; तनावपूर्ण परकशन लय, जिसका अंत चंचल काँच की झंकार पर हो। 16:9 आस्पेक्ट रेशियो।

Generated with Kling v1.6 Multi i2v Pro on Atlas Cloud

Generated with Seedance 2.0 Image-to-Video on Atlas Cloud

Generated with Kling v1.6 i2v Standard on Atlas Cloud

प्रॉम्प्ट

देर रात हांगकांग की एक तंग नूडल दुकान की पिछली रसोई में 9 सेकंड की तनावपूर्ण सूक्ष्म कहानी: एक युवा शेफ रैमेन का ऑर्डर बचाने के लिए लगातार और बेहद सटीक, विश्वसनीय हाथों की गतियों के साथ तेजी से काम करता है। आटे की धूल से ढके कटिंग बोर्ड के ऊपर से गुजरते हुए एक अत्यंत लो-एंगल लेटरल ट्रैकिंग शॉट से शुरुआत करें, जहाँ वह कलाई झटककर नूडल्स का लंबा गुच्छा हवा में बहुत ऊपर उछालता है; घनी भाप के बीच बल खाती लटों का पीछा करें, जिसमें हर नूडल मुड़ता, खिंचता और स्वाभाविक रूप से उसके हाथों तथा लटके हुए बर्तनों को आंशिक रूप से ढकता रहे। व्हिप-पैन करते हुए चूल्हे के पास के तंग एंगल पर जाएँ, जहाँ नूडल्स का गुच्छा लगभग लपटें छोड़ती गैस की आँच में गिरने वाला है; आखिरी क्षण में वह आगे झपटकर उसे वायर स्किमर में साफ़-सुथरे ढंग से पकड़ लेता है, जाली उसके भार के नीचे मुड़ती है, फिर वह एक ही प्रवाहपूर्ण गति में घूमकर नूडल्स को हिंसक रूप से उबलते शोरबे में डुबो देता है, जिससे यथार्थपरक बूँदें, बुलबुले और तैलीय लहरियाँ बर्तन में फैल जाती हैं। तुरंत ऊपर से लिए गए टॉप-डाउन शॉट पर कट करें, जहाँ नूडल्स सूप में खुलकर एक सुघड़ खिलती हुई सर्पिल आकृति बना लेते हैं; सर्विस हैच के पार प्रतीक्षा कर रहे ग्राहक आगे झुकते हैं और प्रसन्न होकर तालियाँ बजाने लगते हैं, जबकि शेफ हाँफते हुए मुस्कुराता है। हर कट में उसी शेफ, कपड़ों, बर्तनों, नूडल्स के गुच्छे, रसोई की भौगोलिक निरंतरता और गति का सटीक क्रम बनाए रखें। गहरी और सघन स्टेजिंग में शेफ, नूडल्स, लपटों, बर्तनों और अग्रभूमि के औज़ारों का लगातार समन्वय हो; हवा में उड़ता आटा, गीली टाइलों के प्रतिबिंब, चमकता तेल, संघनन और लहराती भाप की स्पर्शनीय परतें दिखाई दें। फोटोरियलिस्टिक हांगकांग सिनेमा सौंदर्य, हाथ से पकड़े कैमरे की गतिशील ऊर्जा, स्पष्ट प्राकृतिक मोशन ब्लर, ठंडी सियान सिरेमिक टाइलों से टकराती गर्म टंग्स्टन-नारंगी प्रैक्टिकल लाइटें, समृद्ध कॉन्ट्रास्ट, सूक्ष्म 35mm फिल्म ग्रेन, त्वचा और भोजन का यथार्थपरक टेक्सचर। समकालिक ध्वनि: चाकू और बोर्ड की खड़खड़ाहट, गैस की लपटों की गर्जना, तेज़ी से बहती भाप, स्किमर की खनक, उबलते शोरबे के छींटे, फिर तालियों की तीखी गड़गड़ाहट; तेज़ परकशन वाली रसोई की लय, कोई संवाद नहीं। कोई स्लो मोशन, जमी हुई मुद्राएँ, खाली स्थापना दृश्य, मोंटाज गैप, उछलती हुई निरंतरता, अतिरिक्त उँगलियाँ, विकृत हाथ, दोहराए हुए अंग, टूटे बर्तन, क्लिपिंग, टेलीपोर्ट होते नूडल्स, रबड़ जैसी गति, असंभव द्रव व्यवहार, हवा में तैरती वस्तुएँ, UI, स्क्रीन, डैशबोर्ड, प्रोग्रेस बार, चार्ट, कैप्शन, सबटाइटल, लोगो या दिखाई देने वाला टेक्स्ट नहीं। 16:9 आस्पेक्ट रेशियो।

Generated with Kling v1.6 Multi i2v Pro on Atlas Cloud

Generated with Seedance 2.0 Image-to-Video on Atlas Cloud

Generated with Kling v1.6 i2v Standard on Atlas Cloud

जहाँ Kling 1.6 विचारों को गति में बदलता है

Kling 1.6 प्रॉम्प्ट और स्रोत छवियों को स्टोरीबोर्ड, उत्पाद अभियानों, बहु-विषय दृश्यों, एनिमेटेड कलाकृतियों, सोशल मीडिया वैरिएशन और चरित्र-कथाओं के लिए छोटे वीडियो कॉन्सेप्ट में बदलता है।

Kling 1.6 स्टोरीबोर्ड प्रोटोटाइप

लिखित कॉन्सेप्ट को स्थिर गति और भरोसेमंद प्रॉम्प्ट-अनुरूपता वाले छोटे वीडियो ड्राफ्ट में बदलें। निर्देशक, एजेंसियाँ और उत्पाद टीमें पूर्ण प्रोडक्शन शुरू करने से पहले गति-विन्यास, एक्शन और दृश्य दिशा का पूर्वावलोकन कर सकती हैं।

Kling 1.6 के साथ उत्पादों में गति

बेहतर मोशन ब्लेंडिंग और अधिक यथार्थवादी टेक्सचर के साथ उत्पाद की स्थिर छवियों को एनिमेट करें। मार्केटिंग टीमें नई शूटिंग की व्यवस्था किए बिना कैटलॉग इमेजरी को परिष्कृत लॉन्च क्लिप, फ़ीचर रिवील और अभियान सामग्री में बदल सकती हैं।

बहु-विषय ब्रांड कहानियाँ

अलग-अलग छवियों के विषयों को मिलाएँ, दृश्य की बेहतर संगति बनाए रखें और उनकी गति को सटीक रूप से ट्रैक करें। ब्रांडेड कंटेंट और सोशल अभियानों के लिए बड़े पैमाने पर चरित्र संवाद, सामूहिक क्षण या लाइफ़स्टाइल नैरेटिव बनाएँ।

इलस्ट्रेशन एनिमेशन

Pro image-to-video वैरिएंट के बेहतर मोशन ब्लेंडिंग और उन्नत टेक्सचर रियलिज़्म के साथ स्थिर कलाकृतियों को एनिमेट करें। कलाकार और गेम टीमें मौजूदा विज़ुअल्स से एनिमेटेड कॉन्सेप्ट, चरित्र क्षण या वातावरण-प्रधान दृश्य अध्ययन बना सकती हैं।

Kling 1.6 सोशल वीडियो वैरिएशन

स्थिर या सहज रूप से ब्लेंड की गई गति वाले छोटे वीडियो कॉन्सेप्ट बनाने के लिए प्रॉम्प्ट या स्रोत छवि से शुरुआत करें। क्रिएटर सोशल चैनलों के लिए कई हुक, विज़ुअल ट्रीटमेंट और अभियान दिशाएँ विकसित कर सकते हैं।

चरित्र इंटरैक्शन क्लिप्स

जब कई विषयों को एक ही दृश्य साझा करना हो, तो Multi वैरिएंट संगति और उन्नत मोशन ट्रैकिंग को प्राथमिकता देते हैं। इनका उपयोग छवियों से बनाए गए चरित्र संयोजनों, पालतू जानवरों के इंटरैक्शन, समूह क्षणों या नैरेटिव परीक्षणों के लिए करें।

Kling 1.6 मॉडल और प्रतिस्पर्धी मॉडलों की तुलना

इनपुट वर्कफ़्लो, क्लिप अवधि, मूल ऑडियो और मानक मूल्य के आधार पर Atlas Cloud पर उपलब्ध अन्य वीडियो मॉडलों के साथ Kling 1.6 के विभिन्न संस्करणों की तुलना करें।

मॉडलइनपुट वर्कफ़्लोआउटपुट अवधिमूल ऑडियोमानक मूल्य
Kling v1.6 Multi i2v Proप्रॉम्प्ट + 1 से 4 इमेज5 या 10 सेकंड-$0.098/run
Kling v1.6 Multi i2v Standardप्रॉम्प्ट + 1 से 4 इमेज5 या 10 सेकंड-$0.056/run
Kling v1.6 t2v Standardटेक्स्ट प्रॉम्प्ट5 या 10 सेकंड-$0.056/run
Kling v1.6 i2v Proप्रॉम्प्ट + आरंभिक फ़्रेम + वैकल्पिक अंतिम फ़्रेम5 या 10 सेकंड-$0.098/run
Kling v1.6 i2v Standardप्रॉम्प्ट + आरंभिक फ़्रेम5 या 10 सेकंड-$0.056/run
Wan-3.0 Image-to-videoप्रॉम्प्ट + आरंभिक फ़्रेम + वैकल्पिक अंतिम फ़्रेम2 से 30 सेकंड√$0.05/second
MiniMax H3 Image-to-Videoप्रॉम्प्ट + आरंभिक फ़्रेम + वैकल्पिक अंतिम फ़्रेम4 से 15 सेकंड√$0.038/second

Atlas Cloud पर Kling 1.6 का उपयोग कैसे करें

कुछ ही मिनटों में शुरू करें — इन सरल चरणों का पालन करके Atlas Cloud प्लेटफ़ॉर्म के ज़रिए मॉडल इंटीग्रेट और डिप्लॉय करें।

Atlas Cloud अकाउंट बनाएं

atlascloud.ai पर साइन अप करें और वेरिफिकेशन पूरा करें। नए यूज़र्स को प्लेटफ़ॉर्म एक्सप्लोर करने और मॉडल टेस्ट करने के लिए फ्री क्रेडिट मिलते हैं।

Atlas Cloud पर Kling 1.6 का उपयोग क्यों करें

बेजोड़ प्रदर्शन, स्केलेबिलिटी और विकास अनुभव के लिए उन्नत Kling 1.6 मॉडल को Atlas Cloud के GPU त्वरण प्लेटफ़ॉर्म के साथ संयोजित करें।

प्रदर्शन और लचीलापन

कम विलंबता:
रियल-टाइम प्रतिक्रिया के लिए GPU-अनुकूलित इंफरेंसिंग।

एकीकृत API:
Kling 1.6, GPT, Gemini और DeepSeek के लिए एक इंटीग्रेशन।

पारदर्शी मूल्य निर्धारण:
प्रति token बिलिंग, Serverless मोड का समर्थन।

एंटरप्राइज और स्केल

डेवलपर अनुभव:
SDK, डेटा एनालिटिक्स, फाइन-ट्यूनिंग टूल और टेम्पलेट पूरी तरह से उपलब्ध हैं।

विश्वसनीयता:
99.99% उपलब्धता, RBAC अनुमति नियंत्रण, अनुपालन लॉगिंग।

सुरक्षा और अनुपालन:
SOC 2 Type II प्रमाणन, HIPAA अनुपालन, US डेटा संप्रभुता।

डेवलपर्स के लिए Kling 1.6 API से जुड़े प्रश्न

Kling 1.6, Kuaishou द्वारा विकसित वीडियो जनरेशन मॉडल परिवार है। Atlas Cloud पर यह पाँच Standard और Pro endpoints के माध्यम से text to video, single image to video और multi image to video को सपोर्ट करता है। इसके variants स्थिर motion, prompt alignment, अधिक सहज motion blending, texture realism और multi subject coherence प्रदान करते हैं।

Text prompts को मौलिक वीडियो दृश्यों में बदलें, किसी single starting image को animate करें या multi subject composition में कई reference images को संयोजित करें। Endpoint के आधार पर आप 5 या 10 seconds की clips जनरेट कर सकते हैं।

Text driven generation के लिए T2V Standard और एक image से cost efficient animation के लिए I2V Standard चुनें। I2V Pro अधिक सहज motion blending और अधिक realistic textures को प्राथमिकता देता है। कई subjects या reference images के लिए अपनी लागत और coherence आवश्यकताओं के अनुसार Multi I2V Standard या Multi I2V Pro चुनें।

Atlas Cloud dashboard में API key बनाएँ, फिर अपने Bearer token के साथ POST /api/v1/model/generateVideo पर JSON request भेजें। Exact model identifier, एक prompt और image based endpoints के लिए आवश्यक image या images शामिल करें। लौटाई गई prediction ID को सुरक्षित रखें और asynchronous result प्राप्त करने के लिए उसका उपयोग करें।

हर endpoint के लिए model identifier और अधिकतम 2,500 characters का prompt आवश्यक है। Text to video में aspect ratio, duration, guidance scale और negative prompts सपोर्ट होते हैं, जबकि single image endpoints के लिए JPG, JPEG या PNG starting image आवश्यक है। Multi image endpoints एक से चार reference images स्वीकार करते हैं और duration, aspect ratio तथा negative prompt controls भी प्रदान करते हैं।

सभी पाँच Atlas Cloud endpoints 5 या 10 seconds की generation सपोर्ट करते हैं; documented default 5 seconds है। Text to video और multi image endpoints 16:9, 9:16 या 1:1 स्वीकार करते हैं। Single image workflows समान aspect ratio parameter उपलब्ध कराने के बजाय supplied source image से अपना framing निर्धारित करते हैं।

Standard list pricing के अनुसार, T2V Standard, I2V Standard और Multi I2V Standard endpoints की लागत प्रति generated video second $0.056 है। I2V Pro और Multi I2V Pro की लागत प्रति generated video second $0.098 है, और billing pay as you go आधार पर होती है।

सबसे पहले Bearer token, exact model identifier, आवश्यक prompt और सभी required image fields की जाँच करें। Invalid request दोबारा भेजने से पहले documented prompt length, image format, file size, resolution, duration और parameter ranges जाँच लें। Generation asynchronous होने के कारण prediction ID सुरक्षित रखें और status के processing रहने तक result endpoint को लगातार query करते रहें।

अधिक सीरीज़ एक्सप्लोर करें

Seedance 2.5

Seedance 2.5 API अब Atlas Cloud पर उपलब्ध है! यह डेवलपर्स को ByteDance का नवीनतम वीडियो मॉडल प्रदान करता है। यह टेक्स्ट, एकल छवि, या 50 मल्टीमोडल संदर्भों से एक ही बार में 30 सेकंड तक का नेटिव वीडियो उत्पन्न करता है, जिसमें सिंक्रनाइज़ ऑडियो और इन-फ्रेम बहुभाषी टेक्स्ट शामिल है। Atlas Cloud पर आप इसे एक कुंजी के माध्यम से एक्सेस कर सकते हैं, जिसमें विषय की निरंतरता और बेहतर भौतिकी लंबे शॉट्स को सुसंगत रखती है।

सीरीज़ देखें

Wan 3.0

Wan 3.0 API अलीबाबा (Alibaba) के Wan वीडियो परिवार की अगली पीढ़ी है, जिसे लॉन्ग-फॉर्म जनरेशन, मल्टी-रेफरेंस कंट्रोल और ऑडियो-विज़ुअल क्वालिटी को नई ऊंचाइयों पर ले जाने के लिए बनाया गया है। Atlas Cloud पहले से ही Wan 2.7, 2.6 और 2.5 को होस्ट करता है, और Wan 3.0 बिना किसी अलग सेटअप के उसी यूनिफाइड की पर चलता है। आज ही निर्माण शुरू करें। Wan 3.0 क्या बना सकता है, यह देखने के लिए नीचे शोकेस पर स्क्रॉल करें।

सीरीज़ देखें

MiniMax H3

MiniMax H3, टेक्स्ट, इमेज और संदर्भ-निर्देशित सृजन के लिए MiniMax का मल्टीमॉडल वीडियो परिवार है। समर्थित रूट्स में यह संदर्भ मीडिया के विषयों को बनाए रखता है, लचीले आस्पेक्ट रेशियो उपलब्ध कराता है और H3 Developer के ज़रिए जनरेटेड साउंड को विज़ुअल्स के साथ संयोजित करता है; आउटपुट प्रोफ़ाइल endpoint के अनुसार चुनी जाती हैं। Atlas Cloud इस परिवार को एक OpenAI-compatible key के पीछे एकीकृत करता है और $0.038 प्रति सेकंड की मानक दर से शुरू होने वाली पारदर्शी pay-as-you-go pricing प्रदान करता है। आज ही निर्माण शुरू करें।

सीरीज़ देखें

Seedream 5.0 Pro

Seedream 5.0 Pro API डेवलपर्स को Atlas Cloud पर ByteDance का नियंत्रणीय छवि संपादन मॉडल प्रदान करता है। यह एंकर और निर्देशांकों के साथ संपादनों को सटीक रूप से रखता है, छवियों को संपादन योग्य परतों में अलग करता है, कई संदर्भों को मिलाता है, और 2K और 3K पर बहुभाषी पाठ के साथ सटीक रंगों और सामग्रियों का मिलान करता है। Atlas Cloud पर आप एक कुंजी के माध्यम से इस तक पहुँच सकते हैं!

सीरीज़ देखें

Seedance 2.0

Seedance 2.0 ByteDance का प्रोडक्शन-ग्रेड वीडियो मॉडल है, जो सटीक शॉट निर्माण के लिए बनाया गया है। प्रॉम्प्ट्स को वीडियो में बदलें, वैकल्पिक अंतिम-फ़्रेम मार्गदर्शन के साथ प्रथम-फ़्रेम छवि को एनिमेट करें, या संदर्भ मीडिया और वैकल्पिक वेब खोज की मदद से परिणामों को आकार दें। Atlas Cloud इन वर्कफ़्लो को पारदर्शी उपयोग-आधारित मूल्य निर्धारण और एक OpenAI-संगत कुंजी वाली एकीकृत API में लाता है। आज ही निर्माण शुरू करें।

सीरीज़ देखें

GPT Image 2.5

OpenAI का gpt-image-2.5 परिवार डेवलपर्स को प्रोडक्शन इमेज वर्कफ़्लो के लिए Flare और Sunburst में से चुनने की सुविधा देता है। 3840x2160 तक के मनचाहे रिज़ॉल्यूशन पर रेंडर करें और विशिष्ट आउटपुट आवश्यकताओं के अनुरूप xhigh और max समेत पाँच गुणवत्ता स्तरों में से चुनें। Atlas Cloud बिना कोल्ड स्टार्ट और प्रति जनरेशन $0.004 से शुरू होने वाले मानक मूल्य निर्धारण के साथ उपयोग के लिए तैयार REST inference उपलब्ध कराता है। आज से निर्माण शुरू करें।

सीरीज़ देखें

GPT Image 2

GPT Image 2 API डेवलपर्स को OpenAI के नवीनतम इमेज मॉडल तक पहुंच प्रदान करता है, जो GPT Image 1.5 का उत्तराधिकारी है। यह लैटिन और CJK लिपियों में सटीक टेक्स्ट रेंडरिंग के साथ चित्र बनाता और संपादित करता है, साथ ही पोस्टर, मॉकअप और इन्फोग्राफिक्स के लिए मजबूत संयोजन (कंपोजिशन) प्रदान करता है। Atlas Cloud पर आप इसे 300+ मॉडलों के साथ एक एकीकृत API के माध्यम से एक्सेस कर सकते हैं, जिसमें मुफ्त क्रेडिट, 99.99% अपटाइम और OpenAI संगठन सत्यापन की कोई आवश्यकता नहीं है।

सीरीज़ देखें

Gemini Omni Flash

Gemini Omni API Google DeepMind के मूल रूप से मल्टीमॉडल Gemini Omni Flash परिवार, जिसमें Gemini Omni 1.1 Flash भी शामिल है, को डेवलपर्स तक पहुंचाता है। सिंक्रोनाइज़्ड नेटिव ऑडियो के साथ सिनेमैटिक वीडियो बनाएं, सटीक आरंभिक और अंतिम फ़्रेम नियंत्रण के साथ स्थिर छवियों को एनिमेट करें, या टेक्स्ट-निर्देशित संपादनों के ज़रिए मौजूदा फ़ुटेज को संशोधित करें—इस तरह कि अपरिवर्तित सामग्री सुरक्षित रहे। Atlas Cloud एक OpenAI-compatible key, एकीकृत एक्सेस और पारदर्शी pay-as-you-go मूल्य निर्धारण प्रदान करता है। आज ही निर्माण शुरू करें।

सीरीज़ देखें

Grok Imagine

Grok Imagine API xAI की छवि, वीडियो और भाषण मॉडलों को शामिल करता है, Image 2.0 से Video 1.5 और xAI TTS v1 तक। 14 पहलू अनुपातों में 1K या 2K स्थिर छवियां उत्पन्न करें, एक दृश्य को 1080p में 15 सेकंड की गति तक बढ़ाएं, 7 संदर्भ छवियों के साथ शॉट्स को निर्देशित करें, या उन्हें 20 भाषाओं में सुनाएं। Atlas Cloud सभी मोड को एक endpoint पर चलाता है, प्रति उपयोग भुगतान मूल्य निर्धारण $0.02 प्रति छवि और $0.05 प्रति सेकंड से। आज ही निर्माण शुरू करें।

सीरीज़ देखें

Google

Google के सबसे शक्तिशाली क्रिएटिव मॉडल अब Atlas Cloud पर उपलब्ध हैं। Veo 3.1 सिनेमैटिक वीडियो जनरेशन प्रदान करता है, Nano Banana 2 हाई-फिडेलिटी इमेज क्रिएशन को शक्ति देता है, और Gemini हर वर्कफ़्लो में मल्टीमॉडल इंटेलिजेंस लाता है। Day-0 उपलब्धता और पे-एज़-यू-गो (pay-as-you-go) प्राइसिंग के साथ एक ही API key के माध्यम से संपूर्ण Google मॉडल सूट तक पहुंचें।

सीरीज़ देखें

Seedance 2.0 Mini

Seedance 2.0 Mini, ByteDance के मल्टीमोडल वीडियो जनरेशन को उन वर्कफ़्लो में लाता है जहाँ गति और लागत सबसे अधिक मायने रखते हैं। यह एक हल्के फुटप्रिंट पर Seedance 2.0 की मुख्य क्षमताएँ प्रदान करता है — तेज़ जनरेशन, प्रति वीडियो कम लागत, और वही API एकीकरण जिसका आप पहले से उपयोग करते हैं। उच्च-मात्रा वाले पाइपलाइन चलाने या बड़े पैमाने पर प्रोटोटाइपिंग करने वाली टीमों के लिए, Mini व्यावहारिक डिफ़ॉल्ट विकल्प है।

सीरीज़ देखें

ByteDance

सिनेमैटिक वीडियो जनरेशन से लेकर हाई-फिडेलिटी इमेज क्रिएशन तक, ByteDance के सबसे शक्तिशाली मॉडल Atlas Cloud पर लाइव हैं। सबसे कम इन्फ्रेंस प्राइसिंग और शून्य इन्फ्रास्ट्रक्चर ओवरहेड के साथ बड़े पैमाने पर Seedance और Seedream को रन करें।

सीरीज़ देखें

हर मीडिया AI के लिए एक ही API।

सभी मॉडल एक्सप्लोर करें