


Gemini Omni 1.1 Flash, Google DeepMind की लचीले प्रोडक्शन वर्कफ़्लो के लिए मूल रूप से मल्टीमॉडल वीडियो फ़ैमिली है। टेक्स्ट निर्देशों के ज़रिए मौजूदा फ़ुटेज संपादित करें, अधिकतम 10 रेफ़रेंस इमेज और 3 वीडियो क्लिप के साथ दृश्यगत एकरूपता बनाए रखें, या किसी शॉट को आपस में जोड़े जा सकने वाले सेगमेंट में 40 सेकंड तक बढ़ाएँ। एक OpenAI-compatible API key, उपयोग के अनुसार भुगतान वाली कीमत और Day-0 उपलब्धता के साथ Atlas Cloud पर हर वर्कफ़्लो तक पहुँचें। आज ही निर्माण शुरू करें।
Gemini Omni 1.1 Flash को Google द्वारा विकसित किया गया है। Atlas Cloud (Atlas Cloud AI LLC द्वारा संचालित) इस तक पहुँच प्रदान करता है, इसका स्वामी नहीं है। सभी ट्रेडमार्क उनके संबंधित स्वामियों की संपत्ति हैं।
Atlas Cloud आपको उद्योग में अग्रणी नवीनतम रचनात्मक मॉडल प्रदान करता है।
इनपुट वर्कफ़्लो, आउटपुट क्षमताओं और प्रोडक्शन उपयोग-केस के आधार पर पाँच Gemini Omni 1.1 Flash endpoints की तुलना करें।
| मोडैलिटी | विवरण |
|---|---|
| Gemini Omni 1.1 Flash Video Extend API | मौजूदा क्लिप को 3 से 10 सेकंड लंबे, सहज रूप से मेल खाते एक्सटेंशन के साथ जारी रखें और मूल ऑडियो बनाए रखें। कुल 40 सेकंड तक की एक सुसंगत वीडियो शॉट बनाने के लिए कई एक्सटेंशन को चेन करें। |
| Gemini Omni 1.1 Flash Video Edit API | पूरे सीन को फिर से बनाए बिना मौजूदा फ़ुटेज में बदलाव करना है? टेक्स्ट निर्देशों का उपयोग करके मूल ऑडियो के साथ वीडियो एलिमेंट जोड़ें, हटाएँ, बदलें या उनकी शैली बदलें, और उस सामग्री को सुरक्षित रखें जिसका प्रॉम्प्ट में उल्लेख नहीं है। |
| Gemini Omni 1.1 Flash Reference-to-Video API | सिनेमैटिक वीडियो और मूल ध्वनि जनरेट करने के लिए एक टेक्स्ट प्रॉम्प्ट के साथ अधिकतम 10 reference images और 3 reference video clips दें। यह endpoint उन प्रोजेक्ट्स के लिए उपयुक्त है जिनमें अलग-अलग generations में एकसमान कैरेक्टर, प्रोडक्ट या आर्ट डायरेक्शन की आवश्यकता होती है। |
| Gemini Omni 1.1 Flash Image-to-Video API | टेक्स्ट प्रॉम्प्ट के मार्गदर्शन में किसी still image को सिनेमैटिक, sound-enabled क्लिप में एनिमेट करें। वैकल्पिक अंतिम फ़्रेम से जनरेट किए गए शॉट के आरंभ और अंत पर सटीक नियंत्रण मिलता है। |
| Gemini Omni 1.1 Flash Text-to-Video API | एक टेक्स्ट प्रॉम्प्ट से शुरू होकर, यह endpoint synchronized native audio के साथ सिनेमैटिक वीडियो तैयार करता है। duration, aspect ratio और output resolution समायोजित करें—तेज़ 360p ड्राफ्ट से लेकर 4K परिणाम तक। |
Gemini Omni 1.1 Flash वीडियो जनरेशन, नेटिव ऑडियो, रेफ़रेंस-आधारित निरंतरता, सटीक फ़्रेम नियंत्रण, निर्देश-आधारित एडिटिंग और श्रृंखलाबद्ध विस्तार को एक लचीले Atlas Cloud वर्कफ़्लो में एक साथ लाता है।
टेक्स्ट प्रॉम्प्ट से शुरुआत करें और सिंक्रोनाइज़्ड नेटिव ऑडियो के साथ सिनेमैटिक क्लिप जनरेट करें। Gemini Omni 1.1 Flash आपको 360p ड्राफ़्ट से लेकर 4K तक अवधि, आस्पेक्ट रेशियो और आउटपुट रिज़ॉल्यूशन नियंत्रित करने देता है। एक ही अनुरोध में गति, कैमरा दिशा, संवाद, संगीत और माहौल का वर्णन करें। यह वर्कफ़्लो ट्रेलर, सोशल स्पॉट और ऐसे कहानी दृश्यों के लिए उपयुक्त है जिनमें दृश्य और ध्वनि को साथ विकसित करना हो।
मौजूदा क्लिप को सहज रूप से मेल खाते 3 से 10 सेकंड के सेगमेंट के साथ आगे बढ़ाएँ, फिर एक्सटेंशन को श्रृंखलाबद्ध करके अवधि को 40 सेकंड तक ले जाएँ। मॉडल विज़ुअल संदर्भ और नेटिव ऑडियो को आगे बनाए रखता है, ताकि नई कार्रवाई उसी शॉट का हिस्सा लगे। जब कहानी को अधिक विस्तार चाहिए, तब सीक्वेंस को फिर से शुरू किए बिना लंबे रिवील, पीछा करने वाले दृश्य या प्रोडक्ट स्टोरी बनाएँ।
नेटिव ऑडियो के साथ एक सुसंगत जनरेशन को निर्देशित करने के लिए टेक्स्ट प्रॉम्प्ट के साथ अधिकतम 10 रेफ़रेंस इमेज और 3 रेफ़रेंस वीडियो क्लिप दें। इमेज किसी किरदार, प्रोडक्ट, स्थान या कला निर्देशन को आधार दे सकती हैं, जबकि वीडियो रेफ़रेंस गति और शॉट के व्यवहार को दिशा देते हैं। इस विकल्प का उपयोग तब करें जब कैंपेन एसेट, एपिसोडिक दृश्यों या ब्रांडेड कंटेंट में दोहराने योग्य पहचान और विज़ुअल भाषा महत्वपूर्ण हो।
शुरुआती इमेज तय करें और शॉट कहाँ समाप्त हो, इसे नियंत्रित करने के लिए वैकल्पिक रूप से आख़िरी फ़्रेम भी दें। Gemini Omni 1.1 Flash स्थिर इमेज को नेटिव साउंड वाली सिनेमैटिक क्लिप में एनिमेट करता है और दिए गए अंतिम बिंदु की ओर सहज संक्रमण बनाता है। यह शुरुआत और अंत की संरचना प्रोडक्ट रिवील, सहज ट्रांज़िशन, मैच कट और ऐसे नियोजित कैमरा मूव के लिए उपयुक्त है जिन्हें सटीक कंपोज़िशन पर समाप्त होना हो।
सीधे टेक्स्ट निर्देश के माध्यम से मौजूदा वीडियो में बदलाव करें और प्रॉम्प्ट में जिन बातों का उल्लेख नहीं है, उन्हें यथावत रखें। एलिमेंट जोड़ें, हटाएँ, बदलें या उनकी शैली परिवर्तित करें, और एडिट किए गए परिणाम में नेटिव ऑडियो बनाए रखें। जब किसी अच्छे टेक को केवल नए ऑब्जेक्ट, वातावरण या विज़ुअल ट्रीटमेंट की आवश्यकता हो, तब यह केंद्रित वर्कफ़्लो बाकी काम को सुरक्षित रखता है और सीन को शुरू से दोबारा बनाने से बचाता है।
एक ही API key के साथ Atlas Cloud के माध्यम से टेक्स्ट-टू-वीडियो, इमेज-टू-वीडियो, रेफ़रेंस जनरेशन, एडिटिंग और एक्सटेंशन के बीच सहज रूप से काम करें। पारदर्शी पे-ऐज़-यू-गो बिलिंग प्रयोगों को सब्सक्रिप्शन या न्यूनतम प्रतिबद्धताओं से अलग रखती है। डेवलपर 360p पर ड्राफ़्ट तैयार कर सकते हैं और अंतिम विवरण महत्वपूर्ण होने पर 4K तक के आउटपुट माँग सकते हैं। यह एकीकृत तरीका पूरे मॉडल परिवार को प्रोडक्शन वर्कफ़्लो में जोड़ना आसान बनाता है।
देखें कि Gemini Omni 1.1 Flash, Seedance 2.5 और पिछला Gemini Omni Flash उन्हीं दो सिनेमाई प्रॉम्प्ट्स की व्याख्या कैसे करते हैं।
काली पड़ चुकी पारंपरिक काँच-फूँकने की कार्यशाला के भीतर सेट की गई 8–10 सेकंड की फैंटेसी माइक्रो-फ़िल्म: शुरुआत एक जलती-लाल, पिघले हुए काँच के गोले पर एक्सट्रीम मैक्रो पुश-इन से हो, जो ब्लोपाइप के सिरे पर तेज़ी से घूम रहा है; उसकी चिपचिपी सतह लगातार मुड़ती, चमकती और भट्ठी की आग को अपवर्तित करती रहे, जबकि मिट्टी से बना कारीगर पाइप को निरंतर घुमाता रहे; कारीगर की गतिशील अग्रबाहु के चारों ओर क़रीबी ऑर्बिट करते हुए धातु की चिमटियाँ ताल पर प्रहार करें और पिघले हुए काँच को दबाएँ—बिना कट के, दहकता हुआ पिंड खिंचकर ठंडा हो और सहज रूप से अग्निमय हृदय वाले पारदर्शी काँच के हमिंगबर्ड में बदल जाए। तेज़ व्हिप-पैन के बाद हाई-स्पीड ट्रैकिंग शॉट में जाएँ, जहाँ हमिंगबर्ड अपने क्रिस्टलीय पंख फड़फड़ाता हुआ खुले रंगद्रव्य जारों के ऊपर से झपटे और मोर-नीले तथा मैजेंटा पाउडर की अशांत लहरों को हवा में खींच ले; हर पंख-प्रहार से कण बिखरें, आपस में टकराएँ, घूमें और उसकी अपवर्तित आकृति के भीतर चमकें। पक्षी अचानक एक तैरते हुए काँच के बुलबुले की ओर तीखा मोड़ ले और अंतिम संगीतमय प्रहार पर ठीक उसी क्षण उसे चोंच मारे; नाटकीय टॉप-डाउन दृश्य में कट करें, जहाँ बुलबुला बाहर की ओर फटता है और रेज़र-पतले टुकड़े लगातार रूप बदलकर मुलायम, पारभासी फूलों की पंखुड़ियों में बदलते हुए कार्यशाला में सर्पिलाकार फैलें। चमकदार अर्ध-पारदर्शी आर्ट-ग्लास टेक्सचर के साथ परिष्कृत क्ले स्टॉप-मोशन; स्पर्शनीय हस्तनिर्मित अपूर्णताएँ, विश्वसनीय प्रतिबिंब, अपवर्तन, कॉस्टिक्स, गर्मी की झिलमिलाहट, काँच का विकृतिकरण और कण-भौतिकी; शुरुआत में नारंगी-लाल भट्ठी की रोशनी प्रमुख की-लाइट हो, ठंडी सियान चाँदनी रिम-लाइटिंग दे, और आरंभिक रंग-पैलेट गहरे काले-सुनहरे से चरम दृश्य में संतृप्त मोर-नीले और मैजेंटा में विस्फोट करे। तेज़, प्रवाही कैमरा गति, मज़बूत टेम्पोरल और चरित्र-संगति, कोई विराम या धीमी गति वाला अनावश्यक हिस्सा नहीं। ऑडियो: भट्ठी की गर्जना, घूमते काँच की गूँज, हर दबाव और पंख-प्रहार के साथ समकालिक लयबद्ध धातु-प्रहार, तेज़ी से बहता पाउडर, टकराव पर तीखी क्रिस्टलीय झंकार और अंत में काँच से पंखुड़ियों में बदलने का उज्ज्वल झरनानुमा समापन; कोई स्क्रीन, इंटरफ़ेस, डैशबोर्ड, प्रोग्रेस बार, चार्ट, कैप्शन, लोगो या टेक्स्ट नहीं। 16:9 आस्पेक्ट रेशियो।
Generated with Gemini Omni 1.1 Flash Text-to-Video on Atlas Cloud
Generated with Seedance 2.5 Text-to-Video on Atlas Cloud
Generated with Gemini Omni Flash Text-to-Video on Atlas Cloud
कम ज्वार के समय चट्टानी ज्वार-कुंड की गुफा के भीतर 8–10 सेकंड का अल्ट्रा-फोटोरियलिस्टिक मैक्रो प्रकृति-डॉक्यूमेंट्री अनुक्रम: एक चमकीला कोरल-नारंगी नारियल ऑक्टोपस तालवाद्य बजाता हुआ, उसकी सभी आठ शारीरिक रूप से सुसंगत भुजाएँ स्वतंत्र लेकिन स्वाभाविक रूप से गतिशील हों; उसके सकर मोती जैसे समुद्री शंखों, खोखले समुद्री-साही के खोलों और चिकने समुद्री काँच पर लगातार घनी होती लय में प्रहार करें, जिसमें सटीक विकृतिकरण, संपर्क, उछाल और वस्तुओं के भार का एहसास हो। शुरुआत जल-रेखा के पास मैक्रो लेटरल ट्रैकिंग शॉट से हो, जो ऑक्टोपस के बगल से गुज़रे; उसकी बनावटदार त्वचा पर बूँदें चमकें और हर प्रहार से ठंडे सियान समुद्री जल में छोटी-छोटी लहरें फैलें; फिर एक्सट्रीम लो-एंगल कैमरा चलती भुजाओं और वाद्य-वस्तुओं के बीच तेज़ी से बुने, स्पष्ट भुजा-निरंतरता और यथार्थवादी अवरोध बनाए रखे। अचानक एक हर्मिट क्रैब अंदर आए, मुख्य शंख को पकड़कर भाग जाए; तेज़, चंचल पीछा शुरू करने वाले व्हिप-पैन में जाएँ, जहाँ ऑक्टोपस चिकनी, असमान चट्टान पर छलाँग लगाते और बहते हुए आगे बढ़े; उसकी भुजाएँ विश्वसनीय घर्षण के साथ पकड़ें, छोड़ें और धक्का दें, जबकि केकड़े के पैर कंकड़ों पर खड़खड़ाएँ। आने वाली लहर से गुफा डूबने से ठीक पहले ऑक्टोपस शंख वापस झपट ले, उसे मज़बूती से टिकाए और एक ज़ोरदार अंतिम प्रहार करे; फिर तेज़ी से कैमरा ऊपर उठाकर टॉप-डाउन ओवरहेड शॉट में जाएँ, जहाँ लहर ऑक्टोपस के चारों ओर फूटे और फैलता हुआ झाग लगभग पूर्ण वृत्ताकार संरचना बनाए। टूटी हुई धूप से बनती पानी के भीतर की नृत्यमय कॉस्टिक्स, कोरल-नारंगी विषय के विपरीत ठंडा टील जल, क्रिस्टलीय छींटे, बुलबुले, तैरती रेत, गीली चट्टानों के प्रतिबिंब, उथली मैक्रो डेप्थ ऑफ़ फील्ड, सिनेमाई HDR, अत्यंत तीखी प्राकृतिक बनावटें, सतत प्रवाही गति, बिना धीमी गति के हाई-स्पीड कैमरा ट्रांज़िशन। केवल डायजेटिक ऑडियो, पूर्ण समकालिकता के साथ: अलग-अलग शंख-प्रहार, खोखले साही-खोल की चोटें, चमकीली काँच-सी क्लिक ध्वनियाँ, सकर के छूटने की आवाज़, हर्मिट क्रैब के पंजों और पैरों की घिसट, बढ़ता हुआ समुद्री ज्वार, फिर सटीक लयात्मक तालमेल में अंतिम प्रहार और लहर का टकराना; कोई संगीत, वर्णन, टेक्स्ट, कैप्शन, लोगो, इंटरफ़ेस, डैशबोर्ड, चार्ट, प्रोग्रेस बार, स्प्लिट स्क्रीन, अतिरिक्त भुजाएँ, जुड़ी या दोहराई गई भुजाएँ, विकृत शारीरिक रचना, तैरती वस्तुएँ, वस्तुओं का एक-दूसरे में घुसना या टूटी हुई संपर्क-भौतिकी, रबड़ जैसी गति, टेम्पोरल झिलमिलाहट, जंप कट, असंगत शंख-स्थिति या कार्टून शैली नहीं। अल्ट्रा-फोटोरियलिस्टिक सिनेमाई वाइल्डलाइफ़ मैक्रो डॉक्यूमेंट्री, 16:9 आस्पेक्ट रेशियो।
Generated with Gemini Omni 1.1 Flash Text-to-Video on Atlas Cloud
Generated with Seedance 2.5 Text-to-Video on Atlas Cloud
Generated with Gemini Omni Flash Text-to-Video on Atlas Cloud
Gemini Omni 1.1 Flash ब्रीफ़, स्थिर चित्रों, संदर्भ मीडिया और मौजूदा क्लिप्स को कैंपेन वीडियो, एकरूप किरदारों वाली कहानियों, नियंत्रित ट्रांज़िशन, विस्तारित दृश्यों और नेटिव ऑडियो वाले प्रोडक्शन-रेडी सोशल एसेट्स में बदल देता है।
मौजूदा क्लिप्स में सहज रूप से मेल खाता हुआ three से ten सेकंड का निरंतर भाग जोड़ा जा सकता है, और क्रमिक एक्सटेंशन से अवधि forty सेकंड तक पहुँच सकती है। फ़िल्मकार और सीरियल कंटेंट टीमें हर दृश्य को फिर से बनाए बिना सुसंगत एकल शॉट्स का विस्तार कर सकती हैं।
नया प्रोडक्ट, बैकग्राउंड या विज़ुअल स्टाइल चाहिए? टेक्स्ट निर्देश से एडिट लागू करें और जिन तत्वों का उल्लेख नहीं किया गया है उन्हें सुरक्षित रखें। इससे मार्केटिंग टीमें हर बार स्रोत क्लिप को शुरू से बनाए बिना लक्षित वैरिएंट तैयार कर सकती हैं।
अधिकतम ten संदर्भ चित्रों और three वीडियो क्लिप्स के साथ मॉडल अलग-अलग जनरेशन में किसी किरदार, प्रोडक्ट या कला-निर्देशन को एकरूप बनाए रख सकता है। ब्रांड स्टूडियो अधिक सुसंगत विज़ुअल पहचान वाली संबंधित लॉन्च सीन्स तैयार कर सकते हैं।
एक स्थिर चित्र से शुरुआत करें और वैकल्पिक रूप से अंतिम फ़्रेम दें, ताकि मॉडल दोनों कंपोज़िशन के बीच सिनेमाई पथ को ऐनिमेट कर सके। डिज़ाइनरों को रिवील, लूप और दृश्य बदलावों के लिए शुरुआत और अंत पर सटीक नियंत्रण मिलता है।
एक ही टेक्स्ट ब्रीफ़ सिंक्रोनाइज़्ड नेटिव ऑडियो वाली सिनेमाई क्लिप में बदल जाता है, जबकि अवधि, आस्पेक्ट रेशियो और आउटपुट रिज़ॉल्यूशन चुनने योग्य रहते हैं। क्रिएटर अलग-अलग पब्लिशिंग फ़ॉर्मैट के लिए विज्ञापनों और सोशल कहानियों को आकार दे सकते हैं।
शॉट का परीक्षण करते समय 360p पर प्रोटोटाइप बनाएं, संभावनाशील दिशाओं की तुलना करें और चुनी गई अवधारणाओं को 4K आउटपुट तक ले जाएँ। निर्देशक और क्रिएटिव डेवलपर अंतिम प्रोडक्शन से पहले गति, फ़्रेमिंग, ध्वनि और पेसिंग को मान्य कर सकते हैं।
क्लिप की अवधि, अधिकतम रिज़ॉल्यूशन, नेटिव ऑडियो सपोर्ट और आउटपुट फ़्रेम रेट के आधार पर Gemini Omni 1.1 Flash की तुलना प्रमुख टेक्स्ट-टू-वीडियो मॉडल से करें।
| मॉडल | आउटपुट अवधि | अधिकतम रिज़ॉल्यूशन | नेटिव ऑडियो | फ़्रेम रेट |
|---|---|---|---|---|
| Gemini Omni 1.1 Flash Text-to-Video | 3–10 सेकंड | 4K | √ | 24 FPS |
| MiniMax H3 Text-to-Video | 4–15 सेकंड | 2K | √ | 24 FPS |
| Wan-3.0 Text-to-video | 2–30 सेकंड | 1080P | √ | 30 FPS |
कुछ ही मिनटों में शुरू करें — इन सरल चरणों का पालन करके Atlas Cloud प्लेटफ़ॉर्म के ज़रिए मॉडल इंटीग्रेट और डिप्लॉय करें।
atlascloud.ai पर साइन अप करें और वेरिफिकेशन पूरा करें। नए यूज़र्स को प्लेटफ़ॉर्म एक्सप्लोर करने और मॉडल टेस्ट करने के लिए फ्री क्रेडिट मिलते हैं।
बेजोड़ प्रदर्शन, स्केलेबिलिटी और विकास अनुभव के लिए उन्नत Gemini Omni 1.1 Flash मॉडल को Atlas Cloud के GPU त्वरण प्लेटफ़ॉर्म के साथ संयोजित करें।
कम विलंबता:
रियल-टाइम प्रतिक्रिया के लिए GPU-अनुकूलित इंफरेंसिंग।
एकीकृत API:
Gemini Omni 1.1 Flash, GPT, Gemini और DeepSeek के लिए एक इंटीग्रेशन।
पारदर्शी मूल्य निर्धारण:
प्रति token बिलिंग, Serverless मोड का समर्थन।
डेवलपर अनुभव:
SDK, डेटा एनालिटिक्स, फाइन-ट्यूनिंग टूल और टेम्पलेट पूरी तरह से उपलब्ध हैं।
विश्वसनीयता:
99.99% उपलब्धता, RBAC अनुमति नियंत्रण, अनुपालन लॉगिंग।
सुरक्षा और अनुपालन:
SOC 2 Type II प्रमाणन, HIPAA अनुपालन, US डेटा संप्रभुता।
Gemini Omni 1.1 Flash Google DeepMind का मूल रूप से मल्टीमॉडल वीडियो जनरेशन और एडिटिंग मॉडल है। Atlas Cloud पर यह जनरेशन, रेफ़रेंस-आधारित निर्माण, एडिटिंग और विस्तार को कवर करने वाले पाँच कार्य-विशिष्ट वर्कफ़्लो सपोर्ट करता है। इसके वीडियो आउटपुट में सिंक्रनाइज़्ड नेटिव ऑडियो शामिल हो सकता है।
यह टेक्स्ट से वीडियो जनरेट कर सकता है, स्थिर इमेज को एनिमेट कर सकता है, विज़ुअल रेफ़रेंस का पालन कर सकता है, टेक्स्ट निर्देश के आधार पर मौजूदा क्लिप को एडिट कर सकता है या किसी दृश्य को जारी रख सकता है। नियंत्रित शॉट ट्रांज़िशन के लिए Image to Video दिए गए अंतिम फ़्रेम की दिशा में इंटरपोलेट भी कर सकता है।
Atlas Cloud API कुंजी बनाएँ और अपने वर्कफ़्लो से मेल खाने वाला endpoint चुनें। उस endpoint की पैरामीटर स्कीमा के अनुसार आवश्यक स्रोत इमेज, वीडियो या रेफ़रेंस मीडिया के साथ prompt सबमिट करें। एक स्पष्ट रूप से वर्णित शॉट से शुरुआत करें, फिर परिणाम की समीक्षा के बाद अपने इनपुट को बेहतर बनाएँ।
Prompt-आधारित जनरेशन के लिए Text to Video चुनें और स्थिर फ़्रेम को एनिमेट करने के लिए Image to Video चुनें। Reference to Video पहचान या कला-निर्देशन में मदद करता है, जबकि Video Edit मौजूदा फुटेज में बदलाव करता है और Video Extend पहले से स्थापित शॉट को जारी रखता है।
Text to Video में अवधि, आस्पेक्ट रेशियो और 360p से 4K तक आउटपुट रिज़ॉल्यूशन के नियंत्रण मिलते हैं। Image to Video शुरुआती इमेज स्वीकार करता है और वैकल्पिक अंतिम फ़्रेम का उपयोग कर सकता है। Reference to Video अधिकतम 10 रेफ़रेंस इमेज और 3 रेफ़रेंस वीडियो क्लिप सपोर्ट करता है।
हाँ, सभी पाँच Atlas Cloud वर्कफ़्लो सिंक्रनाइज़्ड नेटिव ऑडियो वाले वीडियो बनाने के लिए डिज़ाइन किए गए हैं। जब दृश्य के लिए ऑडियो महत्वपूर्ण हो, तो अपने prompt में इच्छित संवाद, वातावरण, संगीत या ध्वनि प्रभावों का स्पष्ट रूप से वर्णन करें।
Atlas Cloud पे-एज़-यू-गो ऐक्सेस उपलब्ध कराता है। Text to Video, Reference to Video, Video Edit और Video Extend की मानक आधार कीमत $0.041 है, जबकि Image to Video की मानक आधार कीमत $0.043 है। ये आँकड़े अस्थायी छूट दरों के बजाय मानक बैकएंड कीमतें हैं।
हर extension 3 से 10 सेकंड जोड़ सकता है, और extensions को तब तक श्रृंखलाबद्ध किया जा सकता है जब तक एक सुसंगत शॉट कुल 40 सेकंड तक न पहुँच जाए। मॉडल मौजूदा क्लिप को संदर्भ के रूप में उपयोग करते हुए विज़ुअल और नेटिव ऑडियो, दोनों को जारी रखता है।
स्पष्ट और संगत रेफ़रेंस एसेट के साथ Reference to Video का उपयोग करें, जिसमें अधिकतम 10 इमेज और 3 वीडियो क्लिप शामिल हो सकते हैं। इमेज एनिमेशन के लिए एक मजबूत शुरुआती फ़्रेम दें और नियंत्रित गंतव्य की आवश्यकता होने पर वैकल्पिक अंतिम फ़्रेम भी दें। जनरेटिव आउटपुट में फिर भी बदलाव आ सकता है, इसलिए हर जनरेशन या extension के बाद पहचान, लाइटिंग, गति और ऑडियो की जाँच करें।
Google 1080p और 4K को नेटिव जनरेशन रिज़ॉल्यूशन के बजाय अपस्केल आउटपुट विकल्पों के रूप में बताता है। ड्राफ़्ट पुनरावृत्तियों के लिए 360p का उपयोग करें, फिर कंपोज़िशन और गति आपकी आवश्यकताओं के अनुरूप होने पर उच्च रिज़ॉल्यूशन चुनें।
Atlas Cloud का भरपूर लाभ उठाने में मदद करने वाली गाइड, ट्यूटोरियल और प्रोडक्ट अपडेट।