Hero background 1Hero background 2Hero background 3

Gemini Omni 1.1 Flash Multimodal Video

Gemini Omni 1.1 Flash هي عائلة فيديو متعددة الوسائط أصيلة التصميم من Google DeepMind، مصممة لسير عمل إنتاج مرن. حرّر اللقطات الموجودة باستخدام تعليمات نصية، وحافظ على الاتساق البصري باستخدام ما يصل إلى 10 صور مرجعية و3 مقاطع فيديو، أو مدّد اللقطة إلى أجزاء متسلسلة قابلة للربط بطول يصل إلى 40 ثانية. يمكنك الوصول إلى جميع سير العمل على Atlas Cloud باستخدام مفتاح API واحد متوافق مع OpenAI، وتسعير حسب الاستخدام، وإتاحة من اليوم الأول. ابدأ البناء اليوم.

Gemini Omni 1.1 Flash من تطوير Google. توفّر Atlas Cloud (التي تُشغّلها Atlas Cloud AI LLC) إمكانية الوصول إليه ولا تملكه. جميع العلامات التجارية ملك لأصحابها المعنيين.

استكشف النماذج الرائدة

يوفر لك Atlas Cloud أحدث النماذج الإبداعية الرائدة في الصناعة.

مقارنة أوضاع الفيديو في Gemini Omni 1.1 Flash

قارن بين خمس نقاط نهاية لـ Gemini Omni 1.1 Flash حسب سير عمل الإدخال، وإمكانات الإخراج، وحالة الاستخدام الإنتاجية.

النمطالوصف
Gemini Omni 1.1 Flash Video Extend APIتابع مقطعًا موجودًا بامتداد متناسق بسلاسة، تتراوح مدته بين 3 و10 ثوانٍ، مع الاحتفاظ بالصوت الأصلي. اربط عدة امتدادات لإنشاء لقطة فيديو واحدة متماسكة تصل مدتها الإجمالية إلى 40 ثانية.
Gemini Omni 1.1 Flash Video Edit APIهل تحتاج إلى تعديل لقطات موجودة من دون إعادة بناء المشهد بالكامل؟ استخدم تعليمات نصية لإضافة عناصر الفيديو أو إزالتها أو استبدالها أو تغيير أسلوبها، مع صوت أصلي، مع الحفاظ على المحتوى الذي لم يذكره الطلب.
Gemini Omni 1.1 Flash Reference-to-Video APIقدّم طلبًا نصيًا مع ما يصل إلى 10 صور مرجعية و3 مقاطع فيديو مرجعية لإنشاء فيديو سينمائي بصوت أصلي. تناسب نقطة النهاية هذه المشاريع التي تتطلب اتساق الشخصيات أو المنتجات أو التوجه الفني عبر عمليات التوليد.
Gemini Omni 1.1 Flash Image-to-Video APIحوّل صورة ثابتة إلى مقطع سينمائي مزوّد بالصوت، مع توجيهه عبر طلب نصي. يتيح الإطار النهائي الاختياري تحكمًا دقيقًا في موضع بدء اللقطة المُولّدة وانتهائها.
Gemini Omni 1.1 Flash Text-to-Video APIبدءًا من طلب نصي واحد، تنتج نقطة النهاية هذه فيديو سينمائيًا مع صوت أصلي متزامن. اضبط المدة ونسبة العرض إلى الارتفاع ودقة الإخراج، بدءًا من مسودة سريعة بدقة 360p ووصولًا إلى نتيجة بدقة 4K.

داخل حزمة أدوات الفيديو Gemini Omni 1.1 Flash

يجمع Gemini Omni 1.1 Flash بين توليد الفيديو، والصوت الأصلي، والاستمرارية المستندة إلى المراجع، والتحكم الدقيق في الإطارات، والتحرير القائم على التعليمات، والتمديد القابل للتسلسل ضمن سير عمل مرن واحد على Atlas Cloud.

صوت أصلي مع كل مطالبة

ابدأ بمطالبة نصية وأنشئ مقطعًا سينمائيًا بصوت أصلي متزامن. يتيح لك Gemini Omni 1.1 Flash التحكم في المدة ونسبة العرض إلى الارتفاع ودقة الإخراج، بدءًا من المسودات بدقة 360p وصولًا إلى 4K. صف الحركة واتجاه الكاميرا والحوار والموسيقى والأجواء في طلب واحد. يناسب هذا الأسلوب الإعلانات التشويقية ومقاطع التواصل الاجتماعي واللحظات السردية التي تتطلب تطوير الصورة والصوت معًا.

تمديد المشهد باستخدام Gemini Omni 1.1 Flash

تابع مقطعًا موجودًا بامتداد متطابق بسلاسة مدته من 3 إلى 10 ثوانٍ، ثم اربط الامتدادات للوصول إلى مدة تصل إلى 40 ثانية. يحافظ النموذج على السياق البصري والصوت الأصلي وينقلهما إلى الأمام، بحيث ينتمي الحدث الجديد إلى اللقطة نفسها. أنشئ مشاهد كشف أو مطاردات أو قصصًا أطول للمنتجات من دون إعادة بدء التسلسل كلما احتاج السرد إلى مساحة إضافية.

استمرارية بصرية موجّهة بالمراجع

قدّم مطالبة نصية مع ما يصل إلى 10 صور مرجعية و3 مقاطع فيديو مرجعية لتوجيه عملية توليد متماسكة واحدة بصوت أصلي. يمكن للصور تثبيت هوية شخصية أو منتج أو موقع أو توجه فني، بينما توجّه مراجع الفيديو الحركة وسلوك اللقطة. استخدم هذا المسار عندما تكون الهوية القابلة للتكرار واللغة البصرية المتسقة مهمة عبر أصول الحملات أو المشاهد المتسلسلة أو المحتوى ذي العلامة التجارية.

التحكم في الإطارين الأول والأخير

حدّد الصورة الافتتاحية، ثم أضف إطارًا أخيرًا اختياريًا للتحكم في نقطة انتهاء اللقطة. يحرّك Gemini Omni 1.1 Flash الصورة الثابتة لإنشاء مقطع سينمائي بصوت أصلي، وينتقل تدريجيًا نحو نقطة النهاية المحددة. يناسب هذا الهيكل الافتتاحي والختامي مشاهد الكشف عن المنتجات والانتقالات السلسة والقطع المتطابق وحركات الكاميرا المخطط لها التي يجب أن تنتهي عند تكوين بصري دقيق.

حرّر اللقطة من دون إعادة بنائها

غيّر فيديو موجودًا من خلال تعليمة نصية مباشرة، مع الاحتفاظ بكل ما لم تذكره المطالبة. أضف العناصر أو أزلها أو استبدلها أو غيّر أسلوبها، وحافظ على الصوت الأصلي ضمن النتيجة المحررة. عندما تحتاج لقطة قوية إلى كائن جديد أو بيئة مختلفة أو معالجة بصرية جديدة فقط، يحافظ هذا الأسلوب المركّز على بقية العمل ويتجنب إعادة بناء المشهد من الصفر.

Gemini Omni 1.1 Flash عبر API واحد

انتقل بين تحويل النص إلى فيديو، وتحويل الصورة إلى فيديو، والتوليد بالاستناد إلى المراجع، والتحرير، والتمديد عبر Atlas Cloud باستخدام مفتاح API واحد. يتيح نظام الفوترة الشفاف بالدفع حسب الاستخدام فصل التجارب عن الاشتراكات أو الالتزامات الدنيا. يستطيع المطورون إعداد المسودات بدقة 360p وطلب مخرجات تصل إلى 4K عندما تكون التفاصيل النهائية مهمة. يسهّل هذا المسار الموحد إضافة عائلة النماذج كاملة إلى سير عمل الإنتاج.

مواجهة فيديو في مطالبة واحدة: Gemini Omni 1.1 Flash

شاهد كيف يفسّر Gemini Omni 1.1 Flash وSeedance 2.5 وGemini Omni Flash السابق المطالبات السينمائية نفسها.

الموجه

فيلم خيالي قصير جدًا مدته 8–10 ثوانٍ، تدور أحداثه داخل ورشة نفخ زجاج حرفية مسوّدة بالسخام: ابدأ باقتراب ماكرو شديد على كتلة حمراء متوهجة من الزجاج المنصهر، تدور بسرعة عند طرف أنبوب نفخ، بينما ينثني سطحها اللزج ويتوهج ويكسر ضوء الفرن، في حين يواصل حرفي مصنوع من الطين تدوير الأنبوب؛ دُر حول ساعد الحرفي المتحرك عن قرب، بينما تضرب ملاقط معدنية على الإيقاع وتضغط الزجاج المنصهر—ومن دون قطع، تتمدد الكتلة المتوهجة وتبرد وتتحول بسلاسة إلى طائر طنان زجاجي شفاف بقلب ناري. نفّذ حركة دوران سريعة إلى لقطة تتبّع عالية السرعة، بينما يخفق الطائر الطنان بجناحيه البلوريين ويندفع فوق أوعية أصباغ مفتوحة، ويسحب في الهواء مسارات مضطربة من مسحوق أزرق طاووسي وأرجواني؛ ومع كل خفقة جناح تتناثر الجسيمات فتتصادم وتلتف وتتلألأ عبر صورته الظلية المنكسرة للضوء. ينعطف الطائر بحدة نحو فقاعة زجاجية عائمة وينقرها بالضبط عند الضربة الموسيقية الأخيرة؛ انتقل إلى لقطة علوية درامية بينما تنفجر الفقاعة إلى الخارج، وتتحول الشظايا فائقة الرقة باستمرار إلى بتلات زهور شفافة وناعمة تلتف عبر الورشة. تحريك طيني بإيقاف الحركة ممزوج بأنسجة زجاج فني مضيئة شبه شفافة، وعيوب يدوية ملموسة، وانعكاسات وانكسارات مقنعة، وتأثيرات كاوستية، وتموّج حراري، وتشوهات زجاجية، وفيزياء جسيمات؛ ضوء فرن برتقالي-أحمر بوصفه الإضاءة الأساسية المهيمنة، وإضاءة حواف بضوء قمري سماوي بارد، ولوحة ألوان من الأسود والذهبي الداكنين في الافتتاح تنفجر إلى الأزرق الطاووسي والأرجواني المشبعين عند الذروة. حركة كاميرا سريعة وانسيابية، واتساق زمني واتساق قوي للشخصية، من دون توقفات أو حشو بالحركة البطيئة. الصوت: هدير الفرن، وطنين الزجاج الدوار، ونقرات معدنية إيقاعية متزامنة مع كل ضغطة وخفقة جناح، واندفاع المسحوق، ورنين بلوري حاد عند الاصطدام، ونهاية مشرقة مت cascading من الزجاج إلى البتلات؛ من دون شاشات أو واجهات أو لوحات معلومات أو أشرطة تقدم أو مخططات أو تسميات توضيحية أو شعارات أو نصوص. نسبة العرض إلى الارتفاع 16:9.

Generated with Gemini Omni 1.1 Flash Text-to-Video on Atlas Cloud

Generated with Seedance 2.5 Text-to-Video on Atlas Cloud

Generated with Gemini Omni Flash Text-to-Video on Atlas Cloud

الموجه

تسلسل ماكرو فائق الواقعية على طريقة أفلام الطبيعة الوثائقية، مدته 8–10 ثوانٍ، داخل كهف صخري يحوي بركة مدّ وجزر عند انحسار المد: أخطبوط جوز هند برتقالي مرجاني زاهي يرتجل إيقاعًا، فتتحرك أذرعه الثمانية المتسقة تشريحيًا باستقلالية وبشكل طبيعي، بينما تضرب ممصّاته أصدافًا لؤلؤية، وقواقع قنافذ بحر مجوفة، وزجاج بحر أملس بإيقاع يزداد كثافة، مع تشوه وتلامس وارتداد ووزن واقعي دقيق للأجسام. ابدأ بلقطة تتبّع ماكرو جانبية عند خط الماء، تنساب بمحاذاة الأخطبوط بينما تتلألأ القطرات على جلده ذي الملمس الواضح، ويرسل كل اصطدام تموّجات صغيرة عبر مياه البحر السماوية الباردة؛ انتقل إلى كاميرا بزاوية منخفضة للغاية تنسج بسرعة بين الأذرع المتحركة والآلات، مع الحفاظ على استمرارية الأطراف ووضوح الحجب الواقعي. يظهر سلطعون ناسك فجأة، فينتزع الصدفة الرئيسية ويفر؛ نفّذ حركة التفاف سريعة إلى مطاردة مرحة، بينما يقفز الأخطبوط وينساب فوق صخر زلق غير مستوٍ، فتتشبث أذرعه وتتحرر وتدفع باحتكاك مقنع، في حين تثرثر أرجل السلطعون فوق الحصى. قبيل أن يغمر اندفاع قادم الكهف، ينتزع الأخطبوط الصدفة مجددًا، ويثبتها بقوة، ويوجه ضربة نهائية حاسمة؛ اصعد بسرعة إلى لقطة علوية من الأعلى، بينما تنفجر الموجة حول الأخطبوط ويشكّل الزبد المشع تكوينًا دائريًا شبه مثالي. تأثيرات كاوستية راقصة تحت الماء ناتجة عن ضوء الشمس المتكسر، وماء فيروزي بارد يتباين مع subject البرتقالي المرجاني، ورذاذ بلوري، وفقاعات، ورمال معلقة، وانعكاسات على الصخور المبتلة، وعمق مجال ماكرو ضحل، وHDR سينمائي، وأنسجة طبيعية شديدة الحدة، وحركة مستمرة وانسيابية، وانتقالات كاميرا عالية السرعة من دون حركة بطيئة. صوت من داخل المشهد فقط، متزامن تمامًا: نقرات مميزة للأصداف، وطرق مجوف لقواقع قنافذ البحر، ونقرات زجاجية لامعة، وانفصال الممصّات، واحتكاكات مخالب وأرجل السلطعون الناسك، وتزايد هدير الأمواج، ثم الضربة النهائية واصطدام الموجة بتوافق إيقاعي دقيق؛ من دون موسيقى أو سرد أو نصوص أو تسميات توضيحية أو شعارات أو واجهة أو لوحة معلومات أو مخططات أو أشرطة تقدم أو شاشة منقسمة أو أطراف إضافية أو أذرع ملتحمة أو مكررة أو تشريح مشوه أو أجسام عائمة أو اختراق أو فيزياء تلامس مكسورة أو حركة مطاطية أو وميض زمني أو قطع مفاجئة أو مواضع غير متسقة للأصداف أو أسلوب كرتوني. فيلم وثائقي سينمائي فائق الواقعية عن الحياة البرية بتصوير ماكرو، بنسبة عرض إلى ارتفاع 16:9.

Generated with Gemini Omni 1.1 Flash Text-to-Video on Atlas Cloud

Generated with Seedance 2.5 Text-to-Video on Atlas Cloud

Generated with Gemini Omni Flash Text-to-Video on Atlas Cloud

من الموجز إلى المشاهد المكتملة مع Gemini Omni 1.1 Flash

يحوّل Gemini Omni 1.1 Flash الموجزات والصور الثابتة والوسائط المرجعية والمقاطع الحالية إلى فيديوهات للحملات، وقصص بشخصيات متسقة، وانتقالات مضبوطة، ومشاهد ممتدة، وأصول اجتماعية جاهزة للإنتاج مع صوت أصلي مدمج.

تمديدات قصص Gemini Omni 1.1 Flash

تحصل المقاطع الحالية على استمرار متطابق بسلاسة لمدة من ثلاث إلى عشر ثوانٍ، ويمكن أن تصل التمديدات المتسلسلة إلى أربعين ثانية. يستطيع صانعو الأفلام وفرق المحتوى المتسلسل تطوير لقطات متماسكة دون إعادة بناء كل مشهد.

مراجعات دقيقة للحملات

هل تحتاج إلى منتج أو خلفية أو نمط بصري جديد؟ طبّق تعديلاً موجهاً بالنص مع الحفاظ على العناصر التي لم تُذكر، ما يتيح لفرق التسويق إنشاء نسخ مستهدفة دون إعادة إنشاء المقطع المصدر من الصفر في كل مرة.

عوالم العلامات التجارية مع Gemini Omni 1.1 Flash

باستخدام ما يصل إلى عشر صور مرجعية وثلاثة مقاطع فيديو، يستطيع النموذج الحفاظ على شخصية أو منتج أو توجه فني عبر عمليات التوليد. وتحصل استوديوهات العلامات التجارية على مشاهد إطلاق مترابطة بهوية بصرية أكثر اتساقاً.

انتقالات مضبوطة بين الإطارات الرئيسية

ابدأ بصورة ثابتة واحدة، وأضف الإطار النهائي اختيارياً، لتمكين النموذج من تحريك مسار سينمائي بين التكوينين. ويحصل المصممون على تحكم دقيق في الافتتاح والاختتام لعمليات الكشف والحلقات وتغييرات المشاهد.

إنتاج فيديو اجتماعي موجّه بالمطالبات

يتحوّل موجز نصي واحد إلى مقطع سينمائي بصوت أصلي متزامن، مع إمكانية اختيار المدة ونسبة العرض إلى الارتفاع ودقة الإخراج. ويستطيع صنّاع المحتوى إعداد الإعلانات والقصص الاجتماعية لتنسيقات نشر متنوعة.

المعاينة المسبقة مع Gemini Omni 1.1 Flash

عند اختبار لقطة، أنشئ نموذجاً أولياً بدقة 360p، وقارن الاتجاهات الواعدة، ثم ارفع المفاهيم المختارة إلى إخراج بدقة 4K. يستطيع المخرجون والمطورون المبدعون التحقق من الحركة والتأطير والصوت والإيقاع قبل الإنتاج النهائي.

مكانة Gemini Omni 1.1 Flash في توليد الفيديو

قارن Gemini Omni 1.1 Flash بأبرز نماذج تحويل النص إلى فيديو من حيث مدة المقطع، والدقة القصوى، ودعم الصوت الأصلي، ومعدل الإطارات الناتج.

النموذجمدة الإخراجالدقة القصوىالصوت الأصليمعدل الإطارات
Gemini Omni 1.1 Flash Text-to-Video3–10 ثوانٍ4K√24 FPS
MiniMax H3 Text-to-Video4–15 ثانية2K√24 FPS
Wan-3.0 Text-to-video2–30 ثانية1080P√30 FPS

كيفية استخدام Gemini Omni 1.1 Flash على Atlas Cloud

Get started in minutes — follow these simple steps to integrate and deploy models through Atlas Cloud’s platform.

إنشاء حساب Atlas Cloud

سجّل في atlascloud.ai وأكمل التحقق. يحصل المستخدمون الجدد على رصيد مجاني لاستكشاف المنصة واختبار النماذج.

لماذا تستخدم Gemini Omni 1.1 Flash على Atlas Cloud

دمج نماذج Gemini Omni 1.1 Flash المتقدمة مع منصة Atlas Cloud المسرّعة بـ GPU يوفر أداءً لا مثيل له وقابلية للتوسع وتجربة مطور استثنائية.

الأداء والمرونة

زمن انتقال منخفض:
استدلال محسّن لـ GPU للاستجابة في الوقت الفعلي.

API موحد:
قم بتشغيل Gemini Omni 1.1 Flash و GPT و Gemini و DeepSeek من خلال تكامل واحد.

تسعير شفاف:
فواتير يمكن التنبؤ بها لكل رمز مع خيارات بدون خادم.

المؤسسات والتوسع

تجربة المطور:
SDKs والتحليلات وأدوات الضبط الدقيق والقوالب.

الموثوقية:
وقت تشغيل 99.99%، RBAC، وتسجيل جاهز للامتثال.

الأمان والامتثال:
SOC 2 Type II، توافق HIPAA، سيادة البيانات في الولايات المتحدة.

أسئلة وأجوبة حول Gemini Omni 1.1 Flash API

Gemini Omni 1.1 Flash هو نموذج أصلي متعدد الوسائط لتوليد الفيديو وتحريره من Google DeepMind. يدعم على Atlas Cloud خمسة مسارات عمل مخصصة للمهام، تشمل التوليد، والإنشاء الموجَّه بالمراجع، والتحرير، والتمديد. ويمكن أن تتضمن مخرجات الفيديو صوتًا أصليًا متزامنًا.

يمكنه توليد فيديو من نص، وتحريك صورة ثابتة، واتباع مراجع مرئية، وتحرير مقطع موجود استنادًا إلى تعليمات نصية، أو متابعة مشهد. ويمكن لـ Image to Video أيضًا إجراء استيفاء باتجاه إطار أخير مُدخل للتحكم في انتقالات اللقطات.

أنشئ مفتاح API في Atlas Cloud، ثم اختر نقطة النهاية المطابقة لسير عملك. أرسل مطالبة مع أي صورة مصدر أو فيديو أو وسائط مرجعية مطلوبة، وفق مخطط المعلمات الخاص بنقطة النهاية. ابدأ بلقطة واحدة موصوفة بوضوح، ثم حسّن مدخلاتك بعد مراجعة النتيجة.

اختر Text to Video للتوليد المستند إلى المطالبات، وImage to Video عند تحريك إطار ثابت. يساعد Reference to Video في توجيه الهوية أو التوجه الفني، بينما يغيّر Video Edit اللقطات الموجودة ويواصل Video Extend لقطة قائمة.

يوفر Text to Video عناصر تحكم في المدة ونسبة العرض إلى الارتفاع ودقة الإخراج من 360p إلى 4K. يقبل Image to Video صورة بداية، ويمكنه استخدام إطار أخير اختياري. ويدعم Reference to Video ما يصل إلى 10 صور مرجعية و3 مقاطع فيديو مرجعية.

نعم، صُممت مسارات العمل الخمسة في Atlas Cloud لإنتاج فيديو بصوت أصلي متزامن. صِف الحوار المقصود أو الأجواء المحيطة أو الموسيقى أو المؤثرات الصوتية بوضوح في مطالبتك عندما يكون الصوت مهمًا للمشهد.

يوفر Atlas Cloud إمكانية الاستخدام بنظام الدفع حسب الاستهلاك. يبلغ السعر الأساسي القياسي $0.041 لكل من Text to Video وReference to Video وVideo Edit وVideo Extend، بينما يبلغ السعر الأساسي القياسي لـ Image to Video مقدار $0.043. وهذه الأرقام هي أسعار الواجهة الخلفية القياسية وليست أسعار خصم مؤقتة.

يمكن لكل عملية تمديد إضافة مدة تتراوح بين 3 و10 ثوانٍ، كما يمكن ربط عمليات التمديد حتى تصل لقطة واحدة متماسكة إلى 40 ثانية إجمالًا. ويستخدم النموذج المقطع الموجود كسياق مع مواصلة العناصر المرئية والصوت الأصلي معًا.

استخدم Reference to Video مع أصول مرجعية واضحة ومتوافقة، بما في ذلك ما يصل إلى 10 صور و3 مقاطع فيديو. ولتحريك الصور، قدّم إطار بداية قويًا وإطارًا أخيرًا اختياريًا عندما تحتاج إلى وجهة متحكم بها. ومع ذلك، قد ينحرف الإخراج التوليدي، لذا راجع الهوية والإضاءة والحركة والصوت بعد كل عملية توليد أو تمديد.

تصف Google دقتي 1080p و4K بأنهما خياران لإخراج مُكبَّر، وليس دقتَي توليد أصليتين. استخدم 360p للتكرارات الأولية، ثم اختر دقة أعلى بعد أن يفي التكوين والحركة بمتطلباتك.

استكشف المزيد من العائلات

Seedance 2.5

واجهة برمجة تطبيقات Seedance 2.5 متاحة الآن على Atlas Cloud! توفر للمطورين أحدث نموذج فيديو من ByteDance. يمكن للنموذج إنشاء ما يصل إلى 30 ثانية من الفيديو الأصلي في مسار واحد من نص، أو صورة واحدة، أو ما يصل إلى 50 مرجعاً متعدد الوسائط، مع صوت متزامن ونص متعدد اللغات داخل الإطار. على Atlas Cloud، يمكنك الوصول إليه من خلال مفتاح واحد، مع الحفاظ على تناسق الموضوع والفيزياء المحسنة التي تحافظ على تماسك اللقطات الطويلة.

عرض العائلة

Wan 3.0

تعد واجهة برمجة تطبيقات Wan 3.0 الجيل التالي من عائلة فيديو Wan التابعة لشركة Alibaba، وقد تم تصميمها لدفع التوليد طويل التنسيق والتحكم متعدد المراجع والجودة السمعية والبصرية إلى آفاق جديدة. تستضيف Atlas Cloud بالفعل Wan 2.7 و 2.6 و 2.5، ويعمل Wan 3.0 على نفس المفتاح الموحد دون أي إعداد منفصل. ابدأ البناء اليوم. قم بالتمرير لأسفل إلى قسم العرض لترى ما يمكن أن ينشئه Wan 3.0.

عرض العائلة

MiniMax H3

MiniMax H3 هي عائلة MiniMax متعددة الوسائط للفيديو، وتدعم الإنشاء الموجّه بالنصوص والصور والمراجع. وعبر المسارات المدعومة، تحافظ على العناصر من الوسائط المرجعية، وتوفر نسب أبعاد مرنة، وتقرن الصوت المُولّد بالمشاهد من خلال H3 Developer، مع تحديد ملفات الإخراج وفقًا لنقطة النهاية. توحّد Atlas Cloud هذه العائلة خلف مفتاح واحد متوافق مع OpenAI، مع تسعير شفاف حسب الاستخدام يبدأ من السعر القياسي البالغ $0.038 لكل ثانية. ابدأ البناء اليوم.

عرض العائلة

Seedream 5.0 Pro

يوفر واجهة برمجة التطبيقات Seedream 5.0 Pro API للمطورين نموذج تحرير الصور القابل للتحكم من ByteDance على Atlas Cloud. وهو يضع التعديلات بدقة باستخدام نقاط الإرساء والإحداثيات، ويفصل الصور إلى طبقات قابلة للتحرير، ويدمج مراجع متعددة، ويطابق الألوان والمواد الدقيقة، مع نص متعدد اللغات بدقة 2K و 3K. على Atlas Cloud، يمكنك الوصول إليه من خلال مفتاح واحد!

عرض العائلة

Seedance 2.0

Seedance 2.0 هو نموذج الفيديو المخصص للإنتاج من ByteDance لإنشاء اللقطات بدقة. حوّل المطالبات إلى فيديو، أو حرّك صورة الإطار الأول مع إمكانية توجيه اختيارية عبر الإطار الأخير، أو شكّل النتائج باستخدام الوسائط المرجعية والبحث الاختياري على الويب. يضم Atlas Cloud هذه التدفقات في API موحّد واحد، مع تسعير شفاف حسب الاستخدام ومفتاح واحد متوافق مع OpenAI. ابدأ البناء اليوم.

عرض العائلة

GPT Image 2.5

تمنح عائلة gpt-image-2.5 من OpenAI المطورين خيار استخدام Flare وSunburst في عمليات إنتاج الصور. نفّذ التصيير بدقة عشوائية تصل إلى 3840x2160، واختر من بين خمس درجات للجودة، بما في ذلك xhigh وmax، لتلبية متطلبات الإخراج المحددة. توفر Atlas Cloud استدلال REST جاهزًا للاستخدام من دون بدء تشغيل بارد، وبسعر قياسي يبدأ من $0.004 لكل عملية توليد. ابدأ البناء اليوم.

عرض العائلة

GPT Image 2

توفر واجهة برمجة تطبيقات GPT Image 2 للمطورين إمكانية الوصول إلى أحدث نموذج صور من OpenAI، وهو خليفة GPT Image 1.5. يقوم النموذج بإنشاء الصور وتعديلها مع عرض دقيق للنصوص عبر الحروف اللاتينية ونصوص CJK، بالإضافة إلى تكوين قوي للملصقات والنماذج المبدئية والرسوم البيانية (الإنفوجرافيك). على Atlas Cloud، يمكنك الوصول إليه من خلال واجهة برمجة تطبيقات موحدة بجانب أكثر من 300 نموذج، مع أرصدة مجانية، ووقت تشغيل بنسبة 99.99%، وبدون الحاجة إلى التحقق من مؤسسة OpenAI.

عرض العائلة

Gemini Omni Flash

Gemini Omni هي عائلة فيديو متعددة الوسائط أصليًا من Google DeepMind، مخصصة للإنشاء والتحرير الموجّهين بالمطالبات. أنشئ مقاطع من النصوص، أو حرّك الصور الثابتة، أو عدّل اللقطات الموجودة باستخدام مراجع بصرية اختيارية مع الحفاظ على المحتوى غير المتأثر. تدعم عناصر التحكم المرنة في الدقة ونسبة العرض إلى الارتفاع والمدة مجموعة متنوعة من مهام الإنتاج. توحّد Atlas Cloud إمكانية الوصول من خلال تسعير شفاف حسب الاستخدام. ابدأ البناء اليوم.

عرض العائلة

Grok Imagine

يغطي Grok Imagine API نماذج xAI للصور والفيديو والكلام، من Image 2.0 إلى Video 1.5 و xAI TTS v1. صيّر صور ثابتة بدقة 1K و2K عبر 14 نسبة عرض إلى ارتفاع، أو مدّ مشهد لمدة 15 ثانية من الحركة بدقة 1080p، أو وجّه اللقطات باستخدام ما يصل إلى 7 صور مرجعية، أو أضفِ سرداً نصياً بـ 20 لغة. يشغل Atlas Cloud كل وضع على نقطة نهاية واحدة، بتسعير الدفع حسب الاستخدام من $0.02 لكل صورة و$0.05 لكل ثانية. ابدأ البناء اليوم.

عرض العائلة

Google

تتوفر أقوى النماذج الإبداعية من Google بالكامل على Atlas Cloud. يقدم Veo 3.1 توليد فيديو سينمائي، ويدعم Nano Banana 2 إنشاء صور عالية الدقة، ويجلب Gemini ذكاءً متعدد الوسائط لكل سير عمل. يمكنك الوصول إلى مجموعة نماذج Google الكاملة من خلال مفتاح API key واحد مع توفر Day-0 وتسعير الدفع حسب الاستخدام (pay-as-you-go).

عرض العائلة

Seedance 2.0 Mini

يجلب Seedance 2.0 Mini إنشاء مقاطع الفيديو متعددة الوسائط من ByteDance إلى مسارات العمل حيث تعتبر السرعة والتكلفة الأكثر أهمية. إنه يوفر القدرات الأساسية لـ Seedance 2.0 ببصمة أخف — إنشاء أسرع، وتكلفة أقل لكل مقطع فيديو، ونفس تكامل API الذي تستخدمه بالفعل. بالنسبة للفرق التي تدير مسارات عمل ذات حجم كبير أو تقوم بالنماذج الأولية على نطاق واسع، فإن Mini هو الخيار الافتراضي العملي.

عرض العائلة

ByteDance

من إنشاء مقاطع الفيديو السينمائية إلى توليد الصور عالية الدقة، أصبحت أقوى نماذج ByteDance متاحة الآن على Atlas Cloud. يمكنك تشغيل Seedance و Seedream على نطاق واسع بأقل أسعار للاستدلال وبدون أي أعباء إضافية للبنية التحتية.

عرض العائلة

واجهة برمجية واحدة لكل وسائط الذكاء الاصطناعي.

استكشف جميع النماذج