لأسبوعين فقط | خصم 20% على Seedream 5.0 Pro!
Hero background 1Hero background 2

MiniMax H3 API for Video Generation and Editing

تتيح MiniMax H3 API الوصول إلى نموذج الفيديو العام متعدد الوسائط من MiniMax، الذي يقرأ النصوص والصور والفيديو والصوت كسياق واحد بدلًا من التعامل مع مهمة واحدة في كل مرة. تعمل المقاطع لمدة من 5 إلى 15 ثانية بمعدل 24 FPS عبر نسب أبعاد من 21:9 إلى 9:16، ويمكن لمطالبة واحدة تبديل الشخصيات أو استبدال الخلفيات أو إعادة كتابة الحوار أو استنساخ صوت من مقطع مرجعي. تقدم Atlas Cloud كل ذلك عبر نقطة نهاية واحدة متوافقة مع OpenAI. ابدأ التطوير اليوم.

استكشف النماذج الرائدة

يوفر لك Atlas Cloud أحدث النماذج الإبداعية الرائدة في الصناعة.

من النص إلى تسعة مراجع: أنماط MiniMax H3 API

يقرأ كل endpoint في MiniMax H3 API النصوص والصور والفيديو والصوت بطريقة مختلفة، لذا راجع الصفوف أدناه وطابق النمط مع ما تبنيه.

النمطالوصف
MiniMax H3 T2V API (النص إلى الفيديو)اكتب prompt يصل إلى 7,000 حرف، وسيعيد النموذج مقطعًا مدته من 5 إلى 15 ثانية بمعدل 24 FPS وبدقة 1440p، مع صوت stereo أصلي يُنشأ في العملية نفسها. تُحدَّد نسبة العرض إلى الارتفاع لكل طلب من بين 21:9 و16:9 و4:3 و1:1 و3:4 و9:16، لذلك تكفي مكالمة واحدة لإنشاء مقاطع دعائية سينمائية ومقاطع عمودية للشبكات الاجتماعية على حد سواء.
MiniMax H3 I2V API (الصورة إلى الفيديو)تحدد صورة واحدة الإطار الافتتاحي، بينما تثبّت صورتان الإطارين الأول والأخير، ويتولى H3 ملء الحركة بينهما وفق نسبة العرض إلى الارتفاع في صورة الإدخال. تُقبل المصادر من 256 إلى 5760 بكسل لكل ضلع، مما يجعل تحريك الرسومات الرئيسية ولقطات المنتجات الثابتة وإطارات storyboard أمرًا مباشرًا.
MiniMax H3 Omni Reference API (المرجع إلى الفيديو)هل تحتاج إلى عمل عدة مصادر معًا؟ يمكن تضمين ما يصل إلى تسع صور وثلاثة مقاطع فيديو وثلاثة مسارات صوتية في طلب واحد ضمن حد أقصى قدره 12 ملفًا، وتُقرأ كلها كسياق واحد متعدد الوسائط. يمكنك الحفاظ على شخصية أو حركة كاميرا أو نبرة صوت عبر اللقطات، أو تعديل مقطع موجود باستبدال الشخصيات والخلفيات والسطور المنطوقة.

الصورة والصوت والتحرير في استدعاء MiniMax H3 API واحد

كل مقطع يعيده MiniMax H3 API يمتد حتى خمس عشرة ثانية بدقة 1440p مع صوت ستيريو أصلي، ويُنشأ من أي مزيج من مراجع النصوص والصور والفيديو والصوت، كما يمكن للاستدعاء نفسه تعديل الشخصيات والمشاهد والحوار داخل اللقطات المتوفرة لديك بالفعل.

اثنا عشر ملفًا مرجعيًا في استدعاء MiniMax H3 API واحد

يقبل طلب MiniMax H3 API واحد ما يصل إلى تسع صور مرجعية، وثلاثة مقاطع فيديو، وثلاثة مسارات صوتية، بحد أقصى قدره اثنا عشر ملفًا. وبدلًا من التعامل معها كخانات منفصلة، يعامل النموذج النص والصورة والصوت كسياق واحد، فيستخلص شخصية من صورة، وحركة كاميرا من مقطع، ومزاجًا من مسار صوتي داخل المشهد نفسه. تحصل الفرق التي لديها مواد جاهزة على مسار مباشر نحو لقطة نهائية.

صوت ستيريو أصلي في كل مقطع

كل نتيجة تأتي مزودة بالصوت. يتم إنتاج الحوار والأجواء والموسيقى بصوت ستيريو أصلي في نفس المرور الذي يعرض الصورة بمعدل 24 إطارًا في الثانية، لذلك لا يلزم تأليف موسيقى أو دبلجة لاحقًا. وبما أن التوقيت يُحسم أثناء إنشاء اللقطة، تبقى الخطوات والكلام والقصات متزامنة مع الحركة. تخرج الإعلانات القصيرة ومقاطع الشبكات الاجتماعية جاهزة للنشر.

تعديلات على مستوى المطالبة عبر MiniMax H3 API

هل تحتاج إلى استبدال قطة بكلب، أو تغيير شاشة خضراء، أو إعادة كتابة جملة حوار واحدة؟ يطبق MiniMax H3 API تعديلات كهذه على الفيديو الذي تزوده به، بما يشمل الشخصيات والعناصر والخلفيات والإضاءة والمؤثرات، بينما تبقى الأجزاء التي لم تذكرها قريبة من الأصل. تدعم المطالبات حتى 7000 حرف، لذا يمكن تجميع عشرات التغييرات في مرور واحد. وهذا يجعل التكرار على نسخة معتمدة أمرًا عمليًا.

نقل طابع الصوت واستبدال الحوار

أرسل عينة صوتية إلى جانب الصور أو اللقطات، وستتحدث الشخصية المُنشأة بذلك الطابع الصوتي. يُسمح بما يصل إلى ثلاثة مراجع صوتية لكل طلب، مدة كل منها بين ثانيتين وخمس عشرة ثانية، ويجب أن يرافق الصوت دائمًا إدخالًا بصريًا بدلًا من إرساله منفردًا. يمكن أيضًا استبدال الحوار الحالي وضبط الأداء ليتطابق معه. تحافظ أعمال السلاسل على صوت واحد مميز عبر كل حلقة.

1440p وست نسب عرض إلى ارتفاع في MiniMax H3 API

تمتد المقاطع من خمس إلى خمس عشرة ثانية، ويضع وضع 1440p عدد 1440 بكسل على الجانب القصير بين 16:9 و9:16، أو نحو 3.7 ميغابكسل عند النسب الأعرض مثل 2976 × 1248 لـ 21:9. يمكن اختيار ست نسب، من 21:9 السينمائية إلى 9:16 العمودية، كما يستطيع MiniMax H3 API اختيار واحدة لك أيضًا. يغطي هذا النطاق إعلانًا تشويقيًا، وحلقة منتج متكررة، ودراما عمودية دون تبديل النماذج.

إدخال صيغ الإنتاج مباشرة، بلا خطوة تحويل

إذا كانت ملفات المصدر لديك قادمة مباشرة من كاميرا أو من خط زمني للتحرير، فيمكن إدخالها كما هي: فيديو H.264 وH.265، وصور ثابتة JPG وPNG وWEBP وHEIC وHEIF، بالإضافة إلى صوت WAV وMP3. حدود كل ملف هي 50MB للفيديو، و30MB للصور، و15MB للصوت، بينما يتيح تمرير الأصول عبر URL إبقاء الطلبات ضمن حد جسم الطلب البالغ 64MB. على Atlas Cloud تعمل المجموعة كلها عبر مفتاح واحد متوافق مع OpenAI مع فوترة حسب الاستخدام.

نفس النص التوجيهي، ثلاثة محركات: مقارنة مباشرة لـ MiniMax H3 API

كل مقطع في هذه المجموعة ناتج عن نص توجيهي متطابق أُرسل إلى MiniMax H3 API وإلى نموذجَي فيديو آخرين مستضافين على Atlas Cloud، بحيث يمكن مقارنة الحركة والصوت ومدى الالتزام بالتعليمات من دون تغيير أي كلمة.

الموجه

15 seconds، فيديو قصير أفقي بنسبة 16:9. لقطات تصوير حي لمغسلة ذاتية الخدمة في ساعة متأخرة من الليل، ممزوجة برسوم متحركة متوهجة مرسومة باليد لتكوين صورة متعددة الوسائط. مغسلة صغيرة ذاتية الخدمة، أضواؤها الفلورية تومض بخفوت؛ في الداخل غسالات تعمل، وسلال غسيل بلاستيكية، ومقعد قديم، مع جورب واحد ملقى على الأرض. المكان كله هادئ ويحمل مزاجًا خافتًا مفعمًا بالحنين. يحمل ملمس لقطات هاتف محمول مصوّرة بيد واحدة، مع اهتزاز واضح في الكاميرا؛ يتسبب الضوء الفلوري الأبيض في تذبذب التعريض بين السطوع والخفوت؛ الأسطح الزجاجية تحمل انعكاسات محيطة؛ ويظهر تأخر في التركيز عندما تقترب العدسة من الأجسام. يجب ألا تبدو الصورة مصقولة ومرتبة مثل إعلان تجاري — بل ينبغي أن يكون الإحساس العام أشبه بلقطة وثائقية حقيقية، كما لو أنك دخلت المكان مصادفة في وقت متأخر من الليل والتقطت المشهد وأنت تطارد رؤية غريبة تشبه الحلم.

Generated with MiniMax H3 on Atlas Cloud

Generated with Seedance 2.0 on Atlas Cloud

Generated with Wan-2.7 on Atlas Cloud

الموجه

منظور الشخص الأول · ارتفاع بمستوى العين · كاميرا ألعاب محمولة باليد المشهد: تحاكي اللقطة لاعبًا يشغّل لعبة FPS حربية حديثة، يمسك بندقية هجومية بكلتا يديه بينما يتقدم ببطء على طول المحيط الخارجي لقاعدة عسكرية. يتحرك اللاعب إلى الأمام على طريق بجانب ساتر، ويتنقل مؤشر التصويب عبر الممر في الأمام؛ بعد توقف قصير، يطلق بضع طلقات نحو هدف بعيد، ثم يواصل التقدم — مثل لقطات لعب مباشرة للاعب عادي. الإضاءة: يتداخل الضوء الطبيعي البارد لقاعدة عسكرية حديثة مع الدخان ونيران فوهة السلاح. الصورة واقعية وحادة، مع سلاح معدني وغبار وضباب ساحة المعركة بجودة ألعاب AAA. حركة الكاميرا: في الكاميرا تمايل خفيف محمول باليد أثناء حركة اللاعب — تتقدم ببطء أولًا، ثم تقوم بمسحات صغيرة يمينًا ويسارًا للمراقبة، مع اهتزاز ارتداد خفيف عند إطلاق النار، قبل أن تواصل في النهاية التقدم بثبات.

Generated with MiniMax H3 on Atlas Cloud

Generated with Seedance 2.0 on Atlas Cloud

Generated with Wan-2.7 on Atlas Cloud

موقع MiniMax H3 API ضمن سير عمل الإنتاج

من أفلام العلامات التجارية والدراما العمودية إلى مقاطع المنتجات ومرئيات الألعاب والتعديلات الدقيقة على اللقطات الحالية، يغطي MiniMax H3 API كل سيناريو عبر طلب واحد متعدد الوسائط يعيد فيديو مع صوت ستيريو أصلي.

أفلام علامات تجارية سينمائية باستخدام MiniMax H3 API

مرّر إطارات لوحة القصة وقائمة اللقطات في استدعاء واحد للحصول على عروض دعائية بدقة 1440p، وإعلانات TVC، وحملات أزياء بمعدل 24 FPS. يأتي الصوت الستيريو الأصلي مع كل نتيجة، لتتمكن فرق العلامات التجارية من معاينة نسخ نهائية جاهزة.

إنتاج الدراما القصيرة العمودية

يدعم الإخراج العمودي 9:16 مشاهد الدراما المكتوبة، من ألغاز الأزياء إلى المواجهات العائلية، مع أداء الحوار صوتيًا في العملية نفسها. تحصل الاستوديوهات التي تبني مكتبات دراما قصيرة على خطّافات مدتها 15 ثانية من دون حجز ممثلين أو مواقع تصوير.

تجميع لقطات متعددة المراجع

إذا احتاجت اللقطة إلى وجه وحركة محددين، يمكن لما يصل إلى تسع صور وثلاثة فيديوهات وثلاثة مقاطع صوتية توجيه استدعاء واحد. تبقى هوية الشخصية وحركة الكاميرا ونبرة الصوت ثابتة عبر الحلقات.

تحرير اللقطات الحالية باستخدام MiniMax H3 API

هل تحتاج إلى تغيير لاحق؟ يمكن تحرير اللقطات الحالية عبر موجّه: استبدال عنصر، تغيير الخلفية، ضبط الإضاءة، أو إعادة صياغة جملة منطوقة من دون إعادة تصوير أي إطار.

تسويق المنتجات والتجارة الإلكترونية

تتحول صور المنتجات إلى حركة: صورة مرجعية واحدة تصبح عرضًا بزاوية 360 درجة، أو شرحًا لميزة، أو مقطعًا مدفوعًا للشبكات الاجتماعية. تتيح نسب العرض إلى الارتفاع من 21:9 إلى 9:16 استخدام مجموعة أصول واحدة في كل موضع نشر.

MiniMax H3 API لمرئيات الألعاب والأنمي

يحافظ الإخراج المنمّط على جودته في game CG، وcharacter PV، وافتتاحيات الأنمي، وعروض الواجهات التي يجب أن تبقى فيها القوائم وعناصر HUD والطبقات النصية قابلة للقراءة. تستخدمه فرق الفن للتحقق من المفاهيم قبل الإنتاج.

مقارنة MiniMax H3 API بنماذج فيديو متعددة الوسائط أخرى

قارِن MiniMax H3 API بنماذج الفيديو الأخرى المستضافة على Atlas Cloud، وتعرّف عمليًا على اختلاف وسائط الإدخال، وحدود المراجع، والمدة، والدقة، ومخرجات الصوت قبل الالتزام بأي endpoint.

النموذجوسائط الإدخالالحد الأقصى لملفات المراجعمدة المخرَجالدقة القصوىالصوت الأصلي
MiniMax H3نص، صورة، فيديو، صوت9 صور، 3 فيديوهات، 3 مقاطع صوتية، بإجمالي 12 ملفًامن 5s إلى 15s1440p عند 24 FPS√ صوت ستيريو أصلي في كل مخرَج
Seedance 2.0 Reference-to-Videoنص، صورة، فيديو، صوت9 صور، 3 فيديوهات، 3 مقاطع صوتيةحتى 15s720p√ حوار ستيريو ومؤثرات وموسيقى تُولَّد في تمريرة واحدة
Veo3.1 Reference-to-videoنص وصورة3 صور مرجعية4s أو 6s أو 8s4K لمدة 8s فقط√ حوار وأجواء ومؤثرات صوتية متزامنة مع الخط الزمني
Wan-2.7 Reference-to-videoنص، صورة، فيديو، صوت5 صور أو مقاطع فيديو، بالإضافة إلى مقطع صوتي واحدمن 2s إلى 15s1080p√ توليد موسيقى ومؤثرات، أو قيادة مزامنة الشفاه باستخدام الصوت الخاص بك
Kling v3.0 Pro Image-to-Videoنص وصورة-حتى 15s1080p√ حوار متعدد اللغات مع مزامنة الشفاه بخمس لغات

كيفية استخدام MiniMax H3 على Atlas Cloud

Get started in minutes — follow these simple steps to integrate and deploy models through Atlas Cloud’s platform.

إنشاء حساب Atlas Cloud

سجّل في atlascloud.ai وأكمل التحقق. يحصل المستخدمون الجدد على رصيد مجاني لاستكشاف المنصة واختبار النماذج.

لماذا تستخدم MiniMax H3 على Atlas Cloud

دمج نماذج MiniMax H3 المتقدمة مع منصة Atlas Cloud المسرّعة بـ GPU يوفر أداءً لا مثيل له وقابلية للتوسع وتجربة مطور استثنائية.

الأداء والمرونة

زمن انتقال منخفض:
استدلال محسّن لـ GPU للاستجابة في الوقت الفعلي.

API موحد:
قم بتشغيل MiniMax H3 و GPT و Gemini و DeepSeek من خلال تكامل واحد.

تسعير شفاف:
فواتير يمكن التنبؤ بها لكل رمز مع خيارات بدون خادم.

المؤسسات والتوسع

تجربة المطور:
SDKs والتحليلات وأدوات الضبط الدقيق والقوالب.

الموثوقية:
وقت تشغيل 99.99%، RBAC، وتسجيل جاهز للامتثال.

الأمان والامتثال:
SOC 2 Type II، توافق HIPAA، سيادة البيانات في الولايات المتحدة.

MiniMax H3 API: إجابات للمطورين

تمنح MiniMax H3 API المطورين وصولًا برمجيًا إلى MiniMax H3، وهو نموذج فيديو متعدد الوسائط مفتوح وعام الغرض يتعامل مع النصوص والصور والفيديو والصوت كسياق مشترك واحد. وبدلًا من فصل التوليد والتحرير والمراجع في نماذج مهام منفصلة، يقرأ H3 مجموعة المدخلات كاملة ويعيد مقطعًا نهائيًا مزودًا بالصوت. على Atlas Cloud يعمل خلف مفتاح API واحد مع تسعير بالدفع حسب الاستخدام.

تشمل إمكاناته أفلام العلامات التجارية، والمقاطع التشويقية، والدراما القصيرة العمودية، وإعلانات المنتجات والتجارة الإلكترونية، وعروض الحركة للألعاب وUI، والتحريك بأساليب فنية مختلفة. وبما أن النموذج يتعامل مع النصوص الظاهرة على الشاشة والترجمات وأصول العلامة التجارية، تستخدمه الفرق أيضًا للتحقق من المفاهيم، ومعاينة القصص المصورة، والعروض المرئية قبل تخصيص ميزانية الإنتاج.

أنشئ حسابًا على Atlas Cloud، وولّد مفتاح API، ثم أرسل مطالبة مع أي ملفات مرجعية إلى نقطة نهاية إنشاء الفيديو، واستعلم دوريًا حتى تحصل على النتيجة النهائية. يُوصى بتمرير الوسائط كعناوين URL مستضافة بدلًا من الرفع المضمّن، لأن حجم نص الطلب محدود بـ 64MB. ابدأ البناء اليوم.

الفوترة بنظام الدفع حسب الاستخدام، لذا تدفع لكل استدعاء بدلًا من شراء اشتراك أو ترخيص مقعد. تتبع التكلفة ما تقوم بعرضه فعليًا، ما يعني أن الدقة وطول المقطع يحددان إجمالي تكلفة الدفعة. راجع صفحة النموذج لمعرفة السعر الحالي لكل عملية توليد قبل التخطيط لتشغيلات كبيرة الحجم.

نعم. تُسلَّم كل نتيجة من H3 بصوت ستيريو أصلي، بحيث تصل الحوارات والمؤثرات والأجواء الصوتية في نفس المرور مع الصورة. عند تزويد النموذج بمقطع صوتي مرجعي، يمكنه نقل تلك النبرة إلى شخصية، مما يلغي خطوة منفصلة لتوليف الصوت من مسار العمل.

تتراوح المقاطع من 5 إلى 15 ثانية بمعدل 24 FPS. في وضع 1440p يُعرض الضلع الأقصر عند 1440 بكسل للنسب بين 16:9 و9:16، وخارج هذا النطاق يحتفظ الإطار بإجمالي يقارب 3.7M بكسل، مثل 2976 × 1248 عند 21:9. تقبل طلبات تحويل النص إلى فيديو وomni reference النسب 21:9 و16:9 و4:3 و1:1 و3:4 و9:16، بينما ترث طلبات الإطار الأول والأخير نسبة العرض إلى الارتفاع من صورة الإدخال.

يمكن إرفاق ما يصل إلى تسع صور، وثلاثة مقاطع فيديو، وثلاثة مقاطع صوتية مع مطالبة واحدة، بحد أقصى يبلغ اثني عشر ملفًا إجمالًا. يجب ألا يتجاوز إجمالي مدة الفيديو والصوت لكل منهما 15 ثانية، كما يجب أن يكون الصوت مصحوبًا بصورة أو فيديو بدلًا من أن يصل منفردًا. يمكن أن تصل المطالبات إلى 7000 حرف، مما يترك مساحة لتوجيهات لقطة بلقطة تغطي الكاميرا والأداء والصوت.

تشمل المدخلات المقبولة فيديو H.264 وH.265، وصور JPG وJPEG وPNG وWEBP وHEIC وHEIF، وصوت WAV أو MP3، مع AAC أو MP3 للمسار الصوتي داخل ملف الفيديو. حدود الحجم لكل ملف هي 50MB للفيديو، و30MB للصور، و15MB للصوت. وبما أن نص الطلب محدود بـ 64MB، تظل عناوين URL المستضافة الخيار الأكثر أمانًا للأصول الثقيلة.

التحرير أحد أوضاعه الأساسية. أرسل مقطعًا مصدرًا مع التعليمات، ويمكن لـ MiniMax H3 API استبدال الشخصيات أو الكائنات، وتغيير الخلفيات والإضاءة، وإضافة مؤثرات بصرية على طبقات، وإعادة كتابة الحوار مع الحفاظ على ثبات المناطق غير المعدلة. تُنفَّذ التعليمات المركبة في طلب واحد، لذلك تُطبَّق عدة تغييرات معًا بدلًا من توزيعها على جولات متكررة ذهابًا وإيابًا.

تأخذ معظم نماذج الفيديو مطالبة واحدة مع صورة واحدة وتعيد مقطعًا صامتًا. أما H3 فيستهلك بدلًا من ذلك مجموعة مختلطة من المراجع، ويقرأ نية الشخصية والحركة والكاميرا والصوت عبرها كلها، ثم يعيد مقطعًا بصوت أصلي. إذا كان مسار عملك الحالي يربط بين نموذج فيديو ونموذج صوت ومحرر، فإن H3 يدمج تلك المراحل في استدعاء واحد.

استكشف المزيد من العائلات

Seedance 2.0

تمنحك واجهة برمجة تطبيقات Seedance 2.0 وصولاً إنتاجيًا إلى نموذج الفيديو متعدد الوسائط من ByteDance — إدخالات رباعية الوسائط (نص، صورة، فيديو، صوت) ونظام "Universal Reference" الرائد في الصناعة والذي يثبت التكوين وحركة الكاميرا وإجراءات الشخصيات عبر اللقطات. قم بدمج تحكم على مستوى المخرج من خلال استدعاء API واحد، بسعر ثابت قدره 0.09 دولار/ثانية، ومفتاح فوري، وبدون قائمة انتظار — مدعومًا بوقت تشغيل وامتثال على مستوى المؤسسات. Seedance 2.0 Native 4K متاح الآن!

عرض العائلة

GPT Image 2

توفر واجهة برمجة تطبيقات GPT Image 2 للمطورين إمكانية الوصول إلى أحدث نموذج صور من OpenAI، وهو خليفة GPT Image 1.5. يقوم النموذج بإنشاء الصور وتعديلها مع عرض دقيق للنصوص عبر الحروف اللاتينية ونصوص CJK، بالإضافة إلى تكوين قوي للملصقات والنماذج المبدئية والرسوم البيانية (الإنفوجرافيك). على Atlas Cloud، يمكنك الوصول إليه من خلال واجهة برمجة تطبيقات موحدة بجانب أكثر من 300 نموذج، مع أرصدة مجانية، ووقت تشغيل بنسبة 99.99%، وبدون الحاجة إلى التحقق من مؤسسة OpenAI.

عرض العائلة

Seedream 5.0 Pro

يوفر واجهة برمجة التطبيقات Seedream 5.0 Pro API للمطورين نموذج تحرير الصور القابل للتحكم من ByteDance على Atlas Cloud. وهو يضع التعديلات بدقة باستخدام نقاط الإرساء والإحداثيات، ويفصل الصور إلى طبقات قابلة للتحرير، ويدمج مراجع متعددة، ويطابق الألوان والمواد الدقيقة، مع نص متعدد اللغات بدقة 2K و 3K. على Atlas Cloud، يمكنك الوصول إليه من خلال مفتاح واحد!

عرض العائلة

Gemini Omni Flash

يجلب Gemini Omni API إلى بنيتك التقنية نموذج التوليد والتحرير متعدد الوسائط للفيديو من Google DeepMind، الذي أُعلن عنه في Google I/O 2026. يدمج Gemini Omni محرك الاستدلال في Gemini مع الوسائط التوليدية، ويقبل أي مزيج من النصوص والصور والفيديو والصوت لإنتاج مخرجات متسقة ومستندة إلى المعرفة. حسّن النتائج عبر محادثة طبيعية: استبدل العناصر، وأعد كتابة المشاهد، وغيّر الأنماط، مع بقاء الفيزياء والشخصيات والاستمرارية سليمة دون أي خلل. توفر Atlas Cloud تشكيلة Gemini Omni Flash الكاملة — تحويل النص إلى فيديو، وتحويل الصورة إلى فيديو مع ما يصل إلى 7 صور مرجعية، وتحويل المرجع إلى فيديو — عبر واجهة API موحدة بتسعير شفاف لكل ثانية يبدأ من $0.112 ومن دون اشتراك. ابدأ البناء اليوم.

عرض العائلة

Grok Imagine

توفر Grok Imagine API للمطورين إمكانية إنشاء الصور ومقاطع الفيديو والصوت من xAI في حزمة واحدة. وتنتج صورًا بدقة تصل إلى 2K مع عرض نص متعدد اللغات، بالإضافة إلى مقاطع فيديو تصل مدتها إلى 15 ثانية مع صوت أصلي متزامن وتحرير قائم على المراجع. على Atlas Cloud، يقوم مفتاح واحد بتشغيل كل وضع من أوضاع Grok Imagine، لذا يمكنك التنقل بين الصور والفيديو والصوت دون إعدادات منفصلة، بدءًا من 0.02 دولار لكل صورة و0.05 دولار لكل ثانية.

عرض العائلة

Google

تتوفر أقوى النماذج الإبداعية من Google بالكامل على Atlas Cloud. يقدم Veo 3.1 توليد فيديو سينمائي، ويدعم Nano Banana 2 إنشاء صور عالية الدقة، ويجلب Gemini ذكاءً متعدد الوسائط لكل سير عمل. يمكنك الوصول إلى مجموعة نماذج Google الكاملة من خلال مفتاح API key واحد مع توفر Day-0 وتسعير الدفع حسب الاستخدام (pay-as-you-go).

عرض العائلة

Seedance 2.0 Mini

يجلب Seedance 2.0 Mini إنشاء مقاطع الفيديو متعددة الوسائط من ByteDance إلى مسارات العمل حيث تعتبر السرعة والتكلفة الأكثر أهمية. إنه يوفر القدرات الأساسية لـ Seedance 2.0 ببصمة أخف — إنشاء أسرع، وتكلفة أقل لكل مقطع فيديو، ونفس تكامل API الذي تستخدمه بالفعل. بالنسبة للفرق التي تدير مسارات عمل ذات حجم كبير أو تقوم بالنماذج الأولية على نطاق واسع، فإن Mini هو الخيار الافتراضي العملي.

عرض العائلة

ByteDance

من إنشاء مقاطع الفيديو السينمائية إلى توليد الصور عالية الدقة، أصبحت أقوى نماذج ByteDance متاحة الآن على Atlas Cloud. يمكنك تشغيل Seedance و Seedream على نطاق واسع بأقل أسعار للاستدلال وبدون أي أعباء إضافية للبنية التحتية.

عرض العائلة

Alibaba

تجمع Atlas Cloud مجموعة نماذج Alibaba الكاملة ضمن API واحد: Qwen لمهام اللغة والصورة، و Wan لإنشاء مقاطع الفيديو بدقة تصل إلى 1080p. يمكنك الوصول إلى كل نموذج بنظام الدفع حسب الاستخدام (pay-as-you-go) دون أي اشتراكات. تتوفر Alibaba API عبر عنوان URL أساسي واحد باستخدام عميلك الحالي المتوافق مع OpenAI.

عرض العائلة

OpenAI

تمنحك Atlas Cloud إمكانية الوصول إلى مجموعة API الكاملة من OpenAI، بدءًا من GPT Image 2 لتوليد الصور وحتى Sora 2 للفيديو. يتوفر كل نموذج بنظام الدفع حسب الاستخدام بدون أي التزام شهري. يمكنك الربط بسهولة عن طريق تبديل عنوان URL الأساسي باستخدام الـ API المتوافق مع OpenAI.

عرض العائلة

xAI

قم ببناء مسارات عمل كاملة للصور والفيديو باستخدام xAI API على Atlas Cloud. قم بالتوليد بدقة 2K، والتحرير باستخدام صور مرجعية، وتحريك الصور إلى مقاطع متزامنة مع الصوت.

عرض العائلة

Kwaivgi

واجهة برمجة تطبيقات Kwaivgi (API) بسعر أقل بنسبة 15% من السعر القياسي. توفر Atlas Cloud وصولاً من اليوم الأول (Day-0) إلى إصدارات Kling الجديدة مع تسعير الدفع حسب الاستخدام وبدون حدود لعدد المقاعد. حساب واحد، مفتاح واحد، وكل نماذج Kling من المستوى القياسي إلى المستوى الرئيسي (master).

عرض العائلة

واجهة برمجية واحدة لكل وسائط الذكاء الاصطناعي.

استكشف جميع النماذج