Seedance 2.0 Mini & Fast API بأقل الأسعار في العالم — خصم يصل إلى 68% على السعر الرسمي
Grok Imagine Video 1.5 Motion Prompting

Grok Imagine Video 1.5 Motion Prompting

Grok Imagine Video 1.5 هي عائلة xAI لتوليد الفيديو للمطورين الذين يحتاجون إلى حركة مضبوطة انطلاقًا من الأوصاف النصية والمدخلات المرئية. حرّك الإطار الابتدائي باستخدام تعليمات حركة باللغة الطبيعية، واختر 480p أو 720p لسير عمل يعتمد على المراجع، وأضف صوتًا مرجعيًا اختياريًا لتوجيه النتيجة. يمكنك الوصول إلى الأوضاع المدعومة باستخدام مفتاح واحد متوافق مع OpenAI من Atlas Cloud، مع تسعير شفاف بنظام الدفع حسب الاستخدام. ابدأ البناء اليوم.

Grok Imagine Video 1.5 من تطوير xAI. توفّر Atlas Cloud (التي تُشغّلها Atlas Cloud AI LLC) إمكانية الوصول إليه ولا تملكه. جميع العلامات التجارية ملك لأصحابها المعنيين.

استكشف النماذج الرائدة(6)

مقارنة أنماط الإدخال في Grok Imagine Video 1.5

استكشف ستة endpoints تحوّل النص أو الإطارات الابتدائية أو الأصول المرجعية إلى فيديو ضمن سير عمل المطورين وسير العمل القياسية.

النمطالوصف
Grok Imagine Video 1.5 Developer Reference-to-Video APIحوّل من 1 إلى 7 صور مرجعية وصوتًا مرجعيًا اختياريًا إلى فيديو مع صوت متزامن مدمج أصليًا. يمكن أن تصل مدة المخرجات إلى 15 ثانية بدقة 480p أو 720p. تناسب نقطة النهاية هذه المشاهد الموجّهة بالمراجع والمفاهيم البصرية التي تتطلب عدة صور مصدرية.
Grok Imagine Video 1.5 Reference-to-Video APIبإرشاد من 1 إلى 7 صور مرجعية، تنشئ نقطة النهاية هذه فيديوهات بصوت متزامن مدمج أصليًا، كما يمكنها قبول صوت مرجعي اختياري. تدعم مددًا تصل إلى 15 ثانية بدقة 480p أو 720p. اخترها لإنتاج فيديو يستند إلى مراجع متعددة وتسلسلات موجّهة بالصوت.
Grok Imagine Video 1.5 Developer Text-to-Video APIتكفي مطالبة نصية لإنشاء فيديو بصوت متزامن مدمج أصليًا عبر نقطة النهاية المخصصة للمطورين هذه. أنشئ مقاطع تصل مدتها إلى 15 ثانية بدقة 480p أو 720p أو 1080p. يلائم هذا المفاهيم القائمة على المطالبات، ولوحات القصة، وإنتاج الفيديوهات القصيرة.
Grok Imagine Video 1.5 Text-to-Video APIأنشئ فيديو مباشرةً من مطالبة نصية مع توليد صوت متزامن مدمج أصليًا. تشمل خيارات الإخراج المتاحة 480p و720p و1080p، بمدة قصوى قدرها 15 ثانية. استخدمه للمشاهد المكتوبة، أو مفاهيم الحملات، أو أصول الفيديو المخصصة لمنصات التواصل الاجتماعي.
Grok Imagine Video 1.5 Developer Image-to-Video APIبدءًا من صورة واحدة، تطبّق نقطة النهاية المخصصة للمطورين هذه تعليمات حركة باللغة الطبيعية لإنتاج فيديو متحرك. تشمل خيارات الدقة 480p و720p و1080p. وتناسب تحريك الأعمال الفنية، والمرئيات الخاصة بالمنتجات، والإطارات الافتتاحية المُعدّة مسبقًا.
Grok Imagine Video 1.5 Image-to-Video APIحرّك صورة الإطار الابتدائي عبر وصف الحركة المطلوبة باللغة الطبيعية. يمكن إنشاء الفيديو الناتج بدقة 480p أو 720p أو 1080p. يدعم سير العمل هذا دراسات الحركة، والسرد البصري، والإنتاج الإبداعي القائم على الصور.

داخل المحرك الإبداعي لـ Grok Imagine Video 1.5

يجمع Grok Imagine Video 1.5 بين النص والصورة الابتدائية وسير عمل الصور المرجعية من صورة واحدة إلى سبع صور، مع صوت أصلي متزامن وإخراج يصل إلى 1080p ومقاطع تصل مدتها إلى 15 ثانية في نمطي النص أو المرجع، بينما تضيف Atlas Cloud واجهة API واحدة وتسعيراً شفافاً حسب الاستخدام.

Grok Imagine Video 1.5 من النص

ابدأ بموجّه نصي وأنشئ مقاطع تصل مدتها إلى 15 ثانية بدقة 480p أو 720p أو 1080p. يصل الصوت الأصلي المتزامن مع الفيديو ضمن عملية التوليد نفسها. شكّل المشهد والحركة بالكامل عبر التوجيه المكتوب عندما لا تتوفر صورة مصدر. يناسب هذا المسار الأفلام المفاهيمية والتجارب السينمائية وخطوط إنتاج المحتوى المعتمدة على الموجّهات.

الحركة الموجّهة بالصورة

يتحوّل إطار ابتدائي واحد إلى تسلسل متحرك عبر موجّهات الحركة باللغة الطبيعية. اختر إخراجاً بدقة 480p أو 720p أو 1080p، بينما تحدد الصورة التكوين الافتتاحي. وجّه حركة العناصر وحركة المشهد في الموجّه، ثم دع النموذج يواصل التحريك انطلاقاً من ذلك المرساة البصرية. يناسب هذا اللقطات التجارية للمنتجات ولحظات الشخصيات والصور الثابتة الموجّهة فنياً التي تحتاج إلى حركة.

التوجيه بالصور المرجعية في Grok Imagine Video 1.5

وجّه Grok Imagine Video 1.5 باستخدام صورة مرجعية واحدة إلى سبع صور، مع صوت مرجعي اختياري. ينتج نمط المرجع مقاطع تصل مدتها إلى 15 ثانية بدقة 480p أو 720p، مع صوت أصلي متزامن. استخدم هذه المدخلات لدفع المشهد المُولّد نحو توجه بصري محدد مسبقاً. يناسب هذا المسار الحملات والقصص المبنية على مراجع إبداعية موجودة.

الصوت الأصلي المتزامن

يُولَّد الفيديو والصوت معاً، بحيث يمكن أن يتضمن كل مقطع صوتاً أصلياً متزامناً من دون مرحلة صوت منفصلة. ابنِ المشاهد حول أفعال مرئية يمكن تعزيز توقيتها عبر المسار الصوتي المصاحب. عندما تكون المزامنة مهمة، يقلل مسار التوليد الموحّد هذا من الفاصل بين إنشاء الصورة وإنتاج الصوت. وهو مفيد بشكل خاص للقطات الغنية بالأداء والأجواء.

أقواس سردية مدتها 15 ثانية

مدّد لحظة بصرية مكتملة عبر مقاطع نصية أو مرجعية تصل مدتها إلى 15 ثانية، بدلاً من التوقف عند حلقة قصيرة. تتيح المدة المتوفرة تقديم التمهيد والحركة والخاتمة الواضحة ضمن تسلسل مُولّد واحد. اقرن هذه المساحة الزمنية بتغيير زوايا الكاميرا واستمرارية الحركة لإنشاء لحظة أكثر تطوراً. تناسب هذه المدة الإعلانات القصيرة والكشف السردي ومشاهد الفيديو الاجتماعية.

واجهة API واحدة، وست نقاط نهاية

انتقل بين التوليد من النصوص والصور الابتدائية والمراجع عبر واجهة Atlas Cloud API واحدة، مع تسعير شفاف حسب الاستخدام. اختر سير العمل الذي يناسب كل أصل بدلاً من إجبار كل فكرة على المرور عبر نوع إدخال واحد. يتيح التكامل نفسه للمطورين الوصول إلى نقاط النهاية الست المدرجة لـ Grok Imagine Video v1.5، بما في ذلك المساران Standard وDeveloper. يبسّط ذلك التجارب والتخطيط للإنتاج عبر مهام الفيديو المتنوعة.

مواجهة بين النماذج باستخدام موجّه واحد: Grok Imagine Video 1.5

تعرّف على كيفية تفسير Grok Imagine Video 1.5 وبديلين من Atlas Cloud للموجّهات المتطابقة، عبر مشاهد حركة سينمائية وفانتازيا مُنَمَّقة.

الموجه

فيلم فانتازيا باروكي تحت الماء، مدته 9 ثوانٍ وبلقطة واحدة متواصلة، داخل دار أوبرا مهجورة ومغمورة بالكامل بالماء: غطّاسة حرة رشيقة بشعر منسدل وقناع لؤلؤي مضيء تطارد أخطبوطًا أحمر مرجانيًا زاهيًا يحمل مفتاحًا نحاسيًا مزخرفًا، عبر ستائر مخملية عائمة. ابدأ من داخل أرضية مسرح متشققة بلقطة صاعدة درامية من زاوية منخفضة، بينما تتدحرج الغطّاسة وتغوص برأسها أولًا عبر الشق؛ ثم انتقل إلى حركة تتبّع جانبية قريبة وهي تنساب بين مقاعد المسرح المنهارة، مع استجابة شعرها وملابسها طبيعيًا للتيارات، بينما تنتفخ الستائر وتتبعها فقاعات عبر الأقواس المتراكبة؛ ثم دُر حولها وارفع الكاميرا إلى أعلى بينما ينتزع ضغط الماء ثريا بلورية من موضعها فوقها. في ذروة المشهد، تلتوي جانبياً في اللحظة الأخيرة لتتجنب الثريا الساقطة، فتتصادم البلورات وتتبعثر بواقعية، بينما يلتقط الأخطبوط المفتاح المتدحرج بمهارة بواسطة مخالبه المعقدة المتلوية، ويتوقف في وقار احتفالي، ثم يعيده إلى يدها المفتوحة. حركة مائية متصلة، وبداية واضحة ثم مطاردة ثم خاتمة، واتساق في الشخصية وقناع اللؤلؤ، مع تمثيل دقيق فيزيائيًا لمقاومة الماء والطفو والقماش والشعر والفقاعات وتشوه المخالب والاصطدامات وتجنب التصادم. أشعة سماوية باردة بلون السيان، تتسلل من المناور المحطمة وتخترق القاعة المظلمة الغارقة؛ الأحمر المرجاني هو اللون الوحيد عالي التشبع، ليوجّه العين عبر الطبقات العميقة من الأقواس والستائر والحطام المعلّق والفقاعات. تصوير سينمائي فوتوغرافي واقعي تحت الماء، بملمس زيتي مرهف، وفخامة باروكية أنيقة، وتأثيرات انكسار ضوئي حجمية، وتفاصيل عالية، ومن دون نص أو واجهة أو قطوع متخفية على هيئة إطارات ثابتة. صوت غامر: دوي مكتوم تحت الماء، وتيارات متدفقة، ورفرفة القماش، وفقاعات، واصطدامات بلورية، ونبض أوركسترالي متوتر ينتهي بنغمة هارب رقيقة واحدة عند إعادة المفتاح. نسبة أبعاد 16:9.

Generated with Grok Imagine Video v1.5 Text-to-Video on Atlas Cloud

Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud

Generated with Grok Imagine Video v1.5 Developer Text-to-Video on Atlas Cloud

الموجه

إعلان كوميدي عبثي مليء بالحركة، مدته 9 ثوانٍ، تدور أحداثه داخل صالون حلاقة من خمسينيات القرن العشرين، مُفصّل بعناية فائقة عند الفجر. كلب راعٍ إنجليزي قديم عابس وكثيف الفرو، مغطى برغوة صابون بيضاء كثيفة، يقتحم الباب ويندفع عبر الصالون بينما ينفض الرغوة في كل اتجاه؛ فيقفز حلاق مذعور إلى كرسي دوّار ويطارده راكبًا إياه، ويقص بسرعة شعر الكلب المتطاير، مع تزامن كل طقّة مقص واضحة بدقة مع ضربات طبول جاز حادة. ابدأ بلقطة تتبّع شديدة الانخفاض عند مستوى الأرض، تندفع بمحاذاة الكفوف المبللة وهي تنزلق فوق بلاط مربعات لامع أبيض وأسود، فترسل قطرات ورذاذ رغوة واقعيين نحو العدسة؛ ثم نفّذ حركة التفاف سريعة إلى أعلى، تليها لقطة تتبّع دائرية سريعة تستخدم ثلاث مرايا كبيرة لكشف مواقع الكلب والحلاق المتغيرة والحفاظ عليها باستمرار عبر انعكاسات معقدة ودقيقة؛ ثم نفّذ حركة اقتراب سريعة بالكاميرا بينما تتساقط قصاصات الشعر الأخيرة في الهواء وتدور وتهبط بدقة فوق رأس الكلب، لتشكّل تسريحة بومبادور شاهقة ومبالغًا فيها. يتوقف الكلب ويتخذ وضعية مغرورة في لحظة استعراضية مدتها ثانية واحدة تشبه التجميد، ثم يعطس فجأة مطلقًا نفخة انفجارية من الرغوة والشعر، بينما ينتهي الجاز بضربة حافة طبول كوميدية حادة. أضواء تنغستن عملية دافئة تشق ضباب الصباح الفيروزي البارد خارج النوافذ؛ لوحة ألوان عتيقة غنية من العنابي والكريمي والنحاس المصقول والخشب الداكن؛ تصوير سينمائي إعلاني حي فاخر، وكوريغرافيا متصلة عالية السرعة بسلاسة، واتساق في الشخصيات والاستمرارية المكانية، مع تمثيل دقيق فيزيائيًا للفرو المبلل ورغوة الصابون والشعر المتساقط والانعكاسات ودوران الكرسي والقصور الذاتي والاصطدامات، وتفاصيل فوتوغرافية واقعية ملموسة ووضوح حركي حاد، ومن دون حركة بطيئة، أو لقطات تأسيسية فارغة، أو شاشات، أو واجهات برمجية، أو لوحات معلومات، أو أشرطة تقدم، أو مخططات، أو تعليقات توضيحية، أو نص تفسيري، أو شعارات، أو علامات مائية، بنسبة أبعاد 16:9.

Generated with Grok Imagine Video v1.5 Text-to-Video on Atlas Cloud

Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud

Generated with Grok Imagine Video v1.5 Developer Text-to-Video on Atlas Cloud

Grok Imagine Video 1.5 عبر مسار العمل الإبداعي

يحوّل Grok Imagine Video 1.5 المطالبات، والإطارات المصدرية، وما يصل إلى سبع صور مرجعية إلى مقاطع فيديو قصيرة بصوت متزامن للحملات، وعروض المنتجات، وقصص الشخصيات، ومحتوى شبكات التواصل الاجتماعي، والنمذجة البصرية السريعة.

مقاطع المنتجات باستخدام Grok Imagine Video 1.5

حوّل صورة ثابتة لمنتج إلى مشهد متحرك باستخدام مطالبات حركة باللغة الطبيعية وصوت متزامن. أنشئ مقاطع عرض قصيرة للمتاجر الإلكترونية، وصفحات الحملات، ومواد الإطلاق، أو المواضع الإعلانية المدفوعة على شبكات التواصل الاجتماعي بدقة تصل إلى 1080p.

قصص الشخصيات الموجّهة بالصور المرجعية

وجّه المشهد باستخدام مرجع واحد إلى سبعة مراجع للشخصيات، مع إمكانية إضافة صوت مرجعي اختياري. يتيح هذا الإعداد ظهور طاقم متكرر، ولحظات الحوار، ومقاطع سردية قصيرة بصوت متزامن أصلي.

مفاهيم الحملات المعتمدة أولًا على المطالبة

ابدأ بمطالبة نصية لإنشاء فيديو متكامل بصوت متزامن أصلي. يمكن لفرق التسويق استكشاف مفاهيم الحملات، والمقاطع المزاجية، والإعلانات التشويقية للإطلاق دون إعداد صورة مصدر.

مقاطع التواصل الاجتماعي باستخدام Grok Imagine Video 1.5

حوّل إطار بداية واحد إلى حركة باستخدام توجيهات باللغة الطبيعية بدقة تصل إلى 1080p. أنشئ مواد حملات موجزة للخلاصات، وصفحات الإطلاق، وإعلانات الفعاليات، وتحديثات المنتجات، والمنشورات التي ينشئها المبدعون.

تحريك إطارات لوحة القصة

امنح إطارًا معتمدًا من لوحة القصة حياةً جديدة بحركة موجّهة بالمطالبة، مع الاحتفاظ به كصورة البداية. يمكن للمخرجين والمصممين إنشاء لقطات previz قصيرة بصوت متزامن لمراجعتها.

حملات العلامات التجارية باستخدام Grok Imagine Video 1.5

اجمع بين صور المنتجات، ولقطات الشخصيات، وتفاصيل الأزياء، ومراجع المشاهد في ما يصل إلى سبع صور. يمكن لفرق العلامات التجارية توجيه مشاهد ترويجية قصيرة بصوت متزامن، مع الاستناد في كل طلب إلى الأصول المرئية الموفّرة.

Grok Imagine Video 1.5 في مجال الفيديو متعدد الوسائط

قارن Grok Imagine Video 1.5 مع نماذج Reference-to-Video الرائدة من حيث المدخلات المقبولة، وطول المقطع، والدقة، والصوت المتزامن، والسعر القياسي لكل ثانية.

النموذجأنواع المدخلاتطول المقطعأقصى دقةصوت أصليالسعر القياسي
Grok Imagine Video v1.5نص، صورة، صور مرجعية، صوتحتى 15 ثانية1080p√$0.08/ثانية
Seedance 2.0 Reference-to-Videoنص، صورة، فيديو، صوتمن 4 إلى 15 ثانية4K√$0.112/ثانية
MiniMax H3 Reference-to-Videoنص، صورة، فيديو، صوتمن 4 إلى 15 ثانية2K√$0.038/ثانية
Wan-2.7 Reference-to-videoنص، صورة، فيديو، صوتمن 2 إلى 10 ثوانٍ1080p√$0.10/ثانية

كيفية استخدام Grok Imagine Video 1.5 على Atlas Cloud

Get started in minutes — follow these simple steps to integrate and deploy models through Atlas Cloud’s platform.

إنشاء حساب Atlas Cloud

سجّل في atlascloud.ai وأكمل التحقق. يحصل المستخدمون الجدد على رصيد مجاني لاستكشاف المنصة واختبار النماذج.

لماذا تستخدم Grok Imagine Video 1.5 على Atlas Cloud

دمج نماذج Grok Imagine Video 1.5 المتقدمة مع منصة Atlas Cloud المسرّعة بـ GPU يوفر أداءً لا مثيل له وقابلية للتوسع وتجربة مطور استثنائية.

الأداء والمرونة

زمن انتقال منخفض:
استدلال محسّن لـ GPU للاستجابة في الوقت الفعلي.

API موحد:
قم بتشغيل Grok Imagine Video 1.5 و GPT و Gemini و DeepSeek من خلال تكامل واحد.

تسعير شفاف:
فواتير يمكن التنبؤ بها لكل رمز مع خيارات بدون خادم.

المؤسسات والتوسع

تجربة المطور:
SDKs والتحليلات وأدوات الضبط الدقيق والقوالب.

الموثوقية:
وقت تشغيل 99.99%، RBAC، وتسجيل جاهز للامتثال.

الأمان والامتثال:
SOC 2 Type II، توافق HIPAA، سيادة البيانات في الولايات المتحدة.

الأسئلة الشائعة حول API الخاص بـ Grok Imagine Video 1.5

Grok Imagine Video 1.5 هو عائلة نماذج xAI لتوليد الفيديو، وتتيح إنشاء مقاطع انطلاقًا من نص أو صورة بداية أو عدة صور مرجعية. ومن خلال Atlas Cloud، يمكن للمطورين الوصول إلى نقاط نهاية منفصلة لكل وضع توليد.

تتوفر ثلاثة أوضاع: text-to-video وimage-to-video وreference-to-video. اختر text لإنشاء مشهد من الصفر، أو image لتحريك إطار البداية، أو reference لتوجيه الشخصيات والعناصر والأنماط باستخدام عدة صور.

أنشئ مفتاح API في Atlas Cloud، ثم أرسل طلبًا موثّقًا إلى نقطة نهاية توليد الفيديو مع معرّف النموذج المناسب. استخدم معرّف المهمة المُعاد للتحقق من حالة التوليد واسترداد عنوان URL للفيديو المكتمل.

يتطلب text-to-video مطالبةً بلغة طبيعية، بينما يضيف image-to-video صورةً واحدة لإطار البداية. يقبل reference-to-video مطالبةً من 1 إلى 7 صور مرجعية، مع إمكانية اختيارية لاستخدام معرّفات أصوات مُعدّة مسبقًا للحوار المُولّد.

تدعم مخططات Atlas Cloud المتاحة مقاطع تتراوح مدتها بين 1 و15 ثانية. يوفر text-to-video وimage-to-video إخراجًا بدقّات 480p أو 720p أو 1080p، بينما يدعم reference-to-video دقّتي 480p أو 720p.

نعم. ينشئ text-to-video صوتًا أصليًا متزامنًا انطلاقًا من المطالبة، ويمكن لـ reference-to-video دمج صوت مُولّد مع صوت مُعدّ مسبقًا اختياري للحوار.

تعرض Atlas Cloud سعرًا أساسيًا قياسيًا قدره $0.08 لكل نقطة نهاية مشمولة في صفحة هذه العائلة. راجع تفاصيل الفوترة الحالية لنقطة النهاية المحددة قبل النشر، لأن سجل الأسعار المتاح لا يحدد وحدة الفوترة.

أرسل من 1 إلى 7 صور عبر نقطة نهاية reference-to-video. حدّد الأصول المطلوبة في المطالبة باستخدام وسوم مثل <IMAGE_0> و<IMAGE_1>، حتى يتمكن النموذج من ربط كل مرجع بالشخصية أو العنصر المقصود في المشهد.

لا تتضمن مخططات Atlas Cloud المتاحة مَعلمة مخصصة للإطار الأخير. يستخدم image-to-video صورةً واحدة كإطار بداية، بينما يستخدم reference-to-video من 1 إلى 7 صور كإرشاد بصري، وليس كإطارين أول وأخير مضمونين.

اختر reference-to-video عندما تحتاج عدة صور إلى توجيه الأشخاص أو العناصر أو النمط البصري في مشهد جديد. استخدم image-to-video عندما ينبغي أن تصبح صورة موجودة إطار الافتتاح، وأن تتبع حركتها مطالبةً بلغة طبيعية.

استكشف المزيد من العائلات

Seedance 2.5

واجهة برمجة تطبيقات Seedance 2.5 متاحة الآن على Atlas Cloud! توفر للمطورين أحدث نموذج فيديو من ByteDance. يمكن للنموذج إنشاء ما يصل إلى 30 ثانية من الفيديو الأصلي في مسار واحد من نص، أو صورة واحدة، أو ما يصل إلى 50 مرجعاً متعدد الوسائط، مع صوت متزامن ونص متعدد اللغات داخل الإطار. على Atlas Cloud، يمكنك الوصول إليه من خلال مفتاح واحد، مع الحفاظ على تناسق الموضوع والفيزياء المحسنة التي تحافظ على تماسك اللقطات الطويلة.

عرض العائلة

Wan 3.0

تعد واجهة برمجة تطبيقات Wan 3.0 الجيل التالي من عائلة فيديو Wan التابعة لشركة Alibaba، وقد تم تصميمها لدفع التوليد طويل التنسيق والتحكم متعدد المراجع والجودة السمعية والبصرية إلى آفاق جديدة. تستضيف Atlas Cloud بالفعل Wan 2.7 و 2.6 و 2.5، ويعمل Wan 3.0 على نفس المفتاح الموحد دون أي إعداد منفصل. ابدأ البناء اليوم. قم بالتمرير لأسفل إلى قسم العرض لترى ما يمكن أن ينشئه Wan 3.0.

عرض العائلة

MiniMax H3

MiniMax H3 هي عائلة MiniMax متعددة الوسائط للفيديو، وتدعم الإنشاء الموجّه بالنصوص والصور والمراجع. وعبر المسارات المدعومة، تحافظ على العناصر من الوسائط المرجعية، وتوفر نسب أبعاد مرنة، وتقرن الصوت المُولّد بالمشاهد من خلال H3 Developer، مع تحديد ملفات الإخراج وفقًا لنقطة النهاية. توحّد Atlas Cloud هذه العائلة خلف مفتاح واحد متوافق مع OpenAI، مع تسعير شفاف حسب الاستخدام يبدأ من السعر القياسي البالغ $0.038 لكل ثانية. ابدأ البناء اليوم.

عرض العائلة

Seedream 5.0 Pro

يوفر واجهة برمجة التطبيقات Seedream 5.0 Pro API للمطورين نموذج تحرير الصور القابل للتحكم من ByteDance على Atlas Cloud. وهو يضع التعديلات بدقة باستخدام نقاط الإرساء والإحداثيات، ويفصل الصور إلى طبقات قابلة للتحرير، ويدمج مراجع متعددة، ويطابق الألوان والمواد الدقيقة، مع نص متعدد اللغات بدقة 2K و 3K. على Atlas Cloud، يمكنك الوصول إليه من خلال مفتاح واحد!

عرض العائلة

Seedance 2.0

Seedance 2.0 هو نموذج الفيديو المخصص للإنتاج من ByteDance لإنشاء اللقطات بدقة. حوّل المطالبات إلى فيديو، أو حرّك صورة الإطار الأول مع إمكانية توجيه اختيارية عبر الإطار الأخير، أو شكّل النتائج باستخدام الوسائط المرجعية والبحث الاختياري على الويب. يضم Atlas Cloud هذه التدفقات في API موحّد واحد، مع تسعير شفاف حسب الاستخدام ومفتاح واحد متوافق مع OpenAI. ابدأ البناء اليوم.

عرض العائلة

GPT Image 2.5

تمنح عائلة gpt-image-2.5 من OpenAI المطورين خيار استخدام Flare وSunburst في عمليات إنتاج الصور. نفّذ التصيير بدقة عشوائية تصل إلى 3840x2160، واختر من بين خمس درجات للجودة، بما في ذلك xhigh وmax، لتلبية متطلبات الإخراج المحددة. توفر Atlas Cloud استدلال REST جاهزًا للاستخدام من دون بدء تشغيل بارد، وبسعر قياسي يبدأ من $0.004 لكل عملية توليد. ابدأ البناء اليوم.

عرض العائلة

GPT Image 2

توفر واجهة برمجة تطبيقات GPT Image 2 للمطورين إمكانية الوصول إلى أحدث نموذج صور من OpenAI، وهو خليفة GPT Image 1.5. يقوم النموذج بإنشاء الصور وتعديلها مع عرض دقيق للنصوص عبر الحروف اللاتينية ونصوص CJK، بالإضافة إلى تكوين قوي للملصقات والنماذج المبدئية والرسوم البيانية (الإنفوجرافيك). على Atlas Cloud، يمكنك الوصول إليه من خلال واجهة برمجة تطبيقات موحدة بجانب أكثر من 300 نموذج، مع أرصدة مجانية، ووقت تشغيل بنسبة 99.99%، وبدون الحاجة إلى التحقق من مؤسسة OpenAI.

عرض العائلة

Gemini Omni Flash

توفّر Gemini Omni API للمطورين عائلة Gemini Omni Flash المتعددة الوسائط أصلاً من Google DeepMind، بما في ذلك Gemini Omni 1.1 Flash. أنشئ فيديو سينمائياً مع صوت أصلي متزامن، أو حرّك الصور الثابتة مع تحكّم دقيق في الإطارين الابتدائي والنهائي، أو عدّل اللقطات الموجودة عبر تعديلات موجّهة بالنص تحافظ على المحتوى الذي لم تطله التعديلات. توفّر Atlas Cloud مفتاحاً واحداً متوافقاً مع OpenAI، ووصولاً موحّداً، وتسعيراً شفافاً بنظام الدفع حسب الاستخدام. ابدأ التطوير اليوم.

عرض العائلة

Grok Imagine

يغطي Grok Imagine API نماذج xAI للصور والفيديو والكلام، من Image 2.0 إلى Video 1.5 و xAI TTS v1. صيّر صور ثابتة بدقة 1K و2K عبر 14 نسبة عرض إلى ارتفاع، أو مدّ مشهد لمدة 15 ثانية من الحركة بدقة 1080p، أو وجّه اللقطات باستخدام ما يصل إلى 7 صور مرجعية، أو أضفِ سرداً نصياً بـ 20 لغة. يشغل Atlas Cloud كل وضع على نقطة نهاية واحدة، بتسعير الدفع حسب الاستخدام من $0.02 لكل صورة و$0.05 لكل ثانية. ابدأ البناء اليوم.

عرض العائلة

Google

تتوفر أقوى النماذج الإبداعية من Google بالكامل على Atlas Cloud. يقدم Veo 3.1 توليد فيديو سينمائي، ويدعم Nano Banana 2 إنشاء صور عالية الدقة، ويجلب Gemini ذكاءً متعدد الوسائط لكل سير عمل. يمكنك الوصول إلى مجموعة نماذج Google الكاملة من خلال مفتاح API key واحد مع توفر Day-0 وتسعير الدفع حسب الاستخدام (pay-as-you-go).

عرض العائلة

Seedance 2.0 Mini

يجلب Seedance 2.0 Mini إنشاء مقاطع الفيديو متعددة الوسائط من ByteDance إلى مسارات العمل حيث تعتبر السرعة والتكلفة الأكثر أهمية. إنه يوفر القدرات الأساسية لـ Seedance 2.0 ببصمة أخف — إنشاء أسرع، وتكلفة أقل لكل مقطع فيديو، ونفس تكامل API الذي تستخدمه بالفعل. بالنسبة للفرق التي تدير مسارات عمل ذات حجم كبير أو تقوم بالنماذج الأولية على نطاق واسع، فإن Mini هو الخيار الافتراضي العملي.

عرض العائلة

ByteDance

من إنشاء مقاطع الفيديو السينمائية إلى توليد الصور عالية الدقة، أصبحت أقوى نماذج ByteDance متاحة الآن على Atlas Cloud. يمكنك تشغيل Seedance و Seedream على نطاق واسع بأقل أسعار للاستدلال وبدون أي أعباء إضافية للبنية التحتية.

عرض العائلة

واجهة برمجية واحدة لكل وسائط الذكاء الاصطناعي.

استكشف جميع النماذج