Seedance 2.0 Mini & Fast API بأقل الأسعار في العالم — خصم يصل إلى 68% على السعر الرسمي
Grok Imagine Video with Reference Guidance

Grok Imagine Video with Reference Guidance

يمنح Grok Imagine Video المطورين إمكانية الوصول إلى عائلة الفيديو من xAI لإنشاء المقاطع وتحريكها وتمديدها وتحريرها. أنشئ مقاطع فيديو تتراوح مدتها بين 1 و15 ثانية انطلاقًا من المطالبات، ووجّه الأشخاص أو الكائنات أو الأنماط باستخدام ما يصل إلى سبع صور مرجعية، واعمل بدقة 480p أو 720p. تجمع Atlas Cloud هذه الإمكانات عبر نقاط نهاية متوافقة مع OpenAI، مع تسعير شفاف حسب الاستخدام. ابدأ البناء اليوم.

Grok Imagine Video من تطوير xAI. توفّر Atlas Cloud (التي تُشغّلها Atlas Cloud AI LLC) إمكانية الوصول إليه ولا تملكه. جميع العلامات التجارية ملك لأصحابها المعنيين.

مقارنة بين أوضاع وسير عمل Grok Imagine Video

اختر نقطة نهاية Grok Imagine Video التي تتوافق مع أصولك المصدرية والتحويل المطلوب وسير عمل الإنتاج.

النمطالوصف
Grok Imagine Video T2V API (Text To Video)حوّل الأوامر المكتوبة باللغة الطبيعية إلى مقاطع فيديو مدتها من 1 إلى 15 ثانية بدقة 480p أو 720p. تناسب نقطة النهاية هذه تصوّر الأفكار، والمقاطع المخصّصة لوسائل التواصل الاجتماعي، والمشاهد المُنشأة من دون وسائط مصدرية.
Grok Imagine Video I2V API (Image To Video)بدءًا من صورة مُقدّمة، تطبّق نقطة النهاية هذه أوامر حركة باللغة الطبيعية لإنتاج فيديو بدقة 480p أو 720p. استخدمها لتحريك الأعمال الفنية، أو صور المنتجات، أو إطارات الشخصيات، أو العناصر المرئية للحملات.
Grok Imagine Video R2V API (Reference To Video)وجّه إنشاء الفيديو باستخدام من 1 إلى 7 صور مرجعية تمثّل أشخاصًا أو كائنات أو أنماطًا مرئية. يمكن أن تصل مدة المخرجات إلى 10 ثوانٍ بدقة 480p أو 720p، ما يدعم الإنتاج الإبداعي القائم على المراجع.
Grok Imagine Video Extend API (Video Extension)مدّد ملف MP4 موجودًا تتراوح مدته بين 2 و15 ثانية باستخدام أمر يوجّه امتدادًا تتراوح مدته بين 2 و10 ثوانٍ. يطابق الإخراج تنسيق الإدخال، وتُحدَّد دقته بحد أقصى 720p، ما يجعل نقطة النهاية هذه مفيدة لإطالة اللقطات الحالية.
Grok Imagine Video Edit API (Video Editing)قدّم ملف MP4 وتعليمات باللغة الطبيعية لتعديل محتواه المرئي مع الحفاظ على مدة المصدر. تُحدَّد مدة الإخراج بحد أقصى 8.7 ثوانٍ، ما يلائم المراجعات المستهدفة والتحويلات القائمة على الأوامر للمقاطع القصيرة.

فيديو Grok Imagine عبر خمسة مسارات إبداعية

يحوّل Grok Imagine Video النصوص والإطارات الافتتاحية وما يصل إلى سبعة مراجع إلى مقاطع قصيرة، ثم يمدّد لقطات MP4 الحالية أو يحرّرها عبر API موحّد من Atlas Cloud بنظام الدفع حسب الاستخدام.

فيديو Grok Imagine من النص

اكتب مطالبة بلغة طبيعية وأنشئ مقطعًا مدته من 1 إلى 15 ثانية بدقة 480p أو 720p. تتيح لك سبع نسب أبعاد، من بينها 16:9 و1:1 و9:16، ملاءمة كل لقطة لمساحتها المقصودة. تحكّم في الموضوع والحركة وحركة الكاميرا والأجواء مباشرةً من خلال المطالبة. إنه نقطة بداية مرنة لبناء لحظات القصة ومفاهيم الحملات ومقاطع الفيديو الاجتماعية.

تحريك إطار افتتاحي

حوّل صورة إطار افتتاحي مقدَّمة منك إلى فيديو مدته من 1 إلى 15 ثانية بدقة 480p أو 720p. تحدد الصورة التكوين الافتتاحي، بينما توجّه مطالبة حركة بلغة طبيعية حركة المشهد وتطوّره. اختر من بين سبع نسب أبعاد عند الحاجة إلى شكل إخراج مختلف. يناسب هذا المسار لقطات المنتجات والمشاهد المصوّرة والمفاهيم الموجّهة فنيًا التي تحتاج إلى حركة من دون إعادة بناء الإطار الافتتاحي.

التحكّم بالمراجع في Grok Imagine Video

وجّه فيديو باستخدام من 1 إلى 7 صور مرجعية تمثّل أشخاصًا أو عناصر أو أساليب بصرية. أشِر إلى المدخلات الفردية في المطالبة، ثم أنشئ فيديو يصل إلى 10 ثوانٍ بدقة 480p أو 720p عبر سبع نسب أبعاد مدعومة. وبما أن المراجع تشكّل المشهد من دون أن تقتصر وظيفتها على كونها إطارًا افتتاحيًا، يحصل المبدعون على تحكّم أكبر بالعناصر البصرية المتكررة. استخدمه للمشاهد التي تقودها الشخصيات، أو سرد قصص المنتجات، أو الحملات التي تراعي الأسلوب البصري.

تمديد تسلسل القصة

تابع مقطع MP4 موجودًا مدته من 2 إلى 15 ثانية بتمديد موجّه بمطالبة يستمر من 2 إلى 10 ثوانٍ. يواصل Grok Imagine Video من الإطار الأخير ويعيد المقطع الأصلي مع الجزء الجديد، مع مطابقة دقة الإدخال حتى 720p. صِف الحركة التالية أو لحظة الكشف أو حركة الكاميرا بلغة واضحة. يسهّل ذلك تحويل النهايات المفاجئة إلى لحظات سردية مكتملة.

تحرير المقاطع باستخدام Grok Imagine Video

زوّد Grok Imagine Video بملف MP4 وتعليمات بلغة طبيعية لتحويل اللقطات مع الحفاظ على مدتها الأصلية. يمكن أن تصل مدة المدخلات إلى 8.7 ثوانٍ، وتُحتسب الفوترة وفقًا لطول الفيديو المُدخل. اطلب تغييرًا بصريًا أو تحوّلًا في الأجواء أو تعديلًا على مستوى المشهد من دون إعادة بناء المقطع من الصفر. وهو مناسب جدًا للتنويعات الإبداعية القصيرة والتحسينات المنضبطة بعد التوليد.

خمسة مسارات، وAPI واحد

تنقّل بين تحويل النص إلى فيديو، وتحويل الصورة إلى فيديو، والتوليد الموجّه بالمراجع، والتمديد، والتحرير من خلال API موحّد واحد. اختر نقطة النهاية التي تتوافق مع المواد المصدرية المتاحة، وأرسل كل مهمة عبر تدفق تنبؤ غير متزامن. حافظ على اتساق أنماط المصادقة والتكامل عبر مختلف المسارات. يتيح الوصول بنظام الدفع حسب الاستخدام إجراء التجارب وبناء خطوط إنتاج قابلة للتكرار. ويمكن للمطورين إنشاء أدوات فيديو أوسع مع تقليل عبء التكامل.

موجّه واحد، ثلاث رؤى: مقارنة فيديو Grok Imagine

تعرّف على كيفية تفسير Grok Imagine Video وبديلين رائدين للموجّهات المتطابقة من خلال الحركة، والاستمرارية، والتحكم بالكاميرا، والإضاءة، والسرد البصري.

الموجه

فيلم مغامرات خارجي فائق الواقعية مدته 8–10 ثوانٍ، تدور أحداثه في وادٍ زمردي مباشرةً بعد عاصفة مطرية غزيرة. ينطلق كاياكر يرتدي بدلة واقية من الماء زرقاء كوبالتية وسترة نجاة برتقالية حمراء عبر مياه بيضاء هائجة منذ الإطار الأول وحتى الأخير. افتتح بلقطة تتبّع فائقة الانخفاض عند خط الماء، تنطلق بمحاذاة الكاياك بينما تشق شفرات المجداف التيار، فتنثر رذاذًا حادًا عبر العدسة؛ يرتفع الكاياك فوق قمة موجة شديدة الانحدار وينطلق في الهواء. نفّذ انتقالًا سريعًا بحركة التفاف إلى منظور الشخص الأول POV للكاياكر، بينما تنقلب القارب جانبياً أسفل شجرة ساقطة، وتخترق ستارة ماء شفافة، وتتجاوز بصعوبة صخورًا رطبة مسننة، مع الحفاظ على الاتساق الفيزيائي لليدين والمجداف ومقدمة الكاياك الزرقاء الكوبالتية عبر الرذاذ والحجب اللحظي. يثبت الكاياكر المجداف في مواجهة التيار، وينحرف مبتعدًا عن جدار الوادي في انعطاف ارتدادي ضيق، ثم يهبط مجددًا في السيل. عند الذروة، انتقل إلى غوصة بطائرة مسيّرة من أعلى الجرف، تهبط سريعًا وتدور حول الكاياكر أثناء الهبوط؛ تصطدم المقدمة بصندوق خشبي عائم بارتطام مقنع، فتكسره—ثم، في مفاجأة مرحة مفاجئة، تنبثق منه سلسلة متصلة من فوانيس ورقية ملوّنة سليمة تمامًا، وتنتشر وتتراقص بدفء فوق المياه الباردة الجارية بينما يواصل الكاياك اندفاعه. حركة مستمرة صحيحة تشريحيًا، قصور ذاتي واقعي للكاياك، مقاومة المجداف، اصطدامات، ديناميكيات موائع مضطربة، حركة القماش، قطرات الماء، رذاذ العدسة، وثبات هوية الشخص بلا تذبذب بعد كل عائق؛ لا حركة بطيئة، ولا لقطات تأسيسية فارغة، ولا انتقالات إلى شاشات أو واجهات أو لوحات معلومات أو أشرطة تقدم أو مخططات أو تعليقات توضيحية أو شعارات أو نصوص تفسيرية. ضوء نهاري بارد سماوي ملبّد بالغيوم، جدران صخرية زمردية داكنة بفعل المطر، سترة نجاة برتقالية حمراء زاهية، توهج دافئ لفوانيس متعددة الألوان، وتكوينات سينمائية عريضة بزاويا قطرية تؤكد السرعة، مع تباين عالٍ، وضبابية حركة طبيعية، وتصوير غامر واقعي للغاية لرياضات الحركة. صوت متزامن: هدير المياه السريعة، ارتطامات المجداف الحادة، تشقق الخشب، تنفّس مجهد، اصطدام الماء بالهيكل، ولمسة موسيقية إيقاعية مشرقة عند تحرر الفوانيس. نسبة العرض إلى الارتفاع 16:9.

Generated with Grok Imagine Video v1.5 Text-to-Video on Atlas Cloud

Generated with Seedance 2.5 Text-to-Video on Atlas Cloud

Generated with Grok Imagine Video v1.5 Developer Text-to-Video on Atlas Cloud

الموجه

تسلسل سينمائي متواصل ومليء بالحركة مدته 8–10 ثوانٍ في سوق ليلي مفتوح، قبل لحظات من هطول غزير: يركض طاهٍ بارع في إعداد الرامن ومعصوب العينين بثقة عبر متاهة من أكشاك الطعام المزدحمة، بينما يمد باستمرار شريطًا من المعكرونة الفضية البيضاء بين يديه. ابدأ بمنظور عمودي تمامًا من أعلى إلى أسفل، ثم اهبط سريعًا من الأعلى إلى متاهة السوق المضاءة بالنيون بينما تضرب أولى قطرات المطر الثقيلة المظلات والأرض المبتلة. ثبّت التركيز على شريط المعكرونة الطائر وانطلق بمحاذاته بفارق بضع بوصات بينما يلتف فوق مواقد الفحم المتوهجة، ورواد المطاعم المذعورين، والمشاوي الأزيز، والمظلات التي تنفتح بعنف في مهب الريح؛ حافظ على حركة بشرية متصلة، وفيزياء مرنة مقنعة للمعكرونة، وحجب معقد في المقدمة، ومطر متناثر، وشرر، وبخار كثيف. نفّذ حركة التفاف سريعة نحو الطاهي وهو يقفز فوق صندوق منخفض دون أن يقطع خطوته، ثم أجرِ دورانًا سريعًا بزاوية 360-degree حوله بينما يلتف ويطلق المعكرونة إلى الخلف بزخم دقيق. ينحني شريط المعكرونة بنظافة ليسقط في قدر نحاسي يغلي بقوة خلفه—وفي لحظة الانتصار بالضبط، تقفز قطة برتقالية مشاكسة من أسفل الكشك، وتلتقط نصف المعكرونة المتدلية بفمها، ثم تهرب مسرعة، لتصنع مفارقة بصرية واضحة بينما يواصل الطاهي الركض دون أن يدرك ما حدث. واقعية ضوئية سينمائية بطابع نيون-نوار، وانعكاسات سماوية خضراء وأرجوانية على الأرض الزلقة بالمطر، ونار دافئة بلون الفرن البرتقالي كلمسات بصرية إيقاعية، وبخار ومطر ملموسان، وتصميم حركي مستقر، وتفاصيل سينمائية حادة، وإيقاع نشط في الزمن الحقيقي، بلا حركة بطيئة ولا انتقالات تقطع الاستمرارية المكانية أو استمرارية الشخصيات. الصوت: رعد متصاعد، أحاديث السوق، وقع أقدام مدوٍّ، طقطقة المظلات، أزيز الفحم، غليان الماء، أزيز المعكرونة المتزامن مع حركات الكاميرا، وينتهي بمواء قط مرح ومشرق ورذاذ من القدر النحاسي. لا شاشات، ولا واجهات مستخدم، ولا لوحات معلومات، ولا أشرطة تقدم، ولا مخططات، ولا تعليقات توضيحية، ولا ترجمات، ولا شعارات، ولا علامات مائية، ولا نصوص تفسيرية. نسبة العرض إلى الارتفاع 16:9.

Generated with Grok Imagine Video v1.5 Text-to-Video on Atlas Cloud

Generated with Seedance 2.5 Text-to-Video on Atlas Cloud

Generated with Grok Imagine Video v1.5 Developer Text-to-Video on Atlas Cloud

Grok Imagine Video في كل مرحلة إبداعية

يحوّل Grok Imagine Video الأوامر النصية، والصور الثابتة، والمراجع، وملفات MP4 الحالية إلى مسارات عملية للمقاطع الاجتماعية، ومرئيات المنتجات، وقصص العلامات التجارية، والتسلسلات الأطول، والتعديلات الموجّهة، وأدوات المبدعين.

مقاطع Grok Imagine Video لوسائل التواصل الاجتماعي

يحوّل Grok Imagine Video الأوامر النصية باللغة الطبيعية إلى مقاطع قصيرة بدقة 480p أو 720p. استخدمه لإنتاج تشويقات لوسائل التواصل الاجتماعي، ومفاهيم للحملات، ومسودات مرئية سريعة من دون إعداد لقطات مصدر مسبقًا.

تحريك الصور الثابتة للمنتجات

انطلاقًا من صورة منتج، يضيف image to video endpoint حركة موجّهة بالأوامر النصية بدقة 480p أو 720p. يمكن للعلامات التجارية تحويل الصور الثابتة في الكتالوج إلى لقطات لكشف المنتجات، ومواد إطلاق، ومرئيات لمنصات التجارة الإلكترونية.

قصص العلامات التجارية الموجّهة بالمراجع

باستخدام من 1 إلى 7 صور، يوجّه reference to video الأشخاص أو الكائنات أو الأنماط إلى مقطع جديد. يمكن للفرق الإبداعية تطوير قصص العلامات التجارية، ومفاهيم الشخصيات، ومشاهد المنتجات المستندة إلى المرئيات المقدّمة.

تمديدات قصص Grok Imagine Video

واصل ملف MP4 موجودًا بامتداد موجّه بالأوامر النصية مدته من 2 إلى 10 ثوانٍ، مع الحفاظ على دقة الإدخال حتى 720p. يدعم ذلك مشاهد أطول في لوحة القصة، وانتقالات حلقية، وتسلسلات لاحقة انطلاقًا من لقطات معتمدة.

تحرير الفيديو باللغة الطبيعية

حرّر ملف MP4 باستخدام تعليمات باللغة الطبيعية مع الحفاظ على مدته الأصلية، وبحد أقصى للإخراج يبلغ 8.7 ثوانٍ. يمكن للفرق إنشاء مظاهر بديلة، ونسخ محلية من الحملات، أو معالجات بصرية منقحة.

البناء باستخدام Grok Imagine Video

أنشئ أدوات فيديو موجّهة بالأوامر النصية حول أوضاع Grok Imagine Video الـ5 للتوليد، والتحريك، والمراجع، والتمديد، والتحرير. يمكن للمطورين دعم سير عمل المبدعين ضمن عائلة واحدة مع اختيار إخراج بدقة 480p أو 720p.

مكانة Grok Imagine Video بين نماذج الفيديو

قارن سير عمل Grok Imagine Video ببدائل مختارة من Atlas Cloud عبر طرق الإدخال وطول المقطع والدقة القصوى والسعر القياسي.

النموذجسير عمل الإدخالطول المقطع أو الجزءالدقة القصوىالسعر القياسي
Grok Imagine Video Text-to-Videoمطالبة نصية1–15s720p$0.05/sec
Grok Imagine Video Image-to-Videoصورة البدء + مطالبة نصية1–15s720p$0.05/sec
Grok Imagine Video Reference-to-Videoمن 1 إلى 7 صور مرجعية + مطالبة نصية1–10s720p$0.05/sec
Grok Imagine Video Extendملف MP4 بطول 2–15s + مطالبة نصيةتمديد بطول 2–10sيطابق الإدخال، حتى 720p$0.07/sec
Grok Imagine Video EditMP4 + تعليمات نصيةيطابق الإدخال، حتى 8.7s-$0.07/input sec
MiniMax H3 Text-to-Videoمطالبة نصية4–15s2K$0.038/sec
Seedance 2.0 Image-to-Videoصورة البدء + نص، مع إمكانية إضافة الإطار الأخير4–15s4K أصلية$0.112/sec
Vidu Q3-Mix Reference to Videoمن 1 إلى 4 صور مرجعية + مطالبة نصية1–16s1440p SR، وأصلية حتى 1080p$0.125/run
Wan-2.7 Video-editفيديو المصدر + نص، مع إمكانية إضافة صور أو صوت-1080p$0.10/run

كيفية استخدام Grok Imagine Video على Atlas Cloud

Get started in minutes — follow these simple steps to integrate and deploy models through Atlas Cloud’s platform.

إنشاء حساب Atlas Cloud

سجّل في atlascloud.ai وأكمل التحقق. يحصل المستخدمون الجدد على رصيد مجاني لاستكشاف المنصة واختبار النماذج.

لماذا تستخدم Grok Imagine Video على Atlas Cloud

دمج نماذج Grok Imagine Video المتقدمة مع منصة Atlas Cloud المسرّعة بـ GPU يوفر أداءً لا مثيل له وقابلية للتوسع وتجربة مطور استثنائية.

الأداء والمرونة

زمن انتقال منخفض:
استدلال محسّن لـ GPU للاستجابة في الوقت الفعلي.

API موحد:
قم بتشغيل Grok Imagine Video و GPT و Gemini و DeepSeek من خلال تكامل واحد.

تسعير شفاف:
فواتير يمكن التنبؤ بها لكل رمز مع خيارات بدون خادم.

المؤسسات والتوسع

تجربة المطور:
SDKs والتحليلات وأدوات الضبط الدقيق والقوالب.

الموثوقية:
وقت تشغيل 99.99%، RBAC، وتسجيل جاهز للامتثال.

الأمان والامتثال:
SOC 2 Type II، توافق HIPAA، سيادة البيانات في الولايات المتحدة.

أسئلة حول Grok Imagine Video، والإجابات عنها

Grok Imagine Video هو مجموعة نماذج xAI لتوليد الفيديو، مخصّصة لإنشاء المقاطع القصيرة وتحريكها وتمديدها وتحريرها. يوفّر Atlas Cloud نقاط نهاية API منفصلة لسير عمل النص والصورة والمرجع والتمديد والتحرير.

يمكن لـ Grok Imagine Video إنشاء مقطع من نص، أو تحريك صورة ابتدائية، أو استخدام ما يصل إلى 7 صور مرجعية لتوجيه الأشخاص والعناصر والأنماط. وتتيح نقاط نهاية منفصلة متابعة مقطع موجود أو تحرير ملف MP4 باستخدام تعليمات باللغة الطبيعية.

أنشئ مفتاح API لـ Atlas Cloud وأرسل طلب POST موثّقًا إلى /api/v1/model/generateVideo. حدّد معرّف النموذج المطلوب، وprompt، وأي مدخلات صور أو فيديو يطلبها ذلك المسار. تتضمن الاستجابة معرّف الطلب وحالته وحقول الإخراج.

اختر text-to-video عندما يبدأ المشهد من prompt، أو image-to-video عندما يجب أن تصبح صورة مُدخلة هي الإطار الابتدائي. يوفّر reference-to-video توجيهًا أوسع باستخدام عدة صور، بينما يعمل extend-video وedit-video على ملفات MP4 موجودة.

يدعم text-to-video وimage-to-video مقاطع مدتها من 1 إلى 15 ثانية بدقة 480p أو 720p. ويدعم reference-to-video مدة من 1 إلى 10 ثوانٍ بالدقات نفسها، بينما تشمل نسب العرض إلى الارتفاع الشائعة 16:9 و9:16 و1:1 و4:3 و3:4 و3:2 و2:3. وتتبع مسارات التمديد والتحرير حدود الإدخال الخاصة بها.

نعم. توثّق xAI توليد الصوت الأصلي كجزء من سير عمل فيديو Grok Imagine، ما يتيح إنتاج الصوت والعناصر المرئية معًا. ولا تعرض المخططات المنشورة في Atlas Cloud لهذه المسارات مفتاحًا منفصلًا للصوت.

أرسل من 1 إلى 7 عناوين URL عامة لصور HTTPS أو معرّفات بيانات base64 عبر نقطة نهاية reference-to-video. ويمكن لوسوم مثل <IMAGE_0> ربط كل صورة مرجعية بالأشخاص أو العناصر أو الأنماط المذكورة في prompt. يعيد هذا المسار مقاطع تصل مدتها إلى 10 ثوانٍ بدقة 480p أو 720p.

استخدم extend-video مع ملف MP4 مدته من 2 إلى 15 ثانية، واطلب إضافة حركة موجّهة بواسطة prompt لمدة تتراوح من 2 إلى 10 ثوانٍ. ولإجراء تغييرات محددة، يقبل edit-video ملف MP4 لا تتجاوز مدته 8.7 ثوانٍ ويحافظ على مدته. ويحدّد كلا المسارين دقة الإخراج القصوى عند 720p.

تبلغ الأسعار القياسية في Atlas Cloud مقدار $0.05 لكل ثانية لـ text-to-video وimage-to-video وreference-to-video. ويستخدم extend-video وedit-video سعرًا قياسيًا قدره $0.07 لكل ثانية. ويُحتسب التحرير وفقًا لمدة فيديو الإدخال لأن الإخراج يحافظ على هذه المدة.

تحقّق أولًا من توافق نقطة النهاية المحددة مع نوع الإدخال، ومن وجود كل prompt أو عنوان URL للصورة أو عنوان URL للفيديو المطلوب. راجع حدود المدة والدقة ونسبة العرض إلى الارتفاع وعدد الصور المرجعية وملف MP4 الخاصة بالمسار قبل إعادة الإرسال. وإذا نجح الطلب لكن كان المشهد غير دقيق، فأعد كتابة prompt مع توضيح حركة العنصر وحركة الكاميرا والإيقاع والتفاصيل المرئية.

استكشف المزيد من العائلات

Seedance 2.5

واجهة برمجة تطبيقات Seedance 2.5 متاحة الآن على Atlas Cloud! توفر للمطورين أحدث نموذج فيديو من ByteDance. يمكن للنموذج إنشاء ما يصل إلى 30 ثانية من الفيديو الأصلي في مسار واحد من نص، أو صورة واحدة، أو ما يصل إلى 50 مرجعاً متعدد الوسائط، مع صوت متزامن ونص متعدد اللغات داخل الإطار. على Atlas Cloud، يمكنك الوصول إليه من خلال مفتاح واحد، مع الحفاظ على تناسق الموضوع والفيزياء المحسنة التي تحافظ على تماسك اللقطات الطويلة.

عرض العائلة

Wan 3.0

تعد واجهة برمجة تطبيقات Wan 3.0 الجيل التالي من عائلة فيديو Wan التابعة لشركة Alibaba، وقد تم تصميمها لدفع التوليد طويل التنسيق والتحكم متعدد المراجع والجودة السمعية والبصرية إلى آفاق جديدة. تستضيف Atlas Cloud بالفعل Wan 2.7 و 2.6 و 2.5، ويعمل Wan 3.0 على نفس المفتاح الموحد دون أي إعداد منفصل. ابدأ البناء اليوم. قم بالتمرير لأسفل إلى قسم العرض لترى ما يمكن أن ينشئه Wan 3.0.

عرض العائلة

MiniMax H3

MiniMax H3 هي عائلة MiniMax متعددة الوسائط للفيديو، وتدعم الإنشاء الموجّه بالنصوص والصور والمراجع. وعبر المسارات المدعومة، تحافظ على العناصر من الوسائط المرجعية، وتوفر نسب أبعاد مرنة، وتقرن الصوت المُولّد بالمشاهد من خلال H3 Developer، مع تحديد ملفات الإخراج وفقًا لنقطة النهاية. توحّد Atlas Cloud هذه العائلة خلف مفتاح واحد متوافق مع OpenAI، مع تسعير شفاف حسب الاستخدام يبدأ من السعر القياسي البالغ $0.038 لكل ثانية. ابدأ البناء اليوم.

عرض العائلة

Seedream 5.0 Pro

يوفر واجهة برمجة التطبيقات Seedream 5.0 Pro API للمطورين نموذج تحرير الصور القابل للتحكم من ByteDance على Atlas Cloud. وهو يضع التعديلات بدقة باستخدام نقاط الإرساء والإحداثيات، ويفصل الصور إلى طبقات قابلة للتحرير، ويدمج مراجع متعددة، ويطابق الألوان والمواد الدقيقة، مع نص متعدد اللغات بدقة 2K و 3K. على Atlas Cloud، يمكنك الوصول إليه من خلال مفتاح واحد!

عرض العائلة

Seedance 2.0

Seedance 2.0 هو نموذج الفيديو المخصص للإنتاج من ByteDance لإنشاء اللقطات بدقة. حوّل المطالبات إلى فيديو، أو حرّك صورة الإطار الأول مع إمكانية توجيه اختيارية عبر الإطار الأخير، أو شكّل النتائج باستخدام الوسائط المرجعية والبحث الاختياري على الويب. يضم Atlas Cloud هذه التدفقات في API موحّد واحد، مع تسعير شفاف حسب الاستخدام ومفتاح واحد متوافق مع OpenAI. ابدأ البناء اليوم.

عرض العائلة

GPT Image 2.5

تمنح عائلة gpt-image-2.5 من OpenAI المطورين خيار استخدام Flare وSunburst في عمليات إنتاج الصور. نفّذ التصيير بدقة عشوائية تصل إلى 3840x2160، واختر من بين خمس درجات للجودة، بما في ذلك xhigh وmax، لتلبية متطلبات الإخراج المحددة. توفر Atlas Cloud استدلال REST جاهزًا للاستخدام من دون بدء تشغيل بارد، وبسعر قياسي يبدأ من $0.004 لكل عملية توليد. ابدأ البناء اليوم.

عرض العائلة

GPT Image 2

توفر واجهة برمجة تطبيقات GPT Image 2 للمطورين إمكانية الوصول إلى أحدث نموذج صور من OpenAI، وهو خليفة GPT Image 1.5. يقوم النموذج بإنشاء الصور وتعديلها مع عرض دقيق للنصوص عبر الحروف اللاتينية ونصوص CJK، بالإضافة إلى تكوين قوي للملصقات والنماذج المبدئية والرسوم البيانية (الإنفوجرافيك). على Atlas Cloud، يمكنك الوصول إليه من خلال واجهة برمجة تطبيقات موحدة بجانب أكثر من 300 نموذج، مع أرصدة مجانية، ووقت تشغيل بنسبة 99.99%، وبدون الحاجة إلى التحقق من مؤسسة OpenAI.

عرض العائلة

Gemini Omni Flash

توفّر Gemini Omni API للمطورين عائلة Gemini Omni Flash المتعددة الوسائط أصلاً من Google DeepMind، بما في ذلك Gemini Omni 1.1 Flash. أنشئ فيديو سينمائياً مع صوت أصلي متزامن، أو حرّك الصور الثابتة مع تحكّم دقيق في الإطارين الابتدائي والنهائي، أو عدّل اللقطات الموجودة عبر تعديلات موجّهة بالنص تحافظ على المحتوى الذي لم تطله التعديلات. توفّر Atlas Cloud مفتاحاً واحداً متوافقاً مع OpenAI، ووصولاً موحّداً، وتسعيراً شفافاً بنظام الدفع حسب الاستخدام. ابدأ التطوير اليوم.

عرض العائلة

Grok Imagine

يغطي Grok Imagine API نماذج xAI للصور والفيديو والكلام، من Image 2.0 إلى Video 1.5 و xAI TTS v1. صيّر صور ثابتة بدقة 1K و2K عبر 14 نسبة عرض إلى ارتفاع، أو مدّ مشهد لمدة 15 ثانية من الحركة بدقة 1080p، أو وجّه اللقطات باستخدام ما يصل إلى 7 صور مرجعية، أو أضفِ سرداً نصياً بـ 20 لغة. يشغل Atlas Cloud كل وضع على نقطة نهاية واحدة، بتسعير الدفع حسب الاستخدام من $0.02 لكل صورة و$0.05 لكل ثانية. ابدأ البناء اليوم.

عرض العائلة

Google

تتوفر أقوى النماذج الإبداعية من Google بالكامل على Atlas Cloud. يقدم Veo 3.1 توليد فيديو سينمائي، ويدعم Nano Banana 2 إنشاء صور عالية الدقة، ويجلب Gemini ذكاءً متعدد الوسائط لكل سير عمل. يمكنك الوصول إلى مجموعة نماذج Google الكاملة من خلال مفتاح API key واحد مع توفر Day-0 وتسعير الدفع حسب الاستخدام (pay-as-you-go).

عرض العائلة

Seedance 2.0 Mini

يجلب Seedance 2.0 Mini إنشاء مقاطع الفيديو متعددة الوسائط من ByteDance إلى مسارات العمل حيث تعتبر السرعة والتكلفة الأكثر أهمية. إنه يوفر القدرات الأساسية لـ Seedance 2.0 ببصمة أخف — إنشاء أسرع، وتكلفة أقل لكل مقطع فيديو، ونفس تكامل API الذي تستخدمه بالفعل. بالنسبة للفرق التي تدير مسارات عمل ذات حجم كبير أو تقوم بالنماذج الأولية على نطاق واسع، فإن Mini هو الخيار الافتراضي العملي.

عرض العائلة

ByteDance

من إنشاء مقاطع الفيديو السينمائية إلى توليد الصور عالية الدقة، أصبحت أقوى نماذج ByteDance متاحة الآن على Atlas Cloud. يمكنك تشغيل Seedance و Seedream على نطاق واسع بأقل أسعار للاستدلال وبدون أي أعباء إضافية للبنية التحتية.

عرض العائلة

واجهة برمجية واحدة لكل وسائط الذكاء الاصطناعي.

استكشف جميع النماذج