Seedance 2.5 متاح الآن — لأول مرة على Atlas Cloud
Hero background 1Hero background 2Hero background 3
Grok Imagine API for 15 Second Video

Grok Imagine API for 15 Second Video

يغطي Grok Imagine API نماذج xAI للصور والفيديو والكلام، من Image 2.0 إلى Video 1.5 و xAI TTS v1. صيّر صور ثابتة بدقة 1K و2K عبر 14 نسبة عرض إلى ارتفاع، أو مدّ مشهد لمدة 15 ثانية من الحركة بدقة 1080p، أو وجّه اللقطات باستخدام ما يصل إلى 7 صور مرجعية، أو أضفِ سرداً نصياً بـ 20 لغة. يشغل Atlas Cloud كل وضع على نقطة نهاية واحدة، بتسعير الدفع حسب الاستخدام من $0.02 لكل صورة و$0.05 لكل ثانية. ابدأ البناء اليوم.

Grok Imagine من تطوير xAI. توفّر Atlas Cloud (التي تُشغّلها Atlas Cloud AI LLC) إمكانية الوصول إليه ولا تملكه. جميع العلامات التجارية ملك لأصحابها المعنيين.

استكشف النماذج الرائدة

يوفر لك Atlas Cloud أحدث النماذج الإبداعية الرائدة في الصناعة.

كل نقاط نهاية Grok Imagine API، من الصور الثابتة إلى الصوت

طابق نموذج Grok Imagine API المناسب مع نوع الإدخال وطول الإخراج والدقة وسعر كل استدعاء.

الأسلوبالوصف
Grok Imagine Image 2.0 T2I API (Text to Image)اكتب موجه بما يصل إلى 8,000 حرف وستعيد نقطة النهاية من صورة واحدة إلى أربع صور بدقة 1K أو 2K. تتيح لك طبقات الجودة المنخفضة والمتوسطة المقارنة بين جهد التصيير والسرعة، بسعر $0.04 لكل صورة. مناسبة لاستكشاف المفاهيم والعناصر الإبداعية للوسائط الاجتماعية والإنتاج البصري الضخم.
Grok Imagine Image 2.0 Edit API (Image to Image)أرسل إلى نقطة النهاية ما يصل إلى ثلاث صور مرجعية مع تعليمات باللغة الطبيعية، وستعود النتائج المعدلة بدقة 1K أو 2K بنسبة العرض إلى الارتفاع المحددة أو تلقائياً. تنطبق نفس طبقات الجودة المنخفضة والمتوسطة، وتكلف كل صورة $0.04. إعادة صياغة المنتجات والتبديل الخلفي والتغييرات التصميمية السريعة تعمل من استدعاء واحد.
Grok Imagine Image Quality T2I API (Text to Image)عندما تكون الجودة العالية مهمة، تحول هذه النقطة موجهات النص إلى صور ثابتة متقنة بدقة 1K أو 2K وتعيد ما يصل إلى أربع متغيرات لكل طلب بسعر $0.05 لكل صورة. تغطي نسب العرض إلى الارتفاع الصيغ المربعة والعمودية والأفقية والفائقة العرض. استخدمها للصور البطلة والعناصر الإعلانية وتصاير المنتجات من فئة العلامات التجارية.
Grok Imagine Image Quality Edit API (Image to Image)أدخل من صورة واحدة إلى ثماني صور مصدر مع تعليمات التحرير واستقبل نسخاً منقحة بدقة 1K أو 2K بسعر $0.05 لكل صورة. يتم معالجة المراجع متعددة الصور مباشرة مثل <IMAGE_0> و <IMAGE_1>، لذا يمكن دمج الموضوعات والأنماط في تعليمة واحدة. تحديثات الحملات ونقل الأنماط والتعديلات المركبة هي الوظائف الشائعة.
Grok Imagine Image T2I API (Text to Image)تحتفظ نقطة النهاية الأصلية للنص إلى الصورة بإخراج 1K و 2K وتجميع أربع صور بأقل سعر صورة في العائلة، $0.02 لكل صورة. هذا يجعلها خياراً افتراضياً عملياً لخطوط الأنابيب عالية الحجم وإنشاء الصور المصغرة واختبار الموجهات بسرعة.
Grok Imagine Image Edit API (Image to Image)هل تحتاج تعديلات خفيفة بنطاق واسع؟ تقبل هذه النقطة من صورة واحدة إلى ثماني صور مع تعليمات نصية وتعيد ما يصل إلى أربع نتائج معدلة بدقة 1K أو 2K بسعر $0.02 لكل صورة. تنظيف الكتالوج والمتغيرات الموسمية والتمريرات التصميمية المتكررة تبقى رخيصة.
Grok Imagine Video v1.5 T2V API (Text to Video)موجه وحده ينتج من ثانية واحدة إلى خمس عشرة ثانية من الفيديو مع صوت متزامن أصلي بدقة 480p أو 720p أو 1080p، عبر سبع نسب عرض إلى ارتفاع. الفواتير بمعدل $0.08 لكل ثانية من الإخراج. المقاطع الدعائية والمقاطع الاجتماعية والمشاهد السردية التي تحتاج صوتاً مدمجاً تناسبها بشكل أفضل.
Grok Imagine Video v1.5 I2V API (Image to Video)قدم إطار بداية وموجه حركة، و v1.5 سيحركها لمدة تصل إلى خمس عشرة ثانية بدقة تصل إلى 1080p مع الصوت المُنشأ في نفس المسار. التكلفة $0.08 لكل ثانية. دورات المنتجات وتحريك الصور الشخصية وموارد الحملات من الثابت إلى الحركة تناسب هنا.
Grok Imagine Video v1.5 R2V API (Reference to Video)من صورة واحدة إلى سبع صور مرجعية توجه الشخصيات والأشياء والأسلوب على الشاشة، بينما تقود ما يصل إلى ثلاث أصوات مختارة من 26 إعداد مسبق الصوت المنطوق. يصل الإخراج إلى خمس عشرة ثانية بدقة 480p أو 720p بسعر $0.08 لكل ثانية. سرد القصص المتسق في الشخصيات والتجربة الافتراضية والعلامات التجارية المميزة تستفيد أكثر.
Grok Imagine Video T2V API (Text to Video)موجهات النص تصبح مقاطع من ثانية واحدة إلى خمس عشرة ثانية بدقة 480p أو 720p، مع سبع نسب عرض إلى ارتفاع تغطي الصيغ الأفقية والمربعة والعمودية. بسعر $0.05 لكل ثانية، هو خيار القيمة للمحتوى الاجتماعي ولوحات المفاهيم السريعة.
Grok Imagine Video I2V API (Image to Video)ثبت صورة ثابتة كإطار أول، صف الحركة التي تريدها، والمقطع يمتد إلى خمس عشرة ثانية بدقة 480p أو 720p. السعر يبقى عند $0.05 لكل ثانية، وهذا يحافظ على تحريك الصور المنتجات والصور الشخصية بكميات كبيرة برسوم معقولة.
Grok Imagine Video R2V API (Reference to Video)بين صورة واحدة وسبع صور مرجعية توجه من وماذا يظهر على الشاشة دون تحديد إطار افتتاح ثابت. تعمل المقاطع لمدة تصل إلى عشر ثوان بدقة 480p أو 720p وتكلف $0.05 لكل ثانية. استخدمها عندما يجب أن تظل الهوية والأسلوب متسقة من لقطة إلى أخرى.
Grok Imagine Video Extend API (Video Extension)يمكن متابعة ملف mp4 موجود من ثانيتين إلى خمس عشرة ثانية بمدة أخرى من ثانيتين إلى عشر ثوان، موجهة بموجه يحدد ما يحدث بعد ذلك. يطابق الإخراج الفيديو المصدر ومحدود عند 720p، مع الفواتير بمعدل $0.07 لكل ثانية. وهو مفيد لتمديد مقطع قصير إلى طول إعلان مطلوب.
Grok Imagine Video Edit API (Video to Video)تعليمات باللغة الطبيعية تعيد كتابة ملف mp4 موجود بينما تبقى المشهد الأصلي والحركة والإطار سليمة. يحافظ الإخراج على المدة المصدر، محدود بـ 8.7 ثانية، والفواتير تتبع الفيديو الإدخال بسعر $0.07 لكل ثانية. إضافات الدعائم وتغييرات خزانة الملابس وإعادة التصميم تحدث دون إعادة تصوير.
xAI TTS v1 API (Text to Speech)ما يصل إلى 15,000 حرف من النص يصبح كلام طبيعي بزمن انتقال تحت الثانية عبر 20 لغة، مع كشف اللغة التلقائي المتاح. الإيصال قابل للضبط: سرعة التشغيل من 0.7x إلى 1.5x، والعاهدات بما فيها mp3 و wav و pcm، ومعدلات العينات حتى 48 kHz. الراويات والتنبيهات IVR والسرد في التطبيق هي الخيارات الطبيعية.

كيف يغطي Grok Imagine API الصور والفيديو والكلام

يُلبي كل جزء من Grok Imagine API حاجة إنتاجية مختلفة؛ حيث يغطي الصور الثابتة بدقة 2K عبر 14 نسبة عرض إلى ارتفاع، والتحرير الموجه بالمرجع، والفيديو الذي يحمل صوتاً متزامناً خاصاً به، والكلام بـ20 لغة.

توليد الصوت والحركة في مرحلة واحدة

توليد الصوت والحركة في مرحلة واحدة

يُنتج الحوار والأجواء الموسيقية والموسيقى في نفس المرحلة مع الحركة، لذا تصل المقاطع حتى 15 ثانية متزامنة مسبقاً. لا حاجة لمرحلة منفصلة لتأليف الموسيقى أو الدبلجة قبل النشر.

تفاصيل 2K عبر 14 نسبة عرض إلى ارتفاع في Grok Imagine API

تفاصيل 2K عبر 14 نسبة عرض إلى ارتفاع في Grok Imagine API

يُحافظ Grok Imagine Image 2.0 على الملمس الفوتو واقعي بدقة 1K أو 2K عبر 14 نسبة عرض إلى ارتفاع، مع مستويي جودة منخفض ومتوسط بسعر 0.04 دولار لكل صورة. يغطي التوليد الواحد لافتات البطل، وقصاصات الطباعة، واللقطات القريبة.

من الصورة الثابتة إلى اللقطة المتحركة

من الصورة الثابتة إلى اللقطة المتحركة

أدخل صورةً ويثبّت Grok Imagine Video v1.5 الإطار الافتتاحي، ثم يبني الحركة حوله بدقة تصل إلى 1080p. تتحول لقطات الكتالوج والصور الشخصية إلى عروض بورتفوليو دون أي إعادة تصوير.

تحرير متعدد الصور في Grok Imagine API

تحرير متعدد الصور في Grok Imagine API

يمكن تحرير ما يصل إلى ثلاث صور مرجعية معاً بدقة 1K أو 2K، مع تغيير التعليمات بلغة طبيعية العناصر التي تذكرها فقط. بسعر 0.04 دولار لكل تعديل، تبقى تكرارات التصميم ومجموعات المتغيرات المتوافقة مع العلامة التجارية منخفضة التكلفة.

شخصيات تحافظ على هويتها من إطار إلى آخر

شخصيات تحافظ على هويتها من إطار إلى آخر

تحمل من واحد إلى سبع صور مرجعية الشخصيات والقطع والأسلوب إلى مقاطع تصل إلى 15 ثانية، دون إطار بداية ثابت. تتيح تجربة الارتداء الافتراضية، ووضع المنتجات، والمسلسلات المدفوعة بالشخصيات مظهراً واحداً قابلاً للتعريف.

كلام تعبيرِيّ بـ20 لغة مع Grok Imagine API

كلام تعبيرِيّ بـ20 لغة مع Grok Imagine API

يُضم xAI TTS v1 داخل المجموعة نفسها، محوّلاً النص إلى كلام تعبيرِيّ عبر 20 لغة بزمن استجابة أقل من ثانية. اربطه بالفيديو المُولَّد للحصول على فيديوهات شرح مُعلَقة، وإعلانات محلية، ومساعدات داخل التطبيق.

اختيار الصوت وضبط التسليم

اختيار الصوت وضبط التسليم

التحكم الدقيق في الإيقاع والتأكيد والنبرة يُشكّل كل قراءة، ويجعل استماع العينة شبه فوري بفضل زمن التوليد الأقل من ثانية. عبر أكثر من 80 صوتاً، يغطي محرك واحد الكتب الصوتية، والدبلجة، وحوارات الشخصيات.

مُحَـوِّلةٌ وَاحِدَة، وَثَلَاثَة نَمَاذِج: واجهة Grok Imagine API جَانِبًا إِلَى جَانِب

تُشغِّل كُل صَفٍّ المُحَوِّلَ نَفْسَهُ عَبْر واجهة Grok Imagine API واثنين مِنَ النُّمُوذَجَيْنِ المُتَنَافِسَيْنِ عَلَى Atlas Cloud، لِتُقَاسَ الحَرَكَـة، تَطَابُق الصَّوْت، التَّفْصِيل، وَالطِّبَاقَة عَلَى أَسَاسٍ سَوِيٍّ.

الموجه

صُورَةٌ مَكْرُوسَكوبِيَّةٌ مُتَطَرِّفَةٌ مُصَوَّرَةٌ عَلَى مُسْتَوَى الطَّاوِلَةِ، وَعْدَسَةُ الْكَامِيرَا مُسْتَوِيَةً عَلَى السَّطْحِ الْخَشَبِيِّ لِلْمَكْتَبِ عَلَى ارْتِفَاعِ عَيْنِ شَخْصٍ مِقْيَاسِهِ 1:64، تَنْظُرُ أُفُقِيًّا عَبْرَ مَكْتَبِ عَمَلِ نَمَاذِجٍ صَغِيرٍ فِي اللَّحْظَةِ الدَّقِيقَةِ الَّتِي يَصْدُرُ فِيهَا خَدَعَةُ الْحَجْمِ كَحَقِيقَةٍ. فِي الْوَسَطِ، مَوْجَةٌ مِنْ قَطْرَانِ الإيبُوكْسِيّ مُزَيَّفِ الْلَّوْنِ الْأَزْرَقِ تَوَقَّفَتْ نِصْفَ انْقِشَارِهَا، وَسَطْحُهَا مُرَشُوشٌ بِالْمُرَشَّاشِ الْمَائِيِّ حَتَّى تَتَكَوَّرُ الْقَطَرَاتُ الْحَقِيقِيَّةُ وَتَلْتَصِقُ بِالْقَطْرَانِ اللَّامِعِ؛ ثَلَاثَةُ رَاكِبِي أَمْوَاجٍ صِغَارٍ مَرْسُومِينَ بِأَيْدٍ بِبِطُونِ سَبَاحٍ بَرَّاقَةٍ بِلَوْنٍ أَورَاجِيّ يَنْزِلُونَ وَجْهَةَ الْمَوْجِ الْمُتَوَقِّفِ، وَاحِدٌ مُنْحَنٍ مُنْخَفِضًا بِذِرَاعٍ تَسْحَبُ فِي الْقَطْرَانِ، وَرَشَّاشَةٌ مِنْ قَطَرَاتِ مَاءٍ حَقِيقِيَّةٍ تَنْطَرِحُ مِنْ شَفَّةِ الْمَوْجِ، مُتَوَقِّفَةٌ حَادَّةٌ فِي الْهَوَاءِ مَعَ بَرَاوِقَ صِغَارٍ عَلَى كُلِّ حَافَّةِ قَطْرَةٍ. وَرَاءَهُمْ، بِخُرُوجٍ نَاعِمٍ مِنَ الْوَضْعِ، يَدُ صَانِعَةِ نَمَاذِجٍ شَابَّةٍ تَحُومُ فِي الْهَوَاءِ حَامِلَةً مَلْعَقَتَيْنِ مِطْفَرِيَّتَيْنِ دَقِيقَتَيْنِ، مُعَلَّقَةٌ وَضَخْمَةٌ كَأَنَّهَا جَارَةٌ تَمَرَّدَتْ إِلَى الْعَالَمِ الَّذِي بَنَتْهُ؛ وَفقط النِّصْفُ السُّفْلِيُّ مِنْ وَجْهِهَا ظَاهِرٌ فِي أَعْلى الْإطَارِ، وَزَاوِيَةُ شَفَتِهَا مُنْحَنِيَةً إِلَى ضَحْكَةٍ صَغِيرَةٍ مَسْرُورَةٍ، كُلُّ ذَلِكَ ذَابًا فِي بُوكِهَةٍ كَرِيمِيَّةٍ. شَمْسُ مَا بَعْدَ الظُّهْرِ الصَّارِمَةُ تَخْتَرِقُ سُدَّادَاتِ فِنِيدِيَان، مُصَوِّرَةً صُفُوفًا مِنْ أَشْرِبَةِ ضَوْءٍ مَائِلَةٍ نَظِيفَةٍ وَظِلَالٍ نَقِيَّةٍ عَبْرَ الْخَشَبِ الْعَارِيّ وَعَلَى بَحْرِ الْقَطْرَانِ، مُخَطِّطَةً أَكْمُشَ رَاكِبِي الْأَمْوَاجِ. قِطْعَةٌ صَغِيرَةٌ مُتَسَاقِطَةٌ خَارِجَةٌ مِنَ الْوَضْعِ — شِقَّةُ رَشْحٍ بَلَسْتِيكِيّ ضَالَّةٌ — تَجْلِسُ فِي الْأَمَامِ الْبَعِيدِ كَطَبَقَةٍ مُغْطِيَةٍ ضَبْلَاءَ فِي الزَّاوِيَةِ السُّفْلِيَّةِ الْيُسْرَى، مُفَرِّقَةً الْمَسْتَوِيَاتِ؛ أَشْرِبَةٌ مِنْ لِسَانِ لَصْقٍ أَزْرَقٍ تُحِيطُ بِبَحْرِ الْقَطْرَانِ، وَحَيْدَةٌ سَلْبِيَّةٌ مُتْرَكَةٌ عَلَى الْجَانِبِ الْأَيْمَنِ لِلسَّنَادِسِ الْمُتَوَقِّفَةِ. لَوْنٌ مُتَمِمٌ بَيْنَ الْأُورَاجِيّ وَالْأَزْرَقِ: قَطْرَانٌ أَزْرَقُ مُبْتَلٌّ وَلِسَانُ لَصْقٍ أَزْرَقُ ضِدَّ بِطُونٍ أَورَاجِيَّةٍ دَافِئَةٍ، مُثَبَّتَةٌ بِلَوْنِ عَسَلٍ دَافِئٍ لِلْمَكْتَبِ الْخَشَبِيِّ. مُصَوَّرٌ بِعَدْسَةٍ مَكْرُوسَكوبِيَّةٍ 100mm f/2.8، عُمْقُ مَجَالٍ ضَحِلّ مُتَطَرِّفٌ مَعَ تَدَرُّجِ وُضُوحٍ كَالزُّبْدَةِ، انْضِغَاطُ التِّيلِيْفُوتُو مِنْ مَوْقِعِ كَامِيرَا مُنْخَفِضٍ جِدًّا، حَبُوبَةُ فِيلْمٍ دَقِيقَةٌ ظَاهِرَةٌ، وَاقِعِيَّةٌ صُورِيَّةٌ حَقِيقِيَّةٌ، لَا رَسْمٌ، لَا مَظهَرُ CGI. نِسْبَةُ أَجْهَزَةٍ عَرِيضَةٌ 16:9، تَرْكِيبٌ أُفُقِيّ مُتَمَدِّدٌ.

Generated with Grok Imagine Video v1.5 on Atlas Cloud

Generated with Veo3.1 on Atlas Cloud

Generated with Grok Imagine Video on Atlas Cloud

الموجه

Extreme macro photograph shot at tabletop level, camera lens resting flat on the wooden desk surface at the eye height of a 1:64 scale figure, looking horizontally across a miniature modeling workbench in the exact instant the illusion of scale becomes real. In the mid-ground, a wave of blue-tinted epoxy resin has been frozen mid-curl, its surface just misted with a water sprayer so genuine droplets bead and cling to the glossy resin; three tiny hand-painted surfers in bright orange swim trunks ride down the face of the frozen wave, one crouched low with an arm dragging through the resin, and a spray of real water beads flings off the wave's lip, caught sharp in mid-air with tiny burst highlights on every droplet edge. Behind them, softly out of focus, the hand of a young woman modelmaker hovers in the air holding fine steel tweezers, suspended and enormous like a giant who has wandered into the world she built; only the lower half of her face is visible at the top of the frame, the corner of her mouth curved into a small delighted smile, all of it dissolved into creamy bokeh. Late-afternoon hard sunlight cuts through venetian blinds, painting a row of crisp diagonal light bars and clean shadows across the bare wood and over the resin sea, striping the surfers' shoulders. A single dropped, out-of-focus miniature part — a stray plastic sprue fragment — sits in the extreme foreground as a blurred occluding layer at the lower left, separating planes; strips of blue masking tape edge the resin sea, and negative space is left on the right side for the hovering tweezers. Complementary orange-and-blue palette: cool blue resin and blue tape against warm orange trunks, grounded by the warm honey tone of the oak desk. Shot on 100mm f/2.8 macro lens, ultra-shallow depth of field with buttery focus falloff, telephoto compression from an ultra-low camera position, visible fine film grain, true photographic realism, no illustration, no CGI look. Wide 16:9 aspect ratio, full-bleed horizontal composition.

Generated with Grok Imagine Image 2.0 on Atlas Cloud

Generated with Grok Imagine Image 2.0 on Atlas Cloud

Generated with Seedream v5.0 Pro on Atlas Cloud

Generated with Seedream v5.0 Pro on Atlas Cloud

Generated with Grok Imagine Image Quality on Atlas Cloud

Generated with Grok Imagine Image Quality on Atlas Cloud

ابنِ عبر الصور والفيديو والصوت باستخدام Grok Imagine API

كل سير عمل أدناه يعمل بمفتاح واحد متوافق مع OpenAI، مما يتيح للفريق نقل مفهوم ما عبر مسودات صور Grok Imagine API، وتعديلات مرجعية، وفيديو بصوت متزامن، وسرد مترجم دون تغيير التقنيات المستخدمة.

التكرار السريع للمفاهيم مع Grok Imagine API

تُرجع Image 2.0 ما يقرب من ألف مسودة في نحو عشر ثوانٍ على طبقة الجودة المنخفضة، وتُنتج حتى أربعة متغيرات لكل استدعاء. تفتش فرق التصميم العديد من الاتجاهات مبكرًا، ثم تعيد التصيير للفائز بدقة 2K.

تركيبات منتجات متعددة المراجع

أدخل حتى ثلاث صور مرجعية إلى Grok Imagine Image 2.0 Edit ووصف التغيير باللغة العادية. تبادل فرق التجارة الإلكترونية الخلفيات، وتُعيد تصميم عبوات المنتجات، وتحافظ على اتساق منتج واحد عبر كتالوج كامل.

التعليق الصوتي والسرد متعدد اللغات

يحوّل xAI TTS v1 النصوص إلى كلام تعبيرِي عبر عشرين لغة وأكثر من ثمانين صوتًا بزمن استجابة أقل من ثانية. تدمج فرق المنتجات هذه الميزة مع الفيديو المُولَّد لإعلانات وسيناريوهات تعليمية وسرد داخلي في التطبيق، كلها مُكيَّفة للغة المستهدفة.

فيديو Grok Imagine API مع صوت أصلي

تكتب Grok Imagine Video v1.5 موسيقى ومؤثرات وحوار متزامنة مع الصورة في مقاطع تصل إلى خمسة عشر ثانية بدقة 1080p. يحصل المسوقون على إعلان جاهز في عملية واحدة، دون جلسة صوت منفصلة.

سرد قصصي متسق الشخصيات عبر Grok Imagine API

تحتاج نفس الشخصية في كل لقطة؟ يقبل Reference-to-video من صورة مرجعية واحدة إلى سبع صور، بالإضافة إلى صوت مرجعي اختياري، مما يسمح لصناع المسلسلات بالحفاظ على هوية الشخصية ونبرة صوتها ثابتة عبر مقطع مدته خمسة عشر ثانية.

ما بعد الإنتاج دون إعادة تصوير

يمكن إعادة تصيير اللقطات الموجودة عبر تعديل بلغتها الطبيعية، أو إكمالها بتمديد مدته من ثانيتين إلى عشر ثوانٍ يتطابق مع المصدر. تصلح فرق ما بعد الإنتاج العناصر والملابس والإيقاع دون العودة إلى موقع التصوير.

مقارنة النماذج

شاهد كيف تتقارن نماذج مختلف المزودين — قارن الأداء والأسعار ونقاط القوة الفريدة لاتخاذ قرار مدروس.

النموذجحد صورة المرجععدد المخرجاتالدقةنسبة العرض إلى الارتفاع
Grok Imagine Image Quality81~42K, 1Kتلقائي, 1:1, 3:2, 2:3, 3:4, 4:3, 9:16, 16:9, 9:19.5, 19.5:9, 9:20, 20:9, 1:2, 2:1
Nano Banana 21414K, 2K, 1K1:1, 3:2, 2:3, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9, 21:9
Nano Banana Pro1014K, 2K, 1K1:1, 3:2, 2:3, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9, 21:9
Seedream 5.0 Lite141~152K~4K+1:1, 3:2, 2:3, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9, 21:9
Qwen-Image31~6512P~2KWidth[512, 2048]px, Height[512, 2048]px

كيفية استخدام Grok Imagine على Atlas Cloud

Get started in minutes — follow these simple steps to integrate and deploy models through Atlas Cloud’s platform.

إنشاء حساب Atlas Cloud

سجّل في atlascloud.ai وأكمل التحقق. يحصل المستخدمون الجدد على رصيد مجاني لاستكشاف المنصة واختبار النماذج.

لماذا تستخدم Grok Imagine على Atlas Cloud

دمج نماذج Grok Imagine المتقدمة مع منصة Atlas Cloud المسرّعة بـ GPU يوفر أداءً لا مثيل له وقابلية للتوسع وتجربة مطور استثنائية.

الأداء والمرونة

زمن انتقال منخفض:
استدلال محسّن لـ GPU للاستجابة في الوقت الفعلي.

API موحد:
قم بتشغيل Grok Imagine و GPT و Gemini و DeepSeek من خلال تكامل واحد.

تسعير شفاف:
فواتير يمكن التنبؤ بها لكل رمز مع خيارات بدون خادم.

المؤسسات والتوسع

تجربة المطور:
SDKs والتحليلات وأدوات الضبط الدقيق والقوالب.

الموثوقية:
وقت تشغيل 99.99%، RBAC، وتسجيل جاهز للامتثال.

الأمان والامتثال:
SOC 2 Type II، توافق HIPAA، سيادة البيانات في الولايات المتحدة.

الأسئلة التي يطرحها المطورون حول Grok Imagine API

تُعد Grok Imagine API نقطة الوصول الموحدة من Atlas Cloud إلى مجموعة توليد Grok Imagine الخاصة بـ xAI، حيث تغطي إنشاء الصور وتحريرها والفيديو والنطق. مفتاح واحد يتيح الوصول إلى جميع الأوضاع، بما في ذلك أحدث نماذج Grok Imagine Image 2.0 Text-to-Image وGrok Imagine Image 2.0 Edit التي أُصدرت في 7 أغسطس 2026. الفوترة تكون حسب الاستخدام لكل عملية توليد ناجحة، لذا تدفع مقابل كل طلب دون اشتراك.

تتوفر ثلاثة أجيال من الصور جنبًا إلى جنب: Grok Imagine Image بسعر 0.02 دولار لكل صورة، وGrok Imagine Image Quality بسعر 0.05 دولار، وGrok Imagine Image 2.0 ابتداءً من 0.04 دولار، وكل منها مجهز بنقطة تحرير خاصة به. أما الفيديو فيعمل عبر Grok Imagine Video بسعر 0.05 دولار للثانية وGrok Imagine Video v1.5 بسعر 0.08 دولار للثانية، مع نقاط تمديد وتحرير بجانبها. ويكمل المجموعة xAI TTS v1 بأكثر من 80 صوتًا عبر 20 لغة.

تخطط Image 2.0 للطباعة والتخطيط كما يفعل المصمم، لذا تظل التكوينات الكثيفة والنصوص الصغيرة مقروءة بدلاً من أن تتحول إلى نسيج. كما تتوفر فيها طبقة جودة قابلة للاختيار، مما يتيح لك المقارنة بين وقت التقديم والدقة لنفس المطالبة، وهو ما لا تقدمه نماذج Image وImage Quality السابقة. ويشارك كل من متغيري Text-to-Image وEdit هذا السلوك.

السعر يُحسب لكل عملية توليد ناجحة دون الحد الأدنى. Grok Imagine Image 2.0 بسعر 0.04 دولار للصورة عند الجودة المنخفضة و1K، و0.06 دولار عند الجودة المنخفضة مع 2K أو الجودة المتوسطة مع 1K، و0.08 دولار عند الجودة المتوسطة مع 2K، بينما تضيف كل صورة مدخلة على نقطة Edit 0.01 دولار. بالنسبة لنماذج الصور الأخرى، Grok Imagine Image بسعر 0.02 دولار للصورة وGrok Imagine Image Quality بسعر 0.05 دولار، ويبدأ الفيديو من 0.05 دولار للثانية.

أنشئ مفتاح Grok Imagine API من Atlas Cloud، ثم أرسل طلبك ومعرف النموذج مثل xai/grok-imagine-image-2.0/text-to-image إلى نقطة توليد الصور. التقديم غير متزامن، لذا يعيد الطلب معرف طلب تقوم باستفساره على نقطة التنبؤ حتى يتحول حالته من معالجة إلى مكتمل. وبما أن كل نماذج Grok Imagine تتبع نفس النمط، فإن إضافة الفيديو أو النطق لاحقًا يعني تغيير سلسلة واحدة فقط. ابدأ البناء اليوم.

تُقدم المخرجات بدقة 1K (1024×1024) أو 2K (2048×2048) عبر 14 نسبة عرض، من المربع 1:1 والشاشة العريضة 16:9 إلى الطولي 9:20 واللافتة فائقة الاتساع 20:9. يمكن للطلب الواحد إرجاع ما يصل إلى أربع صور، ويمكن أن تصل المطالبات إلى 8000 حرف. على نقطة Edit، تكون نسبة العرض التلقائية وتلتقط صورة الإدخال الأولى ما لم تحدد ذلك صراحةً.

حتى ثلاث صور مصدرية لكل طلب، تُقدم كروابط URL عامة أو بيانات base64. عند تمرير أكثر من واحدة، اذكرها في المطالبة كـ <IMAGE_0> و<IMAGE_1> و<IMAGE_2> حتى يعرف النموذج أي أصل تنطبق عليه كل تعليمات. تضيف كل صورة مدخلة 0.01 دولار إلى الطلب، ويمكنك طلب واحد إلى أربعة متغيرات معدلة في كل مرة.

نعم. ينتج Grok Imagine Video v1.5 صوتًا أصليًا ومتزامنًا في نفس المرور مع الصورة، لذا تتزامن الموسيقى والمؤثرات الصوتية والحوار مع الحركة بدلاً من الحاجة إلى خط أنابيب ثانٍ. يقبل وضعه من مرجع إلى فيديو صوت مرجعي اختياريًا إلى جانب واحد إلى سبعة صور مرجعية. تصل المقاطع إلى 15 ثانية، بدرجة 1080p على النص إلى فيديو والصورة إلى فيديو.

اختر Image 2.0 عندما يحمل الإطار طباعة أو تخطيطًا أو تفاصيل متعددة الأجزاء يجب أن تبقى متماسكة، وعندما تريد تحكمًا مباشرًا في المقايضة بين السرعة والدقة. يبقى Grok Imagine Image Quality بسعر موحد بسيط قدره 0.05 دولار للصورة مع نفس مخرجات 1K و2K ونسب العرض الـ 14. إذا كان الحجم أهم من النصوص الدقيقة، يظل Grok Imagine Image الأصلي بسعر 0.02 دولار للصورة هو الخيار الأكثر اقتصادية.

المتوسط هو طبقة الجودة الافتراضية ويستغرق حوالي 84 ثانية عند 1K لأنه يستهدف أفضل مخرجات النموذج. تعيين الجودة إلى منخفض يخفض ذلك إلى حوالي 10 ثوانٍ، أي أسرع بحوالي 8 مرات، بسعر 0.04 دولار بدلاً من 0.06 دولار لصورة 1K. صمم وتكرّر بالجودة المنخفضة، ثم أعد تشغيل المطالبات الفائزة فقط بالمتوسطة و2K بمجرد استقرار التكوين.

استكشف المزيد من العائلات

Seedance 2.5

واجهة برمجة تطبيقات Seedance 2.5 متاحة الآن على Atlas Cloud! توفر للمطورين أحدث نموذج فيديو من ByteDance. يمكن للنموذج إنشاء ما يصل إلى 30 ثانية من الفيديو الأصلي في مسار واحد من نص، أو صورة واحدة، أو ما يصل إلى 50 مرجعاً متعدد الوسائط، مع صوت متزامن ونص متعدد اللغات داخل الإطار. على Atlas Cloud، يمكنك الوصول إليه من خلال مفتاح واحد، مع الحفاظ على تناسق الموضوع والفيزياء المحسنة التي تحافظ على تماسك اللقطات الطويلة.

عرض العائلة

MiniMax H3

تتيح MiniMax H3 API الوصول إلى نموذج الفيديو العام متعدد الوسائط من MiniMax، الذي يقرأ النصوص والصور والفيديو والصوت كسياق واحد بدلًا من التعامل مع مهمة واحدة في كل مرة. تعمل المقاطع لمدة من 5 إلى 15 ثانية بمعدل 24 FPS عبر نسب أبعاد من 21:9 إلى 9:16، ويمكن لمطالبة واحدة تبديل الشخصيات أو استبدال الخلفيات أو إعادة كتابة الحوار أو استنساخ صوت من مقطع مرجعي. تقدم Atlas Cloud كل ذلك عبر نقطة نهاية واحدة متوافقة مع OpenAI. ابدأ التطوير اليوم.

عرض العائلة

Seedream 5.0 Pro

يوفر واجهة برمجة التطبيقات Seedream 5.0 Pro API للمطورين نموذج تحرير الصور القابل للتحكم من ByteDance على Atlas Cloud. وهو يضع التعديلات بدقة باستخدام نقاط الإرساء والإحداثيات، ويفصل الصور إلى طبقات قابلة للتحرير، ويدمج مراجع متعددة، ويطابق الألوان والمواد الدقيقة، مع نص متعدد اللغات بدقة 2K و 3K. على Atlas Cloud، يمكنك الوصول إليه من خلال مفتاح واحد!

عرض العائلة

Seedance 2.0

تمنحك واجهة برمجة تطبيقات Seedance 2.0 وصولاً إنتاجيًا إلى نموذج الفيديو متعدد الوسائط من ByteDance — إدخالات رباعية الوسائط (نص، صورة، فيديو، صوت) ونظام "Universal Reference" الرائد في الصناعة والذي يثبت التكوين وحركة الكاميرا وإجراءات الشخصيات عبر اللقطات. قم بدمج تحكم على مستوى المخرج من خلال استدعاء API واحد، بسعر ثابت قدره 0.09 دولار/ثانية، ومفتاح فوري، وبدون قائمة انتظار — مدعومًا بوقت تشغيل وامتثال على مستوى المؤسسات. Seedance 2.0 Native 4K متاح الآن!

عرض العائلة

GPT Image 2

توفر واجهة برمجة تطبيقات GPT Image 2 للمطورين إمكانية الوصول إلى أحدث نموذج صور من OpenAI، وهو خليفة GPT Image 1.5. يقوم النموذج بإنشاء الصور وتعديلها مع عرض دقيق للنصوص عبر الحروف اللاتينية ونصوص CJK، بالإضافة إلى تكوين قوي للملصقات والنماذج المبدئية والرسوم البيانية (الإنفوجرافيك). على Atlas Cloud، يمكنك الوصول إليه من خلال واجهة برمجة تطبيقات موحدة بجانب أكثر من 300 نموذج، مع أرصدة مجانية، ووقت تشغيل بنسبة 99.99%، وبدون الحاجة إلى التحقق من مؤسسة OpenAI.

عرض العائلة

Gemini Omni Flash

يجلب Gemini Omni API إلى بنيتك التقنية نموذج التوليد والتحرير متعدد الوسائط للفيديو من Google DeepMind، الذي أُعلن عنه في Google I/O 2026. يدمج Gemini Omni محرك الاستدلال في Gemini مع الوسائط التوليدية، ويقبل أي مزيج من النصوص والصور والفيديو والصوت لإنتاج مخرجات متسقة ومستندة إلى المعرفة. حسّن النتائج عبر محادثة طبيعية: استبدل العناصر، وأعد كتابة المشاهد، وغيّر الأنماط، مع بقاء الفيزياء والشخصيات والاستمرارية سليمة دون أي خلل. توفر Atlas Cloud تشكيلة Gemini Omni Flash الكاملة — تحويل النص إلى فيديو، وتحويل الصورة إلى فيديو مع ما يصل إلى 7 صور مرجعية، وتحويل المرجع إلى فيديو — عبر واجهة API موحدة بتسعير شفاف لكل ثانية يبدأ من $0.112 ومن دون اشتراك. ابدأ البناء اليوم.

عرض العائلة

Grok Imagine

يغطي Grok Imagine API نماذج xAI للصور والفيديو والكلام، من Image 2.0 إلى Video 1.5 و xAI TTS v1. صيّر صور ثابتة بدقة 1K و2K عبر 14 نسبة عرض إلى ارتفاع، أو مدّ مشهد لمدة 15 ثانية من الحركة بدقة 1080p، أو وجّه اللقطات باستخدام ما يصل إلى 7 صور مرجعية، أو أضفِ سرداً نصياً بـ 20 لغة. يشغل Atlas Cloud كل وضع على نقطة نهاية واحدة، بتسعير الدفع حسب الاستخدام من $0.02 لكل صورة و$0.05 لكل ثانية. ابدأ البناء اليوم.

عرض العائلة

Google

تتوفر أقوى النماذج الإبداعية من Google بالكامل على Atlas Cloud. يقدم Veo 3.1 توليد فيديو سينمائي، ويدعم Nano Banana 2 إنشاء صور عالية الدقة، ويجلب Gemini ذكاءً متعدد الوسائط لكل سير عمل. يمكنك الوصول إلى مجموعة نماذج Google الكاملة من خلال مفتاح API key واحد مع توفر Day-0 وتسعير الدفع حسب الاستخدام (pay-as-you-go).

عرض العائلة

Seedance 2.0 Mini

يجلب Seedance 2.0 Mini إنشاء مقاطع الفيديو متعددة الوسائط من ByteDance إلى مسارات العمل حيث تعتبر السرعة والتكلفة الأكثر أهمية. إنه يوفر القدرات الأساسية لـ Seedance 2.0 ببصمة أخف — إنشاء أسرع، وتكلفة أقل لكل مقطع فيديو، ونفس تكامل API الذي تستخدمه بالفعل. بالنسبة للفرق التي تدير مسارات عمل ذات حجم كبير أو تقوم بالنماذج الأولية على نطاق واسع، فإن Mini هو الخيار الافتراضي العملي.

عرض العائلة

ByteDance

من إنشاء مقاطع الفيديو السينمائية إلى توليد الصور عالية الدقة، أصبحت أقوى نماذج ByteDance متاحة الآن على Atlas Cloud. يمكنك تشغيل Seedance و Seedream على نطاق واسع بأقل أسعار للاستدلال وبدون أي أعباء إضافية للبنية التحتية.

عرض العائلة

Alibaba

تجمع Atlas Cloud مجموعة نماذج Alibaba الكاملة ضمن API واحد: Qwen لمهام اللغة والصورة، و Wan لإنشاء مقاطع الفيديو بدقة تصل إلى 1080p. يمكنك الوصول إلى كل نموذج بنظام الدفع حسب الاستخدام (pay-as-you-go) دون أي اشتراكات. تتوفر Alibaba API عبر عنوان URL أساسي واحد باستخدام عميلك الحالي المتوافق مع OpenAI.

عرض العائلة

OpenAI

تمنحك Atlas Cloud إمكانية الوصول إلى مجموعة API الكاملة من OpenAI، بدءًا من GPT Image 2 لتوليد الصور وحتى Sora 2 للفيديو. يتوفر كل نموذج بنظام الدفع حسب الاستخدام بدون أي التزام شهري. يمكنك الربط بسهولة عن طريق تبديل عنوان URL الأساسي باستخدام الـ API المتوافق مع OpenAI.

عرض العائلة

واجهة برمجية واحدة لكل وسائط الذكاء الاصطناعي.

استكشف جميع النماذج