Seedance 2.5 متاح الآن — لأول مرة على Atlas Cloud
Hero background 1Hero background 2Hero background 3

MAI Image 2.5 API for Accurate In-image Text

توفّر واجهة برمجة التطبيقات MAI Image 2.5 API عائلة Microsoft لتوليد الصور الواقعية وتحريرها عبر endpoint واحد، وتشمل text-to-image والتحرير بإصداري Standard وFlash. وإلى جانب النص الموثوق داخل الصور، تُنتج صورًا شخصية طبيعية وتطبّق الاستدلال البصري للحفاظ على اتساق تخطيط المشهد. تقدّم Atlas Cloud تسعيرًا حسب الاستخدام يبدأ من $0.03 لكل صورة، مع وصول Day-0 ومفتاح واحد متوافق مع OpenAI.

استكشف النماذج الرائدة

يوفر لك Atlas Cloud أحدث النماذج الإبداعية الرائدة في الصناعة.

قارن بين كل نقطة نهاية في MAI Image 2.5 API حسب النمط والسعر

تغطي أربع نقاط نهاية توليد الصور من النص وتحرير الصور، ويتوفر كل منها بفئة قياسية وفئة Flash مع تسعير شفاف لكل استدعاء.

النمطالوصف
MAI Image 2.5 API (Text to Image)حوّل الأوامر النصية باللغة الطبيعية إلى صور عالية الجودة وغنية بصريًا باستخدام نموذج Microsoft الرائد لتوليد الصور من النص. يستهدف المرئيات التسويقية، وتصوير منتجات التجارة الإلكترونية، وأعمال التصميم التجاري التي تحتاج إلى مخرجات جاهزة للإنتاج. السعر $0.05 لكل صورة.
MAI Image 2.5 Flash (Text to Image)عندما تكون الإنتاجية والميزانية بأهمية الدقة نفسها، يولّد إصدار Flash الصور بالبنية نفسها القائمة على الانتشار وبتكلفة أقل تبلغ $0.03 لكل صورة. يناسب مسارات التوليد كبيرة الحجم والنمذجة الأولية السريعة التي تحتاج إلى جودة متسقة دون تضخيم الإنفاق.
MAI Image 2.5 Edit API (Image Editing)مرّر صورة موجودة مع تعليمة باللغة الطبيعية لتطبيق تعديلات دقيقة وقابلة للتحكم بدلًا من إعادة التوليد من الصفر. تتعامل نقطة النهاية مع إزالة العناصر، واستبدال المكونات، والتعديلات الموضعية مع الحفاظ على التكوين المحيط كما هو، وتُحتسب بتكلفة $0.058 لكل تعديل.
MAI Image 2.5 Flash Edit (Image Editing)تحصل الفرق التي تشغّل مسارات تحسين عالية الإنتاجية على قدرة التحرير الموجّهة بالتعليمات نفسها المتاحة في نموذج Edit القياسي وبتكلفة مخفضة تبلغ $0.038 لكل تعديل. يجعل ذلك تنظيف الكتالوجات بالجملة وتحديث الأصول على دفعات كبيرة أمرًا عمليًا مع إبقاء الإنفاق لكل عملية منخفضًا.

الميزات الجديدة لنماذج MAI-Image-2.5 + عرض توضيحي

يوفر الجمع بين النماذج المتقدمة ومنصة Atlas Cloud المسرّعة بوحدات GPU سرعة وقابلية توسع وتحكمًا إبداعيًا لا مثيل لهما في إنشاء الصور والفيديو.

توليد صور شخصية واقعية

توليد صور شخصية واقعية

ينشئ MAI-Image-2.5 صوراً شخصية معبرة وذات مظهر طبيعي مع بنية وجه دقيقة وإضاءة ونسيج بشرة من خلال المطالبات النصية. يقدم النموذج جماليات بجودة سينمائية مع إضاءة متسقة تتطابق مع المشهد الموصوف. تم تصميمه للحملات التحريرية، والعلامات التجارية، والحملات التجارية حيث تحتاج الصور التي تركز على الإنسان إلى أن تبدو جاهزة دون معالجة لاحقة.

تصيير النص داخل الصورة

تصيير النص داخل الصورة

يوفر MAI-Image-2.5 موثوقية محسنة لإنشاء النصوص داخل الصور، والتعامل مع ملصقات المنتجات واللافتات والعناوين الرئيسية ونسخ العلامات التجارية بتباعد صحيح ومقروئية عالية. يعالج هذا نقطة ضعف مستمرة في معظم نماذج إنشاء الصور ويجعله عمليًا لنماذج التغليف والأصول الإعلانية حيث يلزم وجود نص مقروء في المخرجات. إنه الخيار الصحيح لسير عمل التصميم حيث تكون دقة النص داخل الصورة أمرًا غير قابل للمساومة.

التحرير الدقيق للكائنات

التحرير الدقيق للكائنات

تنفذ نقطة النهاية MAI-Image-2.5 Edit تعديلات مستهدفة على مناطق محددة في الصورة: إزالة العناصر غير المرغوب فيها، واستبدال الكائنات أو إعادة تلوينها، وتحديث النص في اللافتات الحالية، وملء المناطق المفقودة، وتنظيف العيوب البصرية مثل الضبابية والضوضاء. تحافظ التعديلات على التماسك والتكوين طوال الوقت، وتترك المناطق التي لم يتم لمسها سليمة بصريًا. إنها الأداة المثالية لتحسين المنتجات، وتنظيف الكتالوجات، وتحديث أصول التسويق.

أصول العلامة التجارية والتصميم التجاري

أصول العلامة التجارية والتصميم التجاري

تم تصميم MAI-Image-2.5 خصيصًا لتطبيقات التصميم التجاري والاحترافي، حيث يدعم إنشاء العلامات التجارية والنماذج الأولية للمنتجات والمحتوى الجاهز للحملات من خلال المطالبات النصية. يحافظ النموذج على سلامة التخطيط والتكوين أثناء كل من الإنشاء والتحرير، مما ينتج أصولًا جاهزة للاستخدام في الإعلانات وحملات المنتجات. إنه الحل القياسي لفرق التصميم التي تنتج صورًا تجارية على نطاق واسع.

الاستدلال البصري عبر الكائنات والمشاهد

الاستدلال البصري عبر الكائنات والمشاهد

يطبق MAI-Image-2.5 الاستدلال البصري لفهم العلاقات المكانية، ووضع الكائنات، وتماسك الإضاءة عبر الصورة بأكملها. هذا يجعله موثوقًا لتوليد مشاهد حيث تحتاج عناصر متعددة إلى التعايش بشكل طبيعي، ولمهام التحرير حيث يحتاج التعديل إلى احترام السياق المحيط. إنه مناسب لتصور المنتجات في المشهد وأي سير عمل حيث تكون الدقة السياقية في المخرجات مهمة.

Mai Image 2.5 مقارنةً بالنماذج الأخرى - مطالبة واحدة

المطالبة نفسها، مولَّدة بواسطة Mai Image 2.5 ونماذج الصور الرائدة الأخرى: إعلان منتج ونمط حياة سينمائي

الموجه

صورة ماكرو تحريرية لطبيعة صامتة: صف من قوارير عطار وعبوات عطر قديمة مصنوعة يدويًا من زجاج معشّق، بارتفاعات غير متساوية — قصيرة، طويلة، منتفخة — تقف على حافة نافذة من جص كلسي متآكل، وزجاجها المعتم مخطّط بفقاعات هواء صغيرة محبوسة. اللحظة الحاسمة: يد بشرية عارية تميل بزجاجة كهرمانية، وخيط رفيع ونظيف من سائل شفاف يتدلى معلّقًا في الهواء، ملتقطًا ومضاءً في منتصف سقوطه، بتوتر سطحي وحافة متقطّرة حادَّين كالموس. في الخلفية، تثني الزجاجات الأخرى شمس الساعة الذهبية المنخفضة إلى تناثر من كاوستكس متداخلة بألوان الأحجار الكريمة — كهرماني، أخضر داكن كلون الزجاجات، وردي وردي — تزحف ببطء فوق الجص الرمادي الخشن المتكلّس. إضاءة جانبية خلفية منخفضة الزاوية في الساعة الذهبية تنفذ عبر الزجاج، مرسلة كاوستكس موجهة ومركزة وضوء حافة متوهجًا على امتداد ظلال كل زجاجة. تكوين مبني على التكرار الغرافيكي لمصفوفة الزجاجات مقابل مساحة واسعة من جدار رمادي محايد كفراغ سلبي، مع عمق مجال ضحل يضغط الصف، وتكون اليد الساكبة وخيط الماء اللامع نقطة التركيز الحادة. لوحة محدودة بدرجات الأحجار الكريمة من الكهرماني والأخضر الداكن والوردي الوردي في تباين مع الجدار الرمادي الخافت — رصينة، لا فاقعة أبدًا. تفاصيل ماكرو فائقة الواقعية: حبيبات الزجاج المعتم، الفقاعات، ملمس الجدار الطباشيري، جلد السائل المشدود، ذرات غبار خافتة تنجرف في حزمة الضوء. هادئة، مع لمسة من السحر. مصوّرة بعدسة ماكرو 100mm، ضوء نافذة طبيعي، تشطيب تصوير منتجات تحريري. نسبة عرض إلى ارتفاع 16:9.

Mai Image 2.5

Mai Image 2.5

Flux.2

Flux.2

Qwen Image 2.0

Qwen Image 2.0

الموجه

كشك نودلز في شارع ليلًا، اللحظة الحاسمة الخاطفة حين يسحب معلّم لاميان كرة عجين واحدة لتتحول إلى مروحة من عشرات خيوط النودلز الرفيعة كالشعر والمتوازية تمامًا، معلّقة في الهواء، تتسع إلى الخارج كمروحة يدوية تتفتح، بينما تنفجر في اللحظة نفسها نفحة من الدقيق المتطاير والبخار الصاعد — هذا فعل ملتقط أثناء الحركة، لا وقفة مصطنعة. وجهه غارق في تركيز كامل، وعضلاته مشدودة بقوة منضبطة، وحاجباه مقطّبان، وحبة عرق عند صدغه؛ خلفه، متفرجون خارج التركيز ومموهون يحبسون أنفاسهم ترقبًا. تصوير وثائقي واقعي للشارع، بلغة عدسة telephoto. مضاء بالمصباح التنغستن الدافئ الوحيد في الكشك كإضاءة جانبية خلفية قاسية ترسم حافة كل خيط نودلز شبه شفاف بتوهج مضيء، وتلتقط غبار الدقيق العالق في الهواء كشرارات طافية، وتحول البخار الأبيض المتصاعد إلى كتلة مضيئة؛ أما نيون الشارع الليلي الأزرق البارد في الخلفية فيذوب إلى كرات بوكيه ناعمة. ضغط عمق متعدد الطبقات بعدسة telephoto يسطّح يدي المعلم ووجهه المركّز وشلال النودلز في مستوى واحد، وتعمل الخيوط المتوازية الكثيفة كعنصر غرافيكي متكرر وكخطوط قيادة طبيعية تجذب العين عبر الإطار. توازن لوني بارد-دافئ — توهج تنغستن كهرماني في المقدمة مقابل الأزرق البارد العميق لليل — رصين وغير فاقع أبدًا. ملمس غني وملموس: جزيئات دقيق خشنة، لمعان خافت للغلوتين، لوح تقطيع خشبي مهترئ مشبع بالزيت، عرق على الجلد، وتمويه حركة خفيف على الخيوط الطائرة والمسحوق المنجرف. حبيبات فيلم دقيقة، عمق مجال ضحل، بلا إفراط في التصيير، بلا بشرة بلاستيكية، نغمة طبيعية صادقة. مصوّرة بعدسة telephoto 135mm، فتحة واسعة، إحساس ريبورتاج عفوي. نسبة عرض إلى ارتفاع 16:9.

Mai Image 2.5

Mai Image 2.5

Flux.2

Flux.2

Qwen Image 2.0

Qwen Image 2.0

أين تستفيد فرق التصميم من MAI Image 2.5 API

من كتالوجات التجارة الإلكترونية والمواد الإعلانية إلى التغليف، وصور المتحدثين باسم العلامة، وتصور المنتجات داخل المشاهد، يدعم MAI Image 2.5 API أعمال التصميم التجارية التي تطلقها الفرق يوميًا.

تصوير كتالوجات التجارة الإلكترونية على نطاق واسع

أنشئ لقطات للمنتجات بخلفيات متنوعة انطلاقًا من مرجع واحد، ثم أعد تلوينها ونظّف العيوب عبر نطاق SKU كامل من خلال Edit endpoint. تكلفة مجموعة كاملة من المتغيرات أقل من إعادة تصوير واحدة في الاستوديو.

المواد الإعلانية واختبارات A/B باستخدام MAI Image 2.5 API

ينتج مسوّقو الأداء تنويعات للبانرات والمنصات الاجتماعية وإعلانات العرض مع طبقات نصية دقيقة وتخطيطات متسقة مع هوية العلامة. وبما أن متغير Flash يعمل بتكلفة $0.03 لكل صورة، يبقى اختبار عشرات الأفكار قبل توسيع نطاق الأفكار الفائزة منخفض التكلفة.

إنتاج التغليف والملصقات

تعرض نماذج التغليف Typography مقروءة مدمجة مباشرة في تصاميم الصناديق والزجاجات ولافتات الرفوف بدلًا من وضعها يدويًا. وعند تغيير الصياغة، يراجع Edit endpoint الأسماء أو الأسعار أو النصوص الموسمية من دون إعادة بناء التخطيط.

صور متحدث باسم العلامة باتساق بصري

يبقى الوجه المعروف والملابس والهوية العامة ثابتة عبر الوضعيات والتخطيطات من خلال تعديلات متتابعة. وهذا يحافظ على تماسك مظهر شخصيات الحملات المتكررة والسلاسل الاجتماعية المستمرة أينما ظهرت.

تنقيح الكتالوجات وتنظيفها باستخدام MAI Image 2.5 API

تُزال الانعكاسات والأجسام الدخيلة وضبابية الحركة بسلاسة، بينما تملأ تقنية inpainting المناطق الناقصة مع الحفاظ على التكوين المحيط سليمًا. وبتكلفة $0.058 لكل تعديل، يصبح تنظيف آلاف الصور القديمة مهمة دفعية روتينية.

تصور المنتجات داخل المشاهد باستخدام MAI Image 2.5 API

يفهم النموذج الإضاءة والمقياس والعلاقات المكانية لوضع المنتجات داخل مشاهد حياتية بظلال ومنظور مقنعين. وتتمكن فرق التصور والنمذجة الأولية من معاينة أفكار الإعداد قبل وقت طويل من حجز جلسة تصوير فعلية.

كيف تقارن MAI Image 2.5 API بنماذج الصور المنافسة

قارن MAI Image 2.5 API مباشرةً مع أبرز نماذج تحويل النص إلى صورة من Google وByteDance وAlibaba من حيث المزوّد والسعر والدقة وعرض النص.

النموذجالمزوّدالسعر الابتدائي (لكل صورة)الدقة القصوىعرض النص داخل الصورةفئة سريعة مُحسّنة للتكلفة
MAI-Image-2.5 (تحويل النص إلى صورة)Microsoft$0.05حتى ~1 MP (بحد أقصى 1360 px لكل ضلع)
MAI-Image-2.5 Flash (تحويل النص إلى صورة)Microsoft$0.03حتى ~1 MP (بحد أقصى 1360 px لكل ضلع)
Nano Banana 2 (تحويل النص إلى صورة)Google$0.08حتى 4K
Seedream v4.5ByteDance$0.04حتى 2048×2048-
Qwen Image 2.0 (تحويل النص إلى صورة)Alibaba$0.035حتى 2048×2048-

كيفية استخدام MAI Image 2.5 على Atlas Cloud

Get started in minutes — follow these simple steps to integrate and deploy models through Atlas Cloud’s platform.

إنشاء حساب Atlas Cloud

سجّل في atlascloud.ai وأكمل التحقق. يحصل المستخدمون الجدد على رصيد مجاني لاستكشاف المنصة واختبار النماذج.

لماذا تستخدم MAI Image 2.5 على Atlas Cloud

دمج نماذج MAI Image 2.5 المتقدمة مع منصة Atlas Cloud المسرّعة بـ GPU يوفر أداءً لا مثيل له وقابلية للتوسع وتجربة مطور استثنائية.

الأداء والمرونة

زمن انتقال منخفض:
استدلال محسّن لـ GPU للاستجابة في الوقت الفعلي.

API موحد:
قم بتشغيل MAI Image 2.5 و GPT و Gemini و DeepSeek من خلال تكامل واحد.

تسعير شفاف:
فواتير يمكن التنبؤ بها لكل رمز مع خيارات بدون خادم.

المؤسسات والتوسع

تجربة المطور:
SDKs والتحليلات وأدوات الضبط الدقيق والقوالب.

الموثوقية:
وقت تشغيل 99.99%، RBAC، وتسجيل جاهز للامتثال.

الأمان والامتثال:
SOC 2 Type II، توافق HIPAA، سيادة البيانات في الولايات المتحدة.

MAI Image 2.5 API: أسئلة يطرحها المطورون قبل البدء بالبناء

يمنح MAI Image 2.5 API المطورين وصولًا برمجيًا إلى نموذج Microsoft‏ MAI-Image-2.5، وهو نموذج لتوليد الصور الواقعية وتحريرها مصمم لأعمال التصميم التجارية. يغطي كلًا من توليد الصور من النص وتحرير الصور بناءً على التعليمات، ويتوفر كل منهما بإصدار قياسي وإصدار Flash. على Atlas Cloud يمكنك الوصول إلى نقاط النهاية الأربع كلها عبر مفتاح واحد متوافق مع OpenAI، مع تسعير بنظام الدفع حسب الاستخدام يبدأ من $0.03 لكل صورة.

يشترك الإصداران في بنية الانتشار نفسها، والواقعية التصويرية، وجودة عرض النصوص. يعد Flash الخيار المحسن من حيث التكلفة بسعر $0.03 لكل صورة للتوليد و$0.038 لكل عملية تحرير، بينما يعمل النموذج القياسي بسعر $0.05 لكل صورة و$0.058 لكل عملية تحرير. استخدم Flash للتوليد بكميات كبيرة والنمذجة الأولية السريعة، واحتفظ بالنموذج القياسي للأعمال التي تكون فيها أعلى درجات الدقة والجودة هي الأهم.

التسعير على Atlas Cloud بنظام الدفع حسب الاستخدام ومن دون اشتراك. توليد الصور من النص بالإصدار القياسي يكلف $0.05 لكل صورة، والتحرير القياسي يكلف $0.058 لكل عملية تحرير، بينما تنخفض إصدارات Flash إلى $0.03 لكل صورة و$0.038 لكل عملية تحرير. تتم محاسبتك على كل استدعاء ناجح، لذا فإن دفعة من التنويعات لا تكلف إلا الرسوم الثابتة لكل صورة مضروبة في عدد المخرجات.

سجل في Atlas Cloud، وأنشئ مفتاح API واحدًا، ووجه عميلك الحالي المتوافق مع OpenAI إلى نقطة نهاية MAI-Image-2.5. أرسل مطالبة نصية للتوليد، أو صورة مع تعليمات للتحرير، وسيعيد الرد عناوين URL للصور النهائية. تعني إتاحة Day-0 أن النموذج يصبح متاحًا لحظة إطلاقه، من دون قائمة انتظار. ابدأ البناء اليوم.

تحدد أبعاد الإخراج باستخدام معامل size بصيغة العرض في الارتفاع، والقيمة الافتراضية هي 1024 في 1024. يمكن أن يتراوح كل جانب من 768 إلى 1360 بكسل، حتى حد أقصى يقارب ميغابكسل واحدًا إجمالًا، ما يغطي الإطارات المربعة والعمودية والأفقية. تشترك إصدارات التوليد القياسية وFlash في حدود الدقة نفسها.

تأخذ نقطة نهاية Edit صورة مصدر واحدة، مقدمة كعنوان URL أو base64 بتنسيق JPEG أو PNG، مع تعليمات بلغة طبيعية. تنفذ تغييرات موجهة مثل إزالة الكائنات، واستبدال العناصر، وإعادة التلوين، وتحديث النص في اللافتات، وتنظيف العيوب، مع إبقاء المناطق غير المستهدفة كما هي. ولأن النموذج يستنتج بنية المشهد والإضاءة، تبقى التعديلات منسجمة مع التكوين المحيط.

يعد عرض النصوص من أكبر مكاسب النموذج، وتشير Microsoft إلى أن أكبر قفزة في الجودة مقارنة بالجيل السابق كانت تحديدًا في هذه الفئة. ينتج النموذج بشكل موثوق ملصقات المنتجات، واللافتات، والعناوين، والنصوص المرتبطة بالعلامة التجارية مع تباعد صحيح وقابلية قراءة عالية. تجعل هذه الموثوقية استخدامه عمليًا لنماذج التغليف ومواد الإعلان التي لا يمكن التنازل فيها عن نص مقروء داخل الصورة.

على لوحات ترتيب Arena العامة، أطلق MAI-Image-2.5 في المرتبة No. 2 لتحرير الصور والمرتبة No. 3 لتوليد الصور من النص. تكمن نقاط قوته في الصور الشخصية الواقعية، وعرض النصوص بجودة تجارية، والتحرير المتسق مع الهوية، أكثر من المخرجات الأسلوبية أو الفنية. بالنسبة للفرق التي تنتج مرئيات جاهزة للعلامة التجارية، يجعل هذا التموضع منه بديلًا قويًا للمولدات العامة.

بنت Microsoft نموذج MAI-Image-2.5 وضبطته خصيصًا لأعمال التصميم التجارية والمهنية، بما في ذلك التغليف، ونماذج المنتجات، واللافتات، والمرئيات الموجهة للعلامة التجارية. النموذج مخصص للاستخدام الإنتاجي عبر مسارات عمل الإعلان، والتجارة الإلكترونية، والتسويق. لمعرفة حقوق الاستخدام الدقيقة التي تنطبق على حسابك، راجع شروط Atlas Cloud الحالية قبل نشر الأصول المولدة.

استكشف المزيد من العائلات

Seedance 2.5

واجهة برمجة تطبيقات Seedance 2.5 متاحة الآن على Atlas Cloud! توفر للمطورين أحدث نموذج فيديو من ByteDance. يمكن للنموذج إنشاء ما يصل إلى 30 ثانية من الفيديو الأصلي في مسار واحد من نص، أو صورة واحدة، أو ما يصل إلى 50 مرجعاً متعدد الوسائط، مع صوت متزامن ونص متعدد اللغات داخل الإطار. على Atlas Cloud، يمكنك الوصول إليه من خلال مفتاح واحد، مع الحفاظ على تناسق الموضوع والفيزياء المحسنة التي تحافظ على تماسك اللقطات الطويلة.

عرض العائلة

MiniMax H3

تتيح MiniMax H3 API الوصول إلى نموذج الفيديو العام متعدد الوسائط من MiniMax، الذي يقرأ النصوص والصور والفيديو والصوت كسياق واحد بدلًا من التعامل مع مهمة واحدة في كل مرة. تعمل المقاطع لمدة من 5 إلى 15 ثانية بمعدل 24 FPS عبر نسب أبعاد من 21:9 إلى 9:16، ويمكن لمطالبة واحدة تبديل الشخصيات أو استبدال الخلفيات أو إعادة كتابة الحوار أو استنساخ صوت من مقطع مرجعي. تقدم Atlas Cloud كل ذلك عبر نقطة نهاية واحدة متوافقة مع OpenAI. ابدأ التطوير اليوم.

عرض العائلة

Seedream 5.0 Pro

يوفر واجهة برمجة التطبيقات Seedream 5.0 Pro API للمطورين نموذج تحرير الصور القابل للتحكم من ByteDance على Atlas Cloud. وهو يضع التعديلات بدقة باستخدام نقاط الإرساء والإحداثيات، ويفصل الصور إلى طبقات قابلة للتحرير، ويدمج مراجع متعددة، ويطابق الألوان والمواد الدقيقة، مع نص متعدد اللغات بدقة 2K و 3K. على Atlas Cloud، يمكنك الوصول إليه من خلال مفتاح واحد!

عرض العائلة

Seedance 2.0

تمنحك واجهة برمجة تطبيقات Seedance 2.0 وصولاً إنتاجيًا إلى نموذج الفيديو متعدد الوسائط من ByteDance — إدخالات رباعية الوسائط (نص، صورة، فيديو، صوت) ونظام "Universal Reference" الرائد في الصناعة والذي يثبت التكوين وحركة الكاميرا وإجراءات الشخصيات عبر اللقطات. قم بدمج تحكم على مستوى المخرج من خلال استدعاء API واحد، بسعر ثابت قدره 0.09 دولار/ثانية، ومفتاح فوري، وبدون قائمة انتظار — مدعومًا بوقت تشغيل وامتثال على مستوى المؤسسات. Seedance 2.0 Native 4K متاح الآن!

عرض العائلة

GPT Image 2

توفر واجهة برمجة تطبيقات GPT Image 2 للمطورين إمكانية الوصول إلى أحدث نموذج صور من OpenAI، وهو خليفة GPT Image 1.5. يقوم النموذج بإنشاء الصور وتعديلها مع عرض دقيق للنصوص عبر الحروف اللاتينية ونصوص CJK، بالإضافة إلى تكوين قوي للملصقات والنماذج المبدئية والرسوم البيانية (الإنفوجرافيك). على Atlas Cloud، يمكنك الوصول إليه من خلال واجهة برمجة تطبيقات موحدة بجانب أكثر من 300 نموذج، مع أرصدة مجانية، ووقت تشغيل بنسبة 99.99%، وبدون الحاجة إلى التحقق من مؤسسة OpenAI.

عرض العائلة

Gemini Omni Flash

يجلب Gemini Omni API إلى بنيتك التقنية نموذج التوليد والتحرير متعدد الوسائط للفيديو من Google DeepMind، الذي أُعلن عنه في Google I/O 2026. يدمج Gemini Omni محرك الاستدلال في Gemini مع الوسائط التوليدية، ويقبل أي مزيج من النصوص والصور والفيديو والصوت لإنتاج مخرجات متسقة ومستندة إلى المعرفة. حسّن النتائج عبر محادثة طبيعية: استبدل العناصر، وأعد كتابة المشاهد، وغيّر الأنماط، مع بقاء الفيزياء والشخصيات والاستمرارية سليمة دون أي خلل. توفر Atlas Cloud تشكيلة Gemini Omni Flash الكاملة — تحويل النص إلى فيديو، وتحويل الصورة إلى فيديو مع ما يصل إلى 7 صور مرجعية، وتحويل المرجع إلى فيديو — عبر واجهة API موحدة بتسعير شفاف لكل ثانية يبدأ من $0.112 ومن دون اشتراك. ابدأ البناء اليوم.

عرض العائلة

Grok Imagine

يغطي Grok Imagine API نماذج xAI للصور والفيديو والكلام، من Image 2.0 إلى Video 1.5 و xAI TTS v1. صيّر صور ثابتة بدقة 1K و2K عبر 14 نسبة عرض إلى ارتفاع، أو مدّ مشهد لمدة 15 ثانية من الحركة بدقة 1080p، أو وجّه اللقطات باستخدام ما يصل إلى 7 صور مرجعية، أو أضفِ سرداً نصياً بـ 20 لغة. يشغل Atlas Cloud كل وضع على نقطة نهاية واحدة، بتسعير الدفع حسب الاستخدام من $0.02 لكل صورة و$0.05 لكل ثانية. ابدأ البناء اليوم.

عرض العائلة

Google

تتوفر أقوى النماذج الإبداعية من Google بالكامل على Atlas Cloud. يقدم Veo 3.1 توليد فيديو سينمائي، ويدعم Nano Banana 2 إنشاء صور عالية الدقة، ويجلب Gemini ذكاءً متعدد الوسائط لكل سير عمل. يمكنك الوصول إلى مجموعة نماذج Google الكاملة من خلال مفتاح API key واحد مع توفر Day-0 وتسعير الدفع حسب الاستخدام (pay-as-you-go).

عرض العائلة

Seedance 2.0 Mini

يجلب Seedance 2.0 Mini إنشاء مقاطع الفيديو متعددة الوسائط من ByteDance إلى مسارات العمل حيث تعتبر السرعة والتكلفة الأكثر أهمية. إنه يوفر القدرات الأساسية لـ Seedance 2.0 ببصمة أخف — إنشاء أسرع، وتكلفة أقل لكل مقطع فيديو، ونفس تكامل API الذي تستخدمه بالفعل. بالنسبة للفرق التي تدير مسارات عمل ذات حجم كبير أو تقوم بالنماذج الأولية على نطاق واسع، فإن Mini هو الخيار الافتراضي العملي.

عرض العائلة

ByteDance

من إنشاء مقاطع الفيديو السينمائية إلى توليد الصور عالية الدقة، أصبحت أقوى نماذج ByteDance متاحة الآن على Atlas Cloud. يمكنك تشغيل Seedance و Seedream على نطاق واسع بأقل أسعار للاستدلال وبدون أي أعباء إضافية للبنية التحتية.

عرض العائلة

Alibaba

تجمع Atlas Cloud مجموعة نماذج Alibaba الكاملة ضمن API واحد: Qwen لمهام اللغة والصورة، و Wan لإنشاء مقاطع الفيديو بدقة تصل إلى 1080p. يمكنك الوصول إلى كل نموذج بنظام الدفع حسب الاستخدام (pay-as-you-go) دون أي اشتراكات. تتوفر Alibaba API عبر عنوان URL أساسي واحد باستخدام عميلك الحالي المتوافق مع OpenAI.

عرض العائلة

OpenAI

تمنحك Atlas Cloud إمكانية الوصول إلى مجموعة API الكاملة من OpenAI، بدءًا من GPT Image 2 لتوليد الصور وحتى Sora 2 للفيديو. يتوفر كل نموذج بنظام الدفع حسب الاستخدام بدون أي التزام شهري. يمكنك الربط بسهولة عن طريق تبديل عنوان URL الأساسي باستخدام الـ API المتوافق مع OpenAI.

عرض العائلة

واجهة برمجية واحدة لكل وسائط الذكاء الاصطناعي.

استكشف جميع النماذج