Kling v2.6 Cinematic Video Creation

Kling v2.6 Cinematic Video Creation

Kling v2.6 هي عائلة نماذج الفيديو من Kuaishou لإنشاء فيديوهات سينمائية من النصوص والصور، وإنشاء الصور الرمزية بالذكاء الاصطناعي، ونقل الحركة اعتمادًا على المراجع. تدعم نسب أبعاد مرنة، وديناميكيات محسّنة، وثبات الهوية، واتساقًا زمنيًا عبر مسارات عمل متخصصة. توفر Atlas Cloud خياري Pro وStandard من خلال نقاط نهاية متسقة، مع تسعير شفاف حسب الاستخدام. ابدأ التطوير اليوم.

Kling 2.6 من تطوير Kuaishou. توفّر Atlas Cloud (التي تُشغّلها Atlas Cloud AI LLC) إمكانية الوصول إليه ولا تملكه. جميع العلامات التجارية ملك لأصحابها المعنيين.

استكشف النماذج الرائدة(6)

مقارنة نقاط نهاية توليد الفيديو في Kling v2.6

طابق كل نقطة نهاية في Kling v2.6 مع سير عمل الإدخال المدعوم، ونقاط القوة في الإنتاج، وحالات استخدام الفيديو المستهدفة.

النمطالوصف
Kling v2.6 Pro Avatar API (Avatar To Video)صُممت نقطة النهاية هذه لتوليد صور رمزية عالية الجودة، إذ تنتج مقاطع فيديو متميزة بتفاصيل واضحة وحركة مستقرة واتساق قوي في الهوية. وهي مناسبة لمقاطع الملف الشخصي المصقولة، والمقدمات، ومحتوى وسائل التواصل الاجتماعي.
Kling v2.6 Std Avatar API (Avatar To Video)اختر نقطة نهاية Standard Avatar لإنشاء مقاطع فيديو لشخصيات رمزية بالذكاء الاصطناعي، مع تفاصيل واضحة وحركة سينمائية والتزام موثوق بالتعليمات. وتناسب إمكاناتها الملفات الشخصية، والمقدمات القصيرة، والإنتاج المتكرر لمحتوى وسائل التواصل الاجتماعي.
Kling v2.6 Pro Motion Control API (Reference Motion To Video)تنقل مقاطع الحركة المرجعية الرقص أو الحركات أو الإيماءات إلى صورة شخصية أو فيديو مصدر، مع الحفاظ على الهوية والاتساق الزمني. استخدمها لإنشاء رسوم متحركة سلسة للشخصيات تتبع حركات مسجلة محددة.
Kling v2.6 Std Motion Control API (Image And Motion To Video)حرّك صورة ثابتة لشخصية من خلال تزويدها بمقطع حركة يتضمن رقصة أو حركة أو إيماءة. تستخرج نقطة النهاية هذه الحركة وتولّد فيديو سلسًا وواقعيًا لسير عمل سهل لنقل الحركة.
Kling v2.6 Pro API (Text To Video)تحوّل التعليمات النصية إلى مقاطع فيديو سينمائية مع توليد الصوت ونِسَب أبعاد مرنة باستخدام نموذج Kuaishou هذا. وهو يدعم تطوير الأفكار، والمشاهد السردية، والإعلانات، وسائر مشاريع الفيديو المعتمدة على التعليمات.
Kling v2.6 Pro API (Image To Video)انطلاقًا من صورة، تنشئ نقطة النهاية هذه فيديو سينمائيًا مع توليد الصوت وديناميكيات محسّنة. أضف الحيوية إلى صور المنتجات أو الرسومات التوضيحية أو اللقطات الإبداعية الثابتة عندما يكون التحكم في الاستمرارية البصرية مهمًا.

Kling v2.6 في الصوت والحركة والهوية

يجمع Kling v2.6 بين التوليد السمعي البصري الأصلي، وسير العمل القائم على النصوص والصور، والتحكم في الحركة المستند إلى المراجع، والصور الرمزية المدفوعة بالصوت، والمعلمات المرنة، والوصول بنظام الدفع حسب الاستخدام عبر نقاط النهاية Standard وPro.

التوليد السمعي البصري الأصلي في Kling v2.6

يمكن لـ Kling v2.6 Pro توليد الفيديو والصوت معًا انطلاقًا من مطالبة نصية أو صورة مصدر. يكون مفتاح الصوت مفعّلًا افتراضيًا في نقاط نهاية Atlas Cloud لتحويل النص إلى فيديو وتحويل الصورة إلى فيديو. لذلك يمكن للحوار والمؤثرات والأجواء الصوتية أن تواكب تطور المشهد. ويُعد هذا الخيار مناسبًا جدًا للمقاطع السردية القصيرة التي تحتاج إلى نتيجة سمعية بصرية متناسقة من دون مرحلة صوت منفصلة.

مسارات التوليد النصي والقائم على الصور

ابدأ بمشهد مكتوب أو حرّك صورة ثابتة باستخدام نقاط نهاية التوليد Pro. تدعم المطالبات النصية مخرجات بنسبة 1:1 و9:16 و16:9، بينما يتيح كلا المسارين مددًا قدرها 5 أو 10 ثوانٍ، ومفتاحًا للصوت، ومطالبات سلبية، وتحكم CFG من 0 إلى 1. تقبل مدخلات الصور ملفات JPG أو JPEG أو PNG بحجم يصل إلى 10 MB، مما يمنح المطورين تحكمًا عمليًا في الأصول المخصصة للتواصل الاجتماعي والمنتجات والمحتوى السينمائي.

التحكم في نقل الحركة عبر Kling v2.6 Motion Control

قدّم صورة لشخصية ومقطع حركة مرجعيًا إلى Kling v2.6 Motion Control، الذي ينقل تسلسلات الرقص أو الحركة أو الإيماءات لكامل الجسم مع الحفاظ على الهوية والاتساق الزمني. يمكن أن تتراوح مدة الفيديوهات المرجعية بين 3 و30 ثانية. اختر ما إذا كان التكوين سيتبع الصورة أم فيديو الحركة، وحدد ما إذا كنت تريد الاحتفاظ بالصوت الأصلي. وتناسب النتيجة العروض المتواصلة، وتحريك الشخصيات، والحملات القائمة على الحركة.

فيديوهات الصور الرمزية المدفوعة بالصوت

تتطلب نقاط نهاية Avatar من Standard وPro صورة ومسارًا صوتيًا، مع إمكانية إضافة مطالبة اختيارية لتوجيه النتيجة. يعطي Pro الأولوية للتفاصيل الواضحة، والحركة المستقرة، والاتساق القوي للهوية، بينما يجمع Standard بين الحركة السينمائية والالتزام الموثوق بالمطالبة. استخدم هذا المسار عندما يحتاج شخص معروف إلى تقديم صوت مُعد مسبقًا في فيديوهات الملفات الشخصية أو المقدمات ذات العلامة التجارية أو المحتوى الاجتماعي المتكرر.

اختيار النموذج بنظام الدفع حسب الاستخدام

اختر نقاط نهاية Standard أو Pro وفقًا لحجم العمل، ثم ادفع فقط مقابل الاستدعاءات التي تجريها عبر Atlas Cloud. يبدأ Standard Avatar من $0.056 لكل استدعاء، وStandard Motion Control من $0.07، وPro Text to Video وImage to Video من $0.07، بينما يبدأ Pro Avatar أو Motion Control من $0.112. ويمتد حساب واحد عبر نقاط النهاية الست كلها، مما يساعد المطورين على تحقيق التوازن بين الجودة البصرية واحتياجات الحركة وتكلفة الإنتاج من دون التزام باشتراك.

Kling v2.6 تحت المجهر: نموذج واحد، وثلاثة نماذج فيديو

تعرّف على كيفية تفسير Kling v2.6 وبديلين من Atlas Cloud للمطالبات المتطابقة في مشاهد الحركة الواقعية والسرد القصصي ذي الطابع الأسلوبي.

الموجه

فيلم إعلاني للموضة فائق الواقعية مدته 8–10 ثوانٍ، تدور أحداثه عند الظهيرة فوق بحيرة ملح بيضاء شاسعة: يشكّل ستة متزلجين سريعي الحركة يرتدون عباءات عاكسة قزحية الألوان فريقًا هندسيًا دقيقًا لحصاد الملح بالطائرة الورقية، حيث يسحب كل منهم حبلًا مشدودًا بلون أزرق كوبالت وبرتقالي فلوري، متصلًا بطائرة ورقية هائلة على شكل شفنين. ابدأ بلقطة جوية عمودية من الأعلى بطائرة مسيّرة، بينما تنحت التشكيلة المتزامنة أنماطًا حادة كالشفرات في قشرة الملح؛ ثم تهبط الطائرة المسيّرة فجأة وتستوي على ارتفاع بضع بوصات فوق الأرض، متسارعة خلف القائد بينما يتعرج الفريق عبر بوابات أعلام ترفرف، والعباءات تفرقع والحبال تنثني تحت شد واقعي. انتقل بحركة تحريك سريعة للكاميرا إلى دوران كامل بزاوية 360 درجة عندما تنفجر دوامة غبار مفاجئة بجانبهم، فتدور بلورات الملح المتناثرة في الهواء؛ يستجيب المتزلجون الستة بتناغم تام، ويسحبون حبالهم بسرعة وحزم، وتنطوي الطائرة الورقية الشبيهة بالشفنين إلى غطسة قوية درامية، مخترقة دوامة البلورات ومبعثرة الملح اللامع كثلج متساقط مبهر فوق الفريق المسرع. حركة منسقة ومتواصلة من البداية إلى النهاية، هويات وتشكيلة متماسكتان في كل لقطة، زخم تزلج مقنع، شد حبال دقيق فيزيائيًا، حركة أقمشة انسيابية، جزيئات ملح حبيبية، اضطراب رياح، وظلال راسخة على الأرض. ضوء شمس علوي قاسٍ، إضاءة علوية حادة عالية التباين، انعكاسات قوس قزح منشورية عبر العباءات العاكسة وسطح الملح، تكوين متعدد الطبقات من الأبيض الثلجي والأزرق الكوبالت والبرتقالي الفلوري، جمالية إعلانية فاخرة وسريالية للموضة الراقية، تفاصيل سينمائية حادة كالموسى، إيقاع قرعي متزامن مع كل انحناءة وانتقال للكاميرا، رياح عاصفة، احتكاك الشفرات، فرقعة القماش، شد الحبال، ثم فحيح بلوري ساطع في النهاية. لا حركة بطيئة، لا لقطات حشو ثابتة، لا قطع يخل بالاستمرارية المكانية، لا أجساد مشوهة، لا أشخاص مكررين، لا حبال متشابكة أو منفصلة، لا أزياء غير متسقة، لا أجسام طافية، لا شاشات، لا واجهات برمجية، لا لوحات معلومات، لا أشرطة تقدم، لا مخططات، لا عناوين، لا شعارات، لا علامات مائية، لا نص مقروء. نسبة العرض إلى الارتفاع 16:9.

Generated with Kling v2.6 Pro Text-to-Video on Atlas Cloud

Generated with Seedance 2.0 Text-to-Video on Atlas Cloud

Generated with Seedance 2.0 Fast Text-to-Video on Atlas Cloud

الموجه

مطاردة سينمائية متواصلة في أعماق البحر مدتها 8–10 ثوانٍ داخل قاعة الرقص شديدة الميل في حطام سفينة متحللة: ابدأ بلقطة ماكرو فائقة القرب لمجس أخطبوط مقلّد شبه شفاف يتلألأ عبر بلورات ثريا متصدعة بينما يخطف «لؤلؤة» متوهجة؛ ثم تحرك بالكاميرا إلى الخلف بسرعة مع تأثير تقريب وإبعاد متزامن، لتكشف الأخطبوط يتأرجح من درابزين متآكل فوق طاولات طعام مقلوبة، بينما تنساب ثعابين موراي بين الكراسي وتطارده، مع ارتفاع أدوات المائدة وشظايا الزجاج والرواسب وسلاسل الفقاعات وتصادمها وفق فيزياء مقنعة تحت الماء. انتقل إلى لقطة مطاردة ضيقة تدور بزاوية 360 درجة، فيما يغيّر الأخطبوط باستمرار نسيج جلده وشفافيته ليتطابق مع الستائر المخملية والنحاس الباهت والخشب المغطى بالبرنقيل، ثم يطلق سحابة حبر كثيفة تلتف لتشكّل طعمًا مقنعًا على هيئة أخطبوط؛ فتهاجم الثعابين الصورة الظلية الزائفة بينما يتسلل الأخطبوط الحقيقي من بينها. حرّك الكاميرا بحركة سريعة ولفّها إلى منظور علوي مائل بحدة: تنفتح «اللؤلؤة» المسروقة فجأة عن عين صغيرة، ويشتد توهجها الكهرماني، ويظهر تحت طاولة المأدبة وجه ضخم مموه لسمكة صائدة—فاللؤلؤة طُعمها؛ يتجمد الأخطبوط لنبضة كوميدية واحدة بينما تندفع السمكة الصائدة نحو الكاميرا. واقعية سينمائية فوتوغرافية لأعماق البحر، ضوء محيطي بارد بلون سماوي متباين مع تلألؤ حيوي كهرماني دافئ، ماء حجمي، جزيئات عائمة، حركة عالية الكثافة لمجسات لينة الجسم، محاكاة للسوائل، تصادمات بين الأجسام الطافية، استمرارية سلسة للموضوع، زخم مقنع فيزيائيًا، حركة حادة وواضحة، لا حركة بطيئة. صوت غامر متزامن: أنين مكتوم لهيكل السفينة، رنين البلورات، فقاعات مندافعة، طقطقة الثعابين، إيقاع قرعي نابض للمطاردة، انفجار حبر رطب، ثم ضربة جهير مفاجئة عند لحظة الكشف. لا شاشات، لا واجهات، لا لوحات معلومات، لا أشرطة تقدم، لا مخططات، لا عناوين، لا ترجمات، لا شعارات، لا علامات مائية، ولا نص توضيحي. نسبة العرض إلى الارتفاع 16:9

Generated with Kling v2.6 Pro Text-to-Video on Atlas Cloud

Generated with Seedance 2.0 Text-to-Video on Atlas Cloud

Generated with Seedance 2.0 Fast Text-to-Video on Atlas Cloud

Kling v2.6 عبر القصص والشخصيات والحركة

من المطالبات السينمائية واللقطات الثابتة للحملات المتحركة إلى الصور الرمزية المتسقة والعروض الموجّهة بالحركة، يدعم Kling v2.6 المطورين في إنشاء الأفلام والإعلانات والمحتوى الاجتماعي والشخصيات ذات العلامات التجارية.

مفاهيم سينمائية باستخدام Kling v2.6

حوّل المفاهيم المكتوبة إلى فيديو سينمائي باستخدام Kling v2.6 Pro Text to Video، مع نسب أبعاد مرنة وصوت مُولّد. يستطيع صانعو الأفلام إعداد نماذج أولية للإعلانات التشويقية والمشاهد الدرامية والعروض البصرية انطلاقًا من مطالبة واحدة.

حملات المنتجات المتحركة

أضف الحياة إلى صورة منتج أو لقطة ثابتة لحملة من خلال ديناميكيات محسّنة وجودة سينمائية وصوت مُولّد. يمكن لفرق التسويق إنشاء إعلانات تشويقية للإطلاق وعروض مرئية وترويجات اجتماعية انطلاقًا من الأعمال الفنية الحالية.

مقدمو العروض بالصور الرمزية عبر Kling v2.6

أنشئ مقاطع فيديو احترافية للصور الرمزية بتفاصيل واضحة وحركة مستقرة واتساق قوي في الهوية من خلال نموذج Pro Avatar. استخدمها للتعريف بالملفات الشخصية وفقرات التقديم والشخصيات الاجتماعية المتكررة للعلامات التجارية.

تصميم الرقصات اعتمادًا على المراجع

أسقط لقطات الرقص أو الحركة أو الإيماءات على صورة شخصية مع الحفاظ على الهوية والاتساق الزمني. يمكن للمبدعين إنتاج اختبارات لتصميم الرقصات وتمائم متحركة ومقاطع اجتماعية قائمة على الأداء انطلاقًا من حركة مسجّلة.

إعادة إسناد أدوار الشخصيات باستخدام Kling v2.6

امنح صورة شخصية أو فيديو مصدرًا الحركةَ الموجودة في مقطع مرجعي عبر Pro Motion Control، مع الحفاظ على اتساق الشخصية. تستطيع فرق الإنتاج استكشاف مؤدين بدلاء وتسلسلات حركة بأساليب فنية متنوعة ورسوم متحركة متسقة للشخصيات.

مسارات عمل مؤتمتة لفيديوهات التواصل الاجتماعي

ابدأ بمطالبة نصية وأنشئ فيديو سينمائيًا مع الصوت وبنسب أبعاد مرنة. يمكن للمطورين أتمتة مفاهيم الحملات القصيرة ومحتوى المبدعين والمرئيات المخصصة للمنصات، من دون توفير صورة افتتاحية.

Kling v2.6 في مواجهة واجهات برمجة التطبيقات الإنتاجية للفيديو

قارن Kling v2.6 بأبرز نماذج تحويل النص إلى فيديو من حيث المزوّد، ومدة المقطع، والصوت الأصلي، والسعر الأساسي القياسي.

النموذجالمزوّدمدة الإخراجالصوت الأصليالسعر الأساسي القياسي
Kling v2.6 Pro Text-to-VideoKuaishou5 أو 10 ثوانٍ√$0.07/second
Seedance 2.0 Text-to-VideoByteDanceمن 4 إلى 15 ثانية√$0.112/second
Wan-2.7 Text-to-videoQwenمن 2 إلى 15 ثانية√$0.10/second
Veo 3.1 Lite Text-to-videoGoogle4 أو 6 أو 8 ثوانٍ√$0.05/second

كيفية استخدام Kling 2.6 على Atlas Cloud

Get started in minutes — follow these simple steps to integrate and deploy models through Atlas Cloud’s platform.

إنشاء حساب Atlas Cloud

سجّل في atlascloud.ai وأكمل التحقق. يحصل المستخدمون الجدد على رصيد مجاني لاستكشاف المنصة واختبار النماذج.

لماذا تستخدم Kling 2.6 على Atlas Cloud

دمج نماذج Kling 2.6 المتقدمة مع منصة Atlas Cloud المسرّعة بـ GPU يوفر أداءً لا مثيل له وقابلية للتوسع وتجربة مطور استثنائية.

الأداء والمرونة

زمن انتقال منخفض:
استدلال محسّن لـ GPU للاستجابة في الوقت الفعلي.

API موحد:
قم بتشغيل Kling 2.6 و GPT و Gemini و DeepSeek من خلال تكامل واحد.

تسعير شفاف:
فواتير يمكن التنبؤ بها لكل رمز مع خيارات بدون خادم.

المؤسسات والتوسع

تجربة المطور:
SDKs والتحليلات وأدوات الضبط الدقيق والقوالب.

الموثوقية:
وقت تشغيل 99.99%، RBAC، وتسجيل جاهز للامتثال.

الأمان والامتثال:
SOC 2 Type II، توافق HIPAA، سيادة البيانات في الولايات المتحدة.

أسئلة حول واجهة API لـ Kling v2.6 للمطورين

Kling v2.6 هو مجموعة نماذج فيديو بالذكاء الاصطناعي من Kuaishou، ومتاحة عبر Atlas Cloud. وتشمل إنشاء الفيديو من النص والصورة إلى الفيديو عبر Pro، بالإضافة إلى نقاط النهاية Standard وPro للأفاتار والتحكم في الحركة.

يمكنك إنشاء مقاطع فيديو من التعليمات، وتحريك الصور المصدر، وإنشاء مقاطع أفاتار من صورة وملف صوتي، أو نقل تسلسلات الرقص والحركة والإيماءات من مقاطع مرجعية. ويمكن لنقطتي النهاية Pro Text-to-Video وPro Image-to-Video إنشاء الصوت بالتزامن مع العناصر المرئية.

اختر Text-to-Video عند البدء من تعليمات، وImage-to-Video عند تحريك صورة ثابتة. تربط نقاط نهاية Avatar صورةً بملف صوتي مُقدَّم، بينما تطبّق Motion Control الحركة من فيديو مرجعي على شخصية.

أرسل طلب POST إلى `/api/v1/model/generateVideo` باستخدام مفتاح API الخاص بك في Atlas Cloud، ومعرّف النموذج الدقيق، والمدخلات الخاصة بنقطة النهاية. توفر الاستجابة غير المتزامنة معرّف توقّع يمكنك التحقق منه عبر `/api/v1/model/prediction/{id}` حتى تكتمل المهمة.

تختلف عناصر التحكم حسب نقطة النهاية. يدعم Text-to-Video التعليمات، والتعليمات السلبية، ونِسَب العرض 1:1 و9:16 و16:9، ومددًا قدرها 5 أو 10 ثوانٍ، والصوت، ومقياس التوجيه، بينما تضيف مسارات العمل الأخرى مدخلات للصورة أو الصوت أو فيديو الحركة أو الاتجاه أو الاحتفاظ بالصوت، حسب الحالة.

في Pro Text-to-Video وPro Image-to-Video، تتحكم المعلمة `sound` في إنشاء الصوت بالتزامن. أما نماذج Avatar فتتطلب بدلًا من ذلك إدخالًا صوتيًا مع صورة الشخصية، بينما يمكن لـ Motion Control الاحتفاظ بالصوت الأصلي للفيديو المرجعي.

تعرض Atlas Cloud أسعارًا قياسية قدرها $0.07 لكل ثانية لكل من Pro Text-to-Video وPro Image-to-Video وStandard Motion Control. ويبلغ سعر Standard Avatar ‏$0.056 لكل ثانية، بينما يبلغ سعر Pro Avatar وPro Motion Control ‏$0.112 لكل ثانية، وذلك وفق الأسعار الأصلية وليس الأسعار الترويجية.

جهّز صورة شخصية بصيغة JPG أو JPEG أو PNG، وفيديو حركة بصيغة MP4 أو MOV. يجب ألا يتجاوز حجم كل ملف 10 MB، وأن يبلغ قياسه 300 بكسل على الأقل في كلا البعدين، وأن تكون نسبة العرض إلى الارتفاع بين 1:2.5 و2.5:1.

تحقق أولًا من معرّف النموذج، ومصادقة Bearer، والحقول المطلوبة، وقيود الوسائط الخاصة بنقطة النهاية. إذا قُبلت المهمة، فاستعلم عن معرّف التوقّع حتى تكتمل أو تفشل، وافحص الخطأ المُعاد. ولحل حالات عدم الاتساق البصري، بسّط المشهد واستخدم وسائط مصدر واضحة، خاصةً عند نقل حركة الوجه أو التفاعلات مع كائنات معقدة.

استكشف المزيد من العائلات

Seedance 2.5

واجهة برمجة تطبيقات Seedance 2.5 متاحة الآن على Atlas Cloud! توفر للمطورين أحدث نموذج فيديو من ByteDance. يمكن للنموذج إنشاء ما يصل إلى 30 ثانية من الفيديو الأصلي في مسار واحد من نص، أو صورة واحدة، أو ما يصل إلى 50 مرجعاً متعدد الوسائط، مع صوت متزامن ونص متعدد اللغات داخل الإطار. على Atlas Cloud، يمكنك الوصول إليه من خلال مفتاح واحد، مع الحفاظ على تناسق الموضوع والفيزياء المحسنة التي تحافظ على تماسك اللقطات الطويلة.

عرض العائلة

Wan 3.0

تعد واجهة برمجة تطبيقات Wan 3.0 الجيل التالي من عائلة فيديو Wan التابعة لشركة Alibaba، وقد تم تصميمها لدفع التوليد طويل التنسيق والتحكم متعدد المراجع والجودة السمعية والبصرية إلى آفاق جديدة. تستضيف Atlas Cloud بالفعل Wan 2.7 و 2.6 و 2.5، ويعمل Wan 3.0 على نفس المفتاح الموحد دون أي إعداد منفصل. ابدأ البناء اليوم. قم بالتمرير لأسفل إلى قسم العرض لترى ما يمكن أن ينشئه Wan 3.0.

عرض العائلة

MiniMax H3

MiniMax H3 هي عائلة MiniMax متعددة الوسائط للفيديو، وتدعم الإنشاء الموجّه بالنصوص والصور والمراجع. وعبر المسارات المدعومة، تحافظ على العناصر من الوسائط المرجعية، وتوفر نسب أبعاد مرنة، وتقرن الصوت المُولّد بالمشاهد من خلال H3 Developer، مع تحديد ملفات الإخراج وفقًا لنقطة النهاية. توحّد Atlas Cloud هذه العائلة خلف مفتاح واحد متوافق مع OpenAI، مع تسعير شفاف حسب الاستخدام يبدأ من السعر القياسي البالغ $0.038 لكل ثانية. ابدأ البناء اليوم.

عرض العائلة

Seedream 5.0 Pro

يوفر واجهة برمجة التطبيقات Seedream 5.0 Pro API للمطورين نموذج تحرير الصور القابل للتحكم من ByteDance على Atlas Cloud. وهو يضع التعديلات بدقة باستخدام نقاط الإرساء والإحداثيات، ويفصل الصور إلى طبقات قابلة للتحرير، ويدمج مراجع متعددة، ويطابق الألوان والمواد الدقيقة، مع نص متعدد اللغات بدقة 2K و 3K. على Atlas Cloud، يمكنك الوصول إليه من خلال مفتاح واحد!

عرض العائلة

Seedance 2.0

Seedance 2.0 هو نموذج الفيديو المخصص للإنتاج من ByteDance لإنشاء اللقطات بدقة. حوّل المطالبات إلى فيديو، أو حرّك صورة الإطار الأول مع إمكانية توجيه اختيارية عبر الإطار الأخير، أو شكّل النتائج باستخدام الوسائط المرجعية والبحث الاختياري على الويب. يضم Atlas Cloud هذه التدفقات في API موحّد واحد، مع تسعير شفاف حسب الاستخدام ومفتاح واحد متوافق مع OpenAI. ابدأ البناء اليوم.

عرض العائلة

GPT Image 2.5

تمنح عائلة gpt-image-2.5 من OpenAI المطورين خيار استخدام Flare وSunburst في عمليات إنتاج الصور. نفّذ التصيير بدقة عشوائية تصل إلى 3840x2160، واختر من بين خمس درجات للجودة، بما في ذلك xhigh وmax، لتلبية متطلبات الإخراج المحددة. توفر Atlas Cloud استدلال REST جاهزًا للاستخدام من دون بدء تشغيل بارد، وبسعر قياسي يبدأ من $0.004 لكل عملية توليد. ابدأ البناء اليوم.

عرض العائلة

GPT Image 2

توفر واجهة برمجة تطبيقات GPT Image 2 للمطورين إمكانية الوصول إلى أحدث نموذج صور من OpenAI، وهو خليفة GPT Image 1.5. يقوم النموذج بإنشاء الصور وتعديلها مع عرض دقيق للنصوص عبر الحروف اللاتينية ونصوص CJK، بالإضافة إلى تكوين قوي للملصقات والنماذج المبدئية والرسوم البيانية (الإنفوجرافيك). على Atlas Cloud، يمكنك الوصول إليه من خلال واجهة برمجة تطبيقات موحدة بجانب أكثر من 300 نموذج، مع أرصدة مجانية، ووقت تشغيل بنسبة 99.99%، وبدون الحاجة إلى التحقق من مؤسسة OpenAI.

عرض العائلة

Gemini Omni Flash

توفّر Gemini Omni API للمطورين عائلة Gemini Omni Flash المتعددة الوسائط أصلاً من Google DeepMind، بما في ذلك Gemini Omni 1.1 Flash. أنشئ فيديو سينمائياً مع صوت أصلي متزامن، أو حرّك الصور الثابتة مع تحكّم دقيق في الإطارين الابتدائي والنهائي، أو عدّل اللقطات الموجودة عبر تعديلات موجّهة بالنص تحافظ على المحتوى الذي لم تطله التعديلات. توفّر Atlas Cloud مفتاحاً واحداً متوافقاً مع OpenAI، ووصولاً موحّداً، وتسعيراً شفافاً بنظام الدفع حسب الاستخدام. ابدأ التطوير اليوم.

عرض العائلة

Grok Imagine

يغطي Grok Imagine API نماذج xAI للصور والفيديو والكلام، من Image 2.0 إلى Video 1.5 و xAI TTS v1. صيّر صور ثابتة بدقة 1K و2K عبر 14 نسبة عرض إلى ارتفاع، أو مدّ مشهد لمدة 15 ثانية من الحركة بدقة 1080p، أو وجّه اللقطات باستخدام ما يصل إلى 7 صور مرجعية، أو أضفِ سرداً نصياً بـ 20 لغة. يشغل Atlas Cloud كل وضع على نقطة نهاية واحدة، بتسعير الدفع حسب الاستخدام من $0.02 لكل صورة و$0.05 لكل ثانية. ابدأ البناء اليوم.

عرض العائلة

Google

تتوفر أقوى النماذج الإبداعية من Google بالكامل على Atlas Cloud. يقدم Veo 3.1 توليد فيديو سينمائي، ويدعم Nano Banana 2 إنشاء صور عالية الدقة، ويجلب Gemini ذكاءً متعدد الوسائط لكل سير عمل. يمكنك الوصول إلى مجموعة نماذج Google الكاملة من خلال مفتاح API key واحد مع توفر Day-0 وتسعير الدفع حسب الاستخدام (pay-as-you-go).

عرض العائلة

Seedance 2.0 Mini

يجلب Seedance 2.0 Mini إنشاء مقاطع الفيديو متعددة الوسائط من ByteDance إلى مسارات العمل حيث تعتبر السرعة والتكلفة الأكثر أهمية. إنه يوفر القدرات الأساسية لـ Seedance 2.0 ببصمة أخف — إنشاء أسرع، وتكلفة أقل لكل مقطع فيديو، ونفس تكامل API الذي تستخدمه بالفعل. بالنسبة للفرق التي تدير مسارات عمل ذات حجم كبير أو تقوم بالنماذج الأولية على نطاق واسع، فإن Mini هو الخيار الافتراضي العملي.

عرض العائلة

ByteDance

من إنشاء مقاطع الفيديو السينمائية إلى توليد الصور عالية الدقة، أصبحت أقوى نماذج ByteDance متاحة الآن على Atlas Cloud. يمكنك تشغيل Seedance و Seedream على نطاق واسع بأقل أسعار للاستدلال وبدون أي أعباء إضافية للبنية التحتية.

عرض العائلة

واجهة برمجية واحدة لكل وسائط الذكاء الاصطناعي.

استكشف جميع النماذج