


تضع FLUX 3 API أحدث نموذج foundation من Black Forest Labs في متناول منصتك، مع بنية Self-Flow واحدة جرى تدريبها بشكل مشترك على الصور والفيديو والصوت. أنشئ مقاطع تصل إلى 20 seconds وتتضمن حوارًا متعدد اللغات، ومؤثرات صوتية، وأجواءً صوتية في تمريرة واحدة، أو أنجز أعمال text-to-image بطباعة دقيقة. وتقدمه Atlas Cloud عبر مفتاح واحد متوافق مع OpenAI، مع تسعير pay-as-you-go لكل طلب ووصول Day-0.
يوفر لك Atlas Cloud أحدث النماذج الإبداعية الرائدة في الصناعة.
توجد خمس نقاط نهاية للفيديو خلف واجهة FLUX 3 API واحدة، ويوضح الجدول أدناه ما الذي تستقبله كل نقطة، وما الذي تُعيده، وتكلفتها لكل ثانية.
| النمط | الوصف |
|---|---|
| FLUX 3 T2V API (نص إلى فيديو) | تتحول المطالبات النصية إلى مقاطع مدتها من 5 إلى 20 ثانية مع صوت يتم توليده في العملية نفسها، لأن generate_audio مفعّل افتراضيًا. يعمل الإخراج بدقة 720p أو 1080p عبر سبع نسب أبعاد ثابتة من 21:9 إلى 9:16، إضافةً إلى خيار auto، كما تتيح قيمة seed إعادة إنتاج أي نتيجة. التسعير هو $0.17 لكل ثانية من الفيديو المُولَّد. |
| FLUX 3 I2V API (صورة إلى فيديو) | قدّم صورة واحدة بتنسيق PNG أو JPEG أو WebP، وسيحرّك النموذج المشهد انطلاقًا من ذلك الإطار، مستمدًا الحركة والإيقاع من المطالبة. يمكن اختيار المدة في أي نطاق من 5 إلى 20 ثانية، ما يناسب لقطات المنتجات، ومقدمات الشخصيات، والنسخ القصيرة للشبكات الاجتماعية المبنية على أعمال فنية تملكها بالفعل. تتم الفوترة بسعر $0.17 لكل ثانية من الفيديو المُولَّد. |
| FLUX 3 Keyframes API (الإطارات المفتاحية إلى فيديو) | عندما يجب أن تصيب اللقطة إيقاعات محددة، يمكن تثبيت ما يصل إلى 10 صور كإطارات مفتاحية في مواضع إطارات دقيقة على خط زمني بمعدل 24 fps. يجب أن يبقى كل frame_index ضمن ناتج ضرب duration في 24، ما يمنح فرق storyboard وpreviz تحكمًا مباشرًا فيما يظهر ومتى يظهر. السعر يطابق نقاط نهاية التوليد الأخرى عند $0.17 لكل ثانية من الفيديو المُولَّد. |
| FLUX 3 FLF API (الإطار الأول والأخير إلى فيديو) | هل تحتاج إلى مقطع ينتهي على صورة ختامية محددة تمامًا؟ تمرير start_image_url وend_image_url يثبّت طرفي اللقطة بينما يملأ النموذج الحركة بينهما. يناسب ذلك كشف الشعارات، وتسلسلات التحول، وتسليمات المشاهد التي يجب أن تطابق اللقطات المحيطة، وذلك بسعر $0.17 لكل ثانية من الفيديو المُولَّد. |
| FLUX 3 Extend API (تمديد الفيديو) | تتابع اللقطات الموجودة القصة عبر نقطة النهاية هذه: يتم تمديد ملف MP4 حجمه أقل من 50 MB ومدته أقل من 15 ثانية انطلاقًا من إطاراته الأخيرة وفقًا للمطالبة. يستمر توليد الصوت بالتوازي مع الصورة، ولا تزال دقة الإخراج نفسها 720p أو 1080p ونطاق المدة من 5 إلى 20 ثانية تنطبق. يُسعَّر التمديد بسعر $0.41 لكل ثانية من الفيديو المُولَّد. |
تم بناؤه بواسطة Black Forest Labs على عمود فقري واحد متعدد الوسائط، ويعيد FLUX 3 API ما يصل إلى 20 ثانية من فيديو HD أو Full HD مع حوار ومؤثرات صوتية وأجواء تُنشأ في المسار نفسه، كما يستجيب للتوجيهات المتعلقة باللقطات والإطارات المفتاحية واللغات والنصوص الظاهرة على الشاشة أثناء العملية.
يعيد استدعاء واحد فيديو مدته من 5 إلى 20 ثانية مع صوت يُنشأ داخل المسار نفسه، ولا يُدبلج لاحقًا أبدًا. يصل الحوار والمؤثرات الصوتية والطبقات الصوتية المحيطة إلى الإطار الدقيق الذي يقع فيه الحدث، ويصل الناتج بدقة 720p HD أو 1080p Full HD. هذا التزامن هو ما يجعل اشتعال المقلاة أو ارتطام الباب يبدو مصوّرًا لا مركّبًا.
اطلب قطعًا، وسيقدمه النموذج. تتغير المشاهد وزوايا الكاميرا ضمن توليد واحد، بينما تستمر الشخصية نفسها والملابس ومنطق الإضاءة عبر كل لقطة. أما الأعمال الأطول فتنتج من ربط المقاطع بأسلوب وكيل، حيث تُوصل توليدات منفصلة في تسلسلات تمتد لدقائق. لوحات القصة التي كانت تحتاج سابقًا إلى أربع عمليات تصيير ومحرر، تعود الآن كعمل واحد متصل.
النص فقط، أو صورة ثابتة واحدة، أو زوج من الإطار الأول والأخير، أو إطارات مفتاحية موضوعة على طول الخط الزمني، أو مقطع موجود لمتابعته: كل نقاط الدخول الخمس مدعومة. تثبت الإطارات المفتاحية ما يحدث ومتى يحدث، بينما تتابع ميزة الاستكمال من اللقطات التي تمتلكها بالفعل. يمكن للاستوديوهات التي لديها صور ثابتة للعلامة التجارية أو قصات نصف مكتملة أن تبدأ من تلك الأصول بدلًا من وصف كل لقطة من الصفر.
يمتد الحوار الأصلي عبر لهجات الإنجليزية والصينية والإسبانية والفرنسية والألمانية واليابانية والبرتغالية والروسية والإيطالية والإندونيسية والتركية والهندية والبنجابية وغيرها، مع مطابقة حركة الشفاه للغة التي تطلبها. كما تُعرض الطباعة بوصفها جزءًا من المشهد، بحيث تستقر اللافتات والعناوين داخل الإطار بدل تركيبها لاحقًا. لذلك يمكن لموجه واحد أن ينتج إعلانًا موطّنًا وحروفه في مكانها بالفعل.
تقدم Atlas Cloud خدمة FLUX 3 عبر نقطة النهاية الموحدة نفسها التي تدعم بقية كتالوجها، لذا يصل مفتاح واحد إلى نماذج الفيديو والصورة واللغة من دون تكامل ثانٍ. تبقى الفوترة بنظام الدفع حسب الاستخدام من دون اشتراك ومن دون رسوم مقاعد، ولا تدفع إلا مقابل عمليات التوليد التي تشغلها فعليًا. تبديل النماذج يعني تغيير سلسلة نصية. ابدأ البناء اليوم.
يشغّل كل صف أدناه مطالبة واحدة متطابقة عبر FLUX 3 API ونموذجين آخرين للفيديو على Atlas Cloud، بحيث يمكن تقييم استمرارية الحركة، وتغييرات اللقطات، والصوت الأصلي وفق الموجز نفسه بدلًا من عروض مختارة بعناية.
تصوير سينمائي حي، زقاق خلفي في طوكيو ليلًا تلمع أرضه بالمطر. كلب شيبا إينو يرتدي معطف مطر أصفر صغيرًا يركب لوح تزلج عبر الزقاق، متعرجًا بين البرك وفتحات البخار. ابدأ بلقطة تتبّع من زاوية منخفضة تنزلق فوق الرصيف المبلل خلف اللوح مباشرة، بينما تمر انعكاسات النيون كخطوط خاطفة. يصطدم الكلب بكومة من الفوانيس الورقية فتندفع في الهواء، وتتبع لقطة whip pan أحد الفوانيس الدوارة وهو يتدحرج نحو كشك رامن. اقطع إلى لقطة drone ترتفع وتتراجع بينما يضرب الشيبا بمخلبه إلى الأسفل، ويدير اللوح ليتوقف توقفًا حادًا، ثم ينبح مرة واحدة في وجه طاهي الرامن الضاحك، الذي يقذف شريحة chashu يلتقطها الكلب في الهواء. ضوء دافئ من الكشك مقابل نيون بارد، ورذاذ ماء مضاء من الخلف. الصوت: هسيس المطر، هدير عجلات اليوريثان فوق الحجر، مقلاة wok تصدر أزيزًا، نبحة حادة واحدة، وقطار يمر في مكان ما بالأعلى. نسبة العرض إلى الارتفاع 16:9.
Generated with BLACKFORESTLABS FLUX 3 on Atlas Cloud
Generated with Veo3.1 on Atlas Cloud
Generated with Kling v3.0 on Atlas Cloud
أسلوب أنمي مرسوم يدويًا، ظهيرة ساطعة فوق بحر لا نهائي من السحب. صيادة سماوية مراهقة تثبت قدميها على سطح سفينة هوائية خشبية وتلقي خيطًا طويلًا إلى أسفل داخل بحر السحب. ابدأ بمنظور الشخص الأول POV فوق الدرابزين بينما ينطلق الخيط كالسوط ويختفي في البياض. يشتد صنّار الصيد فجأة، وتنتقل الكاميرا إلى دوران سريع حول السطح بينما تُسحب عبر الألواح، والحبل يدخن وهو ينزلق عبر قفازيها، وحذاء واحد يعلق بلفة من حبال السفينة. تضع قدمًا على الدرابزين وتسحب بكل قوتها في اللحظة التي تخترق فيها سمكة koi بحجم حوت السحب من خلفها، فتقذف حراشفها ضوءًا قزحيًا عبر الأشرعة. اختتم بلقطة بطولية من زاوية منخفضة بينما ينفجر الطاقم هتافًا وينساب رذاذ السحب عبر الكادر. تظليل cel shading بطابع رسومي، ضوء حافة دافئ، وملمس فرشاة ظاهر. الصوت: رياح مندفعة، حبل يصرّ، تصاعد أوركسترالي متنامٍ، ودوي مائي عميق عند الاختراق. نسبة العرض إلى الارتفاع 16:9.
Generated with BLACKFORESTLABS FLUX 3 on Atlas Cloud
Generated with Seedance 2.0 on Atlas Cloud
Generated with Kling v3.0 on Atlas Cloud
سواء كانت المهمة مقطعًا اجتماعيًا مدته 20 seconds مع صوت أصلي، أو لوحة قصة بإطارات مفتاحية، أو نسخة إعلان مترجمة محليًا، أو مسودة سريعة قبل التصيير النهائي، فإن FLUX 3 API يغطي ذلك على Atlas Cloud بتسعير الدفع حسب الاستخدام وإتاحة Day-0.
أنشئ فيديو يصل إلى 20 seconds من مطالبة نصية واحدة، مع إنتاج الكلام والمؤثرات والأجواء الصوتية بالتوازي مع الإطارات. تحصل فرق الشبكات الاجتماعية على مقطع مكتمل من دون مرحلة صوت منفصلة.
تتيح الإطارات المفتاحية المرتبة لـ FLUX 3 API نقل المشهد عبر لحظات محددة، مع تغيير زوايا الكاميرا والإعدادات ضمن عملية توليد واحدة. يمكن لفناني لوحات القصة معاينة تسلسل كامل قبل حجز أي تصوير.
تُعرض الخطوط بدقة داخل المشاهد المولّدة، كما يتحسن التعامل مع النصوص متعددة اللغات مقارنةً بما قدمته أجيال FLUX السابقة. تخرج نماذج التغليف وبطاقات العناوين واللافتات المترجمة محليًا من استدعاء واحد جاهزة للمراجعة.
هل تحتاج إلى نفس الإعلان في 6 أسواق؟ يولّد FLUX 3 API حوارًا متعدد اللغات ومتزامنًا مع الفيديو، بحيث تحمل كل نسخة مسارها الصوتي المحلي من دون مرحلة دبلجة.
يمكن نقل اللقطات الموجودة إلى سياقات جديدة، أو تمديدها بصوت مطابق، أو إعادة تشكيلها مع الحفاظ على عناصرها الأساسية كما هي. تعيد الوكالات إحياء أصول الحملات القديمة بدلًا من تكليف تصوير جديد.
يعيد وضع المسودة معاينة HD سريعة بتكلفة أقل، وتُصيَّر اللقطات المعتمدة مرة أخرى بدقة HD أو FHD عبر FLUX 3 API. تبقى عملية التكرار ميسورة عندما يحتاج المفهوم إلى 20 محاولة.
قارن بين طول المقطع، ودقة الإخراج، والصوت الأصلي، وتكلفة كل ثانية لمعرفة أين تتفوق FLUX 3 API وأين قد يكون نموذج آخر من Atlas Cloud أنسب لخط أنابيبك.
| النموذج | الحد الأقصى لطول المقطع | الحد الأقصى لدقة الإخراج | الصوت الأصلي | السعر لكل ثانية |
|---|---|---|---|---|
| FLUX 3 Video (Text-to-Video) | 20 s | FHD، حتى 2 MP لكل إطار | √ حوار، SFX، أجواء محيطة | $0.17 HD / $0.29 FHD |
| FLUX 3 Video (Video-to-Video) | 20 s | FHD، حتى 2 MP لكل إطار | √ حوار، SFX، أجواء محيطة | $0.41 HD / $0.53 FHD |
| Seedance 2.0 Text-to-Video | 15 s | 4K (3840 x 2160) | √ مفعّل افتراضيًا | $0.112 |
| Kling V3.0 Turbo Text-to-Video | 15 s | 1080p | √ اختياري، معطّل افتراضيًا | $0.112 |
| Wan-2.7 Text-to-video | 15 s | 1080p native, 1440p-SR | √ SFX، موسيقى، أجواء محيطة | $0.10 |
| Veo3.1 Text-to-video | 8 s | 1080p | √ صوت متزامن | $0.20 |
Get started in minutes — follow these simple steps to integrate and deploy models through Atlas Cloud’s platform.
سجّل في atlascloud.ai وأكمل التحقق. يحصل المستخدمون الجدد على رصيد مجاني لاستكشاف المنصة واختبار النماذج.
دمج نماذج FLUX 3 المتقدمة مع منصة Atlas Cloud المسرّعة بـ GPU يوفر أداءً لا مثيل له وقابلية للتوسع وتجربة مطور استثنائية.
زمن انتقال منخفض:
استدلال محسّن لـ GPU للاستجابة في الوقت الفعلي.
API موحد:
قم بتشغيل FLUX 3 و GPT و Gemini و DeepSeek من خلال تكامل واحد.
تسعير شفاف:
فواتير يمكن التنبؤ بها لكل رمز مع خيارات بدون خادم.
تجربة المطور:
SDKs والتحليلات وأدوات الضبط الدقيق والقوالب.
الموثوقية:
وقت تشغيل 99.99%، RBAC، وتسجيل جاهز للامتثال.
الأمان والامتثال:
SOC 2 Type II، توافق HIPAA، سيادة البيانات في الولايات المتحدة.
FLUX 3 هو نموذج أساس متعدد الوسائط من Black Forest Labs، دُرّب بشكل مشترك على الصور والفيديو والصوت وتوقّع الأفعال، بدلًا من تجميعه من أنظمة منفصلة. يتيح FLUX 3 API الوصول إلى هذا النموذج عبر Atlas Cloud، بحيث يُرجع الطلب الواحد فيديو مع صوت متزامن. ويغطيه مفتاح واحد متوافق مع OpenAI إلى جانب كل النماذج الأخرى في الكتالوج، مع فوترة حسب الاستخدام.
الفيديو هو الإمكانية المتاحة عمومًا، ويشمل text to video، وimage to video، واللقطات الموجّهة بالإطارات المفتاحية، ومتابعة مقطع موجود، مع صوت أصلي اختياري في كل حالة. تطرح Black Forest Labs هذه العائلة على مراحل، لذلك تأتي FLUX 3 Image وFLUX 3 Action بعد endpoints الخاصة بالفيديو بدلًا من إطلاقها معها في الوقت نفسه.
أنشئ حسابًا، وولّد مفتاح API، ووجّه عميلك الحالي إلى endpoint الخاصة بـ FLUX 3 API. تتبع الطلبات النمط نفسه المتوافق مع OpenAI والمستخدم عبر كتالوج Atlas Cloud، لذلك لا توجد SDK منفصلة تحتاج إلى تعلمها، ولا ارتباط بمورّد يصعب التخلص منه لاحقًا. الفوترة بنظام الدفع حسب الاستخدام لكل عملية توليد، من دون اشتراك يجب توقيعه أولًا. ابدأ البناء اليوم.
نعم، ويتم ذلك في تمريرة التوليد نفسها بدلًا من استخدام نموذج ثانٍ، ما يحافظ على تزامن الحوار والمؤثرات الصوتية والأجواء مع الصورة. يتعامل FLUX 3 مع الكلام مع مزامنة الشفاه عبر أكثر من اثنتي عشرة لغة، بما في ذلك English وChinese وSpanish وJapanese وHindi. ويمكن إيقاف الصوت لكل طلب عندما تكون اللقطات الصامتة كل ما تحتاج إليه.
تمتد عمليات التوليد من 5 إلى 20 ثانية، مع إخراج بدقة HD 720p، وتتوفر Full HD 1080p عندما تكون التفاصيل أهم من التكلفة. وتُدعم إطارات العرض العريضة والمربعة والعمودية، لذا يمكن توجيه الموجه نفسه إلى واجهة رئيسية لصفحة هبوط أو إلى خلاصة على الهاتف. من الأفضل بناء القصص الأطول من عدة مقاطع مضبوطة بدلًا من طلب واحد كبير جدًا.
قدّم صورة بداية فيقوم النموذج بتحريكها، أو ثبّت إطارات مفتاحية عندما يجب أن تحقق اللقطة لحظات محددة بترتيب معين. ويمكن أيضًا متابعة لقطات موجودة، مع الحفاظ على الحركة والتأطير من نهاية مقطع الإدخال. استخدم سلاسل المتابعات باعتدال، لأن الاتساق البصري ينحرف مع بناء كل تمديد على التمديد السابق.
يعيد Draft mode معاينة HD أقل تكلفة كي تتمكن من تقييم التكوين والإيقاع والصوت قبل الدفع مقابل التصيير النهائي. كرّر تحسين الموجهات هناك، ثم أعد تشغيل الموجه الفائز بدقة HD القياسية أو Full HD من دون تغيير بنية الطلب. الفرق التي تطلق عددًا كبيرًا من النسخ البديلة تحصل على أكبر قيمة من هذه الدورة.
تتم فوترة الفيديو لكل ثانية من الإخراج، لذا يكلّف المقطع القصير جزءًا بسيطًا من تكلفة المقطع الطويل، ولا تدفع إلا مقابل ما تولّده فعليًا. تحدد الدقة السعر، إذ تكون Full HD أعلى من HD القياسية، ويكون Draft mode أقل من كليهما. ولا تضيف Atlas Cloud أي اشتراك أو رسوم مقاعد أو حد أدنى للإنفاق فوق ذلك. ابدأ اليوم.
ليس بعد. FLUX 3 Video هو الجزء المطروح من العائلة، بينما FLUX 3 Image في طرح مرحلي، وقد أُعلن عن متغير FLUX 3 Dev بنمط open weights لوقت لاحق. تضيف Atlas Cloud كل endpoint جديدة من FLUX 3 عند إطلاقها، لذلك يستمر المفتاح نفسه في العمل عندما تصل ميزة توليد الصور.
يزيل النموذج المشترك خطوة التجميع: فلا توجد تمريرة ثانية لمزامنة الصوت مع حركة الفم أو لإضافة الأجواء تحت المونتاج النهائي. ويظهر أثر ذلك أكثر في مشاهد الحوار، حيث يكون الانحراف بين المسارات مرئيًا فورًا للمشاهدين. تنكمش خطوط المعالجة من عدة خدمات إلى استدعاء واحد، ما يعني نقاط فشل أقل يجب مراقبتها.
أدلة وشروحات وتحديثات المنتج لمساعدتك على تحقيق أقصى استفادة من Atlas Cloud.