Seedance 2.0 Mini & Fast API بأقل الأسعار في العالم — خصم يصل إلى 68% على السعر الرسمي

Seedance 2.5 مقابل MiniMax H3: الجميع اختبر المرونة لمدة 30 ثانية. لا أحد اختبر اللقطة الرابعة.

مقارنة بين Seedance 2.5 و MiniMax H3، نفس ورقة الشخصية، نفس المطالبة. مواصفات حقيقية، سير عمل درامي قصير من 5 خطوات قابل للنسخ واللصق، وأيهما يحافظ على الوجه عبر أربع لقطات.

MiniMax أصدرت H3 يوم الجمعة. في غضون 24 ساعة، أصبح Seedance 2.5 في أيدي المستخدمين، وانهار الجدول الزمني في محادثة واحدة: ثلاثون ثانية، دقة 4K أصلية، خمسون مدخلًا مرجعيًا. منشور إطلاق H3 كان تحته، بهدوء، ولم يقم أحد تقريبًا بتشغيل اختبار حقيقي عليه.

أفهم لماذا. ثلاثون ثانية رقم رائع. يليق بالعناوين.

لكن إذا كنت تصنع مسلسلات قصيرة رأسية حقيقية، فأنت تعلم أن الشيء الذي يفسد ليلتك ليس الثانية الثلاثين. إنها اللقطة 4. خط الفك للبطل الذكر يتحرك نصف سنتيمتر، يفقد ربطة عنقه ثنية، ويبتعد المشاهد قبل أن تثبت الخطاف. لا أحد يغادر لأن المقطع كان خمس عشرة ثانية بدلاً من ثلاثين. يغادرون لأن الرجل في اللقطة القريبة ليس هو الرجل من اللقطة الواسعة.

لذا تجاوزت مبارزة المواصفات. أنشأت ورقة تحول شخصية واحدة، ولوحة موقع من ست لوحات، وكتبت موجهاً لدراما قصيرة قوطية مدتها 15 ثانية، وأرسلت الحزمة المتطابقة إلى كلا الجانبين. ثم حدقت في الوجه.

الخلاصات الرئيسية

  • فقط H3 قابل للاستدعاء اليوم — API Seedance 2.5 متاح لدى ByteDance، لكنه لا يزال صفحة اليوم الأول على هذه المنصة.
  • المواصفات منقسمة بوضوح: Seedance 2.5 = 30 ثانية في لقطة واحدة، دقة 4K أصلية، حتى 50 مرجعًا؛ H3 = 5–15 ثانية، دقة 2K، صوت ستيريو على كل مقطع.
  • استقرار الشخصية مشكلة تعبئة — حزمة مرجعية جيدة، لا نموذج أكبر، هي التي تثبت الوجه.
  • كلاهما يولد صوتًا أصليًا؛ H3 أيضًا يثبت صوتًا من ما يصل إلى ثلاثة مراجع صوتية.
  • احكم بالبكسل لكل إطار، لا بالثواني — في نفس التشغيل، أعاد H3 دقة 1440p بينما Seedance أعاد 720p.

نتيجة Seedance 2.5 مقابل MiniMax H3، قبل أي نظرية

قبل أي نظرية، إليك ما ينتجه سير العمل. هذه أربع لقطات مأخوذة من مقطع رأسي مكتمل مدته 15 ثانية ومبلطة. إنها تشغيل H3 المرجعي الخاص بـ MiniMax المبني تمامًا من ورقة الشخصية ولوحة الموقع التي ستراها في الخطوة 1 والخطوة 2، بدقة أصلية 1440x2560. تشغيلاتي الخاصة لنفس الحزمة تأتي لاحقًا، في البرنامج التعليمي، مع حالة الملعب مرئية.

 

 

تصل إلى الباب المنحوت، وهو اللوحة 4 من لوحة الموقع، ثم مواجهة الممر، ثم لقطة قريبة ضيقة له، ثم اللقطة الثنائية. خط شعره منقسم بنفس الطريقة في الملف الشخصي وفي اللقطة القريبة. تاجها المضفر نصف المرفوع ينجو من لقطة قريبة كاملة للوجه، وهو بالضبط المكان الذي تعيد فيه معظم النماذج بناء وجه بهدوء. مشد الدانتيل الكريمي يحافظ على نفس خط العنق وكفة الكم من الإطار الأول إلى الأخير.

هذا هو الاختبار بأكمله. ليس ثلاثين ثانية. أربع لقطات وخط فك.

لماذا انكسر Seedance 2.5 مقابل MiniMax H3 في نفس الأسبوع، ولماذا معظم اختبارات الشخصية عديمة الفائدة

أصدرت MiniMax H3 في 30 يوليو، نموذج فيديو متعدد الوسائط للأغراض العامة يقرأ النصوص والصور والفيديو والصوت كسياق واحد ويعيد مقاطع من 5 إلى 15 ثانية بدقة تصل إلى 2K مع صوت ستيريو أصلي. يمكنه أيضًا تحرير اللقطات الموجودة ونقل الحركة من مقطع إلى آخر، وقالت MiniMax إن الأوزان ستتبع في غضون أيام (Reuters، يوليو 2026).

Seedance 2.5 هبط في نفس النافذة برقم أعلى: 30 ثانية في توليد واحد، دقة 4K أصلية، وما يصل إلى 50 مدخلًا مرجعيًا متعدد الوسائط في مهمة واحدة (The Next Web، يوليو 2026). API الخاص به بالفعل في أيدي المطورين، مع تحرير موضعي يعيد رسم جزء من الإطار مع ترك الأداء والإضاءة وسلوك الكاميرا سليمة، ومرجع إلى فيديو يقبل ألواح الشاشة الخضراء أو نماذج ثلاثية الأبعاد بيضاء، وإحدى عشرة لغة، ووضع فيديو طويل تجريبي يصل إلى 180 ثانية (CineD، يوليو 2026).

 

 

فجوة الانتباه هي الجزء المثير للاهتمام. تقريبًا كل منشور وجدته كان مقطع 2.5. وفي الوقت نفسه، تقول أرقام الساحة العامة شيئًا آخر: على لوحة متصدرين تحويل الصورة إلى فيديو من Artificial Analysis، يتصدر Seedance 2.0 بدقة 720p بـ 1,196 Elo، يليه Gemini Omni Flash بـ 1,195، و MiniMax H3 بالفعل في المرتبة الثالثة بـ 1,185، بعد أربعة أيام من الإطلاق. Seedance 2.5 ليس له تصنيف هناك بعد (Artificial Analysis، يوليو 2026). النموذج الأقل حديثًا هو الذي لديه أعلى نسبة من النقاط إلى الانتباه.

الآن الجزء الذي يقرر ناتجك فعليًا، لأنه لا علاقة له تقريبًا بأي شعار تختار.

معظم اختبارات ثبات الشخصية تفشل قبل أن يتم إشراك النموذج حتى. أربعة أنماط فشل، وكلها تقع على عاتقك لإصلاحها:

نمط الفشلما تراه في الناتجالإصلاح
إرسال مراجع من زوايا متعددة كملفات منفصلةوجه كل لقطة "قريب من الصحيح" ولا يتفق اثنانقم بتركيب المشاهد في صورة واحدة، ثم قم بتعيين الأدوار في الموجه ("الرجل على اليسار"، "المرأة على اليمين")
إعادة كتابة وصف الشخصية لكل لقطةالزي والإكسسوارات تنجرف من لقطة لأخرىاكتب كتلة الهوية مرة واحدة وأعد استخدامها حرفيًا؛ فقط الكاميرا والفعل يتغيران لكل لقطة
السماح للإضاءة بالتحرك مع المشهديتم إعادة بناء الوجه هيكليًا في الضوء الجديدقم ببناء لوحة موقع منفصلة تثبت اتجاه الضوء والضباب وانعكاس الأرضية، وأطعمها كمرجع
التعامل مع المدة القصوى كمقياس جودةانحراف واحد داخل 30 ثانية يقتل الـ30 بأكملهاقص إلى الدقة التي يمكنك إعادة لفها، ثم تحدث عن الطول

هل تريد وضع Seedance 2.5 و MiniMax H3 أمام نفس الموجه بنفسك؟ مقارنة النماذج من Atlas Cloud تشغلهما جنبًا إلى جنب في تمريرة واحدة — نفس الموجه والإعدادات، مع تقدير التكلفة قبل التوليد — حتى تتمكن من الحكم على الوجوه والحركة والنص على الشاشة دون حجز اختبارين منفصلين.

مقارنة نماذج Atlas Cloud تشغل Seedance 2.5 و MiniMax H3 على نفس الموجه، مع عرض سعر ودقة كل تشغيل جنبًا إلى جنب

Seedance 2.5 و MiniMax H3 على نفس الموجه في مقارنة نماذج Atlas Cloud. أعاد Seedance 2.5 دقة 720p بتكلفة 2.42 دولار؛ أعاد MiniMax H3 دقة 1440p مقابل 1.12 دولار، وتم تقدير كلا السعرين قبل التشغيل. تم التقاطها مباشرة على مستكشف النماذج.

الصف الأول هو الذي يخطئ فيه الناس أكثر. أرسل ست صور منفردة ويعاملها النموذج على أنها ستة أشخاص مرشحين ويحسب المتوسط. أرسل تركيبة واحدة نظيفة ويعاملها كشخص واحد يُرى من ثلاث جهات. نفس البكسلات، نتيجة مختلفة تمامًا.

 

 

ورقة مواصفات Seedance 2.5 مقابل MiniMax H3، وما يمكنك استدعاؤه فعليًا اليوم

قسّم القدرة من التوفر وسيصبح التوتر واضحًا. على القدرة الخام، يتفوق Seedance 2.5 في المدة وسقف الدقة وعدد المراجع ودقة التحرير. على التوفر، H3 هو الذي لديه ثلاث نقاط نهاية حية على منصة نماذج للأغراض العامة هذا الأسبوع. إذا كنت تقوم بمقارنة نماذج فيديو AI لتخطيط 2026، فإن العمود الثاني يهم بقدر الأول.

 MiniMax H3Seedance 2.5Seedance 2.0 مرجع إلى فيديو (ما شغلته)
أقصى طول، توليد واحد5 إلى 15 ثانيةحتى 30 ثانية، بدون ربط (وضع تجريبي إلى 180 ثانية، تجريبي)قائمة مقاطع قصيرة، راجع صفحة النموذج
الدقة2K أصلي، 1440p جانب قصير بـ 16:9 إلى 9:16؛ طبقة 768p مدرجة كقادمة4K أصلي، ألوان 10 بتحتى 720p على هذه النقطة النهائية
معدل الإطارات24 إطارًا في الثانيةغير منشور بشكل منفصلغير منشور بشكل منفصل
المدخلات المرجعية9 صور + 3 فيديوهات + 3 صوت، 12 ملفًا إجمالاًحتى 50 مرجعًا متعدد الوسائط9 صور + 3 فيديوهات + 3 صوت
الصوت الأصلينعم، كل ناتج، ستيريونعم، بالإضافة إلى 11 لغة ترجمة وصوتنعم
دقة التحريرتحريرات تعليمات على مستوى المقطع بالكامل (تبديل شخصية، خلفية، إضاءة، حوار)تحريرات على مستوى المنطقة تعيد رسم جزء من الإطارتحريرات تعليمات على مستوى المقطع بالكامل
سقف الموجه7,000 حرفغير منشورغير منشور
الأوزان المفتوحةأُعلن عنها في غضون أيام بعد الإطلاقغير معلن عنهاغير معلن عنها
Elo لتحويل الصورة إلى فيديو من Artificial Analysis، 31 يوليو 20261,185 (الثالث)لم يتم تقييمه بعد1,196 (الأول، إدخال Dreamina 720p)
قابل للاستدعاء على المنصة التي اختبرتهانعم، 3 نقاط نهايةليس بعد، صفحة اليوم الأولنعم

الإفصاح الكامل عن إعدادات الاختبار. لم يكن Seedance 2.5 مفتوحًا على منصتي عندما شغلت هذا، لذا فإن جانب Seedance هو Seedance 2.0 مرجع إلى فيديو، العضو الحالي الشحن من نفس العائلة مع نفس نظام المراجع رباعي الوسائط. حيث قد يغير 2.5 الإجابة، سأقول ذلك. صفحة Seedance 2.5 هي إشعار اليوم الأول في الوقت الحالي.

كل ما يلي يعمل في علامة تبويب متصفح واحدة، على مفتاح واحد، ثلاثة نماذج إجمالاً:

الخطوةالنموذجما ينتجهالإعدادات الرئيسيةما يحدد التكلفة
1OpenAI GPT Image 2 نص إلى صورةورقة تحول الشخصيةالجودة عالية، 16:9لكل صورة، الدفع حسب الاستخدام، السعر الحالي على صفحة النموذج
2نفس النموذج، تشغيل ثانلوحة الموقع والإضاءة المكونة من ست لوحاتالجودة عالية، 16:9لكل صورة، الدفع حسب الاستخدام
3MiniMax H3 مرجع إلى فيديوالمقطع الرأسي 9:16 مع صوت أصلي9:16، 2K، مدة 5 لاختبار و 15 للقطع الحقيقيالثواني × الدقة، تُحسب بالثانية
4Seedance 2.0 مرجع إلى فيديوتشغيل التحكم، نفس المدخلات9:16، أعلى دقة متاحة، نفس المدةالثواني × الدقة، تُحسب بالثانية
5H3 مرجع إلى فيديو، المقطع كمدخللقطة واحدة مثبتة دون إعادة لف كل شيءنفس الدقة، مدة قصيرةالثواني × الدقة، تُحسب بالثانية

H3 لديه أيضًا إدخالات نص إلى فيديو و صورة إلى فيديو إذا كنت تريد خطًا أساسيًا نصيًا خالصًا أو تحكمًا في الإطار الأول والأخير بدلاً من ذلك.

شيء آخر يستحق المعرفة قبل أن تخطط لمجموعة: النص على الشاشة. هذا التسلسل الافتتاحي لـ H3 لمدة 15 ثانية يحمل الاعتمادات الإنجليزية عبر ثمانية قطع حادة دون أي خطأ إملائي واحد، وهو أحد أصعب الأشياء التي يمكن الحفاظ عليها مستقرة في الفيديو المولد.

 

 

سير عمل الدراما القصيرة لـ Seedance 2.5 مقابل MiniMax H3، خطوة بخطوة

خمس خطوات. انسخ الموجهات تمامًا كما هي مكتوبة، بما في ذلك الأجزاء القبيحة. لم أنظفها للمقال ولا يجب عليك تنظيفها للنموذج.

الخطوة 1: بناء ورقة الشخصية باستخدام GPT Image 2

اصنع حزمة المرجع قبل أن تصنع أي فيديو. صورة واحدة، شخصيتان، ثلاث زوايا لكل منهما، خلفية بيضاء ناعمة ومتجانسة، إضاءة استوديو متساوية. هذا يزيل كل غموض باستثناء الذي يهمك: كيف يبدو هذا الشخص.

plaintext
1ورقة مرجعية لتحول شخصية كاملة الطول على خلفية بيضاء ناعمة ومتجانسة، شخصيتان جنبًا إلى جنب، ستة أشكال إجمالاً، إضاءة استوديو محايدة متساوية، لا ظلال على الأرض، لا نص، لا تسميات، لا علامة مائية.
2
3النصف الأيسر، البطل الذكر، ثلاث زوايا في صف واحد: أمام، ملف شخصي يمين، خلف. أواخر العشرينات، بشرة شاحبة، شعر داكن مموج متوسط الطول، خط فك حاد. يرتدي معطفًا طويلًا من المخمل الأسود أسود مع تطريز دقيق على الياقات والأساور، صدرية مطرزة بالذهب الأسود، ربطة عنق حريرية سوداء، بنطلون أسود مستقيم، حذاء جلدي أسود مصقول. ذراعاه مسترخيتان على جانبيه، تعبير محايد.
4
5النصف الأيمن، البطلة الأنثى، ثلاث زوايا في صف واحد: أمام، ملف شخصي يمين، خلف. أوائل العشرينات، بشرة فاتحة، شعر بني كستنائي طويل مموج مع تاج مضفر نصف مرفوع. ترتدي فستان دانتيل قطني كريمي فيكتوري، أكمام طويلة مع أساور دانتيل، مشد مناسب مع أزرار صغيرة، تنورة كاملة بطول الكاحل، حذاء بكعب منخفض مع حزام كاحل كريمي. ذراعاها مسترخيتان على جانبيها، تعبير محايد.
6
7واقعية فوتوغرافية، مقياس ثابت بين جميع الأشكال الستة، أقدام محاذية على نفس الخط الأساسي، تركيز حاد من الحافة إلى الحافة.

الإعدادات: النموذج OpenAI GPT Image 2 Text-to-Image، الجودة عالية، نسبة العرض إلى الارتفاع 16:9، كل شيء آخر افتراضي. المجموع: 11 كلمة. مثالي. واجهة مولد صور AI تعرض إدخال الموجه والشخصية المولدة GPT Image 2 Text-to-Image على Atlas Cloud، اكتمل التشغيل: موجه التحول على اليسار، ستة أشكال على ورقة بيضاء واحدة في لوحة OUTPUT.

هذا هو الشكل المستهدف. ستة أشكال، خط أساس واحد، لا شيء في الخلفية للجدال حوله: لنرى حزمة المرجع التي قادت مقطع العرض التوضيحي: البطل الذكر في المخمل الأسود، البطلة الأنثى في الدانتيل الكريمي الفكتوري، ثلاث زوايا لكل منهما، ملف واحد. منظر أمامي وجانبي وخلفي لأزياء فيكتورية سوداء وكريمية تشغيل GPT Image 2 الخاص بي لموجه الخطوة 1، للمقارنة مع المرجع أعلاه.

الخطوة 2: تثبيت الموقع بلوحة مشهد من ست لوحات

لقد ثبت الوجه. الضوء سيظل يخونك. الصورة المرجعية الثانية تثبت ستة مواقع للكاميرا، اتجاه ضوء القمر، مقدار الضباب في الهواء ومدى رطوبة الأرضية التي تقرأها. أنت تخبر النموذج أن هذا الفيلم لديه إعداد إضاءة واحد بالضبط.

plaintext
1لوحة موقع سينمائية من ست لوحات، صفين في 3 أعمدة، فواصل سوداء رفيعة بين اللوحات، كل لوحة مكتوب عليها بتعليق صغير أبيض أنيق بأحرف كبيرة متباعدة في أسفل تلك اللوحة. الموضوع: داخل قلعة قوطية مهجورة ليلاً. ضوء قمر أزرق بارد، ضباب منخفض متحرك، أرضية حجرية رطبة عاكسة، نوافذ زجاجية ملونة طويلة، أضواء شموع حديدية ذات لهب دافئ صغير، أسود مشبع عميق، ستائر مخملية ثقيلة. لا يوجد أشخاص في أي لوحة.
2
3اللوحة 1، التعليق "منظر واسع تأسيسي - ممر": ممر طويل بأعمدة يتجه نحو نافذة زجاجية ملونة مضاءة.
4اللوحة 2، التعليق "زاوية منخفضة - ضوء القمر عبر الأرضية": كاميرا منخفضة، شعاع من ضوء القمر يمر عبر ألواح حجرية رطبة.
5اللوحة 3، التعليق "تكوين المدخل والدرج": مدخل مقوس يؤطر درجًا حجريًا منحنيًا.
6اللوحة 4، التعليق "تفاصيل قريبة - باب منحوت": لقطة ضيقة لباب خشبي منحوت ثقيل بمقبض حديدي.
7اللوحة 5، التعليق "منظر بجانب النافذة - ضباب وستائر": نافذة طويلة، ضباب يتدحرج، حافة ستارة في المقدمة.
8اللوحة 6، التعليق "إطار ملصق نهائي - قاعة فارغة": قاعة فارغة متناظرة، سجادة ممر منقوشة تؤدي إلى النافذة.
9
10فوتوغرافي، سينمائي، حبيبات فيلم، تدرج ألوان ثابت عبر جميع اللوحات الست.

الإعدادات: نفس النموذج، الجودة عالية، نسبة العرض إلى الارتفاع 16:9. ست لوحات ستوري بورد من الديكورات الداخلية للقلعة القوطية المظلمة مع ضوء القمر لوحة الموقع التي قادت مقطع العرض التوضيحي: ستة ديكورات داخلية للقلعة القوطية، تدرج لوني واحد، تعليقات قابلة للقراءة. ست زوايا كاميرا سينمائية لداخل قلعة قوطية مظلمة تشغيل GPT Image 2 الخاص بي لموجه لوحة الخطوة 2.

الخطوة 3: توليد اللقطة باستخدام MiniMax H3 مرجع إلى فيديو

صورتان مرجعيتان بالإضافة إلى موجه واحد يحمل مواقع الكاميرا واتجاه الصوت. يتم إنتاج الصوت في نفس التمريرة، لذلك لا توجد خطوة صوت أو موسيقى منفصلة. حافظ على المدة قصيرة أثناء الضبط، ثم ادفعها إلى 15 للقطع الحقيقي.

plaintext
1الصورة المرجعية 1 هي ورقة الشخصية: الرجل على اليسار هو البطل الذكر، المرأة على اليمين هي البطلة الأنثى. حافظ على هوية كل منهما تمامًا كما هو موضح: خط فكه، شعره الداكن المموج، معطفه المخملي الأسود، صدرية المطرزة بالذهب الأسود وربطة عنقه الحريرية السوداء؛ شعرها الكستنائي نصف المرفوع المضفر وفستان الدانتيل الكريمي الفكتوري. الصورة المرجعية 2 هي لوحة الموقع والإضاءة: طابق ضوء قمرها الأزرق البارد، الضباب المتحرك، الأرضية الحجرية الرطبة العاكسة ونغماتها السوداء المشبعة.
2
39:16 رأسي، مظهر دراما قصيرة حية راقية، عمق مجال ضحل، تباين سينمائي، لا ترجمات، لا نص على الشاشة، لا علامة مائية.
4
5اللقطة 1: لقطة متوسطة قريبة، الكاميرا تتحرك ببطء إلى الداخل. البطلة الأنثى تقف في الممر المضاء بضوء القمر، تتنفس بشكل ضحل، عيناها مثبتتان على شيء خارج الإطار إلى اليمين. الضباب يتحرك بجانبها عند ارتفاع الركبة.
6اللقطة 2: قطع حاد. فوق الكتف من خلفها، البطل الذكر يخرج من القوس المظلم إلى ضوء القمر، المعطف يلتقط الضوء، تعبير بارد وفضولي.
7اللقطة 3: لقطة قريبة ضيقة لوجهه، نصف مضاء بالنافذة، ثم لقطة قريبة مطابقة لوجهها وهي ترفض النظر بعيدًا.
8
9الصوت: طنين جهير منخفض مستمر، صدى حجري بعيد، أنفاسها غير المستقرة، خطوة ثقيلة واحدة وهو يخطو إلى الضوء، انتفاخ وتر واحد ناعم في القطع الأخير.

الإعدادات: النموذج MiniMax H3 Reference-to-Video، الدقة 2K، المدة 8 (الافتراضي المنزلق؛ ادفع إلى 15 للقطع الحقيقي)، نسبة العرض إلى الارتفاع تكيفية، وكلا الملفين في المواد المرجعية. اللوحة تعدهم كـ 2 من 9، لذا لديك مساحة كافية لإضافة ألواح الزي أو الدعائم لاحقًا.

جدير بالذكر ما حدث مع النسبة. تركت نسبة العرض إلى الارتفاع على تكيفية وكتبت فقط "9:16 رأسي" داخل الموجه. عاد H3 عموديًا على أي حال، لذا قرأ الإطار من النص بدلاً من الحاجة إلى حقل النموذج. واجهة مولد فيديو AI تعرض موجه النص ومعاينة الفيديو المكتملة MiniMax H3 Reference-to-Video على Atlas Cloud، اكتمل التشغيل: كلا الملفين المرجعيين تم تحميلهما كـ 2 من 9، الدقة 2K، والمقطع الرأسي المولد يعمل في لوحة OUTPUT.

الإطار الأول هو البطلة الأنثى في مشد الدانتيل الكريمي، واقفة في الممر من لوحة اللوحة 1، مع ضباب على ارتفاع الركبة وضوء القمر يضرب الأرضية الرطبة بالضبط حيث وضعته اللوحة. كلتا الصورتين المرجعيتين وصلتا.

الخطوة 4: تشغيل التحكم في Seedance 2.5 مقابل MiniMax H3 مع الحزمة المتطابقة

لا تغير كلمة واحدة. نفس الصورتين المرجعيتين، نفس الموجه، نموذج مختلف. تركت المدة الافتراضية لكل صفحة خاصة بها دون إجبارها على التطابق، وأقول ما أعادته كل منها أدناه. إعادة صياغة موجه "لـ" النموذج الآخر هي بالضبط كيف تبدأ المقارنات في الكذب.

plaintext
1نفس الموجه كما في الخطوة 3، حرفيًا. لا تعيد صياغته للنموذج الآخر.

الإعدادات: النموذج Seedance 2.0 Reference-to-Video، الدقة 720p، نفس الصورتين المرجعيتين في الصور المرجعية (مرة أخرى 2 من 9، مع فتحات منفصلة لما يصل إلى 3 فيديوهات مرجعية و 3 ملفات صوت مرجعية). المدة تركت على الافتراضي للصفحة، والتي عادت كمقطع مدته 10 ثوانٍ. واجهة توليد فيديو AI تعرض موجه نص وفيديو مكتمل Seedance 2.0 Reference-to-Video على Atlas Cloud، اكتمل التشغيل مع نفس حزمة المرجع والموجه من الخطوة 3، ونتيجة 10 ثوانٍ في لوحة OUTPUT.

هذا ما أظهرته لوحتا OUTPUT بالفعل، وأنا أبلغ عنه بشكل مسطح بدلاً من اختيار فائز.

كلا التشغيلين حافظا على الشخصية. نفس فستان الدانتيل الكريمي مع نفس خط العنق وأساور الأكمام، نفس الشعر الكستنائي، نفس الممر المليء بالضباب وضوء القمر المأخوذ من اللوحة. لم يخترع أي منهما امرأة مختلفة. حزمة المرجع قامت بهذا العمل على كلا الجانبين، وهو ما يهمني أكثر.

الاختلافات كانت حول الشكل، لا الوجه. نقطة نهاية Seedance هذه سلمت 720p؛ H3 سلم 2K من مدخلات متطابقة. وانقسم التأطير: قرأ H3 "9:16 رأسي" مباشرة من نص الموجه وأعاد عموديًا، بينما عاد تشغيل Seedance بـ 16:9 لأن تلك الصفحة تحمل عنصر التحكم الخاص بها في نسبة العرض إلى الارتفاع ونص الموجه وحده لم يتجاوزها. إذا كنت تقوم بالقص لـ TikTok، فإن هذا الاختلاف سيكلفك تشغيلًا في المرة الأولى التي تنسى فيها حقل النموذج. Seedance 2.5 من المحتمل أن يغير نصف الدقة من هذا ويضيف عمليات إعادة لف على مستوى المنطقة، ولن أدعي أنني قست ذلك.

الخطوة 5: إصلاح لقطة واحدة دون إعادة لف المقطع بالكامل

التكلفة الحقيقية للدراما القصيرة ليست التوليد الأول. إنها المراجعة السابعة. H3 يقبل مقطعًا موجودًا كمدخل ويحرر حسب التعليمات، ممسكًا بما لم تذكره. عرض Seedance 2.5 هنا أدق: إعادة رسم منطقة من الإطار وترك الأداء والإضاءة والكاميرا كما هي.

plaintext
1باستخدام المقطع المقدم: احتفظ بالشخصيتين، ملابسهما، حركات الكاميرا وإيقاع القطع تمامًا كما هي. غيّر فقط البيئة، استبدل الممر الحجري المضاء بضوء القمر بقاعة الرقص الخاصة بالقلعة نفسها، نوافذ مقوسة طويلة، ثريا مضاءة، وضوء شموع دافئ، وأعد إضاءة كلتا الشخصيتين بحيث يأتي ضوءهما الرئيسي من الثريا على يسار الإطار بدلاً من النافذة. أعد كتابة سطرها المنطوق الوحيد إلى "لم تكن نائمًا أبدًا، أليس كذلك." حافظ على توقيت أدائها على نفس الإيقاعات.

الإعدادات: MiniMax H3 Reference-to-Video مع مقطع الخطوة 3 كمدخل مرجعي، المدة 5، الدقة 2K.

 

 

ما وراء اختبار Seedance 2.5 مقابل MiniMax H3: أربع طرق لدفع حزمة المرجع

نفس الشخصية، الحلقة التالية. احفظ ورقة الخطوة 1 كأصل وغيّر فقط قائمة اللقطات وكتلة القصة في الموجه. الهوية تأتي من ملف، وليس من ذاكرتك لكيفية صياغتها يوم الثلاثاء الماضي.

 

 

ثبت الصوت أيضًا. H3 يأخذ ما يصل إلى ثلاثة مراجع صوتية، مدة كل منها 2 إلى 15 ثانية، ويجب أن ترافق إدخال صورة أو فيديو. أعطه عينة صوتية وسيتحدث الشخصية بهذا الجرس، لذا لن تعيد تمثيل صوتي بين الحلقات.

 

 

احجب الكاميرا قبل أن تدفع مقابل العرض. مرجع Seedance 2.5 إلى فيديو يقبل نماذج بيضاء ثلاثية الأبعاد وألواح شاشة خضراء، لذا يمكنك تثبيت التأطير على هندسة رمادية وبعدها فقط تلتزم بمظهر نهائي. هذا المثال شُغّل على Seedance 2.1، عضو سابق من العائلة، لكن شكل سير العمل هو نفسه.

 

 

ترجمة مقطع رئيسي واحد بدلاً من إعادة تصويره. استبدال على مستوى المنطقة يغير وجهًا أو منتجًا أو لغة منطوقة بينما تبقى الكاميرا والتوقيت ومدة الشفاه ثابتة. هنا يتم إعادة تمثيل مقطع جمال رئيسي واحد وإعادة صوته للإسبانية والكورية والهندية، مع تثبيت الغرفة والتأطير ومدة الشفاه.

 

 

ولأن شخصًا ما سيسأل كيف يبدو نقل الحركة عندما تتوقف عن كونك عاقلًا: ثلاثة رجال في بدلات، تم استبدالهم بثلاثة كابيبارا واقعية، تتبع مسار حركة المقطع الأصلي نبضة بنبضة حتى يتكدسون في هرم.

 

 

هناك أيضًا النسخة العادية من كل هذا، التي لا ينشرها أحد: ملصق ثابت يصبح ملصقًا متحركًا، ويبقى التخطيط على قيد الحياة. صبي كرتوني في هودي ديناصور وردي يمد يده بمخلب عملاق ملصق المصدر الثابت. أطعمه لمرجع إلى فيديو مع "احتفظ بالإطار واللوحة والتخطيط، حرك النص" وستحصل على نسخة متحركة من نفس التصميم.

ما هي تكلفة فيلم قصير لـ Seedance 2.5 مقابل MiniMax H3 فعليًا؟

لا توجد أرقام هنا، لأن الأرقام تتحرك والهيكل لا يتغير. كلا العائلتين تفوتان بالثانية، الدفع حسب الاستخدام، لا مقعد ولا اشتراك. هذا يترك ثلاثة متغيرات: الثواني، طبقة الدقة، وعمليات إعادة اللف.

الثالثة هي الفاتورة بأكملها. مقطع مدته 15 ثانية ينجح من المحاولة الأولى هو شحنة واحدة. نفس المقطع في المحاولة السابعة هو سبع. لذا فإن الحركة الموفرة للنقود ليست اختيار النموذج الأرخص لكل ثانية، بل هي الحصول على حزمة المرجع بشكل صحيح قبل أن تولد أي شيء. استدعاءات الصورتين في الخطوة 1 والخطوة 2 هما أرخص خط في خط الأنابيب بأكمله وهما اللذان يقرران عدد استدعاءات الفيديو التي ستجريها. أعلى عائد على الإنفاق في السلسلة بأكملها، بفارق كبير.

ثم صحح غريزة الثواني. نفس حزمة المرجع، نفس وقت التشغيل: مرجع H3 إلى فيديو يعيد 1440p، نقطة نهاية Seedance المرجعية هذه تعيد 720p. الثانية هي الوحدة الخاطئة. البكسل لكل إطار، وما إذا كنت ستدفع بعد ذلك مقابل تمريرة رفع دقة منفصلة، هو الصحيح.

الصوت ينتمي أيضًا إلى الحساب. كلا الجانبين ينتجان صوتًا متزامنًا أصليًا في نفس التمريرة. إذا كان خط أنابيبك الحالي هو نموذج فيديو بالإضافة إلى TTS بالإضافة إلى محرر يقوم بمحاذاة المسارات، فإن ما توفره هو استدعاءين API وبعد ظهر شخص، وهذا التوفير لا يظهر في أي قائمة أسعار في أي مكان.

أي واحد لأي وظيفة:

الوظيفةاخترلماذاتنبيه
دراما قصيرة رأسية، 9:16، TikTok أو ReelShortMiniMax H31440p رأسي مع ستيريو أصلي، قابل للاستدعاء الآن، 15 ثانية هي خطاف كاملتقطع عند 15 ثانية، لذا خطط الإيقاعات وفقًا لذلك
فيلم علامة تجارية مستمر لمدة 30 ثانيةSeedance 2.5توليد واحد، بدون ربط، دقة 4K أصليةتحقق من التوفر على منصتك أولاً
إصلاح لقطة واحدة داخل قطع معتمدSeedance 2.5إعادة رسم على مستوى المنطقة يترك الباقي سليمًاتحرير المقطع الكامل لـ H3 يوصلك إلى معظم الطريق اليوم
قصاصات المنتج والتجارة الإلكترونيةأي منهماكلاهما يحمل النص على الشاشة وعلامات العلامة التجارية بشكل جيدتحقق من النص بالدقة التي تشحن بها
عروض توضيحية للألعاب أو الواجهاتMiniMax H3استقرار واجهة المستخدم والطباعة بدقة 2K قويسقف 15 ثانية لتمريرة واحدة
إصدارات متعددة اللغات لمقطع رئيسي واحدSeedance 2.5استبدال المنطقة بالإضافة إلى صوت متعدد اللغاتجودة الترجمة لا تزال بحاجة إلى فحص أصلي
الشحن الليلةMiniMax H3ثلاث نقاط نهاية حية، بالإضافة إلى كل Seedance 2.0الوصول إلى Seedance 2.5 يختلف حسب المنصة

قبل أن تشحن. قالت MiniMax إن أوزان H3 ستتبع في غضون أيام من الإطلاق، والأوزان المفتوحة ليست نفس الترخيص التجاري، لذا اقرأ الشروط قبل أن تستضيف بنفسك. سياسة العلامة المائية والاستخدام التجاري تختلف أيضًا بين تطبيقات المستهلك والوصول API على كلا الجانبين، ولم أتمكن من تأكيد أي منهما من صفحة شروط أساسية أثناء كتابة هذا، لذا تحقق من شروط المزود بدلاً من أخذ كلمتي. ولا شيء في أي ترخيص نموذج يغطي الشبه أو العلامة التجارية. إذا كان هناك شخص حقيقي أو علامة تجارية حقيقية أو ملكية فكرية لشخص آخر في حزمة المرجع الخاصة بك، فهذه مسألة قانونية منفصلة ولن تجيب عليها شروط النموذج.

كل نموذج في الجداول أعلاه يعمل على نفس المفتاح، و صفحات النماذج تحمل الأسعار الحالية بالإضافة إلى كود النسخ واللصق، بما في ذلك أي عروض ترويجية قد تكون جارية على خط Seedance هذا الأسبوع.

الأسئلة الشائعة

هل Seedance 2.5 أفضل من MiniMax H3 لثبات الشخصية؟

على الورق يجب أن يكون، مع ما يصل إلى 50 مرجعًا متعدد الوسائط مقابل 12 ملفًا لـ H3، بالإضافة إلى عمليات إعادة اللف على مستوى المنطقة. ولكن اعتبارًا من 31 يوليو 2026، لا يوجد اختبار عام مقترن يمكنني الإشارة إليه، وليس لدى Seedance 2.5 تصنيف ساحة بعد. في التشغيلات التي تمكنت فعليًا من إجرائها، كان المتغير الذي يقرر استقرار الهوية هو بنية حزمة المرجع، وليس جيل النموذج: مع ورقة تحول مركبة واحدة بالإضافة إلى لوحة إضاءة واحدة، كلا الجانبين احتفظا بالشخصية. احصل على الحزمة بشكل صحيح قبل أن تقضي وقتًا في التسوق بين النماذج.

هل يمكنني استخدام Seedance 2.5 الآن، أم يجب أن أنتظر؟

API الخاص به مباشر لدى ByteDance. التوفر على منصات النماذج الخارجية غير متساوٍ، وعلى المنصة التي اختبرتها لا يزال إشعار اليوم الأول. إذا كنت بحاجة إلى ناتج الليلة، فإن الخيارات القابلة للاستدعاء هي نقاط نهاية MiniMax H3 الثلاث وخط Seedance 2.0 الشحن بالكامل.

هل يقوم MiniMax H3 حقًا بفيديو مدته 30 ثانية؟

لا. المواصفات هي 5 إلى 15 ثانية لكل توليد بمعدل 24 إطارًا في الثانية. أي شيء أطول هو تمديد أو ربط، وهو شيء مختلف بمخاطر انحراف مختلفة. التوليد الوحيد لمدة 30 ثانية يعود لـ Seedance 2.5. لا تدع الادعاءين يختلطان.

هل يولد كلا النموذجين صوتًا، وهل يمكنني الاحتفاظ بصوت واحد عبر الحلقات؟

كلاهما ينتج صوتًا متزامنًا أصليًا في نفس التمريرة، و H3 يخرج ستيريو في كل نتيجة. للحصول على صوت ثابت، يقبل H3 ما يصل إلى ثلاثة مراجع صوتية مدة كل منها 2 إلى 15 ثانية، والتي يجب تقديمها جنبًا إلى جنب مع إدخال صورة أو فيديو وليس بمفردها.

كم عدد الصور المرجعية التي يجب أن أرسلها فعليًا؟

أقل مما تعتقد، منظمة أفضل مما تعتقد. تركيبة واحدة جيدة التكوين تتغلب عمومًا على ستة اقتصاصات فضفاضة، لأن الملفات المنفصلة تدعو النموذج إلى حساب متوسطها في شخص غير موجود. أعطه مهمتين واضحتين، الهوية والإضاءة، ولا تدرج عينات أسلوب تتعارض مع بعضها البعض.

أي نموذج يجب أن أستخدمه للدراما القصيرة الرأسية بأسلوب TikTok أو ReelShort؟

الشحن هذا الأسبوع، بدقة 9:16، عالية الدقة مع صوت مختلط بالفعل: MiniMax H3. تخطيط مشهد مستمر لمدة 30 ثانية حيث تتوقع إعادة لف مناطق فردية بدلاً من مقاطع كاملة: ابنِ لـ Seedance 2.5 وتحقق عندما تفتح منصتك.

أحدث النماذج

واجهة برمجية واحدة لكل وسائط الذكاء الاصطناعي.

استكشف جميع النماذج