لأسبوعين فقط | خصم 20% على Seedream 5.0 Pro!

Seedance 2.5 ضد MiniMax H3: الجميع اختبروا المرونة لمدة 30 ثانية. لم يختبر أحد اللقطة 4.

Seedance 2.5 مقابل MiniMax H3، نفس ورقة الشخصية، نفس المطالبة. المواصفات الحقيقية، سير عمل دراما قصيرة من 5 خطوات قابل للنسخ واللصق، وأيهما يحافظ على الوجه عبر أربع لقطات.

MiniMax أطلقت H3 يوم الجمعة. في غضون أربع وعشرين ساعة، أصبح Seedance 2.5 بين أيدي الناس، وانهار الجدول الزمني في محادثة واحدة: ثلاثون ثانية، 4K أصلي، خمسون مرجع إدخال. منشور إطلاق H3 كان جالسًا تحته، بهدوء، مع عدم وجود أحد تقريبًا يجري اختبارًا حقيقيًا عليه.

أفهم لماذا. ثلاثون ثانية رقم رائع. يناسب العناوين الرئيسية.

لكن إذا كنت تصنع دراما قصيرة عمودية حقًا، فأنت تعلم أن الشيء الذي يفسد ليلتك ليس الثانية الثلاثين. إنها اللقطة 4. يتغير خط فك البطل بنصف سنتيمتر، وتفقد ربطة عنقه طية، ويبتعد المشاهد قبل أن تصل الخطافة. لا أحد يغادر لأن المقطع كان خمس عشرة ثانية بدلاً من ثلاثين. يغادرون لأن الرجل في اللقطة القريبة ليس هو الرجل في اللقطة البعيدة.

لذا تخطيت مبارزة ورقة المواصفات. بنيت ورقة تحويل شخصية واحدة، ولوحة موقع من ست لوحات، وكتبت طلب دراما قصيرة قوطية مدتها 15 ثانية، وأرسلت الحزمة المتطابقة لكلا الجانبين. ثم حدقت في الوجه.

الخلاصات الرئيسية

  • كلاهما حقيقي، لكن ليس بنفس السهولة في الوصول. نقاط نهاية H3 الثلاث (نص، صورة، ومرجع إلى فيديو) مباشرة وقابلة للاستدعاء الآن. API Seedance 2.5 موجود في ByteDance، لكن على منصة النماذج المتعددة التي أجريت عليها كل شيء، لا تزال صفحة اليوم 0، لذا فإن جانب Seedance في المقارنة المباشرة هو Seedance 2.0 Reference-to-Video. أشير إلى ذلك أينما كان مهمًا.
  • المواصفات تنقسم بوضوح. Seedance 2.5 = حتى 30 ثانية في توليد واحد، 4K أصلي، حتى 50 مرجعًا متعدد الوسائط، تحرير على مستوى المنطقة. H3 = 5 إلى 15 ثانية، 2K أصلي بمعدل 24 إطارًا في الثانية، 9 صور + 3 فيديوهات + 3 مقاطع صوتية (12 ملفًا كحد أقصى)، صوت ستيريو على كل مخرج، تحرير تعليمات للقطة كاملة.
  • ثبات الشخصية مشكلة تغليف، وليست مشكلة توليد نموذج. باستخدام ورقة تحويل مركبة واحدة بالإضافة إلى لوحة إضاءة واحدة، حافظ كلا النموذجين على نفس الوجه ونفس الملابس. لا رقم توليد أنقذ أو أفسد اللقطة؛ الحزمة فعلت ذلك.
  • النموذج الذي لم يختبره أحد مصنف بالفعل في المرتبة الثالثة. في ساحة Artificial Analysis للصورة إلى فيديو، يجلس H3 عند 1,185 Elo خلف Seedance 2.0 عند 1,196. Seedance 2.5 ليس على اللوحة بعد على الإطلاق.
  • كلاهما يولد صوته الخاص. يقبل H3 أيضًا ما يصل إلى ثلاثة مراجع صوتية لتثبيت صوت على شخصية، مما يحذف مرحلة تحويل النص إلى كلام ومزامنة كاملة من خط أنابيب الدراما القصيرة.
  • اسأل عن البكسل لكل إطار، وليس الثواني. نفس حزمة المرجع، نفس وقت التشغيل: H3's reference-to-video يعيد 1440p، Seedance 2.0's reference-to-video يعيد 720p. هذا يعيد تأطير مسألة التكلفة بأكملها.

أرقام Seedance 2.5 الخاصة المقترنة لم تصل بعد. سأضيفها في اليوم الذي تفتح فيه نقطة النهاية حيث أختبر.

نتيجة Seedance 2.5 مقابل MiniMax H3، قبل أي نظرية

قبل أي نظرية، إليك ما ينتجه سير العمل. هذه أربع لقطات مأخوذة من مقطع عمودي منتهٍ مدته 15 ثانية ومبلطة. إنها تشغيل مرجع H3 الخاص ب MiniMax المبني تمامًا من ورقة الشخصية ولوحة الموقع التي ستراها في الخطوة 1 والخطوة 2، بدقة 1440x2560 أصلية. تشغيلاتي الخاصة لنفس الحزمة تأتي لاحقًا، في البرنامج التعليمي، مع حالة الملعب مرئية.

 

 

تصل إلى الباب المنحوت، وهو اللوحة 4 من لوحة الموقع، ثم مواجهة الممر، ثم لقطة قريبة ضيقة عليه، ثم اللقطة الثنائية. خط شعره ينفصل بنفس الطريقة في الملف الشخصي وفي اللقطة القريبة. تاجها المضفر نصف المرفوع ينجو من لقطة قريبة للوجه بالكامل، وهو بالضبط المكان الذي تعيد فيه معظم النماذج بناء وجه بهدوء. يحافظ صديري الدانتيل الكريمي على نفس خط العنق وكفة الكم من الإطار الأول إلى الأخير.

هذا هو الاختبار بأكمله. ليس ثلاثين ثانية. أربع لقطات وخط فك.

لماذا انكسر Seedance 2.5 مقابل MiniMax H3 في نفس الأسبوع، ولماذا معظم اختبارات الشخصية عديمة الفائدة

أصدرت MiniMax H3 في 30 يوليو، وهو نموذج فيديو متعدد الوسائط للأغراض العامة يقرأ النص والصور والفيديو والصوت كسياق واحد ويعيد مقاطع من 5 إلى 15 ثانية بدقة تصل إلى 2K مع صوت ستيريو أصلي. يمكنه أيضًا تحرير اللقطات الحالية ونقل الحركة من مقطع إلى آخر، وقالت MiniMax إن الأوزان ستتبع في غضون أيام (رويترز، يوليو 2026).

هبط Seedance 2.5 في نفس الإطار برقم أعلى: 30 ثانية في توليد واحد، 4K أصلي، وما يصل إلى 50 مرجع إدخال متعدد الوسائط في مهمة واحدة (The Next Web، يوليو 2026). API الخاص به موجود بالفعل في أيدي المطورين، مع تحرير موضعي يعيد رسم جزء من الإطار مع ترك الأداء والإضاءة وسلوك الكاميرا سليمة، ومرجع إلى فيديو يقبل لوحات الشاشة الخضراء أو كتل النماذج البيضاء ثلاثية الأبعاد، وإحدى عشرة لغة، ووضع فيديو طويل تجريبي يصل إلى 180 ثانية (CineD، يوليو 2026).

 

 

فجوة الانتباه هي الجزء المثير للاهتمام. تقريبًا كل منشور وجدته كان مقطع 2.5. وفي الوقت نفسه، تقول أرقام الساحة العامة شيئًا آخر: على لوحة متصدرين Artificial Analysis للصورة إلى فيديو، يتصدر Seedance 2.0 بدقة 720p بـ 1,196 Elo، يليه Gemini Omni Flash بـ 1,195، و MiniMax H3 هو بالفعل الثالث بـ 1,185، بعد أربعة أيام من الإطلاق. Seedance 2.5 ليس له تصنيف هناك بعد (Artificial Analysis، يوليو 2026). النموذج الذي لديه أقل ثرثرة هو الذي لديه أعلى نسبة من النقاط إلى الاهتمام.

الآن الجزء الذي يحدد مخرجاتك فعليًا، لأنه لا علاقة له تقريبًا بأي شعار تختار.

معظم اختبارات ثبات الشخصية تفشل قبل أن يشارك النموذج حتى. أربعة أوضاع فشل، وكلها تقع على عاتقك لإصلاحها:

وضع الفشلما تراه في المخرجاتالإصلاح
إرسال مراجع متعددة الزوايا كملفات منفصلةوجه كل لقطة "قريب من الصواب" ولا يتفق اثنانقم بتركيب الزوايا في صورة واحدة، ثم عين الأدوار في الطلب ("الرجل على اليسار"، "المرأة على اليمين")
إعادة كتابة وصف الشخصية لكل لقطةالملحقات والإكسسوارات تنجرف من لقطة لأخرىاكتب كتلة الهوية مرة واحدة وأعد استخدامها حرفيًا؛ فقط الكاميرا والإجراء يتغيران لكل لقطة
السماح للإضاءة بالتحرك مع المشهديتم إعادة بناء الوجه هيكليًا في الضوء الجديدقم ببناء لوحة موقع منفصلة تقفل اتجاه الضوء والضباب وانعكاس الأرضية، وأطعمها كمرجع
معاملة المدة القصوى كمقياس جودةانحراف واحد في غضون 30 ثانية يقتل الـ 30 كلهاقص إلى التفاصيل التي يمكنك إعادة رميها، ثم تحدث عن الطول

الصف الأول هو الذي يخطئ فيه الناس أكثر. أرسل ست صور منفردة الزاوية ويعاملها النموذج كستة أشخاص مرشحين ويحسب متوسطهم. أرسل صورة مركبة واحدة نظيفة ويعاملها كشخص واحد يُرى من ثلاث جهات. نفس البكسلات، نتيجة مختلفة تمامًا.

 

 

ورقة مواصفات Seedance 2.5 مقابل MiniMax H3، وما يمكنك استدعاؤه فعليًا اليوم

افصل القدرة عن التوفر ويتضح التوتر. على القدرة الخام، يتفوق Seedance 2.5 في المدة، وسقف الدقة، وعدد المراجع، وتفاصيل التحرير. على التوفر، H3 هو النموذج الذي لديه ثلاث نقاط نهاية مباشرة على منصة نموذج للأغراض العامة هذا الأسبوع. إذا كنت تقوم بمقارنة نماذج فيديو AI لتخطيط 2026، فإن العمود الثاني مهم بقدر الأول.

 MiniMax H3Seedance 2.5Seedance 2.0 Ref-to-Video (ما شغّلته)
أقصى طول، توليد واحد5 إلى 15 ثانيةحتى 30 ثانية، بدون خياطة (وضع تجريبي إلى 180 ثانية، تجريبي)قائمة مقاطع قصيرة، راجع صفحة النموذج
الدقة2K أصلي، جانب قصير 1440p بنسبة 16:9 إلى 9:16؛ مستوى 768p مدرج كقادم4K أصلي، لون 10 بتحتى 720p على نقطة النهاية هذه
معدل الإطارات24 إطارًا في الثانيةغير منشور بشكل منفصلغير منشور بشكل منفصل
مدخلات المرجع9 صور + 3 فيديوهات + 3 صوت، 12 ملفًا إجمالاًحتى 50 مرجعًا متعدد الوسائط9 صور + 3 فيديوهات + 3 صوت
الصوت الأصلينعم، كل مخرج، ستيريونعم، بالإضافة إلى 11 لغة ترجمة وصوتنعم
تفاصيل التحريرتحرير تعليمات للقطة كاملة (تبديل شخصية، خلفية، إضاءة، حوار)تحرير على مستوى المنطقة يعيد رسم جزء من إطارتحرير تعليمات للقطة كاملة
سقف الطلب7,000 حرفغير منشورغير منشور
الأوزان المفتوحةأُعلن أنها ستتبع في غضون أيام من الإطلاقغير معلنغير معلن
Artificial Analysis I2V Elo، 31 يوليو 20261,185 (الثالث)لم يصنف بعد1,196 (الأول، إدخال Dreamina 720p)
قابل للاستدعاء على المنصة التي اختبرتهانعم، 3 نقاط نهايةليس بعد، صفحة اليوم 0نعم

الإفصاح الكامل عن إعداد الاختبار. لم يكن Seedance 2.5 مفتوحًا على منصتي عندما شغّلت هذا، لذا فإن جانب Seedance هو Seedance 2.0 Reference-to-Video، العضو الحالي الشحن من نفس العائلة مع نفس نظام المرجع رباعي الوسائط. حيثما قد يغير 2.5 الإجابة، أقول ذلك. صفحة Seedance 2.5 هي إشعار اليوم 0 في الوقت الحالي.

كل ما يلي يعمل في علامة تبويب متصفح واحدة، على مفتاح واحد، ثلاثة نماذج إجمالاً:

الخطوةالنموذجما ينتجهالإعدادات الرئيسيةما يحدد التكلفة
1OpenAI GPT Image 2 Text-to-Imageورقة تحويل الشخصيةالجودة عالية، 16:9لكل صورة، الدفع حسب الاستخدام، السعر الحالي على صفحة النموذج
2نفس النموذج، تشغيل ثانٍلوحة الموقع والإضاءة المكونة من ست لوحاتالجودة عالية، 16:9لكل صورة، الدفع حسب الاستخدام
3MiniMax H3 Reference-to-Videoالمقطع 9:16 مع صوت أصلي9:16، 2K، المدة 5 للاختبار و15 للقطعة الحقيقيةالثواني × الدقة، مفوتر بالثانية
4Seedance 2.0 Reference-to-Videoتشغيل التحكم، مدخلات متطابقة9:16، أعلى دقة متاحة، نفس المدةالثواني × الدقة، مفوتر بالثانية
5H3 Reference-to-Video، مقطع كمدخللقطة واحدة ثابتة بدون إعادة رمي كل شيءنفس الدقة، مدة قصيرةالثواني × الدقة، مفوتر بالثانية

لدى H3 أيضًا إدخالات نص إلى فيديو و صورة إلى فيديو إذا كنت تريد خط أساس نصي نقي أو تحكم في الإطار الأول والأخير بدلاً من ذلك.

شيء آخر يستحق المعرفة قبل أن تخطط لمجموعة: النص على الشاشة. هذا التسلسل الافتتاحي لـ H3 مدته 15 ثانية يحمل اعتمادات اللغة الإنجليزية من خلال ثماني قطع قاسية دون خطأ إملائي واحد، وهو أحد أصعب الأشياء للحفاظ على استقرارها في الفيديو المولد.

 

 

سير عمل الدراما القصيرة Seedance 2.5 مقابل MiniMax H3، خطوة بخطوة

خمس خطوات. انسخ الطلبات تمامًا كما هي مكتوبة، بما في ذلك الأجزاء القبيحة. لم أنظفها للمقال ولا يجب عليك تنظيفها للنموذج.

الخطوة 1: بناء ورقة الشخصية باستخدام GPT Image 2

اصنع حزمة المرجع قبل أن تصنع أي فيديو. صورة واحدة، شخصيتان، ثلاث زوايا لكل منهما، خلفية بيضاء نقية سلسة، إضاءة استوديو متساوية. هذا يزيل كل غموض باستثناء الذي تهتم به: كيف يبدو هذا الشخص.

plaintext
1ورقة مرجعية لتحويل شخصية كاملة الجسم على خلفية بيضاء نقية سلسة، شخصيتان جنبًا إلى جنب، ستة أشكال إجمالاً، إضاءة استوديو محايدة متساوية، لا ظلال على الأرض، لا نص، لا تسميات، لا علامة مائية.
2
3النصف الأيسر، البطل الذكر، ثلاث زوايا في صف: أمامي، ملف شخصي يمين، خلفي. أواخر العشرينات، بشرة شاحبة، شعر داكن مموج متوسط الطول، فك حاد. يرتدي معطفًا طويلاً من المخمل الأسود يصل إلى الأرض مع تطريز دقيق بنفس اللون على الياقات والأساور، صدرية بروكار سوداء، ربطة عنق حريرية سوداء، سروال أسود مستقيم، أحذية ديربي جلدية سوداء مصقولة. ذراعاه مسترخيتان على جانبيه، تعبير محايد.
4
5النصف الأيمن، البطلة الأنثى، ثلاث زوايا في صف: أمامي، ملف شخصي يمين، خلفي. أوائل العشرينات، بشرة فاتحة، شعر طويل مموج بلون الكستناء مع تاج مضفر نصف مرفوع. ترتدي فستانًا من الدانتيل القطني الكريمي الفيكتوري، أكمام طويلة مع أساور دانتيل، صديري ضيق بأزرار صغيرة، تنورة كاملة بطول الكاحل، حذاء بكعب منخفض ورباط كاحل كريمي. ذراعاها مسترخيتان على جانبيهما، تعبير محايد.
6
7واقعية فوتوغرافية، مقياس متسق بين جميع الأشكال الستة، أقدام مصطفة على نفس خط الأساس، تركيز حاد من الحافة إلى الحافة.

الإعدادات: النموذج OpenAI GPT Image 2 Text-to-Image، الجودة عالية، نسبة العرض إلى الارتفاع 16:9، كل شيء آخر افتراضي. المجموع: 11 كلمة. مثالي. واجهة مولد صور AI تعرض إدخال الطلب والشخصية المولدة GPT Image 2 Text-to-Image على Atlas Cloud، اكتمل التشغيل: طلب التحويل على اليسار، ستة أشكال على ورقة بيضاء واحدة في لوحة OUTPUT.

هذا هو الشكل المستهدف. ستة أشكال، خط أساس واحد، لا شيء في الخلفية للجدال حوله: لنرى حزمة المرجع التي قادت مقطع العرض: البطل الذكر في المخمل الأسود، البطلة الأنثى في الدانتيل الكريمي الفيكتوري، ثلاث زوايا لكل منهما، ملف واحد. المنظر الأمامي والجانبي والخلفي لأزياء فيكتورية سوداء وكريمية تشغيل GPT Image 2 الخاص بي لطلب الخطوة 1، للمقارنة مع المرجع أعلاه.

الخطوة 2: قفل الموقع باستخدام لوحة مشهد من ست لوحات

لقد ثبت الوجه. الضوء سيظل يخونك. الصورة المرجعية الثانية تثبت ستة مواقع كاميرا، واتجاه ضوء القمر، وكمية الضباب في الهواء، ومدى رطوبة الأرضية التي تقرأها. أنت تخبر النموذج أن هذا الفيلم لديه إعداد إضاءة واحد بالضبط.

plaintext
1لوحة موقع سينمائية من ست لوحات، صفين في 3 أعمدة، حواف سوداء رفيعة بين اللوحات، كل لوحة مكتوب عليها بتعليق صغير أنيق أبيض بأحرف كبيرة متباعدة في أسفل تلك اللوحة. الموضوع: داخل قلعة قوطية مهجورة ليلاً. ضوء قمر أزرق بارد، ضباب منخفض متحرك، أرضية حجرية رطبة عاكسة، نوافذ زجاج ملون طويلة، شمعدانات حديدية مع لهب دافئ صغير، أسود عميقة غير مشبعة، ستائر مخملية ثقيلة. لا يوجد أشخاص في أي لوحة.
2
3اللوحة 1، التعليق "منظر عام واسع - الممر": ممر طويل بأعمدة يتلاشى نحو نافذة زجاج ملون مضاءة.
4اللوحة 2، التعليق "زاوية منخفضة - ضوء القمر عبر الأرضية": كاميرا منخفضة، شعاع من ضوء القمر يمر عبر ألواح حجرية مبللة.
5اللوحة 3، التعليق "تكوين المدخل والسلالم": مدخل مقوس يؤطر درجًا حجريًا منحنيًا.
6اللوحة 4، التعليق "تفاصيل قريبة - باب منحوت": لقطة ضيقة لباب خشبي منحوت ثقيل بمقبض حديدي.
7اللوحة 5، التعليق "منظر بجانب النافذة - ضباب وستائر": نافذة طويلة، ضباب يتدحرج، حافة ستارة في المقدمة.
8اللوحة 6، التعليق "إطار ملصق نهائي - قاعة فارغة": قاعة فارغة متماثلة، سجادة ممر منقوشة تؤدي إلى النافذة.
9
10فوتوغرافي، سينمائي، حبيبات فيلم، درجة لونية متسقة عبر جميع اللوحات الست.

الإعدادات: نفس النموذج، الجودة عالية، نسبة العرض إلى الارتفاع 16:9. ست لوحات ستوري بورد لديكورات قلعة قوطية مظلمة مع ضوء القمر لوحة الموقع التي قادت مقطع العرض: ستة ديكورات داخلية لقلعة قوطية، درجة لونية واحدة، تعليقات مقروءة. ست زوايا كاميرا سينمائية لديكور داخلي لقلعة قوطية مظلمة تشغيل GPT Image 2 الخاص بي لطلب لوحة الخطوة 2.

الخطوة 3: توليد اللقطة باستخدام MiniMax H3 reference-to-video

صورتان مرجعيتان بالإضافة إلى طلب واحد يحمل مواقع الكاميرا واتجاه الصوت. يتم إنتاج الصوت في نفس الممر، لذلك لا توجد خطوة صوت أو موسيقى منفصلة. حافظ على المدة قصيرة أثناء الضبط، ثم ادفعها إلى 15 للقطة الحقيقية.

plaintext
1الصورة المرجعية 1 هي ورقة الشخصية: الرجل على اليسار هو البطل الذكر، المرأة على اليمين هي البطلة الأنثى. حافظ على هوية كل منهما تمامًا كما هو موضح: فكه، شعره الداكن المموج، معطفه المخملي الأسود، صدرية البروكار السوداء وربطة العنق الحريرية السوداء؛ شعرها الكستنائي المضفر نصف المرفوع وفستان الدانتيل الكريمي الفيكتوري. الصورة المرجعية 2 هي لوحة الموقع والإضاءة: طابق ضوء القمر الأزرق البارد، والضباب المتحرك، والأرضية الحجرية الرطبة العاكسة والدرجات السوداء غير المشبعة.
2
39:16 عمودي، مظهر دراما قصيرة حية عالية الجودة، عمق مجال ضحل، تباين سينمائي، لا ترجمة، لا نص على الشاشة، لا علامة مائية.
4
5اللقطة 1: لقطة متوسطة قريبة، الكاميرا تدفع ببطء إلى الداخل. تقف البطلة الأنثى في الممر المقمر، تتنفس بشكل سطحي، عيناها مثبتتان على شيء خارج الإطار إلى اليمين. الضباب يتحرك بجانبها عند ارتفاع الركبة.
6اللقطة 2: قطع قاسي. فوق الكتف من خلفها، يخرج البطل الذكر من القوس المظلم إلى ضوء القمر، معطفه يلتقط الضوء، تعبيره بارد وفضولي.
7اللقطة 3: لقطة قريبة ضيقة لوجهه، نصف مضاء بالنافذة، ثم لقطة قريدة مطابقة لوجهها وهي ترفض النظر بعيدًا.
8
9الصوت: طنين جهير مستمر منخفض، صدى حجري بعيد، أنفاسها غير المستقرة، خطوة ثقيلة واحدة عندما يخطو إلى الضوء، انتفاخ وتر ناعم واحد على القطع الأخير.

الإعدادات: النموذج MiniMax H3 Reference-to-Video، الدقة 2K، المدة 8 (الشريط الافتراضي؛ ادفع إلى 15 للقطة الحقيقية)، نسبة العرض إلى الارتفاع تكيفية، وكلا الملفين في المواد المرجعية. اللوحة تعدهم كـ 2 من 9، لذلك لديك مساحة كبيرة لإضافة ألواح ملابس أو دعائم لاحقًا.

جدير بالملاحظة ما حدث مع النسبة. تركت نسبة العرض إلى الارتفاع على تكيفية وكتبت فقط "9:16 عمودي" داخل الطلب. عاد H3 عموديًا على أي حال، لذلك قرأ التأطير من النص بدلاً من الحاجة إلى حقل النموذج. واجهة مولد فيديو AI تعرض الطلب النصي ومعاينة الفيديو المكتمل MiniMax H3 Reference-to-Video على Atlas Cloud، اكتمل التشغيل: كلا الملفين المرجعيين محملين كـ 2 من 9، الدقة 2K، والمقطع العمودي المولد يعمل في لوحة OUTPUT.

الإطار الأول هو البطلة الأنثى في صديري الدانتيل الكريمي، واقفة في الممر من لوحة اللوحة 1، مع ضباب على ارتفاع الركبة وضوء القمر يضرب الأرضية الرطبة بالضبط حيث وضعته اللوحة. هبطت كلتا الصورتين المرجعيتين.

الخطوة 4: تشغيل التحكم Seedance 2.5 مقابل MiniMax H3 مع الحزمة المتطابقة

لا تغير كلمة واحدة. نفس الصورتين المرجعيتين، نفس الطلب، نموذج مختلف. تركت المدة الافتراضية لكل صفحة بمفردها بدلاً من فرض تطابق، وأقول ما أعاده كل واحد أدناه. إعادة صياغة طلب "من أجل" النموذج الآخر هو بالضبط كيف تبدأ المقارنات في الكذب.

plaintext
1نفس طلب الخطوة 3، حرفيًا. لا تعيد صياغته للنموذج الآخر.

الإعدادات: النموذج Seedance 2.0 Reference-to-Video، الدقة 720p، نفس الصورتين المرجعيتين في الصور المرجعية (مرة أخرى 2 من 9، مع فتحات منفصلة لما يصل إلى 3 فيديوهات مرجعية و3 ملفات صوتية مرجعية). المدة تركت على الافتراضي للصفحة، والذي عاد كمقطع مدته 10 ثوانٍ. واجهة توليد فيديو AI تعرض طلبًا نصيًا وفيديو مكتمل Seedance 2.0 Reference-to-Video على Atlas Cloud، اكتمل التشغيل مع حزمة المرجع والطلب المتطابقين من الخطوة 3، ونتيجة مدتها 10 ثوانٍ في لوحة OUTPUT.

هذا ما أظهرته لوحتا OUTPUT فعليًا، وأنا أبلغ عنه بشكل مسطح بدلاً من اختيار فائز.

كلا التشغيلين حافظا على الشخصية. نفس فستان الدانتيل الكريمي مع نفس خط العنق وأساور الأكمام، نفس شعر الكستناء، نفس الممر المليء بالضباب وضوء القمر المأخوذ من اللوحة. لم يخترع أي منهما امرأة مختلفة. حزمة المرجع قامت بذلك العمل على كلا الجانبين، وهو النتيجة التي أهتم بها أكثر.

الاختلافات كانت حول الشكل، وليس الوجه. نقطة النهاية هذه من Seedance سلمت 720p؛ H3 سلم 2K من مدخلات متطابقة. وانقسم التأطير: H3 قرأ "9:16 عمودي" مباشرة من نص الطلب وعاد عموديًا، بينما عاد تشغيل Seedance بنسبة 16:9 لأن تلك الصفحة تحمل عنصر تحكم خاص بها في نسبة العرض إلى الارتفاع ونص الطلب وحده لم يلغها. إذا كنت تقطع لـ TikTok، فإن هذا الاختلاف سيكلفك تشغيلًا في المرة الأولى التي تنسى فيها حقل النموذج. من المحتمل أن يغير Seedance 2.5 نصف الدقة من هذا ويضيف إعادة رمي على مستوى المنطقة، ولن أتظاهر بأنني قست ذلك.

الخطوة 5: إصلاح لقطة واحدة دون إعادة رمي المقطع بأكمله

التكلفة الحقيقية للدراما القصيرة ليست التوليد الأول. إنها المراجعة السابعة. يقبل H3 مقطعًا موجودًا كمدخل ويحرر وفقًا للتعليمات، محافظًا على ما لم تذكره. عرض Seedance 2.5 هنا أدق: إعادة رسم منطقة من الإطار وترك الأداء والإضاءة والكاميرا بمفردها.

plaintext
1باستخدام المقطع المقدم: احتفظ بالشخصيتين، وملابسهما، وحركات الكاميرا وإيقاع القطع تمامًا كما هي. غير فقط البيئة، استبدل الممر الحجري المقمر بقاعة الرقص نفسها في القلعة، نوافذ مقوسة عالية، ثريا مضاءة، وضوء شموع دافئ، وأعد إضاءة كلتا الشخصيتين بحيث يأتي ضوءهما الرئيسي من الثريا على يسار الإطار بدلاً من النافذة. أعد كتابة سطرها المنطوق الوحيد إلى "لم تكن نائمًا أبدًا، أليس كذلك." حافظ على توقيت أدائها على نفس الإيقاعات.

الإعدادات: MiniMax H3 Reference-to-Video مع مقطع الخطوة 3 كمدخل مرجعي، المدة 5، الدقة 2K.

 

 

ما وراء اختبار Seedance 2.5 مقابل MiniMax H3: أربع طرق لدفع حزمة المرجع

نفس الشخصية، الحلقة التالية. احفظ ورقة الخطوة 1 كأصل وغير فقط قائمة اللقطات وكتلة القصة في الطلب. الهوية تأتي من ملف، وليس من ذاكرتك لكيفية صياغتها الثلاثاء الماضي.

 

 

ثبت الصوت أيضًا. يأخذ H3 ما يصل إلى ثلاثة مراجع صوتية، من 2 إلى 15 ثانية لكل منها، ويجب أن ترافق مدخل صورة أو فيديو. أعطه عينة صوتية وستتحدث الشخصية بهذا الجرس، لذلك لا تعيد تمثيل دور ممثل صوتي بين الحلقات.

 

 

احجب الكاميرا قبل أن تدفع ثمن العرض. يقبل Seedance 2.5's reference-to-video كتل النماذج البيضاء ثلاثية الأبعاد ولوحات الشاشة الخضراء، لذلك يمكنك قفل التأطير على هندسة رمادية وبعدها فقط تلتزم بشكل نهائي. هذا المثال شُغل على Seedance 2.1، وهو عضو سابق من العائلة، لكن شكل سير العمل هو نفسه.

 

 

قم بتوطين قطع رئيسي واحد بدلاً من إعادة تصويره. الاستبدال على مستوى المنطقة يبدل وجهًا أو منتجًا أو لغة منطوقة بينما تبقى الكاميرا والتوقيت ومدة الشفاه ثابتة. هنا يتم إعادة تمثيل وتصويت قطع جمالي رئيسي واحد للإسبانية والكورية والهندية، مع الحفاظ على الغرفة والتأطير ومدة الشفاه.

 

 

ولأن شخصًا ما سيسأل كيف يبدو نقل الحركة عندما تتوقف عن العقلانية: ثلاثة رجال في بدلات، تم استبدالهم بثلاثة كابيبارا واقعية، يتبعون مسار حركة المقطع الأصلي نبضة بنبضة حتى يتكدسون في هرم.

 

 

هناك أيضًا النسخة العادية من كل هذا، التي لا ينشرها أحد: ملصق ثابت يصبح ملصقًا متحركًا، ويبقى التخطيط على قيد الحياة. صبي كرتوني في هودي ديناصور وردي يمد يده بمخلب عملاق الملصق المصدر الثابت. أطعمه لـ reference-to-video مع "احتفظ بالإطار واللوحة والتخطيط، حرك النوع" وستحصل على نسخة متحركة من نفس التصميم.

كم تكلفك دراما قصيرة Seedance 2.5 مقابل MiniMax H3 فعليًا

لا أرقام هنا، لأن الأرقام تتحرك والهيكل لا يفعل. كلتا العائلتين تفوتزان بالثانية، الدفع حسب الاستخدام، لا مقعد ولا اشتراك. هذا يترك ثلاثة متغيرات: الثواني، مستوى الدقة، وإعادة الرميات.

الثالث هو الفاتورة بأكملها. مقطع مدته 15 ثانية يصل في المحاولة الأولى هو شحنة واحدة. نفس المقطع في المحاولة السابعة هو سبع. لذا فإن التوفير في المال ليس اختيار النموذج الأرخص في الثانية، بل هو الحصول على حزمة المرجع بشكل صحيح قبل أن تولد أي شيء. استدعاءات الصورتين في الخطوة 1 والخطوة 2 هما أرخص سطر في خط الأنابيب بأكمله وهما اللذان يقرران عدد استدعاءات الفيديو التي تقوم بها. أعلى عائد على الإنفاق في السلسلة بأكملها، بفارق كبير.

ثم صحح غريزة الثانية. نفس حزمة المرجع، نفس وقت التشغيل: H3's reference-to-video يعيد 1440p، نقطة نهاية Seedance reference-to-video هذه تعيد 720p. الثانية هي الوحدة الخاطئة. البكسل لكل إطار، وما إذا كان عليك بعد ذلك دفع ثمن تمريرة رفع دقة منفصلة، هو الصحيح.

الصوت ينتمي أيضًا إلى الحساب. كلا الجانبين ينتجان صوتًا متزامنًا أصليًا في نفس الممر. إذا كان خط أنابيبك الحالي هو نموذج فيديو بالإضافة إلى تحويل النص إلى كلام بالإضافة إلى محرر يقوم بمحاذاة المسارات، فإن ما توفره هو استدعاءي API وبعد ظهر شخص ما، وهذا التوفير لا يظهر في أي قائمة أسعار في أي مكان.

أي واحد لأي مهمة:

المهمةاخترلماذاتحذير
دراما قصيرة عمودية، 9:16، TikTok أو ReelShortMiniMax H31440p عمودي مع ستيريو أصلي، قابل للاستدعاء الآن، 15 ثانية هي خطافة كاملةتقطع عند 15 ثانية، لذا خطط للإيقاعات وفقًا لذلك
فيلم علامة تجارية مستمر لمدة 30 ثانيةSeedance 2.5توليد واحد، بدون خياطة، 4K أصليتحقق من التوفر على منصتك أولاً
إصلاح لقطة واحدة داخل قطع معتمدSeedance 2.5إعادة رسم على مستوى المنطقة تترك الباقي بمفردهتحرير المقطع الكامل لـ H3 يوصلك إلى معظم الطريق اليوم
تخفيضات المنتج والتجارة الإلكترونيةأي منهماكلاهما يحافظ على النص على الشاشة وعلامات العلامة التجارية بشكل جيدتحقق من النص بالدقة التي تشحن بها
عروض الألعاب أو الواجهاتMiniMax H3استقرار واجهة المستخدم والطباعة عند 2K قويسقف 15 ثانية لممر واحد
إصدارات متعددة اللغات لقطعة رئيسية واحدةSeedance 2.5استبدال المنطقة بالإضافة إلى صوت متعدد اللغاتجودة التوطين لا تزال بحاجة إلى تدقيق أصلي
الشحن الليلةMiniMax H3ثلاث نقاط نهاية مباشرة، بالإضافة إلى كل Seedance 2.0الوصول إلى Seedance 2.5 يختلف حسب المنصة

قبل أن تشحن. قالت MiniMax أن أوزان H3 ستتبع في غضون أيام من الإطلاق، والأوزان المفتوحة ليست نفس الشيء مثل الترخيص التجاري، لذا اقرأ الشروط قبل أن تستضيف بنفسك. سياسة العلامة المائية والاستخدام التجاري تختلف أيضًا بين تطبيقات المستهلك ووصول API على كلا الجانبين، ولم أستطع تأكيد أي منهما من صفحة شروط أساسية أثناء كتابة هذا، لذا تحقق من شروط المزود بدلاً من أخذ كلامي. ولا شيء في أي ترخيص نموذج يغطي الشبه أو العلامة التجارية. إذا كان شخص حقيقي أو علامة تجارية حقيقية أو ملكية فكرية لشخص آخر في حزمة المرجع الخاصة بك، فهذه مسألة قانونية منفصلة ولن تجيب عليها شروط النموذج.

كل نموذج في الجداول أعلاه يعمل على نفس المفتاح، و صفحات النماذج تحمل الأسعار الحالية بالإضافة إلى كود النسخ واللصق، بما في ذلك أي عروض ترويجية قد تكون جارية على خط Seedance هذا الأسبوع.

الأسئلة المتكررة

هل Seedance 2.5 أفضل من MiniMax H3 لثبات الشخصية؟

نظريًا يجب أن يكون، مع ما يصل إلى 50 مرجعًا متعدد الوسائط مقابل 12 ملفًا لـ H3، بالإضافة إلى إعادة رمي على مستوى المنطقة. ولكن اعتبارًا من 31 يوليو 2026، لا يوجد اختبار عام مقترن يمكنني الإشارة إليه، وليس لدى Seedance 2.5 تصنيف ساحة بعد. في التشغيلات التي تمكنت فعليًا من إجرائها، كان المتغير الذي يحدد استقرار الهوية هو بنية حزمة المرجع، وليس رقم توليد النموذج: باستخدام ورقة تحويل مركبة واحدة بالإضافة إلى لوحة إضاءة واحدة، حافظ كلا الجانبين على الشخصية. احصل على الحزمة بشكل صحيح قبل أن تقضي وقتًا في التسوق بين النماذج.

هل يمكنني استخدام Seedance 2.5 الآن، أم يجب أن أنتظر؟

API الخاص به مباشر في ByteDance. التوفر على منصات النماذج التابعة لجهات خارجية غير متساوٍ، وعلى المنصة التي اختبرتها لا يزال إشعار اليوم 0. إذا كنت بحاجة إلى إخراج الليلة، فإن الخيارات القابلة للاستدعاء هي نقاط نهاية H3 الثلاث وخط Seedance 2.0 الشحن بالكامل.

هل يقوم MiniMax H3 حقًا بفيديو مدته 30 ثانية؟

لا. المواصفات هي 5 إلى 15 ثانية لكل توليد بمعدل 24 إطارًا في الثانية. أي شيء أطول هو تمديد أو خياطة، وهو شيء مختلف مع مخاطر انحراف مختلفة. التوليد الفردي لمدة 30 ثانية يعود إلى Seedance 2.5. لا تدع الادعاءين يمتزجان.

هل يولد كلا النموذجين صوتًا، وهل يمكنني الاحتفاظ بصوت واحد عبر الحلقات؟

كلاهما ينتج صوتًا متزامنًا أصليًا في نفس الممر، ويخرج H3 ستيريو على كل نتيجة. لصوت مستمر، يقبل H3 ما يصل إلى ثلاثة مراجع صوتية من 2 إلى 15 ثانية لكل منها، والتي يجب تقديمها جنبًا إلى جنب مع مدخل صورة أو فيديو وليس بمفردها.

كم عدد الصور المرجعية التي يجب أن أرسلها فعليًا؟

أقل مما تعتقد، منظمة بشكل أفضل مما تعتقد. صورة مركبة جيدة التكوين تتغلب عمومًا على ستة قصاصات فضفاضة، لأن الملفات المنفصلة تدعو النموذج إلى حساب متوسطها في شخص غير موجود. أعطه وظيفتين واضحتين، الهوية والإضاءة، ولا تضمن عينات نمط تتعارض مع بعضها البعض.

أي نموذج يجب أن أستخدمه للدراما القصيرة العمودية على غرار TikTok أو ReelShort؟

الشحن هذا الأسبوع، بنسبة 9:16، بدقة عالية مع صوت مختلط بالفعل: MiniMax H3. التخطيط لمشهد مستمر مدته 30 ثانية حيث تتوقع إعادة رمي مناطق فردية بدلاً من مقاطع كاملة: ابنِ لـ Seedance 2.5 وتحقق من متى تفتح منصتك.

أحدث النماذج

واجهة برمجية واحدة لكل وسائط الذكاء الاصطناعي.

استكشف جميع النماذج