Seedance 2.0 Mini & Fast API بأقل الأسعار في العالم — خصم يصل إلى 68% على السعر الرسمي

MiniMax H3 مقابل Gemini Omni Flash: جوجل تفوز بلوحة النقاط بـ5 نقاط. ثم يطلب العميل تغييرًا.

MiniMax H3 مقابل Gemini Omni Flash على ثلاث لوحات متصدرين، وجميع الفروقات الثلاثة تقع ضمن هامش الخطأ. لذا قمت بتشغيل لقطة واحدة عبر كليهما، ثم أعدت إرسال نفس ملاحظة المراجعة.

لحدقت في ثلاثة لوحات متصدرة من Artificial Analysis لمدة عشر دقائق أحاول معرفة من الفائز الفعلي.

نص إلى فيديو: Gemini Omni Flash بفارق 5 نقاط. صورة إلى فيديو: Gemini بفارق نقطتين. تحرير فيديو: MiniMax H3 بفارق 9 نقاط.

ثم نظرت إلى عمود فترة الثقة. زائد أو ناقص 7. زائد أو ناقص 9. زائد أو ناقص 10.

ثلاث لوحات، ثلاث فجوات، كل واحدة منها تقع ضمن هامش الخطأ الخاص بها. في التصويت الأعمى، هذان النموذجان هما نفس النموذج.

لذا أغلقت اللوحات المتصدرة وفتحت القوائم المنسدلة بدلاً من ذلك. تلك الفجوة ليست 5 نقاط. تلك الفجوة هي طبقة دقة كاملة.

النقاط الرئيسية

  • جميع فجوات Artificial Analysis الثلاث (+5، +2، +9، لقطة تاريخ 6 أغسطس 2026) تقع ضمن فترات الثقة من ±7 إلى ±10. من حيث الجودة الخام، هذا تعادل وليس فوزًا.
  • H3 يُنتج بدقة 2K، ومدة تصل إلى 15 ثانية، وستة أبعاد جانبية. واجهة Gemini Omni Flash API تقتصر على 720p، و10 ثوانٍ، وبعدين جانبيين فقط. هذه قيم محددة مسبقًا، وليست آراء.
  • H3 يقبل الصوت كمدخل. Gemini لا يقبل. Gemini يحتوي على seed و thinking_level. H3 لا يحتوي على أي منهما.
  • جيميني لديها نقطة نهاية مخصصة video-edit تقوم بتعديل مقطع المصدر الخاص بك. مسار المراجعة في H3 هو reference-to-video، والذي يعيد التوليد باستخدام المقطع الخاص بك كمرجع. إنها ليست نفس العملية، والجولة الثانية تُظهر ذلك.
  • واحد فقط من الاثنين لديه أوزان قابلة للتنزيل، وهو ليس نموذج Google.

مقارنة جنبًا إلى جنب لمشهد كشك طعام ليلي بدقات مختلفة

الجولة الأولى من اختبار MiniMax H3 مقابل Gemini Omni Flash، كلا النموذجين يحركان نفس الإطار الأول، معروضين جنبًا إلى جنب

الجولة الأولى: نفس الإطار الأول، نفس المطالبة، نفس المدة. اليسار MiniMax H3 بدقة 2K، اليمين Gemini Omni Flash بدقة 720p. معروض هنا كصورة GIF صامتة؛ كلا الملفين المُسَلَّمين يحملان صوتًا أصليًا وكلاهما مضمن كفيديو قابل للتشغيل أدناه. هذه هي المشكلة. كلاهما جيد.


لماذا تُقرأ فجوة لوحة المتصدرين بين MiniMax H3 و Gemini Omni Flash بشكل خاطئ

تقريبًا كل منشور عن MiniMax H3 مقابل Gemini Omni Flash ستجده يقتبس لوحة متصدرة واحدة وسعرًا واحدًا. كلا العادتين تؤديان إلى إجابة خاطئة.

إليك لوحات Artificial Analysis الثلاث، مع العمود الذي يتجاهله الجميع.

الجدول أ: MiniMax H3 مقابل Gemini Omni Flash عبر ثلاث لوحات متصدرة من Artificial Analysis (مع الصوت)، لقطة تاريخ 6 أغسطس 2026

لوحة المتصدرينGemini Omni FlashMiniMax H3الفجوةضمن هامش الخطأ؟
نص إلى فيديو1,243 (#1) ±7، 11,842 صوتًا1,238 (#2) ±9، 6,830 صوتًاGemini +5نعم
صورة إلى فيديو1,191 (#2) ±9، 6,506 صوتًا1,189 (#3) ±10، 5,545 صوتًاGemini +2نعم
تحرير فيديو1,123 (#2) ±5، 11,706 صوتًا1,132 (#1) ±6، 9,128 صوتًاH3 +9نعم، بالكاد

MiniMax H3 هو واحد من أكثر من 30 نموذج فيديو يمكنك تشغيلها جنبًا إلى جنب على نفس المطالبة في مقارنة نماذج Atlas Cloud — مع التكلفة لكل ثانية معروضة قبل التوليد.

أرقام Elo من ساحة فيديو Artificial Analysis (Artificial Analysis، أغسطس 2026). صورة إلى فيديو يتصدرها Dreamina Seedance 2.0 720p عند 1,197، لذا لا يحمل أي منهما هذا التاج. هذه نتائج تصويت جماعي متغيرة وتتحرك، وهذا هو بالضبط سبب عدم كون فجوة 5 نقاط حكمًا.

فارق 5 نقاط مع فترة ±9 يعني أن الترتيب يمكن أن ينقلب الأسبوع القادم بسبب ضوضاء التصويت وحدها. هذا ليس "Gemini أفضل في تحويل النص إلى فيديو." هذا مجرد رمي عملة معدنية بلوحة نتائج.

ثلاثة أشياء أخرى يخطئ فيها الناس:

عمود الدولار لكل دقيقة ليس ما تدفعه. يسرد Artificial Analysis 6.00 دولار/دقيقة لـ Gemini و 7.80 دولار/دقيقة لـ H3. هذا العمود يوحّد التكلفة إلى دقيقة واحدة من 1080p بالإعدادات الافتراضية. Gemini Omni Flash لا يمكنها إنتاج 1080p على الإطلاق. لذا الرقم هو تقدير نموذجي، وليس فاتورة. قارن المنتجات النهائية المُسَلَّمة، وليس الثواني.

لوحة واحدة ليست النموذج. H3 يحتل المركز الثاني والثالث والأول عبر اللوحات الثلاث. Gemini تحتل المركز الأول والثاني والثاني. اقتبس أيًا منها بمفردها ويمكنك إثبات ما كنت تعتقده بالفعل.

"Omni" لا تعني "يأكل أي شيء." إنه اسم جيد ومضلل. واحد من هذين الاثنين يقبل ملفات الصوت كمدخل. إنه ليس الذي يحمل اسم "omni".

ورقة المواصفات بين MiniMax H3 و Gemini Omni Flash التي لا يطبعها أحد

إذا كانت نتائج Elo لا تستطيع التفريق بينهما، فإن جداول القيود تستطيع. لقد سحبت مخططات الإدخال المباشرة لكلا النموذجين بدلاً من الوثوق بأي منشور إطلاق، والاختلافات ليست طفيفة.

الجدول ب: القيود الصارمة بين MiniMax H3 و Gemini Omni Flash، مقروءة من مخططات API المباشرة في 6 أغسطس 2026

القيدMiniMax H3Gemini Omni Flash
الدقة768P أو 2K720p، وهذه هي القيمة الوحيدة في القائمة المحددة مسبقًا
المدة4 إلى 15 ثانية3 إلى 10 ثوانٍ
الأبعاد الجانبية21:9، 16:9، 4:3، 1:1، 3:4، 9:1616:9 و 9:16 فقط
مسار المراجعةمرجع إلى فيديو (يعيد التوليد مع المراجع)نقطة نهاية مخصصة لتحرير الفيديو (تعدل مصدرك)
التحكم في الإطار الأخيرend_image مدعومةغير متاحة
حدود المراجع≤9 صور، ≤3 فيديوهات، ≤3 مقاطع صوتية، 12 ملفًا إجمالًا1 إلى 10 صور
الإدخال الصوتينعملا
قابلية تكرار البذرةلانعم
thinking_levelلانعم (افتراضي / عالي / منخفض)
الأوزان مفتوحة المصدرنعم، على Hugging Faceلا

اقرأ هذا الجدول بصدق، ستجد أن Gemini تفوز في ثلاثة صفوف بشكل واضح. البذور القابلة للتكرار مهمة إذا كنت تبني خط أنابيب يجب أن يعرض نفس الإطار مرتين. نقطة نهاية video-edit حقيقية هي أداة مختلفة تمامًا عن إعادة التوليد المشروطة بالمرجع. و thinking_level يمنحك قرص جودة لا يوفره H3 ببساطة.

H3 يفوز في خمسة صفوف، وهي الصفوف التي تحدد ما إذا كان يمكنك تسليم الملف الذي طلبه العميل.

لقد قمت بتشغيل كل ما يلي على Atlas Cloud لأن كلا النموذجين يقعان خلف نفس نقطة النهاية /api/v1/model/generateVideo هناك، مما يعني حلقة استقصاء واحدة ورأس مصادقة واحد للاختبار بأكمله. كان تغيير النموذج مجرد تغيير في سلسلة model. هذه التفاصيل هي السبب الكامل وراء كون "استخدم كليهما" إجابة واقعية وليست تهربًا.

الجدول ج: تكلفة كل نقطة نهاية في هذا الاختبار، تم التحقق منها مقابل قائمة الأسعار المباشرة في 6 أغسطس 2026

نقطة النهايةالسعرمقطع 10 ثوانٍ في هذا الاختبار
openai/gpt-image-2/text-to-image0.009 دولار / صورة0.01 دولار
minimax/h3/image-to-video0.14 دولار / ثانية1.40 دولار
minimax/h3/reference-to-video0.14 دولار / ثانية1.40 دولار
google/gemini-omni-flash/image-to-video0.13 دولار / ثانية1.30 دولار
google/gemini-omni-flash/video-edit0.14 دولار / ثانية1.40 دولار
google/gemini-omni-flash/text-to-video0.125 دولار / ثانيةغير مستخدم
minimax/h3/text-to-video0.14 دولار / ثانيةغير مستخدم

لا يحمل أي من النموذجين خصماً هذا الشهر. توفر Gemini أيضًا طبقة مطور أرخص (0.112 دولار/ثانية للنص إلى فيديو والصورة إلى فيديو، 0.12 دولار/ثانية للفيديو المرجعي)؛ H3 ليس لديه طبقة مكافئة.

خط الأوزان مفتوحة المصدر الذي لا تستطيع Gemini Omni Flash تجاوزه. تم نشر أوزان H3 على Hugging Face (MiniMax، أغسطس 2026): محول Omni كثيف 33B أحادي الدفق، بالإضافة إلى مشفر النص Qwen3-VL-32B، وVAE بصري وVAE صوتي. هناك تحفظان أكثر أهمية من حجم التنزيل. أولاً، ما تستضيفه بنفسك يعمل بدقة 768 بكسل للجانب القصير؛ مرحلة المعالجة المسبقة Context-IR ووحدة Regenerate-2K غير موجودتين في الإصدار، وإخراج 2K يأتي من هاتين الوحدتين. ثانيًا، لا يغطي ترخيص المجتمع حاليًا الاتحاد الأوروبي أو المملكة المتحدة أو كوريا الجنوبية أو الولايات المتحدة، وهناك نموذج طلب منفصل لتلك المناطق. اقرأه قبل بناء منتج عليه. ليس لدى Gemini Omni Flash أي نقاش مكافئ، لأنه لا يوجد ملف لتنزيله.

هذا الموقف من الأوزان مفتوحة المصدر، إلى جانب التسعير القوي، هو القصة الاستراتيجية الكاملة للإطلاق (South China Morning Post، أغسطس 2026).

اختبر اختبار المراجعة بين MiniMax H3 و Gemini Omni Flash بنفسك

إليك الجزء الذي لم يختبره أحد. الجميع يقيس الجيل الأول. لا أحد يقيس الجيل الثاني.

العمل الحقيقي ليس مطالبة واحدة. العمل الحقيقي هو مقطع يعجبك بالفعل، بالإضافة إلى عميل يرد "أحببته، هل يمكن أن تقول اللافتة 24 ساعة ويمكن أن يكون مئزرها أحمر." هذه الجملة الواحدة هي المكان الذي يتوقف فيه هذان النموذجان عن كونهما قابلين للتبادل، ويصادف أنها المهمة الدقيقة التي يقيسها لوحة تحرير الفيديو.

المشهد قاسٍ عمدًا: كشك نودلز مبتل بالمطر ليلاً، البائعة تتحدث مباشرة إلى العدسة، لافتة مكتوبة بخط اليد بكلمات مقروءة خلفها، بخار يتصاعد من المرق، مطر على المظلة. إطار واحد يضغط على مزامنة الشفاه، واستقرار النص على الشاشة، والحركة السلسة، والصوت المحيطي متعدد الطبقات في وقت واحد.

كلا النموذجين يحصلان على نفس الإطار الأول، ونفس المطالبة، ونفس ملاحظة المراجعة. كل عملية تشغيل أدناه مدتها 10 ثوانٍ، وهو الحد الأقصى لـ Gemini Omni Flash وداخل حدود H3 بسهولة.

الخطوة 1: تثبيت الإطار الأول باستخدام GPT Image 2

يجب أن يبدأ كلا النموذجين من نفس الصورة، وإلا فإن الجولة الأولى تقيس حظ التكوين بدلاً من النموذج. افتح صندوق GPT Image 2، اضبط الجودة على عالية والنسبة على 16:9، ثم الصق ما يلي:

Plain
1مشهد واقعي ليلي لكشك طعام شارع في أمطار غزيرة، تم تصويره بعدسة 35 مم عند f/2.0. امرأة في أواخر الثلاثينيات من عمرها ترتدي مئزرًا من القماش بلون النيلي تقف خلف منصة نودلز تتصاعد منها البخار، تنظر مباشرة إلى العدسة، وهي في منتصف الجملة. خلفها لافتة ضوئية من الصفيح مطلية باليد تتوهج باللون الكهرماني الدافئ وتحمل عبارة "OPEN LATE" بأحرف كبيرة واضحة بخط sans-serif غامق. خطوط المطر تخترق ضوء الشارع الصوديومي، البخار يتصاعد من وعاء المرق، الأسفلت الرطب يعكس أضواء النيون الحمراء والخضراء من عبر الشارع. عمق مجال ضحل، إضاءة عملية فقط، ضبابية خفيفة للعدسة، نسيج بشرة طبيعي، لا يوجد نص في أي مكان آخر في الإطار. 16:9.

واجهة مولد الصور بالذكاء الاصطناعي تعرض مطالبة والصورة المُولَّدة

صندوق GPT Image 2 على Atlas Cloud مع مطالبة كشك النودلز على اليسار والإطار الأول المُولَّد في لوحة الإخراج

GPT Image 2 على Atlas Cloud: المطالبة على اليسار، الإطار الأول المشترك في OUTPUT. تكلفة هذه الخطوة: 0.009 دولار.

امرأة تقف عند كشك طعام شارع يتصاعد منه البخار ليلاً

الإطار الأول المُولَّد: امرأة ترتدي مئزرًا نيليًا خلف منصة نودلز تتصاعد منها البخار ليلاً تحت المطر، مع لافتة OPEN LATE مطلية باليد تتوهج خلفها

المدخل الوحيد الذي تلقاه كلا النموذجين. لاحظ الأمرين اللذين ستستهدفهما المراجعة: لافتة "OPEN LATE" والمئزر النيلي. تم توليدها باستخدام openai/gpt-image-2/text-to-image.

الخطوة 2: الجولة الأولى على MiniMax H3

انتقل إلى صندوق MiniMax H3، اختر مهمة image-to-video، ارفع إطار الخطوة 1، واضبط resolution على 2K، و duration على 10، و ratio على adaptive (قائمة image-to-video تقدم adaptive فقط). المطالبة:

Plain
1تنظر البائعة إلى العدسة وتقول، بصوت دافئ متعب: "المرق على النار من الساعة الرابعة صباحًا. اجلس، المطر لا يزال يهطل." ترفع المغرفة وهي تتحدث. يتصاعد البخار عبر الإطار. يستمر المطر في الهطول على المظلة خلفها. تظل الكاميرا ثابتة، لا تقريب، لا تحريك. صوت محيطي: مطر على القماش، غليان المرق، مرور سيارات بعيد، صوتها قريب وجاف.

واجهة توليد فيديو بالذكاء الاصطناعي تعرض إدخال النص وإخراج الفيديو

صندوق MiniMax H3 image-to-video على Atlas Cloud مع اختيار دقة 2K والمقطع النهائي يُشغل في لوحة الإخراج

MiniMax H3 image-to-video على Atlas Cloud: تم اختيار 2K، المقطع النهائي في OUTPUT. هذا الالتقاط جرى على الإعداد الافتراضي للملعب البالغ 8 ثوانٍ وكلف 1.12 دولار؛ النسخة ذات 10 ثوانٍ المستخدمة للمقارنة مضمنة أدناه وكلفت 1.40 دولار.

MiniMax H3، الجولة الأولى، 2K، 10 ثوانٍ. الصوت قيد التشغيل: الحوار، المطر والمرق تم توليدها جميعًا في نفس المسار، وليس إضافتها لاحقًا.

الخطوة 3: الجولة الأولى على Gemini Omni Flash، نفس الإطار، نفس الكلمات

افتح صندوق Gemini Omni Flash، اختر image-to-video، ارفع نفس إطار الخطوة 1، والصق مطالبة الخطوة 2 دون تغيير حرف واحد. الإعدادات: resolution 720p، duration 10، aspect_ratio 16:9، thinking_level default، seed -1.

شيئان يجب ملاحظتهما أثناء وجودك في هذا النموذج، لأنهما يمثلان المقالة بشكل مصغر. القائمة المنسدلة resolution تحتوي على خيار واحد بالضبط. حقل duration يتوقف عند 10. لم أختر 720p على شيء أفضل؛ لا يوجد شيء آخر للاختيار.

ملاحظة حول ما هو مفقود هنا: لم أتمكن من التقاط لقطة شاشة لصندوق اللعب بعد اكتمال التشغيل لأي من خطوات Gemini. بيئة التدريج التي ألتقط عليها لقطات الشاشة أعادت 403 PERMISSION_DENIED من جانب Google في جميع المحاولات الثلاث، لذا فإن لقطات Gemini الوحيدة التي لدي تظهر لوحة OUTPUT فاشلة ولن أزيف واحدة كتشغيل ناجح. المقاطع أدناه حقيقية، تم توليدها من خلال API الإنتاج بالإعدادات المذكورة أعلاه. خطوتا H3 التقطتا بشكل نظيف ولقطات الشاشة تلك أصلية.

Gemini Omni Flash، الجولة الأولى، 720p، 10 ثوانٍ، مدخلات متطابقة. شغّل هذا مباشرة بعد مقطع H3 أعلاه واحكم على الصوت بنفسك.

الخطوة 4: الجولة الثانية، أرسل المراجعة إلى Gemini Omni Flash

هذه هي الجولة المهمة. انتقل إلى مهمة video-edit على نفس صفحة نموذج Gemini، ارفع المقطع الذي أنتجته Gemini نفسها في الخطوة 3 كمدخل video، واضبط resolution على 720p و thinking_level على high (تعليمات تحرير من جزأين هي بالضبط الحالة المعقدة التي صُمم هذا القرص من أجلها). الصق هذه الملاحظة تمامًا كما سيرسلها العميل:

Plain
1حافظ على هذه اللقطة بالضبط: نفس موقع الكاميرا، نفس المرأة، نفس الوجه، نفس المطر، نفس الإضاءة، نفس الصوت. غيّر اللافتة المكتوبة بخط اليد لتقرأ "OPEN 24H" بدلاً من "OPEN LATE"، بنفس الأسلوب المطلي ونفس التوهج الكهرماني. غيّر مئزرها من الأزرق النيلي إلى الأحمر القاني. لا تغير أي شيء آخر في الإطار.

Gemini Omni Flash بعد ملاحظة المراجعة. شاهد اللافتة، ثم المئزر، ثم تحقق مما إذا كان أي شيء آخر قد تحرك.

الخطوة 5: الجولة الثانية، أرسل نفس المراجعة إلى MiniMax H3

إليك الاختلاف الهيكلي الصادق، ويجب أن تعرفه قبل قراءة النتيجة. H3 ليس لديه نقطة نهاية video-edit. مسار المراجعة الخاص به هو reference-to-video: تسلمه المقطع الأصلي كمرجع ويقوم بتوليد فيديو جديد مشروط بذلك المرجع. إنه لا يحرر ملفك. إنه يصنع ملفًا جديدًا من المفترض أن يشبه ملفك.

على صفحة MiniMax H3، اختر مهمة reference-to-video، أضف المقطع الذي أنتجه H3 في الخطوة 2 إلى refers كمرجع فيديو، ثم اضبط resolution على 2K، و duration على 10، و ratio على adaptive. الصق مطالبة الخطوة 4 دون أي تعديل على الإطلاق.

هذه الخطوة ليس لديها لقطة شاشة لصندوق اللعب أيضًا، لسبب مختلف وأكثر مللاً: المتصفح بدون واجهة الذي ألتقط به تعطل ثلاث مرات على أداة رفع المراجع أثناء تحميل مرجع فيديو. التشغيل نفسه تم عبر API دون مشكلة.

MiniMax H3 بعد نفس ملاحظة المراجعة، عبر reference-to-video بدقة 2K.

مقارنة لامرأة تطبخ في كشك طعام ليلي ممطر

مقارنة جنبًا إلى جنب للجولة الثانية: نتيجة Gemini Omni Flash video-edit بجانب نتيجة MiniMax H3 reference-to-video، كلاهما من نفس ملاحظة المراجعة

الجولة الثانية جنبًا إلى جنب، GIF صامت. اليسار Gemini Omni Flash عبر video-edit، اليمين MiniMax H3 عبر reference-to-video. كلاهما عمل على نفس الجملة.

ما حدث بالفعل في الجولة الثانية. دخلت وأنا أتوقع أن تخسر H3 هذه الجولة. إعادة التوليد المشروطة بالمرجع هي أداة أقل دقة من نقطة نهاية تحرير حقيقية، و"أعد توليد المقطع بالكامل وآمل أن يهبط في نفس المكان" هو بالضبط كيف تحصل على وجه مختلف، وكاميرا متحركة، وعميل يسأل ماذا حدث للقطة.

هذا ليس ما عاد. كلا النموذجين قاما بالمهمة، وقاما بها بشكل نظيف.

تصرفت video-edit الخاصة بـ Gemini تمامًا كما هو معلن. اللافتة تقرأ OPEN 24H بنفس الكتابة اليدوية، وبنفس التوهج الكهرماني ونفس تأثيرات الطقس على الصفيح. المئزر أحمر قاني. كل شيء آخر لم يمس: نفس الوجه، نفس التعبير، نفس زاوية المغرفة، نفس شكل البخار، نفس المطر، نفس أضواء الذيل في الخلفية. يبدو كالملف الأصلي مع تصحيحين بعمق بكسلات، لأن هذا هو جوهر ما هو عليه.

أنتجت reference-to-video الخاصة بـ H3 نفس التغييرين وثبتت اللقطة بشكل أفضل بكثير مما يوحي به الهيكل. تغيرت اللافتة، تغير المئزر، وعبر كل 10 ثوانٍ، بقيت التأطير، وسكب المرق من المغرفة، وعمود البخار ووجهها مطابقين للمقطع في الجولة الأولى. إذا كان هناك انحراف هنا، لم أستطع العثور عليه من خلال التنقل بين الإطارات.

لذا الجولة الثانية هي تعادل إحصائي ثالث، ولن أدعي عكس ذلك لجعل القصة أكثر ترتيبًا. ما يفرق بين المخرجين ليس جودة التحرير. إنه أن H3 أعاد 2560x1440 مع مسار استريو 32 كيلوهرتز و Gemini أعاد 1280x720. نفس التعليمات، نفس النجاح، تسليم مختلف.

تحفظ صادق واحد على المنهجية: هذه مراجعة واحدة على لقطة واحدة، وليست دراسة خاضعة للرقابة. تغيير من جزأين على لافتة وقطعة ملابس هو تعديل سهل إلى حد ما. الحالات الأصعب (إزالة جسم تتحرك الكاميرا بجانبه، تغيير شيء يحجبه الهدف، أربع جولات من الملاحظات المتراكمة على بعضها) هي حيث يجب أن تتفوق نقطة نهاية التحرير المخصصة، وحيث يجب أن تبدأ إعادة التوليد في الاهتزاز. قم بتشغيل حالتك الخاصة قبل أن تقرر.

ثلاثة اختلافات أخرى بين MiniMax H3 و Gemini Omni Flash تستحق الاختبار

الجولة الثانية هي الاختلاف الذي يغير التسليم. ثلاثة اختلافات أخرى تستحق عشرين دقيقة من رصيدك الخاص.

أطعمه ملف صوتي. reference-to-video من H3 يقبل ما يصل إلى ثلاثة مقاطع صوتية مدة كل منها 2 إلى 15 ثانية، بشرط أن يأتي معها مرجع صورة أو فيديو واحد على الأقل. هذا يعني أنه يمكنك تسليمه تسجيل صوت حقيقي وجعل الشخصية تؤديه. ليس لدى Gemini Omni Flash حقل إدخال صوتي في أي من نقاط النهاية الأربع، لذا لا يمكن إجراء هذه المقارنة على الإطلاق. هذا ليس خسارة في التسجيل لـ Google؛ إنها قدرة غائبة ببساطة.

اطلب 21:9. قائمة النسب ratio في reference-to-video من H3 تحتوي على 21:9، 16:9، 4:3، 1:1، 3:4 و 9:16. قائمة aspect_ratio في Gemini تحتوي على 16:9 و 9:16. إذا كان تسليمك عبارة عن تسلسل عنوان عريض أو مقطع اجتماعي بنسبة 1:1، فإن أحد هذين النموذجين ليس في النقاش.

ثبّت بذرة وأعد التشغيل. هذا يذهب في الاتجاه الآخر. تقدم Gemini seed؛ H3 لا يقدمها في أي نقطة نهاية. إذا كنت تبني خط أنابيب حيث يجب أن يعيد نفس الطلب نفس الإطارات يوم الثلاثاء التي أعادها يوم الاثنين، فإن Gemini تمنحك مقبضًا و H3 لا يمنحك شيئًا. لاختبار الانحدار، أو متغيرات النسخ A/B، أو أي مزرعة عرض آلية، هذه ميزة حقيقية وتنتمي إلى جانب Google من السجل.

ما هي التكلفة الفعلية لاختبار MiniMax H3 مقابل Gemini Omni Flash

التجربة بأكملها أعلاه، أربعة أجيال فيديو وصورة واحدة، جاءت بحوالي 5.51 دولار. إطار أول واحد بسعر 0.009 دولار، مقطعين للجولة الأولى مدة كل منهما 10 ثوانٍ بسعر 1.40 دولار و 1.30 دولار، مقطعين للجولة الثانية مدة كل منهما 10 ثوانٍ بسعر 1.40 دولار لكل منهما.

لكل ثانية، Gemini أرخص: 0.125 دولار إلى 0.14 دولار مقابل 0.14 دولار ثابت لـ H3، لذا حوالي 7 إلى 11 بالمائة أقل حسب نقطة النهاية. هذا الرقم صحيح وهو أيضًا عديم الفائدة تقريبًا بمفرده.

إليك السبب. افترض أن التسليم عبارة عن افتتاحية سينمائية مدتها 15 ثانية بنسبة 21:9 وبدقة 2K. H3 يعرضها كمقطع واحد. Gemini لا يمكنها عرضها على الإطلاق: لا الدقة، ولا المدة، ولا نسبة العرض إلى الارتفاع. ستقوم بتجميع مقطع 10 ثوانٍ وآخر 5 ثوانٍ بنسبة 16:9، وقصها لتزييف الشاشة العريضة، وشحنها بدقة 720p. سعر الثانية لشيء لا يمكنك تسليمه ليس توفيرًا.

اقلبها. افترض أن التسليم عبارة عن مقطع اجتماعي بنسبة 16:9 سيمر بأربع جولات من ملاحظات العميل ويجب أن يعود متطابقًا بالبايت عندما يطلب الفريق القانوني إعادة عرضه بعد ثلاثة أسابيع. video-edit الخاص بـ Gemini بالإضافة إلى seed مبني تمامًا لهذه الحلقة، وهو أقل تكلفة في الثانية أثناء القيام بذلك.

الجدول د: أي وظيفة من MiniMax H3 مقابل Gemini Omni Flash تذهب إلى أين

المهمة التي أمامكأرسلها إلى
تسليم بدقة 2KMiniMax H3
لقطة واحدة أطول من 10 ثوانٍMiniMax H3
تأطير بنسبة 21:9، 4:3، 1:1 أو 3:4MiniMax H3
تغذية مسار صوتي حقيقيMiniMax H3
الاستضافة الذاتية على وحدات معالجة رسومية خاصة بكMiniMax H3
الهبوط على إطار نهائي محددMiniMax H3
مراجعات متعددة الجولات حواريةGemini Omni Flash
الحفاظ على الأجزاء غير المعدلة من المقطعGemini Omni Flash
عرض قابل للتكرار عبر البذرةGemini Omni Flash
قصة قصيرة عادية بنسبة 16:9 بأقل سعر في الثانيةGemini Omni Flash

خاتمة هذه المقالة هي هذا الجدول، وليس نتيجة. إذا كان المعيار لا يمكنه فصل نموذجين بأكثر من هامش الخطأ الخاص به، فإن المعيار قد أخبرك بكل ما يعرفه، وتتولى ورقة المواصفات المسؤولية من هناك.

للحصول على نظرة أوسع حول مكانة H3 مقارنة ببقية المجال، يغطي تحليل بدائل MiniMax H3 النماذج التي تتفوق عليه في اللوحات التي لا يتصدرها.

الأسئلة الشائعة

هل MiniMax H3 أفضل من Gemini Omni Flash؟

التصويت الأعمى لا يمكنه التفريق بينهما. عبر ثلاث لوحات متصدرة من Artificial Analysis، الفجوات هي 5 و 2 و 9 نقاط Elo، وكل واحدة تقع ضمن فترة ثقة تتراوح بين ±7 و ±10. اختر بناءً على المواصفات، وليس على الترتيب. سقف الدقة، وحد المدة، وقائمة الأبعاد الجانبية ستغير تسليمك؛ 5 نقاط Elo لن تفعل.

أيهما أرخص، MiniMax H3 أم Gemini Omni Flash؟

لكل ثانية، Gemini. على Atlas Cloud، تتراوح تكلفتها من 0.125 دولار إلى 0.14 دولار في الثانية مقابل 0.14 دولار ثابت لـ H3، مع طبقة مطور بسعر 0.112 دولار في الثانية ليس لـ H3 ما يعادلها. لكن Gemini محدودة بدقة 720p و 10 ثوانٍ وبعدين جانبيين فقط، لذا بالنسبة للعديد من التسليمات، فأنت لا تقارن نفس المنتج. سعّر المقطع النهائي، وليس الثانية.

هل يمكن لـ Gemini Omni Flash توليد فيديو بدقة 1080p أو 2K أو 15 ثانية؟

لا. معامل resolution في API الخاص بها له قيمة قانونية واحدة، وهي 720p، و duration يقبل من 3 إلى 10 ثوانٍ. يقدم MiniMax H3 دقة 768P أو 2K ومدة من 4 إلى 15 ثانية. هذه قيود قيم مقروءة من المخطط المباشر في 6 أغسطس 2026، وليست رأيًا تحريريًا، وقد ترفعها Google لاحقًا.

هل يمكنني استضافة Gemini Omni Flash ذاتيًا كما يمكنني استضافة MiniMax H3؟

لا. أوزان H3 موجودة على Hugging Face وتعمل محليًا بدقة 768 بكسل للجانب القصير. مرحلة Context-IR ووحدة Regenerate-2K اللتان تنتجان إخراج 2K غير موجودتين في الإصدار وتبقى في جانب API. تحقق أيضًا من الترخيص: لا يغطي حاليًا الاتحاد الأوروبي أو المملكة المتحدة أو كوريا الجنوبية أو الولايات المتحدة دون طلب منفصل.

هل يجب أن أختار واحدًا فقط؟

لا، والجدول مقسم حسب المهمة أعلاه هو الإجابة الأفضل. كلا النموذجين يقعان خلف نفس نقطة نهاية generateVideo على Atlas Cloud، لذا فإن تشغيل كليهما يعني حلقة استقصاء واحدة وسلسلة model مختلفة، وليس تكاملين. توجيه حسب التسليم يتفوق على المراهنة على لوحة متصدرة تتحرك كل أسبوع.

أحدث النماذج

واجهة برمجية واحدة لكل وسائط الذكاء الاصطناعي.

استكشف جميع النماذج