Ik staarde tien minuten naar drie Artificial Analysis-leaderboards om te achterhalen wie er eigenlijk gewonnen had.
Tekst-naar-video: Gemini Omni Flash met 5 punten. Afbeelding-naar-video: Gemini met 2 punten. Videobewerking: MiniMax H3 met 9 punten.
Toen keek ik naar de kolom met betrouwbaarheidsintervallen. Plus of min 7. Plus of min 9. Plus of min 10.
Drie borden, drie verschillen, elk ervan binnen de eigen foutmarge. Bij blind stemmen zijn deze twee modellen hetzelfde model.
Dus ik sloot de leaderboards en opende in plaats daarvan de dropdowns. Dat verschil is niet 5 punten. Dat verschil is een hele resolutietrap.
Belangrijkste punten
- Alle drie de Artificial Analysis-verschillen (+5, +2, +9, momentopname van 6 augustus 2026) vallen binnen de betrouwbaarheidsintervallen van ±7 tot ±10. Op ruwe kwaliteit is dit een gelijkspel, geen overwinning.
- H3 levert 2K, tot 15 seconden en zes beeldverhoudingen. Gemini Omni Flash's API heeft een maximum van 720p, 10 seconden en twee beeldverhoudingen. Dat zijn enum-waarden, geen meningen.
- H3 accepteert audio als invoer. Gemini niet. Gemini heeft
seedenthinking_level. H3 heeft geen van beide. - Gemini heeft een speciaal
video-edit-eindpunt dat je bronclip muteert. H3's revisiepad isreference-to-video, dat opnieuw genereert met je clip als referentie. Het zijn niet dezelfde bewerkingen, en ronde twee laat dat zien. - Slechts één van de twee heeft downloadbare gewichten, en dat is niet het Google-model.

Ronde één van de MiniMax H3 vs Gemini Omni Flash-test, beide modellen animeren hetzelfde eerste frame, naast elkaar weergegeven
Ronde één: hetzelfde eerste frame, dezelfde prompt, dezelfde duur. Links MiniMax H3 op 2K, rechts Gemini Omni Flash op 720p. Hier getoond als stille GIF; beide geleverde bestanden hebben native audio en beide zijn verderop als afspeelbare video ingesloten. Dit is het probleem. Ze zijn allebei goed.
Waarom het leaderboardverschil tussen MiniMax H3 en Gemini Omni Flash verkeerd wordt geïnterpreteerd
Bijna elk bericht over MiniMax H3 vs Gemini Omni Flash dat je tegenkomt, citeert één leaderboard en één prijs. Beide gewoontes leiden tot het verkeerde antwoord.
Hier zijn alle drie de Artificial Analysis-borden, met de kolom die iedereen overslaat.
Tabel A: MiniMax H3 vs Gemini Omni Flash op drie Artificial Analysis-leaderboards (met audio), momentopname 6 augustus 2026
| Leaderboard | Gemini Omni Flash | MiniMax H3 | Verschil | Binnen de foutmarges? |
|---|---|---|---|---|
| Tekst-naar-video | 1.243 (#1) ±7, 11.842 stemmen | 1.238 (#2) ±9, 6.830 stemmen | Gemini +5 | Ja |
| Afbeelding-naar-video | 1.191 (#2) ±9, 6.506 stemmen | 1.189 (#3) ±10, 5.545 stemmen | Gemini +2 | Ja |
| Videobewerking | 1.123 (#2) ±5, 11.706 stemmen | 1.132 (#1) ±6, 9.128 stemmen | H3 +9 | Ja, net aan |
MiniMax H3 is een van de 30+ videomodellen die je naast elkaar kunt draaien met dezelfde prompt in de Atlas Cloud-modelvergelijking — met de kosten per seconde zichtbaar voordat je genereert.
Elo-scores van de Artificial Analysis Video Arena (Artificial Analysis, augustus 2026). Afbeelding-naar-video wordt aangevoerd door Dreamina Seedance 2.0 720p met 1.197, dus geen van beide heeft die kroon. Dit zijn doorlopende publieksstemmingsscores en ze bewegen, wat precies de reden is waarom een verschil van 5 punten geen oordeel is.
Een voorsprong van 5 punten met een ±9-interval betekent dat de rangschikking volgende week al kan omslaan door alleen stemruis. Dat is niet "Gemini is beter in tekst-naar-video." Dat is een toss met een scorebord eraan.
Nog drie dingen die mensen verkeerd doen:
De kolom dollar per minuut is niet wat je betaalt. Artificial Analysis vermeldt $6,00/min voor Gemini en $7,80/min voor H3. Die kolom normaliseert naar de kosten van één minuut 1080p bij standaardinstellingen. Gemini Omni Flash kan helemaal geen 1080p produceren. Dus het getal is een modelschatting, geen factuur. Vergelijk eindproducten, geen seconden.
Eén leaderboard is niet het model. H3 staat op de tweede, derde en eerste plaats op de drie borden. Gemini staat op de eerste, tweede en tweede plaats. Alleen een van beide citeren en je kunt bewijzen wat je al geloofde.
"Omni" betekent niet "eet alles." Het is een goede naam en een misleidende. Een van deze twee neemt audiobestanden als invoer. Het is niet degene met "omni" in de naam.
De specificatietabel van MiniMax H3 vs Gemini Omni Flash die niemand afdrukt
Als de Elo-scores ze niet kunnen scheiden, kunnen de constrainttabellen dat wel. Ik heb de live invoerschema's van beide modellen opgehaald in plaats van een aankondigingspost te vertrouwen, en de verschillen zijn niet subtiel.
Tabel B: MiniMax H3 vs Gemini Omni Flash harde constraints, uitgelezen uit de live API-schema's op 6 augustus 2026
| Constraint | MiniMax H3 | Gemini Omni Flash |
|---|---|---|
| Resolutie | 768P of 2K | 720p, en dat is de enige waarde in de enum |
| Duur | 4 tot 15 seconden | 3 tot 10 seconden |
| Beeldverhoudingen | 21:9, 16:9, 4:3, 1:1, 3:4, 9:16 | Alleen 16:9 en 9:16 |
| Revisiepad | reference-to-video (genereert opnieuw met referenties) | Speciaal video-edit-eindpunt (muteert je bron) |
| Laatste frame controle | end_image ondersteund | Niet beschikbaar |
| Referentielimieten | ≤9 afbeeldingen, ≤3 video's, ≤3 audio, 12 bestanden totaal | 1 tot 10 afbeeldingen |
| Audio-invoer | Ja | Nee |
| seed reproduceerbaarheid | Nee | Ja |
| thinking_level | Nee | Ja (default / high / low) |
| Open gewichten | Ja, op Hugging Face | Nee |
Lees die tabel eerlijk: Gemini wint drie rijen overtuigend. Reproduceerbare seeds zijn belangrijk als je een pijplijn bouwt die hetzelfde frame twee keer moet renderen. Een echt video-edit-eindpunt is een wezenlijk andere tool dan referentiegestuurde regeneratie. En thinking_level geeft je een kwaliteitsknop die H3 simpelweg niet blootgeeft.
H3 wint vijf rijen, en dat zijn de rijen die bepalen of je het bestand kunt leveren dat de klant vroeg.
Ik heb alles hieronder uitgevoerd op Atlas Cloud omdat beide modellen daar achter hetzelfde /api/v1/model/generateVideo-eindpunt zitten, wat betekende dat ik één polling-lus en één auth-header had voor de hele test. Modellen wisselen was een wijziging in de model-string. Dat detail is de hele reden waarom "gebruik beide" een realistisch antwoord is in plaats van een makkelijk uitweg.
Tabel C: wat elk eindpunt in deze test kost, geverifieerd aan de hand van de live prijslijst op 6 augustus 2026
| Eindpunt | Prijs | Deze 10-secondenclip |
|---|---|---|
| openai/gpt-image-2/text-to-image | $0,009 / afbeelding | $0,01 |
| minimax/h3/image-to-video | $0,14 / s | $1,40 |
| minimax/h3/reference-to-video | $0,14 / s | $1,40 |
| google/gemini-omni-flash/image-to-video | $0,13 / s | $1,30 |
| google/gemini-omni-flash/video-edit | $0,14 / s | $1,40 |
| google/gemini-omni-flash/text-to-video | $0,125 / s | niet gebruikt |
| minimax/h3/text-to-video | $0,14 / s | niet gebruikt |
Geen van beide modellen heeft deze maand een korting. Gemini biedt ook een goedkopere ontwikkelaarstier ($0,112/s voor tekst-naar-video en afbeelding-naar-video, $0,12/s voor referentie-naar-video); H3 heeft geen equivalent.
De open-gewichtenlijn die Gemini Omni Flash niet kan overschrijden. H3's gewichten zijn gepubliceerd op Hugging Face (MiniMax, augustus 2026): een 33B dichte single-stream Omni Transformer, plus de Qwen3-VL-32B tekstencoder, een visuele VAE en een audio-VAE. Twee kanttekeningen zijn belangrijker dan de downloadgrootte. Ten eerste draait wat je zelf host op een korte zijde van 768 pixels; de Context-IR-voorbewerkingsfase en de Regenerate-2K-module zitten niet in de release, en 2K-uitvoer komt van die twee. Ten tweede dekt de communitylicentie momenteel niet de EU, het Verenigd Koninkrijk, Zuid-Korea of de Verenigde Staten, en er is een apart aanvraagformulier voor die gebieden. Lees het voordat je er een product op bouwt. Gemini Omni Flash heeft geen equivalent gesprek, omdat er geen bestand te downloaden is.
Die open-gewichtenpositie, gecombineerd met agressieve prijzen, is het hele strategische verhaal van de lancering (South China Morning Post, augustus 2026).
Voer de revisietest van MiniMax H3 vs Gemini Omni Flash zelf uit
Hier is het deel dat niemand heeft uitgevoerd. Iedereen benchmarkt de eerste generatie. Niemand benchmarkt de tweede.
Echt werk is niet één prompt. Echt werk is een clip die je al mooi vindt, plus een klant die terugschrijft "love it, kan het bord 24H zeggen en kan haar schort rood zijn." Die ene zin is waar deze twee modellen ophouden uitwisselbaar te zijn, en het blijkt precies de taak te zijn die het leaderboard voor videobewerking meet.
De scène is opzettelijk wreed: een doorweekte noedelkraam 's nachts, de verkoper praat recht in de lens, een handgeschilderd bord met leesbare woorden achter haar, stoom van de bouillon, regen op de luifel. Eén frame dat lippen sync, stabiliteit van tekst op het scherm, vloeiende beweging en gelaagde omgevingsaudio tegelijk belast.
Beide modellen krijgen hetzelfde eerste frame, dezelfde prompt en dezelfde revisienotitie. Elke run hieronder is 10 seconden, wat het plafond van Gemini Omni Flash is en ruim binnen H3's limiet.
Stap 1: Zet het eerste frame vast met GPT Image 2
Beide modellen moeten vanaf dezelfde afbeelding starten, anders meet ronde één compositiegeluk in plaats van het model. Open de GPT Image 2-playground, stel kwaliteit in op high en verhouding op 16:9, en plak dit:
Plain1Photoreal night street-food stall in heavy rain, shot on a 35mm lens at f/2.0. A woman in her late thirties in an indigo canvas apron stands behind a steaming noodle counter, looking straight into the lens, mid-sentence. Behind her a hand-painted tin light-box sign glows warm amber with the words "OPEN LATE" in clean bold sans-serif capitals. Rain streaks through the sodium streetlight, steam rises off the broth pot, wet asphalt reflects red and green neon from across the street. Shallow depth of field, practical lighting only, slight lens haze, natural skin texture, no text anywhere else in the frame. 16:9.

GPT Image 2-playground op Atlas Cloud met de noedelkraamprompt links en het gegenereerde eerste frame in het uitvoerpaneel
GPT Image 2 op Atlas Cloud: de prompt links, het gedeelde eerste frame in OUTPUT. Kosten voor deze stap , $0,009.

Het gegenereerde eerste frame: een vrouw in een indigo schort achter een stomende noedelbalie 's nachts in de regen, met een handgeschilderd OPEN LATE-bord dat achter haar gloeit
De enige invoer die beide modellen ontvingen. Let op de twee dingen die de revisie zal aanpakken: het "OPEN LATE"-bord en het indigo schort. Gegenereerd met openai/gpt-image-2/text-to-image.
Stap 2: Ronde één op MiniMax H3
Ga naar de MiniMax H3-playground, kies de taak image-to-video, upload het frame uit stap 1, en stel resolution in op 2K, duration op 10, ratio op adaptive (de image-to-video-enum biedt alleen adaptive). Prompt:
Plain1The vendor looks into the lens and says, in a warm tired voice: "Broth's been on since four this morning. Sit down, it's still raining." She lifts the ladle as she speaks. Steam curls up across the frame. Rain keeps falling on the awning behind her. The camera holds still, no push, no pan. Ambient audio: rain on canvas, broth simmering, distant traffic, her voice close and dry.

MiniMax H3 image-to-video-playground op Atlas Cloud met 2K-resolutie geselecteerd en de voltooide clip afspelend in het uitvoerpaneel
MiniMax H3 image-to-video op Atlas Cloud: 2K geselecteerd, de voltooide clip in OUTPUT. Deze opname draaide op de standaard 8 seconden van de playground en kostte $1,12; de 10-secondenversie die voor de vergelijking is gebruikt, is hieronder ingesloten en kostte $1,40.
MiniMax H3, ronde één, 2K, 10 seconden. Geluid aan: de dialoog, de regen en de bouillon worden allemaal in dezelfde passage gegenereerd, niet achteraf gelaagd.
Stap 3: Ronde één op Gemini Omni Flash, hetzelfde frame, dezelfde woorden
Open de Gemini Omni Flash-playground, kies image-to-video, upload hetzelfde frame uit stap 1, en plak de prompt uit stap 2 zonder een letter te veranderen. Instellingen: resolution 720p, duration 10, aspect_ratio 16:9, thinking_level default, seed -1.
Twee dingen om op te merken terwijl je in dat formulier bent, want ze zijn het artikel in het klein. De resolution-dropdown bevat precies één optie. Het duration-veld stopt bij 10. Ik koos niet 720p boven iets beters; er is niets anders te kiezen.
Een opmerking over wat hier ontbreekt: ik kon geen screenshot van een voltooide run voor een van beide Gemini-stappen maken. De staging-omgeving waar ik screenshots neem, gaf 403 PERMISSION_DENIED van Google's kant bij alle drie de pogingen, dus de enige Gemini-opnamen die ik heb, tonen een mislukt OUTPUT-paneel en ik ga er niet een als een succesvolle run presenteren. De onderstaande clips zijn echt, gegenereerd via de productie-API met de bovenstaande instellingen. De twee H3-stappen werden wel schoon vastgelegd en die screenshots zijn authentiek.
Gemini Omni Flash, ronde één, 720p, 10 seconden, identieke invoer. Speel dit direct na de H3-clip hierboven af en beoordeel de audio zelf.
Stap 4: Ronde twee, stuur de revisie naar Gemini Omni Flash
Dit is de ronde die ertoe doet. Schakel naar de taak video-edit op dezelfde modelpagina van Gemini, upload de clip die Gemini zelf in stap 3 heeft geproduceerd als de video-invoer, stel resolution 720p en thinking_level high in (een instructie voor een bewerking in twee delen is precies het complexe geval waar die knop voor is). Plak deze notitie exact zoals een klant hem zou sturen:
Plain1Keep this exact shot: same camera position, same woman, same face, same rain, same lighting, same audio. Change the hand-painted sign so it reads "OPEN 24H" instead of "OPEN LATE", in the same painted style and the same amber glow. Change her apron from indigo blue to deep crimson. Change nothing else in the frame.
Gemini Omni Flash na de revisienotitie. Kijk naar het bord, dan naar het schort en controleer of er nog iets anders is veranderd.
Stap 5: Ronde twee, stuur de identieke revisie naar MiniMax H3
Hier is het eerlijke structurele verschil, en je moet het weten voordat je de uitslag leest. H3 heeft geen video-edit-eindpunt. Het revisiepad is reference-to-video: je geeft het de originele clip als referentie en het genereert een nieuwe video, geconditioneerd op die referentie. Het bewerkt je bestand niet. Het maakt een nieuw bestand dat eruit zou moeten zien als het jouwe.
Op de MiniMax H3-pagina kies je de taak reference-to-video, voeg je de clip die H3 in stap 2 heeft geproduceerd toe aan refers als videoreferentie, en stel je resolution in op 2K, duration op 10, ratio op adaptive. Plak de prompt uit stap 4 zonder enige aanpassing.
Deze stap heeft ook geen playground-screenshot, om een andere, saaie reden: de headless browser waarmee ik screenshots maak, crashte drie keer op de referentie-uploader tijdens het laden van een videoreferentie. De run zelf ging zonder problemen via de API.
MiniMax H3 na de identieke revisienotitie, via reference-to-video op 2K.

Naast elkaar van ronde twee: het Gemini Omni Flash video-edit-resultaat naast het MiniMax H3 reference-to-video-resultaat, beide van dezelfde revisienotitie
Ronde twee naast elkaar, stille GIF. Links Gemini Omni Flash via video-edit, rechts MiniMax H3 via reference-to-video. Beide hadden dezelfde zin om mee te werken.
Wat er werkelijk gebeurde in ronde twee. Ik verwachtte dat H3 deze zou verliezen. Referentiegestuurde regeneratie is een botter instrument dan een echt bewerkingseindpunt, en "genereer de hele clip opnieuw en hoop dat hij op dezelfde plek landt" is precies hoe je een ander gezicht, een zwevende camera en een klant krijgt die vraagt wat er met de opname is gebeurd.
Dat is niet wat er terugkwam. Beide modellen deden het werk, en allebei deden ze het netjes.
Gemini's video-edit gedroeg zich precies zoals geadverteerd. Het bord leest OPEN 24H in hetzelfde handgeschilderde lettertype, met dezelfde amberkleurige gloed en dezelfde verwering op het tin. Het schort is dieprood. Al het andere is onaangetast: hetzelfde gezicht, dezelfde uitdrukking, dezelfde lepelhoek, dezelfde stoomvorm, dezelfde regen, dezelfde achterlichten op de achtergrond. Het leest als het originele bestand met twee pixel-diepe correcties, want dat is het in wezen.
H3's reference-to-video produceerde dezelfde twee veranderingen en hield de opname veel beter vast dan de architectuur suggereert. Bord veranderd, schort veranderd, en gedurende alle 10 seconden bleven de kadrering, het gieten van bouillon van de lepel, de stoompluim en haar gezicht op model ten opzichte van de clip uit ronde één. Als er hier drift is, kon ik die niet vinden door frames te doorlopen.
Dus ronde twee is een derde statistisch gelijkspel, en ik ga niet doen alsof het anders is om een netter verhaal te krijgen. Wat de twee uitvoeren scheidt, is niet de bewerkingskwaliteit. Het is dat H3 2560x1440 teruggaf met een 32 kHz stereo track en Gemini 1280x720. Dezelfde instructie, hetzelfde succes, ander eindproduct.
Eén eerlijke kanttekening bij de methode: dit is een enkele revisie op een enkele opname, geen gecontroleerde studie. Een verandering in twee delen aan een bord en een kledingstuk is een vrij vriendelijke bewerking. Moeilijkere gevallen (een object verwijderen waar de camera langs beweegt, iets veranderen dat het onderwerp blokkeert, vier rondes notities die op elkaar stapelen) zijn waar een speciaal bewerkingseindpunt vooruit zou moeten komen, en waar regeneratie zou moeten gaan wankelen. Voer de jouwe uit voordat je beslist.
Nog drie splitsingen tussen MiniMax H3 en Gemini Omni Flash die het testen waard zijn
Ronde twee is de splitsing die een levering verandert. Nog drie zijn twintig minuten van je eigen tegoed waard.
Voer er een audiobestand in. H3's reference-to-video accepteert tot drie audioclips van 2 tot 15 seconden elk, zolang er ten minste één afbeelding of videoreferentie meegeleverd wordt. Dat betekent dat je het een echte stemopname kunt geven en het personage het kunt laten uitvoeren. Gemini Omni Flash heeft geen audio-invoerveld op een van zijn vier eindpunten, dus deze vergelijking kan helemaal niet worden uitgevoerd. Dat is geen scoringsverlies voor Google; het is een mogelijkheid die simpelweg ontbreekt.
Vraag om 21:9. H3's reference-to-video-ratio-enum bevat 21:9, 16:9, 4:3, 1:1, 3:4 en 9:16. Gemini's aspect_ratio-enum bevat 16:9 en 9:16. Als je eindproduct een breedbeeld-titelreeks of een 1:1 social cut is, doet een van deze twee modellen niet mee.
Vergrendel een seed en voer opnieuw uit. Deze gaat de andere kant op. Gemini stelt seed bloot; H3 stelt het op geen enkel eindpunt bloot. Als je een pijplijn bouwt waarbij hetzelfde verzoek op dinsdag dezelfde frames moet retourneren als op maandag, geeft Gemini je een handvat en geeft H3 je niets. Voor regressietesten, A/B-varianten van teksten of een geautomatiseerde renderfarm is dat een echt voordeel en het hoort aan de Google-kant van de balans.
Wat een MiniMax H3 vs Gemini Omni Flash-test werkelijk kost
Het hele bovenstaande experiment, vier videogeneraties en één afbeelding, kostte ongeveer $5,51. Eén eerste frame voor $0,009, twee clips van 10 seconden in ronde één voor $1,40 en $1,30, twee clips van 10 seconden in ronde twee voor $1,40 elk.
Per seconde is Gemini goedkoper: $0,125 tot $0,14 tegen een vast $0,14 voor H3, dus ruwweg 7 tot 11 procent minder, afhankelijk van het eindpunt. Dat getal klopt en het is ook bijna nutteloos op zichzelf.
Hier is waarom. Stel dat het eindproduct een 15 seconden durende 21:9 cinematic opener is op 2K. H3 rendert het als één clip. Gemini kan het helemaal niet renderen: niet de resolutie, niet de duur, niet de beeldverhouding. Je zou een 10-seconden- en een 5-seconden 16:9-clip aan elkaar moeten naaien, bijsnijden om de breedbeeld te vervalsen, en 720p leveren. De prijs per seconde van iets dat je niet kunt leveren, is geen besparing.
Draai het om. Stel dat het eindproduct een 16:9 social cut is die vier rondes klantnotities doormaakt en over drie weken byte-identiek terug moet komen wanneer het juridische team vraagt om het opnieuw te renderen. Gemini's video-edit plus seed is precies voor die lus gebouwd, en het kost minder per seconde terwijl het dat doet.
Tabel D: welke MiniMax H3 vs Gemini Omni Flash-klus waar naartoe gaat
| De klus voor je | Stuur naar |
|---|---|
| 2K levering | MiniMax H3 |
| Een enkele opname langer dan 10 seconden | MiniMax H3 |
| 21:9, 4:3, 1:1 of 3:4 kadrering | MiniMax H3 |
| Een echte audiotrack invoeren | MiniMax H3 |
| Self-hosten op je eigen GPU's | MiniMax H3 |
| Landen op een specifiek laatste frame | MiniMax H3 |
| Conversationele multi-round revisies | Gemini Omni Flash |
| De onaangetaste delen van een clip behouden | Gemini Omni Flash |
| Reproduceerbare renders via seed | Gemini Omni Flash |
| Gewone 16:9 korte vorm tegen het laagste tarief per seconde | Gemini Omni Flash |
De conclusie van dit artikel is die tabel, geen score. Als een benchmark twee modellen niet kan scheiden met meer dan zijn eigen foutmarge, heeft de benchmark je alles verteld wat hij weet, en neemt de specificatietabel het over.
Voor een breder beeld van waar H3 staat ten opzichte van de rest van het veld, de MiniMax H3-alternatieven uitsplitsing behandelt de modellen die het verslaan op de borden die het niet aanvoert.
Veelgestelde vragen
Is MiniMax H3 beter dan Gemini Omni Flash?
Blind stemmen kan ze niet scheiden. Op drie Artificial Analysis-leaderboards zijn de verschillen 5, 2 en 9 Elo-punten, en elk valt binnen een betrouwbaarheidsinterval van ±7 tot ±10. Kies op specificaties, niet op rangschikking. De resolutieplafond, duurlimiet en lijst met beeldverhoudingen zullen je eindproduct veranderen; 5 Elo-punten niet.
Wat is goedkoper, MiniMax H3 of Gemini Omni Flash?
Per seconde, Gemini. Op Atlas Cloud kost het $0,125 tot $0,14 per seconde tegen H3's vaste $0,14, met een ontwikkelaarstier van $0,112 per seconde waar H3 geen equivalent van heeft. Maar Gemini is beperkt tot 720p, 10 seconden en twee beeldverhoudingen, dus voor veel eindproducten vergelijk je niet hetzelfde product. Prijs de voltooide cut, niet de seconde.
Kan Gemini Omni Flash 1080p, 2K of 15-seconden video genereren?
Nee. De resolution-parameter van de API heeft één geldige waarde, 720p, en duration accepteert 3 tot 10 seconden. MiniMax H3 biedt 768P of 2K en 4 tot 15 seconden. Dit zijn enum-beperkingen uitgelezen uit het live schema op 6 augustus 2026, geen redactionele mening, en Google kan ze later opheffen.
Kan ik Gemini Omni Flash self-hosten zoals ik MiniMax H3 kan self-hosten?
Nee. H3's gewichten staan op Hugging Face en draaien lokaal op een korte zijde van 768 pixels. De Context-IR-fase en de Regenerate-2K-module die 2K-uitvoer produceren, zitten niet in de release en blijven API-zijdig. Controleer ook de licentie: deze dekt momenteel niet de EU, het VK, Zuid-Korea of de VS zonder een aparte aanvraag.
Moet ik er maar één kiezen?
Nee, en de tabel met klus per model hierboven is het betere antwoord. Beide modellen zitten achter hetzelfde generateVideo-eindpunt op Atlas Cloud, dus beide gebruiken betekent één polling-lus en een andere model-string, niet twee integraties. Routeren op eindproduct is beter dan wedden op een leaderboard dat elke week beweegt.






