Seedance 2.0 Mini & Fast API com os preços mais baixos do mundo — até 68% de desconto no preço oficial

MiniMax H3 2K vs 768P: Eu executei o mesmo prompt duas vezes e obtive dois filmes diferentes

Medido em 2026-08-05: MiniMax H3 2K vs 768P retorna 1344x768 vs 2560x1440 a $0.40 vs $0.56. Por que o rascunho barato não é uma prévia do seu final, e a correção.

Duas fotos impressas de garrafas de cold brew sobre uma mesa de madeira

Duas impressões da mesma foto de garrafa de cold brew sobre um balcão de cafeteria, uma suave e uma nítida, com um recibo entre elas

Duas impressões da mesma foto, uma suave e uma nítida. No MiniMax H3 essa diferença não é um controle deslizante de qualidade. Gerado com openai/gpt-image-2/text-to-image.

Enviei o mesmo prompt duas vezes. A única coisa que mudei foi um menu suspenso: 768P, depois 2K.

A primeira execução custou US$ 0,40 e voltou em 130 segundos. A segunda custou US$ 0,56 e levou 181 segundos. Então coloquei os dois quadros lado a lado e algo pareceu errado. A garrafa ainda estava lá. O rótulo ainda estava lá, letras miúdas e tudo. Mas o balcão havia mudado de madeira quente para pedra pálida, uma prateleira apareceu ao fundo atrás do barista, a condensação no vidro estava de repente por toda parte, e a luz mudou de cor.

Eu não tinha economizado dinheiro em um rascunho. Eu tinha filmado dois filmes diferentes.

Isso não é um bug. É o que "2K" realmente significa no H3, e uma vez que você entende, o conselho padrão que todos dão, rascunho barato depois finalize caro, silenciosamente desmorona. Abaixo estão todos os números desse teste, além da única mudança que faz o rascunho barato funcionar.

Principais conclusões (todos os números medidos no Atlas Cloud, 2026-08-05)

  • 768P entregou 1344x768, 2K entregou 2560x1440 em uma solicitação 16:9. Isso é 3,6x os pixels e 3,6x a taxa de bits do vídeo.
  • A cobrança foi de US$ 0,40 vs US$ 0,56 para um clipe de 4 segundos, ou seja, US$ 0,10/s vs US$ 0,14/s. 768P é 29% mais barato por segundo, não metade do preço.
  • 768P voltou 28% mais rápido no par texto-para-vídeo (130s vs 181s) e 17% mais rápido no par imagem-para-vídeo (194s vs 234s).
  • Texto-para-vídeo em 768P e 2K com o mesmo prompt produziu duas tomadas diferentes, não duas qualidades de uma única tomada. Um rascunho simples em 768P não pré-visualiza o seu final em 2K.
  • Trave o primeiro quadro com imagem-para-vídeo e a deriva para. Mesmo cenário, mesmo enquadramento, mesma posição do rótulo, e o 2K gasta seus pixels extras exatamente onde o MiniMax diz que gasta: nas letras miúdas.
  • 768P não está restrito. Ambos os níveis estão ativos no enum de resolução e selecionáveis no menu suspenso a partir de 2026-08-05, independentemente do que os resumos mais antigos ainda dizem.

MiniMax H3 2K vs 768P: O 768P ainda está em beta fechado?

Não, e vale a pena matar essa ideia logo porque ainda é repetida na maioria dos resumos de preços escritos nos dias após o lançamento.

Puxei o esquema de entrada ao vivo para todos os três endpoints H3 hoje. O campo resolutionenum: ["768P", "2K"] com default: "2K" em texto-para-vídeo, imagem-para-vídeo e referência-para-vídeo, e duration executa cada segundo inteiro de 4 a 15 em todos os três. Nenhum sinalizador, nenhum portão, nenhum formulário de vendas. Em seguida, enviei um trabalho 768P em dois endpoints diferentes e ambos foram concluídos e cobrados na taxa mais baixa. Se uma página diz para você entrar em contato com vendas para 768P, essa página está descrevendo a primeira semana do lançamento, não esta semana.

MiniMax H3 2K vs 768P, Mesmo Prompt, Lado a Lado

Esquerda é 768P. Direita é 2K. Prompt idêntico, duration=4 idêntico, ratio=16:9 idêntico, enviados consecutivamente para minimax/h3/text-to-video.

Comparação lado a lado da resolução da imagem mostrando uma garrafa de cold brew

MiniMax H3 2K vs 768P tela dividida do mesmo prompt texto-para-vídeo, com resolução, preço e tempo de parede gravados

Mesmo prompt, duas execuções. Esquerda: 768P, 1344x768, US$ 0,40, 130s. Direita: 2K, 2560x1440, US$ 0,56, 181s. Mostrado como um GIF silencioso; ambos os arquivos entregues carregam áudio estéreo de 32 kHz. Medido no Atlas Cloud, 2026-08-05.

Observe o que realmente difere. Não é nitidez. É o filme. Material do balcão diferente, decoração de fundo diferente, quantidade de condensação diferente, altura diferente da câmera, temperatura de cor diferente, e o rótulo está em um ponto diferente na garrafa. Nada no prompt pediu qualquer uma dessas mudanças.

Agora a parte que todo mundo assume que vai para o outro lado. Aqui está a área do rótulo de ambas as tomadas, recortada dos arquivos nativos e ampliada para a mesma largura, então o recorte 768P está mais ampliado do que o recorte 2K.

Comparação da resolução 768p e 2K em um rótulo de cold brew

Comparação de recorte do rótulo entre as tomadas MiniMax H3 768P e 2K, ambas mostrando a pequena linha de ingredientes como legível

A pequena linha "single origin ethiopia guji / 250ml / roasted 04.08.2026" sobrevive em 768P. Está mais suave e o espaçamento entre letras oscila, mas nada é ilegível. O custo real do 768P aqui não foi texto borrado, foi uma composição diferente.

Portanto, o enquadramento honesto de MiniMax H3 2K vs 768P não é "nítido versus borrado". É "esta tomada versus uma tomada diferente, mais uma passagem de detalhes por cima".

A Ficha Técnica MiniMax H3 2K vs 768P, Medida

Tudo nesta tabela veio de ffmpeg -i nos arquivos entregues e do campo price na previsão finalizada, não de uma página de documentação.

Medido no arquivo entregue768P2KProporção
Resolução entregue (solicitação 16:9)1344x7682560x14403,6x pixels
Taxa de bits do vídeo998 kb/s3.624 kb/s3,6x
Tamanho do arquivo, clipe de 4,46s620 KB2,00 MB3,3x
Taxa de quadros24 fps24 fpsmesma
Faixa de áudioAAC estéreo, 32.000 Hz, 131 kb/sAAC estéreo, 32.000 Hz, 127 kb/smesma
Duração do container para duration=44,46s4,46smesma
Enviar até concluir, tempo de parede130s181s1,39x
Realmente cobradoUS$ 0,40US$ 0,561,4x
Taxa efetivaUS$ 0,10/sUS$ 0,14/s29% mais barato

Quer comparar o MiniMax H3 com outros modelos de vídeo no mesmo prompt? A comparação de modelos do Atlas Cloud os executa lado a lado com resolução e custo por segundo mostrados antes de você gerar.

Duas notas de rodapé que me custaram dinheiro para aprender. Primeiro, ambos os níveis entregaram 4,46 segundos para uma solicitação duration=4 e ambos cobraram 4 segundos, então você ganha os 0,46s extras de graça, mas não pode planejar um corte em torno disso. Segundo, o áudio é idêntico entre os níveis. Se o seu clipe é sustentado por diálogo ou sincronia musical, 2K não compra nada no que importa.

Por que MiniMax H3 2K vs 768P Pega Todo Mundo Desprevenido

Porque 2K no H3 não é uma etapa de upscale. É uma segunda geração.

O MiniMax descreve o mecanismo diretamente: "Para a saída 2K do H3, em vez de usar um módulo de super-resolução dedicado convencional, fazemos o modelo base H3 regenerar sua própria saída de baixa resolução no contexto." Eles explicam por que construíram dessa forma também: a abordagem no contexto "permite que ele recorra ao contexto multimodal original novamente para produzir saída de alta resolução, recuperando detalhes que a super-resolução tradicional só pode 'adivinhar' e muitas vezes não consegue restaurar, como texto pequeno e detalhes finos" (MiniMax, julho de 2026).

Leia isso novamente com uma mentalidade de produção. A passagem 2K volta ao seu contexto original e gera novamente. Quando seu contexto não é nada além de um prompt de texto, "gerar novamente" significa "rolar os dados novamente". É exatamente isso que minhas duas tomadas mostram. O modelo nunca foi instruído a reproduzir a versão 768P, porque nunca viu a versão 768P.

Três maneiras como isso morde na prática:

  1. Você faz rascunhos baratos em 768P no texto-para-vídeo, escolhe um vencedor e depois o executa novamente em 2K. Você recebe um estranho de volta. O prompt é honrado, o filme é novo. Esse é o teste no topo desta página.
  2. Você faz o orçamento como se 29% mais barato por segundo significasse 29% mais barato. Não significa, porque os finais são a parte cara de qualquer lote real, e uma repetição 2K desperdiçada anula a economia de vários rascunhos.
  3. Você assume que o caminho de upgrade barato está em algum lugar. Verifiquei o catálogo completo no Atlas Cloud hoje: 452 modelos, três endpoints H3, e nenhum endpoint de regeneração H3 entre eles. Onde apenas os três endpoints de geração estão expostos, "atualizar este clipe para 2K" significa ou repeti-lo ou executar um upscaler separado sobre ele. Ambos custam dinheiro, e não compram a mesma coisa.

Vale a pena dizer por que vale a pena contornar esse modelo em vez de trocar. A oferta principal no lançamento foi vídeo "em até resolução 2K, em clipes de até 15 segundos, com áudio estéreo nativo" (DataNorth AI, agosto de 2026), e as pontuações apoiaram: o H3 atualmente está no topo do quadro de classificação Elo de edição de vídeo do Artificial Analysis em 1.130, à frente do Gemini Omni Flash em 1.122 e 93 pontos à frente do Dreamina Seedance 2.0 720p em 1.037 (Artificial Analysis, agosto de 2026). A qualidade vale um fluxo de trabalho. O fluxo de trabalho só precisa respeitar como o 2K é produzido.

Os Quatro Modelos Por Trás Deste Teste MiniMax H3 2K vs 768P, em Uma Aba

O teste inteiro são quatro modelos, uma chave de API, uma conta. Eu executei no Atlas Cloud porque alternar entre um modelo de imagem, dois endpoints H3 e um upscaler de outra forma significa três contas e três faturas para reconciliar no final do mês.

Trabalho neste testeModeloPreço a partir de agosto de 2026O que realmente paguei
Travar o primeiro quadroopenai/gpt-image-2/text-to-imagelistado a partir de US$ 0,009/imagem (níveis de token acima)US$ 0,1745 por um 2048x1152 em qualidade alta
Rascunho e final, quadro travadominimax/h3/image-to-videoUS$ 0,14/s em 2K, US$ 0,10/s em 768PUS$ 0,40 e US$ 0,56 para 4s cada
Par de controle simplesminimax/h3/text-to-videomesmos dois níveisUS$ 0,40 e US$ 0,56 para 4s cada
Manter a tomada, aumentar os pixelsatlascloud/video-upscalerUS$ 0,018/s para 1080p, US$ 0,024/s para 2K, mínimo de 5sUS$ 0,12 para o clipe de 4,46s

Duas notas antes de copiar os números. Os endpoints H3 publicam uma única taxa principal de US$ 0,14/s, que é o nível 2K; a taxa 768P aparece na conta, não na listagem, então meça você mesmo uma vez. E nenhum desses quatro modelos está com desconto agora. Se você quiser reduzir a etapa de travamento de quadro, openai/gpt-image-2-developer/text-to-image está com 50% de desconto (US$ 0,004 de US$ 0,009) a partir de agosto de 2026, e é a mesma família fazendo o mesmo trabalho.

Como Executar o Teste MiniMax H3 2K vs 768P Você Mesmo

Cinco etapas, US$ 2,21 de crédito e cerca de 15 minutos de tempo de parede total. Cada prompt abaixo é a string exata que enviei.

Três notas de parâmetro primeiro, porque cada uma pode silenciosamente custar uma execução:

  • No texto-para-vídeo, o campo é ratio, não aspect_ratio, seu padrão é 1:1, e seu enum não tem opção adaptive. Passe 16:9 você mesmo ou você recebe um clipe quadrado. No imagem-para-vídeo, o enum é apenas adaptive, porque seu primeiro quadro decide a forma.
  • Sempre envie duration explicitamente em vez de confiar no padrão documentado de 8. O que é cobrado segue o que é entregue, não o que você assumiu.
  • Cada trabalho H3 dura mais do que um tempo limite normal inline, então envie assíncrono e faça polling. O campo price também é preenchido tardiamente: quando status muda para completed, muitas vezes ainda está vazio, e você precisa fazer polling do id da previsão mais uma vez para obter o número real. Sem esse segundo polling, você não pode construir uma tabela de custos honesta.

Etapa 1: Travar o Quadro Com GPT Image 2

Este é o passo que transforma um rascunho em uma pré-visualização em vez de um bilhete de loteria. Gere a composição finalizada como um still, e ela se torna a parte imóvel de ambas as execuções de vídeo.

text
1Fotografia macro de produto de uma garrafa de café cold brew preta fosca em pé sobre uma laje de ardósia molhada, luz da manhã de uma janela varrendo-a da direita. Um rótulo de papel creme envolve a garrafa, nitidamente legível: título em maiúsculas negrito "NORTHBOUND COLD BREW" em uma linha, e diretamente abaixo em tipo pequeno "single origin ethiopia guji / 250ml / roasted 04.08.2026". Gotas de condensação no vidro, uma máquina de espresso e um barista em uma camisa jeans suavemente desfocados ao fundo. Cinematográfico, profundidade de campo rasa, tom neutro quente, fotorrealista, 16:9.
2

Configurações: qualidade alta, tamanho 2048x1152. Não economize aqui. Cada detalhe que você quer que a passagem 2K proteja precisa existir neste quadro primeiro.

Uma garrafa de café Northbound Cold Brew em um balcão de cafeteria

O primeiro quadro travado gerado com GPT Image 2 em 2048x1152, mostrando a garrafa de cold brew e suas letras miúdas legíveis

Gerado com openai/gpt-image-2/text-to-image, qualidade alta, 2048x1152. Cobrado US$ 0,1745, de volta em 146s.

Captura de tela de uma interface de gerador de imagens de IA com etapas numeradas

Playground GPT Image 2 no Atlas Cloud com o prompt do quadro preenchido e a garrafa gerada no painel de saída

GPT Image 2 no Atlas Cloud: qualidade definida como alta, 16:9, o quadro travado renderizado à direita.

Etapa 2: Rascunhá-lo em 768P

Mesmo endpoint que você usará para o final. Apenas a resolução difere entre esta etapa e a etapa 4.

text
1Dolly-in macro lento na garrafa. Gotas de condensação deslizam pelo vidro. O rótulo permanece perfeitamente parado e legível. No fundo suave, o barista limpa o balcão uma vez. Tom ambiente natural de cafeteria, um leve chiado de máquina de espresso. Sem trepidação de câmera.
2

Configurações em minimax/h3/image-to-video: primeiro quadro = sua saída da etapa 1, resolution=768P, duration=4, ratio=adaptive.

Uma garrafa de café Northbound Cold Brew em um balcão de cafeteria

O clipe de rascunho MiniMax H3 768P, um dolly-in macro lento na garrafa de cold brew

O rascunho 768P: 1344x768, cobrado US$ 0,40, de volta em 194s. Mostrado como um GIF silencioso; o arquivo em si carrega áudio estéreo de 32 kHz. Observe as quatro faixas grossas de gotejamento manchadas no rótulo.

Interface de gerador de vídeo de IA com prompt e vídeo de cold brew gerado

Playground MiniMax H3 imagem-para-vídeo no Atlas Cloud com o quadro travado carregado, o prompt digitado e um clipe finalizado no painel de saída

O formulário imagem-para-vídeo com o quadro travado carregado. Resolução e Duração são os únicos dois campos que separam esta etapa da etapa 4, e ambos os níveis estão na mesma lista sem nada restringindo um ou outro. Esta captura foi deixada nos padrões 2K e 8 segundos, e é por isso que o botão Executar cita US$ 1,12; mude Resolução para 768P e Duração para 4 e essa cotação cai para US$ 0,40.

Etapa 3: Julgar o Rascunho MiniMax H3 2K vs 768P nas Coisas Certas

O rascunho é um ensaio, não uma prova. Dos meus dois pares, aqui está o que ele diz de forma confiável e o que não diz.

Confie nele para: redação do prompt, se o movimento faz sentido, a quantidade de movimento da câmera, o ritmo ao longo dos quatro segundos e a base de áudio. Tudo isso foi transferido limpo.

Não confie nele para: textura superficial fina, o menor tipo de letra no seu produto, ou qualquer artefato que ele invente. No meu rascunho 768P, o rótulo pegou quatro gotas marrons grossas que a execução 2K não produziu, e a pequena linha de ingredientes se desfez em bagunça. Se eu tivesse rejeitado aquele rascunho por parecer sujo, teria rejeitado um prompt que estava funcionando.

Essa é a verdadeira divisão de trabalho. 768P responde "esta é a tomada certa", 2K responde "isto é entregável".

Etapa 4: Virar Um Campo e Finalizar em 2K

Mesmo endpoint, mesmo primeiro quadro, mesma string de prompt. Mude resolution para 2K e nada mais.

Uma garrafa de café Northbound Cold Brew em um balcão de cafeteria

O clipe final MiniMax H3 2K do mesmo primeiro quadro travado, com rótulo limpo e letras miúdas legíveis

O final 2K: 2560x1440, cobrado US$ 0,56, de volta em 234s. Mesma laje, mesma máquina de espresso, mesma planta, mesmo barista, mesma posição do rótulo que o rascunho.

Aqui está a resposta para a pergunta que este artigo inteiro foi construído para testar, e foi para o lado bom. Com o primeiro quadro travado, a deriva parou. O cenário, o enquadramento, a altura da câmera e a posição da tipografia se mantiveram entre o rascunho 768P e o final 2K. As diferenças se limitaram aos detalhes: a passagem 2K limpou as gotas manchadas para um único filete fino, resolveu o grão do papel e transformou a pequena linha de ingredientes de ruído de volta em palavras. Esse é exatamente o comportamento que o MiniMax afirma para a regeneração no contexto, e é a primeira vez neste teste que o 2K pareceu um nível de qualidade em vez de uma repetição.

Para contraste, o grupo de controle. Esta é a execução simples de texto-para-vídeo em 2K, aquela que produziu o estranho no topo desta página. Mesmo conteúdo de prompt, sem primeiro quadro, então nada prende a composição.

11 palavras

Playground MiniMax H3 texto-para-vídeo em 2K com o clipe de controle finalizado no painel de saída

MiniMax H3 texto-para-vídeo no Atlas Cloud: sem primeiro quadro, Resolução 2K, Proporção 16:9, e o clipe finalizado no painel de saída. Nada estava errado com esta geração. Só não é o mesmo filme que a execução 768P produziu.

Etapa 5: Ou Pule a Repetição MiniMax H3 2K vs 768P e Faça Upscale

Às vezes a tomada 768P já é a certa. A performance acertou, o timing está certo, e você não quer uma regeneração que possa cair de forma diferente. Então não repita. Empurre o arquivo exato através de um upscaler.

Configurações em atlascloud/video-upscaler: video = URL da sua saída 768P, target_resolution=2k. O limite de entrada em 2K é de 23 segundos e 690 quadros, e o fps de entrada deve ser 30 ou inferior, então os clipes de 24 fps do H3 passam confortavelmente.

Garrafa de café Northbound Cold Brew em um balcão de cafeteria

A tomada 768P empurrada através do upscaler de vídeo do Atlas Cloud para 2K, mesma filmagem em resolução mais alta

A tomada com upscale: 2540x1452, cobrado US$ 0,12, de volta em 40s. Mesmas quatro gotas, tudo igual. Este é o mesmo filme, não um novo.

Interface de gerador de vídeo de IA mostrando vídeo de entrada e saída concluída

Playground do upscaler de vídeo do Atlas Cloud com o clipe 768P carregado e o resultado 2K no painel de saída

O upscaler de vídeo no Atlas Cloud com o clipe H3 768P carregado e o resultado com upscale tocando à direita. Esta captura foi executada no padrão 1080p, que o botão Executar precifica em US$ 0,09 para qualquer coisa abaixo do mínimo de 5 segundos. Mude Resolução Alvo para 2k e você está no nível de US$ 0,024/s, que é os US$ 0,12 que me foram cobrados pela minha própria execução.

E aqui está o veredito que ninguém deve pular, todos os três recortes de rótulo do mesmo quadro travado na mesma ampliação.

Comparação de três painéis de rótulos de garrafa de cold brew em diferentes resoluções

Comparação de recorte de rótulo de três vias: 768P nativo, esse clipe com upscale para 2K e 2K nativo, mostrando que apenas o 2K nativo recupera as letras miúdas

768P nativo, o mesmo clipe com upscale e 2K nativo. O upscaler nitifica o grão do papel e o título grande lindamente, e mantém a tomada exata. O que ele não pode fazer é colocar a pequena linha de volta, porque essa informação nunca esteve no arquivo 768P. A passagem de regeneração pode, porque ela volta ao contexto em vez de aos pixels.

Portanto, as duas rotas não são concorrentes. Elas respondem a perguntas diferentes. O upscale preserva uma performance. A regeneração recupera detalhes. Escolha por aquele que seu clipe não pode perder.

Variações Que Valem a Pena Testar no MiniMax H3 2K vs 768P

  • Vertical. Meus testes 16:9 retornaram 1344x768, então o lado curto é o que o nível fixa. Uma solicitação 9:16 deve chegar em 768x1344 na mesma lógica, mas meça uma vez antes de construir um lote vertical com base na suposição. No imagem-para-vídeo, você define a forma através do primeiro quadro em vez de lutar com o enum adaptive.
  • Cabeças falantes. Este é o lugar onde eu pularia o rascunho completamente e iria direto para 2K. Rostos, dentes e linhas do olhar são precisamente a classe de pequenos detalhes para a qual a passagem de regeneração existe, e um rascunho 768P vai te informar mal sobre todos os três.
  • Clipes longos. Em 15 segundos a diferença aumenta para US$ 1,50 contra US$ 2,10, e o tempo de parede se estica junto. Planeje a fila, não apenas o orçamento.
  • Texto de produto e trabalho multilíngue. O tipo de texto estável no quadro do H3 e seu áudio multilíngue nativo são as razões pelas quais as pessoas o escolhem para embalagens comerciais em primeiro lugar. Ambos sobrevivem em 768P, o que torna o 768P um nível de entrega genuinamente utilizável para cortes sociais, não apenas uma sala de ensaio.

Quanto Custa Realmente o MiniMax H3 2K vs 768P Por Clipe Utilizável

Primeiro, as três rotas para um entregável 2K, por clipe de 8 segundos, às taxas que realmente me foram cobradas.

Rota para um clipe 2KTaxas usadasCusto para um clipe de 8sMantém a mesma tomadaRecupera texto pequeno
Direto para 2KUS$ 0,14/sUS$ 1,12n/aSim
Rascunho 768P, depois repetição 2K em quadro travadoUS$ 0,10/s depois US$ 0,14/sUS$ 0,80 + US$ 1,12 = US$ 1,92Sim, se o primeiro quadro estiver travadoSim
Final 768P, depois upscale para 2KUS$ 0,10/s depois US$ 0,024/sUS$ 0,80 + US$ 0,192 = US$ 0,99Sim, exatamenteNão

Agora o número que decide o seu mês. Pegue uma mistura realista: dez rolagens de rascunho de 4 segundos para encontrar a tomada, depois dois clipes finais de 8 segundos.

Lote de 10 rascunhos + 2 finaisRascunhosFinaisTravamento de quadroTotal
Tudo em 2K10 x 4s x US$ 0,14 = US$ 5,602 x 8s x US$ 0,14 = US$ 2,24nenhumUS$ 7,84
Rascunhos 768P, finais 2K, quadro travado10 x 4s x US$ 0,10 = US$ 4,00US$ 2,24US$ 0,17US$ 6,41 (18% menos)
Rascunhos 768P, finais 768P, com upscaleUS$ 4,002 x (US$ 0,80 + US$ 0,192) = US$ 1,98US$ 0,17US$ 6,15 (22% menos)

Leia a linha do meio honestamente. A economia por segundo é de 29%, mas a economia por lote é de 18%, porque seus finais ainda são finais. A economia só cresce em direção a 29% à medida que os rascunhos dominam: em vinte rolagens de rascunho de 8 segundos em vez de dez curtas, a rota dois chega cerca de 25% abaixo de tudo 2K. E cada centavo disso depende do quadro travado, porque sem ele aquelas dez rolagens baratas são dez filmes que você não vai enviar.

O segundo dividendo é o tempo, e pode importar mais. No par texto-para-vídeo, 768P retornou 28% mais rápido, e em ambos os pares nunca levou mais tempo. Em clipes de 4 segundos com esses tempos de parede, isso é aproximadamente 27 rolagens de rascunho em uma hora em vez de 20. Quando você ainda está caçando o prompt certo, sete tentativas extras importam mais do que os US$ 1,60 que você economizou.

Uma nota legal se você estava planejando evitar tudo isso com auto-hospedagem. Os pesos abertos no Hugging Face são H3-Base, que gera no lado curto 768. A passagem 2K vive no lado da API, então os pesos abertos lhe dão o nível de rascunho e não o nível de finalização. A licença da comunidade também carrega territórios excluídos cobrindo a UE, Reino Unido, Coreia e EUA, com um canal de autorização separado aberto, então leia a licença antes de construir um pipeline comercial em um checkout local. Para uma visão mais ampla do que os pesos lançados fazem e não fazem, veja nossa análise do MiniMax H3, e o catálogo completo de modelos se você quiser comparar o H3 com o restante do campo atual de vídeo.

Perguntas Frequentes

No MiniMax H3 2K vs 768P, o 768P é realmente mais barato por clipe?

Sim. Fui cobrado US$ 0,40 por um clipe de 4 segundos em 768P e US$ 0,56 pela solicitação idêntica em 2K, então US$ 0,10/s contra US$ 0,14/s, uma economia de 29% por segundo. A pegadinha é que a economia só conta se a execução barata te ensinar algo sobre a cara, o que requer travar o primeiro quadro. Um rascunho simples de texto-para-vídeo em 768P é um filme separado, e dinheiro gasto nele não é dinheiro economizado.

No MiniMax H3 2K vs 768P, o 2K é apenas um upscale da saída 768P?

Não. O MiniMax faz o modelo base regenerar sua própria saída de baixa resolução no contexto em vez de executar um módulo de super-resolução dedicado, e é por isso que o 2K pode restaurar texto pequeno e detalhes finos de superfície que um upscaler só pode aproximar. Meu recorte de rótulo de três vias mostra exatamente isso: o clipe 768P com upscale nitificou o grão do papel, mas deixou a pequena linha de ingredientes como ruído ilegível, enquanto a execução nativa 2K transformou de volta em palavras.

Meu rascunho MiniMax H3 768P vai se parecer com meu final 2K?

Só se você travar o primeiro quadro. No texto-para-vídeo simples, os dois níveis me deram decoração de cenário diferente, altura de câmera diferente, condensação diferente e uma posição de rótulo diferente a partir do mesmo prompt. No imagem-para-vídeo com um primeiro quadro fixo, a composição, enquadramento e tipografia se mantiveram entre os níveis e as únicas mudanças foram em detalhes e textura.

Ainda preciso entrar em contato com vendas para o MiniMax H3 768P?

Não, a partir de 2026-08-05. O esquema ao vivo em todos os três endpoints H3 lista resolution como enum: ["768P", "2K"], o playground mostra ambos em um menu suspenso, e meus trabalhos 768P foram concluídos e cobrados na taxa mais baixa em dois endpoints diferentes. A linha de beta fechado vem de cobertura escrita nos primeiros dias após o lançamento.

No MiniMax H3 2K vs 768P, quanto mais lento é o 2K?

Nos meus pares de 4 segundos, 1,2x a 1,4x mais lento: 181s contra 130s no texto-para-vídeo e 234s contra 194s no imagem-para-vídeo, medidos do envio à conclusão. Arquitetonicamente, o 2K é uma segunda passagem de geração sobre o mesmo contexto, então espere que a diferença absoluta aumente em clipes mais longos, em vez de permanecer plana.

Posso atualizar um clipe 768P para 2K sem repeti-lo?

Você pode aumentar a resolução sem tocar na tomada executando-o através de um upscaler de vídeo, o que me custou US$ 0,12 para um clipe de 4,46 segundos no nível 2K (US$ 0,024/s com um mínimo de 5 segundos) e retornou em 40 segundos. Isso preserva a performance quadro a quadro. O que não fará é recuperar detalhes que nunca foram capturados, então se o objetivo de ir para 2K é tipo pequeno legível, você precisa da passagem de regeneração, não do upscaler.

Modelos recentes

Uma API para toda a IA de mídia.

Explorar Todos os Modelos