
A MiniMax API disponibiliza a família de modelos da MiniMax, do laboratório de Xangai por trás do Hailuo, abrangendo a série M de LLMs de raciocínio agêntico e os geradores de vídeo Hailuo. O M3 potencia agentes de programação com contexto longo, enquanto o Hailuo ocupa o primeiro lugar no WorldModelBench em simulação física, com dinâmica de fluidos e movimento realistas. Na Atlas Cloud, todos os modelos são executados numa única conta, com preços transparentes no modelo pay-as-you-go e acesso Day-0 a novos lançamentos. Comece a desenvolver hoje mesmo.
Gere vídeos cinematográficos e de alta fidelidade a partir de texto e imagens com os mais recentes modelos de IA de geração de vídeo na Atlas Cloud.
Impulsione chat, raciocínio e agentes em larga escala com os principais grandes modelos de linguagem, entregues de forma rápida e acessível na Atlas Cloud.
Compare standard vs. our pricing across every MiniMax model.
| Model | Standard Price (USD) | Our Price (USD) | Discount | |
|---|---|---|---|---|
| MiniMax M3 | $0.6/$2.4per 1M tokens524.3K context | $0.3/$1.2M in/outper 1M tokens524.3K context | -50% | View |
| MiniMax Speech 2.6 Turbo | $0.06/K chars | Start from$0.048/K chars | -20% | View |
| MiniMax Speech 2.6 HD | $0.1/K chars | Start from$0.08/K chars | -20% | View |
| MiniMax M2.7 | $0.3/$1.2per 1M tokens196.6K context | $0.3/$1.2M in/outper 1M tokens196.6K context | — | View |
| MiniMax M2.5 | $0.3/$1.2per 1M tokens196.6K context | $0.295/$1.2M in/outper 1M tokens196.6K context | — | View |
| MiniMax Music 2.6 | $0.15/K chars | Start from$0.15/K chars | — | View |
Instantly explore and experiment with 400+ production-ready models in the Atlas Playground. Start customizing with one click.
A série M da MiniMax lida com programação, agentes e raciocínio de contexto longo, enquanto a Hailuo transforma essas saídas em vídeo. As equipes usam ambas as linhas de produtos juntas para executar fluxos de trabalho autônomos e produzir mídias finalizadas sem precisar trocar de plataforma.
As equipes de desenvolvimento usam o MiniMax M3 para executar agentes de codificação de longo alcance que inspecionam grandes bases de código, rastreiam dependências de vários arquivos e enviam commits funcionais sem pontos de verificação humanos. A MiniMax demonstrou o M3 funcionando de forma autônoma por quase 12 horas para reproduzir um artigo de pesquisa, gerando 18 commits e 23 figuras experimentais a partir de uma única descrição de tarefa. O modelo de preços pay-as-you-go da Atlas Cloud torna prático executar sessões estendidas de agentes sem comprometer capacidade antecipadamente.
Equipes jurídicas e de pesquisa usam a janela de contexto de 1M de tokens do MiniMax M3 para processar contratos inteiros, arquivos de casos ou corpora de pesquisa em uma única chamada. O modelo rastreia referências entre documentos, sinaliza inconsistências e produz resumos estruturados de entradas que excederiam os limites de modelos com contexto mais curto. Isso remove a etapa de fragmentação manual que normalmente prejudica a análise dependente de contexto em fluxos de trabalho com muitos documentos.
Equipes de produtos e dados usam o MiniMax M2.5 para pipelines automatizados de pesquisa na web, obtendo 76,3% no BrowseComp para conclusão de tarefas baseadas em navegador. A arquitetura MoE mantém a latência baixa e o custo previsível em US$ 0,295 por milhão de tokens de entrada, tornando-o viável para execuções agênticas em larga escala que chamam ferramentas externas repetidamente. As equipes que executam fluxos de trabalho de produção conhecidos e repetíveis se beneficiam da vantagem de velocidade consistente do M2.5 em relação a modelos mais pesados.
As equipas de marketing usam o Hailuo 02 Pro para gerar vídeos de produtos a 1080p e clipes de histórias de marca a partir de uma única imagem de referência ou prompt de texto. A precisão física e o manuseamento de câmara cinematográfica do modelo produzem resultados que correspondem às instruções de direção com uma taxa de resposta a instruções complexas de 85%. A US$ 0,49 por segundo na Atlas Cloud, um clipe de 10 segundos com qualidade de produção custa menos do que a maioria das taxas de licenciamento de vídeos de stock.
Estúdios e plataformas de conteúdo utilizam o Hailuo 2.3 para gerar conteúdo de vídeo ilustrado e em estilo anime com microexpressões precisas e movimentos corporais fluidos dos personagens. O primeiro lugar do modelo no WorldModelBench para simulação física estende-se a cenários estilizados, mantendo o movimento natural mesmo em saídas não fotorrealistas. O Hailuo 2.3 Fast no Atlas Cloud, a US$ 0,19 por execução, mantém os custos de iteração baixos durante a fase de desenvolvimento criativo.
Directors and animators use Hailuo 02 to generate motion reference clips and storyboard previsualisations before committing to full production. Complex action sequences, physics-driven scenes, and camera movements can be tested via the API at a fraction of the cost of live-action or animation studio work. The consistent prompt adherence across repeated calls means the same scene description reliably produces comparable output for client presentations.
A MiniMax API é uma interface única para a família de modelos da MiniMax, cobrindo os grandes modelos de linguagem da série M para raciocínio em texto e codificação agêntica, além dos modelos Hailuo para geração de vídeo. No Atlas Cloud, você acessa todos eles por meio de um único endpoint compatível com OpenAI, portanto uma única integração atende a cargas de trabalho de texto e vídeo. A cobrança é pay-as-you-go por chamada, sem assinatura nem compromisso.
A linha se divide em duas frentes. No lado de linguagem ficam os modelos da série M, incluindo M2, M2.5 e o mais recente M3, criados para agentes de codificação, uso de ferramentas e raciocínio com contexto longo. No lado de vídeo estão os modelos Hailuo, como Hailuo 02 e Hailuo 2.3, que produzem clipes curtos cinematográficos e estilizados.
Sim. Todos os modelos MiniMax no Atlas Cloud, dos LLMs da série M ao Hailuo 02 e Hailuo 2.3, funcionam com a mesma chave de API e a mesma URL base. Você pode alternar entre uma chamada de raciocínio em texto e uma chamada de geração de vídeo dentro de um único pipeline sem configurar autenticação separada.
Crie uma conta no Atlas Cloud, gere uma chave de API e aponte seu cliente existente compatível com OpenAI para a URL base do Atlas. Como a MiniMax API segue o formato de requisição da OpenAI, a maioria das integrações precisa apenas alterar a URL base e o nome do modelo, em vez de fazer uma reescrita. Comece a criar hoje mesmo.
O Hailuo 02 Pro gera vídeo nativo em 1080p e oferece suporte a clipes de 6 segundos e 10 segundos por requisição, enquanto a camada Standard troca resolução por menor custo. O Hailuo 2.3 mantém a saída em 1080p com melhor tratamento de movimento estilizado e orientado a personagens. O vídeo é cobrado por segundo de filmagem gerada, então o custo escala conforme a duração que você realmente produz.
O MiniMax M3 introduz a arquitetura MSA (MiniMax Sparse Attention), entrada multimodal nativa para imagens e vídeo, e uma janela de contexto que a MiniMax documenta em até 1M tokens. A série M2, incluindo M2.5, mira tarefas de codificação e agênticas de alta taxa de transferência e é somente texto. Escolha o M3 para agentes multimodais com contexto longo e a série M2 para pipelines de codificação de alto volume e bom custo-benefício.
O Hailuo 02 tem um viés cinematográfico, construído sobre a arquitetura de renderização NCR da MiniMax para saída fotorrealista em estilo live-action. O Hailuo 2.3 mantém essa base física, mas amplia o escopo para estilos de anime, ilustração e game-CG, com controle mais refinado sobre movimento de personagens e microexpressões. Use o 02 para trabalhos de produto e live-action, e o 2.3 para conteúdo estilizado ou animado.
O Hailuo 2.3 conquistou o título Physics Champion no WorldModelBench por sua precisão ao simular conservação de massa, dinâmica de fluidos e consistência espaço-temporal. Em vez de apenas aproximar visualmente o movimento, ele modela o comportamento físico, o que se sustenta em cenas exigentes, como líquidos sendo derramados, objetos à deriva e movimentos corporais complexos. Para prompts com muita ação ou tecnicamente precisos, essa fidelidade física costuma ser o fator decisivo.
A MiniMax documenta o M3 com até 1M tokens de contexto, habilitados por seu design de atenção esparsa. Os modelos anteriores da série M oferecem uma janela de contexto grande, na faixa das centenas de milhares de tokens, embora o limite exato configurado possa variar conforme o provedor. Consulte a página do modelo específico no Atlas Cloud para ver o tamanho de contexto em vigor na sua implantação.
Guias, tutoriais e novidades de produto para você aproveitar ao máximo a Atlas Cloud.