
La API de MiniMax abre el acceso a la familia de modelos de MiniMax del laboratorio de Shanghái detrás de Hailuo, que abarca la serie M de LLMs de razonamiento agéntico y los generadores de video Hailuo. M3 impulsa agentes de programación de contexto largo, mientras que Hailuo ocupa el primer puesto en WorldModelBench en simulación física, con dinámica de fluidos y movimiento realistas. En Atlas Cloud, todos los modelos se ejecutan con una sola cuenta, con precios transparentes de pago por uso y acceso desde el día 0 a los nuevos lanzamientos. Empieza a crear hoy.
Genera vídeos cinematográficos de alta fidelidad a partir de texto e imágenes con los modelos de IA de generación de vídeo más recientes en Atlas Cloud.
Impulsa chat, razonamiento y agentes a gran escala con los principales grandes modelos de lenguaje, servidos de forma rápida y asequible en Atlas Cloud.
Compare standard vs. our pricing across every MiniMax model.
| Model | Standard Price (USD) | Our Price (USD) | Discount | |
|---|---|---|---|---|
| MiniMax M3 | $0.6/$2.4per 1M tokens524.3K context | $0.3/$1.2M in/outper 1M tokens524.3K context | -50% | View |
| MiniMax Speech 2.6 Turbo | $0.06/K chars | Start from$0.048/K chars | -20% | View |
| MiniMax Speech 2.6 HD | $0.1/K chars | Start from$0.08/K chars | -20% | View |
| MiniMax M2.7 | $0.3/$1.2per 1M tokens196.6K context | $0.3/$1.2M in/outper 1M tokens196.6K context | — | View |
| MiniMax M2.5 | $0.3/$1.2per 1M tokens196.6K context | $0.295/$1.2M in/outper 1M tokens196.6K context | — | View |
| MiniMax Music 2.6 | $0.15/K chars | Start from$0.15/K chars | — | View |
Instantly explore and experiment with 400+ production-ready models in the Atlas Playground. Start customizing with one click.
La serie M de MiniMax gestiona la programación, los agentes y el razonamiento de contexto largo, mientras que Hailuo convierte esos resultados en video. Los equipos utilizan ambas líneas de productos juntas para ejecutar flujos de trabajo autónomos y producir medios terminados sin cambiar de plataforma.
Los equipos de desarrollo utilizan MiniMax M3 para ejecutar agentes de codificación de largo alcance que inspeccionan grandes bases de código, rastrean dependencias de múltiples archivos y envían commits funcionales sin puntos de control humanos. MiniMax demostró que M3 funciona de forma autónoma durante casi 12 horas para reproducir un artículo de investigación, generando 18 commits y 23 figuras experimentales a partir de una única descripción de tarea. Los precios de pago por uso de Atlas Cloud hacen que sea práctico ejecutar sesiones extendidas de agentes sin comprometer capacidad por adelantado.
Los equipos legales y de investigación utilizan la ventana de contexto de 1M de tokens de MiniMax M3 para procesar contratos completos, expedientes o corpus de investigación en una sola llamada. El modelo rastrea referencias cruzadas entre documentos, señala inconsistencias y produce resúmenes estructurados a través de entradas que excederían los límites de los modelos de contexto más corto. Esto elimina el paso de fragmentación manual que normalmente interrumpe el análisis dependiente del contexto en flujos de trabajo con gran volumen de documentos.
Los equipos de productos y datos utilizan MiniMax M2.5 para procesos automatizados de investigación web, logrando un 76,3 % en BrowseComp para la finalización de tareas basadas en navegador. La arquitectura MoE mantiene baja la latencia y los costos predecibles en 0,295 $ por millón de tokens de entrada, haciéndolo viable para ejecuciones de agentes a gran escala que llaman repetidamente a herramientas externas. Los equipos que ejecutan flujos de trabajo de producción conocidos y repetibles se benefician de la ventaja de velocidad constante de M2.5 frente a modelos más pesados.
Los equipos de marketing utilizan Hailuo 02 Pro para generar videos de productos en 1080p y clips de historias de marca a partir de una sola imagen de referencia o un texto (prompt). La precisión física del modelo y su manejo cinematográfico de la cámara producen resultados que coinciden con las instrucciones de dirección con una tasa de respuesta a instrucciones complejas del 85%. A $0,49 por segundo en Atlas Cloud, un clip de 10 segundos con calidad de producción cuesta menos que la mayoría de las tarifas de licencia de videos de archivo.
Los estudios y las plataformas de contenido utilizan Hailuo 2.3 para generar contenido de vídeo de estilo anime e ilustrado con microexpresiones precisas y movimientos corporales fluidos de los personajes. El primer puesto del modelo en WorldModelBench para simulación física se extiende a escenarios estilizados, manteniendo el movimiento natural incluso en salidas no fotorrealistas. Hailuo 2.3 Fast en Atlas Cloud, a 0,19 $ por ejecución, mantiene bajos los costes de iteración durante la fase de desarrollo creativo.
Directors and animators use Hailuo 02 to generate motion reference clips and storyboard previsualisations before committing to full production. Complex action sequences, physics-driven scenes, and camera movements can be tested via the API at a fraction of the cost of live-action or animation studio work. The consistent prompt adherence across repeated calls means the same scene description reliably produces comparable output for client presentations.
MiniMax API es una interfaz única para la familia de modelos de MiniMax, que abarca los modelos de lenguaje grandes de la serie M para razonamiento de texto y programación agéntica, y los modelos Hailuo para generación de video. En Atlas Cloud accedes a todos ellos mediante un único endpoint compatible con OpenAI, por lo que una sola integración gestiona cargas de trabajo tanto de texto como de video. La tarificación es de pago por uso por llamada, sin suscripción ni compromiso.
La línea se divide en dos vertientes. En el lado del lenguaje están los modelos de la serie M, incluidos M2, M2.5 y el más reciente M3, creados para agentes de programación, uso de herramientas y razonamiento con contexto largo. En el lado del video están los modelos Hailuo, como Hailuo 02 y Hailuo 2.3, que producen clips cortos cinematográficos y estilizados.
Sí. Todos los modelos de MiniMax en Atlas Cloud, desde los LLMs de la serie M hasta Hailuo 02 y Hailuo 2.3, funcionan con la misma API key y la misma URL base. Puedes pasar de una llamada de razonamiento de texto a una llamada de generación de video dentro de un mismo pipeline sin configurar autenticación por separado.
Crea una cuenta de Atlas Cloud, genera una API key y apunta tu cliente existente compatible con OpenAI a la URL base de Atlas. Como MiniMax API sigue el formato de solicitud de OpenAI, la mayoría de las integraciones solo necesitan cambiar la URL base y el nombre del modelo, en lugar de reescribirse. Empieza a crear hoy mismo.
Hailuo 02 Pro genera video nativo en 1080p y admite clips de 6 segundos y 10 segundos por solicitud, mientras que el nivel Standard sacrifica resolución a cambio de un menor coste. Hailuo 2.3 mantiene la salida en 1080p con una mejor gestión de movimiento estilizado y centrado en personajes. El video se factura por segundo de metraje generado, por lo que el coste escala con la duración que realmente produces.
MiniMax M3 introduce la arquitectura MSA (MiniMax Sparse Attention), entrada multimodal nativa para imágenes y video, y una ventana de contexto que MiniMax documenta en hasta 1M tokens. La serie M2, incluido M2.5, está orientada a tareas de programación y agénticas de alto rendimiento, y es solo de texto. Elige M3 para agentes multimodales con contexto largo, y la serie M2 para pipelines de programación de alto volumen y eficientes en coste.
Hailuo 02 tiene un enfoque cinematográfico y está creado sobre la arquitectura de renderizado NCR de MiniMax para generar resultados fotorrealistas con estilo de acción real. Hailuo 2.3 mantiene esa base física, pero se amplía a estilos de anime, ilustración y game-CG, con un control más fino del movimiento de personajes y las microexpresiones. Usa 02 para trabajos de producto y acción real, y 2.3 para contenido estilizado o animado.
Hailuo 2.3 obtuvo el título de Physics Champion en WorldModelBench por su precisión al simular conservación de masa, dinámica de fluidos y coherencia espacio-temporal. En lugar de aproximar visualmente el movimiento, modela el comportamiento físico, lo que se mantiene sólido en escenas exigentes como líquidos que se vierten, objetos a la deriva y movimientos corporales complejos. Para prompts con mucha acción o técnicamente precisos, esa fidelidad física suele ser el factor decisivo.
MiniMax documenta M3 con hasta 1M tokens de contexto, gracias a su diseño de atención dispersa. Los modelos anteriores de la serie M ofrecen una ventana de contexto amplia, en el rango bajo de cientos de miles de tokens, aunque el límite exacto configurado puede variar según el proveedor. Consulta la página del modelo específico en Atlas Cloud para ver la longitud de contexto vigente en tu despliegue.
Guías, tutoriales y novedades de producto para aprovechar al máximo Atlas Cloud.