
MiniMax API mở quyền truy cập vào họ mô hình của MiniMax từ phòng thí nghiệm tại Thượng Hải đứng sau Hailuo, bao gồm dòng M gồm các LLM suy luận tác nhân và các trình tạo video Hailuo. M3 hỗ trợ các tác nhân lập trình ngữ cảnh dài, trong khi Hailuo xếp hạng nhất trên WorldModelBench về mô phỏng vật lý với động lực học chất lỏng và chuyển động chân thực. Trên Atlas Cloud, mọi mô hình chạy dưới cùng một tài khoản với giá pay-as-you-go minh bạch và quyền truy cập Day-0 vào các bản phát hành mới. Hãy bắt đầu xây dựng ngay hôm nay.
Tạo video điện ảnh độ trung thực cao từ văn bản và hình ảnh với các mô hình AI tạo video mới nhất trên Atlas Cloud.
Thúc đẩy trò chuyện, suy luận và tác tử ở quy mô lớn với các mô hình ngôn ngữ lớn hàng đầu, được cung cấp nhanh chóng và tiết kiệm trên Atlas Cloud.
Compare standard vs. our pricing across every MiniMax model.
| Model | Standard Price (USD) | Our Price (USD) | Discount | |
|---|---|---|---|---|
| MiniMax M3 | $0.6/$2.4per 1M tokens524.3K context | $0.3/$1.2M in/outper 1M tokens524.3K context | -50% | View |
| MiniMax Speech 2.6 Turbo | $0.06/K chars | Start from$0.048/K chars | -20% | View |
| MiniMax Speech 2.6 HD | $0.1/K chars | Start from$0.08/K chars | -20% | View |
| MiniMax M2.7 | $0.3/$1.2per 1M tokens196.6K context | $0.3/$1.2M in/outper 1M tokens196.6K context | — | View |
| MiniMax M2.5 | $0.3/$1.2per 1M tokens196.6K context | $0.295/$1.2M in/outper 1M tokens196.6K context | — | View |
| MiniMax Music 2.6 | $0.15/K chars | Start from$0.15/K chars | — | View |
Instantly explore and experiment with 400+ production-ready models in the Atlas Playground. Start customizing with one click.
Dòng M của MiniMax xử lý việc viết mã, các agent và suy luận ngữ cảnh dài, trong khi Hailuo chuyển các đầu ra đó thành video. Các nhóm sử dụng kết hợp cả hai dòng sản phẩm để chạy các quy trình làm việc tự trị và sản xuất các phương tiện truyền thông hoàn chỉnh mà không cần chuyển đổi nền tảng.
Các nhóm phát triển sử dụng MiniMax M3 để chạy các tác nhân lập trình dài hạn, có khả năng kiểm tra các cơ sở mã lớn, theo dõi các phụ thuộc đa tệp và đẩy các commit hoạt động mà không cần các trạm kiểm tra của con người. MiniMax đã trình diễn M3 chạy tự chủ trong gần 12 giờ để tái tạo một bài báo nghiên cứu, tạo ra 18 commit và 23 hình ảnh thực nghiệm chỉ từ một mô tả nhiệm vụ duy nhất. Mức giá trả theo mức sử dụng (pay-as-you-go) của Atlas Cloud giúp cho việc chạy các phiên tác nhân kéo dài trở nên thiết thực mà không cần cam kết trước về dung lượng.
Các nhóm pháp lý và nghiên cứu sử dụng cửa sổ ngữ cảnh 1M token của MiniMax M3 để xử lý toàn bộ hợp đồng, hồ sơ vụ án hoặc ngữ liệu nghiên cứu trong một lệnh gọi duy nhất. Mô hình theo dõi các tham chiếu chéo giữa các tài liệu, gắn cờ các điểm không nhất quán và tạo ra các bản tóm tắt có cấu trúc trên các đầu vào có thể vượt quá giới hạn của các mô hình có ngữ cảnh ngắn hơn. Điều này loại bỏ bước chia nhỏ thủ công vốn thường phá vỡ phân tích phụ thuộc vào ngữ cảnh trong các quy trình làm việc nhiều tài liệu.
Các nhóm sản phẩm và dữ liệu sử dụng MiniMax M2.5 cho các luồng nghiên cứu web tự động, đạt điểm số 76,3% trên BrowseComp về khả năng hoàn thành tác vụ dựa trên trình duyệt. Kiến trúc MoE giữ cho độ trễ thấp và chi phí có thể dự đoán được ở mức 0,295 USD cho mỗi triệu token đầu vào, làm cho nó trở nên khả thi cho các quá trình chạy tác nhân quy mô lớn liên tục gọi các công cụ bên ngoài. Các nhóm chạy các luồng công việc sản xuất đã biết và có thể lặp lại được hưởng lợi từ lợi thế tốc độ nhất quán của M2.5 so với các mô hình nặng hơn.
Các nhóm tiếp thị sử dụng Hailuo 02 Pro để tạo video sản phẩm 1080p và clip câu chuyện thương hiệu từ một hình ảnh tham chiếu hoặc lời nhắc văn bản (prompt) duy nhất. Độ chính xác vật lý và khả năng xử lý máy quay đậm chất điện ảnh của mô hình tạo ra đầu ra khớp với các hướng dẫn của đạo diễn với tỷ lệ phản hồi hướng dẫn phức tạp là 85%. Với mức giá 0,49 đô la mỗi giây trên Atlas Cloud, một đoạn clip chất lượng sản xuất dài 10 giây có chi phí thấp hơn hầu hết các khoản phí cấp phép video có sẵn (stock video).
Các studio và nền tảng nội dung sử dụng Hailuo 2.3 để tạo nội dung video minh họa và phong cách anime với các biểu cảm vi mô chính xác và chuyển động cơ thể nhân vật mượt mà. Vị trí số 1 của mô hình trên WorldModelBench về mô phỏng vật lý mở rộng sang các tình huống cách điệu, giữ cho chuyển động tự nhiên ngay cả trong các đầu ra không mang tính tả thực. Hailuo 2.3 Fast trên Atlas Cloud với mức giá 0,19 đô la cho mỗi lần chạy giúp giữ chi phí lặp lại ở mức thấp trong giai đoạn phát triển sáng tạo.
Directors and animators use Hailuo 02 to generate motion reference clips and storyboard previsualisations before committing to full production. Complex action sequences, physics-driven scenes, and camera movements can be tested via the API at a fraction of the cost of live-action or animation studio work. The consistent prompt adherence across repeated calls means the same scene description reliably produces comparable output for client presentations.
MiniMax API là một giao diện duy nhất để truy cập họ mô hình của MiniMax, bao gồm các mô hình ngôn ngữ lớn M-series cho suy luận văn bản và lập trình agentic, cùng các mô hình Hailuo cho tạo video. Trên Atlas Cloud, bạn truy cập tất cả thông qua một endpoint tương thích OpenAI, nên chỉ một tích hợp có thể xử lý cả workload văn bản lẫn video. Giá được tính theo mức sử dụng cho từng lệnh gọi, không cần gói đăng ký hay cam kết.
Dòng sản phẩm này được chia thành hai nhánh. Ở phía ngôn ngữ là các mô hình M-series, bao gồm M2, M2.5 và M3 mới hơn, được xây dựng cho coding agents, sử dụng công cụ và suy luận ngữ cảnh dài. Ở phía video là các mô hình Hailuo, chẳng hạn Hailuo 02 và Hailuo 2.3, tạo ra các clip ngắn mang phong cách điện ảnh và cách điệu.
Có. Mọi mô hình MiniMax trên Atlas Cloud, từ M-series LLMs đến Hailuo 02 và Hailuo 2.3, đều chạy với cùng một API key và base URL. Bạn có thể chuyển giữa một lệnh gọi suy luận văn bản và một lệnh gọi tạo video trong cùng một pipeline mà không cần thiết lập xác thực riêng.
Tạo tài khoản Atlas Cloud, tạo một API key và trỏ client tương thích OpenAI hiện có của bạn đến Atlas base URL. Vì MiniMax API tuân theo định dạng request của OpenAI, hầu hết tích hợp chỉ cần đổi base URL và tên mô hình thay vì viết lại. Hãy bắt đầu xây dựng ngay hôm nay.
Hailuo 02 Pro tạo video 1080p native và hỗ trợ cả độ dài clip 6 giây lẫn 10 giây cho mỗi request, trong khi tầng Standard đánh đổi độ phân giải để có chi phí thấp hơn. Hailuo 2.3 tiếp tục xuất 1080p với khả năng xử lý tốt hơn cho chuyển động cách điệu và dựa trên nhân vật. Video được tính phí theo từng giây footage được tạo, nên chi phí tăng theo đúng độ dài bạn tạo ra.
MiniMax M3 giới thiệu kiến trúc MSA (MiniMax Sparse Attention), đầu vào đa phương thức native cho hình ảnh và video, cùng context window được MiniMax ghi nhận lên đến 1M tokens. M2 series, bao gồm M2.5, nhắm đến các tác vụ lập trình và agentic có thông lượng cao, đồng thời chỉ hỗ trợ văn bản. Hãy chọn M3 cho agent đa phương thức, ngữ cảnh dài; và chọn M2 series cho các pipeline lập trình khối lượng lớn, tối ưu chi phí.
Hailuo 02 thiên về chất điện ảnh, được xây dựng trên kiến trúc kết xuất NCR của MiniMax để tạo đầu ra phong cách live-action, chân thực như ảnh. Hailuo 2.3 giữ nền tảng vật lý đó nhưng mở rộng sang phong cách anime, minh họa và game-CG, với khả năng kiểm soát tinh hơn đối với chuyển động nhân vật và vi biểu cảm. Hãy chọn 02 cho sản phẩm và nội dung live-action, và chọn 2.3 cho nội dung cách điệu hoặc hoạt hình.
Hailuo 2.3 đã đạt danh hiệu Physics Champion trên WorldModelBench nhờ độ chính xác khi mô phỏng bảo toàn khối lượng, động lực học chất lưu và tính nhất quán không-thời gian. Thay vì chỉ xấp xỉ chuyển động về mặt thị giác, mô hình hóa hành vi vật lý, nên vẫn ổn định trong các cảnh khó như chất lỏng bị nghiêng đổ, vật thể trôi dạt và chuyển động cơ thể phức tạp. Với các prompt nhiều hành động hoặc đòi hỏi độ chính xác kỹ thuật, độ trung thực vật lý đó thường là yếu tố quyết định.
MiniMax ghi nhận M3 hỗ trợ ngữ cảnh lên đến 1M tokens, nhờ thiết kế sparse attention. Các mô hình M-series trước đó cung cấp context window lớn ở mức vài trăm nghìn tokens, dù giới hạn cấu hình chính xác có thể khác nhau tùy nhà cung cấp. Hãy kiểm tra trang mô hình cụ thể trên Atlas Cloud để biết độ dài ngữ cảnh đang áp dụng cho deployment của bạn.
Hướng dẫn, bài hướng dẫn và cập nhật sản phẩm giúp bạn khai thác tối đa Atlas Cloud.