
MiniMax API 开放了来自上海实验室(Hailuo 背后的团队)的 MiniMax 模型家族,涵盖具备智能体推理能力的 M 系列 LLM 以及 Hailuo 视频生成模型。M3 为长上下文编码智能体提供支持,而 Hailuo 在 WorldModelBench 物理仿真评测中排名第一,具备逼真的流体动力学和运动效果。在 Atlas Cloud 上,所有模型都可通过一个账户使用,采用透明的按量付费定价,并可在新版本发布当天即刻访问。立即开始构建。
在 Atlas Cloud 上,借助最新的 AI 视频生成模型,从文本与图像生成电影级的高保真视频。
在 Atlas Cloud 上,依托顶尖的大语言模型,以极速且实惠的方式驱动对话、推理与智能体的规模化应用。
对比 MiniMax 全部模型的标准价、平台价与折扣。
| 模型 | 标准价 (USD) | 平台价 (USD) | 折扣 | |
|---|---|---|---|---|
| MiniMax M3 | $0.6/$2.4每 100 万 tokens524.3K 上下文 | $0.3/$1.2M 输入/输出每 100 万 tokens524.3K 上下文 | -50% | 查看 |
| MiniMax Speech 2.6 Turbo | $0.06/千字符 | 低至$0.048/千字符 | -20% | 查看 |
| MiniMax Speech 2.6 HD | $0.1/千字符 | 低至$0.08/千字符 | -20% | 查看 |
| MiniMax M2.7 | $0.3/$1.2每 100 万 tokens196.6K 上下文 | $0.3/$1.2M 输入/输出每 100 万 tokens196.6K 上下文 | — | 查看 |
| MiniMax M2.5 | $0.3/$1.2每 100 万 tokens196.6K 上下文 | $0.295/$1.2M 输入/输出每 100 万 tokens196.6K 上下文 | — | 查看 |
| MiniMax Music 2.6 | $0.15/千字符 | 低至$0.15/千字符 | — | 查看 |
MiniMax的M系列负责处理编程、智能体和长上下文推理,而Hailuo则将这些输出转化为视频。团队可以结合使用这两条产品线来运行自主工作流并制作媒体成品,而无需切换平台。
开发团队使用 MiniMax M3 来运行长期执行的编码代理,这些代理能够检查大型代码库、追踪多文件依赖,并在无需人工检查点的情况下推送可用的提交。MiniMax 展示了 M3 自主运行近 12 小时来复现一篇研究论文,仅凭借单一的任务描述就生成了 18 次提交和 23 张实验图表。Atlas Cloud 的按需付费定价使得运行扩展的代理会话变得切实可行,且无需预先承诺算力容量。
法律和研究团队利用 MiniMax M3 的 1M token 上下文窗口,在单次调用中处理完整的合同、案卷或研究语料库。该模型能够追踪跨文档引用、标记不一致之处,并对超出短上下文模型限制的输入生成结构化摘要。这消除了在文档密集型工作流中通常会破坏上下文依赖分析的手动分块步骤。
产品和数据团队使用 MiniMax M2.5 进行自动化的网络研究流水线,在基于浏览器的任务完成度基准测试 BrowseComp 上得分为 76.3%。MoE 架构保持了低延迟,并将成本稳定在每百万输入 tokens 0.295 美元,使其非常适合需要频繁调用外部工具的大规模智能体运行。对于运行已知、可重复生产工作流的团队而言,M2.5 相比更庞大的模型具有持续的速度优势,他们将从中受益。
营销团队使用 Hailuo 02 Pro,仅需一张参考图像或一段文本提示,即可生成1080p产品视频和品牌故事片段。该模型的物理准确性和电影级运镜处理产生的输出内容,能够以85%的复杂指令响应率完美契合导演的指示。在 Atlas Cloud 上,每秒成本为0.49美元,生成一段10秒的制作级质量视频片段的成本低于大多数商业库存视频的授权费用。
工作室和内容平台使用 Hailuo 2.3 生成动漫风格和插画风格的视频内容,具备准确的微表情和流畅的角色肢体动作。该模型在 WorldModelBench 物理模拟榜单中排名第一,其优势同样适用于风格化场景,即使在非写实输出中也能保持运动的自然感。Hailuo 2.3 Fast 在 Atlas Cloud 上每次运行仅需 0.19 美元,在创意开发阶段保持较低的迭代成本。
Directors and animators use Hailuo 02 to generate motion reference clips and storyboard previsualisations before committing to full production. Complex action sequences, physics-driven scenes, and camera movements can be tested via the API at a fraction of the cost of live-action or animation studio work. The consistent prompt adherence across repeated calls means the same scene description reliably produces comparable output for client presentations.
MiniMax API 是访问 MiniMax 模型家族的统一接口,涵盖用于文本推理和智能体式编程的 M-series 大语言模型,以及用于视频生成的 Hailuo models。在 Atlas Cloud 上,你可以通过一个 OpenAI-compatible endpoint 访问所有模型,因此一次集成即可同时处理文本和视频工作负载。定价按每次调用即用即付,无需订阅或承诺用量。
该模型阵容分为两个方向。语言侧是 M-series models,包括 M2、M2.5 和更新的 M3,面向编程智能体、工具调用和长上下文推理而构建。视频侧是 Hailuo models,例如 Hailuo 02 和 Hailuo 2.3,可生成短篇电影感和风格化视频片段。
可以。Atlas Cloud 上的每个 MiniMax model,从 M-series LLMs 到 Hailuo 02 和 Hailuo 2.3,都使用同一个 API key 和 base URL。你可以在同一条 pipeline 中从文本推理调用切换到视频生成调用,无需设置单独的身份验证。
创建一个 Atlas Cloud 账户,生成一个 API key,并将你现有的 OpenAI-compatible client 指向 Atlas base URL。由于 MiniMax API 遵循 OpenAI request format,大多数集成只需要修改 base URL 和 model name,而不必重写。立即开始构建吧。
Hailuo 02 Pro 可生成原生 1080p 视频,并支持每次请求生成 6-second 和 10-second 两种片段时长;Standard tier 则以较低分辨率换取更低成本。Hailuo 2.3 继续支持 1080p 输出,并在风格化内容和角色驱动动作处理上更强。视频按生成素材的每秒计费,因此成本会随你实际生成的时长而扩展。
MiniMax M3 引入了 MSA (MiniMax Sparse Attention) 架构,支持图像和视频的原生多模态输入,并提供 MiniMax 文档中标注最高可达 1M tokens 的上下文窗口。M2 series(包括 M2.5)面向高吞吐量编程和智能体式任务,且仅支持文本。长上下文、多模态智能体请选择 M3;注重成本效率和高并发的编程 pipeline 则选择 M2 series。
Hailuo 02 更偏电影感,基于 MiniMax 的 NCR 渲染架构构建,适合生成照片级真实感、真人实拍风格的输出。Hailuo 2.3 保留了这一物理基础,同时扩展到 anime、illustration 和 game-CG 风格,并能更精细地控制角色动作和微表情。产品展示和真人实拍类工作可选择 02;风格化或动画内容则选择 2.3。
Hailuo 2.3 凭借在质量守恒、流体动力学和时空一致性模拟方面的准确性,获得了 WorldModelBench 的 Physics Champion 称号。它不是从视觉上近似运动,而是对物理行为进行建模,因此在倾倒液体、漂移物体和复杂人体运动等高要求场景中也能保持稳定。对于动作密集或技术精度要求高的 prompt,这种物理保真度往往是决定性因素。
MiniMax 文档标注 M3 的上下文最高可达 1M tokens,这得益于其稀疏注意力设计。较早的 M-series models 提供数十万 tokens 级别的大上下文窗口,但具体配置上限可能因 provider 而异。请查看 Atlas Cloud 上的具体 model page,确认你的部署实际生效的上下文长度。
指南、教程与产品动态,助你充分发挥 Atlas Cloud 的价值。