Seedance 2.0 Mini & Fast API 全球最低价 —— 比官方定价最高低 68%
MiniMax H3 Fast Subject Preserving Video

MiniMax H3 Fast Subject Preserving Video

MiniMax H3 Fast 是 MiniMax 面向提示词驱动的视频生成系列,支持电影感文生视频、可控制的首帧动画(可选末帧),以及能够保留源主体的参考图生视频片段。通过 Atlas Cloud 的统一 API,以每秒 $0.046 的标准按量付费价格访问整个工作流系列,只需一次集成即可覆盖全系列。立即开始构建。

MiniMax H3 Fast 由 MiniMax 开发。Atlas Cloud(由 Atlas Cloud AI LLC 运营)仅提供接入服务,并不拥有该模型。所有商标均归其各自所有者所有。

MiniMax H3 Fast 输入方式与视频生成模式

按源输入、已验证能力和目标生产流程,对比 MiniMax H3 Fast 接口。

模态描述
MiniMax H3 Fast T2V API(文生视频)将文本提示词转换为时长 5 到 15 秒的电影感 480P 视频。支持 16:9、9:16、1:1 或自适应画幅,适用于概念短片、社交媒体内容和视觉分镜板。
MiniMax H3 Fast I2V API(图生视频)以首帧图像为基础,该接口可根据文本生成 480P 视频,并可选择加入末帧。适用于图像动画、镜头转场,以及时长 5 到 15 秒的产品或角色短片。
MiniMax H3 Fast R2V API(参考图生视频)通过参考图像锁定主体,同时使用文本提示词引导生成 480P 视频。适用于主体一致的宣传镜头、创作者内容,或时长 5 到 15 秒的短视觉序列。

MiniMax H3 Fast 覆盖三种创作路径

MiniMax H3 Fast 将文本驱动创作、首帧及可选尾帧动画,以及参考图引导的主体一致性融入时长 5 至 15 秒的 480P 视频片段,并提供灵活画幅与统一的 Atlas Cloud API,标准价格为每生成一秒 $0.046。

MiniMax H3 Fast 文本生成视频

使用 MiniMax H3 Fast 将文本提示词转换为电影感 480P 视频片段。时长可在 5 至 15 秒之间选择,画幅支持 16:9、9:16、1:1 或自适应格式。在一次请求中描述主体、动作、镜头运动和场景。该模式适合直接探索创意、制作社交媒体视频草稿,以及在制作前规划镜头。

首帧与尾帧控制

从提供的首帧开始,并添加可选的尾帧,引导序列的开场与收束。文本提示词控制两个视觉锚点之间的运动,同时输出保持为 480P、时长为 5 至 15 秒。输入图像决定起始构图。该路径适合受控转场、动画主视觉,以及具有明确收尾效果的产品展示。

MiniMax H3 Fast 参考图一致性

让参考图中的主体在运动过程中保持可识别,同时通过文本提示词将其置于动态场景中。MiniMax H3 Fast Reference to Video 可生成时长 5 至 15 秒的 480P 视频片段,为开发者提供专用于参考图驱动生成的路径。无需每次生成都重新设计主体,即可将其视觉特征延续到全新场景中。适用于 recurring characters、吉祥物和以产品为中心的连续镜头。

灵活的 5 至 15 秒视频片段

从 5 到 15 秒中选择任意受支持的时长,以匹配创意节奏。较短的片段便于专注于快速迭代,较长的输出则能在一次生成中容纳完整的视觉节拍。文本、图像和参考图驱动的路径均支持相同的时长范围。无需切换模型系列,即可制作紧凑广告、单镜头叙事或动作测试。

适配各种信息流与画布的格式

为文本生成的视频选择 16:9 横屏、9:16 竖屏信息流或 1:1 方形版位,也可使用自适应画幅。这一选择让同一模型系列覆盖宽屏演示、移动端社交帖子和均衡的方形创意内容。图像驱动生成会将提供的首帧作为视觉起点。选择与投放目标匹配的路径和画幅,而不是围绕单一固定画布重新构思。

单一 API,按秒计费

通过 Atlas Cloud 访问 MiniMax H3 Fast 的三条路径,无需为文本、图像和参考图工作流分别集成不同提供商。标准价格为每生成一秒 $0.046,因此成本会随所选视频片段时长直接变化。统一的访问路径让项目不断演进时更容易在不同生成模式之间切换。对于测试创意或运行可重复的视频流水线的开发者而言,这种方式非常实用。

MiniMax H3 Fast 三模型提示词对决

看看 MiniMax H3 Fast、一个领先竞争对手模型,以及另一款 MiniMax H3 模型,如何解读同样的两条电影感视频提示词。

提示词

一段 7-second 的高能微型故事,发生在受到暴风雨威胁的渔港:一位身形矫健、饱经风霜、银发的女渔民,穿着锈红色油布外套、芥黄色针织帽、深色涉水裤和饱经海水侵蚀的靴子,追赶一张失控的渔网。狂风将渔网鼓成巨大的风帆,拖拽着橙黄相间的浮球冲向翻腾的大海。开场是浸湿绳结绷断的极致微距镜头,纤维朝镜头爆裂飞散,随后快速推进;甩镜切换到贴地横向跟拍镜头,她在湿滑木板上飞奔,流畅地从杂乱飞舞的绳索迷宫下方躲过,踏上一座剧烈摇晃的木架,然后跃起,用双臂紧紧缠住主缆绳。切到完全垂直的俯拍镜头:渔网的几何网格、她扭转的身体、交错的绳索和弹跳的彩色浮球,在清晰而充满动感的构图中交织碰撞;她用全身重量将缆绳猛地往下拽,帆状渔网轰然砸在码头上,发出雷鸣般的湿重拍击声,喷起水雾和海水。快速推近她如释重负又兴奋不已的脸庞,一条小银鱼从塌陷的网眼中弹出,恰好落进她的针织帽里;她僵住,把双眼往上翻成斗鸡眼,然后咧嘴一笑。确保每次切镜中的人物、服装、渔网、绳索和港口始终保持完全连续;准确呈现绳索张力、绳结、织物形变、风压、惯性、碰撞、湿润表面、海浪飞沫和头发运动等物理效果。冷冽的青绿色暴风雨光线,锈红色外套与橙黄色浮球,戏剧性的逆光勾勒出空中水雾,写实的 35mm 海事电影质感,手持摄影的紧迫感,浅景深,细腻的胶片颗粒,清晰自然的运动,快速的喜剧节奏,不要慢动作。音频:逐渐增强的狂风,索具吱嘎声,绳索绷断与抽打声,靴子重重踏击湿木板的声音,木架呻吟声,渔网沉重砸落声,随后是小鱼滑稽的啪嗒落地声和她气喘吁吁的轻笑。不要出现屏幕、软件界面、仪表盘、进度条、图表、说明文字、字幕、徽标、水印、解释性文本、重复人物、人物漂移、服装变化、解剖结构错误、四肢缠绕或融化、不可能的绳索运动、失去重量感的布料、跳跃式运动、动作冻结或彼此割裂的镜头。16:9 画幅比例。

Generated with MiniMax H3 Fast Text-to-Video on Atlas Cloud

Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud

Generated with MiniMax H3 Text-to-Video on Atlas Cloud

提示词

一段 8-second 的照片级写实电影感美食广告镜头,场景设定在黎明时分的点心厨房:一位年轻点心师傅掀开竹蒸笼盖,一个光泽莹润、半透明的虾饺突然跃出,粉红色的虾馅透过精致的象牙白外皮泛着光。镜头从蒸笼内部开始,以虾饺的 POV 视角拍摄;笼盖打开,温暖的金色窗光穿透翻涌的蒸汽。切到极致微距跟拍镜头,贴着撒满面粉的操作台掠过;虾饺一边逃跑,一边翻滚、弹起并发生弹性挤压,每次撞击都扬起细密的面粉。点心师傅立即做出反应,将木擀面杖横扫过它的逃跑路线上;甩镜切入旋转俯拍镜头,虾饺在餐具之间左右穿梭,挤压在台面上,然后以一条连续且符合物理规律的弧线跃过磨光的菜刀刀背。镜头紧贴台面高度跟随,以快速斜向构图呈现面粉颗粒与拖曳蒸汽的交错碰撞;虾饺落在蒸笼边缘,摇晃几下,翻回笼内,并调皮地朝点心师傅惊讶的脸喷出最后一股蒸汽。确保每次切镜中的人物、虾饺、厨房和空间关系始终完美连续;动作全程不停且流畅,真实的动量、碰撞和弹性形变,半透明湿润的外皮质感,诱人的虾肉细节,具有触感的竹纹,浅景深,清晰利落的微距拉焦,象牙白、竹棕色与虾肉粉色的色彩搭配,温暖的金色晨间逆光,高端高速美食广告摄影风格,俏皮的悬念与精准的喜剧节奏。同步音频:竹盖咔嗒声,柔软橡胶般的弹跳声,沾粉打滑声,擀面杖呼啸声,金属菜刀清脆的叮声,以及有力的蒸汽嘶声;轻快的节奏型打击乐逐渐叠加,直至最后的笑点。不要慢动作、静态填充镜头、屏幕、软件界面、仪表盘、进度条、图表、说明文字、字幕、徽标、水印、多余肢体、重复物体、损坏的餐具、食物变形或不连贯的运动。16:9 画幅比例。

Generated with MiniMax H3 Fast Text-to-Video on Atlas Cloud

Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud

Generated with MiniMax H3 Text-to-Video on Atlas Cloud

使用 MiniMax H3 Fast 从提示词生成短视频

MiniMax H3 Fast 可将文本提示词、首帧、可选尾帧和主体参考图转化为 480P 视频,适用于分镜、社交媒体格式、引导式转场、角色短片和营销活动概念测试。

MiniMax H3 Fast 分镜

将文本提示词转换为时长 5 至 15 秒的 480P 电影感片段。电影制作人和创意团队可以在投入更大规模的制作流程前,测试场景、节奏和视觉方向。

社交媒体活动版本

从文本生成视频时,可选择 16:9、9:16、1:1 或自适应画幅。营销团队无需为每个创意分别从独立起始素材重新制作,即可准备横屏、竖屏和方形片段用于活动概念设计。

静态图像动画化

在文本提示词引导下,将首帧图像制作成 480P 视频片段。设计师可以让插画、产品静态图或活动主视觉动起来,用于演示、预览和社交媒体帖子。

引导式帧间转场

同时提供首帧和尾帧,以引导基于图像的片段如何发展。这种工作流适用于转场研究、前后对比概念,以及需要在屏幕上呈现明确视觉终点的分镜节拍。

MiniMax H3 Fast 主体短片

通过参考图像和文本提示词生成内容,让选定主体持续出现在视频中。创作者可以制作以角色为中心的短片、产品展示或反复出现的活动片段,并始终从同一视觉主体开始。

MiniMax H3 Fast 概念测试

将每次生成设置为 480P、5 至 15 秒,以便集中探索创意。小型工作室可以在选择后续开发方向前,对比紧凑片段中的提示词、首帧图像和参考主体。

MiniMax H3 Fast 四模型视频 API 对比

比较 MiniMax H3 Fast 与 Atlas Cloud 的三个文生视频端点,涵盖片段时长、可用分辨率、宽高比及所列标准价格。

模型输出时长可用分辨率宽高比标准价格
MiniMax H3 Fast Text-to-Video5-15s480P16:9、9:16、1:1、自适应$0.046/second
Seedance 2.0 Mini Text-to-Video4-15s 或自动480p、720p、720p-SR、1080p-SR、1440p-SR16:9、4:3、1:1、3:4、9:16、21:9、自适应$0.056
Wan-3.0 Text-to-video2-30s 或智能时长480P、720P、1080P16:9、9:16、4:3、3:4、1:1、自适应$0.05
Veo 3.1 Lite Text-to-video4s、6s 或 8s720p、1080p16:9、9:16$0.05

如何在 Atlas Cloud 上使用 MiniMax H3 Fast

几分钟即可上手 — 按照以下简单步骤,通过 Atlas Cloud 平台集成和部署模型。

创建 Atlas Cloud 账户

在 atlascloud.ai 注册并完成验证。新用户可获得免费额度,用于探索平台和测试模型。

为何在 Atlas Cloud 使用 MiniMax H3 Fast

将先进的 MiniMax H3 Fast 模型与 Atlas Cloud 的 GPU 加速平台相结合,提供无与伦比的性能、可扩展性和开发体验。

性能与灵活性

低延迟:
GPU 优化推理,实现实时响应。

统一 API:
一次集成,畅用 MiniMax H3 Fast、GPT、Gemini 和 DeepSeek。

透明定价:
按 Token 计费,支持 Serverless 模式。

企业与规模

开发者体验:
SDK、数据分析、微调工具和模板一应俱全。

可靠性:
99.99% 可用性、RBAC 权限控制、合规日志。

安全与合规:
SOC 2 Type II 认证、HIPAA 合规、美国数据主权。

MiniMax H3 Fast API 常见问题

MiniMax H3 Fast 是 Atlas Cloud 上的视频生成模型,提供独立的文本生成视频、图像生成视频和参考图生成视频路由。经验证的 Atlas 配置可生成时长为 5 至 15 秒的 480P 视频片段。

你可以根据文本提示词创建电影感视频片段,使用可选的尾帧为首帧图像制作动画,或根据参考图生成视频,同时保持主体的可识别性。每种经验证的工作流都支持生成时长为 5 至 15 秒的 480P 视频。

选择与输入内容匹配的 Atlas Cloud 路由,然后提交其 Playground schema 中定义的提示词和媒体字段。将 minimax/h3-fast/text-to-video、minimax/h3-fast/image-to-video 或 minimax/h3-fast/reference-to-video 作为 model ID。

Atlas Cloud 的三条路由均支持 480P 输出,时长范围为 5 至 15 秒。超出此分辨率或时长范围的请求不属于经验证的配置。

对于文本生成视频,可选择 16:9、9:16、1:1 或 adaptive。已验证事实未确定图像驱动路由可选的宽高比列表,因此请遵循每个路由的 Playground schema。

可以。图像生成视频路由会对提供的首帧进行动画处理,并可接受可选的尾帧;文本提示词则用于指导两帧之间的运动。

当需要让参考图锚定生成片段中的主体时,请选择 reference-to-video。将图像与描述所需场景和运动的提示词搭配使用,然后检查生成结果,因为生成式一致性并非绝对。

Atlas Cloud 为其文本生成视频、图像生成视频和参考图生成视频路由列出的标准价格为每生成 1 秒 $0.046。最终费用取决于输出时长,并按标准价格计费,不适用临时折扣价。

首先确认 model ID 与预期工作流匹配,输出设置为 480P,且时长介于 5 至 15 秒之间。对于文本生成视频,还应使用 16:9、9:16、1:1 或 adaptive,然后将每个字段与对应的 Atlas Cloud Playground schema 进行比对。

探索更多系列

Seedance 2.5

Seedance 2.5 API 现已在 Atlas Cloud 上线!它为开发者提供了 ByteDance 最新的视频模型。该模型可通过文本、单张图像或多达 50 个多模态参考,一次性生成长达 30 秒的原生视频,并包含同步音频和画面内的多语言文本。在 Atlas Cloud 上,您可以通过单个密钥访问它,其主体一致性和改进的物理特性能够保持长镜头的连贯性。

查看系列

Wan 3.0

Wan 3.0 API 是阿里巴巴 Wan 视频系列的下一代产品,旨在将长视频生成、多参考控制和音视频质量推向新的高度。Atlas Cloud 已经托管了 Wan 2.7、2.6 和 2.5,而 Wan 3.0 使用相同的统一密钥运行,无需额外设置。立即开始构建吧。向下滚动至展示区,查看 Wan 3.0 的创作能力。

查看系列

MiniMax H3

MiniMax H3 是 MiniMax 的多模态视频系列,支持文本、图像和参考内容引导创作。在支持的路由中,它能够保留参考媒体中的主体,提供灵活的宽高比,并通过 H3 Developer 将生成的声音与画面结合;输出配置则由 endpoint 选择。Atlas Cloud 通过一个 OpenAI 兼容密钥统一接入整个系列,并提供透明的按量付费定价,标准费率为每秒 $0.038。立即开始构建。

查看系列

Seedream 5.0 Pro

Seedream 5.0 Pro API 为开发者在 Atlas Cloud 上提供了字节跳动的可控图像编辑模型。它通过锚点和坐标精确定位编辑,将图像分离为可编辑图层,融合多个参考,并精准匹配颜色和材质,支持 2K 和 3K 分辨率的多语言文本。在 Atlas Cloud 上,您只需一个密钥即可访问!

查看系列

Seedance 2.0

Seedance 2.0 是 ByteDance 面向生产环境的视频模型,专用于精准镜头创作。将提示词转换为视频,使用首帧图像生成动画并可选用尾帧引导,或结合参考媒体和可选的联网搜索来塑造结果。Atlas Cloud 将这些工作流整合到统一的 API 中,提供透明的按量付费定价和一个兼容 OpenAI 的密钥。立即开始构建。

查看系列

GPT Image 2.5

OpenAI 的 gpt-image-2.5 系列为开发者提供 Flare 和 Sunburst 两种选择,满足生产级图像工作流需求。支持最高 3840x2160 的任意分辨率渲染,并提供包括 xhigh 和 max 在内的五档质量等级,以匹配特定的输出要求。Atlas Cloud 提供开箱即用的 REST 推理服务,无冷启动,每次生成起价 $0.004,采用标准定价。立即开始构建。

查看系列

GPT Image 2

GPT Image 2 API 为开发者提供了访问 OpenAI 最新图像模型的途径,它是 GPT Image 1.5 的继任者。该模型可生成和编辑图像,能够在拉丁和 CJK 文字上实现准确的文本渲染,并在海报、样机和信息图表方面具备强大的排版能力。在 Atlas Cloud 上,您可以通过一个统一的 API 与 300 多个模型一起访问它,并享受免费额度、99.99% 的正常运行时间,且无需 OpenAI 组织验证。

查看系列

Gemini Omni Flash

gemini omni API 将 Google DeepMind 原生多模态的 Gemini Omni Flash 系列(包括 Gemini Omni 1.1 Flash)带给开发者。创建带同步原生音频的电影级视频,使用精确的起始帧和结束帧控制为静态图像制作动画,或通过文本引导式编辑修改现有视频,同时保留未编辑的内容。Atlas Cloud 提供一个 OpenAI 兼容密钥、统一访问能力以及透明的按量付费定价。立即开始构建。

查看系列

Grok Imagine

Grok Imagine API 涵盖 xAI 的图像、视频和语音模型,包括 Image 2.0、Video 1.5 和 xAI TTS v1。支持生成跨 14 种宽高比的 1K 或 2K 静帧、生成最长 15 秒的 1080p 视频、通过最多 7 张参考图像引导镜头、或用 20 种语言进行配音。Atlas Cloud 在单一端点上运行所有功能,采用按量计费,起价为每张图像 $0.02、每秒 $0.05。立即开始使用。

查看系列

Google

Google最强大的创意模型现已在Atlas Cloud上全面可用。Veo 3.1提供电影级别的视频生成,Nano Banana 2支持高保真图像创建,而Gemini为每个工作流带来多模态智能。通过单一API key即可访问完整的Google模型套件,提供Day-0可用性和按需付费(pay-as-you-go)定价。

查看系列

Seedance 2.0 Mini

Seedance 2.0 Mini 将 ByteDance 的多模态视频生成技术引入到对速度和成本要求极高的工作流中。它以更轻量的占用空间提供 Seedance 2.0 的核心能力——更快的生成速度、更低的单条视频成本,并且使用您现有的同款 API 集成。对于运行高吞吐量流水线或进行大规模原型设计的团队来说,Mini 是最实用的默认选择。

查看系列

ByteDance

从电影级视频生成到高保真图像创建,ByteDance 最强大的模型现已在 Atlas Cloud 上线。以最低的推理定价和零基础设施开销,大规模运行 Seedance 和 Seedream。

查看系列

一个 API,畅享全模态 AI。

探索全部模型