Seedance 2.5 现已上线 — 首发 Atlas Cloud

$875 in Creator Quotes vs $3.16: 五个 MiniMax H3 UGC 广告, 按秒计价

五种视觉上不同的MiniMax H3 UGC广告,基于五个基础框架:实际的每秒计费、15个插槽并发上限,以及品牌文本中断的位置。

会议室的屏幕上有二十个剪辑。客户看了十一秒,停在了那个把瓶子推近镜头的片段上,问标签上写的是什么。

没人能说明白。那四个字母在瓶子和镜头之间变成了模糊的一片。那个剪辑花了五十美分。它一文不值。

以下是那五十美分的完整账目。五个基础帧,五个完全不同的镜头,一次向明确定义的15槽上限发起的20个任务冲击,以及原生分辨率裁剪,清晰显示品牌文字在哪里保持清晰、在哪里变得模糊。下面的每个数字都来自本周的真实账单,而不是定价页面。

品牌是故意虚构的。更多内容在文末。

关键要点

  1. 五个完成的MiniMax H3 UGC广告,来自五个不同的基础帧,总成本为3.16美元。按照市场中位数,五位人类UGC创作者的成本为875美元,且不包含使用权限(Influee,2026)。
  2. 768P按0.10美元/秒计费,2K按0.14美元/秒计费,使用同一端点。两者在静态结束卡片上都能正确拼写品牌名称。当产品移向镜头时,768P出现了问题。
  3. H3按**CONN(并发任务数)**计量:免费套餐最多2个并发任务,付费套餐最多15个(MiniMax文档,2026)。我的一次性20个任务全部完成,端到端耗时4分13秒。
  4. resolutionduration是必填字段,不是可选字段。如果忽略它们,你会意外地购买到2K版本。
  5. 两个层级都输出32 kHz的AAC立体声。音质不会随分辨率提升而改善,因此为2K付费只买到了像素,其他方面没有变化。

五个来自完全不同镜头的MiniMax H3 UGC广告

先看成果。一个虚构的护肤品牌ORVA,五个看起来截然不同的原型:一个包含面部的浴室镜自拍、一个无面部的微距跌落测试、一个由完全不同的人参与的黄金时段街头推荐、一个只有手部的俯拍桌面开箱视频,以及一个纯文字排版结束卡片。

五个完成的广告片段,硬剪成一个短片。打开声音:对话、环境音和纸张沙沙声都是在与画面相同的生成过程中产生的,并非后期叠加。使用minimax/h3/image-to-video生成。

这里的缩略图比短片本身更重要,因为重点在于这五个片段看起来不像用五种不同脚本拍的同一场摄制:

ORVA护肤品的五种不同广告格式

五个MiniMax H3 UGC广告原型并排展示,标注了宽高比和每个剪辑的实际价格

从每个完成的片段中提取一帧,标注了宽高比和该剪辑的实际成本。

五种宽高比,没有一种需要额外付费。H3的image-to-video端点只接受adaptive作为ratio参数,这听起来像是个限制,直到你意识到这意味着第一帧决定了画面形状。你只需在第一步中,以图片价格购买一次宽高比。


为什么大多数MiniMax H3 UGC广告永远无法进入广告账户

从“我做了一个视频”到“我把这个放进了真实的广告账户”之间的鸿沟,是几乎所有AI UGC实验失败的地方。三个具体的障碍,按通常出现的顺序排列。

障碍实际成本
免费消费者套餐:水印加分辨率上限文件无法作为交付物使用。你不能给客户看带有角落Logo的文件,而且去除水印违反了你同意的条款。
按积分计费的工具你可以向老板报告月度订阅费用。但你无法报告每个可用剪辑的成本,而这是媒体购买者唯一能采取行动的数字。
一次只能处理一个任务二十个钩子变成了一个通宵的工作。测试不再是周二下午就能完成的事,而是变成了一个冲刺任务。

第一个障碍是产品边界,不是bug。免费消费者应用和API是不同的产品,有不同的条款。如果交付物要离开你的公司,你必须在付费路径上,没有商量余地。

第二个障碍更隐蔽也更糟糕。大多数AI UGC视频生成器产品按月订阅销售,并以积分计量工作量,而积分并非任何人在预算审查中都能捍卫的单位。询问一个绩效营销人员一次5秒钩子测试的成本是多少,你会得到一个耸肩或一个除法问题。本文之所以按秒定价,是因为每秒是唯一能在电子表格中存活下来的单位。

第三个障碍是人们最后才发现的。批量处理是AI创意的全部价值主张。你不是在制作一个完美的广告,而是在制作二十个平庸的钩子,让算法找到其中两个有效的。这意味着并发性是一个首要规格,而几乎没有人公开他们的并发数据。

然后还有一个没有人定价的失败模式:

一只手拿着手机,手机屏幕上贴着便签,写着“拒绝,名称错误”

一部手机显示AI生成的UGC广告帧,其中产品文字商标拼写错误,旁边贴着一张拒绝便签

没有人为此做预算的拒绝。灯光没问题,表演没问题,但瓶子上的四个字母是错误的,这个片段一文不值。

这正是MiniMax发起挑战的领域。他们的发布文章声称H3在“指令遵循、准确文本和品牌渲染”方面表现出色,并表示该模型“专为广告、品牌、电子商务而构建”(MiniMax,2026年7月)。这是一个可测试的声明,第四步将对其进行测试。

这很重要,因为可读性是一个关键变量。在一项覆盖超过5亿次展示和300万次点击的Taboola平台数据研究中,来自哥伦比亚大学、哈佛大学、慕尼黑工业大学和卡内基梅隆大学的研究人员发现,AI生成的广告平均点击率为0.76%,而人类制作的广告为0.65%,一旦应用严格的统计控制,两者基本持平(Taboola,2026年1月)。最强的单一预测因素不是“由AI制作”或“由人类制作”,而是创意是否包含一张大而清晰的人类面孔,并且看起来真实。没有人会信任一个标签拼写错误的瓶子。


MiniMax H3 UGC广告工作流程,以及每秒的成本

链条由三个环节组成。一个图像模型固定镜头并购买宽高比。一个视频模型在此基础上购买秒数。一个竞争对手模型以几乎相同的标价作为对照,因此比较并非仅仅引用一家供应商。

所有这些都位于Atlas Cloud的同一目录中,这是我以这种方式运行它的唯一实际原因:一个密钥,一张发票,每秒费率在账单上和在模型卡上相同。

链条步骤模型价格折扣?
五个基础帧google/nano-banana-2/text-to-image1k 0.08美元 / 2k 0.12美元 / 4k 0.16美元 每张图片
草稿和最终成品minimax/h3/image-to-video768P 0.10美元/秒,2K 0.14美元/秒
无基础帧minimax/h3/text-to-video相同的两个层级
整个系列中相同的面孔minimax/h3/reference-to-video相同的两个层级;参考素材可以接受任意组合的图片、视频和音频
对照模型bytedance/seedance-2.5/image-to-video标价从0.134美元/秒起,上限720p,时长4到30秒。在预算中使用该数字前,请先阅读变体部分。
廉价钩子测试层级bytedance/seedance-2.0-mini/image-to-video0.039美元/秒,从0.056美元下调是,截至2026年8月优惠30%
保留表演,增加像素atlascloud/video-upscaler0.018美元/秒升至1080p,0.024美元/秒升至2K,最低收费5秒

网页界面显示三个MiniMax H3视频生成模型卡

Atlas Cloud模型目录中的三个MiniMax H3端点,每个都显示“从0.10美元/秒”的价格卡

目录中的三个H3端点。卡片价格是底线,即768P层级0.10美元/秒;同一端点下的2K是0.14美元/秒。

在任何人核实我之前,先诚实地补充一点:MiniMax自己的即用即付页面列出了2K为0.13美元/秒,768P为0.08美元/秒,因此直接购买每秒便宜一两美分。这里额外的一美分买到的是:图像模型、两个视频模型和升频器都位于同一个密钥之后,这是一个工作流与四个工作流之间的区别。


如何制作MiniMax H3 UGC广告:四步运行

四步。下面的每个提示都是我粘贴的确切字符串,每个设置都是我选择的准确设置。

第一步:构建五个不同的基础帧,而不是在同一个帧上写五个钩子

这是整篇文章的核心论点。常见的错误是一张产品照片再加六种不同的脚本,结果产生五个视觉上完全相同的剪辑和一个感到无聊的读者。相反,花0.60美元购买五个真正不同的镜头:有脸和没有脸,室内和室外,平视和俯视,两个不同的人。

模型:google/nano-banana-2/text-to-imageresolution: 2k,每个0.12美元。我选择它而不是通用照片模型,原因只有一个:现阶段唯一的验收标准是瓶子上的四个字母拼写正确。把最好的文字渲染模型放在第一位,你就能在0.12美元的成本上解决拼写问题,而不是在0.70美元的成本上。

在继续之前,检查每一帧的三件事:文字商标拼写正确;没有手遮挡文字商标;有足够的头部空间和底部空间,确保字幕和平台UI不会覆盖在产品上。

A. 镜子早晨日常aspect_ratio: 9:16

text
1在小浴室镜子中拍摄的竖屏手机照片:一位29岁的女性,头发湿漉漉,素颜,手持一个30毫升的琥珀色玻璃滴管瓶贴着脸颊,看着自己的倒影。瓶子正面标签上写着粗体奶油色无衬线字体的"ORVA",下方有较小字体的"10% NIACINAMIDE · 30 ML"。上方温暖的白炽灯梳妆台灯光,镜边微微起雾,白色瓷砖,画面中有牙刷杯和折叠的灰色毛巾。逼真,手持拍摄,曝光不完美,无屏幕文字叠加,无水印,除瓶子标签外无其他Logo。
2

B. 微距跌落测试aspect_ratio: 1:1

text
1极近特写照片,无面部出镜:一只手挤压滴管,一滴清澈粘稠的液体即将滴落在另一只手的手背上。凉爽的北窗日光,浅景深,可见的皮肤纹理和细毛,琥珀色的"ORVA"瓶子在后方柔和地虚化。干净的浅灰色背景。逼真的产品微距,无文字叠加,无水印。
2

C. 黄金时段街头推荐aspect_ratio: 9:16

text
1竖屏手持自拍视频截图,前置摄像头:一位34岁的男性,留着短胡须,穿着海军蓝圆领衫,沿着城市人行道行走,将小小的琥珀色"ORVA"滴管瓶举向镜头,对着镜头说话。强烈的黄金时段逆光,带有镜头光晕,身后模糊的店面和人行道上停放的自行车,画面边缘有轻微运动模糊。逼真,自然肤色,无调色,无文字叠加,无水印。
2

D. 俯拍桌面开箱aspect_ratio: 16:9

text
1正上方俯拍平铺照片,仅见双手,无面部:两只手从一个打开的牛皮纸盒中取出一个琥珀色滴管瓶,盒内衬有奶油色纸巾,放在浅橡木桌上。盒子内盖印有奶油色无衬线字体的"ORVA"和较小字体的"NIACINAMIDE SERUM · MADE IN SPAIN"。旁边放着一张折叠的卡片、剪刀和一块亚麻布。左侧柔和的漫射日光,真实的阴影。逼真的电商开箱,无文字叠加,无水印。
2

E. 结束卡片静帧aspect_ratio: 9:16

text
1竖屏产品静物照:30毫升琥珀色"ORVA"滴管瓶居中放置在无缝暖沙色背景上,右侧相机方向单一柔光主光源,拉出长长的清晰阴影。下方三分之一处有排版布局:"ORVA"粗体奶油色无衬线字体,下方是较轻字重的"20% OFF YOUR FIRST BOTTLE",最底部是"orvaskin.com"。清晰的字母边缘,充足的间距,无杂乱,无额外Logo,无水印。
2

关于这一步的一个说明:我尝试了三次在Nano Banana 2的游乐场中运行时截图,但三次都因为测试环境中的模型提供商上游连接错误而失败,因此这里没有浏览器截图。下面的五个帧来自API,设置相同,每张图片0.12美元的价格与游乐场报价一致。

ORVA护肤品的五种不同广告创意选项

五个ORVA基础帧并排展示,每个标注了宽高比和0.12美元的成本

所有五个基础帧。五种宽高比,总计0.60美元,视频步骤将免费继承每一个形状。使用google/nano-banana-2/text-to-image生成。

第二步:购买秒数,将每个帧转换为768P草稿

现在每个帧变成运动。模型:minimax/h3/image-to-video。重要的设置:

  • image:来自第一步的匹配基础帧,作为URL或base64数据URL。
  • resolution: "768P"用于草稿。这是一个必填字段。默认是2K,两个层级每秒相差40%。
  • duration: 5。也是必填。忽略它不会给你一个免费短片。
  • ratio:忽略它。这个端点的枚举只有adaptive,第一帧决定形状。

这两个必填字段是整个工作流程中最容易出错且代价最高的地方。一次20个任务使用默认设置提交,结果是20个2K、8秒的剪辑,花费22.40美元而不是10.00美元,而且这些草稿你本来就要扔掉。

text
1A: 手持竖屏视频,在镜子前。她倾斜瓶子,让标签面向镜子,然后看向自己的眼睛,用干燥、略带调侃的语气说:"两周了。我的皮肤现在很无聊。这就是全部评价。" 浴室环境音,微弱的排风扇嗡嗡声,无音乐。一镜到底,无剪辑。保持瓶子标签清晰且不变。
2
3B: 固定机位微距镜头,无相机移动。液滴从滴管上脱落,落下,在手背上缓慢扩散;手指倾斜以捕捉光线。无对白。只有音效:轻柔的液体接触声,微弱的环境音。一镜到底。
4
5C: 手持行走自拍视频,自然晃动。他保持与镜头的眼神接触,低头看了一眼瓶子,用随意的美式口音说:"我从来没有过护肤程序。我现在有一个步骤了。就是这个步骤。" 街道环境音,远处的交通声,麦克风上的风声,无音乐。一镜到底,无剪辑。
6
7D: 固定机位俯拍镜头。双手将瓶子完全从盒子中取出,在橡木桌上直立放好,然后将纸巾折叠回去。无对白。纸张沙沙声,玻璃与木头的轻柔敲击声,安静的环境音。保持盒盖上的印刷文字清晰、静止且不变。
8

AI视频生成器界面截图,显示输入和输出

Atlas Cloud上的MiniMax H3图像转视频游乐场,已加载基础帧,输出面板正在播放完成的剪辑

MiniMax H3图像转视频游乐场,提示已粘贴,基础帧已加载,输出面板中显示完成的剪辑。此截图特意保留在未更改的默认设置上,运行按钮会为你计算价格:2K、8秒为1.12美元。本教程中的草稿是768P、5秒,为0.50美元。这个差距正是这两个字段被标记为必填的全部原因。

本次运行得到的几何数据,直接从文件中读取。768P将短边设为768像素:竖屏768x1376,横屏1376x768,正方形768x768。2K将短边设为1440:竖屏1440x2560,正方形1440x1440。两者都是24 fps,都带有32 kHz的AAC立体声。音质规格不随层级变化,因此额外的四美分每秒只买到了像素,其他方面没有变化。

第三步:将整个批次发射到15槽上限

不要一次迭代一个剪辑。这个习惯是从只能一次处理一个事物的工具中继承下来的,也是人们认为AI创意很慢的原因。

H3不像旧的Hailuo模型那样按每分钟请求数计量。它是按**CONN(并发任务数)**计量的:免费套餐最多2个并发任务,付费套餐最多15个(MiniMax文档,2026年)。理论上,这是一个非常具体的后果:15是你的批次宽度,第16个任务等待而不是报错。

因此,我一次性提交了20个任务,并对每个任务打上了时间戳。四个原型广告片段,两个分辨率的结束卡片,以及14个改变台词、手势或相机运动的变体。其中18个是768P、5秒;两个结束卡片任务是4秒,一个2K,一个768P。

text
1变体配方:保持基础帧和镜头相同,只改变一件事。
2- 只更换台词(相同构图,相同手势):从A和C衍生4个变体。
3- 只更换手势(相同台词,相同构图):从A和D衍生3个变体。
4- 只更换相机运动(固定机位改为缓慢推进,或手持改为更稳定):从B和D衍生3个变体。
5- 只更换结束动作(放下瓶子,将瓶子放稳,在微笑时剪切):从A、C和D衍生4个变体。
6在一个循环中提交所有变体。不要等待一个完成再提交下一个。
7

横向柱状图,显示二十个MiniMax H3任务的完成时间

20个MiniMax H3任务一次性提交的时间线,每个柱状图从提交到完成测量

每个柱状图代表一个任务,从我的提交调用到完成状态。所有20个任务在8.1秒内提交,并全部返回。

返回的结果与我预期的上限不同。

所有20个提交在8.1秒内返回HTTP 200。所有20个任务都完成了。最快的在114.3秒内完成,中位数在175.6秒,最慢的在253.0秒。其中18个任务在114到196秒的紧密区间内完成。2K结束卡片用了222.7秒,这与我在这个模型上测量的其他2K结果一致:它更慢,但并非显著更慢。恰好有一个768P任务,一个镜子场景的台词变体,用了253秒,它是图表中唯一看起来像排队的柱状图。

端到端,20个5秒的UGC剪辑在4分13秒内完成,花费9.96美元。这是需要记住的数字:一个曾经需要通宵工作才能完成的钩子测试批次,现在比喝杯咖啡的时间还短。

这证明了两件事,也未能证明一件事。它没有证明15槽上限是虚构的,因为路由供应商可以以单个直接账户无法做到的方式汇集容量,而且一次下午的一次批次只是一个数据点。但它确实证明了实际的批次宽度足够高,以至于你应该停止编写顺序循环。提交批次,然后去读点东西。

一个警告,因为我在不同日子测量过这个端点:并发行为不是一个常数。在较早的一次运行中,六个重叠任务全部干净地完成;在另一次运行中,一个重叠任务返回了429 rate limit exceeded (task concurrency)。将上述数字视为我的批次在当天的表现,在构建基于此的调度器之前,先测量你自己的。

第四步:结束卡片,MiniMax H3 UGC广告的文字生死攸关

结束卡片是考试。一个文字商标,一行优惠信息和一个URL,所有这些都必须在手臂长度距离的手机上可读,而且其中一个是域名,一个字符错误就会导致点击无处可去。

基于相同的基础帧和相同的提示运行两次:一次使用resolution: "2K", duration: 4,一次使用resolution: "768P", duration: 4

text
1瓶子向右旋转约12度,同时每个字母保持完全静止:字母形状锁定,无变形,无闪烁,无重新构成。一个柔和的镜面高光在玻璃上移动。静音三秒,然后一声短促干净的UI提示音。
2

锁定第一帧在这里不是可选的,这是整个工作流程中最不直观的部分。H3的2K层级是上下文内再生,而不是升频。给两个层级相同的文本提示,但不提供基础帧,你会得到两个不同的影像,有不同的场景布置和不同的标签位置,这告诉不了你什么。将两个运行都锁定在同一个第一帧,唯一可能不同的就是细节。然后比较才有意义。

不同视频分辨率的Orva广告并排对比

并排结束卡片,左侧768P,右侧2K,相同的第一个帧和相同的提示

相同的基础帧,相同的提示,各四秒。左侧768P,右侧2K。此处显示为静音GIF;两个交付文件都带有32 kHz的AAC立体声。

以下是真正决定性的部分:

让我们试试:"768P和2K视频分辨率并排对比"

像素级裁剪对比:ORVA文字商标、成分行和URL在768P与2K下的表现

上方行是瓶子标签,下方行是结束卡片文字块。原生裁剪在768P下为292x220和691x372像素,在2K下为547x410和1296x691像素;两者均以同一显示宽度展示,即手机渲染它们的方式。

以下是诚实的结论,而且不是我预期要写的那种。

768P没有拼错任何东西。 ORVA20% OFF YOUR FIRST BOTTLEorvaskin.com在两个层级都正确、稳定且可读。没有闪烁,没有重新构成,没有随着瓶子旋转而变形。在近乎静态的结束卡片上,MiniMax的“准确文本和品牌渲染”声明在廉价层级上成立。

768P损失的是边缘质量。观察O和R内部的封闭区域,以及标签上的10% NIACINAMIDE / 30 ML。在2K下,字母形状有清晰的边缘;在768P下,它们变得模糊,瓶子上较小的文字正处于猜测的边缘。在手臂长度距离的手机上,你可能两者都能通过。但在平板电脑上、客户审核中,或者一旦有人暂停并放大,768P版本就会显得像廉价渲染。

768P真正失败的地方是运动,而不是分辨率。 在批次中,一个街头变体以瓶子推近镜头结束。当它占据更多画面并倾斜时,四个字母溶解成模糊的一片,看起来像另一种字母表。相同的层级,相同的模型,相同的品牌,无法使用的剪辑。这就是真正的规则:当文字小、平且静止时,它保持清晰;当它快速穿过画面时,就会失效。购买2K并不能修复一个要求模型在移动中重新构成旋转标签的镜头。设计镜头才能解决这个问题。


MiniMax H3 UGC广告与相同标价下的最佳AI视频生成器对比

任何寻找最佳AI视频生成器用于广告的人最终都会比较这两者,因为目录让它们每秒的价格相差不到半美分。因此,我使用相同的提示,通过两者运行了基础帧B(该组中难度最大的微距跌落测试,包含最小的印刷文字),然后阅读了两张账单。

两张对比图,显示滴管将精华液滴在手上

相同的基础帧,分别由左侧的MiniMax H3(2K)和右侧的Seedance 2.5(720p)动画化

相同的第一帧,相同的提示,各五秒。左侧MiniMax H3(2K),右侧Seedance 2.5(720p)。两个剪辑均来自API:Seedance游乐场在三次截图尝试后仍显示“进行中”,因此此步骤也没有浏览器截图。

使用minimax/h3/image-to-video和bytedance/seedance-2.5/image-to-video生成。

MiniMax H3(图像转视频)Seedance 2.5(图像转视频)
标价2K 0.14美元/秒,768P 0.10美元/秒从0.134美元/秒起
这个5秒剪辑实际计费0.70美元(2K,1440x1440)1.51美元(720p,960x960)
分辨率上限2K,短边1440720p,从该方形源来看为960x960
剪辑长度4到15秒4到30秒
参考材料任意组合的图片、视频和音频最多30张图片,仅限图片
原生音频是,32 kHz立体声,随画面生成
标签小字,本次运行文字商标和成分行在2K下均可读文字商标可读,成分行模糊
延迟,此剪辑190.5秒224.7秒

一起阅读前两行,因为这是整个惊喜所在。标价几乎相同。但账单不同。

H3两次都按标价计费:5秒2K为0.70美元,768P为0.50美元,没有四舍五入,没有意外。Seedance 2.5对5秒720p计费1.5148美元,大约是0.30美元/秒,而不是0.134美元。所以我检查了原因,并以480p再次运行了相同的镜头:4秒0.5397美元,即0.1349美元/秒,几乎与标价一致。

这解释了原因。目录价格是480p的费率,而方形源上的720p是960x960对640x640,像素数量是2.25倍,在我的账单上价格也是2.25倍。关于“From”价格没有任何不诚实之处,但“From”在这句话中确实起了作用,而且这是你在发票中而不是在比较表中会发现的那种东西。

这彻底翻转了决策。在这次运行中,H3以0.70美元的价格在短边交付了1440像素,而Seedance 2.5以1.51美元的价格交付了960像素。如果你的广告是一个人在说话,屏幕上没有任何需要阅读的内容,那么Seedance 2.5仍然值得拥有:它最长可达30秒,而H3只有15秒,这对于更长的故事叙述格式很重要,并且它接受更多的参考图片。当文字商标、优惠信息行或URL需要在手机屏幕上存活时,H3既更清晰又更便宜,而且差距明显。

这个普遍教训比两个模型都更持久:在将每秒费率放入电子表格之前,先以你的真实设置运行一个剪辑并阅读实际账单。

三个值得了解的更便宜的变体,本月均在目录中验证:

分拆购买。 两个5秒的剪辑比一个10秒的剪辑更适合钩子测试,因为你得到了两个开头而不是一个。相同的金额,两倍的漏斗顶部。

在廉价层级上制作草稿。 对于纯钩子测试,不需要读取任何内容时,bytedance/seedance-2.0-mini/image-to-video为0.039美元/秒,目前比其0.056美元的标价优惠30%(截至2026年8月)。这使得一个5秒的钩子大约20美分,便宜到可以随意使用。

使用reference-to-video锁定面孔。 将相同的参考图片输入minimax/h3/reference-to-video可以在不同场景中保持一个主持人一致,这样你就能从一个角色中获得一个月的素材,而不是每周换一个新面孔。它按相同的两个层级计费。我没有为本文运行它,因此我不会展示我尚未拥有的结果。

保留表演,增加像素。 当一个768P的表演完美,只有分辨率有问题时,atlascloud/video-upscaler可以保留该表演,以0.024美元/秒升至2K,最低收费5秒。它无法创造源分辨率未能解析的文字,因此它挽救的是好的表演,而不是损坏的标签。


MiniMax H3 UGC广告每个可用剪辑的成本

首先是标价,然后是真正重要的数字。

费用项目本次运行人类UGC创作者等效成本
五个基础帧,2k5 x 0.12美元 = 0.60美元包含在拍摄中
四个广告片段,768P,每个5秒4 x 0.50美元 = 2.00美元4 x 175美元 = 700美元
结束卡片,2K,4秒0.56美元175美元
五个可交付的广告片段3.16美元875美元,不含使用权限
付费广告使用权限包含+30%至+50%,即1,138美元至1,313美元
用于证明观点的768P结束卡片对照0.40美元无法购买的东西
整个20个任务的钩子测试批次9.96美元无法购买的东西

创作者列使用了每个视频约175美元的市场中位数,典型范围是150美元到212美元,再加上30%到50%的付费分发权限(Influee,2026年)。

现在说诚实的部分,因为标价假设每个剪辑都可用,但实际上并非如此。

我观看了批次中的所有20个剪辑,拒绝了三个。一个在瓶子推近镜头时文字商标模糊。一个的表演者手指在整个表演中遮住了标签。一个偏离得太远,以至于作为该镜头重点的印刷盒盖离开了画面。

这意味着20个中有17个可用,成功率85%,花费9.96美元。每个可用剪辑的成本:0.59美元,而平均标价为0.50美元。

关于这个数字,有两件事值得说明。首先,85%很高,我不能保证在更难的简报上也能保持;一个包含更快运动或更密集包装文字的批次会失败更多。其次,三个被拒绝的剪辑都是构图中我在提示中可以预防的问题,而不是模型缺陷。拒绝是设计税,而不是渲染税。

这是要放进幻灯片中的数字:每个可用剪辑的成本,而不是每个剪辑的成本。而且,直到整个批次完成并且你观看了所有内容,你才能知道这个数字。任何向你报出每个剪辑的费率但没有提供可用率的人,都是在引用等式中更便宜的那一半。

值得明确地说:这并不会使人类创作者过时。它只是让测试阶段变得便宜。花几美元找到两个有效的钩子,然后把那875美元花在真正有预算的版本上,使用一个真实的人,人们会追随他们的面孔。


MiniMax H3 UGC广告的披露和品牌规则

三件事,没有一件是可选的,全部都很简短。

声明它。 Meta和TikTok都要求广告商标记由AI生成或大幅AI修改的创意,并且两者都运行自动检测,包括许多生成工具嵌入文件中的C2PA内容凭证。由AI制作不是拒绝的理由。未能声明才是。政策措辞变化足够频繁,因此唯一明智的指令是:在发布之前阅读你自己的Ads Manager中的当前文本,而不是博客文章对其的总结。

不要将真实商标放入提示中。 这就是为什么ORVA是虚构的。MiniMax的API条款包括一项防御和赔偿条款,涵盖模型输出引起的专利和版权索赔,但它不扩展到商标或肖像权。因此,在生成品牌密集型广告时,你最希望得到保护的那一类风险恰恰是不受保护的。使用你自己的标记(你有权使用的标记),或者虚构的标记。

开放权重不是司法管辖区变通方法。 H3-Base确实可以下载,它是一个真正的33B版本,而不是精简演示。但社区许可证目前排除了欧盟、英国、韩国和美国,这些地区有单独的正式许可渠道。而且自托管运行的是768像素的短边,Context-IR和Regenerate-2K阶段保留在API端。因此,本地路径无法交付本文证明的、可读品牌文字所需的唯一东西。


MiniMax H3 UGC广告:常见问题解答

一个MiniMax H3 UGC广告的成本是多少?

一个5秒的竖屏广告在minimax/h3/image-to-video上,768P为0.50美元,2K为0.70美元,加上基础帧的0.12美元(如果你生成一个)。一个4秒的2K结束卡片为0.56美元。直接从MiniMax购买每秒略便宜,其即用即付页面上的2K为0.13美元/秒,768P为0.08美元/秒,而此处分别为0.14美元和0.10美元。

我可以一次生成多少个MiniMax H3 UGC广告?

H3按并发任务数计量,而不是每分钟请求数:免费套餐2个并发任务,付费套餐15个。提交更多任务不会报错,而是会排队。在我的运行中,一次性提交的20个任务全部完成,中位数耗时175.6秒,整个批次在4分13秒内完成。按此速率,一个工作日是几百个5秒的剪辑,远远超过任何团队实际能审核的创意量。在基于此构建调度器之前,先测量你自己的批次,因为并发行为会变化。

MiniMax H3 UGC广告会带有水印吗?

API不会。我逐帧检查了交付的文件,没有发现任何角落标记。免费消费者应用是一个独立的产品,带有水印、分辨率上限和禁止去除水印的条款。如果文件是客户交付物,请使用API路径。

MiniMax H3能正确渲染我的品牌名称和行动号召文字吗?

大部分可以,但有一个明确的条件。在近乎静态的结束卡片上,768P和2K都能正确渲染ORVA、折扣行和orvaskin.com,并在整个镜头中保持稳定;2K只带来了更清晰的字母边缘和瓶子上可读的小字。在我的运行中,它失败的地方是运动:当产品被推近镜头并倾斜时,文字商标在768P下模糊成了无意义的内容。本次运行中起到关键作用的三个规则:将关键文字放在近乎静态的结束卡片上,而不是放在运动镜头中;绝不让相机在文字上移动;在花费一分钱做视频之前,检查基础帧上是否有手或手指遮挡文字商标。

MiniMax H3是最佳AI视频生成器用于广告,还是有更便宜的选择?

对于纯说话头钩子测试,无需读取任何内容时,廉价层级确实足够:bytedance/seedance-2.0-mini/image-to-video为0.039美元/秒,目前比其0.056美元的标价优惠30%(截至2026年8月),这使得一个5秒的钩子大约20美分。当文字商标、优惠信息行或URL需要可读时,2K层级额外的四美分每秒在第一次广告没有被退回时就收回了成本。

Meta或TikTok会拒绝一个AI生成的UGC广告吗?

不会因为它是AI生成的。两个平台都要求广告商标记由AI生成或大幅AI修改的创意,并且两者都运行自动检测,包括C2PA内容凭证。拒绝的风险在于未声明,而不是技术本身。在发布之前,检查你自己的Ads Manager中当前的确切措辞,因为这两个平台经常修订此语言。

最新模型

一个 API,畅享全模态 AI。

探索全部模型