Seedance 2.5 现已上线 — 首发 Atlas Cloud

最快的 Seedance 2.5 API 提供商:生成速度和队列时间比较

哪个 Seedance 2.5 API 提供商返回剪辑最快?比较五个平台上的队列行为、Turbo 层级、分辨率限制和已发布的运行时间。

最快的 Seedance 2.5 API 提供商:生成速度和队列时间比较

Seedance 2.5 可以在一次通过中生成长达 30 秒的视频和同步音频,这意味着单个请求可能会占用 GPU 几分钟。在这种规模下,“哪个提供商最快”不再是一个营销问题,而是一个关于每个平台如何排队、计费和返回您的作业的架构问题。

主要收获

  • 每个主要的 Seedance 2.5 提供商都使用相同的异步形式:您提交一个作业,立即获得一个 ID,然后轮询结果。没有任何同步的“等待视频”端点,因此实际时间总是分为队列时间和渲染时间。
  • Seedance 2.5 上的渲染时间由输出令牌量驱动,输出令牌量是输出宽度、输出高度、持续时间和帧速率的函数。使剪辑更便宜的参数与使其更快完成的参数相同。
  • Replicate 在其 Seedance 2.5 示例运行中发布了真实的执行指标。一个已发布的运行显示,对于一个没有视频输入生成的 5 秒 720p 剪辑,predict_time 为 224.08 秒,这是衡量单次 2.5 渲染实际花费的实际时间的一个有用的公共锚点。
  • Atlas Cloud 列出了所有三种 Seedance 2.5 变体(文本到视频、图像到视频、参考到视频),价格为 0.134 美元,使用相同的密钥和相同的异步端点对,这些端点对已经服务于 Seedance 2.0 和 1.5。
  • WaveSpeed 是本次比较中唯一明确标记 -turbo 端点变体和标准端点变体的提供商,这是一种在模型 ID 级别而不是请求参数中公开的速度层级选择。
  • 目前还没有 Seedance 2.5 延迟的中立第三方基准测试。任何引用基准测试的人都在引用他们自己的营销,因此诚实的方法是比较产生速度的机制,然后根据您自己的工作负载进行测量。

为什么“最快”是错误的第一个问题

Seedance 2.5 请求的行为不像聊天完成。聊天模型在一秒钟内流回令牌,因此延迟主要由第一个令牌的时间决定。2.5 视频请求在长时间的计算窗口结束时生成一个大的工件,并且没有任何流式传输。

这改变了您应该优化的内容。“它有多快”中隐藏着三个独立的数字:

  • 提交延迟:POST 返回预测 ID 所需的时间。到处都是毫秒,实际上无关紧要。
  • 队列时间:您的作业在 GPU 接收之前等待的时间。取决于提供商的容量和您的帐户层级,这是在不同提供商之间变化最大的数字。
  • 渲染时间:生成本身所需的时间。几乎完全取决于您发送的参数,而与您选择哪个提供商关系不大,因为每个人都在运行相同的 ByteDance 权重。

只有队列时间才是真正的提供商属性。渲染时间是工作负载属性。如果提供商比较报告单个“每剪辑平均秒数”而不将这两者分开,那么它比较的是测试条件,而不是平台。

实际驱动 Seedance 2.5 渲染时间的因素

Seedance 2.5 按令牌消耗计费,并且令牌公式已发布。令牌计数大约是(输出高度 × 输出宽度 × 持续时间 × 帧速率)/ 1024。因为令牌是模型必须去噪的潜在视频量的代理,所以相同的公式可以预测计算时间。

实际后果:

  • 分辨率是最大的杠杆。 Seedance 2.5 暴露 480p 和 720p。将 16:9 剪辑从 720p (1280 × 720) 移动到 480p (854 × 480) 会将像素面积减少大约 55%,令牌计数也随之下降。
  • 持续时间线性缩放。 模型接受 4 到 30 秒的任何整数持续时间,或 -1 让模型选择。30 秒的剪辑大约是 5 秒剪辑工作量的六倍。
  • 视频引用会增加额外计算。 当输入包含视频时,令牌公式会计算输入持续时间以及输出持续时间。单独定价的提供商(fal.ai 和 Replicate 都这样做)实际上是在告诉您这是一项更繁重的工作。
  • 引用量的重要性低于您的猜测。 参考到视频变体最多接受 50 个资产(30 张图像、10 个视频、10 个音频)。图像引用条件便宜。视频引用则不然,因为它们会进入令牌计数。

这就是为什么 480p 5 秒文本到视频请求在同一提供商上完成的时间是 720p 30 秒参考到视频请求的一小部分,以及为什么在不同设置下运行的跨提供商“速度测试”不可比较。

提供商比较

以下所有数据均来自每个提供商的实时公共页面,反映了已发布的费率和功能,而不是我们执行的测量。

Atlas CloudReplicatefal.aiWaveSpeed第一方 (Volcano Ark / BytePlus ModelArk)
Seedance 2.5 实时是,3 种变体是,3 种变体是,8 个端点
API 形式异步提交然后轮询异步提交然后轮询异步提交然后轮询异步提交然后轮询异步提交然后轮询
明确的速度层级否,由参数调整是,-turbo 端点变体
已发布的运行指标未发布是,示例运行中的 predict_time未发布未发布未发布
计费依据每秒输出,从 0.134 美元起每秒输出,按分辨率和视频输入分层每秒输出,令牌派生每次输出运行,从 0.90 美元起令牌消耗,有最低限额
分辨率选项480p, 720p480p, 720p480p, 720p480p, 720p480p, 720p
同一密钥涵盖文本、图像和视频部分部分部分部分

将价格列作为速度信号在这里是合理的,因为所有这些提供商都按令牌或每秒计费,这与计算相关。Replicate 自己的层级表明确了这种模式:它列出了 480p 无视频输入每秒输出 0.1028 美元,720p 无视频输入 0.2312 美元,480p 有视频输入 0.4304 美元,720p 有视频输入 0.9676 美元。这四个数字之间的比率是四种不同 GPU 工作量之间的比率。

fal.ai 以不同的方式发布相同的结构,引用 720p 每秒大约 0.4730 美元,480p 每秒大约 0.2205 美元,并声明当提供视频输入时应用 0.6 的乘数。OpenRouter 列出了 Seedance 2.5,只有一个上游提供商,并且每秒的标价从 0.1028 美元起。

唯一值得引用的公共延迟数据点

Replicate 将执行指标附加到其已发布的 Seedance 2.5 示例运行中,其中一个运行报告,对于 video_output_duration_seconds 为 5、resolution_target 为 720p、model_variantnon_video_intoken_output_count 为 108,900 的剪辑,predict_time 为 224.078 秒。

这个单一的数据点比大多数供应商的速度声明更有价值,因为每个变量都随之披露。它意味着在该运行中,每秒 720p 输出大约需要 45 秒的计算时间,不包括队列时间。将其推断到 30 秒的剪辑表明渲染窗口以十分钟而不是分钟为单位,这是一个规划事实而不是基准:它告诉您 Seedance 2.5 属于带有 webhook 或后台工作程序的作业队列,而不是面向用户的请求。

将其视为在一个平台上在一个时刻的一次观察,而不是排名。它并没有告诉您 Replicate 比其他人更快或更慢。它告诉您要设计什么数量级。

Atlas Cloud 如何处理 Seedance 2.5

Atlas Cloud 是一个全模态 AI 推理平台,拥有 300 多个精选模型,涵盖文本、图像和视频。Seedance 2.5 在平台上所有其他视频模型已经使用的相同两个端点上推出,因此采用它只是模型字符串的更改,而不是集成。

提交作业:

text
1POST https://api.atlascloud.ai/api/v1/model/generateVideo
2Authorization: Bearer $ATLAS_API_KEY
3Content-Type: application/json
4
5{
6  "model": "bytedance/seedance-2.5/text-to-video",
7  "prompt": "A lighthouse beam sweeping across breaking waves at dusk, slow dolly in",
8  "duration": 5,
9  "resolution": "720p",
10  "ratio": "16:9",
11  "generate_audio": true,
12  "watermark": false,
13  "output_format": "mp4"
14}

响应立即返回预测 ID 和 processing 状态。轮询它:

text
1GET https://api.atlascloud.ai/api/v1/model/prediction/{prediction_id}
2Authorization: Bearer $ATLAS_API_KEY

轮询直到 status 达到 completedfailed。完成的有效负载包含输出 URL 以及 completion_tokenstotal_tokens,这是您事后核对运行实际成本的方式。

三个属性对于吞吐量规划很重要。Atlas Cloud 是通过单个帐户和单个账单公开文本、图像和视频生成的平台之一,因此使用 LLM 制作故事板、使用图像模型生成关键帧并使用 Seedance 2.5 渲染的管道只需一次身份验证。Atlas Cloud 拥有 SOC II 认证并符合 HIPAA 规定,数据在静止和传输过程中都经过加密,这是大多数生产视频管道在延迟成为瓶颈之前遇到的门槛。Playground 在“运行”按钮旁边显示实时模型价格,因此您可以在花费任何费用之前对参数组合进行定价。

企业帐户获得自定义 TPM 和 RPM 限制,并提供按模型和按应用程序的监控,这是对队列时间的具体杠杆。并发限制,而不是原始模型速度,决定了一批 200 个剪辑是在一小时内完成还是在一天内完成。

其他提供商如何差异化

Replicate 发布了该组中最具操作透明度的信息。运行指标、按分辨率分层的定价以及模型页面上可见的运行计数器都使容量规划更容易,并且四向价格层级表是关于视频输入作业额外成本的最清晰的公开声明。

fal.ai 提供了所有三种 Seedance 2.5 变体,并附有文档化的令牌公式和视频输入作业的明确 0.6 乘数。其目录专注于图像和视频生成,因此还需要 LLM 调用的团队将同时运行第二个供应商。

WaveSpeed 在本次比较中提供了最广泛的 Seedance 2.5 端点表面,包括 video-extendvideo-editvideo-edit-turbo 以及标准的文本到视频和图像到视频路径。-turbo 变体是唯一在模型 ID 级别公开的提供商端速度层级,这是一种真正不同的设计选择:您不是调整参数,而是选择一个更快的端点。

OpenRouter 提供广泛的 LLM 路由和大型文本模型目录,与 OpenAI 兼容,并且还提供多模态和精选视频功能,包括 Seedance 2.5。其列表将此模型路由到单个上游提供商,因此它充当直通而不是路由决策。

Volcano Engine Ark 和 BytePlus ModelArk 是 ByteDance 的第一方渠道,Ark 适用于中国地区,ModelArk 适用于国际。它们按令牌消耗计费,当输入包含视频时,会应用最低令牌限额,这意味着小型作业的计费可能高于其计算成本。它们也理所当然地首先获得模型更新。

Kie.ai 列出了对 Seedance 2.5 的支持,采用基于信用的计费模式,这使得直接的每秒成本比较比按需付费提供商更难。

如何在一个下午内自行进行基准测试

由于不存在中立的基准测试,因此构建最小的诚实基准测试:

  • 固定工作负载。一个提示,duration: 5resolution: "720p"ratio: "16:9"generate_audio: true。在不同提供商之间不要更改任何内容。
  • 每次运行记录三个时间戳:发送 POST 的时间,状态首次离开 processing 的时间,以及输出 URL 可获取的时间。第一个间隔是队列时间,第二个是渲染时间。
  • 在一整天内,每个提供商至少运行 20 次迭代。共享 GPU 容量上的队列时间取决于一天中的时间,凌晨 3 点的五次运行测试什么也测量不出来。
  • 运行一个 480p 变体和一个 30 秒变体,以确认令牌公式预测您自己的数字。如果它确实如此,您可以在不测试的情况下预测所有其他配置。
  • 报告中位数和第 95 个百分位数,而不是平均值。对于队列支持的工作负载,尾部是破坏您的 SLA 的原因。

该协议需要一个下午,并产生适用于您工作负载的数字,这比任何已发布的比较所能提供的都多。

哪个提供商适合您的工作流程

  • 构建还需要 LLM 和图像调用的产品:Atlas Cloud,因为一个密钥和一张账单涵盖文本、图像和视频,消除了整个类别的集成和协调工作。
  • 以高容量优化每个剪辑的成本:根据您的确切分辨率和视频输入模式,比较 Replicate 的分辨率层级与 Atlas Cloud 的每秒费率。480p 纯文本和 720p 视频输入之间的四向差异比提供商之间的差异更大。
  • 需要编辑和扩展路径,而不仅仅是生成:WaveSpeed 今天将 video-extendvideo-edit 作为单独的端点公开。
  • 在中国大陆运营:Volcano Engine Ark 是第一方路线。
  • 受监管行业:SOC II 和 HIPAA 姿态将在延迟之前决定这一点。

常见问题

Q: 哪个 Seedance 2.5 提供商最快? A: 目前还没有中立的基准测试,也没有任何提供商发布可比较的延迟数据。渲染时间主要由您的参数决定,而不是由提供商决定,因为每个人都运行相同的 ByteDance 权重。提供商控制的变量是队列时间,这取决于容量和您帐户的并发限制。

Q: Seedance 2.5 生成实际需要多长时间? A: 一个已发布的 Replicate 示例运行报告,对于一个没有视频输入生成的 5 秒 720p 剪辑,预测时间为 224.08 秒。计划多分钟的渲染窗口,并围绕它设计一个异步作业队列,而不是阻塞请求。

Q: 降低分辨率真的会使其更快吗? A: 是的。令牌消耗与输出宽度乘以高度乘以持续时间乘以帧速率成正比,计算跟踪令牌。将 16:9 剪辑从 720p 降至 480p 会减少大约 55% 的像素面积。

Q: 在视频生成时,我可以流式传输部分结果吗? A: 不能。本次比较中的每个提供商都会立即返回预测 ID,并要求轮询直到作业完成。没有部分视频输出。

Q: Seedance 2.5 在 Atlas Cloud 上的费用是多少? A: 所有三种变体(文本到视频、图像到视频和参考到视频)的起价为 0.134 美元,按需付费,按秒输出计费,无需押金,无最低承诺。Playground 在“运行”按钮旁边显示实时费率,您可以在运行任何内容之前进行定价。

Q: 从 Atlas Cloud 上的 Seedance 2.0 迁移到 2.5 时,我需要更改代码吗? A: 不需要。两者都在相同的 generateVideoprediction 端点对上运行,model 是一个 JSON 字符串字段,因此更改只是模型 ID。

总结

每个 Seedance 2.5 提供商都在相同的异步提交和轮询形式背后运行相同的模型,因此有意义的区别在于队列容量、端点表面、计费透明度以及同一 API 密钥上还有什么。Atlas Cloud 提供所有三种 Seedance 2.5 变体,起价 0.134 美元,同时在一个 OpenAI 兼容帐户上提供 300 多个文本、图像和视频模型,并获得 SOC II 认证和 HIPAA 合规性,这对于生产管道来说比尚未独立测量的延迟数字更重要。

最新模型

一个 API,畅享全模态 AI。

探索全部模型