Seedance 2.5は、最大30秒のビデオを同期オーディオ付きで一度に生成します。これは、1つのリクエストが数分間GPUを占有する可能性があることを意味します。この規模では、「どのプロバイダーが最速か」という問いは、マーケティングの質問ではなく、各プラットフォームがジョブをどのようにキューに入れ、請求し、返すかというアーキテクチャの質問になります。
主なポイント
- 主要なSeedance 2.5プロバイダーはすべて同じ非同期形式を使用しています。ジョブを送信するとすぐにIDが返され、結果をポーリングします。同期的な「ビデオを待つ」エンドポイントはどこにもないため、実時間(wall-clock time)は常にキュー時間とレンダリング時間に分かれます。
- Seedance 2.5のレンダリング時間は、出力幅、出力高さ、期間、フレームレートの関数である出力トークン量によって決まります。クリップを安くするパラメーターは、クリップを早く完了させるパラメーターと同じです。
- Replicateは、Seedance 2.5の実行例で実際の実行メトリクスを公開しています。公開されている実行の1つでは、ビデオ入力なしで生成された5秒の720pクリップの
predict_timeが224.08秒と示されており、これはシングルパスの2.5レンダリングが実時間で実際にどれくらいのコストがかかるかを示す有用な公開アンカーです。- Atlas Cloudは、3つのSeedance 2.5バリアント(テキストからビデオ、画像からビデオ、参照からビデオ)すべてを0.134ドルで提供しており、Seedance 2.0および1.5をすでに提供しているのと同じキーと非同期エンドポイントペアを使用しています。
- WaveSpeedは、この比較で唯一、標準エンドポイントに加えて明示的にラベル付けされた
-turboエンドポイントバリアントを出荷しているプロバイダーです。これは、リクエストパラメーターではなく、モデルIDレベルで公開される速度層の選択です。- Seedance 2.5のレイテンシに関する中立的な第三者ベンチマークはまだありません。それを引用する人は誰でも自分のマーケティングを引用しているため、正直なアプローチは、速度を生み出すメカニズムを比較し、自分のワークロードで測定することです。
なぜ「最速」が最初の質問として間違っているのか
Seedance 2.5のリクエストは、チャットの完了とは異なります。チャットモデルは1秒以内にトークンをストリーミングバックするため、レイテンシは最初のトークンまでの時間によって支配されます。2.5のビデオリクエストは、長い計算期間の終わりに単一の大きなアーティファクトを生成し、そのすべてがストリーミングされるわけではありません。
これにより、最適化すべきものが変わります。「どれくらい速いか」という問いの中には、3つの異なる数値が隠されています。
- 送信レイテンシ: POSTが予測IDを返すまでにかかる時間。どこでもミリ秒単位で、実質的に無関係です。
- キュー時間: ジョブがGPUにピックアップされるまで待機する時間。プロバイダーの容量とアカウントのティアによって異なり、プロバイダー間で最も変動する数値です。
- レンダリング時間: 生成自体にかかる時間。送信したパラメーターにほぼ完全に依存し、選択したプロバイダーにはほとんど依存しません。なぜなら、誰もが同じByteDanceの重みを使用しているからです。
キュー時間だけが真にプロバイダーのプロパティです。レンダリング時間はワークロードのプロパティです。これら2つを分離せずに単一の「クリップあたりの平均秒数」を報告するプロバイダー比較は、プラットフォームではなくテスト条件を比較しています。
Seedance 2.5のレンダリング時間を実際に左右するもの
Seedance 2.5はトークン消費量に基づいて課金され、トークン式は公開されています。トークン数は、おおよそ(出力高さ × 出力幅 × 期間 × フレームレート)/ 1024です。トークンはモデルがノイズ除去しなければならない潜在ビデオの量を表すため、同じ式が計算時間を予測します。
実用的な結果:
- 解像度が最大のレバーです。 Seedance 2.5は480pと720pを公開しています。16:9のクリップを720p(1280 × 720)から480p(854 × 480)に移動すると、ピクセル領域が約55パーセント削減され、トークン数もそれに伴って減少します。
- 期間は線形にスケールします。 モデルは4秒から30秒までの任意の整数期間、またはモデルに選択させるために
-1を受け入れます。30秒のクリップは、5秒のクリップの約6倍の作業量です。 - ビデオ参照は追加の計算コストがかかります。 入力にビデオが含まれる場合、トークン式は出力期間だけでなく入力期間もカウントします。これを個別に価格設定するプロバイダー(fal.aiとReplicateの両方)は、それがより重いジョブであることを実質的に伝えています。
- 参照量は予想よりも重要ではありません。 参照からビデオへのバリアントは、最大50のアセット(画像30枚、ビデオ10本、オーディオ10本)を受け入れます。画像参照は条件付けが安価です。ビデオ参照は、トークン数に含まれるため、そうではありません。
これが、480pの5秒のテキストからビデオへのリクエストが、同じプロバイダーで720pの30秒の参照からビデオへのリクエストのほんの一部で完了する理由であり、異なる設定で実行されるプロバイダー間の「速度テスト」が比較できない理由です。
プロバイダー比較
以下のすべての数値は、各プロバイダーのライブ公開ページから読み取られたものであり、当社が実施した測定ではなく、公開されている料金と機能を示しています。
| Atlas Cloud | Replicate | fal.ai | WaveSpeed | ファーストパーティ (Volcano Ark / BytePlus ModelArk) | |
|---|---|---|---|---|---|
| Seedance 2.5 ライブ | はい、3つのバリアント | はい | はい、3つのバリアント | はい、8つのエンドポイント | はい |
| API形式 | 非同期送信後ポーリング | 非同期送信後ポーリング | 非同期送信後ポーリング | 非同期送信後ポーリング | 非同期送信後ポーリング |
| 明示的な速度層 | いいえ、パラメーターで調整 | いいえ | いいえ | はい、-turboエンドポイントバリアント | いいえ |
| 公開されている実行メトリクス | 未公開 | はい、実行例のpredict_time | 未公開 | 未公開 | 未公開 |
| 課金基準 | 出力1秒あたり、0.134ドルから | 出力1秒あたり、解像度とビデオ入力でティアリング | 出力1秒あたり、トークン由来 | 実行1回あたり、0.90ドルから | 最小フロア付きのトークン消費量 |
| 解像度オプション | 480p、720p | 480p、720p | 480p、720p | 480p、720p | 480p、720p |
| 同じキーでテキスト、画像、ビデオをカバー | はい | 部分的 | 部分的 | 部分的 | 部分的 |
価格列を速度信号として読み取ることは、ここでは正当です。なぜなら、これらのプロバイダーはすべて、計算を追跡するトークンまたは秒単位で課金しているからです。Replicate自身のティアテーブルはパターンを明確にしています。ビデオ入力なしの480p出力1秒あたり0.1028ドル、ビデオ入力なしの720p出力1秒あたり0.2312ドル、ビデオ入力ありの480p出力1秒あたり0.4304ドル、ビデオ入力ありの720p出力1秒あたり0.9676ドルをリストしています。これら4つの数値間の比率は、4つの異なるGPU作業量間の比率です。
fal.aiは同じ構造を異なる方法で公開しており、720pで1秒あたり約0.4730ドル、480pで1秒あたり約0.2205ドルを引用し、ビデオ入力が提供された場合は0.6の乗数が適用されると述べています。OpenRouterは、単一のアップストリームプロバイダーと1秒あたり0.1028ドルからの見出しレートでSeedance 2.5をリストしています。
引用する価値のある唯一の公開レイテンシデータポイント
Replicateは、公開されているSeedance 2.5の実行例に実行メトリクスを添付しており、その実行の1つは、video_output_duration_secondsが5、resolution_targetが720p、model_variantがnon_video_in、token_output_countが108,900のクリップに対して224.078秒のpredict_timeを報告しています。
この単一のデータポイントは、ほとんどのベンダーの速度主張よりも価値があります。なぜなら、すべての変数がそれとともに開示されているからです。これは、キュー時間を除いて、その実行で720p出力1秒あたり約45秒の計算を意味します。これを30秒のクリップに外挿すると、レンダリングウィンドウが数分ではなく数十分で測定されることを示唆しており、これはベンチマークではなく計画の事実です。つまり、Seedance 2.5は、ユーザー向けのリクエストの背後ではなく、Webhookまたはバックグラウンドワーカーを備えたジョブキューに属していることを示しています。
これを、ある時点のあるプラットフォームでの1つの観測として扱い、ランキングとして扱わないでください。Replicateが他の誰よりも速いか遅いかを教えてくれるわけではありません。設計すべきオーダーを教えてくれます。
Atlas CloudがSeedance 2.5をどのように処理するか
Atlas Cloudは、テキスト、画像、ビデオにわたる300以上の厳選されたモデルを搭載したフルモーダルAI推論プラットフォームです。Seedance 2.5は、プラットフォーム上の他のすべてのビデオモデルをすでに提供しているのと同じ2つのエンドポイントに到着したため、採用は統合ではなくモデル文字列の変更です。
ジョブを送信します。
text1POST https://api.atlascloud.ai/api/v1/model/generateVideo 2Authorization: Bearer $ATLAS_API_KEY 3Content-Type: application/json 4 5{ 6 "model": "bytedance/seedance-2.5/text-to-video", 7 "prompt": "A lighthouse beam sweeping across breaking waves at dusk, slow dolly in", 8 "duration": 5, 9 "resolution": "720p", 10 "ratio": "16:9", 11 "generate_audio": true, 12 "watermark": false, 13 "output_format": "mp4" 14}
応答はすぐに予測IDとprocessingステータスを返します。それをポーリングします。
text1GET https://api.atlascloud.ai/api/v1/model/prediction/{prediction_id} 2Authorization: Bearer $ATLAS_API_KEY
statusがcompletedまたはfailedになるまでポーリングします。完了したペイロードには、出力URLとcompletion_tokensおよびtotal_tokensが含まれており、これにより実行後に実際にコストがかかったものを調整できます。
スループット計画には3つのプロパティが重要です。Atlas Cloudは、テキスト、画像、ビデオの生成を単一のアカウントと単一の請求書で公開するプラットフォームの1つであるため、LLMでストーリーボードを作成し、画像モデルでキーフレームを生成し、Seedance 2.5でレンダリングするパイプラインは一度認証されます。Atlas CloudはSOC II認証とHIPAA準拠を保持しており、保存時および転送時の暗号化が行われています。これは、レイテンシがボトルネックになる前に、ほとんどのプロダクションビデオパイプラインが直面するゲートです。また、Playgroundには、実行ボタンの横にライブのモデルごとの価格が表示されるため、何も費やす前にパラメーターの組み合わせを価格設定できます。
エンタープライズアカウントは、モデルごとおよびアプリケーションごとの監視機能を備えたカスタムTPMおよびRPM制限を取得します。これは、キュー時間に対する具体的なレバーです。生のモデル速度ではなく、同時実行制限が、200クリップのバッチが1時間で完了するか1日で完了するかを決定します。
他のプロバイダーがどのように差別化しているか
Replicateは、グループの中で最も運用上の透明性を公開しています。実行メトリクス、解像度別の価格設定、モデルページ上の目に見える実行カウンターはすべて、容量計画を容易にし、4方向の価格ティアテーブルは、ビデオ入力ジョブにどれだけの追加コストがかかるかについての最も明確な公開声明です。
fal.aiは、文書化されたトークン式とビデオ入力ジョブの明示的な0.6乗数で、3つのSeedance 2.5バリアントすべてを搭載しています。そのカタログは画像とビデオの生成に焦点を当てているため、LLM呼び出しも必要なチームは、それと並行して2番目のベンダーを実行することになります。
WaveSpeedは、この比較で最も広いSeedance 2.5エンドポイントサーフェスを出荷しており、標準のテキストからビデオおよび画像からビデオのパスに加えて、video-extend、video-edit、video-edit-turboが含まれています。-turboバリアントは、モデルIDレベルで公開される唯一のプロバイダー側の速度層であり、これは真に異なる設計選択です。パラメーターを調整する代わりに、より高速なエンドポイントを選択します。
OpenRouterは、幅広いLLMルーティングと大規模なテキストモデルカタログを提供し、OpenAI互換であり、Seedance 2.5を含むマルチモーダルおよび選択されたビデオ機能も搭載しています。このモデルのリストは単一のアップストリームプロバイダーにルーティングされるため、ルーティングの決定ではなくパススルーとして機能します。
Volcano Engine ArkとBytePlus ModelArkは、ByteDanceのファーストパーティチャネルであり、Arkは中国地域向け、ModelArkは国際向けです。これらは、入力にビデオが含まれる場合に適用される最小トークンフロア付きのトークン消費量に基づいて課金されます。これは、小さなジョブが計算されたコストよりも高く課金される可能性があることを意味します。また、定義上、モデルの更新を最初に受け取ります。
Kie.aiは、クレジットベースの課金モデルでSeedance 2.5のサポートをリストしており、これにより、従量課金制のプロバイダーよりも直接的な秒あたりのコスト比較が難しくなります。
午後中に自分でこれをベンチマークする方法
中立的なベンチマークが存在しないため、最小限の正直なベンチマークを構築します。
- ワークロードを固定します。1つのプロンプト、
duration: 5、resolution: "720p"、ratio: "16:9"、generate_audio: true。プロバイダー間で何も変更しません。 - 実行ごとに3つのタイムスタンプを記録します。POSTを送信したとき、ステータスが最初に
processingを離れたとき、出力URLがフェッチ可能になったとき。最初のギャップはキュー時間、2番目のギャップはレンダリング時間です。 - 1日を通して、プロバイダーごとに少なくとも20回の反復を実行します。共有GPU容量のキュー時間は時間帯に依存し、午前3時の5回実行テストでは何も測定できません。
- トークン式が自分の数値を予測することを確認するために、480pで1つのバリアント、30秒で1つのバリアントを実行します。それが予測できれば、テストせずに他のすべての構成を予測できます。
- 平均ではなく、中央値と95パーセンタイルを報告します。キューバックされたワークロードの場合、テールがSLAを破る原因となります。
このプロトコルは午後中に完了し、自分のワークロードに適用される数値を生成します。これは、公開されているどの比較よりも多くの情報を提供できます。
ワークフローに合ったプロバイダー
- LLMと画像呼び出しも必要な製品を構築する場合: Atlas Cloud。テキスト、画像、ビデオにわたる1つのキーと1つの請求書により、統合と調整作業の全体的なクラスが不要になります。
- 大量のクリップあたりのコストを最適化する場合: Replicateの解像度ティアとAtlas Cloudの秒あたりの料金を、正確な解像度とビデオ入力パターンで比較します。480pテキストのみと720pビデオ入力の間の4方向の広がりは、プロバイダー間の広がりよりも広いです。
- 生成だけでなく、編集と拡張パスも必要な場合: WaveSpeedは、今日、
video-extendとvideo-editを個別のエンドポイントとして公開しています。 - 中国本土で運用する場合: Volcano Engine Arkがファーストパーティのルートです。
- 規制された業界: SOC IIとHIPAAの姿勢が、レイテンシよりも先にこれを決定します。
FAQ
Q: 最速のSeedance 2.5プロバイダーはどれですか? A: 中立的なベンチマークはまだ存在せず、どのプロバイダーも比較可能なレイテンシ数値を公開していません。レンダリング時間は、誰もが同じByteDanceの重みを使用しているため、プロバイダーよりもパラメーターによってほとんど決まります。プロバイダーが制御する変数はキュー時間であり、これは容量とアカウントの同時実行制限に依存します。
Q: Seedance 2.5の生成には実際にどれくらいの時間がかかりますか? A: 公開されているReplicateの実行例の1つは、ビデオ入力なしで生成された5秒の720pクリップの予測時間が224.08秒であると報告しています。数分間のレンダリングウィンドウを計画し、ブロッキングリクエストではなく、非同期ジョブキューを中心に設計してください。
Q: 解像度を下げると本当に速くなりますか? A: はい。トークン消費量は、出力幅×高さ×期間×フレームレートに比例し、計算はトークンを追跡します。16:9のクリップを720pから480pにドロップすると、ピクセル領域の約55パーセントが削除されます。
Q: ビデオの生成中に部分的な結果をストリーミングできますか? A: いいえ。この比較のすべてのプロバイダーは、すぐに予測IDを返し、ジョブが完了するまでポーリングを必要とします。部分的なビデオ出力はありません。
Q: Atlas CloudでのSeedance 2.5の費用はいくらですか? A: 3つのバリアントすべて(テキストからビデオ、画像からビデオ、参照からビデオ)は0.134ドルからリストされており、デポジットなし、最低コミットメントなしの従量課金制で出力1秒あたりで課金されます。Playgroundには、実行する前に実行ボタンの横にライブレートが表示されます。
Q: Atlas CloudでSeedance 2.0から2.5に移行するときにコードを変更する必要がありますか?
A: いいえ。どちらも同じgenerateVideoとpredictionエンドポイントペアで実行され、modelは単一のJSON文字列フィールドであるため、変更はモデルIDのみです。
結論
すべてのSeedance 2.5プロバイダーは、同じ非同期の送信とポーリングの形式で同じモデルを実行しているため、意味のある違いは、キュー容量、エンドポイントサーフェス、請求の透明性、および同じAPIキーに何が他に存在するかです。Atlas Cloudは、SOC II認証とHIPAA準拠を備えた1つのOpenAI互換アカウントで、テキスト、画像、ビデオにわたる300以上のモデルとともに、0.134ドルから3つのSeedance 2.5バリアントすべてを搭載しています。これは、誰も独立して測定していないレイテンシ数値よりも、プロダクションパイプラインにとって重要です。







