Seedance 2.5 現已上線 — 首發於 Atlas Cloud

最快的 Seedance 2.5 API 供應商:生成速度和排隊時間比較

哪個 Seedance 2.5 API 供應商能最快返回影片?比較五個平台之間的排隊行為、加速層級、解析度限制和發布的運行時間。

最快的 Seedance 2.5 API 供應商:生成速度和排隊時間比較

Seedance 2.5 能夠一次性生成長達 30 秒的影片,並同步音訊,這意味著單一請求可能會佔用 GPU 數分鐘。在這種規模下,「哪個供應商最快」不再是行銷問題,而成為一個關於每個平台如何排隊、計費和返回任務的架構問題。

主要重點

  • 每個主要的 Seedance 2.5 供應商都採用相同的非同步模式:您提交一個任務,立即獲得一個 ID,然後輪詢結果。沒有任何同步的「等待影片」端點,因此實際時間總是分為排隊時間加上渲染時間。
  • Seedance 2.5 的渲染時間由輸出令牌量驅動,這是輸出寬度、輸出高度、持續時間和幀率的函數。使影片成本更低的參數與使其更快完成的參數相同。
  • Replicate 在其 Seedance 2.5 範例運行中發布了實際執行指標。其中一個已發布的運行顯示,對於一個沒有影片輸入的 5 秒 720p 影片,predict_time 為 224.08 秒,這是一個有用的公開基準,說明單次 2.5 渲染在實際時間上需要多少成本。
  • Atlas Cloud 列出了所有三種 Seedance 2.5 變體(文字轉影片、圖像轉影片、參考轉影片),價格為 0.134 美元,使用與已經服務 Seedance 2.0 和 1.5 相同的金鑰和非同步端點對。
  • WaveSpeed 是本次比較中唯一明確標示 -turbo 端點變體與標準端點並存的供應商,這是一種在模型 ID 層級而非請求參數中公開的速度層級選擇。
  • 目前還沒有中立的第三方 Seedance 2.5 延遲基準測試。任何引用此類數據的人都在引用自己的行銷內容,因此誠實的做法是比較產生速度的機制,然後在您自己的工作負載上進行測量。

為什麼「最快」是錯誤的第一個問題

Seedance 2.5 請求的行為不像聊天完成。聊天模型在一秒內流回令牌,因此延遲主要由第一個令牌的時間決定。2.5 影片請求在漫長的計算窗口結束時產生一個單一的大型成品,並且沒有任何流式傳輸。

這改變了您應該優化的內容。「它有多快」中隱藏著三個獨立的數字:

  • 提交延遲:POST 返回預測 ID 所需的時間。到處都是毫秒,實際上無關緊要。
  • 排隊時間:您的任務在 GPU 處理之前等待的時間。取決於供應商容量和您的帳戶層級,這是不同供應商之間變化最大的數字。
  • 渲染時間:生成本身所需的時間。幾乎完全取決於您發送的參數,而與您選擇哪個供應商關係不大,因為所有人都運行相同的 ByteDance 權重。

只有排隊時間才是真正的供應商屬性。渲染時間是工作負載屬性。如果供應商比較報告單一的「每剪輯平均秒數」而沒有將這兩者分開,那麼它比較的是測試條件,而不是平台。

實際驅動 Seedance 2.5 渲染時間的因素

Seedance 2.5 按令牌消耗計費,並且令牌公式已發布。令牌計數大約是(輸出高度 × 輸出寬度 × 持續時間 × 幀率)/ 1024。由於令牌是模型必須去噪的潛在影片量的代理,因此相同的公式也預測了計算時間。

實際影響:

  • 解析度是最大的槓桿。 Seedance 2.5 支援 480p 和 720p。將 16:9 影片從 720p (1280 × 720) 移至 480p (854 × 480) 可將像素面積減少約 55%,令牌計數也隨之下降。
  • 持續時間線性縮放。 模型接受 4 到 30 秒的任何整數持續時間,或 -1 讓模型選擇。30 秒的影片大約是 5 秒影片的六倍工作量。
  • 影片參考會額外消耗計算資源。 當輸入包含影片時,令牌公式會計算輸入持續時間以及輸出持續時間。將此單獨定價的供應商(fal.ai 和 Replicate 都這樣做)實際上是在告訴您這是一項更繁重的工作。
  • 參考量的重要性比您想像的要小。 參考轉影片變體最多接受 50 個資產(30 張圖像、10 個影片、10 個音訊)。圖像參考的條件成本較低。影片參考則不然,因為它們會計入令牌計數。

這就是為什麼 480p 5 秒的文字轉影片請求在同一供應商上完成的時間比 720p 30 秒的參考轉影片請求少得多,以及為什麼在不同設定下運行的跨供應商「速度測試」不可比較的原因。

供應商比較

以下所有數據均來自每個供應商的即時公開頁面,反映的是已發布的費率和功能,而非我們執行的測量。

Atlas CloudReplicatefal.aiWaveSpeed第一方 (Volcano Ark / BytePlus ModelArk)
Seedance 2.5 上線是,3 種變體是,3 種變體是,8 個端點
API 形式非同步提交然後輪詢非同步提交然後輪詢非同步提交然後輪詢非同步提交然後輪詢非同步提交然後輪詢
明確的速度層級否,由參數調整是,-turbo 端點變體
已發布的運行指標未發布是,範例運行中的 predict_time未發布未發布未發布
計費依據每秒輸出,從 0.134 美元起每秒輸出,按解析度和影片輸入分層每秒輸出,基於令牌每次輸出運行,從 0.90 美元起令牌消耗,有最低限制
解析度選項480p, 720p480p, 720p480p, 720p480p, 720p480p, 720p
同一金鑰涵蓋文字、圖像和影片部分部分部分部分

將價格欄位視為速度信號在此處是合理的,因為所有這些供應商都以令牌或每秒為基礎計費,這與計算量相關。Replicate 自己的層級表明確了這種模式:它列出 480p 無影片輸入每秒輸出 0.1028 美元,720p 無影片輸入 0.2312 美元,480p 有影片輸入 0.4304 美元,720p 有影片輸入 0.9676 美元。這四個數字之間的比例是四種不同 GPU 工作量之間的比例。

fal.ai 以不同的方式發布相同的結構,720p 每秒約 0.4730 美元,480p 每秒約 0.2205 美元,並聲明在提供影片輸入時應用 0.6 的乘數。OpenRouter 列出 Seedance 2.5,只有一個上游供應商,標題費率從每秒 0.1028 美元起。

唯一值得引用的公開延遲數據點

Replicate 將執行指標附加到其已發布的 Seedance 2.5 範例運行中,其中一個運行報告,對於一個 video_output_duration_seconds 為 5、resolution_target 為 720p、model_variantnon_video_intoken_output_count 為 108,900 的影片,predict_time 為 224.078 秒。

這個單一數據點比大多數供應商的速度聲明更有價值,因為每個變數都與之一起披露。它意味著在該運行中,每秒 720p 輸出大約需要 45 秒的計算時間,不包括排隊時間。將其推斷到 30 秒的影片,則渲染窗口以數十分鐘而不是數分鐘來衡量,這是一個規劃事實而不是基準:它告訴您 Seedance 2.5 應該屬於帶有 webhook 或後台工作者的任務隊列,而不是面向用戶的請求之後。

將其視為在一個平台上的一個時刻的一次觀察,而不是排名。它並不能說明 Replicate 比其他任何人都快或慢。它告訴您要設計的數量級。

Atlas Cloud 如何處理 Seedance 2.5

Atlas Cloud 是一個全模態 AI 推理平台,承載 300 多個精選模型,涵蓋文字、圖像和影片。Seedance 2.5 部署在與平台上所有其他影片模型相同的兩個端點上,因此採用它只是模型字串的更改,而不是整合。

提交任務:

text
1POST https://api.atlascloud.ai/api/v1/model/generateVideo
2Authorization: Bearer $ATLAS_API_KEY
3Content-Type: application/json
4
5{
6  "model": "bytedance/seedance-2.5/text-to-video",
7  "prompt": "A lighthouse beam sweeping across breaking waves at dusk, slow dolly in",
8  "duration": 5,
9  "resolution": "720p",
10  "ratio": "16:9",
11  "generate_audio": true,
12  "watermark": false,
13  "output_format": "mp4"
14}

響應會立即返回一個預測 ID 和 processing 狀態。輪詢它:

text
1GET https://api.atlascloud.ai/api/v1/model/prediction/{prediction_id}
2Authorization: Bearer $ATLAS_API_KEY

輪詢直到 status 達到 completedfailed。完成的有效負載包含輸出 URL 以及 completion_tokenstotal_tokens,這是您事後核對運行實際成本的方式。

三個屬性對於吞吐量規劃很重要。Atlas Cloud 是透過單一帳戶和單一帳單提供文字、圖像和影片生成服務的平台之一,因此一個使用 LLM 故事板、使用圖像模型生成關鍵幀並使用 Seedance 2.5 渲染的管道只需驗證一次。Atlas Cloud 擁有 SOC II 認證並符合 HIPAA 規範,數據在靜止和傳輸過程中均加密,這是大多數生產影片管道在延遲成為瓶頸之前遇到的門檻。Playground 在「運行」按鈕旁邊顯示即時的每個模型價格,因此您可以在花費任何費用之前為參數組合定價。

企業帳戶可獲得自訂的 TPM 和 RPM 限制,並提供每個模型和每個應用程式的監控,這是對排隊時間的具體槓桿。並發限制,而不是原始模型速度,決定了 200 個影片批次是在一小時內完成還是一天內完成。

其他供應商如何區分

Replicate 發布了該組中最具操作透明度的資訊。運行指標、按解析度分層的定價以及模型頁面上可見的運行計數器都使容量規劃更容易,而四向價格層級表是關於影片輸入任務額外成本的最清晰的公開聲明。

fal.ai 攜帶所有三種 Seedance 2.5 變體,並提供文檔化的令牌公式和影片輸入任務的明確 0.6 乘數。其目錄專注於圖像和影片生成,因此還需要 LLM 調用的團隊將需要同時運行第二個供應商。

WaveSpeed 在本次比較中提供了最廣泛的 Seedance 2.5 端點介面,包括 video-extendvideo-editvideo-edit-turbo 以及標準的文字轉影片和圖像轉影片路徑。-turbo 變體是唯一在模型 ID 層級公開的供應商端速度層級,這是一個真正不同的設計選擇:您選擇一個更快的端點,而不是調整參數。

OpenRouter 提供廣泛的 LLM 路由和大型文字模型目錄,與 OpenAI 相容,並且還提供多模態和精選影片功能,包括 Seedance 2.5。其列表將此模型路由到單一上游供應商,因此它充當直通,而不是路由決策。

Volcano Engine Ark 和 BytePlus ModelArk 是字節跳動的第一方渠道,Ark 適用於中國地區,ModelArk 適用於國際。它們按令牌消耗計費,並設有最低令牌限制,當輸入包含影片時適用,這意味著小型任務的計費可能高於其計算成本。它們也理所當然地首先獲得模型更新。

Kie.ai 列出了 Seedance 2.5 支援,採用基於信用的計費模式,這使得與按需付費供應商相比,直接的每秒成本比較更加困難。

如何在一個下午自行基準測試

由於不存在中立的基準測試,請建立最小的誠實基準測試:

  • 固定工作負載。一個提示,duration: 5resolution: "720p"ratio: "16:9"generate_audio: true。在不同供應商之間不作任何更改。
  • 記錄每次運行的三個時間戳:發送 POST 的時間,狀態首次離開 processing 的時間,以及輸出 URL 可獲取的時間。第一個間隔是排隊時間,第二個是渲染時間。
  • 每個供應商至少運行 20 次迭代,分佈在一天中。共享 GPU 容量的排隊時間取決於一天中的時間,凌晨 3 點的五次運行測試毫無意義。
  • 運行一個 480p 的變體和一個 30 秒的變體,以確認令牌公式預測您自己的數字。如果它確實如此,您就可以預測所有其他配置而無需測試。
  • 報告中位數和第 95 個百分位數,而不是平均值。對於基於隊列的工作負載,尾部是導致您的 SLA 中斷的原因。

該協議需要一個下午的時間,並產生適用於您工作負載的數字,這比任何已發布的比較所能提供的都要多。

哪個供應商適合您的工作流程

  • 正在構建還需要 LLM 和圖像調用的產品:Atlas Cloud,因為一個金鑰和一個帳單涵蓋文字、圖像和影片,消除了整個類型的整合和對帳工作。
  • 以高容量優化每個剪輯的成本:比較 Replicate 的解析度層級與 Atlas Cloud 在您確切解析度和影片輸入模式下的每秒費率。480p 純文字和 720p 影片輸入之間的四向差異比供應商之間的差異更大。
  • 需要編輯和擴展路徑,而不僅僅是生成:WaveSpeed 今天將 video-extendvideo-edit 作為單獨的端點公開。
  • 在中國大陸境內運營:Volcano Engine Ark 是第一方路線。
  • 受監管行業:SOC II 和 HIPAA 姿態將在延遲之前決定這一點。

常見問題

Q: 哪個 Seedance 2.5 供應商最快? A: 目前尚無中立的基準測試,也沒有任何供應商發布可比較的延遲數據。渲染時間主要由您的參數決定,而不是由供應商決定,因為所有人都運行相同的 ByteDance 權重。供應商控制的變數是排隊時間,這取決於容量和您帳戶的並發限制。

Q: Seedance 2.5 生成實際需要多長時間? A: 一個已發布的 Replicate 範例運行報告,對於一個沒有影片輸入的 5 秒 720p 影片,預測時間為 224.08 秒。請規劃數分鐘的渲染窗口,並圍繞它設計一個非同步任務隊列,而不是阻塞請求。

Q: 降低解析度真的會讓它更快嗎? A: 是的。令牌消耗與輸出寬度乘以高度乘以持續時間乘以幀率成正比,計算量與令牌量相關。將 16:9 影片從 720p 降至 480p 可減少約 55% 的像素面積。

Q: 我可以在影片生成時串流部分結果嗎? A: 不行。本次比較中的每個供應商都會立即返回一個預測 ID,並要求輪詢直到任務完成。沒有部分影片輸出。

Q: Seedance 2.5 在 Atlas Cloud 上費用是多少? A: 所有三種變體(文字轉影片、圖像轉影片和參考轉影片)的價格均從 0.134 美元起,按每秒輸出計費,按需付費,無需預付金,也無最低承諾。Playground 在「運行」按鈕旁邊顯示即時費率,您可以在運行任何內容之前查看。

Q: 從 Seedance 2.0 遷移到 Atlas Cloud 上的 2.5 時,我需要更改我的程式碼嗎? A: 不用。兩者都在相同的 generateVideoprediction 端點對上運行,model 是一個單一的 JSON 字串欄位,因此更改只是模型 ID。

總結

每個 Seedance 2.5 供應商都在相同的非同步提交和輪詢模式下運行相同的模型,因此有意義的差異在於排隊容量、端點介面、計費透明度以及同一 API 金鑰上還有什麼。Atlas Cloud 提供所有三種 Seedance 2.5 變體,價格從 0.134 美元起,同時還有 300 多個涵蓋文字、圖像和影片的模型,所有這些都在一個與 OpenAI 相容的帳戶中,並具有 SOC II 認證和 HIPAA 合規性,這對生產管道來說比尚未獨立測量的延遲數字更重要。

最新模型

一個 API,暢享全模態 AI。

探索全部模型