
在 Shengshu API 上建構影片製作管線:只需單次呼叫,Vidu Q3 即可產生帶有原生音訊和智慧運鏡的 16 秒電影級片段。
在 Atlas Cloud 上,運用最新的 AI 影片生成模型,由文字與圖像打造電影級的高擬真影片。
对比 ShengShu 全部模型的标准价、平台价与折扣。
| 模型 | 标准价 (USD) | 平台价 (USD) | 折扣 | |
|---|---|---|---|---|
| Vidu Q3-Mix Reference to Video | $0.125 | 低至$0.106/秒 视频 | -15% | 查看 |
| Vidu Q3 Reference to Video | $0.05 | 低至$0.042/秒 视频 | -15% | 查看 |
| Vidu Q3-Pro Start-end-to-video | $0.05 | 低至$0.042/秒 视频 | -15% | 查看 |
| Vidu Q3-Turbo Image-to-video | $0.04 | 低至$0.034/秒 视频 | -15% | 查看 |
| Vidu Q3-Turbo Start-end-to-video | $0.04 | 低至$0.034/秒 视频 | -15% | 查看 |
| Vidu Q3-Turbo Text-to-video | $0.04 | 低至$0.034/秒 视频 | -15% | 查看 |
Vidu Q3 的 16 秒片段、原生音訊和多參考一致性,使其在以往需要製作團隊才能完成的工作流程中非常實用。各團隊透過使用不同的 Q3 層級,無需切換供應商即可從快速迭代無縫推進至最終資產的交付。
工作室和獨立創作者使用 Vidu Q3-Mix 來生成多集動畫內容,確保角色在每個場景中看起來完全一致。透過上傳角色參考表,每個新片段都能繼承相同的面部特徵、服裝和視覺風格,而無需手動進行逐幀的一致性調整。Shengshu 在 SXSW 2026 上展示了這一工作流程,作為動畫劇集製作的首個 AI 解決方案。
行銷團隊只需上傳一次品牌角色的參考圖像,即可使用 Vidu Q3 Reference-to-Video 生成數十個用於 TikTok、Reels 和 YouTube Shorts 的短影音。該角色在所有輸出中保持視覺上的一致,從而消除了逐一簡報和審批每個資產的設計瓶頸。在 Atlas Cloud 上,每秒的費用為 0.042 美元,生成一批 10 秒短影音的單價不到一美元。
電商團隊提供多角度的產品照片作為參考輸入,並生成帶有原生環境音的電影級動態產品行銷短片。輸出結果在同一次調用中附帶同步音效,無需進行影片拍攝或音訊編輯,即可直接用於廣告和產品頁面。首尾幀控制功能使團隊能夠精準主導產品在每個短片中的呈現方式。
導演使用 Vidu Q3-Pro 的運鏡控制功能生成具有特定運鏡的預演片段——向主體推進、掃過場景、跟隨角色的跟拍鏡頭。原生16秒輸出意味著可以透過一次呼叫預演一個完整的短場景。這用動作精準的參考資料取代了早期的分鏡腳本工作,供演員與劇組人員使用。
開發團隊使用 Vidu Q3-Turbo 以每秒 0.034 美元的成本執行批次生成管線,每小時可透過文字或圖像輸入製作數十個短片。較低的每秒成本使其在選擇使用 Q3-Pro 進行擴展之前,能夠切實可行地生成並測試許多創意變體。這兩種模型都在同一個 Atlas Cloud API 金鑰下執行,只需在不同層級之間更改單一參數即可。
旅遊局和旅行平台使用 Vidu Q3-Pro 文本生成影片功能,透過描述性文字提示詞生成帶有自然環境音的氛圍感目的地影片片段。只需輸入一段關於風景、地標或文化場景的書面描述,即可在一次呼叫中生成一段帶有匹配音訊的 16 秒電影級影片片段。這為能夠激發預訂意願的內容創作提供了一種高性價比的實地拍攝替代方案。
Vidu Q3在單次API呼叫中可生成長達16秒的1080p、24fps連續影片。這是同級別領先影片模型中最長的單次生成窗口。在此時長上限內,每次呼叫的影片片段持續時間均可配置。
是的。Vidu Q3 在單次推理過程中,可與影片幀同時產生對話、音效、背景音樂以及唇形同步。無需後期製作配音或手動音訊對齊步驟。音訊時序與畫面動作自動同步。
您可以直接在文字提示中描述鏡頭運動(如推鏡頭、搖鏡頭、跟移鏡頭),模型將從第一幀開始執行這些運動。不需要獨立的參數或控制層。這適用於 Atlas Cloud 上的文字生成影片(text-to-video)和圖像生成影片(image-to-video)端點。
Vidu Q3-Pro 在 Atlas Cloud 上的定價為每秒 0.042 美元,可提供動作流暢、細節豐富的電影級輸出。Vidu Q3-Turbo 的生成速度更快,每秒成本更低,僅為 0.034 美元,適用於草稿和快速迭代。兩者均具有相同的 1080p 輸出解析度並支援原生音訊。
Vidu Q3 的 Reference-to-Video 端點每次呼叫接受 1 到 4 張參考圖像。您可以在單次生成中結合來自不同圖像的主體、環境、服裝和視覺風格。這是在多個影片片段中保持角色和場景一致性的主要方式。
Vidu Q3-Mix 是 Vidu Q3 系列中最高階的參考模型,在 Atlas Cloud 上的定價為每秒 0.106 美元。在一次生成中結合多張參考圖片時,它能提供最強的多主體一致性。它專為動畫影集製作和品牌內容等工作流程而設計,在這些工作流程中,角色特徵必須在眾多片段中保持視覺上的完全一致。
是的。Vidu Q3-Pro 和 Q3-Turbo 在 Atlas Cloud 上均設有 Start-end-to-video 端點。您只需提供起始幀影像並描述所需的動作或結束狀態,模型即可生成過渡效果。這為您提供了對每個場景開場與結尾的精確導演級控制。
Vidu Q3-Turbo 起價為每秒 0.034 美元。Vidu Q3-Pro 和 Reference-to-Video 端點為每秒 0.042 美元。Vidu Q3-Mix 是一致性最高的參考模型,價格為每秒 0.106 美元。所有層級的定價均比標準 Shengshu API 費率低 15%,並支援按需付費(即用即付)。