僅限兩週 | Seedream 5.0 Pro 立享 8 折!

Pixverse API for Multi-Shot Narrative Video Generation

Pixverse API 為開發者提供直接存取 AISphere 影片生成模型的權限。V6 在單一工作流程中涵蓋了文字生成影片、圖像生成影片、參考引導生成、起始與結束幀控制以及影片延展功能;而 C1 則將故事板轉化為多鏡頭序列,並在跨鏡頭時保持角色與場景的一致性。Atlas Cloud 為這兩個系列提供服務,採用透明的按秒計費模式,無需進行基礎設施設定。立即開始建置。

探索領先模型

Atlas Cloud 為您提供最新的行業領先創意模型。

Pixverse API 全端點詳解:涵蓋五大模態的 V6 與 C1

了解每個 Pixverse API 端點在 Atlas Cloud 上的輸入內容、生成結果及所需成本,涵蓋從單一文本提示到七圖參考控制的各項功能。

ModalityDescription
Pixverse V6 Text-to-Video API (Text to Video)對於需要一個角色從一集到下一集看起來相同的序列化內容,此端點接受最多七個標記的參考圖像,並在每個生成的鏡頭中保持其外觀。主題和背景標籤加上每個圖像的參考名稱為Pixverse API提供了最細粒度的一致性控制,分層在C1的多鏡頭架構上。在Atlas Cloud上從每秒$0.03開始使用OpenAI兼容密鑰提供。
Pixverse V6 Image-to-Video API (Image to Video)A single still image is all this endpoint needs to produce a motion clip that preserves the source's visual identity, guided by a text prompt of up to 5,000 characters. It accepts JPG and PNG inputs up to 10MB with aspect ratios from 1:2.5 to 2.5:1, so portraits, product shots, and wide banners all animate without reformatting. Optional native audio and a seed parameter make outputs repeatable for production pipelines.
Pixverse V6 Start-End-to-Video API (Image to Video)When a clip has to land on an exact final frame, this endpoint takes both a start image and an end image and generates all the motion in between. Frames can be passed as public URLs or Base64 in PNG, JPEG, or WebP, and clips run 1 to 15 seconds at up to 1080p. That makes it the natural pick for scene transitions, loopable content, and shots with a fixed visual destination.
Pixverse V6 Reference-to-Video API (Reference to Video)Up to seven reference images steer each generation, and every image can be tagged as subject or background and given its own reference name for prompt-level control. V6 keeps character appearance and scene context stable across the clip, which removes manual keyframing from character-driven and brand-consistent work. Output supports the full range of eight aspect ratios and resolutions up to 1080p.
Pixverse V6 Video-Extend API (Video to Video)Need a clip to run longer than its original cut? Pass a source video URL plus a text prompt and V6 continues the footage for another 1 to 15 seconds, preserving the established motion and visual style. At $0.025 per second on Atlas Cloud, extending a scene costs the same as generating one from scratch.
Pixverse C1 Text-to-Video API (Text to Video)C1 treats text-to-video as a storyboard problem, generating clips built for multi-shot narrative continuity rather than isolated standalone shots. Prompts up to 5,000 characters drive videos of 1 to 15 seconds with native audio, eight aspect ratio options, and quality up to 1080p. Atlas Cloud prices the C1 series from $0.03 per second on a pay-as-you-go basis.
Pixverse C1 Image-to-Video API (Image to Video)Feed C1 a still image and it returns a video sequence in which character and scene fidelity hold from the first frame to the last. Inputs follow the same practical limits as V6, JPG or PNG up to 10MB with aspect ratios from 1:2.5 to 2.5:1, so existing assets drop straight in. Its storyboard-aware design suits multi-scene projects where identity drift between shots is not acceptable.
Pixverse C1 Start-End-to-Video API (Image to Video)Defining a clip by its first and last frames gives C1 a complete narrative arc to fill, and the model generates the connecting motion while keeping the series' storyboard-native visual language intact. Start and end images upload as URLs or Base64 in PNG, JPEG, or WebP, with durations of 1 to 15 seconds and a seed option for repeatable results. Episodic and multi-chapter productions use it to lock scene-to-scene transitions in place.
Pixverse C1 Reference-to-Video API (Reference to Video)For serialized content where a character must look identical from one episode to the next, this endpoint accepts up to seven tagged reference images and holds their appearance across every generated shot. Subject and background tags plus per-image reference names give the Pixverse API its most granular consistency control, layered on C1's multi-shot architecture. It is available on Atlas Cloud from $0.03 per second with one OpenAI-compatible key.

PixVerse 模型新功能 + 案例展示

將先進模型與 Atlas Cloud 的 GPU 加速平台相結合,為影像與影片生成帶來無與倫比的速度、可擴展性與創作掌控力。

動作與視覺特效場景

C1 專為處理最能暴露多數 AI 影片模型極限的場景而打造——近身格鬥動作設計、高速運動、粒子特效、流體動力學以及氛圍環境。空間關係與物理重量在各影格之間保持一致,減少動作類內容通常所需的修正工作量。它可在同一生成工作流程中同時支援寫實與風格化場景。

分鏡腳本直轉影片製作

PixVerse C1 可將靜態分鏡佈局直接轉換為連續的影片序列,並依提示詞結構自動完成場景切分。製作團隊上傳靜態分鏡畫面即可獲得多鏡頭序列,無需從零重建每個場景。這使 C1 成為電影工作室、動畫團隊以及依既定創意簡報作業的代理商的實用之選。

電影級運鏡控制

PixVerse V6 能精準渲染各類運鏡——跟拍鏡頭、視角切換與環境揭示——且幾乎不產生瑕疵。角色的情緒與肢體語言在場景切換中保持一致,使其能可靠支撐不只單一獨立片段的敘事序列。對行銷團隊和內容工作室而言,這意味著更少的手動修正,以及從簡報到成品更快的迭代速度。

七張參考圖控制

最多可將七張參考圖標註為主體或背景,為每張圖命名,並在提示詞中直接呼叫。人臉、產品和環境在每一影格中都保持原貌。

一次生成,聲畫俱全

想要聲音卻不想另建一條管線?V6 和 C1 都能在同一次生成中渲染同步音訊,預告片、廣告和社群短片從 API 輸出後即可直接發布。

一個 Pixverse API,適配所有螢幕尺寸

從 21:9 的寬銀幕畫幅到 9:16 的直式動態消息,八種長寬比和四檔解析度涵蓋電影、廣播和社群媒體輸出。草稿可選 360p,成品交付可選 1080p,生成後無需再裁切。

Pixverse API 支援 5,000 字元提示詞

單條提示詞最長可達 5,000 字元,足以在一次請求中指定鏡頭順序、燈光、服裝和節奏。詳盡的腳本能一次就生成符合簡報要求的素材。

Pixverse 對比其他模型 —— 同一條提示詞

同一條提示詞,由 Pixverse 與其他領先影片模型生成:多鏡頭、高階商業廣告片

提示詞

為一款豪華電動自行車製作一支 10 秒的電影級產品廣告。 場景 1(0–2 秒): 微距特寫:雨滴滑過霧面黑色車架。柔和的霓虹反光,淺景深,緩慢推進的鏡頭運動。細微的雨聲氛圍。 場景 2(2–5 秒): 低角度跟蹤鏡頭:自行車夜間駛過濕漉漉的城市街道,輪胎濺過淺淺的水窪。加入真實的輪胎濺水聲、輕柔的電動馬達嗡鳴聲和遠處的車流環境音。 場景 3(5–8 秒): 平滑的側面跟拍鏡頭:同一輛自行車從路燈下駛過。保持完全一致的車架幾何結構、車輪、車燈、顏色和比例。可控的動態模糊,高級商業廣告構圖。 場景 4(8–10 秒): 最終主鏡頭:自行車停在一棟玻璃建築旁。車燈柔和發光,雨水和霓虹反光自然淡出。產品置中、清晰銳利,呈現高階廣告質感。 要求: - 所有鏡頭中保持完全一致的自行車設計 - 使用清晰的電影級運鏡:微距特寫、低角度跟蹤、側面跟拍、最終主鏡頭 - 保持雨水、光線、反光和城市氛圍的一致性 - 音訊與動作同步:雨聲、輪胎濺水聲、電動馬達嗡鳴聲、城市環境音 - 不得出現變形的車輪、變化的車架結構或不一致的產品細節 - 真實材質,精緻的商業廣告片質感,1080p

Pixverse

Wan 2.7

Kling V3.0

提示詞

為一款放置在現代攝影棚桌面上的透明無線音箱製作一支 10 秒的電影級產品廣告。 場景 1(0–2 秒): 透明音箱外殼的微距特寫。透過透明外殼可以看到內部元件。柔和的攝影棚燈光,乾淨的反光,淺景深,緩慢推進的鏡頭運動。 場景 2(2–5 秒): 音箱開機。一圈低調的 LED 燈環從中心向外亮起。鏡頭圍繞產品進行平滑的環繞運鏡。加入柔和的開機提示音,以及與 LED 動畫同步的低頻低音脈衝。 場景 3(5–8 秒): 側面近景:透過旁邊一杯水的輕微振動來呈現聲波。音箱的形狀、尺寸、材質和內部佈局保持完全一致。乾淨的攝影棚背景,高級產品構圖。 場景 4(8–10 秒): 最終主鏡頭:透明音箱位於桌面中央,LED 燈環柔和發光,鏡頭緩緩後拉。極簡的未來感攝影棚,精緻的商業廣告質感。 要求: - 所有鏡頭中保持完全一致的音箱設計 - 使用電影級運鏡:微距特寫、平滑環繞、側面近景、最終主鏡頭後拉 - 保持攝影棚燈光、反光、透明質感和產品比例的一致性 - 音訊與動作同步:開機提示音、低音脈衝、細微振動 - 不得出現變化的內部元件、變形的透明外殼或位置不一致的 LED - 高階科技廣告風格,乾淨的構圖,真實材質,1080p

Pixverse

Wan 2.7

Kling V3.0

從單支短片到連載故事:Pixverse API 應用場景

無論是讓一張產品照動起來,還是執導多集連載影集,Atlas Cloud 上的 Pixverse API 都能涵蓋社群影片、電商動態、無縫轉場與長篇敘事,並採用透明的隨用隨付定價。

短影音社群內容

透過 Pixverse V6 的文字生成影片能力,把一句文字提示詞變成讓人停下滑動的直式短片。每天在 TikTok、Reels 與 Shorts 上發布內容的創作者,只需每秒 $0.025 就能讓動態牆保持新鮮。

用 Pixverse API 製作產品廣告

透過 V6 的圖片生成影片能力,靜態產品照可變成動感十足的主視覺短片,原有視覺識別在每一格畫面中都完整保留。電商團隊不必預約棚拍,就能把整個商品目錄製作成動態廣告。

角色連載敘事

需要同一位主角貫穿十集內容?C1 的參考圖生成影片能力可在片段之間鎖定角色外觀與場景環境,為動畫團隊、條漫工作室和 IP 擁有者提供可靠的連載製作流程。

透過 Pixverse API 實現無縫轉場

當兩張關鍵影格定義了你的鏡頭,start-end 端點會生成兩者之間的全部動態。精緻的場景切換、變形轉場的畫面揭示,以及可完美循環的背景視覺,全都不需任何手動關鍵影格作業。

由短片段剪出長內容

生成的片段很少需要止步於第一次剪輯,因為 V6 的 video-extend 端點能在保持動態與風格的前提下延續畫面。剪輯師把延長後的片段串接成預告片、音樂錄影帶和更長的段落。

基於 Pixverse API 打造影片應用

所有 V6 和 C1 端點都透過 Atlas Cloud 上同一組 OpenAI 相容金鑰呼叫,採隨用隨付計費,每秒 $0.025 起。開發者不必管理 GPU 基礎設施,就能為自家產品加入生產級影片生成能力。

PixVerse API 基準比較:V6 與 C1 在頂尖影片模型中的定位

在選定影片生成技術棧之前,先看看 PixVerse API 在輸入模式、解析度、片段長度、原生音訊和按秒計價方面與 Kling、Veo、Sora、Wan 的比較。

模型輸入模式最高解析度片段長度原生音訊Price per Second
PixVerse V6文字、圖片、參考圖、首尾影格、影片延長1080p1 至 15 秒From $0.025/s on Atlas Cloud
PixVerse C1文字、圖片、參考圖、首尾影格1080p1 至 15 秒From $0.03/s on Atlas Cloud
Kling 2.5 Turbo Pro文字、圖片1080p5 秒或 10 秒-About $0.07/s
Google Veo 3.1文字、圖片、參考圖、首尾影格最高 4K4 秒、6 秒或 8 秒$0.40/s (Fast from $0.10/s)
OpenAI Sora 2文字、圖片720p(Sora 2 Pro 為 1080p)4 秒、8 秒或 12 秒$0.10/s ($0.30/s for Pro)
Alibaba Wan 2.5文字、圖片、可選的音訊引導1080p5 秒或 10 秒From $0.05/s

如何在 Atlas Cloud 上使用 Pixverse

幾分鐘即可上手 — 按照以下簡單步驟,透過 Atlas Cloud 平台整合和部署模型。

建立 Atlas Cloud 帳戶

在 atlascloud.ai 註冊並完成驗證。新用戶可獲得免費額度,用於探索平台和測試模型。

為何在 Atlas Cloud 使用 Pixverse

將先進的 Pixverse 模型與 Atlas Cloud 的 GPU 加速平台相結合,提供無與倫比的效能、可擴展性和開發體驗。

效能與靈活性

低延遲:
GPU 最佳化推理,實現即時回應。

統一 API:
一次整合,暢用 Pixverse、GPT、Gemini 和 DeepSeek。

透明定價:
按 Token 計費,支援 Serverless 模式。

企業與規模

開發者體驗:
SDK、資料分析、微調工具和模板一應俱全。

可靠性:
99.99% 可用性、RBAC 權限控制、合規日誌。

安全與合規:
SOC 2 Type II 認證、HIPAA 合規、美國資料主權。

Pixverse API 常見問題解答

PixVerse API 透過 Atlas Cloud 為開發者提供對 PixVerse AI 影片生成模型的程式設計存取。與使用消耗每日點數、添加浮水印並限制解析度的 PixVerse 消費者應用程式不同,您可以直接透過 REST API 呼叫模型,並且只需為您生成的內容付費。

V6 是旗艦級通用系列,在單一流程中涵蓋文字生成影片、圖片生成影片、參考圖生成影片、首尾影格控制與影片延長。C1 則採用原生分鏡(storyboard)思維,專為多鏡頭敘事製作而生,鏡頭之間的場景連續性與角色一致性,和單一影格畫質同樣重要。在 Atlas Cloud 上,V6 端點每秒 $0.025 起,C1 端點每秒 $0.03 起。

採用量計費,無需訂閱。PixVerse V6 的全部五個端點依生成影片每秒 $0.025 起計費,C1 的全部四個端點每秒 $0.03 起。只需為實際生成的內容付費,每次請求的單次呼叫價格公開透明。

PixVerse 的所有生成端點均可輸出 360p、540p、720p 或 1080p,預設為 720p。片段長度可在 1 到 15 秒之間任選,並提供八種長寬比:16:9、9:16、1:1、4:3、3:4、2:3、3:2 和 21:9。從直式社群格式到 21:9 電影畫幅全數涵蓋,生成後無需任何裁切。

會。V6 和 C1 都會在同一次生成中輸出聲音,Pixverse API 提供 sound 參數且預設開啟。如果打算自行配樂,將其設為 false 即可。唯一的例外是 V6 的 Video-Extend 端點,它不提供音訊參數。

C1 讀取多格分鏡稿的方式,就像導演讀漫畫分頁:把每一格視為獨立鏡頭,並自動推斷鏡頭之間的轉場邏輯。輸出是一段角色一致、空間邏輯連貫的連續多鏡頭序列,團隊可以直接從定稿分鏡進入成片製作,無需逐場景重建。在文字生成影片端點上,鏡頭切分還可以直接由提示詞結構來控制。

V6 和 C1 的 Reference-to-Video 端點每次請求都可接受 1 到 7 張參考圖,每張圖可標記為主體(subject)或背景(background)參考。圖片可以用公開 URL 或 Base64 字串提供,支援 PNG、JPEG、WebP 格式,單次請求總大小上限為 20MB。帶標記的參考圖正是多鏡頭製作在各個片段之間鎖定角色身份的關鍵。

V6 的 Video-Extend 端點接收來源影片 URL 加一段文字提示詞,生成 1 到 15 秒的續接內容。運動連貫性和視覺風格會延續到擴展部分,因此無論是把片段拉長到超出原始長度,還是用多個素材拼接出連續內容,都很實用。計費與其他 V6 端點相同,均為每秒 $0.025。

註冊 Atlas Cloud 帳號,產生 API key,然後在 Authorization 請求標頭中帶上該 key 呼叫任意 PixVerse 端點即可。請求以非同步方式執行:提交生成任務後會取得一個 prediction ID,輪詢結果端點直到狀態變為 completed。無需架設任何基礎設施,Day-0 接入意味著 PixVerse 新版本一發布即可使用、無需遷移。今天就開始打造吧。

探索更多系列

Seedance 2.0

Seedance 2.0 API 為您提供 ByteDance 多模態影片模型的生產級存取權限——支援四模態輸入(文字、影像、影片、音訊),以及業界領先的「Universal Reference」(通用參考)系統,可在不同鏡頭間鎖定構圖、運鏡與角色動作。只需一次 API 呼叫即可整合導演級控制,固定費率為 $0.09/秒,即時取得金鑰,無需排隊——由企業級正常運行時間與合規性提供保障。Seedance 2.0 原生 4K 現已上線!

檢視系列

Grok Imagine

Grok Imagine API 為開發者提供 xAI 的圖像、影片和音訊生成一站式套件。它可以生成解析度高達 2K 且支援多語言文本渲染的圖像,以及長達 15 秒且帶有原生同步音訊和基於參考圖像編輯功能的影片。在 Atlas Cloud 上,只需一個金鑰即可執行每個 Grok Imagine 模式,因此您可以在圖像、影片和音訊之間無縫切換,無需單獨設定,每張圖像 0.02 美元起,每秒 0.05 美元起。

檢視系列

Gemini Omni Flash

Gemini Omni API 將 Google DeepMind 於 Google I/O 2026 發表的多模態影片生成與編輯模型帶進你的技術棧。Gemini Omni 將 Gemini 的推理引擎與生成式媒體融合,可接受文字、圖片、影片與音訊的任意組合輸入,產生一致且以知識為根據的輸出。透過自然對話持續打磨成果:替換物件、改寫場景、切換風格,同時維持物理規律、角色與畫面連貫性不變。Atlas Cloud 透過單一整合 API 提供完整的 Gemini Omni Flash 系列——文字生成影片、支援最多 7 張參考圖片的圖片生成影片,以及參考圖生成影片——採每秒計費、價格透明,$0.112 起,無需訂閱。立即開始打造。

檢視系列

GPT Image 2

GPT Image 2 API 為開發者提供了訪問 OpenAI 最新圖像模型的途徑,它是 GPT Image 1.5 的繼任者。該模型可生成和編輯圖像,能夠在拉丁和 CJK 文字上實現準確的文本渲染,並在海報、樣機和資訊圖表方面具備強大的排版能力。在 Atlas Cloud 上,您可以透過一個統一的 API 與 300 多個模型一起訪問它,並享受免費額度、99.99% 的正常運行時間,且無需 OpenAI 組織驗證。

檢視系列

Google

Google最強大的創意模型現已在Atlas Cloud上全面可用。Veo 3.1提供電影等級的影片生成,Nano Banana 2支援高保真圖像建立,而Gemini為每個工作流程帶來多模態智慧。透過單一API key即可存取完整的Google模型套件,提供Day-0可用性和隨用隨付(pay-as-you-go)定價。

檢視系列

Seedance 2.0 Mini

Seedance 2.0 Mini 將 ByteDance 的多模態影片生成技術引入到對速度和成本要求極高的工作流程中。它以更輕量的佔用空間提供 Seedance 2.0 的核心能力——更快的生成速度、更低的單支影片成本,並且使用您現有的同款 API 整合。對於運行高吞吐量流水線或進行大規模原型設計的團隊來說,Mini 是最實用的預設選擇。

檢視系列

ByteDance

從電影級影片生成到高保真影像建立,ByteDance 最強大的模型現已在 Atlas Cloud 上線。以最低的推論定價和零基礎設施開銷,大規模執行 Seedance 和 Seedream。

檢視系列

Alibaba

Atlas Cloud 將 Alibaba 的全系模型陣容整合至同一個 API 中:Qwen 適用於語言和圖像任務,Wan 適用於高達 1080p 的影片生成。所有模型均採用按需付費模式,無需訂閱。您可以使用現有的 OpenAI 兼容客戶端,透過單一的 base URL 存取 Alibaba API。

檢視系列

OpenAI

Atlas Cloud 為您提供存取完整 OpenAI API 產品線的權限,從用於圖像生成的 GPT Image 2 到用於影片的 Sora 2。每個模型均採用按需付費模式,無月度消費限制。使用相容 OpenAI 的 API,只需簡單替換基礎 URL 即可輕鬆接入。

檢視系列

xAI

在 Atlas Cloud 上使用 xAI API 建構完整的影像與影片處理管線。以 2K 解析度生成、使用參考影像進行編輯,並將影像動畫化為音訊同步的影片片段。

檢視系列

Kwaivgi

Kwaivgi API 價格低於標準定價 15%。Atlas Cloud 提供對最新 Kling 版本的零日(Day-0)存取權限,採用按需付費定價且無席位限制。一個帳戶,一個金鑰,暢享從標準版到大師版的所有 Kling 模型。

檢視系列

Seedream 5.0 Pro

Seedream 5.0 Pro API 為開發者在 Atlas Cloud 上提供了字節跳動的可控圖像編輯模型。它透過錨點和座標精確定位編輯,將圖像分離為可編輯圖層,融合多個參考,並精準匹配顏色和材質,支援 2K 和 3K 解析度的多語言文本。在 Atlas Cloud 上,您只需一個金鑰即可存取!

檢視系列

一個 API,暢享全模態 AI。

探索全部模型