Pixverse API는 개발자에게 AISphere의 비디오 생성 모델에 대한 직접적인 액세스를 제공합니다. V6는 텍스트-비디오, 이미지-비디오, 참조 안내 생성, 시작 및 종료 프레임 제어, 단일 파이프라인에서의 클립 확장을 지원하며, C1은 스토리보드를 컷 간 캐릭터와 장면의 일관성을 유지하는 다중 샷 시퀀스로 변환합니다. Atlas Cloud는 투명한 초당 요금제와 인프라 설정 없이 두 시리즈 모두를 서비스합니다. 오늘 바로 구축을 시작해 보세요.
Atlas Cloud는 업계 최고의 최신 크리에이티브 모델을 제공합니다.
단일 텍스트 프롬프트부터 7개의 이미지 참조 제어에 이르기까지, 각 Pixverse API 엔드포인트의 입력 항목, 생성 결과 및 Atlas Cloud에서의 비용을 확인해 보세요.
| Modality | Description |
|---|---|
| Pixverse V6 Text-to-Video API (Text to Video) | Describe a scene in up to 5,000 characters and V6 renders it as a video of 1 to 15 seconds, at up to 1080p, with audio generated in the same pass. Eight aspect ratios from 21:9 cinematic to 9:16 vertical cover film, social, and ad formats without post-cropping. Pricing on Atlas Cloud starts at $0.025 per second. |
| Pixverse V6 Image-to-Video API (Image to Video) | A single still image is all this endpoint needs to produce a motion clip that preserves the source's visual identity, guided by a text prompt of up to 5,000 characters. It accepts JPG and PNG inputs up to 10MB with aspect ratios from 1:2.5 to 2.5:1, so portraits, product shots, and wide banners all animate without reformatting. Optional native audio and a seed parameter make outputs repeatable for production pipelines. |
| Pixverse V6 Start-End-to-Video API (Image to Video) | When a clip has to land on an exact final frame, this endpoint takes both a start image and an end image and generates all the motion in between. Frames can be passed as public URLs or Base64 in PNG, JPEG, or WebP, and clips run 1 to 15 seconds at up to 1080p. That makes it the natural pick for scene transitions, loopable content, and shots with a fixed visual destination. |
| Pixverse V6 Reference-to-Video API (Reference to Video) | Up to seven reference images steer each generation, and every image can be tagged as subject or background and given its own reference name for prompt-level control. V6 keeps character appearance and scene context stable across the clip, which removes manual keyframing from character-driven and brand-consistent work. Output supports the full range of eight aspect ratios and resolutions up to 1080p. |
| Pixverse V6 Video-Extend API (Video to Video) | Need a clip to run longer than its original cut? Pass a source video URL plus a text prompt and V6 continues the footage for another 1 to 15 seconds, preserving the established motion and visual style. At $0.025 per second on Atlas Cloud, extending a scene costs the same as generating one from scratch. |
| Pixverse C1 Text-to-Video API (Text to Video) | C1 treats text-to-video as a storyboard problem, generating clips built for multi-shot narrative continuity rather than isolated standalone shots. Prompts up to 5,000 characters drive videos of 1 to 15 seconds with native audio, eight aspect ratio options, and quality up to 1080p. Atlas Cloud prices the C1 series from $0.03 per second on a pay-as-you-go basis. |
| Pixverse C1 Image-to-Video API (Image to Video) | Feed C1 a still image and it returns a video sequence in which character and scene fidelity hold from the first frame to the last. Inputs follow the same practical limits as V6, JPG or PNG up to 10MB with aspect ratios from 1:2.5 to 2.5:1, so existing assets drop straight in. Its storyboard-aware design suits multi-scene projects where identity drift between shots is not acceptable. |
| Pixverse C1 Start-End-to-Video API (Image to Video) | Defining a clip by its first and last frames gives C1 a complete narrative arc to fill, and the model generates the connecting motion while keeping the series' storyboard-native visual language intact. Start and end images upload as URLs or Base64 in PNG, JPEG, or WebP, with durations of 1 to 15 seconds and a seed option for repeatable results. Episodic and multi-chapter productions use it to lock scene-to-scene transitions in place. |
| Pixverse C1 Reference-to-Video API (Reference to Video) | For serialized content where a character must look identical from one episode to the next, this endpoint accepts up to seven tagged reference images and holds their appearance across every generated shot. Subject and background tags plus per-image reference names give the Pixverse API its most granular consistency control, layered on C1's multi-shot architecture. It is available on Atlas Cloud from $0.03 per second with one OpenAI-compatible key. |
고급 모델과 Atlas Cloud의 GPU 가속 플랫폼을 결합하여 이미지 및 영상 생성에서 타의 추종을 불허하는 속도, 확장성, 창의적 제어를 제공합니다.
C1은 대부분의 AI 영상 모델의 한계를 드러내는 시퀀스, 즉 근접 전투 안무, 고속 모션, 파티클 효과, 유체 역학, 분위기 있는 환경을 처리하도록 설계되었습니다. 공간 관계와 물리적 무게감이 프레임 전반에 걸쳐 일관되게 유지되어 액션 콘텐츠에 일반적으로 필요한 수정 작업을 줄여 줍니다. 단일 생성 워크플로 안에서 사실적인 장면과 양식화된 장면을 모두 지원합니다.
PixVerse C1은 정적인 스토리보드 레이아웃을 연속적인 영상 시퀀스로 바로 변환하며, 장면 분할은 프롬프트 구조에 따라 자동으로 처리됩니다. 프로덕션 팀은 스틸 패널을 업로드하기만 하면 각 장면을 처음부터 다시 만들 필요 없이 멀티샷 시퀀스를 받을 수 있습니다. 덕분에 C1은 이미 승인된 크리에이티브 브리프를 바탕으로 작업하는 영화 스튜디오, 애니메이션 팀, 에이전시에 실용적인 선택지입니다.
PixVerse V6는 트래킹 샷, 시점 전환, 환경을 드러내는 연출 등 카메라 움직임을 정밀하게, 아티팩트를 최소화하며 렌더링합니다. 장면이 바뀌어도 캐릭터의 감정과 몸짓이 일관되게 유지되어, 단일 클립 이상의 서사 시퀀스에도 믿고 쓸 수 있습니다. 마케팅 팀과 콘텐츠 스튜디오에게는 수작업 수정이 줄고 브리프에서 최종 결과물까지의 반복 작업이 빨라진다는 뜻입니다.
최대 7장의 참조 이미지를 피사체 또는 배경으로 태그하고, 각각에 이름을 붙여 프롬프트에서 바로 호출할 수 있습니다. 얼굴, 제품, 환경이 모든 프레임에서 원래 모습 그대로 유지됩니다.
별도의 파이프라인 없이 소리까지 원하시나요? V6와 C1 모두 같은 생성 과정에서 동기화된 오디오를 렌더링하므로, 트레일러, 광고, 소셜 클립이 API에서 나오는 즉시 게시할 수 있는 상태가 됩니다.
21:9 시네마틱 프레임부터 9:16 세로형 피드까지, 8가지 화면비와 4단계 해상도가 영화, 방송, 소셜 미디어 출력을 모두 아우릅니다. 초안에는 360p, 최종 납품에는 1080p를 선택하면 되고, 생성 후 별도의 크롭이 필요 없습니다.
프롬프트 하나에 최대 5,000자까지 담을 수 있어, 한 번의 요청으로 샷 순서, 조명, 의상, 페이스까지 지정하기에 충분합니다. 상세한 스크립트는 첫 번째 시도부터 브리프에 부합하는 영상으로 이어집니다.
동일한 프롬프트를 Pixverse와 다른 주요 비디오 모델로 생성: 멀티숏 하이엔드 광고 영상
고급 전기 자전거를 위한 10초 분량의 시네마틱 제품 광고를 제작하세요. 장면 1(0~2초): 무광 블랙 자전거 프레임 위로 미끄러지는 빗방울의 매크로 클로즈업. 부드러운 네온 반사, 얕은 심도, 느린 푸시인 카메라 움직임. 은은한 빗소리 앰비언스. 장면 2(2~5초): 밤에 젖은 도심 거리를 달리는 자전거를 로우앵글 트래킹 숏으로 촬영. 타이어가 얕은 물웅덩이를 지나며 물을 튀긴다. 사실적인 타이어 물튀김 소리, 부드러운 전기 모터의 웅웅거림, 멀리서 들리는 차량 소음을 추가. 장면 3(5~8초): 가로등 아래를 지나가는 같은 자전거를 부드러운 사이드 팔로우 숏으로 촬영. 프레임 형상, 바퀴, 헤드라이트, 색상, 비율을 완전히 동일하게 유지. 절제된 모션 블러, 프리미엄 광고 구도. 장면 4(8~10초): 마지막 히어로 숏: 자전거가 유리 건물 옆에 멈춘다. 헤드라이트가 은은하게 빛나고, 비와 네온 반사가 자연스럽게 사라진다. 제품을 중앙에 배치, 선명하고 하이엔드한 광고 룩. 요구 사항: - 모든 숏에서 자전거 디자인을 완전히 동일하게 유지 - 명확한 시네마틱 카메라 컨트롤 사용: 매크로 클로즈업, 로우앵글 트래킹, 사이드 팔로우, 마지막 히어로 숏 - 비, 조명, 반사, 도시 분위기의 일관성 유지 - 오디오를 움직임과 동기화: 빗소리, 타이어 물튀김, 전기 모터 소리, 도시 앰비언스 - 휘어진 바퀴, 변하는 프레임 구조, 일관성 없는 제품 디테일 금지 - 사실적인 재질, 완성도 높은 광고 필름 룩, 1080p
Pixverse
Wan 2.7
Kling V3.0
모던한 스튜디오 테이블 위 투명 무선 스피커를 위한 10초 분량의 시네마틱 제품 광고를 제작하세요. 장면 1(0~2초): 투명한 스피커 케이스의 매크로 클로즈업. 투명한 외피를 통해 내부 부품이 보인다. 부드러운 스튜디오 조명, 깨끗한 반사, 얕은 심도, 느린 푸시인 카메라 움직임. 장면 2(2~5초): 스피커의 전원이 켜진다. 은은한 LED 링이 중심에서 바깥쪽으로 점등된다. 카메라가 제품 주위를 부드럽게 도는 오빗 숏을 수행. LED 애니메이션과 동기화된 부드러운 시작음과 낮은 베이스 펄스를 추가. 장면 3(5~8초): 측면 클로즈 숏: 옆에 놓인 물잔의 잔잔한 진동으로 음파를 시각화한다. 스피커는 형태, 크기, 재질, 내부 배치가 완전히 동일하게 유지된다. 깨끗한 스튜디오 배경, 프리미엄 제품 구도. 장면 4(8~10초): 마지막 히어로 숏: 투명 스피커가 테이블 중앙에 놓이고, LED 링이 은은하게 빛나며, 카메라가 천천히 뒤로 빠진다. 미니멀한 미래적 스튜디오, 완성도 높은 광고 룩. 요구 사항: - 모든 숏에서 스피커 디자인을 완전히 동일하게 유지 - 시네마틱 카메라 컨트롤 사용: 매크로 클로즈업, 부드러운 오빗, 측면 클로즈업, 마지막 히어로 풀백 - 스튜디오 조명, 반사, 투명도, 제품 크기의 일관성 유지 - 오디오를 동작과 동기화: 시작음, 베이스 펄스, 미세한 진동 - 내부 부품 변경, 왜곡된 투명 케이스, 일관성 없는 LED 위치 금지 - 하이엔드 테크 광고 스타일, 깔끔한 구도, 사실적인 재질, 1080p
Pixverse
Wan 2.7
Kling V3.0
제품 사진 한 장을 애니메이션으로 만들든 여러 에피소드로 구성된 시리즈를 연출하든, Atlas Cloud의 Pixverse API는 소셜 영상, 이커머스 모션, 매끄러운 전환, 장편 스토리텔링까지 투명한 종량제 요금으로 지원합니다.
Pixverse V6의 텍스트-투-비디오 생성으로 텍스트 프롬프트 하나를 스크롤을 멈추게 하는 세로형 클립으로 만들어 보세요. TikTok, Reels, Shorts에 매일 게시하는 크리에이터는 초당 $0.025로 피드를 신선하게 유지합니다.
V6의 이미지-투-비디오를 통해 정적인 제품 사진이 움직임이 풍부한 히어로 클립으로 바뀌며, 원본의 비주얼 아이덴티티가 프레임 단위로 그대로 유지됩니다. 이커머스 팀은 스튜디오 촬영 예약 없이 전체 카탈로그를 광고로 애니메이션화합니다.
열 개의 에피소드에 걸쳐 같은 주인공이 필요하신가요? C1의 레퍼런스-투-비디오는 클립마다 캐릭터의 외형과 배경을 고정해, 애니메이션 팀, 웹툰 스튜디오, IP 보유자에게 믿을 수 있는 시리즈 제작 파이프라인을 제공합니다.
두 개의 키프레임으로 숏을 정의하면 start-end 엔드포인트가 그 사이의 모든 움직임을 생성합니다. 세련된 장면 전환, 모핑 연출, 완벽하게 루프되는 배경 비주얼을 수작업 키프레임 작업 없이 얻을 수 있습니다.
V6의 video-extend 엔드포인트가 움직임과 스타일을 유지하면서 영상을 이어서 생성하므로, 생성된 클립이 첫 번째 컷에서 끝날 필요는 거의 없습니다. 편집자는 연장된 세그먼트를 이어 붙여 예고편, 뮤직비디오, 더 긴 시퀀스를 만듭니다.
모든 V6 및 C1 엔드포인트는 Atlas Cloud의 OpenAI 호환 키 하나로 이용할 수 있으며, 초당 $0.025부터 시작하는 종량제로 과금됩니다. 개발자는 GPU 인프라를 관리하지 않고도 프로덕션급 비디오 생성을 자사 제품에 추가할 수 있습니다.
비디오 생성 스택을 선택하기 전에, 입력 모드, 해상도, 클립 길이, 네이티브 오디오, 초당 요금 측면에서 PixVerse API가 Kling, Veo, Sora, Wan과 어떻게 비교되는지 확인해 보세요.
| 모델 | 입력 모드 | 최대 해상도 | 클립 길이 | 네이티브 오디오 | Price per Second |
|---|---|---|---|---|---|
| PixVerse V6 | 텍스트, 이미지, 참조 이미지, 시작 및 종료 프레임, 비디오 연장 | 1080p | 1~15초 | √ | From $0.025/s on Atlas Cloud |
| PixVerse C1 | 텍스트, 이미지, 참조 이미지, 시작 및 종료 프레임 | 1080p | 1~15초 | √ | From $0.03/s on Atlas Cloud |
| Kling 2.5 Turbo Pro | 텍스트, 이미지 | 1080p | 5초 또는 10초 | - | About $0.07/s |
| Google Veo 3.1 | 텍스트, 이미지, 참조 이미지, 첫 프레임 및 마지막 프레임 | 최대 4K | 4초, 6초 또는 8초 | √ | $0.40/s (Fast from $0.10/s) |
| OpenAI Sora 2 | 텍스트, 이미지 | 720p (Sora 2 Pro에서는 1080p) | 4초, 8초 또는 12초 | √ | $0.10/s ($0.30/s for Pro) |
| Alibaba Wan 2.5 | 텍스트, 이미지, 선택적 오디오 가이드 | 1080p | 5초 또는 10초 | √ | From $0.05/s |
몇 분 만에 시작하세요 — 간단한 단계를 따라 Atlas Cloud 플랫폼을 통해 모델을 통합하고 배포하세요.
atlascloud.ai에서 가입하고 인증을 완료하세요. 신규 사용자는 플랫폼 탐색과 모델 테스트를 위한 무료 크레딧을 받습니다.
고급 Pixverse 모델과 Atlas Cloud의 GPU 가속 플랫폼을 결합하여 비교할 수 없는 성능, 확장성 및 개발자 경험을 제공합니다.
낮은 지연 시간:
실시간 추론을 위한 GPU 최적화 추론.
통합 API:
하나의 통합으로 Pixverse, GPT, Gemini 및 DeepSeek를 실행합니다.
투명한 가격:
Serverless 옵션을 포함한 예측 가능한 token당 청구.
개발자 경험:
SDK, 분석, 파인튜닝 도구 및 템플릿.
신뢰성:
99.99% 가동 시간, RBAC 및 규정 준수 로깅.
보안 및 규정 준수:
SOC 2 Type II, HIPAA 준수, 미국 내 데이터 주권.
PixVerse API는 개발자가 Atlas Cloud를 통해 PixVerse의 AI 비디오 생성 모델에 프로그래밍 방식으로 액세스할 수 있도록 지원합니다. 일일 크레딧으로 실행되고 워터마크가 추가되며 해상도가 제한되는 PixVerse 소비자 앱을 사용하는 대신, REST API를 통해 직접 모델을 호출하고 생성한 만큼만 비용을 지불하면 됩니다.
V6는 플래그십 범용 시리즈로, 텍스트-투-비디오, 이미지-투-비디오, 레퍼런스-투-비디오, 시작·종료 프레임 제어, 비디오 연장을 하나의 파이프라인에서 모두 지원합니다. C1은 스토리보드 네이티브 방식을 채택해 멀티샷 내러티브 제작에 맞게 설계되었으며, 컷 사이의 장면 연속성과 캐릭터 일관성이 단일 프레임 품질만큼 중요한 작업에 적합합니다. Atlas Cloud에서 V6 엔드포인트는 초당 $0.025부터, C1 엔드포인트는 초당 $0.03부터 이용할 수 있습니다.
요금은 구독 없이 사용한 만큼만 내는 종량제입니다. PixVerse V6의 5개 엔드포인트는 모두 생성된 영상 초당 $0.025부터, C1의 4개 엔드포인트는 초당 $0.03부터 과금됩니다. 생성한 만큼만 비용을 지불하며, 모든 요청에 대해 호출별 요금이 투명하게 공개됩니다.
PixVerse의 모든 생성 엔드포인트는 360p, 540p, 720p, 1080p로 출력하며 기본값은 720p입니다. 클립 길이는 1초에서 15초까지 지정할 수 있고, 화면 비율은 16:9, 9:16, 1:1, 4:3, 3:4, 2:3, 3:2, 21:9의 8가지를 지원합니다. 세로형 소셜 포맷부터 21:9 시네마틱 프레임까지 생성 후 크롭 없이 모두 커버할 수 있는 범위입니다.
네. V6와 C1 모두 동일한 생성 과정에서 사운드를 함께 만들어내며, Pixverse API는 기본적으로 활성화된 sound 파라미터를 제공합니다. 클립에 직접 음악을 입힐 계획이라면 false로 설정하세요. 유일한 예외는 V6 Video-Extend 엔드포인트로, 오디오 파라미터를 제공하지 않습니다.
C1은 감독이 만화 페이지를 읽듯 멀티 패널 스토리보드 레이아웃을 읽습니다. 각 패널을 별도의 샷으로 처리하고 패널 사이의 전환 논리를 스스로 추론합니다. 결과물은 캐릭터와 공간 논리가 일관되게 유지되는 연속적인 멀티샷 시퀀스이므로, 팀은 승인된 스토리보드에서 장면을 다시 만들 필요 없이 곧바로 영상으로 넘어갈 수 있습니다. 텍스트-투-비디오 엔드포인트에서는 프롬프트 구조만으로 샷 분할을 직접 제어할 수도 있습니다.
V6와 C1의 Reference-to-Video 엔드포인트는 모두 요청당 1~7장의 참조 이미지를 받으며, 각 이미지는 피사체(subject) 또는 배경(background) 참조로 태그할 수 있습니다. 이미지는 공개 URL 또는 Base64 문자열로 전달할 수 있고 PNG, JPEG, WebP 형식을 지원하며, 요청 전체 크기는 20MB로 제한됩니다. 태그된 참조 이미지야말로 멀티샷 제작에서 클립마다 캐릭터의 정체성을 고정해 주는 수단입니다.
V6 Video-Extend 엔드포인트는 원본 영상 URL과 텍스트 프롬프트를 받아 1~15초 분량의 후속 영상을 생성합니다. 모션의 연속성과 비주얼 스타일이 연장 구간까지 이어지므로, 클립을 원래 길이보다 늘리거나 여러 소스로 이어지는 콘텐츠를 만들 때 실용적입니다. 요금은 다른 V6 엔드포인트와 동일하게 초당 $0.025로 과금됩니다.
Atlas Cloud 계정을 만들고 API 키를 발급받은 뒤, 그 키를 Authorization 헤더에 넣어 아무 PixVerse 엔드포인트나 호출하면 됩니다. 요청은 비동기로 처리됩니다. 생성 요청을 제출하면 prediction ID를 받게 되고, 상태가 completed가 될 때까지 결과 엔드포인트를 폴링하면 됩니다. 별도로 구축할 인프라가 없으며, Day-0 액세스 덕분에 PixVerse의 새 릴리스도 마이그레이션 없이 바로 사용할 수 있습니다. 오늘 바로 시작해 보세요.