Pixverse API ช่วยให้นักพัฒนาสามารถเข้าถึงโมเดลการสร้างวิดีโอของ AISphere ได้โดยตรง V6 ครอบคลุมการแปลงข้อความเป็นวิดีโอ การแปลงรูปภาพเป็นวิดีโอ การสร้างตามอ้างอิง การควบคุมเฟรมเริ่มต้นและสิ้นสุด และการขยายคลิปในไปป์ไลน์เดียว ในขณะที่ C1 จะเปลี่ยนสตอรีบอร์ดให้เป็นลำดับหลายช็อตที่รักษาตัวละครและฉากให้สอดคล้องกันตลอดการตัดต่อ Atlas Cloud ให้บริการทั้งสองซีรีส์ด้วยการกำหนดราคาต่อวินาทีที่โปร่งใสและไม่มีการตั้งค่าโครงสร้างพื้นฐาน เริ่มต้นสร้างได้แล้ววันนี้
Atlas Cloud มอบโมเดลสร้างสรรค์ล่าสุดที่นำหน้าในอุตสาหกรรมให้กับคุณ
ดูว่าแต่ละ endpoint ของ Pixverse API รับข้อมูลเข้าใดบ้าง สร้างอะไรออกมา และมีค่าใช้จ่ายเท่าใดบน Atlas Cloud ตั้งแต่พรอมต์ข้อความเดี่ยวไปจนถึงการควบคุมการอ้างอิงด้วยเจ็ดรูปภาพ
| Modality | Description |
|---|---|
| Pixverse V6 Text-to-Video API (Text to Video) | Describe a scene in up to 5,000 characters and V6 renders it as a video of 1 to 15 seconds, at up to 1080p, with audio generated in the same pass. Eight aspect ratios from 21:9 cinematic to 9:16 vertical cover film, social, and ad formats without post-cropping. Pricing on Atlas Cloud starts at $0.025 per second. |
| Pixverse V6 Image-to-Video API (Image to Video) | A single still image is all this endpoint needs to produce a motion clip that preserves the source's visual identity, guided by a text prompt of up to 5,000 characters. It accepts JPG and PNG inputs up to 10MB with aspect ratios from 1:2.5 to 2.5:1, so portraits, product shots, and wide banners all animate without reformatting. Optional native audio and a seed parameter make outputs repeatable for production pipelines. |
| Pixverse V6 Start-End-to-Video API (Image to Video) | When a clip has to land on an exact final frame, this endpoint takes both a start image and an end image and generates all the motion in between. Frames can be passed as public URLs or Base64 in PNG, JPEG, or WebP, and clips run 1 to 15 seconds at up to 1080p. That makes it the natural pick for scene transitions, loopable content, and shots with a fixed visual destination. |
| Pixverse V6 Reference-to-Video API (Reference to Video) | Up to seven reference images steer each generation, and every image can be tagged as subject or background and given its own reference name for prompt-level control. V6 keeps character appearance and scene context stable across the clip, which removes manual keyframing from character-driven and brand-consistent work. Output supports the full range of eight aspect ratios and resolutions up to 1080p. |
| Pixverse V6 Video-Extend API (Video to Video) | Need a clip to run longer than its original cut? Pass a source video URL plus a text prompt and V6 continues the footage for another 1 to 15 seconds, preserving the established motion and visual style. At $0.025 per second on Atlas Cloud, extending a scene costs the same as generating one from scratch. |
| Pixverse C1 Text-to-Video API (Text to Video) | C1 treats text-to-video as a storyboard problem, generating clips built for multi-shot narrative continuity rather than isolated standalone shots. Prompts up to 5,000 characters drive videos of 1 to 15 seconds with native audio, eight aspect ratio options, and quality up to 1080p. Atlas Cloud prices the C1 series from $0.03 per second on a pay-as-you-go basis. |
| Pixverse C1 Image-to-Video API (Image to Video) | Feed C1 a still image and it returns a video sequence in which character and scene fidelity hold from the first frame to the last. Inputs follow the same practical limits as V6, JPG or PNG up to 10MB with aspect ratios from 1:2.5 to 2.5:1, so existing assets drop straight in. Its storyboard-aware design suits multi-scene projects where identity drift between shots is not acceptable. |
| Pixverse C1 Start-End-to-Video API (Image to Video) | Defining a clip by its first and last frames gives C1 a complete narrative arc to fill, and the model generates the connecting motion while keeping the series' storyboard-native visual language intact. Start and end images upload as URLs or Base64 in PNG, JPEG, or WebP, with durations of 1 to 15 seconds and a seed option for repeatable results. Episodic and multi-chapter productions use it to lock scene-to-scene transitions in place. |
| Pixverse C1 Reference-to-Video API (Reference to Video) | For serialized content where a character must look identical from one episode to the next, this endpoint accepts up to seven tagged reference images and holds their appearance across every generated shot. Subject and background tags plus per-image reference names give the Pixverse API its most granular consistency control, layered on C1's multi-shot architecture. It is available on Atlas Cloud from $0.03 per second with one OpenAI-compatible key. |
การผสานโมเดลขั้นสูงเข้ากับแพลตฟอร์มเร่งความเร็วด้วย GPU ของ Atlas Cloud มอบความเร็ว ความสามารถในการขยายระบบ และการควบคุมเชิงสร้างสรรค์ที่เหนือชั้นสำหรับการสร้างภาพและวิดีโอ
C1 ถูกสร้างมาเพื่อรับมือกับซีเควนซ์ที่เผยขีดจำกัดของโมเดลวิดีโอ AI ส่วนใหญ่ ไม่ว่าจะเป็นการออกแบบท่าต่อสู้ระยะประชิด การเคลื่อนไหวความเร็วสูง เอฟเฟกต์อนุภาค พลศาสตร์ของไหล และสภาพแวดล้อมที่เต็มไปด้วยบรรยากาศ ความสัมพันธ์เชิงพื้นที่และน้ำหนักทางกายภาพยังคงสม่ำเสมอในทุกเฟรม ช่วยลดภาระการแก้ไขที่คอนเทนต์แอ็กชันมักต้องการ อีกทั้งยังรองรับทั้งฉากสมจริงและฉากสไตล์เฉพาะตัวภายในเวิร์กโฟลว์การสร้างเดียว
PixVerse C1 แปลงเลย์เอาต์สตอรีบอร์ดแบบนิ่งให้เป็นซีเควนซ์วิดีโอต่อเนื่องได้โดยตรง โดยการแบ่งฉากจะถูกจัดการอัตโนมัติตามโครงสร้างของพรอมต์ ทีมโปรดักชันสามารถอัปโหลดภาพนิ่งแต่ละช่องแล้วรับซีเควนซ์แบบหลายช็อตได้ทันที โดยไม่ต้องสร้างแต่ละฉากขึ้นใหม่ตั้งแต่ต้น จึงทำให้ C1 เป็นตัวเลือกที่ใช้งานได้จริงสำหรับสตูดิโอภาพยนตร์ ทีมแอนิเมชัน และเอเจนซีที่ทำงานตามบรีฟครีเอทีฟที่ได้รับอนุมัติแล้ว
PixVerse V6 เรนเดอร์การเคลื่อนกล้อง ไม่ว่าจะเป็นช็อตติดตาม การเปลี่ยนมุมมอง และการเผยสภาพแวดล้อม ได้อย่างแม่นยำและมีอาร์ทิแฟกต์น้อยที่สุด อารมณ์และภาษากายของตัวละครคงความสม่ำเสมอแม้เปลี่ยนฉาก จึงเชื่อถือได้สำหรับซีเควนซ์เชิงเล่าเรื่องที่ต้องการมากกว่าคลิปเดี่ยว ๆ สำหรับทีมการตลาดและสตูดิโอคอนเทนต์ นี่หมายถึงการแก้ไขด้วยมือที่น้อยลง และการทำซ้ำจากบรีฟถึงงานขั้นสุดท้ายที่เร็วขึ้น
แท็กภาพอ้างอิงได้สูงสุด 7 ภาพเป็นตัวแบบหรือฉากหลัง ตั้งชื่อให้แต่ละภาพ แล้วเรียกใช้ได้โดยตรงในพรอมต์ ใบหน้า ผลิตภัณฑ์ และสภาพแวดล้อมจะคงรูปลักษณ์เดิมทุกประการในทุกเฟรม
อยากได้เสียงโดยไม่ต้องมีไปป์ไลน์แยกต่างหากใช่ไหม ทั้ง V6 และ C1 เรนเดอร์เสียงที่ซิงก์กับภาพในการประมวลผลครั้งเดียวกัน ทำให้ตัวอย่างหนัง โฆษณา และคลิปโซเชียลออกจาก API ในสภาพพร้อมเผยแพร่ทันที
ตั้งแต่เฟรมภาพยนตร์ 21:9 ไปจนถึงฟีดแนวตั้ง 9:16 อัตราส่วนภาพ 8 แบบและระดับความละเอียด 4 ระดับครอบคลุมงานภาพยนตร์ งานออกอากาศ และโซเชียลมีเดีย เลือก 360p สำหรับฉบับร่าง หรือ 1080p สำหรับส่งมอบงานขั้นสุดท้าย โดยไม่ต้องครอบตัดหลังการสร้าง
พรอมต์เดียวสามารถยาวได้ถึง 5,000 อักขระ เพียงพอที่จะระบุลำดับช็อต แสง เสื้อผ้า และจังหวะในคำขอเดียว สคริปต์ที่ละเอียดจะกลายเป็นฟุตเทจที่ตรงตามบรีฟตั้งแต่ครั้งแรก
พรอมป์ตเดียวกัน สร้างด้วย Pixverse และโมเดลวิดีโอชั้นนำอื่น ๆ: งานหลายช็อตและภาพยนตร์โฆษณาระดับไฮเอนด์
สร้างภาพยนตร์โฆษณาสินค้าแนวซีเนมาติกความยาว 10 วินาที สำหรับจักรยานไฟฟ้าหรู ฉากที่ 1 (0–2 วินาที): ภาพโคลสอัประยะมาโครของหยดฝนที่ไหลผ่านเฟรมจักรยานสีดำด้าน แสงสะท้อนนีออนนุ่มนวล ระยะชัดตื้น กล้องเคลื่อนเข้าหาช้า ๆ พร้อมเสียงบรรยากาศฝนแผ่วเบา ฉากที่ 2 (2–5 วินาที): ช็อตแทร็กกิงมุมต่ำขณะจักรยานแล่นผ่านถนนในเมืองที่เปียกฝนยามค่ำคืน ยางรถสาดน้ำผ่านแอ่งน้ำตื้น ๆ เพิ่มเสียงน้ำกระเซ็นจากยางที่สมจริง เสียงหึ่งเบา ๆ ของมอเตอร์ไฟฟ้า และเสียงบรรยากาศการจราจรไกล ๆ ฉากที่ 3 (5–8 วินาที): ช็อตติดตามด้านข้างอย่างลื่นไหลของจักรยานคันเดิมขณะแล่นผ่านใต้เสาไฟถนน คงรูปทรงเฟรม ล้อ ไฟหน้า สี และสัดส่วนให้เหมือนเดิมทุกประการ โมชันเบลอร์ที่ควบคุมได้ดี การจัดเฟรมแบบโฆษณาระดับพรีเมียม ฉากที่ 4 (8–10 วินาที): ฮีโร่ช็อตปิดท้าย: จักรยานจอดข้างอาคารกระจก ไฟหน้าเรืองแสงนุ่มนวล แสงสะท้อนของฝนและนีออนค่อย ๆ จางหายอย่างเป็นธรรมชาติ สินค้าอยู่กึ่งกลางภาพ คมชัด ให้ลุคโฆษณาระดับไฮเอนด์ ข้อกำหนด: - คงดีไซน์จักรยานให้เหมือนเดิมทุกประการในทุกช็อต - ใช้การควบคุมกล้องแบบซีเนมาติกที่ชัดเจน: โคลสอัปมาโคร แทร็กกิงมุมต่ำ ติดตามด้านข้าง และฮีโร่ช็อตปิดท้าย - รักษาความสม่ำเสมอของฝน แสง เงาสะท้อน และบรรยากาศเมือง - ซิงก์เสียงให้ตรงกับการเคลื่อนไหว: เสียงฝน น้ำกระเซ็นจากยาง เสียงมอเตอร์ไฟฟ้า และเสียงบรรยากาศเมือง - ห้ามมีล้อบิดเบี้ยว โครงสร้างเฟรมที่เปลี่ยนไป หรือรายละเอียดสินค้าที่ไม่สอดคล้องกัน - วัสดุสมจริง ลุคภาพยนตร์โฆษณาที่ประณีต ความละเอียด 1080p
Pixverse
Wan 2.7
Kling V3.0
สร้างภาพยนตร์โฆษณาสินค้าแนวซีเนมาติกความยาว 10 วินาที สำหรับลำโพงไร้สายแบบโปร่งใสที่วางอยู่บนโต๊ะสตูดิโอสมัยใหม่ ฉากที่ 1 (0–2 วินาที): ภาพโคลสอัประยะมาโครของตัวเครื่องลำโพงแบบโปร่งใส มองเห็นชิ้นส่วนภายในผ่านเปลือกใส แสงสตูดิโอนุ่มนวล เงาสะท้อนสะอาดตา ระยะชัดตื้น กล้องเคลื่อนเข้าหาช้า ๆ ฉากที่ 2 (2–5 วินาที): ลำโพงเปิดทำงาน วงแหวน LED เรืองแสงอย่างแผ่วเบาจากตรงกลางออกสู่ด้านนอก กล้องเคลื่อนวนรอบสินค้าอย่างลื่นไหล เพิ่มเสียงเปิดเครื่องนุ่ม ๆ และจังหวะเบสทุ้มต่ำที่ซิงก์กับแอนิเมชันของ LED ฉากที่ 3 (5–8 วินาที): ช็อตด้านข้างระยะใกล้: คลื่นเสียงถูกถ่ายทอดผ่านการสั่นไหวเบา ๆ ของน้ำในแก้วที่วางอยู่ใกล้ ๆ ลำโพงยังคงรูปทรง ขนาด วัสดุ และการจัดวางชิ้นส่วนภายในเหมือนเดิมทุกประการ ฉากหลังสตูดิโอสะอาดตา การจัดเฟรมสินค้าระดับพรีเมียม ฉากที่ 4 (8–10 วินาที): ฮีโร่ช็อตปิดท้าย: ลำโพงโปร่งใสอยู่กึ่งกลางโต๊ะ วงแหวน LED เรืองแสงนุ่มนวล กล้องค่อย ๆ ถอยออกช้า ๆ สตูดิโอแนวมินิมัลล้ำสมัย ลุคโฆษณาที่ประณีต ข้อกำหนด: - คงดีไซน์ลำโพงให้เหมือนเดิมทุกประการในทุกช็อต - ใช้การควบคุมกล้องแบบซีเนมาติก: โคลสอัปมาโคร การเคลื่อนวนรอบอย่างลื่นไหล โคลสอัปด้านข้าง และการถอยกล้องปิดท้ายแบบฮีโร่ช็อต - รักษาความสม่ำเสมอของแสงสตูดิโอ เงาสะท้อน ความโปร่งใส และสัดส่วนของสินค้า - ซิงก์เสียงให้ตรงกับการกระทำ: เสียงเปิดเครื่อง จังหวะเบส และการสั่นไหวแผ่วเบา - ห้ามมีชิ้นส่วนภายในที่เปลี่ยนไป ตัวเครื่องโปร่งใสที่บิดเบี้ยว หรือตำแหน่ง LED ที่ไม่สอดคล้องกัน - สไตล์โฆษณาเทคโนโลยีระดับไฮเอนด์ องค์ประกอบภาพสะอาดตา วัสดุสมจริง ความละเอียด 1080p
Pixverse
Wan 2.7
Kling V3.0
ไม่ว่าคุณจะทำภาพสินค้าภาพเดียวให้เคลื่อนไหวหรือกำกับซีรีส์หลายตอน Pixverse API บน Atlas Cloud ครอบคลุมทั้งวิดีโอโซเชียล งานโมชันอีคอมเมิร์ซ ทรานซิชันไร้รอยต่อ และการเล่าเรื่องแบบยาว พร้อมราคาแบบจ่ายตามการใช้งานที่โปร่งใส
เปลี่ยนพรอมป์ตข้อความเพียงหนึ่งเดียวให้เป็นคลิปแนวตั้งที่ทำให้คนหยุดเลื่อนฟีด ด้วยการสร้างวิดีโอจากข้อความของ Pixverse V6 ครีเอเตอร์ที่โพสต์ลง TikTok, Reels และ Shorts ทุกวันสามารถทำให้ฟีดสดใหม่อยู่เสมอในราคา $0.025 ต่อวินาที
ภาพสินค้าแบบนิ่งกลายเป็นคลิปฮีโร่ที่เต็มไปด้วยการเคลื่อนไหวผ่านการแปลงภาพเป็นวิดีโอของ V6 โดยคงอัตลักษณ์ทางภาพดั้งเดิมไว้ทุกเฟรม ทีมอีคอมเมิร์ซจึงเปลี่ยนแคตตาล็อกทั้งชุดให้เป็นโฆษณาได้โดยไม่ต้องจองสตูดิโอถ่ายทำ
ต้องการตัวเอกคนเดิมตลอดสิบตอนใช่ไหม? การแปลงภาพอ้างอิงเป็นวิดีโอของ C1 ล็อกรูปลักษณ์ตัวละครและสภาพแวดล้อมให้คงเดิมทุกคลิป มอบไปป์ไลน์งานซีรีส์ที่วางใจได้ให้ทีมแอนิเมชัน สตูดิโอเว็บตูน และเจ้าของ IP
เมื่อคีย์เฟรมสองภาพกำหนดช็อตของคุณ endpoint แบบ start-end จะสร้างการเคลื่อนไหวทั้งหมดระหว่างสองภาพนั้น ทั้งการตัดฉากที่เนี้ยบ การเผยภาพแบบมอร์ฟ และภาพพื้นหลังที่วนลูปได้อย่างสมบูรณ์แบบ เกิดขึ้นได้โดยไม่ต้องทำคีย์เฟรมด้วยมือเลย
คลิปที่สร้างขึ้นแทบไม่จำเป็นต้องจบที่คัตแรก เพราะ endpoint แบบ video-extend ของ V6 ต่อฟุตเทจให้ยาวขึ้นโดยคงการเคลื่อนไหวและสไตล์เดิมไว้ นักตัดต่อจึงร้อยเรียงส่วนที่ต่อขยายเป็นตัวอย่างหนัง มิวสิกวิดีโอ และซีเควนซ์ที่ยาวขึ้น
ทุก endpoint ของ V6 และ C1 อยู่หลังคีย์ที่เข้ากันได้กับ OpenAI เพียงคีย์เดียวบน Atlas Cloud คิดค่าใช้จ่ายแบบจ่ายตามการใช้งานเริ่มต้นที่ $0.025 ต่อวินาที นักพัฒนาจึงเพิ่มการสร้างวิดีโอระดับโปรดักชันลงในผลิตภัณฑ์ของตนเองได้โดยไม่ต้องดูแลโครงสร้างพื้นฐาน GPU
ก่อนเลือกสแต็กสำหรับสร้างวิดีโอ ลองดูว่า PixVerse API เทียบกับ Kling, Veo, Sora และ Wan เป็นอย่างไรในด้านโหมดอินพุต ความละเอียด ความยาวคลิป เสียงในตัว และราคาต่อวินาที
| โมเดล | โหมดอินพุต | ความละเอียดสูงสุด | ความยาวคลิป | เสียงในตัว | Price per Second |
|---|---|---|---|---|---|
| PixVerse V6 | ข้อความ รูปภาพ รูปภาพอ้างอิง เฟรมเริ่มต้นและเฟรมสุดท้าย การต่อความยาววิดีโอ | 1080p | 1 ถึง 15 วินาที | √ | From $0.025/s on Atlas Cloud |
| PixVerse C1 | ข้อความ รูปภาพ รูปภาพอ้างอิง เฟรมเริ่มต้นและเฟรมสุดท้าย | 1080p | 1 ถึง 15 วินาที | √ | From $0.03/s on Atlas Cloud |
| Kling 2.5 Turbo Pro | ข้อความ รูปภาพ | 1080p | 5 หรือ 10 วินาที | - | About $0.07/s |
| Google Veo 3.1 | ข้อความ รูปภาพ รูปภาพอ้างอิง เฟรมแรกและเฟรมสุดท้าย | สูงสุด 4K | 4, 6 หรือ 8 วินาที | √ | $0.40/s (Fast from $0.10/s) |
| OpenAI Sora 2 | ข้อความ รูปภาพ | 720p (1080p บน Sora 2 Pro) | 4, 8 หรือ 12 วินาที | √ | $0.10/s ($0.30/s for Pro) |
| Alibaba Wan 2.5 | ข้อความ รูปภาพ เสียงกำกับ (ไม่บังคับ) | 1080p | 5 หรือ 10 วินาที | √ | From $0.05/s |
เริ่มต้นได้ในไม่กี่นาที — ทำตามขั้นตอนง่าย ๆ เหล่านี้เพื่อเชื่อมต่อและใช้งานโมเดลผ่านแพลตฟอร์ม Atlas Cloud
สมัครสมาชิกที่ atlascloud.ai และยืนยันตัวตน ผู้ใช้ใหม่จะได้รับเครดิตฟรีเพื่อสำรวจแพลตฟอร์มและทดสอบโมเดล
การรวมโมเดล Pixverse ขั้นสูงเข้ากับแพลตฟอร์มที่เร่งด้วย GPU ของ Atlas Cloud ให้ประสิทธิภาพ ความสามารถในการขยาย และประสบการณ์นักพัฒนาที่ไม่มีใครเทียบได้
เวลาแฝงต่ำ:
inference ที่ปรับแต่ง GPU เพื่อการตอบสนองแบบเรียลไทม์
API แบบรวมศูนย์:
รัน Pixverse, GPT, Gemini และ DeepSeek ด้วยการเชื่อมต่อเดียว
ราคาโปร่งใส:
ชำระเงินต่อโทเค็นที่คาดเดาได้พร้อมตัวเลือก serverless
ประสบการณ์นักพัฒนา:
SDK, การวิเคราะห์, เครื่องมือปรับแต่ง และเทมเพลต
ความน่าเชื่อถือ:
ความพร้อมใช้งาน 99.99%, RBAC และการบันทึกที่พร้อมสำหรับการปฏิบัติตาม
ความปลอดภัยและการปฏิบัติตาม:
SOC 2 Type II, สอดคล้อง HIPAA, อธิปไตยข้อมูลในสหรัฐอเมริกา
PixVerse API ช่วยให้นักพัฒนาสามารถเข้าถึงโมเดลการสร้างวิดีโอ AI ของ PixVerse ผ่านการเขียนโปรแกรมด้วย Atlas Cloud แทนที่จะใช้แอปผู้บริโภคของ PixVerse ซึ่งทำงานโดยใช้เครดิตรายวัน เพิ่มลายน้ำ และจำกัดความละเอียด คุณสามารถเรียกใช้โมเดลโดยตรงผ่าน REST API และจ่ายเฉพาะสิ่งที่คุณสร้างขึ้นเท่านั้น
V6 คือซีรีส์เรือธงแบบอเนกประสงค์ ครอบคลุมการสร้างวิดีโอจากข้อความ จากภาพ จากภาพอ้างอิง การควบคุมเฟรมเริ่มต้นและเฟรมสุดท้าย รวมถึงการต่อความยาววิดีโอในไปป์ไลน์เดียว ส่วน C1 ใช้แนวทางที่ออกแบบมาเพื่อสตอรีบอร์ดโดยตรง สำหรับงานเล่าเรื่องแบบหลายช็อต ซึ่งความต่อเนื่องของฉากและความสม่ำเสมอของตัวละครระหว่างคัตสำคัญไม่แพ้คุณภาพของแต่ละเฟรม บน Atlas Cloud เอนด์พอยต์ V6 เริ่มต้นที่ $0.025 ต่อวินาที และเอนด์พอยต์ C1 เริ่มต้นที่ $0.03 ต่อวินาที
คิดค่าบริการแบบจ่ายตามการใช้งานจริง ไม่ต้องสมัครสมาชิก เอนด์พอยต์ PixVerse V6 ทั้งห้าตัวคิดค่าบริการเริ่มต้นที่ $0.025 ต่อวินาทีของวิดีโอที่สร้าง และเอนด์พอยต์ C1 ทั้งสี่ตัวเริ่มต้นที่ $0.03 ต่อวินาที คุณจ่ายเฉพาะสิ่งที่สร้างเท่านั้น พร้อมราคาต่อการเรียกที่โปร่งใสในทุกคำขอ
เอนด์พอยต์การสร้างวิดีโอของ PixVerse ทุกตัวให้เอาต์พุตที่ 360p, 540p, 720p หรือ 1080p โดยค่าเริ่มต้นคือ 720p คลิปมีความยาวได้ตั้งแต่ 1 ถึง 15 วินาที และมีอัตราส่วนภาพให้เลือกแปดแบบ ได้แก่ 16:9, 9:16, 1:1, 4:3, 3:4, 2:3, 3:2 และ 21:9 ครอบคลุมตั้งแต่ฟอร์แมตแนวตั้งสำหรับโซเชียลไปจนถึงเฟรมภาพยนตร์ 21:9 โดยไม่ต้องครอปหลังสร้างเลย
ใช่ ทั้ง V6 และ C1 สร้างเสียงในรอบการสร้างเดียวกัน และ Pixverse API มีพารามิเตอร์ sound ที่เปิดใช้งานเป็นค่าเริ่มต้น หากต้องการใส่เสียงเองภายหลัง ให้ตั้งค่าเป็น false ข้อยกเว้นเดียวคือเอนด์พอยต์ Video-Extend ของ V6 ซึ่งไม่มีพารามิเตอร์เสียงให้ใช้
C1 อ่านเลย์เอาต์สตอรีบอร์ดหลายช่องแบบเดียวกับที่ผู้กำกับอ่านหน้าการ์ตูน โดยถือว่าแต่ละช่องเป็นช็อตแยกกัน และอนุมานตรรกะการเปลี่ยนผ่านระหว่างช็อตเอง ผลลัพธ์คือซีเควนซ์หลายช็อตที่ต่อเนื่อง มีตัวละครและตรรกะเชิงพื้นที่ที่สม่ำเสมอ ทีมงานจึงเปลี่ยนจากบอร์ดที่อนุมัติแล้วไปเป็นฟุตเทจได้โดยไม่ต้องสร้างทุกฉากใหม่ ส่วนบนเอนด์พอยต์สร้างวิดีโอจากข้อความ ยังสามารถกำหนดการแบ่งช็อตผ่านโครงสร้างของพรอมต์ได้โดยตรงด้วย
เอนด์พอยต์ Reference-to-Video ของทั้ง V6 และ C1 รับภาพอ้างอิงได้ 1 ถึง 7 ภาพต่อคำขอ โดยแต่ละภาพติดแท็กได้ว่าเป็นภาพอ้างอิงตัวละครหรือฉากหลัง ส่งภาพได้ทั้งแบบ URL สาธารณะหรือสตริง Base64 ในรูปแบบ PNG, JPEG หรือ WebP โดยคำขอทั้งหมดจำกัดที่ 20MB ภาพอ้างอิงที่ติดแท็กนี่เองที่ช่วยให้งานโปรดักชันหลายช็อตคงอัตลักษณ์ของตัวละครไว้ได้ตลอดทุกคลิป
เอนด์พอยต์ Video-Extend ของ V6 รับ URL ของวิดีโอต้นฉบับพร้อมพรอมต์ข้อความ แล้วสร้างส่วนต่อความยาว 1 ถึง 15 วินาที ความต่อเนื่องของการเคลื่อนไหวและสไตล์ภาพจะถูกส่งต่อไปยังส่วนขยาย จึงเหมาะกับการยืดคลิปให้ยาวกว่าความยาวเดิม หรือสร้างคอนเทนต์ต่อเนื่องจากหลายแหล่ง โดยคิดค่าบริการอัตราเดียวกับเอนด์พอยต์ V6 อื่น ๆ คือ $0.025 ต่อวินาที
สร้างบัญชี Atlas Cloud สร้าง API key แล้วเรียกเอนด์พอยต์ PixVerse ตัวใดก็ได้โดยใส่ key นั้นในเฮดเดอร์ Authorization คำขอทำงานแบบอะซิงโครนัส: ส่งคำขอสร้างวิดีโอ รับ prediction ID แล้วคอยเรียกเอนด์พอยต์ผลลัพธ์จนกว่าสถานะจะเป็น completed ไม่ต้องตั้งค่าโครงสร้างพื้นฐานใด ๆ และการเข้าถึงแบบ Day-0 หมายความว่ารุ่นใหม่ของ PixVerse จะพร้อมใช้งานทันทีโดยไม่ต้องย้ายระบบ เริ่มสร้างได้เลยวันนี้