Seedance 2.0 Mini & Fast API với mức giá thấp nhất toàn cầu — giảm đến 68% so với giá chính thức

ShengShu Models on AtlasCloud | Vidu

Xây dựng quy trình sản xuất video trên Shengshu API: Chỉ với một lần gọi, Vidu Q3 tạo ra các đoạn phim điện ảnh dài 16 giây với âm thanh gốc và chuyển cảnh camera thông minh.

ShengShu do ShengShu Technology phát triển. Atlas Cloud (vận hành bởi Atlas Cloud AI LLC) cung cấp quyền truy cập vào mô hình này và không sở hữu mô hình. Mọi thương hiệu đều thuộc về chủ sở hữu tương ứng.

AI Video Models by ShengShu

Tạo video điện ảnh độ trung thực cao từ văn bản và hình ảnh với các mô hình AI tạo video mới nhất trên Atlas Cloud.

Xem tất cả mô hình

ShengShu Models API Pricing Details

Compare standard vs. our pricing across every ShengShu model.

ModelStandard Price (USD)Our Price (USD)Discount
Vidu Q3-Mix Reference to Video$0.125
Start from$0.106/s video
-15%View
Vidu Q3 Reference to Video$0.05
Start from$0.042/s video
-15%View
Vidu Q3-Pro Start-end-to-video$0.05
Start from$0.042/s video
-15%View
Vidu Q3-Turbo Image-to-video$0.04
Start from$0.034/s video
-15%View
Vidu Q3-Turbo Start-end-to-video$0.04
Start from$0.034/s video
-15%View
Vidu Q3-Turbo Text-to-video$0.04
Start from$0.034/s video
-15%View

Explore models from other providers

Instantly explore and experiment with 400+ production-ready models in the Atlas Playground. Start customizing with one click.

Các trường hợp sử dụng API ShengShu mà bạn có thể xây dựng trên Atlas Cloud

Các video ngắn 16 giây, âm thanh gốc và tính nhất quán đa tham chiếu của Vidu Q3 làm cho quy trình làm việc trở nên thiết thực đối với những công việc trước đây từng đòi hỏi một đội ngũ sản xuất. Các nhóm sử dụng các cấp độ Q3 khác nhau để chuyển từ bước lặp lại nhanh chóng sang các tài sản hoàn thiện mà không cần đổi nhà cung cấp.

Loạt Phim Hoạt Hình Với Nhân Vật Nhất Quán

Các studio và nhà sáng tạo độc lập sử dụng Vidu Q3-Mix để tạo ra nội dung hoạt hình nhiều tập, trong đó các nhân vật trông giống hệt nhau trong mọi cảnh. Bằng cách tải lên các bảng tham chiếu nhân vật, mỗi đoạn phim mới sẽ thừa hưởng các đặc điểm khuôn mặt, trang phục và phong cách hình ảnh tương tự mà không cần phải làm việc thủ công để đảm bảo tính nhất quán của từng khung hình. Shengshu đã trình diễn quy trình làm việc này tại SXSW 2026 với tư cách là giải pháp AI đầu tiên cho việc sản xuất phim hoạt hình dài tập.

Nội dung Avatar thương hiệu và Linh vật ở quy mô lớn

Các nhóm tiếp thị tải lên hình ảnh tham chiếu của nhân vật thương hiệu một lần và sử dụng Vidu Q3 Reference-to-Video để tạo hàng chục clip ngắn cho TikTok, Reels và YouTube Shorts. Nhân vật giữ nguyên đặc điểm hình ảnh trên mọi kết quả đầu ra, loại bỏ nút thắt trong thiết kế khi phải tóm tắt và phê duyệt riêng lẻ từng tài nguyên. Với mức giá 0,042 đô la mỗi giây trên Atlas Cloud, một lô đầy đủ các clip 10 giây có giá chưa đến một đô la cho mỗi clip.

Video tiếp thị sản phẩm đa góc độ

Các nhóm thương mại điện tử cung cấp hình ảnh sản phẩm từ nhiều góc độ làm dữ liệu đầu vào tham chiếu và tạo ra các đoạn phim tiếp thị điện ảnh hiển thị sản phẩm chuyển động cùng với âm thanh môi trường nguyên bản. Đầu ra được cung cấp kèm theo âm thanh đồng bộ trong cùng một lần gọi, sẵn sàng cho các quảng cáo và trang sản phẩm mà không cần quay video hay chỉnh sửa âm thanh. Tính năng kiểm soát khung hình bắt đầu và kết thúc cho phép các nhóm chỉ đạo chính xác cách sản phẩm được hiển thị qua từng đoạn phim.

Tạo Cảnh Định Hướng Cho Giai Đoạn Tiền Kỳ Điện Ảnh

Các đạo diễn sử dụng tính năng điều khiển máy ảnh của Vidu Q3-Pro để tạo các clip tiền trực quan hóa với các chuyển động được chỉ định — đẩy vào chủ thể, lia máy ngang qua bối cảnh, các cảnh quay theo dõi nhân vật. Đầu ra 16 giây gốc có nghĩa là có thể tiền trực quan hóa toàn bộ một cảnh ngắn chỉ trong một lần gọi. Điều này thay thế cho công việc vẽ kịch bản phân cảnh ở giai đoạn đầu bằng tài liệu tham khảo chính xác về chuyển động cho dàn diễn viên và đoàn làm phim.

Luồng nội dung xã hội khối lượng lớn

Các nhóm phát triển sử dụng Vidu Q3-Turbo để chạy các đường ống tạo hàng loạt với mức phí 0,034 đô la mỗi giây, sản xuất hàng chục video ngắn từ đầu vào văn bản hoặc hình ảnh mỗi giờ. Chi phí mỗi giây thấp hơn khiến việc tạo và thử nghiệm nhiều biến thể sáng tạo trở nên thiết thực trước khi chọn biến thể nào để mở rộng quy mô với Q3-Pro. Cả hai mô hình đều chạy dưới cùng một khóa API Atlas Cloud chỉ với một thay đổi tham số duy nhất giữa các cấp độ.

Du lịch Văn hóa và Nội dung Điểm đến

Các tổng cục du lịch và nền tảng du lịch sử dụng công cụ chuyển văn bản thành video Vidu Q3-Pro để tạo các đoạn phim điểm đến đầy không khí với âm thanh môi trường tự nhiên từ các lời nhắc văn bản mô tả. Một mô tả cảnh bằng văn bản về một cảnh quan, địa danh hoặc bối cảnh văn hóa sẽ tạo ra một đoạn phim điện ảnh dài 16 giây với âm thanh phù hợp chỉ trong một lệnh gọi API. Điều này mang lại một giải pháp thay thế tiết kiệm chi phí cho việc quay phim tại địa điểm đối với nội dung thúc đẩy ý định đặt phòng.

Biến tm nhìn doanh nghip ca bn thành hin thc vi Atlas Cloud AI.

Liên hệ kinh doanh

Các câu hỏi thường gặp về các mô hình ShengShu

Vidu Q3 tạo ra video liên tục lên đến 16 giây chỉ trong một lần gọi API duy nhất ở độ phân giải 1080p và 24fps. Đây là cửa sổ tạo video một lần (single-pass) dài nhất trong số các mô hình video hàng đầu cùng phân khúc. Thời lượng video có thể được định cấu hình cho mỗi lần gọi trong phạm vi tối đa đó.

Có. Vidu Q3 tạo ra lời thoại, hiệu ứng âm thanh, nhạc nền và đồng bộ khẩu hình cùng lúc với các khung hình video chỉ trong một quá trình suy luận duy nhất. Không có bước lồng tiếng hậu kỳ hoặc căn chỉnh âm thanh thủ công. Thời gian âm thanh và hành động trên màn hình được đồng bộ hóa tự động.

Bạn có thể mô tả trực tiếp chuyển động của camera trong prompt văn bản — push-in, pan, tracking shot — và mô hình sẽ thực hiện chúng ngay từ khung hình đầu tiên. Không cần thêm tham số hay lớp điều khiển riêng biệt. Điều này áp dụng cho cả endpoint text-to-video và image-to-video trên Atlas Cloud.

Vidu Q3-Pro mang đến chất lượng đầu ra chuẩn điện ảnh với chuyển động mượt mà và chi tiết phong phú, có giá 0,042 USD mỗi giây trên Atlas Cloud. Vidu Q3-Turbo tạo với tốc độ cao hơn cùng chi phí mỗi giây thấp hơn là 0,034 USD, rất phù hợp cho các bản nháp và lặp lại nhanh chóng. Cả hai đều có chung độ phân giải đầu ra 1080p và hỗ trợ âm thanh gốc.

Điểm cuối Reference-to-Video của Vidu Q3 chấp nhận từ 1 đến 4 hình ảnh tham chiếu cho mỗi lần gọi. Bạn có thể kết hợp các chủ thể, môi trường, trang phục và phong cách hình ảnh từ các hình ảnh khác nhau trong một lần tạo. Đây là cách chính để duy trì tính nhất quán của nhân vật và cảnh quay qua nhiều clip.

Vidu Q3-Mix là mô hình tham chiếu cấp cao nhất trong dòng sản phẩm Vidu Q3, có giá 0,106 USD mỗi giây trên Atlas Cloud. Mô hình này mang lại tính nhất quán đa chủ thể mạnh mẽ nhất khi kết hợp nhiều hình ảnh tham chiếu trong một lần tạo. Nó được thiết kế cho các quy trình làm việc như sản xuất phim hoạt hình dài tập và nội dung có thương hiệu, nơi đặc điểm nhận dạng của nhân vật phải được giữ nguyên về mặt hình ảnh trên nhiều đoạn clip.

Có. Cả Vidu Q3-Pro và Q3-Turbo đều có endpoint Start-end-to-video trên Atlas Cloud. Bạn cung cấp hình ảnh khung hình bắt đầu và mô tả chuyển động hoặc trạng thái kết thúc mong muốn, sau đó mô hình sẽ tạo ra sự chuyển tiếp. Điều này mang lại khả năng kiểm soát đạo diễn chính xác về cách mỗi cảnh quay mở đầu và kết thúc.

Vidu Q3-Turbo bắt đầu từ 0,034 USD mỗi giây. Vidu Q3-Pro và endpoint Reference-to-Video có giá 0,042 USD mỗi giây. Vidu Q3-Mix, mô hình tham chiếu có tính nhất quán cao nhất, có giá 0,106 USD mỗi giây. Tất cả các cấp độ đều có giá thấp hơn 15% so với mức giá tiêu chuẩn của Shengshu API và có sẵn theo hình thức thanh toán theo mức sử dụng (pay-as-you-go).

Khám phá Thêm Dòng

Seedance 2.5

Seedance 2.5 API hiện đã có mặt trên Atlas Cloud! Cung cấp cho các nhà phát triển mô hình video mới nhất của ByteDance. Nó tạo ra tối đa 30 giây video gốc chỉ trong một lần xử lý từ văn bản, một hình ảnh duy nhất hoặc tối đa 50 tài liệu tham khảo đa phương thức, với âm thanh được đồng bộ hóa và văn bản đa ngôn ngữ trong khung hình. Trên Atlas Cloud, bạn có thể truy cập thông qua một khóa duy nhất, với tính nhất quán của chủ thể và vật lý được cải thiện giúp giữ cho các cảnh quay dài luôn mạch lạc.

Xem Dòng

Wan 3.0

Wan 3.0 API là thế hệ tiếp theo trong hệ sinh thái video Wan của Alibaba, được xây dựng để đưa khả năng tạo video dài, kiểm soát đa tham chiếu và chất lượng nghe nhìn lên những tầm cao mới. Atlas Cloud đã lưu trữ Wan 2.7, 2.6 và 2.5, và Wan 3.0 hoạt động trên cùng một khóa hợp nhất mà không cần thiết lập riêng. Bắt đầu xây dựng ngay hôm nay. Cuộn xuống phần trưng bày để xem những gì Wan 3.0 có thể tạo ra.

Xem Dòng

MiniMax H3

MiniMax H3 là dòng mô hình video của MiniMax dành cho việc tạo video từ văn bản, hình ảnh và ảnh tham chiếu. Tạo các đoạn clip dài 5 đến 15 giây, định hướng chuyển động bằng khung hình cuối tùy chọn, giữ lại chủ thể từ ảnh tham chiếu hoặc chọn H3 Developer khi âm thanh được tạo phù hợp với quy trình làm việc. Atlas Cloud tích hợp H3, H3 Fast, H3 Max và H3 Developer vào một quy trình API duy nhất, với mức giá tiêu chuẩn từ $0.038 mỗi giây. Bắt đầu xây dựng ngay hôm nay.

Xem Dòng

Seedream 5.0 Pro

Seedream 5.0 Pro API cung cấp cho các nhà phát triển mô hình chỉnh sửa hình ảnh có thể kiểm soát của ByteDance trên Atlas Cloud. Nó đặt các chỉnh sửa một cách chính xác bằng các điểm neo và tọa độ, tách hình ảnh thành các lớp có thể chỉnh sửa, kết hợp nhiều tham chiếu và khớp màu sắc cũng như vật liệu chính xác, với văn bản đa ngôn ngữ ở độ phân giải 2K và 3K. Trên Atlas Cloud, bạn có thể truy cập nó chỉ bằng một khóa!

Xem Dòng

Seedance 2.0

Seedance 2.0 API cung cấp cho bạn quyền truy cập cấp sản xuất vào mô hình video đa phương thức của ByteDance — đầu vào bốn phương thức (văn bản, hình ảnh, video, âm thanh) và hệ thống "Universal Reference" hàng đầu trong ngành giúp khóa bố cục, chuyển động của camera và hành động của nhân vật trên các cảnh quay. Tích hợp quyền kiểm soát cấp độ đạo diễn bằng một lệnh gọi API, mức giá cố định $0,09/giây, cấp khóa tức thì và không có danh sách chờ — được hỗ trợ bởi thời gian hoạt động và sự tuân thủ cấp doanh nghiệp. Seedance 2.0 Native 4K hiện đã ra mắt!

Xem Dòng

GPT Image 2.5

API GPT Image 2.5 cung cấp mô hình hình ảnh mới nhất của OpenAI thông qua Atlas Cloud với hai biến thể: Flare cho độ trễ thấp hơn khoảng 50% và Sunburst cho độ chính xác tối đa đối với các công việc chi tiết. Tạo và chỉnh sửa hình ảnh với chi tiết sắc nét hơn, ánh sáng tự nhiên hơn và các chỉnh sửa nhiều lượt đáng tin cậy giúp giữ cho chủ thể nhất quán, cộng với các mức chất lượng xhigh và max mới cùng tùy chọn nền không trong suốt.

Xem Dòng

GPT Image 2

GPT Image 2 API cung cấp cho các nhà phát triển quyền truy cập vào mô hình hình ảnh mới nhất của OpenAI, phiên bản kế nhiệm của GPT Image 1.5. Mô hình này tạo và chỉnh sửa hình ảnh với khả năng hiển thị văn bản chính xác trên các chữ viết Latinh và CJK, cùng với bố cục mạnh mẽ cho áp phích, mockup và đồ họa thông tin. Trên Atlas Cloud, bạn có thể truy cập nó thông qua một API thống nhất cùng với hơn 300 mô hình khác, với tín dụng miễn phí, 99,99% thời gian hoạt động và không yêu cầu xác minh tổ chức OpenAI.

Xem Dòng

Gemini Omni Flash

Gemini Omni API mang dòng Gemini Omni Flash đa phương thức nguyên bản của Google DeepMind, bao gồm Gemini Omni 1.1 Flash, đến với các nhà phát triển. Tạo video điện ảnh với âm thanh gốc được đồng bộ, tạo chuyển động cho ảnh tĩnh với khả năng kiểm soát chính xác khung hình bắt đầu và kết thúc, hoặc chỉnh sửa cảnh quay hiện có bằng các hướng dẫn văn bản mà vẫn bảo toàn nội dung không được thay đổi. Atlas Cloud cung cấp một khóa tương thích với OpenAI, quyền truy cập hợp nhất và mức giá trả theo mức sử dụng minh bạch. Bắt đầu xây dựng ngay hôm nay.

Xem Dòng

Grok Imagine

Grok Imagine API của xAI cung cấp các mô hình hình ảnh, video và lời nói, từ Image 2.0 đến Video 1.5 và xAI TTS v1. Render 1K hoặc 2K hình tĩnh trên 14 tỷ lệ khung hình, tạo cảnh 15 giây video 1080p, điều hướng các shot bằng tối đa 7 hình ảnh tham chiếu, hoặc cung cấp lời tường thuật bằng 20 ngôn ngữ. Atlas Cloud chạy mọi chế độ trên một endpoint, có giá theo mô hình trả tiền khi sử dụng từ $0.02 mỗi hình ảnh và $0.05 mỗi giây. Bắt đầu xây dựng hôm nay.

Xem Dòng

Google

Các mô hình sáng tạo mạnh mẽ nhất của Google hiện đều có sẵn trên Atlas Cloud. Veo 3.1 cung cấp khả năng tạo video đậm chất điện ảnh, Nano Banana 2 hỗ trợ tạo hình ảnh có độ chân thực cao, và Gemini mang trí tuệ đa phương thức vào mọi quy trình làm việc. Truy cập toàn bộ bộ mô hình Google thông qua một API key duy nhất với tính khả dụng Day-0 và mức giá dùng bao nhiêu trả bấy nhiêu (pay-as-you-go).

Xem Dòng

Seedance 2.0 Mini

Seedance 2.0 Mini mang khả năng tạo video đa phương thức của ByteDance vào các quy trình làm việc nơi tốc độ và chi phí là quan trọng nhất. Nó cung cấp các khả năng cốt lõi của Seedance 2.0 với mức tiêu thụ tài nguyên nhẹ hơn — tạo nhanh hơn, chi phí mỗi video thấp hơn và tích hợp API giống như bạn đã sử dụng. Đối với các nhóm chạy các quy trình (pipeline) khối lượng lớn hoặc tạo nguyên mẫu ở quy mô lớn, Mini là lựa chọn mặc định thiết thực.

Xem Dòng

ByteDance

Từ tạo video điện ảnh đến kiến tạo hình ảnh có độ trung thực cao, các mô hình mạnh mẽ nhất của ByteDance hiện đã có mặt trên Atlas Cloud. Chạy Seedance và Seedream ở quy mô lớn với mức giá suy luận thấp nhất và không có chi phí quản lý cơ sở hạ tầng.

Xem Dòng