Seedance 2.0 Mini & Fast API với mức giá thấp nhất toàn cầu — giảm đến 68% so với giá chính thức
Hero background 1Hero background 2Hero background 3Hero background 4Hero background 5

Seedance 2.5 API: 30-Second Native Video Generation

Seedance 2.5 API hiện đã có mặt trên Atlas Cloud! Cung cấp cho các nhà phát triển mô hình video mới nhất của ByteDance. Nó tạo ra tối đa 30 giây video gốc chỉ trong một lần xử lý từ văn bản, một hình ảnh duy nhất hoặc tối đa 50 tài liệu tham khảo đa phương thức, với âm thanh được đồng bộ hóa và văn bản đa ngôn ngữ trong khung hình. Trên Atlas Cloud, bạn có thể truy cập thông qua một khóa duy nhất, với tính nhất quán của chủ thể và vật lý được cải thiện giúp giữ cho các cảnh quay dài luôn mạch lạc.

Seedance 2.5 do ByteDance phát triển. Atlas Cloud (vận hành bởi Atlas Cloud AI LLC) cung cấp quyền truy cập vào mô hình này và không sở hữu mô hình. Mọi thương hiệu đều thuộc về chủ sở hữu tương ứng.

Khám phá Mô hình Hàng đầu

Atlas Cloud cung cấp cho bạn các mô hình sáng tạo tiên tiến nhất trong ngành.

Một Seedance 2.5 API, hai cách sử dụng: endpoint văn bản và hình ảnh

Dù quá trình tạo bắt đầu từ một prompt bằng văn bản hay một tập hình ảnh tham chiếu, bảng này cho biết từng endpoint Seedance 2.5 API nhận gì, tạo ra gì và phù hợp nhất với những quy trình sản xuất nào.

Phương thứcMô tả
Seedance 2.5 T2V API (Text To Video)Mô tả một cảnh bằng ngôn ngữ thông thường và Seedance 2.5 Text to Video API sẽ trả về tối đa 30 giây video gốc chỉ trong một lần tạo, từ độ phân giải 480p đến 4K. Văn bản trên màn hình và phụ đề đa ngôn ngữ được hiển thị trực tiếp vào khung hình, do đó thẻ tiêu đề và phụ đề không còn cần bước tổng hợp (compositing) riêng biệt. Khả năng tuân thủ prompt mạnh mẽ hơn giúp kết quả trung thành với mô tả bằng văn bản của bạn.
Seedance 2.5 I2V API (Image To Video)Image to Video API của Seedance 2.5 có thể nhận một khung hình đầu tiên, hoặc cả khung hình đầu và cuối, và lấp đầy chuyển động giữa chúng trong một cảnh quay liên tục 30 giây mà không có vết nối. Bạn thiết lập vị trí bắt đầu và kết thúc của cảnh quay trong khi mô hình xử lý chuyển động của máy ảnh và hành động ở giữa. Khả năng kiểm soát đó biến một bức ảnh tĩnh duy nhất thành một cảnh quay dài có đạo diễn thay vì một vòng lặp ngắn.
Seedance 2.5 R2V API (Tham chiếu sang Video)Với tối đa 50 tài liệu tham khảo đa phương thức toàn diện, bao gồm hình ảnh, âm thanh, mô hình trắng 3D và mẫu phong cách, Seedance 2.5 Reference to Video API khóa chặt diện mạo, chuyển động và giọng nói của chúng vào kết quả. Các chủ thể giữ được sự nhất quán qua các cảnh quay với đặc tính vật lý thực tế, do đó một nhân vật hoặc sản phẩm sẽ luôn hoạt động theo cùng một cách. Nó được xây dựng cho nội dung chuỗi dài kỳ, người dẫn chương trình ảo và các chiến dịch thương hiệu được kiểm soát.

Khám phá Seedance 2.5 API: 30 giây, 50 tài liệu tham khảo

Được xây dựng cho quy trình sản xuất video, Seedance 2.5 API kết hợp khả năng tạo một lần trong 30 giây và 50 tham chiếu đa phương thức với đầu ra 480p đến 720p, chỉnh sửa cục bộ có mục tiêu, văn bản đa ngôn ngữ trong khung hình, cùng với tính nhất quán của chủ thể và vật lý ổn định hơn.

Một lượt xử lý, 30 giây

Một lệnh gọi trả về tối đa 30 giây video liên tục, gấp đôi giới hạn 15 giây của Seedance 2.0 và vượt xa giới hạn một lượt của hầu hết đối thủ. Mô hình lập kế hoạch toàn bộ clip trong một forward pass, nên ánh sáng, chuyển động và danh tính nhân vật không bị trôi như khi ghép các đoạn lại với nhau. Các tập phim ngắn, câu chuyện quảng cáo và chuỗi cảnh theo nhạc cuối cùng cũng có thể diễn ra liền mạch mà không có vết cắt lộ rõ.

50 tham chiếu đa phương thức trong một yêu cầu

Đưa tối đa 50 tài sản đa phương thức vào một yêu cầu, kết hợp hình ảnh, video clip, âm thanh và văn bản, tăng gấp bốn lần so với giới hạn 12 tham chiếu của Seedance 2.0. Footage phông xanh và tham chiếu 3D white model cũng được hỗ trợ, giúp đạo diễn kiểm soát chính xác blocking và đường đi camera. Nhân vật, sản phẩm, trang phục và phong cách thương hiệu luôn được neo ổn định xuyên suốt mọi cảnh mà mô hình tạo ra.

Âm thanh được sinh ra trong cùng một lượt

Seedance 2.5 đồng tạo âm thanh và video trong cùng một không gian tiềm ẩn, nên nhạc, hội thoại và hiệu ứng âm thanh không bao giờ phải lồng thêm về sau. Khớp môi, tiếng bước chân và nhạc nền rơi đúng vào các khung hình theo mặc định, là kết quả trực tiếp từ kiến trúc âm thanh và video hợp nhất của ByteDance. Từ hội thoại talking head đến các bản dựng theo nhạc, clip nhận về đã có sẵn âm thanh đi kèm và sẵn sàng xuất bản.

Văn bản đa ngôn ngữ, render ngay trong khung hình

Nếu chiến dịch của bạn triển khai trên nhiều thị trường, mô hình render tiêu đề, caption và phụ đề trực tiếp trong khung hình, hỗ trợ các ngôn ngữ lớn gồm Chinese, English, Spanish, Arabic, Japanese và Korean. Các artifact phụ đề lạc chỗ và nhạc nền không mong muốn được triệt tiêu ngay lúc tạo, nên clip nhận về sạch sẽ. Các bản dựng bản địa hóa cho khán giả toàn cầu không còn cần thêm bước dàn chữ hoặc dọn dẹp riêng.

Viết chuyển động camera ngay trong prompt

Ngay từ prompt, Seedance 2.5 dàn dựng các chuỗi nhiều cảnh quay với lia máy, dolly, orbit shot và kéo nét được mô tả bằng ngôn ngữ tự nhiên. Chủ thể giữ nguyên danh tính qua mọi lần cắt, nên một cảnh có kịch bản trông như phần coverage đã được lên kế hoạch thay vì các clip rời rạc. Các đội ngũ làm theo storyboard có thể đưa cho mô hình một danh sách cảnh quay bằng văn bản và nhận lại footage đã khớp với danh sách đó.

Chỉnh chi tiết, giữ nguyên cảnh quay

Cần đổi sản phẩm, sửa một phần nền hoặc thay một diễn viên? Seedance 2.5 chỉ viết lại vùng bạn chỉ định, đồng thời giữ nguyên chuyển động camera, hướng sáng và bố cục cảnh ban đầu. Chủ thể có thể thay đổi trong khi cảnh được giữ nguyên, hoặc cảnh có thể thay đổi quanh cùng một chủ thể. Các vòng chỉnh sửa không còn đồng nghĩa với việc tạo lại toàn bộ, nhờ đó giảm cả thời gian hoàn thành lẫn chi phí cho mỗi lệnh gọi.

Vật lý và độ nhất quán chủ thể trong Seedance 2.5 API

Cảnh đông người vẫn mạch lạc: ByteDance đã trình diễn mô hình điều phối hơn 10 diễn viên chỉ từ tài sản hình ảnh, trong khi từng khuôn mặt và trang phục đều giữ ổn định. Hành vi vật lý cũng mạnh hơn, với chuyển động, va chạm và tương tác vật liệu tuân theo logic đời thực trung thực hơn so với các phiên bản Seedance trước đây. Độ tin cậy đó giúp phim ngắn nhiều nhân vật và demo sản phẩm an toàn hơn nhiều khi chạy trong production.

4K Native thông qua API Seedance 2.5

Độ phân giải trải từ bản nháp 720p đến native 4K với màu 10 bit, và khung hình 4K được tạo trực tiếp thay vì upscale sau đó. Các cấu trúc tinh như sợi tóc, đường chỉ may và thớ vải vẫn nguyên vẹn ở chất lượng bàn giao đầy đủ. Đội ngũ có thể lặp nhanh ở các mức thấp hơn, rồi render bản dựng đã duyệt ở 4K cho phát sóng và các chiến dịch màn hình lớn.

Một Prompt, Ba Engine: Seedance 2.5 API So Găng Ra Sao

Chúng tôi đưa đúng cùng một prompt vào Seedance 2.5, Google Veo 3.1 và Seedance 2.0, để bạn có thể đối chiếu chuyển động, vật lý và độ nhất quán trước khi gọi Seedance 2.5 API.

Prompt

Phong cách quảng cáo hoạt hình 3D, màu sắc tươi sáng và trong mờ; phần thịt quả và nước ép phải tạo cảm giác tươi mát và tác động thật mạnh. Tổng thể mang cảm giác của một phim ngắn hoạt hình quảng cáo chất lượng cao, pha chút hài hước phóng đại. Nhân vật thằn lằn sừng sa mạc dễ thương, sinh động và biểu cảm phong phú — tham chiếu @Image1. Chất liệu hình ảnh theo tham chiếu: ánh sáng tự nhiên dịu, lông tơ / kết cấu da được thể hiện tinh tế, độ sâu trường ảnh macro mơ màng, chân thực nhưng có chút ngây thơ kỳ whimsical. Mở đầu: một sa mạc bị mặt trời thiêu đốt. Không khí rung lên vì nóng, cát nóng bỏng, phía xa như bốc khói. Một con thằn lằn sừng sa mạc nằm bẹp trên cát cháy rát, lưỡi hơi thè ra, mắt đờ đẫn, gần như bị nướng khô. Cứ đi được vài bước nó lại loạng choạng, cả con thằn lằn trông như sắp "bốc hơi". SFX: sóng nhiệt vù vù, tiếng nứt khô phóng đại khe khẽ của mặt đất khô cằn. Phát hiện: con thằn lằn đột ngột khựng lại, mũi khịt khịt. Nó nhìn xuống — vùi trong cát là một quả bưởi căng mọng, lạnh buốt, đọng đầy giọt nước, lấp lánh dưới nắng, vỏ có kết cấu tinh xảo — như một phép màu giữa sa mạc. Diễn xuất: mắt con thằn lằn lập tức mở to khổng lồ, như thể nhìn thấy hy vọng cuối cùng. SFX: tín hiệu phát hiện "ding" trong trẻo. Cú vồ: con thằn lằn phóng tới như một cú tackle bay, ôm chặt quả bưởi bằng cả hai tay, cả khuôn mặt áp vào lớp vỏ, mang biểu cảm sung sướng kiểu "mình sống lại rồi". Khung hình giữ lại một nhịp — một điểm nhấn quảng cáo phóng đại, hài hước và dễ nhớ. SFX: một tiếng bịch, rồi nửa giây im lặng. Vụ bung nổ: con thằn lằn siết lấy quả bưởi. Lớp vỏ nứt toác, hé lộ phần thịt quả căng mọng, bóng bẩy, trong mờ. Ngay khoảnh khắc tiếp theo, nước không chảy rỉ ra — mà phun trào như sóng thần. SFX: tiếng "crack" giòn khi cắn bung, tiếp theo là một vụ nổ nước ép phóng đại. Trận lũ: nước bưởi màu cam hồng, trong vắt rực sáng, tuôn ào ạt, đổ xuống các cồn cát và nhanh chóng nhấn chìm cả sa mạc. Cát vàng khô biến thành một đại dương mùa hè mát lạnh, lấp lánh, thơm ngát. Xương rồng, đá và những cồn cát nhỏ lần lượt bị các con sóng nước ép nuốt chửng — phóng đại và mộng mị. Diễn xuất: ban đầu con thằn lằn phấn khích, rồi nhận ra có gì đó không ổn — biểu cảm lật từ vui sướng sang kinh hoàng. Sinh tồn: con thằn lằn gần như bị "biển bưởi" nhấn chìm, cuống cuồng bám vào nửa quả bưởi như phao cứu sinh, nổi trên mặt nước. Nó thò cái đầu ướt sũng ra, hoàn toàn ngơ ngác. Mặt biển lấp lánh, có màu như nước ép dưới nắng. SFX: tiếng nước bắn phóng đại, sóng biển, pha chất hài. Thẻ thương hiệu: cắt đột ngột sang màn hình trắng. Tên thương hiệu và slogan xuất hiện ở giữa khung hình: "Seedance Grapefruit — cắn vào phần thịt quả, mùa hè sẽ tuôn trào." Voice-over đọc trọn câu. SFX: âm hiệu thương hiệu sạch, mát và sảng khoái. Kết thúc: cắt từ màn trắng trở lại. Giờ đây con thằn lằn đang nằm thư thái trên quả bưởi nổi, đeo kính râm tí hon, ôm một chiếc cốc có ống hút, lười biếng trôi trên biển nước ép như đang đi nghỉ. Xung quanh nó nổi lơ lửng tép cam, những viên đá nhỏ và các tia nước mát; bầu trời chuyển sang xanh rực rỡ — tâm trạng bật từ "sinh tồn" sang "nghỉ dưỡng". Cuối cùng con thằn lằn ngả lưng mãn nguyện vào quả bưởi khi camera kéo rộng, đóng băng trên một khung hình mùa hè sắc nét, tươi sáng, tinh nghịch. SFX: nhạc mùa hè thoảng gió, sóng vỗ nhẹ. Chữ trên màn hình: chỉ tên thương hiệu, không thêm gì khác.

Generated with Seedance 2.5 on Atlas Cloud

Generated with HappyHorse 1.1 on Atlas Cloud

Generated with Seedance 2.0 on Atlas Cloud

Prompt

【Người đàn ông say rượu gặp nguy trên sân thượng — Trượt chân và rơi xuống — Chộp được một sợi cáp, lao xuyên qua cửa sổ — Ngủ thiếp đi | Phim ngắn hài đen】 【Logline】Một chuỗi phim mang chất hài đen: một người đàn ông trung niên say rượu, mũm mĩm và đáng yêu, vừa ăn burger vừa uống bia trên sân thượng một tòa nhà chọc trời. Khi đứng dậy vươn vai, ông mất thăng bằng và rơi khỏi mép mái, hoảng loạn chộp được một sợi cáp cứu mạng giữa lúc đang rơi, bị quăng xuyên qua một ô cửa sổ sáng đèn vào trong phòng, ngồi đờ ra một giây — rồi đơn giản nằm xuống và ngủ say ngay lập tức. Ảnh tham chiếu @Image1 — một người đàn ông trung niên say rượu, mũm mĩm và đáng yêu. Thân hình tròn trịa, chắc nịch với bụng bia to tròn, vóc dáng thấp, động tác lỏng lẻo, chậm chạp và loạng choạng vì say. Mặt tròn, cằm đôi, má và mũi đỏ ửng vì rượu, mắt nheo thành hai khe với ánh nhìn mơ màng, mất tiêu điểm, toát lên vẻ say xỉn ngờ nghệch và hài hước. Một lớp râu lởm chởm ngắn, luộm thuộm quanh hàm, tóc ngắn bù xù. Biểu cảm ngốc nghếch, dễ thương và vô tư. Ăn mặc rất cẩu thả: áo ba lỗ trắng (áo lót) dính sốt burger / ketchup, buông lỏng trên cái bụng tròn với gấu áo hơi quăn, phối với quần jeans cũ, mặc theo kiểu xộc xệch. Ông luôn nắm một chiếc burger ăn dở trong tay. Bộ phim chỉ có MỘT nhân vật. Đơn giản, lơ mơ, ngà ngà say, lúc nào cũng chậm mất một nhịp — một ông chú đáng mến, xui xẻo nhưng vô tư vui vẻ. Khớp 100% với ảnh tham chiếu. Tổng thể hình ảnh — một siêu đô thị cyberpunk về đêm: rừng nhà chọc trời bằng kính và thép, biển hiệu neon dày đặc (cyan / magenta / electric blue), billboard holographic, mặt đất ướt bóng phản chiếu, sương thể tích được ánh sáng thành phố nhuộm màu, vệt sáng của xe bay ở xa, drone len lỏi qua lại. Mặt tiền các tòa nhà ướt mưa phản chiếu neon. Trên sân thượng: vài lon bia rỗng, một túi giấy burger, một chiếc ghế nhựa. Bảng màu 60:30:10 — bầu trời đêm xanh đen sâu + thép và kính ướt (60) / ánh neon cyan và magenta + ánh sáng billboard (30) / màu trắng của áo ba lỗ + vàng ấm của giấy gói burger + điểm sáng phản chiếu từ biển hiệu (10). Chất liệu live-action photorealistic, ống kính điện ảnh vật lý, vật liệu thật, KHÔNG có vẻ 3D render / game engine / anime. Siêu chi tiết — vải áo ba lỗ bay phấp phới, vết dầu mỡ, giọt mồ hôi, vụn burger, giọt nước, mảnh kính đều sắc như dao. Camera & speed ramping — kết hợp handheld và crane / drone, chuyển góc máy và cỡ cảnh theo storyboard; sau cú rơi, camera lao xuống cùng ông, mặt tiền tòa nhà và neon vệt lên phía trên khung hình để truyền tải tốc độ. Cảm giác ống kính anamorphic góc rộng màn ảnh rộng kiểu điện ảnh vật lý (24–35mm), motion blur màn trập 180°, trọng lượng handheld thật, vài giọt mưa nhẹ trên ống kính. Tốc độ: chủ yếu real-time; chỉ có hai khoảnh khắc slow-motion ngắn — đúng lúc sợi cáp chịu trọng lượng của ông, và đúng lúc cửa sổ vỡ tung. Thiết kế âm thanh là cốt lõi của chất hài đen: cắt gắt qua lại giữa "điếc tai" và "im lặng tuyệt đối" theo storyboard. Vật lý (thực tế không nhân nhượng) — trọng lực thật xuyên suốt; cơ thể mũm mĩm say rượu của ông có đầy đủ trọng lượng, cảm nhận được rõ. Vươn vai → mất thăng bằng → loạng choạng → rơi xuống là một chuyển động say rượu tự nhiên, liên tục. Khi rơi tự do, thân hình tròn và tay chân ông quơ quạng vụng về trong luồng gió, áo ba lỗ phồng lên vì gió, burger vẫn nắm chặt trong tay. Sợi dây = một sợi cáp căng / zipline nối giữa hai tòa nhà; giữa lúc rơi ông vung tay loạn xạ và may mắn chộp được nó — sợi cáp giật căng và võng sâu dưới sức nặng của ông, tích trữ năng lượng, rồi quăng ông theo một cung con lắc về phía một ô cửa sổ sáng đèn bên dưới. Cửa sổ = ông lao vào bằng lưng / sườn trước ở tốc độ văng — kính nổ tung vào trong, mảnh kính bay tỏa tròn theo quỹ đạo thực tế, khung cửa bung vỡ, và ông lộn nhào vào phòng, cả người lẫn burger. Tiếp đất = cơ thể mũm mĩm của ông đập mạnh nặng nề xuống sàn / sofa trong phòng, mảnh kính rơi lả tả xung quanh. Chuỗi cảnh quay (theo đúng thứ tự, nhịp độ và chuyển đổi âm thanh này): S1・Mở đầu: cực cận cảnh nhai (CÓ âm thanh) — phim mở bằng khuôn mặt ông chiếm toàn bộ màn hình: @Image1 đang ngoạm burger, má phồng lên, má đỏ ửng, mắt say nheo lại, biểu cảm mơ màng, sốt dính ở khóe miệng, hoàn toàn mãn nguyện. Nghe rõ tiếng nhai, tiếng ậm ừ hài lòng bị nghẹt, ambience thành phố neon xa xa. Real-time. S2・Kéo ra cảnh rộng: vươn vai → trượt chân và rơi (CÓ âm thanh) — camera mượt mà kéo lùi ra thành cảnh rộng: người đàn ông say ở gần mép sân thượng, lon bia rỗng và túi burger vương vãi bên cạnh. Ông lảo đảo đứng dậy, vươn vai một cách khoái chí, ngả người ra sau — mất chỗ đặt chân, trượt, rồi loạng choạng lùi thẳng khỏi mép sân thượng. Vụng về và đúng vật lý, burger không bao giờ rời tay. Ambience thành phố + một tiếng la hoảng ngắn. Real-time. S3・Cắt: cận cảnh gương mặt kinh hãi (la hét, ĐIẾC TAI) — cắt gắt sang cực cận mặt ông giữa lúc rơi: đôi mắt say bật mở to, cằm đôi rúm lại, kinh hoàng tột độ, miệng há rộng trong tiếng hét khủng khiếp "AAAH—!!". Tiếng hét cực lớn và bùng nổ, gió rít qua. Real-time. S4・Cắt: cảnh rộng xa ngang tầm mắt (IM LẶNG TUYỆT ĐỐI) — cắt gắt sang cảnh rộng từ xa, ngang tầm mắt: nhìn từ một tòa nhà đối diện hoặc từ đường phố, một bóng người trắng nhỏ xíu lao thẳng xuống dọc tòa nhà chọc trời, siêu đô thị neon cao vút, rộng lớn và dửng dưng. Khung hình hoàn toàn im lặng — tĩnh tuyệt đối, một tương phản hài đen tàn nhẫn với tiếng hét điếc tai ngay một giây trước, nhấn mạnh cá nhân nhỏ bé và phi lý đến mức nào. Real-time. S5・Cắt: cận mặt (la hét) → chộp được sợi cáp — cắt gắt trở lại cận mặt, âm thanh đập mạnh trở lại: ông tiếp tục hét "AAAAAH—!!", hai tay cào vào không khí — rồi chộp được sợi cáp cứu mạng! Sợi cáp giật căng và võng sâu dưới sức nặng của ông với một tiếng bật vang, tiếng hét bị cắt ngang giữa chừng khi ông bị giật lại và quăng văng ra ngoài. Speed ramp: slow motion ngắn đúng khoảnh khắc cáp chịu trọng lượng của ông (sợi cáp lún võng sâu, áo ba lỗ phấp phới dữ dội) → trở lại real-time khi ông bị quăng về phía cửa sổ. S6・Cắt: POV trong phòng (yên tĩnh) → kính nổ tung → hạ cánh bằng cú đâm — cắt gắt sang góc nhìn bên trong: camera trong một căn phòng tối mờ, yên tĩnh, nhìn ra ngoài qua ô cửa sổ sáng đèn — ban đầu hoàn toàn yên ắng, chỉ có tiếng máy điều hòa rất nhẹ. Giây tiếp theo, kính nổ tung vào trong (slow motion bullet-time ngắn), người đàn ông say lao xuyên qua cùng chiếc burger, mảnh kính bay tỏa tròn, ánh neon tràn qua khung kính vỡ; ông đập nặng nề vào phòng, xuống sàn / sofa, kính rơi leng keng. Bật trở lại real-time. S7・Kết thúc: một giây ngơ ngác → ngủ thiếp đi (cú chốt hài đen) — người đàn ông nằm dang tay dang chân trên sàn, phủ đầy mảnh kính, burger kỳ diệu thay vẫn trong tay (hoặc nằm trên ngực). Ông từ từ mở mắt và nhìn trống rỗng, ngơ ngác, trong đúng một giây — nhìn quanh như đang nghĩ "mình... đang ở đâu?". Rồi rượu thắng thế: ông chép môi vô tư, ôm chiếc burger vào ngực, lăn người, ổn định tư thế thoải mái trên sàn và ngủ say ngay với một tiếng ngáy nhẹ. Camera từ từ kéo lùi hoặc giữ trên tableau phi lý nhưng yên bình này. Cắt gắt sang đen. Âm thanh (thiết kế âm thanh hài đen) — chỉ âm thanh diegetic production, KHÔNG nhạc / KHÔNG phụ đề. Cốt lõi là các cú cắt gắt giữa ĐIẾC TAI và IM LẶNG: nhai và ậm ừ mãn nguyện (sound ON) → vươn vai, trượt chân, tiếng la ngắn (ON) → tiếng hét khổng lồ ở cận cảnh (BLASTING) → cảnh rộng từ xa trong im lặng tuyệt đối (tương phản chết lặng) → cận cảnh la hét lần nữa + tiếng cáp bật vang + tiếng hét bị cắt cụt khi chộp được → bên trong ban đầu yên tĩnh, rồi vụ nổ kính khổng lồ → tiếng tiếp đất bịch nặng + mảnh kính leng keng + một giây im lặng + tiếng chép môi hài lòng và ngáy khẽ, lắng xuống bình yên. Bên dưới: ambience thành phố cyberpunk (giao thông, tiếng điện neon vo ve, drone, mưa, tiếng gió rít mạnh dần khi rơi). Không thoại (ngoại trừ tiếng la và hét bản năng). Ràng buộc tích cực — chuỗi phim hài đen, nhiều cú cắt gắt, tuân thủ nghiêm ngặt tiến trình cỡ cảnh của storyboard (nhai ECU → wide → terrified CU → distant eye-level wide → face CU → interior POV) và chuyển đổi âm thanh (loud / silent va đập vào nhau). Chỉ MỘT nhân vật trong toàn bộ phim: một người đàn ông trung niên say rượu, mũm mĩm, đáng yêu, mặc áo ba lỗ trắng dính sốt và quần jeans, cầm burger; không có người nào khác; danh tính / khuôn mặt / kiểu cơ thể / trạng thái say / trang phục / burger khớp 100% với ảnh tham chiếu, nhất quán xuyên suốt, không drift. Vật lý hoàn toàn thực tế xuyên suốt (đủ trọng lượng, mỗi va chạm đều rõ ràng, không bồng bềnh); vóc dáng say rượu mũm mĩm khiến cú rơi và các va chạm nặng hơn và buồn cười hơn. Cử chỉ say xỉn từ đầu đến cuối (lỏng lẻo, chậm chạp, lơ mơ). Vòng chuyện khép kín: ăn burger và uống bia → vươn vai và trượt chân → rơi trong tiếng hét → chộp cáp → lao vỡ cửa sổ → một giây ngơ ngác → ngủ thiếp đi. Chất liệu live-action photorealistic, đêm neon cyberpunk, 60:30:10, KHÔNG có vẻ 3D render / game / anime. Chỉ âm thanh môi trường và vocal bản năng của nhân vật; không nhạc / phụ đề / chữ trên màn hình.

Generated with Seedance 2.5 on Atlas Cloud

Generated with HappyHorse 1.1on Atlas Cloud

Generated with Seedance 2.0 on Atlas Cloud

Từ kịch bản đến màn ảnh: Seedance 2.5 API trong môi trường production

Dù bạn đang đạo diễn một quảng cáo 30 giây trong một lần quay, giữ cho 50 tài sản tham chiếu đúng nhận diện thương hiệu, hay bản địa hóa phụ đề cho thị trường mới, Seedance 2.5 API biến mỗi kịch bản thành một lệnh gọi API duy nhất trên Atlas Cloud.

Một lần tạo, trọn câu chuyện 30 giây

Seedance 2.5 tạo video native dài tối đa 30 giây trong một lượt, không cần ghép nối. Hãy đạo diễn một quảng cáo, trailer hoặc cảnh phim ngắn hoàn chỉnh như một cú máy liên tục.

Chiến dịch đúng nhận diện thương hiệu qua Seedance 2.5 API

Cung cấp cho Seedance 2.5 API tối đa 50 tham chiếu đa phương thức, từ bộ nhân vật đến brand kit và bảng phong cách. Mọi cảnh trong chiến dịch đều nhất quán với thương hiệu mà không cần nhiều vòng chỉnh sửa lặp lại.

Chỉnh sửa có mục tiêu, giữ nguyên các cảnh còn lại

Cần thay đổi một chi tiết mà không làm lại cả cảnh quay? Khả năng chỉnh sửa cục bộ mạnh hơn cho phép bạn vẽ lại một vùng của khung hình theo yêu cầu, trong khi bố cục xung quanh, chuyển động của chủ thể và ánh sáng vẫn giữ đúng như đã tạo.

Hiển thị chú thích ở mọi ngôn ngữ

Văn bản trên màn hình và phụ đề đa ngôn ngữ được render trực tiếp bên trong khung hình, nên tiêu đề và chú thích không còn cần bước phủ lớp riêng. Các nhóm bản địa hóa có thể cắt cùng một cảnh cho mọi thị trường.

Chuyển động tuân theo vật lý thực

Vật thể rơi, va chạm và tương tác theo các quy luật vật lý, trong khi chủ thể vẫn giữ nhất quán danh tính xuyên suốt toàn bộ clip. Độ tin cậy đó khiến công cụ phù hợp cho demo sản phẩm, hành động thể thao và kể chuyện xoay quanh nhân vật.

Bậc thầy 4K

Độ phân giải có thể mở rộng từ 480p cho các bản nháp mạng xã hội nhanh chóng đến siêu HD 4K cho các vị trí cao cấp. Phân phối một chiến dịch duy nhất trên các bảng tin, trình phát web và màn hình lớn mà không cần bước nâng cấp độ phân giải (upscaling) riêng biệt.

So sánh Seedance 2.5 API: tạo video 30 giây so với Kling, Veo và Wan

Từ độ dài clip trong một lượt, khả năng dùng tham chiếu đến độ phân giải, xem chính xác Seedance 2.5 API vượt lên ở đâu so với các model video mạnh nhất được lưu trữ trên Atlas Cloud.

ModelĐộ dài clip tối đa (một lượt)Đầu vào tham chiếu đa phương thứcĐộ phân giải tối đaÂm thanh tích hợp sẵnGiá trên Atlas Cloud (Standard)
Seedance 2.5Tối đa 30 giâyTối đa 50 tài nguyên (hình ảnh, video, âm thanh)Lên đến 4KTừ $0.134
Seedance 2.0Tối đa 15 giâyTối đa 12 tệp (hình ảnh, video, âm thanh)Tối đa 4KTừ $0.112
Kling v3.0 ProTối đa 15 giây-1080pTừ $0.112
Veo 3.1Tối đa 8 giây mỗi lượtTối đa 3 hình ảnhTối đa 1080pTừ $0.20
Wan 2.7Tối đa 15 giâyTối đa 5 tài nguyên (hình ảnh và video)Tối đa 1080pTừ $0.10

Cách Sử Dụng Seedance 2.5 trên Atlas Cloud

Bắt đầu trong vài phút — làm theo các bước đơn giản sau để tích hợp và triển khai mô hình qua nền tảng Atlas Cloud.

Tạo Tài Khoản Atlas Cloud

Đăng ký tại atlascloud.ai và hoàn tất xác minh. Người dùng mới nhận được tín dụng miễn phí để khám phá nền tảng và thử nghiệm mô hình.

Tại sao Sử dụng Seedance 2.5 trên Atlas Cloud

Sự kết hợp của các mô hình tiên tiến của Seedance 2.5 với nền tảng được tăng tốc GPU của Atlas Cloud mang lại hiệu suất, khả năng mở rộng và trải nghiệm nhà phát triển độc đáo.

Hiệu suất và Tính linh hoạt

Độ Trễ Thấp:
Suy luận được tối ưu hóa GPU cho suy luận thời gian thực.

API Thống nhất:
Chạy Seedance 2.5, GPT, Gemini và DeepSeek với một tích hợp duy nhất.

Giá cả Minh bạch:
Thanh toán dựa trên token có thể dự đoán với tùy chọn serverless.

Doanh nghiệp và Mở rộng

Trải nghiệm Nhà phát triển:
SDK, phân tích, công cụ tinh chỉnh và mẫu.

Độ tin cậy:
99,99% khả dụng, RBAC và ghi nhật ký sẵn sàng cho tuân thủ.

Bảo mật và Tuân thủ:
SOC 2 Type II, tuân thủ HIPAA, chủ quyền dữ liệu tại Hoa Kỳ.

Giải đáp thắc mắc về Seedance 2.5 API

API Seedance 2.5 cung cấp quyền truy cập theo chương trình vào mô hình tạo video mới nhất của ByteDance. Nó tạo ra tới 30 giây video gốc chỉ trong một lần chạy và chấp nhận tối đa 50 đầu vào tham chiếu đa phương thức, một bước tiến đáng kể so với các bản phát hành Seedance trước đó. Hiện nó đã có mặt trên Atlas Cloud thông qua cùng một nền tảng thống nhất đã lưu trữ Seedance 2.0 và 1.5.

Các tập phim ngắn, quảng cáo sản phẩm và phim thương hiệu là những ứng dụng phù hợp rõ ràng nhất: một clip đầy đủ 30 giây được tạo trong một lần chạy, nên các câu chuyện dài hơn không còn cần ghép lại từ nhiều lần tạo riêng lẻ. Văn bản trên màn hình cũng là một thế mạnh, vì Seedance 2.5 hiển thị tiêu đề, chú thích và phụ đề đa ngôn ngữ trực tiếp trong khung hình. Khả năng mô phỏng vật lý được cải thiện giúp đám đông, nước và vải chuyển động tự nhiên từ khung hình đầu đến khung hình cuối.

Đăng ký tại atlascloud.ai và tạo khóa API từ bảng điều khiển của bạn. API Seedance 2.5 hiện đã có sẵn trên cùng một nền tảng đang lưu trữ Seedance 2.0 và 1.5, vì vậy bạn có thể gọi nó ngay lập tức và mã được viết cho các phiên bản trước đó có thể được sử dụng lại chỉ bằng cách thay đổi tên mô hình.

Có thể đính kèm tối đa 50 tham chiếu đa phương thức vào một request, kết hợp hình ảnh, video clip và âm thanh. Cần giữ một nhân vật, sản phẩm hoặc môi trường giống hệt nhau trong mọi cảnh quay? Hãy neo chúng bằng các tài nguyên tham chiếu, và Seedance 2.5 sẽ duy trì danh tính đó xuyên suốt toàn bộ 30 giây; đó là lý do các đội ngũ sáng tạo xem hệ thống tham chiếu là tính năng nổi bật nhất của mô hình.

Seedance 2.5 API hỗ trợ đầu ra từ 480p đến 4K. Hãy tạo bản nháp nhanh chóng ở 480p trong khi bạn tinh chỉnh các câu lệnh (prompts), sau đó chạy lại cùng một yêu cầu đó ở 4K để có kết quả rõ nét hơn. Danh sách đầy đủ các tỷ lệ khung hình và tham số được ghi chép trong tài liệu tham khảo Seedance 2.5 API trên Atlas Cloud.

Có. Seedance 2.5 tăng cường khả năng chỉnh sửa có mục tiêu, nên một prompt có thể thay đổi một chủ thể, đối tượng hoặc vùng trong clip hiện có trong khi bố cục và chuyển động xung quanh vẫn được giữ nguyên. Điều này giúp việc thay sản phẩm, điều chỉnh trang phục hoặc sửa một chi tiết đơn lẻ trở nên thực tế hơn mà không cần tạo lại toàn bộ cảnh.

Độ dài clip gốc tăng gấp đôi từ 15 lên 30 giây, và khả năng tham chiếu mở rộng lên 50 tài nguyên đa phương thức. Khả năng kiểm soát là nâng cấp ít ồn ào hơn nhưng quan trọng: vật lý ổn định hơn trong các chuyển động phức tạp, nhân vật và sản phẩm giữ được danh tính qua nhiều cảnh quay, còn văn bản trong khung hình và phụ đề đa ngôn ngữ được hiển thị sạch hơn so với Seedance 2.0. Tổng hợp lại, những thay đổi này đưa mô hình từ tạo clip sang sản xuất nội dung ngắn hoàn chỉnh.

Seedance 2.5 API sử dụng hệ thống thanh toán trả phí theo mức sử dụng minh bạch giống như phần còn lại của dòng sản phẩm Seedance, không yêu cầu đăng ký hoặc cam kết tối thiểu. Truy cập trang mô hình Seedance 2.5 trên Atlas Cloud để xem mức giá cho mỗi lần tạo theo độ phân giải hiện tại. Bắt đầu xây dựng ngay hôm nay.

Khám phá Thêm Dòng

Seedance 2.5

Seedance 2.5 API hiện đã có mặt trên Atlas Cloud! Cung cấp cho các nhà phát triển mô hình video mới nhất của ByteDance. Nó tạo ra tối đa 30 giây video gốc chỉ trong một lần xử lý từ văn bản, một hình ảnh duy nhất hoặc tối đa 50 tài liệu tham khảo đa phương thức, với âm thanh được đồng bộ hóa và văn bản đa ngôn ngữ trong khung hình. Trên Atlas Cloud, bạn có thể truy cập thông qua một khóa duy nhất, với tính nhất quán của chủ thể và vật lý được cải thiện giúp giữ cho các cảnh quay dài luôn mạch lạc.

Xem Dòng

Wan 3.0

Wan 3.0 API là thế hệ tiếp theo trong hệ sinh thái video Wan của Alibaba, được xây dựng để đưa khả năng tạo video dài, kiểm soát đa tham chiếu và chất lượng nghe nhìn lên những tầm cao mới. Atlas Cloud đã lưu trữ Wan 2.7, 2.6 và 2.5, và Wan 3.0 hoạt động trên cùng một khóa hợp nhất mà không cần thiết lập riêng. Bắt đầu xây dựng ngay hôm nay. Cuộn xuống phần trưng bày để xem những gì Wan 3.0 có thể tạo ra.

Xem Dòng

MiniMax H3

MiniMax H3 là dòng mô hình video của MiniMax dành cho việc tạo video từ văn bản, hình ảnh và ảnh tham chiếu. Tạo các đoạn clip dài 5 đến 15 giây, định hướng chuyển động bằng khung hình cuối tùy chọn, giữ lại chủ thể từ ảnh tham chiếu hoặc chọn H3 Developer khi âm thanh được tạo phù hợp với quy trình làm việc. Atlas Cloud tích hợp H3, H3 Fast, H3 Max và H3 Developer vào một quy trình API duy nhất, với mức giá tiêu chuẩn từ $0.038 mỗi giây. Bắt đầu xây dựng ngay hôm nay.

Xem Dòng

Seedream 5.0 Pro

Seedream 5.0 Pro API cung cấp cho các nhà phát triển mô hình chỉnh sửa hình ảnh có thể kiểm soát của ByteDance trên Atlas Cloud. Nó đặt các chỉnh sửa một cách chính xác bằng các điểm neo và tọa độ, tách hình ảnh thành các lớp có thể chỉnh sửa, kết hợp nhiều tham chiếu và khớp màu sắc cũng như vật liệu chính xác, với văn bản đa ngôn ngữ ở độ phân giải 2K và 3K. Trên Atlas Cloud, bạn có thể truy cập nó chỉ bằng một khóa!

Xem Dòng

Seedance 2.0

Seedance 2.0 API cung cấp cho bạn quyền truy cập cấp sản xuất vào mô hình video đa phương thức của ByteDance — đầu vào bốn phương thức (văn bản, hình ảnh, video, âm thanh) và hệ thống "Universal Reference" hàng đầu trong ngành giúp khóa bố cục, chuyển động của camera và hành động của nhân vật trên các cảnh quay. Tích hợp quyền kiểm soát cấp độ đạo diễn bằng một lệnh gọi API, mức giá cố định $0,09/giây, cấp khóa tức thì và không có danh sách chờ — được hỗ trợ bởi thời gian hoạt động và sự tuân thủ cấp doanh nghiệp. Seedance 2.0 Native 4K hiện đã ra mắt!

Xem Dòng

GPT Image 2.5

Dòng gpt-image-2.5 của OpenAI mang đến cho nhà phát triển lựa chọn giữa Flare và Sunburst cho các quy trình xử lý ảnh trong môi trường production. Kết xuất ở độ phân giải tùy ý lên đến 3840x2160 và chọn một trong năm cấp chất lượng, bao gồm xhigh và max, để đáp ứng các yêu cầu đầu ra cụ thể. Atlas Cloud cung cấp dịch vụ suy luận REST sẵn sàng sử dụng, không cần khởi động nguội, với mức giá tiêu chuẩn từ $0.004 cho mỗi lần tạo. Bắt đầu xây dựng ngay hôm nay.

Xem Dòng

GPT Image 2

GPT Image 2 API cung cấp cho các nhà phát triển quyền truy cập vào mô hình hình ảnh mới nhất của OpenAI, phiên bản kế nhiệm của GPT Image 1.5. Mô hình này tạo và chỉnh sửa hình ảnh với khả năng hiển thị văn bản chính xác trên các chữ viết Latinh và CJK, cùng với bố cục mạnh mẽ cho áp phích, mockup và đồ họa thông tin. Trên Atlas Cloud, bạn có thể truy cập nó thông qua một API thống nhất cùng với hơn 300 mô hình khác, với tín dụng miễn phí, 99,99% thời gian hoạt động và không yêu cầu xác minh tổ chức OpenAI.

Xem Dòng

Gemini Omni Flash

Gemini Omni API mang dòng Gemini Omni Flash đa phương thức nguyên bản của Google DeepMind, bao gồm Gemini Omni 1.1 Flash, đến với các nhà phát triển. Tạo video điện ảnh với âm thanh gốc được đồng bộ, tạo chuyển động cho ảnh tĩnh với khả năng kiểm soát chính xác khung hình bắt đầu và kết thúc, hoặc chỉnh sửa cảnh quay hiện có bằng các hướng dẫn văn bản mà vẫn bảo toàn nội dung không được thay đổi. Atlas Cloud cung cấp một khóa tương thích với OpenAI, quyền truy cập hợp nhất và mức giá trả theo mức sử dụng minh bạch. Bắt đầu xây dựng ngay hôm nay.

Xem Dòng

Grok Imagine

Grok Imagine API của xAI cung cấp các mô hình hình ảnh, video và lời nói, từ Image 2.0 đến Video 1.5 và xAI TTS v1. Render 1K hoặc 2K hình tĩnh trên 14 tỷ lệ khung hình, tạo cảnh 15 giây video 1080p, điều hướng các shot bằng tối đa 7 hình ảnh tham chiếu, hoặc cung cấp lời tường thuật bằng 20 ngôn ngữ. Atlas Cloud chạy mọi chế độ trên một endpoint, có giá theo mô hình trả tiền khi sử dụng từ $0.02 mỗi hình ảnh và $0.05 mỗi giây. Bắt đầu xây dựng hôm nay.

Xem Dòng

Google

Các mô hình sáng tạo mạnh mẽ nhất của Google hiện đều có sẵn trên Atlas Cloud. Veo 3.1 cung cấp khả năng tạo video đậm chất điện ảnh, Nano Banana 2 hỗ trợ tạo hình ảnh có độ chân thực cao, và Gemini mang trí tuệ đa phương thức vào mọi quy trình làm việc. Truy cập toàn bộ bộ mô hình Google thông qua một API key duy nhất với tính khả dụng Day-0 và mức giá dùng bao nhiêu trả bấy nhiêu (pay-as-you-go).

Xem Dòng

Seedance 2.0 Mini

Seedance 2.0 Mini mang khả năng tạo video đa phương thức của ByteDance vào các quy trình làm việc nơi tốc độ và chi phí là quan trọng nhất. Nó cung cấp các khả năng cốt lõi của Seedance 2.0 với mức tiêu thụ tài nguyên nhẹ hơn — tạo nhanh hơn, chi phí mỗi video thấp hơn và tích hợp API giống như bạn đã sử dụng. Đối với các nhóm chạy các quy trình (pipeline) khối lượng lớn hoặc tạo nguyên mẫu ở quy mô lớn, Mini là lựa chọn mặc định thiết thực.

Xem Dòng

ByteDance

Từ tạo video điện ảnh đến kiến tạo hình ảnh có độ trung thực cao, các mô hình mạnh mẽ nhất của ByteDance hiện đã có mặt trên Atlas Cloud. Chạy Seedance và Seedream ở quy mô lớn với mức giá suy luận thấp nhất và không có chi phí quản lý cơ sở hạ tầng.

Xem Dòng

Một API cho mọi AI đa phương tiện.

Khám phá tất cả mô hình