Hero background 1Hero background 2Hero background 3

HappyHorse 1.1 Multi Image Video Generation

HappyHorse 1.1 là dòng sản phẩm tạo video của Alibaba dành cho các nhà phát triển làm việc với văn bản, khung hình nguồn hoặc hình ảnh tham chiếu. Sản phẩm biến prompt thành các đoạn clip, tạo chuyển động cho khung hình đầu tiên đã chọn với hướng dẫn tùy chọn và có thể sử dụng từ một đến chín hình ảnh tham chiếu để định hướng hình ảnh chính xác. Atlas Cloud tích hợp các quy trình này vào một giải pháp duy nhất với mức giá trả theo mức sử dụng minh bạch. Bắt đầu xây dựng ngay hôm nay.

Happyhorse 1.1 do Alibaba phát triển. Atlas Cloud (vận hành bởi Atlas Cloud AI LLC) cung cấp quyền truy cập vào mô hình này và không sở hữu mô hình. Mọi thương hiệu đều thuộc về chủ sở hữu tương ứng.

Khám phá Mô hình Hàng đầu

Atlas Cloud cung cấp cho bạn các mô hình sáng tạo tiên tiến nhất trong ngành.

So sánh các chế độ tạo video của HappyHorse 1.1

Chọn đầu vào văn bản, hình ảnh hoặc hình ảnh tham chiếu tùy theo cách bạn muốn định hướng từng video.

Phương thứcMô tả
HappyHorse 1.1 T2V API (Text to Video)Chuyển prompt văn bản thành video ở 480P, 720P hoặc 1080P với tỷ lệ khung hình linh hoạt và thời lượng từ 3 đến 15 giây. Sử dụng endpoint này để trực quan hóa ý tưởng, tạo nội dung mạng xã hội và sản xuất video mà không cần hình ảnh nguồn.
HappyHorse 1.1 I2V API (Image to Video)Bắt đầu từ hình ảnh khung hình đầu tiên, endpoint này tạo video dài từ 3 đến 15 giây với tùy chọn định hướng bằng prompt và đầu ra 480P, 720P hoặc 1080P. Phù hợp cho hoạt ảnh sản phẩm, chuyển động nhân vật và kể chuyện bằng hình ảnh dựa trên bố cục có sẵn.
HappyHorse 1.1 R2V API (Reference to Video)Định hướng quá trình tạo video bằng từ một đến chín hình ảnh tham chiếu cùng prompt văn bản, với lựa chọn đầu ra 480P, 720P hoặc 1080P, tỷ lệ khung hình linh hoạt và thời lượng từ 3 đến 15 giây. Chọn chế độ này cho các cảnh dựa trên hình ảnh tham chiếu, video ngắn tập trung vào nhân vật và những dự án đòi hỏi định hướng hình ảnh chặt chẽ hơn.

Bộ công cụ HappyHorse 1.1: ba đầu vào, một trải nghiệm liền mạch

HappyHorse 1.1 biến prompt, khung hình đầu tiên hoặc tối đa chín ảnh tham chiếu thành video dài từ 3 đến 15 giây, hỗ trợ đầu ra 480P, 720P và 1080P, chín tỷ lệ cho chế độ văn bản và ảnh tham chiếu, điều khiển seed cùng quyền truy cập trả theo mức sử dụng thông qua Atlas Cloud.

HappyHorse 1.1 Text-to-Video

Bắt đầu bằng prompt văn bản dài tối đa 2.500 ký tự để tạo một đoạn video hoàn chỉnh mà không cần ảnh đầu vào. HappyHorse 1.1 hỗ trợ đầu ra 480P, 720P hoặc 1080P, đồng thời cho phép đặt thời lượng từ 3 đến 15 giây. Bạn có thể chọn một trong chín tỷ lệ khung hình cho video màn hình rộng, dọc, vuông, chân dung hoặc siêu rộng. Quy trình này phù hợp để trực quan hóa ý tưởng, tạo quảng cáo và xây dựng các cảnh kể chuyện ngắn.

Hoạt ảnh từ khung hình đầu tiên

Biến một ảnh khung hình đầu tiên thành chuyển động, với prompt tùy chọn để định hướng hành động, phong cách hoặc chi tiết bối cảnh. Endpoint image-to-video chấp nhận tệp JPEG, JPG, PNG hoặc WEBP có dung lượng tối đa 20 MB, với cả hai chiều đều từ 300 pixel trở lên. Chọn 480P, 720P hoặc 1080P cùng thời lượng từ 3 đến 15 giây. Tính năng này phù hợp với ảnh sản phẩm, ảnh chân dung và các khung hình then chốt trong storyboard.

Điều khiển bằng ảnh tham chiếu của HappyHorse 1.1

Định hướng video mới bằng từ một đến chín ảnh tham chiếu cùng prompt văn bản bắt buộc. Mỗi ảnh tham chiếu JPEG, JPG, PNG hoặc WEBP có thể có dung lượng tối đa 20 MB, và cạnh ngắn phải đạt ít nhất 400 pixel. Thiết lập độ phân giải, thời lượng, tỷ lệ khung hình và seed cho đầu ra. Chế độ này cung cấp thêm tư liệu nguồn cho các quy trình định hướng nhân vật, sản phẩm và nghệ thuật.

Định dạng cho mọi nền tảng

Định khung cho mỗi lần tạo video dựa trên văn bản hoặc ảnh tham chiếu theo mục đích sử dụng với chín tỷ lệ: 16:9, 9:16, 1:1, 4:3, 3:4, 4:5, 5:4, 9:21 và 21:9. Độ phân giải trải dài từ 480P đến 720P và 1080P, trong khi thời lượng dao động từ 3 đến 15 giây. Kết hợp các tùy chọn này để tạo video cho bảng tin di động, trình phát web, bố cục vuông, ảnh chân dung hoặc khung hình siêu rộng mà không cần thay đổi endpoint.

Điều khiển seed của HappyHorse 1.1

Sử dụng tham số seed cùng các thiết lập prompt, độ phân giải, tỷ lệ và thời lượng khi cần kiểm soát chặt chẽ hơn các đầu vào tạo video. HappyHorse 1.1 chấp nhận giá trị seed từ -1 đến 2,147,483,647, trong đó -1 yêu cầu seed ngẫu nhiên. Giữ các thiết lập còn lại ở trạng thái tường minh trong quá trình lặp. Quy trình dựa trên tham số này giúp nhà phát triển tổ chức việc thử nghiệm sáng tạo và so sánh các biến thể với cấu trúc request nhất quán.

Một key, ba quy trình

Truy cập cả ba quy trình HappyHorse 1.1 thông qua Atlas Cloud bằng một key tương thích với OpenAI và hình thức thanh toán theo mức sử dụng. Mức giá tiêu chuẩn bắt đầu từ $0.07 mỗi giây, và chi phí tăng theo mức sử dụng thay vì theo gói đăng ký. Chuyển đổi giữa các đường dẫn model text-to-video, image-to-video và reference-to-video trong khi vẫn duy trì cùng một cách tích hợp. Thiết lập này phù hợp với các nhà phát triển xây dựng sản phẩm video đa chế độ mà không cần tài khoản riêng với từng nhà cung cấp.

HappyHorse 1.1 trong cuộc đối đầu prompt giữa ba mô hình

Xem HappyHorse 1.1 và hai mô hình video tương đương diễn giải cùng một prompt như thế nào qua các câu chuyện hành động đậm chất điện ảnh và kỳ ảo cách điệu.

Prompt

Một phân cảnh điện ảnh ẩm thực động lực học, chân thực như ảnh, liền mạch trong 8–10 giây trên một toa ăn đang lao qua trận bão tuyết núi cao dữ dội. Một đầu bếp tàu hỏa lành nghề đung đưa tự nhiên theo chuyển động lắc ngang khắc nghiệt của toa tàu khi nấu bữa sáng: anh dùng một tay tung cao chiếc crêpe mỏng màu vàng óng, trượt qua lối đi hẹp để bắt một quả cam đang lăn bằng tay còn lại, rồi dùng vành chảo đập vào chiếc crêpe đang rơi xuống, phóng nó theo một quỹ đạo cong gọn gàng và chính xác về mặt vật lý qua cánh cửa nối giữa các toa. Mở đầu bằng cận cảnh cực gần bám theo chiều ngang cạnh ngọn lửa bếp đang gầm rú, bột bánh xèo xèo và những giọt bơ nóng bắn tung tóe trên thép đánh bóng; chuyển nhanh thành cú máy nửa vòng quanh đầu bếp khi anh liên tục giữ thăng bằng trước từng cú giật, áo khoác và tạp dề phản ứng chân thực; sau đó lao qua khung cửa trong một cú máy bám theo chính xác chiếc crêpe đang bay khi nó vượt qua khớp nối co giãn sang toa kế bên, sượt qua một người phục vụ, rồi đáp hoàn hảo xuống đĩa thức ăn sáng của một hành khách bất ngờ. Đúng khoảnh khắc tiếp đất, một trận tuyết lở khổng lồ cuồn cuộn tràn qua bên ngoài cửa sổ khi đoàn tàu thoát khỏi nó, tạo nên cao trào hình ảnh sắc nét. Đèn tungsten ấm và ánh lửa cam tương phản với bình minh xanh băng giá xuyên qua những ô cửa sổ phủ vệt tuyết; các lớp màu thực phẩm cam-vàng, kim loại xám bạc và thiên nhiên hoang dã xanh lạnh; phối cảnh trung tâm sâu và hẹp, các khung cửa lặp lại lồng trong nhau, hiệu ứng thị sai mạnh, rung máy cầm tay tinh tế, chuyển động rõ nét, tính liên tục liền mạch của chủ thể và sự nhất quán không gian xuyên suốt cả hai toa, sự cân bằng chân thực, chất lỏng bắn tung tóe mượt mà, quán tính vải, va chạm và vật lý vật phóng. Thiết kế âm thanh đồng bộ: tiếng bánh tàu lạch cạch và tiếng toa tàu rên rỉ tạo nhịp điệu, tiếng chảo xèo xèo và tiếng bơ nổ lách tách đẩy nhanh nhịp, quả cam lăn đồng bộ với những tiếng kim loại leng keng, cú đập chảo rơi xuống như một nhịp gõ sáng rõ, tiếp nối bằng tiếng đĩa khẽ va và tiếng tuyết lở gầm vang; không slow motion, không cảnh tĩnh dư thừa, không màn hình, giao diện, dashboard, thanh tiến trình, biểu đồ, chú thích, phụ đề, logo hay văn bản hiển thị. Chủ nghĩa hiện thực điện ảnh cao cấp, quảng cáo ẩm thực năng động, ảo giác one-take đắm chìm, tỷ lệ khung hình 16:9.

Generated with HappyHorse-1.1 Text-to-video on Atlas Cloud

Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud

Generated with HappyHorse-1.0 Text-to-video on Atlas Cloud

Prompt

Một phân cảnh hành động hoạt hình 3D đồ họa, độ bão hòa cao, dài 9 giây tại một bến container lúc chạng vạng: một cây đại dương cầm màu đỏ san hô bị tuột khỏi vị trí và lao xuống dốc xếp hàng bằng thép, những bánh xe nhỏ rung lắc và nảy lên dưới sức nặng được thể hiện thuyết phục, trong khi một tài xế xe nâng mặc bộ đồ liền thân màu xanh cobalt phóng theo, luồn lách qua những cần cẩu màu vàng mù tạt và các container vận chuyển liên tục nâng lên hạ xuống, thoáng chốc tạo thành một hành lang khẩn cấp luôn biến đổi. Mở đầu bằng cú máy bám theo từ góc cực thấp, cách bánh xe đang quay và chân đàn rung giật dữ dội chỉ vài inch, tia lửa và va chạm kim loại đồng bộ hoàn hảo với âm thanh; nhanh chóng nâng máy lên góc nhìn từ trên xuống, hé lộ tuyến truy đuổi như một mê cung hình học gồm các khối màu đỏ san hô, xanh cobalt và vàng mù tạt; sau đó whip-pan và orbit ra phía trước chiếc xe nâng đang tăng tốc khi nó thu hẹp khoảng cách. Ở mép bến tàu, tài xế đẩy càng nâng xuống dưới cây đàn, nâng phần thân nặng ở khoảnh khắc cuối cùng, xoay một vòng đầy lực và hạ nó chắc chắn với tiếng clang trầm đồng bộ. Nắp đàn bật mở do quán tính; ở nhịp cuối, một con mòng biển đậu xuống các phím đàn và gõ một nốt cuối trong trẻo. Chuyển động liên tục với mật độ cao, động lượng, va chạm, độ nảy của hệ treo, tải trọng dịch chuyển và nhận diện ổn định của nhân vật và vật thể xuyên suốt đều đáng tin về mặt vật lý; bóng đổ sắc cạnh, bố cục hình học mạnh, hoạt hình 3D điện ảnh cách điệu, ánh viền chạng vạng sắc nét, nhịp percussion công nghiệp được tạo nên từ tiếng bánh xe lạch cạch, tiếng thủy lực xì hơi, va chạm container, tiếng động cơ gằn, tiếng cánh mòng biển và nốt đàn piano cuối cùng. Không slow motion, không cảnh chờ, không cú cắt phá vỡ tính liên tục không gian, không màn hình, giao diện phần mềm, dashboard, thanh tiến trình, biểu đồ, chú thích, nhãn, logo, watermark hay văn bản giải thích. Tỷ lệ khung hình 16:9.

Generated with HappyHorse-1.1 Text-to-video on Atlas Cloud

Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud

Generated with HappyHorse-1.0 Text-to-video on Atlas Cloud

HappyHorse 1.1 trong các quy trình sáng tạo

Từ ý tưởng chiến dịch và hoạt ảnh sản phẩm đến video thương hiệu theo ảnh tham chiếu và công cụ dành cho nhà phát triển, HappyHorse 1.1 biến prompt và hình ảnh thành nội dung video ngắn linh hoạt.

Ý tưởng chiến dịch HappyHorse 1.1

Biến các ý tưởng bằng văn bản thành video ở 480P, 720P hoặc 1080P với tỷ lệ khung hình linh hoạt. Đội ngũ sáng tạo có thể tạo ý tưởng chiến dịch, bài đăng mạng xã hội và đề xuất cốt truyện mà không cần cảnh quay gốc hay quay phim.

Ảnh tĩnh chuyển động

Bắt đầu bằng hình ảnh khung hình đầu tiên, sau đó hướng dẫn chuyển động bằng prompt tùy chọn trong thời lượng từ 3 đến 15 giây. Các nhà tiếp thị sản phẩm có thể biến tài nguyên tĩnh thành clip ra mắt, video trưng bày hoặc chuyển động cho danh mục sản phẩm.

Biến thể thương hiệu theo ảnh tham chiếu

Sử dụng từ một đến chín ảnh tham chiếu, model định hình video dựa trên dữ liệu hình ảnh được cung cấp ở độ phân giải lên đến 1080P. Đội ngũ thương hiệu có thể phát triển các biến thể chiến dịch dựa trên hình ảnh nhân vật, sản phẩm hoặc môi trường đã được phê duyệt.

Quy trình nội dung đa định dạng

Chọn tỷ lệ khung hình linh hoạt và ba cấp độ độ phân giải để chuẩn bị clip cho nhiều vị trí hiển thị khác nhau trong một quy trình tạo duy nhất. Nhà phát triển có thể hỗ trợ bố cục dọc, ngang và các bố cục khác trên nhiều sản phẩm nội dung và chiến dịch.

Lập kế hoạch clip HappyHorse 1.1

Bạn cần một nhịp storyboard nhanh hay một phân đoạn sản phẩm dài hơn? Thời lượng từ 3 đến 15 giây cho phép các công cụ sáng tạo hỗ trợ ý tưởng nhanh, clip quảng bá và chuỗi hình ảnh cô đọng trong cùng một giao diện.

Đầu vào linh hoạt cho ứng dụng video

Xây dựng ứng dụng video dựa trên văn bản, hình ảnh khung hình đầu tiên và đầu vào đa tham chiếu thông qua một họ model duy nhất. Người dùng có thể chọn chất liệu ban đầu phù hợp nhất với từng quy trình phát triển ý tưởng, tạo hoạt ảnh hoặc sáng tạo theo định hướng thương hiệu.

HappyHorse 1.1 nổi bật thế nào trong việc tạo video

So sánh các chế độ tạo video của HappyHorse 1.1 với các mô hình video hàng đầu của Atlas Cloud về đầu vào được hỗ trợ, thời lượng clip, độ phân giải, số lượng tham chiếu và giá cơ bản được niêm yết.

Mô hìnhĐầu vào được hỗ trợThời lượng đầu raĐộ phân giảiSố ảnh tham chiếu tối đaGiá cơ bản được niêm yết
HappyHorse-1.1 Text-to-videoPrompt văn bản3 đến 15 giây480P, 720P, 1080P-$0.07, chưa liệt kê đơn vị
HappyHorse-1.1 Image-to-videoẢnh khung hình đầu tiên và prompt tùy chọn3 đến 15 giây480P, 720P, 1080P-$0.07, chưa liệt kê đơn vị
HappyHorse-1.1 Reference-to-videoPrompt văn bản và ảnh tham chiếu3 đến 15 giây480P, 720P, 1080P9$0.07, chưa liệt kê đơn vị
Wan-3.0 Reference-to-videoTham chiếu văn bản, hình ảnh, video, âm thanh, tài liệu hoặc trang web2 đến 30 giây hoặc thời lượng thông minh480P, 720P, 1080P10$0.05, chưa liệt kê đơn vị
Seedance 2.5 Reference-to-VideoTham chiếu văn bản, hình ảnh, video và âm thanhTối đa 30 giây-30$0.167, chưa liệt kê đơn vị
MiniMax H3 Reference-to-VideoTham chiếu văn bản, hình ảnh, video và âm thanh4 đến 15 giây768p mặc định, tối đa 2K9$0.038/giây

Cách Sử Dụng Happyhorse 1.1 trên Atlas Cloud

Bắt đầu trong vài phút — làm theo các bước đơn giản sau để tích hợp và triển khai mô hình qua nền tảng Atlas Cloud.

Tạo Tài Khoản Atlas Cloud

Đăng ký tại atlascloud.ai và hoàn tất xác minh. Người dùng mới nhận được tín dụng miễn phí để khám phá nền tảng và thử nghiệm mô hình.

Tại sao Sử dụng Happyhorse 1.1 trên Atlas Cloud

Sự kết hợp của các mô hình tiên tiến của Happyhorse 1.1 với nền tảng được tăng tốc GPU của Atlas Cloud mang lại hiệu suất, khả năng mở rộng và trải nghiệm nhà phát triển độc đáo.

Hiệu suất và Tính linh hoạt

Độ Trễ Thấp:
Suy luận được tối ưu hóa GPU cho suy luận thời gian thực.

API Thống nhất:
Chạy Happyhorse 1.1, GPT, Gemini và DeepSeek với một tích hợp duy nhất.

Giá cả Minh bạch:
Thanh toán dựa trên token có thể dự đoán với tùy chọn serverless.

Doanh nghiệp và Mở rộng

Trải nghiệm Nhà phát triển:
SDK, phân tích, công cụ tinh chỉnh và mẫu.

Độ tin cậy:
99,99% khả dụng, RBAC và ghi nhật ký sẵn sàng cho tuân thủ.

Bảo mật và Tuân thủ:
SOC 2 Type II, tuân thủ HIPAA, chủ quyền dữ liệu tại Hoa Kỳ.

Xây dựng với HappyHorse 1.1: Các câu hỏi thường gặp

HappyHorse 1.1 là mô hình tạo video của Alibaba, có trên Atlas Cloud, dùng để chuyển văn bản, khung hình đầu tiên hoặc hình ảnh tham chiếu thành các đoạn video ngắn. Dòng mô hình này cung cấp các endpoint riêng cho text-to-video, image-to-video và reference-to-video.

Bạn có thể tạo một cảnh từ prompt văn bản, tạo chuyển động cho hình ảnh tĩnh hoặc định hướng một đoạn video mới bằng nhiều hình ảnh tham chiếu. Các quy trình này hỗ trợ video chỉ từ prompt, hoạt ảnh từ khung hình đầu tiên và nội dung được định hướng bằng hình ảnh tham chiếu.

Hãy tạo khóa API Atlas Cloud và gửi yêu cầu POST có xác thực đến /api/v1/model/generateVideo, kèm ID model đã chọn và các đầu vào bắt buộc. Phản hồi sẽ bao gồm ID tác vụ, bạn có thể dùng ID này để kiểm tra trạng thái dự đoán cho đến khi đầu ra sẵn sàng.

Chọn alibaba/happyhorse-1.1/text-to-video để tạo video dựa trên prompt, alibaba/happyhorse-1.1/image-to-video để tạo hoạt ảnh từ khung hình đầu tiên hoặc alibaba/happyhorse-1.1/reference-to-video để định hướng bằng nhiều hình ảnh. Mỗi chế độ có schema đầu vào riêng.

Đối với text-to-video và reference-to-video, bạn có thể chọn 480p, 720p hoặc 1080p, thời lượng từ 3 đến 15 giây và một trong chín tỷ lệ khung hình được hỗ trợ. Image-to-video cung cấp cùng phạm vi độ phân giải và thời lượng, đồng thời sử dụng hình ảnh đã tải lên làm khung hình đầu tiên.

Reference-to-video chấp nhận từ một đến chín URL hình ảnh, cùng prompt mô tả cách các hình ảnh đó định hướng kết quả. Các tệp JPEG, JPG, PNG và WEBP được hỗ trợ, với giới hạn 20 MB cho mỗi hình ảnh và cạnh ngắn tối thiểu 400 pixel.

Atlas Cloud niêm yết mức giá tiêu chuẩn là $0.07 cho mỗi giây đối với cả ba endpoint HappyHorse 1.1. Hình thức tính phí là trả theo mức sử dụng, vì vậy chi phí tạo video tăng theo thời lượng đoạn video được yêu cầu.

Sử dụng tham số seed trong text-to-video hoặc reference-to-video khi muốn kiểm soát tính ngẫu nhiên của quá trình tạo. Atlas Cloud chấp nhận các giá trị số nguyên cụ thể hoặc -1 nếu muốn dùng seed ngẫu nhiên.

Mỗi yêu cầu tạo ra một đoạn video dài từ 3 đến 15 giây. Image-to-video sử dụng một hình ảnh làm khung hình đầu tiên, còn reference-to-video chấp nhận tối đa chín hình ảnh tham chiếu.

Khám phá Thêm Dòng

Seedance 2.5

Seedance 2.5 API hiện đã có mặt trên Atlas Cloud! Cung cấp cho các nhà phát triển mô hình video mới nhất của ByteDance. Nó tạo ra tối đa 30 giây video gốc chỉ trong một lần xử lý từ văn bản, một hình ảnh duy nhất hoặc tối đa 50 tài liệu tham khảo đa phương thức, với âm thanh được đồng bộ hóa và văn bản đa ngôn ngữ trong khung hình. Trên Atlas Cloud, bạn có thể truy cập thông qua một khóa duy nhất, với tính nhất quán của chủ thể và vật lý được cải thiện giúp giữ cho các cảnh quay dài luôn mạch lạc.

Xem Dòng

Wan 3.0

Wan 3.0 API là thế hệ tiếp theo trong hệ sinh thái video Wan của Alibaba, được xây dựng để đưa khả năng tạo video dài, kiểm soát đa tham chiếu và chất lượng nghe nhìn lên những tầm cao mới. Atlas Cloud đã lưu trữ Wan 2.7, 2.6 và 2.5, và Wan 3.0 hoạt động trên cùng một khóa hợp nhất mà không cần thiết lập riêng. Bắt đầu xây dựng ngay hôm nay. Cuộn xuống phần trưng bày để xem những gì Wan 3.0 có thể tạo ra.

Xem Dòng

MiniMax H3

MiniMax H3 là dòng video đa phương thức của MiniMax, hỗ trợ sáng tạo từ văn bản, hình ảnh và nội dung tham chiếu. Trên các route được hỗ trợ, sản phẩm duy trì chủ thể từ nội dung tham chiếu, cung cấp các tỷ lệ khung hình linh hoạt và kết hợp âm thanh được tạo với hình ảnh thông qua H3 Developer, với hồ sơ đầu ra được lựa chọn theo endpoint. Atlas Cloud hợp nhất dòng sản phẩm này dưới một khóa tương thích với OpenAI, cùng mức giá trả theo nhu cầu minh bạch bắt đầu từ mức tiêu chuẩn $0.038 mỗi giây. Hãy bắt đầu xây dựng ngay hôm nay.

Xem Dòng

Seedream 5.0 Pro

Seedream 5.0 Pro API cung cấp cho các nhà phát triển mô hình chỉnh sửa hình ảnh có thể kiểm soát của ByteDance trên Atlas Cloud. Nó đặt các chỉnh sửa một cách chính xác bằng các điểm neo và tọa độ, tách hình ảnh thành các lớp có thể chỉnh sửa, kết hợp nhiều tham chiếu và khớp màu sắc cũng như vật liệu chính xác, với văn bản đa ngôn ngữ ở độ phân giải 2K và 3K. Trên Atlas Cloud, bạn có thể truy cập nó chỉ bằng một khóa!

Xem Dòng

Seedance 2.0

Seedance 2.0 là mô hình video phục vụ môi trường production của ByteDance, giúp tạo cảnh quay chính xác. Biến prompt thành video, tạo chuyển động cho hình ảnh khung hình đầu tiên với tùy chọn hướng dẫn bằng khung hình cuối, hoặc định hình kết quả bằng media tham chiếu và tùy chọn tìm kiếm web. Atlas Cloud hợp nhất các quy trình này trong một API duy nhất, với mức giá pay-as-you-go minh bạch và một key tương thích với OpenAI. Bắt đầu xây dựng ngay hôm nay.

Xem Dòng

GPT Image 2.5

Dòng gpt-image-2.5 của OpenAI mang đến cho nhà phát triển lựa chọn giữa Flare và Sunburst cho các quy trình xử lý ảnh trong môi trường production. Kết xuất ở độ phân giải tùy ý lên đến 3840x2160 và chọn một trong năm cấp chất lượng, bao gồm xhigh và max, để đáp ứng các yêu cầu đầu ra cụ thể. Atlas Cloud cung cấp dịch vụ suy luận REST sẵn sàng sử dụng, không cần khởi động nguội, với mức giá tiêu chuẩn từ $0.004 cho mỗi lần tạo. Bắt đầu xây dựng ngay hôm nay.

Xem Dòng

GPT Image 2

GPT Image 2 API cung cấp cho các nhà phát triển quyền truy cập vào mô hình hình ảnh mới nhất của OpenAI, phiên bản kế nhiệm của GPT Image 1.5. Mô hình này tạo và chỉnh sửa hình ảnh với khả năng hiển thị văn bản chính xác trên các chữ viết Latinh và CJK, cùng với bố cục mạnh mẽ cho áp phích, mockup và đồ họa thông tin. Trên Atlas Cloud, bạn có thể truy cập nó thông qua một API thống nhất cùng với hơn 300 mô hình khác, với tín dụng miễn phí, 99,99% thời gian hoạt động và không yêu cầu xác minh tổ chức OpenAI.

Xem Dòng

Gemini Omni Flash

Gemini Omni là dòng video đa phương thức nguyên bản của Google DeepMind, phục vụ việc tạo và chỉnh sửa video theo hướng dẫn từ prompt. Tạo video từ văn bản, tạo chuyển động cho ảnh tĩnh hoặc chỉnh sửa cảnh quay hiện có bằng các tham chiếu hình ảnh tùy chọn, đồng thời bảo toàn nội dung không bị tác động. Các tùy chọn linh hoạt về độ phân giải, tỷ lệ khung hình và thời lượng đáp ứng nhiều quy trình sản xuất khác nhau. Atlas Cloud hợp nhất quyền truy cập với mức giá trả theo mức sử dụng minh bạch. Bắt đầu xây dựng ngay hôm nay.

Xem Dòng

Grok Imagine

Grok Imagine API của xAI cung cấp các mô hình hình ảnh, video và lời nói, từ Image 2.0 đến Video 1.5 và xAI TTS v1. Render 1K hoặc 2K hình tĩnh trên 14 tỷ lệ khung hình, tạo cảnh 15 giây video 1080p, điều hướng các shot bằng tối đa 7 hình ảnh tham chiếu, hoặc cung cấp lời tường thuật bằng 20 ngôn ngữ. Atlas Cloud chạy mọi chế độ trên một endpoint, có giá theo mô hình trả tiền khi sử dụng từ $0.02 mỗi hình ảnh và $0.05 mỗi giây. Bắt đầu xây dựng hôm nay.

Xem Dòng

Google

Các mô hình sáng tạo mạnh mẽ nhất của Google hiện đều có sẵn trên Atlas Cloud. Veo 3.1 cung cấp khả năng tạo video đậm chất điện ảnh, Nano Banana 2 hỗ trợ tạo hình ảnh có độ chân thực cao, và Gemini mang trí tuệ đa phương thức vào mọi quy trình làm việc. Truy cập toàn bộ bộ mô hình Google thông qua một API key duy nhất với tính khả dụng Day-0 và mức giá dùng bao nhiêu trả bấy nhiêu (pay-as-you-go).

Xem Dòng

Seedance 2.0 Mini

Seedance 2.0 Mini mang khả năng tạo video đa phương thức của ByteDance vào các quy trình làm việc nơi tốc độ và chi phí là quan trọng nhất. Nó cung cấp các khả năng cốt lõi của Seedance 2.0 với mức tiêu thụ tài nguyên nhẹ hơn — tạo nhanh hơn, chi phí mỗi video thấp hơn và tích hợp API giống như bạn đã sử dụng. Đối với các nhóm chạy các quy trình (pipeline) khối lượng lớn hoặc tạo nguyên mẫu ở quy mô lớn, Mini là lựa chọn mặc định thiết thực.

Xem Dòng

ByteDance

Từ tạo video điện ảnh đến kiến tạo hình ảnh có độ trung thực cao, các mô hình mạnh mẽ nhất của ByteDance hiện đã có mặt trên Atlas Cloud. Chạy Seedance và Seedream ở quy mô lớn với mức giá suy luận thấp nhất và không có chi phí quản lý cơ sở hạ tầng.

Xem Dòng

Một API cho mọi AI đa phương tiện.

Khám phá tất cả mô hình