Seedance 2.0 Mini & Fast API với mức giá thấp nhất toàn cầu — giảm đến 68% so với giá chính thức
MiniMax H3 Fast Subject Preserving Video

MiniMax H3 Fast Subject Preserving Video

MiniMax H3 Fast là dòng tạo video dựa trên prompt của MiniMax, hỗ trợ chuyển văn bản thành video (text-to-video) mang phong cách điện ảnh, tạo hoạt ảnh có thể kiểm soát từ khung hình đầu tiên với tùy chọn thêm khung hình cuối, cùng các đoạn video dựa trên ảnh tham chiếu vẫn giữ lại chủ thể nguồn. Truy cập mọi quy trình qua API hợp nhất của Atlas Cloud với mức giá thanh toán theo mức sử dụng tiêu chuẩn là $0.046 mỗi giây, chỉ cần một lần tích hợp cho toàn bộ dòng sản phẩm. Bắt đầu xây dựng ngay hôm nay.

MiniMax H3 Fast do MiniMax phát triển. Atlas Cloud (vận hành bởi Atlas Cloud AI LLC) cung cấp quyền truy cập vào mô hình này và không sở hữu mô hình. Mọi thương hiệu đều thuộc về chủ sở hữu tương ứng.

Các đầu vào và chế độ tạo video của MiniMax H3 Fast

So sánh các endpoint MiniMax H3 Fast theo nguồn đầu vào, các khả năng đã được xác minh và quy trình sản xuất dự kiến.

Phương thứcMô tả
MiniMax H3 Fast T2V API (Văn bản thành video)Chuyển một prompt văn bản thành video 480P mang phong cách điện ảnh, thời lượng từ 5 đến 15 giây. Chọn khung hình 16:9, 9:16, 1:1 hoặc tự điều chỉnh cho các đoạn clip ý tưởng, nội dung mạng xã hội và bảng phân cảnh hình ảnh.
MiniMax H3 Fast I2V API (Hình ảnh thành video)Bắt đầu từ hình ảnh khung hình đầu tiên, endpoint này tạo video 480P theo hướng dẫn bằng văn bản và có thể tùy chọn kết hợp thêm khung hình cuối. Phù hợp cho việc tạo chuyển động từ ảnh, chuyển tiếp cảnh quay và các đoạn clip sản phẩm hoặc nhân vật dài từ 5 đến 15 giây.
MiniMax H3 Fast R2V API (Tham chiếu thành video)Một hình ảnh tham chiếu giúp giữ chủ thể nhất quán, trong khi prompt văn bản định hướng video 480P đầu ra. Sử dụng chế độ này cho các cảnh quảng bá nhất quán về chủ thể, nội dung của nhà sáng tạo hoặc các chuỗi hình ảnh ngắn dài từ 5 đến 15 giây.

MiniMax H3 Fast cho ba hướng sáng tạo

MiniMax H3 Fast mang đến khả năng tạo nội dung từ văn bản, hoạt ảnh với khung hình đầu tiên và khung hình cuối tùy chọn, cùng tính nhất quán của chủ thể dựa trên ảnh tham chiếu trong các clip 480P dài từ 5 đến 15 giây, với khung hình linh hoạt và một Atlas Cloud API có mức giá tiêu chuẩn $0.046 cho mỗi giây được tạo.

MiniMax H3 Fast Text to Video

Biến lời nhắc văn bản thành clip 480P mang phong cách điện ảnh với MiniMax H3 Fast. Chọn thời lượng từ 5 đến 15 giây và định khung kết quả theo tỷ lệ 16:9, 9:16, 1:1 hoặc định dạng thích ứng. Mô tả chủ thể, hành động, chuyển động máy quay và bối cảnh trong một yêu cầu duy nhất. Chế độ này phù hợp để khám phá ý tưởng trực tiếp, tạo bản nháp video mạng xã hội và lập kế hoạch cảnh quay trước khi sản xuất.

Kiểm soát khung hình đầu tiên và cuối cùng

Bắt đầu bằng một khung hình đầu vào được cung cấp và thêm khung hình cuối tùy chọn để định hướng cách chuỗi hình ảnh mở đầu và kết thúc. Lời nhắc văn bản điều khiển chuyển động giữa hai mốc hình ảnh đó, trong khi đầu ra vẫn giữ độ phân giải 480P và thời lượng từ 5 đến 15 giây. Ảnh đầu vào xác lập bố cục ban đầu. Sử dụng quy trình này cho các chuyển cảnh có kiểm soát, key art hoạt họa và màn ra mắt sản phẩm với phần kết được xác định rõ.

Duy trì tính nhất quán tham chiếu với MiniMax H3 Fast

Giữ cho chủ thể trong ảnh tham chiếu vẫn dễ nhận diện khi lời nhắc văn bản đưa chủ thể đó vào chuyển động. MiniMax H3 Fast Reference to Video tạo các clip 480P dài từ 5 đến 15 giây, mang đến cho nhà phát triển một quy trình chuyên biệt để tạo sinh dựa trên ảnh tham chiếu. Thay vì thiết kế lại chủ thể cho từng lượt quay, bạn có thể duy trì nhận diện hình ảnh của chủ thể trong một bối cảnh mới. Quy trình này phù hợp với nhân vật xuất hiện định kỳ, linh vật và các chuỗi hình ảnh tập trung vào sản phẩm.

Clip linh hoạt từ 5 đến 15 giây

Chọn bất kỳ thời lượng nào được hỗ trợ, từ 5 đến 15 giây, để phù hợp với nhịp độ của ý tưởng. Clip ngắn giúp tập trung vào việc lặp lại nhanh, còn đầu ra dài hơn tạo không gian cho một nhịp hình ảnh hoàn chỉnh trong một lần tạo. Cùng dải thời lượng này được hỗ trợ trên các quy trình dựa trên văn bản, hình ảnh và ảnh tham chiếu. Xây dựng quảng cáo ngắn, câu chuyện một cảnh hoặc bài kiểm tra chuyển động mà không cần thay đổi họ mô hình.

Định dạng cho mọi bảng tin và khung bố cục

Định dạng video được tạo từ văn bản theo khung ngang 16:9, feed dọc 9:16 hoặc bố cục vuông 1:1, đồng thời hỗ trợ cả khung hình thích ứng. Lựa chọn này giúp một họ mô hình đáp ứng các bài trình bày màn hình rộng, bài đăng mạng xã hội trên thiết bị di động và nội dung vuông cân đối. Tạo sinh dựa trên hình ảnh sử dụng khung hình đầu tiên được cung cấp làm điểm bắt đầu trực quan. Chọn quy trình và cách định khung phù hợp với nơi xuất bản thay vì phải xây dựng lại ý tưởng theo một canvas cố định.

Một API, tính phí theo giây

Truy cập cả ba quy trình MiniMax H3 Fast thông qua Atlas Cloud thay vì tích hợp các nhà cung cấp riêng cho quy trình văn bản, hình ảnh và ảnh tham chiếu. Mức giá tiêu chuẩn là $0.046 cho mỗi giây được tạo, vì vậy chi phí tăng trực tiếp theo độ dài clip đã chọn. Một điểm truy cập dùng chung giúp đơn giản hóa việc chuyển đổi giữa các chế độ tạo sinh khi dự án phát triển. Đây là lựa chọn thực tế cho các nhà phát triển đang thử nghiệm ý tưởng hoặc vận hành các pipeline video có thể lặp lại.

MiniMax H3 Fast trong màn so tài prompt của ba mô hình

Xem cách MiniMax H3 Fast, một đối thủ hàng đầu và một mô hình MiniMax H3 khác diễn giải cùng hai prompt video mang tính điện ảnh.

Prompt

Một câu chuyện vi mô giàu năng lượng kéo dài 7 giây trong một cảng cá bị bão đe dọa: một nữ ngư dân dáng mảnh, mái tóc bạc phong trần, mặc áo khoác vải dầu màu đỏ gỉ, đội mũ len vàng mù tạt, mặc quần lội nước màu tối và đi ủng sờn vì nước biển, đuổi theo một chiếc lưới đánh cá tuột chạy; gió dữ thổi phồng nó thành cánh buồm khổng lồ, kéo những chiếc phao màu cam và vàng rực về phía biển cuộn sóng. Mở đầu bằng cảnh macro cực cận một nút dây ướt sũng bật đứt, các sợi dây bung tóe về phía ống kính, tiếp theo là một cú push-in nhanh; whip-cut sang cảnh tracking ngang sát mặt đất khi cô chạy nước rút trên những tấm ván ướt, uyển chuyển cúi người lách qua mê cung hỗn loạn của những sợi dây quất vun vút, bước lên một giá gỗ rung lắc dữ dội rồi nhảy tới, vòng cả hai tay quanh sợi cáp chính. Cắt sang cảnh top-down thẳng đứng hoàn hảo: lưới hình học, cơ thể xoắn vặn của cô, những sợi dây đan chéo và các phao màu nảy lên va quyện trong một bố cục động học rõ ràng, khi toàn bộ trọng lượng cơ thể cô kéo sợi cáp xuống và chiếc lưới như cánh buồm đổ sầm xuống cầu cảng với tiếng bẹp ướt nặng như sấm, bắn tung sương mù và nước biển. Nhanh chóng push-in vào gương mặt nhẹ nhõm, phấn khích của cô khi một con cá bạc nhỏ bật ra khỏi mắt lưới sụp xuống và rơi gọn vào mũ len; cô khựng lại, trợn chéo mắt nhìn lên rồi cười toe. Duy trì tính nhất quán tuyệt đối về nhân vật, trang phục, lưới, dây và cảng qua mọi cú cắt; thể hiện chân thực về mặt vật lý lực căng dây, nút thắt, biến dạng vải, áp suất gió, quán tính, va chạm, bề mặt ướt, nước biển bắn tung và chuyển động của tóc. Ánh sáng bão màu cyan lạnh, áo đỏ gỉ và phao cam-vàng, backlight ấn tượng viền rõ lớp sương bay trong không khí, điện ảnh hàng hải 35mm chân thực, cảm giác gấp gáp của máy quay handheld, độ sâu trường ảnh nông, hạt phim tinh tế, chuyển động tự nhiên sắc nét, nhịp hài nhanh, không slow motion. Âm thanh: tiếng gió giật dâng cao, giàn dây cót két, dây đứt và quất vun vút, ủng nện lên ván ướt, giá gỗ rên rỉ, lưới đập xuống nặng nề, sau đó là tiếng cá rơi “bõm” hài hước và tiếng cười khúc khích đứt quãng vì hụt hơi của cô. Không có màn hình, giao diện phần mềm, bảng điều khiển, thanh tiến trình, biểu đồ, chú thích, phụ đề, logo, watermark, văn bản giải thích, người trùng lặp, sai lệch nhân vật, thay đổi trang phục, lỗi giải phẫu, tay chân rối hoặc tan chảy, hành vi dây phi lý, vải không trọng lượng, chuyển động giật cục, hành động đông cứng hoặc các cảnh cắt rời. Tỷ lệ khung hình 16:9.

Generated with MiniMax H3 Fast Text-to-Video on Atlas Cloud

Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud

Generated with MiniMax H3 Text-to-Video on Atlas Cloud

Prompt

Một chuỗi cảnh quảng cáo ẩm thực điện ảnh chân thực như ảnh kéo dài 8 giây, diễn ra trong căn bếp dim sum lúc bình minh: một đầu bếp bánh trẻ nhấc nắp xửng tre lên, và một chiếc har gow bóng mượt, bán trong mờ bất ngờ bật ra, phần nhân tôm màu hồng phát sáng xuyên qua lớp vỏ mỏng màu trắng ngà. Bắt đầu từ bên trong xửng, theo POV của chiếc bánh, khi nắp mở ra và ánh sáng vàng ấm từ cửa sổ xuyên qua làn hơi nước cuộn; cắt sang cảnh tracking macro cực cận lướt sát mặt bàn phủ bột khi chiếc bánh lăn nhào, bật nảy và bị ép bẹp đàn hồi trong lúc tháo chạy, tung lớp bột mịn lên sau mỗi cú va chạm. Người đầu bếp lập tức phản ứng, quét một cây cán bột gỗ ngang qua đường chạy của nó; whip-pan sang cảnh overhead xoay tròn khi chiếc bánh lách qua các dụng cụ, bị nén vào mặt bàn rồi phóng qua sống bóng loáng của một con dao phay trong một đường bay liên tục, thuyết phục về mặt vật lý. Bám sát ở ngang mặt bàn với bố cục chéo nhanh khi các hạt bột va vào làn hơi nước kéo dài; chiếc bánh đáp xuống vành xửng, lắc lư, lật ngược trở vào trong rồi tinh nghịch phun một luồng hơi nước cuối cùng vào gương mặt ngạc nhiên của đầu bếp. Duy trì tính nhất quán hoàn hảo về nhân vật, chiếc bánh, căn bếp và không gian qua mọi cú cắt; hành động liên tục mượt mà, quán tính chân thực, va chạm, biến dạng đàn hồi, texture vỏ ẩm trong mờ, chi tiết tôm hấp dẫn, thớ tre giàu cảm giác xúc giác, độ sâu trường ảnh nông, các cú chuyển nét macro sắc nét, bảng màu trắng ngà, nâu tre và hồng tôm, backlight buổi sáng vàng ấm, kỹ thuật quay quảng cáo ẩm thực tốc độ cao cao cấp, cảm giác hồi hộp tinh nghịch và nhịp hài chính xác. Âm thanh đồng bộ: tiếng nắp tre lách cách, tiếng nảy mềm như cao su, tiếng trượt trên bột, tiếng vút của cây cán bột, tiếng “ping” kim loại của dao phay và tiếng xì hơi nước dứt khoát, cùng phần gõ nhịp nhẹ dần dồn lên đến trò gây cười cuối cùng. Không slow motion, không cảnh tĩnh lấp chỗ trống, không màn hình, giao diện phần mềm, bảng điều khiển, thanh tiến trình, biểu đồ, chú thích, văn bản, logo, watermark, tay chân thừa, vật thể trùng lặp, dụng cụ bị hỏng, thức ăn biến hình hoặc chuyển động gián đoạn. Tỷ lệ khung hình 16:9.

Generated with MiniMax H3 Fast Text-to-Video on Atlas Cloud

Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud

Generated with MiniMax H3 Text-to-Video on Atlas Cloud

Từ Prompt đến video ngắn với MiniMax H3 Fast

MiniMax H3 Fast biến prompt văn bản, khung hình mở đầu, khung hình kết thúc tùy chọn và hình ảnh tham chiếu chủ thể thành video 480P phục vụ storyboard, định dạng mạng xã hội, chuyển cảnh có hướng dẫn, video ngắn về nhân vật và thử nghiệm ý tưởng chiến dịch.

Storyboard với MiniMax H3 Fast

Biến prompt văn bản thành đoạn video điện ảnh 480P dài từ 5 đến 15 giây. Nhà làm phim và các nhóm sáng tạo có thể thử nghiệm bối cảnh, nhịp độ và định hướng hình ảnh trước khi triển khai quy trình sản xuất quy mô lớn hơn.

Các phiên bản chiến dịch mạng xã hội

Chọn khung hình 16:9, 9:16, 1:1 hoặc thích ứng khi tạo video từ văn bản. Các nhóm marketing có thể chuẩn bị video ngang, dọc và vuông cho ý tưởng chiến dịch mà không cần xây dựng lại từng ý tưởng từ một tài sản khởi đầu riêng.

Hoạt ảnh hóa hình ảnh tĩnh

Tạo chuyển động cho hình ảnh khung hình đầu tiên thành đoạn video 480P theo hướng dẫn của prompt văn bản. Nhà thiết kế có thể biến tranh minh họa, hình ảnh tĩnh sản phẩm hoặc hình ảnh chủ đạo của chiến dịch trở nên sống động để dùng trong bản trình bày, bản xem trước và bài đăng mạng xã hội.

Chuyển cảnh giữa các khung hình có hướng dẫn

Cung cấp cả khung hình mở đầu và khung hình kết thúc để định hướng cách đoạn video dựa trên hình ảnh phát triển. Quy trình này phù hợp với nghiên cứu chuyển cảnh, ý tưởng trước và sau, cũng như các nhịp storyboard cần một điểm đến hình ảnh được xác định rõ trên màn hình.

Video ngắn về chủ thể với MiniMax H3 Fast

Giữ chủ thể được chọn luôn hiện diện bằng cách tạo video từ hình ảnh tham chiếu và prompt văn bản. Nhà sáng tạo có thể sản xuất video ngắn tập trung vào nhân vật, sự xuất hiện của sản phẩm hoặc các khoảnh khắc lặp lại trong chiến dịch, bắt đầu từ cùng một chủ thể hình ảnh.

Thử nghiệm ý tưởng với MiniMax H3 Fast

Đặt mỗi lần tạo trong khoảng từ 5 đến 15 giây ở 480P để tập trung khám phá ý tưởng. Các studio nhỏ có thể so sánh prompt, hình ảnh mở đầu và chủ thể tham chiếu qua những đoạn video ngắn trước khi chọn hướng phát triển.

MiniMax H3 Fast trong So sánh API Video của Bốn Mô hình

So sánh MiniMax H3 Fast với ba endpoint text-to-video của Atlas Cloud theo thời lượng clip, độ phân giải khả dụng, tỷ lệ khung hình và mức giá tiêu chuẩn được niêm yết.

Mô hìnhThời lượng đầu raĐộ phân giải khả dụngTỷ lệ khung hìnhGiá tiêu chuẩn
MiniMax H3 Fast Text-to-Video5-15s480P16:9, 9:16, 1:1, thích ứng$0.046/giây
Seedance 2.0 Mini Text-to-Video4-15s hoặc tự động480p, 720p, 720p-SR, 1080p-SR, 1440p-SR16:9, 4:3, 1:1, 3:4, 9:16, 21:9, thích ứng$0.056
Wan-3.0 Text-to-video2-30s hoặc thời lượng thông minh480P, 720P, 1080P16:9, 9:16, 4:3, 3:4, 1:1, thích ứng$0.05
Veo 3.1 Lite Text-to-video4s, 6s hoặc 8s720p, 1080p16:9, 9:16$0.05

Cách Sử Dụng MiniMax H3 Fast trên Atlas Cloud

Bắt đầu trong vài phút — làm theo các bước đơn giản sau để tích hợp và triển khai mô hình qua nền tảng Atlas Cloud.

Tạo Tài Khoản Atlas Cloud

Đăng ký tại atlascloud.ai và hoàn tất xác minh. Người dùng mới nhận được tín dụng miễn phí để khám phá nền tảng và thử nghiệm mô hình.

Tại sao Sử dụng MiniMax H3 Fast trên Atlas Cloud

Sự kết hợp của các mô hình tiên tiến của MiniMax H3 Fast với nền tảng được tăng tốc GPU của Atlas Cloud mang lại hiệu suất, khả năng mở rộng và trải nghiệm nhà phát triển độc đáo.

Hiệu suất và Tính linh hoạt

Độ Trễ Thấp:
Suy luận được tối ưu hóa GPU cho suy luận thời gian thực.

API Thống nhất:
Chạy MiniMax H3 Fast, GPT, Gemini và DeepSeek với một tích hợp duy nhất.

Giá cả Minh bạch:
Thanh toán dựa trên token có thể dự đoán với tùy chọn serverless.

Doanh nghiệp và Mở rộng

Trải nghiệm Nhà phát triển:
SDK, phân tích, công cụ tinh chỉnh và mẫu.

Độ tin cậy:
99,99% khả dụng, RBAC và ghi nhật ký sẵn sàng cho tuân thủ.

Bảo mật và Tuân thủ:
SOC 2 Type II, tuân thủ HIPAA, chủ quyền dữ liệu tại Hoa Kỳ.

Câu hỏi thường gặp về API MiniMax H3 Fast

MiniMax H3 Fast là một model tạo video trên Atlas Cloud với các route riêng cho text-to-video, image-to-video và reference-to-video. Cấu hình Atlas đã được xác minh tạo ra các clip 480P có thời lượng từ 5 đến 15 giây.

Bạn có thể tạo clip điện ảnh từ prompt văn bản, làm sống động ảnh khung hình đầu tiên với tùy chọn thêm khung hình cuối, hoặc tạo video từ ảnh tham chiếu trong khi vẫn giữ được khả năng nhận diện chủ thể. Mọi quy trình đã được xác minh đều hỗ trợ video 480P có thời lượng từ 5 đến 15 giây.

Chọn route Atlas Cloud phù hợp với dữ liệu đầu vào, sau đó gửi prompt và các trường media được định nghĩa trong schema Playground của route đó. Sử dụng minimax/h3-fast/text-to-video, minimax/h3-fast/image-to-video hoặc minimax/h3-fast/reference-to-video làm model ID.

Cả ba route Atlas Cloud đều hỗ trợ đầu ra 480P và thời lượng từ 5 đến 15 giây. Các request nằm ngoài phạm vi độ phân giải hoặc thời lượng này không thuộc cấu hình đã được xác minh.

Đối với text-to-video, bạn có thể chọn 16:9, 9:16, 1:1 hoặc adaptive. Các thông tin đã được xác minh chưa xác định danh sách tỷ lệ khung hình có thể chọn cho những route sử dụng hình ảnh, vì vậy hãy làm theo schema Playground của từng route.

Có. Route image-to-video tạo chuyển động từ khung hình đầu tiên được cung cấp và có thể nhận thêm khung hình cuối tùy chọn, trong khi prompt văn bản điều hướng chuyển động giữa hai khung hình.

Chọn reference-to-video khi bạn muốn ảnh tham chiếu làm điểm neo cho chủ thể trong toàn bộ clip được tạo. Kết hợp ảnh với prompt mô tả bối cảnh và chuyển động mong muốn, sau đó kiểm tra kết quả vì tính nhất quán của nội dung tạo sinh không phải là tuyệt đối.

Atlas Cloud niêm yết mức giá tiêu chuẩn là $0.046 cho mỗi giây video được tạo đối với các route text-to-video, image-to-video và reference-to-video. Khoản phí cuối cùng phụ thuộc vào thời lượng đầu ra và áp dụng mức giá tiêu chuẩn thay vì mức giá tạm thời được giảm.

Trước tiên, hãy xác nhận model ID khớp với workflow dự định, đầu ra được đặt ở 480P và thời lượng nằm trong khoảng từ 5 đến 15 giây. Đối với text-to-video, hãy sử dụng thêm 16:9, 9:16, 1:1 hoặc adaptive, sau đó đối chiếu mọi trường với schema Playground tương ứng trên Atlas Cloud.

Khám phá Thêm Dòng

Seedance 2.5

Seedance 2.5 API hiện đã có mặt trên Atlas Cloud! Cung cấp cho các nhà phát triển mô hình video mới nhất của ByteDance. Nó tạo ra tối đa 30 giây video gốc chỉ trong một lần xử lý từ văn bản, một hình ảnh duy nhất hoặc tối đa 50 tài liệu tham khảo đa phương thức, với âm thanh được đồng bộ hóa và văn bản đa ngôn ngữ trong khung hình. Trên Atlas Cloud, bạn có thể truy cập thông qua một khóa duy nhất, với tính nhất quán của chủ thể và vật lý được cải thiện giúp giữ cho các cảnh quay dài luôn mạch lạc.

Xem Dòng

Wan 3.0

Wan 3.0 API là thế hệ tiếp theo trong hệ sinh thái video Wan của Alibaba, được xây dựng để đưa khả năng tạo video dài, kiểm soát đa tham chiếu và chất lượng nghe nhìn lên những tầm cao mới. Atlas Cloud đã lưu trữ Wan 2.7, 2.6 và 2.5, và Wan 3.0 hoạt động trên cùng một khóa hợp nhất mà không cần thiết lập riêng. Bắt đầu xây dựng ngay hôm nay. Cuộn xuống phần trưng bày để xem những gì Wan 3.0 có thể tạo ra.

Xem Dòng

MiniMax H3

MiniMax H3 là dòng video đa phương thức của MiniMax, hỗ trợ sáng tạo từ văn bản, hình ảnh và nội dung tham chiếu. Trên các route được hỗ trợ, sản phẩm duy trì chủ thể từ nội dung tham chiếu, cung cấp các tỷ lệ khung hình linh hoạt và kết hợp âm thanh được tạo với hình ảnh thông qua H3 Developer, với hồ sơ đầu ra được lựa chọn theo endpoint. Atlas Cloud hợp nhất dòng sản phẩm này dưới một khóa tương thích với OpenAI, cùng mức giá trả theo nhu cầu minh bạch bắt đầu từ mức tiêu chuẩn $0.038 mỗi giây. Hãy bắt đầu xây dựng ngay hôm nay.

Xem Dòng

Seedream 5.0 Pro

Seedream 5.0 Pro API cung cấp cho các nhà phát triển mô hình chỉnh sửa hình ảnh có thể kiểm soát của ByteDance trên Atlas Cloud. Nó đặt các chỉnh sửa một cách chính xác bằng các điểm neo và tọa độ, tách hình ảnh thành các lớp có thể chỉnh sửa, kết hợp nhiều tham chiếu và khớp màu sắc cũng như vật liệu chính xác, với văn bản đa ngôn ngữ ở độ phân giải 2K và 3K. Trên Atlas Cloud, bạn có thể truy cập nó chỉ bằng một khóa!

Xem Dòng

Seedance 2.0

Seedance 2.0 là mô hình video phục vụ môi trường production của ByteDance, giúp tạo cảnh quay chính xác. Biến prompt thành video, tạo chuyển động cho hình ảnh khung hình đầu tiên với tùy chọn hướng dẫn bằng khung hình cuối, hoặc định hình kết quả bằng media tham chiếu và tùy chọn tìm kiếm web. Atlas Cloud hợp nhất các quy trình này trong một API duy nhất, với mức giá pay-as-you-go minh bạch và một key tương thích với OpenAI. Bắt đầu xây dựng ngay hôm nay.

Xem Dòng

GPT Image 2.5

Dòng gpt-image-2.5 của OpenAI mang đến cho nhà phát triển lựa chọn giữa Flare và Sunburst cho các quy trình xử lý ảnh trong môi trường production. Kết xuất ở độ phân giải tùy ý lên đến 3840x2160 và chọn một trong năm cấp chất lượng, bao gồm xhigh và max, để đáp ứng các yêu cầu đầu ra cụ thể. Atlas Cloud cung cấp dịch vụ suy luận REST sẵn sàng sử dụng, không cần khởi động nguội, với mức giá tiêu chuẩn từ $0.004 cho mỗi lần tạo. Bắt đầu xây dựng ngay hôm nay.

Xem Dòng

GPT Image 2

GPT Image 2 API cung cấp cho các nhà phát triển quyền truy cập vào mô hình hình ảnh mới nhất của OpenAI, phiên bản kế nhiệm của GPT Image 1.5. Mô hình này tạo và chỉnh sửa hình ảnh với khả năng hiển thị văn bản chính xác trên các chữ viết Latinh và CJK, cùng với bố cục mạnh mẽ cho áp phích, mockup và đồ họa thông tin. Trên Atlas Cloud, bạn có thể truy cập nó thông qua một API thống nhất cùng với hơn 300 mô hình khác, với tín dụng miễn phí, 99,99% thời gian hoạt động và không yêu cầu xác minh tổ chức OpenAI.

Xem Dòng

Gemini Omni Flash

Gemini Omni API mang dòng Gemini Omni Flash đa phương thức nguyên bản của Google DeepMind, bao gồm Gemini Omni 1.1 Flash, đến với các nhà phát triển. Tạo video điện ảnh với âm thanh gốc được đồng bộ, tạo chuyển động cho ảnh tĩnh với khả năng kiểm soát chính xác khung hình bắt đầu và kết thúc, hoặc chỉnh sửa cảnh quay hiện có bằng các hướng dẫn văn bản mà vẫn bảo toàn nội dung không được thay đổi. Atlas Cloud cung cấp một khóa tương thích với OpenAI, quyền truy cập hợp nhất và mức giá trả theo mức sử dụng minh bạch. Bắt đầu xây dựng ngay hôm nay.

Xem Dòng

Grok Imagine

Grok Imagine API của xAI cung cấp các mô hình hình ảnh, video và lời nói, từ Image 2.0 đến Video 1.5 và xAI TTS v1. Render 1K hoặc 2K hình tĩnh trên 14 tỷ lệ khung hình, tạo cảnh 15 giây video 1080p, điều hướng các shot bằng tối đa 7 hình ảnh tham chiếu, hoặc cung cấp lời tường thuật bằng 20 ngôn ngữ. Atlas Cloud chạy mọi chế độ trên một endpoint, có giá theo mô hình trả tiền khi sử dụng từ $0.02 mỗi hình ảnh và $0.05 mỗi giây. Bắt đầu xây dựng hôm nay.

Xem Dòng

Google

Các mô hình sáng tạo mạnh mẽ nhất của Google hiện đều có sẵn trên Atlas Cloud. Veo 3.1 cung cấp khả năng tạo video đậm chất điện ảnh, Nano Banana 2 hỗ trợ tạo hình ảnh có độ chân thực cao, và Gemini mang trí tuệ đa phương thức vào mọi quy trình làm việc. Truy cập toàn bộ bộ mô hình Google thông qua một API key duy nhất với tính khả dụng Day-0 và mức giá dùng bao nhiêu trả bấy nhiêu (pay-as-you-go).

Xem Dòng

Seedance 2.0 Mini

Seedance 2.0 Mini mang khả năng tạo video đa phương thức của ByteDance vào các quy trình làm việc nơi tốc độ và chi phí là quan trọng nhất. Nó cung cấp các khả năng cốt lõi của Seedance 2.0 với mức tiêu thụ tài nguyên nhẹ hơn — tạo nhanh hơn, chi phí mỗi video thấp hơn và tích hợp API giống như bạn đã sử dụng. Đối với các nhóm chạy các quy trình (pipeline) khối lượng lớn hoặc tạo nguyên mẫu ở quy mô lớn, Mini là lựa chọn mặc định thiết thực.

Xem Dòng

ByteDance

Từ tạo video điện ảnh đến kiến tạo hình ảnh có độ trung thực cao, các mô hình mạnh mẽ nhất của ByteDance hiện đã có mặt trên Atlas Cloud. Chạy Seedance và Seedream ở quy mô lớn với mức giá suy luận thấp nhất và không có chi phí quản lý cơ sở hạ tầng.

Xem Dòng

Một API cho mọi AI đa phương tiện.

Khám phá tất cả mô hình