Seedance 2.0 Mini & Fast API với mức giá thấp nhất toàn cầu — giảm đến 68% so với giá chính thức
Hero background 1Hero background 2Hero background 3

Qwen Image 3.0 Precise Text Rendering

Qwen Image 3.0 là dòng sản phẩm tạo và chỉnh sửa hình ảnh của Qwen dành cho các nhà phát triển xây dựng sản phẩm trực quan. Sản phẩm kết hợp khả năng tuân thủ prompt chính xác và kết xuất văn bản phức tạp với tính năng tự động viết lại prompt và lựa chọn độ phân giải dựa trên prompt. Thông qua Atlas Cloud, các nhà phát triển có thể truy cập cả model tạo và chỉnh sửa với mức giá thanh toán theo mức sử dụng tiêu chuẩn là $0.03 cho mỗi lần gọi. Bắt đầu xây dựng ngay hôm nay.

Qwen Image 3.0 do Alibaba phát triển. Atlas Cloud (vận hành bởi Atlas Cloud AI LLC) cung cấp quyền truy cập vào mô hình này và không sở hữu mô hình. Mọi thương hiệu đều thuộc về chủ sở hữu tương ứng.

Khám phá Mô hình Hàng đầu

Atlas Cloud cung cấp cho bạn các mô hình sáng tạo tiên tiến nhất trong ngành.

Qwen Image 3.0: So sánh khả năng tạo và chỉnh sửa

So sánh các endpoint Qwen Image 3.0 theo phương thức đầu vào, khả năng đã được xác minh, quy trình làm việc phù hợp và mức giá tiêu chuẩn.

Phương thứcMô tả
Qwen Image 3.0 Text-to-Image API (Chuyển văn bản thành hình ảnh)Chuyển một prompt văn bản thành hình ảnh với độ phân giải lên đến 2048×2048, kèm tính năng tự động viết lại prompt và lựa chọn độ phân giải theo prompt. Khả năng kết xuất văn bản phức tạp và tuân thủ prompt chính xác giúp API phù hợp với áp phích, hình ảnh sản phẩm, concept art và các quy trình làm việc dựa trên prompt khác. Atlas Cloud niêm yết mức giá cơ bản tiêu chuẩn là $0.03.
Qwen Image 3.0 Edit API (Chỉnh sửa hình ảnh)Cung cấp từ một đến ba hình ảnh tham chiếu cùng chỉ dẫn bằng ngôn ngữ tự nhiên để tạo hình ảnh đã chỉnh sửa, đồng thời bảo toàn các chi tiết quan trọng như đặc điểm khuôn mặt và danh tính. Sử dụng API cho việc điều chỉnh phong cách có kiểm soát, thay đổi có mục tiêu, duy trì tính nhất quán của nhân vật và tinh chỉnh hình ảnh theo từng vòng lặp. Atlas Cloud niêm yết mức giá cơ bản tiêu chuẩn là $0.03.

Qwen Image 3.0: Độ chính xác từ prompt đến chỉnh sửa

Qwen Image 3.0 kết hợp khả năng hiển thị văn bản phức tạp, đầu ra thích ứng lên đến 2048 × 2048, tự động viết lại prompt thông minh, chỉnh sửa dựa trên từ một đến ba ảnh tham chiếu và khả năng kiểm soát quá trình tạo ảnh thông qua một Atlas Cloud API duy nhất với mức giá $0.03 mỗi ảnh.

Văn bản phức tạp với Qwen Image 3.0

Văn bản phức tạp với Qwen Image 3.0

Qwen Image 3.0 biến các prompt chi tiết thành hình ảnh với khả năng tuân thủ chỉ dẫn chính xác và hiển thị văn bản phức tạp mạnh mẽ. Hãy mô tả thứ bậc, vị trí và phong cách hình ảnh bằng ngôn ngữ tự nhiên, sau đó để model sắp xếp bố cục theo các ràng buộc đó. Đây là lựa chọn thiết thực cho đồ họa chiến dịch khổ rộng, hình minh họa giàu thông tin và hình ảnh sản phẩm, nơi văn bản và hình ảnh cần phối hợp chặt chẽ.

Đầu ra thích ứng 2048 pixel

Đầu ra thích ứng 2048 pixel

Tạo ảnh ở độ phân giải từ 512 × 512 đến 2048 × 2048, hoặc bỏ qua kích thước để Qwen Image 3.0 tự chọn dựa trên prompt. Tính năng tự động định hướng độ phân giải sẽ điều chỉnh canvas theo cảnh được yêu cầu thay vì ép mọi ý tưởng vào một thiết lập cố định. Sử dụng tính năng này cho phong cảnh chi tiết, banner ngang, tài nguyên hình vuông và các định dạng bàn giao khác cần độ rõ nét sẵn sàng cho sản xuất.

Hai cách mở rộng prompt

Hai cách mở rộng prompt

Các prompt ngắn có thể được tự động mở rộng trước khi Qwen Image 3.0 tạo ảnh. Chọn chế độ trực tiếp để viết lại trong một lượt hoặc chế độ agent cho quy trình viết lại theo tác nhân, đồng thời vẫn có thể tắt tính năng mở rộng để toàn quyền kiểm soát thủ công. Sự linh hoạt này giúp các nhóm nhanh chóng chuyển từ bản mô tả ngắn gọn sang những cảnh phong phú hơn mà không buộc người dùng chuyên sâu phải theo một phương pháp viết prompt duy nhất.

Chỉnh sửa đa tham chiếu với Qwen Image 3.0

Chỉnh sửa đa tham chiếu với Qwen Image 3.0

Chỉnh sửa bằng một, hai hoặc ba ảnh tham chiếu kết hợp với chỉ dẫn bằng ngôn ngữ tự nhiên. Qwen Image 3.0 giữ lại các chi tiết nhận dạng quan trọng, bao gồm đặc điểm khuôn mặt, đồng thời áp dụng biến đổi được yêu cầu vào kết quả mới. Kết hợp người, sản phẩm và bối cảnh làm ảnh tham chiếu, hoặc tinh chỉnh một ảnh nguồn duy nhất. Quy trình này phù hợp với việc tạo biến thể chiến dịch, duy trì tính nhất quán của nhân vật và tái cấu trúc hình ảnh có kiểm soát.

Kiểm soát batch và seed

Kiểm soát batch và seed

Tạo tối đa bốn ảnh trong một request, định hướng các yếu tố cần loại trừ bằng prompt phủ định và đặt seed từ 0 đến 2147483647 khi cần khả năng tái lập. Bỏ trống seed bất cứ khi nào bạn muốn có biến thể mới. Các tùy chọn này giúp việc so sánh và lặp lại dễ dàng hơn trong định hướng nghệ thuật, tạo batch tài nguyên và quy trình kiểm thử cần chạy lại ổn định hoặc tạo đa dạng có chủ đích.

Một key, $0.03 mỗi ảnh

Một key, $0.03 mỗi ảnh

Cả tính năng tạo ảnh và chỉnh sửa bằng Qwen Image 3.0 đều có mức giá tiêu chuẩn đã được xác minh là $0.03 mỗi ảnh trên Atlas Cloud. Một API key duy nhất có thể truy cập cả hai route của model, giúp sản phẩm chuyển đổi giữa việc tạo hình ảnh mới và chỉnh sửa ảnh tham chiếu mà không cần tài khoản riêng từ các nhà cung cấp khác nhau. Cách tính phí minh bạch theo từng ảnh giúp việc tạo prototype, sản xuất batch và chỉnh sửa lặp lại diễn ra trong một quy trình dễ dự đoán.

So sánh hình ảnh Qwen Image 3.0 với cùng một prompt

Xem cách Qwen Image 3.0 và hai model hình ảnh tương đương diễn giải cùng các prompt sẵn sàng cho production trên các khía cạnh typography, chi tiết con người, ánh sáng, bố cục và độ chân thực của vật liệu.

Prompt

Ảnh thể thao tốc độ cao ở mặt cắt trên-dưới bên trong một nhà thi đấu nhảy cầu trong nhà hiện đại, ghi lại khoảnh khắc quyết định khi một vận động viên nhảy cầu trẻ thuộc nhóm tinh hoa lao xuyên qua mặt nước: phía trên đường mặt nước sắc nét, chỉ còn thấy đôi bàn chân duỗi thẳng hoàn hảo với các ngón chân duỗi nhọn giữa vương miện bọt nước trắng sắc nét bùng nổ; phía dưới mặt nước, hiển thị toàn bộ cơ thể thuôn dài của vận động viên đang chìm xuống qua các lớp nước màu turquoise, bao quanh bởi những vệt bong bóng hỗn loạn, giải phẫu cơ thể bị khúc xạ, các phản chiếu méo mó lấp lánh và vạch làn trên đáy bể hiện rõ. Trên sàn hồ bơi, một bảng điểm điện tử phải hiển thị chính xác dòng chữ hoàn toàn dễ đọc “ROUND 03 / 9.6”, trong khi một đồng đội đội mũ bơi màu cam-đỏ bật nhảy lên với vẻ ngạc nhiên và phấn khích chân thực. Ánh nắng buổi trưa định hướng mạnh xuyên chéo qua các giếng trời, tạo ra những cột sáng thể tích rõ ràng, bóng đổ có cạnh sắc, các vân sáng hội tụ phát quang trên mặt nước gợn và chiều sâu trong suốt mà không có quầng sáng nhân tạo. Bố cục với đường mặt nước chạy ngang qua toàn bộ khung hình và các làn hồ bơi lặp lại tạo thành những đường dẫn mạnh hướng về phía vận động viên; các tông cyan mở rộng và aqua đậm được nhấn vừa phải bằng mũ cam-đỏ, với tương phản màu xanh-cam tiết chế. Khúc xạ nước chân thực như ảnh chụp, kết cấu da trẻ tự nhiên, giải phẫu vận động viên chính xác, giọt nước lơ lửng, độ trong suốt phân lớp, chỉ có nhòe chuyển động nhẹ ở mép bọt nước, hạt film analog tinh tế, ảnh thể thao biên tập chân thực, vỏ máy ảnh dưới nước với cổng vòm split-shot, tốc độ màn trập nhanh, ống kính góc rộng 24mm, phân cấp nét rõ ràng. Tránh HDR xử lý quá mức, vi chi tiết thái quá, da nhựa, màu sắc đục, quầng sáng giả tưởng, bóng tối biển sâu mờ đục, grading teal-cam kiểu điện ảnh, tay chân dị dạng, cơ thể trùng lặp, typography méo mó, đường viền, khung hoặc letterboxing; tỷ lệ khung hình ngang rộng 16:9, tràn khung.

Generated with Qwen Image 3.0 Pro Text-to-Image on Atlas Cloud

Generated with Qwen Image 3.0 Pro Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Qwen Image 3.0 Text-to-Image on Atlas Cloud

Generated with Qwen Image 3.0 Text-to-Image on Atlas Cloud

Prompt

Ảnh thể thao chuyên nghiệp góc siêu rộng bên trong một nhà thi đấu nhảy cầu trong nhà ngập nắng vào giữa mùa hè, ghi lại tích tắc quyết định ngay sau khi hai vận động viên nhảy cầu đồng bộ nam nữ trẻ tuổi rời bục: nhịp của họ hơi lệch nhau, tạo thành một tư thế đối xứng ấn tượng—một vận động viên đứng thẳng, người còn lại lộn ngược—cả hai có giải phẫu chính xác, rõ ràng đang ở trên không, tóc ướt, cơ bắp căng, ngón chân duỗi nhọn và trang phục thi đấu bơi lội chân thực; các đồng đội bên hồ ngước lên và thở hắt ra trong hoảng hốt tự phát. Một bảng điểm điện tử dễ đọc hiển thị chính xác “FINAL DIVE / 9.8”. Ánh sáng ban ngày trắng lạnh chiếu chéo qua các cửa sổ cao sát mái, xuyên qua lớp sương ẩm mịn, trong khi những gợn sóng xanh cobalt phản chiếu từ hồ bơi lan lên các bức tường bê tông thô. Sử dụng kết cấu bục nhảy cầu như một khung trong khung mạnh và mặt nước như một bố cục phản chiếu thứ hai, với phối cảnh kiến trúc sắc nét, tỷ lệ thuyết phục và khoảng không ngang rộng tạo sức căng. Xanh cobalt tiết chế, tông da tự nhiên ấm áp và các điểm nhấn nhỏ màu cam an toàn; hơi nước chân thực, giọt nước, vải ẩm, hạt film tinh tế và nhòe chuyển động có hướng nhẹ trên tay chân của vận động viên cùng luồng không khí bị xáo trộn. Phóng sự ảnh thể thao đẳng cấp Olympic theo phong cách biên tập, kịch tính nhưng tự nhiên, góc nhìn thấp và rộng, ống kính 18mm, màn trập nhanh với vệt chuyển động được kiểm soát, mặt phẳng tiêu điểm sắc nét, chuyển vùng sáng tinh tế, kết cấu da chân thực. Không render bóng nhờn quá mức, không chi tiết HDR thái quá, không da nhựa, không màu sắc đục, không quầng sáng tràn lan, không vẻ ngoài fantasy sử thi rẻ tiền, không tạo dáng dàn dựng, không giải phẫu méo mó, không tay chân trùng lặp, không chữ trên bảng điểm khó đọc hoặc sai chính tả. Bố cục ngang rộng, tỷ lệ khung hình 16:9, tràn khung.

Generated with Qwen Image 3.0 Pro Text-to-Image on Atlas Cloud

Generated with Qwen Image 3.0 Pro Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Qwen Image 3.0 Text-to-Image on Atlas Cloud

Generated with Qwen Image 3.0 Text-to-Image on Atlas Cloud

Xây dựng hình ảnh sản xuất với Qwen Image 3.0

Qwen Image 3.0 chuyển từ đồ họa chiến dịch và ý tưởng sản phẩm dựa trên văn bản sang chỉnh sửa bảo toàn nhận diện và định hướng nghệ thuật đa tham chiếu, tạo ra hình ảnh lên đến 2048×2048 cho các đội ngũ marketing, gian hàng trực tuyến, studio thiết kế và ứng dụng sáng tạo.

Đồ họa chiến dịch với Qwen Image 3.0

Tạo hình ảnh chiến dịch từ các prompt chi tiết, với khả năng bám sát prompt chính xác và kết xuất văn bản phức tạp mạnh mẽ. Các đội ngũ marketing có thể tạo áp phích, đồ họa ra mắt và nội dung mạng xã hội ở độ phân giải lên đến 2048×2048 cho các chiến dịch đa kênh.

Trực quan hóa ý tưởng sản phẩm

Biến bản mô tả sản phẩm thành hình ảnh ý tưởng chi tiết với khả năng tự động viết lại prompt và lựa chọn độ phân giải theo prompt. Nhà thiết kế có thể khám phá bao bì, sản phẩm thương mại và định hướng bối cảnh trước khi phân bổ nguồn lực cho sản xuất hoặc chụp ảnh.

Chỉnh sửa chân dung bảo toàn nhận diện

Thay đổi phong cách chân dung bằng hướng dẫn ngôn ngữ tự nhiên, đồng thời giữ nguyên các đặc điểm khuôn mặt và nhận diện từ ảnh nguồn. Các studio sáng tạo có thể cập nhật trang phục, bối cảnh hoặc phong cách hình ảnh mà không cần dựng lại chủ thể từ đầu mỗi lần.

Chỉnh sửa đa tham chiếu với Qwen Image 3.0

Hướng dẫn chỉnh sửa bằng từ một đến ba hình ảnh tham chiếu và một chỉ dẫn ngôn ngữ tự nhiên. Các agency có thể bảo toàn những nhận diện và chi tiết cốt lõi, đồng thời điều chỉnh bố cục cho các biến thể nội dung chiến dịch, danh mục sản phẩm và nội dung thương hiệu.

Mockup giao diện nhiều văn bản

Cần một ý tưởng giao diện chứa nhiều văn bản? Chuyển các chỉ dẫn chi tiết thành mockup hình ảnh với khả năng kết xuất văn bản phức tạp mạnh mẽ, giúp đội ngũ sản phẩm có tài liệu rõ ràng hơn cho các buổi đánh giá ban đầu, khám phá thiết kế và thống nhất với các bên liên quan trước khi bắt đầu phát triển.

Các biến thể hình ảnh với Qwen Image 3.0

Bắt đầu từ một hình ảnh có sẵn, sau đó mô tả những thay đổi chính xác mà vẫn giữ nguyên các chi tiết hình ảnh quan trọng. Nhà phát triển có thể xây dựng công cụ chỉnh sửa cho nền tảng sáng tạo, quy trình nội dung và quá trình lặp nhanh nội dung trên nhiều dự án.

Qwen Image 3.0 so với các đối thủ về khả năng tạo và chỉnh sửa

So sánh Qwen Image 3.0 với các mô hình tạo và chỉnh sửa hình ảnh hàng đầu theo quy trình, độ phân giải, khả năng dùng ảnh tham chiếu và giá tiêu chuẩn cho mỗi ảnh.

Mô hìnhNhà cung cấpQuy trìnhĐộ phân giải đầu ra tối đaSố ảnh tham chiếu tối đaGiá tiêu chuẩn
Qwen Image 3.0 Text-to-ImageQwenVăn bản thành hình ảnh2048×2048-$0.03 / ảnh
Qwen Image 3.0 EditQwenChỉnh sửa hình ảnh2048×20483$0.03 / ảnh
Seedream v5.0 Flash Text-to-ImageByteDanceVăn bản thành hình ảnh2K-$0.018 / ảnh
Seedream v5.0 Flash EditByteDanceChỉnh sửa hình ảnh2K10$0.018 / ảnh
Grok Imagine Image 2.0 Text-to-ImagexAIVăn bản thành hình ảnh2K-$0.04 / ảnh
Grok Imagine Image 2.0 EditxAIChỉnh sửa hình ảnh2K5$0.04 / ảnh

Cách Sử Dụng Qwen Image 3.0 trên Atlas Cloud

Bắt đầu trong vài phút — làm theo các bước đơn giản sau để tích hợp và triển khai mô hình qua nền tảng Atlas Cloud.

Tạo Tài Khoản Atlas Cloud

Đăng ký tại atlascloud.ai và hoàn tất xác minh. Người dùng mới nhận được tín dụng miễn phí để khám phá nền tảng và thử nghiệm mô hình.

Tại sao Sử dụng Qwen Image 3.0 trên Atlas Cloud

Sự kết hợp của các mô hình tiên tiến của Qwen Image 3.0 với nền tảng được tăng tốc GPU của Atlas Cloud mang lại hiệu suất, khả năng mở rộng và trải nghiệm nhà phát triển độc đáo.

Hiệu suất và Tính linh hoạt

Độ Trễ Thấp:
Suy luận được tối ưu hóa GPU cho suy luận thời gian thực.

API Thống nhất:
Chạy Qwen Image 3.0, GPT, Gemini và DeepSeek với một tích hợp duy nhất.

Giá cả Minh bạch:
Thanh toán dựa trên token có thể dự đoán với tùy chọn serverless.

Doanh nghiệp và Mở rộng

Trải nghiệm Nhà phát triển:
SDK, phân tích, công cụ tinh chỉnh và mẫu.

Độ tin cậy:
99,99% khả dụng, RBAC và ghi nhật ký sẵn sàng cho tuân thủ.

Bảo mật và Tuân thủ:
SOC 2 Type II, tuân thủ HIPAA, chủ quyền dữ liệu tại Hoa Kỳ.

Câu hỏi thường gặp về API Qwen Image 3.0

Qwen Image 3.0 là dòng mô hình hình ảnh dùng để tạo ảnh từ văn bản và chỉnh sửa ảnh theo chỉ dẫn. Mô hình được thiết kế để xử lý việc kết xuất văn bản phức tạp, tuân thủ chính xác prompt và tạo ra hình ảnh trực quan chi tiết.

Bạn có thể tạo ảnh trực tiếp từ prompt văn bản hoặc biến đổi hình ảnh hiện có bằng các chỉ dẫn ngôn ngữ tự nhiên. Mô hình hỗ trợ tạo bố cục chi tiết, đồ họa nhiều văn bản, ảnh chân dung, hình ảnh sản phẩm và các thay đổi có kiểm soát trên ảnh được cung cấp.

Bạn có thể bắt đầu với playground của Atlas Cloud hoặc gửi yêu cầu đã xác thực thông qua API. Chọn endpoint text-to-image để tạo ảnh từ prompt hoặc endpoint edit khi làm việc với ảnh tham chiếu.

Để tạo ảnh mới, hãy chọn `qwen-image-3.0/text-to-image` và cung cấp prompt văn bản. Khi chỉnh sửa nội dung hiện có, hãy sử dụng `qwen-image-3.0/edit` cùng với chỉ dẫn bằng ngôn ngữ tự nhiên và một hoặc nhiều ảnh tham chiếu.

Đầu ra text-to-image hỗ trợ độ phân giải lên đến 2048 × 2048. Khi không chỉ định kích thước, mô hình có thể chọn độ phân giải phù hợp dựa trên prompt. Các tùy chọn khả dụng gồm kích thước ảnh, số lượng đầu ra, negative prompt, seed và viết lại prompt.

Endpoint edit chấp nhận từ một đến ba ảnh tham chiếu cùng với chỉ dẫn bằng ngôn ngữ tự nhiên. Hãy mô tả cả thay đổi cần thực hiện và những chi tiết phải được giữ nguyên, chẳng hạn như đặc điểm khuôn mặt, danh tính, bố cục hoặc bối cảnh hình ảnh.

Trên Atlas Cloud, mức giá tiêu chuẩn là $0.03 cho mỗi lần gọi đối với cả endpoint text-to-image và edit. Hệ thống tính phí theo mức sử dụng minh bạch và không yêu cầu đăng ký gói thuê bao.

Hãy bật tính năng tự động viết lại prompt khi một prompt ngắn cần thêm chi tiết hoặc cấu trúc mô tả. Tắt tính năng này khi prompt của bạn đã rõ ràng, chính xác và bạn muốn mô hình tuân thủ trực tiếp cách diễn đạt đó.

Tài liệu API chính thức được tham khảo cho FAQ này mô tả quyền truy cập dạng hosted nhưng không xác nhận việc cung cấp weights có thể tải xuống của mô hình Qwen Image 3.0. Nếu cần tự lưu trữ, hãy kiểm tra thông tin phát hành và giấy phép Qwen mới nhất trước khi lựa chọn kiến trúc.

Khám phá Thêm Dòng

Seedance 2.5

Seedance 2.5 API hiện đã có mặt trên Atlas Cloud! Cung cấp cho các nhà phát triển mô hình video mới nhất của ByteDance. Nó tạo ra tối đa 30 giây video gốc chỉ trong một lần xử lý từ văn bản, một hình ảnh duy nhất hoặc tối đa 50 tài liệu tham khảo đa phương thức, với âm thanh được đồng bộ hóa và văn bản đa ngôn ngữ trong khung hình. Trên Atlas Cloud, bạn có thể truy cập thông qua một khóa duy nhất, với tính nhất quán của chủ thể và vật lý được cải thiện giúp giữ cho các cảnh quay dài luôn mạch lạc.

Xem Dòng

Wan 3.0

Wan 3.0 API là thế hệ tiếp theo trong hệ sinh thái video Wan của Alibaba, được xây dựng để đưa khả năng tạo video dài, kiểm soát đa tham chiếu và chất lượng nghe nhìn lên những tầm cao mới. Atlas Cloud đã lưu trữ Wan 2.7, 2.6 và 2.5, và Wan 3.0 hoạt động trên cùng một khóa hợp nhất mà không cần thiết lập riêng. Bắt đầu xây dựng ngay hôm nay. Cuộn xuống phần trưng bày để xem những gì Wan 3.0 có thể tạo ra.

Xem Dòng

MiniMax H3

MiniMax H3 là dòng video đa phương thức của MiniMax, hỗ trợ sáng tạo từ văn bản, hình ảnh và nội dung tham chiếu. Trên các route được hỗ trợ, sản phẩm duy trì chủ thể từ nội dung tham chiếu, cung cấp các tỷ lệ khung hình linh hoạt và kết hợp âm thanh được tạo với hình ảnh thông qua H3 Developer, với hồ sơ đầu ra được lựa chọn theo endpoint. Atlas Cloud hợp nhất dòng sản phẩm này dưới một khóa tương thích với OpenAI, cùng mức giá trả theo nhu cầu minh bạch bắt đầu từ mức tiêu chuẩn $0.038 mỗi giây. Hãy bắt đầu xây dựng ngay hôm nay.

Xem Dòng

Seedream 5.0 Pro

Seedream 5.0 Pro API cung cấp cho các nhà phát triển mô hình chỉnh sửa hình ảnh có thể kiểm soát của ByteDance trên Atlas Cloud. Nó đặt các chỉnh sửa một cách chính xác bằng các điểm neo và tọa độ, tách hình ảnh thành các lớp có thể chỉnh sửa, kết hợp nhiều tham chiếu và khớp màu sắc cũng như vật liệu chính xác, với văn bản đa ngôn ngữ ở độ phân giải 2K và 3K. Trên Atlas Cloud, bạn có thể truy cập nó chỉ bằng một khóa!

Xem Dòng

Seedance 2.0

Seedance 2.0 là mô hình video phục vụ môi trường production của ByteDance, giúp tạo cảnh quay chính xác. Biến prompt thành video, tạo chuyển động cho hình ảnh khung hình đầu tiên với tùy chọn hướng dẫn bằng khung hình cuối, hoặc định hình kết quả bằng media tham chiếu và tùy chọn tìm kiếm web. Atlas Cloud hợp nhất các quy trình này trong một API duy nhất, với mức giá pay-as-you-go minh bạch và một key tương thích với OpenAI. Bắt đầu xây dựng ngay hôm nay.

Xem Dòng

GPT Image 2.5

Dòng gpt-image-2.5 của OpenAI mang đến cho nhà phát triển lựa chọn giữa Flare và Sunburst cho các quy trình xử lý ảnh trong môi trường production. Kết xuất ở độ phân giải tùy ý lên đến 3840x2160 và chọn một trong năm cấp chất lượng, bao gồm xhigh và max, để đáp ứng các yêu cầu đầu ra cụ thể. Atlas Cloud cung cấp dịch vụ suy luận REST sẵn sàng sử dụng, không cần khởi động nguội, với mức giá tiêu chuẩn từ $0.004 cho mỗi lần tạo. Bắt đầu xây dựng ngay hôm nay.

Xem Dòng

GPT Image 2

GPT Image 2 API cung cấp cho các nhà phát triển quyền truy cập vào mô hình hình ảnh mới nhất của OpenAI, phiên bản kế nhiệm của GPT Image 1.5. Mô hình này tạo và chỉnh sửa hình ảnh với khả năng hiển thị văn bản chính xác trên các chữ viết Latinh và CJK, cùng với bố cục mạnh mẽ cho áp phích, mockup và đồ họa thông tin. Trên Atlas Cloud, bạn có thể truy cập nó thông qua một API thống nhất cùng với hơn 300 mô hình khác, với tín dụng miễn phí, 99,99% thời gian hoạt động và không yêu cầu xác minh tổ chức OpenAI.

Xem Dòng

Gemini Omni Flash

Gemini Omni API mang dòng Gemini Omni Flash đa phương thức nguyên bản của Google DeepMind, bao gồm Gemini Omni 1.1 Flash, đến với các nhà phát triển. Tạo video điện ảnh với âm thanh gốc được đồng bộ, tạo chuyển động cho ảnh tĩnh với khả năng kiểm soát chính xác khung hình bắt đầu và kết thúc, hoặc chỉnh sửa cảnh quay hiện có bằng các hướng dẫn văn bản mà vẫn bảo toàn nội dung không được thay đổi. Atlas Cloud cung cấp một khóa tương thích với OpenAI, quyền truy cập hợp nhất và mức giá trả theo mức sử dụng minh bạch. Bắt đầu xây dựng ngay hôm nay.

Xem Dòng

Grok Imagine

Grok Imagine API của xAI cung cấp các mô hình hình ảnh, video và lời nói, từ Image 2.0 đến Video 1.5 và xAI TTS v1. Render 1K hoặc 2K hình tĩnh trên 14 tỷ lệ khung hình, tạo cảnh 15 giây video 1080p, điều hướng các shot bằng tối đa 7 hình ảnh tham chiếu, hoặc cung cấp lời tường thuật bằng 20 ngôn ngữ. Atlas Cloud chạy mọi chế độ trên một endpoint, có giá theo mô hình trả tiền khi sử dụng từ $0.02 mỗi hình ảnh và $0.05 mỗi giây. Bắt đầu xây dựng hôm nay.

Xem Dòng

Google

Các mô hình sáng tạo mạnh mẽ nhất của Google hiện đều có sẵn trên Atlas Cloud. Veo 3.1 cung cấp khả năng tạo video đậm chất điện ảnh, Nano Banana 2 hỗ trợ tạo hình ảnh có độ chân thực cao, và Gemini mang trí tuệ đa phương thức vào mọi quy trình làm việc. Truy cập toàn bộ bộ mô hình Google thông qua một API key duy nhất với tính khả dụng Day-0 và mức giá dùng bao nhiêu trả bấy nhiêu (pay-as-you-go).

Xem Dòng

Seedance 2.0 Mini

Seedance 2.0 Mini mang khả năng tạo video đa phương thức của ByteDance vào các quy trình làm việc nơi tốc độ và chi phí là quan trọng nhất. Nó cung cấp các khả năng cốt lõi của Seedance 2.0 với mức tiêu thụ tài nguyên nhẹ hơn — tạo nhanh hơn, chi phí mỗi video thấp hơn và tích hợp API giống như bạn đã sử dụng. Đối với các nhóm chạy các quy trình (pipeline) khối lượng lớn hoặc tạo nguyên mẫu ở quy mô lớn, Mini là lựa chọn mặc định thiết thực.

Xem Dòng

ByteDance

Từ tạo video điện ảnh đến kiến tạo hình ảnh có độ trung thực cao, các mô hình mạnh mẽ nhất của ByteDance hiện đã có mặt trên Atlas Cloud. Chạy Seedance và Seedream ở quy mô lớn với mức giá suy luận thấp nhất và không có chi phí quản lý cơ sở hạ tầng.

Xem Dòng

Một API cho mọi AI đa phương tiện.

Khám phá tất cả mô hình