Seedance 2.0 Mini & Fast API với mức giá thấp nhất toàn cầu — giảm đến 68% so với giá chính thức
Hero background 1Hero background 2Hero background 3

Qwen Image 2.0 Native 2K

Qwen Image 2.0 là thế hệ mô hình hình ảnh tiếp theo của đội ngũ Qwen thuộc Alibaba Cloud. Được xây dựng để xử lý đầu vào là văn bản và hình ảnh, mô hình cung cấp đầu ra 2K nguyên bản, khả năng bám sát ngữ nghĩa tốt hơn, chi tiết chân thực và tuân thủ chỉ dẫn chính xác trong cả quy trình tạo mới lẫn chỉnh sửa. Atlas Cloud cung cấp các REST endpoint sẵn sàng sử dụng cho cả hai chế độ, không có thời gian khởi động nguội và mức giá tiêu chuẩn là $0.035 cho mỗi hình ảnh. Bắt đầu xây dựng ngay hôm nay.

Qwen Image 2.0 do Alibaba phát triển. Atlas Cloud (vận hành bởi Atlas Cloud AI LLC) cung cấp quyền truy cập vào mô hình này và không sở hữu mô hình. Mọi thương hiệu đều thuộc về chủ sở hữu tương ứng.

Khám phá Mô hình Hàng đầu

Atlas Cloud cung cấp cho bạn các mô hình sáng tạo tiên tiến nhất trong ngành.

Các chế độ tạo và chỉnh sửa của Qwen Image 2.0

So sánh hai endpoint Qwen Image 2.0 để tạo và tinh chỉnh hình ảnh ở độ phân giải lên đến 2K.

Phương thứcMô tả
Qwen Image 2.0 Text to Image APIChuyển các prompt văn bản thành hình ảnh ở độ phân giải lên đến 2K, với khả năng hiểu prompt và chất lượng hình ảnh được cải thiện. Sử dụng endpoint này cho concept art, hình ảnh sản phẩm, tài sản marketing và các quy trình tạo hình ảnh dựa trên prompt khác.
Qwen Image 2.0 Edit APIĐược thiết kế cho việc chỉnh sửa hình ảnh, endpoint này áp dụng các chỉ dẫn bằng văn bản lên hình ảnh hiện có và tạo ra kết quả ở độ phân giải lên đến 2K. Phù hợp để tinh chỉnh tài sản, tạo biến thể sáng tạo, thực hiện các thay đổi hình ảnh có mục tiêu và hỗ trợ quy trình sản xuất lặp.

Qwen Image 2.0: Từ prompt đến thành phẩm chính xác

Qwen Image 2.0 kết hợp khả năng xuất ảnh lên đến 2K, hiểu prompt tốt hơn, hiển thị văn bản song ngữ, chỉnh sửa có định hướng bằng ảnh tham chiếu, seed có thể tái tạo và quyền truy cập REST qua Atlas Cloud với mức giá minh bạch theo lượt sử dụng.

Chi tiết 2K với Qwen Image 2.0

Chi tiết 2K với Qwen Image 2.0

Qwen Image 2.0 kết xuất ảnh với kích thước từ 512 đến 2048 pixel trên mỗi chiều, hỗ trợ đầu ra lên đến 2K. Chất lượng hình ảnh được nâng cao giúp bảo toàn bề mặt tinh tế, phong cảnh nhiều lớp và các điểm nhấn thị giác nhỏ trên toàn khung hình. Hãy chọn kích thước phù hợp với định dạng phân phối của bạn. Nhờ đó, model đặc biệt phù hợp với hình ảnh sản phẩm, nhiếp ảnh biên tập và concept art chi tiết.

Kiểm soát prompt với Qwen Image 2.0

Kiểm soát prompt với Qwen Image 2.0

Các bản mô tả có cấu trúc vẫn dễ quản lý với prompt dài tối đa 800 ký tự bằng tiếng Anh hoặc tiếng Trung. Mô tả chủ thể, ánh sáng, bố cục, chất liệu và hành động trong một chỉ dẫn duy nhất, sau đó sử dụng seed cố định khi cần các lần lặp có thể tái tạo. Khả năng hiểu prompt được cải thiện giúp duy trì mối quan hệ giữa nhiều thành phần được yêu cầu. Các ý tưởng phức tạp trở nên dễ dự đoán hơn cho chiến dịch, bối cảnh kiến trúc và quy trình sáng tạo có định hướng.

Kiểu chữ song ngữ

Kiểu chữ song ngữ

Văn bản tiếng Anh và tiếng Trung dễ đọc có thể xuất hiện trong những hình ảnh dày đặc, được bố cục cẩn thận. Model kết hợp khả năng kết xuất đa ngôn ngữ với bố cục ổn định, giúp nhãn, biển hiệu, tiêu đề và đồ họa bổ trợ hài hòa với bối cảnh xung quanh. Nội dung song ngữ có thể là một phần của hình ảnh thay vì một lớp phủ riêng biệt. Hãy sử dụng tính năng này cho đồ họa quảng bá khổ rộng, hình ảnh thuyết trình, thực đơn và các tác phẩm giàu thông tin vốn thường cần nhiều công đoạn chỉnh sửa thủ công.

Chỉnh sửa có định hướng bằng ảnh tham chiếu

Chỉnh sửa có định hướng bằng ảnh tham chiếu

Bắt đầu với một đến ba ảnh tham chiếu, sau đó mô tả thay đổi mong muốn bằng ngôn ngữ tự nhiên. Endpoint chỉnh sửa chấp nhận chỉ dẫn dài tối đa 800 ký tự và có thể trả về ảnh lên đến 2K, đồng thời sử dụng seed để tạo các lần chạy có thể lặp lại. Quy trình được kiểm soát này phù hợp với việc điều chỉnh sản phẩm, tái tạo phong cách hình ảnh và phát triển sáng tạo theo từng vòng lặp mà không cần dựng lại bố cục nguồn từ đầu.

Kiểm soát canvas có thể lặp lại

Kiểm soát canvas có thể lặp lại

Kích thước đầu ra có thể nằm trong khoảng từ 512 đến 2048 pixel trên mỗi cạnh, còn seed chấp nhận các giá trị từ 0 đến 2147483647. Seed ngẫu nhiên vẫn khả dụng với giá trị mặc định là âm một. Điều chỉnh canvas theo nhu cầu ảnh vuông, ngang hoặc dọc trong khi vẫn duy trì điểm khởi đầu có thể lặp lại. Các tùy chọn này giúp đơn giản hóa việc kiểm thử có hệ thống và tạo asset nhất quán trên nhiều vị trí hiển thị.

Truy cập REST cho Qwen Image 2.0

Truy cập REST cho Qwen Image 2.0

Atlas Cloud cung cấp khả năng tạo ảnh từ văn bản và chỉnh sửa ảnh thông qua các endpoint REST với mức giá tiêu chuẩn $0.035 cho mỗi ảnh. Inference sẵn sàng sử dụng, không có thời gian khởi động nguội và quyền truy cập từ Day 0 giúp loại bỏ công việc lưu trữ model, trong khi một API hợp nhất giữ cho quá trình tích hợp nhất quán trên toàn bộ dòng model. Thiết lập này hỗ trợ prototype, công cụ production và pipeline hình ảnh có khả năng mở rộng với cơ chế thanh toán minh bạch theo lượt sử dụng.

Qwen Image 2.0: Một prompt cho ba mô hình tạo ảnh

Khám phá cách Qwen Image 2.0 và hai mô hình tạo ảnh tương đương diễn giải cùng một prompt trong thiết kế đồ họa chính xác và nhiếp ảnh phóng sự chuyển động nhanh.

Prompt

Một bộ phim thảm họa điện ảnh trên mặt bàn, ghi lại hậu trường ở khoảnh khắc quyết định: bàn tay chân thực của một nghệ nhân làm mô hình trẻ vươn vào khung hình để giữ một ngọn hải đăng thu nhỏ bị một con sóng khổng lồ bất ngờ trào ra từ tách trà trắng kem hất nghiêng, trong khi vài nhân vật đoàn làm phim tí hon hoảng loạn bỏ chạy, mang theo máy quay màu xanh navy, chân máy, dây cáp và thiết bị chiếu sáng; một bảng clapperboard thu nhỏ với chữ rõ nét đọc chính xác “TÁCH TRÀ CUỐI CÙNG” và “CẢNH 07”, viết đúng chính tả, sạch sẽ. Cảm giác thủ công xúc giác của hoạt hình stop-motion hòa quyện với nhiếp ảnh macro chân thực, nhấn mạnh sự va chạm hài hước giữa quy mô con người và mô hình thu nhỏ. Vị trí máy quay thấp, lướt sát mặt bàn; những dây điện rối và vệt nước lấp lánh tạo thành các đường dẫn mạnh hướng về ngọn hải đăng nghiêng và tách trà; một con vít kim loại mất nét che khuất một phần tiền cảnh cực gần, tạo chiều sâu phân lớp và sự nhập nhòe về quy mô. Ánh nắng trưa định hướng gắt xuyên qua rèm sáo, đổ những bóng sọc sắc nét lên bối cảnh, với các giọt nước lơ lửng lấp lánh và hiệu ứng nhòe chuyển động nhẹ trên đoàn làm phim đang tháo chạy. Bảng màu giới hạn nghiêm ngặt gồm trắng kem, xanh navy và cam an toàn. Vân gỗ cũ thuyết phục, bột giấy ướt sũng và cong vênh, lớp sơn mô hình bong tróc, kim loại trầy xước, vải ẩm, nước trong suốt với hiện tượng khúc xạ, sức căng bề mặt, tia nước bắn và các mối quan hệ không gian được tái hiện chính xác về mặt vật lý. Hoạt động dày đặc quanh thảm họa trung tâm được cân bằng bằng khoảng trống yên tĩnh gần các mép khung hình, những khiếm khuyết thủ công, hạt phim tinh tế được tiết chế, độ sâu trường ảnh nông, ống kính macro, lấy nét gần, suy giảm quang học chân thực, nhiếp ảnh hiệu ứng thực tế cao cấp, không kết xuất bóng dầu quá mức, không chi tiết dày đặc kiểu HDR phủ kín toàn khung, không làn da trông như nhựa, không ám màu đục hoặc bẩn, không hiệu ứng phát sáng tràn lan, không ánh sáng fantasy sử thi rẻ tiền, không phong cách tối tăm dưới nước hay tàn tích ngoài không gian, tỷ lệ khung hình ngang rộng 16:9, tràn viền.

Generated with Qwen Image 2.0 Text-to-image on Atlas Cloud

Generated with Qwen Image 2.0 Text-to-image on Atlas Cloud

Generated with Seedream v4.7 Text-to-Image on Atlas Cloud

Generated with Seedream v4.7 Text-to-Image on Atlas Cloud

Generated with Wan-2.7 Text-to-image on Atlas Cloud

Generated with Wan-2.7 Text-to-image on Atlas Cloud

Prompt

Một cuộc vượt ngục thu nhỏ diễn ra trên bàn làm việc của nghệ nhân làm tượng, đúng vào khoảnh khắc quyết định khi người sáng tạo vừa rời đi: một nhóm nhân vật tí hon bằng đất sét trắng chưa sơn đã khéo léo gấp một thẻ kiểm tra bằng giấy—trên đó có dòng chữ nhỏ, sắc nét, hoàn toàn dễ đọc “KIỂM TRA CUỐI CÙNG”—thành một khinh khí cầu nóng tạm thời; một nhân vật vừa cắt sợi dây neo cuối cùng, khiến khinh khí cầu giấy giật mạnh bay lên với chút nhòe chuyển động, trong khi những người bạn đồng hành giật mình lùi lại, reo hò và kinh ngạc ngước nhìn. Một lọ sơn bị đổ tràn ra thành dòng sông màu xanh ultramarine uốn lượn xuyên qua khung cảnh, viền quanh là những dấu chân nhỏ màu đỏ vermilion và các cây cầu ứng biến. Kể chuyện không gian thu nhỏ chính xác, với mỗi nhân vật thực hiện một hành động riêng biệt. Giá đựng dụng cụ bằng gỗ tạo nên một khung trong khung mạnh mẽ; nhíp, que điêu khắc và dao thủ công tạo thành các đường dẫn tỏa tâm hướng về khinh khí cầu đang bay lên; giữ khoảng trống sạch sẽ, gọn gàng ở góc trên bên phải. Ánh sáng cửa sổ định hướng chiếu chéo từ bên trái, tạo những bóng kéo dài với rìa mềm và soi rõ dấu vân tay in trên đất sét thô, vân gỗ mòn, sợi giấy gấp, dụng cụ kim loại trầy xước và bề mặt dính của lớp sơn đang khô một nửa. Chỉ sử dụng bảng màu ba màu nghiêm ngặt: trắng đất sét, xanh ultramarine và đỏ vermilion, với biến thiên sắc độ tự nhiên được tiết chế—không thêm màu nhấn nào khác. Hoạt hình stop-motion tinh tế hòa quyện với kỹ thuật quay macro điện ảnh chân thực, những khiếm khuyết thủ công giàu xúc giác, độ sâu trường ảnh nông có chọn lọc, dụng cụ tiền cảnh được làm mờ nhẹ, hành động trung tâm được tái hiện sắc nét, hạt phim analog tinh tế, ống kính macro 100mm, điện ảnh nhưng gần gũi, chủ nghĩa hiện thực hiệu ứng thực tế tinh tế, không bề mặt nhựa bóng, không kết xuất bóng dầu quá mức, không HDR, không màu sắc đục, không hiệu ứng phát sáng tràn lan, không phong cách fantasy sử thi rẻ tiền, không không khí tối tăm dưới nước hay tàn tích ngoài không gian, bố cục ngang rộng 16:9, khung hình tràn viền từ mép này đến mép kia.

Generated with Qwen Image 2.0 Text-to-image on Atlas Cloud

Generated with Qwen Image 2.0 Text-to-image on Atlas Cloud

Generated with Seedream v4.7 Text-to-Image on Atlas Cloud

Generated with Seedream v4.7 Text-to-Image on Atlas Cloud

Generated with Wan-2.7 Text-to-image on Atlas Cloud

Generated with Wan-2.7 Text-to-image on Atlas Cloud

Từ bản mô tả đến hình ảnh hoàn thiện với Qwen Image 2.0

Qwen Image 2.0 biến các prompt chi tiết và hình ảnh có sẵn thành đồ họa thuyết trình, tài sản chiến dịch, bối cảnh sản phẩm, bảng phân cảnh, hình ảnh bản địa hóa và các chỉnh sửa chính xác ở độ phân giải lên đến 2K.

Thiết kế bài thuyết trình với Qwen Image 2.0

Biến các prompt chi tiết thành hình ảnh thuyết trình chỉn chu với bố cục có cấu trúc và văn bản trong ảnh dễ đọc. Các nhóm sản phẩm có thể tạo slide ý tưởng, nội dung giải thích và tài liệu thuyết trình nội bộ ở độ phân giải lên đến 2K.

Kiểu chữ cho tài sản chiến dịch

Kiểu chữ được kết xuất chuyên nghiệp giúp poster, đồ họa mạng xã hội và ý tưởng chiến dịch xây dựng từ prompt chi tiết trở nên rõ ràng hơn. Các nhóm marketing có thêm nhiều hướng hình ảnh linh hoạt cho hoạt động ra mắt, khuyến mãi và truyền thông thương hiệu mà không cần dựng lại thủ công từng bố cục.

Bối cảnh sản phẩm với Qwen Image 2.0

Khi bối cảnh sản phẩm cần độ chi tiết cao, hãy tạo hình ảnh từ các prompt mô tả ở độ phân giải lên đến 2K. Nhà bán lẻ và studio sáng tạo có thể tinh chỉnh phông nền, các vật thể xung quanh hoặc bối cảnh chiến dịch thông qua hướng dẫn chỉnh sửa rõ ràng cho nhiều vị trí hiển thị khác nhau.

Chỉnh sửa hình ảnh chính xác

Cần thay đổi một hình ảnh có sẵn mà không phải bắt đầu lại? Cung cấp cho endpoint chỉnh sửa các hướng dẫn rõ ràng để cập nhật văn bản, vật thể, tư thế hoặc phong cách, đáp ứng phản hồi của khách hàng và quy trình sản xuất lặp lại ở quy mô lớn.

Poster và tài liệu hướng dẫn bản địa hóa

Poster và tài liệu hướng dẫn nhiều văn bản có thể kết hợp cách kể chuyện bằng hình ảnh với kiểu chữ đa ngôn ngữ. Các nhóm nội dung toàn cầu có thể xây dựng tài liệu du lịch, đồ họa sự kiện và ý tưởng chiến dịch theo từng khu vực trong một hình ảnh được dàn dựng hoàn chỉnh.

Bảng phân cảnh với Qwen Image 2.0

Các prompt chi tiết có thể chuyển hóa mạch truyện thành truyện tranh, lịch hoặc các khung storyboard với bố cục hình ảnh có cấu trúc. Nhà sáng tạo có thể khám phá các chuỗi cảnh, nội dung giải thích giáo dục và ý tưởng chiến dịch trước khi phân bổ nguồn lực cho quá trình sản xuất hoàn chỉnh.

Qwen Image 2.0 so với các API hình ảnh tương đương

So sánh các endpoint Qwen Image 2.0 với các lựa chọn thay thế của Microsoft theo tác vụ, độ phân giải đầu ra tối đa và mức giá tiêu chuẩn cho mỗi hình ảnh.

Mô hìnhTác vụĐộ phân giải tối đaGiá tiêu chuẩn
Qwen Image 2.0 Text-to-imageVăn bản thành hình ảnh2048 × 2048$0.035/hình ảnh
Qwen Image 2.0 EditChỉnh sửa hình ảnh2048 × 2048$0.035/hình ảnh
MAI-Image-2.6-Flash Text-to-imageVăn bản thành hình ảnhTối đa 2.36 MP, tương đương 1536 × 1536$0.044/hình ảnh
MAI-Image-2.6-Flash EditChỉnh sửa hình ảnhTối đa 2.36 MP, tương đương 1536 × 1536$0.047/hình ảnh

Cách Sử Dụng Qwen Image 2.0 trên Atlas Cloud

Bắt đầu trong vài phút — làm theo các bước đơn giản sau để tích hợp và triển khai mô hình qua nền tảng Atlas Cloud.

Tạo Tài Khoản Atlas Cloud

Đăng ký tại atlascloud.ai và hoàn tất xác minh. Người dùng mới nhận được tín dụng miễn phí để khám phá nền tảng và thử nghiệm mô hình.

Tại sao Sử dụng Qwen Image 2.0 trên Atlas Cloud

Sự kết hợp của các mô hình tiên tiến của Qwen Image 2.0 với nền tảng được tăng tốc GPU của Atlas Cloud mang lại hiệu suất, khả năng mở rộng và trải nghiệm nhà phát triển độc đáo.

Hiệu suất và Tính linh hoạt

Độ Trễ Thấp:
Suy luận được tối ưu hóa GPU cho suy luận thời gian thực.

API Thống nhất:
Chạy Qwen Image 2.0, GPT, Gemini và DeepSeek với một tích hợp duy nhất.

Giá cả Minh bạch:
Thanh toán dựa trên token có thể dự đoán với tùy chọn serverless.

Doanh nghiệp và Mở rộng

Trải nghiệm Nhà phát triển:
SDK, phân tích, công cụ tinh chỉnh và mẫu.

Độ tin cậy:
99,99% khả dụng, RBAC và ghi nhật ký sẵn sàng cho tuân thủ.

Bảo mật và Tuân thủ:
SOC 2 Type II, tuân thủ HIPAA, chủ quyền dữ liệu tại Hoa Kỳ.

Câu hỏi thường gặp về API Qwen Image 2.0

Qwen Image 2.0 là mô hình hình ảnh của đội ngũ Qwen thuộc Alibaba, dùng để tạo hình ảnh từ văn bản và chỉnh sửa ảnh hiện có theo chỉ dẫn. Atlas Cloud cung cấp các endpoint REST chuyên dụng cho cả hai tác vụ, với độ phân giải đầu ra lên đến 2K.

Sử dụng mô hình để tạo hình ảnh từ các mô tả chi tiết hoặc thay đổi hình ảnh hiện có bằng chỉ dẫn ngôn ngữ tự nhiên. Khả năng hiểu prompt được cải thiện hỗ trợ các quy trình như thiết kế đồ họa marketing, concept art, hình ảnh sản phẩm, infographic và thiết kế trực quan.

Có. Atlas Cloud nhấn mạnh khả năng hiển thị văn bản rõ ràng trong hình ảnh và hỗ trợ các prompt phức tạp, giúp mô hình phù hợp với infographic, áp phích, tài liệu marketing và các bố cục có cấu trúc khác. Hãy nêu rõ nội dung và yêu cầu bố cục trong giới hạn prompt 800 ký tự của API.

Tạo API key trong bảng điều khiển Atlas Cloud, chọn model ID dùng để tạo hoặc chỉnh sửa, rồi gửi một REST request. Inference được lưu trữ trên máy chủ, vì vậy bạn không cần cấu hình GPU cục bộ hoặc triển khai model weights.

Gửi một POST request có xác thực đến https://api.atlascloud.ai/api/v1/model/generateImage, kèm model ID và các input trong phần thân JSON. Request bất đồng bộ sẽ trả về prediction ID. Bạn có thể dùng ID này để polling prediction endpoint cho đến khi quá trình xử lý hoàn tất.

Chọn qwen/qwen-image-2.0/text-to-image khi tạo hình ảnh mới từ prompt. Để thay đổi hình ảnh tham chiếu dựa trên chỉ dẫn, hãy chọn qwen/qwen-image-2.0/edit.

Tạo hình ảnh từ văn bản yêu cầu prompt và chấp nhận tùy chọn size và seed. Tác vụ chỉnh sửa cũng yêu cầu một mảng images, trong khi size và seed vẫn là tùy chọn. Cả hai endpoint đều hỗ trợ prompt tiếng Trung và tiếng Anh dài tối đa 800 ký tự.

Endpoint chỉnh sửa chấp nhận từ 1 đến 3 URL hình ảnh tham chiếu, trong đó mỗi ảnh có kích thước từ 384 đến 3072 pixel trên mỗi chiều. Kích thước đầu ra có thể nằm trong khoảng từ 512 đến 2048 pixel, và thông tin model cho biết mô hình hỗ trợ độ phân giải lên đến 2K.

Atlas Cloud niêm yết mức giá cơ bản tiêu chuẩn là $0.035 cho mỗi request đối với cả endpoint tạo hình ảnh từ văn bản và endpoint chỉnh sửa. Đây là mức giá pay-as-you-go ban đầu, chưa bao gồm các chương trình giảm giá tạm thời.

Đặt seed thành một số nguyên cụ thể từ 0 đến 2147483647 khi cần kiểm thử có thể tái lập; giá trị mặc định -1 sẽ chọn seed ngẫu nhiên. Giữ nguyên model ID, prompt và size khi so sánh đầu ra hoặc xác định nguyên nhân của những thay đổi ngoài dự kiến.

Khám phá Thêm Dòng

Seedance 2.5

Seedance 2.5 API hiện đã có mặt trên Atlas Cloud! Cung cấp cho các nhà phát triển mô hình video mới nhất của ByteDance. Nó tạo ra tối đa 30 giây video gốc chỉ trong một lần xử lý từ văn bản, một hình ảnh duy nhất hoặc tối đa 50 tài liệu tham khảo đa phương thức, với âm thanh được đồng bộ hóa và văn bản đa ngôn ngữ trong khung hình. Trên Atlas Cloud, bạn có thể truy cập thông qua một khóa duy nhất, với tính nhất quán của chủ thể và vật lý được cải thiện giúp giữ cho các cảnh quay dài luôn mạch lạc.

Xem Dòng

Wan 3.0

Wan 3.0 API là thế hệ tiếp theo trong hệ sinh thái video Wan của Alibaba, được xây dựng để đưa khả năng tạo video dài, kiểm soát đa tham chiếu và chất lượng nghe nhìn lên những tầm cao mới. Atlas Cloud đã lưu trữ Wan 2.7, 2.6 và 2.5, và Wan 3.0 hoạt động trên cùng một khóa hợp nhất mà không cần thiết lập riêng. Bắt đầu xây dựng ngay hôm nay. Cuộn xuống phần trưng bày để xem những gì Wan 3.0 có thể tạo ra.

Xem Dòng

MiniMax H3

MiniMax H3 là dòng video đa phương thức của MiniMax, hỗ trợ sáng tạo từ văn bản, hình ảnh và nội dung tham chiếu. Trên các route được hỗ trợ, sản phẩm duy trì chủ thể từ nội dung tham chiếu, cung cấp các tỷ lệ khung hình linh hoạt và kết hợp âm thanh được tạo với hình ảnh thông qua H3 Developer, với hồ sơ đầu ra được lựa chọn theo endpoint. Atlas Cloud hợp nhất dòng sản phẩm này dưới một khóa tương thích với OpenAI, cùng mức giá trả theo nhu cầu minh bạch bắt đầu từ mức tiêu chuẩn $0.038 mỗi giây. Hãy bắt đầu xây dựng ngay hôm nay.

Xem Dòng

Seedream 5.0 Pro

Seedream 5.0 Pro API cung cấp cho các nhà phát triển mô hình chỉnh sửa hình ảnh có thể kiểm soát của ByteDance trên Atlas Cloud. Nó đặt các chỉnh sửa một cách chính xác bằng các điểm neo và tọa độ, tách hình ảnh thành các lớp có thể chỉnh sửa, kết hợp nhiều tham chiếu và khớp màu sắc cũng như vật liệu chính xác, với văn bản đa ngôn ngữ ở độ phân giải 2K và 3K. Trên Atlas Cloud, bạn có thể truy cập nó chỉ bằng một khóa!

Xem Dòng

Seedance 2.0

Seedance 2.0 là mô hình video phục vụ môi trường production của ByteDance, giúp tạo cảnh quay chính xác. Biến prompt thành video, tạo chuyển động cho hình ảnh khung hình đầu tiên với tùy chọn hướng dẫn bằng khung hình cuối, hoặc định hình kết quả bằng media tham chiếu và tùy chọn tìm kiếm web. Atlas Cloud hợp nhất các quy trình này trong một API duy nhất, với mức giá pay-as-you-go minh bạch và một key tương thích với OpenAI. Bắt đầu xây dựng ngay hôm nay.

Xem Dòng

GPT Image 2.5

Dòng gpt-image-2.5 của OpenAI mang đến cho nhà phát triển lựa chọn giữa Flare và Sunburst cho các quy trình xử lý ảnh trong môi trường production. Kết xuất ở độ phân giải tùy ý lên đến 3840x2160 và chọn một trong năm cấp chất lượng, bao gồm xhigh và max, để đáp ứng các yêu cầu đầu ra cụ thể. Atlas Cloud cung cấp dịch vụ suy luận REST sẵn sàng sử dụng, không cần khởi động nguội, với mức giá tiêu chuẩn từ $0.004 cho mỗi lần tạo. Bắt đầu xây dựng ngay hôm nay.

Xem Dòng

GPT Image 2

GPT Image 2 API cung cấp cho các nhà phát triển quyền truy cập vào mô hình hình ảnh mới nhất của OpenAI, phiên bản kế nhiệm của GPT Image 1.5. Mô hình này tạo và chỉnh sửa hình ảnh với khả năng hiển thị văn bản chính xác trên các chữ viết Latinh và CJK, cùng với bố cục mạnh mẽ cho áp phích, mockup và đồ họa thông tin. Trên Atlas Cloud, bạn có thể truy cập nó thông qua một API thống nhất cùng với hơn 300 mô hình khác, với tín dụng miễn phí, 99,99% thời gian hoạt động và không yêu cầu xác minh tổ chức OpenAI.

Xem Dòng

Gemini Omni Flash

Gemini Omni API mang dòng Gemini Omni Flash đa phương thức nguyên bản của Google DeepMind, bao gồm Gemini Omni 1.1 Flash, đến với các nhà phát triển. Tạo video điện ảnh với âm thanh gốc được đồng bộ, tạo chuyển động cho ảnh tĩnh với khả năng kiểm soát chính xác khung hình bắt đầu và kết thúc, hoặc chỉnh sửa cảnh quay hiện có bằng các hướng dẫn văn bản mà vẫn bảo toàn nội dung không được thay đổi. Atlas Cloud cung cấp một khóa tương thích với OpenAI, quyền truy cập hợp nhất và mức giá trả theo mức sử dụng minh bạch. Bắt đầu xây dựng ngay hôm nay.

Xem Dòng

Grok Imagine

Grok Imagine API của xAI cung cấp các mô hình hình ảnh, video và lời nói, từ Image 2.0 đến Video 1.5 và xAI TTS v1. Render 1K hoặc 2K hình tĩnh trên 14 tỷ lệ khung hình, tạo cảnh 15 giây video 1080p, điều hướng các shot bằng tối đa 7 hình ảnh tham chiếu, hoặc cung cấp lời tường thuật bằng 20 ngôn ngữ. Atlas Cloud chạy mọi chế độ trên một endpoint, có giá theo mô hình trả tiền khi sử dụng từ $0.02 mỗi hình ảnh và $0.05 mỗi giây. Bắt đầu xây dựng hôm nay.

Xem Dòng

Google

Các mô hình sáng tạo mạnh mẽ nhất của Google hiện đều có sẵn trên Atlas Cloud. Veo 3.1 cung cấp khả năng tạo video đậm chất điện ảnh, Nano Banana 2 hỗ trợ tạo hình ảnh có độ chân thực cao, và Gemini mang trí tuệ đa phương thức vào mọi quy trình làm việc. Truy cập toàn bộ bộ mô hình Google thông qua một API key duy nhất với tính khả dụng Day-0 và mức giá dùng bao nhiêu trả bấy nhiêu (pay-as-you-go).

Xem Dòng

Seedance 2.0 Mini

Seedance 2.0 Mini mang khả năng tạo video đa phương thức của ByteDance vào các quy trình làm việc nơi tốc độ và chi phí là quan trọng nhất. Nó cung cấp các khả năng cốt lõi của Seedance 2.0 với mức tiêu thụ tài nguyên nhẹ hơn — tạo nhanh hơn, chi phí mỗi video thấp hơn và tích hợp API giống như bạn đã sử dụng. Đối với các nhóm chạy các quy trình (pipeline) khối lượng lớn hoặc tạo nguyên mẫu ở quy mô lớn, Mini là lựa chọn mặc định thiết thực.

Xem Dòng

ByteDance

Từ tạo video điện ảnh đến kiến tạo hình ảnh có độ trung thực cao, các mô hình mạnh mẽ nhất của ByteDance hiện đã có mặt trên Atlas Cloud. Chạy Seedance và Seedream ở quy mô lớn với mức giá suy luận thấp nhất và không có chi phí quản lý cơ sở hạ tầng.

Xem Dòng

Một API cho mọi AI đa phương tiện.

Khám phá tất cả mô hình