


Qwen Image 2.0 là thế hệ mô hình hình ảnh tiếp theo của đội ngũ Qwen thuộc Alibaba Cloud. Được xây dựng để xử lý đầu vào là văn bản và hình ảnh, mô hình cung cấp đầu ra 2K nguyên bản, khả năng bám sát ngữ nghĩa tốt hơn, chi tiết chân thực và tuân thủ chỉ dẫn chính xác trong cả quy trình tạo mới lẫn chỉnh sửa. Atlas Cloud cung cấp các REST endpoint sẵn sàng sử dụng cho cả hai chế độ, không có thời gian khởi động nguội và mức giá tiêu chuẩn là $0.035 cho mỗi hình ảnh. Bắt đầu xây dựng ngay hôm nay.
Qwen Image 2.0 do Alibaba phát triển. Atlas Cloud (vận hành bởi Atlas Cloud AI LLC) cung cấp quyền truy cập vào mô hình này và không sở hữu mô hình. Mọi thương hiệu đều thuộc về chủ sở hữu tương ứng.
Atlas Cloud cung cấp cho bạn các mô hình sáng tạo tiên tiến nhất trong ngành.
So sánh hai endpoint Qwen Image 2.0 để tạo và tinh chỉnh hình ảnh ở độ phân giải lên đến 2K.
| Phương thức | Mô tả |
|---|---|
| Qwen Image 2.0 Text to Image API | Chuyển các prompt văn bản thành hình ảnh ở độ phân giải lên đến 2K, với khả năng hiểu prompt và chất lượng hình ảnh được cải thiện. Sử dụng endpoint này cho concept art, hình ảnh sản phẩm, tài sản marketing và các quy trình tạo hình ảnh dựa trên prompt khác. |
| Qwen Image 2.0 Edit API | Được thiết kế cho việc chỉnh sửa hình ảnh, endpoint này áp dụng các chỉ dẫn bằng văn bản lên hình ảnh hiện có và tạo ra kết quả ở độ phân giải lên đến 2K. Phù hợp để tinh chỉnh tài sản, tạo biến thể sáng tạo, thực hiện các thay đổi hình ảnh có mục tiêu và hỗ trợ quy trình sản xuất lặp. |
Qwen Image 2.0 kết hợp khả năng xuất ảnh lên đến 2K, hiểu prompt tốt hơn, hiển thị văn bản song ngữ, chỉnh sửa có định hướng bằng ảnh tham chiếu, seed có thể tái tạo và quyền truy cập REST qua Atlas Cloud với mức giá minh bạch theo lượt sử dụng.

Qwen Image 2.0 kết xuất ảnh với kích thước từ 512 đến 2048 pixel trên mỗi chiều, hỗ trợ đầu ra lên đến 2K. Chất lượng hình ảnh được nâng cao giúp bảo toàn bề mặt tinh tế, phong cảnh nhiều lớp và các điểm nhấn thị giác nhỏ trên toàn khung hình. Hãy chọn kích thước phù hợp với định dạng phân phối của bạn. Nhờ đó, model đặc biệt phù hợp với hình ảnh sản phẩm, nhiếp ảnh biên tập và concept art chi tiết.

Các bản mô tả có cấu trúc vẫn dễ quản lý với prompt dài tối đa 800 ký tự bằng tiếng Anh hoặc tiếng Trung. Mô tả chủ thể, ánh sáng, bố cục, chất liệu và hành động trong một chỉ dẫn duy nhất, sau đó sử dụng seed cố định khi cần các lần lặp có thể tái tạo. Khả năng hiểu prompt được cải thiện giúp duy trì mối quan hệ giữa nhiều thành phần được yêu cầu. Các ý tưởng phức tạp trở nên dễ dự đoán hơn cho chiến dịch, bối cảnh kiến trúc và quy trình sáng tạo có định hướng.

Văn bản tiếng Anh và tiếng Trung dễ đọc có thể xuất hiện trong những hình ảnh dày đặc, được bố cục cẩn thận. Model kết hợp khả năng kết xuất đa ngôn ngữ với bố cục ổn định, giúp nhãn, biển hiệu, tiêu đề và đồ họa bổ trợ hài hòa với bối cảnh xung quanh. Nội dung song ngữ có thể là một phần của hình ảnh thay vì một lớp phủ riêng biệt. Hãy sử dụng tính năng này cho đồ họa quảng bá khổ rộng, hình ảnh thuyết trình, thực đơn và các tác phẩm giàu thông tin vốn thường cần nhiều công đoạn chỉnh sửa thủ công.

Bắt đầu với một đến ba ảnh tham chiếu, sau đó mô tả thay đổi mong muốn bằng ngôn ngữ tự nhiên. Endpoint chỉnh sửa chấp nhận chỉ dẫn dài tối đa 800 ký tự và có thể trả về ảnh lên đến 2K, đồng thời sử dụng seed để tạo các lần chạy có thể lặp lại. Quy trình được kiểm soát này phù hợp với việc điều chỉnh sản phẩm, tái tạo phong cách hình ảnh và phát triển sáng tạo theo từng vòng lặp mà không cần dựng lại bố cục nguồn từ đầu.

Kích thước đầu ra có thể nằm trong khoảng từ 512 đến 2048 pixel trên mỗi cạnh, còn seed chấp nhận các giá trị từ 0 đến 2147483647. Seed ngẫu nhiên vẫn khả dụng với giá trị mặc định là âm một. Điều chỉnh canvas theo nhu cầu ảnh vuông, ngang hoặc dọc trong khi vẫn duy trì điểm khởi đầu có thể lặp lại. Các tùy chọn này giúp đơn giản hóa việc kiểm thử có hệ thống và tạo asset nhất quán trên nhiều vị trí hiển thị.

Atlas Cloud cung cấp khả năng tạo ảnh từ văn bản và chỉnh sửa ảnh thông qua các endpoint REST với mức giá tiêu chuẩn $0.035 cho mỗi ảnh. Inference sẵn sàng sử dụng, không có thời gian khởi động nguội và quyền truy cập từ Day 0 giúp loại bỏ công việc lưu trữ model, trong khi một API hợp nhất giữ cho quá trình tích hợp nhất quán trên toàn bộ dòng model. Thiết lập này hỗ trợ prototype, công cụ production và pipeline hình ảnh có khả năng mở rộng với cơ chế thanh toán minh bạch theo lượt sử dụng.
Khám phá cách Qwen Image 2.0 và hai mô hình tạo ảnh tương đương diễn giải cùng một prompt trong thiết kế đồ họa chính xác và nhiếp ảnh phóng sự chuyển động nhanh.
Một bộ phim thảm họa điện ảnh trên mặt bàn, ghi lại hậu trường ở khoảnh khắc quyết định: bàn tay chân thực của một nghệ nhân làm mô hình trẻ vươn vào khung hình để giữ một ngọn hải đăng thu nhỏ bị một con sóng khổng lồ bất ngờ trào ra từ tách trà trắng kem hất nghiêng, trong khi vài nhân vật đoàn làm phim tí hon hoảng loạn bỏ chạy, mang theo máy quay màu xanh navy, chân máy, dây cáp và thiết bị chiếu sáng; một bảng clapperboard thu nhỏ với chữ rõ nét đọc chính xác “TÁCH TRÀ CUỐI CÙNG” và “CẢNH 07”, viết đúng chính tả, sạch sẽ. Cảm giác thủ công xúc giác của hoạt hình stop-motion hòa quyện với nhiếp ảnh macro chân thực, nhấn mạnh sự va chạm hài hước giữa quy mô con người và mô hình thu nhỏ. Vị trí máy quay thấp, lướt sát mặt bàn; những dây điện rối và vệt nước lấp lánh tạo thành các đường dẫn mạnh hướng về ngọn hải đăng nghiêng và tách trà; một con vít kim loại mất nét che khuất một phần tiền cảnh cực gần, tạo chiều sâu phân lớp và sự nhập nhòe về quy mô. Ánh nắng trưa định hướng gắt xuyên qua rèm sáo, đổ những bóng sọc sắc nét lên bối cảnh, với các giọt nước lơ lửng lấp lánh và hiệu ứng nhòe chuyển động nhẹ trên đoàn làm phim đang tháo chạy. Bảng màu giới hạn nghiêm ngặt gồm trắng kem, xanh navy và cam an toàn. Vân gỗ cũ thuyết phục, bột giấy ướt sũng và cong vênh, lớp sơn mô hình bong tróc, kim loại trầy xước, vải ẩm, nước trong suốt với hiện tượng khúc xạ, sức căng bề mặt, tia nước bắn và các mối quan hệ không gian được tái hiện chính xác về mặt vật lý. Hoạt động dày đặc quanh thảm họa trung tâm được cân bằng bằng khoảng trống yên tĩnh gần các mép khung hình, những khiếm khuyết thủ công, hạt phim tinh tế được tiết chế, độ sâu trường ảnh nông, ống kính macro, lấy nét gần, suy giảm quang học chân thực, nhiếp ảnh hiệu ứng thực tế cao cấp, không kết xuất bóng dầu quá mức, không chi tiết dày đặc kiểu HDR phủ kín toàn khung, không làn da trông như nhựa, không ám màu đục hoặc bẩn, không hiệu ứng phát sáng tràn lan, không ánh sáng fantasy sử thi rẻ tiền, không phong cách tối tăm dưới nước hay tàn tích ngoài không gian, tỷ lệ khung hình ngang rộng 16:9, tràn viền.

Generated with Qwen Image 2.0 Text-to-image on Atlas Cloud

Generated with Seedream v4.7 Text-to-Image on Atlas Cloud

Generated with Wan-2.7 Text-to-image on Atlas Cloud
Một cuộc vượt ngục thu nhỏ diễn ra trên bàn làm việc của nghệ nhân làm tượng, đúng vào khoảnh khắc quyết định khi người sáng tạo vừa rời đi: một nhóm nhân vật tí hon bằng đất sét trắng chưa sơn đã khéo léo gấp một thẻ kiểm tra bằng giấy—trên đó có dòng chữ nhỏ, sắc nét, hoàn toàn dễ đọc “KIỂM TRA CUỐI CÙNG”—thành một khinh khí cầu nóng tạm thời; một nhân vật vừa cắt sợi dây neo cuối cùng, khiến khinh khí cầu giấy giật mạnh bay lên với chút nhòe chuyển động, trong khi những người bạn đồng hành giật mình lùi lại, reo hò và kinh ngạc ngước nhìn. Một lọ sơn bị đổ tràn ra thành dòng sông màu xanh ultramarine uốn lượn xuyên qua khung cảnh, viền quanh là những dấu chân nhỏ màu đỏ vermilion và các cây cầu ứng biến. Kể chuyện không gian thu nhỏ chính xác, với mỗi nhân vật thực hiện một hành động riêng biệt. Giá đựng dụng cụ bằng gỗ tạo nên một khung trong khung mạnh mẽ; nhíp, que điêu khắc và dao thủ công tạo thành các đường dẫn tỏa tâm hướng về khinh khí cầu đang bay lên; giữ khoảng trống sạch sẽ, gọn gàng ở góc trên bên phải. Ánh sáng cửa sổ định hướng chiếu chéo từ bên trái, tạo những bóng kéo dài với rìa mềm và soi rõ dấu vân tay in trên đất sét thô, vân gỗ mòn, sợi giấy gấp, dụng cụ kim loại trầy xước và bề mặt dính của lớp sơn đang khô một nửa. Chỉ sử dụng bảng màu ba màu nghiêm ngặt: trắng đất sét, xanh ultramarine và đỏ vermilion, với biến thiên sắc độ tự nhiên được tiết chế—không thêm màu nhấn nào khác. Hoạt hình stop-motion tinh tế hòa quyện với kỹ thuật quay macro điện ảnh chân thực, những khiếm khuyết thủ công giàu xúc giác, độ sâu trường ảnh nông có chọn lọc, dụng cụ tiền cảnh được làm mờ nhẹ, hành động trung tâm được tái hiện sắc nét, hạt phim analog tinh tế, ống kính macro 100mm, điện ảnh nhưng gần gũi, chủ nghĩa hiện thực hiệu ứng thực tế tinh tế, không bề mặt nhựa bóng, không kết xuất bóng dầu quá mức, không HDR, không màu sắc đục, không hiệu ứng phát sáng tràn lan, không phong cách fantasy sử thi rẻ tiền, không không khí tối tăm dưới nước hay tàn tích ngoài không gian, bố cục ngang rộng 16:9, khung hình tràn viền từ mép này đến mép kia.

Generated with Qwen Image 2.0 Text-to-image on Atlas Cloud

Generated with Seedream v4.7 Text-to-Image on Atlas Cloud

Generated with Wan-2.7 Text-to-image on Atlas Cloud
Qwen Image 2.0 biến các prompt chi tiết và hình ảnh có sẵn thành đồ họa thuyết trình, tài sản chiến dịch, bối cảnh sản phẩm, bảng phân cảnh, hình ảnh bản địa hóa và các chỉnh sửa chính xác ở độ phân giải lên đến 2K.
Biến các prompt chi tiết thành hình ảnh thuyết trình chỉn chu với bố cục có cấu trúc và văn bản trong ảnh dễ đọc. Các nhóm sản phẩm có thể tạo slide ý tưởng, nội dung giải thích và tài liệu thuyết trình nội bộ ở độ phân giải lên đến 2K.
Kiểu chữ được kết xuất chuyên nghiệp giúp poster, đồ họa mạng xã hội và ý tưởng chiến dịch xây dựng từ prompt chi tiết trở nên rõ ràng hơn. Các nhóm marketing có thêm nhiều hướng hình ảnh linh hoạt cho hoạt động ra mắt, khuyến mãi và truyền thông thương hiệu mà không cần dựng lại thủ công từng bố cục.
Khi bối cảnh sản phẩm cần độ chi tiết cao, hãy tạo hình ảnh từ các prompt mô tả ở độ phân giải lên đến 2K. Nhà bán lẻ và studio sáng tạo có thể tinh chỉnh phông nền, các vật thể xung quanh hoặc bối cảnh chiến dịch thông qua hướng dẫn chỉnh sửa rõ ràng cho nhiều vị trí hiển thị khác nhau.
Cần thay đổi một hình ảnh có sẵn mà không phải bắt đầu lại? Cung cấp cho endpoint chỉnh sửa các hướng dẫn rõ ràng để cập nhật văn bản, vật thể, tư thế hoặc phong cách, đáp ứng phản hồi của khách hàng và quy trình sản xuất lặp lại ở quy mô lớn.
Poster và tài liệu hướng dẫn nhiều văn bản có thể kết hợp cách kể chuyện bằng hình ảnh với kiểu chữ đa ngôn ngữ. Các nhóm nội dung toàn cầu có thể xây dựng tài liệu du lịch, đồ họa sự kiện và ý tưởng chiến dịch theo từng khu vực trong một hình ảnh được dàn dựng hoàn chỉnh.
Các prompt chi tiết có thể chuyển hóa mạch truyện thành truyện tranh, lịch hoặc các khung storyboard với bố cục hình ảnh có cấu trúc. Nhà sáng tạo có thể khám phá các chuỗi cảnh, nội dung giải thích giáo dục và ý tưởng chiến dịch trước khi phân bổ nguồn lực cho quá trình sản xuất hoàn chỉnh.
So sánh các endpoint Qwen Image 2.0 với các lựa chọn thay thế của Microsoft theo tác vụ, độ phân giải đầu ra tối đa và mức giá tiêu chuẩn cho mỗi hình ảnh.
| Mô hình | Tác vụ | Độ phân giải tối đa | Giá tiêu chuẩn |
|---|---|---|---|
| Qwen Image 2.0 Text-to-image | Văn bản thành hình ảnh | 2048 × 2048 | $0.035/hình ảnh |
| Qwen Image 2.0 Edit | Chỉnh sửa hình ảnh | 2048 × 2048 | $0.035/hình ảnh |
| MAI-Image-2.6-Flash Text-to-image | Văn bản thành hình ảnh | Tối đa 2.36 MP, tương đương 1536 × 1536 | $0.044/hình ảnh |
| MAI-Image-2.6-Flash Edit | Chỉnh sửa hình ảnh | Tối đa 2.36 MP, tương đương 1536 × 1536 | $0.047/hình ảnh |
Bắt đầu trong vài phút — làm theo các bước đơn giản sau để tích hợp và triển khai mô hình qua nền tảng Atlas Cloud.
Đăng ký tại atlascloud.ai và hoàn tất xác minh. Người dùng mới nhận được tín dụng miễn phí để khám phá nền tảng và thử nghiệm mô hình.
Sự kết hợp của các mô hình tiên tiến của Qwen Image 2.0 với nền tảng được tăng tốc GPU của Atlas Cloud mang lại hiệu suất, khả năng mở rộng và trải nghiệm nhà phát triển độc đáo.
Độ Trễ Thấp:
Suy luận được tối ưu hóa GPU cho suy luận thời gian thực.
API Thống nhất:
Chạy Qwen Image 2.0, GPT, Gemini và DeepSeek với một tích hợp duy nhất.
Giá cả Minh bạch:
Thanh toán dựa trên token có thể dự đoán với tùy chọn serverless.
Trải nghiệm Nhà phát triển:
SDK, phân tích, công cụ tinh chỉnh và mẫu.
Độ tin cậy:
99,99% khả dụng, RBAC và ghi nhật ký sẵn sàng cho tuân thủ.
Bảo mật và Tuân thủ:
SOC 2 Type II, tuân thủ HIPAA, chủ quyền dữ liệu tại Hoa Kỳ.
Qwen Image 2.0 là mô hình hình ảnh của đội ngũ Qwen thuộc Alibaba, dùng để tạo hình ảnh từ văn bản và chỉnh sửa ảnh hiện có theo chỉ dẫn. Atlas Cloud cung cấp các endpoint REST chuyên dụng cho cả hai tác vụ, với độ phân giải đầu ra lên đến 2K.
Sử dụng mô hình để tạo hình ảnh từ các mô tả chi tiết hoặc thay đổi hình ảnh hiện có bằng chỉ dẫn ngôn ngữ tự nhiên. Khả năng hiểu prompt được cải thiện hỗ trợ các quy trình như thiết kế đồ họa marketing, concept art, hình ảnh sản phẩm, infographic và thiết kế trực quan.
Có. Atlas Cloud nhấn mạnh khả năng hiển thị văn bản rõ ràng trong hình ảnh và hỗ trợ các prompt phức tạp, giúp mô hình phù hợp với infographic, áp phích, tài liệu marketing và các bố cục có cấu trúc khác. Hãy nêu rõ nội dung và yêu cầu bố cục trong giới hạn prompt 800 ký tự của API.
Tạo API key trong bảng điều khiển Atlas Cloud, chọn model ID dùng để tạo hoặc chỉnh sửa, rồi gửi một REST request. Inference được lưu trữ trên máy chủ, vì vậy bạn không cần cấu hình GPU cục bộ hoặc triển khai model weights.
Gửi một POST request có xác thực đến https://api.atlascloud.ai/api/v1/model/generateImage, kèm model ID và các input trong phần thân JSON. Request bất đồng bộ sẽ trả về prediction ID. Bạn có thể dùng ID này để polling prediction endpoint cho đến khi quá trình xử lý hoàn tất.
Chọn qwen/qwen-image-2.0/text-to-image khi tạo hình ảnh mới từ prompt. Để thay đổi hình ảnh tham chiếu dựa trên chỉ dẫn, hãy chọn qwen/qwen-image-2.0/edit.
Tạo hình ảnh từ văn bản yêu cầu prompt và chấp nhận tùy chọn size và seed. Tác vụ chỉnh sửa cũng yêu cầu một mảng images, trong khi size và seed vẫn là tùy chọn. Cả hai endpoint đều hỗ trợ prompt tiếng Trung và tiếng Anh dài tối đa 800 ký tự.
Endpoint chỉnh sửa chấp nhận từ 1 đến 3 URL hình ảnh tham chiếu, trong đó mỗi ảnh có kích thước từ 384 đến 3072 pixel trên mỗi chiều. Kích thước đầu ra có thể nằm trong khoảng từ 512 đến 2048 pixel, và thông tin model cho biết mô hình hỗ trợ độ phân giải lên đến 2K.
Atlas Cloud niêm yết mức giá cơ bản tiêu chuẩn là $0.035 cho mỗi request đối với cả endpoint tạo hình ảnh từ văn bản và endpoint chỉnh sửa. Đây là mức giá pay-as-you-go ban đầu, chưa bao gồm các chương trình giảm giá tạm thời.
Đặt seed thành một số nguyên cụ thể từ 0 đến 2147483647 khi cần kiểm thử có thể tái lập; giá trị mặc định -1 sẽ chọn seed ngẫu nhiên. Giữ nguyên model ID, prompt và size khi so sánh đầu ra hoặc xác định nguyên nhân của những thay đổi ngoài dự kiến.
Hướng dẫn, bài hướng dẫn và cập nhật sản phẩm giúp bạn khai thác tối đa Atlas Cloud.