


Qwen Image 2.0 adalah model gambar generasi berikutnya dari tim Qwen di Alibaba Cloud. Dirancang untuk input teks dan gambar, model ini menghasilkan output 2K secara native, dengan kesesuaian semantik yang lebih kuat, detail realistis, serta kemampuan mengikuti instruksi secara presisi dalam alur kerja pembuatan dan revisi. Atlas Cloud menyediakan endpoint REST siap digunakan untuk kedua mode, tanpa cold start, dengan harga standar $0.035 per gambar. Mulai membangun hari ini.
Qwen Image 2.0 dikembangkan oleh Alibaba. Atlas Cloud (dioperasikan oleh Atlas Cloud AI LLC) menyediakan akses ke model ini dan tidak memilikinya. Semua merek dagang adalah milik pemiliknya masing-masing.
Atlas Cloud menyediakan model kreatif terdepan dan terbaru di industri untuk Anda.
Bandingkan dua endpoint Qwen Image 2.0 untuk membuat dan menyempurnakan gambar dengan resolusi hingga 2K.
| Modalitas | Deskripsi |
|---|---|
| Qwen Image 2.0 Text to Image API | Ubah prompt teks menjadi gambar dengan resolusi hingga 2K, didukung pemahaman prompt dan kualitas gambar yang lebih baik. Gunakan endpoint ini untuk concept art, gambar produk, aset pemasaran, dan alur kerja visual berbasis prompt lainnya. |
| Qwen Image 2.0 Edit API | Dirancang untuk mengedit gambar, endpoint ini menerapkan instruksi tertulis pada visual yang sudah ada dan menghasilkan gambar dengan resolusi hingga 2K. Cocok untuk penyempurnaan aset, variasi kreatif, perubahan visual yang terarah, dan alur kerja produksi iteratif. |
Qwen Image 2.0 menggabungkan output hingga 2K, pemahaman prompt yang lebih kuat, perenderan teks dwibahasa, pengeditan berbasis referensi, seed yang dapat direproduksi, serta akses REST Atlas Cloud dengan harga bayar sesuai penggunaan yang transparan.

Qwen Image 2.0 merender gambar dengan ukuran 512 hingga 2048 piksel per dimensi, dengan output hingga 2K. Kualitas gambarnya yang ditingkatkan mempertahankan detail permukaan, lanskap berlapis, dan aksen visual kecil di seluruh bidang gambar. Pilih dimensi yang sesuai dengan format distribusi Anda. Hal ini menjadikan model ini cocok untuk visual produk, fotografi editorial, dan concept art yang mendetail.

Brief terstruktur tetap mudah dikelola dengan prompt hingga 800 karakter dalam bahasa Inggris atau Mandarin. Jelaskan subjek, pencahayaan, komposisi, material, dan aksi dalam satu instruksi, lalu gunakan seed tetap saat memerlukan iterasi yang dapat direproduksi. Pemahaman prompt yang lebih baik membantu mempertahankan hubungan antara beberapa elemen yang diminta. Konsep kompleks menjadi lebih mudah diprediksi untuk kampanye, adegan arsitektur, dan alur kerja kreatif yang terarah.

Teks berbahasa Inggris dan Mandarin yang mudah dibaca dapat muncul di dalam visual yang padat dan tersusun cermat. Model ini memadukan perenderan multibahasa dengan komposisi yang andal, sehingga label, papan tanda, judul, dan grafik pendukung tetap selaras dengan adegan di sekitarnya. Arahan dwibahasa dapat menjadi bagian dari gambar, bukan overlay terpisah. Gunakan untuk grafik promosi berukuran besar, visual presentasi, menu, dan karya seni kaya informasi yang jika tidak akan memerlukan banyak pembersihan manual.

Mulai dengan satu hingga tiga gambar referensi, lalu jelaskan pengeditan yang diinginkan menggunakan bahasa alami. Endpoint edit menerima instruksi hingga 800 karakter dan dapat menghasilkan gambar hingga 2K dengan menggunakan seed untuk proses yang dapat diulang. Alur kerja terkontrol ini cocok untuk revisi produk, perubahan gaya visual, dan pengembangan kreatif iteratif tanpa membangun ulang komposisi sumber dari awal.

Dimensi output dapat berkisar dari 512 hingga 2048 piksel per sisi, dan seed menerima nilai dari 0 hingga 2147483647. Seed acak tetap tersedia dengan nilai default negatif satu. Sesuaikan kanvas dengan kebutuhan persegi, lanskap, atau potret sambil mempertahankan titik awal yang dapat diulang. Kontrol ini menyederhanakan pengujian sistematis dan produksi aset yang konsisten di berbagai penempatan.

Atlas Cloud menyediakan pembuatan teks ke gambar dan pengeditan gambar melalui endpoint REST dengan harga standar $0.035 per gambar. Inferensi siap pakai, tanpa cold start, dan akses Day 0 menghilangkan pekerjaan hosting model, sementara satu API terpadu menjaga integrasi tetap konsisten di seluruh keluarga model. Konfigurasi ini mendukung prototipe, alat produksi, dan pipeline gambar berskala besar dengan penagihan bayar sesuai penggunaan yang transparan.
Lihat bagaimana Qwen Image 2.0 dan dua model gambar sebanding menafsirkan prompt yang sama dalam desain grafis presisi dan fotografi dokumenter bergerak cepat.
Film bencana sinematik di atas meja, dipotret di momen penentu: tangan realistis seorang pembuat model muda menjulur ke dalam bingkai untuk menahan mercusuar mini yang miring setelah diterjang gelombang tinggi mendadak yang menyembur dari cangkir teh putih krem, sementara beberapa figur kru film mungil melarikan diri dengan panik sambil membawa kamera biru navy, tripod, kabel, dan peralatan pencahayaan; sebuah papan clapperboard mini yang sangat jelas terbaca bertuliskan tepat “CANGKIR TEH TERAKHIR” dan “PENGAMBILAN 07” dengan huruf yang rapi dan ejaan yang benar. Tekstur taktil animasi stop-motion buatan tangan berpadu dengan fotografi makro fotorealistis, menekankan benturan humoris antara skala manusia dan miniatur. Posisi kamera rendah menyapu permukaan meja; kabel listrik kusut dan jejak air berkilau membentuk garis pengarah kuat menuju mercusuar dan cangkir teh yang miring; sebuah sekrup logam yang tidak fokus sebagian menghalangi latar depan ekstrem untuk menciptakan kedalaman berlapis dan kebingungan skala. Sinar matahari siang yang keras dan terarah menembus tirai venesia, menghasilkan bayangan bergaris yang tajam di seluruh set, dengan tetesan air yang melayang dan buram gerak halus pada kru yang melarikan diri. Palet terbatas yang ketat: putih krem, biru navy, dan oranye keselamatan. Serat kayu tua yang sangat meyakinkan, bubur kertas yang basah dan menggelembung, cat miniatur yang terkelupas, logam tergores, kain lembap, air transparan dengan pembiasan, tegangan permukaan, percikan, dan hubungan spasial yang akurat secara fisik. Aksi padat di sekitar bencana pusat diimbangi ruang negatif yang lebih tenang di dekat tepi bingkai, ketidaksempurnaan buatan tangan, butiran film halus yang terkendali, kedalaman bidang dangkal, lensa makro, fokus dekat, penurunan optik realistis, fotografi efek praktis premium, tanpa rendering berminyak berlebihan, tanpa detail bergaya HDR yang memenuhi seluruh bidang, tanpa kulit yang tampak plastik, tanpa corak warna keruh atau kotor, tanpa cahaya menyeluruh yang berlebihan, tanpa pencahayaan fantasi epik murahan, tanpa estetika bawah air gelap atau reruntuhan luar angkasa, rasio aspek horizontal lebar 16:9, full-bleed.

Generated with Qwen Image 2.0 Text-to-image on Atlas Cloud

Generated with Seedream v4.7 Text-to-Image on Atlas Cloud

Generated with Wan-2.7 Text-to-image on Atlas Cloud
Pelarian dari penjara mini berlangsung di atas meja kerja pembuat figur tepat pada momen penentu ketika sang pembuat pergi sejenak: sekelompok figur kecil dari tanah liat putih yang belum dicat dengan cerdik melipat label inspeksi kertas—bertuliskan kata-kata kecil, tajam, dan sangat jelas “INSPEKSI AKHIR”—menjadi balon udara panas darurat; salah satu figur baru saja memotong tambatan terakhir, balon kertas itu tersentak naik dengan sedikit buram gerak sementara rekan-rekannya mundur, bersorak, dan menatap ke atas dengan takjub. Sebuah stoples cat yang terguling menumpahkan sungai ultramarine berliku melintasi adegan, dengan jejak kaki kecil berwarna vermilion dan jembatan darurat di sepanjang tepinya. Penceritaan spasial miniatur yang presisi, dengan setiap karakter melakukan aksi yang berbeda. Rak perkakas kayu menciptakan bingkai di dalam bingkai yang kuat; pinset, alat pahat, dan pisau kerajinan membentuk garis pengarah radial menuju balon yang sedang naik; pertahankan ruang negatif yang bersih dan tidak berantakan di kanan atas. Cahaya jendela terarah masuk secara diagonal dari kiri, menghasilkan bayangan memanjang dengan tepi lembut serta menerangi sidik jari yang menekan tanah liat mentah, serat kayu yang aus, serat kertas terlipat, perkakas logam tergores, dan permukaan lengket cat yang setengah kering. Hanya palet tiga warna yang ketat: putih tanah liat, biru ultramarine, dan merah vermilion, dengan variasi tonal alami yang terkendali—tanpa warna aksen tambahan. Animasi stop-motion yang sangat indah berpadu dengan sinematografi makro fotorealistis, ketidaksempurnaan buatan tangan yang taktil, kedalaman bidang dangkal selektif, perkakas latar depan yang diburamkan lembut, aksi pusat yang terselesaikan tajam, butiran film analog halus, lensa makro 100mm, sinematik namun intim, realisme efek praktis yang canggih, tanpa permukaan plastik mengilap, tanpa rendering berminyak berlebihan, tanpa HDR, tanpa warna keruh, tanpa cahaya menyeluruh yang berlebihan, tanpa gaya fantasi epik murahan, tanpa suasana bawah air gelap atau reruntuhan luar angkasa, komposisi horizontal lebar 16:9, bingkai full-bleed dari tepi ke tepi.

Generated with Qwen Image 2.0 Text-to-image on Atlas Cloud

Generated with Seedream v4.7 Text-to-Image on Atlas Cloud

Generated with Wan-2.7 Text-to-image on Atlas Cloud
Qwen Image 2.0 mengubah prompt terperinci dan gambar yang sudah ada menjadi grafis presentasi, aset kampanye, adegan produk, storyboard, visual terlokalisasi, serta penyuntingan presisi dengan resolusi hingga 2K.
Ubah prompt terperinci menjadi visual presentasi yang rapi dengan tata letak terstruktur dan teks yang mudah dibaca di dalam gambar. Tim produk dapat membuat slide konsep, materi penjelasan, dan aset presentasi internal dengan resolusi hingga 2K.
Tipografi yang dirender secara profesional menghadirkan kejelasan pada poster, grafis media sosial, dan konsep kampanye yang dibuat dari prompt terperinci. Tim pemasaran memperoleh arahan visual yang fleksibel untuk peluncuran, promosi, dan komunikasi bermerek tanpa harus menyusun ulang setiap komposisi secara manual.
Saat adegan produk membutuhkan detail, buat adegan tersebut dari prompt deskriptif dengan resolusi hingga 2K. Pengecer dan studio kreatif dapat menyempurnakan latar belakang, objek di sekitarnya, atau konteks kampanye melalui instruksi penyuntingan yang jelas untuk berbagai penempatan.
Perlu mengubah visual yang sudah ada tanpa memulai dari awal? Berikan instruksi yang jelas kepada endpoint penyuntingan untuk memperbarui teks, objek, pose, atau gaya demi memenuhi masukan klien dan alur kerja produksi iteratif dalam skala besar.
Poster dan panduan yang kaya teks dapat memadukan penceritaan visual dengan tipografi multibahasa. Tim konten global dapat menyusun materi perjalanan terlokalisasi, grafis acara, dan konsep kampanye regional dalam satu gambar yang tersusun utuh.
Prompt terperinci dapat memetakan narasi menjadi komik, kalender, atau panel storyboard dengan komposisi visual yang terstruktur. Kreator dapat mengeksplorasi rangkaian adegan, materi penjelasan edukatif, dan konsep kampanye sebelum mengalokasikan sumber daya untuk produksi penuh.
Bandingkan endpoint Qwen Image 2.0 dengan alternatif Microsoft berdasarkan tugas, resolusi output maksimum, dan harga standar per gambar.
| Model | Tugas | Resolusi Maksimum | Harga Standar |
|---|---|---|---|
| Qwen Image 2.0 Text-to-image | Teks ke gambar | 2048 × 2048 | $0.035/gambar |
| Qwen Image 2.0 Edit | Pengeditan gambar | 2048 × 2048 | $0.035/gambar |
| MAI-Image-2.6-Flash Text-to-image | Teks ke gambar | maksimum 2.36 MP, setara dengan 1536 × 1536 | $0.044/gambar |
| MAI-Image-2.6-Flash Edit | Pengeditan gambar | maksimum 2.36 MP, setara dengan 1536 × 1536 | $0.047/gambar |
Mulai dalam hitungan menit — ikuti langkah-langkah sederhana berikut untuk mengintegrasikan dan men-deploy model melalui platform Atlas Cloud.
Daftar di atlascloud.ai dan selesaikan verifikasi. Pengguna baru mendapatkan kredit gratis untuk menjelajahi platform dan menguji model.
Gabungkan model Qwen Image 2.0 canggih dengan platform akselerasi GPU Atlas Cloud untuk performa, skalabilitas, dan pengalaman pengembangan yang tak tertandingi.
Latensi Rendah:
Inferensi yang dioptimalkan GPU untuk respons real-time.
API Terpadu:
Satu integrasi untuk Qwen Image 2.0, GPT, Gemini, dan DeepSeek.
Harga Transparan:
Billing per token, mendukung mode Serverless.
Pengalaman Developer:
SDK, analitik data, alat fine-tuning, dan template tersedia lengkap.
Keandalan:
Ketersediaan 99.99%, kontrol izin RBAC, logging kepatuhan.
Keamanan & Kepatuhan:
Sertifikasi SOC 2 Type II, kepatuhan HIPAA, kedaulatan data AS.
Qwen Image 2.0 adalah model gambar dari tim Qwen Alibaba untuk membuat visual dari teks dan mengedit gambar yang sudah ada menggunakan instruksi. Atlas Cloud menyediakan endpoint REST API khusus untuk kedua tugas tersebut, dengan resolusi output hingga 2K.
Gunakan model ini untuk membuat gambar dari deskripsi terperinci atau memodifikasi visual yang sudah ada melalui instruksi dalam bahasa alami. Pemahaman prompt yang lebih baik mendukung alur kerja seperti grafis pemasaran, concept art, gambar produk, infografik, dan desain visual.
Ya. Atlas Cloud menonjolkan teks dalam gambar yang mudah dibaca serta dukungan untuk prompt yang kompleks, sehingga model ini cocok untuk infografik, poster, materi pemasaran, dan tata letak terstruktur lainnya. Pastikan instruksi mengenai teks dan tata letak ditulis secara eksplisit dalam batas prompt API sebesar 800 karakter.
Buat API key di dashboard Atlas Cloud, pilih ID model untuk pembuatan atau pengeditan, lalu kirim REST request. Dengan inference ter-host, Anda tidak perlu mengonfigurasi GPU lokal atau men-deploy bobot model.
Kirim request POST terautentikasi ke https://api.atlascloud.ai/api/v1/model/generateImage dengan ID model dan input Anda di dalam body JSON. Request asinkron ini mengembalikan ID prediksi, yang dapat Anda polling melalui endpoint prediksi hingga pemrosesan selesai.
Pilih qwen/qwen-image-2.0/text-to-image saat membuat gambar baru dari sebuah prompt. Untuk perubahan berbasis instruksi pada gambar referensi, pilih qwen/qwen-image-2.0/edit.
Pembuatan berbasis teks memerlukan prompt dan menerima nilai size serta seed opsional. Pengeditan juga memerlukan array images, sedangkan size dan seed tetap opsional. Kedua endpoint menerima prompt dalam bahasa Mandarin dan Inggris hingga 800 karakter.
Endpoint pengeditan menerima satu hingga tiga URL gambar referensi, dengan setiap gambar berukuran antara 384 dan 3072 piksel per dimensi. Dimensi output dapat berkisar antara 512 hingga 2048 piksel, dan profil model mencantumkan dukungan untuk resolusi hingga 2K.
Atlas Cloud mencantumkan harga dasar standar sebesar $0.035 per request untuk endpoint pembuatan berbasis teks maupun pengeditan. Ini adalah harga pay-as-you-go awal, tidak termasuk diskon sementara.
Tetapkan seed ke bilangan bulat tertentu dari 0 hingga 2147483647 saat memerlukan pengujian yang dapat diulang, sedangkan nilai default -1 akan memilih seed acak. Pertahankan ID model, prompt, dan size agar tetap sama saat membandingkan output atau mengisolasi variasi yang tidak terduga.
Panduan, tutorial, dan pembaruan produk untuk membantu Anda memaksimalkan Atlas Cloud.