


Qwen Image 3.0 pro adalah keluarga model pembuatan dan penyuntingan gambar dari Qwen untuk pengembang yang membangun alur kerja visual produksi. Model ini menghasilkan gambar hingga 2048×2048, menulis ulang prompt secara otomatis, memilih resolusi berdasarkan maksud prompt, serta mengikuti instruksi penyuntingan dalam bahasa alami sambil mempertahankan fitur wajah dan identitas. Akses kedua model melalui Atlas Cloud dengan satu kunci yang kompatibel dengan OpenAI dan harga standar bayar sesuai pemakaian sebesar $0.04 per panggilan. Mulai membangun hari ini.
Qwen Image 3.0 Pro dikembangkan oleh Alibaba. Atlas Cloud (dioperasikan oleh Atlas Cloud AI LLC) menyediakan akses ke model ini dan tidak memilikinya. Semua merek dagang adalah milik pemiliknya masing-masing.
Atlas Cloud menyediakan model kreatif terdepan dan terbaru di industri untuk Anda.
Bandingkan endpoint text-to-image dan penyuntingan berbasis referensi yang tersedia untuk Qwen Image 3.0 pro.
| Modalitas | Deskripsi |
|---|---|
| Qwen Image 3.0 Pro API (Text to Image) | Ubah prompt teks menjadi gambar dengan resolusi hingga 2048×2048, dilengkapi penulisan ulang prompt otomatis dan pemilihan resolusi berbasis prompt. Kemampuan rendering teks kompleks yang kuat serta kepatuhan presisi terhadap prompt mendukung pembuatan poster, visual produk, ilustrasi, dan aset lain yang sensitif terhadap komposisi. |
| Qwen Image 3.0 Pro API (Image Editing) | Berikan satu hingga tiga gambar referensi dan instruksi dalam bahasa alami untuk menghasilkan gambar yang telah diedit. Detail penting seperti fitur wajah dan identitas tetap dipertahankan sementara perubahan yang diminta diterapkan, sehingga endpoint ini cocok untuk penyempurnaan potret, pembuatan variasi visual, dan pembaruan aset secara terkontrol. |
Qwen Image 3.0 pro memadukan rendering teks kompleks, kepatuhan yang presisi terhadap prompt, pembuatan hingga 2048 × 2048, penulisan ulang prompt otomatis, serta pengeditan yang mempertahankan identitas dari satu hingga tiga referensi melalui API bayar sesuai pemakaian terpadu milik Atlas Cloud.

Qwen Image 3.0 pro mengikuti prompt terperinci sekaligus menangani rendering teks kompleks dalam bahasa Inggris dan Tionghoa. Model ini dapat menyusun tata letak kreatif yang padat tanpa memisahkan tipografi dari adegan. Tentukan teks, hierarki, komposisi, dan gaya visual dalam satu permintaan, lalu periksa kembali nama dan angka sebelum dipublikasikan. Hal ini membuatnya praktis untuk banner, grafis editorial, konsep kemasan, dan karya seni kaya informasi.

Hasilkan gambar dengan resolusi hingga 2048 × 2048 saat tekstur halus dan detail yang mudah dibaca menjadi pertimbangan penting. Pemilihan ukuran yang dipandu prompt dapat menentukan resolusi output secara otomatis, sementara ukuran eksplisit memungkinkan Anda menargetkan kanvas yang sudah ditentukan. Mulai dari fotografi produk hingga potret editorial, anggaran piksel tambahan mendukung pemeriksaan lebih dekat, pemotongan lanjutan yang fleksibel, dan aset produksi yang lebih rapi.

Prompt singkat dapat diperluas secara otomatis sebelum generasi, dengan penulisan ulang aktif secara default. Pada endpoint pembuatan teks, mode Direct melakukan penulisan ulang satu kali, sedangkan mode Agent menggunakan pipeline agentic untuk memperkaya brief. Biarkan penulisan ulang tetap aktif untuk konsep eksploratif, atau nonaktifkan saat ketepatan kata dan instruksi yang dikontrol secara ketat lebih penting dalam produksi.

Masukkan satu hingga tiga gambar referensi ke dalam pengeditan dan jelaskan perubahannya menggunakan bahasa alami. Model dapat menggunakan sumber tersebut sebagai panduan subjek, konteks, atau visual, sekaligus mempertahankan fitur wajah dan identitas utama. Minta lingkungan, penataan gaya, atau komposisi baru tanpa membangun ulang subjek yang telah disetujui dari awal. Fitur ini cocok untuk varian kampanye, kesinambungan karakter, dan adegan produk berbasis referensi.

Membutuhkan eksperimen yang dapat diulang? Tetapkan seed tetap dari 0 hingga 2147483647, tambahkan negative prompt, dan minta hingga empat output dalam satu panggilan generasi. Kontrol ini memudahkan perbandingan revisi prompt, pengecualian konten yang tidak diinginkan, dan peninjauan sejumlah kecil opsi dalam kondisi yang konsisten. Gunakan untuk pengujian kreatif yang terstruktur, bukan perkiraan sekali coba.
Lihat bagaimana Qwen Image 3.0 pro, pesaing eksternal terkemuka, dan pendahulunya dari seri yang sama menafsirkan prompt identik dalam desain kaya tipografi dan fotografi dokumenter.
Di sebuah bazar rempah yang ramai saat tengah hari, abadikan momen menentukan yang jenaka ketika seorang pedagang pria muda mengayunkan karung goni kasar berisi saffron ke udara, tepat saat seekor merpati dengan blur gerak menyenggol gundukan kunyit, sehingga awan bercahaya bubuk emas melayang di seluruh adegan; para pelanggan yang terkejut bereaksi secara alami dan jenaka, salah satunya terlihat jelas melindungi beberapa buah delima merah mengilap dengan kedua tangan, sementara yang lain secara bersamaan mendekap bungkusan rempah dari kertas yang terlipat ke dadanya, dengan setiap lengan, tangan, jari, objek, dan interaksi ditampilkan secara anatomis benar, jelas, dan mudah dikenali. Bingkai pasar melalui arkade batu berlapis untuk menciptakan komposisi frame-within-a-frame yang kuat, menggunakan sudut pandang Dutch-angle yang sedikit menanjak; blok-blok cabai merah tua, mangkuk keramik nila pekat, dan tumpukan kunyit kuning cerah membentuk palet warna primer yang disiplin, hanya merah, kuning, dan biru. Cahaya langit tengah hari yang keras dan terarah menghasilkan bayangan geometris yang tegas di seluruh kios, wajah, dan batu paving yang aus. Pertahankan realisme taktil pada butiran bubuk yang beterbangan, serat goni tenun, benang saffron tipis seperti kertas, tumpukan rempah berdebu, timbangan tembaga tempa, tembikar berglasir, serat kayu yang lapuk, bungkusan kertas berkerut, tekstur kulit muda alami, dan grain film analog yang halus. Sertakan papan nama toko lebar horizontal yang dilukis dengan tangan dan bertuliskan tepat “SPICE, SUN & SURPRISE” dalam huruf besar yang sangat mudah dibaca, serta beberapa label harga tulisan tangan terpisah yang masing-masing bertuliskan tepat “SAFFRON 12”, “TURMERIC 4”, “CHILIES 6”, dan “POMEGRANATES 3”, semuanya dieja dengan benar, dibentuk secara rapi, dan menyatu secara alami dengan kios. Fotografi dokumenter majalah perjalanan vintage tahun 1970-an, kehangatan manusia yang spontan, realisme terkendali, lensa lingkungan 28mm, fokus berlapis yang dalam dengan tepi latar depan yang sebagian terhalang lembut, sedikit blur gerak pada merpati, wajah dan tangan yang tajam, pencahayaan autentik, tanpa pose, tanpa rendering berlebihan yang tampak berminyak, tanpa tampilan HDR, tanpa kulit plastik, tanpa warna keruh, tanpa cahaya berlebihan, tanpa pencahayaan epik fantasi, tanpa palet pelangi yang berantakan, tanpa tangan cacat, tanpa jari tambahan, tanpa orang yang terduplikasi, tanpa teks kacau, tanpa bingkai, tanpa mockup, rasio aspek lanskap lebar 16:9, hingga ke tepi.

Generated with Qwen Image 3.0 Pro Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Qwen Image 3.0 Text-to-Image on Atlas Cloud
Foto dokumenter sinematik di dalam binatu swalayan pada malam yang hujan, mengabadikan momen menentukan ketika sebuah mesin cuci bukaan depan tiba-tiba memuntahkan kaskade besar busa putih; seorang wanita muda mengenakan jas hujan kuning cerah tertawa spontan sambil menampung tumpahan dengan baskom cuci plastik merah, tangannya menggenggam bibir baskom secara alami dengan jari-jari yang benar secara anatomis, sementara temannya berdiri di luar kaca yang berembun dan menulis dengan jarinya teks terbalik cermin yang tepat “LAST WASH 11:30”, terbaca dari dalam binatu; pada saat yang sama, satu kaus kaki basah menampar kaca lalu menempel di sana. Deretan pintu mesin cuci bundar menciptakan geometri berulang yang tegas dan garis pengarah kuat menuju ruang yang dalam, sementara pantulan berlapis di jendela menampilkan aksi jenaka di dalam sekaligus jalan neon yang basah oleh hujan di luar, membentuk narasi ganda yang koheren. Cahaya langit-langit fluoresen putih dingin yang terarah membentuk siluet tegas dan kontur bersih pada wajah, jas hujan, tangan, busa, dan krom; neon magenta yang terkendali merembes melalui jendela dan memantul di genangan trotoar, dengan palet tiga warna yang disiplin: biru sian, kuning cerah, dan magenta. Tetesan air fotorealistik di kaca, gelembung transparan, kain tenun lembap, logam dengan finishing sikat, karet penyegel pintu, kondensasi, pantulan genangan, blur gerak halus pada busa yang beterbangan, grain film high-ISO yang lembut, tekstur kulit muda alami, ekspresi spontan, pantulan dan permukaan transparan yang kompleks namun konsisten secara spasial. Reportase lingkungan setinggi mata, lensa 35mm, kedalaman bidang sedang, realisme sinematik, ketidaksempurnaan halus, tanpa pose yang dibuat-buat, tanpa rendering berlebihan yang tampak berminyak, tanpa tampilan HDR, tanpa kulit plastik, tanpa warna keruh, tanpa cahaya berlebihan, tanpa pencahayaan epik murahan, rasio aspek horizontal lebar 16:9, hingga ke tepi.

Generated with Qwen Image 3.0 Pro Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Qwen Image 3.0 Text-to-Image on Atlas Cloud
Qwen Image 3.0 Pro mendukung grafis kampanye, visual produk, konsep antarmuka, storyboard, dan penyuntingan yang mempertahankan identitas melalui kepatuhan prompt yang presisi, rendering teks kompleks, output hingga 2048×2048, serta satu hingga tiga gambar referensi.
Ubah prompt yang menantang menjadi poster kampanye, banner, dan grafis media sosial dengan memanfaatkan keunggulan Qwen dalam rendering teks kompleks dan kepatuhan prompt yang presisi. Buat aset merek hingga 2048×2048 untuk peluncuran, acara, dan promosi.
Hasilkan adegan produk dari teks, sementara penulisan ulang prompt otomatis memperluas ide singkat dan penentuan ukuran berbasis prompt memilih kanvas yang sesuai. Hasilnya mendukung gambar katalog, promosi ecommerce, dan pengujian konsep secara cepat untuk tim kecil.
Pertahankan fitur wajah dan identitas sambil mengubah pakaian, latar, pencahayaan, atau gaya visual melalui penyuntingan dalam bahasa alami. Studio potret dan aplikasi kreator dapat menghasilkan variasi kampanye yang tetap mudah dikenali dari satu hingga tiga gambar referensi.
Membutuhkan visual kaya informasi dari instruksi terperinci? Gunakan kepatuhan prompt yang presisi dan rendering teks kompleks untuk membuat prototipe konsep antarmuka, diagram edukatif, penjelasan beranotasi, dan grafis presentasi bagi tim produk atau pembelajaran.
Masukkan hingga tiga gambar referensi ke dalam satu permintaan penyuntingan, lalu arahkan perubahan dalam bahasa alami sambil mempertahankan detail penting. Ini cocok untuk komposit, variasi merchandise, dan alur kerja kreatif yang berpusat pada karakter.
Buat sketsa adegan berurutan dari prompt yang ditulis dengan cermat, dengan kepatuhan prompt yang membantu setiap frame mengikuti subjek, latar, dan arahan visual yang diminta. Pembuat film, agensi, dan tim game dapat mengubah ide awal menjadi panel storyboard.
Bandingkan Qwen Image 3.0 pro dengan endpoint Seedream dan Nano Banana berdasarkan alur kerja, ukuran output maksimum, kapasitas referensi, alat prompt, dan harga standar Atlas Cloud.
| Model | Alur Kerja | Ukuran Output Maksimum | Jumlah Gambar Referensi Maksimum | Alat Prompt | Harga Standar |
|---|---|---|---|---|---|
| Qwen Image 3.0 Pro Text-to-Image | Teks ke gambar | 2048×2048 | - | Penulisan ulang prompt otomatis | $0.04/gambar |
| Qwen Image 3.0 Pro Edit | Pengeditan gambar | 1440×1440 | 3 | Penulisan ulang prompt otomatis | $0.04/gambar |
| Seedream v5.0 Pro Text-to-Image | Teks ke gambar | Hingga 4.19 MP | - | Penalaran dan pengoptimalan prompt | $0.045/gambar |
| Seedream v5.0 Pro Edit | Pengeditan gambar | Hingga 4.19 MP | 10 | Penalaran dan pengoptimalan prompt | $0.045/gambar |
| Nano Banana 2 Text-to-Image | Teks ke gambar | 4K | - | Penalaran dan grounding pencarian | $0.08/gambar |
| Nano Banana 2 Edit | Pengeditan gambar | 4K | 14 | Penalaran dan grounding pencarian | $0.08/gambar |
Mulai dalam hitungan menit — ikuti langkah-langkah sederhana berikut untuk mengintegrasikan dan men-deploy model melalui platform Atlas Cloud.
Daftar di atlascloud.ai dan selesaikan verifikasi. Pengguna baru mendapatkan kredit gratis untuk menjelajahi platform dan menguji model.
Gabungkan model Qwen Image 3.0 Pro canggih dengan platform akselerasi GPU Atlas Cloud untuk performa, skalabilitas, dan pengalaman pengembangan yang tak tertandingi.
Latensi Rendah:
Inferensi yang dioptimalkan GPU untuk respons real-time.
API Terpadu:
Satu integrasi untuk Qwen Image 3.0 Pro, GPT, Gemini, dan DeepSeek.
Harga Transparan:
Billing per token, mendukung mode Serverless.
Pengalaman Developer:
SDK, analitik data, alat fine-tuning, dan template tersedia lengkap.
Keandalan:
Ketersediaan 99.99%, kontrol izin RBAC, logging kepatuhan.
Keamanan & Kepatuhan:
Sertifikasi SOC 2 Type II, kepatuhan HIPAA, kedaulatan data AS.
Qwen Image 3.0 Pro adalah model generasi dan pengeditan gambar dari Alibaba untuk menghasilkan gambar dari teks atau memodifikasi visual yang ada menggunakan instruksi bahasa alami. Di Atlas Cloud, model ini mendukung output hingga 2048×2048 serta pengeditan dengan satu hingga tiga gambar referensi.
Gunakan model ini untuk menghasilkan gambar yang memerlukan kepatuhan terhadap prompt secara mendetail, rendering teks yang kompleks, atau output beresolusi tinggi. Dalam alur kerja pengeditan, instruksi bahasa alami dapat mengubah gambar sekaligus mempertahankan detail penting seperti fitur wajah dan identitas.
Pilih rute text-to-image atau edit, lalu panggil melalui API yang kompatibel dengan OpenAI milik Atlas Cloud menggunakan ID model yang sesuai. Jadikan skema parameter Playground yang ditautkan sebagai sumber kebenaran saat menyusun dan memvalidasi permintaan Anda.
Pilih qwen-image-3.0-pro/text-to-image saat menghasilkan gambar dari prompt, atau qwen-image-3.0-pro/edit saat memodifikasi gambar referensi. Kedua rute memiliki skema Playground terpisah, jadi gunakan skema yang sesuai dengan alur kerja pilihan Anda.
Generasi text-to-image mendukung resolusi hingga 2048×2048. Jika resolusi tidak dipilih secara manual, model dapat menggunakan prompt untuk menentukan resolusi yang sesuai.
Berikan satu hingga tiga gambar referensi bersama instruksi pengeditan dalam bahasa alami. Model edit menggunakan input tersebut untuk menerapkan perubahan yang diminta sambil mempertahankan detail visual utama, termasuk fitur wajah dan identitas.
Ya. Model text-to-image menyertakan penulisan ulang prompt otomatis sekaligus pemilihan resolusi berdasarkan prompt. Tinjau output berdasarkan instruksi asli Anda jika ketepatan kata, tata letak, atau teks yang disematkan sangat penting.
Atlas Cloud mencantumkan harga dasar standar sebesar $0.04 per gambar untuk model text-to-image dan edit. Penagihan menggunakan model bayar sesuai pemakaian, sehingga developer dapat menggunakan salah satu alur kerja tanpa komitmen berlangganan.
Kedua versi mendukung generasi text-to-image dan pengeditan gambar. Ikhtisar resmi Alibaba menjelaskan bahwa model standar menyeimbangkan kualitas dan kecepatan, tetapi sumber terverifikasi yang ditinjau di sini tidak memberikan perbandingan kuantitatif dengan Pro. Jalankan prompt yang representatif pada kedua versi sebelum memilih default produksi.
Mulailah dengan gambar referensi yang jelas dan nyatakan secara eksplisit detail wajah atau identitas mana yang harus tetap tidak berubah. Endpoint edit menerima hingga tiga referensi dan dirancang untuk mempertahankan detail tersebut. Jika perubahan identitas masih terjadi, sederhanakan transformasi yang diminta dan evaluasi generasi lainnya.
Panduan, tutorial, dan pembaruan produk untuk membantu Anda memaksimalkan Atlas Cloud.