Seedance 2.5 Kini Tersedia — Hadir Pertama di Atlas Cloud

Wan 3.0 Multi-Shot Consistency: Saya Menghitung Setiap Potongan dalam 110 Klip Resmi

Wan 3.0 Konsistensi Multi-Shot: Saya Menghitung Semua 110 Klip

Konsistensi Multi-Shot Wan 3.0: Saya Menghitung Setiap Potongan di 110 Klip Resmi

Anda menulis skrip empat shot. Shot 1 mendarat sempurna: topi jerami, kalung manik-manik hitam, gaun linen putih, pencahayaan tepat. Shot 2 tiba dan itu adalah wanita berbeda dengan topi berbeda.

Kesenjangan itulah alasan mengapa orang-orang menatap konsistensi multi-shot Wan 3.0, janji satu prompt, enam shot, tiga puluh detik, karakter yang sama dari awal hingga akhir.

Jadi saya berhenti membaca lembar spesifikasi. Saya mengunduh semua 110 file demo yang diterbitkan Alibaba dengan buku panduan kreator Wan 3.0 miliknya sendiri, menjalankan ffmpeg pada setiap file, mengurai semua 64 prompt berpasangan, dan kemudian melakukan hal yang belum pernah dilakukan siapa pun dalam hasil pencarian: saya menghitung potongan sebenarnya dalam video yang dikirim dan membandingkannya dengan jumlah shot yang diminta setiap prompt.

Tiga temuan bertentangan dengan apa yang akan Anda baca di mana-mana.

Ruang grading warna sinematik dengan dinding monitor menampilkan karakter bertopi jerami yang sama di enam shot berbeda, titik referensi untuk konsistensi multi-shot Wan 3.0

Dinding referensi colorist adalah model mental yang jujur untuk konsistensi multi-shot: satu identitas, enam pembingkaian, diperiksa berdampingan. Dihasilkan dengan openai/gpt-image-2.

Poin penting

  • 6 shot itu nyata tetapi tidak dijamin: 3 dari prompt multi-shot Alibaba sendiri mencapai jumlah yang dinyatakan dengan tepat, 2 kurang dari yang diminta.
  • Kasus terburuk meminta 4 shot dan hanya menghasilkan 2.
  • Tidak ada 4K. Nol dari 110 file resmi melebihi 1080p, dan hanya 4 yang tepat 1920x1080.
  • Properti dan kamera meleset sebelum wajah. Perhatikan topinya, bukan matanya.
  • Belum ada API publik Wan 3.0 di luar platform Alibaba sendiri, jadi tutorial di bawah ini membangunnya kembali pada model yang bisa Anda panggil hari ini.

Berikut adalah hasil terbaik, dari buku panduan Alibaba sendiri. Enam shot dinyatakan dalam prompt, enam shot terkirim, dua karakter yang sama, pakaian yang sama, hujan yang sama:

Urutan anime enam shot di peron kereta hujan, gadis yang sama dengan payung transparan dan anak laki-laki dengan ransel khaki dipertahankan secara konsisten di setiap potongan

Demo beta resmi Wan 3.0 Alibaba (klip buku panduan v013, 1280x720, 20,05 detik). Prompt memberi nomor shot 1 hingga 6; ffmpeg menemukan tepat 5 potongan keras, sehingga semua 6 shot mendarat. Tidak dihasilkan oleh Atlas Cloud.

Apa Sebenarnya Konsistensi Multi-Shot Wan 3.0

Versi singkat: ini adalah tiga janji terpisah dengan satu nama, dan Alibaba sangat spesifik tentang tiga mana.

Dalam tulisan peluncurannya, Alibaba membagi konsistensi menjadi karakter ("fitur wajah, gaya rambut dan warna rambut, bentuk tubuh, pakaian, dan aksesori"), properti ("penampilan multi-sudut, struktur perangkat keras, logo, dan detail material"), dan ruang ("pemblokiran karakter dan perspektif kamera") (Alibaba Cloud, 2026). Pembagian tiga lapis itu adalah rubrik penilaian untuk semua yang ada di bawah. Wajah sama, kalung salah, adalah gagal.

Model menghasilkan hingga 30 detik dalam satu pekerjaan, pada 480P, 720P atau 1080P (Alibaba Cloud, 2026).

Sekarang bagian yang salah dalam hasil pencarian.

Klaim umum di hasil pencarianApa yang sebenarnya ditunjukkan materi pihak pertama
"Generasi 4K asli"Postingan resmi hanya mencantumkan 480P / 720P / 1080P. Di 110 file demo resmi, tidak ada yang melebihi 1080p, dan hanya 4 file yang tepat 1920x1080. Output lanskap "1080p" biasa adalah 1920x1072.
"Hingga 6 shot independen per generasi"Tidak ada spesifikasi jumlah shot yang muncul di postingan peluncuran Alibaba sendiri. Secara empiris, ini berlaku: dari 8 prompt multi-shot eksplisit di buku panduan, yang tertinggi menyatakan 6, dan dua di antaranya menghasilkan 6.
"Hingga 12 gambar referensi"Pengujian langsung melaporkan hingga 10 gambar plus 5 klip video plus 5 klip audio (Curious Refuge, 2026). Postingan Alibaba tidak memberikan angka sama sekali.
"Bobot terbuka, Apache-2.0"Rilis Wan sebelumnya bersifat open-weight; Wan 3.0 hadir sebagai layanan platform dan tidak ada bobot yang muncul (Curious Refuge, 2026).
"API sudah keluar"Ini berjalan di Alibaba Cloud Model Studio. Platform inferensi pihak ketiga belum memilikinya.

Dan ini adalah tabel yang membutuhkan waktu paling lama untuk dibuat. Setiap angka milik saya, dari deteksi adegan ffmpeg pada file yang dikirim dibandingkan dengan jumlah shot yang ditulis dalam prompt berpasangan:

Demo resmiPrompt menyatakanPotongan keras ditemukanShot terkirimPutusan
v013 platform hujan, anime6 shot56Tepat
v055 buku harian golden retriever6 shot, 30,0 detik56Tepat
v021 restoran ramen dan anak kucing4 shot34Tepat
v008 danau hutan, 3D4 shot23Kurang satu
v085 wanita bertopi jerami4 shot12Setengah
v041 lorong ke gang ajaib3 segmen, "tanpa potongan keras"01 pengambilan kontinuTepat seperti yang diminta
v045, v084, v1023 / 5 / multi-subjekTerlalu banyak untuk diuraiTidak dapat dihitungPemotongan cepat dan strobo tinta-cuci mengalahkan deteksi

Baca baris tengah lagi. Tiga prompt mencapai jumlahnya tepat. Dua tidak. Jumlah shot yang Anda ketik adalah permintaan, bukan kontrak.

Mengapa Konsistensi Multi-Shot Wan 3.0 Rusak: 4 Mode Kegagalan

Putusan pertama: jarang rusak pada wajah. Rusak pada objek dan kamera, dan paling parah saat Anda mengubah beberapa hal sekaligus.

Berikut klip yang paling banyak mengajari saya, karena ini adalah kinerja terburuk dalam pameran Alibaba sendiri.

GtZy2TUK4ak

Demo beta resmi Wan 3.0 Alibaba (klip buku panduan v085, 1240x742, 30,08 detik). Prompt menuliskan empat shot dengan cap waktu. ffmpeg menemukan satu potongan nyata, pada 9,3 detik. Shot 3 dan 4 runtuh menjadi satu pengambilan tunggal yang memudar menjadi hitam. Tidak dihasilkan oleh Atlas Cloud.

Mode kegagalan 1: properti meleset sebelum wajah. Dalam klip itu, lihat pengambilan pembuka saja, sebelum potongan terjadi. Pada 0,6 detik, topi boater memiliki pita hitam tipis dan liontin adalah batu biru segi. Pada 9,2 detik, pitanya adalah pita hitam lebar dan liontinnya adalah tetesan hitam mengkilap halus. Wajahnya stabil sepanjang waktu. Aksesorinya tidak.

Dua bingkai dari pengambilan sembilan detik kontinu yang sama, berdampingan, menunjukkan pita topi melebar dan liontin kalung berubah bentuk dan warna

Kedua bingkai berasal dari pengambilan tak terputus yang sama dari demo v085 resmi, 8,6 detik terpisah, tanpa potongan di antaranya. Pita topi dan liontin keduanya berubah. Ini adalah lapisan properti yang gagal sementara lapisan karakter bertahan.

Itulah mengapa uji penerimaan yang benar-benar berfungsi adalah daftar periksa properti, bukan pemeriksaan getaran. Untuk karakter ini ada tiga item: bentuk topi dan pita, kalung manik-manik dan liontin, garis leher gaun.

Mode kegagalan 2: adegan multi-subjek bertahan sendiri-sendiri dan kabur saat kontak. Setiap karakter tetap dikenali sendiri. Taruh mereka dalam bingkai bersama, berinteraksi, dan identitasnya bercampur. Pengujian independen menemukan hal yang sama: "Konsistensi karakter mulai rusak, dan pengomposisian terkadang terlihat lebih seperti efek layar hijau yang buruk daripada lingkungan yang dihasilkan secara alami," dengan sinkronisasi bibir disebut sebagai kelemahan terbesar (Curious Refuge, 2026).

Mode kegagalan 3: Anda mengubah empat variabel dalam satu baris. Lokasi baru ditambah sudut kamera baru ditambah pencahayaan baru ditambah status pakaian baru adalah cara yang andal untuk kehilangan identitas. Prompt buku panduan sendiri melawan ini dengan menyatakan ulang seluruh kostum di setiap segmen. Di 64 prompt berpasangan, 9 secara eksplisit mengatakan "tetap tidak berubah", 5 memposisikan kamera, dan 4 menuntut karakter tetap identik.

Mode kegagalan 4: 30 detik dalam satu pekerjaan bukanlah 30 detik dari satu shot. Ini adalah produk yang berbeda. Pekerjaan multi-shot 30 detik memotong di antara pembingkaian. Jika yang Anda inginkan adalah satu pengambilan kontinu tanpa putus, merantai kelanjutan akan menurun: kesalahan identitas bertambah di setiap serah terima, sehingga pengambilan tunggal yang bersih secara alami pendek.

Buku panduan memiliki tepat satu prompt yang mendapatkan kesinambungan dengan benar, dan ini layak menyalin struktur kalimatnya:

Tiga segmen prompt dirender sebagai satu pengambilan kontinu tanpa putus, dari lorong apartemen melalui pintu ke gang gotik yang diterangi lampu

Demo beta resmi Wan 3.0 Alibaba (klip buku panduan v041, 720x1280, 15,04 detik). Tiga segmen prompt, dan ffmpeg menemukan nol potongan keras, persis seperti yang diminta prompt. Tidak dihasilkan oleh Atlas Cloud.

Baris serah terimanya, diterjemahkan, adalah hal yang paling dapat digunakan kembali di seluruh buku panduan: lanjutkan dengan mulus dari bingkai terakhir segmen sebelumnya; karakter, pakaian, lokasi, dan posisi kamera tetap sepenuhnya identik; tidak ada potongan keras dan tidak ada transisi adegan mendadak. Hanya satu prompt dari 64 yang menggunakannya. Curi itu.

Alur Kerja Konsistensi Multi-Shot yang Dapat Anda Jalankan Hari Ini

Pertanyaannya adalah: di mana Anda benar-benar menjalankan ini?

Saat ini Wan 3.0 berada di Model Studio milik Alibaba sendiri. Tidak ada platform inferensi pihak ketiga yang menghostingnya. Di Atlas Cloud itu hanya muncul sebagai entri segera hadir dengan nol titik akhir langsung, yang merupakan keadaan jujur dan layak dikatakan secara blak-blakan daripada berpura-pura sebaliknya.

Jadi Anda memiliki dua opsi: tunggu, atau berhenti meminta satu prompt untuk melakukan enam hal.

Opsi kedua lebih baik, dan penghitungan potongan saya adalah argumen untuk itu. Satu pekerjaan multi-shot tunggal memberi Anda jumlah shot yang meleset setengahnya di pameran Alibaba sendiri. Membagi pekerjaan mengembalikan kendali itu ke tangan Anda:

  1. Kunci tampilan sekali, sebagai gambar diam.
  2. Kloning identitas itu ke dalam satu keyframe per shot, mengubah tepat satu variabel setiap kali.
  3. Animasi setiap shot secara terpisah dengan referensi terkunci.
  4. Gabungkan secara lokal.

Lebih lambat untuk diatur, jauh lebih dapat diprediksi. Dan setiap model dalam rantai dapat dipanggil hari ini.

LangkahModelPeran dalam rantaiHarga terdaftar
1bytedance/seedream-v5.0-pro/text-to-imageKunci tampilan karakter$0,045 / gambar
2google/nano-banana-2/editKloning identitas ke keyframe setiap shot$0,08 / gambar
3alibaba/wan-2.7/reference-to-videoAnimasi setiap shot dengan referensi terkunci$0,10 / detik
Altalibaba/wan-2.7/text-to-videoSatu prompt, banyak shot (paling tidak terkendali)$0,10 / detik
Perbaikialibaba/wan-2.7/video-editPerbaiki satu properti yang salah tanpa regenerasi$0,10 / detik

Perlu diketahui untuk pertanyaan "model terbaik untuk konsistensi multi-shot": reference-to-video sekarang menjadi kategori tersendiri. bytedance/seedance-2.0-fast/reference-to-video berjalan $0,072/dtk (20% diskon dari $0,09, per Agustus 2026), kwaivgi/kling-video-o3-pro/reference-to-video $0,095/dtk (15% diskon dari $0,112), minimax/h3/reference-to-video $0,10/dtk, dan google/veo3.1/reference-to-video $0,20/dtk. Semua harga diverifikasi terhadap katalog langsung pada 21 Agustus 2026.

Satu peringatan sebelum langkah-langkah: harga terdaftar adalah lantai, bukan kutipan. Resolusi dan durasi mengubah angka sebenarnya, jadi baca tombol Jalankan sebelum Anda berkomitmen.

Cara Membangun Konsistensi Multi-Shot Gaya Wan 3.0, Langkah demi Langkah

Kami membangun kembali lembar irama yang persis sama yang gagal dilakukan oleh model Alibaba sendiri: wanita bertopi jerami, empat shot, taman ke mobil. Skrip yang sama, kontrol per-shot, dan kali ini Anda mendapatkan empat shot karena Anda merender empat.

Mari kita mulai.

Langkah 1: kunci tampilan. Satu gambar menjadi jangkar identitas untuk semua yang hilir. Hasilkan di Seedream v5.0 Pro, 16:9, resolusi tertinggi yang ditawarkan halaman. Sebutkan tiga properti pemeriksaan secara eksplisit, karena itulah yang akan meleset.

plaintext
1Still film 35mm, taman mawar vintage yang terkena sinar matahari. Seorang wanita muda elegan mengenakan topi boater jerami alami dengan pita hitam, kalung manik-manik hitam dengan liontin tetesan air mata tunggal, dan gaun linen putih tanpa lengan. Dia berdiri di depan dinding mawar merah muda dan krem yang mekar, satu tangan dengan ringan menyentuh tepi topinya, tatapan lembut dan penuh pemikiran sedikit di luar kamera. Cahaya alami hangat yang lembut, suar matahari berbintik-bintik, kedalaman bidang dangkal, butiran film halus, medium close-up.

Playground Seedream v5.0 Pro di Atlas Cloud dengan prompt bertopi jerami dimasukkan dan keyframe karakter selesai dirender di panel keluaran

Langkah 1 selesai: jangkar identitas untuk seluruh urutan empat shot.

Langkah 2: kloning identitas ke shot 2 hingga 4. Satu keyframe per shot, satu kali jalan masing-masing, menggunakan Nano Banana 2 Edit dengan keluaran Langkah 1 sebagai referensi. Disiplin yang penting: nyatakan ulang seluruh pakaian setiap kali, lalu ubah tepat satu hal.

Shot 2, perubahan emosional:

plaintext
1Pertahankan wanita yang persis sama dari gambar referensi: wajah identik, topi boater jerami alami identik dengan pita hitam, kalung manik-manik hitam identik dengan liontin tetesan air mata, gaun linen putih tanpa lengan identik. Shot baru: close-up sinematik, dia perlahan mengangkat topi jerami dari kepalanya dan menurunkan dagunya, ekspresi sedikit melankolis. Latar belakang taman mawar yang sama. Pertahankan secara ketat pencahayaan, warna kulit, butiran film, dan grading warna yang sama dengan referensi.

Shot 3, potongan ke mobil:

plaintext
1Pertahankan wanita yang persis sama dari gambar referensi: wajah identik, kalung manik-manik hitam identik dengan liontin tetesan air mata, gaun linen putih tanpa lengan identik, topi boater jerami sekarang bertumpu di pangkuannya. Shot baru: kursi belakang mobil yang bergerak, profil samping, tangannya bertumpu di pintu, menatap ke luar jendela yang dihiasi butiran hujan, dedaunan hijau buram melesat di belakang. Cahaya mendung dengan isian interior hangat, kedalaman bidang dangkal, melankolis elegan. Pertahankan secara ketat wajah yang sama, grading warna yang sama, dan butiran film 35mm yang sama dengan referensi.

Shot 4, pandangan terakhir:

plaintext
1Pertahankan wanita yang persis sama dari gambar referensi: wajah identik, kalung manik-manik hitam identik dengan liontin tetesan air mata. Shot baru: close-up wajah ekstrem di samping jendela mobil, mata perlahan menutup, ekspresi tenang dan lega. Tetesan hujan meluncur di kaca di depannya, fokus beralih ke tetesan, latar belakang jatuh ke bokeh. Suasana sinematik gaya Wong Kar-wai, butiran film halus. Pertahankan secara ketat wajah yang sama, pencahayaan yang sama, dan grading warna yang sama dengan referensi.

Playground Nano Banana 2 Edit di Atlas Cloud dengan keyframe Langkah 1 dimuat sebagai referensi dan keyframe shot 2 dirender, identitas dan pakaian dipertahankan

Langkah 2 selesai: keyframe shot 2, wanita yang sama, topi sekarang di tangannya.

Langkah 3: animasi shot 1 dengan referensi terkunci. Sekarang setiap shot menjadi video secara independen di Wan 2.7 reference-to-video. Pengaturan: 720P, 5 detik, dan taruh keyframe Langkah 1 ke slot Gambar. Periksa kutipan tombol Jalankan sebelum Anda memicunya.

plaintext
1Shot 1 dari 4. Gambar referensi 1 mendefinisikan karakter: pertahankan wajah yang sama, topi boater jerami alami yang sama dengan pita hitam, kalung manik-manik hitam yang sama dengan liontin tetesan air mata, dan gaun linen putih tanpa lengan yang sama identik untuk seluruh klip. Tampilan film 35mm, taman mawar vintage yang terkena sinar matahari. Wanita itu dengan ringan menyentuh tepi topinya saat angin sepoi-sepoi mengangkat helaian rambutnya; kamera mendorong masuk sangat lambat. Cahaya alami hangat, suar matahari berbintik-bintik, kedalaman bidang dangkal, butiran film halus. Posisi kamera tetap stabil. Tidak ada potongan keras dan tidak ada perubahan adegan.

Playground Wan 2.7 reference-to-video di Atlas Cloud dengan keyframe di slot Gambar dan klip lima detik selesai diputar di panel keluaran

Langkah 3 selesai: klip terkunci referensi dirender di panel keluaran.

Dan inilah yang keluar:

Klip terkunci referensi lima detik dari wanita bertopi jerami di taman mawar, pita topi dan kalung stabil sepanjang waktu

Jalankan kami sendiri di Atlas Cloud, bukan demo Alibaba. Ditampilkan sebagai GIF diam; file yang dikirimkan membawa trek audio.

Langkah 4: rantai shot 2 hingga 4, lalu gabungkan. Ulangi Langkah 3 untuk setiap keyframe yang tersisa, dan tempelkan kalimat serah terima dari buku panduan di bagian atas setiap prompt lanjutan:

plaintext
1Lanjutkan dengan mulus dari bingkai terakhir segmen sebelumnya. Karakter, pakaian, lokasi, dan posisi kamera tetap sepenuhnya identik. Tidak ada potongan keras dan tidak ada transisi adegan mendadak.

Kemudian gabungkan secara lokal dengan ffmpeg dan jalankan pemeriksaan penerimaan tiga poin: bentuk topi dan pita, kalung manik-manik dan liontin, dan apakah kemajuan pembingkaian antar shot benar-benar masuk akal. Jika tepat satu properti salah dalam satu shot, jangan regenerasi shot tersebut. Kirim melalui wan-2.7/video-edit dan ubah hanya itu, pinjam ungkapan buku panduan: pertahankan tindakan, pakaian, dan sisa bingkai tidak berubah.

Variasi: Adegan Multi-Subjek dan Kunci Gaya

Tiga pola dari buku panduan yang layak dicuri.

Kartu karakter untuk bidikan multi-subjek. Ketika dua orang atau lebih berbagi bingkai, prompt resmi menetapkan kartu karakter berhuruf dan menyatakan ulang kostum lengkap masing-masing di setiap segmen. Bertele-tele, jelek, dan berfungsi lebih baik daripada kata ganti.

Deklarasi gaya global untuk karya bergaya. Tinta-cuci, animasi sel, dan gaya berat lainnya perlu gaya disematkan sekali untuk seluruh karya, lalu lembar irama dengan cap waktu di bawahnya.

Urutan seni bela diri tinta-cuci dengan pendekar pedang di hutan bambu, gaya dikunci di seluruh pertarungan lima irama dengan cap waktu

Demo beta resmi Wan 3.0 Alibaba (klip buku panduan v084, 20,05 detik, dipotong). Lima irama dengan cap waktu di bawah satu deklarasi gaya tinta-cuci global. Sapuan kuas strobo adalah mengapa deteksi potongan otomatis tidak dapat menghitung yang ini. Tidak dihasilkan oleh Atlas Cloud.

Perbaiki, jangan regenerasi. Operasi pengeditan video pada satu properti yang salah lebih murah daripada render baru dan tidak dapat merusak shot yang sudah benar.

Berapa Biaya Urutan Empat Shot

Angka konkret untuk urutan yang dibangun di atas, pada tarif terdaftar:

  • 1 jangkar identitas di Seedream v5.0 Pro: $0,045
  • 3 keyframe shot di Nano Banana 2 Edit: 3 x $0,08 = $0,24
  • 4 klip @ 5 dtk, 720P, di Wan 2.7 reference-to-video: 20 dtk x $0,10 = $2,00
  • Total: sekitar $2,29 untuk urutan 20 detik, empat shot, identitas terkunci

Perpanjang menjadi enam shot 30 detik dan jalur video menjadi $3,00, mendekati $3,44 semuanya.

Dua peringatan jujur. Pertama, harga terdaftar adalah lantai: tingkat resolusi dan durasi mengubah biaya sebenarnya, dan kutipan Jalankan playground sendiri adalah satu-satunya angka yang mengikat, itulah mengapa tangkapan layar di atas lebih penting daripada daftar ini. Kedua, pada Wan 3.0 sendiri, Alibaba memberi harga generasi video Model Studio per detik berdasarkan tingkat resolusi, tetapi saya tidak dapat mengonfirmasi tarif per detik Wan 3.0 yang tepat dari halaman pihak pertama, jadi saya tidak mengutip angka yang tidak dapat saya verifikasi.

Perlu dicatat apa yang Anda beli dengan pendekatan pekerjaan terpisah: bukan harga yang lebih rendah, tetapi jumlah shot yang cocok dengan skrip Anda. Berdasarkan bukti pameran Alibaba sendiri, itu bukanlah sesuatu yang dapat dijanjikan oleh satu pekerjaan 30 detik kepada Anda, dan itu adalah jawaban praktis untuk konsistensi multi-shot Wan 3.0 sampai API terbuka.

Pertanyaan yang Sering Diajukan

Berapa banyak shot yang dapat dipertahankan konsisten oleh Wan 3.0 dalam satu generasi?

Enam, berdasarkan bukti saat ini, dengan peringatan. Postingan peluncuran Alibaba tidak menerbitkan spesifikasi jumlah shot. Di 8 prompt multi-shot eksplisit di buku panduan resminya, yang tertinggi menyatakan 6, dan dua di antaranya menghasilkan tepat 6 shot yang diverifikasi potongan. Perlakukan 6 sebagai batas yang diamati, bukan jaminan.

Apakah Wan 3.0 benar-benar menghasilkan 4K asli?

Tidak. Postingan resmi hanya mencantumkan 480P, 720P, dan 1080P. Di semua 110 file demo resmi, tidak ada yang melebihi 1080p, hanya 4 file yang tepat 1920x1080, dan output lanskap umum adalah 1920x1072. Kecepatan bingkai terbagi 24fps untuk 63 file dan 30fps untuk 46.

Apakah API Wan 3.0 tersedia, dan di mana saya bisa menjalankannya?

Ini berjalan di Alibaba Cloud Model Studio. Belum ada platform inferensi pihak ketiga yang menghostingnya; Atlas Cloud mencantumkannya sebagai entri segera hadir tanpa titik akhir langsung. Jika Anda membutuhkan output multi-shot minggu ini, rantai Wan 2.7 reference-to-video di atas adalah pengganti yang berfungsi.

Mengapa karakter saya masih berubah antar shot meskipun menggunakan gambar referensi?

Biasanya karena satu prompt mengubah lokasi, sudut kamera, dan pencahayaan secara bersamaan. Ubah satu variabel per shot, dan nyatakan ulang seluruh pakaian di setiap prompt. Juga periksa hal yang benar: di demo Alibaba sendiri, wajah tetap stabil sementara pita topi dan liontin kalung keduanya berubah di dalam satu pengambilan tak terputus.

Apakah bobot Wan 3.0 bersifat open source?

Belum ada bobot yang dirilis. Versi Wan sebelumnya dapat diunduh dan dijalankan secara lokal, sedangkan Wan 3.0 hadir sebagai layanan platform yang dihosting. Siapa pun yang mengutip lisensi Apache-2.0 untuk Wan 3.0 mengulangi sesuatu tanpa sumber pihak pertama di belakangnya.

Apa cara tercepat untuk mendapatkan konsistensi multi-shot tanpa akses Wan 3.0?

Empat langkah: kunci satu gambar identitas, kloning ke satu keyframe per shot dengan mengubah satu variabel setiap kali, animasi setiap shot dengan reference-to-video, lalu gabungkan secara lokal dan periksa properti Anda. Sekitar $2,29 dan sekitar setengah jam untuk urutan empat shot.


Metodologi: semua 110 file demo dan 64 prompt berpasangan berasal dari buku panduan kreator resmi Wan 3.0 Alibaba, diarsipkan secara lokal pada 11 Agustus 2026. Metadata dibaca file demi file dengan ffmpeg; jumlah shot berasal dari deteksi perubahan adegan ffmpeg pada ambang 0,2, diperiksa silang dengan bingkai yang diekstrak; struktur prompt diurai secara terprogram. Harga Atlas Cloud diverifikasi terhadap katalog model langsung pada 21 Agustus 2026.

Sumber: Alibaba Cloud (Agustus 2026); Curious Refuge (2026).

Model Terbaru

Satu API untuk semua AI multimedia.

Jelajahi semua model