


Gemini Omni 1.1 Flash adalah keluarga model video multimodal native dari Google DeepMind untuk alur kerja produksi yang fleksibel. Edit rekaman yang ada melalui instruksi teks, pertahankan konsistensi visual dengan hingga 10 gambar referensi dan 3 klip video, atau perpanjang sebuah shot dalam segmen yang dapat dirangkai hingga 40 detik. Akses semua alur kerja di Atlas Cloud dengan satu kunci API yang kompatibel dengan OpenAI, harga bayar sesuai pemakaian, dan ketersediaan sejak Day-0. Mulai membangun hari ini.
Gemini Omni 1.1 Flash dikembangkan oleh Google. Atlas Cloud (dioperasikan oleh Atlas Cloud AI LLC) menyediakan akses ke model ini dan tidak memilikinya. Semua merek dagang adalah milik pemiliknya masing-masing.
Atlas Cloud menyediakan model kreatif terdepan dan terbaru di industri untuk Anda.
Bandingkan lima endpoint Gemini Omni 1.1 Flash berdasarkan alur input, kemampuan output, dan kasus penggunaan produksi.
| Modalitas | Deskripsi |
|---|---|
| Gemini Omni 1.1 Flash Video Extend API | Lanjutkan klip yang sudah ada dengan ekstensi yang menyatu secara mulus selama 3 hingga 10 detik dan tetap mempertahankan audio bawaan. Rangkai beberapa ekstensi untuk membuat satu bidikan video yang koheren dengan durasi total hingga 40 detik. |
| Gemini Omni 1.1 Flash Video Edit API | Perlu merevisi rekaman yang sudah ada tanpa membangun ulang seluruh adegan? Gunakan instruksi teks untuk menambahkan, menghapus, mengganti, atau mengubah gaya elemen video dengan audio bawaan, sambil mempertahankan konten yang tidak disebutkan dalam prompt. |
| Gemini Omni 1.1 Flash Reference-to-Video API | Berikan prompt teks dengan hingga 10 gambar referensi dan 3 klip video referensi untuk menghasilkan video sinematik dengan suara bawaan. Endpoint ini cocok untuk proyek yang memerlukan karakter, produk, atau arahan artistik yang konsisten di seluruh proses generasi. |
| Gemini Omni 1.1 Flash Image-to-Video API | Animasikan gambar diam menjadi klip sinematik dengan suara berdasarkan panduan prompt teks. Frame akhir opsional memberikan kontrol presisi atas titik awal dan akhir bidikan yang dihasilkan. |
| Gemini Omni 1.1 Flash Text-to-Video API | Berawal dari satu prompt teks, endpoint ini menghasilkan video sinematik dengan audio bawaan yang tersinkronisasi. Sesuaikan durasi, rasio aspek, dan resolusi output, mulai dari draf 360p yang cepat hingga hasil 4K. |
Gemini Omni 1.1 Flash menggabungkan pembuatan video, audio native, kontinuitas berbasis referensi, kontrol frame yang presisi, pengeditan berbasis instruksi, dan ekstensi berantai dalam satu alur kerja Atlas Cloud yang fleksibel.
Mulai dengan prompt teks dan buat klip sinematik dengan audio native yang tersinkronisasi. Gemini Omni 1.1 Flash memungkinkan Anda mengontrol durasi, rasio aspek, dan resolusi output mulai dari draf 360p hingga 4K. Jelaskan gerakan, arah kamera, dialog, musik, dan suasana dalam satu permintaan. Alur kerja ini cocok untuk trailer, konten media sosial, dan rangkaian adegan yang memerlukan pengembangan visual dan suara secara bersamaan.
Lanjutkan klip yang sudah ada dengan segmen berdurasi 3 hingga 10 detik yang menyatu tanpa terasa, lalu rangkai ekstensi hingga mencapai 40 detik. Model mempertahankan konteks visual dan audio native sehingga aksi baru tetap terasa sebagai bagian dari shot yang sama. Buat pengungkapan, adegan kejar-kejaran, atau cerita produk yang lebih panjang tanpa mengulang urutan dari awal saat narasi memerlukan ruang tambahan.
Berikan prompt teks dengan hingga 10 gambar referensi dan 3 klip video referensi untuk memandu satu generasi yang koheren dengan audio native. Gambar dapat menjadi acuan karakter, produk, lokasi, atau arahan artistik, sementara referensi video mengarahkan gerakan dan perilaku shot. Gunakan alur ini ketika identitas dan bahasa visual yang konsisten diperlukan di berbagai aset kampanye, adegan episodik, atau konten bermerek.
Tentukan gambar pembuka, lalu secara opsional berikan frame terakhir untuk mengontrol titik akhir shot. Gemini Omni 1.1 Flash menganimasikan gambar diam menjadi klip sinematik dengan suara native dan melakukan interpolasi menuju endpoint yang diberikan. Struktur awal dan akhir ini cocok untuk pengungkapan produk, transisi mulus, match cut, dan pergerakan kamera terencana yang harus berakhir pada komposisi yang presisi.
Ubah video yang sudah ada melalui instruksi teks langsung dengan mempertahankan semua hal yang tidak disebutkan dalam prompt. Tambahkan, hapus, ganti, atau ubah gaya elemen, serta pertahankan audio native dalam hasil edit. Saat sebuah take yang kuat hanya memerlukan objek, lingkungan, atau perlakuan visual baru, alur kerja terarah ini mempertahankan bagian lain dari pekerjaan dan menghindari pembangunan ulang adegan dari awal.
Gunakan text to video, image to video, generasi berbasis referensi, pengeditan, dan ekstensi melalui Atlas Cloud dengan satu kunci API. Penagihan transparan berbasis pemakaian memisahkan eksperimen dari langganan atau komitmen minimum. Developer dapat membuat draf dalam 360p dan meminta output hingga 4K saat detail akhir diperlukan. Jalur terpadu ini memudahkan penambahan seluruh keluarga model ke alur kerja produksi.
Lihat bagaimana Gemini Omni 1.1 Flash, Seedance 2.5, dan Gemini Omni Flash sebelumnya menafsirkan dua prompt sinematik yang sama.
Sebuah mikro-film fantasi berdurasi 8–10 detik yang berlatar di dalam bengkel peniupan kaca artisanal yang menghitam: awali dengan push-in makro ekstrem menuju gumpalan kaca cair merah menyala yang berputar cepat di ujung pipa tiup, permukaannya yang kental terus melipat, berpijar, dan membiaskan api tungku saat seorang perajin tanah liat terus menggulirkan pipa; orbitkan kamera secara rapat mengelilingi lengan bawah perajin yang bergerak ketika penjepit logam menghantam mengikuti ketukan dan menjepit kaca cair—tanpa potongan, massa pijar tersebut meregang, mendingin, lalu berubah secara mulus menjadi burung kolibri kaca transparan dengan jantung yang menyala. Lakukan whip-pan menuju tracking shot berkecepatan tinggi saat burung kolibri mengepakkan sayap kristalnya, melesat di atas stoples pigmen terbuka, dan menarik jejak turbulen bubuk biru merak serta magenta ke udara; setiap kepakan sayap menyebarkan partikel yang bertumbukan, berputar, dan berkilauan melalui siluetnya yang dibiaskan. Burung itu berbelok tajam menuju gelembung kaca yang melayang dan mematuknya tepat pada hentakan musik terakhir; potong ke tampilan dramatis dari atas saat gelembung pecah ke arah luar, serpihan setipis silet terus bermorfing menjadi kelopak bunga translusen lembut yang berpilin melintasi bengkel. Stop-motion tanah liat yang halus berpadu dengan tekstur kaca seni semi-transparan bercahaya, ketidaksempurnaan buatan tangan yang terasa nyata, pantulan, pembiasan, kaustik, kilauan panas, deformasi kaca, dan fisika partikel yang meyakinkan; cahaya tungku oranye-merah sebagai key light dominan, rim light cahaya bulan sian yang sejuk, palet hitam pekat dan emas pada pembukaan yang meledak menjadi biru merak dan magenta jenuh pada klimaks. Gerakan kamera cepat dan mengalir, konsistensi temporal serta karakter yang kuat, tanpa jeda atau pengisi gerak lambat. Audio: raungan tungku, dengung kaca yang berputar, ketukan logam ritmis yang tersinkron dengan setiap jepitan dan kepakan sayap, deru bubuk yang melaju, denting kristal tajam saat benturan, serta penutup cerah yang mengalir dari kaca menjadi kelopak; tanpa layar, antarmuka, dasbor, bilah progres, grafik, keterangan, logo, atau teks. Rasio aspek 16:9.
Generated with Gemini Omni 1.1 Flash Text-to-Video on Atlas Cloud
Generated with Seedance 2.5 Text-to-Video on Atlas Cloud
Generated with Gemini Omni Flash Text-to-Video on Atlas Cloud
Sebuah sekuens dokumenter alam makro ultra-fotorealistis berdurasi 8–10 detik di dalam gua kolam pasang berbatu saat air surut: seekor gurita kelapa berwarna oranye koral cerah memainkan perkusi secara improvisasional, kedelapan lengannya yang konsisten secara anatomis bergerak secara independen namun tetap alami ketika alat pengisapnya menghantam cangkang kerang mutiara, cangkang bulu babi berongga, dan kaca laut halus dalam ritme yang semakin padat, dengan deformasi, kontak, pantulan, dan bobot objek yang presisi. Awali dengan waterline macro lateral tracking shot yang meluncur di samping gurita saat tetesan air berkilau di kulitnya yang bertekstur dan setiap benturan mengirimkan riak-riak kecil melalui air laut sian yang dingin; potong ke kamera sudut rendah ekstrem yang bergerak cepat di antara lengan dan instrumen yang bergerak, dengan kesinambungan anggota tubuh serta oklusi realistis tetap jelas. Seekor umang-umang tiba-tiba berlari masuk, meraih cangkang utama, lalu melarikan diri; lakukan whip-pan menuju kejar-kejaran cepat dan jenaka saat gurita melompat dan mengalir di atas batu licin yang tidak rata, lengannya mencengkeram, melepaskan, dan mendorong dengan gesekan yang meyakinkan sementara kaki-kaki kepiting berderak melintasi kerikil. Tepat sebelum gelombang pasang yang datang membanjiri gua, gurita merebut kembali cangkang itu, menancapkannya dengan kuat, lalu memberikan satu hentakan akhir yang tegas; segera crane kamera ke atas menuju top-down overhead shot saat gelombang meledak mengelilingi gurita dan busa yang memancar membentuk komposisi hampir sempurna berbentuk lingkaran. Kaustik bawah air yang menari dari sinar matahari yang terpecah, air teal sejuk yang kontras dengan subjek oranye koral, percikan kristalin, gelembung, pasir yang melayang, pantulan batu basah, depth of field makro dangkal, HDR sinematik, tekstur alami setajam silet, gerakan kontinu yang mengalir, transisi kamera berkecepatan tinggi tanpa gerak lambat. Hanya audio diegetik, tersinkron sempurna: ketukan cangkang yang berbeda, bunyi hantaman cangkang bulu babi yang berongga, klik kaca yang cerah, pelepasan alat pengisap, gesekan capit dan kaki umang-umang, suara ombak yang meninggi, lalu pukulan terakhir dan deburan gelombang dalam keselarasan ritmis yang tepat; tanpa musik, narasi, teks, keterangan, logo, antarmuka, dasbor, grafik, bilah progres, layar terbagi, lengan tambahan, lengan yang menyatu atau terduplikasi, anatomi yang berubah bentuk, objek melayang, penetrasi atau fisika kontak yang rusak, gerakan kenyal, flicker temporal, jump cut, posisi cangkang yang tidak konsisten, atau gaya kartun. Dokumenter makro satwa liar sinematik ultra-fotorealistis, rasio aspek 16:9.
Generated with Gemini Omni 1.1 Flash Text-to-Video on Atlas Cloud
Generated with Seedance 2.5 Text-to-Video on Atlas Cloud
Generated with Gemini Omni Flash Text-to-Video on Atlas Cloud
Gemini Omni 1.1 Flash mengubah brief, gambar diam, media referensi, dan klip yang ada menjadi video kampanye, cerita karakter yang konsisten, transisi terkontrol, adegan yang diperpanjang, serta aset media sosial siap produksi dengan audio native.
Klip yang ada mendapatkan kelanjutan berdurasi tiga hingga sepuluh detik yang menyatu mulus, dan ekstensi berantai dapat mencapai empat puluh detik. Pembuat film dan tim konten berseri dapat mengembangkan satu pengambilan gambar yang koheren tanpa membangun ulang setiap adegan.
Perlu produk, latar belakang, atau gaya visual baru? Terapkan pengeditan berbasis instruksi teks sambil mempertahankan elemen yang tidak disebutkan, sehingga tim pemasaran dapat membuat varian yang terarah tanpa membuat ulang klip sumber dari awal setiap kali.
Dengan hingga sepuluh gambar referensi dan tiga klip video, model dapat mempertahankan karakter, produk, atau arahan artistik di berbagai generasi. Studio merek mendapatkan adegan peluncuran yang saling terkait dengan identitas visual yang lebih konsisten.
Mulai dari satu gambar diam dan, jika diinginkan, berikan frame terakhir, sehingga model dapat menganimasikan jalur sinematik di antara kedua komposisi. Desainer mendapatkan kontrol presisi atas pembukaan dan penutupan untuk pengungkapan, perulangan, dan pergantian adegan.
Satu brief teks menjadi klip sinematik dengan audio native yang tersinkronisasi, sementara durasi, rasio aspek, dan resolusi output tetap dapat dipilih. Kreator dapat menyesuaikan iklan dan cerita media sosial untuk berbagai format publikasi.
Saat menguji sebuah pengambilan gambar, buat prototipe pada 360p, bandingkan arah yang menjanjikan, lalu naikkan konsep terpilih hingga output 4K. Sutradara dan developer kreatif dapat memvalidasi gerakan, pembingkaian, suara, dan tempo sebelum produksi akhir.
Bandingkan Gemini Omni 1.1 Flash dengan model text-to-video terkemuka berdasarkan durasi klip, resolusi maksimum, dukungan audio native, dan laju frame output.
| Model | Durasi Output | Resolusi Maksimum | Audio Native | Laju Frame |
|---|---|---|---|---|
| Gemini Omni 1.1 Flash Text-to-Video | 3–10 detik | 4K | √ | 24 FPS |
| MiniMax H3 Text-to-Video | 4–15 detik | 2K | √ | 24 FPS |
| Wan-3.0 Text-to-video | 2–30 detik | 1080P | √ | 30 FPS |
Mulai dalam hitungan menit — ikuti langkah-langkah sederhana berikut untuk mengintegrasikan dan men-deploy model melalui platform Atlas Cloud.
Daftar di atlascloud.ai dan selesaikan verifikasi. Pengguna baru mendapatkan kredit gratis untuk menjelajahi platform dan menguji model.
Gabungkan model Gemini Omni 1.1 Flash canggih dengan platform akselerasi GPU Atlas Cloud untuk performa, skalabilitas, dan pengalaman pengembangan yang tak tertandingi.
Latensi Rendah:
Inferensi yang dioptimalkan GPU untuk respons real-time.
API Terpadu:
Satu integrasi untuk Gemini Omni 1.1 Flash, GPT, Gemini, dan DeepSeek.
Harga Transparan:
Billing per token, mendukung mode Serverless.
Pengalaman Developer:
SDK, analitik data, alat fine-tuning, dan template tersedia lengkap.
Keandalan:
Ketersediaan 99.99%, kontrol izin RBAC, logging kepatuhan.
Keamanan & Kepatuhan:
Sertifikasi SOC 2 Type II, kepatuhan HIPAA, kedaulatan data AS.
Gemini Omni 1.1 Flash adalah model pembuatan dan penyuntingan video multimodal native dari Google DeepMind. Di Atlas Cloud, model ini mendukung lima alur kerja khusus yang mencakup pembuatan, kreasi berbasis referensi, penyuntingan, dan perluasan. Output videonya dapat mencakup audio native yang tersinkronisasi.
Model ini dapat membuat video dari teks, menganimasikan gambar diam, mengikuti referensi visual, mengedit klip yang sudah ada berdasarkan instruksi teks, atau melanjutkan sebuah adegan. Image to Video juga dapat melakukan interpolasi menuju frame terakhir yang diberikan untuk transisi shot yang terkontrol.
Buat kunci API Atlas Cloud, lalu pilih endpoint yang sesuai dengan alur kerja Anda. Kirim prompt beserta gambar sumber, video, atau media referensi yang diperlukan sesuai skema parameter endpoint tersebut. Mulailah dengan satu shot yang dideskripsikan secara jelas, lalu sempurnakan input setelah meninjau hasilnya.
Pilih Text to Video untuk pembuatan berbasis prompt dan Image to Video saat menganimasikan frame diam. Reference to Video membantu memandu identitas atau arahan artistik, sedangkan Video Edit mengubah footage yang sudah ada dan Video Extend melanjutkan shot yang telah dibuat.
Text to Video menyediakan kontrol untuk durasi, rasio aspek, dan resolusi output mulai dari 360p hingga 4K. Image to Video menerima gambar awal dan dapat menggunakan frame terakhir opsional. Reference to Video mendukung hingga 10 gambar referensi dan 3 klip video referensi.
Ya, kelima alur kerja Atlas Cloud dirancang untuk menghasilkan video dengan audio native yang tersinkronisasi. Jelaskan dialog, ambience, musik, atau efek suara yang diinginkan dengan jelas dalam prompt jika audio penting bagi adegan tersebut.
Atlas Cloud menyediakan akses bayar sesuai penggunaan. Harga dasar standar adalah $0.041 untuk Text to Video, Reference to Video, Video Edit, dan Video Extend, sedangkan Image to Video memiliki harga dasar standar sebesar $0.043. Angka-angka ini merupakan harga backend standar, bukan tarif diskon sementara.
Setiap perluasan dapat menambahkan antara 3 hingga 10 detik, dan perluasan dapat dirangkai hingga satu shot yang koheren mencapai total 40 detik. Model ini menggunakan klip yang sudah ada sebagai konteks sambil melanjutkan visual dan audio native.
Gunakan Reference to Video dengan aset referensi yang jelas dan kompatibel, termasuk hingga 10 gambar dan 3 klip video. Untuk animasi gambar, berikan frame awal yang kuat serta frame terakhir opsional jika Anda memerlukan tujuan yang terkontrol. Output generatif tetap dapat mengalami pergeseran, jadi periksa identitas, pencahayaan, gerakan, dan audio setelah setiap pembuatan atau perluasan.
Google menjelaskan bahwa 1080p dan 4K merupakan opsi output yang ditingkatkan skalanya, bukan resolusi generasi native. Gunakan 360p untuk iterasi draf, lalu pilih resolusi yang lebih tinggi setelah komposisi dan gerakannya memenuhi kebutuhan Anda.
Panduan, tutorial, dan pembaruan produk untuk membantu Anda memaksimalkan Atlas Cloud.