
Grok Imagine Video 1.5 adalah keluarga pembuatan video dari xAI untuk developer yang membutuhkan gerakan terkontrol berdasarkan prompt dan input visual. Animasikan frame awal dengan instruksi gerakan dalam bahasa alami, pilih 480p atau 720p untuk alur kerja berbasis referensi, dan tambahkan suara referensi opsional untuk memandu hasilnya. Akses mode yang didukung melalui satu kunci Atlas Cloud yang kompatibel dengan OpenAI, dengan harga transparan berdasarkan pemakaian. Mulai membangun hari ini.
Grok Imagine Video 1.5 dikembangkan oleh xAI. Atlas Cloud (dioperasikan oleh Atlas Cloud AI LLC) menyediakan akses ke model ini dan tidak memilikinya. Semua merek dagang adalah milik pemiliknya masing-masing.
Jelajahi enam endpoint yang mengubah teks, frame awal, atau aset referensi menjadi video dalam alur kerja developer dan standar.
| Modalitas | Deskripsi |
|---|---|
| Grok Imagine Video 1.5 Developer Reference-to-Video API | Ubah 1 hingga 7 gambar referensi dan suara referensi opsional menjadi video dengan audio tersinkronisasi bawaan. Output dapat berdurasi hingga 15 detik pada 480p atau 720p. Endpoint ini cocok untuk adegan berbasis referensi dan konsep visual yang memerlukan beberapa gambar sumber. |
| Grok Imagine Video 1.5 Reference-to-Video API | Dengan panduan 1 hingga 7 gambar referensi, endpoint ini menghasilkan video dengan audio tersinkronisasi bawaan dan juga dapat menerima suara referensi opsional. Endpoint ini mendukung durasi hingga 15 detik pada 480p atau 720p. Pilih endpoint ini untuk produksi video dengan banyak referensi dan rangkaian yang dipandu suara. |
| Grok Imagine Video 1.5 Developer Text-to-Video API | Cukup gunakan prompt teks untuk menghasilkan video dengan audio tersinkronisasi bawaan melalui endpoint developer ini. Buat klip berdurasi hingga 15 detik dalam 480p, 720p, atau 1080p. Endpoint ini cocok untuk konsep berbasis prompt, storyboard, dan produksi video berdurasi singkat. |
| Grok Imagine Video 1.5 Text-to-Video API | Buat video langsung dari prompt teks sekaligus menghasilkan audio tersinkronisasi secara bawaan. Opsi output yang tersedia mencakup 480p, 720p, dan 1080p, dengan durasi maksimum 15 detik. Gunakan untuk adegan berskrip, konsep kampanye, atau aset video untuk media sosial. |
| Grok Imagine Video 1.5 Developer Image-to-Video API | Dengan memulai dari satu gambar, endpoint developer ini menerapkan instruksi gerakan dalam bahasa alami untuk menghasilkan video animasi. Opsi resolusi mencakup 480p, 720p, dan 1080p. Endpoint ini cocok untuk menganimasikan karya seni, visual produk, dan frame pembuka yang telah disiapkan. |
| Grok Imagine Video 1.5 Image-to-Video API | Animasikan gambar frame awal dengan mendeskripsikan gerakan yang diinginkan dalam bahasa alami. Video yang dihasilkan dapat dibuat dalam 480p, 720p, atau 1080p. Alur kerja ini mendukung studi gerakan, penceritaan visual, dan produksi kreatif berbasis gambar. |
Grok Imagine Video 1.5 menyatukan alur kerja teks, gambar awal, dan satu hingga tujuh gambar referensi dengan audio tersinkronisasi native, output hingga 1080p, serta klip berdurasi hingga 15 detik dalam mode teks atau referensi, sementara Atlas Cloud menyediakan satu API dan harga bayar sesuai pemakaian yang transparan.
Mulai dengan prompt teks dan hasilkan klip berdurasi hingga 15 detik pada resolusi 480p, 720p, atau 1080p. Audio tersinkronisasi native dihasilkan bersama video dalam generasi yang sama. Bentuk adegan dan aksi sepenuhnya melalui arahan tertulis saat tidak tersedia gambar sumber. Alur ini cocok untuk film konsep, eksperimen sinematik, dan pipeline konten berbasis prompt.
Satu frame awal diubah menjadi rangkaian bergerak melalui prompt gerakan dalam bahasa alami. Pilih output 480p, 720p, atau 1080p, sementara gambar menetapkan komposisi pembuka. Arahkan pergerakan subjek dan adegan melalui prompt, lalu biarkan model menganimasikan kelanjutannya dari jangkar visual tersebut. Cocok untuk pengambilan gambar produk, momen karakter, dan gambar diam dengan arahan artistik yang membutuhkan gerakan.
Arahkan Grok Imagine Video 1.5 dengan satu hingga tujuh gambar referensi dan suara referensi opsional. Mode referensi menghasilkan klip berdurasi hingga 15 detik pada resolusi 480p atau 720p, dengan audio tersinkronisasi native. Gunakan input tersebut untuk mengarahkan adegan yang dihasilkan agar mengikuti arahan visual yang telah ditetapkan. Alur ini cocok untuk kampanye dan cerita yang dibangun dari referensi kreatif yang sudah ada.
Video dan suara dihasilkan secara bersamaan, sehingga setiap klip dapat menyertakan audio tersinkronisasi native tanpa proses audio terpisah. Bangun adegan berdasarkan aksi visual yang waktunya dapat diperkuat oleh trek audio pendamping. Untuk momen yang membutuhkan sinkronisasi, alur generasi terpadu ini mengurangi perpindahan antara pembuatan visual dan produksi suara. Fitur ini sangat berguna untuk rekaman yang kaya akan performa dan atmosfer.
Bentangkan satu beat visual lengkap dalam klip teks atau referensi berdurasi hingga 15 detik, alih-alih berhenti pada loop singkat. Durasi yang tersedia mendukung pembukaan, pergerakan, dan penutup yang jelas dalam satu rangkaian hasil generasi. Padukan durasi tersebut dengan perubahan perspektif kamera dan aksi berkelanjutan untuk menciptakan momen yang lebih berkembang. Durasi ini cocok untuk iklan pendek, pengungkapan naratif, dan adegan video sosial.
Beralih antara generasi dari teks, gambar awal, dan gambar referensi melalui satu API Atlas Cloud, dengan harga bayar sesuai pemakaian yang transparan. Pilih alur kerja yang sesuai dengan setiap aset, alih-alih memaksakan semua ide melalui satu jenis input. Integrasi yang sama memberi developer akses ke keenam endpoint Grok Imagine Video v1.5 yang tercantum, termasuk rute standar dan Developer. Hal ini menyederhanakan eksperimen dan perencanaan produksi untuk berbagai pekerjaan video.
Lihat bagaimana Grok Imagine Video 1.5 dan dua alternatif Atlas Cloud menafsirkan prompt yang identik dalam adegan aksi sinematik dan fantasi bergaya.
Film fantasi Barok bawah air berdurasi 9-second dalam satu pengambilan gambar di dalam gedung opera yang terbengkalai dan sepenuhnya tergenang: seorang penyelam bebas anggun dengan rambut terurai dan topeng mutiara bercahaya mengejar gurita merah koral mencolok yang membawa kunci kuningan berhias, melewati tirai beludru yang hanyut. Awali dari dalam lantai panggung yang retak dengan pengambilan gambar dramatis dari sudut rendah ke atas saat ia berguling dan menyelam dengan kepala lebih dahulu menembus celah; beralih ke gerakan tracking lateral yang rapat saat ia menyusup di antara kursi-kursi teater yang tumbang, rambut dan kostumnya merespons arus secara alami sementara tirai mengembang dan gelembung-gelembung melintas di antara lengkungan berlapis; lalu mengorbit di sekelilingnya dan bergerak naik dengan crane saat tekanan air merobek lampu gantung kristal dari tempatnya di atas. Pada klimaks, ia memutar tubuh ke samping pada detik terakhir untuk menghindari lampu gantung yang jatuh, kristal-kristalnya bertabrakan dan berhamburan secara realistis, sementara gurita dengan cekatan menangkap kunci yang berputar jatuh menggunakan tentakel-tentakelnya yang melengkung kompleks, berhenti dengan khidmat seolah dalam sebuah seremoni, lalu meletakkannya kembali ke telapak tangannya yang terbuka. Gerakan cair yang berkesinambungan, awal–pengejaran–penyelesaian yang jelas, karakter dan topeng mutiara yang konsisten, hambatan air, daya apung, kain, rambut, gelembung, deformasi tentakel, benturan, dan penghindaran tabrakan yang akurat secara fisika. Berkas cahaya sian dingin dari jendela atap yang pecah menembus auditorium gelap yang terendam; merah koral menjadi satu-satunya warna yang sangat jenuh, mengarahkan mata melewati lapisan-lapisan lengkungan, tirai, puing-puing yang melayang, dan gelembung. Fotografi bawah air sinematik fotorealistis dengan tekstur sapuan cat minyak yang halus, kemegahan Barok yang elegan, kaustik volumetrik, detail tinggi, tanpa teks, tanpa antarmuka, tanpa potongan yang disamarkan sebagai bingkai diam. Audio imersif: gemuruh bawah air yang teredam, arus yang menderu, kibaran kain, gelembung, benturan kristal, dan denyut orkestra tegang yang berakhir menjadi satu nada harpa lembut saat kunci dikembalikan. Rasio aspek 16:9.
Generated with Grok Imagine Video v1.5 Text-to-Video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Generated with Grok Imagine Video v1.5 Developer Text-to-Video on Atlas Cloud
Iklan komedi aksi absurd berdurasi 9-second yang berlatar di dalam barbershop tahun 1950-an yang dirancang dengan detail saksama saat fajar. Seekor Old English Sheepdog yang pemarah dan berbulu lebat, berlumuran busa sabun putih tebal, menerobos pintu dan berlari melintasi toko sambil mengguncangkan busa ke segala arah; seorang tukang cukur yang terkejut melompat ke atas kursi berputar dan mengendarainya mengejar anjing tersebut, menggunting bulu anjing yang beterbangan dengan cepat, setiap bunyi gunting yang tajam tersinkronisasi secara presisi dengan ketukan drum jazz yang menghentak. Awali dengan pengambilan tracking ekstrem dari level permukaan lantai yang melaju di samping telapak kaki basah saat kaki-kaki itu tergelincir di atas ubin kotak-kotak hitam-putih yang mengilap, mengirimkan tetesan air dan cipratan busa realistis ke arah lensa; lakukan whip-pan ke atas menuju pengambilan tracking melingkar cepat yang menggunakan tiga cermin besar untuk terus-menerus menampilkan dan mempertahankan posisi anjing serta tukang cukur yang berubah-ubah melalui pantulan kompleks dan akurat; lalu lakukan dolly-in cepat saat potongan-potongan bulu terakhir yang melayang jatuh, berputar, dan mendarat sempurna di kepala anjing, membentuk pompadour yang menjulang tinggi secara konyol. Anjing itu berhenti dan berpose dengan angkuh dalam momen heroik seperti freeze selama satu detik, lalu tiba-tiba bersin dengan semburan busa dan bulu yang eksplosif saat jazz berakhir dengan rimshot komedi yang tajam. Lampu praktis tungsten hangat menembus kabut pagi teal yang sejuk di luar jendela; palet vintage yang kaya dengan burgundy, krem, kuningan mengilap, dan kayu gelap; sinematografi iklan live-action premium, koreografi berkecepatan tinggi yang mulus dan berkesinambungan, karakter serta kontinuitas ruang yang konsisten, bulu basah, busa sabun, rambut yang terlepas, pantulan, rotasi kursi, inersia, dan tabrakan yang akurat secara fisika, detail fotorealistis yang terasa nyata, kejernihan gerak yang tajam, tanpa gerak lambat, tanpa shot pembuka yang kosong, tanpa layar, tanpa antarmuka perangkat lunak, tanpa dasbor, tanpa bilah kemajuan, tanpa grafik, tanpa takarir, tanpa teks penjelasan, tanpa logo, tanpa watermark, rasio aspek 16:9.
Generated with Grok Imagine Video v1.5 Text-to-Video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Generated with Grok Imagine Video v1.5 Developer Text-to-Video on Atlas Cloud
Grok Imagine Video 1.5 mengubah prompt, frame sumber, dan hingga tujuh gambar referensi menjadi video pendek dengan audio tersinkronisasi untuk kampanye, showcase produk, cerita karakter, konten media sosial, dan pembuatan prototipe visual secara cepat.
Animasikan gambar diam produk dengan prompt gerakan dalam bahasa alami dan audio tersinkronisasi. Buat klip showcase pendek untuk etalase, halaman kampanye, aset peluncuran, atau penempatan di media sosial berbayar hingga 1080p.
Arahkan sebuah adegan dengan satu hingga tujuh referensi karakter dan suara referensi opsional. Pengaturan ini mendukung kemunculan pemeran berulang, momen dialog, dan klip naratif pendek dengan audio tersinkronisasi bawaan.
Mulai dari prompt teks untuk menghasilkan video lengkap dengan audio tersinkronisasi bawaan. Tim pemasaran dapat mengeksplorasi konsep kampanye, video bernuansa, dan teaser peluncuran tanpa menyiapkan gambar sumber.
Ubah satu frame awal menjadi gerakan menggunakan arahan dalam bahasa alami hingga 1080p. Hasilkan aset kampanye ringkas untuk feed, halaman peluncuran, pengumuman acara, pembaruan produk, dan postingan yang dipimpin kreator.
Hidupkan frame storyboard yang telah disetujui dengan gerakan yang diarahkan melalui prompt, sambil mempertahankannya sebagai gambar awal. Sutradara dan desainer dapat membuat shot previz pendek dengan audio tersinkronisasi untuk ditinjau.
Gabungkan tampilan produk, potret karakter, detail busana, dan referensi adegan dari hingga tujuh gambar. Tim merek dapat mengarahkan adegan promosi pendek dengan suara tersinkronisasi sambil mendasarkan setiap permintaan pada aset visual yang disediakan.
Bandingkan Grok Imagine Video 1.5 dengan model reference-to-video terkemuka berdasarkan input yang diterima, durasi klip, resolusi, audio tersinkronisasi, dan harga standar per detik.
| Model | Jenis Input | Durasi Klip | Resolusi Maksimum | Audio Bawaan | Harga Standar |
|---|---|---|---|---|---|
| Grok Imagine Video v1.5 | Teks, Gambar, Gambar Referensi, Suara | Hingga 15 detik | 1080p | √ | $0.08/detik |
| Seedance 2.0 Reference-to-Video | Teks, Gambar, Video, Audio | 4 hingga 15 detik | 4K | √ | $0.112/detik |
| MiniMax H3 Reference-to-Video | Teks, Gambar, Video, Audio | 4 hingga 15 detik | 2K | √ | $0.038/detik |
| Wan-2.7 Reference-to-video | Teks, Gambar, Video, Audio | 2 hingga 10 detik | 1080p | √ | $0.10/detik |
Mulai dalam hitungan menit — ikuti langkah-langkah sederhana berikut untuk mengintegrasikan dan men-deploy model melalui platform Atlas Cloud.
Daftar di atlascloud.ai dan selesaikan verifikasi. Pengguna baru mendapatkan kredit gratis untuk menjelajahi platform dan menguji model.
Gabungkan model Grok Imagine Video 1.5 canggih dengan platform akselerasi GPU Atlas Cloud untuk performa, skalabilitas, dan pengalaman pengembangan yang tak tertandingi.
Latensi Rendah:
Inferensi yang dioptimalkan GPU untuk respons real-time.
API Terpadu:
Satu integrasi untuk Grok Imagine Video 1.5, GPT, Gemini, dan DeepSeek.
Harga Transparan:
Billing per token, mendukung mode Serverless.
Pengalaman Developer:
SDK, analitik data, alat fine-tuning, dan template tersedia lengkap.
Keandalan:
Ketersediaan 99.99%, kontrol izin RBAC, logging kepatuhan.
Keamanan & Kepatuhan:
Sertifikasi SOC 2 Type II, kepatuhan HIPAA, kedaulatan data AS.
Grok Imagine Video 1.5 adalah keluarga model pembuatan video milik xAI untuk membuat klip dari teks, gambar awal, atau beberapa gambar referensi. Melalui Atlas Cloud, pengembang dapat mengakses endpoint terpisah untuk setiap mode pembuatan.
Tersedia tiga mode: text-to-video, image-to-video, dan reference-to-video. Pilih text untuk membuat adegan dari awal, image untuk menganimasikan frame awal, atau mode reference untuk mengarahkan subjek, objek, dan gaya menggunakan beberapa gambar.
Buat kunci API Atlas Cloud, lalu kirim permintaan terautentikasi ke endpoint pembuatan video dengan ID model yang sesuai. Gunakan task ID yang dikembalikan untuk memeriksa status pembuatan dan mengambil URL video yang telah selesai.
Text-to-video memerlukan prompt dalam bahasa alami, sedangkan image-to-video menambahkan satu gambar frame awal. Reference-to-video menerima prompt dan 1 hingga 7 gambar referensi, dengan ID suara preset opsional untuk dialog yang dihasilkan.
Skema Atlas Cloud yang tersedia mendukung klip berdurasi 1 hingga 15 detik. Text-to-video dan image-to-video menyediakan output 480p, 720p, atau 1080p, sedangkan reference-to-video mendukung 480p atau 720p.
Ya. Text-to-video menghasilkan audio native yang tersinkronisasi dari prompt, sedangkan reference-to-video dapat menggabungkan audio yang dihasilkan dengan suara preset opsional untuk dialog.
Atlas Cloud mencantumkan harga dasar standar sebesar $0.08 untuk setiap endpoint yang tercakup dalam halaman keluarga model ini. Tinjau detail penagihan terkini pada endpoint yang dipilih sebelum deployment karena catatan harga yang tersedia tidak menyebutkan unit penagihannya.
Berikan 1 hingga 7 gambar melalui endpoint reference-to-video. Identifikasi aset tertentu dalam prompt menggunakan tag seperti <IMAGE_0> dan <IMAGE_1> agar model dapat mengaitkan setiap referensi dengan subjek atau elemen adegan yang dimaksud.
Skema Atlas Cloud yang tersedia tidak menyertakan parameter khusus untuk frame terakhir. Image-to-video menggunakan satu gambar sebagai frame awal, sedangkan reference-to-video menggunakan 1 hingga 7 gambar sebagai panduan visual, bukan sebagai frame pertama dan terakhir yang dijamin.
Pilih reference-to-video ketika beberapa gambar perlu mengarahkan orang, objek, atau gaya visual dalam adegan baru. Gunakan image-to-video ketika satu gambar yang sudah ada harus menjadi frame pembuka dan gerakannya mengikuti prompt dalam bahasa alami.
Panduan, tutorial, dan pembaruan produk untuk membantu Anda memaksimalkan Atlas Cloud.