
Kling O1 adalah keluarga model video milik Kuaishou yang dibangun dengan teknologi Multi-modal Visual Language. Alur kerja text-to-video dan image-to-video menghubungkan konteks bahasa dan visual untuk menciptakan dinamika adegan yang mulus dari prompt atau gambar sumber. Atlas Cloud menyediakan kedua mode tersebut melalui REST API siap pakai tanpa cold start dan dengan harga pay-as-you-go yang transparan. Mulai membangun hari ini.
Kling o1 dikembangkan oleh Kuaishou. Atlas Cloud (dioperasikan oleh Atlas Cloud AI LLC) menyediakan akses ke model ini dan tidak memilikinya. Semua merek dagang adalah milik pemiliknya masing-masing.
Bandingkan alur kerja teks dan gambar Kling O1 untuk memilih endpoint pembuatan video yang tepat bagi proyek Anda.
| Modalitas | Deskripsi |
|---|---|
| Kling O1 T2V API (Text To Video) | Ubah prompt teks menjadi video sinematik dengan endpoint Kling O1 Text to Video. Teknologi MVL-nya mendukung pemahaman semantik yang presisi, konsistensi subjek, dan simulasi fisika yang alami. Gunakan alur kerja ini untuk konsep cerita, narasi produk, dan adegan yang diarahkan melalui teks. |
| Kling O1 I2V API (Image To Video) | Berawal dari gambar statis, endpoint Kling O1 Image to Video menghasilkan video sinematik yang dinamis. Endpoint ini mempertahankan konsistensi subjek sekaligus menambahkan gerakan alami, simulasi fisika, dan dinamika adegan yang mulus. Alur kerja ini cocok untuk animasi gambar, penceritaan visual, dan pengembangan adegan sinematik. |
Kling O1 menggabungkan generasi text-to-video dan image-to-video dengan konsistensi subjek, fisika alami, pemahaman prompt yang presisi, kontrol frame pertama dan terakhir, durasi fleksibel 5 atau 10 detik, tiga rasio aspek, serta akses REST Atlas Cloud yang siap digunakan dengan harga transparan berbasis pemakaian.
Kling O1 mengubah prompt teks atau gambar sumber menjadi video sinematik melalui endpoint text-to-video dan image-to-video khusus dari Atlas Cloud. Arsitektur MVL-nya menafsirkan maksud adegan berdasarkan input bahasa dan visual. Pilih mode yang sesuai dengan aset awal tanpa mengubah keluarga model yang mendasarinya. Fleksibilitas ini cocok untuk tim yang beralih dari konsep awal ke materi kampanye animasi atau adegan cerita.
Model ini menjaga subjek tetap mudah dikenali saat aksi berlangsung, bahkan ketika kamera bergerak dan adegan berkembang. Generasi image-to-video membawa identitas visual gambar sumber ke dalam gerakan, sedangkan text-to-video membangun karakter yang koheren dari prompt. Subjek yang stabil mengurangi perubahan mengganggu antar-frame. Manfaatkan keunggulan ini untuk cerita yang berfokus pada karakter, pengambilan gambar produk, dan rangkaian adegan yang membutuhkan kontinuitas visual.
Simulasi fisika alami memberikan bobot, momentum, dan interaksi yang meyakinkan dengan lingkungan sekitar. Kling O1 menganimasikan manusia, objek, dan elemen lingkungan dengan dinamika yang terasa saling terhubung, bukan seperti ditempelkan. Padukan arahan aksi yang eksplisit dengan arah kamera di dalam prompt. Hasilnya cocok untuk cuplikan olahraga, makanan, alam, dan aksi yang mengandalkan kualitas gerakan.
Mulai dengan satu gambar, atau berikan gambar terakhir opsional untuk menentukan titik akhir gerakan. Skema image-to-video Atlas Cloud mendukung klip berdurasi 5 atau 10 detik, sehingga Anda dapat memilih tempo yang jelas untuk beat singkat maupun transisi yang lebih panjang. Model menyintesis gerakan di antara kondisi visual berdasarkan arahan prompt. Kontrol ini cocok untuk pengungkapan produk, transformasi, dan alur naratif ringkas.
Pemahaman semantik yang presisi memungkinkan Kling O1 menerjemahkan prompt terperinci menjadi subjek, aksi, dinamika adegan, dan gerakan kamera sinematik. Atur framing dengan output 16:9, 9:16, atau 1:1, lalu jelaskan gerakan dan suasana dalam bahasa alami. Arahan kompleks diubah menjadi request generasi terstruktur, bukan animasi manual. Hal ini membuat model berguna untuk klip media sosial, storyboard, dan konsep visual yang telah dipoles.
Bangun melalui unified REST API Atlas Cloud untuk generasi text-to-video dan image-to-video. Atlas Cloud tidak mencantumkan cold start dan mengenakan tarif standar $0.112 per detik output, dengan biaya berdasarkan durasi yang dihasilkan. Kirim prompt, frame sumber, durasi, dan rasio aspek sebagai parameter terstruktur. Pengaturan ini memberi developer biaya yang dapat diprediksi dan integrasi langsung untuk workflow video produksi.
Lihat bagaimana Kling O1, Seedance 2.0, dan Kling V3.0 Turbo menafsirkan dua prompt yang sama dalam realisme sinematik, kesinambungan gerakan, interaksi fisik, dan penceritaan bergaya.
Buat video sinematik fotorealistis berdurasi 10 detik tentang seekor golden retriever yang membawa buket bunga melewati pasar bunga yang ramai saat matahari terbit. Awali dengan tracking shot dari sudut rendah saat anjing itu berlari melintasi jalan berbatu yang basah, menebarkan kelopak bunga dan meliuk di antara gerobak yang bergerak. Lakukan whip pan ke penjual bunga yang mengejar dari belakang, lalu mengorbit anjing tersebut saat ia melompati keranjang yang jatuh dan mendarat secara alami. Akhiri dengan rapid push-in saat anjing itu berhenti di samping seorang anak, menyerahkan buket, dan penjual yang tertawa berhasil menyusul. Backlight hangat, fisika bulu, kain, dan kelopak bunga yang realistis, gerakan energik yang berkesinambungan, rasio aspek 16:9.
Generated with Kling Video O1 Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Buat video stop-motion tanah liat bergaya berdurasi 8 detik di dalam toko roti yang diterangi cahaya bulan, tempat seekor rubah kecil yang berprofesi sebagai koki menyiapkan kue ajaib. Awali dengan overhead crane shot saat rubah itu memutar adonan, melempar buah beri, dan menghindari peralatan dapur yang memantul. Beralih ke tracking view di atas meja dapur saat kue tersebut melaju masuk ke oven dan mulai bercahaya. Bergerak melingkar dengan cepat mengitari rubah saat oven terbuka lebar dan seekor naga kue mini terbang keluar, berputar melewati tepung yang beterbangan, lalu mendarat di topi koki. Tekstur tanah liat buatan tangan, gerakan ekspresif, pencahayaan biru dan amber yang ceria, kesinambungan aksi yang mulus, rasio aspek 16:9.
Generated with Kling Video O1 Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Dari konsep sinematik berbasis prompt hingga citra produk animasi, Kling O1 memberikan jalur praktis bagi pembuat film, pemasar, tim e-commerce, dan pengembang aplikasi untuk mengubah teks atau frame diam menjadi video yang konsisten dan mengikuti prinsip fisika.
Ubah prompt terperinci menjadi rangkaian sinematik dengan pemahaman semantik yang presisi dan fisika alami. Pembuat film dan tim pravisualisasi dapat mengeksplorasi suasana, aksi, dan ide kamera sebelum mengalokasikan sumber daya untuk produksi langsung yang mahal.
Animasikan gambar produk statis sambil mempertahankan subjeknya dan menambahkan dinamika adegan yang mulus. Tim e-commerce dapat mengubah visual katalog menjadi aset bergerak yang rapi untuk peluncuran, etalase toko, dan materi kreatif kampanye.
Mulai dengan konsep tertulis, lalu hasilkan video sinematik dengan gerakan yang mengikuti prinsip fisika alami. Tim media sosial mendapatkan arah visual baru untuk pengumuman, kampanye musiman, dan pengujian materi kreatif khusus kanal secara cepat.
Ubah prompt naratif menjadi adegan bergerak yang koheren melalui pemahaman semantik yang presisi. Sutradara, agensi, dan studio game dapat memvisualisasikan aksi karakter, gerakan lingkungan, dan atmosfer sinematik selama tahap awal pengembangan serta perencanaan kreatif.
Berikan gerakan alami pada potret diam, sementara mode gambar Kling O1 menjaga konsistensi subjek. Kreator dapat menghasilkan video profil yang ekspresif, pengenalan karakter, dan aset penceritaan visual dari karya yang sudah ada.
Saat prompt menjelaskan gerakan kompleks, Kling O1 menerapkan simulasi fisika alami dan pemahaman semantik yang presisi. Desainer aksi dan tim konsep dapat melihat pratinjau adegan dinamis dengan gerakan yang meyakinkan sebelum produksi dimulai.
Bandingkan Kling O1 dengan model video Atlas Cloud lainnya berdasarkan penyedia, mode generasi, ID model, dan harga katalog standar.
| Model | Penyedia | Mode Generasi | ID Model Atlas | Harga Dasar yang Tercantum |
|---|---|---|---|---|
| Kling Video O1 Text-to-video | Kuaishou | Teks ke Video | kwaivgi/kling-video-o1/text-to-video | $0.112, unit tidak tercantum |
| Kling Video O1 Image-to-video | Kuaishou | Gambar ke Video | kwaivgi/kling-video-o1/image-to-video | $0.112, unit tidak tercantum |
| Seedance 2.0 Text-to-Video | ByteDance | Teks ke Video | bytedance/seedance-2.0/text-to-video | $0.112, unit tidak tercantum |
| Wan-2.7 Image-to-video | Qwen | Gambar ke Video | alibaba/wan-2.7/image-to-video | $0.10, unit tidak tercantum |
| Veo 3.1 Lite Text-to-video | Teks ke Video | google/veo3.1-lite/text-to-video | $0.05, unit tidak tercantum | |
| MiniMax H3 Image-to-Video | MiniMax | Gambar ke Video | minimax/h3/image-to-video | $0.038 per detik |
Mulai dalam hitungan menit — ikuti langkah-langkah sederhana berikut untuk mengintegrasikan dan men-deploy model melalui platform Atlas Cloud.
Daftar di atlascloud.ai dan selesaikan verifikasi. Pengguna baru mendapatkan kredit gratis untuk menjelajahi platform dan menguji model.
Gabungkan model Kling o1 canggih dengan platform akselerasi GPU Atlas Cloud untuk performa, skalabilitas, dan pengalaman pengembangan yang tak tertandingi.
Latensi Rendah:
Inferensi yang dioptimalkan GPU untuk respons real-time.
API Terpadu:
Satu integrasi untuk Kling o1, GPT, Gemini, dan DeepSeek.
Harga Transparan:
Billing per token, mendukung mode Serverless.
Pengalaman Developer:
SDK, analitik data, alat fine-tuning, dan template tersedia lengkap.
Keandalan:
Ketersediaan 99.99%, kontrol izin RBAC, logging kepatuhan.
Keamanan & Kepatuhan:
Sertifikasi SOC 2 Type II, kepatuhan HIPAA, kedaulatan data AS.
Kling O1 adalah model video multimodal terpadu dari Kuaishou yang dibangun dengan teknologi Multi-modal Visual Language. Di Atlas Cloud, keluarga model yang telah diverifikasi mencakup endpoint text-to-video dan image-to-video. Model ini berfokus pada pemahaman prompt semantik, konsistensi subjek, dan simulasi fisika yang natural.
Gunakan text-to-video untuk mengubah arahan adegan tertulis menjadi klip sinematik, atau animasikan gambar sumber melalui mode image-to-video. Kedua endpoint mendukung alur kerja yang memerlukan subjek yang konsisten, gerakan yang terkontrol, dan dinamika adegan yang realistis.
Pilih text-to-video jika proyek Anda dimulai dari deskripsi adegan tertulis. Pilih image-to-video jika gambar yang sudah ada harus menetapkan subjek, komposisi, atau frame pertama sebelum gerakan ditambahkan.
Kirim permintaan POST terautentikasi ke https://api.atlascloud.ai/api/v1/model/generateVideo dengan ID model dan input yang telah Anda pilih. Gunakan kwaivgi/kling-video-o1/text-to-video atau kwaivgi/kling-video-o1/image-to-video, lalu ambil hasilnya menggunakan ID prediksi yang dikembalikan.
Untuk text-to-video, berikan prompt dan gunakan kontrol rasio aspek serta durasi yang terdokumentasi. Image-to-video memerlukan prompt dan image, sedangkan last_image bersifat opsional. Rasio aspek yang telah diverifikasi adalah 16:9, 9:16, dan 1:1, dengan durasi 5 atau 10 detik.
Atlas Cloud menetapkan harga standar sebesar $0.112 per detik untuk kedua endpoint video yang telah diverifikasi. Penagihan disesuaikan dengan durasi output yang diminta, sehingga generasi berdurasi 10 detik biayanya dua kali lipat dibandingkan generasi berdurasi 5 detik dengan tarif standar.
Generasi dimulai dengan permintaan POST yang mengembalikan ID prediksi dan status pemrosesan. Lakukan polling ke https://api.atlascloud.ai/api/v1/model/prediction/{prediction_id} hingga tugas selesai atau gagal. Respons yang berhasil menempatkan URL video yang dihasilkan di dalam array outputs.
Konsistensi subjek merupakan kemampuan yang terdokumentasi pada kedua mode yang tersedia, dan image-to-video menggunakan frame sumber sebagai acuan identitas visual serta komposisi. Hasil tetap dapat bervariasi tergantung kualitas input dan kompleksitas prompt, sehingga sebaiknya gunakan gambar sumber yang jelas dan instruksi gerakan yang eksplisit.
Tidak, setidaknya tidak dalam dua endpoint Atlas Cloud yang telah diverifikasi untuk halaman keluarga model ini. Pilihan saat ini mencakup text-to-video dan image-to-video, sehingga parameter Elements, reference video, dan penyuntingan tidak boleh dikirim kecuali Atlas Cloud menerbitkan endpoint dan skema yang kompatibel.
Panduan, tutorial, dan pembaruan produk untuk membantu Anda memaksimalkan Atlas Cloud.