
Kling O1 هي عائلة نماذج فيديو من Kuaishou، طُوّرت باستخدام تقنية Multi-modal Visual Language. تربط مسارات عمل text-to-video وimage-to-video بين السياق اللغوي والبصري لإنشاء ديناميكيات مشاهد سلسة انطلاقًا من المطالبات أو الصور المصدر. يوفّر Atlas Cloud كلا النمطين عبر REST API جاهزة للاستخدام، من دون عمليات بدء باردة، وبأسعار شفافة بنظام الدفع حسب الاستخدام. ابدأ البناء اليوم.
Kling o1 من تطوير Kuaishou. توفّر Atlas Cloud (التي تُشغّلها Atlas Cloud AI LLC) إمكانية الوصول إليه ولا تملكه. جميع العلامات التجارية ملك لأصحابها المعنيين.
قارن بين مساري النص والصورة في Kling O1 لاختيار نقطة نهاية توليد الفيديو المناسبة لمشروعك.
| النمط | الوصف |
|---|---|
| Kling O1 T2V API (Text To Video) | حوّل المطالبات النصية إلى فيديوهات سينمائية باستخدام نقطة نهاية Kling O1 Text to Video. تدعم تقنية MVL فهمًا دقيقًا للمعنى، واتساق العناصر، ومحاكاة طبيعية للفيزياء. استخدمها لتطوير أفكار القصص، وسرديات المنتجات، والمشاهد الموجّهة عبر النص. |
| Kling O1 I2V API (Image To Video) | بدءًا من صورة ثابتة، تنشئ نقطة نهاية Kling O1 Image to Video فيديو سينمائيًا ديناميكيًا. وتحافظ على اتساق العناصر مع إضافة حركة طبيعية، ومحاكاة للفيزياء، وديناميكيات سلسة للمشهد. يناسب هذا المسار تحريك الصور، والسرد البصري، وتطوير المشاهد السينمائية. |
يجمع Kling O1 بين توليد الفيديو من النص وتوليد الفيديو من الصور، مع الحفاظ على اتساق العناصر، ومحاكاة طبيعية للفيزياء، وفهم دقيق للتوجيهات، والتحكم في الإطارين الأول والأخير، وخيارات زمنية مرنة لمدة 5 أو 10 ثوانٍ، وثلاث نسب أبعاد، وإمكانية الوصول الجاهزة للاستخدام إلى Atlas Cloud REST بتسعير شفاف قائم على الاستخدام.
يحوّل Kling O1 التوجيهات النصية أو صورة مصدر إلى فيديو سينمائي من خلال نقاط النهاية المخصصة لتوليد الفيديو من النص وتوليد الفيديو من الصور لدى Atlas Cloud. تفسّر بنية MVL نية المشهد عبر المدخلات اللغوية والبصرية. اختر الوضع الذي يناسب مادة البداية من دون تغيير عائلة النموذج الأساسية. تلائم هذه المرونة الفرق التي تنتقل من المفاهيم الأولية إلى لقطات الحملات أو القصص المتحركة.
يحافظ النموذج على قابلية تمييز العناصر أثناء تطور الحركة، حتى مع تحرك الكاميرا وتطور المشهد. ينقل توليد الفيديو من الصور الهوية البصرية لصورة المصدر إلى الحركة، بينما ينشئ توليد الفيديو من النص شخصيات متماسكة انطلاقًا من التوجيه. يقلل ثبات العناصر من التحولات المشتتة بين الإطارات. استخدم هذه الميزة في القصص التي تتمحور حول الشخصيات، ولقطات المنتجات، والتسلسلات التي يكون فيها الاستمرارية البصرية مهمة.
تمنح محاكاة الفيزياء الطبيعية الحركةَ وزنًا وزخمًا وتفاعلًا مقنعًا مع المشهد المحيط. يحرّك Kling O1 الأشخاص والعناصر والبيئة بديناميكيات تبدو مترابطة بدلًا من أن تكون ملصقة معًا. اجمع بين إشارات الحركة الصريحة وتوجيهات الكاميرا في التوجيه. وتناسب النتيجة اللقطات الرياضية، ولقطات الطعام، والطبيعة، والحركة، حيث تؤثر جودة الحركة في قوة المشهد.
ابدأ بصورة واحدة، أو أضف صورة أخيرة اختيارية لتحديد نقطة انتهاء الحركة. يدعم مخطط توليد الفيديو من الصور لدى Atlas Cloud مقاطع مدتها 5 أو 10 ثوانٍ، ما يمنح الإيقاعات القصيرة والانتقالات الأطول خيارات واضحة للتحكم في الوتيرة. يركّب النموذج الحركة بين الحالات البصرية وفقًا لتوجيهاتك. يناسب هذا التحكم عمليات الكشف عن المنتجات، والتحولات، والأقواس السردية الموجزة.
يتيح الفهم الدلالي الدقيق لـ Kling O1 تحويل التوجيهات المفصلة إلى عناصر وحركات وديناميكيات للمشهد وحركة كاميرا سينمائية. حدّد الإطار باستخدام 16:9 أو 9:16 أو 1:1، ثم صِف الحركة والأجواء بلغة طبيعية. تتحول التوجيهات المعقدة إلى طلب توليد منظم بدلًا من التحريك اليدوي. وهذا يجعل النموذج مفيدًا للمقاطع الاجتماعية، ولوحات القصة، والمفاهيم البصرية المصقولة.
أنشئ تطبيقاتك عبر Atlas Cloud REST API الموحدة لتوليد الفيديو من النص ومن الصور. لا تعرض Atlas Cloud أي عمليات بدء بارد، وتفرض السعر القياسي البالغ $0.112 لكل ثانية ناتجة، مع احتساب الاستخدام وفق مدة الفيديو المُولّد. أرسل التوجيهات، وإطارات المصدر، والمدة، ونسبة الأبعاد بوصفها معاملات منظمة. يوفّر هذا الإعداد للمطورين تكلفة يمكن التنبؤ بها وتكاملًا مباشرًا مع سير عمل إنتاج الفيديو.
شاهد كيف يفسّر كل من Kling O1 وSeedance 2.0 وKling V3.0 Turbo الموجّهين نفسيهما عبر الواقعية السينمائية، واستمرارية الحركة، والتفاعل الفيزيائي، والسرد ذي الطابع الأسلوبي.
أنشئ فيديو سينمائيًا واقعيًا للغاية مدته 10 ثوانٍ لكلب غولدن ريتريفر يحمل باقة زهور عبر سوق زهور مزدحم عند شروق الشمس. ابدأ بلقطة تتبّع من زاوية منخفضة بينما يركض الكلب بسرعة فوق حجارة رصف مبللة، متناثرًا بتلات الزهور ومتلوّيًا بين العربات المتحركة. انتقل بحركة دوران سريعة إلى بائع الزهور وهو يطارده من الخلف، ثم تحرّك في مدار حول الكلب بينما يقفز فوق سلة سقطت ويهبط بصورة طبيعية. اختتم بدفعة كاميرا سريعة إلى الأمام عندما يتوقف الكلب بجانب طفل، ويقدّم له الباقة، ثم يلحق به البائع الضاحك. إضاءة خلفية دافئة، وفراء واقعي، ومحاكاة واقعية لفيزياء القماش والبتلات، وحركة متواصلة وحيوية، ونسبة عرض إلى ارتفاع 16:9.
Generated with Kling Video O1 Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
أنشئ فيديو إيقاف حركة بأسلوب الطين مدته 8 ثوانٍ داخل مخبز مضاء بضوء القمر، حيث يُعدّ طاهٍ ثعلب صغير معجنات سحرية. افتح بلقطة رافعة علوية بينما يدور الثعلب بالعجين، ويقذف التوت، ويتفادى الأدوات المرتدة. انتقل إلى لقطة تتبّع على سطح العمل بينما تندفع المعجنات إلى داخل الفرن وتبدأ بالتوهج. تحرّك بسرعة في دائرة حول الثعلب بينما ينفتح الفرن بقوة ويخرج منه تنين معجنات مصغّر، ويحلق في حلقات وسط الدقيق المتطاير، ثم يهبط على قبعة الطاهي. خامات طين مصنوعة يدويًا، وحركة تعبيرية، وإضاءة مرحة باللونين الأزرق والكهرماني، واستمرارية سلسة للأحداث، ونسبة عرض إلى ارتفاع 16:9.
Generated with Kling Video O1 Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
من المفاهيم السينمائية المعتمدة على المطالبات إلى الصور المتحركة للمنتجات، يوفّر Kling O1 لصنّاع الأفلام والمسوقين وفرق التجارة وبناة التطبيقات مسارات عملية لتحويل النصوص أو الإطارات الثابتة إلى فيديو متسق يتعامل مع الفيزياء بواقعية.
حوّل المطالبات المفصلة إلى تسلسلات سينمائية بفضل الفهم الدلالي الدقيق والفيزياء الطبيعية. يستطيع صنّاع الأفلام وفرق التصور المسبق استكشاف الأجواء والحركة وأفكار الكاميرا قبل تخصيص الموارد للإنتاج الحي المكلف.
حرّك صورة ثابتة لمنتج مع الحفاظ على المنتج نفسه وإضافة ديناميكيات سلسة للمشهد. تستطيع فرق التجارة الإلكترونية تحويل صور الكتالوج إلى مواد متحركة مصقولة للإطلاقات وواجهات المتاجر والمواد الإبداعية للحملات.
ابدأ بمفهوم مكتوب، ثم أنشئ فيديوهات سينمائية تتبع حركتها قوانين الفيزياء الطبيعية. تحصل فرق التواصل الاجتماعي على توجهات بصرية جديدة للإعلانات والحملات الموسمية واختبار المواد الإبداعية المخصصة لكل قناة بسرعة.
حوّل المطالبات السردية إلى مشاهد متحركة ومتماسكة بفضل الفهم الدلالي الدقيق. يستطيع المخرجون والوكالات واستوديوهات الألعاب تصور حركة الشخصيات وحركة البيئة والأجواء السينمائية خلال المراحل الأولى من التطوير والتخطيط الإبداعي.
أضف حركة طبيعية إلى صورة شخصية ثابتة، مع حفاظ وضع الصور في Kling O1 على اتساق الشخص أو العنصر. يستطيع المبدعون إنتاج فيديوهات ملف شخصي معبّرة ومقدمات للشخصيات ومواد للسرد البصري انطلاقًا من الأعمال الفنية الموجودة.
عندما تصف المطالبة حركة معقدة، يطبّق Kling O1 محاكاة فيزيائية طبيعية وفهمًا دلاليًا دقيقًا. يستطيع مصممو الحركة وفرق المفاهيم معاينة المشاهد الديناميكية بحركة مقنعة قبل بدء الإنتاج.
قارن Kling O1 مع نماذج الفيديو الأخرى في Atlas Cloud حسب المزوّد، ووضع التوليد، ومعرّف النموذج، والسعر الأساسي المدرج في الكتالوج.
| النموذج | المزوّد | وضع التوليد | معرّف نموذج Atlas | السعر الأساسي المدرج |
|---|---|---|---|---|
| Kling Video O1 تحويل النص إلى فيديو | Kuaishou | تحويل النص إلى فيديو | kwaivgi/kling-video-o1/text-to-video | $0.112، الوحدة غير مدرجة |
| Kling Video O1 تحويل الصورة إلى فيديو | Kuaishou | تحويل الصورة إلى فيديو | kwaivgi/kling-video-o1/image-to-video | $0.112، الوحدة غير مدرجة |
| Seedance 2.0 تحويل النص إلى فيديو | ByteDance | تحويل النص إلى فيديو | bytedance/seedance-2.0/text-to-video | $0.112، الوحدة غير مدرجة |
| Wan-2.7 تحويل الصورة إلى فيديو | Qwen | تحويل الصورة إلى فيديو | alibaba/wan-2.7/image-to-video | $0.10، الوحدة غير مدرجة |
| Veo 3.1 Lite تحويل النص إلى فيديو | تحويل النص إلى فيديو | google/veo3.1-lite/text-to-video | $0.05، الوحدة غير مدرجة | |
| MiniMax H3 تحويل الصورة إلى فيديو | MiniMax | تحويل الصورة إلى فيديو | minimax/h3/image-to-video | $0.038 لكل ثانية |
Get started in minutes — follow these simple steps to integrate and deploy models through Atlas Cloud’s platform.
سجّل في atlascloud.ai وأكمل التحقق. يحصل المستخدمون الجدد على رصيد مجاني لاستكشاف المنصة واختبار النماذج.
دمج نماذج Kling o1 المتقدمة مع منصة Atlas Cloud المسرّعة بـ GPU يوفر أداءً لا مثيل له وقابلية للتوسع وتجربة مطور استثنائية.
زمن انتقال منخفض:
استدلال محسّن لـ GPU للاستجابة في الوقت الفعلي.
API موحد:
قم بتشغيل Kling o1 و GPT و Gemini و DeepSeek من خلال تكامل واحد.
تسعير شفاف:
فواتير يمكن التنبؤ بها لكل رمز مع خيارات بدون خادم.
تجربة المطور:
SDKs والتحليلات وأدوات الضبط الدقيق والقوالب.
الموثوقية:
وقت تشغيل 99.99%، RBAC، وتسجيل جاهز للامتثال.
الأمان والامتثال:
SOC 2 Type II، توافق HIPAA، سيادة البيانات في الولايات المتحدة.
Kling O1 هو نموذج Kuaishou الموحد للفيديو متعدد الوسائط، والمبني باستخدام تقنية Multi-modal Visual Language. على Atlas Cloud، تضم العائلة الموثّقة نقاط نهاية text-to-video وimage-to-video. ويركّز على فهم المطالبات الدلالية، واتساق العناصر، ومحاكاة الفيزياء الطبيعية.
استخدم text-to-video لتحويل توجيهات المشهد المكتوبة إلى مقاطع سينمائية، أو حرّك صورة مصدر باستخدام وضع image-to-video. تدعم نقطتا النهاية سير عمل يستفيد من اتساق العناصر، والتحكم في الحركة، وديناميكيات المشهد الواقعية.
اختر text-to-video عندما يبدأ مشروعك بوصف مكتوب للمشهد. وحدد image-to-video عندما ينبغي لصورة موجودة أن تحدد العنصر أو التكوين أو الإطار الأول قبل إضافة الحركة.
أرسل طلب POST موثّقًا إلى https://api.atlascloud.ai/api/v1/model/generateVideo، مع تضمين معرّف النموذج والمدخلات التي اخترتها. استخدم kwaivgi/kling-video-o1/text-to-video أو kwaivgi/kling-video-o1/image-to-video، ثم استرجع النتيجة باستخدام prediction ID المُعاد.
بالنسبة إلى text-to-video، قدّم prompt واستخدم عناصر التحكم الموثّقة لنسبة العرض إلى الارتفاع والمدة. يتطلب image-to-video إدخالَي prompt وimage، بينما last_image اختياري. ونِسَب العرض إلى الارتفاع الموثّقة له هي 16:9 و9:16 و1:1، مع مدد تبلغ 5 أو 10 ثوانٍ.
تعرض Atlas Cloud سعرًا قياسيًا قدره $0.112 لكل ثانية لكلتا نقطتي نهاية الفيديو الموثّقتين. تتناسب الفوترة مع مدة الإخراج المطلوبة، لذا تكلّف عملية توليد مدتها 10 ثوانٍ ضعف تكلفة عملية مدتها 5 ثوانٍ وفق السعر القياسي.
يبدأ التوليد بطلب POST يُعيد prediction ID وحالة المعالجة. أرسل طلبات استعلام إلى https://api.atlascloud.ai/api/v1/model/prediction/{prediction_id} حتى تكتمل المهمة أو تفشل. ويضع الرد الناجح عنوان URL للفيديو المُولّد داخل مصفوفة outputs.
يُعد اتساق العنصر قدرة موثّقة في كلا الوضعين المتاحين، ويستخدم image-to-video الإطار المصدر لتثبيت الهوية البصرية والتكوين. ومع ذلك، قد تختلف النتائج باختلاف جودة المدخلات وتعقيد prompt، لذا يُنصح باستخدام صور مصدر واضحة وتعليمات حركة صريحة.
ليست ضمن نقطتي نهاية Atlas Cloud الموثّقتين لهذه الصفحة الخاصة بالعائلة. يغطي الاختيار الحالي text-to-video وimage-to-video، لذلك لا ينبغي إرسال معلمات Elements أو الفيديو المرجعي أو التحرير ما لم تنشر Atlas Cloud نقطة نهاية ومخططًا متوافقين.
أدلة وشروحات وتحديثات المنتج لمساعدتك على تحقيق أقصى استفادة من Atlas Cloud.