
Kling O1은 멀티모달 시각 언어 기술로 구축된 Kuaishou의 동영상 모델 제품군입니다. 텍스트-투-비디오 및 이미지-투-비디오 워크플로는 언어와 시각적 맥락을 연결하여 프롬프트 또는 소스 이미지로부터 자연스럽게 이어지는 장면의 움직임을 생성합니다. Atlas Cloud는 콜드 스타트 없이 바로 사용할 수 있는 REST API와 투명한 종량제 요금으로 두 가지 모드를 모두 제공합니다. 지금 바로 개발을 시작해 보세요.
Kling o1은(는) Kuaishou에서 개발한 모델입니다. Atlas Cloud(운영: Atlas Cloud AI LLC)는 해당 모델에 대한 액세스를 제공할 뿐이며 이를 소유하지 않습니다. 모든 상표는 각 소유자에게 귀속됩니다.
Kling O1 텍스트 및 이미지 워크플로를 비교하여 프로젝트에 적합한 동영상 생성 엔드포인트를 선택하세요.
| 모달리티 | 설명 |
|---|---|
| Kling O1 T2V API (Text To Video) | Kling O1 Text to Video 엔드포인트를 사용하면 텍스트 프롬프트를 시네마틱 동영상으로 변환할 수 있습니다. MVL 기술을 통해 정밀한 의미 이해, 일관된 피사체 표현, 자연스러운 물리 시뮬레이션을 지원합니다. 텍스트로 연출하는 스토리 콘셉트, 제품 내러티브, 장면 제작에 활용하세요. |
| Kling O1 I2V API (Image To Video) | 정적 이미지로 시작하면 Kling O1 Image to Video 엔드포인트가 역동적인 시네마틱 동영상을 생성합니다. 피사체의 일관성을 유지하면서 자연스러운 움직임, 물리 시뮬레이션, 매끄러운 장면 전환을 더합니다. 이미지 애니메이션, 시각적 스토리텔링, 시네마틱 장면 개발에 적합한 워크플로입니다. |
Kling O1은 피사체 일관성, 자연스러운 물리 효과, 정교한 프롬프트 이해, 첫 프레임과 마지막 프레임 제어, 유연한 5초 또는 10초 길이 설정, 3가지 화면 비율, 투명한 사용량 기반 요금으로 바로 사용할 수 있는 Atlas Cloud REST 액세스를 결합합니다.
Kling O1은 Atlas Cloud의 전용 text-to-video 및 image-to-video 엔드포인트를 통해 텍스트 프롬프트나 소스 이미지를 시네마틱 영상으로 변환합니다. MVL 아키텍처는 언어 입력과 시각적 입력을 종합해 장면의 의도를 해석합니다. 기반 모델 제품군을 변경하지 않고 시작 에셋에 맞는 모드를 선택할 수 있습니다. 이러한 유연성은 초기 콘셉트부터 애니메이션 캠페인 영상이나 스토리 장면까지 작업 범위를 확장하는 팀에 적합합니다.
카메라가 움직이고 장면이 전개되는 동안에도 모델은 피사체를 알아볼 수 있는 상태로 유지합니다. image-to-video 생성은 소스 이미지의 시각적 정체성을 움직임에 반영하고, text-to-video는 프롬프트를 바탕으로 일관된 캐릭터를 구성합니다. 피사체가 안정적으로 유지되므로 프레임 간 시선을 분산시키는 변화가 줄어듭니다. 캐릭터 중심 스토리, 제품 영상, 시각적 연속성이 중요한 시퀀스에 이 강점을 활용할 수 있습니다.
자연스러운 물리 시뮬레이션은 움직임에 무게감과 관성을 부여하고 주변 장면과의 상호작용을 설득력 있게 표현합니다. Kling O1은 사람, 사물, 환경 요소를 서로 따로 붙인 듯한 느낌이 아니라 장면에 유기적으로 연결된 역학으로 애니메이션화합니다. 프롬프트에 구체적인 동작 지시와 카메라 방향을 함께 작성하세요. 움직임의 품질이 영상의 완성도를 좌우하는 스포츠, 음식, 자연, 액션 영상에 적합합니다.
이미지 1장으로 시작하거나 선택 사항인 마지막 이미지를 추가해 움직임이 끝날 지점을 지정할 수 있습니다. Atlas Cloud의 image-to-video 스키마는 5초 또는 10초 클립을 지원하므로 짧은 장면과 긴 전환에 맞춰 명확하게 속도를 선택할 수 있습니다. 모델은 프롬프트의 안내에 따라 시각적 상태 사이의 움직임을 합성합니다. 이러한 제어 기능은 제품 공개, 변형 장면, 간결한 내러티브 흐름에 적합합니다.
정교한 의미 이해 기능을 통해 Kling O1은 상세한 프롬프트를 피사체, 동작, 장면의 역학, 시네마틱 카메라 움직임으로 변환합니다. 16:9, 9:16, 1:1 출력 중 하나로 구도를 설정한 다음 자연어로 움직임과 분위기를 설명하세요. 복잡한 연출이 수동 애니메이션이 아닌 구조화된 생성 요청으로 변환됩니다. 따라서 소셜 클립, 스토리보드, 완성도 높은 비주얼 콘셉트 제작에 유용합니다.
text-to-video 및 image-to-video 생성을 모두 지원하는 Atlas Cloud의 통합 REST API를 통해 개발할 수 있습니다. Atlas Cloud는 콜드 스타트를 제공하지 않으며, 생성된 영상 길이를 기준으로 출력 초당 표준 요금 $0.112를 부과합니다. 프롬프트, 소스 프레임, 영상 길이, 화면 비율을 구조화된 매개변수로 전송하세요. 이 구성은 개발자에게 예측 가능한 비용과 프로덕션 영상 워크플로를 위한 직접적인 통합 방식을 제공합니다.
Kling O1, Seedance 2.0, Kling V3.0 Turbo가 같은 두 프롬프트를 시네마틱 리얼리즘, 움직임의 연속성, 물리적 상호작용, 스타일리시한 스토리텔링 측면에서 어떻게 해석하는지 확인해 보세요.
10-second 포토리얼 시네마틱 동영상을 제작하세요. 해 질 무렵 붐비는 꽃 시장을 골든 리트리버가 꽃다발을 들고 지나갑니다. 젖은 돌길 위를 개가 질주하며 꽃잎을 흩날리고 움직이는 손수레 사이를 빠져나가는 모습을 로우 앵글 트래킹 샷으로 시작하세요. 뒤에서 쫓아오는 꽃집 주인에게 휩 팬한 다음, 개가 쓰러진 바구니를 뛰어넘어 자연스럽게 착지하는 모습을 중심으로 카메라가 개 주위를 회전하게 하세요. 개가 아이 옆에 멈춰 꽃다발을 건네고, 웃으며 따라온 꽃집 주인이 마침내 도착하는 순간 빠른 푸시인으로 마무리하세요. 따뜻한 역광, 사실적인 털과 천, 꽃잎의 물리 효과, 끊김 없이 역동적인 움직임, 16:9 화면 비율.
Generated with Kling Video O1 Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
8-second 스타일라이즈드 클레이 스톱모션 동영상을 제작하세요. 달빛이 비추는 빵집 안에서 작은 여우 셰프가 마법의 페이스트리를 만듭니다. 여우가 반죽을 빙글빙글 돌리고 베리를 던져 넣으며 튀어 오르는 조리 도구를 피하는 모습을 오버헤드 크레인 샷으로 시작하세요. 페이스트리가 오븐 안으로 빠르게 들어가 빛을 내기 시작하는 장면을 조리대 높이의 트래킹 뷰로 전환하세요. 오븐이 활짝 열리며 작은 페이스트리 드래곤이 날아 나와 흩날리는 밀가루 사이를 한 바퀴 돌고 셰프의 모자 위에 내려앉는 순간, 카메라가 여우 주위를 빠르게 회전하게 하세요. 손으로 빚은 듯한 클레이 질감, 풍부한 표정의 움직임, 장난스러운 파란색과 호박색 조명, 매끄럽게 이어지는 액션, 16:9 화면 비율.
Generated with Kling Video O1 Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
프롬프트 기반의 영화적 콘셉트부터 애니메이션 제품 이미지까지, Kling O1은 영화 제작자, 마케터, 커머스 팀, 앱 개발자가 텍스트나 스틸 프레임을 일관되고 물리 법칙을 반영한 영상으로 구현할 수 있는 실용적인 경로를 제공합니다.
상세한 프롬프트를 정밀한 의미 이해와 자연스러운 물리 표현을 갖춘 영화적 시퀀스로 변환합니다. 영화 제작자와 프리비주얼라이제이션 팀은 비용이 많이 드는 실사 제작에 리소스를 투입하기 전에 분위기, 액션, 카메라 아이디어를 탐색할 수 있습니다.
정적인 제품 이미지에 자연스러운 장면의 움직임을 더하면서 피사체는 그대로 유지합니다. 커머스 팀은 카탈로그 이미지를 출시, 온라인 스토어, 캠페인 크리에이티브에 활용할 세련된 모션 에셋으로 변환할 수 있습니다.
작성된 콘셉트에서 시작해 자연스러운 물리 법칙에 따라 움직이는 영화적 영상을 생성합니다. 소셜 팀은 공지, 시즌 캠페인, 빠른 채널별 크리에이티브 테스트를 위한 새로운 비주얼 방향을 확보할 수 있습니다.
정밀한 의미 이해를 통해 내러티브 프롬프트를 일관된 움직이는 장면으로 변환합니다. 감독, 에이전시, 게임 스튜디오는 초기 크리에이티브 개발과 기획 단계에서 캐릭터의 움직임, 환경의 동작, 영화적 분위기를 시각화할 수 있습니다.
Kling O1 이미지 모드가 피사체의 일관성을 유지하는 동안 정적인 인물 사진에 자연스러운 움직임을 더합니다. 크리에이터는 기존 아트워크를 활용해 표현력 있는 프로필 영상, 캐릭터 소개, 비주얼 스토리텔링 에셋을 제작할 수 있습니다.
프롬프트가 복잡한 움직임을 설명하면 Kling O1은 자연스러운 물리 시뮬레이션과 정밀한 의미 이해를 적용합니다. 액션 디자이너와 콘셉트 팀은 제작을 시작하기 전에 믿을 수 있는 움직임을 갖춘 역동적인 장면을 미리 확인할 수 있습니다.
제공업체, 생성 모드, 모델 ID 및 표준 카탈로그 가격 기준으로 Kling O1과 다른 Atlas Cloud 비디오 모델을 비교합니다.
| 모델 | 제공업체 | 생성 모드 | Atlas 모델 ID | 표시된 기본 가격 |
|---|---|---|---|---|
| Kling Video O1 Text-to-video | Kuaishou | 텍스트에서 비디오로 | kwaivgi/kling-video-o1/text-to-video | $0.112, 단위 미기재 |
| Kling Video O1 Image-to-video | Kuaishou | 이미지에서 비디오로 | kwaivgi/kling-video-o1/image-to-video | $0.112, 단위 미기재 |
| Seedance 2.0 Text-to-Video | ByteDance | 텍스트에서 비디오로 | bytedance/seedance-2.0/text-to-video | $0.112, 단위 미기재 |
| Wan-2.7 Image-to-video | Qwen | 이미지에서 비디오로 | alibaba/wan-2.7/image-to-video | $0.10, 단위 미기재 |
| Veo 3.1 Lite Text-to-video | 텍스트에서 비디오로 | google/veo3.1-lite/text-to-video | $0.05, 단위 미기재 | |
| MiniMax H3 Image-to-Video | MiniMax | 이미지에서 비디오로 | minimax/h3/image-to-video | 초당 $0.038 |
몇 분 만에 시작하세요 — 간단한 단계를 따라 Atlas Cloud 플랫폼을 통해 모델을 통합하고 배포하세요.
atlascloud.ai에서 가입하고 인증을 완료하세요. 신규 사용자는 플랫폼 탐색과 모델 테스트를 위한 무료 크레딧을 받습니다.
고급 Kling o1 모델과 Atlas Cloud의 GPU 가속 플랫폼을 결합하여 비교할 수 없는 성능, 확장성 및 개발자 경험을 제공합니다.
낮은 지연 시간:
실시간 추론을 위한 GPU 최적화 추론.
통합 API:
하나의 통합으로 Kling o1, GPT, Gemini 및 DeepSeek를 실행합니다.
투명한 가격:
Serverless 옵션을 포함한 예측 가능한 token당 청구.
개발자 경험:
SDK, 분석, 파인튜닝 도구 및 템플릿.
신뢰성:
99.99% 가동 시간, RBAC 및 규정 준수 로깅.
보안 및 규정 준수:
SOC 2 Type II, HIPAA 준수, 미국 내 데이터 주권.
Kling O1은 Multi-modal Visual Language 기술로 구축된 Kuaishou의 통합 멀티모달 비디오 모델입니다. Atlas Cloud에서 검증된 제품군에는 text-to-video 및 image-to-video endpoint가 포함되어 있습니다. 의미 기반 프롬프트 이해, 피사체 일관성, 자연스러운 물리 시뮬레이션에 중점을 둡니다.
text-to-video를 사용하면 텍스트로 작성한 장면 지시를 영화 같은 클립으로 변환할 수 있고, image-to-video 모드에서는 원본 이미지를 애니메이션으로 만들 수 있습니다. 두 endpoint 모두 일관된 피사체, 제어된 움직임, 사실적인 장면 역학이 필요한 워크플로를 지원합니다.
프로젝트가 텍스트로 작성한 장면 설명에서 시작한다면 text-to-video를 선택하세요. 기존 이미지로 피사체, 구도 또는 첫 프레임을 설정한 후 움직임을 추가하려면 image-to-video를 선택하세요.
선택한 model ID와 입력값을 포함해 https://api.atlascloud.ai/api/v1/model/generateVideo로 인증된 POST 요청을 보내세요. kwaivgi/kling-video-o1/text-to-video 또는 kwaivgi/kling-video-o1/image-to-video를 사용한 다음, 반환된 prediction ID로 결과를 조회하세요.
text-to-video에는 prompt를 제공하고 문서에 명시된 aspect ratio 및 duration 제어값을 사용하세요. image-to-video에는 prompt와 image가 필요하며, last_image는 선택 사항입니다. 검증된 aspect ratio는 16:9, 9:16, 1:1이고, duration은 5초 또는 10초입니다.
Atlas Cloud는 검증된 두 video endpoint 모두에 대해 표준 요금으로 초당 $0.112를 책정하고 있습니다. 요금은 요청한 output duration에 따라 달라지므로, 표준 요금 기준으로 10초 생성 비용은 5초 생성 비용의 2배입니다.
생성은 prediction ID와 처리 상태를 반환하는 POST 요청으로 시작됩니다. 작업이 완료되거나 실패할 때까지 https://api.atlascloud.ai/api/v1/model/prediction/{prediction_id}를 폴링하세요. 성공한 응답에서는 생성된 video URL이 outputs 배열에 포함됩니다.
피사체 일관성은 사용 가능한 두 모드 모두에서 문서화된 기능이며, image-to-video는 원본 프레임을 기준으로 시각적 정체성과 구도를 유지합니다. 그래도 입력 품질과 프롬프트의 복잡성에 따라 결과가 달라질 수 있으므로, 선명한 원본 이미지와 구체적인 움직임 지시를 사용하는 것이 좋습니다.
이 제품군 페이지에서 검증된 두 Atlas Cloud endpoint에는 포함되지 않습니다. 현재 선택 가능한 항목은 text-to-video와 image-to-video이므로, Atlas Cloud가 호환되는 endpoint와 schema를 공개하지 않는 한 Elements, reference video 및 editing 파라미터를 제출해서는 안 됩니다.
Atlas Cloud를 최대한 활용할 수 있는 가이드, 튜토리얼, 제품 업데이트.