
Kling 2.0 es la familia de modelos de generación de vídeo de Kuaishou para crear contenido de texto a vídeo e imagen a vídeo. Sus modelos Master combinan imágenes de alta fidelidad con una iluminación refinada y un realismo de cámara avanzado, ofreciendo a los desarrolladores dos flujos de trabajo especializados para convertir prompts o imágenes de origen en clips pulidos. En Atlas Cloud, puedes acceder a ambos modelos mediante una única clave compatible con OpenAI, con disponibilidad desde el Day-0 y una integración sencilla. Empieza a desarrollar hoy mismo.
Kling 2.0 ha sido desarrollado por Kuaishou. Atlas Cloud (operado por Atlas Cloud AI LLC) proporciona acceso al modelo, pero no es su propietario. Todas las marcas comerciales pertenecen a sus respectivos titulares.
Elige el endpoint de Kling 2.0 que mejor se adapte a tu material de origen y a tus objetivos de producción.
| Modalidad | Descripción |
|---|---|
| Kling 2.0 I2V Master API (Image To Video) | Transforma una imagen de origen en un vídeo cinematográfico de 1080p, con una iluminación refinada, un comportamiento realista de la cámara y personajes coherentes entre fotogramas. Este endpoint es ideal para publicidad centrada en personajes, escenas de marca y narrativas visuales que deben conservar la imagen de origen. |
| Kling 2.0 T2V Master API (Text To Video) | A partir de un prompt de texto, Kling 2.0 T2V Master genera vídeos cinematográficos con imágenes de alta fidelidad y movimientos humanos realistas. Úsalo para crear metraje conceptual, secuencias narrativas, contenido promocional o escenas impulsadas por el movimiento sin necesidad de proporcionar una imagen inicial. |
Kling 2.0 combina una salida cinematográfica en 1080p, movimiento estable de personajes, rutas de creación mediante texto e imágenes, fotogramas iniciales y finales controlables, ajustes flexibles de clips y acceso unificado a la API con pago por uso en Atlas Cloud.
Kling 2.0 renderiza clips cinematográficos en 1080p con iluminación refinada y un realismo de cámara sobresaliente en ambos modelos de la familia. Los detalles precisos y las imágenes de alta fidelidad ayudan a que las escenas mantengan su calidad en primeros planos, planos generales y condiciones de iluminación cambiantes. Úsalo cuando las películas de producto, las vistas previas narrativas o las secuencias de marca necesiten un acabado pulido y listo para pantalla, tanto para la revisión creativa como para el montaje final.
El movimiento humano natural proporciona a los personajes un peso, una sincronización y un flujo físico convincentes. La estabilidad entre fotogramas ayuda a que el mismo sujeto siga siendo reconocible mientras evolucionan las expresiones, los gestos, la ropa y los ángulos de cámara a lo largo del clip. Para coreografías, actuaciones o narrativas impulsadas por la acción, esta combinación permite movimientos enérgicos sin sacrificar la continuidad visual que mantiene la credibilidad de la escena de principio a fin.
Elige un prompt de texto cuando la escena comience como una idea, o proporciona una imagen cuando una composición establecida deba guiar el movimiento. Ambos endpoints de Kling 2.0 Master comparten el mismo flujo de generación de vídeo en Atlas Cloud. Este acceso combinado permite a los desarrolladores crear prototipos de planos originales, animar piezas gráficas de campañas y alternar entre modos de creación sin reconstruir el resto de la experiencia del producto.
Guía la animación de imágenes de Kling 2.0 con un primer fotograma obligatorio y un fotograma final opcional que define dónde debe terminar el movimiento. El endpoint de imagen admite duraciones de 5 o 10 segundos, además de una escala de orientación de 0 a 1 para equilibrar la dirección del prompt. Las transiciones controladas son ideales para revelaciones, transformaciones, match cuts y secuencias visuales con una composición final planificada.
Configura los clips generados a partir de texto para entregas panorámicas, verticales o cuadradas con relaciones de aspecto de 16:9, 9:16 y 1:1. Selecciona una duración de 5 o 10 segundos y usa un prompt negativo para evitar elementos visuales no deseados. Estos controles hacen que una única ruta de generación sea práctica para avances cinematográficos, publicaciones en redes sociales e historias de producto compactas en distintos formatos de publicación, sin cambiar el modelo principal.
Accede a los modelos de texto e imagen mediante una única API de Atlas Cloud con una facturación transparente de pago por uso. Cada endpoint tiene un precio base estándar verificado de $0.28, mientras que la gestión asíncrona de predicciones se adapta a backends de aplicaciones y flujos de trabajo de medios en cola. Desarrolla con una sola clave de API de Atlas Cloud cuando tu producto necesite tanto vídeo guiado por prompts como animación basada en imágenes de referencia, sin integraciones independientes con distintos proveedores.
Compara cómo los principales modelos de video interpretan el mismo prompt centrado en la acción, desde el movimiento de cámara y la continuidad física hasta la consistencia de los personajes y la composición cinematográfica.
Una aventura de aterrizaje lunar en miniatura de 8–10 segundos sobre el abarrotado banco de trabajo de un artesano que trabaja hasta tarde: un astronauta de latón de cuerda, del tamaño de un pulgar, gira su propia llave, cobra vida de golpe y corre a toda velocidad sobre la madera arañada sin detenerse. Plano macro extremo de seguimiento lateral mientras pisa un balancín hecho con una regla y lanza una canica de acero hacia una precisa reacción en cadena: los botes de pintura tintinean y se tambalean, los engranajes cubiertos de verdín giran y una pista de origami azul cobalto se despliega justo delante de la canica en movimiento. Barrido rápido hacia una vista cenital mientras el astronauta corre a su lado, agarra un pincel oscilante, salta por el aire y aterriza dentro de una nave espacial hecha con una caja de cerillas, marcada con una diminuta franja roja de advertencia. Orbita fluidamente la nave acelerada mientras atraviesa una lupa; la refracción realista deforma el taller hasta convertirlo en un vasto horizonte lunar azul frío, con reflejos que se ondulan sobre el cristal y el metal. La nave parece despegar hacia una luna llena resplandeciente; después, retrocede rápidamente con un dolly para el desenlace final: la «luna» es en realidad una lámpara de escritorio redonda que cuelga sobre el borde de la mesa, mientras el diminuto astronauta saluda orgullosamente desde la caja de cerillas suspendida en el aire. Fotografía práctica de miniaturas combinada con animación stop-motion vintage y táctil, escala miniatura constante, intrincadas colisiones físicas, movimiento continuo y animado, profundidad de campo reducida y controlada con cambios de foco precisos, cálida luz ámbar de trabajo contrastando con la fría luz azul de luna, tonos de madera, pátina verde cobriza, azul cobalto y rojo de advertencia usado con moderación. Diseño sonoro nítido y sincronizado: resorte que hace tic-tac, diminutos pasos metálicos, chasquido de la regla, clics de la canica, tintineo del cristal, parloteo de los engranajes, crujido del papel, silbido del pincel, zumbido del motor de la caja de cerillas y un crescendo orquestal juguetón que termina con el zumbido eléctrico de la lámpara. Sin pantallas, interfaces de software, paneles de control, barras de progreso, gráficos, rótulos, subtítulos, logotipos ni texto explicativo. Relación de aspecto 16:9.
Generated with Kling Video O3 4K Text-to-Video on Atlas Cloud
Generated with Seedance 2.5 Text-to-Video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Una vívida comedia cinematográfica de acción real de 9 segundos al atardecer, en un gigantesco campo de ropa tendida al aire libre: un chico adolescente con botas de lluvia amarillo limón mantiene el equilibrio sobre una cesta de ropa de mimbre que rueda, mientras persigue a un avestruz que ha robado un calcetín rojo brillante con el pico. Comienza con un plano de seguimiento a ras de suelo junto a las ruedas traqueteantes de la cesta, mientras el chico mueve los brazos y avanza tambaleándose; atraviesa a toda velocidad filas de enormes sábanas blancas que ondean formando arcos translúcidos, con la tela barriendo repetidamente el objetivo como transiciones naturales y fluidas, manteniendo la coherencia de la ropa, el rostro, las botas y la cesta del chico, así como del mismo avestruz. Barrido rápido hacia la zancada elástica y físicamente precisa del avestruz; después, orbita rápidamente alrededor de ambos personajes mientras zigzaguean, se agachan, chocan con telas colgantes y suaves, y continúan la persecución sin interrumpir el movimiento. El avestruz gira bruscamente y se lanza a través de densas cuerdas de tender; camisas, vestidos y toallas de colores se voltean y se enroscan en secuencia como fichas de dominó, y cada colisión de tela se propaga de forma realista por toda la línea. En el clímax cómico, el calcetín rojo sale disparado hacia arriba y cae perfectamente sobre la cabeza del avestruz; el avestruz y el chico se detienen exactamente al mismo tiempo y se miran en un silencio atónito. Corte abrupto a un plano elevado de grúa que revela las cuerdas de tender enredadas, arremolinándose a su alrededor como un vórtice de colores. Realismo cinematográfico práctico de alta saturación, comedia física juguetona, cálido contraluz naranja rojizo que perfila la tela semitransparente, sombras verde azulado intensas, viento dinámico, detalle textil nítido, desenfoque de movimiento natural, anatomía coherente, acción continua, física realista de las telas y continuidad de las oclusiones. Audio sincronizado: ruedas traqueteantes de la cesta, botas golpeando el suelo, pisadas del avestruz, sábanas que chasquean, aleteo en cascada de las telas; después, un corte musical repentino y un único gorjeo cómico y seco. Sin cámara lenta, relleno estático, subtítulos, rótulos, logotipos, marcas de agua, pantallas, interfaces de software, paneles de control, barras de progreso, gráficos, diagramas ni texto explicativo. Relación de aspecto 16:9.
Generated with Kling Video O3 4K Text-to-Video on Atlas Cloud
Generated with Seedance 2.5 Text-to-Video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Desde los conceptos de campaña y las imágenes de producto hasta las narrativas centradas en personajes, Kling 2.0 convierte prompts de texto o imágenes fijas en clips cinematográficos de 1080p con movimiento realista, iluminación refinada y personajes estables entre fotogramas.
Convierte ideas de escenas escritas en clips cinematográficos con imágenes de alta fidelidad y movimiento humano realista. Los directores y equipos creativos pueden previsualizar el encuadre, las interpretaciones y la dirección visual antes de la producción.
Anima una imagen de producto para convertirla en un clip de 1080p con iluminación refinada y un tratamiento de cámara realista. Los equipos de marketing obtienen recursos visuales pulidos para lanzamientos, páginas de destino y campañas de pago sin tener que filmar cada concepto.
Crea vídeos cinematográficos de 1080p a partir de prompts o imágenes fijas, manteniendo personajes estables entre fotogramas. Los equipos de redes sociales pueden desarrollar publicaciones pulidas, avances de campaña e historias visuales listas para cada plataforma, adaptadas a calendarios de contenido recurrentes.
Construye secuencias centradas en personajes con movimiento humano realista y continuidad entre fotogramas. Cineastas, animadores y equipos de desarrollo de videojuegos pueden explorar momentos dramáticos, decisiones de movimiento y escenas cinematográficas durante las primeras etapas del desarrollo narrativo.
Pon a prueba conceptos de escenas mediante imágenes de alta fidelidad, iluminación refinada y un comportamiento de cámara realista antes de comprometerte con la producción. Los equipos creativos pueden comparar direcciones visuales y comunicar con mayor claridad la atmósfera, el movimiento y el encuadre previstos.
Da movimiento a obras de arte o fotografías estáticas y conviértelas en clips cinematográficos de 1080p con iluminación refinada. Editoriales, diseñadores y equipos de medios pueden crear acompañamientos visuales para reportajes digitales, portafolios y paquetes editoriales de marca.
Compara los endpoints de Kling 2.0 con Seedance 2.0 y Wan 2.7 en cuanto al flujo de entrada, la duración del clip, el audio nativo y el precio estándar.
| Modelo | Flujo de entrada | Duración del clip | Audio nativo | Precio estándar |
|---|---|---|---|---|
| kling v2.0 i2v Master | Imagen, fotograma final opcional | 5 o 10 sec | - | $0.28/sec |
| Kling v2.0 t2v Master | Texto | 5 o 10 sec | - | $0.28/sec |
| Seedance 2.0 Text-to-Video | Prompts de texto | de 4 a 15 sec | √ | $0.112/sec |
| Seedance 2.0 Image-to-Video | Primer fotograma, último fotograma opcional | de 4 a 15 sec | √ | $0.112/sec |
| Wan-2.7 Text-to-video | Instrucción de texto | de 2 a 15 sec | √ | $0.10/sec |
Empieza en minutos — sigue estos sencillos pasos para integrar y desplegar modelos a través de la plataforma de Atlas Cloud.
Regístrate en atlascloud.ai y completa la verificación. Los nuevos usuarios reciben créditos gratuitos para explorar la plataforma y probar modelos.
Combina modelos avanzados de Kling 2.0 con la plataforma acelerada por GPU de Atlas Cloud, proporcionando rendimiento, escalabilidad y experiencia de desarrollo incomparables.
Baja Latencia:
Inferencia optimizada por GPU para respuestas en tiempo real.
API Unificada:
Una sola integración para acceder a Kling 2.0, GPT, Gemini y DeepSeek.
Precios Transparentes:
Facturación por Token, soporta modo Serverless.
Experiencia del Desarrollador:
SDK, análisis de datos, herramientas de ajuste fino y plantillas todo en uno.
Confiabilidad:
99.99% de disponibilidad, control de permisos RBAC, registros de cumplimiento.
Seguridad y Cumplimiento:
Certificación SOC 2 Type II, cumplimiento HIPAA, soberanía de datos en EE.UU.
Kling 2.0 es una familia de modelos de generación de vídeo desarrollada por Kuaishou. Atlas Cloud ofrece endpoints Master dedicados para generar vídeos cinematográficos a partir de indicaciones de texto o imágenes de origen.
Usa T2V Master para convertir descripciones escritas de escenas en vídeos cinematográficos, o elige I2V Master para animar una imagen de origen. La familia se centra en imágenes de alta fidelidad y movimiento realista, mientras que I2V Master ofrece salida en 1080p, iluminación refinada, realismo de cámara y estabilidad de los personajes entre fotogramas.
Elige el endpoint T2V Master o I2V Master según tus datos de entrada y utiliza una clave de API de Atlas Cloud para enviar las solicitudes. Sigue el esquema del playground del modelo seleccionado para conocer la estructura actual de las solicitudes y los valores admitidos.
Selecciona T2V Master cuando la escena comience con una descripción escrita y quieras que el modelo componga los elementos visuales. Elige I2V Master cuando ya tengas una imagen de origen cuya temática, composición o identidad visual deba guiar el clip.
T2V Master parte de una indicación de texto, mientras que I2V Master combina una imagen de origen con instrucciones que describen la acción prevista o el comportamiento de la cámara. Consulta el esquema correspondiente del playground de Atlas Cloud antes de implementar, ya que los controles disponibles y los valores admitidos son específicos de cada endpoint.
Sí. El perfil verificado de Atlas Cloud para el endpoint I2V Master especifica clips cinematográficos en 1080p, con iluminación refinada, comportamiento realista de la cámara y estabilidad de los personajes entre fotogramas.
El precio base estándar es de $0.28 para los endpoints T2V Master e I2V Master. Atlas Cloud utiliza un sistema de pago por uso, lo que permite a los desarrolladores elegir el flujo de trabajo adecuado sin comprometerse con una suscripción.
Simplifica las escenas saturadas, describe las acciones en una secuencia clara e indica directamente el movimiento de cámara previsto. En las solicitudes de imagen a vídeo, comienza con una imagen de origen nítida y centra la indicación en el movimiento que debe producirse.
Guías, tutoriales y novedades de producto para aprovechar al máximo Atlas Cloud.