
Kling 1.6 es el modelo de generación de video de Kuaishou, diseñado para convertir prompts e imágenes de referencia en videos cortos coherentes. Mejora la respuesta al movimiento, las acciones temporales y el movimiento de cámara, a la vez que refuerza la coherencia del sujeto, la precisión del color, la dinámica de la iluminación y el renderizado detallado. Accede a la familia a través de Atlas Cloud con una única clave compatible con OpenAI y precios transparentes de pago por uso. Empieza a crear hoy mismo.
Kling 1.6 ha sido desarrollado por Kuaishou. Atlas Cloud (operado por Atlas Cloud AI LLC) proporciona acceso al modelo, pero no es su propietario. Todas las marcas comerciales pertenecen a sus respectivos titulares.
Descubre cómo cada endpoint de Kling 1.6 gestiona las entradas de texto o imagen y en qué casos encajan sus fortalezas verificadas en movimiento, coherencia, detalle y eficiencia.
| Modalidad | Descripción |
|---|---|
| Kling 1.6 Multi I2V Pro API (Multi Image To Video) | Convierte imágenes en video con múltiples sujetos, mejorando la coherencia y la precisión avanzada del seguimiento del movimiento. Este endpoint Pro es adecuado para escenas complejas en las que importan el movimiento coordinado de los sujetos y la consistencia visual. |
| Kling 1.6 Multi I2V Standard API (Multi Image To Video) | Para generar múltiples sujetos de forma rentable, este endpoint convierte imágenes en video equilibrando velocidad y detalle. Es adecuado para animaciones de escenas básicas y la producción habitual de contenido con varios sujetos. |
| Kling 1.6 T2V Standard API (Text To Video) | Las indicaciones de texto se convierten en videos cortos con movimiento estable y una alineación fiable con la indicación. Usa este endpoint de nivel inicial para visualizar conceptos, crear contenido para redes sociales y producir secuencias sencillas basadas en indicaciones. |
| Kling 1.6 I2V Pro API (Image To Video) | A partir de una imagen estática, el endpoint Pro genera videos con una mezcla de movimiento más fluida y un realismo de texturas mejorado. Funciona especialmente bien para imágenes de producto pulidas, planos de personajes y animación cinematográfica de imágenes. |
| Kling 1.6 I2V Standard API (Image To Video) | Elige este endpoint ligero para transformar imágenes en video mediante un flujo de generación básico. Su enfoque de coste reducido lo hace adecuado para animaciones sencillas, primeras pruebas creativas y producción de mayor volumen. |
Kling 1.6 combina flujos de trabajo de texto, imagen única y hasta cuatro imágenes de referencia, con resultados de 5 o 10 segundos, control sobre el seguimiento del prompt, prompts negativos opcionales, relaciones de aspecto seleccionadas y acceso Standard o Pro mediante una única API de Atlas Cloud.
Kling 1.6 permite generar texto a video e imagen a video mediante variantes específicas. Comienza con una escena escrita o anima una imagen de origen y, después, guía la acción con prompts de hasta 2,500 caracteres. Los modelos Standard priorizan la eficiencia de costes, mientras que la variante de imagen Pro hace hincapié en una combinación de movimiento más fluida y texturas más realistas. Esta variedad se adapta a pruebas de conceptos, clips para redes sociales y secuencias visuales pulidas.
Sube entre una y cuatro imágenes de referencia con la variante Multi I2V Standard o Pro. El modelo las utiliza como referencias visuales mientras un prompt dirige los sujetos, el movimiento y el desarrollo de la escena. Pro está optimizado para una mayor coherencia entre múltiples sujetos y un seguimiento del movimiento más preciso. Es adecuado para interacciones entre personajes, combinaciones de productos y escenas que reúnen varios elementos visuales.
Define una imagen inicial y una imagen final opcional con la variante I2V Pro para determinar dónde comienza y termina un clip. Cada imagen puede ser JPG, JPEG o PNG, de hasta 10 MB y con un mínimo de 300 por 300 píxeles. Añade instrucciones de movimiento entre esos anclajes visuales. Este control resulta especialmente útil para transiciones planificadas, cambios de pose y presentaciones de productos.
El movimiento fluido es una prioridad de la variante de imagen Pro, con una combinación mejorada y un realismo de texturas superior registrados en su perfil de Atlas Cloud. Una escala de guidance de 0 a 1 ajusta el seguimiento del prompt, mientras que los prompts negativos ayudan a evitar elementos no deseados. Utiliza estos controles para equilibrar el movimiento natural con una acción dirigida con precisión. Esta combinación es adecuada para movimientos exigentes de personajes, telas y cámaras.
Elige resultados de 5 o 10 segundos en toda la familia Kling 1.6. Las variantes de texto y de múltiples imágenes también ofrecen relaciones de aspecto de 16:9, 9:16 y 1:1, de modo que un mismo flujo de trabajo puede orientarse a composiciones panorámicas, verticales o cuadradas. El límite de 2,500 caracteres por prompt deja espacio para definir el sujeto, la acción, la iluminación y la dirección de cámara. Estas opciones ayudan a los equipos a planificar recursos específicos para cada plataforma sin cambiar de familia de modelos.
Ejecuta todas las variantes de Kling 1.6 incluidas mediante una única API de generación de video de Atlas Cloud con facturación de pago por uso. Las variantes Standard utilizan un precio base original verificado de $0.056 por ejecución, mientras que las variantes Pro utilizan $0.098 por ejecución. Elige el nivel que ofrezca el equilibrio necesario entre coste, detalle y calidad del movimiento. Esta configuración permite realizar experimentos rápidos y ejecutar pipelines de producción sin integrar proveedores por separado.
Descubre cómo Kling 1.6 y dos modelos de vídeo alternativos interpretan prompts idénticos en escenas de acción realista y narración estilizada.
Una secuencia cinematográfica de 8–10 segundos en miniatura y acción real dentro de un taller de soplado de vidrio a medianoche: un joven artesano gira continuamente una caña de soplado mientras una burbuja de vidrio al rojo vivo se expande rápidamente; su forma perfectamente redonda sirve de eje a la composición. Comienza con una órbita macro extrema alrededor del vidrio fundido en rotación, capturando filamentos de ámbar transparentes que se estiran, tensión superficial viscosa, reverberación del calor, pequeñas chispas y refracción interna realista. La burbuja, al hincharse, se desprende de repente de la caña, golpea la mesa metálica gris plateada y rueda a gran velocidad; desciende a un plano de seguimiento de alta velocidad a nivel de la mesa junto a ella mientras se tambalea, se deforma, desprende hilos incandescentes y refleja la luz de luna azul cobalto contra el resplandor naranja del horno. Haz un whip-pan hacia el artesano alarmado, que se lanza sobre el banco y atrapa el vidrio descontrolado con una paleta de madera húmeda en el último instante; un siseo explosivo envía vapor físicamente preciso arremolinándose por el encuadre. Cuando el vapor se despeja, revela que el vidrio se ha congelado milagrosamente en un pequeño pez globo transparente con delicadas aletas de vidrio y burbujas internas uniformes; infla suavemente las mejillas una vez, en un desenlace juguetón. Movimiento continuo y fluido, transformación coherente del sujeto, viscosidad realista del vidrio, colisiones, resplandor térmico, chispas, refracción, cáusticas, distorsión por calor y física del vapor; paleta en capas de ámbar, azul cobalto y gris plateado; luz principal naranja del horno, luz de contorno azul lunar fría, poca profundidad de campo, realización de miniaturas prácticas de alta gama con textura cinematográfica fotorrealista, sin cámara lenta, sin relleno estático, sin pantallas, interfaces de software, paneles, barras de progreso, gráficos, subtítulos, texto, logotipos ni marcas de agua. Audio sincronizado: rugido del horno, raspado de la caña al girar, tintineo metálico agudo, traqueteo del vidrio al rodar, pisada urgente, fuerte siseo húmedo y, después, un diminuto soplido cristalino; ritmo percusivo tenso que termina con un encantador tintineo de vidrio. Relación de aspecto 16:9.
Generated with Kling v1.6 Multi i2v Pro on Atlas Cloud
Generated with Seedance 2.0 Image-to-Video on Atlas Cloud
Generated with Kling v1.6 i2v Standard on Atlas Cloud
Una microhistoria tensa de 9 segundos en la estrecha cocina trasera de un restaurante de noodles de Hong Kong abierto hasta altas horas de la noche: un joven chef rescata con urgencia un pedido de ramen, moviéndose continuamente con una coreografía manual precisa y creíble. Comienza con un plano lateral de seguimiento en ángulo extremadamente bajo que se desliza sobre la tabla de cortar cubierta de harina mientras chasquea las muñecas y lanza al aire un largo manojo de noodles; sigue los hilos retorcidos a través del vapor denso, con cada noodle flexionándose y estirándose, ocultando de forma natural sus manos y los utensilios de cocina colgantes. Haz un whip-pan hacia un ángulo cerrado junto al fogón cuando el manojo de noodles está a punto de caer en una llama de gas que se eleva; en el último instante, se lanza hacia delante y lo atrapa limpiamente con una espumadera de alambre, cuya malla se flexiona bajo su peso; después gira con un movimiento fluido y sumerge los noodles en un caldo que hierve violentamente, enviando gotas, burbujas y ondulaciones aceitosas realistas por toda la olla. Cambia bruscamente a un plano cenital completamente vertical mientras los noodles se desenrollan formando una espiral ordenada y floreciente en la sopa; a través de la ventanilla de servicio, los comensales que esperan se inclinan hacia delante y rompen en aplausos entusiasmados mientras el chef esboza una sonrisa jadeante. Mantén una continuidad exacta del mismo chef, su ropa, los utensilios, el manojo de noodles, la distribución de la cocina y el movimiento en cada corte. Una puesta en escena profunda y ajustada coordina constantemente al chef, los noodles, las llamas, las ollas y los utensilios en primer plano; capas táctiles de harina suspendida en el aire, reflejos sobre los azulejos mojados, aceite reluciente, condensación y vapor ondulante. Estética fotorrealista del cine de Hong Kong, energía cinética de cámara en mano, desenfoque de movimiento natural y nítido, luces prácticas cálidas de tungsteno naranja en contraste con azulejos cerámicos cian fríos, contraste intenso, grano sutil de película de 35mm, textura realista de la piel y los alimentos. Sonido sincronizado: golpeteo del cuchillo contra la tabla, rugido de la llama de gas, vapor a presión, clang de la espumadera, salpicadura del caldo hirviendo y, después, una ráfaga aguda de aplausos; ritmo percusivo rápido de cocina, sin diálogos. Sin cámara lenta, poses congeladas, planos generales vacíos, saltos de montaje, continuidad entrecortada, dedos adicionales, manos deformes, extremidades duplicadas, utensilios rotos, clipping, noodles que se teletransportan, movimiento gomoso, comportamiento imposible de los fluidos, objetos flotantes, UI, pantallas, paneles, barras de progreso, gráficos, subtítulos, leyendas, logotipos ni texto visible. Relación de aspecto 16:9.
Generated with Kling v1.6 Multi i2v Pro on Atlas Cloud
Generated with Seedance 2.0 Image-to-Video on Atlas Cloud
Generated with Kling v1.6 i2v Standard on Atlas Cloud
Kling 1.6 convierte prompts e imágenes de referencia en conceptos de vídeo breves para storyboards, campañas de producto, escenas con varios sujetos, ilustraciones animadas, variaciones para redes sociales y narrativas de personajes.
Convierte conceptos escritos en borradores de vídeo breves, con movimiento estable y una alineación fiable con el prompt. Directores, agencias y equipos de producto pueden previsualizar el ritmo, la acción y la dirección visual antes de comprometerse con una producción completa.
Anima imágenes fijas de producto con una mezcla de movimiento más fluida y texturas más realistas. Los equipos de marketing pueden transformar imágenes de catálogo en clips de lanzamiento pulidos, presentaciones de funcionalidades y recursos de campaña sin organizar una nueva sesión de fotos.
Combina sujetos de imágenes independientes, conservando una mayor coherencia de escena y siguiendo sus movimientos con precisión. Crea interacciones entre personajes, momentos de conjunto o narrativas de estilo de vida para contenidos de marca y campañas en redes sociales a escala.
Anima obras estáticas con la mezcla de movimiento más fluida y el realismo de texturas mejorado de la variante Pro de image-to-video. Artistas y equipos de desarrollo de videojuegos pueden crear conceptos animados, momentos de personajes o estudios de escenas atmosféricas a partir de recursos visuales existentes.
Parte de un prompt o una imagen de referencia para producir conceptos de vídeo breves con movimiento estable o suavemente combinado. Los creadores pueden desarrollar múltiples ganchos, tratamientos visuales y direcciones de campaña para sus canales sociales.
Cuando varios sujetos deben compartir una misma escena, las variantes Multi priorizan la coherencia y el seguimiento avanzado del movimiento. Úsalas para parejas de personajes, interacciones entre mascotas, momentos de grupo o pruebas narrativas creadas a partir de imágenes.
Compara las variantes de Kling 1.6 con otros modelos de video disponibles en Atlas Cloud según los flujos de entrada, la duración del clip, el audio nativo y los precios estándar.
| Modelo | Flujo de entrada | Duración de salida | Audio nativo | Precio estándar |
|---|---|---|---|---|
| Kling v1.6 Multi i2v Pro | Prompt + de 1 a 4 imágenes | 5 o 10 segundos | - | $0.098/ejecución |
| Kling v1.6 Multi i2v Standard | Prompt + de 1 a 4 imágenes | 5 o 10 segundos | - | $0.056/ejecución |
| Kling v1.6 t2v Standard | Prompt de texto | 5 o 10 segundos | - | $0.056/ejecución |
| Kling v1.6 i2v Pro | Prompt + fotograma inicial + fotograma final opcional | 5 o 10 segundos | - | $0.098/ejecución |
| Kling v1.6 i2v Standard | Prompt + fotograma inicial | 5 o 10 segundos | - | $0.056/ejecución |
| Wan-3.0 Image-to-video | Prompt + fotograma inicial + fotograma final opcional | De 2 a 30 segundos | √ | $0.05/segundo |
| MiniMax H3 Image-to-Video | Prompt + fotograma inicial + fotograma final opcional | De 4 a 15 segundos | √ | $0.038/segundo |
Empieza en minutos — sigue estos sencillos pasos para integrar y desplegar modelos a través de la plataforma de Atlas Cloud.
Regístrate en atlascloud.ai y completa la verificación. Los nuevos usuarios reciben créditos gratuitos para explorar la plataforma y probar modelos.
Combina modelos avanzados de Kling 1.6 con la plataforma acelerada por GPU de Atlas Cloud, proporcionando rendimiento, escalabilidad y experiencia de desarrollo incomparables.
Baja Latencia:
Inferencia optimizada por GPU para respuestas en tiempo real.
API Unificada:
Una sola integración para acceder a Kling 1.6, GPT, Gemini y DeepSeek.
Precios Transparentes:
Facturación por Token, soporta modo Serverless.
Experiencia del Desarrollador:
SDK, análisis de datos, herramientas de ajuste fino y plantillas todo en uno.
Confiabilidad:
99.99% de disponibilidad, control de permisos RBAC, registros de cumplimiento.
Seguridad y Cumplimiento:
Certificación SOC 2 Type II, cumplimiento HIPAA, soberanía de datos en EE.UU.
Kling 1.6 es una familia de modelos de generación de video desarrollada por Kuaishou. En Atlas Cloud, ofrece generación de texto a video, de una sola imagen a video y de múltiples imágenes a video mediante cinco endpoints Standard y Pro. Sus variantes ofrecen movimiento estable, alineación con el prompt, transiciones de movimiento más fluidas, realismo en las texturas y coherencia entre múltiples sujetos.
Convierte prompts de texto en escenas de video originales, anima una única imagen inicial o combina varias imágenes de referencia en una composición con múltiples sujetos. Según el endpoint, puedes generar clips de 5 o 10 segundos.
Elige T2V Standard para la generación basada en texto e I2V Standard para animar una imagen con un coste eficiente. I2V Pro prioriza transiciones de movimiento más fluidas y texturas más realistas. Para varios sujetos o imágenes de referencia, selecciona Multi I2V Standard o Multi I2V Pro según tus requisitos de coste y coherencia.
Crea una clave de API en el panel de Atlas Cloud y, a continuación, envía una solicitud JSON a POST /api/v1/model/generateVideo con tu token Bearer. Incluye el identificador exacto del modelo, un prompt y la imagen o imágenes requeridas para los endpoints basados en imágenes. Guarda el ID de predicción devuelto y úsalo para obtener el resultado asíncrono.
Todos los endpoints requieren un identificador de modelo y un prompt de hasta 2,500 caracteres. La generación de texto a video admite relación de aspecto, duración, escala de guidance y prompts negativos, mientras que los endpoints de una sola imagen requieren una imagen inicial en formato JPG, JPEG o PNG. Los endpoints de múltiples imágenes aceptan de una a cuatro imágenes de referencia y también ofrecen controles de duración, relación de aspecto y prompt negativo.
Los cinco endpoints de Atlas Cloud admiten generaciones de 5 o 10 segundos, con 5 segundos como valor predeterminado documentado. Los endpoints de texto a video y de múltiples imágenes aceptan 16:9, 9:16 o 1:1. Los flujos de trabajo de una sola imagen determinan el encuadre a partir de la imagen de origen proporcionada, en lugar de exponer el mismo parámetro de relación de aspecto.
Según las tarifas estándar publicadas, los endpoints T2V Standard, I2V Standard y Multi I2V Standard cuestan $0.056 por cada segundo de video generado. I2V Pro y Multi I2V Pro cuestan $0.098 por cada segundo de video generado, con facturación de pago por uso.
Primero, verifica el token Bearer, el identificador exacto del modelo, el prompt obligatorio y los campos de imagen requeridos. Comprueba la longitud documentada del prompt, el formato de imagen, el tamaño del archivo, la resolución, la duración y los rangos de parámetros antes de volver a enviar una solicitud no válida. Como la generación es asíncrona, conserva el ID de predicción y sigue consultando el endpoint de resultados mientras su estado sea processing.
Guías, tutoriales y novedades de producto para aprovechar al máximo Atlas Cloud.