
Kling v2.1 es la familia de modelos de vídeo con IA de Kuaishou para desarrolladores que crean flujos de trabajo de vídeo orientados a producción. La familia admite creación rápida de borradores en 720p, animación de imágenes nítida y fluida, profundidad visual profesional, interpretación de prompts complejos, lógica de movimiento avanzada y renderizado mejorado de cámaras dinámicas. Accede a estas capacidades a través de la API unificada de Atlas Cloud con una única clave compatible con OpenAI y disponibilidad de modelos desde el Day-0. Empieza a desarrollar hoy.
Kling 2.1 ha sido desarrollado por Kuaishou. Atlas Cloud (operado por Atlas Cloud AI LLC) proporciona acceso al modelo, pero no es su propietario. Todas las marcas comerciales pertenecen a sus respectivos titulares.
Elige el endpoint de Kling v2.1 que mejor se adapte a tu material de origen, requisitos de movimiento y flujo de producción.
| Modalidad | Descripción |
|---|---|
| Kling v2.1 I2V Pro Start End Frame API | Proporciona fotogramas iniciales y finales para generar un video con continuidad de movimiento controlada entre ambas imágenes. Las transiciones de escena más fluidas hacen que este endpoint sea adecuado para cambios de plano planificados, secuencias visuales y momentos narrativos definidos. |
| Kling v2.1 T2V Master API (Text To Video) | Los prompts de texto complejos se convierten en videos con lógica de movimiento avanzada y una representación dinámica de cámara mejorada. Selecciona este endpoint para indicaciones de escena detalladas, movimientos expresivos y conceptos que dependen de un comportamiento de cámara deliberado. |
| Kling v2.1 I2V Master API (Image To Video) | Diseñado para la generación profesional de imagen a video, este endpoint anima una imagen de origen con continuidad de movimiento precisa y profundidad visual. Es ideal para trabajos creativos pulidos en los que el movimiento coherente y la presentación dimensional son prioritarios. |
| Kling v2.1 I2V Pro API (Image To Video) | Equilibra la velocidad de generación y la fidelidad al convertir imágenes de origen en videos nítidos y fluidos. Úsalo para la producción creativa general que necesita una calidad visual confiable sin depender del endpoint Master. |
| Kling v2.1 I2V Standard API (Image To Video) | Para iteraciones rápidas, este endpoint convierte imágenes de origen en videos confiables de 720p. Su perfil enfocado en la velocidad permite crear borradores visuales rápidos, revisar conceptos iniciales y desarrollar prototipos de video de forma eficiente. |
Kling v2.1 combina la creación de texto a video e imagen a video, el acondicionamiento del primer y último fotograma, clips de 5 o 10 segundos, control de guidance ajustable y niveles Standard, Pro y Master mediante una única API de Atlas Cloud.
Kling v2.1 Pro acepta tanto un primer fotograma como un fotograma final, con cada imagen limitada a JPEG o PNG, 10 MB y al menos 300 por 300 píxeles. El modelo genera el movimiento entre esos puntos de referencia y preserva la continuidad durante la transición. Elige una salida de 5 o 10 segundos para definir revelaciones, transformaciones y momentos narrativos cuidadosamente dirigidos.
Las variantes Master incorporan lógica de movimiento avanzada, renderizado dinámico de cámara, continuidad precisa y profundidad visual para escenas exigentes. Tanto si el prompt requiere una persecución rápida, movimiento de personajes en varias capas o un desplazamiento amplio de cámara, el modelo está diseñado para mantener una acción coherente. Elige Master cuando el trabajo profesional de imagen a video o de texto a video complejo necesite el nivel más capaz de la familia.
Crea a partir de palabras o anima un fotograma existente mediante modelos independientes de texto a video e imagen a video. La familia incluye opciones de imagen Standard, Pro y Master, mientras que Master también procesa prompts de texto con formatos 16:9, 9:16 o 1:1 seleccionables. Esta variedad permite que una sola integración cubra borradores rápidos, producción creativa general y conceptos cinematográficos más exigentes.
Configura cada modelo compatible para producir un clip de 5 o 10 segundos. Las ejecuciones cortas son ideales para pruebas visuales rápidas, mientras que la opción más larga ofrece más espacio para desarrollar el movimiento, los cambios de cámara y las transiciones sin cambiar el endpoint de generación. Standard está optimizado para borradores rápidos en 720p, lo que lo convierte en un punto de entrada práctico antes de pasar un concepto a Pro o Master.
Da forma a los resultados de Kling v2.1 con un prompt positivo obligatorio, un prompt negativo opcional y un control de guidance de 0 a 1. Aumenta o reduce el valor de guidance para ajustar el grado de fidelidad, mientras que los prompts negativos identifican los elementos que quieres que el modelo evite. En conjunto, estos controles permiten un lenguaje de cámara más intencionado, composiciones más limpias y una iteración reproducible entre distintas variaciones creativas.
Accede a las cinco variantes mediante una única API de Atlas Cloud, con precios base estándar de $0.056 para Standard, $0.098 para cada opción Pro y $0.28 para cada opción Master. Paga solo por las llamadas al modelo que realices y cambia de nivel según evolucionen las necesidades de producción. Una única clave compatible con OpenAI mantiene la experimentación y el despliegue dentro de una sola integración.
Ejecuta dos prompts cinematográficos idénticos con Kling v2.1, Seedance 2.0 y Kling V3.0 Turbo para comparar la continuidad del movimiento, el seguimiento del prompt, el control de cámara y la narrativa visual.
Una persecución de rescate de alta intensidad de 8–10 segundos, al mediodía, sobre un vasto lago salado cubierto por una capa de agua tan fina como un espejo: una chica adolescente con un traje de carreras azul cobalto pilota a toda velocidad un yate terrestre de tres ruedas tras una bolsa de emergencia rojo coral arrastrada por una ráfaga violenta. Comienza con un macro extremo a ras de suelo de cristales de sal blanco plateados y afilados como cuchillas, mientras el neumático delantero pasa a toda velocidad y salpica agua centelleante sobre el objetivo; acelera hasta un plano de seguimiento lateral que corre junto al yate mientras su tensa vela de lona chasquea con el viento y la chica baja el mástil para pasar por debajo de una bandada de flamencos que alza el vuelo. Haz un barrido brusco alrededor del vehículo hasta entrar en una órbita dinámica de 360 grados, mientras una rueda lateral se eleva brevemente del agua debido a una fuerza centrífuga realista; ella se inclina hacia fuera sin perder el control, engancha con una mano la correa de la bolsa y la sube a bordo. Termina elevándote rápidamente hasta una vista aérea elevada que revele la larga estela curva del yate; entonces, un pingüino bebé empapado asoma inesperadamente la cabeza por la bolsa abierta y gorjea mientras la chica reacciona con sorprendida alegría. Conserva una continuidad perfecta del personaje, el vehículo, la bolsa y el espacio durante cada transición de cámara; tensión de la vela, dinámica de las ruedas, salpicaduras en aguas poco profundas, reflejos, evitación de los flamencos, resistencia del viento y momento físicamente precisos. Luz solar intensa y nítida del mediodía contra nubes de tormenta índigo lejanas, paleta controlada de blanco plateado, azul cobalto y rojo coral, cine publicitario fotorrealista premium, detalle táctil, desenfoque natural de movimiento nítido, acción continua y fluida, sin cámara lenta ni planos generales de establecimiento vacíos. Audio inmersivo sincronizado: viento rugiente, lona ondeando, neumáticos rozando el agua, salpicaduras rítmicas, aleteo de alas, una banda sonora percusiva ascendente y un gorjeo claro de pingüino en el momento de la revelación. Sin pantallas, interfaces de software, paneles, barras de progreso, gráficos, subtítulos, etiquetas, logotipos, marcas de agua ni texto en pantalla; sin errores anatómicos, sujetos duplicados, saltos de continuidad, geometría deformada del vehículo, objetos flotantes, física antinatural ni vibración de cámara. Relación de aspecto 16:9.
Generated with Kling v2.1 t2v Master on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Una persecución animada continua de 8–10 segundos por tejados blancos del Mediterráneo azotados por el viento, al anochecer, bajo una luz cian fría: una mujer anciana con un delantal índigo corre tras una única bufanda larga de color escarlata intenso, saltando sobre tendederos y deslizándose por tejas de terracota inclinadas mientras la tela chasquea, se retuerce y ondea de forma natural con el repentino viento marino. Comienza con un plano de seguimiento bajo y rápido que roza la estrecha cumbrera del tejado junto a sus pies mientras corre; atraviesa sábanas blancas que ondean violentamente para crear una transición de oclusión perfecta, y luego desciende en picado desde arriba hasta una órbita cerrada alrededor de la mujer mientras la bufanda se enrolla en una veleta y balancea suavemente a un gato naranja sorprendido hasta sus brazos. Ella atrapa al gato sin romper el paso; la veleta gira, el gato maúlla y ella se ríe mientras la cámara se aleja rápidamente hacia atrás para revelar el pueblo costero escalonado que desciende hasta el mar resplandeciente. Conserva con exactitud la continuidad del personaje, la ropa, el gato y los tejados durante cada oclusión y cambio de cámara; carrera, saltos, deslizamientos y captura fluidos e ininterrumpidos, física compleja de la tela impulsada por el viento, un fuerte paralaje del primer plano al fondo, animación cel dibujada a mano de gran expresividad con fondos delicados de acuarela, crepúsculo verde azulado frío contrastado con la luz ámbar cálida de las ventanas, y la bufanda escarlata como única guía visual altamente saturada de toda la composición. Ráfagas rítmicas, ropa tendida chasqueando, pasos rápidos sobre las tejas, el suave giro metálico de la veleta, un maullido sorprendido, oleaje lejano y cuerdas mediterráneas animadas que crecen hasta la captura cómica. Sin cámara lenta, planos estáticos, texto, logotipos, bordes ni elementos de interfaz. Relación de aspecto 16:9.
Generated with Kling v2.1 t2v Master on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
A partir de conceptos escritos e imágenes de referencia, Kling v2.1 admite la previsualización cinematográfica, el movimiento de productos, las transiciones controladas entre fotogramas, los borradores rápidos para redes sociales, las ilustraciones animadas y la planificación de escenas de videojuegos en sus variantes de texto a video e imagen a video.
Kling v2.1 t2v Master interpreta indicaciones complejas con lógica de movimiento avanzada y renderizado dinámico de cámara. Los directores y equipos creativos pueden convertir conceptos escritos en borradores de escenas cinematográficas antes de comprometer recursos de producción.
Anima una imagen de producto con un movimiento nítido y fluido, equilibrando la velocidad de generación y la fidelidad mediante el endpoint Pro. Los equipos de marketing pueden crear clips de lanzamiento, recursos visuales para tiendas y variaciones de campaña a partir de imágenes estáticas existentes.
Usa los fotogramas inicial y final para guiar la continuidad del movimiento y crear transiciones más fluidas entre dos estados visuales. Esto permite crear revelaciones del antes y el después, puentes entre escenas y transformaciones planificadas con puntos finales definidos.
Cuando la velocidad es importante, el modelo Standard produce borradores fiables de imagen a video en 720p para iterar rápidamente. Los equipos de redes sociales y los creadores independientes pueden probar ideas de movimiento, ganchos visuales y enfoques de contenido antes de pasar a una producción de mayor fidelidad.
Da vida a ilustraciones o imágenes estáticas de personajes con continuidad de movimiento y profundidad visual gracias a i2v Master. Los artistas pueden desarrollar secuencias, bucles atmosféricos o piezas para su portafolio, preservando la imagen de origen como base visual.
¿Necesitas una escena de videojuego en movimiento a partir de un briefing escrito? Master text to video gestiona indicaciones complejas y el renderizado dinámico de cámara, ayudando a los desarrolladores a previsualizar entornos, momentos narrativos y escenas cinematográficas para videojuegos.
Compara las variantes de Kling v2.1 con otros modelos de vídeo disponibles en Atlas Cloud según el modo de generación, la duración del clip, el control del fotograma final y el precio base estándar.
| Modelo | Modo de generación | Duración del clip | Control del fotograma final | Precio base estándar |
|---|---|---|---|---|
| Kling v2.1 i2v Pro Start-end-frame | De fotograma inicial y final a vídeo | 5 o 10 s | √ | $0.098 |
| Kling v2.1 t2v Master | De texto a vídeo | 5 o 10 s | - | $0.28 |
| Kling v2.1 i2v Master | De imagen a vídeo | 5 o 10 s | - | $0.28 |
| Kling v2.1 i2v Pro | De imagen a vídeo | 5 o 10 s | - | $0.098 |
| Kling v2.1 i2v Standard | De imagen a vídeo | 5 o 10 s | - | $0.056 |
| Veo 3.1 Lite Start-End Frame to Video | De fotograma inicial y final a vídeo | 4, 6 u 8 s | √ | $0.05 |
| Seedance 2.0 Image-to-Video | De imagen a vídeo | De 4 a 15 s o automático | √ | $0.112 |
| Wan-2.7 Image-to-video | De imagen a vídeo | De 2 a 15 s | √ | $0.10 |
Empieza en minutos — sigue estos sencillos pasos para integrar y desplegar modelos a través de la plataforma de Atlas Cloud.
Regístrate en atlascloud.ai y completa la verificación. Los nuevos usuarios reciben créditos gratuitos para explorar la plataforma y probar modelos.
Combina modelos avanzados de Kling 2.1 con la plataforma acelerada por GPU de Atlas Cloud, proporcionando rendimiento, escalabilidad y experiencia de desarrollo incomparables.
Baja Latencia:
Inferencia optimizada por GPU para respuestas en tiempo real.
API Unificada:
Una sola integración para acceder a Kling 2.1, GPT, Gemini y DeepSeek.
Precios Transparentes:
Facturación por Token, soporta modo Serverless.
Experiencia del Desarrollador:
SDK, análisis de datos, herramientas de ajuste fino y plantillas todo en uno.
Confiabilidad:
99.99% de disponibilidad, control de permisos RBAC, registros de cumplimiento.
Seguridad y Cumplimiento:
Certificación SOC 2 Type II, cumplimiento HIPAA, soberanía de datos en EE.UU.
Kling v2.1 es una familia de modelos de generación de vídeo de Kuaishou para crear vídeos a partir de texto e imágenes. Atlas Cloud ofrece endpoints Standard, Pro, Master y de fotograma inicial/final para distintos requisitos de calidad y control.
Convierte prompts de texto en vídeos con T2V Master o anima imágenes de origen con los endpoints I2V Standard, Pro y Master. La variante de fotograma inicial/final crea una continuidad de movimiento controlada y transiciones más fluidas entre dos fotogramas proporcionados.
Crea una clave de API de Atlas Cloud, guárdala en un entorno seguro del lado del servidor y envía una solicitud POST autenticada a /api/v1/model/generateVideo. Usa el ID de predicción devuelto para supervisar el trabajo y obtener la URL del vídeo en outputs cuando finalice.
Elige T2V Master cuando el prompt de texto sea tu entrada principal y sean importantes la lógica de movimiento compleja o el renderizado dinámico de cámara. Para animación de imágenes, Standard está orientado a borradores rápidos en 720p, Pro equilibra velocidad y fidelidad, Master prioriza la continuidad del movimiento y la profundidad visual, mientras que start/end Pro controla ambos fotogramas límite.
Los controles disponibles incluyen prompts, prompts negativos, duraciones de five o ten second y guidance scale. T2V Master también admite relaciones de aspecto 16:9, 9:16 y 1:1, mientras que las entradas de imagen aceptan archivos JPG, JPEG o PNG de hasta 10 MB, con una resolución mínima de 300 by 300 píxeles. El endpoint de inicio/final también requiere una imagen final.
Los precios base estándar verificados son $0.056 para I2V Standard, $0.098 para I2V Pro y start/end Pro, y $0.28 para cualquiera de los endpoints Master. Estas son las tarifas originales publicadas, no precios rebajados temporales, por lo que debes revisar la estimación actual de la solicitud antes de enviarla.
Envía primero la solicitud de generación; Atlas Cloud devolverá un ID de predicción en lugar del vídeo terminado. Consulta /api/v1/model/prediction/{prediction_id} hasta que el estado sea completed o succeeded y, después, lee la URL generada en outputs.
Proporciona image y end_image al endpoint de fotograma inicial/final junto con un prompt. Estos fotogramas límite guían la continuidad del movimiento y la transición a lo largo de la secuencia generada. Cada imagen debe cumplir los requisitos documentados de formato, tamaño de archivo y resolución.
No. Considera que una función mostrada en una aplicación de consumo de Kling no está disponible a través de esta familia de Atlas Cloud, salvo que aparezca en el esquema del endpoint seleccionado. Por ejemplo, los esquemas publicados para estos cinco endpoints no exponen controles Multi-Elements.
Primero, haz coincidir el ID del modelo, la imagen de origen, el prompt, el prompt negativo, la duración, guidance scale y la relación de aspecto cuando corresponda. Los esquemas publicados de Atlas Cloud no exponen ningún parámetro seed para estos endpoints, por lo que no se puede configurar una reproducción determinista exacta mediante los controles indicados.
Guías, tutoriales y novedades de producto para aprovechar al máximo Atlas Cloud.