
La API de LTX-2 lleva la familia de video de pesos abiertos de Lightricks a producción, generando video y audio sincronizado en una sola pasada. Crea a partir de texto, anima una imagen fija o extiende un clip existente, y cada resultado llega con sincronización labial, foley y sonido ambiente alineados. En Atlas Cloud accedes a ella mediante una única clave compatible con OpenAI, con precios transparentes de pago por uso y acceso Day-0. Empieza a construir hoy mismo.
Atlas Cloud le proporciona los últimos modelos creativos líderes en la industria.
Compara todas las modalidades de la API Ltx-2 en una sola vista: desde la generación guiada por prompt hasta la animación de imágenes estáticas y la continuación de clips existentes, cada una con audio sincronizado opcional.
| Modalidad | Descripción |
|---|---|
| Ltx-2 T2V API (texto a vídeo) | Proporciona un prompt de texto de hasta 2,000 caracteres y la API Ltx-2 devuelve un vídeo completamente renderizado, con audio sincronizado opcional cuando generate_audio está habilitado. La duración del clip escala de 25 a 257 fotogramas, y seis preajustes de resolución cubren salidas cuadradas, verticales 9:16 y horizontales 16:9. Este endpoint es adecuado para conceptos publicitarios, vídeos cortos para redes sociales y previsualizaciones de storyboard creadas íntegramente a partir de una descripción escrita, con una tarifa base estándar de $0.002. |
| Ltx-2 I2V API (imagen a vídeo) | Proporciona una imagen estática en jpg, png, webp, gif o avif junto con un prompt de movimiento, y este endpoint la anima para convertirla en un clip en movimiento con generación de audio opcional. Se aplican el mismo rango de 25 a 257 fotogramas y los seis preajustes de relación de aspecto, de modo que un único fotograma de origen se convierte en un vídeo horizontal o vertical. Fotografías de producto, retratos de personajes y arte conceptual son entradas naturales, todo con el precio base estándar de $0.002. |
| Ltx-2 Extend Video API | Cuando un clip existente necesita más duración, este endpoint lo continúa hacia delante o hacia atrás a partir de un archivo fuente mp4, mov, webm, m4v o gif proporcionado. Extiende las secuencias hasta 481 fotogramas, conserva el ritmo original mediante match_input_fps y puede añadir una capa de audio generado. Úsalo para alargar b-roll, crear escenas en bucle o unir cortes, facturado con la misma tarifa base de $0.002. |
La Ltx-2 API combina modos de generación desde texto, imagen y extensión con audio sincronizado nativo, recuentos de fotogramas controlables y seis presets de relación de aspecto, todo accesible mediante una única clave compatible con OpenAI y con precios transparentes de pago por uso.
Describe una escena en hasta 2,000 caracteres y la Ltx-2 API convierte texto puro en un clip con movimiento y sonido, sin requerir ningún recurso de referencia. Tu prompt controla el sujeto, el movimiento, la iluminación y el comportamiento de la cámara, mientras que una seed opcional fija el resultado para iteraciones repetibles. Como todo parte del lenguaje, es ideal para storyboards, propuestas de concepto y exploración creativa rápida cuando tienes una idea pero aún no tienes metraje.
Proporciona una sola imagen fija en jpg, png, webp, gif o avif y el modelo la anima en un video con audio coherente. El prompt guía cómo debe moverse el encuadre, desde un push-in lento hasta una escena de acción completa, mientras la composición original se mantiene intacta. Fotógrafos, diseñadores y equipos de producto usan esto para convertir una imagen hero en movimiento compartible sin volver a grabar nada.
Sube un clip existente y la Ltx-2 API lo continúa hacia delante o hacia atrás, generando hasta 481 fotogramas adicionales que heredan el estilo y el ritmo originales. La opción match_input_fps mantiene el nuevo metraje bloqueado a la frecuencia de fotogramas de la fuente, de modo que las uniones permanecen invisibles. Así es como las tomas cortas se convierten en secuencias de formato largo y como puedes rescatar una escena que terminó un instante demasiado pronto.
El recuento de fotogramas es totalmente controlable desde 25 hasta 257 frames en los modos de texto e imagen, siempre definido en múltiplos de ocho más uno para un muestreo limpio. Seis presets de resolución cubren HD cuadrado de 1024 por 1024, un cuadrado de 512, retrato 3:4, retrato 9:16, paisaje 4:3 y paisaje 16:9, de modo que un solo modelo sirve para cine, redes sociales y feeds verticales. Elige primero el formato y deja que una sola solicitud devuelva el recorte correcto.
Cada solicitud pasa por una única clave compatible con OpenAI en Atlas Cloud, con precios transparentes de pago por uso y sin suscripción. Envía una seed fija junto con el mismo prompt y el modelo devuelve el mismo clip, convirtiendo la generación impredecible en un paso controlable y versionable. El acceso Day-0 significa que las nuevas versiones de la Ltx-2 API se pueden invocar en cuanto se lanzan, para que los equipos puedan estandarizar un pipeline de video y escalarlo sin gestionar GPUs.
Envía un único prompt idéntico a la API de Ltx-2 y a dos de los modelos de vídeo más populares de Atlas Cloud; luego compara cómo gestiona cada uno el movimiento, el audio sincronizado y el detalle cinematográfico a partir de exactamente las mismas instrucciones.
Un curioso mono macaco corre entre la multitud de un mercado de especias de Marrakech durante la hora dorada y le arrebata a un comerciante un fez rojo brillante de un puesto. Salta sobre sacos abiertos de azafrán y pimentón, levantando remolinos de polvo naranja, luego se queda inmóvil en lo alto de un poste de toldo y mira hacia atrás justo cuando el comerciante, riendo, sale en su persecución. Abrir con un plano de seguimiento en contrapicado que avanza detrás del mono entre la multitud, hacer un barrido rápido hacia el rostro sorprendido del comerciante y luego elevarse hasta un amplio plano de grúa por encima de los puestos mientras el polvo brilla en la luz cálida. Estilo cinematográfico realista, poca profundidad de campo, etalonaje de colores terrosos intensos. Audio: animado murmullo del mercado, tintineo de latón y percusión rítmica de tambores de mano que crece durante la persecución. Relación de aspecto 16:9.
Generated with Ltx 2.3 Quality on Atlas Cloud
Generated with Veo3.1 on Atlas Cloud
Generated with Seedance 2.0 on Atlas Cloud
Una joven mensajera del cielo con una capa carmesí ondeante salta desde el borde de un templo de piedra flotante y cabalga una grulla mecánica de papel entre nubes de cañón, esquivando linternas luminosas a la deriva. Gira bruscamente alrededor de una aguja de roca irregular, atrapa una carta reluciente en el aire y luego se recoge en una pronunciada caída mientras un planeador rival irrumpe entre la niebla justo detrás de ella. Comenzar con un POV en primera persona sobre su hombro cuando la grulla despega, cortar a un plano de dron que corre junto al descenso y luego bajar a un plano en contrapicado desde abajo mientras ella sale de la caída hacia una luz solar cegadora. Estilo anime vibrante, con cel shading, paleta luminosa de hora mágica. Audio: viento a toda velocidad, aleteo de alas de papel y un crescendo orquestal de cuerdas sincronizado con la remontada. Relación de aspecto 16:9.
Generated with Ltx 2.3 Quality on Atlas Cloud
Generated with Veo3.1 on Atlas Cloud
Generated with Seedance 2.0 on Atlas Cloud
Desde prompts de texto e imagen hasta cortes extendidos y sonido sincronizado, la Ltx-2 API cubre todo el recorrido, del primer borrador a la entrega en 4K, para marketing, e-commerce y producción creativa.
Un único prompt escrito permite que la Ltx-2 API genere video 4K nativo con audio creado de forma integrada. Los estudios y equipos publicitarios convierten briefs de campaña en spots para redes sociales terminados, sin cámaras ni edición manual.
Sube una sola imagen fija y la generación image-to-video la pone en movimiento, preservando la composición original mientras añade movimientos de cámara realistas. Vendedores de e-commerce e ilustradores dan vida a catálogos y portfolios estáticos para feeds que detienen el scroll.
¿Necesitas una toma más larga? El endpoint extend-video añade fotogramas nuevos a un clip existente mientras mantiene la continuidad del movimiento, el estilo y el audio. Los creadores unen generaciones breves en narrativas fluidas que van más allá de una sola solicitud.
Cuando el sonido importa, la Ltx-2 API sintetiza diálogo, foley y audio ambiental en una sola pasada junto con las imágenes, sincronizados con el movimiento. Encaja en videos explicativos, tráileres y escenas que necesitan sonido en el momento justo.
Para la entrega final, la Ltx-2 API renderiza fotogramas 4K nativos con movimiento limpio y texturas nítidas, en lugar de previsualizaciones reescaladas. Agencias y estudios exportan masters listos para emisión directamente desde el endpoint a sus flujos de edición.
Como LTX-2 es un modelo abierto eficiente, los trabajos de alto volumen se ejecutan con precios transparentes de pago por uso, mientras cambias entre modos de rendimiento en cada solicitud. Los equipos de producto prototipan a bajo coste y luego aumentan la fidelidad para el lanzamiento.
Compara la API Ltx-2 con modelos de video similares basados en texto e imagen en Atlas Cloud según modos de generación, resolución, audio nativo, duración del clip y precio inicial.
| Modelo | Modos de generación | Resolución máxima | Audio sincronizado | Duración máxima del clip | Precio inicial |
|---|---|---|---|---|---|
| LTX-2.3 Quality Text-to-Video | Texto a video | Preajustes de 1024×1024 (16:9 predeterminado) | √ (interruptor opcional) | Hasta 257 fotogramas | $0.002 |
| LTX-2.3 Quality Image-to-Video | Imagen a video, extender | Preajustes de 1024×1024 (16:9 predeterminado) | √ (interruptor opcional) | Hasta 257 fotogramas | $0.002 |
| Seedance 2.0 Text-to-Video | Texto a video | Hasta 2K | √ nativo | 4 a 15 s | $0.112 |
| Veo 3.1 Text-to-Video | Texto a video | Hasta 4K | √ nativo | 8 s (ampliable) | $0.2 |
| Kling Video O3 4K Text-to-Video | Texto e imagen a video | 4K nativo (3840×2160) | √ nativo | 3 a 15 s | $0.42 |
Empieza en minutos — sigue estos sencillos pasos para integrar y desplegar modelos a través de la plataforma de Atlas Cloud.
Regístrate en atlascloud.ai y completa la verificación. Los nuevos usuarios reciben créditos gratuitos para explorar la plataforma y probar modelos.
Combina modelos avanzados de Ltx-2 con la plataforma acelerada por GPU de Atlas Cloud, proporcionando rendimiento, escalabilidad y experiencia de desarrollo incomparables.
Baja Latencia:
Inferencia optimizada por GPU para respuestas en tiempo real.
API Unificada:
Una sola integración para acceder a Ltx-2, GPT, Gemini y DeepSeek.
Precios Transparentes:
Facturación por Token, soporta modo Serverless.
Experiencia del Desarrollador:
SDK, análisis de datos, herramientas de ajuste fino y plantillas todo en uno.
Confiabilidad:
99.99% de disponibilidad, control de permisos RBAC, registros de cumplimiento.
Seguridad y Cumplimiento:
Certificación SOC 2 Type II, cumplimiento HIPAA, soberanía de datos en EE.UU.
La Ltx-2 API ofrece a los desarrolladores acceso programático a LTX-2, el modelo fundacional de audio y vídeo con pesos abiertos de Lightricks. Convierte prompts de texto o imagen en vídeo y audio sincronizados en una sola pasada de generación, y en Atlas Cloud se accede a través de un único endpoint compatible con OpenAI, con precios de pago por uso.
LTX-2 cubre text-to-video, image-to-video y extensión de clips, de modo que puedes convertir una escena escrita en movimiento, animar una imagen estática o alargar una toma que ya tengas. Todos los modos pueden renderizar audio acompañante, por lo que encaja bien en cortometrajes, anuncios, demos de producto y contenido para redes sociales.
Sí. El audio y el vídeo se generan en una sola pasada sincronizada, en lugar de unirse después, e incluyen sincronización labial de diálogos, efectos de sonido y sonido ambiental. En Atlas Cloud se activa con el parámetro generate_audio, que está desactivado de forma predeterminada.
El modelo LTX-2 alcanza de forma nativa hasta resolución 4K a un máximo de 50 fps, con clips de hasta 20 segundos a velocidades de 24, 25, 48 y 50 fotogramas por segundo. En Atlas Cloud, los endpoints de calidad te permiten elegir la relación de aspecto y definir la duración del clip mediante un recuento de fotogramas entre 25 y 257 frames.
Envía una solicitud estándar al endpoint de Atlas Cloud con tu prompt, un modelo como ltx-2.3-quality/text-to-video, una relación de aspecto, un recuento de fotogramas y una seed opcional para obtener resultados reproducibles. Como el endpoint es compatible con OpenAI, una sola clave funciona tanto con la Ltx-2 API como con cualquier otro modelo de la plataforma, por lo que la integración suele llevar solo unos minutos.
Por supuesto. El modelo ltx-2.3-quality/extend-video continúa un clip LTX-2 existente manteniendo la coherencia del movimiento y del audio más allá de la duración original. Esto ayuda cuando una sola generación se queda por debajo de la duración que realmente necesita una escena.
LTX-2 se distribuye con pesos abiertos y es lo bastante eficiente como para ejecutarse en GPUs de consumo, así que el self-hosting es una opción real. Si prefieres evitar el aprovisionamiento de GPUs, la gestión de colas y el escalado, la API alojada ofrece el mismo modelo sin infraestructura que mantener.
Atlas Cloud factura la Ltx-2 API bajo un modelo de pago por uso, con precios transparentes por llamada y sin suscripción ni compromiso mínimo. Pagas solo por lo que generas, y la misma clave te da acceso Day-0 a nuevos lanzamientos de modelos. Empieza a crear hoy mismo.
LTX-2.3 es la iteración actual de la familia LTX-2 y la versión que Atlas Cloud ofrece a través de sus endpoints de calidad para text-to-video, image-to-video y extend-video. Mejora la versión original manteniendo el mismo enfoque de audio y vídeo sincronizados, de modo que obtienes la calidad más reciente sin cambiar la forma de llamar al modelo.