Hero background 1Hero background 2Hero background 3

HappyHorse 1.1 Multi Image Video Generation

HappyHorse 1.1 es la familia de generación de vídeo de Alibaba para desarrolladores que trabajan a partir de texto, fotogramas de origen o referencias visuales. Convierte las indicaciones en clips, anima un primer fotograma elegido con orientación opcional y puede utilizar de una a nueve imágenes de referencia para proporcionar una dirección visual precisa. Atlas Cloud integra estos flujos de trabajo en una única integración con precios transparentes de pago por uso. Empieza a crear hoy mismo.

Happyhorse 1.1 ha sido desarrollado por Alibaba. Atlas Cloud (operado por Atlas Cloud AI LLC) proporciona acceso al modelo, pero no es su propietario. Todas las marcas comerciales pertenecen a sus respectivos titulares.

Explorar Modelos Líderes

Atlas Cloud le proporciona los últimos modelos creativos líderes en la industria.

Comparación de los modos de generación de vídeo de HappyHorse 1.1

Elige entre entradas de texto, imagen o referencias según cómo quieras dirigir cada vídeo.

ModalidadDescripción
HappyHorse 1.1 T2V API (Text to Video)Convierte prompts de texto en vídeos de 480P, 720P o 1080P, con relaciones de aspecto flexibles y duraciones de entre 3 y 15 segundos. Usa este endpoint para visualizar conceptos, crear contenido para redes sociales y producir vídeos sin una imagen de origen.
HappyHorse 1.1 I2V API (Image to Video)A partir de una imagen del primer fotograma, este endpoint crea un vídeo de entre 3 y 15 segundos, con orientación opcional mediante prompts y salida de 480P, 720P o 1080P. Es adecuado para animaciones de productos, movimiento de personajes y narrativas visuales basadas en una composición existente.
HappyHorse 1.1 R2V API (Reference to Video)Guía la generación de vídeos con entre una y nueve imágenes de referencia, además de un prompt de texto, y permite seleccionar una salida de 480P, 720P o 1080P, relaciones de aspecto flexibles y una duración de entre 3 y 15 segundos. Elígelo para escenas guiadas por referencias, clips centrados en personajes y proyectos que requieran una dirección visual más precisa.

Tres entradas, un kit HappyHorse 1.1

HappyHorse 1.1 convierte prompts, primeros fotogramas o hasta nueve imágenes de referencia en videos de 3 a 15 segundos, con salida en 480P, 720P y 1080P, nueve relaciones de aspecto para los modos de texto y referencia, control de seed y acceso de pago por uso a través de Atlas Cloud.

HappyHorse 1.1 Text-to-Video

Comienza con un prompt de hasta 2,500 caracteres y genera un clip completo sin una imagen de entrada. HappyHorse 1.1 admite salida en 480P, 720P o 1080P y permite establecer una duración de 3 a 15 segundos. Elige entre nueve relaciones de aspecto para entregas panorámicas, verticales, cuadradas, de retrato o ultrapanorámicas. Este flujo de trabajo es ideal para visualizar conceptos, crear anuncios y producir escenas narrativas breves.

Animación del primer fotograma

Convierte una imagen del primer fotograma en movimiento, con un prompt opcional que guía la acción, el estilo o los detalles de la escena. El endpoint image-to-video acepta archivos JPEG, JPG, PNG o WEBP de hasta 20 MB, con ambas dimensiones de al menos 300 píxeles. Selecciona 480P, 720P o 1080P y una duración de 3 a 15 segundos. Es ideal para tomas de producto, retratos y fotogramas clave de storyboards.

HappyHorse 1.1 Reference Control

Guía un video nuevo con entre una y nueve imágenes de referencia, además de un prompt de texto obligatorio. Cada referencia JPEG, JPG, PNG o WEBP puede tener hasta 20 MB, y su lado más corto debe medir al menos 400 píxeles. Configura la resolución, la duración, la relación de aspecto y el seed de salida. Este modo proporciona a los flujos de trabajo de dirección de personajes, productos y arte más material de origen con el que trabajar.

Formatos para cualquier destino

Adapta cada generación basada en texto o referencias a su destino con nueve relaciones de aspecto: 16:9, 9:16, 1:1, 4:3, 3:4, 4:5, 5:4, 9:21 y 21:9. La resolución abarca 480P, 720P y 1080P, mientras que la duración va de 3 a 15 segundos. Combina estos controles para producir clips para feeds móviles, reproductores web, ubicaciones cuadradas, retratos o composiciones ultrapanorámicas sin cambiar los endpoints.

Control de seed de HappyHorse 1.1

Usa el parámetro seed junto con la configuración del prompt, la resolución, la relación de aspecto y la duración cuando necesites un control más preciso de las entradas de generación. HappyHorse 1.1 acepta valores de seed desde -1 hasta 2,147,483,647, donde -1 solicita un seed aleatorio. Mantén explícita el resto de la configuración mientras iteras. Este flujo de trabajo parametrizado ayuda a los desarrolladores a organizar las pruebas creativas y comparar variaciones con una estructura de solicitud coherente.

Una clave, tres flujos de trabajo

Accede a los tres flujos de trabajo de HappyHorse 1.1 a través de Atlas Cloud con una única clave compatible con OpenAI y facturación de pago por uso. La tarifa estándar comienza en $0.07 por segundo, y la facturación escala según el uso en lugar de depender de una suscripción. Cambia entre las rutas de modelo text-to-video, image-to-video y reference-to-video manteniendo el mismo patrón de integración. Esta configuración es adecuada para desarrolladores que crean productos de video multimodales sin cuentas independientes de distintos proveedores.

HappyHorse 1.1 en un enfrentamiento de prompts entre tres modelos

Descubre cómo HappyHorse 1.1 y otros dos modelos de vídeo comparables interpretan los mismos prompts en relatos de acción cinematográfica y fantasía estilizada.

Prompt

Una secuencia continua de 8–10 segundos, fotorrealista y de cine gastronómico cinético, a bordo de un coche comedor que atraviesa a toda velocidad una violenta ventisca alpina. Un chef de tren experto se balancea de forma natural con el brutal movimiento lateral del vagón mientras prepara el desayuno: lanza al aire un crepe fino y dorado con una mano, se desliza por el estrecho pasillo para atrapar una naranja que rueda con la mano libre y, después, golpea el crepe descendente con el borde de la sartén, proyectándolo en un arco limpio y físicamente preciso a través de una puerta abierta entre coches. Comenzar con un primerísimo primer plano que siga lateralmente las rugientes llamas del fogón, la masa chisporroteante y las gotas de mantequilla caliente salpicando el acero pulido; pasar rápidamente a una media órbita alrededor del chef mientras compensa cada sacudida, con el abrigo y el delantal reaccionando de forma realista; después, atravesar velozmente la puerta en un plano de seguimiento preciso fijado al crepe en el aire mientras cruza el conector flexible hacia el siguiente coche, pasa por poco junto a un camarero y aterriza perfectamente en el plato de desayuno de un pasajero sorprendido. En el instante exacto del aterrizaje, una enorme avalancha irrumpe junto a las ventanas mientras el tren escapa de ella, creando un clímax visual contundente. Las lámparas de tungsteno cálido y la luz anaranjada del fuego chocan con el amanecer azul gélido que entra por las ventanas surcadas de nieve; tonos gastronómicos en capas de naranja y dorado, metal gris plateado y naturaleza salvaje azul fría; perspectiva central profunda y estrecha, marcos de puertas repetidos dentro de otros marcos, fuerte paralaje, vibración sutil de cámara en mano, nitidez de movimiento, continuidad impecable del sujeto y coherencia espacial entre ambos coches, equilibrio realista, salpicaduras fluidas, inercia de las telas, colisiones y física precisa de los proyectiles. Diseño sonoro sincronizado: el traqueteo de los raíles y los crujidos del coche establecen el ritmo, el siseo de la sartén y los estallidos de la mantequilla lo aceleran, la naranja rueda sincronizada con clics metálicos, el golpe de la sartén cae como un brillante pulso percusivo, seguido por el suave golpe del plato y el rugido atronador de la avalancha; sin cámara lenta, sin relleno estático, sin pantallas, interfaces, paneles de control, barras de progreso, gráficos, textos superpuestos, subtítulos, logotipos ni texto visible. Realismo cinematográfico premium, anuncio gastronómico dinámico, ilusión inmersiva de una sola toma, relación de aspecto 16:9.

Generated with HappyHorse-1.1 Text-to-video on Atlas Cloud

Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud

Generated with HappyHorse-1.0 Text-to-video on Atlas Cloud

Prompt

Una secuencia de acción animada en 3D de 9 segundos, gráfica y de alta saturación, en una terminal de contenedores al anochecer: un piano de cola rojo coral se suelta y se precipita por una rampa de carga de acero, con sus pequeñas ruedas giratorias traqueteando y rebotando bajo un peso convincente, mientras un conductor de carretilla elevadora con un mono azul cobalto lo persigue a toda velocidad, zigzagueando entre grúas amarillo mostaza y contenedores marítimos que suben y bajan constantemente, formando durante unos instantes un corredor de emergencia cambiante. Comenzar con un plano de seguimiento extremadamente bajo, a pocos centímetros de la rueda giratoria y de la pata del piano que se sacude violentamente, con chispas e impactos metálicos perfectamente sincronizados con el sonido; elevar rápidamente la cámara hasta una vista cenital que revele la ruta de la persecución como un laberinto geométrico de bloques de color rojo coral, azul cobalto y amarillo mostaza; después, realizar un whip-pan y orbitar hacia el frontal de la carretilla elevadora a toda velocidad mientras acorta distancias. En el borde del muelle, el conductor introduce las horquillas bajo el piano, eleva su pesado cuerpo en el último instante, gira con una rotación enérgica y lo deposita de forma segura con un profundo clang sincronizado. La tapa se abre de golpe por la inercia; en el último pulso, una gaviota se posa sobre las teclas y toca una última nota nítida. Movimiento continuo de alta densidad, impulso físicamente creíble, colisiones, rebote de la suspensión, cargas cambiantes y una identidad estable de personajes y objetos durante toda la secuencia; sombras marcadas, composición geométrica audaz, animación 3D cinematográfica estilizada, intensa luz de contorno del crepúsculo, percusión industrial rítmica construida a partir del traqueteo de las ruedas, siseos hidráulicos, impactos de contenedores, esfuerzo del motor, aleteos de la gaviota y la nota final del piano. Sin cámara lenta, sin planos inactivos, sin cortes que rompan la continuidad espacial, sin pantallas, interfaces de software, paneles de control, barras de progreso, gráficos, textos superpuestos, etiquetas, logotipos, marcas de agua ni texto explicativo. Relación de aspecto 16:9.

Generated with HappyHorse-1.1 Text-to-video on Atlas Cloud

Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud

Generated with HappyHorse-1.0 Text-to-video on Atlas Cloud

HappyHorse 1.1 en flujos de trabajo creativos

Desde conceptos de campaña y animación de productos hasta vídeos de marca guiados por referencias y herramientas para desarrolladores, HappyHorse 1.1 convierte prompts e imágenes en contenido de vídeo corto adaptable.

Conceptos de campaña con HappyHorse 1.1

Convierte conceptos escritos en vídeos a 480P, 720P o 1080P con relaciones de aspecto flexibles. Los equipos creativos pueden producir conceptos de campaña, publicaciones para redes sociales y propuestas narrativas sin metraje de origen ni rodaje.

Imágenes estáticas en movimiento

Comienza con una imagen del primer fotograma y guía su animación con un prompt opcional durante entre 3 y 15 segundos. Los responsables de marketing de producto pueden convertir recursos estáticos en clips de lanzamiento, vídeos para escaparates o animaciones para catálogos.

Variaciones de marca guiadas por referencias

A partir de una a nueve imágenes de referencia, el modelo crea vídeos basados en los recursos visuales proporcionados, hasta 1080P. Los equipos de marca pueden desarrollar variaciones de campaña guiadas por imágenes aprobadas de personajes, productos o entornos.

Flujos de contenido multiformato

Elige relaciones de aspecto flexibles y tres niveles de resolución para preparar clips destinados a distintas ubicaciones a partir de un único flujo de generación. Los desarrolladores pueden ofrecer formatos verticales, horizontales y otras composiciones en productos de contenido y campañas.

Planificación de clips con HappyHorse 1.1

¿Necesitas una escena rápida para un storyboard o un momento de producto más largo? Las duraciones de entre 3 y 15 segundos permiten que las herramientas creativas admitan conceptos rápidos, clips promocionales y secuencias visuales concisas en una única interfaz.

Entradas flexibles para aplicaciones de vídeo

Crea aplicaciones de vídeo en torno a texto, imágenes del primer fotograma y entradas con múltiples referencias mediante una única familia de modelos. Los usuarios pueden elegir el material inicial que mejor se adapte a la ideación, la animación o la creación guiada por la marca en cada flujo de trabajo.

Qué tal se desempeña HappyHorse 1.1 para la generación de video

Compara los modos de generación de HappyHorse 1.1 con los principales modelos de video de Atlas Cloud según las entradas compatibles, la duración del clip, la resolución, la capacidad de referencias y el precio base indicado.

ModeloEntradas compatiblesDuración de salidaResoluciónMáximo de imágenes de referenciaPrecio base indicado
HappyHorse-1.1 Text-to-videoPrompt de textoDe 3 a 15 segundos480P, 720P, 1080P-$0.07, unidad no indicada
HappyHorse-1.1 Image-to-videoImagen del primer fotograma y prompt opcionalDe 3 a 15 segundos480P, 720P, 1080P-$0.07, unidad no indicada
HappyHorse-1.1 Reference-to-videoPrompt de texto e imágenes de referenciaDe 3 a 15 segundos480P, 720P, 1080P9$0.07, unidad no indicada
Wan-3.0 Reference-to-videoReferencias de texto, imagen, video, audio, documento o página webDe 2 a 30 segundos o duración inteligente480P, 720P, 1080P10$0.05, unidad no indicada
Seedance 2.5 Reference-to-VideoReferencias de texto, imagen, video y audioHasta 30 segundos-30$0.167, unidad no indicada
MiniMax H3 Reference-to-VideoReferencias de texto, imagen, video y audioDe 4 a 15 segundos768p predeterminada, hasta 2K9$0.038/segundo

Cómo usar Happyhorse 1.1 en Atlas Cloud

Empieza en minutos — sigue estos sencillos pasos para integrar y desplegar modelos a través de la plataforma de Atlas Cloud.

Crea una cuenta en Atlas Cloud

Regístrate en atlascloud.ai y completa la verificación. Los nuevos usuarios reciben créditos gratuitos para explorar la plataforma y probar modelos.

Por Qué Usar Happyhorse 1.1 en Atlas Cloud

Combina modelos avanzados de Happyhorse 1.1 con la plataforma acelerada por GPU de Atlas Cloud, proporcionando rendimiento, escalabilidad y experiencia de desarrollo incomparables.

Rendimiento y Flexibilidad

Baja Latencia:
Inferencia optimizada por GPU para respuestas en tiempo real.

API Unificada:
Una sola integración para acceder a Happyhorse 1.1, GPT, Gemini y DeepSeek.

Precios Transparentes:
Facturación por Token, soporta modo Serverless.

Empresa y Escala

Experiencia del Desarrollador:
SDK, análisis de datos, herramientas de ajuste fino y plantillas todo en uno.

Confiabilidad:
99.99% de disponibilidad, control de permisos RBAC, registros de cumplimiento.

Seguridad y Cumplimiento:
Certificación SOC 2 Type II, cumplimiento HIPAA, soberanía de datos en EE.UU.

Construye con HappyHorse 1.1: preguntas frecuentes

HappyHorse 1.1 es un modelo de generación de vídeo de Alibaba disponible en Atlas Cloud para convertir texto, un primer fotograma o imágenes de referencia en clips de vídeo cortos. La familia ofrece endpoints independientes de texto a vídeo, imagen a vídeo y referencia a vídeo.

Puedes generar una escena a partir de un prompt de texto, animar una imagen fija o guiar un clip nuevo con varias referencias visuales. Estos flujos abarcan vídeos generados solo con prompts, animaciones del primer fotograma y contenido guiado por referencias.

Crea una clave de API de Atlas Cloud y envía una solicitud POST autenticada a /api/v1/model/generateVideo con el ID del modelo elegido y las entradas obligatorias. La respuesta incluye un ID de tarea que puedes usar para consultar el estado de la predicción hasta que el resultado esté listo.

Selecciona alibaba/happyhorse-1.1/text-to-video para la generación basada en prompts, alibaba/happyhorse-1.1/image-to-video para animar el primer fotograma o alibaba/happyhorse-1.1/reference-to-video para la guía mediante varias imágenes. Cada modo tiene su propio esquema de entrada.

Para text-to-video y reference-to-video, puedes elegir 480p, 720p o 1080p, una duración de 3 a 15 segundos y una de las nueve relaciones de aspecto compatibles. Image-to-video ofrece los mismos intervalos de resolución y duración, y utiliza la imagen subida como primer fotograma.

Reference-to-video acepta de una a nueve URL de imágenes, además de un prompt que describe cómo deben guiar las imágenes el resultado. Se admiten archivos JPEG, JPG, PNG y WEBP, con un límite de 20 MB por imagen y un lado menor mínimo de 400 píxeles.

Atlas Cloud establece un precio estándar de $0.07 por segundo para cada uno de los tres endpoints de HappyHorse 1.1. La facturación es de pago por uso, por lo que el coste de generación aumenta según la duración solicitada del clip.

Usa el parámetro seed en text-to-video o reference-to-video cuando quieras controlar la aleatoriedad de la generación. Atlas Cloud acepta valores enteros explícitos o -1 cuando prefieras una seed aleatoria.

Cada solicitud produce un clip de entre 3 y 15 segundos. Image-to-video utiliza una imagen como primer fotograma, mientras que reference-to-video acepta como máximo nueve imágenes de referencia.

Explorar Más Series

Seedance 2.5

¡La API de Seedance 2.5 ya está disponible en Atlas Cloud! Ofrece a los desarrolladores el modelo de video más reciente de ByteDance. Genera hasta 30 segundos de video nativo en una sola pasada a partir de texto, una sola imagen o hasta 50 referencias multimodales, con audio sincronizado y texto multilingüe en el encuadre. En Atlas Cloud puede acceder a él mediante una única clave, con consistencia del sujeto y físicas mejoradas que mantienen la coherencia en las tomas largas.

Ver Serie

Wan 3.0

La API Wan 3.0 es la próxima generación de la familia de videos Wan de Alibaba, diseñada para llevar la generación de formato largo, el control de múltiples referencias y la calidad audiovisual a nuevas alturas. Atlas Cloud ya aloja Wan 2.7, 2.6 y 2.5, y Wan 3.0 se ejecuta con la misma clave unificada sin necesidad de configuración adicional. Empieza a construir hoy mismo. Desplázate hacia abajo hasta la galería para ver lo que Wan 3.0 puede crear.

Ver Serie

MiniMax H3

MiniMax H3 es la familia de vídeo multimodal de MiniMax para la creación guiada por texto, imagen y referencias. En las rutas compatibles, conserva los sujetos del material de referencia, ofrece relaciones de aspecto flexibles y combina el sonido generado con los elementos visuales mediante H3 Developer, con perfiles de salida seleccionados según el endpoint. Atlas Cloud reúne toda la familia bajo una única clave compatible con OpenAI, con precios transparentes de pago por uso a partir de la tarifa estándar de $0.038 por segundo. Empieza a crear hoy mismo.

Ver Serie

Seedream 5.0 Pro

La API de Seedream 5.0 Pro ofrece a los desarrolladores el modelo de edición de imágenes controlable de ByteDance en Atlas Cloud. Sitúa las ediciones con precisión mediante anclajes y coordenadas, separa las imágenes en capas editables, fusiona múltiples referencias y empareja colores y materiales exactos, con texto multilingüe a 2K y 3K. ¡En Atlas Cloud puede acceder a él mediante una sola clave!

Ver Serie

Seedance 2.0

Seedance 2.0 es el modelo de vídeo para producción de ByteDance, diseñado para crear planos con precisión. Convierte prompts en vídeo, anima una imagen del primer fotograma con orientación opcional del último fotograma o da forma a los resultados mediante medios de referencia y búsqueda web opcional. Atlas Cloud reúne estos flujos de trabajo en una única API unificada, con precios transparentes de pago por uso y una sola clave compatible con OpenAI. Empieza a crear hoy mismo.

Ver Serie

GPT Image 2.5

La familia gpt-image-2.5 de OpenAI ofrece a los desarrolladores la posibilidad de elegir entre Flare y Sunburst para flujos de trabajo de producción de imágenes. Renderiza con resoluciones arbitrarias de hasta 3840x2160 y elige entre cinco niveles de calidad, incluidos xhigh y max, para adaptarte a requisitos de salida específicos. Atlas Cloud proporciona inferencia REST lista para usar, sin arranques en frío y con precios estándar desde $0.004 por generación. Empieza a crear hoy mismo.

Ver Serie

GPT Image 2

La API de GPT Image 2 ofrece a los desarrolladores acceso al último modelo de imágenes de OpenAI, el sucesor de GPT Image 1.5. Genera y edita imágenes con una representación de texto precisa en caracteres latinos y CJK, además de una sólida composición para carteles, maquetas e infografías. En Atlas Cloud, puede acceder a ella a través de una API unificada junto con más de 300 modelos, con créditos gratuitos, un tiempo de actividad del 99,99% y sin necesidad de verificación de organización de OpenAI.

Ver Serie

Gemini Omni Flash

Gemini Omni es la familia de vídeo nativamente multimodal de Google DeepMind para la creación y edición guiadas por prompts. Genera vídeos a partir de texto, anima imágenes estáticas o modifica metraje existente con referencias visuales opcionales, preservando el contenido que no se haya modificado. Los controles flexibles de resolución, relación de aspecto y duración permiten adaptarse a diversos flujos de producción. Atlas Cloud unifica el acceso con precios transparentes de pago por uso. Empieza a crear hoy mismo.

Ver Serie

Grok Imagine

La API Grok Imagine cubre los modelos de imagen, video y voz de xAI, desde Image 2.0 hasta Video 1.5 y xAI TTS v1. Genera imágenes de 1K o 2K en 14 relaciones de aspecto, expande una escena a 15 segundos de movimiento en 1080p, controla tomas con hasta 7 imágenes de referencia, o nárralas en 20 idiomas. Atlas Cloud ejecuta todos los modos en un endpoint, con precios de pago por uso desde $0.02 por imagen y $0.05 por segundo. Empieza a construir hoy.

Ver Serie

Google

Los modelos creativos más potentes de Google están todos disponibles en Atlas Cloud. Veo 3.1 ofrece generación de video cinematográfico, Nano Banana 2 impulsa la creación de imágenes de alta fidelidad y Gemini aporta inteligencia multimodal a cada flujo de trabajo. Acceda a la suite completa de modelos de Google a través de una sola API key con disponibilidad Day-0 y precios de pago por uso (pay-as-you-go).

Ver Serie

Seedance 2.0 Mini

Seedance 2.0 Mini lleva la generación de video multimodal de ByteDance a los flujos de trabajo donde la velocidad y el costo son más importantes. Ofrece las capacidades principales de Seedance 2.0 con un menor consumo de recursos: generación más rápida, menor costo por video y la misma integración de API que ya utiliza. Para los equipos que ejecutan pipelines de alto volumen o crean prototipos a escala, Mini es la opción predeterminada práctica.

Ver Serie

ByteDance

Desde la generación de video cinematográfico hasta la creación de imágenes de alta fidelidad, los modelos más potentes de ByteDance están disponibles en Atlas Cloud. Ejecute Seedance y Seedream a gran escala con los precios de inferencia más bajos y cero gastos generales de infraestructura.

Ver Serie

Una sola API para toda la IA multimedia.

Explorar Todos los Modelos