


HappyHorse 1.1 es la familia de generación de vídeo de Alibaba para desarrolladores que trabajan a partir de texto, fotogramas de origen o referencias visuales. Convierte las indicaciones en clips, anima un primer fotograma elegido con orientación opcional y puede utilizar de una a nueve imágenes de referencia para proporcionar una dirección visual precisa. Atlas Cloud integra estos flujos de trabajo en una única integración con precios transparentes de pago por uso. Empieza a crear hoy mismo.
Happyhorse 1.1 ha sido desarrollado por Alibaba. Atlas Cloud (operado por Atlas Cloud AI LLC) proporciona acceso al modelo, pero no es su propietario. Todas las marcas comerciales pertenecen a sus respectivos titulares.
Atlas Cloud le proporciona los últimos modelos creativos líderes en la industria.
Elige entre entradas de texto, imagen o referencias según cómo quieras dirigir cada vídeo.
| Modalidad | Descripción |
|---|---|
| HappyHorse 1.1 T2V API (Text to Video) | Convierte prompts de texto en vídeos de 480P, 720P o 1080P, con relaciones de aspecto flexibles y duraciones de entre 3 y 15 segundos. Usa este endpoint para visualizar conceptos, crear contenido para redes sociales y producir vídeos sin una imagen de origen. |
| HappyHorse 1.1 I2V API (Image to Video) | A partir de una imagen del primer fotograma, este endpoint crea un vídeo de entre 3 y 15 segundos, con orientación opcional mediante prompts y salida de 480P, 720P o 1080P. Es adecuado para animaciones de productos, movimiento de personajes y narrativas visuales basadas en una composición existente. |
| HappyHorse 1.1 R2V API (Reference to Video) | Guía la generación de vídeos con entre una y nueve imágenes de referencia, además de un prompt de texto, y permite seleccionar una salida de 480P, 720P o 1080P, relaciones de aspecto flexibles y una duración de entre 3 y 15 segundos. Elígelo para escenas guiadas por referencias, clips centrados en personajes y proyectos que requieran una dirección visual más precisa. |
HappyHorse 1.1 convierte prompts, primeros fotogramas o hasta nueve imágenes de referencia en videos de 3 a 15 segundos, con salida en 480P, 720P y 1080P, nueve relaciones de aspecto para los modos de texto y referencia, control de seed y acceso de pago por uso a través de Atlas Cloud.
Comienza con un prompt de hasta 2,500 caracteres y genera un clip completo sin una imagen de entrada. HappyHorse 1.1 admite salida en 480P, 720P o 1080P y permite establecer una duración de 3 a 15 segundos. Elige entre nueve relaciones de aspecto para entregas panorámicas, verticales, cuadradas, de retrato o ultrapanorámicas. Este flujo de trabajo es ideal para visualizar conceptos, crear anuncios y producir escenas narrativas breves.
Convierte una imagen del primer fotograma en movimiento, con un prompt opcional que guía la acción, el estilo o los detalles de la escena. El endpoint image-to-video acepta archivos JPEG, JPG, PNG o WEBP de hasta 20 MB, con ambas dimensiones de al menos 300 píxeles. Selecciona 480P, 720P o 1080P y una duración de 3 a 15 segundos. Es ideal para tomas de producto, retratos y fotogramas clave de storyboards.
Guía un video nuevo con entre una y nueve imágenes de referencia, además de un prompt de texto obligatorio. Cada referencia JPEG, JPG, PNG o WEBP puede tener hasta 20 MB, y su lado más corto debe medir al menos 400 píxeles. Configura la resolución, la duración, la relación de aspecto y el seed de salida. Este modo proporciona a los flujos de trabajo de dirección de personajes, productos y arte más material de origen con el que trabajar.
Adapta cada generación basada en texto o referencias a su destino con nueve relaciones de aspecto: 16:9, 9:16, 1:1, 4:3, 3:4, 4:5, 5:4, 9:21 y 21:9. La resolución abarca 480P, 720P y 1080P, mientras que la duración va de 3 a 15 segundos. Combina estos controles para producir clips para feeds móviles, reproductores web, ubicaciones cuadradas, retratos o composiciones ultrapanorámicas sin cambiar los endpoints.
Usa el parámetro seed junto con la configuración del prompt, la resolución, la relación de aspecto y la duración cuando necesites un control más preciso de las entradas de generación. HappyHorse 1.1 acepta valores de seed desde -1 hasta 2,147,483,647, donde -1 solicita un seed aleatorio. Mantén explícita el resto de la configuración mientras iteras. Este flujo de trabajo parametrizado ayuda a los desarrolladores a organizar las pruebas creativas y comparar variaciones con una estructura de solicitud coherente.
Accede a los tres flujos de trabajo de HappyHorse 1.1 a través de Atlas Cloud con una única clave compatible con OpenAI y facturación de pago por uso. La tarifa estándar comienza en $0.07 por segundo, y la facturación escala según el uso en lugar de depender de una suscripción. Cambia entre las rutas de modelo text-to-video, image-to-video y reference-to-video manteniendo el mismo patrón de integración. Esta configuración es adecuada para desarrolladores que crean productos de video multimodales sin cuentas independientes de distintos proveedores.
Descubre cómo HappyHorse 1.1 y otros dos modelos de vídeo comparables interpretan los mismos prompts en relatos de acción cinematográfica y fantasía estilizada.
Una secuencia continua de 8–10 segundos, fotorrealista y de cine gastronómico cinético, a bordo de un coche comedor que atraviesa a toda velocidad una violenta ventisca alpina. Un chef de tren experto se balancea de forma natural con el brutal movimiento lateral del vagón mientras prepara el desayuno: lanza al aire un crepe fino y dorado con una mano, se desliza por el estrecho pasillo para atrapar una naranja que rueda con la mano libre y, después, golpea el crepe descendente con el borde de la sartén, proyectándolo en un arco limpio y físicamente preciso a través de una puerta abierta entre coches. Comenzar con un primerísimo primer plano que siga lateralmente las rugientes llamas del fogón, la masa chisporroteante y las gotas de mantequilla caliente salpicando el acero pulido; pasar rápidamente a una media órbita alrededor del chef mientras compensa cada sacudida, con el abrigo y el delantal reaccionando de forma realista; después, atravesar velozmente la puerta en un plano de seguimiento preciso fijado al crepe en el aire mientras cruza el conector flexible hacia el siguiente coche, pasa por poco junto a un camarero y aterriza perfectamente en el plato de desayuno de un pasajero sorprendido. En el instante exacto del aterrizaje, una enorme avalancha irrumpe junto a las ventanas mientras el tren escapa de ella, creando un clímax visual contundente. Las lámparas de tungsteno cálido y la luz anaranjada del fuego chocan con el amanecer azul gélido que entra por las ventanas surcadas de nieve; tonos gastronómicos en capas de naranja y dorado, metal gris plateado y naturaleza salvaje azul fría; perspectiva central profunda y estrecha, marcos de puertas repetidos dentro de otros marcos, fuerte paralaje, vibración sutil de cámara en mano, nitidez de movimiento, continuidad impecable del sujeto y coherencia espacial entre ambos coches, equilibrio realista, salpicaduras fluidas, inercia de las telas, colisiones y física precisa de los proyectiles. Diseño sonoro sincronizado: el traqueteo de los raíles y los crujidos del coche establecen el ritmo, el siseo de la sartén y los estallidos de la mantequilla lo aceleran, la naranja rueda sincronizada con clics metálicos, el golpe de la sartén cae como un brillante pulso percusivo, seguido por el suave golpe del plato y el rugido atronador de la avalancha; sin cámara lenta, sin relleno estático, sin pantallas, interfaces, paneles de control, barras de progreso, gráficos, textos superpuestos, subtítulos, logotipos ni texto visible. Realismo cinematográfico premium, anuncio gastronómico dinámico, ilusión inmersiva de una sola toma, relación de aspecto 16:9.
Generated with HappyHorse-1.1 Text-to-video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Generated with HappyHorse-1.0 Text-to-video on Atlas Cloud
Una secuencia de acción animada en 3D de 9 segundos, gráfica y de alta saturación, en una terminal de contenedores al anochecer: un piano de cola rojo coral se suelta y se precipita por una rampa de carga de acero, con sus pequeñas ruedas giratorias traqueteando y rebotando bajo un peso convincente, mientras un conductor de carretilla elevadora con un mono azul cobalto lo persigue a toda velocidad, zigzagueando entre grúas amarillo mostaza y contenedores marítimos que suben y bajan constantemente, formando durante unos instantes un corredor de emergencia cambiante. Comenzar con un plano de seguimiento extremadamente bajo, a pocos centímetros de la rueda giratoria y de la pata del piano que se sacude violentamente, con chispas e impactos metálicos perfectamente sincronizados con el sonido; elevar rápidamente la cámara hasta una vista cenital que revele la ruta de la persecución como un laberinto geométrico de bloques de color rojo coral, azul cobalto y amarillo mostaza; después, realizar un whip-pan y orbitar hacia el frontal de la carretilla elevadora a toda velocidad mientras acorta distancias. En el borde del muelle, el conductor introduce las horquillas bajo el piano, eleva su pesado cuerpo en el último instante, gira con una rotación enérgica y lo deposita de forma segura con un profundo clang sincronizado. La tapa se abre de golpe por la inercia; en el último pulso, una gaviota se posa sobre las teclas y toca una última nota nítida. Movimiento continuo de alta densidad, impulso físicamente creíble, colisiones, rebote de la suspensión, cargas cambiantes y una identidad estable de personajes y objetos durante toda la secuencia; sombras marcadas, composición geométrica audaz, animación 3D cinematográfica estilizada, intensa luz de contorno del crepúsculo, percusión industrial rítmica construida a partir del traqueteo de las ruedas, siseos hidráulicos, impactos de contenedores, esfuerzo del motor, aleteos de la gaviota y la nota final del piano. Sin cámara lenta, sin planos inactivos, sin cortes que rompan la continuidad espacial, sin pantallas, interfaces de software, paneles de control, barras de progreso, gráficos, textos superpuestos, etiquetas, logotipos, marcas de agua ni texto explicativo. Relación de aspecto 16:9.
Generated with HappyHorse-1.1 Text-to-video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Generated with HappyHorse-1.0 Text-to-video on Atlas Cloud
Desde conceptos de campaña y animación de productos hasta vídeos de marca guiados por referencias y herramientas para desarrolladores, HappyHorse 1.1 convierte prompts e imágenes en contenido de vídeo corto adaptable.
Convierte conceptos escritos en vídeos a 480P, 720P o 1080P con relaciones de aspecto flexibles. Los equipos creativos pueden producir conceptos de campaña, publicaciones para redes sociales y propuestas narrativas sin metraje de origen ni rodaje.
Comienza con una imagen del primer fotograma y guía su animación con un prompt opcional durante entre 3 y 15 segundos. Los responsables de marketing de producto pueden convertir recursos estáticos en clips de lanzamiento, vídeos para escaparates o animaciones para catálogos.
A partir de una a nueve imágenes de referencia, el modelo crea vídeos basados en los recursos visuales proporcionados, hasta 1080P. Los equipos de marca pueden desarrollar variaciones de campaña guiadas por imágenes aprobadas de personajes, productos o entornos.
Elige relaciones de aspecto flexibles y tres niveles de resolución para preparar clips destinados a distintas ubicaciones a partir de un único flujo de generación. Los desarrolladores pueden ofrecer formatos verticales, horizontales y otras composiciones en productos de contenido y campañas.
¿Necesitas una escena rápida para un storyboard o un momento de producto más largo? Las duraciones de entre 3 y 15 segundos permiten que las herramientas creativas admitan conceptos rápidos, clips promocionales y secuencias visuales concisas en una única interfaz.
Crea aplicaciones de vídeo en torno a texto, imágenes del primer fotograma y entradas con múltiples referencias mediante una única familia de modelos. Los usuarios pueden elegir el material inicial que mejor se adapte a la ideación, la animación o la creación guiada por la marca en cada flujo de trabajo.
Compara los modos de generación de HappyHorse 1.1 con los principales modelos de video de Atlas Cloud según las entradas compatibles, la duración del clip, la resolución, la capacidad de referencias y el precio base indicado.
| Modelo | Entradas compatibles | Duración de salida | Resolución | Máximo de imágenes de referencia | Precio base indicado |
|---|---|---|---|---|---|
| HappyHorse-1.1 Text-to-video | Prompt de texto | De 3 a 15 segundos | 480P, 720P, 1080P | - | $0.07, unidad no indicada |
| HappyHorse-1.1 Image-to-video | Imagen del primer fotograma y prompt opcional | De 3 a 15 segundos | 480P, 720P, 1080P | - | $0.07, unidad no indicada |
| HappyHorse-1.1 Reference-to-video | Prompt de texto e imágenes de referencia | De 3 a 15 segundos | 480P, 720P, 1080P | 9 | $0.07, unidad no indicada |
| Wan-3.0 Reference-to-video | Referencias de texto, imagen, video, audio, documento o página web | De 2 a 30 segundos o duración inteligente | 480P, 720P, 1080P | 10 | $0.05, unidad no indicada |
| Seedance 2.5 Reference-to-Video | Referencias de texto, imagen, video y audio | Hasta 30 segundos | - | 30 | $0.167, unidad no indicada |
| MiniMax H3 Reference-to-Video | Referencias de texto, imagen, video y audio | De 4 a 15 segundos | 768p predeterminada, hasta 2K | 9 | $0.038/segundo |
Empieza en minutos — sigue estos sencillos pasos para integrar y desplegar modelos a través de la plataforma de Atlas Cloud.
Regístrate en atlascloud.ai y completa la verificación. Los nuevos usuarios reciben créditos gratuitos para explorar la plataforma y probar modelos.
Combina modelos avanzados de Happyhorse 1.1 con la plataforma acelerada por GPU de Atlas Cloud, proporcionando rendimiento, escalabilidad y experiencia de desarrollo incomparables.
Baja Latencia:
Inferencia optimizada por GPU para respuestas en tiempo real.
API Unificada:
Una sola integración para acceder a Happyhorse 1.1, GPT, Gemini y DeepSeek.
Precios Transparentes:
Facturación por Token, soporta modo Serverless.
Experiencia del Desarrollador:
SDK, análisis de datos, herramientas de ajuste fino y plantillas todo en uno.
Confiabilidad:
99.99% de disponibilidad, control de permisos RBAC, registros de cumplimiento.
Seguridad y Cumplimiento:
Certificación SOC 2 Type II, cumplimiento HIPAA, soberanía de datos en EE.UU.
HappyHorse 1.1 es un modelo de generación de vídeo de Alibaba disponible en Atlas Cloud para convertir texto, un primer fotograma o imágenes de referencia en clips de vídeo cortos. La familia ofrece endpoints independientes de texto a vídeo, imagen a vídeo y referencia a vídeo.
Puedes generar una escena a partir de un prompt de texto, animar una imagen fija o guiar un clip nuevo con varias referencias visuales. Estos flujos abarcan vídeos generados solo con prompts, animaciones del primer fotograma y contenido guiado por referencias.
Crea una clave de API de Atlas Cloud y envía una solicitud POST autenticada a /api/v1/model/generateVideo con el ID del modelo elegido y las entradas obligatorias. La respuesta incluye un ID de tarea que puedes usar para consultar el estado de la predicción hasta que el resultado esté listo.
Selecciona alibaba/happyhorse-1.1/text-to-video para la generación basada en prompts, alibaba/happyhorse-1.1/image-to-video para animar el primer fotograma o alibaba/happyhorse-1.1/reference-to-video para la guía mediante varias imágenes. Cada modo tiene su propio esquema de entrada.
Para text-to-video y reference-to-video, puedes elegir 480p, 720p o 1080p, una duración de 3 a 15 segundos y una de las nueve relaciones de aspecto compatibles. Image-to-video ofrece los mismos intervalos de resolución y duración, y utiliza la imagen subida como primer fotograma.
Reference-to-video acepta de una a nueve URL de imágenes, además de un prompt que describe cómo deben guiar las imágenes el resultado. Se admiten archivos JPEG, JPG, PNG y WEBP, con un límite de 20 MB por imagen y un lado menor mínimo de 400 píxeles.
Atlas Cloud establece un precio estándar de $0.07 por segundo para cada uno de los tres endpoints de HappyHorse 1.1. La facturación es de pago por uso, por lo que el coste de generación aumenta según la duración solicitada del clip.
Usa el parámetro seed en text-to-video o reference-to-video cuando quieras controlar la aleatoriedad de la generación. Atlas Cloud acepta valores enteros explícitos o -1 cuando prefieras una seed aleatoria.
Cada solicitud produce un clip de entre 3 y 15 segundos. Image-to-video utiliza una imagen como primer fotograma, mientras que reference-to-video acepta como máximo nueve imágenes de referencia.
Guías, tutoriales y novedades de producto para aprovechar al máximo Atlas Cloud.