Seedance 2.0 Mini & Fast API a los precios más bajos del mundo: hasta un 68 % de descuento sobre el precio oficial
Grok Imagine Video with Reference Guidance

Grok Imagine Video with Reference Guidance

Grok Imagine Video brinda a los desarrolladores acceso a la familia de modelos de video de xAI para crear, animar, ampliar y editar clips. Genera videos de 1 a 15 segundos a partir de indicaciones, guía personas, objetos o estilos con hasta siete imágenes de referencia y trabaja en 480p o 720p. Atlas Cloud reúne estas capacidades mediante endpoints compatibles con OpenAI y precios transparentes de pago por uso. Empieza a crear hoy mismo.

Grok Imagine Video ha sido desarrollado por xAI. Atlas Cloud (operado por Atlas Cloud AI LLC) proporciona acceso al modelo, pero no es su propietario. Todas las marcas comerciales pertenecen a sus respectivos titulares.

Comparación de los modos y flujos de trabajo de Grok Imagine Video

Elige el endpoint de Grok Imagine Video que corresponda a tus recursos de origen, la transformación deseada y tu flujo de producción.

ModalidadDescripción
Grok Imagine Video T2V API (Text To Video)Convierte prompts en lenguaje natural en vídeos de 1 a 15 segundos a 480p o 720p. Este endpoint es adecuado para visualizar conceptos, crear clips para redes sociales y generar escenas sin recursos multimedia de origen.
Grok Imagine Video I2V API (Image To Video)A partir de una imagen proporcionada, este endpoint aplica prompts de movimiento en lenguaje natural para producir vídeos a 480p o 720p. Úsalo para animar ilustraciones, imágenes de productos, fotogramas de personajes o recursos visuales de campañas.
Grok Imagine Video R2V API (Reference To Video)Guía la generación de vídeos con entre 1 y 7 imágenes de referencia que representan personas, objetos o estilos visuales. Las salidas pueden durar hasta 10 segundos a 480p o 720p, lo que facilita una producción creativa basada en referencias.
Grok Imagine Video Extend API (Video Extension)Continúa un MP4 existente de 2 a 15 segundos con una extensión dirigida por un prompt y con una duración de 2 a 10 segundos. La salida coincide con el formato de entrada y está limitada a 720p, por lo que este endpoint resulta útil para alargar planos ya establecidos.
Grok Imagine Video Edit API (Video Editing)Proporciona un MP4 e instrucciones en lenguaje natural para modificar su contenido visual conservando la duración de origen. La salida está limitada a 8.7 segundos, lo que permite realizar revisiones específicas y transformaciones basadas en prompts sobre vídeos cortos.

Grok Imagine Video en cinco flujos de trabajo creativos

Grok Imagine Video convierte texto, fotogramas iniciales y hasta siete referencias en clips cortos, y después amplía o edita metraje MP4 existente mediante la API unificada de pago por uso de Atlas Cloud.

Grok Imagine Video a partir de texto

Escribe un prompt en lenguaje natural y genera un clip de 1 a 15 segundos en 480p o 720p. Siete relaciones de aspecto, incluidas 16:9, 1:1 y 9:16, permiten adaptar cada toma al lienzo previsto. Controla el sujeto, la acción, el movimiento de cámara y la atmósfera directamente desde el prompt. Es un punto de partida flexible para momentos narrativos, conceptos de campaña y vídeos para redes sociales.

Anima un fotograma inicial

Convierte una imagen proporcionada como fotograma inicial en un vídeo de 1 a 15 segundos en 480p o 720p. La imagen establece la composición de apertura, mientras que un prompt de movimiento en lenguaje natural dirige el movimiento y la evolución de la escena. Elige entre siete relaciones de aspecto cuando necesites una forma de salida diferente. Este flujo de trabajo es adecuado para tomas de producto, escenas ilustradas y conceptos dirigidos artísticamente que necesitan movimiento sin reconstruir el fotograma inicial.

Control mediante referencias de Grok Imagine Video

Guía un vídeo con entre 1 y 7 imágenes de referencia que representen personas, objetos o estilos visuales. Haz referencia a entradas individuales en el prompt y genera hasta 10 segundos en 480p o 720p con cualquiera de las siete relaciones de aspecto compatibles. Como las referencias dan forma a la escena sin servir únicamente como fotograma inicial, los creadores obtienen un mayor control sobre los elementos visuales recurrentes. Úsalo para escenas protagonizadas por personajes, narrativas de producto o campañas sensibles al estilo.

Amplía la historia

Continúa un MP4 existente de 2 a 15 segundos con una ampliación guiada por prompt de 2 a 10 segundos. Grok Imagine Video retoma la acción desde el fotograma final y devuelve el clip original junto con el nuevo segmento, manteniendo la resolución de entrada hasta 720p. Describe la siguiente acción, revelación o movimiento de cámara en lenguaje sencillo. Así, los finales abruptos se convierten más fácilmente en momentos narrativos completos.

Edita clips con Grok Imagine Video

Proporciona a Grok Imagine Video un MP4 e instrucciones en lenguaje natural para transformar el metraje manteniendo su duración original. Las entradas pueden durar hasta 8.7 segundos y la facturación se basa en la duración del vídeo de entrada. Solicita un cambio visual, una modificación de la atmósfera o una revisión a nivel de escena sin reconstruir el clip desde cero. Es ideal para variaciones creativas breves y ajustes controlados posteriores a la generación.

Cinco flujos de trabajo, una API

Pasa de texto a vídeo, de imagen a vídeo, generación guiada por referencias, ampliación y edición mediante una única API unificada. Selecciona el endpoint que corresponda al material de origen disponible y envía cada trabajo mediante un flujo de predicción asíncrono. Mantén coherentes los patrones de autenticación e integración en todos los flujos de trabajo. El acceso de pago por uso facilita la experimentación y los pipelines de producción repetibles. Los desarrolladores pueden crear herramientas de vídeo más completas con menos esfuerzo de integración.

Un prompt, tres visiones: comparación de Grok Imagine Video

Descubre cómo Grok Imagine Video y dos alternativas líderes interpretan prompts idénticos mediante el movimiento, la continuidad, el control de cámara, la iluminación y la narrativa visual.

Prompt

Una película de aventura hiperrealista de 8–10 segundos, ambientada al aire libre en un desfiladero esmeralda justo después de una tormenta torrencial. Desde el primer fotograma hasta el último, un kayakista con traje impermeable azul cobalto y chaleco salvavidas rojo anaranjado se lanza por rápidos de aguas bravas violentas. Comienza con un travelling ultrabajo a ras del agua, corriendo junto al kayak mientras las palas cortan la corriente y lanzan gotas nítidas contra el objetivo; el kayak asciende por la cresta de una ola empinada y sale disparado por el aire. Haz un whip-pan hacia la POV en primera persona del kayakista mientras la embarcación gira de lado bajo un árbol caído, atraviesa una cortina translúcida de agua y supera por poco unas rocas dentadas y mojadas, manteniendo la coherencia física de las manos, la pala y la proa cobalto a través de las salpicaduras y las oclusiones momentáneas. El kayakista apoya la pala contra la corriente, se separa de la pared del cañón en un giro cerrado de rebote y vuelve a caer en el torrente. En el clímax, pasa a una inmersión de dron desde lo alto del acantilado, descendiendo rápidamente y orbitando al kayakista durante el aterrizaje; la proa golpea una caja de madera flotante con un impacto convincente, la rompe y, como giro lúdico inesperado, de su interior salta una ristra conectada de farolillos de papel coloridos perfectamente intactos, que se despliega y flota cálidamente sobre el agua fría y rápida mientras el kayak sigue avanzando. Movimiento continuo y anatómicamente correcto, inercia realista del kayak, resistencia de la pala, colisiones, dinámica turbulenta de fluidos, movimiento de la tela, gotas, salpicaduras sobre el objetivo e identidad inalterable del sujeto tras cada obstáculo; sin cámara lenta, sin planos generales vacíos de establecimiento, sin cortes a pantallas, interfaces, paneles, barras de progreso, gráficos, subtítulos, logotipos ni texto explicativo. Luz diurna fría cian y nublada, paredes de roca esmeralda oscurecidas por la lluvia, chaleco salvavidas rojo anaranjado intenso, resplandor cálido y multicolor de los farolillos, composiciones diagonales cinematográficas en formato panorámico que enfatizan la velocidad, alto contraste, desenfoque de movimiento natural y cinematografía inmersiva fotorrealista de deportes de acción. Audio sincronizado: rápidos rugientes, impactos secos de la pala, madera crujiendo, respiración forzada, agua golpeando el casco y un brillante acento musical percusivo cuando los farolillos quedan libres. Relación de aspecto 16:9.

Generated with Grok Imagine Video v1.5 Text-to-Video on Atlas Cloud

Generated with Seedance 2.5 Text-to-Video on Atlas Cloud

Generated with Grok Imagine Video v1.5 Developer Text-to-Video on Atlas Cloud

Prompt

Una secuencia cinematográfica de acción continua de 8–10 segundos en un mercado nocturno al aire libre, momentos antes de un aguacero torrencial: un maestro ramen ciego corre con confianza por un laberinto de puestos de comida abarrotados mientras estira continuamente entre sus manos una cinta de fideos de color blanco plateado. Comienza con una vista cenital perfectamente vertical y luego desciende rápidamente desde las alturas hacia el laberinto del mercado iluminado por neón, mientras las primeras gotas de lluvia pesadas golpean los toldos y el pavimento mojado. Fija la cámara en la cinta de fideos voladora y corre a escasos centímetros de ella mientras pasa silbando sobre braseros de carbón encendidos, comensales sorprendidos, parrillas chisporroteantes y paraguas que se abren de golpe con el viento; conserva un movimiento humano fluido, una física elástica y creíble de los fideos, oclusiones complejas en primer plano, lluvia salpicante, chispas y vapor denso. Haz un whip-pan hacia el chef saltando una caja baja sin romper el ritmo y luego ejecuta una órbita rápida de 360 grados a su alrededor mientras gira y suelta los fideos hacia atrás con un impulso preciso. La cinta de fideos traza un arco limpio hasta caer en una olla de cobre que hierve vigorosamente detrás de él; justo en el momento del triunfo, un travieso gato atigrado naranja salta desde debajo del puesto, atrapa con la boca la mitad de los fideos colgantes y sale corriendo, creando un remate visual nítido mientras el chef sigue corriendo sin darse cuenta. Fotorrealismo neonoir, reflejos cian verdosos y magenta sobre el suelo resbaladizo por la lluvia, fuego naranja cálido del horno como acentos visuales rítmicos, vapor y lluvia táctiles, coreografía estable, detalle cinematográfico nítido, ritmo energético en tiempo real, sin cámara lenta ni cortes que rompan la continuidad espacial o de los personajes. Audio: truenos crecientes, conversaciones del mercado, pasos contundentes, paraguas abriéndose de golpe, carbón chisporroteando, agua hirviendo y silbidos de los fideos sincronizados con los movimientos de cámara, con un brillante maullido cómico y una salpicadura de la olla de cobre al final. Sin pantallas, interfaces de usuario, paneles, barras de progreso, gráficos, subtítulos, logotipos, marcas de agua ni texto explicativo. Relación de aspecto 16:9.

Generated with Grok Imagine Video v1.5 Text-to-Video on Atlas Cloud

Generated with Seedance 2.5 Text-to-Video on Atlas Cloud

Generated with Grok Imagine Video v1.5 Developer Text-to-Video on Atlas Cloud

Grok Imagine Video en cada etapa creativa

Grok Imagine Video convierte prompts, imágenes fijas, referencias y archivos MP4 existentes en vías prácticas para clips sociales, imágenes de producto, historias de marca, secuencias más largas, ediciones específicas y herramientas para creadores.

Clips para redes sociales con Grok Imagine Video

Grok Imagine Video convierte prompts en lenguaje natural en clips cortos de 480p o 720p. Úsalo para producir teasers para redes sociales, conceptos de campaña y borradores visuales rápidos sin preparar metraje de origen por adelantado.

Anima imágenes fijas de productos

A partir de una imagen de producto, el endpoint image to video añade movimiento dirigido por prompts en 480p o 720p. Las marcas pueden convertir imágenes fijas de catálogo en revelaciones de productos, recursos para lanzamientos e imágenes para marketplaces.

Historias de marca guiadas por referencias

Con entre 1 y 7 imágenes, reference to video guía personas, objetos o estilos para crear un clip nuevo. Los equipos creativos pueden desarrollar historias de marca, conceptos de personajes y escenas de productos basadas en los elementos visuales proporcionados.

Extensiones de historias con Grok Imagine Video

Continúa un MP4 existente con una extensión de 2 a 10 segundos dirigida por prompts que conserva la resolución de entrada hasta 720p. Esto permite crear momentos más largos del storyboard, transiciones episódicas y secuencias posteriores a partir de metraje aprobado.

Ediciones de video en lenguaje natural

Edita un MP4 mediante instrucciones en lenguaje natural conservando su duración original, con una salida limitada a 8.7 segundos. Los equipos pueden crear estilos alternativos, variantes localizadas de campañas o tratamientos visuales revisados.

Crea con Grok Imagine Video

Desarrolla herramientas de video dirigidas por prompts en torno a los 5 modos de Grok Imagine Video para generación, animación, referencias, extensiones y edición. Los desarrolladores pueden ofrecer flujos de trabajo para creadores desde una misma familia y elegir una salida de 480p o 720p.

Dónde se sitúa Grok Imagine Video entre los modelos de vídeo

Compara los flujos de trabajo de Grok Imagine Video con alternativas seleccionadas de Atlas Cloud en métodos de entrada, duración del clip, resolución máxima y precios estándar.

ModeloFlujo de entradaDuración del clip o segmentoResolución máximaPrecio estándar
Grok Imagine Video Text-to-VideoPrompt de texto1–15s720p$0.05/sec
Grok Imagine Video Image-to-VideoImagen inicial + prompt de texto1–15s720p$0.05/sec
Grok Imagine Video Reference-to-Video1–7 imágenes de referencia + prompt de texto1–10s720p$0.05/sec
Grok Imagine Video ExtendMP4 de 2–15s + prompt de textoExtensión de 2–10sCoincide con la entrada, hasta 720p$0.07/sec
Grok Imagine Video EditMP4 + instrucción de textoCoincide con la entrada, hasta 8.7s-$0.07/sec de entrada
MiniMax H3 Text-to-VideoPrompt de texto4–15s2K$0.038/sec
Seedance 2.0 Image-to-VideoImagen inicial + texto, fotograma final opcional4–15s4K nativo$0.112/sec
Vidu Q3-Mix Reference to Video1–4 imágenes de referencia + prompt de texto1–16s1440p SR, hasta 1080p nativo$0.125/ejecución
Wan-2.7 Video-editVídeo de origen + texto, imágenes o audio opcionales-1080p$0.10/ejecución

Cómo usar Grok Imagine Video en Atlas Cloud

Empieza en minutos — sigue estos sencillos pasos para integrar y desplegar modelos a través de la plataforma de Atlas Cloud.

Crea una cuenta en Atlas Cloud

Regístrate en atlascloud.ai y completa la verificación. Los nuevos usuarios reciben créditos gratuitos para explorar la plataforma y probar modelos.

Por Qué Usar Grok Imagine Video en Atlas Cloud

Combina modelos avanzados de Grok Imagine Video con la plataforma acelerada por GPU de Atlas Cloud, proporcionando rendimiento, escalabilidad y experiencia de desarrollo incomparables.

Rendimiento y Flexibilidad

Baja Latencia:
Inferencia optimizada por GPU para respuestas en tiempo real.

API Unificada:
Una sola integración para acceder a Grok Imagine Video, GPT, Gemini y DeepSeek.

Precios Transparentes:
Facturación por Token, soporta modo Serverless.

Empresa y Escala

Experiencia del Desarrollador:
SDK, análisis de datos, herramientas de ajuste fino y plantillas todo en uno.

Confiabilidad:
99.99% de disponibilidad, control de permisos RBAC, registros de cumplimiento.

Seguridad y Cumplimiento:
Certificación SOC 2 Type II, cumplimiento HIPAA, soberanía de datos en EE.UU.

Preguntas y respuestas sobre la API de vídeo de Grok Imagine

Grok Imagine Video es la familia de modelos de generación de vídeo de xAI para crear, animar, ampliar y editar clips cortos. Atlas Cloud proporciona puntos de conexión de API independientes para flujos de trabajo de texto, imagen, referencia, extensión y edición.

Grok Imagine Video puede generar un clip a partir de texto, animar una imagen inicial o utilizar hasta siete imágenes de referencia para orientar a personas, objetos y estilos. Los puntos de conexión independientes pueden continuar un clip existente o editar un MP4 mediante instrucciones en lenguaje natural.

Crea una clave de API de Atlas Cloud y envía una solicitud POST autenticada a /api/v1/model/generateVideo. Especifica el ID de modelo obligatorio, el prompt y cualquier entrada de imagen o vídeo que requiera esa ruta. La respuesta incluye un ID de solicitud, el estado y los campos de salida.

Elige text-to-video cuando la escena comience con un prompt, o image-to-video cuando una imagen proporcionada deba convertirse en el fotograma inicial. Reference-to-video ofrece una guía más amplia a partir de varias imágenes, mientras que extend-video y edit-video funcionan con archivos MP4 existentes.

Text-to-video e image-to-video admiten clips de 1 a 15 segundos a 480p o 720p. Reference-to-video admite de 1 a 10 segundos con las mismas resoluciones, mientras que las relaciones de aspecto habituales incluyen 16:9, 9:16, 1:1, 4:3, 3:4, 3:2 y 2:3. Las rutas de extensión y edición tienen sus propios límites de entrada.

Sí. xAI documenta la generación de audio nativo como parte del flujo de trabajo de vídeo de Grok Imagine, lo que permite producir el sonido y los elementos visuales conjuntamente. Los esquemas publicados por Atlas Cloud para estas rutas no exponen un interruptor de audio independiente.

Proporciona entre una y siete URL públicas de imágenes mediante HTTPS o URI de datos en base64 a través del punto de conexión reference-to-video. Las etiquetas como <IMAGE_0> pueden vincular referencias individuales con las personas, los objetos o los estilos descritos en el prompt. Esta ruta devuelve clips de hasta 10 segundos a 480p o 720p.

Usa extend-video con un MP4 de entre 2 y 15 segundos y solicita entre 2 y 10 segundos adicionales de acción guiada por el prompt. Para cambios específicos, edit-video acepta un MP4 de no más de 8.7 segundos y conserva su duración. Ambas rutas limitan la resolución de salida a 720p.

El precio estándar de Atlas Cloud es de $0.05 por segundo para text-to-video, image-to-video y reference-to-video. Extend-video y edit-video utilizan una tarifa estándar de $0.07 por segundo. La edición se factura según la duración del vídeo de entrada, ya que la salida conserva esa duración.

Primero, confirma que el punto de conexión seleccionado coincide con el tipo de entrada y que están presentes todos los prompts, las URL de imagen o las URL de vídeo obligatorios. Comprueba los límites específicos de la ruta para la duración, la resolución, la relación de aspecto, el número de referencias y el MP4 antes de volver a enviarla. Si la solicitud se completa correctamente pero la escena no es precisa, reescribe el prompt con instrucciones explícitas sobre el movimiento del sujeto, el movimiento de cámara, el ritmo y los detalles visuales.

Explorar Más Series

Seedance 2.5

¡La API de Seedance 2.5 ya está disponible en Atlas Cloud! Ofrece a los desarrolladores el modelo de video más reciente de ByteDance. Genera hasta 30 segundos de video nativo en una sola pasada a partir de texto, una sola imagen o hasta 50 referencias multimodales, con audio sincronizado y texto multilingüe en el encuadre. En Atlas Cloud puede acceder a él mediante una única clave, con consistencia del sujeto y físicas mejoradas que mantienen la coherencia en las tomas largas.

Ver Serie

Wan 3.0

La API Wan 3.0 es la próxima generación de la familia de videos Wan de Alibaba, diseñada para llevar la generación de formato largo, el control de múltiples referencias y la calidad audiovisual a nuevas alturas. Atlas Cloud ya aloja Wan 2.7, 2.6 y 2.5, y Wan 3.0 se ejecuta con la misma clave unificada sin necesidad de configuración adicional. Empieza a construir hoy mismo. Desplázate hacia abajo hasta la galería para ver lo que Wan 3.0 puede crear.

Ver Serie

MiniMax H3

MiniMax H3 es la familia de vídeo multimodal de MiniMax para la creación guiada por texto, imagen y referencias. En las rutas compatibles, conserva los sujetos del material de referencia, ofrece relaciones de aspecto flexibles y combina el sonido generado con los elementos visuales mediante H3 Developer, con perfiles de salida seleccionados según el endpoint. Atlas Cloud reúne toda la familia bajo una única clave compatible con OpenAI, con precios transparentes de pago por uso a partir de la tarifa estándar de $0.038 por segundo. Empieza a crear hoy mismo.

Ver Serie

Seedream 5.0 Pro

La API de Seedream 5.0 Pro ofrece a los desarrolladores el modelo de edición de imágenes controlable de ByteDance en Atlas Cloud. Sitúa las ediciones con precisión mediante anclajes y coordenadas, separa las imágenes en capas editables, fusiona múltiples referencias y empareja colores y materiales exactos, con texto multilingüe a 2K y 3K. ¡En Atlas Cloud puede acceder a él mediante una sola clave!

Ver Serie

Seedance 2.0

Seedance 2.0 es el modelo de vídeo para producción de ByteDance, diseñado para crear planos con precisión. Convierte prompts en vídeo, anima una imagen del primer fotograma con orientación opcional del último fotograma o da forma a los resultados mediante medios de referencia y búsqueda web opcional. Atlas Cloud reúne estos flujos de trabajo en una única API unificada, con precios transparentes de pago por uso y una sola clave compatible con OpenAI. Empieza a crear hoy mismo.

Ver Serie

GPT Image 2.5

La familia gpt-image-2.5 de OpenAI ofrece a los desarrolladores la posibilidad de elegir entre Flare y Sunburst para flujos de trabajo de producción de imágenes. Renderiza con resoluciones arbitrarias de hasta 3840x2160 y elige entre cinco niveles de calidad, incluidos xhigh y max, para adaptarte a requisitos de salida específicos. Atlas Cloud proporciona inferencia REST lista para usar, sin arranques en frío y con precios estándar desde $0.004 por generación. Empieza a crear hoy mismo.

Ver Serie

GPT Image 2

La API de GPT Image 2 ofrece a los desarrolladores acceso al último modelo de imágenes de OpenAI, el sucesor de GPT Image 1.5. Genera y edita imágenes con una representación de texto precisa en caracteres latinos y CJK, además de una sólida composición para carteles, maquetas e infografías. En Atlas Cloud, puede acceder a ella a través de una API unificada junto con más de 300 modelos, con créditos gratuitos, un tiempo de actividad del 99,99% y sin necesidad de verificación de organización de OpenAI.

Ver Serie

Gemini Omni Flash

La API de gemini omni pone a disposición de los desarrolladores la familia Gemini Omni Flash nativamente multimodal de Google DeepMind, incluido Gemini Omni 1.1 Flash. Crea vídeos cinematográficos con audio nativo sincronizado, anima imágenes estáticas con un control preciso de los fotogramas inicial y final, o revisa metraje existente mediante ediciones guiadas por texto que conservan el contenido no modificado. Atlas Cloud proporciona una única clave compatible con OpenAI, acceso unificado y precios transparentes de pago por uso. Empieza a desarrollar hoy mismo.

Ver Serie

Grok Imagine

La API Grok Imagine cubre los modelos de imagen, video y voz de xAI, desde Image 2.0 hasta Video 1.5 y xAI TTS v1. Genera imágenes de 1K o 2K en 14 relaciones de aspecto, expande una escena a 15 segundos de movimiento en 1080p, controla tomas con hasta 7 imágenes de referencia, o nárralas en 20 idiomas. Atlas Cloud ejecuta todos los modos en un endpoint, con precios de pago por uso desde $0.02 por imagen y $0.05 por segundo. Empieza a construir hoy.

Ver Serie

Google

Los modelos creativos más potentes de Google están todos disponibles en Atlas Cloud. Veo 3.1 ofrece generación de video cinematográfico, Nano Banana 2 impulsa la creación de imágenes de alta fidelidad y Gemini aporta inteligencia multimodal a cada flujo de trabajo. Acceda a la suite completa de modelos de Google a través de una sola API key con disponibilidad Day-0 y precios de pago por uso (pay-as-you-go).

Ver Serie

Seedance 2.0 Mini

Seedance 2.0 Mini lleva la generación de video multimodal de ByteDance a los flujos de trabajo donde la velocidad y el costo son más importantes. Ofrece las capacidades principales de Seedance 2.0 con un menor consumo de recursos: generación más rápida, menor costo por video y la misma integración de API que ya utiliza. Para los equipos que ejecutan pipelines de alto volumen o crean prototipos a escala, Mini es la opción predeterminada práctica.

Ver Serie

ByteDance

Desde la generación de video cinematográfico hasta la creación de imágenes de alta fidelidad, los modelos más potentes de ByteDance están disponibles en Atlas Cloud. Ejecute Seedance y Seedream a gran escala con los precios de inferencia más bajos y cero gastos generales de infraestructura.

Ver Serie

Una sola API para toda la IA multimedia.

Explorar Todos los Modelos