Seedance 2.5 ya está disponible — Primero en Atlas Cloud

Wan 3.0 API is Coming to Atlas Cloud Soon

Wan 3.0 API es la próxima generación de la familia de videos Wan de Alibaba, diseñada para llevar la generación de formato largo, el control de múltiples referencias y la calidad audiovisual a nuevas alturas. Atlas Cloud ya aloja Wan 2.7, 2.6 y 2.5, por lo que Wan 3.0 utilizará la misma clave unificada y funcionará sin configuración adicional. Obtenga acceso anticipado el día de su lanzamiento. Desplácese hacia abajo hasta la galería para ver un adelanto de lo que Wan 3.0 puede crear.

Wan 3.0 ha sido desarrollado por Alibaba. Atlas Cloud (operado por Atlas Cloud AI LLC) proporciona acceso al modelo, pero no es su propietario. Todas las marcas comerciales pertenecen a sus respectivos titulares.

Próximamente

Modelos próximos a lanzarse

Estamos dando los toques finales a esta colección — mientras tanto, explora colecciones similares a continuación.

Explorar Más Series

Seedance 2.5

¡La API de Seedance 2.5 ya está disponible en Atlas Cloud! Ofrece a los desarrolladores el modelo de video más reciente de ByteDance. Genera hasta 30 segundos de video nativo en una sola pasada a partir de texto, una sola imagen o hasta 50 referencias multimodales, con audio sincronizado y texto multilingüe en el encuadre. En Atlas Cloud puede acceder a él mediante una única clave, con consistencia del sujeto y físicas mejoradas que mantienen la coherencia en las tomas largas.

Ver Serie

MiniMax H3

La API de MiniMax H3 abre el acceso al modelo de video multimodal de propósito general de MiniMax, que procesa texto, imágenes, video y audio como un único contexto en lugar de una tarea a la vez. Los clips duran de 5 a 15 segundos a 24 FPS, con relaciones de aspecto de 21:9 a 9:16, y un solo prompt puede cambiar personajes, reemplazar fondos, reescribir diálogos o clonar una voz a partir de un clip de referencia. Atlas Cloud lo ofrece todo a través de un único endpoint compatible con OpenAI. Empieza a crear hoy mismo.

Ver Serie

Seedream 5.0 Pro

La API de Seedream 5.0 Pro ofrece a los desarrolladores el modelo de edición de imágenes controlable de ByteDance en Atlas Cloud. Sitúa las ediciones con precisión mediante anclajes y coordenadas, separa las imágenes en capas editables, fusiona múltiples referencias y empareja colores y materiales exactos, con texto multilingüe a 2K y 3K. ¡En Atlas Cloud puede acceder a él mediante una sola clave!

Ver Serie

Seedance 2.0

La API de Seedance 2.0 le ofrece acceso de producción al modelo de video multimodal de ByteDance: entradas cuatrimodales (texto, imagen, video, audio) y un sistema "Universal Reference" líder en la industria que bloquea la composición, el movimiento de la cámara y las acciones de los personajes en diferentes tomas. Integre un control de nivel de director con una sola llamada a la API, una tarifa fija de $0.09/s, clave instantánea y sin lista de espera, todo respaldado por un tiempo de actividad y cumplimiento de nivel empresarial. ¡Seedance 2.0 Native 4K ya está disponible!

Ver Serie

GPT Image 2

La API de GPT Image 2 ofrece a los desarrolladores acceso al último modelo de imágenes de OpenAI, el sucesor de GPT Image 1.5. Genera y edita imágenes con una representación de texto precisa en caracteres latinos y CJK, además de una sólida composición para carteles, maquetas e infografías. En Atlas Cloud, puede acceder a ella a través de una API unificada junto con más de 300 modelos, con créditos gratuitos, un tiempo de actividad del 99,99% y sin necesidad de verificación de organización de OpenAI.

Ver Serie

Gemini Omni Flash

La Gemini Omni API lleva a tu stack el modelo multimodal de generación y edición de vídeo de Google DeepMind, presentado en Google I/O 2026. Gemini Omni fusiona el motor de razonamiento de Gemini con los medios generativos y acepta cualquier combinación de texto, imágenes, vídeo y audio para producir resultados coherentes y fundamentados en conocimiento. Refina los resultados mediante conversación natural: sustituye objetos, reescribe escenas y cambia de estilo mientras la física, los personajes y la continuidad permanecen intactos. Atlas Cloud ofrece toda la gama Gemini Omni Flash —texto a vídeo, imagen a vídeo con hasta 7 imágenes de referencia y referencia a vídeo— a través de una única API unificada, con precios transparentes por segundo desde $0.112 y sin suscripción. Empieza a construir hoy mismo.

Ver Serie

Grok Imagine

La API Grok Imagine cubre los modelos de imagen, video y voz de xAI, desde Image 2.0 hasta Video 1.5 y xAI TTS v1. Genera imágenes de 1K o 2K en 14 relaciones de aspecto, expande una escena a 15 segundos de movimiento en 1080p, controla tomas con hasta 7 imágenes de referencia, o nárralas en 20 idiomas. Atlas Cloud ejecuta todos los modos en un endpoint, con precios de pago por uso desde $0.02 por imagen y $0.05 por segundo. Empieza a construir hoy.

Ver Serie

Google

Los modelos creativos más potentes de Google están todos disponibles en Atlas Cloud. Veo 3.1 ofrece generación de video cinematográfico, Nano Banana 2 impulsa la creación de imágenes de alta fidelidad y Gemini aporta inteligencia multimodal a cada flujo de trabajo. Acceda a la suite completa de modelos de Google a través de una sola API key con disponibilidad Day-0 y precios de pago por uso (pay-as-you-go).

Ver Serie

Seedance 2.0 Mini

Seedance 2.0 Mini lleva la generación de video multimodal de ByteDance a los flujos de trabajo donde la velocidad y el costo son más importantes. Ofrece las capacidades principales de Seedance 2.0 con un menor consumo de recursos: generación más rápida, menor costo por video y la misma integración de API que ya utiliza. Para los equipos que ejecutan pipelines de alto volumen o crean prototipos a escala, Mini es la opción predeterminada práctica.

Ver Serie

ByteDance

Desde la generación de video cinematográfico hasta la creación de imágenes de alta fidelidad, los modelos más potentes de ByteDance están disponibles en Atlas Cloud. Ejecute Seedance y Seedream a gran escala con los precios de inferencia más bajos y cero gastos generales de infraestructura.

Ver Serie

Alibaba

Atlas Cloud reúne toda la línea de modelos de Alibaba bajo una sola API: Qwen para tareas de lenguaje e imagen, y Wan para la generación de video hasta 1080p. Acceda a cada modelo con pago por uso sin suscripciones. La API de Alibaba está disponible a través de una única URL base utilizando su cliente compatible con OpenAI existente.

Ver Serie

OpenAI

Atlas Cloud le ofrece acceso a la línea completa de la API de OpenAI, desde GPT Image 2 para la generación de imágenes hasta Sora 2 para video. Cada modelo está disponible bajo la modalidad de pago por uso sin compromiso mensual. Intégrelo cambiando simplemente la URL base mediante la API compatible con OpenAI.

Ver Serie

Wan 3.0 en acción

6 capacidades principales que muestran lo que puede producir una sola solicitud a Wan 3.0, desde películas de marca con múltiples referencias hasta tomas únicas de 30 segundos.

Películas de marca multirreferencia

El modo Omni procesa hasta 20 materiales de referencia, 10 imágenes, 5 clips y 5 pistas de audio, además de un documento o página web de origen, de modo que un kit de marca completo se convierte en un único vídeo adaptado a la marca en una sola pasada.

Historias en una sola toma de 30 segundos

La generación nativa de 30 segundos otorga a la narrativa espacio para desarrollarse, permitiendo movimientos de cámara continuos y secuencias de plano secuencia que los clips más cortos no pueden abarcar. La duración inteligente permite al modelo establecer el ritmo de cada escena por sí mismo.

Consistencia de Referencia a Nivel de Píxel

Los rostros, los productos y los detalles finos se reproducen con una fidelidad a nivel de píxel en cada fotograma. Los equipos de producción obtienen la certeza de entrega que exigen los personajes recurrentes y los activos de marca exactos.

Sonido Inmersivo y Realismo

El realismo, la textura de la imagen y el audio nativo mejoran simultáneamente, por lo que una escena generada se presenta con el sonido correspondiente en lugar de ser una secuencia silenciosa. El resultado logra un verdadero impacto audiovisual.

Edición de instrucciones y referencias

La edición precisa reelabora el material existente a partir de una instrucción escrita o un clip de referencia, cambiando un sujeto, estilo o momento sin regenerar todo el video.

Documentos y páginas web a video

Más allá de texto, imagen, audio y video, Wan 3.0 lee archivos doc, xls, ppt, pdf y md, así como páginas web en vivo, transformando un informe o una presentación de diapositivas directamente en un clip terminado.

Comparaciones de vídeo en el mismo prompt

Vea la presentación en video generada por los modelos Wan 3.0, Seedance 2.5 y Wan 2.7.

Prompt

Generating a 30-second, 16:9 widescreen adult sci-fi war animated short film. Visual style: Ultra-photorealistic CGI Biomechanical structures Fusion of gray-white bone and black metal Insect-like joints Extremely fine bone texturing Dried blood streaks, ceramic cracks, and industrial oil grime Abandoned futuristic city Cold gray skylight Sparse toxic-green organisms High-contrast cinematic lighting Low-saturation cool color palette Minimal orange-red used only for flames and alarms Realistic physical destruction Oppressive, heavy, unheroic tone Characters no longer have complete flesh bodies. They are composed primarily of: Human spine Ribs Skull Black hydraulic muscle Metal joints Neural fiber optics Weapon interface ports The skeletons are not zombies — they are "legacy hardware" still being operated by military-industrial systems. Narrative & Dynamic Timeline 0–4 sec | Still Fighting After Death The shot opens on a soldier's dog tag lying in a pool of standing water. Want me to continue translating the rest of the timeline if you have more seconds/beats written out? This looks like it's cut off after the 0-4 second beat.

Generated by Wan 3.0

Generated by Seedance 2.5 on Altas Cloud

Generated by Wan 2.7 on Altas Cloud

Prompt

Generating a 15-second, 16:9 ultra-widescreen plush-universe adventure clip. A spaceship made of plush fabric, buttons, zippers, and stuffing cotton is fleeing at high speed through a universe made of giant yarn planets, fuzzy nebulae, and rag-doll megafauna. The ship is piloted by three small plush animals: a rabbit, a fox, and a crow. A giant interstellar whale-beast covered in deep-blue long plush fur, with eyes like two glass buttons, chases the ship out of the nebula. Overall style: ultra-fine plush textures, cinematic space scale, a strong contrast between cute appearance and intense action, exaggerated FPV camera work, and realistic soft-body physics. **15-Second Dynamic Timeline** **0–3 sec | Zipper Ship Ejection Launch** The shot is inside the plush ship, with a cockpit made of stitching, buttons, and fabric instrument panels. A red warning button flashes rapidly. The rabbit pulls down a giant zipper-lever control, and the ship's forward hatch splits open like a cloth sack. The camera pulls back rapidly from the cockpit, passes through the zipper hatch, and emerges outside the ship. The ship ejects and launches out of the knitted crater of a yarn planet. **3–6 sec | High-Speed Orbit Skimming the Yarn Planet** The camera hugs the ship's tail, flying low over the planet's surface. The ground is woven from giant strands of yarn: - Knitted mountain ranges streak past below at high speed - Loose thread-ends sway like a forest - The ship dodges sharply left and right - The camera continuously banks and rolls - The thrusters emit a trailing wake of white cotton fluff **6–8.5 sec | The Giant Plush Whale Appears** The fuzzy nebula suddenly parts to either side as a giant deep-blue plush whale bursts out from behind. The long fur on the whale's body is blown backward by the high-speed airflow, and its glass-button eyes reflect the planet's light. The camera whips halfway around the ship, switching to a rear-facing (reverse) view, so the whale continuously grows larger in the frame behind the ship.

Generated by Wan 3.0

Generated by Seedance 2.5 on Altas Cloud

Generated by Wan 2.7 on Altas Cloud

Wan 3.0 API - Diseñado para flujos de trabajo creativos reales

Las actualizaciones de Wan 3.0 se remontan a las demandas reales de la industria, integrándose directamente en los flujos de trabajo de producción a continuación, desde dramas cortos hasta videos corporativos.

Cine, TV, Dramas Cortos y MV

Las tomas nativas de 30 segundos y la restauración de escenas reales permiten que las películas, los cortometrajes y los videos musicales de IA omitan gran parte del rodaje físico. La coherencia de píxeles mantiene a los protagonistas recurrentes, y el audio nativo llega sincronizado con cada corte.

Animación, Marca e IP

El control total de estilos pasa del realismo al anime dentro de un único modelo, mientras que la consistencia de píxeles fija una mascota, un logotipo o un personaje de IP en cada fotograma. Las animaciones completas de marca se renderizan sin la tediosa cadena de producción.

Publicidad y Promoción Corporativa

La creación Omni supera los límites de texto e imagen para las marcas de electrodomésticos, belleza, automoción, bienes de consumo de alta rotación (FMCG) y moda. Introduzca directamente una página de producto o un informe de la empresa para crear de todo, desde demostraciones de productos hasta vídeos corporativos de marca.

Diseño de Software y Productos

Proporcione un recorrido por la interfaz de usuario de un producto, una animación de características o una visualización de datos, y Wan 3.0 mantendrá la estética original mientras lo transforma en una pieza de animación narrativa. El tedioso paso de la animación desaparece.

Educación

La entrada de documentos lee directamente un PDF, PPT o página web, de modo que una lección o informe de investigación se convierte en un video explicativo claro sin necesidad de un guion separado. El material complejo se vuelve visual en un solo paso.

Turismo Cultural

La restauración de escenas reales recrea paisajes, sitios patrimoniales y gastronomía local sin necesidad de rodajes a gran escala, por lo que las películas urbanas y la digitalización cultural se realizan a bajo costo. Lugares lejanos llegan justo frente a los espectadores.

Cómo usar Wan 3.0 en Atlas Cloud

Empieza en minutos — sigue estos sencillos pasos para integrar y desplegar modelos a través de la plataforma de Atlas Cloud.

Crea una cuenta en Atlas Cloud

Regístrate en atlascloud.ai y completa la verificación. Los nuevos usuarios reciben créditos gratuitos para explorar la plataforma y probar modelos.

Por Qué Usar Wan 3.0 en Atlas Cloud

Combina modelos avanzados de Wan 3.0 con la plataforma acelerada por GPU de Atlas Cloud, proporcionando rendimiento, escalabilidad y experiencia de desarrollo incomparables.

Rendimiento y Flexibilidad

Baja Latencia:
Inferencia optimizada por GPU para respuestas en tiempo real.

API Unificada:
Una sola integración para acceder a Wan 3.0, GPT, Gemini y DeepSeek.

Precios Transparentes:
Facturación por Token, soporta modo Serverless.

Empresa y Escala

Experiencia del Desarrollador:
SDK, análisis de datos, herramientas de ajuste fino y plantillas todo en uno.

Confiabilidad:
99.99% de disponibilidad, control de permisos RBAC, registros de cumplimiento.

Seguridad y Cumplimiento:
Certificación SOC 2 Type II, cumplimiento HIPAA, soberanía de datos en EE.UU.

Preguntas frecuentes sobre la API de Wan 3.0

Wan 3.0 es el modelo de video todo en uno de próxima generación de Alibaba, ahora en beta pública. Una sola solicitud puede convertir texto, imágenes, video, audio, documentos o páginas web en un video de hasta 30 segundos de duración, y el modelo combina esa amplia entrada con consistencia a nivel de píxeles, edición precisa y audio generado de forma nativa.

Atlas Cloud planea añadir la API de Wan 3.0 tan pronto como Alibaba la lance, con el objetivo de ofrecer acceso Day-0. Regístrese y reciba una notificación el día de su lanzamiento.

Wan 3.0 es el lanzamiento más amplio de la línea. Aumenta la duración nativa a 30 segundos, acepta hasta 20 materiales de referencia mixtos además de documentos y páginas web en el modo de referencia omni, añade un modo de primer y último fotograma, y avanza hacia la consistencia a nivel de píxel con audio nativo. Las versiones anteriores de Wan en Atlas Cloud siguen siendo excelentes opciones para trabajos más cortos y enfocados de texto a video e imagen a video.

Wan 3.0 procesa mucho más que un simple prompt como material de origen. Una sola solicitud puede utilizar hasta 20 referencias mixtas, 10 imágenes, 5 clips de vídeo que sumen 15 segundos y 5 clips de audio que sumen 15 segundos, junto con un único documento (doc, xls, ppt, pdf o md) o página web, mientras que el propio prompt de texto puede alcanzar los 20.000 caracteres.

Los clips se reproducen de forma nativa hasta 30 segundos. Una solicitud de texto o imagen puede durar de 2 a 30 segundos, mientras que una solicitud que incluye video mantiene la entrada y la salida dentro de un límite combinado de 30 segundos, y la duración inteligente puede establecer la longitud por usted. La resolución abarca 480p, 720p y 1080p, con proporciones de 16:9, 9:16, 4:3, 3:4, 1:1 y proporciones inteligentes disponibles.

La coherencia se gestiona a nivel de píxel, por lo que un rostro, un atuendo, un producto o un fino detalle de referencia mantiene su aspecto a medida que cambian las escenas y los sujetos se mueven. Para las series de producción que reutilizan el mismo personaje o un activo de marca exacto, esa estabilidad es lo que hace que cada entrega sea predecible.

Sí, tanto mediante instrucciones como por referencia. Una nota escrita o un clip de muestra pueden cambiar el estilo de un sujeto, modificar la iluminación o reemplazar un solo segmento, y los elementos que desea mantener intactos permanecen en su lugar durante toda la edición.

Sí. Atlas Cloud ya ofrece Wan 2.7, 2.6 y 2.5 bajo una clave unificada, y Wan 3.0 se unirá a esa misma clave sin necesidad de una cuenta nueva, sin reconfiguración de endpoints y sin configuración independiente. Los equipos que ya realizan llamadas a la familia Wan podrán acceder a Wan 3.0 simplemente cambiando el nombre del modelo una vez que esté disponible.

Una sola API para toda la IA multimedia.

Explorar Todos los Modelos