
La API HiDream O1 1.5 Image lleva el modelo fundacional unificado de HiDream.ai a tu stack, ejecutando generación de texto a imagen, edición de una sola imagen y personalización basada en sujetos en un único sistema a nivel de píxel. Ajusta la guía y los pasos de inferencia para lograr una alta fidelidad al prompt en seis presets de relación de aspecto. Atlas Cloud lo ofrece mediante un único endpoint compatible con OpenAI, con precios transparentes de pago por uso a $0.044 por imagen. Empieza a crear hoy mismo.
Compare what each route of the HiDream O1 1.5 Image API takes in, renders out, and charges per call.
| Modality | Description |
|---|---|
| HiDream O1 1.5 Text-to-Image API (Text To Image) | Turn a written prompt of up to 2,500 characters into a fully composed image across six presets, from a 512x512 square to 16:9 landscape, with PNG, JPEG, or WebP output. Denoising steps range from 1 to 100 and guidance scale from 1.0 to 20.0, so each request can trade speed against how tightly the result follows your prompt. At $0.044 per image, it fits e-commerce mockups, advertising concepts, and game art produced at volume. |
| HiDream O1 1.5 Edit API (Image Editing) | Feed one reference image URL alongside your instruction and this endpoint rewrites that image, or pass several URLs for subject-driven personalization across a set. It shares the same six size presets, 1 to 100 inference steps, and 1.0 to 20.0 guidance range as the text-to-image route, returning PNG, JPEG, or WebP. Billed at $0.044 per image, it handles product retouching, background swaps, and consistent character edits. |
La HiDream O1 1.5 Image API unifica la generación de texto a imagen, la edición basada en instrucciones y la personalización guiada por sujeto dentro de un único modelo pixel-native que renderiza texto bilingüe con precisión y ofrece a los desarrolladores control directo sobre la guía, los pasos de muestreo y el formato de salida.

Envía un prompt de hasta 2,500 caracteres y el modelo lo renderiza como una imagen final mediante un único transformer pixel-native que codifica píxeles, texto y condiciones de tarea en un mismo espacio compartido. Como no hay ningún VAE externo ni un codificador de texto separado en el flujo, el detalle fino y la composición se mantienen estables incluso en descripciones densas y con varias cláusulas. Esto lo convierte en una base fiable para concept art, recursos visuales de marketing y mockups de producto.

Pocos modelos de imagen colocan palabras legibles dentro de una composición, pero HiDream O1 1.5 renderiza chino, inglés, cadenas en varios idiomas y datos numéricos con la limpieza suficiente como para evitar el retoque manual. El diseño pixel-native gestiona maquetaciones con varias regiones y mantiene nítidos titulares, pies de foto y etiquetas allí donde los modelos de espacio latente suelen desenfocar o deformar la tipografía. Los diseñadores pueden crear borradores de pósteres, packaging y gráficos para redes sociales con texto listo para publicar.

Cuando envías una URL de imagen de referencia con una instrucción en lenguaje natural, como remove the earphones, el endpoint de edición aplica el cambio preservando la composición circundante. El mismo modelo que genera también edita, por lo que la iluminación, el estilo y las regiones sin modificar se mantienen coherentes en lugar de reconstruirse desde cero. Los equipos lo usan para iterar sobre piezas visuales ya aprobadas sin tener que rediseñarlas por completo.

Varias URL de imágenes de referencia permiten que el modelo se centre en un sujeto y mantenga su identidad en escenas, poses y fondos completamente nuevos. Este modo guiado por sujeto mantiene reconocible a un personaje, producto o mascota de marca de una generación a la siguiente sin necesidad de ajuste fino por imagen. Es adecuado para campañas, storyboards y assets de juegos donde la misma figura debe aparecer en todas partes.

¿Cuánto control necesitas realmente? Ajusta guidance_scale de 1.0 a 20.0 y los pasos de inferencia de 1 a 100, elige uno de seis presets de relación de aspecto y exporta como PNG, JPEG o WebP. Cada llamada se ejecuta a través de un único endpoint compatible con OpenAI a un precio transparente de $0.044 por imagen, con facturación de pago por uso y sin suscripción. Empieza a crear hoy mismo.
Envía un prompt idéntico a través de HiDream O1 1.5 Image API junto con dos modelos de imagen rivales y compara cómo cada uno interpreta las mismas palabras en composición, iluminación y detalle fino.
Un bullicioso mercado de pescado por la mañana en una ciudad portuaria mediterránea, puestos de madera alineados con pizarras de precios escritas a mano con tiza que anuncian la pesca fresca del día, una joven pescadera con delantal a rayas riendo en pleno gesto mientras lanza una sardina plateada al aire, luz lateral dorada y baja rozando los adoquines mojados y las escamas brillantes de los peces, compresión de teleobjetivo profundo que apila los puestos contra un puerto brumoso y suave al fondo, paleta de contraventanas verde azulado frente a cálidas paredes de terracota y peces de plata fría, letras de tiza nítidas y veta de madera envejecida, fotografía de reportaje documental espontánea, 35mm, relación de aspecto amplia 16:9, a sangre

Generated with HiDream O1 1.5 on Atlas Cloud

Generated with Nano Banana Pro on Atlas Cloud

Generated with Seedream v4.5 on Atlas Cloud
Una pareja de guacamayos escarlata captados en plena riña por una rama fructífera de cecropia, alas desplegadas en un estallido de carmesí y cobalto, un ave girando boca abajo en pleno aleteo, a contraluz de una suave luz selvática nublada que brilla a través de las plumas translúcidas, tomada con un teleobjetivo de 400mm que comprime capas de selva tropical brumosa en el fondo, generoso espacio negativo de cielo pálido ocupando el tercio derecho, plumaje rojo complementario recortado contra follaje esmeralda intenso, barbas de las plumas y textura del pico renderizadas con nitidez extrema, fotografía de vida salvaje de historia natural, relación de aspecto amplia 16:9, a sangre

Generated with HiDream O1 1.5 on Atlas Cloud

Generated with Nano Banana Pro on Atlas Cloud

Generated with Seedream v4.5 on Atlas Cloud
En e-commerce, publicidad, arte para juegos y campañas sociales, la HiDream O1 1.5 Image API convierte un prompt o un conjunto de referencias en generación, edición y personalización con coherencia de sujeto por una tarifa fija de $0.044 por imagen.
Los equipos de retail generan fotos de producto y escenas de estilo de vida a partir de un prompt de texto por $0.044 por imagen, eligiendo entre seis presets de relación de aspecto. Los visuales de catálogo se entregan sin sesión fotográfica ni tiempos de espera de estudio.
Crea pósteres y banners de campaña renderizados como composiciones rigurosas, con iluminación cinematográfica, en encuadres horizontales, verticales y cuadrados. Las agencias iteran la creatividad principal en una sola sesión y luego entregan a los clientes arte listo para producción.
Una imagen de referencia más un prompt de edición permite al modelo cambiar el estilo, retocar o recomponer una foto conservando su estructura e iluminación. Los diseñadores corrigen fondos o sustituyen elementos sin usar un editor completo.
Proporciona varias imágenes de referencia y el modelo mantiene la coherencia de un personaje, producto o mascota en escenas completamente nuevas. Los estudios crean recursos de marca reutilizables y series de campaña que se mantienen fieles al modelo.
Cuando un equipo de juego necesita entornos, props o conceptos de personajes, el modelo devuelve arte detallado ajustado mediante guidance scale e inference steps. Los directores de arte exploran direcciones visuales antes de comprometer tiempo de estudio.
¿Gestionas un calendario de contenido intenso? Los equipos de marketing crean rápidamente gráficos que detienen el scroll para publicaciones, stories y miniaturas en presets cuadrados, verticales y horizontales, cada uno renderizado a una tarifa fija y predecible de $0.044 por imagen.
Descubre cómo se posiciona la API de imágenes HiDream O1 1.5 frente a los modelos de imagen de Alibaba y ByteDance en razonamiento integrado, texto bilingüe, pesos abiertos y coste por imagen.
| Modelo | Proveedor | Agente de prompts de razonamiento | Renderizado de texto bilingüe | Pesos abiertos | Precio (por imagen) |
|---|---|---|---|---|---|
| HiDream O1 1.5 Text-to-Image | HiDream.ai | √ | √ | √ | $0.044 |
| HiDream O1 1.5 Edit | HiDream.ai | √ | √ | √ | $0.044 |
| Qwen Image 2.0 | Alibaba (Qwen) | - | √ | - | $0.035 |
| Seedream v4.5 | ByteDance | - | √ | - | $0.04 |
Empieza en minutos — sigue estos sencillos pasos para integrar y desplegar modelos a través de la plataforma de Atlas Cloud.
Regístrate en atlascloud.ai y completa la verificación. Los nuevos usuarios reciben créditos gratuitos para explorar la plataforma y probar modelos.
Combina modelos avanzados de HiDream con la plataforma acelerada por GPU de Atlas Cloud, proporcionando rendimiento, escalabilidad y experiencia de desarrollo incomparables.
Baja Latencia:
Inferencia optimizada por GPU para respuestas en tiempo real.
API Unificada:
Una sola integración para acceder a HiDream, GPT, Gemini y DeepSeek.
Precios Transparentes:
Facturación por Token, soporta modo Serverless.
Experiencia del Desarrollador:
SDK, análisis de datos, herramientas de ajuste fino y plantillas todo en uno.
Confiabilidad:
99.99% de disponibilidad, control de permisos RBAC, registros de cumplimiento.
Seguridad y Cumplimiento:
Certificación SOC 2 Type II, cumplimiento HIPAA, soberanía de datos en EE.UU.
La HiDream O1 1.5 Image API ofrece a los desarrolladores acceso programático al modelo unificado de generación de imágenes de HiDream mediante un único endpoint compatible con OpenAI en Atlas Cloud. Basada en un transformador unificado a nivel de píxel, permite generación de texto a imagen, edición y personalización basada en sujeto desde un solo modelo, en lugar de una pila de herramientas independientes. El acceso está disponible desde el Day-0 con pago por uso y precios transparentes por llamada.
Además de la generación directa de texto a imagen, el modelo gestiona edición basada en instrucciones, personalización basada en sujeto con varias imágenes de referencia y renderizado preciso de textos largos para pósteres y gráficos comerciales. Los equipos lo usan para visuales de producto en e-commerce, piezas creativas publicitarias y arte para juegos, donde importan tanto una composición precisa como texto legible dentro de la imagen.
Sí. HiDream O1 1.5 se entrenó para interpretar prompts con matices tanto en chino como en inglés, y renderiza texto multilingüe dentro de la imagen con gran precisión. Esto lo convierte en una opción práctica para equipos que entregan visuales localizados sin tener que cambiar de modelo.
Llamas a la HiDream O1 1.5 Image API con una única clave compatible con OpenAI, por lo que la mayoría de los SDK existentes funcionan en cuanto los apuntas al endpoint de Atlas Cloud. Envía una solicitud con tu prompt y cualquier parámetro opcional al modelo hidream-o1-1.5/text-to-image y luego lee la imagen generada. No necesitas alojar modelos por separado ni contar con infraestructura GPU de tu lado.
Los prompts pueden tener hasta 2,500 caracteres, y puedes elegir entre tamaños predefinidos, incluidos square_hd a 1024x1024, square a 512x512, además de opciones verticales y horizontales en 4:3 y 16:9. También puedes ajustar num_inference_steps de 1 a 100 con un valor predeterminado de 50, establecer guidance_scale entre 1.0 y 20.0 con un valor predeterminado de 5.0, y devolver PNG, JPEG o WebP.
Pasa una sola URL en reference_image_urls para ejecutar edición basada en instrucciones sobre una imagen existente, o proporciona varias URL para impulsar una personalización que mantiene un sujeto coherente entre escenas. Deja el campo vacío para la generación estándar de texto a imagen. Hay un modelo dedicado hidream-o1-1.5/edit disponible para flujos de trabajo de edición con la misma tarifa por imagen.
La HiDream O1 1.5 Image API tiene un precio de $0.044 por imagen en Atlas Cloud, y los modelos de texto a imagen y de edición comparten esa misma tarifa. La facturación es de pago por uso con precios transparentes por llamada, así que solo pagas por las imágenes que generas, sin suscripción. Empieza a crear hoy mismo.
En Atlas Cloud eliges un tamaño predefinido, como square_hd a 1024x1024, y el modelo sintetiza cada imagen directamente a partir de píxeles sin procesar mediante su transformador unificado, en lugar de comprimirla en un espacio latente. Como los detalles y el texto dentro de la imagen se generan en vez de ampliarse desde un cuello de botella, HiDream es conocido por su tipografía limpia y bordes nítidos en pósteres y gráficos de producto.