
Die HiDream O1 1.5 Image API bringt das einheitliche Foundation Model von HiDream.ai in Ihren Stack und ermöglicht Text-to-Image, Single-Image Editing und subjektgesteuerte Personalisierung in einem pixelgenauen System. Passen Sie Guidance und Inference Steps für hohe Prompt-Treue über sechs voreingestellte Seitenverhältnisse hinweg an. Atlas Cloud stellt es über einen OpenAI-kompatiblen Endpoint mit transparenter Pay-as-you-go-Preisgestaltung für $0.044 pro Bild bereit. Starten Sie noch heute mit der Entwicklung.
Compare what each route of the HiDream O1 1.5 Image API takes in, renders out, and charges per call.
| Modality | Description |
|---|---|
| HiDream O1 1.5 Text-to-Image API (Text To Image) | Turn a written prompt of up to 2,500 characters into a fully composed image across six presets, from a 512x512 square to 16:9 landscape, with PNG, JPEG, or WebP output. Denoising steps range from 1 to 100 and guidance scale from 1.0 to 20.0, so each request can trade speed against how tightly the result follows your prompt. At $0.044 per image, it fits e-commerce mockups, advertising concepts, and game art produced at volume. |
| HiDream O1 1.5 Edit API (Image Editing) | Feed one reference image URL alongside your instruction and this endpoint rewrites that image, or pass several URLs for subject-driven personalization across a set. It shares the same six size presets, 1 to 100 inference steps, and 1.0 to 20.0 guidance range as the text-to-image route, returning PNG, JPEG, or WebP. Billed at $0.044 per image, it handles product retouching, background swaps, and consistent character edits. |
Die HiDream O1 1.5 Image API vereint Text-to-Image-Generierung, anweisungsbasierte Bearbeitung und subjektgesteuerte Personalisierung in einem einzigen pixelnativen Modell, das präzisen zweisprachigen Text rendert und Entwicklern direkte Kontrolle über guidance, sampling steps und Ausgabeformat gibt.

Senden Sie einen Prompt mit bis zu 2,500 Zeichen, und das Modell rendert ihn als fertiges Bild über einen einzigen pixelnativen Transformer, der Pixel, Text und Aufgabenbedingungen in einem gemeinsamen Raum kodiert. Da kein externes VAE und kein separater Text-Encoder im Pfad liegen, bleiben feine Details und Komposition auch bei dichten Beschreibungen mit mehreren Teilsätzen stabil. Dadurch eignet es sich als verlässliche Grundlage für Concept Art, Marketing-Visuals und Produkt-Mockups.

Nur wenige Bildmodelle platzieren lesbare Wörter innerhalb einer Komposition, doch HiDream O1 1.5 rendert Chinesisch, Englisch, gemischtsprachige Strings und numerische Daten so sauber, dass manuelle Retusche entfallen kann. Das pixelnative Design verarbeitet Layouts mit mehreren Bereichen und hält Headlines, Captions und Labels scharf, wo Latent-Space-Modelle Schrift oft verwischen oder entstellen. Designer können Poster, Verpackungen und Social-Media-Grafiken entwerfen, deren Text sofort produktionsreif ist.

Wenn Sie eine Referenzbild-URL zusammen mit einer natürlichsprachlichen Anweisung wie „remove the earphones“ übergeben, wendet der edit endpoint die Änderung an und erhält dabei die umliegende Komposition. Dasselbe Modell, das generiert, bearbeitet auch; dadurch bleiben Beleuchtung, Stil und unveränderte Bereiche konsistent, statt von Grund auf neu aufgebaut zu werden. Teams nutzen es, um freigegebene Visuals zu iterieren, ohne ein vollständiges Redesign anzustoßen.

Mehrere Referenzbild-URLs ermöglichen es dem Modell, ein Subjekt zu erfassen und dessen Identität über völlig neue Szenen, Posen und Hintergründe hinweg beizubehalten. Dieser subjektgesteuerte Modus hält eine Figur, ein Produkt oder ein Markenmaskottchen von einer Generierung zur nächsten wiedererkennbar, ganz ohne Fine-Tuning pro Bild. Er eignet sich für Kampagnen, Storyboards und Game Assets, bei denen dieselbe Figur überall erscheinen muss.

Wie viel Kontrolle benötigen Sie wirklich? Stellen Sie guidance_scale von 1.0 bis 20.0 und inference steps von 1 bis 100 ein, wählen Sie eines von sechs Seitenverhältnis-Presets und exportieren Sie als PNG, JPEG oder WebP. Jeder Call läuft über einen OpenAI-kompatiblen Endpoint zu transparenten $0.044 pro Bild mit Pay-As-You-Go-Abrechnung und ohne Abonnement. Starten Sie noch heute mit der Entwicklung.
Sende einen identischen Prompt über die HiDream O1 1.5 Image API sowie durch zwei konkurrierende Bildmodelle und vergleiche anschließend, wie jedes Modell dieselben Worte in Komposition, Licht und feine Details übersetzt.
Ein geschäftiger morgendlicher Fischmarkt in einer mediterranen Hafenstadt, Holzstände gesäumt von handbeschrifteten Kreidetafeln mit den frischen Fängen des Tages, eine junge Fischhändlerin in gestreifter Schürze lacht mitten in der Bewegung, während sie eine silberne Sardine in die Luft wirft, niedriges goldenes Seitenlicht streift über nasses Kopfsteinpflaster und glänzende Fischschuppen, starke Tele-Kompression stapelt die Stände vor einem weich verschwommenen, nebligen Hafen im Hintergrund, Farbpalette aus türkisgrünen Fensterläden vor warmen Terrakottawänden und kalt-silbernen Fischen, gestochen scharfe Kreideschrift und verwitterte Holzmaserung, spontane dokumentarische Reportagefotografie, 35mm, breites 16:9-Seitenverhältnis, randabfallend

Generated with HiDream O1 1.5 on Atlas Cloud

Generated with Nano Banana Pro on Atlas Cloud

Generated with Seedream v4.5 on Atlas Cloud
Ein Paar scharlachroter Aras, mitten in einem Streit um einen fruchttragenden Cecropia-Zweig eingefangen, ausgebreitete Flügel als Ausbruch aus Karminrot und Kobaltblau, ein Vogel kopfüber mitten im Flügelschlag taumelnd, von weichem, bedecktem Dschungellicht von hinten beleuchtet, das durch durchscheinende Federn glüht, aufgenommen mit einem 400mm-Teleobjektiv, das den gestaffelten, nebligen Regenwald im Hintergrund komprimiert, großzügiger negativer Raum aus blassem Himmel füllt das rechte Drittel, komplementäres rotes Gefieder vor tief smaragdgrünem Blattwerk, Federäste und Schnabelstruktur messerscharf gerendert, Naturkunde-Wildtierfotografie, breites 16:9-Seitenverhältnis, randabfallend

Generated with HiDream O1 1.5 on Atlas Cloud

Generated with Nano Banana Pro on Atlas Cloud

Generated with Seedream v4.5 on Atlas Cloud
In E-Commerce, Werbung, Game Art und Social-Media-Kampagnen verwandelt die HiDream O1 1.5 Image API einen Prompt oder eine Reihe von Referenzen in Generierung, Bearbeitung und motivkonsistente Personalisierung zu einem Pauschalpreis von $0.044 pro Bild.
Retail-Teams generieren Produktaufnahmen und Lifestyle-Szenen aus einem Text-Prompt für $0.044 pro Bild und wählen dabei aus sechs Seitenverhältnis-Presets. Katalogvisuals sind ohne Fotoshooting oder Studio-Durchlauf einsatzbereit.
Erstellen Sie Kampagnenposter und Banner, gerendert als streng komponierte, cineastisch ausgeleuchtete Layouts in Querformat-, Hochformat- und quadratischen Framings. Agenturen iterieren Hero-Creatives in einer Sitzung und übergeben anschließend produktionsfertige Artworks an Kunden.
Ein Referenzbild plus ein Bearbeitungs-Prompt ermöglicht es dem Modell, ein Foto neu zu stylen, zu retuschieren oder neu zu komponieren, während Struktur und Beleuchtung erhalten bleiben. Designer korrigieren Hintergründe oder tauschen Elemente aus, ohne einen vollständigen Editor zu benötigen.
Füttern Sie das Modell mit mehreren Referenzbildern, und es hält einen Charakter, ein Produkt oder ein Maskottchen über völlig neue Szenen hinweg konsistent. Studios erstellen wiederverwendbare Markenassets und Kampagnenserien, die model-konform bleiben.
Wenn ein Game-Team Umgebungen, Props oder Charakterkonzepte benötigt, liefert das Modell detaillierte Artworks, abgestimmt über Guidance Scale und Inference Steps. Art Directors erkunden visuelle Richtungen, bevor sie Studiozeit einplanen.
Ein voller Content-Kalender? Marketer erstellen schnell scroll-stoppende Grafiken für Posts, Stories und Thumbnails über quadratische, Hochformat- und Querformat-Presets hinweg, jeweils gerendert zum festen und planbaren Preis von $0.044 pro Bild.
Sehen Sie, wo die HiDream O1 1.5 Image API im Vergleich zu Bildmodellen von Alibaba und ByteDance bei integriertem Reasoning, zweisprachigem Text, offenen Gewichten und Kosten pro Bild steht.
| Modell | Anbieter | Reasoning-Prompt-Agent | Zweisprachiges Text-Rendering | Offene Gewichte | Preis (pro Bild) |
|---|---|---|---|---|---|
| HiDream O1 1.5 Text-to-Image | HiDream.ai | √ | √ | √ | $0.044 |
| HiDream O1 1.5 Edit | HiDream.ai | √ | √ | √ | $0.044 |
| Qwen Image 2.0 | Alibaba (Qwen) | - | √ | - | $0.035 |
| Seedream v4.5 | ByteDance | - | √ | - | $0.04 |
In wenigen Minuten startklar — folgen Sie diesen einfachen Schritten, um Modelle über die Plattform von Atlas Cloud zu integrieren und bereitzustellen.
Registrieren Sie sich auf atlascloud.ai und schließen Sie die Verifizierung ab. Neue Nutzer erhalten kostenlose Credits zum Erkunden der Plattform und Testen von Modellen.
Die Kombination der fortschrittlichen HiDream-Modelle mit der GPU-beschleunigten Plattform von Atlas Cloud bietet unübertroffene Leistung, Skalierbarkeit und Entwicklererfahrung.
Niedrige Latenz:
GPU-optimierte Inferenz für Echtzeit-Reasoning.
Einheitliche API:
Führen Sie HiDream, GPT, Gemini und DeepSeek mit einer Integration aus.
Transparente Preisgestaltung:
Vorhersehbare Token-basierte Abrechnung mit serverlosen Optionen.
Entwicklererfahrung:
SDKs, Analysen, Fine-Tuning-Tools und Vorlagen.
Zuverlässigkeit:
99,99% Verfügbarkeit, RBAC und compliance-bereite Protokollierung.
Sicherheit & Compliance:
SOC 2 Type II, HIPAA-Ausrichtung, Datensouveränität in den USA.
Die HiDream O1 1.5 Image API bietet Entwicklern programmatischen Zugriff auf HiDreams einheitliches Bildgenerierungsmodell über einen einzigen OpenAI-compatible endpoint auf Atlas Cloud. Basierend auf einem pixel-level unified transformer liefert sie Text-to-image, Bearbeitung und subject-driven personalization aus einem einzigen Modell statt aus einem Stapel separater Tools. Der Zugriff ist ab Day-0 mit nutzungsbasierter Abrechnung und transparenter Preisgestaltung pro Aufruf möglich.
Über einfache Text-to-image-Generierung hinaus beherrscht das Modell anweisungsbasierte Bearbeitung, subject-driven personalization über mehrere Referenzbilder hinweg sowie präzises Long-text rendering für Poster und kommerzielle Grafiken. Teams nutzen es für E-Commerce-Produktvisualisierungen, Werbemittel und Game Art, wo sowohl präzise Komposition als auch gut lesbarer Text im Bild wichtig sind.
Ja. HiDream O1 1.5 wurde darauf trainiert, nuancierte Prompts sowohl auf Chinesisch als auch auf Englisch zu interpretieren, und rendert mehrsprachigen Text im Bild mit hoher Genauigkeit. Damit eignet es sich gut für Teams, die lokalisierte Visuals ausliefern, ohne zwischen Modellen wechseln zu müssen.
Sie rufen die HiDream O1 1.5 Image API mit einem einzigen OpenAI-compatible key auf, sodass die meisten vorhandenen SDKs funktionieren, sobald Sie sie auf den Atlas Cloud endpoint ausrichten. Senden Sie eine Anfrage mit Ihrem Prompt und optionalen Parametern an das Modell hidream-o1-1.5/text-to-image und lesen Sie anschließend das generierte Bild aus. Separates Model Hosting oder GPU-Infrastruktur ist auf Ihrer Seite nicht erforderlich.
Prompts können bis zu 2,500 Zeichen lang sein, und Sie wählen aus vordefinierten Größen wie square_hd mit 1024x1024, square mit 512x512 sowie Hoch- und Querformatoptionen in 4:3 und 16:9. Außerdem können Sie num_inference_steps von 1 bis 100 mit einem Standardwert von 50 anpassen, guidance_scale zwischen 1.0 und 20.0 mit einem Standardwert von 5.0 festlegen und PNG, JPEG oder WebP zurückgeben.
Übergeben Sie eine einzelne URL in reference_image_urls, um eine anweisungsbasierte Bearbeitung eines vorhandenen Bildes auszuführen, oder geben Sie mehrere URLs an, um eine Personalisierung zu steuern, die ein konsistentes Subjekt über verschiedene Szenen hinweg beibehält. Lassen Sie das Feld für die Standard-Text-to-image-Generierung leer. Für Bearbeitungs-Workflows steht ein dediziertes Modell hidream-o1-1.5/edit zum gleichen Preis pro Bild zur Verfügung.
Die HiDream O1 1.5 Image API kostet auf Atlas Cloud $0.044 pro Bild, und die Text-to-image- und Edit-Modelle nutzen denselben Tarif. Die Abrechnung erfolgt nutzungsbasiert mit transparenter Preisgestaltung pro Aufruf, sodass Sie nur für die Bilder zahlen, die Sie generieren, ganz ohne Abonnement. Starten Sie noch heute mit der Entwicklung.
Auf Atlas Cloud wählen Sie eine vordefinierte Größe wie square_hd mit 1024x1024, und das Modell synthetisiert jedes Bild direkt aus Rohpixeln über seinen unified transformer, statt es in einen latent space zu komprimieren. Da Details und Text im Bild generiert und nicht aus einem Engpass hochskaliert werden, ist HiDream für saubere Typografie und scharfe Kanten in Postern und Produktgrafiken bekannt.