
HiDream O1 1.5 Image API wprowadza zunifikowany model bazowy HiDream.ai do Twojego stosu, obsługując generowanie obrazów z tekstu, edycję pojedynczych obrazów oraz personalizację opartą na obiekcie w jednym systemie na poziomie pikseli. Dostosuj guidance i liczbę kroków inference, aby uzyskać wysoką zgodność z promptem w sześciu presetach proporcji obrazu. Atlas Cloud udostępnia go przez jeden endpoint zgodny z OpenAI, z przejrzystymi cenami pay-as-you-go na poziomie $0.044 za obraz. Zacznij budować już dziś.
Compare what each route of the HiDream O1 1.5 Image API takes in, renders out, and charges per call.
| Modality | Description |
|---|---|
| HiDream O1 1.5 Text-to-Image API (Text To Image) | Turn a written prompt of up to 2,500 characters into a fully composed image across six presets, from a 512x512 square to 16:9 landscape, with PNG, JPEG, or WebP output. Denoising steps range from 1 to 100 and guidance scale from 1.0 to 20.0, so each request can trade speed against how tightly the result follows your prompt. At $0.044 per image, it fits e-commerce mockups, advertising concepts, and game art produced at volume. |
| HiDream O1 1.5 Edit API (Image Editing) | Feed one reference image URL alongside your instruction and this endpoint rewrites that image, or pass several URLs for subject-driven personalization across a set. It shares the same six size presets, 1 to 100 inference steps, and 1.0 to 20.0 guidance range as the text-to-image route, returning PNG, JPEG, or WebP. Billed at $0.044 per image, it handles product retouching, background swaps, and consistent character edits. |
HiDream O1 1.5 Image API łączy generowanie obrazów z tekstu, edycję opartą na instrukcjach oraz personalizację sterowaną tematem w jednym pixel-native model, który renderuje dokładny tekst dwujęzyczny i daje deweloperom bezpośrednią kontrolę nad guidance, sampling steps oraz formatem wyjściowym.

Wyślij prompt o długości do 2,500 znaków, a model wyrenderuje go jako gotowy obraz za pomocą pojedynczego pixel-native transformer, który koduje piksele, tekst i warunki zadania we wspólnej przestrzeni. Ponieważ w procesie nie ma zewnętrznego VAE ani osobnego text encoder, drobne detale i kompozycja pozostają stabilne nawet przy gęstych, wieloczęściowych opisach. Dzięki temu jest to niezawodna baza do concept art, materiałów marketingowych i makiet produktów.

Niewiele modeli obrazów potrafi umieszczać czytelne słowa w kompozycji, a HiDream O1 1.5 renderuje tekst chiński, angielski, ciągi mieszane językowo oraz dane liczbowe na tyle czysto, że można pominąć ręczny retusz. Konstrukcja pixel-native obsługuje układy wieloobszarowe, zachowując ostrość nagłówków, podpisów i etykiet tam, gdzie modele latent-space często rozmywają lub zniekształcają liternictwo. Projektanci mogą tworzyć szkice plakatów, opakowań i grafik do mediów społecznościowych z tekstem gotowym do publikacji.

Gdy przekażesz jeden URL obrazu referencyjnego wraz z instrukcją w języku naturalnym, taką jak remove the earphones, endpoint edycji zastosuje zmianę, zachowując otaczającą kompozycję. Ten sam model, który generuje, również edytuje, więc oświetlenie, styl i niezmienione obszary pozostają spójne, zamiast być odtwarzane od zera. Zespoły sięgają po niego, aby iterować na zatwierdzonych materiałach wizualnych bez pełnego przeprojektowania.

Wiele URL-i obrazów referencyjnych pozwala modelowi uchwycić temat i przenosić jego tożsamość między zupełnie nowymi scenami, pozami i tłami. Ten tryb sterowany tematem sprawia, że postać, produkt lub maskotka marki pozostają rozpoznawalne z jednej generacji na kolejną bez fine-tuning dla każdego obrazu. Sprawdza się w kampaniach, storyboardach i assetach do gier, w których ta sama figura musi pojawiać się wszędzie.

Ile kontroli naprawdę potrzebujesz? Dostosuj guidance_scale od 1.0 do 20.0 oraz inference steps od 1 do 100, wybierz jeden z sześciu presetów proporcji i eksportuj jako PNG, JPEG lub WebP. Każde wywołanie przechodzi przez jeden endpoint zgodny z OpenAI, w przejrzystej cenie $0.044 za obraz, z rozliczeniem pay-as-you-go i bez subskrypcji. Zacznij budować już dziś.
Send one identical prompt through the HiDream O1 1.5 Image API alongside two rival image models, then compare how each reads the same words into composition, lighting, and fine detail.
A bustling morning fish market in a Mediterranean harbor town, wooden stalls lined with hand-chalked price boards spelling out the day's fresh catch, a young fishmonger in a striped apron laughing mid-gesture as she tosses a silver sardine into the air, low golden side light raking across wet cobblestones and glistening fish scales, deep telephoto compression stacking the stalls into a soft misty harbor behind, palette of teal shutters against warm terracotta walls and cold silver fish, crisp chalk lettering and weathered wood grain, candid documentary reportage photography, 35mm, wide 16:9 aspect ratio, full-bleed

Generated with HiDream O1 1.5 on Atlas Cloud

Generated with Nano Banana Pro on Atlas Cloud

Generated with Seedream v4.5 on Atlas Cloud
A pair of scarlet macaws caught mid-squabble over a fruiting cecropia branch, wings flared into a burst of crimson and cobalt, one bird tumbling upside down mid-flap, backlit by soft overcast jungle light glowing through translucent feathers, shot on a 400mm telephoto that compresses layered misty rainforest into the background, generous negative space of pale sky filling the right third, complementary red plumage read against deep emerald foliage, feather barbs and beak texture rendered razor sharp, natural-history wildlife photography, wide 16:9 aspect ratio, full-bleed

Generated with HiDream O1 1.5 on Atlas Cloud

Generated with Nano Banana Pro on Atlas Cloud

Generated with Seedream v4.5 on Atlas Cloud
W e-commerce, reklamie, grafice do gier i kampaniach społecznościowych HiDream O1 1.5 Image API zamienia pojedynczy prompt lub zestaw referencji w generowanie, edycję i spersonalizowane materiały ze spójnym motywem za stałą cenę $0.044 za obraz.
Zespoły retail generują ujęcia produktów i sceny lifestyle’owe z promptu tekstowego za $0.044 za obraz, wybierając spośród sześciu presetów proporcji obrazu. Materiały katalogowe powstają bez sesji zdjęciowej ani oczekiwania na studio.
Twórz plakaty i banery kampanii renderowane jako precyzyjnie skomponowane układy z filmowym oświetleniem, w kadrach poziomych, pionowych i kwadratowych. Agencje iterują nad główną kreacją podczas jednej sesji, a następnie przekazują klientom grafiki gotowe do produkcji.
Jeden obraz referencyjny oraz prompt edycyjny pozwalają modelowi zmienić styl, wyretuszować lub przekomponować zdjęcie, zachowując jego strukturę i oświetlenie. Projektanci poprawiają tła lub podmieniają elementy bez pełnego edytora.
Podaj kilka obrazów referencyjnych, a model zachowa spójność postaci, produktu lub maskotki w zupełnie nowych scenach. Studia budują wielokrotnego użytku zasoby marki i serie kampanii, które pozostają zgodne z modelem.
Gdy zespół gry potrzebuje środowisk, rekwizytów lub koncepcji postaci, model zwraca szczegółowe grafiki dostrojone przez guidance scale i inference steps. Dyrektorzy artystyczni eksplorują kierunki wizualne, zanim zaangażują czas studia.
Prowadzisz napięty kalendarz treści? Marketerzy szybko tworzą przyciągające uwagę grafiki do postów, stories i miniaturek w presetach kwadratowych, pionowych i poziomych, każdą renderowaną za stałą i przewidywalną cenę $0.044 za obraz.
Zobacz, jak HiDream O1 1.5 Image API wypada w porównaniu z modelami obrazów Alibaba i ByteDance pod względem wbudowanego rozumowania, tekstu dwujęzycznego, otwartych wag i kosztu za obraz.
| Model | Dostawca | Reasoning Prompt Agent | Renderowanie tekstu dwujęzycznego | Otwarte wagi | Cena (za obraz) |
|---|---|---|---|---|---|
| HiDream O1 1.5 Text-to-Image | HiDream.ai | √ | √ | √ | $0.044 |
| HiDream O1 1.5 Edit | HiDream.ai | √ | √ | √ | $0.044 |
| Qwen Image 2.0 | Alibaba (Qwen) | - | √ | - | $0.035 |
| Seedream v4.5 | ByteDance | - | √ | - | $0.04 |
Zacznij w kilka minut — wykonaj te proste kroki, aby zintegrować i wdrożyć modele za pośrednictwem platformy Atlas Cloud.
Zarejestruj się na atlascloud.ai i ukończ weryfikację. Nowi użytkownicy otrzymują bezpłatne kredyty do eksploracji platformy i testowania modeli.
Połączenie zaawansowanych modeli HiDream z platformą GPU-akcelerowaną Atlas Cloud zapewnia niezrównaną wydajność, skalowalność i doświadczenie deweloperskie.
Niska Latencja:
Inferencja zoptymalizowana pod GPU dla rozumowania w czasie rzeczywistym.
Zunifikowane API:
Uruchamiaj HiDream, GPT, Gemini i DeepSeek za pomocą jednej integracji.
Przejrzysta Wycena:
Przewidywalne rozliczenia za token z opcjami serverless.
Doświadczenie Dewelopera:
SDK, analityka, narzędzia dostrajania i szablony.
Niezawodność:
99,99% dostępności, RBAC i logowanie gotowe na zgodność.
Bezpieczeństwo i Zgodność:
SOC 2 Type II, zgodność z HIPAA, suwerenność danych w USA.
HiDream O1 1.5 Image API zapewnia deweloperom programistyczny dostęp do zunifikowanego modelu generowania obrazów HiDream za pośrednictwem pojedynczego endpointu zgodnego z OpenAI w Atlas Cloud. Oparty na zunifikowanym transformerze działającym na poziomie pikseli, obsługuje generowanie text-to-image, edycję oraz personalizację opartą na obiekcie przy użyciu jednego modelu zamiast zestawu oddzielnych narzędzi. Dostęp jest dostępny od Day-0 w modelu pay-as-you-go, z przejrzystą ceną za każde wywołanie.
Poza prostym generowaniem text-to-image model obsługuje edycję opartą na instrukcjach, personalizację obiektu na podstawie wielu obrazów referencyjnych oraz dokładne renderowanie długiego tekstu na potrzeby plakatów i grafik komercyjnych. Zespoły sięgają po niego przy wizualizacjach produktów e-commerce, kreacjach reklamowych i grafice do gier, gdzie liczą się zarówno precyzyjna kompozycja, jak i czytelny tekst na obrazie.
Tak. HiDream O1 1.5 został wytrenowany do interpretowania zniuansowanych promptów zarówno po chińsku, jak i po angielsku, a także renderuje wielojęzyczny tekst na obrazie z wysoką dokładnością. Dzięki temu jest praktycznym wyborem dla zespołów publikujących zlokalizowane materiały wizualne bez przełączania się między modelami.
HiDream O1 1.5 Image API wywołujesz za pomocą jednego klucza zgodnego z OpenAI, więc większość istniejących SDK działa po skierowaniu ich na endpoint Atlas Cloud. Wyślij żądanie z promptem i opcjonalnymi parametrami do modelu hidream-o1-1.5/text-to-image, a następnie odbierz wygenerowany obraz. Po Twojej stronie nie jest wymagany oddzielny hosting modelu ani infrastruktura GPU.
Prompty mogą mieć do 2,500 znaków, a rozmiar wybierasz spośród presetów, w tym square_hd w 1024x1024, square w 512x512 oraz opcji portretowych i poziomych w 4:3 i 16:9. Możesz też dostosować num_inference_steps w zakresie od 1 do 100, z wartością domyślną 50, ustawić guidance_scale między 1.0 a 20.0, z wartością domyślną 5.0, oraz zwrócić plik PNG, JPEG lub WebP.
Przekaż pojedynczy URL w reference_image_urls, aby uruchomić edycję istniejącego obrazu na podstawie instrukcji, albo podaj wiele URL-i, aby sterować personalizacją zachowującą spójny obiekt w różnych scenach. Pozostaw to pole puste dla standardowego generowania text-to-image. Do workflow edycyjnych dostępny jest dedykowany model hidream-o1-1.5/edit w tej samej stawce za obraz.
HiDream O1 1.5 Image API w Atlas Cloud kosztuje $0.044 za obraz, a modele text-to-image i edit mają tę samą stawkę. Rozliczanie działa w modelu pay-as-you-go z przejrzystą ceną za każde wywołanie, więc płacisz tylko za wygenerowane obrazy, bez subskrypcji. Zacznij budować już dziś.
W Atlas Cloud wybierasz preset rozmiaru, taki jak square_hd w 1024x1024, a model syntetyzuje każdy obraz bezpośrednio z surowych pikseli za pomocą zunifikowanego transformera, zamiast kompresować go do przestrzeni latentnej. Ponieważ detale i tekst na obrazie są generowane, a nie upscalowane z wąskiego gardła, HiDream słynie z czystej typografii i ostrych krawędzi na plakatach oraz grafikach produktowych.