لأسبوعين فقط | خصم 20% على Seedream 5.0 Pro!
HiDream O1 1.5 Image API for Pixel-Native Creation

HiDream O1 1.5 Image API for Pixel-Native Creation

تجلب HiDream O1 1.5 Image API نموذج HiDream.ai الأساسي الموحّد إلى بيئتك التقنية، لتشغيل تحويل النص إلى صورة، وتحرير صورة واحدة، والتخصيص المعتمد على الموضوع ضمن نظام واحد على مستوى البكسل. اضبط التوجيه وخطوات الاستدلال للحصول على التزام قوي بالموجهات عبر ستة إعدادات مسبقة لنِسب العرض إلى الارتفاع. توفره Atlas Cloud عبر endpoint واحد متوافق مع OpenAI مع تسعير شفاف بنظام الدفع حسب الاستخدام بسعر $0.044 لكل صورة. ابدأ البناء اليوم.

Every HiDream O1 1.5 Image API Endpoint, Side by Side

Compare what each route of the HiDream O1 1.5 Image API takes in, renders out, and charges per call.

ModalityDescription
HiDream O1 1.5 Text-to-Image API (Text To Image)Turn a written prompt of up to 2,500 characters into a fully composed image across six presets, from a 512x512 square to 16:9 landscape, with PNG, JPEG, or WebP output. Denoising steps range from 1 to 100 and guidance scale from 1.0 to 20.0, so each request can trade speed against how tightly the result follows your prompt. At $0.044 per image, it fits e-commerce mockups, advertising concepts, and game art produced at volume.
HiDream O1 1.5 Edit API (Image Editing)Feed one reference image URL alongside your instruction and this endpoint rewrites that image, or pass several URLs for subject-driven personalization across a set. It shares the same six size presets, 1 to 100 inference steps, and 1.0 to 20.0 guidance range as the text-to-image route, returning PNG, JPEG, or WebP. Billed at $0.044 per image, it handles product retouching, background swaps, and consistent character edits.

Precision and Control Built into the HiDream O1 1.5 Image API

The HiDream O1 1.5 Image API unifies text-to-image generation, instruction-based editing, and subject-driven personalization inside one pixel-native model that renders accurate bilingual text and hands developers direct control over guidance, sampling steps, and output format.

Text-to-Image with the HiDream O1 1.5 Image API

Text-to-Image with the HiDream O1 1.5 Image API

Send a prompt of up to 2,500 characters and the model renders it as a finished image through a single pixel-native transformer that encodes pixels, text, and task conditions in one shared space. Because no external VAE or separate text encoder sits in the path, fine detail and composition stay stable across dense, multi-clause descriptions. This makes it a dependable base for concept art, marketing visuals, and product mockups.

Bilingual Text and Layout Rendering

Bilingual Text and Layout Rendering

Few image models place legible words inside a composition, yet HiDream O1 1.5 renders Chinese, English, mixed-language strings, and numerical data cleanly enough to skip manual retouching. The pixel-native design handles multi-region layouts, keeping headlines, captions, and labels sharp where latent-space models often blur or garble type. Designers can draft posters, packaging, and social graphics whose text is ready to ship.

In-Context Editing on the HiDream O1 1.5 Image API

In-Context Editing on the HiDream O1 1.5 Image API

When you pass one reference image URL with a plain-language instruction such as remove the earphones, the edit endpoint applies the change while preserving the surrounding composition. The same model that generates also edits, so lighting, style, and untouched regions stay consistent rather than being rebuilt from scratch. Teams reach for it to iterate on approved visuals without a full redesign.

Subject-Driven Personalization

Subject-Driven Personalization

Multiple reference image URLs let the model lock onto a subject and carry its identity across entirely new scenes, poses, and backgrounds. This subject-driven mode keeps a character, product, or brand mascot recognizable from one generation to the next without any per-image fine-tuning. It suits campaigns, storyboards, and game assets where the same figure has to appear everywhere.

One Key, Full Control, Pay-As-You-Go

One Key, Full Control, Pay-As-You-Go

How much control do you actually need? Tune guidance_scale from 1.0 to 20.0 and inference steps from 1 to 100, choose one of six aspect presets, and export as PNG, JPEG, or WebP. Every call runs through one OpenAI-compatible endpoint at a transparent $0.044 per image with pay-as-you-go billing and no subscription. Start building today.

HiDream O1 1.5 Image API مقابل النماذج الرائدة: مطالبة واحدة، ثلاثة تصييرات

أرسل مطالبة واحدة متطابقة عبر HiDream O1 1.5 Image API إلى جانب نموذجين منافسين للصور، ثم قارن كيف يحوّل كل نموذج الكلمات نفسها إلى تكوين وإضاءة وتفاصيل دقيقة.

الموجه

سوق سمك صباحي يعجّ بالحركة في بلدة مرفئية متوسطية، أكشاك خشبية مصطفّة تعلوها لوحات أسعار مكتوبة بالطباشير بخط اليد تعرض صيد اليوم الطازج، بائعة سمك شابة ترتدي مئزرًا مخططًا تضحك في منتصف إيماءة وهي تقذف سردينة فضية في الهواء، ضوء جانبي ذهبي منخفض ينساب على الحجارة المرصوفة المبللة وقشور السمك اللامعة، ضغط تيليفوتوغرافي عميق يكدّس الأكشاك أمام خلفية مرفأ ضبابية ناعمة، لوحة ألوان من مصاريع بلون أزرق مخضر مقابل جدران تيراكوتا دافئة وأسماك فضية باردة، حروف طباشيرية حادة وملمس خشب متآكل بفعل الزمن، تصوير فوتوغرافي وثائقي عفوي بأسلوب reportage، 35mm، نسبة عرض إلى ارتفاع عريضة 16:9، ممتد حتى الحواف

Generated with HiDream O1 1.5 on Atlas Cloud

Generated with HiDream O1 1.5 on Atlas Cloud

Generated with Nano Banana Pro on Atlas Cloud

Generated with Nano Banana Pro on Atlas Cloud

Generated with Seedream v4.5 on Atlas Cloud

Generated with Seedream v4.5 on Atlas Cloud

الموجه

زوج من ببغاوات المكاو القرمزية في لحظة شجار فوق غصن سيكروبيا مثمر، أجنحة مفرودة في انفجار من القرمزي والكوبالت، أحد الطائرين يتقلب رأسًا على عقب في منتصف رفرفة، مضاء من الخلف بضوء غابة ناعم ملبّد بالغيوم يتوهج عبر الريش الشفاف، ملتقط بعدسة تيليفوتو 400mm تضغط طبقات الغابة المطيرة الضبابية في الخلفية، مساحة سلبية واسعة من سماء باهتة تملأ الثلث الأيمن، ريش أحمر متكامل لونيًا يبرز أمام أوراق زمردية عميقة، شعيرات الريش وملمس المنقار مرسومان بحدة فائقة، تصوير فوتوغرافي للحياة البرية بأسلوب التاريخ الطبيعي، نسبة عرض إلى ارتفاع عريضة 16:9، ممتد حتى الحواف

Generated with HiDream O1 1.5 on Atlas Cloud

Generated with HiDream O1 1.5 on Atlas Cloud

Generated with Nano Banana Pro on Atlas Cloud

Generated with Nano Banana Pro on Atlas Cloud

Generated with Seedream v4.5 on Atlas Cloud

Generated with Seedream v4.5 on Atlas Cloud

من الفكرة النصية إلى الإنتاج باستخدام HiDream O1 1.5 Image API

عبر التجارة الإلكترونية والإعلانات وفن الألعاب والحملات الاجتماعية، يحوّل HiDream O1 1.5 Image API فكرة نصية واحدة أو مجموعة مراجع إلى توليد وتحرير وتخصيص متّسق للموضوع بسعر ثابت قدره $0.044 لكل صورة.

مرئيات منتجات التجارة الإلكترونية

تولّد فرق التجزئة صور منتجات ومشاهد أسلوب حياة من فكرة نصية بسعر $0.044 لكل صورة، مع الاختيار من بين ستة إعدادات مسبقة لنسب الأبعاد. تُنجَز مرئيات الكتالوجات دون جلسة تصوير أو انتظار دور الاستوديو.

تصميمات إعلانية مبنية على HiDream O1 1.5 Image API

أنشئ ملصقات ولافتات للحملات بتكوينات محكمة وإضاءة سينمائية عبر إطارات أفقية وعمودية ومربعة. تكرّر الوكالات العمل على التصميم الرئيسي في جلسة واحدة، ثم تسلّم العملاء أعمالًا فنية جاهزة للإنتاج.

تحرير صور دقيق

تتيح صورة مرجعية واحدة مع فكرة تحريرية للنموذج إعادة تصميم الصورة أو تنقيحها أو إعادة تركيبها مع الحفاظ على بنيتها وإضاءتها. يصلح المصممون الخلفيات أو يستبدلون العناصر دون الحاجة إلى محرر كامل.

شخصيات متّسقة باستخدام HiDream O1 1.5 Image API

زوّد النموذج بعدة صور مرجعية، وسيحافظ على اتساق شخصية أو منتج أو تميمة عبر مشاهد جديدة تمامًا. تبني الاستوديوهات أصولًا قابلة لإعادة الاستخدام وسلاسل حملات تظل مطابقة للنموذج.

فن الألعاب وتصميم المفاهيم

عندما يحتاج فريق ألعاب إلى بيئات أو عناصر أو مفاهيم شخصيات، يعيد النموذج أعمالًا فنية مفصلة مضبوطة عبر guidance scale وinference steps. يستكشف مديرو الفن الاتجاهات البصرية قبل تخصيص وقت الاستوديو.

حملات اجتماعية على HiDream O1 1.5 Image API

هل تدير تقويم محتوى مزدحمًا؟ يستطيع المسوّقون إنشاء رسومات لافتة للتمرير للمنشورات والقصص والصور المصغرة عبر إعدادات مسبقة مربعة وعمودية وأفقية، وكلها بسعر ثابت ومتوقع قدره $0.044 لكل صورة.

كيف تقارن HiDream O1 1.5 Image API بنماذج الصور المنافسة

تعرّف على موقع HiDream O1 1.5 Image API مقارنةً بنماذج الصور من Alibaba وByteDance من حيث الاستدلال المدمج، والنصوص ثنائية اللغة، والأوزان المفتوحة، وتكلفة كل صورة.

النموذجالمزوّدوكيل موجهات الاستدلالعرض النصوص ثنائية اللغةالأوزان المفتوحةالسعر (لكل صورة)
HiDream O1 1.5 Text-to-ImageHiDream.ai$0.044
HiDream O1 1.5 EditHiDream.ai$0.044
Qwen Image 2.0Alibaba (Qwen)--$0.035
Seedream v4.5ByteDance--$0.04

كيفية استخدام HiDream على Atlas Cloud

Get started in minutes — follow these simple steps to integrate and deploy models through Atlas Cloud’s platform.

إنشاء حساب Atlas Cloud

سجّل في atlascloud.ai وأكمل التحقق. يحصل المستخدمون الجدد على رصيد مجاني لاستكشاف المنصة واختبار النماذج.

لماذا تستخدم HiDream على Atlas Cloud

دمج نماذج HiDream المتقدمة مع منصة Atlas Cloud المسرّعة بـ GPU يوفر أداءً لا مثيل له وقابلية للتوسع وتجربة مطور استثنائية.

الأداء والمرونة

زمن انتقال منخفض:
استدلال محسّن لـ GPU للاستجابة في الوقت الفعلي.

API موحد:
قم بتشغيل HiDream و GPT و Gemini و DeepSeek من خلال تكامل واحد.

تسعير شفاف:
فواتير يمكن التنبؤ بها لكل رمز مع خيارات بدون خادم.

المؤسسات والتوسع

تجربة المطور:
SDKs والتحليلات وأدوات الضبط الدقيق والقوالب.

الموثوقية:
وقت تشغيل 99.99%، RBAC، وتسجيل جاهز للامتثال.

الأمان والامتثال:
SOC 2 Type II، توافق HIPAA، سيادة البيانات في الولايات المتحدة.

أسئلة وأجوبة حول HiDream O1 1.5 Image API

يمنح HiDream O1 1.5 Image API المطوّرين وصولًا برمجيًا إلى نموذج توليد الصور الموحّد من HiDream عبر نقطة نهاية واحدة متوافقة مع OpenAI على Atlas Cloud. وبفضل بنائه على محوّل موحّد على مستوى البكسل، يوفّر من نموذج واحد إمكانات تحويل النص إلى صورة، والتحرير، والتخصيص المعتمد على الموضوع، بدلًا من استخدام مجموعة أدوات منفصلة. الوصول متاح من Day-0 بنظام الدفع حسب الاستخدام، مع تسعير شفاف لكل استدعاء.

إلى جانب توليد الصور مباشرة من النص، يتعامل النموذج مع التحرير القائم على التعليمات، والتخصيص المعتمد على الموضوع عبر عدة صور مرجعية، وعرض النصوص الطويلة بدقة للملصقات والرسومات التجارية. تعتمد عليه الفرق في صور منتجات التجارة الإلكترونية، والإبداعات الإعلانية، ورسومات الألعاب، حيث يكون كل من ضبط التكوين ووضوح النص داخل الصورة أمرين مهمين.

نعم. تم تدريب HiDream O1 1.5 على فهم المطالبات الدقيقة بكل من الصينية والإنجليزية، كما يعرض النصوص متعددة اللغات داخل الصور بدقة عالية. وهذا يجعله خيارًا عمليًا للفرق التي تطلق مرئيات مترجمة دون الحاجة إلى التبديل بين النماذج.

يمكنك استدعاء HiDream O1 1.5 Image API باستخدام مفتاح واحد متوافق مع OpenAI، لذا ستعمل معظم حزم SDK الحالية بمجرد توجيهها إلى نقطة نهاية Atlas Cloud. أرسل طلبًا يتضمن المطالبة وأي معلمات اختيارية إلى نموذج hidream-o1-1.5/text-to-image، ثم اقرأ الصورة الناتجة. لا تحتاج من جانبك إلى استضافة نموذج منفصلة أو بنية تحتية لوحدات GPU.

يمكن أن يصل طول المطالبات إلى 2,500 حرف، ويمكنك الاختيار من أحجام جاهزة تشمل square_hd بدقة 1024x1024، وsquare بدقة 512x512، إضافة إلى خيارات عمودية وأفقية بنسب 4:3 و16:9. يمكنك أيضًا ضبط num_inference_steps من 1 إلى 100 مع قيمة افتراضية 50، وتعيين guidance_scale بين 1.0 و20.0 مع قيمة افتراضية 5.0، وإرجاع الصور بصيغ PNG أو JPEG أو WebP.

مرّر عنوان URL واحدًا في reference_image_urls لتشغيل تحرير قائم على التعليمات لصورة موجودة، أو قدّم عدة عناوين URL لتوجيه تخصيص يحافظ على موضوع متسق عبر المشاهد. اترك الحقل فارغًا لتوليد الصور القياسي من النص. يتوفر نموذج مخصص باسم hidream-o1-1.5/edit لسير عمل التحرير وبنفس السعر لكل صورة.

يبلغ سعر HiDream O1 1.5 Image API ‏$0.044 لكل صورة على Atlas Cloud، وتشترك نماذج text-to-image وedit في السعر نفسه. تتم الفوترة بنظام الدفع حسب الاستخدام مع تسعير شفاف لكل استدعاء، لذا تدفع فقط مقابل الصور التي تولّدها دون اشتراك. ابدأ البناء اليوم.

على Atlas Cloud يمكنك اختيار حجم جاهز مثل square_hd بدقة 1024x1024، ويقوم النموذج بتوليف كل صورة مباشرة من البكسلات الخام عبر المحوّل الموحّد لديه بدلًا من ضغطها في فضاء كامن. وبما أن التفاصيل والنصوص داخل الصورة تُولَّد مباشرة بدلًا من تكبيرها من عنق زجاجة، يُعرف HiDream بطباعة نظيفة وحواف حادة في الملصقات ورسومات المنتجات.

استكشف المزيد من العائلات

Seedance 2.0

تمنحك واجهة برمجة تطبيقات Seedance 2.0 وصولاً إنتاجيًا إلى نموذج الفيديو متعدد الوسائط من ByteDance — إدخالات رباعية الوسائط (نص، صورة، فيديو، صوت) ونظام "Universal Reference" الرائد في الصناعة والذي يثبت التكوين وحركة الكاميرا وإجراءات الشخصيات عبر اللقطات. قم بدمج تحكم على مستوى المخرج من خلال استدعاء API واحد، بسعر ثابت قدره 0.09 دولار/ثانية، ومفتاح فوري، وبدون قائمة انتظار — مدعومًا بوقت تشغيل وامتثال على مستوى المؤسسات. Seedance 2.0 Native 4K متاح الآن!

عرض العائلة

Grok Imagine

توفر Grok Imagine API للمطورين إمكانية إنشاء الصور ومقاطع الفيديو والصوت من xAI في حزمة واحدة. وتنتج صورًا بدقة تصل إلى 2K مع عرض نص متعدد اللغات، بالإضافة إلى مقاطع فيديو تصل مدتها إلى 15 ثانية مع صوت أصلي متزامن وتحرير قائم على المراجع. على Atlas Cloud، يقوم مفتاح واحد بتشغيل كل وضع من أوضاع Grok Imagine، لذا يمكنك التنقل بين الصور والفيديو والصوت دون إعدادات منفصلة، بدءًا من 0.02 دولار لكل صورة و0.05 دولار لكل ثانية.

عرض العائلة

Gemini Omni Flash

يجلب Gemini Omni API إلى بنيتك التقنية نموذج التوليد والتحرير متعدد الوسائط للفيديو من Google DeepMind، الذي أُعلن عنه في Google I/O 2026. يدمج Gemini Omni محرك الاستدلال في Gemini مع الوسائط التوليدية، ويقبل أي مزيج من النصوص والصور والفيديو والصوت لإنتاج مخرجات متسقة ومستندة إلى المعرفة. حسّن النتائج عبر محادثة طبيعية: استبدل العناصر، وأعد كتابة المشاهد، وغيّر الأنماط، مع بقاء الفيزياء والشخصيات والاستمرارية سليمة دون أي خلل. توفر Atlas Cloud تشكيلة Gemini Omni Flash الكاملة — تحويل النص إلى فيديو، وتحويل الصورة إلى فيديو مع ما يصل إلى 7 صور مرجعية، وتحويل المرجع إلى فيديو — عبر واجهة API موحدة بتسعير شفاف لكل ثانية يبدأ من $0.112 ومن دون اشتراك. ابدأ البناء اليوم.

عرض العائلة

GPT Image 2

توفر واجهة برمجة تطبيقات GPT Image 2 للمطورين إمكانية الوصول إلى أحدث نموذج صور من OpenAI، وهو خليفة GPT Image 1.5. يقوم النموذج بإنشاء الصور وتعديلها مع عرض دقيق للنصوص عبر الحروف اللاتينية ونصوص CJK، بالإضافة إلى تكوين قوي للملصقات والنماذج المبدئية والرسوم البيانية (الإنفوجرافيك). على Atlas Cloud، يمكنك الوصول إليه من خلال واجهة برمجة تطبيقات موحدة بجانب أكثر من 300 نموذج، مع أرصدة مجانية، ووقت تشغيل بنسبة 99.99%، وبدون الحاجة إلى التحقق من مؤسسة OpenAI.

عرض العائلة

Google

تتوفر أقوى النماذج الإبداعية من Google بالكامل على Atlas Cloud. يقدم Veo 3.1 توليد فيديو سينمائي، ويدعم Nano Banana 2 إنشاء صور عالية الدقة، ويجلب Gemini ذكاءً متعدد الوسائط لكل سير عمل. يمكنك الوصول إلى مجموعة نماذج Google الكاملة من خلال مفتاح API key واحد مع توفر Day-0 وتسعير الدفع حسب الاستخدام (pay-as-you-go).

عرض العائلة

Seedance 2.0 Mini

يجلب Seedance 2.0 Mini إنشاء مقاطع الفيديو متعددة الوسائط من ByteDance إلى مسارات العمل حيث تعتبر السرعة والتكلفة الأكثر أهمية. إنه يوفر القدرات الأساسية لـ Seedance 2.0 ببصمة أخف — إنشاء أسرع، وتكلفة أقل لكل مقطع فيديو، ونفس تكامل API الذي تستخدمه بالفعل. بالنسبة للفرق التي تدير مسارات عمل ذات حجم كبير أو تقوم بالنماذج الأولية على نطاق واسع، فإن Mini هو الخيار الافتراضي العملي.

عرض العائلة

ByteDance

من إنشاء مقاطع الفيديو السينمائية إلى توليد الصور عالية الدقة، أصبحت أقوى نماذج ByteDance متاحة الآن على Atlas Cloud. يمكنك تشغيل Seedance و Seedream على نطاق واسع بأقل أسعار للاستدلال وبدون أي أعباء إضافية للبنية التحتية.

عرض العائلة

Alibaba

تجمع Atlas Cloud مجموعة نماذج Alibaba الكاملة ضمن API واحد: Qwen لمهام اللغة والصورة، و Wan لإنشاء مقاطع الفيديو بدقة تصل إلى 1080p. يمكنك الوصول إلى كل نموذج بنظام الدفع حسب الاستخدام (pay-as-you-go) دون أي اشتراكات. تتوفر Alibaba API عبر عنوان URL أساسي واحد باستخدام عميلك الحالي المتوافق مع OpenAI.

عرض العائلة

OpenAI

تمنحك Atlas Cloud إمكانية الوصول إلى مجموعة API الكاملة من OpenAI، بدءًا من GPT Image 2 لتوليد الصور وحتى Sora 2 للفيديو. يتوفر كل نموذج بنظام الدفع حسب الاستخدام بدون أي التزام شهري. يمكنك الربط بسهولة عن طريق تبديل عنوان URL الأساسي باستخدام الـ API المتوافق مع OpenAI.

عرض العائلة

xAI

قم ببناء مسارات عمل كاملة للصور والفيديو باستخدام xAI API على Atlas Cloud. قم بالتوليد بدقة 2K، والتحرير باستخدام صور مرجعية، وتحريك الصور إلى مقاطع متزامنة مع الصوت.

عرض العائلة

Kwaivgi

واجهة برمجة تطبيقات Kwaivgi (API) بسعر أقل بنسبة 15% من السعر القياسي. توفر Atlas Cloud وصولاً من اليوم الأول (Day-0) إلى إصدارات Kling الجديدة مع تسعير الدفع حسب الاستخدام وبدون حدود لعدد المقاعد. حساب واحد، مفتاح واحد، وكل نماذج Kling من المستوى القياسي إلى المستوى الرئيسي (master).

عرض العائلة

Seedream 5.0 Pro

يوفر واجهة برمجة التطبيقات Seedream 5.0 Pro API للمطورين نموذج تحرير الصور القابل للتحكم من ByteDance على Atlas Cloud. وهو يضع التعديلات بدقة باستخدام نقاط الإرساء والإحداثيات، ويفصل الصور إلى طبقات قابلة للتحرير، ويدمج مراجع متعددة، ويطابق الألوان والمواد الدقيقة، مع نص متعدد اللغات بدقة 2K و 3K. على Atlas Cloud، يمكنك الوصول إليه من خلال مفتاح واحد!

عرض العائلة

واجهة برمجية واحدة لكل وسائط الذكاء الاصطناعي.

استكشف جميع النماذج