เพียง 2 สัปดาห์เท่านั้น | รับส่วนลด 20% สำหรับ Seedream 5.0 Pro!

Baidu Models on Atlas Cloud | ERNIE

Atlas Cloud โฮสต์ ERNIE Image และ ERNIE Image Turbo ภายใต้ Baidu API โดยทั้งคู่ใช้ระบบจ่ายตามการใช้งานจริง แต่ละโมเดลเป็นผู้นำด้านโอเพ่นซอร์สสำหรับการเรนเดอร์ข้อความในภาษาอังกฤษและภาษาจีน

AI Image Models by Baidu

สร้างภาพที่สวยตระการตาและพร้อมใช้งานจริงจากพรอมต์และภาพอ้างอิง ด้วยโมเดล AI สร้างภาพที่ล้ำสมัยที่สุดบน Atlas Cloud

ดูโมเดลทั้งหมด

Baidu Models API Pricing Details

Compare standard vs. our pricing across every Baidu model.

ModelStandard Price (USD)Our Price (USD)Discount
Baidu ERNIE Image Turbo Text-to-image
Start fromFree
View

Explore models from other providers

Instantly explore and experiment with 400+ production-ready models in the Atlas Playground. Start customizing with one click.

กรณีการใช้งาน Baidu API ที่คุณสามารถสร้างได้บน Atlas Cloud

ERNIE Image ถูกสร้างขึ้นสำหรับเวิร์กโฟลว์ที่ข้อความจะต้องสามารถอ่านได้ภายในภาพที่สร้างขึ้น ทีมต่างๆ ใช้เพื่อสร้างสินทรัพย์สองภาษา เค้าโครงที่มีโครงสร้าง และงานสร้างสรรค์ที่มีข้อความจำนวนมากในระดับขนาดใหญ่โดยไม่ต้องมีทีมออกแบบ

การสร้างโปสเตอร์การตลาดสองภาษา

ทีมการตลาดใช้ ERNIE Image เพื่อสร้างโปสเตอร์แคมเปญที่มีข้อความภาษาอังกฤษและภาษาจีนที่อ่านง่ายในการเรียกใช้ API เพียงครั้งเดียว โดยกำหนดเป้าหมายทั้งสองตลาดจากโครงสร้างพรอมต์ (prompt) เดียวกัน โมเดลเรนเดอร์สคริปต์ทั้งสองด้วยความแม่นยำสูงกว่า 0.96 ทำให้พาดหัวข่าวและเนื้อหาข้อความมีความคมชัดโดยไม่ต้องมีการแก้ไขในขั้นตอนโพสต์โปรดักชัน การกำหนดราคาแบบจ่ายตามการใช้งานจริงของ Atlas Cloud ทำให้สามารถสร้างแคมเปญได้หลายสิบรูปแบบในทางปฏิบัติ โดยไม่มีต้นทุนการออกแบบต่อชิ้นงาน

บรรจุภัณฑ์ผลิตภัณฑ์สำหรับแบรนด์ข้ามตลาด

แบรนด์ที่เข้าสู่ตลาดจีนใช้ ERNIE Image เพื่อสร้างแบบจำลองฉลากผลิตภัณฑ์และบรรจุภัณฑ์ที่มีข้อความสองภาษาที่ถูกต้องก่อนเข้าสู่ขั้นตอนการพิมพ์จริง โมเดลนี้จัดการภาษาจีนตัวย่อ ภาษาจีนตัวเต็ม และภาษาอังกฤษในเลย์เอาต์เดียวกัน รวมถึงข้อความขนาดเล็กบนฉลากและรายการส่วนผสม ที่ความละเอียดเอาต์พุต 1024×1024 แบบจำลองมีคุณภาพระดับการผลิตเพียงพอที่จะใช้ในการขออนุมัติจากลูกค้าและการยื่นเอกสารตามข้อบังคับ

การผลิตคอมมิกและเลย์เอาต์แบบหลายช่อง

ผู้จัดพิมพ์และสตูดิโอสร้างคอนเทนต์ใช้ ERNIE Image เพื่อสร้างช่องการ์ตูนที่มีบอลลูนคำพูด กล่องคำบรรยาย และข้อความในช่องที่แม่นยำในภาษาจีนหรือภาษาอังกฤษ โมเดลนี้ได้คะแนนสูงกว่า 0.96 บน LongTextBench โดยเฉพาะสำหรับเอาต์พุตข้อความในรูปภาพที่มีโครงสร้างประเภทนี้ ERNIE Image Turbo บน Atlas Cloud ให้บริการฟรี ซึ่งทำให้การร่างช่องการ์ตูนในปริมาณมากไม่มีค่าใช้จ่ายในช่วงระหว่างขั้นตอนการทำซ้ำ

การสร้างอินโฟกราฟิกอัตโนมัติ

ทีมข้อมูลสร้างไปป์ไลน์ที่แปลงข้อมูลที่มีโครงสร้างเป็นภาพอินโฟกราฟิกพร้อมป้ายกำกับ โดยใช้ความแม่นยำในการเรนเดอร์ข้อความของ ERNIE Image ป้ายกำกับแผนภูมิ กล่องข้อความ และส่วนหัวของหัวข้อจะถูกเรนเดอร์อย่างแม่นยำในทั้งสองภาษาจาก prompt เพียงอันเดียว ซึ่งช่วยลดขั้นตอนการออกแบบด้วยตนเองระหว่างการส่งออกข้อมูลและการสร้างภาพ Prompt Enhancer ในตัวจะเขียนคำอธิบายข้อมูลสั้นๆ ใหม่เป็นคำแนะนำเค้าโครงโดยละเอียดโดยอัตโนมัติ

ชิ้นงานโฆษณาที่ปรับให้เข้ากับท้องถิ่นในสเกลขนาดใหญ่

ทีมการตลาดเชิงประสิทธิภาพสร้างผลงานโฆษณาที่ปรับให้เข้ากับท้องถิ่นสำหรับตลาดที่พูดภาษาจีนและภาษาอังกฤษจากบรีฟแคมเปญเดียวกัน โดยใช้การรองรับสองภาษาของ ERNIE Image เพื่อผลิตทั้งสองรูปแบบภาษาในไปป์ไลน์เดียว ผลงานสร้างสรรค์แต่ละชิ้นมาพร้อมกับข้อความในรูปภาพที่แม่นยำ ช่วยลดความจำเป็นในการแก้ไขหรือจัดเรียงประเภทรูปภาพที่สร้างขึ้นใหม่ ระดับบริการ Turbo ฟรีบน Atlas Cloud ช่วยให้ต้นทุนการทดสอบเป็นศูนย์ในขณะที่ทีมงานประเมินว่าผลงานสร้างสรรค์รูปแบบใดที่ควรขยายขนาด

การสร้างข้อความสำหรับ UI Mockup

ทีมผลิตภัณฑ์และการออกแบบใช้ ERNIE Image เพื่อสร้างภาพหน้าจอแบบจำลอง UI พร้อมข้อความจำลองที่สมจริงซึ่งแสดงผลอย่างถูกต้องในภาษาอังกฤษหรือภาษาจีน โมเดลนี้จัดการป้ายกำกับปุ่ม ข้อความการนำทาง ฟิลด์แบบฟอร์ม และข้อความโมดอลที่มีความละเอียดสูง ทำให้สามารถนำแบบจำลองไปใช้ในงานนำเสนอได้โดยไม่ต้องแก้ไขเลเยอร์ข้อความด้วยตนเอง สิ่งนี้ช่วยลดเวลาจากแนวคิดโครงร่างไปสู่ภาพกราฟิกที่พร้อมนำเสนอต่อผู้มีส่วนได้ส่วนเสียจากหลายชั่วโมงเหลือเพียงไม่กี่นาที

Atlas Cloud AI

ติดต่อฝ่ายขาย

คำถามที่พบบ่อยเกี่ยวกับ Baidu

ERNIE Image ทำคะแนนได้สูงกว่า 0.96 บน LongTextBench สำหรับการเรนเดอร์ข้อความภาษาจีน ซึ่งสูงที่สุดในบรรดาโมเดลแปลงข้อความเป็นรูปภาพแบบโอเพนเวท (open-weight) โมเดลโอเพนซอร์สคู่แข่งส่วนใหญ่ทำคะแนนได้ต่ำกว่า 0.3 มากในสถานการณ์ที่มีข้อความภาษาจีน ทำให้ไม่น่าเชื่อถือสำหรับเวิร์กโฟลว์ใดๆ ที่ต้องการภาษาจีนที่อ่านออกได้ในรูปภาพที่สร้างขึ้น ERNIE Image คือตัวเลือกที่ใช้งานได้จริงหากข้อความภาษาจีนที่ถูกต้องในผลลัพธ์คือข้อกำหนดที่จำเป็น

ใช่ ERNIE Image สามารถจัดการทั้งสองสคริปต์ในการเรียกใช้การสร้างเพียงครั้งเดียว โดยรักษาความแม่นยำสูงสำหรับแต่ละสคริปต์อย่างอิสระ สิ่งนี้มีประโยชน์สำหรับโปสเตอร์สองภาษา บรรจุภัณฑ์ และเนื้อหาทางการตลาดที่ต้องการให้ทั้งสองภาษาอ่านได้ในเลย์เอาต์เดียวกัน คะแนน LongTextBench สำหรับทั้งภาษาอังกฤษและภาษาจีนนั้นสูงกว่า 0.96

ERNIE Image ประกอบด้วย Prompt Enhancer ที่มีน้ำหนักเบา ซึ่งจะเขียนพรอมต์อินพุตสั้นๆ ใหม่โดยอัตโนมัติให้เป็นคำอธิบายที่สมบูรณ์และมีโครงสร้างมากขึ้น ก่อนที่จะส่งไปยังโมเดลแบบแพร่กระจาย (diffusion model) ซึ่งหมายความว่าคุณสามารถส่งพรอมต์แบบสั้นและได้รับผลลัพธ์ที่ละเอียดและแม่นยำยิ่งขึ้นโดยไม่ต้องทำวิศวกรรมพรอมต์ (prompt engineering) ขั้นสูง Prompt Enhancer จะทำงานเป็นส่วนหนึ่งของไปป์ไลน์การสร้างในทุกๆ การเรียกใช้งาน API

ERNIE Image Turbo ใช้ DMD (Diffusion Model Distillation) และการเรียนรู้แบบเสริมกำลัง (Reinforcement Learning) เพื่อบีบอัดการอนุมานจาก 50 ขั้นตอนเหลือเพียง 8 ขั้นตอน ส่งผลให้ความเร็วเพิ่มขึ้นมากกว่า 6 เท่า Turbo เปิดให้ใช้งานฟรีบน Atlas Cloud และเหมาะสำหรับการทำซ้ำอย่างรวดเร็วและการสร้างฉบับร่าง โมเดลมาตรฐานจะทำงานที่คุณภาพสูงสุดสำหรับชิ้นงานที่ผลิตขั้นสุดท้าย เช่น โปสเตอร์เชิงพาณิชย์และกราฟิกสำหรับบทความ

ใช่ ERNIE Image เผยแพร่ภายใต้ใบอนุญาต Apache 2.0 ซึ่งอนุญาตให้ใช้งานเชิงพาณิชย์ ดัดแปลง และแจกจ่ายได้ รูปภาพที่สร้างขึ้นสามารถนำไปใช้ในการโฆษณา บรรจุภัณฑ์ สิ่งพิมพ์ และแอปพลิเคชันเชิงพาณิชย์อื่นๆ โปรดตรวจสอบข้อกำหนดใบอนุญาตฉบับเต็มได้ที่พื้นที่เก็บข้อมูล GitHub ของ ERNIE Image สำหรับเงื่อนไขเฉพาะเจาะจงใดๆ

สำรวจกลุ่มเพิ่มเติม

Seedance 2.0

Seedance 2.0 API ให้คุณเข้าถึงระดับโปรดักชันของโมเดลวิดีโอแบบมัลติโมดัลจาก ByteDance — รองรับอินพุต 4 รูปแบบ (ข้อความ, รูปภาพ, วิดีโอ, เสียง) และระบบ "Universal Reference" ชั้นนำของอุตสาหกรรมที่ล็อกองค์ประกอบภาพ การเคลื่อนไหวของกล้อง และการกระทำของตัวละครในทุกช็อต ผสานรวมการควบคุมระดับผู้กำกับด้วยการเรียกใช้ API เพียงครั้งเดียว ในราคาคงที่ $0.09/วินาที รับคีย์ได้ทันที และไม่มีคิวรอ — พร้อมการรับประกันเวลาพร้อมใช้งานและการปฏิบัติตามข้อกำหนดระดับองค์กร Seedance 2.0 Native 4K เปิดใช้งานแล้ววันนี้!

ดูกลุ่ม

Grok Imagine

Grok Imagine API นำเสนอการสร้างภาพ วิดีโอ และเสียงของ xAI ให้นักพัฒนาในชุดเครื่องมือเดียว สามารถสร้างภาพความละเอียดสูงสุด 2K พร้อมการเรนเดอร์ข้อความหลายภาษา รวมถึงวิดีโอความยาวสูงสุด 15 วินาทีพร้อมเสียงที่ซิงโครไนซ์แบบเนทีฟและการแก้ไขตามข้อมูลอ้างอิง บน Atlas Cloud คีย์เดียวสามารถรัน Grok Imagine ได้ทุกโหมด คุณจึงสามารถสลับไปมาระหว่างภาพ วิดีโอ และเสียงได้โดยไม่ต้องตั้งค่าแยกกัน เริ่มต้นที่ $0.02 ต่อภาพ และ $0.05 ต่อวินาที

ดูกลุ่ม

Gemini Omni Flash

Gemini Omni API นำโมเดลสร้างและแก้ไขวิดีโอแบบมัลติโมดัลของ Google DeepMind ซึ่งเปิดตัวในงาน Google I/O 2026 มาสู่สแต็กของคุณ Gemini Omni ผสานเอนจินการใช้เหตุผลของ Gemini เข้ากับสื่อเชิงสร้างสรรค์ รองรับอินพุตทุกรูปแบบทั้งข้อความ รูปภาพ วิดีโอ และเสียง เพื่อสร้างผลลัพธ์ที่สอดคล้องกันและอิงตามความรู้ ปรับแต่งผลลัพธ์ผ่านการสนทนาอย่างเป็นธรรมชาติ ไม่ว่าจะเปลี่ยนวัตถุ เขียนฉากใหม่ หรือปรับสไตล์ โดยที่ฟิสิกส์ ตัวละคร และความต่อเนื่องยังคงเดิม Atlas Cloud ให้บริการ Gemini Omni Flash ครบทั้งไลน์อัป ทั้งการสร้างวิดีโอจากข้อความ การสร้างวิดีโอจากรูปภาพพร้อมรูปอ้างอิงสูงสุด 7 รูป และการสร้างวิดีโอจากรูปอ้างอิง ผ่าน API เดียวแบบครบวงจร ด้วยราคาต่อวินาทีที่โปร่งใสเริ่มต้นที่ $0.112 โดยไม่ต้องสมัครสมาชิก เริ่มสร้างได้เลยวันนี้

ดูกลุ่ม

GPT Image 2

GPT Image 2 API ช่วยให้นักพัฒนาสามารถเข้าถึงโมเดลรูปภาพล่าสุดของ OpenAI ซึ่งเป็นรุ่นสืบทอดจาก GPT Image 1.5 โดยสามารถสร้างและแก้ไขรูปภาพพร้อมกับการเรนเดอร์ข้อความที่แม่นยำทั้งในอักษรละตินและ CJK รวมถึงการจัดวางองค์ประกอบที่ยอดเยี่ยมสำหรับโปสเตอร์ ม็อกอัป และอินโฟกราฟิก บน Atlas Cloud คุณสามารถเข้าถึงโมเดลนี้ผ่าน API ที่เป็นหนึ่งเดียวร่วมกับโมเดลอื่นๆ อีกกว่า 300 รุ่น พร้อมเครดิตฟรี เวลาทำงาน 99.99% และไม่จำเป็นต้องมีการตรวจสอบยืนยันองค์กรจาก OpenAI

ดูกลุ่ม

Google

โมเดลเชิงสร้างสรรค์ที่ทรงพลังที่สุดของ Google พร้อมใช้งานแล้วบน Atlas Cloud โดย Veo 3.1 นำเสนอการสร้างวิดีโอระดับภาพยนตร์ Nano Banana 2 ขับเคลื่อนการสร้างภาพที่มีความเที่ยงตรงสูง และ Gemini นำความชาญฉลาดแบบมัลติโมดัลมาสู่ทุกเวิร์กโฟลว์ เข้าถึงชุดโมเดลของ Google เต็มรูปแบบผ่าน API key เดียวพร้อมความพร้อมใช้งานระดับ Day-0 และการกำหนดราคาแบบจ่ายตามการใช้งาน (pay-as-you-go)

ดูกลุ่ม

Seedance 2.0 Mini

Seedance 2.0 Mini นำเสนอการสร้างวิดีโอแบบมัลติโมดัลของ ByteDance สู่เวิร์กโฟลว์ที่ความเร็วและต้นทุนมีความสำคัญสูงสุด โดยมอบความสามารถหลักของ Seedance 2.0 ในรูปแบบที่ใช้ทรัพยากรน้อยลง — สร้างได้เร็วกว่า ต้นทุนต่อวิดีโอต่ำกว่า และใช้การผสานรวม API เดิมที่คุณใช้อยู่แล้ว สำหรับทีมที่จัดการไปป์ไลน์ปริมาณมากหรือสร้างต้นแบบในสเกลขนาดใหญ่ Mini คือตัวเลือกเริ่มต้นที่ใช้งานได้จริง

ดูกลุ่ม

ByteDance

ตั้งแต่การสร้างวิดีโอระดับภาพยนตร์ไปจนถึงการสร้างภาพที่มีความละเอียดสูง โมเดลที่ทรงพลังที่สุดของ ByteDance พร้อมใช้งานแล้วบน Atlas Cloud รัน Seedance และ Seedream ในสเกลขนาดใหญ่ด้วยราคาการอนุมานที่ต่ำที่สุด และไม่มีค่าใช้จ่ายแฝงด้านโครงสร้างพื้นฐาน

ดูกลุ่ม

Alibaba

Atlas Cloud รวบรวมโมเดลทั้งหมดของ Alibaba ไว้ใน API เดียว: Qwen สำหรับงานด้านภาษาและรูปภาพ และ Wan สำหรับการสร้างวิดีโอความละเอียดสูงสุด 1080p เข้าถึงทุกโมเดลในรูปแบบจ่ายตามการใช้งานจริง (pay-as-you-go) โดยไม่ต้องสมัครสมาชิก Alibaba API พร้อมใช้งานผ่าน base URL เดียวโดยใช้ไคลเอนต์ที่รองรับ OpenAI ที่คุณมีอยู่แล้ว

ดูกลุ่ม

OpenAI

Atlas Cloud ให้คุณเข้าถึงกลุ่มผลิตภัณฑ์ OpenAI API แบบครบวงจร ตั้งแต่ GPT Image 2 สำหรับการสร้างภาพถ่าย ไปจนถึง Sora 2 สำหรับวิดีโอ ทุกโมเดลพร้อมใช้งานแบบจ่ายตามการใช้งานจริง (pay-as-you-go) โดยไม่มีข้อผูกมัดรายเดือน เชื่อมต่อได้ง่ายดายด้วยการสลับ base URL เพียงจุดเดียวโดยใช้ API ที่เข้ากันได้กับ OpenAI

ดูกลุ่ม

xAI

สร้างไปป์ไลน์ภาพและวิดีโอที่สมบูรณ์โดยใช้ xAI API บน Atlas Cloud สร้างที่ความละเอียด 2K แก้ไขด้วยภาพอ้างอิง และทำให้ภาพเคลื่อนไหวเป็นคลิปที่ซิงค์กับเสียง

ดูกลุ่ม

Kwaivgi

Kwaivgi API ในราคาที่ถูกกว่าราคามาตรฐาน 15% Atlas Cloud มอบการเข้าถึง Day-0 สำหรับการเปิดตัว Kling ใหม่ด้วยการกำหนดราคาแบบจ่ายตามการใช้งานจริง (pay-as-you-go) และไม่จำกัดจำนวนผู้ใช้ บัญชีเดียว คีย์เดียว สำหรับโมเดล Kling ทุกรุ่นตั้งแต่ระดับมาตรฐานไปจนถึงระดับมาสเตอร์

ดูกลุ่ม

Seedream 5.0 Pro

Seedream 5.0 Pro API มอบโมเดลการแก้ไขภาพที่ควบคุมได้ของ ByteDance บน Atlas Cloud ให้กับนักพัฒนา โดยจะวางการแก้ไขอย่างแม่นยำด้วยจุดยึดและพิกัด แยกภาพออกเป็นเลเยอร์ที่แก้ไขได้ ผสานข้อมูลอ้างอิงหลายรายการ และจับคู่สีและวัสดุที่แน่นอน พร้อมข้อความหลายภาษาที่ความละเอียด 2K และ 3K บน Atlas Cloud คุณสามารถเข้าถึงได้ผ่านคีย์เดียว!

ดูกลุ่ม

บทความแนะนำ

คู่มือ บทแนะนำ และอัปเดตผลิตภัณฑ์ ที่ช่วยให้คุณใช้ Atlas Cloud ได้อย่างเต็มประสิทธิภาพ