เพียง 2 สัปดาห์เท่านั้น | รับส่วนลด 20% สำหรับ Seedream 5.0 Pro!

xAI Models on Atlas Cloud | Grok Imagine Models

สร้างไปป์ไลน์ภาพและวิดีโอที่สมบูรณ์โดยใช้ xAI API บน Atlas Cloud สร้างที่ความละเอียด 2K แก้ไขด้วยภาพอ้างอิง และทำให้ภาพเคลื่อนไหวเป็นคลิปที่ซิงค์กับเสียง

AI Video Models by xAI

สร้างวิดีโอระดับภาพยนตร์ความคมชัดสูงจากข้อความและรูปภาพ ด้วยโมเดล AI สร้างวิดีโอล่าสุดบน Atlas Cloud

ดูโมเดลทั้งหมด

AI Image Models by xAI

สร้างภาพที่สวยตระการตาและพร้อมใช้งานจริงจากพรอมต์และภาพอ้างอิง ด้วยโมเดล AI สร้างภาพที่ล้ำสมัยที่สุดบน Atlas Cloud

ดูโมเดลทั้งหมด

Large Language Models by xAI

ขับเคลื่อนการสนทนา การให้เหตุผล และเอเจนต์ในระดับขนาดใหญ่ด้วยโมเดลภาษาขนาดใหญ่ชั้นนำ ที่ให้บริการอย่างรวดเร็วและคุ้มค่าบน Atlas Cloud

ดูโมเดลทั้งหมด
Grok
LLM
ข้อความเป็นเสียง
เสียงเป็นข้อความ

Grok

Grok ซึ่งพัฒนาโดย xAI เป็นชุดของโมเดลภาษาขนาดใหญ่ที่สร้างขึ้นจากการรับรู้แบบเรียลไทม์และการใช้เหตุผลระดับแนวหน้า Grok 4.3 เป็นโมเดลการสนทนาขั้นสูงของ xAI ที่ได้รับการปรับแต่งมาเพื่อการสนทนาที่เป็นธรรมชาติ การสำรวจความรู้ และการให้เหตุผลแบบหลายขั้นตอนผ่านหน้าต่างบริบทขนาด 1,000,000 โทเค็น Grok Build 0.1 ใช้ทิศทางที่แตกต่างออกไป — โดยถูกสร้างขึ้นโดยเฉพาะสำหรับการพัฒนาซอฟต์แวร์ ซึ่งมีความสามารถที่มุ่งเน้นไปที่การเขียนโค้ด การดีบัก และการปรับโครงสร้างโค้ดในเวิร์กโฟลว์ของนักพัฒนาที่ซับซ้อน ทั้งสองโมเดลพร้อมใช้งานบน Atlas Cloud ผ่าน API endpoints ที่เข้ากันได้กับ OpenAI โดยเริ่มต้นที่ 1 ดอลลาร์ต่อหนึ่งล้านโทเค็น

5 โมเดลสำรวจ Grok

xAI Models API Pricing Details

Compare standard vs. our pricing across every xAI model.

ModelStandard Price (USD)Our Price (USD)Discount
xAI TTS v1$0.015/K chars
Start from$0.015/K chars
View
Grok Imagine Video v1.5 Image-to-Video$0.08
Start from$0.08/s video
View
Grok Imagine Image Quality Text-to-Image$0.05/pic
Start from$0.05/pic
View
Grok Imagine Image Quality Edit$0.05/pic
Start from$0.05/pic
View
Grok Imagine Video Text-to-Video$0.05
Start from$0.05/s video
View
Grok Imagine Video Image-to-Video$0.05
Start from$0.05/s video
View

Explore models from other providers

Instantly explore and experiment with 400+ production-ready models in the Atlas Playground. Start customizing with one click.

กรณีการใช้งาน xAI API ที่คุณสามารถพัฒนาได้บน Atlas Cloud

เอนด์พอยต์รูปภาพและวิดีโอของ Grok Imagine จัดการการสร้าง การแก้ไข และแอนิเมชันได้จาก API เดียว ทีมต่างๆ ใช้เอนด์พอยต์เหล่านี้เพื่อเปลี่ยนเนื้อหาแบบคงที่ให้เป็นเนื้อหาวิดีโอพร้อมเสียง และเพื่อผลิตชิ้นงานสร้างสรรค์ทางภาพด้วยความเร็วและต้นทุนที่เมื่อก่อนไม่สามารถทำได้จริง

วิดีโอสินค้าอีคอมเมิร์ซอัตโนมัติ

ทีมงานอีคอมเมิร์ซสร้างไปป์ไลน์ที่สร้างภาพเคลื่อนไหวจากรูปภาพผลิตภัณฑ์ให้เป็นคลิปวิดีโอสั้นๆ โดยใช้ Grok Imagine Video v1.5 พร้อมกับเสียงรอบทิศทางและเสียงบริบทของผลิตภัณฑ์ซึ่งสร้างขึ้นในการเรียกใช้เพียงครั้งเดียว รูปภาพผลิตภัณฑ์เพียงรูปเดียวจะกลายเป็นคลิปพร้อมเสียงที่พร้อมสำหรับโฆษณาและหน้าผลิตภัณฑ์โดยไม่ต้องถ่ายทำวิดีโอหรือตัดต่อเสียง ด้วยราคา $0.096 ต่อวินาทีบน Atlas Cloud วิดีโอผลิตภัณฑ์ความยาว 10 วินาทีจะมีราคาไม่ถึงหนึ่งดอลลาร์

ชิ้นงานโฆษณาแบรนด์จากสินทรัพย์ภาพนิ่ง

ทีมงานแบรนด์ใช้ Grok Imagine Video v1.5 เพื่อเปลี่ยนภาพถ่ายแคมเปญที่ได้รับการอนุมัติให้เป็นโฆษณาโซเชียลแบบเคลื่อนไหวพร้อมระบบเสียงที่สร้างขึ้นแบบเนทีฟ เนื่องจากโทเค็นของเสียงและวิดีโอถูกสร้างขึ้นในขั้นตอนการอนุมาน (inference pass) เดียวกัน บทสนทนา เอฟเฟกต์เสียง และดนตรีประกอบจึงสอดคล้องกับภาพโดยไม่ต้องพึ่งพางานหลังการผลิต ซึ่งช่วยตัดขั้นตอนการผลิตเสียงออกจากเวิร์กโฟลว์การสร้างสรรค์โฆษณาโดยสิ้นเชิง

การทำสตอรี่บอร์ดก่อนการผลิตภาพยนตร์

ผู้กำกับและผู้กำกับภาพใช้ Grok Imagine Image เพื่อสร้างสตอรี่บอร์ดภาพที่แสดงองค์ประกอบของช็อต มุมกล้อง และการจัดแสงก่อนเริ่มการผลิต ผลลัพธ์ความละเอียด 2K มีรายละเอียดเพียงพอที่จะแชร์กับทีมงานเพื่อเป็นโครงร่างภาพสำหรับแต่ละฉาก ด้วยราคา 0.06 ดอลลาร์ต่อภาพ การวนซ้ำเพื่อดูตัวเลือกช็อตต่างๆ มีค่าใช้จ่ายน้อยกว่าเวลาในการผลิตเพียงหนึ่งชั่วโมง

วิดีโอไลฟ์สไตล์อสังหาริมทรัพย์

นักพัฒนาอสังหาริมทรัพย์ใช้ Grok Imagine Video v1.5 เพื่อสร้างคลิปไลฟ์สไตล์ระดับภาพยนตร์จากภาพเรนเดอร์ทางสถาปัตยกรรมหรือภาพถ่ายการตกแต่งภายใน ภาพเรนเดอร์ระเบียงจะกลายเป็นคลิปวิวพระอาทิตย์ตกพร้อมระบบเสียงรอบทิศทาง ภาพถ่ายห้องครัวจะกลายเป็นฉากยามเช้าพร้อมเสียงธรรมชาติ สิ่งนี้เข้ามาแทนที่การถ่ายภาพไลฟ์สไตล์ที่มีราคาแพงสำหรับรายการประกาศขายและสื่อการตลาดก่อนการขาย

การจัดองค์ประกอบภาพแบบหลายอ้างอิง

ทีมครีเอทีฟใช้อินพุต 3 แหล่งที่มาของ Grok Imagine Image Edit เพื่อจัดองค์ประกอบจากภาพอ้างอิงหลายภาพให้เป็นผลลัพธ์เดียว — โดยรวมภาพผลิตภัณฑ์ พื้นหลัง และภาพอ้างอิงแสงสว่างไว้ในการเรียก API เพียงครั้งเดียว ซึ่งทำให้ในทางปฏิบัติสามารถสร้างตัวแปรแคมเปญที่รักษาความสอดคล้องของแบรนด์ในสภาพแวดล้อมฉากที่แตกต่างกันได้ ภาพที่จัดองค์ประกอบแต่ละภาพมีราคา 0.06 ดอลลาร์ต่อภาพบน Atlas Cloud

คอนเซปต์อาร์ตและตัวอย่างเกมอินดี้

สตูดิโอเกมขนาดเล็กใช้ Grok Imagine Image เพื่อสร้างคอนเซปต์อาร์ตในช่วงก่อนการผลิต จากนั้นจึงส่งคีย์เฟรมไปยัง Grok Imagine Video v1.5 เพื่อผลิตลำดับตัวอย่างแอนิเมชัน ฟีเจอร์ส่วนขยายวิดีโอช่วยให้ทีมสามารถเชื่อมต่อคลิปจากเฟรมเริ่มต้นเพียงเฟรมเดียวเพื่อสร้างลำดับภาพยนตร์ที่ยาวขึ้นเกินขีดจำกัด 15 วินาทีต่อการเรียกใช้งาน เวิร์กโฟลว์นี้เข้ามาแทนที่ผู้รับเหมาทำแอนิเมชันภายนอกสำหรับเนื้อหาทางการตลาดในระยะเริ่มต้น

Atlas Cloud AI

ติดต่อฝ่ายขาย

คำถามที่พบบ่อยเกี่ยวกับโมเดล Xai

xAI ให้บริการเอนด์พอยต์รูปภาพสองรายการบน Atlas Cloud ได้แก่ Grok Imagine Image Quality สำหรับการสร้างรูปภาพจากข้อความ และ Grok Imagine Image Quality Edit สำหรับการแก้ไขรูปภาพที่มีอยู่ ทั้งสองแบบให้เอาต์พุตที่ความละเอียดสูงสุด 2K และมีราคาอยู่ที่ 0.06 ดอลลาร์ต่อรูปภาพ เอนด์พอยต์ทั้งหมดพร้อมใช้งานแบบจ่ายตามการใช้งานจริง (pay-as-you-go) ภายใต้คีย์ API เดียว

ใช่ Atlas Cloud โฮสต์เอ็นด์พอยต์วิดีโอ xAI สี่รายการ ได้แก่: text-to-video, image-to-video, reference-to-video และ Grok Imagine Video v1.5 ใหม่ล่าสุดสำหรับ image-to-video พร้อมระบบเสียงเนทีฟ เอ็นด์พอยต์วิดีโอมาตรฐานทั้งหมดมีราคาอยู่ที่ 0.06 ดอลลาร์ต่อวินาที Video v1.5 มีราคาอยู่ที่ 0.096 ดอลลาร์ต่อวินาที

ใช่ Grok Imagine Video v1.5 จะสร้างเสียงและวิดีโอในกระบวนการอนุมาน (inference pass) เดียวกัน เสียงสนทนา การลิปซิงค์ เอฟเฟกต์เสียง และดนตรีประกอบจะถูกสร้างขึ้นร่วมกับเฟรมวิดีโอ แทนที่จะถูกเพิ่มในกระบวนการหลังการถ่ายทำ (post-processing) ซึ่งหมายความว่าเหตุการณ์ทางเสียงและภาพจะซิงโครไนซ์กันโดยไม่ต้องมีขั้นตอนการจัดตำแหน่งแยกต่างหาก

ใช่ เอ็นด์พอยต์ Grok Imagine Image Quality Edit รองรับการป้อนรูปภาพที่มีอยู่และคำสั่งข้อความ จากนั้นจะสร้างเวอร์ชันที่แก้ไขออกมา คุณสามารถระบุรูปภาพต้นฉบับได้สูงสุด 3 รูปต่อการเรียกใช้หนึ่งครั้งสำหรับการแก้ไขแบบอ้างอิงหลายแหล่ง โดยมีราคาอยู่ที่ 0.06 ดอลลาร์ต่อรูปภาพบน Atlas Cloud

Grok Imagine Image รองรับเอาต์พุตความละเอียด 1K และ 2K ตัวเลือก 2K ให้คุณภาพของภาพระดับสตูดิโอและมีให้บริการในอัตราเดียวกันที่ 0.06 ดอลลาร์ต่อภาพ ความละเอียดจะถูกตั้งค่าเป็นพารามิเตอร์ในการเรียก API แต่ละครั้ง

การเรียกใช้แต่ละครั้งจะสร้างคลิปได้ยาวสูงสุด 15 วินาที สำหรับซีเควนซ์ที่ยาวขึ้น คุณสามารถใช้ฟีเจอร์ส่วนขยายวิดีโอเพื่อสร้างคลิปใหม่ต่อจากเฟรมสุดท้ายของคลิปก่อนหน้าและเชื่อมช็อตต่างๆ เข้าด้วยกัน สิ่งนี้ทำให้สามารถสร้างซีเควนซ์แบบหลายช็อตที่เกินขีดจำกัดของคลิปเดียวได้

ใช่ Atlas Cloud อธิบายว่า Grok Imagine Image มีการเรนเดอร์ข้อความที่ดีที่สุดในระดับเดียวกันในหลายภาษา คุณสามารถรวมข้อความที่ไม่ใช่ภาษาอังกฤษในพรอมต์ของคุณและให้ระบบเรนเดอร์ข้อความนั้นได้อย่างถูกต้องภายในภาพที่สร้างขึ้น รายละเอียดเกี่ยวกับความครอบคลุมของภาษาเฉพาะมีอยู่ในหน้าโมเดล Atlas Cloud Grok Imagine

การสร้างและแก้ไขรูปภาพมีราคาอยู่ที่ $0.06 ต่อรูปภาพ การสร้างวิดีโอมาตรฐานมีค่าใช้จ่าย $0.06 ต่อวินาที Grok Imagine Video v1.5 พร้อมระบบเสียงในตัวมีราคาอยู่ที่ $0.096 ต่อวินาที ทุกโมเดลเป็นระบบจ่ายตามการใช้งานจริง (Pay-as-you-go) โดยไม่มีการเรียกเก็บขั้นต่ำรายเดือน

สำรวจกลุ่มเพิ่มเติม

Seedance 2.0

Seedance 2.0 API ให้คุณเข้าถึงระดับโปรดักชันของโมเดลวิดีโอแบบมัลติโมดัลจาก ByteDance — รองรับอินพุต 4 รูปแบบ (ข้อความ, รูปภาพ, วิดีโอ, เสียง) และระบบ "Universal Reference" ชั้นนำของอุตสาหกรรมที่ล็อกองค์ประกอบภาพ การเคลื่อนไหวของกล้อง และการกระทำของตัวละครในทุกช็อต ผสานรวมการควบคุมระดับผู้กำกับด้วยการเรียกใช้ API เพียงครั้งเดียว ในราคาคงที่ $0.09/วินาที รับคีย์ได้ทันที และไม่มีคิวรอ — พร้อมการรับประกันเวลาพร้อมใช้งานและการปฏิบัติตามข้อกำหนดระดับองค์กร Seedance 2.0 Native 4K เปิดใช้งานแล้ววันนี้!

ดูกลุ่ม

Grok Imagine

Grok Imagine API นำเสนอการสร้างภาพ วิดีโอ และเสียงของ xAI ให้นักพัฒนาในชุดเครื่องมือเดียว สามารถสร้างภาพความละเอียดสูงสุด 2K พร้อมการเรนเดอร์ข้อความหลายภาษา รวมถึงวิดีโอความยาวสูงสุด 15 วินาทีพร้อมเสียงที่ซิงโครไนซ์แบบเนทีฟและการแก้ไขตามข้อมูลอ้างอิง บน Atlas Cloud คีย์เดียวสามารถรัน Grok Imagine ได้ทุกโหมด คุณจึงสามารถสลับไปมาระหว่างภาพ วิดีโอ และเสียงได้โดยไม่ต้องตั้งค่าแยกกัน เริ่มต้นที่ $0.02 ต่อภาพ และ $0.05 ต่อวินาที

ดูกลุ่ม

Gemini Omni Flash

Gemini Omni API นำโมเดลสร้างและแก้ไขวิดีโอแบบมัลติโมดัลของ Google DeepMind ซึ่งเปิดตัวในงาน Google I/O 2026 มาสู่สแต็กของคุณ Gemini Omni ผสานเอนจินการใช้เหตุผลของ Gemini เข้ากับสื่อเชิงสร้างสรรค์ รองรับอินพุตทุกรูปแบบทั้งข้อความ รูปภาพ วิดีโอ และเสียง เพื่อสร้างผลลัพธ์ที่สอดคล้องกันและอิงตามความรู้ ปรับแต่งผลลัพธ์ผ่านการสนทนาอย่างเป็นธรรมชาติ ไม่ว่าจะเปลี่ยนวัตถุ เขียนฉากใหม่ หรือปรับสไตล์ โดยที่ฟิสิกส์ ตัวละคร และความต่อเนื่องยังคงเดิม Atlas Cloud ให้บริการ Gemini Omni Flash ครบทั้งไลน์อัป ทั้งการสร้างวิดีโอจากข้อความ การสร้างวิดีโอจากรูปภาพพร้อมรูปอ้างอิงสูงสุด 7 รูป และการสร้างวิดีโอจากรูปอ้างอิง ผ่าน API เดียวแบบครบวงจร ด้วยราคาต่อวินาทีที่โปร่งใสเริ่มต้นที่ $0.112 โดยไม่ต้องสมัครสมาชิก เริ่มสร้างได้เลยวันนี้

ดูกลุ่ม

GPT Image 2

GPT Image 2 API ช่วยให้นักพัฒนาสามารถเข้าถึงโมเดลรูปภาพล่าสุดของ OpenAI ซึ่งเป็นรุ่นสืบทอดจาก GPT Image 1.5 โดยสามารถสร้างและแก้ไขรูปภาพพร้อมกับการเรนเดอร์ข้อความที่แม่นยำทั้งในอักษรละตินและ CJK รวมถึงการจัดวางองค์ประกอบที่ยอดเยี่ยมสำหรับโปสเตอร์ ม็อกอัป และอินโฟกราฟิก บน Atlas Cloud คุณสามารถเข้าถึงโมเดลนี้ผ่าน API ที่เป็นหนึ่งเดียวร่วมกับโมเดลอื่นๆ อีกกว่า 300 รุ่น พร้อมเครดิตฟรี เวลาทำงาน 99.99% และไม่จำเป็นต้องมีการตรวจสอบยืนยันองค์กรจาก OpenAI

ดูกลุ่ม

Google

โมเดลเชิงสร้างสรรค์ที่ทรงพลังที่สุดของ Google พร้อมใช้งานแล้วบน Atlas Cloud โดย Veo 3.1 นำเสนอการสร้างวิดีโอระดับภาพยนตร์ Nano Banana 2 ขับเคลื่อนการสร้างภาพที่มีความเที่ยงตรงสูง และ Gemini นำความชาญฉลาดแบบมัลติโมดัลมาสู่ทุกเวิร์กโฟลว์ เข้าถึงชุดโมเดลของ Google เต็มรูปแบบผ่าน API key เดียวพร้อมความพร้อมใช้งานระดับ Day-0 และการกำหนดราคาแบบจ่ายตามการใช้งาน (pay-as-you-go)

ดูกลุ่ม

Seedance 2.0 Mini

Seedance 2.0 Mini นำเสนอการสร้างวิดีโอแบบมัลติโมดัลของ ByteDance สู่เวิร์กโฟลว์ที่ความเร็วและต้นทุนมีความสำคัญสูงสุด โดยมอบความสามารถหลักของ Seedance 2.0 ในรูปแบบที่ใช้ทรัพยากรน้อยลง — สร้างได้เร็วกว่า ต้นทุนต่อวิดีโอต่ำกว่า และใช้การผสานรวม API เดิมที่คุณใช้อยู่แล้ว สำหรับทีมที่จัดการไปป์ไลน์ปริมาณมากหรือสร้างต้นแบบในสเกลขนาดใหญ่ Mini คือตัวเลือกเริ่มต้นที่ใช้งานได้จริง

ดูกลุ่ม

ByteDance

ตั้งแต่การสร้างวิดีโอระดับภาพยนตร์ไปจนถึงการสร้างภาพที่มีความละเอียดสูง โมเดลที่ทรงพลังที่สุดของ ByteDance พร้อมใช้งานแล้วบน Atlas Cloud รัน Seedance และ Seedream ในสเกลขนาดใหญ่ด้วยราคาการอนุมานที่ต่ำที่สุด และไม่มีค่าใช้จ่ายแฝงด้านโครงสร้างพื้นฐาน

ดูกลุ่ม

Alibaba

Atlas Cloud รวบรวมโมเดลทั้งหมดของ Alibaba ไว้ใน API เดียว: Qwen สำหรับงานด้านภาษาและรูปภาพ และ Wan สำหรับการสร้างวิดีโอความละเอียดสูงสุด 1080p เข้าถึงทุกโมเดลในรูปแบบจ่ายตามการใช้งานจริง (pay-as-you-go) โดยไม่ต้องสมัครสมาชิก Alibaba API พร้อมใช้งานผ่าน base URL เดียวโดยใช้ไคลเอนต์ที่รองรับ OpenAI ที่คุณมีอยู่แล้ว

ดูกลุ่ม

OpenAI

Atlas Cloud ให้คุณเข้าถึงกลุ่มผลิตภัณฑ์ OpenAI API แบบครบวงจร ตั้งแต่ GPT Image 2 สำหรับการสร้างภาพถ่าย ไปจนถึง Sora 2 สำหรับวิดีโอ ทุกโมเดลพร้อมใช้งานแบบจ่ายตามการใช้งานจริง (pay-as-you-go) โดยไม่มีข้อผูกมัดรายเดือน เชื่อมต่อได้ง่ายดายด้วยการสลับ base URL เพียงจุดเดียวโดยใช้ API ที่เข้ากันได้กับ OpenAI

ดูกลุ่ม

xAI

สร้างไปป์ไลน์ภาพและวิดีโอที่สมบูรณ์โดยใช้ xAI API บน Atlas Cloud สร้างที่ความละเอียด 2K แก้ไขด้วยภาพอ้างอิง และทำให้ภาพเคลื่อนไหวเป็นคลิปที่ซิงค์กับเสียง

ดูกลุ่ม

Kwaivgi

Kwaivgi API ในราคาที่ถูกกว่าราคามาตรฐาน 15% Atlas Cloud มอบการเข้าถึง Day-0 สำหรับการเปิดตัว Kling ใหม่ด้วยการกำหนดราคาแบบจ่ายตามการใช้งานจริง (pay-as-you-go) และไม่จำกัดจำนวนผู้ใช้ บัญชีเดียว คีย์เดียว สำหรับโมเดล Kling ทุกรุ่นตั้งแต่ระดับมาตรฐานไปจนถึงระดับมาสเตอร์

ดูกลุ่ม

Seedream 5.0 Pro

Seedream 5.0 Pro API มอบโมเดลการแก้ไขภาพที่ควบคุมได้ของ ByteDance บน Atlas Cloud ให้กับนักพัฒนา โดยจะวางการแก้ไขอย่างแม่นยำด้วยจุดยึดและพิกัด แยกภาพออกเป็นเลเยอร์ที่แก้ไขได้ ผสานข้อมูลอ้างอิงหลายรายการ และจับคู่สีและวัสดุที่แน่นอน พร้อมข้อความหลายภาษาที่ความละเอียด 2K และ 3K บน Atlas Cloud คุณสามารถเข้าถึงได้ผ่านคีย์เดียว!

ดูกลุ่ม

บทความแนะนำ

คู่มือ บทแนะนำ และอัปเดตผลิตภัณฑ์ ที่ช่วยให้คุณใช้ Atlas Cloud ได้อย่างเต็มประสิทธิภาพ