
Z.ai API นำซีรีส์ GLM ทั้งหมดของ ZhipuAI มาไว้ในสแตกของคุณ ตั้งแต่ GLM-4.6 ไปจนถึงรุ่นเรือธง GLM-5.1 ซึ่งครองอันดับหนึ่งในกลุ่มโมเดลโอเพนซอร์สบน SWE-Bench Pro และสามารถรันเอเจนต์เขียนโค้ดอัตโนมัติได้ต่อเนื่องเป็นเวลาหลายชั่วโมง GLM ผสานบริบทขนาด 202K token เข้ากับเอาต์พุตภาษาจีนและอังกฤษที่สมดุล ภายใต้ไลเซนส์ MIT ที่เปิดกว้าง Atlas Cloud ให้บริการแต่ละโมเดลผ่านคีย์เดียวที่เข้ากันได้กับ OpenAI พร้อมการเข้าถึงตั้งแต่ Day-0 และราคาต่อการเรียกใช้งานที่โปร่งใส เริ่มต้นได้วันนี้
ขับเคลื่อนการสนทนา การให้เหตุผล และเอเจนต์ในระดับขนาดใหญ่ด้วยโมเดลภาษาขนาดใหญ่ชั้นนำ ที่ให้บริการอย่างรวดเร็วและคุ้มค่าบน Atlas Cloud
Compare standard vs. our pricing across every Z.ai model.
| Model | Standard Price (USD) | Our Price (USD) | Discount | |
|---|---|---|---|---|
| GLM 5.2 | $1.4/$4.4per 1M tokens1048.6K context | $1.26/$3.96M in/outper 1M tokens1048.6K context | -10% | View |
| GLM 5.1 | $1.4/$4.4per 1M tokens202.8K context | $1.26/$3.96M in/outper 1M tokens202.8K context | -10% | View |
| GLM 5v Turbo | $1.2/$4per 1M tokens202.8K context | $1.2/$4M in/outper 1M tokens202.8K context | — | View |
| GLM 5 | $1/$3.2per 1M tokens202.8K context | $0.95/$3.15M in/outper 1M tokens202.8K context | — | View |
| GLM 4.7 | $0.6/$2.2per 1M tokens202.8K context | $0.52/$1.85M in/outper 1M tokens202.8K context | — | View |
| GLM 4.6 | $0.6/$2.2per 1M tokens202.8K context | $0.6/$2.2M in/outper 1M tokens202.8K context | — | View |
Instantly explore and experiment with 400+ production-ready models in the Atlas Playground. Start customizing with one click.
ระดับโมเดลของ GLM ครอบคลุมทุกอย่างตั้งแต่งานแชทสองภาษาที่รวดเร็วไปจนถึงเอเจนต์การเขียนโค้ดอัตโนมัติที่ใช้เวลาหลายชั่วโมง ทีมงานใช้ GLM-5.1 สำหรับงานวิศวกรรมระยะยาว และใช้ GLM-4.7 หรือ GLM-5 Turbo เมื่อประสิทธิภาพด้านต้นทุนและความเร็วเป็นสิ่งสำคัญอันดับแรก
Engineering teams use GLM-5.1 to run autonomous optimization agents that iterate on production systems over hundreds of rounds. In a documented run, GLM-5.1 improved a vector database through 600 iterations and 6,000 tool calls, reaching 21,500 queries per second — six times the result achievable in a single 50-turn session. Atlas Cloud's pay-as-you-go pricing makes it practical to run these extended sessions without pre-purchasing capacity.
ทีมพัฒนาใช้ GLM-5.1 ในการดำเนินการแปลงฐานโค้ดทั้งหมดผ่านเซสชันที่กินเวลาหลายชั่วโมงโดยไม่ต้องมีจุดตรวจสอบโดยมนุษย์ โมเดลจะวางแผน เขียน ทดสอบ และทำซ้ำการเปลี่ยนแปลงอย่างต่อเนื่องนานสูงสุด 8 ชั่วโมง โดยจัดการการทำซ้ำถึง 655 ครั้งในการสาธิตการสร้างระบบ Linux จากศูนย์ สิ่งนี้เข้ามาแทนที่งานรีแฟกทอริงด้วยตนเองที่ต้องใช้เวลาหลายสัปดาห์บนฐานโค้ดเดิมที่มีขนาดใหญ่
ทีมเครื่องมือสำหรับนักพัฒนาซอฟต์แวร์ได้รวม GLM-5.1 และ GLM-5 Turbo เข้ามาเป็นโมเดลพื้นฐานสำหรับเวิร์กโฟลว์การเขียนโค้ด AI ใน Claude Code, Kilo Code, Cline, Roo Code และ OpenCode Z-AI API บน Atlas Cloud สามารถใช้งานร่วมกับ OpenAI ได้ ดังนั้นการเปลี่ยน base URL จึงเป็นการเปลี่ยนแปลงเพียงอย่างเดียวที่จำเป็นในการกำหนดเส้นทางของเครื่องมือเหล่านี้ผ่าน GLM หน้าต่างบริบท 262K ของ GLM-5 Turbo ทำให้เหมาะอย่างยิ่งสำหรับบริบทของไฟล์ขนาดใหญ่ในเวิร์กโฟลว์ IDE
ทีมปฏิบัติการสร้างตัวแทนสนับสนุนโดยใช้ GLM-5 ซึ่งรวมการเข้าถึงฐานข้อมูลตั๋ว การค้นหาฐานความรู้ และเครื่องมือการส่งเรื่องต่อ เพื่อจัดการกับคำถามที่ซ้ำซากโดยไม่ต้องอาศัยการแทรกแซงของมนุษย์ การเรียกใช้เครื่องมือหลายอย่างและการรองรับการสตรีมของโมเดลทำให้ใช้งานได้จริงสำหรับการติดตั้งใช้งานที่ต้องเผชิญหน้ากับลูกค้าแบบเรียลไทม์ การรองรับสองภาษาหมายความว่าตัวแทนเดียวกันสามารถจัดการตั๋วทั้งภาษาจีนและภาษาอังกฤษจากตำแหน่งข้อมูลโมเดลเดียวบน Atlas Cloud ได้
ทีมคอนเทนต์และธุรกิจใช้ GLM-4.7 ในการสร้างเอกสาร Word, งานนำเสนอ PowerPoint, PDF และรายงาน Excel ทั้งในภาษาจีนและภาษาอังกฤษจากพรอมต์ที่มีโครงสร้าง ด้วยราคา $0.52 ต่อหนึ่งล้านโทเค็นอินพุต จึงเป็นระดับ GLM ที่คุ้มค่าที่สุดสำหรับเวิร์กโฟลว์เอกสารปริมาณมากที่ไม่ต้องการการให้เหตุผลระดับแนวหน้า หน้าต่างบริบทขนาด 202K เพียงพอที่จะรองรับโครงร่างเอกสารทั้งหมดและวัสดุแหล่งที่มาในการเรียกใช้งานเพียงครั้งเดียว
ทีมโครงสร้างพื้นฐาน AI ใช้ GLM-5.1 เพื่อรันไปป์ไลน์การเพิ่มประสิทธิภาพที่ขับเคลื่อนด้วยเกณฑ์มาตรฐานบนเวิร์กโหลดของแมชชีนเลิร์นนิง ในงานสไตล์ KernelBench นั้น GLM-5.1 จะดำเนินการรอบการเพิ่มประสิทธิภาพที่ขับเคลื่อนด้วยเครื่องมือหลายพันรอบและบรรลุความเร็วเฉลี่ยเรขาคณิต 3.6 เท่า ความสามารถในการดำเนินการอย่างต่อเนื่อง 8 ชั่วโมงหมายความว่าเอเจนต์จะรันลูปการเพิ่มประสิทธิภาพแบบเต็มโดยไม่ต้องรีสตาร์ทแบบแมนนวลระหว่างเซสชัน
Z.ai API ช่วยให้นักพัฒนาเข้าถึง GLM series ของโมเดลภาษาขนาดใหญ่ที่สร้างโดย Z.ai ซึ่งเป็นบริษัทที่รู้จักกันในชื่อ Zhipu AI ผ่านโปรแกรมได้ GLM ย่อมาจาก General Language Model และครอบคลุมรุ่นตั้งแต่ GLM-4.6 ไปจนถึงรุ่นเรือธง GLM-5.1 โดยปรับแต่งมาสำหรับงานเขียนโค้ด เวิร์กโฟลว์แบบ agentic และการใช้งานจริงแบบสองภาษา Chinese และ English บน Atlas Cloud คุณเข้าถึงโมเดลทั้งหมดได้ผ่าน endpoint เดียวที่เข้ากันได้กับ OpenAI
Atlas Cloud ให้บริการ GLM series ตั้งแต่ GLM-4.6 ไปจนถึงรุ่นเรือธง GLM-5.1 โดยมี GLM-4.7 และ GLM-5 อยู่ระหว่างกลาง รุ่นที่เบากว่ารองรับงานประจำวันปริมาณสูงด้วยต้นทุนที่ต่ำกว่า ขณะที่ GLM-5.1 มุ่งเน้นงานเขียนโค้ดและงานแบบ agentic ที่ต้องการความสามารถสูงที่สุด ทุกโมเดลใช้งานแบบจ่ายตามจริงผ่านคีย์เดียวกัน
ใช่ open weights ของ GLM รวมถึง GLM-5.1 เผยแพร่ภายใต้ MIT license ซึ่งอนุญาตให้ใช้งานเชิงพาณิชย์ fine-tuning และแจกจ่ายต่อได้โดยไม่มีข้อจำกัด หากคุณไม่ต้องการจัดการภาระด้านโครงสร้างพื้นฐาน Atlas Cloud ให้บริการโมเดลเดียวกันผ่าน API เพื่อการเข้าถึงแบบ managed แทนการโฮสต์เอง
ชี้ OpenAI SDK ที่คุณใช้อยู่ไปยัง base URL ของ Atlas Cloud ตั้งค่าคีย์ของคุณ แล้วส่งชื่อโมเดล GLM ที่ต้องการ เนื่องจาก Z.ai API เข้ากันได้กับ OpenAI โปรเจกต์ส่วนใหญ่จึงย้ายมาใช้งานได้ด้วยการเปลี่ยนเพียง base URL และสตริงชื่อโมเดล อีกทั้งโมเดลยังเชื่อมต่อกับเครื่องมือ agent เช่น Claude Code, Cline และ Roo Code ได้โดยตรง เริ่มสร้างได้วันนี้
ทั้ง Chinese และ English เป็นภาษาระดับ first-class สำหรับ GLM ซึ่งฝึกมาให้มีความสามารถสูงในแต่ละภาษา คุณสามารถเขียน prompt ด้วยภาษาใดก็ได้และจะได้คุณภาพที่สม่ำเสมอ ทำให้โมเดลชุดนี้เหมาะสำหรับทีมที่ให้บริการทั้งผู้ใช้ชาวจีนและผู้ใช้นานาชาติด้วยโมเดลเดียว แทนการดูแลสแต็กแยกกัน
GLM-4.6 ถึง GLM-5.1 รองรับ context window ขนาด 200K token เพียงพอสำหรับใส่ codebase ขนาดใหญ่ เอกสารยาว หรือ trace ของ agent ที่ต่อเนื่องได้ในคำขอเดียว หากเวิร์กโฟลว์ของคุณสร้างผลลัพธ์ที่ยาว context window เดียวกันยังรองรับไฟล์โค้ดขนาดใหญ่และ log การทำงานหลายขั้นตอนได้โดยไม่ถูกตัดทอนก่อนเวลา
GLM-5.1 ทำคะแนนสูงสุดบน SWE-Bench Pro ด้วยคะแนน 58.4 ในเดือนเมษายน 2026 ทำให้เป็นหนึ่งในโมเดลโอเพนซอร์สที่แข็งแกร่งที่สุดสำหรับงานเขียนโค้ดในโลกจริง นอกจากนี้ยังรองรับการทำงานอัตโนมัติอย่างต่อเนื่องได้นานสูงสุดแปดชั่วโมงต่อหนึ่งงาน โดยดำเนินการวางแผน ทำซ้ำ และส่งมอบในลูปเดียว ซึ่งเหมาะกับเวิร์กโฟลว์ agent ระยะยาวในสภาพแวดล้อมอย่าง Claude Code
ทุกโมเดล GLM บน Z.ai API ใช้ราคาแบบจ่ายตามจริงที่โปร่งใส คิดค่าบริการต่อ token โดยไม่มีค่าสมัครสมาชิกหรือข้อผูกมัดรายเดือน token ขาเข้าและขาออกจะถูกวัดแยกกัน และรุ่นที่เบากว่า เช่น GLM-4.7 มีราคาต่อ token ต่ำกว่ารุ่นเรือธง GLM-5.1 คุณจึงเลือกโมเดลให้เหมาะกับงบประมาณได้ ตรวจสอบอัตราต่อ token ล่าสุดได้บน model card ของแต่ละโมเดลใน Atlas Cloud
คู่มือ บทแนะนำ และอัปเดตผลิตภัณฑ์ ที่ช่วยให้คุณใช้ Atlas Cloud ได้อย่างเต็มประสิทธิภาพ