Z.ai Models on AtlasCloud | GLM

Atlas Cloud menampung seluruh seri GLM melalui API Z-AI, dari GLM-4.6 hingga GLM-5.1. Semua model bersifat dwibahasa dan tersedia dengan sistem bayar sesuai pemakaian (pay-as-you-go) dengan jendela konteks 202K.

Large Language Models by Z.ai

Dukung chat, penalaran, dan agen dalam skala besar dengan model bahasa besar terdepan, yang disajikan cepat dan terjangkau di Atlas Cloud.

Lihat semua model

Z.ai Models API Pricing Details

Compare standard vs. our pricing across every Z.ai model.

ModelStandard Price (USD)Our Price (USD)Discount
GLM 5.1
$1.4/$4.4per 1M tokens202.8K context
$1.26/$3.96M in/outper 1M tokens202.8K context
-10%View
GLM 5 Turbo
$1.2/$4per 1M tokens262.1K context
$1.2/$4M in/outper 1M tokens262.1K context
View
GLM 5
$1/$3.2per 1M tokens202.8K context
$0.95/$3.15M in/outper 1M tokens202.8K context
View
GLM 4.7
$0.6/$2.2per 1M tokens202.8K context
$0.52/$1.85M in/outper 1M tokens202.8K context
View
GLM 4.6
$0.6/$2.2per 1M tokens202.8K context
$0.6/$2.2M in/outper 1M tokens202.8K context
View

Explore models from other providers

Instantly explore and experiment with 300+ production-ready models in the Atlas Playground. Start customizing with one click.

Kasus Penggunaan Z-AI API yang Dapat Anda Bangun di Atlas Cloud

Tingkat model GLM mencakup semuanya, mulai dari tugas obrolan dwibahasa yang cepat hingga agen pengkodean otonom yang memakan waktu berjam-jam. Tim menggunakan GLM-5.1 untuk pekerjaan rekayasa jangka panjang dan GLM-4.7 atau GLM-5 Turbo di mana efisiensi biaya dan kecepatan menjadi prioritas.

Optimasi Kinerja Basis Data Jangka Panjang

Engineering teams use GLM-5.1 to run autonomous optimization agents that iterate on production systems over hundreds of rounds. In a documented run, GLM-5.1 improved a vector database through 600 iterations and 6,000 tool calls, reaching 21,500 queries per second — six times the result achievable in a single 50-turn session. Atlas Cloud's pay-as-you-go pricing makes it practical to run these extended sessions without pre-purchasing capacity.

Refactoring Kode Otonom Skala Repositori

Tim pengembang menggunakan GLM-5.1 untuk mengeksekusi transformasi basis kode penuh selama sesi multi-jam tanpa titik pemeriksaan manusia. Model ini merencanakan, menulis, menguji, dan mengiterasi perubahan secara terus-menerus hingga 8 jam, menangani 655 iterasi dalam demonstrasi pembuatan sistem Linux dari awal. Hal ini menggantikan pekerjaan refaktorisasi manual selama berminggu-minggu pada basis kode warisan yang besar.

Integrasi Agen Pengodean IDE

Tim alat pengembang mengintegrasikan GLM-5.1 dan GLM-5 Turbo sebagai model dasar untuk alur kerja pengkodean AI di Claude Code, Kilo Code, Cline, Roo Code, dan OpenCode. Z-AI API di Atlas Cloud kompatibel dengan OpenAI, sehingga penggantian base URL adalah satu-satunya perubahan yang diperlukan untuk merutekan salah satu alat ini melalui GLM. Jendela konteks 262K pada GLM-5 Turbo membuatnya sangat cocok untuk konteks file besar dalam alur kerja IDE.

Otomatisasi Kueri Dukungan Tier-1

Tim operasi membangun agen dukungan menggunakan GLM-5 yang menggabungkan akses basis data tiket, pencarian basis pengetahuan, dan alat eskalasi untuk menangani kueri berulang tanpa intervensi manusia. Kemampuan pemanggilan banyak alat dan dukungan streaming pada model membuatnya praktis untuk penerapan yang berhadapan langsung dengan pelanggan secara real-time. Dukungan dua bahasa berarti agen yang sama menangani tiket berbahasa Mandarin dan Inggris dari satu titik akhir model di Atlas Cloud.

Pembuatan Dokumen Dwibahasa dalam Skala Besar

Tim konten dan bisnis menggunakan GLM-4.7 untuk menghasilkan dokumen Word, presentasi PowerPoint, PDF, dan laporan Excel baik dalam bahasa Mandarin maupun bahasa Inggris dari prompt yang terstruktur. Pada harga $0,52 per juta token input, ini adalah tingkat GLM yang paling hemat biaya untuk alur kerja dokumen bervolume tinggi yang tidak memerlukan penalaran tingkat mutakhir. Jendela konteks 202K cukup untuk menampung garis besar dokumen lengkap dan materi sumber dalam satu kali pemanggilan.

Optimasi Kernel Beban Kerja ML

Tim infrastruktur AI menggunakan GLM-5.1 untuk menjalankan alur pengoptimalan berbasis tolok ukur pada beban kerja pembelajaran mesin. Pada tugas bergaya KernelBench, GLM-5.1 melakukan ribuan siklus pengoptimalan yang digerakkan oleh alat dan mencapai percepatan rata-rata geometris 3,6x. Kemampuan eksekusi berkelanjutan selama 8 jam berarti agen menjalankan loop pengoptimalan penuh tanpa memerlukan pengaktifan ulang manual antar sesi.

Wujudkan visi perusahaan Anda menjadi kenyataan dengan Atlas Cloud AI.

Hubungi sales

Pertanyaan Umum tentang Model Z.ai

Z-AI (juga ditulis sebagai Z.ai) adalah pengembang di balik seri model bahasa besar GLM, yang juga dikenal sebagai ZhipuAI. GLM adalah singkatan dari General Language Model, sebuah keluarga model yang membentang dari GLM-4.6 hingga model unggulan saat ini, GLM-5.1. Seri ini dibangun untuk pemrograman, alur kerja berbasis agen, dan penggunaan produksi dwibahasa Mandarin-Inggris.

GLM-5.1 mencapai peringkat pertama di SWE-Bench Pro dengan skor 58,4 pada tanggal 7 April 2026, mengungguli GPT-5.4 (57,7) dan Claude Opus 4.6 (57,3). Model ini juga memimpin di CyberGym dengan skor 68,7. Hal ini menjadikannya model open-source peringkat teratas untuk pemrograman tingkat produksi per Kuartal 2 tahun 2026.

Ya. GLM-5.1 mendukung eksekusi otonom berkelanjutan hingga 8 jam pada satu tugas tanpa campur tangan manusia. Model ini menangani siklus penuh perencanaan, eksekusi, optimisasi berulang, dan pengiriman. Ini dirancang khusus untuk alur kerja agen pengkodean jangka panjang di lingkungan seperti Claude Code dan pengaturan yang kompatibel dengan OpenClaw.

GLM-5 adalah model fondasi dasar yang dibangun pada arsitektur MoE dengan 744 miliar parameter, dilatih dengan 28,5 triliun token, dan mencapai peringkat Elo #1 di Chatbot Arena untuk model sumber terbuka. GLM-5.1 adalah peningkatan pascapelatihan dari basis yang sama dengan kemampuan pengkodean, penggunaan alat, dan eksekusi otonom yang jauh lebih kuat. GLM-5 dibanderol dengan harga $0,95 per juta token input di Atlas Cloud; harga GLM-5.1 adalah $1,26 per juta token input.

Ya. GLM-5.1 dirilis di bawah lisensi MIT, yang mengizinkan penggunaan komersial, fine-tuning, dan redistribusi tanpa batasan. Bobot terbuka (open weights) tersedia untuk penerapan yang dihosting sendiri (self-hosted). Atlas Cloud menyediakan GLM-5.1 melalui API untuk tim yang lebih menyukai akses terkelola tanpa beban infrastruktur.

GLM-4.6, GLM-4.7, GLM-5, dan GLM-5.1 semuanya mendukung jendela konteks 202.750 token di Atlas Cloud. GLM-5 Turbo adalah pengecualian dengan jendela konteks yang lebih besar yaitu 262.144 token dan panjang keluaran maksimum 131.072 token. GLM-5.1 cocok untuk menghasilkan file kode yang panjang dan jejak eksekusi yang diperluas dalam batas konteksnya.

Ya. Semua model GLM dioptimalkan untuk bahasa Mandarin dan Inggris dengan tingkat kemahiran yang sama di kedua bahasa tersebut. Anda dapat menulis prompt dalam bahasa apa pun dan menerima output dengan kualitas yang konsisten. Hal ini menjadikan GLM praktis bagi tim yang membangun produk untuk melayani pasar Tiongkok maupun internasional hanya dari satu model tunggal.

GLM-4.7 dimulai dari $0,52 per juta token input dan merupakan tingkatan yang paling hemat biaya. GLM-4.6 seharga $0,60, GLM-5 seharga $0,95, dan GLM-5 Turbo seharga $1,20 per juta token input. GLM-5.1, model unggulan, seharga $1,26 per juta token input dan $3,96 per juta token output. Semua model menggunakan sistem bayar sesuai penggunaan (pay-as-you-go) tanpa komitmen bulanan.

Jelajahi Lebih Banyak Seri

Seedance 2.0 Models

Seedance 2.0(by Bytedance) is a multimodal video generation model that redefines "controllable creation," moving beyond the limitations of text or start/end frames. It supports quad-modal inputs—text, image, video, and audio—and introduces an industry-leading "Universal Reference" system. By precisely replicating the composition, camera movement, and character actions from reference assets, Seedance 2.0 solves critical issues with character consistency and physical coherence, empowering creators to act as true "directors" with deep control over their output.

Lihat Seri

Grok-Imagine Models

Grok Imagine Image Quality is xAI's latest AI image generation model, delivering studio-grade visuals with up to 2K resolution and razor-sharp detail. It offers best-in-class text rendering across multiple languages, photorealistic outputs with natural lighting, rich textures, and believable physics, plus tighter prompt following and image editing with reference inputs for precise creative control. Ideal for hero images, ad creatives, product renders, and brand-grade visuals.

Lihat Seri

Gemini Omni

Gemini Omni (by Google DeepMind) is a video generation and editing model launched on May 20, 2026 at Google I/O that redefines the standard for "reasoning-driven creation," built specifically to solve the core challenge of AI video: making output that actually understands what you mean, not just what you type. It fuses Gemini's reasoning engine with generative capability, accepting any mix of images, text, video, and audio to produce consistent, knowledge-grounded output. Unlike models that start from scratch each time, Omni lets you edit through natural conversation — swapping objects, rewriting scenes, shifting styles — while keeping physics, characters, and continuity intact across every turn.

Lihat Seri

GPT Image 2 Models

GPT Image 2 is a state-of-the-art multimodal foundation model engineered for exceptional text-to-image generation with unprecedented photorealism and creative versatility. Developed by OpenAI as the evolution of the DALL-E lineage, it transforms detailed natural language descriptions into hyper-realistic imagery at up to 4K resolution. With proprietary "Neural Rendering Engine" technology for precise visual control, GPT Image 2 delivers studio-quality results with accurate anatomy, lighting, and composition—making it the premier AI tool for professional creators, enterprises, and developers demanding production-ready visual assets.

Lihat Seri

Google Models on Atlas Cloud | Gemini, Nano Bananas & Veo

Model kreatif paling kuat dari Google semuanya tersedia di Atlas Cloud. Veo 3.1 menghadirkan pembuatan video sinematik, Nano Banana 2 memberdayakan pembuatan gambar dengan fidelitas tinggi, dan Gemini membawa kecerdasan multimodal ke setiap alur kerja. Akses rangkaian lengkap model Google melalui satu API key dengan ketersediaan Day-0 dan harga bayar sesuai pemakaian (pay-as-you-go).

Lihat Seri

ByteDance Models on Atlas Cloud | Seedance & Seedream

Dari pembuatan video sinematik hingga penciptaan gambar dengan fidelitas tinggi, model paling kuat dari ByteDance kini tersedia di Atlas Cloud. Jalankan Seedance dan Seedream dalam skala besar dengan harga inferensi terendah dan tanpa biaya overhead infrastruktur.

Lihat Seri

Alibaba Models on Atlas Cloud | Wan & Qwen

Atlas Cloud menyatukan seluruh jajaran model Alibaba di bawah satu API: Qwen untuk tugas bahasa dan gambar, Wan untuk pembuatan video hingga 1080p. Akses setiap model dengan sistem bayar sesuai pemakaian (pay-as-you-go) tanpa berlangganan. Alibaba API tersedia melalui satu URL dasar (base URL) menggunakan klien yang kompatibel dengan OpenAI Anda saat ini.

Lihat Seri

MAI Image 2.5 Models

MAI-Image-2.5 adalah keluarga model pembuatan dan pengeditan gambar fotorealistis terbaru dari Microsoft, yang dibuat untuk desain komersial, fotografi produk, dan pembuatan konten yang siap pakai untuk merek. Tersedia dalam varian standar dan Flash untuk teks-ke-gambar dan pengeditan gambar, model ini memberikan skor Arena ELO terbaik di kelasnya dengan harga yang kompetitif — mulai dari $0,03 per gambar. Dengan penyajian teks yang presisi, kemampuan pengeditan yang sangat akurat, dan pembuatan potret alami, MAI-Image-2.5 dirancang untuk tim yang membutuhkan visual berkualitas produksi tanpa beban pascapemrosesan.

Lihat Seri

Wan2.7 Models

Launching this March, Wan2.7 is the latest powerhouse in the Qwen ecosystem, delivering a massive upgrade in visual fidelity, audio synchronization, and motion consistency over version 2.6. This all-in-one AI video generator supports advanced features like first-and-last frame control, 3x3 grid synthesis, and instruction-based video editing. Outperforming competitors like Jimeng, Wan2.7 offers superior flexibility with support for real-person image inputs, up to five video references, and 1080P high-definition outputs spanning 2 to 15 seconds, making it the premier choice for professional digital storytelling and high-end content marketing.

Lihat Seri

Nano Banana2 Models

Nano Banana 2 (by Google), is a generative image model that perfectly balances lightning-fast rendering with exceptional visual quality. With an improved price-performance ratio, it achieves breakthrough micro-detail depiction, accurate native text rendering, and complex physical structure reconstruction. It serves as a highly efficient, commercial-grade visual production tool for developers, marketing teams, and content creators.

Lihat Seri

Doubao Models

Doubao adalah keluarga model bahasa besar dari ByteDance, yang dirancang untuk penalaran tingkat produksi, pengkodean, dan beban kerja agen bervolume tinggi. Mencakup produk unggulan Seed 2.0 Pro, varian Code Preview khusus, tingkatan Lite dan Mini yang hemat biaya, plus generasi Seed 1.8 dan Seed 1.6 yang telah terbukti, jajaran ini memberi pengembang antarmuka tunggal yang kompatibel dengan OpenAI untuk melakukan penskalaan mulai dari penalaran tingkat lanjut hingga tugas-tugas dengan hasil tinggi yang peka terhadap latensi. Setiap model Doubao di Atlas Cloud dilengkapi dengan jendela konteks 256K token, streaming, dan kompatibilitas SDK langsung pakai (drop-in) — sehingga Anda dapat mencocokkan model yang tepat untuk setiap pekerjaan tanpa menulis ulang tumpukan (stack) teknologi Anda.

Lihat Seri

Hunyuan 3D Generation Models

Hunyuan3D is a state-of-the-art 3D generative foundation model from Tencent that turns text prompts and single images into high-quality, textured 3D meshes. Built on a two-stage pipeline—Hunyuan3D-DiT for shape generation via flow-matching diffusion and Hunyuan3D-Paint for multi-view texture synthesis—it produces clean geometry with full PBR materials ready for game engines, AR/VR, 3D printing, and DCC tools. Available in Pro (up to 1.5M faces, 4K PBR textures) and Rapid (2–3 minute lightweight generation) tiers, with both Text-to-3D and Image-to-3D entry points, Hunyuan3D is the premier AI 3D toolkit for game developers, e-commerce teams, and 3D content studios. Generations start at $0.02 each.

Lihat Seri

Artikel pilihan

Panduan, tutorial, dan pembaruan produk untuk membantu Anda memaksimalkan Atlas Cloud.

Join our Discord community

Join the Discord community for the latest model updates, prompts, and support.