
Z.ai API för in ZhipuAIs hela GLM-serie i din stack, från GLM-4.6 till flaggskeppet GLM-5.1, som rankas etta bland open-source-modeller på SWE-Bench Pro och kör autonoma kodningsagenter i timmar i sträck. GLM kombinerar ett kontextfönster på 202K tokens med balanserade utdata på kinesiska och engelska under en tillåtande MIT-licens. Atlas Cloud tillhandahåller varje modell via en OpenAI-kompatibel nyckel med Day-0-åtkomst och transparent prissättning per anrop. Kom igång i dag.
Driv chatt, resonemang och agenter i stor skala med ledande stora språkmodeller, levererade snabbt och prisvärt på Atlas Cloud.
Compare standard vs. our pricing across every Z.ai model.
| Model | Standard Price (USD) | Our Price (USD) | Discount | |
|---|---|---|---|---|
| GLM 5.2 | $1.4/$4.4per 1M tokens1048.6K context | $1.26/$3.96M in/outper 1M tokens1048.6K context | -10% | View |
| GLM 5.1 | $1.4/$4.4per 1M tokens202.8K context | $1.26/$3.96M in/outper 1M tokens202.8K context | -10% | View |
| GLM 5v Turbo | $1.2/$4per 1M tokens202.8K context | $1.2/$4M in/outper 1M tokens202.8K context | — | View |
| GLM 5 | $1/$3.2per 1M tokens202.8K context | $0.95/$3.15M in/outper 1M tokens202.8K context | — | View |
| GLM 4.7 | $0.6/$2.2per 1M tokens202.8K context | $0.52/$1.85M in/outper 1M tokens202.8K context | — | View |
| GLM 4.6 | $0.6/$2.2per 1M tokens202.8K context | $0.6/$2.2M in/outper 1M tokens202.8K context | — | View |
Instantly explore and experiment with 400+ production-ready models in the Atlas Playground. Start customizing with one click.
GLM:s modellnivåer täcker allt från snabba tvåspråkiga chattuppgifter till flertimmars autonoma kodningsagenter. Team använder GLM-5.1 för långsiktigt ingenjörsarbete och GLM-4.7 eller GLM-5 Turbo där kostnadseffektivitet och hastighet är prioriterat.
Engineering teams use GLM-5.1 to run autonomous optimization agents that iterate on production systems over hundreds of rounds. In a documented run, GLM-5.1 improved a vector database through 600 iterations and 6,000 tool calls, reaching 21,500 queries per second — six times the result achievable in a single 50-turn session. Atlas Cloud's pay-as-you-go pricing makes it practical to run these extended sessions without pre-purchasing capacity.
Utvecklingsteam använder GLM-5.1 för att utföra fullständiga kodbasomvandlingar under flertimmars-sessioner utan mänskliga kontrollpunkter. Modellen planerar, skriver, testar och itererar ändringar kontinuerligt i upp till 8 timmar och hanterar 655 iterationer i ett demonstrerat Linux-systembyggande från grunden. Detta ersätter veckor av manuellt refaktoreringsarbete på stora, föråldrade kodbaser.
Team för utvecklarverktyg integrerar GLM-5.1 och GLM-5 Turbo som den underliggande modellen för AI-kodningsarbetsflöden i Claude Code, Kilo Code, Cline, Roo Code och OpenCode. Z-AI API på Atlas Cloud är OpenAI-kompatibelt, så byte av base URL är den enda ändring som krävs för att dirigera något av dessa verktyg via GLM. GLM-5 Turbos kontextfönster på 262K gör det särskilt lämpligt för stora filkontexter i IDE-arbetsflöden.
Driftteam bygger supportagenter med GLM-5 som kombinerar åtkomst till ärendedatabaser, sökning i kunskapsbaser och eskaleringsverktyg för att hantera repetitiva frågor utan mänsklig inblandning. Modellens stöd för anrop av flera verktyg och strömning gör den praktisk för kundvända implementeringar i realtid. Tvåspråkigt stöd innebär att samma agent hanterar kinesiska och engelska ärenden från en enda modellslutpunkt på Atlas Cloud.
Innehålls- och affärsteam använder GLM-4.7 för att generera Word-dokument, PowerPoint-presentationer, PDF:er och Excel-rapporter på både kinesiska och engelska från strukturerade prompter. Med 0,52 USD per miljon inmatningstokens är det den mest kostnadseffektiva GLM-nivån för dokumentarbetsflöden med hög volym som inte kräver resonemang på frontlinjenivå. Kontextfönstret på 202K är tillräckligt för att rymma fullständiga dokumentdispositioner och källmaterial i ett enda anrop.
AI-infrastrukturteam använder GLM-5.1 för att köra benchmark-drivna optimeringspipelines på maskininlärningsarbetsbelastningar. På uppgifter av KernelBench-typ utför GLM-5.1 tusentals verktygsdrivna optimeringscykler och uppnår en 3,6x geometrisk genomsnittlig hastighetsökning. Förmågan till 8 timmars kontinuerlig exekvering innebär att agenten kör hela optimeringsloopen utan att kräva manuella omstarter mellan sessionerna.
Z.ai API ger utvecklare programmatisk åtkomst till GLM-serien av stora språkmodeller som byggts av Z.ai, företaget som även är känt som Zhipu AI. GLM står för General Language Model och omfattar versioner från GLM-4.6 till flaggskeppet GLM-5.1, optimerade för kodning, agentbaserade arbetsflöden samt produktionsanvändning på både kinesiska och engelska. På Atlas Cloud når du hela utbudet via en OpenAI-kompatibel endpoint.
Atlas Cloud tillhandahåller GLM-serien från GLM-4.6 upp till flaggskeppet GLM-5.1, med GLM-4.7 och GLM-5 däremellan. Lättare nivåer hanterar vardagliga uppgifter med hög volym till lägre kostnad, medan GLM-5.1 är avsedd för den mest krävande kodningen och det mest avancerade agentbaserade arbetet. Alla modeller körs med pay-as-you-go via samma nyckel.
Ja. GLM open weights, inklusive GLM-5.1, släpps under MIT-licensen, som tillåter kommersiell användning, finjustering och vidaredistribution utan begränsningar. Om du hellre vill slippa infrastrukturkostnader och driftarbete levererar Atlas Cloud samma modeller via API för hanterad åtkomst i stället för egen hosting.
Peka din befintliga OpenAI SDK mot Atlas Cloud base URL, ange din nyckel och skicka med namnet på den GLM-modell du vill använda. Eftersom Z.ai API är OpenAI-kompatibelt kan de flesta projekt migreras genom att bara ändra base URL och modellsträng, och modellerna kan användas direkt i agentverktyg som Claude Code, Cline och Roo Code. Börja bygga i dag.
Både kinesiska och engelska är förstklassigt stödda i GLM, som är tränad för hög kompetens på båda språken. Du kan skriva promptar på vilket som helst av språken och få konsekvent kvalitet tillbaka, vilket gör modellutbudet praktiskt för team som betjänar både kinesiska och internationella användare med en enda modell i stället för att underhålla separata stackar.
GLM-4.6 till GLM-5.1 stöder ett 200K token context window, tillräckligt för att rymma stora kodbaser, långa dokument eller omfattande agent traces i en enda begäran. Om ditt arbetsflöde genererar långa utdata täcker samma fönster stora kodfiler och flerstegsloggar från exekvering utan tidig avkortning.
GLM-5.1 toppade SWE-Bench Pro med en poäng på 58.4 i april 2026, vilket placerar den bland de starkaste open-source-modellerna för verklig kodning. Den stöder också kontinuerlig autonom exekvering i upp till åtta timmar på en enda uppgift, med planering, iteration och leverans i samma loop, vilket passar långsiktiga agentarbetsflöden i miljöer som Claude Code.
Alla GLM-modeller i Z.ai API körs med transparent pay-as-you-go-prissättning och debiteras per token utan abonnemang eller månadsåtagande. Input- och output-tokens mäts separat, och lättare nivåer som GLM-4.7 kostar mindre per token än flaggskeppet GLM-5.1, så du kan anpassa modellvalet efter budgeten. Kontrollera det aktuella tokenpriset på respektive model card i Atlas Cloud.
Guider, handledningar och produktnyheter som hjälper dig att få ut mesta möjliga av Atlas Cloud.