Seedance 2.0 Mini & Fast API till världens lägsta priser — upp till 68 % rabatt på det officiella priset

Z.ai API for Top Open-Source GLM Coding

Z.ai API för in ZhipuAIs hela GLM-serie i din stack, från GLM-4.6 till flaggskeppet GLM-5.1, som rankas etta bland open-source-modeller på SWE-Bench Pro och kör autonoma kodningsagenter i timmar i sträck. GLM kombinerar ett kontextfönster på 202K tokens med balanserade utdata på kinesiska och engelska under en tillåtande MIT-licens. Atlas Cloud tillhandahåller varje modell via en OpenAI-kompatibel nyckel med Day-0-åtkomst och transparent prissättning per anrop. Kom igång i dag.

Z.ai är utvecklad av Z.ai. Atlas Cloud (som drivs av Atlas Cloud AI LLC) tillhandahåller åtkomst till modellen men äger den inte. Alla varumärken tillhör sina respektive ägare.

Large Language Models by Z.ai

Driv chatt, resonemang och agenter i stor skala med ledande stora språkmodeller, levererade snabbt och prisvärt på Atlas Cloud.

Visa alla modeller

Z.ai Models API Pricing Details

Compare standard vs. our pricing across every Z.ai model.

ModelStandard Price (USD)Our Price (USD)Discount
GLM 5.2
$1.4/$4.4per 1M tokens1048.6K context
$0.938/$2.948M in/outper 1M tokens1048.6K context
-33%View
GLM 5.1
$1.4/$4.4per 1M tokens202.8K context
$1.26/$3.96M in/outper 1M tokens202.8K context
-10%View
GLM 5v Turbo
$1.2/$4per 1M tokens202.8K context
$1.2/$4M in/outper 1M tokens202.8K context
View
GLM 5
$1/$3.2per 1M tokens202.8K context
$0.95/$3.15M in/outper 1M tokens202.8K context
View
GLM 4.7
$0.6/$2.2per 1M tokens202.8K context
$0.52/$1.85M in/outper 1M tokens202.8K context
View
GLM 4.6
$0.6/$2.2per 1M tokens202.8K context
$0.6/$2.2M in/outper 1M tokens202.8K context
View

Explore models from other providers

Instantly explore and experiment with 400+ production-ready models in the Atlas Playground. Start customizing with one click.

Z-AI API-användningsfall som du kan bygga på Atlas Cloud

GLM:s modellnivåer täcker allt från snabba tvåspråkiga chattuppgifter till flertimmars autonoma kodningsagenter. Team använder GLM-5.1 för långsiktigt ingenjörsarbete och GLM-4.7 eller GLM-5 Turbo där kostnadseffektivitet och hastighet är prioriterat.

Långsiktig optimering av databasprestanda

Engineering teams use GLM-5.1 to run autonomous optimization agents that iterate on production systems over hundreds of rounds. In a documented run, GLM-5.1 improved a vector database through 600 iterations and 6,000 tool calls, reaching 21,500 queries per second — six times the result achievable in a single 50-turn session. Atlas Cloud's pay-as-you-go pricing makes it practical to run these extended sessions without pre-purchasing capacity.

Autonom Kodrefaktorering på Repository-nivå

Utvecklingsteam använder GLM-5.1 för att utföra fullständiga kodbasomvandlingar under flertimmars-sessioner utan mänskliga kontrollpunkter. Modellen planerar, skriver, testar och itererar ändringar kontinuerligt i upp till 8 timmar och hanterar 655 iterationer i ett demonstrerat Linux-systembyggande från grunden. Detta ersätter veckor av manuellt refaktoreringsarbete på stora, föråldrade kodbaser.

Integration av IDE-kodningsagent

Team för utvecklarverktyg integrerar GLM-5.1 och GLM-5 Turbo som den underliggande modellen för AI-kodningsarbetsflöden i Claude Code, Kilo Code, Cline, Roo Code och OpenCode. Z-AI API på Atlas Cloud är OpenAI-kompatibelt, så byte av base URL är den enda ändring som krävs för att dirigera något av dessa verktyg via GLM. GLM-5 Turbos kontextfönster på 262K gör det särskilt lämpligt för stora filkontexter i IDE-arbetsflöden.

Automatisering av Tier-1-supportfrågor

Driftteam bygger supportagenter med GLM-5 som kombinerar åtkomst till ärendedatabaser, sökning i kunskapsbaser och eskaleringsverktyg för att hantera repetitiva frågor utan mänsklig inblandning. Modellens stöd för anrop av flera verktyg och strömning gör den praktisk för kundvända implementeringar i realtid. Tvåspråkigt stöd innebär att samma agent hanterar kinesiska och engelska ärenden från en enda modellslutpunkt på Atlas Cloud.

Tvåspråkig dokumentgenerering i stor skala

Innehålls- och affärsteam använder GLM-4.7 för att generera Word-dokument, PowerPoint-presentationer, PDF:er och Excel-rapporter på både kinesiska och engelska från strukturerade prompter. Med 0,52 USD per miljon inmatningstokens är det den mest kostnadseffektiva GLM-nivån för dokumentarbetsflöden med hög volym som inte kräver resonemang på frontlinjenivå. Kontextfönstret på 202K är tillräckligt för att rymma fullständiga dokumentdispositioner och källmaterial i ett enda anrop.

Kernel-optimering för ML-arbetsbelastningar

AI-infrastrukturteam använder GLM-5.1 för att köra benchmark-drivna optimeringspipelines på maskininlärningsarbetsbelastningar. På uppgifter av KernelBench-typ utför GLM-5.1 tusentals verktygsdrivna optimeringscykler och uppnår en 3,6x geometrisk genomsnittlig hastighetsökning. Förmågan till 8 timmars kontinuerlig exekvering innebär att agenten kör hela optimeringsloopen utan att kräva manuella omstarter mellan sessionerna.

Förvandla din företagsvision till verklighet med Atlas Cloud AI.

Kontakta säljteamet

Vad utvecklare frågar om Z.ai API

Z.ai API ger utvecklare programmatisk åtkomst till GLM-serien av stora språkmodeller som byggts av Z.ai, företaget som även är känt som Zhipu AI. GLM står för General Language Model och omfattar versioner från GLM-4.6 till flaggskeppet GLM-5.1, optimerade för kodning, agentbaserade arbetsflöden samt produktionsanvändning på både kinesiska och engelska. På Atlas Cloud når du hela utbudet via en OpenAI-kompatibel endpoint.

Atlas Cloud tillhandahåller GLM-serien från GLM-4.6 upp till flaggskeppet GLM-5.1, med GLM-4.7 och GLM-5 däremellan. Lättare nivåer hanterar vardagliga uppgifter med hög volym till lägre kostnad, medan GLM-5.1 är avsedd för den mest krävande kodningen och det mest avancerade agentbaserade arbetet. Alla modeller körs med pay-as-you-go via samma nyckel.

Ja. GLM open weights, inklusive GLM-5.1, släpps under MIT-licensen, som tillåter kommersiell användning, finjustering och vidare­distribution utan begränsningar. Om du hellre vill slippa infrastrukturkostnader och driftarbete levererar Atlas Cloud samma modeller via API för hanterad åtkomst i stället för egen hosting.

Peka din befintliga OpenAI SDK mot Atlas Cloud base URL, ange din nyckel och skicka med namnet på den GLM-modell du vill använda. Eftersom Z.ai API är OpenAI-kompatibelt kan de flesta projekt migreras genom att bara ändra base URL och modellsträng, och modellerna kan användas direkt i agentverktyg som Claude Code, Cline och Roo Code. Börja bygga i dag.

Både kinesiska och engelska är förstklassigt stödda i GLM, som är tränad för hög kompetens på båda språken. Du kan skriva promptar på vilket som helst av språken och få konsekvent kvalitet tillbaka, vilket gör modellutbudet praktiskt för team som betjänar både kinesiska och internationella användare med en enda modell i stället för att underhålla separata stackar.

GLM-4.6 till GLM-5.1 stöder ett 200K token context window, tillräckligt för att rymma stora kodbaser, långa dokument eller omfattande agent traces i en enda begäran. Om ditt arbetsflöde genererar långa utdata täcker samma fönster stora kodfiler och flerstegsloggar från exekvering utan tidig avkortning.

GLM-5.1 toppade SWE-Bench Pro med en poäng på 58.4 i april 2026, vilket placerar den bland de starkaste open-source-modellerna för verklig kodning. Den stöder också kontinuerlig autonom exekvering i upp till åtta timmar på en enda uppgift, med planering, iteration och leverans i samma loop, vilket passar långsiktiga agentarbetsflöden i miljöer som Claude Code.

Alla GLM-modeller i Z.ai API körs med transparent pay-as-you-go-prissättning och debiteras per token utan abonnemang eller månadsåtagande. Input- och output-tokens mäts separat, och lättare nivåer som GLM-4.7 kostar mindre per token än flaggskeppet GLM-5.1, så du kan anpassa modellvalet efter budgeten. Kontrollera det aktuella tokenpriset på respektive model card i Atlas Cloud.

Utforska Fler Familjer

Seedance 2.5

Seedance 2.5 API är nu tillgängligt på Atlas Cloud! Det ger utvecklare ByteDances nyaste videomodell. Den genererar upp till 30 sekunder inbyggd video i en enda körning från text, en enskild bild eller upp till 50 multimodala referenser, med synkroniserat ljud och flerspråkig text i bildrutan. På Atlas Cloud når du den genom en enda nyckel, med motivkonsekvens och förbättrad fysik som håller långa tagningar sammanhängande.

Visa Familj

Wan 3.0

Wan 3.0 API är nästa generation av Alibabas Wan-videofamilj, byggd för att ta långformatsgenerering, multireferenskontroll och audiovisuell kvalitet till nya höjder. Atlas Cloud är redan värd för Wan 2.7, 2.6 och 2.5, och Wan 3.0 körs på samma enhetliga nyckel utan separat konfiguration. Börja bygga idag. Rulla ner till uppvisningen för att se vad Wan 3.0 kan skapa.

Visa Familj

MiniMax H3

MiniMax H3 är MiniMax videomodellfamilj för text-, bild- och referensstyrd generering. Skapa klipp på 5 till 15 sekunder, styr rörelser med en valfri slutbild, bevara motiv från referensbilder eller välj H3 Developer när genererat ljud passar arbetsflödet. Atlas Cloud samlar H3, H3 Fast, H3 Max och H3 Developer i ett enda API-arbetsflöde, med standardpriser från $0.038 per sekund. Börja bygga idag.

Visa Familj

Seedream 5.0 Pro

Seedream 5.0 Pro API ger utvecklare ByteDances kontrollerbara bildredigeringsmodell på Atlas Cloud. Den placerar redigeringar exakt med ankare och koordinater, separerar bilder i redigerbara lager, slår samman flera referenser och matchar exakta färger och material, med flerspråkig text i 2K och 3K. På Atlas Cloud når du den via en enda nyckel!

Visa Familj

Seedance 2.0

Seedance 2.0 API ger dig produktionsåtkomst till ByteDances multimodala videomodell — quad-modala inmatningar (text, bild, video, ljud) och ett branschledande "Universal Reference"-system som låser komposition, kamerarörelser och karaktärers handlingar mellan tagningar. Integrera kontroll på regissörsnivå med ett enda API-anrop, ett fast pris på 0,09 $/s, omedelbar nyckel och ingen väntelista — med stöd av upptid och efterlevnad i företagsklass. Seedance 2.0 Native 4K är nu live!

Visa Familj

GPT Image 2.5

gpt-image-2.5-familjen från OpenAI ger utvecklare möjlighet att välja mellan Flare och Sunburst för produktionsarbetsflöden för bilder. Rendera med valfria upplösningar upp till 3840x2160 och välj mellan fem kvalitetsnivåer, däribland xhigh och max, för att uppfylla specifika krav på utdata. Atlas Cloud erbjuder färdig REST-inferens utan cold starts och med standardpriser från $0.004 per generering. Börja bygga idag.

Visa Familj

GPT Image 2

GPT Image 2 API ger utvecklare tillgång till OpenAI:s senaste bildmodell, uppföljaren till GPT Image 1.5. Den genererar och redigerar bilder med exakt textåtergivning i latinska och CJK-tecken, plus en stark komposition för affischer, mockups och infografik. På Atlas Cloud når du den via ett enhetligt API tillsammans med över 300 modeller, med gratis krediter, 99,99 % upptid och utan krav på OpenAI-organisationsverifiering.

Visa Familj

Gemini Omni Flash

gemini omni API ger utvecklare tillgång till Google DeepMinds nativt multimodala Gemini Omni Flash-familj, inklusive Gemini Omni 1.1 Flash. Skapa filmiska videor med synkroniserat inbyggt ljud, animera stillbilder med exakt kontroll över start- och slutbild eller redigera befintligt videomaterial med textstyrda ändringar som bevarar innehåll som inte berörs. Atlas Cloud erbjuder en OpenAI-kompatibel nyckel, samlad åtkomst och transparent prissättning med betalning efter användning. Börja bygga redan i dag.

Visa Familj

Grok Imagine

Grok Imagine API täcker xAI:s bild-, video- och talmodeller – från Image 2.0 till Video 1.5 och xAI TTS v1. Rendera 1K eller 2K stillbilder över 14 bildformat, skapa upp till 15 sekunders 1080p-video, styr resultatet med upp till 7 referensbilder, eller lägg till röst på 20 språk. Atlas Cloud kör alla lägen på en enda slutpunkt, prissatt per användning från $0.02 per bild och $0.05 per sekund. Börja bygga idag.

Visa Familj

Google

Googles mest kraftfulla kreativa modeller är alla tillgängliga på Atlas Cloud. Veo 3.1 levererar filmisk videogenerering, Nano Banana 2 driver skapandet av högupplösta bilder, och Gemini tillför multimodal intelligens till varje arbetsflöde. Få tillgång till hela Googles modellsvit via en enda API key med Day-0-tillgänglighet och pay-as-you-go-prissättning.

Visa Familj

Seedance 2.0 Mini

Seedance 2.0 Mini tar ByteDances multimodala videogenerering till arbetsflöden där hastighet och kostnad är avgörande. Det levererar kärnfunktionerna i Seedance 2.0 med ett lättare fotavtryck – snabbare generering, lägre kostnad per video och samma API-integration som du redan använder. För team som kör pipelines med hög volym eller gör prototyper i stor skala är Mini den praktiska standarden.

Visa Familj

ByteDance

Från filmisk videogenerering till skapande av högupplösta bilder, ByteDances kraftfullaste modeller är live på Atlas Cloud. Kör Seedance och Seedream i stor skala med de lägsta inferenspriserna och noll infrastrukturkostnader.

Visa Familj

Rekommenderade artiklar

Guider, handledningar och produktnyheter som hjälper dig att få ut mesta möjliga av Atlas Cloud.