
Z.ai API udostępnia w Twoim stosie pełną serię GLM od ZhipuAI, od GLM-4.6 po flagowy GLM-5.1, który zajmuje pierwsze miejsce wśród modeli open source w SWE-Bench Pro i potrafi uruchamiać autonomicznych agentów programistycznych przez wiele godzin. GLM łączy kontekst 202K tokenów ze zrównoważonym generowaniem po chińsku i angielsku na permissive MIT license. Atlas Cloud udostępnia każdy model przez jeden klucz zgodny z OpenAI, z dostępem Day-0 i przejrzystymi cenami za każde wywołanie. Zacznij już dziś.
Napędzaj czat, rozumowanie i agentów na dużą skalę dzięki wiodącym dużym modelom językowym, dostarczanym szybko i przystępnie cenowo w Atlas Cloud.
Compare standard vs. our pricing across every Z.ai model.
| Model | Standard Price (USD) | Our Price (USD) | Discount | |
|---|---|---|---|---|
| GLM 5.2 | $1.4/$4.4per 1M tokens1048.6K context | $1.26/$3.96M in/outper 1M tokens1048.6K context | -10% | View |
| GLM 5.1 | $1.4/$4.4per 1M tokens202.8K context | $1.26/$3.96M in/outper 1M tokens202.8K context | -10% | View |
| GLM 5v Turbo | $1.2/$4per 1M tokens202.8K context | $1.2/$4M in/outper 1M tokens202.8K context | — | View |
| GLM 5 | $1/$3.2per 1M tokens202.8K context | $0.95/$3.15M in/outper 1M tokens202.8K context | — | View |
| GLM 4.7 | $0.6/$2.2per 1M tokens202.8K context | $0.52/$1.85M in/outper 1M tokens202.8K context | — | View |
| GLM 4.6 | $0.6/$2.2per 1M tokens202.8K context | $0.6/$2.2M in/outper 1M tokens202.8K context | — | View |
Instantly explore and experiment with 400+ production-ready models in the Atlas Playground. Start customizing with one click.
Poziomy modeli GLM obejmują wszystko, od szybkich dwujęzycznych zadań czatu po wielogodzinnych autonomicznych agentów kodujących. Zespoły używają GLM-5.1 do długoterminowych prac inżynieryjnych, a GLM-4.7 lub GLM-5 Turbo tam, gdzie priorytetem jest efektywność kosztowa i szybkość.
Engineering teams use GLM-5.1 to run autonomous optimization agents that iterate on production systems over hundreds of rounds. In a documented run, GLM-5.1 improved a vector database through 600 iterations and 6,000 tool calls, reaching 21,500 queries per second — six times the result achievable in a single 50-turn session. Atlas Cloud's pay-as-you-go pricing makes it practical to run these extended sessions without pre-purchasing capacity.
Zespoły programistyczne używają GLM-5.1 do przeprowadzania pełnych transformacji baz kodu podczas wielogodzinnych sesji bez ludzkich punktów kontrolnych. Model planuje, pisze, testuje i iteruje zmiany w sposób ciągły przez maksymalnie 8 godzin, obsługując 655 iteracji w zaprezentowanej kompilacji systemu Linux od podstaw. Zastępuje to tygodnie ręcznej pracy przy refaktoryzacji dużych, starszych baz kodu.
Zespoły ds. narzędzi dla programistów integrują GLM-5.1 i GLM-5 Turbo jako podstawowy model dla przepływów pracy kodowania AI w Claude Code, Kilo Code, Cline, Roo Code i OpenCode. Z-AI API w Atlas Cloud jest kompatybilne z OpenAI, więc zmiana base URL jest jedyną modyfikacją wymaganą do przekierowania dowolnego z tych narzędzi przez GLM. Okno kontekstowe 262K modelu GLM-5 Turbo sprawia, że jest on szczególnie odpowiedni do kontekstu dużych plików w przepływach pracy środowisk IDE.
Zespoły operacyjne budują agentów wsparcia przy użyciu GLM-5, którzy łączą dostęp do bazy danych zgłoszeń, wyszukiwanie w bazie wiedzy i narzędzia do eskalacji, aby obsługiwać powtarzalne zapytania bez interwencji człowieka. Obsługa wywołań wielu narzędzi i strumieniowania przez model czyni go praktycznym we wdrożeniach w czasie rzeczywistym skierowanych do klientów. Obsługa dwóch języków oznacza, że ten sam agent obsługuje zgłoszenia w języku chińskim i angielskim z jednego punktu końcowego modelu w Atlas Cloud.
Zespoły ds. treści i biznesu używają GLM-4.7 do generowania dokumentów Word, prezentacji PowerPoint, plików PDF i raportów Excel zarówno w języku chińskim, jak i angielskim na podstawie ustrukturyzowanych promptów. Przy cenie 0,52 USD za milion tokenów wejściowych jest to najbardziej opłacalny poziom GLM dla wielkoseryjnych przepływów pracy z dokumentami, które nie wymagają wnioskowania na poziomie granicznych modeli (frontier-level). Okno kontekstowe o rozmiarze 202K wystarcza do pomieszczenia pełnych zarysów dokumentów i materiałów źródłowych w jednym wywołaniu.
Zespoły ds. infrastruktury AI używają GLM-5.1 do uruchamiania opartych na benchmarkach potoków optymalizacyjnych dla obciążeń uczenia maszynowego. W zadaniach w stylu KernelBench, GLM-5.1 wykonuje tysiące sterowanych narzędziami cykli optymalizacyjnych i osiąga 3,6-krotne przyspieszenie średniej geometrycznej. Możliwość 8-godzinnego ciągłego wykonywania oznacza, że agent uruchamia pełną pętlę optymalizacyjną bez konieczności ręcznego restartowania między sesjami.
Z.ai API zapewnia deweloperom programistyczny dostęp do serii dużych modeli językowych GLM tworzonych przez Z.ai, firmę znaną również jako Zhipu AI. GLM oznacza General Language Model i obejmuje wydania od GLM-4.6 po flagowy GLM-5.1, dostrojone do programowania, przepływów pracy agentów oraz produkcyjnego użycia dwujęzycznego — po chińsku i angielsku. W Atlas Cloud uzyskujesz dostęp do pełnej gamy przez jeden endpoint zgodny z OpenAI.
Atlas Cloud udostępnia serię GLM od GLM-4.6 po flagowy GLM-5.1, z GLM-4.7 i GLM-5 pomiędzy nimi. Lżejsze warianty obsługują codzienne zadania o dużym wolumenie przy niższych kosztach, a GLM-5.1 jest przeznaczony do najbardziej wymagających prac programistycznych i agentowych. Każdy model działa w modelu pay-as-you-go przy użyciu tego samego klucza.
Tak. Otwarte wagi GLM, w tym GLM-5.1, są udostępniane na licencji MIT, która pozwala na użycie komercyjne, fine-tuning i redystrybucję bez ograniczeń. Jeśli wolisz uniknąć narzutu związanego z infrastrukturą, Atlas Cloud udostępnia te same modele przez API jako usługę zarządzaną zamiast self-hostingu.
Skieruj swój istniejący OpenAI SDK na bazowy URL Atlas Cloud, ustaw klucz i przekaż nazwę wybranego modelu GLM. Ponieważ Z.ai API jest zgodne z OpenAI, większość projektów można przenieść, zmieniając tylko bazowy URL i ciąg z nazwą modelu, a modele podłączają się bezpośrednio do narzędzi agentowych, takich jak Claude Code, Cline i Roo Code. Zacznij tworzyć już dziś.
Zarówno chiński, jak i angielski są w GLM traktowane priorytetowo — model został wytrenowany pod kątem wysokiej biegłości w obu językach. Możesz pisać prompty w dowolnym z nich i otrzymywać spójną jakość odpowiedzi, dzięki czemu ta gama modeli jest praktyczna dla zespołów obsługujących użytkowników chińskich i międzynarodowych z jednego modelu, zamiast utrzymywać osobne stosy.
Modele od GLM-4.6 do GLM-5.1 obsługują okno kontekstu 200K tokenów, wystarczające, aby w jednym żądaniu zmieścić duże bazy kodu, długie dokumenty lub rozbudowane ślady pracy agenta. Jeśli Twój przepływ pracy generuje długie wyniki, to samo okno obejmie duże pliki kodu i wieloetapowe logi wykonania bez przedwczesnego obcięcia.
GLM-5.1 zajął pierwsze miejsce w SWE-Bench Pro z wynikiem 58.4 w kwietniu 2026 roku, plasując się wśród najmocniejszych modeli open-source do rzeczywistych zadań programistycznych. Obsługuje też ciągłe autonomiczne wykonywanie pojedynczego zadania przez maksymalnie osiem godzin, realizując planowanie, iterację i dostarczenie w jednej pętli, co dobrze pasuje do długoterminowych przepływów agentowych w środowiskach takich jak Claude Code.
Każdy model GLM w Z.ai API działa w przejrzystym modelu pay-as-you-go, z rozliczeniem za token, bez subskrypcji ani miesięcznego zobowiązania. Tokeny wejściowe i wyjściowe są mierzone oddzielnie, a lżejsze warianty, takie jak GLM-4.7, kosztują mniej za token niż flagowy GLM-5.1, dzięki czemu możesz dopasować wybór modelu do budżetu. Sprawdź aktualną stawkę za token na karcie każdego modelu w Atlas Cloud.
Poradniki, samouczki i nowości produktowe, dzięki którym w pełni wykorzystasz Atlas Cloud.