
Z.ai API는 GLM-4.6부터 플래그십 GLM-5.1까지 ZhipuAI의 전체 GLM 시리즈를 여러분의 스택에 제공합니다. GLM-5.1은 SWE-Bench Pro에서 오픈소스 모델 중 1위를 기록했으며, 자율 코딩 에이전트를 한 번에 몇 시간씩 실행합니다. GLM은 202K 토큰 컨텍스트와 균형 잡힌 중국어 및 영어 출력을 permissive MIT 라이선스로 제공합니다. Atlas Cloud는 하나의 OpenAI 호환 키로 각 모델을 제공하며, Day-0 액세스와 투명한 호출당 요금제를 지원합니다. 지금 시작하세요.
Z.ai은(는) Z.ai에서 개발한 모델입니다. Atlas Cloud(운영: Atlas Cloud AI LLC)는 해당 모델에 대한 액세스를 제공할 뿐이며 이를 소유하지 않습니다. 모든 상표는 각 소유자에게 귀속됩니다.
Atlas Cloud에서 업계 선도 대규모 언어 모델을 빠르고 합리적인 비용으로 제공해 채팅, 추론, 에이전트를 대규모로 구동합니다.
Compare standard vs. our pricing across every Z.ai model.
| Model | Standard Price (USD) | Our Price (USD) | Discount | |
|---|---|---|---|---|
| GLM 5.2 | $1.4/$4.4per 1M tokens1048.6K context | $0.938/$2.948M in/outper 1M tokens1048.6K context | -33% | View |
| GLM 5.1 | $1.4/$4.4per 1M tokens202.8K context | $1.26/$3.96M in/outper 1M tokens202.8K context | -10% | View |
| GLM 5v Turbo | $1.2/$4per 1M tokens202.8K context | $1.2/$4M in/outper 1M tokens202.8K context | — | View |
| GLM 5 | $1/$3.2per 1M tokens202.8K context | $0.95/$3.15M in/outper 1M tokens202.8K context | — | View |
| GLM 4.7 | $0.6/$2.2per 1M tokens202.8K context | $0.52/$1.85M in/outper 1M tokens202.8K context | — | View |
| GLM 4.6 | $0.6/$2.2per 1M tokens202.8K context | $0.6/$2.2M in/outper 1M tokens202.8K context | — | View |
Instantly explore and experiment with 400+ production-ready models in the Atlas Playground. Start customizing with one click.
GLM의 모델 계층은 빠른 이중 언어 채팅 작업부터 몇 시간에 걸친 자율 코딩 에이전트에 이르기까지 모든 것을 포괄합니다. 팀들은 장기적인 엔지니어링 작업에 GLM-5.1을 사용하며, 비용 효율성과 속도가 우선시되는 곳에서는 GLM-4.7 또는 GLM-5 Turbo를 사용합니다.
Engineering teams use GLM-5.1 to run autonomous optimization agents that iterate on production systems over hundreds of rounds. In a documented run, GLM-5.1 improved a vector database through 600 iterations and 6,000 tool calls, reaching 21,500 queries per second — six times the result achievable in a single 50-turn session. Atlas Cloud's pay-as-you-go pricing makes it practical to run these extended sessions without pre-purchasing capacity.
개발 팀은 GLM-5.1을 사용하여 사람의 검토 지점 없이 몇 시간에 걸친 전체 코드베이스 변환을 실행합니다. 이 모델은 최대 8시간 동안 지속적으로 변경 사항을 계획, 작성, 테스트 및 반복하며, 시연된 처음부터 구축하는 Linux 시스템 빌드에서 655번의 반복을 처리했습니다. 이는 대규모 레거시 코드베이스에서 몇 주 동안 수작업으로 진행되던 리팩토링 작업을 대체합니다.
개발자 도구 팀은 Claude Code, Kilo Code, Cline, Roo Code 및 OpenCode의 AI 코딩 워크플로를 위한 기본 모델로 GLM-5.1 및 GLM-5 Turbo를 통합합니다. Atlas Cloud의 Z-AI API는 OpenAI와 호환되므로, 이러한 도구 중 하나를 GLM을 통해 라우팅하는 데 필요한 변경 사항은 base URL 교체뿐입니다. GLM-5 Turbo의 262K 컨텍스트 창은 IDE 워크플로의 대용량 파일 컨텍스트에 특히 적합합니다.
운영 팀은 GLM-5를 사용하여 티켓 데이터베이스 액세스, 지식 기반 검색 및 에스컬레이션 도구를 결합하여 사람의 개입 없이 반복적인 쿼리를 처리하는 지원 에이전트를 구축합니다. 모델의 다중 도구 호출 및 스트리밍 지원은 실시간 고객 대면 배포에 실용적입니다. 이중 언어 지원을 통해 동일한 에이전트가 Atlas Cloud의 단일 모델 엔드포인트에서 중국어 및 영어 티켓을 처리할 수 있습니다.
콘텐츠 및 비즈니스 팀은 구조화된 프롬프트를 사용하여 중국어와 영어로 된 Word 문서, PowerPoint 프레젠테이션, PDF 및 Excel 보고서를 생성하기 위해 GLM-4.7을 사용합니다. 100만 입력 토큰당 0.52달러인 이 모델은 최첨단 수준의 추론이 필요하지 않은 대용량 문서 워크플로우에 가장 비용 효율적인 GLM 티어입니다. 202K의 컨텍스트 창은 단일 호출로 전체 문서 개요와 원본 자료를 유지하기에 충분합니다.
AI 인프라 팀은 GLM-5.1을 사용하여 기계 학습 워크로드에서 벤치마크 기반 최적화 파이프라인을 실행합니다. KernelBench 스타일의 작업에서 GLM-5.1은 수천 번의 도구 기반 최적화 주기를 수행하여 3.6배의 기하 평균 속도 향상을 달성합니다. 8시간 연속 실행 기능은 에이전트가 세션 간에 수동으로 재시작할 필요 없이 전체 최적화 루프를 실행함을 의미합니다.
Z.ai API는 개발자가 Z.ai(일명 Zhipu AI)가 구축한 GLM 시리즈 대규모 언어 모델에 프로그래밍 방식으로 접근할 수 있게 해줍니다. GLM은 General Language Model의 약자로, GLM-4.6부터 플래그십 GLM-5.1까지의 릴리스를 아우르며 코딩, 에이전트형 워크플로, 중국어와 영어 이중 언어 프로덕션 사용에 맞게 튜닝되어 있습니다. Atlas Cloud에서는 하나의 OpenAI-compatible endpoint를 통해 전체 라인업에 접근할 수 있습니다.
Atlas Cloud는 GLM-4.6부터 플래그십 GLM-5.1까지의 GLM 시리즈를 제공하며, 그 사이에 GLM-4.7과 GLM-5가 포함됩니다. 더 가벼운 티어는 대량의 일상 작업을 더 낮은 비용으로 처리하고, GLM-5.1은 가장 까다로운 코딩 및 에이전트형 작업을 목표로 합니다. 모든 모델은 동일한 키로 pay-as-you-go 방식으로 실행됩니다.
네. GLM-5.1을 포함한 GLM open weights는 MIT license로 공개되며, 상업적 사용, 파인튜닝, 재배포를 제한 없이 허용합니다. 인프라 운영 부담을 피하고 싶다면, 자체 호스팅 대신 Atlas Cloud에서 API를 통해 동일한 모델을 managed access로 사용할 수 있습니다.
기존 OpenAI SDK가 Atlas Cloud base URL을 바라보도록 설정하고, 키를 지정한 뒤 원하는 GLM 모델 이름을 전달하면 됩니다. Z.ai API는 OpenAI-compatible이므로 대부분의 프로젝트는 base URL과 모델 문자열만 변경해 마이그레이션할 수 있으며, 모델은 Claude Code, Cline, Roo Code 같은 에이전트 도구에 바로 연결됩니다. 지금 바로 구축을 시작하세요.
중국어와 영어 모두 GLM에서 일급으로 지원되며, 각 언어에서 뛰어난 숙련도를 갖도록 학습되었습니다. 어느 언어로 프롬프트를 작성해도 일관된 품질의 결과를 얻을 수 있어, 중국 사용자와 글로벌 사용자를 모두 지원하는 팀이 별도 스택을 유지하지 않고 단일 모델로 운영하기에 적합합니다.
GLM-4.6부터 GLM-5.1까지는 200K token context window를 지원하여, 대규모 코드베이스, 긴 문서, 확장된 에이전트 트레이스를 한 번의 요청에 담을 수 있습니다. 워크플로에서 긴 출력이 생성되더라도 동일한 윈도우가 큰 코드 파일과 다단계 실행 로그를 조기 잘림 없이 처리합니다.
GLM-5.1은 2026년 4월 SWE-Bench Pro에서 58.4점을 기록해 1위를 차지했으며, 실제 코딩 작업을 위한 최상위권 오픈 소스 모델 중 하나로 평가받았습니다. 또한 단일 작업에서 최대 8시간 동안 연속 자율 실행을 지원해, 계획 수립, 반복, 전달을 하나의 루프로 수행할 수 있으므로 Claude Code 같은 환경의 장기 에이전트 워크플로에 적합합니다.
Z.ai API의 모든 GLM 모델은 투명한 pay-as-you-go 가격제로 실행되며, 구독이나 월간 약정 없이 token 단위로 과금됩니다. 입력 token과 출력 token은 별도로 계량되며, GLM-4.7 같은 더 가벼운 티어는 플래그십 GLM-5.1보다 token당 비용이 낮아 예산에 맞춰 모델을 선택할 수 있습니다. 현재 token당 요금은 Atlas Cloud의 각 모델 카드에서 확인하세요.
Atlas Cloud를 최대한 활용할 수 있는 가이드, 튜토리얼, 제품 업데이트.