
Z.ai APIは、GLM-4.6からフラッグシップのGLM-5.1まで、ZhipuAIのGLMシリーズ全体をあなたのスタックに提供します。GLM-5.1はSWE-Bench Proでオープンソースモデル中1位にランクされ、自律型コーディングエージェントを何時間も連続して実行できます。GLMは202K tokenのコンテキストと、中国語・英語でバランスの取れた出力を、寛容なMIT licenseのもとで提供します。Atlas Cloudは、OpenAI-compatible key 1つで各モデルを提供し、Day-0 accessと透明性の高いper-call pricingに対応します。今すぐ始めましょう。
Atlas Cloud では、業界をリードする大規模言語モデルを高速かつ低コストで提供し、チャット・推論・エージェントを大規模に支えます。
Compare standard vs. our pricing across every Z.ai model.
| Model | Standard Price (USD) | Our Price (USD) | Discount | |
|---|---|---|---|---|
| GLM 5.2 | $1.4/$4.4per 1M tokens1048.6K context | $1.26/$3.96M in/outper 1M tokens1048.6K context | -10% | View |
| GLM 5.1 | $1.4/$4.4per 1M tokens202.8K context | $1.26/$3.96M in/outper 1M tokens202.8K context | -10% | View |
| GLM 5v Turbo | $1.2/$4per 1M tokens202.8K context | $1.2/$4M in/outper 1M tokens202.8K context | — | View |
| GLM 5 | $1/$3.2per 1M tokens202.8K context | $0.95/$3.15M in/outper 1M tokens202.8K context | — | View |
| GLM 4.7 | $0.6/$2.2per 1M tokens202.8K context | $0.52/$1.85M in/outper 1M tokens202.8K context | — | View |
| GLM 4.6 | $0.6/$2.2per 1M tokens202.8K context | $0.6/$2.2M in/outper 1M tokens202.8K context | — | View |
Instantly explore and experiment with 400+ production-ready models in the Atlas Playground. Start customizing with one click.
GLMのモデル階層は、高速なバイリンガルチャットタスクから、数時間におよぶ自律型コーディングエージェントまで、あらゆるものをカバーしています。チームは長期的なエンジニアリング作業にGLM-5.1を使用し、費用対効果と速度が優先される場合にはGLM-4.7またはGLM-5 Turboを使用します。
Engineering teams use GLM-5.1 to run autonomous optimization agents that iterate on production systems over hundreds of rounds. In a documented run, GLM-5.1 improved a vector database through 600 iterations and 6,000 tool calls, reaching 21,500 queries per second — six times the result achievable in a single 50-turn session. Atlas Cloud's pay-as-you-go pricing makes it practical to run these extended sessions without pre-purchasing capacity.
開発チームは GLM-5.1 を使用して、人間のチェックポイントなしで数時間におよぶ完全なコードベースの変換を実行します。このモデルは最大8時間にわたって継続的に変更の計画、記述、テスト、反復を行い、実演されたゼロからの Linux システム構築では655回の反復を処理しました。これにより、大規模なレガシーコードベースにおける数週間分の手動リファクタリング作業が置き換えられます。
開発者ツールチームは、Claude Code、Kilo Code、Cline、Roo Code、OpenCodeにおけるAIコーディングワークフローの基盤モデルとして、GLM-5.1およびGLM-5 Turboを統合しています。Atlas Cloud上のZ-AI APIはOpenAIと互換性があるため、これらのツールをGLM経由でルーティングするために必要な変更はbase URLの置き換えのみです。GLM-5 Turboの262Kコンテキストウィンドウは、IDEワークフローにおける大規模ファイルのコンテキストに特に適しています。
運用チームは GLM-5 を使用してサポートエージェントを構築します。これらのエージェントは、チケットデータベースへのアクセス、ナレッジベースの検索、エスカレーションツールを組み合わせて、人間の介入なしに反復的な問い合わせを処理します。モデルのマルチツール呼び出しとストリーミングのサポートにより、リアルタイムの顧客向け展開に実用的です。バイリンガルサポートにより、同じエージェントが Atlas Cloud 上の単一のモデルエンドポイントから中国語と英語のチケットを処理できます。
コンテンツチームとビジネスチームは、構造化されたプロンプトから中国語と英語の両方でWord文書、PowerPointプレゼンテーション、PDF、Excelレポートを生成するためにGLM-4.7を使用しています。100万入力トークンあたり0.52ドルで、最先端レベルの推論を必要としない大量のドキュメントワークフローにおいて最も費用対効果の高いGLMティアです。202Kのコンテキストウィンドウは、1回の呼び出しでドキュメントの完全なアウトラインとソース資料を保持するのに十分です。
AIインフラストラクチャチームは、GLM-5.1を使用して、機械学習ワークロード上でベンチマーク主導の最適化パイプラインを実行しています。KernelBenchスタイルのタスクにおいて、GLM-5.1はツール主導の最適化サイクルを数千回実行し、幾何平均で3.6倍の高速化を達成します。8時間の連続実行機能により、エージェントはセッション間で手動で再起動することなく、完全な最適化ループを実行できます。
Z.ai API は、Zhipu AI としても知られる Z.ai が構築した GLM シリーズの大規模言語モデルに、開発者がプログラムからアクセスできるようにする API です。GLM は General Language Model の略で、GLM-4.6 からフラッグシップの GLM-5.1 までのリリースを含み、コーディング、エージェント型ワークフロー、中国語と英語のバイリンガルな本番利用向けに調整されています。Atlas Cloud では、OpenAI 互換の単一エンドポイントから全ラインアップを利用できます。
Atlas Cloud では、GLM-4.6 からフラッグシップの GLM-5.1 までの GLM シリーズをホストしており、その間に GLM-4.7 と GLM-5 も含まれます。軽量なティアは、日常的な大量タスクを低コストで処理し、GLM-5.1 は最も要求の厳しいコーディングやエージェント型の作業を対象としています。すべてのモデルは同じキーで従量課金により実行できます。
はい。GLM-5.1 を含む GLM のオープンウェイトは MIT ライセンスで公開されており、商用利用、ファインチューニング、再配布が制限なく許可されています。インフラ運用の手間を避けたい場合は、セルフホスティングの代わりに、Atlas Cloud が同じモデルを API として提供し、マネージドに利用できます。
既存の OpenAI SDK の接続先を Atlas Cloud のベース URL に向け、キーを設定し、使用したい GLM モデル名を渡します。Z.ai API は OpenAI 互換のため、多くのプロジェクトはベース URL とモデル文字列を変更するだけで移行でき、モデルは Claude Code、Cline、Roo Code などのエージェントツールに直接組み込めます。今すぐ構築を始めましょう。
中国語と英語はいずれも GLM にとって第一級の対応言語であり、それぞれで高い能力を発揮するように学習されています。どちらの言語でプロンプトしても一貫した品質の応答が得られるため、中国語圏と海外のユーザーにサービスを提供するチームは、別々のスタックを維持するのではなく、単一のモデルラインアップで実用的に運用できます。
GLM-4.6 から GLM-5.1 までは 200K token のコンテキストウィンドウをサポートしており、大規模なコードベース、長いドキュメント、拡張されたエージェントのトレースを単一リクエスト内に収めるのに十分です。ワークフローで長い出力が発生する場合でも、同じウィンドウで大きなコードファイルや複数ステップの実行ログを早期に切り詰めることなく扱えます。
GLM-5.1 は 2026年4月に SWE-Bench Pro で 58.4 のスコアを獲得して首位となり、実世界のコーディングにおける最も強力なオープンソースモデルの一つに位置付けられました。また、単一タスクで最大 8 時間の継続的な自律実行をサポートし、計画、反復、成果物の作成を 1 つのループで実行できるため、Claude Code のような環境での長期的なエージェントワークフローに適しています。
Z.ai API 上のすべての GLM モデルは、透明性の高い従量課金で利用でき、サブスクリプションや月額契約なしに token 単位で課金されます。入力 token と出力 token は別々に計測され、GLM-4.7 などの軽量ティアはフラッグシップの GLM-5.1 よりも token あたりのコストが低いため、予算に合わせてモデルを選択できます。現在の token あたりの料金は、Atlas Cloud の各モデルカードで確認してください。
Atlas Cloud を最大限に活用するためのガイド、チュートリアル、製品アップデート。