アイキャッチ画像: Z.aiとGLMモデル:3ヶ日の毎日使用、実際の価格、そして誰に向いているか(そして誰に向いていないか)

Z.aiとGLMモデル:3ヶ日の毎日使用、実際の価格、そして誰に向いているか(そして誰に向いていないか)

公開日:

読了時間: 4 min

テーマ: テクノロジー

著者: Leandro Valencia

#zai#glm#人工知能#開発#技術#コーディング

3ヶ月間のZ.ai/GLMによる実際の開発のための詳細分析。実際の価格、実用的な使用ケース、そして実際に機能する人についての正直な意見。

目次

見てきたテーブル:GLMコーディングプランのプラン

これはZ.aiの開発者向けオファーの核心です。すべてのプランは同じモデルへのアクセスを提供します—制限付きのティアはありません—変わるのはクォータの量だけです。

ライト プロ マックス
基本月額価格 ~$18 USD ~$72–80 USD ~$160–168 USD
5時間ごとのクレジット 2,000 12,000 28,000
週間クレジット 10,000 60,000 140,000
推定トークン/週(GLM-5.3、キャッシュ~95%) 48–97百万 290–580百万 676–1,352百万
含まれるモデル GLM-5.3、GLM-5-Turbo、GLM-4.7 同じ 同じ
含まれるMCP Vision、Web Search、Web Reader、Zread 同じ 同じ
サイクルごとの割引 20%四半期 / 30%年間 同じ 同じ

年間割引でライトは~$12.60/月に下がります。この数字が、他のどのコーディングサブスクリプションとの比較を競合にとって不快なものにします。

価格に関する2つの警告:プロとマックスの金額はソースとプロモーション間で変動しました($72 vs $80、$160 vs $168)、支払い前にページで正確な数字を確認してください。そしてサブスクリプションは購入後は返金されません—ライト月額から始めて、マックス年間から始めないでください。

👉 ここで10%割引でサブスクライブ —割引は最初の支払いにのみ適用され、プラットフォームで有料サブスクリプションを一度もない場合にのみ適用されます。


モデルテーブル:機能とAPI価格

トークン単位で支払うことをサブスクリプションより好む場合、これはカタログです。100万トークンあたりの価格(USD):

テキストモデル

モデル 入力 キャッシュされた入力 出力 用途
GLM-5.3 $1.40 $0.26 $4.40 フラグシップ。複雑なコーディング、長期的なエージェントタスク、セキュリティ。コンテキスト1M、出力最大128K
GLM-5.2 $1.40 $0.26 $4.40 前世代、5.3と同じベース
GLM-5-Turbo $1.20 $0.24 $4.00 高速。自動化と低遅延応答に最適
GLM-4.7 $0.60 $0.11 $2.20 ワーキースホース。中程度のコーディングタスク
GLM-4.7-FlashX $0.07 $0.01 $0.40 高容量:分類、抽出、ルーティング
GLM-4.5-Air $0.20 $0.03 $1.10 軽量、非常に安価
GLM-4.7-Flash 無料 無料 無料 コストなしでのプロトタイプとテスト

ビジョン、画像、オーディオ、ビデオモデル

モデル 価格 用途
GLM-5V-Turbo $1.20 / $4.00 1MTokあたり 高レベルのビジョン:UI、ビデオ、グラフィック分析
GLM-4.6V $0.30 / $0.90 1MTokあたり 標準ビジョン、良いコスト品質比
GLM-OCR $0.03 1MTokあたり スキャンされたドキュメントからのテキスト抽出
GLM-4.6V-Flash 無料 コストなしの基本ビジョン
GLM-Image $0.015 1画像あたり 画像生成
CogVideoX-3 $0.20 1ビデオあたり ビデオ生成
Vidu Q1 / Vidu 2 $0.20–0.40 1ビデオあたり テキスト、画像、または参照からのビデオ
GLM-ASR-2512 ~$0.0024 1分あたり 音声転写
エージェントスライド/ポスター $0.70 1MTokあたり 自動化されたプレゼンテーションとポスター

このテーブルで最も重要なデータ:キャッシュされた入力は通常入力の5分の1のコストです。プロジェクトコンテキストを何度も再送信するエージェントフローでは、この差が月が高価か安価かを決定します。


ほとんどの人が説明しないこと:クレジットの消費方法

ここで人々がイライラしてキャンセルします。プランは**「プロンプト数」では機能しません**。2つの同時制限とモデルごとの乗数で機能します。

2つの制限:

  • 5時間制限。 動的に更新されます:各消費は5時間後にあなたに返されます。
  • 週間制限。 支払い時に開始し、7日ごとにリセットされます。

式: クレジット = (入力トークン × 入力乗数 + キャッシュされたトークン × キャッシュ乗数 + 出力トークン × 出力乗数) / 10,000

乗数:

モデル 入力 キャッシュされた入力 出力
GLM-5.3 6.9 1.7 24
GLM-5-Turbo 5.7 1.5 21
GLM-4.7 4.6 1.2 16
GLM-4.6V(ビジョンMCP) 1.2 0.3 2.7
Web Search / Web Reader / Zread 1.2 呼び出し当たり

3つの実用的な結論を苦労して学びました:

  1. 出力が高価です。 GLM-5.3で入力の6.9に対する出力の24乗数。4万トークンで「声に出して考える」モデルは1日を消費します。そのためreasoning_effort: lowが存在し、期待以上に使用しています。
  2. キャッシュはあなたの予算です。 90.9%と98%のキャッシュヒット率の差は、ライトで週間43百万トークンと105百万トークンの差です。長く一貫したセッションは収益があります。10分ごとに新しいコンテキストを開くとあなたを破滅させます。
  3. オフピーク時間は半額です。 ピーク時間は月~金、14:00–18:00(シンガポール時間、UTC+8)。それ以外—週末全体を含む—は**クレジットの50%**のコストです。アメリカから働いている場合、あなたの日の多くは安価な時間に当たります。おそらくプランの最も宣伝されていない価格の利点です。

ツール:実際にこれを使用できる場所

プランは公式にサポートされているツールに厳密に制限されています。どこでもプラグできるオープンAPIではありません。リスト外で使用すると、残高不足エラーが発生します。

サポートされているコードエージェント: ZCode(Z.ai独自の環境)、Claude Code、Claude for IDE、Codex、Cursor、Cline、OpenCode、Roo Code、Kilo Code、Crush、Goose、Droid、TRAE、Qoder、PiとEigent。

汎用エージェント: OpenClaw、Hermes AgentとSillyTavern、「ベストエフォート」で提供—高負荷下では一時的な制限を適用する場合があります。

設定はbase URLを変更することです:

プロトコル ベースURL
Anthropic Messages(Claude Code、Goose) https://api.z.ai/api/anthropic
OpenAI Chat Completions(残り) https://api.z.ai/api/coding/paas/v4
OpenAI Responses https://api.z.ai/api/v1

そしてクレジット以外のコストで含まれる4つのMCP:Vision Understanding(スクリーンショット、ダイアグラム、モックアップの読み取り)、Web SearchWeb Reader(URLからのコンテンツ抽出)、Zread(GitHubリポジトリの読み取り)。後者は知らないライブラリを統合する際に、思った以上に便利です。


使用ケース:どのモデルがどのタスクに適しているか

これは、サブスクリプションを最大限に活用する人と無駄にする人を分ける部分です。

GLM-5.3 → 重くて長い作業。 15個のファイルを触るリファクタ、移行、何時間も追いかけているバグのデバッグ、仕様の完全実装。このバージョンのジャンプはここで顕著です:内部ベンチマークでGLM-5.2に対して23.4%から34.5%の完了タスクに向上し、より少ない出力トークンを消費しました。Terminal-Bench 3.0では4.6から28.3にジャンプしました。reasoning_effort: maxで使用し、些細なことには使用しないでください。

GLM-5-Turbo → 自動化と遅延。 cron、webhook、またはパイプラインで実行されるすべてのもの。ここでは深い思考は必要ありません、一貫性のある高速応答が必要です。ユーザーが待っているチャットボットでも私のデフォルトの選択です。

GLM-4.7 → 日常作業。 エンドポイントの作成、テストの調整、書いていないファイルの説明、移行スクリプトの生成。GLM-5.3の24に対する出力の16乗数:はるかに多く収益があり、60%のタスクでは品質の差は気になりません。

GLM-4.7-FlashX / GLM-4.5-Air → 容量。 チケットの分類、テキストフィールドの抽出、エージェント間のルーティング、要約。100万トークンあたり$0.07で、FlashXはバッチ処理に実質的に無料です。

GLM-4.6V / GLM-5V-Turbo → ビジョン。 UIバグのスクリーンショット、写真のアーキテクチャダイアグラム、PDFのテーブルを渡す。プランに統合されたビジョンMCPは、コーディングフローの中で特に快適です。

チャットボットについての注意:実際のユーザーとの対話型コミュニケーションを構築している場合、GLM-5-Turbo + Web Search MCPの組み合わせは、価格が示唆する以上に自然な体験を提供します。最も価値がありながら最も話題にのぼらない使用法の一つです。


私の実際の経験:3ヶ月、具体的なフロー

私の働き方はこれであり、なぜうまく機能するのかを説明していると思います:

別のモデルで仕様を定義します。 問題思考の部分にGrok、GPT、またはClaudeを使用:アーキテクチャ、トレードオフ、承認基準、触れるファイル。その会話は探求的で反復的であり、コストに関係なく最高の思考が必要ですなぜなら少ないトークンだからです。

GLMで仕様を実行します。 仕様が書かれ、明確になったらGLM-5.3が実装します。そしてこれが重要です:明確に定義された仕様を実行することは設計するのとは異なる問題です。指示に従い、コンテキストを維持し、創作せず、ツールを正しく使用する必要があります。GLMはこれが非常に得意であり、そこで価格があなたの有利に意味を失います。

明確に言っておきます、クレジットはライトで一日中コーディングするには不十分です。あなたの仕事が8時間のエージェントによるコード生成なら、5時間制限にぶつかります。しかし私のパターン—人間のレビューと交互に実行の爆発—には十分です。オフピーク時間の50%割引は私の有効なマージンを2倍にします。

アプリとチャットも重要です。 IDEの外では、深い思考を必要としないタスクにZ.aiのアプリを使用:テーマのレビュー、ドキュメンテーションの要約、高速な確認、反復的なプロセス。これに対してSonnetを開くと比較して、はるかにコスト効率的で十分に良いです。魔法がそこにあるわけではありませんが、そこに蓄積された節約があります。


正直な真実:これが向いていない人

3ヶ月後で明確なことが一つあるとすれば、これは入門ツールではないということです。

これがあなたに向いていない場合:

  • プログラミングを学んでおり、モデルがステップバイステップでガイドし、あなたの仮定を修正し、何が間違っているかを説明してほしい場合。GLMは非常にうまく実行します; poorly thought-out specからあなたを救うことはありません。漠然とした指示を与えると、大きな自信で漠然とした仕事を返します。
  • 設定なしで「オールインワン」体験をしたい場合。ここではbase URL、プロトコル、クォータ制限、乗数、スケジュールを理解する必要があります。難しいわけではありませんが、実際の摩擦です。
  • 絶対的な能力の天井が必要な場合。Z.aiの独自ベンチマークでは、GLM-5.3は34.5%に達し、Claude Fable 5は39.5%に達します。ギャップは存在し、フロンティアタスクで感じられます。
  • 返金保証が必要な場合。それはない。ポイントです。

これがあなたに向いている場合: すでに問題を定義する方法を知り、エージェントが生成したものをレビューする基準を持っており、あなたのボトルネックは多くを実行するコストであり、フロンティアでの思考の品質ではない場合。

支払い前に考慮すべき他の2つのこと: Z.aiは中国の会社(Zhipu AI)であり、あなたのプロンプトはそのインフラを通過します—厳しいNDA下のコードや規制されたデータを扱う場合、責任者と確認してください。そしてプランはサポートされているツールに結びついています:あなたのスタックがリスト外の何かを使用している場合、サブスクリプションは機能せず、トークン単位の有料APIに行く必要があります。


招待コード:各人が得るもの、飾り気なし

共有するつもりなので、単にリンクを投げるのではなく、プランがどう機能するかを正確に説明したいと思います。

あなたが得るもの(ゲスト):

  • 最初のGLMコーディングプランサブスクリプションの金額に対する10%の即時割引。チェックアウトで自動的に適用され、コードを書く必要はありません。
  • あなたが新しいユーザーであるか、プラットフォームで有料サブスクリプションを一度もない場合にのみ適用されます。
  • 最初の注文にのみ適用されます。更新、アップグレード、ダウングレードは適用されません。
  • その他の最初の購入割引キャンペーンと累積しません。
  • リンクで登録から72時間以内に支払いを完了する必要があります。

私が得るもの(招待者):

  • あなたが実際に支払った金額の**10%**相当のプラットフォームクレジット。現金ではありません:Z.ai内のサブスクリプション、パッケージ、またはAPI呼び出しにのみ使用できるクレジットです。現金化や移行はできません。
  • そしてしきい値があります:3人の有効なゲストを累積するまで何も請求しません。その前では、クレジットは保留状態です。

インセンティブがレビューの読み方を変えるので、あなたが知って自分で決めることを好むと言っています。

👉 10%割引付きリンク (コード: V2TH8OSBEF)

使用する前:ライト月額プランは割引適用で~$18です。あなたの実際のフローで1ヶ月試してください。30日後に5時間制限に達せず、モデルが必要なことをした場合、では年間プランを30%オフで評価してください。その逆ではありません。


結論

Z.aiは「安価なClaude」ではありません。異なるプロファイルのツールです:明確に定義された作業を実行するのに優れ、どれだけ自動化できるかという方程式を変える価格です。あなたのフローが思考と実行を分離している場合—一つのモデルで仕様を定義、別のモデルで実行—ほぼ完璧に適合します。一つのモデルですべてを期待すると、イライラします。

3ヶ月後の私の結論は簡単です:支払っている以上の価値を感じています。しかしそのフレーズは、あなたがすでに何を求めているかを知っている場合にのみ適用されます。


出典

開示:この記事には招待リンクが含まれています。私があなたを通じてサブスクライブすると、プラットフォームクレジットを受け取ります。技術的および価格データはZ.aiの公式ドキュメントからのものであり、2026年8月に検証されました;支払い前に現在の金額を確認してください。

関連記事

興味を持ちそうな関連コンテンツを探し続けましょう

Z.aiとGLMモデル:3ヶ日の毎日使用、実際の価格、そして誰に向いているか(そして誰に向いていないか)