1. SIMY
  2. ガイド
  3. GLM(Z.ai)ガイド

GLM(Z.ai)ユーザーのための活用ガイド

GLMが書いたあと、 決まったことを 止めない。

GLMは、Claude Codeからでも安く速くコードと文章を書いてくれる。でも会議で決まった担当や期限、関係者への連絡は、まだあなたの手元に残る。その先をSIMYが進めます。

  • GLMは、得意な仕事にそのまま
  • SIMYは会議とチャットから拾う
  • お使いのChatGPT(Codex)で動く

※ 画面は説明用のイメージです

目次
  1. 書いたあと、こうなっていませんか
  2. 本当は、こうしたかった
  3. GLMはここで止まる
  4. SIMYがつなぐ
  5. 会議1件で比較
  6. 業種別:GLMの使い方とSIMYが出すもの
  7. はじめ方:3ステップ
  8. GLMとは・Coding Plan・Claude Code・安全性
  9. よくある質問
  10. 参考情報
01 / AFTER THE CODE

GLMで書いたあと、こうなっていませんか

コードも説明文も、GLMで一気に書けた。それでも、そのあとに起きていること。

Coding Planで書いた月 PRは出た、次は?

実装は早く終わった。レビュー会議で決まった修正の担当は、誰も書いていない。

安いAPIで回した週 どれを採用した?

案は大量に出た。決まったことは、チャットとターミナルの履歴に埋もれる。

手元のPCで動かした日 自分だけ速い

社外に出さずに要約できた。会議で決まった依頼は、自分のメモ止まり。

書くのは、GLMで一瞬で終わる。仕事が進むかどうかは、書いたあとで決まっています。

02 / WHAT YOU REALLY WANTED

本当は、こうしたかった:GLMで書いたあと

同じ会議。同じGLM。コードが書けた瞬間に、こうなっていてほしかった。

会議が終わったら 担当と期限が一覧に

実装と説明文はGLMのまま。決まった修正と担当・期限は、もう並んでいる。

期限の前に 止まった仕事が届く

返事待ち・期限間近の仕事を、次の会議の前にSIMYが先に知らせてくれる。

どのモデルで書いても 結論は一か所に

採用した方針と次の行動が、モデルやツールをまたいで1つに残っている。

あなたに戻るのは 判断だけ

「今週リリースするか」。戻ってくるのはその一問だけ。

これは、SIMYに会議とチャットをつないだ次の会議から起きることです。GLMは、得意な仕事にそのまま使えます。

03 / WHERE GLM STOPS

GLMの仕事は、ここで止まる

GLMが得意なのは「頼まれたものを書く」まで。その先は、誰も拾っていません。

※ 流れは説明用のイメージです

chat.z.aiでも、Claude Code経由でも、ローカルでも、同じところで止まります。コードは何度でも書ける。でも「頼む」のは毎回あなたで、終わったかを見に行くのもあなたです。

04 / CONNECT

SIMYがつなぐ。GLMはそのまま、書いたあとを任せる

空白だった4つを、SIMYが埋めます。あなたに戻るのは、判断の1マスだけ。

※ 流れは説明用のイメージです

  • 会議・チャットから拾う
  • あなたのやり方で
  • 判断だけ返す

SIMYは、会議の記録やチャットから「そのあとの仕事」を自分で見つけます。あなたが繰り返している手順と確認事項を会話から学び、同じやり方で進め、終わったかをMy Actionsに並べます。

  1. SIMYに登録し、ChatGPT(Codex)を接続するSIMYのクラウド実行は、お使いのChatGPTアカウントで動きます。Codexの利用は、お使いのChatGPTプランの範囲です。
  2. SIMYデスクトップアプリを入れるPC上のClaude Codeを、SIMYの実行役にできます。Claude CodeやCodexの会話から、繰り返している仕事を「SIMYからの提案」にします。会話本文はサーバーに保存しません。 ダウンロードはこちら
  3. 会議の記録をつなぐ連携画面でPlaudやNotionなどを接続します。GLMで書いた要約やPRの説明も、会議やチャットに貼ればSIMYが拾います。

※ SIMYの画面のイメージです

SIMYとGLMの関係:SIMYは現時点ではGLM(Z.ai)には接続しません。SIMY自身は、お使いのChatGPT(Codex)アカウントと、PC上のClaude Codeで動きます。実装・下書き・要約はGLMの得意な仕事としてそのまま使い、その結果を会議やチャットに持ち込めば、そのあとをSIMYが進めます。

05 / SAMPLE

会議1件で比較:GLMの要約と、SIMYが仕上げる次の一手

決済APIの設計レビュー(約50分)の議事メモを、GLMで要約した場合のサンプルです。左がGLM、右がSIMY。

GLMの要約(例)議事メモ → 3行
概要
決済APIのタイムアウトを30秒から10秒に短くし、リトライ処理を加える。
影響
取引先A社の夜間バッチ連携に影響が出る可能性がある。
宿題
リトライ処理の実装、負荷試験、A社への事前連絡。
予定
リリース候補は10月9日。負荷試験の結果を見て最終判断。
決まった修正と担当の一覧完了

リトライ処理:田中・10/6。負荷試験:QA・10/8。A社への事前連絡:あなた・10/7。

取引先への連絡の下書きAutorun

A社のご担当者へ、タイムアウト変更の予定と影響、検証環境を使える日を、あなたのいつもの文面で。Gmailに下書きとして保存。

QAチームへの共有次

「10/9リリース候補です。負荷試験を10/8までにお願いします」。承認したらチャットに投稿。

あなたの判断あなたの番

負荷試験の結果を見て、今週リリースするか、1週延ばすか。判断が必要なところだけが、あなたに戻ってきます。

GLMが書き、SIMYが動かす。リリースの判断は、あなたのままです。

06 / BY INDUSTRY

業種別:GLMの使い方と、SIMYが出すもの

GLMで書いたあと、SIMYが何を用意するか。個人でもチームでも、型は同じです。

開発チーム GLM:Coding Plan・Claude Code

  • 設計レビューの会議→決まった修正と担当の一覧
  • コードを書いたあと→PCのClaude Codeで次の作業
  • 週の終わり→進捗と判断待ちのまとめ

受託開発・SIer GLM:安いAPIで試作

  • 顧客との定例→宿題と期限の一覧・返信の下書き
  • 仕様の変更→社内共有の文面・判断の1問
  • 納期の前→返事待ちの仕事のリマインド

データ分析・研究 GLM:分析コードと資料の要約

  • 分析の報告会→追加分析の担当と締め切り
  • レビューの指摘→修正点をまとめた依頼文
  • 報告の前→確認待ちの一覧と判断の1問

経営会議・1on1 GLM:資料の要約・論点整理

  • 経営会議→決定事項と担当者の一覧・関係者への共有
  • 1on1→「あれどうなった」を聞く前に、進捗と判断待ち
  • 週の終わり→複数の会議をまとめた週次報告
07 / START

はじめ方:GLMはそのまま、3ステップ

  1. GLMは、いつもどおり使う実装、修正、要約、下書き。chat.z.aiでも、Coding Planでも、ローカルでも構いません。
  2. SIMYに登録し、ChatGPTを接続するクラウド実行はお使いのChatGPT(Codex)。つなぎ方は上のとおりです。Claude Codeを使っている人は、SIMYデスクトップアプリも。 ダウンロードはこちら
  3. 会議を1件、終える担当と期限、連絡の下書き、共有の文面が届きます。決めて、送る。それだけです。

登録の流れ:プランを選ぶ → メールで本人確認 → カードで決済(無料プランはありません)。料金を見る/PCで使うアプリはダウンロードページから。

GLMの使い方は変わりません。SIMYはGLMを置き換えるものではなく、書いたあとの仕事を受け持つ別の仕組みです。

08 / REFERENCE

GLMとは:モデル・GLM Coding Plan・Claude Code・API・安全性(詳しく知りたい人向け)

ここから下は、GLM本体のことを確かめたいときに開いてください。モデル名・料金・仕様は2026年10月時点の情報です。

GLMとは:どこの国のAIか、ほかの「GLM」との違いZhipu AI(智譜)のLLM。海外向けの名前がZ.ai

GLMとZ.ai、Zhipuの関係

GLMは、中国・北京のZhipu AI(智譜)が開発する大規模言語モデル(LLM)のシリーズです。中国国内向けのサービスはZhipuが運営し、海外向けには「Z.ai」の名前で、チャット(chat.z.ai)、API、コーディング向けの定額プランを提供しています。海外向けのZ.aiを運営するのは、シンガポールの法人(JINGSHENG HENGXING TECHNOLOGY PTE. LTD.)です。

Hugging Faceでは「zai-org」という組織名でモデルを公開しています。ニュースや記事では「Zhipu」「智譜」「Z.ai」「GLM」が混ざって使われますが、指しているのは同じ会社のモデルとサービスです。

ほかの「GLM」との違い

「GLM」という略語は、AIのモデル以外でも使われます。検索するときは、次のどれを探しているかで言葉を足すと見つけやすくなります。

  • 一般化線形モデル(Generalized Linear Model):統計学の手法の名前です。ロジスティック回帰やポアソン回帰をまとめた考え方で、RやPythonの統計の解説でよく出てきます。このページのGLMとは無関係です。
  • 自動車の分野のGLM:自動車の会社名や型式の略称として使われることがあります。こちらも、このページのGLMとは別のものです。
  • AIのGLM:Zhipu AIのモデル名です。「GLM-5.3」「GLM-4.7-Flash」のように、世代番号や「Flash」などの種類がつきます。

GLMでできること

  • チャット:質問への回答、文章の作成、翻訳、要約。
  • コーディング:Claude CodeやCline、OpenCodeなどのツールから呼び出して、コードを書く・直す・説明する。
  • 画像の理解・文字の読み取り:GLM-5.3-Flashは画像も入力できるマルチモーダルのモデルです。書類の文字を読み取るGLM-OCRもあります。

主力に近いモデルの重みを公開していて、条件を満たせば自分のサーバーやPCで動かせることが、ChatGPTやClaudeの主力モデルとの違いです。

主なモデル:GLM-5.3・5.3-Flash・5.2・4.7-Flash2026年10月時点。名前と世代は数か月ごとに変わる

表は横にスクロールできます →

モデル役割使える場所
GLM-5.32026年8月末公開の主力。753B、100万トークンの長い文脈。独自ライセンスAPI、Coding Plan、オープンウェイト(大規模サーバー向け)
GLM-5.3-Flash速さと安さ重視。321B(推論時に動くのは約18B)、画像も入力できる。MITライセンスAPI、Coding Plan、オープンウェイト(大規模サーバー向け)
GLM-5.2ひとつ前の世代。APIの料金表にGLM-5.3と同じ単価で載っているAPI(Coding PlanではGLM-5.3に振り替え)
GLM-4.7-Flash30B級の小型モデル。量子化版で約19GBで、手元のPCで動かせる。APIは無料API(無料)、Ollamaでローカル実行
GLM-OCR書類や画像から文字を読み取る公式ドキュメントで確認

「GLM-5.2」で探している人へ:2026年10月時点の主力はGLM-5.3です。GLM-5.2はAPIで引き続き指定できますが、GLM Coding PlanでGLM-5.2を指定するとGLM-5.3に振り替えられます。古い記事の手順は、モデル名をGLM-5.3に読み替えて公式ドキュメントで確かめてください。

モデル名はすぐに変わるので、「主力」「速さ重視のFlash」「手元で動く小型」という役割で覚えておけば足ります。

GLM Coding Plan:コーディングツールから定額で使うLiteは月18米ドル(2026年10月時点・公式)

GLM Coding Planは、Claude Code、Cline、OpenCodeなどのコーディングツールからGLMを定額で使うためのプランです。トークンごとに支払うAPIと違い、月額の範囲で使えるので、毎日コードを書く人は費用の見通しが立てやすくなります。

  • Lite:月18米ドル(2026年10月時点、公式ページの表示。税の扱いは購入画面で確認してください)。
  • 上位プラン:使える量の多いプランがあります。内容と価格は公式の説明と購入ページで確認してください。
  • 使える量:5時間ごとと週ごとに、プランに応じた利用枠(クレジット)があります。
  • 使えるモデル:GLM-5.3とGLM-5.3-Flash。GLM-5.2を指定するとGLM-5.3に、GLM-4.7を指定するとGLM-5.3-Flashに振り替えられます。
  • 使えるツール:Claude Code、Cline、OpenCodeなど、接続先を差し替えられるコーディングツール。

APIの従量課金と、どちらを選ぶか

  • Coding Planが向いている:毎日コーディングツールを使う個人の開発者。月の支出を一定にしたい人。
  • APIが向いている:自社のシステムに組み込む、夜間にまとめて処理する、使う量が月によって大きく変わる場合。

どちらも、書いたコードのあとの「誰がレビューするか」「いつ出すか」は受け持ちません。そこを毎回自分で追っているなら、SIMYのつなぎ方を見てください。

Claude CodeでGLMを使う:Anthropic互換API接続先とAPIキーを環境変数で差し替える

Z.aiはAnthropic互換のAPI(https://api.z.ai/api/anthropic)を用意しています。Claude Codeは接続先を環境変数で変えられるので、Claude Codeの使い方はそのままに、裏で動くモデルをGLMにできます。

  1. Z.aiでAPIキーを発行する。Coding Planを使う場合は、プランに入ってからキーを作ります。
  2. 環境変数を設定する。ANTHROPIC_BASE_URLに上のURLを、ANTHROPIC_AUTH_TOKENにAPIキーを入れます。キーはコードや共有ドキュメントに直接書かないでください。
  3. Claude Codeを起動する。公式の案内では、Claude CodeのOpus・Sonnet相当の呼び出しがGLM-5.3に、Haiku相当がGLM-5.3-Flashに対応します。対応は環境変数で変えられます。
  4. 小さな作業で試す。モデルが変わると、得意な書き方や指示の通り方も変わります。最初はテストの修正などの小さな作業から始めると安心です。

細かい設定値は変わることがあるので、Z.aiの公式手順に従ってください。ClineやOpenCodeでも、同じように接続先とキーを設定して使えます。

SIMYとの関係:SIMYは現時点ではGLM(Z.ai)のAPIキーを接続しません。SIMYのクラウド実行は、お使いのChatGPT(Codex)アカウントで動きます。

GLMのAPI:料金と使い始め方100万トークンあたりの米ドル建て。小型のFlashは無料

表は横にスクロールできます →

モデル入力キャッシュ入力出力
GLM-5.31.40ドル0.26ドル4.40ドル
GLM-5.3-Flash0.15ドル0.03ドル0.50ドル
GLM-4.7-Flash・GLM-4.5-Flash無料

100万トークンあたり・米ドル。2026年10月時点でZ.aiの公式料金ページに掲載されている金額です。税の扱いと最新の金額は公式ページで確認してください。

APIを使い始める手順

  1. Z.aiのアカウントを作る。海外向けの窓口はシンガポールの法人です。利用規約とプライバシーポリシーを先に読んでおきます。
  2. APIキーを発行する。キーは環境変数に入れて管理します。
  3. OpenAI互換かAnthropic互換の接続先に向ける。既存のSDKやツールなら、接続先のURLとモデル名を差し替えて呼び出せます。
  4. 無料のFlashで試してから広げる。GLM-4.7-Flashで流れを確かめ、品質が必要なところだけGLM-5.3に切り替えると、費用を抑えられます。
ライセンスとローカル実行:OllamaでGLM-4.7-FlashMITのFlashと、独自ライセンスのGLM-5.3

ライセンスの違い

「GLMはオープンソース」と一括りにはできません。GLM-5.3-Flashは、商用利用もしやすいMITライセンスです。GLM-5.3は独自の「GLM-5.3 License」で、MITに近い自由な許諾ですが、モデルをAPIとして提供する事業で売上がとても大きい事業者は、商用利用の前にZ.AIのセキュリティ審査を受ける条件があります。ふつうの会社が社内で使う分には影響しないことが多いものの、業務で使う前にライセンス本文を確認してください。

手元のPCで動かす

  • GLM-4.7-Flash:Ollamaでollama run glm-4.7-flash。量子化版(q4_K_M)で約19GBあり、メモリに余裕のあるPCで動きます。
  • GLM-5.3・GLM-5.3-Flash:Ollamaの公式ライブラリでは「cloud」タグだけです。これはOllamaのクラウドで動く版で、手元のPCで動くわけではありません。
  • 自社のサーバーで動かす:GLM-5.3の重みはHugging Faceで公開されていますが、数百Bの大きさなので、複数の大型GPUを前提に考える必要があります。

「ローカル=外に出ない」の注意:データを社外に出さないことが目的なら、cloudタグのモデルは当てはまりません。手元で動くのはGLM-4.7-Flashのような小型のモデルです。

ローカル実行が向いている仕事

社外に出したくない文書の要約、オフラインでの作業、毎日大量に回す定型の下書きは、ローカル実行の得意分野です。小型のモデルは大きなモデルほど賢くはないため、最終版ではなく「たたき台」を作る役として使うと、期待とのずれが少なくなります。

GLMの日本語:どこまで使えるか日本語で頼めるが、公式に書かれた言語は英語と中国語

GLMに日本語で質問すれば、日本語で答えます。ただし、Hugging Faceの公式モデルカードに書かれている言語は英語と中国語だけで、日本語の品質を公式に保証しているわけではありません。

  • 向いていること:コードの生成と修正、英語や中国語の資料の要約、技術的な説明の下書き。
  • 確かめたいこと:敬語の使い分け、日本の固有名詞、日本の法令や商習慣の記述。社外に出す日本語の文面は、必ず読み直してください。
  • 小さなモデルの場合:ローカルで動かす小型のモデルは、長い日本語で言い回しが不自然になることがあります。

日本語の品質は、実際の業務の文書で数件試して確かめるのがいちばん確実です。

データの扱いと安全性:保存先・契約・公的な措置海外向けZ.aiはシンガポール法人。開発元は米国のエンティティリストに掲載

表は横にスクロールできます →

使い方データの処理場所契約・学習の扱い向いている用途
chat.z.ai・海外向けサービス原則としてシンガポールで処理すると案内チャット入力を学習に使うかは、ポリシーに明記がない公開情報の調べもの、試用
API・Coding PlanZ.ai(シンガポール法人)が処理。詳細はデータ処理契約で確認API利用者には別のデータ処理契約(DPA)が適用され、Z.aiはデータ処理者開発、業務システムへの組み込み
ローカル実行自分のPCやサーバーの中だけ外に出ない社外秘の文書、オフラインでの作業

公的な措置について

米国商務省産業安全保障局(BIS)は2025年1月16日、Zhipu AI(北京智譜華章科技)と関連会社をエンティティリストに追加しました。米国の輸出管理規則の対象となる製品や技術をこれらの会社へ輸出するには、許可が必要になる措置です。業務で使ってよいかは、所属先や取引先のルールに沿って判断してください。

  • 社内ルールを先に確認する:生成AIの利用ルールで、使えるサービスや入力してよい情報が決まっている会社もあります。
  • 機密は入れない、が基本:どのAIでも、顧客情報や未公開の数字は入力前に考えてください。
  • 外に出したくないならローカル:データを社外に出さずに使いたい場合は、手元で動くモデルを選びます。

データの扱いは、2026年10月1日時点のZ.aiのプライバシーポリシーの記載に基づきます。SIMYでのデータの取り扱いは、セキュリティとプライバシーポリシーで公開しています。

Kimi・DeepSeek・Qwen・Doubaoとの違いどれが良い悪いではなく、入口とライセンスが違う

表は横にスクロールできます →

比較項目GLM(Z.ai)KimiDeepSeekQwenSIMY
開発元Zhipu AI(北京)Moonshot AI(北京)DeepSeek(杭州)Alibabaグループ(杭州)AwakApp Inc.
Claude Codeから使うAnthropic互換APIありAnthropic互換APIありAnthropic互換APIありCoding Plan経由PCのClaude Codeを実行役にできる
コーディングの定額GLM Coding PlanKimi Code+会員なしCoding Plan—
手元のPCで動く版GLM-4.7-Flash(約19GB)なし(cloudのみ)旧世代の小型版Qwen3.8-27B(約18GB)—
起点あなたが頼むあなたが頼むあなたが頼むあなたが頼む会議・チャットから、SIMYが拾う

ByteDanceのDoubao(豆包)は、主力のSeedモデルの重みを公開しておらず、APIも中国向けのVolcano Engineと海外向けのBytePlusに分かれています。詳しくはDoubao(豆包)ガイドをご覧ください。

使い分け:コードや下書きを書くのは、GLMを含むどのAIでも構いません。そのあとの担当、期限、連絡、共有を毎回自分で追っているなら、SIMYの出番です。各社の比較は中国発のLLMの比較、個別にはKimiのガイド・DeepSeekのガイド・Qwenのガイド・MiniMaxのガイドにまとめています。

09 / FAQ

よくある質問

GLMとは何ですか?

GLMは、中国のZhipu AI(智譜)が開発する大規模言語モデル(LLM)のシリーズです。海外向けにはZ.aiの名前で、チャット、API、コーディング向けの定額プランを提供しています。統計の「一般化線形モデル」もGLMと略されますが、別のものです。

GLM(Z.ai)はどこの国のAIですか?

開発元のZhipu AIは中国・北京の会社です。海外向けのZ.aiはシンガポールの法人が運営し、個人データは原則としてシンガポールで処理するとプライバシーポリシーで案内されています。

GLMの最新モデルは何ですか?

2026年10月時点の主力は、GLM-5.3と、軽くて速いGLM-5.3-Flashです。モデル名は数か月ごとに変わるので、公式の一覧で確認してください。

GLM-5.2はまだ使えますか?

使えます。2026年10月時点で、Z.aiのAPI料金表にGLM-5.2がGLM-5.3と同じ単価で載っています。GLM Coding PlanでGLM-5.2を指定すると、GLM-5.3に振り替えられます。

GLM Coding Planとは何ですか?

Claude CodeやCline、OpenCodeなどのコーディングツールからGLMを月額の定額で使うプランです。2026年10月時点で、いちばん小さいLiteは月18米ドルと公式ページに掲載されています。上位のProとMaxの価格は公式ページで確認してください。

Claude CodeでGLMは使えますか?

使えます。Z.aiはAnthropic互換のAPIを用意しており、Claude Codeの接続先とAPIキーを環境変数で差し替えると、Claude CodeからGLMを呼び出せます。手順はZ.aiの公式ドキュメントに載っています。

GLMは無料で使えますか?

Webのチャットchat.z.aiで試せます。APIでは、2026年10月時点でGLM-4.7-FlashとGLM-4.5-Flashが無料と公式の料金ページに掲載されています。GLM-5.3などの主力モデルは従量課金です。

GLMはローカル(自分のPC)で動かせますか?

一部のモデルは動かせます。OllamaのGLM-4.7-Flashは、量子化版で約19GBあり、メモリに余裕のあるPCで動きます。GLM-5.3とGLM-5.3-FlashはOllamaではクラウド実行のタグだけで、手元のPCでは動きません。

GLMのライセンスは商用利用できますか?

GLM-5.3-FlashはMITライセンスです。GLM-5.3は独自のライセンスで、基本は自由に使えますが、売上規模の大きいAPI提供事業者には商用利用前の審査の条件があります。業務で使う前に、各モデルのライセンス本文を確認してください。

GLMは日本語に対応していますか?

日本語で質問すれば日本語で答えますが、公式のモデルカードに書かれている言語は英語と中国語です。大事な文面は、実際の業務の文書で品質を確かめてから使ってください。

SIMYはGLMで動きますか?

いいえ、SIMYは現時点ではGLM(Z.ai)には接続しません。SIMYはお使いのChatGPT(Codex)アカウントと、PC上のClaude Codeで動きます。GLMで書いたコードや下書きは、そのまま会議やチャットに持ち込めます。

GLMで書いたあとの仕事は、毎回SIMYに頼む必要がありますか?

いいえ。SIMYは会議の記録やチャットから、決まったことと担当・期限を自分で拾います。あなたのやり方を会話から学び、判断が必要なところだけをあなたに返します。

10 / SOURCES

参考情報

GLMのモデル、料金、ライセンス、データの扱いは、次の公式情報で確認しました(確認日:2026年10月1日)。米国の輸出規制については米国の官報(Federal Register)を参照しました。モデル名と料金は頻繁に変わるため、最新の情報は各公式ページをご確認ください。

GLMで書き終えたら、
そのあとはSIMYへ。

GLMは、得意な仕事にそのまま。会議とチャットから拾った仕事をSIMYが進め、返すのは判断だけ。リリースの判断は、あなたのままです。