GLM-5.2 は、単発のチャットではなく長時間タスクの完遂とエージェント型コーディングのために作られた、フラッグシップのオープンウェイトGLMモデルです。ファミリーの実用文脈を200,000トークンから実用に耐える100万トークンへ引き上げ、明示的な推論強度を導入し、スパースアテンションのスタックを共有インデクサ中心に再構築したリリースでもあります。クローズドなフロンティアモデルの代替としてオープンウェイトを評価しているチームにとって、彼らが重視する評価で実際に競えるGLMモデルはこれであり、しかも MIT ライセンスでウェイトが公開されています。
前身の GLM-5.1 と比べると、GLM-5.2 は小幅な更新ではありません。Terminal-Bench 2.1 は63.5から81.0へ、DeepSWE は18.0から46.2へ、FrontierSWE Dominance は30.5から74.4へ。いずれもモデル開発元の公表値であり、当サイトで測定したものではありません。実務上の意味は、コーディングエージェントがリポジトリ全体、そのテスト出力、これまでの自身の試行を1つの軌跡の中に保持でき、検索層を介して断片を読み直さずに済むということです。
登録もアカウントもクレジットも不要。プロンプトを入力すれば、その場で回答がストリーミングされます。
ここに回答がストリーミングされます...
このプレイグラウンドは OpenRouter 経由で無料のオープンソースLLMを実行しています。GLM-5.2 ではなく、GLMのウェイトも使用していません。以下に掲載したGLMの公表ベンチマークを読みながら、稼働中のモデルを実際に試せるように用意したものです。
百万トークンの文脈は、貼り付けられる量が増えるだけでなく、作れるものそのものを変えます。検索パイプラインが小さく欠落の多い断片を渡すのではなく、リポジトリ全体、完全なAPIリファレンス、数日分のログを1つのプロンプトに読み込み、モデルにそのすべてを横断して推論させられます。ファイル間の依存関係やシステム全体の不具合が見えるようになるのはこのためです。サービス境界とマイグレーションとテストフィクスチャが同時に視界に入って初めて現れるバグ、といった類のものです。GLM-5.2 は、大規模実装・自動リサーチ・性能最適化・複雑なデバッグを含む長文脈のコーディングエージェント軌跡で学習されており、モデル開発元がこのウィンドウを「受け付ける」だけでなく「実用に耐える」と表現するのはそのためです。実行が混沌としてきても品質が落ちず、文脈の奥まで保たれることが意図されています。
スコアはモデル開発元の公表値です。
公表された GLM-5.2 の列は、まさに設計意図どおりエージェント型コーディングと長時間の実行で最も強くなっています。Terminal-Bench 2.1 は Terminus-2 ハーネスで81.0、Claude Code では82.7、MCP-Atlas の公開セットで76.8、個々のタスクが最長20時間に及ぶ FrontierSWE Dominance で74.4。純粋な推論では AIME 2026 で99.2、GPQA-Diamond で91.2 を報告しています。3つの長時間評価すべて(FrontierSWE、PostTrainBench、SWE-Marathon)において、公表された比較対象の中でオープンソース首位です。
SWE-bench Pro での比較。モデル開発元の公表値です。
SWE-bench Pro では、GLM-5.2 の62.1 は Claude Opus 4.8 の69.2 に届かないものの、GPT-5.5 の58.6 と Gemini 3.1 Pro の54.2 を上回り、前身 GLM-5.1 の58.4 も上回ります。この構図は表全体で繰り返されます。標準的なコーディング評価のいくつかではクローズドなフロンティアが依然リードし、GLM-5.2 はオープンウェイト勢の首位に立ちつつ、Claude Code ハーネスでの Terminal-Bench 2.1(82.7 対 78.9)や AIME 2026(99.2 対 95.7)など個別項目では明確に勝っています。
GLM-5.2 は、GLM-4.5-Air と GLM-4.7 から GLM-5、GLM-5-Turbo、GLM-5.1 へと続く系列の現在の先頭です。各段階で重点は異なり、GLM-4.7 はプログラミングとフロントエンド生成、GLM-5-Turbo は長い連鎖のエージェント実行、GLM-5.1 は数時間の自律作業に注力しました。GLM-5.2 はそれらの成果を1つのモデルに束ね、はるかに大きなウィンドウを与えたものです。ハードウェア予算の都合でフラッグシップが選べない場合も、軽量な GLM-4.7-Flash と GLM-4.5-Air は同じファミリーの同じ MIT ライセンスです。
GLMモデルのベンチマークを読んだら、実際のモデルを動かしてみてください。上のプレイグラウンドは無料で、何の登録も必要ありません。より本格的なAIツールが必要なら、パートナーの無料プランをどうぞ。