GLM-4.7-Flash — 30B の軽量GLMモデル

GLM-4.7-Flash は、フラッグシップがそもそも収まらない場面のために作られた、300億パラメータのGLMモデルです。300億という規模は、高メモリのアクセラレータ1枚、あるいは量子化すればコンシューマ向けハードウェアでも動く階級であり、ローカル開発、オンプレミス推論、そしてベンチマークの数ポイントよりリクエストごとのレイテンシが重要な用途にとって自然な選択になります。

モデル開発元はこれを効率的かつ高性能と位置づけ、同規模のオープンソースモデルを上回ると報告しています。このティアではその主張こそが本質です。30Bモデルを配備する人はフロンティアシステムに勝つことなど期待していませんが、代わりに動かせた他の30Bの選択肢に勝てるかどうかは大いに気にします。

30B
パラメータ数
アクセラレータ1枚に収まる規模
MIT
オープンソースライセンス
MIT、地域制限なし
4.7
シリーズ世代
GLM-4.7 系列の軽量ティア

無料AIプレイグラウンド — 稼働中のオープンソースLLMを試す

登録もアカウントもクレジットも不要。プロンプトを入力すれば、その場で回答がストリーミングされます。

ここに回答がストリーミングされます...

このプレイグラウンドは OpenRouter 経由で無料のオープンソースLLMを実行しています。GLM-5.2 ではなく、GLMのウェイトも使用していません。以下に掲載したGLMの公表ベンチマークを読みながら、稼働中のモデルを実際に試せるように用意したものです。

30B のGLMモデルを持つ価値

パラメータ数はモデルが物理的にどこで動けるかを決め、その制約は素の能力よりも多くのアーキテクチャ判断を左右します。30Bモデルは小さなチームがすでに所有しているハードウェアで配信でき、プロンプトを自社ネットワーク内にとどめ、バッチキューではなく対話ループに収まる速さで応答します。またファインチューニングが研究プロジェクトでなくなる規模でもあります。30BのGLMモデルを狭い領域に適応させ、その結果を半日で評価することも可能です。代償は現実にあります。パラメータが少なければ、難しく長時間に及ぶ推論の余力は小さくなり、それこそ100万トークン文脈のフラッグシップが担う領域です。ファミリーの正しい使い方は難易度で処理を振り分けることで、安価で大量のタスクは Flash に任せ、本当に必要な問題にだけフラッグシップを充てることです。

パラメータ数
30B
ライセンス
MIT オープンソース
位置づけ
軽量・高スループット
ファミリー
GLM-4.7 シリーズ
ウェイト公開先
HuggingFace · ModelScope

公表ベンチマークデータにおける GLM-4.7-Flash

公表された比較表がカバーするのは GLM-5.2 と GLM-5.1 です。以下の列は GLM-5.1 のもので、ファミリーの参照点として示しているにすぎません。GLM-4.7-Flash のベンチマーク列は公表されておらず、当サイトも推定していません。

GLM-4.7-Flash の公表行はなく、はるかに大きなモデルから推定すればどちらの方向にも誤解を招きます。参照列が役立つのは目盛り合わせとしてです。公表されているGLMモデルがどの範囲に分布するかを示すので、前世代のフルサイズモデルが達成した水準を踏まえたうえで、30Bモデルが自分のタスクに足りそうかを判断できます。

17件のGLMベンチマークをすべて詳しく見る →

長時間コーディングにおけるファミリー比較

DeepSWE での比較。モデル開発元の公表値です。

DeepSWE はモデル規模の差が最も容赦なく表れる場所です。GPT-5.5 が70.0 で首位、Claude Opus 4.8 が58.0、GLM-5.2 が46.2、前世代のオープンモデルははるかに下に固まり、GLM-5.1 と Qwen3.7-Max が18.0、DeepSeek-V4-Pro が8.0 です。ワークロードが DeepSWE のような形なら、どれほど効率的でも軽量モデルは不適切な道具です。分類、抽出、日常的なコード修正のような形なら、Flash で十分でしょう。

GLM vs Qwen の詳細比較を読む →

GLMモデルラインナップにおける GLM-4.7-Flash の位置

GLM-4.7-Flash は GLM-4.7 世代の軽量ティアで、フルサイズの GLM-4.7 と並び、ファミリーの効率系列では旧来の GLM-4.5-Air の上に位置します。この系列はすべて同じ MIT ライセンスと同じウェイト公開先なので、ティア間の移動は法務ではなくハードウェアの判断です。

他のGLMモデル

すべて見る

GLM-4.7-Flash のよくある質問

GLM-4.7-Flash モデルとは何ですか?
GLM-4.7-Flash はGLMモデルファミリーの300億パラメータの軽量モデルです。MIT ライセンスのオープンウェイトで、効率的な高スループット推論のために作られ、同規模のオープンソースモデルを上回るとモデル開発元が報告しています。
GLM-4.7-Flash を動かすにはどんなハードウェアが必要ですか?
300億パラメータは、精度を落とせば高メモリのアクセラレータ1枚に、量子化すればコンシューマ向けハードウェアに収まる規模です。正確な要件は量子化、文脈長、配信フレームワークに依存するので、経験則ではなく自分の構成で実測してください。
GLM-4.7-Flash には公表ベンチマークスコアがありますか?
モデル開発元が公表した比較表にはありません。同表は GLM-5.2 と GLM-5.1 を対象としています。当サイトも列を推定しません。このモデルについての公表された主張は相対的なもので、同規模のオープンモデルを上回るとされています。
GLM-4.7-Flash はオープンソースですか?
はい。MIT ライセンスのオープンウェイトGLMモデルとして HuggingFace と ModelScope に公開され、地域制限もありません。ファミリーの他モデルと同様、transformers、vLLM、SGLang、xLLM、ktransformers で動作します。
GLM-4.7-Flash と GLM-4.5-Air のどちらを選ぶべきですか?
Flash はより新しい軽量ティアで、GLM-4.7 世代のプログラミングと推論の改善を受け継いでいます。Air はそれ以前の効率面のマイルストーンです。どちらも公表ベンチマーク列がないため、両方がハードウェアに収まるなら、位置づけではなく自分のタスクで評価するのが賢明です。

稼働中のAIモデルを無料で試す — アカウント不要

GLMモデルのベンチマークを読んだら、実際のモデルを動かしてみてください。上のプレイグラウンドは無料で、何の登録も必要ありません。より本格的なAIツールが必要なら、パートナーの無料プランをどうぞ。