Tous les modèles GLM, comparés

Parcourez toute la famille de modèles GLM sur une seule page. La gamme GLM s'est élargie rapidement, et les sorties couvrent aujourd'hui des budgets de calcul très différents : un palier Flash à 30B pensé pour une inférence locale bon marché, un palier Air optimisé pour la performance par unité de calcul, un modèle de reconnaissance vocale, et le vaisseau amiral GLM-5.2 à contexte 1M conçu pour l'ingénierie agentique de longue haleine. Quel que soit le modèle GLM que vous évaluez, l'objectif de ce hub est de vous amener rapidement à des chiffres concrets plutôt qu'à des adjectifs marketing.

Chaque fiche renvoie vers une page dédiée avec sa bande de spécifications, les données de benchmark publiées par les auteurs du modèle, un mini-graphique de comparaison face à la frontière propriétaire et une courte FAQ. Deux choses restent constantes dans toute la famille : chaque modèle GLM principal est publié sous licence MIT avec des poids diffusés ouvertement, et chaque chiffre de benchmark cité sur ce site est un résultat tel que publié par les auteurs du modèle, et non une mesure faite ici. Lorsqu'aucun chiffre n'a été publié pour une version donnée, la page le dit au lieu d'en estimer un — un blanc assumé est plus utile dans un tableau comparatif qu'une invention crédible.

GLM-5.2Vaisseau amiralNouveau
Contexte 1M

Le vaisseau amiral à contexte d'1M de tokens. Il représente l'état de l'art open source sur les évaluations de programmation et de longue haleine, avec des niveaux d'effort explicites Non-Thinking, High et Max.

GLM-5.1Raisonnement
Contexte 200K

Le précédent vaisseau amiral. Il a apporté à la famille ses premiers grands gains sur les tâches longues et reste la référence à laquelle chaque progrès de GLM-5.2 est mesuré.

GLM-5Raisonnement
Base de la série 5

La version qui a ouvert la série 5 : des fondamentaux de programmation renforcés, une exécution multi-étapes plus fiable et un comportement nettement meilleur sur les tâches d'agent complexes.

GLM-5-TurboRaisonnement
Agents à longue chaîne

Un modèle de base de la série 5 optimisé pour les scénarios d'agents dynamiques à longue chaîne, où le plan change sans cesse et où la trajectoire doit rester exécutable.

GLM-4.7Raisonnement
Programmation

Un modèle de raisonnement équilibré, doté d'une capacité de programmation renforcée, d'un raisonnement multi-étapes stable et d'une génération front-end nettement améliorée.

GLM-4.7-FlashLéger
30B de paramètres

Le palier léger à 30B. Assez efficace et rapide pour l'inférence locale, et annoncé comme devançant les modèles ouverts d'échelle comparable.

GLM-4.5-AirLéger
Palier Air

Le jalon d'efficacité originel de la famille : un modèle GLM à faible empreinte offrant de solides performances pour chaque unité de calcul consommée.

GLM-ASRParole
CER de 0.0717

Le modèle vocal dédié. Reconnaissance vocale en temps réel avec un taux d'erreur par caractère publié de 0.0717.

Comment choisir le bon modèle GLM

Choisir un modèle GLM revient à répondre à deux questions : de combien de contexte la tâche a-t-elle réellement besoin, et de quel matériel disposez-vous. Une fois ces deux réponses posées, la liste se réduit généralement à un ou deux candidats. Pour l'ingénierie logicielle de longue haleine, les boucles de recherche automatisées et tout ce qui doit garder un dépôt entier sous les yeux, GLM-5.2 est le seul membre de la famille doté d'une fenêtre de contexte publiée d'1M de tokens et de niveaux d'effort explicites. Si vous tournez sur un seul GPU de station de travail ou si vous avez besoin d'un débit très élevé sur du raisonnement plus simple, les paliers légers GLM-4.7-Flash et GLM-4.5-Air existent précisément pour cette contrainte. Si votre charge de travail relève de la transcription plutôt que de la génération de texte, GLM-ASR est le modèle vocal dédié. Tout ce qui se trouve entre les deux — GLM-5, GLM-5-Turbo et GLM-4.7 — correspond aux générations antérieures de la même lignée de raisonnement, utiles quand vous voulez un modèle plus petit et plus prévisible qui tourne toujours sur des poids ouverts.

Comparaison rapide

Le tableau ci-dessous résume comment se positionnent les huit pages de modèles GLM de ce site. Lorsqu'un chiffre n'a pas été publié par les auteurs du modèle, la cellule le signale plutôt que de deviner.

Comparaison rapide
ModèleCatégorieContexteLicence
GLM-5.2Raisonnement haut de gamme1 000 000 de tokensOpen source MIT
GLM-5.1Raisonnement200 000 tokensOpen source MIT
GLM-5RaisonnementNon publiéOpen source MIT
GLM-5-TurboRaisonnementNon publiéOpen source MIT
GLM-4.7RaisonnementNon publiéOpen source MIT
GLM-4.7-FlashLéger (30B)Non publiéOpen source MIT
GLM-4.5-AirLégerNon publiéOpen source MIT
GLM-ASRReconnaissance vocaleFlux audioOpen source MIT

Tous les chiffres de cette page sont des résultats tels que publiés par les auteurs du modèle. glmmodel.com les rapporte ; il n'exécute pas ces évaluations.

Testez un modèle d'IA en direct, gratuitement et sans compte

Consultez les benchmarks des modèles GLM, puis mettez un vrai modèle au travail. Le playground ci-dessus est gratuit et ne demande rien ; si vous cherchez une boîte à outils IA plus complète, l'offre gratuite de notre partenaire commence ici.