Prendre contact
Ch. du Vernay 14a
Gland 1196 CH-Vaud
[email protected]
Tél : +41 21 561 28 48
Retour

GLM-5.2 : un modèle ouvert de type 753B avec 1 million de contextes atteint un niveau de codage comparable à celui d'Opus

En bref : Le GLM-5.2 de Z.ai est le modèle open-weight le plus performant, sous licence MIT, dédié au codage et aux tâches agentiques. Il associe un moteur de traitement de contextes longs de pointe à une infrastructure hébergée aux États-Unis sans conservation des données, ce qui convient parfaitement aux équipes soumises à une réglementation.

Ce que Z.ai a livré

Z.ai, le laboratoire issu de Zhipu AI, a publié la version GLM-5.2 à la mi-juin 2026 comme modèle phare pour les tâches à long terme. Cette version est un système « Mixture-of-Experts » (MoE) à poids ouverts intégrant 753 milliards de paramètres, et il n'en active qu'une petite partie à chaque tour, ce qui permet de maintenir le coût de fonctionnement à un niveau proche de celui d'un modèle bien plus petit. Deux choix de conception le distinguent de la catégorie « open-weight ». Le premier est un fenêtre de contexte fixe d'un million de jetons, soit cinq fois la limite de 200 000 jetons imposée par GLM-5.1, conçu pour garantir une fiabilité constante lors de longues sessions d’agents de codage. Le second est une licence MIT permissive, valable dans toutes les régions, qui autorise une utilisation commerciale sans restriction, un déploiement local et la liberté d’ajuster le modèle.

Le modèle est livré avec un niveau d’effort de réflexion sélectionnable. Le mode « High » traite rapidement les tâches quotidiennes, tandis que le mode « Max » consacre davantage de ressources de calcul aux problèmes plus complexes, permettant ainsi à une équipe d’ingénieurs de faire un compromis entre latence et capacité par tâche. Z.ai a publié les poids du modèle sur Hugging Face et ModelScope, et celui-ci est accessible via Transformers, vLLM, SGLang et d’autres frameworks standard. La principale capacité mise en avant par le laboratoire est la prise en charge de bout en bout : contexte d’ingénierie au niveau du projet, tâches de longue durée menées à bien de manière fiable, respect systématique des normes d’ingénierie, et parcours complet, des exigences au déploiement multiplateforme, au sein d’une seule et même tâche.

L'image de référence, avec les lacunes

Z.ai a conçu GLM-5.2 pour des opérations de codage s'étalant sur plusieurs heures, et les chiffres publiés reflètent bien cette orientation. Dans le tableau de référence établi par le laboratoire lui-même, GLM-5.2 devance tous les modèles ouverts sur les suites de codage à long terme et comble une grande partie de l'écart par rapport à la frontière fermée. Le tableau ci-dessous est tiré du communiqué de Z.ai ; les lecteurs sont invités à considérer les benchmarks réalisés par les éditeurs comme indicatifs et à les mettre en perspective avec des tests indépendants.

Leave a Reply

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *