
La startup chinoise Zhipu AI a publié son modèle de langage phare GLM-5.2 pour les tâches et la programmation longue durée basées sur des agents. La solution open source dispose d'une fenêtre contextuelle de 1 million de jetons, d'une licence MIT et d'un support pour le déploiement local.
La carte sur Hugging Face répertorie le développement comme modèle pour générer du texte en anglais et en chinois. Taille : 753 milliards de paramètres.
GLM-5.2 prend en charge plusieurs niveaux « d'intensité de raisonnement » pour choisir entre qualité et latence. L'architecture comprend également IndexShare et une couche MTP mise à jour pour le décodage spéculatif.
Selon les développeurs, IndexShare réutilise un indexeur pour quatre couches d'attention clairsemées et réduit le nombre d'opérations par jeton de 2,9 fois. La mise à niveau MTP augmente la longueur de confirmation jusqu'à 20 %.
Dans trois tests clés : FrontierSWE, PostTrainBench et SWE-Marathon – GLM-5.2 a surpassé les autres modèles open source.

Lors des tests de performances de programmation standard, GLM-5.2 est également devenu le modèle open source le plus puissant.

GLM-5.2 est distribué sous la licence ouverte MIT. Pour le déploiement local, la prise en charge de SGLang, vLLM, Transformers, KTransformers et Docker Model Runner est déclarée. Des quantifications sont disponibles pour llama.cpp, Ollama et LM Studio.
Rappelons qu'en juin, la société informatique de Rio de Janeiro IplanRIO a présenté Rio 3.5 Open 397B comme un modèle d'IA ouvert formé avec des fonds publics. Cependant, un jour plus tard, l'équipe Nex a déclaré que l'outil ressemblait à une fusion directe de Nex-N2-Pro et Qwen3.5-397B-A17B.
Vous avez trouvé une erreur dans le texte ? Sélectionnez-le et appuyez sur CTRL+ENTRÉE