September 18, 2026 100 000 puces souveraines et deux semaines : comment GLM a bâti sa propre infrastructure d'inférence Systèmes d'inférenceGrands modèles de langagePuissance de calcul