September 18, 2026 100.000 heimische KI-Beschleuniger und zwei Wochen Zeit: Wie GLM seine Inferenz-Infrastruktur per Agent optimierte InferenzsystemeGroße SprachmodelleRechenleistung