August 1, 2026 Faire tourner un modèle IA de 2,78T sur 29 Go de RAM : 0,5 token par seconde iakimilocal-inferenceia-locale