L'IA surpasse-t-elle les mathématiciens par la logique ou par une mémoire de travail démesurée ? Le secret des 2 millions de tokens

L'IA surpasse-t-elle les mathématiciens par la logique ou par une mémoire de travail démesurée ? Le secret des 2 millions de tokens

Intelligence ArtificielleSciences CognitivesRaisonnement Mathématique

Sources:HN + web research

En août 2026, le chercheur en sciences cognitives Davide Piffer a publié une observation scientifique qui bouscule les idées reçues : les performances exceptionnelles de l’intelligence artificielle lors des compétitions mathématiques de premier plan ne découlent pas d’une pensée d’une profondeur surhumaine, mais d’une capacité de mémoire phénoménale. Alors qu’on attribue souvent les compétences mathématiques au quotient intellectuel ou à l’abstraction pure, on oublie que la mémoire est fréquemment le maillon faible du calcul mental. Avec l’extension de la fenêtre de contexte des grands modèles de langage jusqu’à plusieurs millions de tokens, l’IA dispose désormais d’un brouillon externe virtuellement infini.

4 blocs contre 2 millions de tokens : Le goulet d’étranglement du calcul mental

Lorsqu’un être humain éprouve des difficultés à multiplier mentalement deux nombres à trois chiffres, l’obstacle majeur ne réside pas dans la méconnaissance des règles de multiplication, mais dans l’incapacité du cerveau à maintenir simultanément plusieurs produits intermédiaires. Les travaux en psychologie cognitive indiquent que la capacité de la mémoire de travail à court terme chez l’humain se limite à seulement 4 à 9 blocs d’information (chunks). Sans l’aide d’un papier et d’un crayon, l’esprit doit consacrer une énergie cognitive immense à conserver ces valeurs temporaires tout en effectuant les étapes suivantes, ce qui constitue un véritable goulet d’étranglement physiologique.

À l’inverse, la fenêtre de contexte des principaux modèles de langage s’est élargie pour atteindre 128K à plus de 2M+ tokens, permettant de consulter instantanément des centaines de milliers de mots. Dans ce vaste espace symbolique, le modèle peut conserver simultanément l’énoncé initial, les équations intermédiaires sur des centaines d’étapes de calcul, plusieurs voies d’exploration abandonnées ainsi que des définitions théoriques complètes. Ce changement d’échelle place le calculateur mental humain dans un affrontement profondément asymétrique.

Comparaison de la mémoire de travail entre l'IA et l'humain Figure : Comparaison des mécanismes de mémoire de travail entre l’IA et le cerveau humain. Source : Davide Piffer Substack

Une feuille de papier ne rend pas un humain soudainement plus intelligent, mais elle augmente considérablement sa mémoire de travail effective. La fenêtre de contexte d’un LLM s’apparente essentiellement à un bloc-notes géant couplé à un système de recherche ultra-rapide. Du point de vue de l’ingénierie, la stabilité de l’IA dans les démonstrations complexes repose en grande partie sur le fait qu’elle n’oubliera jamais le coefficient calculé trois minutes plus tôt.

Tenue de compte symbolique : Pourquoi les mathématiques sont devenues le terrain de jeu idéal de l’IA

Les compétitions de mathématiques constituent précisément le domaine où cet « avantage de mémoire de travail » se traduit le plus directement en résultats. Au sein des systèmes mathématiques formels, les hypothèses fondamentales sont explicites et chaque étape de transformation peut être substituée et vérifiée au moyen de règles symboliques rigoureuses. Cela permet à l’IA de décomposer de longues démonstrations en un jeu de tenue de compte symbolique de haute précision.

Pendant qu’un candidat humain doit concevoir des stratégies tout en veillant à ne pas commettre d’erreur de calcul, l’IA peut explorer en parallèle des dizaines de branches de déduction et vérifier immédiatement chaque étape grâce à des interpréteurs de code ou des assistants de preuve formelle. Même si 99 de ces voies s’avèrent être des impasses, la fenêtre de contexte conserve l’enregistrement intégral de ces échecs, garantissant que le modèle ne répétera pas la même erreur. Ce suivi d’état systématique cible précisément le point vulnérable de la mémoire humaine à court terme, sujette à une rapide dégradation.

Modèle de mémoire de travail de Baddeley-Hitch Figure : Modèle classique multicomposant de la mémoire de travail humaine selon Baddeley & Hitch. Source : Wikimedia Commons

La littérature scientifique en psychologie cognitive confirme largement ce constat. Une étude prospective menée sur six ans par Alloway et al. (2010) a démontré que la capacité de la mémoire de travail chez les enfants de 5 ans prédit la réussite académique future plus fidèlement que les tests de QI. De plus, une méta-analyse réalisée par Friso-van den Bos en 2013 a mis en évidence une très forte corrélation positive entre la mémoire de travail symbolique et les aptitudes mathématiques. Cela prouve qu’en mathématiques, la qualité de la mémoire constitue en soi une compétence clé longtemps sous-estimée.

Un von Neumann démultiplié ou un Einstein qui tarde à naître ?

Le physicien Eugene Wigner a autrefois comparé deux esprits de génie : John von Neumann possédait une vitesse de calcul fulgurante, une mémoire prodigieuse et une capacité d’assimilation interdisciplinaire remarquable, tandis qu’Albert Einstein disposait d’une pénétration conceptuelle profonde et d’une intuition unique pour reconfigurer les problèmes à leur racine. Si l’on applique cette grille de lecture au domaine de l’IA, la génération actuelle des modèles de langage s’apparente nettement à un von Neumann démultiplié par la puissance de calcul des machines.

Les LLM excellent dans la recherche exhaustive, le rapprochement de motifs et la vérification rapide au sein d’espaces symboliques connus. Comme l’a souligné le développeur hibikir lors d’une discussion sur Hacker News, une grande partie des performances associées à un « QI élevé » consiste simplement à retenir davantage de combinaisons de règles que son entourage. Cependant, face à des problèmes nécessitant un changement radical d’hypothèses ou une redéfinition globale des perspectives, une gigantesque fenêtre de contexte ne génère pas spontanément de rupture conceptuelle.

Imaginons une expérience de pensée : deux personnes s’attaquent au même problème mathématique difficile. L’une s’appuie exclusivement sur le calcul mental, tandis que l’autre dispose d’un papier infini, de notes parfaites, d’une capacité de déduction en parallèle et d’outils de vérification automatique. Si la seconde l’emporte, nous attribuerons cette victoire à une architecture cognitive augmentée plutôt qu’à une élévation de son intelligence intrinsèque. Les scores élevés obtenus aujourd’hui par l’IA en mathématiques sont le résultat direct de la superposition de cette architecture cognitive d’ingénierie.

Redéfinir les frontières de l’IA sur la feuille de brouillon

En prenant la mémoire de travail comme dimension d’analyse fondamentale, nous pouvons établir des prédictions techniques beaucoup plus claires sur les limites des capacités de l’IA. Pour les tâches impliquant des interactions multi-contraintes, des calculs sur de longues séquences d’étapes, des études de cas exhaustives et des références répétées à des résultats antérieurs, l’IA affiche une efficacité écrasante. Tant qu’une tâche repose sur le suivi symbolique précis et la vérification de règles, l’IA surpassera les experts humains grâce à son espace de contexte massif.

À l’inverse, dans les tâches caractérisées par un contexte très court, nécessitant des sauts conceptuels ou la remise en cause des cadres existants, l’avantage de l’IA s’amenuise rapidement. Cette distinction nous invite à ne pas prendre les résultats impressionnants issus d’une excellente mémoire pour l’émergence d’une intuition profonde et auto-évolutive du modèle.

L’éclairage des sciences cognitives déconstruite le récit mythologique autour de l’IA tout en réaffirmant la singularité de la pensée humaine. L’IA prend en charge le travail fastidieux de suivi symbolique à travers des millions de tokens, mais déterminer dans quelle direction explorer et comment reconsidérer un problème demeure l’apanage de l’intuition humaine sur la nature du monde. Lorsque l’immense mémoire externe n’est plus une ressource rare, le véritable cœur de la compétition revient aux sauts conceptuels qu’aucune feuille de brouillon ne saurait à elle seule contenir.

Références :

  • Rapport d’observation de Davide Piffer : « AI Isn’t Outthinking Mathematicians. It’s Out-Remembering Them. »
  • Discussion de la communauté Hacker News (item?id=49312845)
  • Étude prospective d’Alloway & Alloway sur la réussite académique et la mémoire de travail (2010)
  • Méta-analyse de Friso-van den Bos sur la mémoire de travail symbolique et les aptitudes mathématiques (2013)