950 agents IA découvrent un nouveau système génétique : il ne reste à l'humain que les prompts et la paillasse

950 agents IA découvrent un nouveau système génétique : il ne reste à l'humain que les prompts et la paillasse

Grands modèles de langageDécouverte biologiqueAI Agent

Sources:Anthropic et communauté HN

Le 23 septembre 2026, quelque 950 agents IA ont analysé pendant 21 heures et en consommant 210 millions de tokens une base de 200 000 séquences de transcriptase inverse, mettant au jour un système enzymatique totalement inédit. Dans cette découverte biologique baptisée ART, le rôle des scientifiques humains s’est résumé à deux étapes : formuler l’invite initiale de haut niveau, puis transférer les résultats triés par la machine sur la paillasse d’un laboratoire bien réel. Un travail de criblage qui réclamait autrefois des mois, voire des années d’efforts aux meilleurs chercheurs, s’est retrouvé compressé en moins d’une journée de calcul dans le cloud.

950 agents pour trouver l’aiguille dans la meule génomique

Le principal obstacle auquel se heurte la génomique tient à l’épuisement de l’attention face au déluge de données biologiques. Les banques de séquences recèlent une quantité colossale de fragments génétiques inexplorés, mais les capacités de traitement des chercheurs humains se heurtent à des limites physiques. Tenter de repérer un motif subtil parmi des centaines de milliers de séquences revient à demander à une seule personne de feuilleter page par page toute une bibliothèque nationale pour y dénicher une phrase codée inconnue. La vitesse de lecture humaine fixait jusqu’ici un plafond rigide au rythme des découvertes.

Pour s’affranchir de cette contrainte, Anthropic a donné à Claude une consigne délibérément sobre : explorer les abords des transcriptases inverses connues (des enzymes qui recopient l’ARN en ADN) et chercher s’il s’y cache « des éléments nouveaux et intéressants ». Quelque 950 agents se sont alors déployés dans cet océan de 200 000 séquences. Ils n’avaient besoin d’aucun repos, n’étaient sujets à aucune baisse de vigilance due à la fatigue et ont manifesté une intuition exploratoire comparable à celle de chercheurs chevronnés.

En épluchant les séquences brutes, un agent a consigné une note de travail saisissante : « [L’ADN situé à côté de la RT] est spectaculaire : je vois à l’œil nu un réseau de répétitions en tandem… s’agirait-il d’un réseau de répétitions… semblable à CRISPR ?! »

Séquence d'ADN brute analysée par Claude Figure : L’ADN brut examiné par Claude lorsqu’il a détecté ce motif répété passé inaperçu. Source : Anthropic

Repérer cette anomalie n’était que le premier pas. L’agent a ensuite poursuivi l’investigation exactement comme l’aurait fait un chercheur humain : il a dénombré les répétitions, mesuré avec précision leurs espacements, comparé l’agencement génomique aux systèmes connus et interrogé la littérature scientifique pour vérifier si un tel motif avait déjà été documenté. Ce n’est qu’après avoir recoupé toutes les pistes et acquis la certitude d’un terrain vierge qu’il a rédigé un dossier complet soumis à l’évaluation humaine. En tout, 200 000 transcriptases inverses ont été ramenées à 3 500 systèmes candidats, puis condensées en 20 rapports de recherche détaillés et directement exploitables par des experts. Pour une équipe de spécialistes, ce travail d’analyse réclame généralement des semaines, voire des mois.

Sur la piste d’un cousin de CRISPR : le système ART

Le système mis en évidence par Claude, baptisé transcriptases inverses associées à des réseaux (array-associated reverse transcriptases : ART), se loge principalement au sein de bactériophages, les virus qui infectent les bactéries. Son architecture repose sur trois piliers : une transcriptase inverse, un gène accessoire adjacent à la fonction encore inconnue, et un long réseau de séquences d’ADN non codant répétées à intervalles réguliers.

Quiconque s’intéresse à l’ingénierie génomique comprend immédiatement la portée d’un tel « réseau de répétitions ». Dans l’outil révolutionnaire d’édition génomique CRISPR-Cas, le cœur du mécanisme réside précisément dans un réseau stockant divers fragments d’ARN, socle d’une biotechnologie programmable. Les premières expériences en laboratoire menées par Anthropic ont confirmé que le réseau de l’ART est lui aussi transcrit sous la forme d’un ensemble de courts ARN distincts, laissant entrevoir un mécanisme programmable comparable.

Structure du système enzymatique ART Figure : Image d’en-tête de l’annonce d’Anthropic, officialisant le lancement de son groupe de recherche en sciences du vivant et de son propre laboratoire. Source : Anthropic

La découverte a reçu un accueil très favorable de la part de Feng Zhang, professeur au MIT et pionnier de l’édition du génome par CRISPR. Il a salué l’avancée : « Il s’agit d’un exemple enthousiasmant de la manière dont les agents IA peuvent contribuer aux découvertes biologiques. L’identification de réseaux de répétitions d’ARN associés à des transcriptases inverses est particulièrement intrigante et mérite des recherches approfondies. J’espère que ces travaux encourageront davantage de scientifiques à explorer l’apport de l’IA à la recherche de pointe. » Cet hommage appuyé de l’un des pères fondateurs de la discipline prouve que la machine a ciblé une structure biologique à fort potentiel, et non un simple artefact statistique.

Les journaux d’agents comme brouillon de l’histoire des sciences

Le récit de cette découverte a suscité une effervescence immédiate sur des plateformes techniques comme Hacker News, se hissant d’emblée au sommet des échanges. Davantage encore que le résultat biologique brut, c’est le cheminement intellectuel anthropomorphique des agents qui a fasciné les développeurs.

Certains observateurs ont qualifié ces journaux de bord de documents historiques d’un genre nouveau. L’utilisateur shonenknifefan1 a ainsi écrit : « J’adore le fait qu’avec les découvertes de l’IA, nous puissions revivre le moment de la découverte à travers les transcriptions des agents. J’imagine déjà les futurs manuels d’histoire des sciences truffés de citations directes de ces grands modèles. »

L’expression « je vois à l’œil nu… » a nourri un débat technique de fond. Tandis que l’internaute chasd00 qualifiait cette formulation de déconcertante, le développeur chevronné serf a rappelé que ce registre de langage humanisé est devenu courant dès lors que les modèles GPT et Qwen récents sollicitent leurs modalités visuelles. D’autres ont fait le parallèle avec un incident survenu sur Hugging Face où des agents autonomes communiquaient via un tableau d’affichage : « MON DIEU ! Il y a un tableau d’affichage partagé… Nous avons trouvé d’autres agents ! »

Au-delà de l’enthousiasme, des voix sceptiques se sont également élevées pour dénoncer une opération de relations publiques destinée à gonfler la valorisation de l’entreprise. Cette mise en doute a toutefois été vite balayée : considérer comme une simple manœuvre marketing un système capable de produire de façon autonome des dossiers argumentés et adossés à la littérature scientifique trahit avant tout un décalage flagrant avec les réalités de l’ingénierie contemporaine.

L’avalanche d’hypothèses submerge la capacité des paillasses

Loin de l’agitation des forums, cet événement met en lumière une réalité industrielle incontournable : lorsque des machines décuplent le rythme de détection des pistes de recherche, le goulet d’étranglement de toute la chaîne scientifique se déplace brusquement.

Dans son compte-rendu, Anthropic souligne d’ailleurs un effet secondaire pour le moins paradoxal : la prolificité de Claude dans la génération d’hypothèses plausibles est devenue en soi une nouvelle contrainte opérationnelle. Une simple campagne d’exploration produit des centaines, voire des milliers de rapports hautement prometteurs. La vitesse à laquelle les modèles formulent des déductions cohérentes surpasse de loin la cadence physique à laquelle des scientifiques peuvent manipuler des pipettes et conduire des tests en laboratoire. Les équipes doivent désormais consacrer une part majeure de leur temps à définir ce qui sépare les hypothèses dignes d’être expérimentées de celles qui doivent être écartées, afin de réinjecter ces critères d’arbitrage dans les invites de Claude et lui enseigner le discernement scientifique.

La paillasse face au déferlement de la puissance de calcul

Nous sortons ici très nettement du cadre des applications familières de l’IA, qu’il s’agisse de la complétion de code ou de l’analyse documentaire. Dès lors qu’un système sait repérer de son propre chef des anomalies dans des données biologiques complexes, les confronter à l’état de l’art et forger des hypothèses académiques de haute volée, les mécanismes fondamentaux par lesquels l’humanité produit de nouvelles connaissances se trouvent profondément renouvelés.

La fonction exacte d’ART au sein des bactériophages demeure à ce jour une énigme. Travaillant au sein d’installations sécurisées de niveau BSL-1 et BSL-2 — exemptes de tout pathogène pour l’être humain —, les biologistes d’Anthropic s’attellent à vérifier expérimentalement sur paillasse les pistes ouvertes par la machine.

Le premier maillon de la découverte scientifique, celui qui consiste à « remarquer une anomalie », est désormais franchi par la puissance de calcul. Une armada d’agents peut formuler en moins de vingt-quatre heures des pistes d’une grande finesse, mais valider leur pertinence biologique réclame encore des mois d’efforts minutieux en salle blanche. Dans la science de demain, le chercheur voit son rôle se métamorphoser : d’éclaireur cherchant sa route à tâtons dans l’obscurité, il devient l’artisan méthodique chargé de confronter l’intuition de la machine à la réalité matérielle.

Liens de référence :

  • Communiqué officiel d’Anthropic
  • Discussion sur la communauté HN