Publications scientifiques : l'IA oblige ArXiv à revoir ses règles

Par Jean Piot

10 août 2026

1 min

Partager cet article

Sur les réseaux sociaux

Illustration de la breve : Publications scientifiques : l'IA oblige ArXiv à revoir ses règles
Crédit : Jason Leung

ArXiv (à prononcer "ar-kive", comme archive en anglais : le X représente la lettre grecque "Chi") est une plateforme de pré-publication de documents scientifiques. Les documents qui y sont publiés ne font pas l'objet d'une revue par les pairs, étape traditionnellement incontournable pour valider la publication dans le processus scientifique. Le dispositif, s'il se révèle moins solide, est néanmoins beaucoup plus rapide que le processus traditionnel.

Coup de semonce

Le 31 octobre 2025, la rédaction d'ArXiv avait annoncé sur son blog un changement de politique : avant d'être publiées, les soumissions dans le domaine informatique seraient dorénavant revues par un comité de lecture au lieu d'être uniquement validées par un·e modérateur·rice. Une décision prise face à l'afflux de documents générés par IA sans aucune valeur ajoutée. Car à ce jour, ArXiv reçoit plusieurs milliers d'articles par mois. La plateforme, créée en 2001, ne possède pas l'infrastructure pour traiter toutes les soumissions.

La sentence

Le 14 mai 2026, Thomas Dietterich, professeur d'informatique à l'université d'Oregon et président de la section informatique chez ArXiv, publiait cet avertissement :

"A tous les auteurs ArXiv : notre Code de Conduite mentionne que chaque auteur signant une soumission endosse pleinement la responsabilité de son contenu - quelle que soit la façon dont le texte a été créé. L'auteur reste responsable même si le texte soumis est produit par une IA et qu'il contient des expressions inappropriées, du plagiat, des erreurs, des références incorrectes ou du contenu qui prête à confusion. Nous avons récemment clarifié les sanctions à ce sujet. Si une soumission contient des preuves irréfutables que son auteur n'a pas vérifié ce qui est écrit par l'IA, cela veut dire qu'on ne peut pas lui faire confiance. Il sera exclu d'ArXiv pendant un an puis par la suite, toutes ses soumissions devront être validées par un comité d'experts."

Comment détecter que l'auteur·rice n'a pas relu son document ?

Selon Thomas Dietterich, les textes soumis peuvent par exemple contenir :

  • des références inventées.
  • des faits notoirement faux ou injustifiés.
  • des commentaires du type : "ceci est un exemple, veux-tu que je modifie quelque chose ?" ou encore "remplace les données du tableau par tes propres données", preuves flagrantes d'un copier-coller d'une réponse générée par IA.

Comme l'indique le média TheNextWeb, cette décision ne concerne que les auteurs·rices ayant fait des erreurs d'inattention flagrantes. Mais elle ne dit rien quant à l'utilisation de l'IA comme aide dans la rédaction.

Les limites de cette décision

Il subsistera toutefois sur la plateforme des articles écrits par des LLM (Large Language Model- ces IA capables de générer du texte), au vernis scientifique mais dépourvus de substance. De même que des articles avec des conclusions plausibles mais incorrectes, ou encore des documents mettant en avant des données fabriquées de toutes pièces. Pour les éliminer, il faudra non seulement du temps mais aussi des comités de lecture. Et peut-être des IA, même si la détection par IA d'un texte ayant été écrit par une IA n'est pas, à l'heure actuelle, 100% fiable. Evidemment, il ne s'agit pas de bannir complètement l'intelligence artificielle. Mais il est indispensable d'encadrer son usage... ce qui est beaucoup plus facile à dire qu'à faire.

Références :