EUROTEL

Ils préfèrent les histoires écrites par ChatGPT : l’étude révèle une condition qui change tout dans leur jugement

Ils préfèrent les histoires écrites par ChatGPT : l'étude révèle une condition qui change tout dans leur jugement

Une équipe américaine montre, chiffres à l’appui, que des lecteurs préfèrent des nouvelles écrites par ChatGPT à celles d’auteurs humains, aux États-Unis.

Dans cette étude présentée par le média scientifique en ligne néerlandais Scientias, des chercheurs américains se sont penchés sur une question qui inquiète autant les écrivains que les lecteurs : sommes-nous encore capables de distinguer une histoire écrite par un humain d’un texte généré par une IA comme ChatGPT, et surtout, lequel préférons-nous vraiment ?

Une expérience en trois temps avec des nouvelles « humaines » et des textes de ChatGPT

Les travaux menés par l’équipe de Deena Weisberg, psychologue et neuroscientifique à la Villanova University aux États-Unis, reposent sur trois expériences successives. Le matériau de départ : six nouvelles courtes.

  • Trois récits avaient été écrits par des auteurs humains et déjà publiés dans des revues littéraires reconnues.
  • Trois autres histoires, de style et de longueur comparables, ont été générées par ChatGPT.

Dans le premier volet, 1 682 participants ont lu une seule histoire. Avant la lecture, les chercheurs leur disaient si le texte venait d’un humain ou d’une IA. Problème : cette information était parfois vraie, parfois fausse, sans que les lecteurs le sachent. Les participants devaient ensuite noter la qualité du récit et indiquer à quel point ils avaient été absorbés par l’histoire.

Les deuxième et troisième expériences, menées auprès de 424 puis 481 volontaires, changeaient la règle du jeu. Cette fois, chaque lecteur recevait deux textes : un écrit par un humain, un rédigé par ChatGPT, sans savoir lequel était lequel. À la fin, ils devaient deviner l’auteur de chaque histoire, puis répondre à des questions sur :

  • leur familiarité avec les plateformes d’IA comme ChatGPT ;
  • leur niveau de connaissances en littérature.

Les histoires de ChatGPT mieux notées que celles des écrivains

Dans l’ensemble, les nouvelles générées par ChatGPT ont obtenu de meilleurs scores de qualité et d’« absorption » que celles écrites par des auteurs humains.

Les premiers résultats ont surpris les chercheurs. En moyenne, les textes d’IA ont été jugés :

  • plus qualitatifs ;
  • plus captivants, selon une mesure d’« absorption » qui évalue à quel point le lecteur se sent happé par le récit.

Et un effet supplémentaire, plus troublant encore, apparaît lorsque l’on joue sur l’information donnée aux lecteurs. Quand les participants pensaient qu’un texte avait été écrit par un humain, alors qu’il venait en réalité de ChatGPT, ils le notaient encore plus haut.

Les récits produits par ChatGPT sont non seulement préférés, mais ils grimpent dans le classement dès que les lecteurs sont convaincus qu’il y a un humain derrière.

À l’inverse, un texte humain présenté comme rédigé par une IA perdait une partie de son aura. Tout se passe comme si l’étiquette « auteur humain » ou « IA » pilotait une partie du jugement, indépendamment du contenu réel.

Reconnaître un texte d’IA ? Les lecteurs échouent presque

Lorsque les participants devaient deviner si un récit était l’œuvre d’un humain ou d’une IA, leurs performances se sont révélées très faibles. Dans la deuxième expérience, ils identifiaient correctement l’IA dans seulement 39,93 % des cas. C’est moins bien que le pur hasard dans un choix binaire.

Dans la troisième série de tests, les lecteurs atteignaient 51,97 % de bonnes réponses, à peine au-dessus de la pièce de monnaie virtuelle. Autrement dit, même quand on leur demande explicitement de faire la différence, la plupart des gens n’y arrivent pas mieux qu’en devinant au hasard.

Pour Deena Weisberg, ces chiffres illustrent un décalage croissant entre ce que les gens pensent qu’une IA sait faire et ce qu’elle produit concrètement aujourd’hui.

Nos hypothèses sur les capacités de l’IA sont en retard sur la réalité, résume en substance la chercheuse américaine.

Un biais pro-humain qui continue d’influencer notre jugement

Comment expliquer que des textes d’IA plaisent davantage, tout en restant moins bien notés lorsqu’ils sont présentés comme tels ? Selon Weisberg, les résultats mettent au jour un biais très ancré en faveur des créateurs humains.

Elle souligne que beaucoup de personnes estiment encore que l’écriture créative s’appuie sur des qualités « typiquement humaines » :

  • une compréhension fine des émotions ;
  • une vie intérieure riche ;
  • des expériences personnelles accumulées.

Dès lors, un lecteur qui croit lire un auteur de chair et d’os projette spontanément ces qualités sur le texte, ce qui gonfle sa note. Lorsqu’il pense être face à une IA, il part avec un préjugé défavorable, même si le texte est objectivement clair, bien construit et agréable à lire.

Ceux qui connaissent l’IA la repèrent mieux

Un autre enseignement majeur de l’étude concerne le rôle de la culture numérique. Les participants qui déclaraient mieux connaître les systèmes d’IA s’en sortaient davantage pour identifier les textes générés par ChatGPT, alors que le niveau de culture littéraire ne changeait quasiment rien.

Dans la deuxième expérience, chaque point supplémentaire sur une échelle d’auto-évaluation de connaissances en IA augmentait de 14 % la probabilité de deviner correctement l’auteur. Dans la troisième, où les chercheurs ont utilisé une échelle plus précise, l’Artificial Intelligence Literacy Scale (AILS), chaque point gagnait même 33 % de probabilité supplémentaire.

La familiarité avec l’IA aide à repérer certains « tics » d’écriture des modèles comme ChatGPT, par exemple des structures de phrases récurrentes ou des tournures très codifiées.

Parmi ces indices, Weisberg évoque notamment :

  • un usage fréquent de certaines ponctuations, comme les tirets et les incises ;
  • des formules types du style « il ne s’agit pas seulement de X, mais aussi de Y » ;
  • des explications souvent très explicites des thèmes abordés.

Autrement dit, pour apprendre à distinguer humains et IA, lire beaucoup de romans ou avoir étudié les classiques ne suffit pas. Mieux vaut connaître directement le fonctionnement et les sorties des systèmes d’intelligence artificielle actuels.

Pourquoi les lecteurs préfèrent des textes d’IA

L’étude américaine rejoint d’autres travaux montrant que des participants choisissent souvent des poèmes ou des essais générés par IA lorsqu’ils sont présentés de façon anonyme. Les chercheurs avancent une piste : les textes de modèles comme ChatGPT seraient, en moyenne, plus faciles d’accès.

Selon Weisberg, les récits produits par IA tendent à être :

  • plus clairs ;
  • plus directs ;
  • plus simples à traiter cognitivement.

Les histoires écrites par des humains peuvent être plus subtiles, plus ambiguës, avec des niveaux de lecture multiples et des zones de non-dit. ChatGPT, lui, a tendance à nommer les thèmes et les émotions de manière explicite, au lieu de laisser le lecteur les inférer à partir des gestes et dialogues des personnages.

Nombre de lecteurs semblent apprécier cette lisibilité immédiate, quitte à sacrifier une partie de la complexité et des silences qui caractérisent souvent la littérature humaine.

Weisberg évoque également le contexte plus large : baisse du temps consacré à la lecture, attention fragmentée, influence d’outils numériques et de plateformes comme TikTok. Selon elle, l’IA ne crée pas ces tendances, mais renforce une préférence préexistante pour la clarté et la prévisibilité.

Quels enjeux pour les lecteurs et auteurs en France ?

En France, la question de la place de ChatGPT et des autres IA génératives dans la création littéraire commence à se poser concrètement. De nombreuses maisons d’édition, festivals et jurys de prix littéraires réfléchissent déjà à la manière de garantir l’authenticité des textes soumis.

Le cadre juridique français et européen évolue : les discussions autour de la régulation de l’intelligence artificielle et des droits d’auteur portent notamment sur l’obligation de transparence quand un contenu est généré ou coécrit par une IA. Les principes en jeu rejoignent les préoccupations révélées par l’étude américaine :

  • les lecteurs veulent savoir qui a écrit le texte ;
  • cette information influence directement leur jugement ;
  • il devient difficile, techniquement, de repérer l’IA à l’œil nu.

Pour un lecteur français, l’enjeu pratique est simple : lorsqu’il lit une nouvelle en ligne, un texte sur un réseau social ou même, un jour, un manuscrit autopublié, sa capacité à savoir si une IA est intervenue risque d’être très limitée sans signalement clair.

Les acteurs français du livre (éditeurs, libraires, organisateurs de concours) commencent donc à définir leurs propres lignes rouges : textes entièrement humains exigés pour certains prix, obligation de mentionner l’usage d’IA dans d’autres, voire création de catégories spécifiques dédiées à la fiction assistée par IA.

Ce que cette étude change dans notre manière de lire

Les travaux repris par Scientias ne tranchent pas la question de la « supériorité » littéraire des humains ou des IA. Ils montrent plutôt deux évolutions concrètes auxquelles lecteurs et auteurs vont devoir s’adapter :

  • Les textes d’IA peuvent rivaliser, sur de courts formats, avec des nouvelles publiées dans des revues littéraires reconnues, au moins sur des critères de lisibilité et de plaisir immédiat.
  • Notre jugement est soumis à un biais puissant : nous récompensons davantage ce que nous croyons humain, même lorsque c’est faux.
  • Pour un lecteur qui souhaite affiner son regard, une attitude consiste à développer une forme de « littératie de l’IA » : apprendre à repérer certains automatismes de style, comparer plusieurs textes, se demander comment l’intrigue est construite et à quel point les personnages semblent vivre au-delà des besoins immédiats du scénario.

    Pour un auteur, l’enjeu devient double : affirmer ce qui fait sa singularité – une voix, une expérience, des choix de style risqués – tout en sachant que des outils comme ChatGPT peuvent servir de support, par exemple pour tester des idées, structurer un récit ou travailler un synopsis, à condition d’assumer cette utilisation.

    Vers une nouvelle compétence : lire avec l’IA en tête

    À mesure que les modèles de langage progressent, la capacité à lire en tenant compte de la présence possible d’une IA pourrait devenir une compétence à part entière, au même titre que l’esprit critique face aux images retouchées ou aux vidéos manipulées.

    Cette étude américaine montre que la frontière entre texte humain et texte d’IA devient peu perceptible pour le grand public. Pour un lecteur français, se former un minimum à ces technologies et comprendre comment elles écrivent n’est plus seulement une curiosité technologique : c’est un moyen concret de garder la main sur son jugement littéraire, au moment où ChatGPT se glisse déjà, discrètement, dans une partie de ce que nous lisons chaque jour.

    Questions fréquentes

    Pourquoi les lecteurs préfèrent-ils les textes de ChatGPT à ceux des auteurs humains ?

    Les textes générés par IA sont généralement plus clairs, plus directs et plus faciles à traiter cognitivement. ChatGPT nomme les thèmes et émotions de manière explicite, tandis que les auteurs humains explorent souvent la subtilité et l'ambiguïté, ce qui demande plus d'effort de lecture.

    Comment expliquer que les mêmes textes soient mieux notés quand on dit qu'ils viennent d'un humain ?

    Un biais pro-humain influencement le jugement des lecteurs. Ceux-ci projettent spontanément des qualités humaines (empathie, richesse émotionnelle, expérience personnelle) sur un texte attribué à un auteur de chair et d'os, ce qui gonfle artificielle la note, même si le contenu est identique.

    Est-ce que la culture littéraire aide à mieux reconnaître les textes d'IA ?

    Non, l'étude montre que le niveau de connaissance littéraire ne changeait quasiment rien. C'est la familiarité directe avec les systèmes d'IA qui aide vraiment à identifier les textes générés, notamment en repérant des « tics » spécifiques comme les structures récurrentes ou les formules codifiées.

    Quels sont les indices qui permettent d'identifier un texte de ChatGPT ?

    Les chercheurs identifient notamment l'usage fréquent de certaines ponctuations comme les tirets et les incises, des formules type du style « il ne s'agit pas seulement de X, mais aussi de Y », et des explications très explicites des thèmes abordés plutôt que laisser le lecteur les inférer.

    Combien de participants ont participé à cette étude ?

    L'étude s'est déroulée en trois phases avec 1 682 participants dans la première expérience, puis 424 et 481 volontaires respectivement dans les deux autres expériences.
    Défiler vers le haut