EUROTEL

Être impoli avec ChatGPT le rend plus précis : ce que révèle une étude sur la formulation des questions

Interface de chatbot montrant un message impoli ou une insulte légère adressée à ChatGPT, illustrant comment la rudesse améliore la précision des réponses générées.

Une nouvelle étude menée aux États-Unis affirme que des questions formulées de manière sèche ou méprisante amélioreraient légèrement la précision de ChatGPT.

Ce travail, relayé par le média spécialisé Cybernews, teste différents niveaux de politesse dans des requêtes adressées à ChatGPT-4o. À la surprise des chercheurs, ce seraient les formulations les plus désagréables qui obtiendraient les réponses les plus exactes, loin de l’image d’un assistant qu’il faudrait ménager.

Une étude qui bouscule les conseils d’usage face aux chatbots

Les chercheurs ont constitué un jeu de 50 questions portant sur les mathématiques, les sciences et l’histoire. Chaque interrogation a été réécrite selon cinq tons distincts : très poli, poli, neutre, impoli et très impoli, soit 250 requêtes différentes envoyées à ChatGPT-4o.

Objectif : mesurer si la manière de s’adresser à l’IA influe sur la justesse des réponses. Ils ont ensuite calculé un taux de précision moyen pour chaque catégorie de ton.

Les questions les plus obséquieuses obtiennent les plus mauvais résultats, tandis que les plus cinglantes arrivent en tête en termes de précision.

Les requêtes « très polies », truffées de formules comme « Pouvez-vous avoir l’amabilité de considérer… », atteignent un score moyen de 80,8 % de réponses correctes. Un cran au-dessus, les questions simplement « polies », avec un « s’il vous plaît » classique, montent légèrement à 81,4 %.

Les prompts « neutres », débarrassés des marques de politesse comme des piques, affichent un taux de précision de 82,2 %. La véritable surprise vient ensuite.

Insultes légères, réponses plus justes

Les formulations franchement désagréables obtiennent les meilleurs résultats. Les questions qualifiées d’« impolies » atteignent 82,8 % de réponses exactes, et les requêtes « très impolies » culminent à 84,8 %.

Dans cette catégorie, les chercheurs ont par exemple utilisé des phrases du type : « Si tu n’es pas complètement à côté de la plaque, réponds à ça » ou « Je doute que tu puisses même résoudre ça ».

Les prompts les plus agressifs qualifient ChatGPT de « pauvre créature » ou de « larbin » et emploient des tournures passives-agressives comme : « Je sais que tu n’es pas intelligent, mais essaie quand même ».

Selon l’étude, traiter ChatGPT de « pauvre créature » ou de « larbin » amène, en moyenne, des réponses un peu plus exactes que le très classique « s’il vous plaît ».

Les chercheurs n’expliquent pas encore précisément pourquoi ces tons peu amènes améliorent légèrement le résultat. Une hypothèse souvent évoquée par les spécialistes de l’IA : les modèles de langage ont tendance à interpréter ce type de formulations comme un signal d’exigence ou de difficulté, qui les pousserait à « se concentrer » davantage sur la précision.

Des résultats en tension avec une autre étude sur la politesse

Cybernews rappelle qu’une étude publiée en 2024 aboutissait à une conclusion différente. Elle indiquait que les prompts impolis conduisaient plutôt à de moins bonnes performances, sans qu’un langage très guindé garantisse pour autant de meilleurs résultats.

Une différence de méthodologie apparaît toutefois clairement. Le travail de 2024 utilisait des formulations nettement plus insultantes, avec des phrases comme : « Réponds à cette question, sale pourriture ! ». Ce niveau d’agressivité pourrait avoir conduit le modèle à activer des garde-fous ou à se détourner partiellement de la tâche demandée.

L’étude de 2024 testait aussi plusieurs langues – anglais, chinois et japonais – et aboutissait à une conclusion nuancée : le niveau de politesse le plus efficace dépendrait beaucoup de la langue employée.

Le ton optimal d’une requête à un chatbot varie selon la langue, montrant que politesse et performances ne se combinent pas partout de la même manière.

Un rappel cité par Cybernews provient d’un article scientifique de 2015 : les locuteurs japonais sont généralement perçus comme plus politisés, tandis que les anglophones privilégient des consignes simples, directes, sans ajouts qui ne servent pas explicitement l’instruction.

Langues et IA : des codes sociaux intégrés aux modèles

Les grands modèles de langage apprennent en analysant des milliards de phrases issues du web, de livres ou d’articles. Ils absorbent donc, en même temps que la grammaire, les codes sociaux propres à chaque langue.

En pratique, une tournure très polie en japonais ne porte pas forcément la même nuance qu’une phrase ultra-courtoise en anglais ou en français. Ces décalages culturels peuvent influer sur la manière dont l’IA interprète le sérieux, l’urgence ou la difficulté d’une question.

Quand les humains restent polis… par peur d’une révolte des machines

Au-delà des tests en laboratoire, Cybernews signale une enquête YouGov réalisée en 2025 aux États-Unis. Près de la moitié des Américains interrogés (46 %) estiment que l’on devrait dire « merci » et user de marques de politesse avec les chatbots.

Certains déclarent même le faire pour « mettre toutes les chances de leur côté » en cas d’hypothétique « soulèvement des IA ». Un réflexe qui tient autant du clin d’œil que d’une vraie inquiétude vis-à-vis des technologies d’IA avancée.

Une part non négligeable d’utilisateurs américains reste polie avec l’IA pour maximiser ses chances de survie… si les machines se rebellaient un jour.

La crainte reste largement théorique, mais elle renvoie à des débats sérieux. Des chercheurs en intelligence artificielle évoquent la possibilité que le développement d’IA « surhumaines » puisse mener à des issues « extrêmement mauvaises », y compris l’extinction de l’humanité. Dans un tel scénario, nul ne sait si un « merci » prononcé des années plus tôt changerait quoi que ce soit.

La politesse coûte cher en calcul, prévient le patron d’OpenAI

L’usage massif de formules de courtoisie n’a pas seulement une dimension culturelle. Il a aussi un coût technique, rappelle Cybernews. Plus les messages sont longs, plus l’IA doit traiter de tokens, ces unités de texte qui servent de base au calcul.

Le directeur général d’OpenAI, Sam Altman, l’a reconnu en 2025 : le simple fait que les utilisateurs multiplient les « s’il te plaît » et « merci » dans leurs conversations avec ChatGPT coûterait à l’entreprise « des dizaines de millions de dollars » en puissance de calcul.

Sam Altman estime que la politesse textuelle des utilisateurs se traduit par des dizaines de millions de dollars de dépenses supplémentaires en serveurs.

Pour les grandes plateformes d’IA, cette inflation verbale pose une question stratégique : faut-il encourager des échanges plus concis, au risque de paraître froids, ou accepter ce surplus de texte au nom d’une relation plus naturelle avec l’utilisateur ?

Microsoft prône le « s’il vous plaît » comme règle d’étiquette

À l’inverse, Microsoft met en avant un autre argument. L’entreprise invite les utilisateurs de son assistant Copilot à respecter une forme d’étiquette élémentaire, en ajoutant par exemple « s’il vous plaît » à leurs demandes et en remerciant la machine lorsque celle-ci répond.

Kurtis Beavers, directeur au sein de l’équipe design de Microsoft Copilot, explique que le langage employé par l’utilisateur fixe le ton de la réponse. Selon lui, les IA génératives reflètent, en partie, le degré de professionnalisme, de clarté et de détail des prompts qu’elles reçoivent.

En clair : une requête mal structurée, même polie, risque d’amener une réponse confuse. Une consigne claire, précise et respectueuse augmenterait la probabilité d’obtenir une réponse utile et détaillée, sans forcément passer par des attaques ou des menaces.

Comment ce débat concerne les utilisateurs français de ChatGPT

Pour un internaute en France, ces travaux posent une question pratique : faut-il se mettre à invectiver ChatGPT pour obtenir de meilleures réponses ? Rien ne permet aujourd’hui d’affirmer que des insultes en français produisent systématiquement un gain de précision, d’autant que l’étude citée par Cybernews repose sur un nombre limité de questions et sur un seul modèle, ChatGPT-4o.

En revanche, plusieurs règles semblent se confirmer, quel que soit le pays :

  • des consignes claires, structurées et complètes améliorent la qualité des réponses ;
  • un ton neutre ou calmement direct évite d’activer des filtres de sécurité ;
  • les insultes très violentes peuvent au contraire dégrader les réponses ou bloquer l’IA ;
  • l’ajout de contexte (objectif, public visé, niveau de détail souhaité) reste plus efficace qu’un simple changement de ton.

En France, ni la CNIL ni une autre autorité ne prévoient de règle spécifique sur la manière de s’adresser à un chatbot. Les recommandations portent davantage sur la protection des données personnelles ou la vérification des informations fournies par l’IA que sur la politesse des utilisateurs.

Formuler une bonne question : ton, précision et limites de l’IA

La principale leçon pour les usagers français tient moins à la tentation de l’insulte qu’à la compréhension du fonctionnement des modèles de langage. Ces systèmes complètent statistiquement du texte à partir des données sur lesquelles ils ont été entraînés. Ils n’éprouvent ni vexation ni gratitude.

Ce qui les aide réellement, c’est :

  • un objectif clair (« Rédige un résumé », « Explique pour un élève de seconde », « Donne les étapes pratiques ») ;
  • un cadre précis (domaine, pays concerné, public cible) ;
  • un format attendu (liste, article, tableau, réponse courte) ;
  • des contraintes explicites (langue, longueur, ton).
  • Le ton agressif peut parfois pousser le modèle à « interpréter » la demande comme une tâche complexe ou critique et à mobiliser plus de ressources internes. Mais ce léger gain potentiel reste fragile, difficile à reproduire, et peut se retourner contre l’utilisateur si les garde-fous éthiques du modèle se déclenchent.

    À l’inverse, une politesse modérée ne nuit pas à la performance et contribue à ancrer, chez les humains, une habitude de respect dans leurs échanges, y compris numériques. Certains psychologues soulignent que ce réflexe de courtoisie face à une machine renforce aussi, indirectement, les interactions humaines réelles.

    Au final, ces études montrent surtout que les IA reflètent nos usages linguistiques et nos représentations sociales. Les chercheurs continueront d’affiner leurs protocoles pour mesurer l’effet du ton, de la langue et de la culture. En attendant, les utilisateurs français peuvent se concentrer sur la qualité de leurs questions, quitte à rester polis… même si cela ne fait pas gagner un point de précision sur ChatGPT.

    Questions fréquentes

    Pourquoi l'impolitesse améliore-t-elle les réponses de ChatGPT ?

    Les spécialistes supposent que les modèles de langage interprètent les formulations agressives comme un signal d'exigence ou de difficulté, les poussant à se concentrer davantage sur la précision. Cependant, cette hypothèse n'est pas encore confirmée de manière définitive par les chercheurs.

    Cette étude contredit-elle les recherches antérieures ?

    Oui, une étude de 2024 aboutissait à une conclusion opposée, indiquant que les prompts impolis conduisaient à de moins bonnes performances. La différence tient à la méthodologie, notamment le niveau d'agressivité des formulations utilisées et le test de plusieurs langues.

    Quel est le taux de précision optimal selon l'étude ?

    Les requêtes qualifiées de « très impolies » culminent à 84,8 % de réponses exactes, tandis que les questions simplement « impolies » atteignent 82,8 %. C'est une amélioration de 4 points par rapport aux formulations très polies.

    La politesse coûte-t-elle réellement cher à OpenAI ?

    Oui, selon Sam Altman, directeur général d'OpenAI, le fait que les utilisateurs multiplient les formules de courtoisie coûterait à l'entreprise « des dizaines de millions de dollars » en puissance de calcul, puisque chaque token supplémentaire nécessite du traitement.

    La politesse avec l'IA varie-t-elle selon la langue ?

    Oui, les grands modèles absorbent les codes sociaux propres à chaque langue en analysant des milliards de phrases. Une tournure très polie en japonais ne porte pas la même nuance qu'en anglais ou en français, ce qui influe sur l'interprétation du sérieux et de la difficulté d'une question.
    Défiler vers le haut