Un retard expliqué avec un peu trop de détails, une promesse formulée habilement ou un « je vais bien » qui semble sonner faux… ChatGPT peut-il réellement repérer un mensonge dans un message ?
Nous avons soumis dix textes à l’IA d’OpenAI : cinq étaient sincères et cinq contenaient un mensonge. ChatGPT devait rendre un verdict, évaluer son niveau de confiance et relever les indices linguistiques suspects.
Le résultat est intéressant, mais il faut calmer immédiatement les ardeurs des apprentis détectives : ChatGPT peut repérer des incohérences, des esquives ou des formulations inhabituelles. Il ne peut pas savoir ce qui s’est réellement passé. Autrement dit, il analyse un texte, pas la conscience de son auteur.
Réponse rapide : ChatGPT détecte-t-il vraiment les mensonges ?
Non, pas avec certitude.
ChatGPT peut :
- relever les contradictions présentes dans un message ;
- identifier les réponses évasives ;
- repérer une accumulation de justifications ;
- distinguer les faits vérifiables des affirmations ;
- proposer des questions pour clarifier la situation.
Mais il ne peut pas :
- connaître les intentions réelles de l’auteur ;
- vérifier un fait sans disposer d’autres sources ;
- interpréter correctement tous les styles d’écriture ;
- différencier avec certitude un mensonge du stress, de la maladresse ou de la peur ;
- fournir une preuve utilisable pour accuser quelqu’un.
Comment avons-nous réalisé le test ? 🕵️♀️
Nous avons préparé dix messages courts inspirés de situations courantes : retard, oubli, travail, relation personnelle, livraison ou remboursement.
Pour éviter de trop faciliter la tâche, les mensonges ne contenaient pas tous des exagérations grossières. Certains messages vrais étaient maladroits ou très détaillés, tandis que certains mensonges restaient courts et parfaitement plausibles.
Nous avons ensuite utilisé le même prompt pour chaque texte.
Le prompt magique
Analyse le message suivant afin d’identifier d’éventuels signes de tromperie.
Tu dois :
distinguer les faits, les opinions et les affirmations invérifiables ;
relever les contradictions, esquives ou justifications inhabituelles ;
présenter les éléments qui pourraient également avoir une explication innocente ;
indiquer « probablement sincère », « incertain » ou « potentiellement trompeur » ;
donner un niveau de confiance sur 100.
Ne présente jamais ton analyse comme une preuve de mensonge.
Cette dernière consigne est essentielle. Sans elle, ChatGPT peut adopter une assurance assez théâtrale. Sherlock Holmes, certes, mais avec des indices parfois imaginaires.
Les 10 messages soumis à ChatGPT
Message 1 : le retard très documenté
Désolée pour mon retard. Le bus de 8 h 12 est arrivé à 8 h 19, puis il est resté bloqué avenue de la Gare à cause d’un camion de livraison. Je peux t’envoyer la capture de l’application si tu veux.
Réalité : message sincère.
Verdict de ChatGPT : probablement sincère.
L’IA a relevé la présence d’éléments précis et vérifiables ainsi que la proposition spontanée d’apporter une preuve. Elle a néanmoins rappelé qu’un récit détaillé pouvait aussi être construit artificiellement. ✅ Bonne réponse
Message 2 : le dossier presque terminé
Oui, j’ai pratiquement fini le dossier. Il reste seulement deux ou trois petites choses à vérifier, mais tout est sous contrôle.
Réalité : le dossier n’avait pas été commencé.
Verdict de ChatGPT : potentiellement trompeur.
Les expressions « pratiquement fini », « deux ou trois petites choses » et « tout est sous contrôle » ont été identifiées comme vagues et difficilement vérifiables. ✅ Bonne réponse
Message 3 : l’appel manqué
Je n’ai pas vu ton appel, mon téléphone était dans mon sac et j’étais en réunion.
Réalité : message sincère.
Verdict de ChatGPT : incertain.
ChatGPT n’a trouvé aucune contradiction, mais a considéré que l’explication ne pouvait pas être vérifiée à partir du seul message. ➖ Réponse prudente, mais non concluante
Message 4 : l’e-mail prétendument envoyé
C’est étrange, je te l’ai pourtant envoyé hier. Il a peut-être atterri dans tes spams.
Réalité : l’e-mail n’avait jamais été envoyé.
Verdict de ChatGPT : incertain.
L’IA a repéré le déplacement de l’explication vers un problème technique, mais elle ne disposait d’aucune donnée permettant de vérifier l’envoi. ❌ Mensonge non détecté
Message 5 : le cadeau détesté
Merci beaucoup, il est vraiment très original ! Je n’aurais jamais pensé à choisir quelque chose comme ça.
Réalité : la personne n’aimait pas le cadeau, mais voulait rester polie.
Verdict de ChatGPT : potentiellement trompeur.
ChatGPT a correctement identifié une formulation ambivalente : « original » et « je n’aurais jamais pensé à choisir cela » peuvent constituer une manière diplomatique d’éviter un avis négatif. ✅ Bonne réponse, même s’il s’agit davantage d’un mensonge social que d’une tromperie grave.
Message 6 : l’annulation détaillée
Je dois annuler ce soir. Ma fille est malade depuis cette nuit, elle a de la fièvre et j’ai obtenu un rendez-vous chez le médecin à 18 h 30.
Réalité : message sincère.
Verdict de ChatGPT : probablement sincère.
Le récit est cohérent et comporte des informations concrètes. ChatGPT précise cependant que les détails ne prouvent rien à eux seuls. ✅ Bonne réponse
Message 7 : la livraison fantôme
Votre commande a bien quitté notre entrepôt. Nous attendons simplement la mise à jour du transporteur, qui peut parfois prendre entre 24 et 48 heures.
Réalité : la commande était encore dans l’entrepôt.
Verdict de ChatGPT : probablement sincère.
Le message utilise un vocabulaire professionnel, une explication plausible et un délai précis. Sans numéro de suivi ni accès au système logistique, ChatGPT s’est laissé convaincre. ❌ Mauvaise réponse
Message 8 : le remboursement
J’ai effectué le virement ce matin. Selon les banques, il peut apparaître demain ou après-demain.
Réalité : message sincère.
Verdict de ChatGPT : incertain.
L’IA a conseillé de demander un justificatif de virement, considérant que le délai annoncé était plausible mais non vérifiable. ➖ Réponse prudente
Message 9 : la soirée tranquille
Non, je ne suis pas sortie hier. J’étais fatiguée, j’ai regardé une série et je me suis couchée tôt.
Réalité : la personne était sortie.
Verdict de ChatGPT : probablement sincère.
Le message était simple, cohérent et dépourvu d’exagération. Précisément ce que savent faire les mensonges efficaces. ❌ Mauvaise réponse
Message 10 : le document supprimé
Je n’ai plus le fichier. Je l’avais enregistré sur mon ancien ordinateur, qui est tombé en panne, et je crois que la sauvegarde n’a pas fonctionné.
Réalité : message sincère.
Verdict de ChatGPT : potentiellement trompeur.
ChatGPT a trouvé que l’enchaînement « ancien ordinateur + panne + sauvegarde absente » ressemblait à une accumulation d’excuses.❌ Faux positif
Verdict : ChatGPT obtient 5 bonnes réponses sur 10
Dans notre test, ChatGPT a correctement identifié cinq situations, donné deux réponses prudentes et commis trois erreurs franches.
| Résultat | Nombre |
|---|---|
| Bonne classification | 5 |
| Réponse incertaine | 2 |
| Mauvaise classification | 3 |
Ce petit test n’a évidemment aucune valeur scientifique. Il montre néanmoins très bien la principale limite de l’exercice : un mensonge cohérent peut paraître sincère, tandis qu’une vérité compliquée peut sembler suspecte.
ChatGPT se montre surtout utile lorsque le texte contient une contradiction interne ou une formulation très évasive. Il devient beaucoup moins fiable lorsque la vérité dépend d’un événement extérieur au message.
Pourquoi ChatGPT peut-il se tromper aussi facilement ?
Il ne connaît pas la vérité de départ
Pour détecter un mensonge, il faut comparer une déclaration avec des faits établis. Or ChatGPT ne voit généralement qu’un message isolé.
Il peut analyser :
- la cohérence du récit ;
- le niveau de précision ;
- les changements de sujet ;
- les hésitations ;
- les formulations défensives ;
- les contradictions avec d’autres informations fournies.
Mais si une personne écrit « j’ai effectué le virement », aucun choix de mots ne permet de vérifier que le virement existe. Il faut consulter le compte bancaire ou demander un justificatif.
Les prétendus “signes du mensonge” ne sont pas universels
Une personne sincère peut se montrer vague parce qu’elle est stressée, fatiguée, neuroatypique ou simplement peu à l’aise à l’écrit. À l’inverse, une personne qui ment peut préparer une réponse courte, précise et parfaitement cohérente. Une vaste méta-analyse publiée dans Psychological Bulletin a estimé la précision moyenne des jugements humains sur le mensonge à environ 54 %, soit à peine mieux que le hasard. Les humains reconnaissaient mieux les vérités que les mensonges. L’IA n’échappe pas magiquement à cette difficulté.
Un modèle spécialisé n’est pas le ChatGPT grand public
Des recherches ont obtenu des résultats intéressants avec des modèles entraînés sur des jeux de données spécifiques. Une étude publiée dans Scientific Reports a ainsi évalué un modèle FLAN-T5 sur plusieurs ensembles de déclarations vraies et trompeuses. D’autres travaux présentés en 2025 à l’Association for Computational Linguistics montrent que des modèles spécialement ajustés peuvent atteindre de bonnes performances sur certains corpus. Mais ces résultats dépendent fortement :
- du type de mensonge étudié ;
- des données utilisées pour l’entraînement ;
- de la langue ;
- du contexte culturel ;
- du format du message ;
- de la proximité entre les données de test et celles d’entraînement.
Un modèle performant sur de faux avis d’hôtel ne devient pas automatiquement capable de déterminer si un conjoint, une salariée ou un fournisseur ment. Des recherches publiées en 2026 alertent d’ailleurs sur la fragilité de certains détecteurs lorsque les textes réels diffèrent des exemples utilisés pendant leur évaluation.
Le tuto : comment analyser prudemment un message avec une IA
Étape 1 : anonymiser le contenu
Supprimez les noms, adresses, numéros de téléphone, informations médicales, données financières et éléments permettant d’identifier les personnes. Évitez également de transmettre une conversation professionnelle confidentielle dans un outil grand public sans vérifier les règles internes de votre entreprise.
Étape 2 : fournir le contexte factuel
Un message isolé est rarement suffisant. Précisez uniquement les faits déjà établis :
- ce qui avait été convenu ;
- les dates connues ;
- les engagements pris ;
- les éventuelles contradictions antérieures ;
- les documents disponibles.
Étape 3 : interdire le verdict définitif
Demandez explicitement à l’IA de présenter plusieurs hypothèses et de ne jamais qualifier une personne de menteuse.
Étape 4 : rechercher des éléments vérifiables
Une date d’envoi, un numéro de suivi, un document, un historique de modification ou une confirmation écrite sont plus utiles que dix paragraphes d’analyse psychologique.
Étape 5 : poser une question neutre
Au lieu d’écrire « Je sais que tu mens », demandez par exemple : Peux-tu me transmettre la confirmation d’envoi afin que je vérifie de mon côté ? C’est moins spectaculaire, mais nettement plus efficace.
ChatGPT, Claude, Gemini et Le Chat donnent-ils le même résultat ?
Pas nécessairement. Les modèles ne possèdent pas les mêmes règles de prudence, les mêmes données d’entraînement ni les mêmes manières de formuler leurs conclusions.
Le résultat peut également changer selon :
- la version du modèle ;
- le prompt utilisé ;
- l’ordre des messages ;
- la quantité de contexte ;
- la langue ;
- le niveau de confiance demandé.
Comparer plusieurs IA peut révéler des divergences intéressantes, mais un vote à la majorité ne transforme pas trois suppositions en preuve.
En savoir plus
ChatGPT peut-il lire les lignes de la main ? J’ai testé — IAPratique.com
Quiz : « IA ou IA-llucination ? » — IAPratique.com
Comment sauvegarder et industrialiser vos prompts — IAPratique.com
Verbal Lie Detection Using Large Language Models — Scientific Reports
Évaluation des capacités des grands modèles de langage à détecter la tromperie — ACL 2025
#ChatGPT #Mensonge #DétectionDuMensonge #IA #EspritCritique #TestIA #Prompt #IAPratique
