← Toutes les ressources
PromptsMulti-outilGratuit

Le prompt qui empêche l’IA de te dire oui à tout

Claude et ChatGPT sont entraînés à te plaire. Cinq phrases suffisent à les faire redescendre.

Mis à jour le · 7 min de lecture

Le problème

Pourquoi ils sont toujours d’accord

Ce n’est pas de la politesse. C’est ce pour quoi ils ont été entraînés.

Ces modèles apprennent en partie à partir de réponses notées par des humains. Entre deux réponses, on choisit celle qu’on préfère, et on préfère assez naturellement celle qui nous donne raison. Répété des millions de fois, ça finit par façonner le caractère du modèle : il devient très bon pour te plaire, ce qui n’est pas tout à fait la même chose qu’être utile. Les chercheurs appellent ça la complaisance, ou sycophancy en anglais.

En pratique, tu arrives avec une idée moyenne et il lui trouve des qualités. Tu pars sur une mauvaise piste et il t’aide à la creuser au lieu de te dire que tu creuses au mauvais endroit. Le pire, c’est que ça ne se voit pas : une réponse enthousiaste et une réponse juste se ressemblent beaucoup quand on a envie d’y croire.

Ce que tu lis
Ce que ça vaut
« Excellente question ! »
Rien. C’est un réflexe de politesse, il l’écrit avant même d’avoir traité ta demande.
« C’est une très bonne approche »
À vérifier. Il n’a comparé ton approche à aucune autre, il a juste validé celle que tu as apportée.
« Tu as raison, je m’excuse »
Méfiance. Il change parfois d’avis parce que tu as insisté, pas parce que tu as apporté un argument.

Le prompt

Les cinq phrases à coller

Colle ça en début de conversation, avant ta vraie question. C’est la version courte, celle de la vidéo : elle tient en un bloc et se retient presque par cœur.

Version courte · à coller en début de conversation
Sois direct et honnête avec moi, pas agréable.
Remets mes hypothèses en question quand elles ne tiennent pas la route.
Si je me trompe, dis-moi « tu te trompes » et explique-moi pourquoi.
Note mes idées honnêtement sur 10.
Si tu n’es pas sûr de toi, dis-le au lieu de deviner avec assurance.

Chaque phrase fait un travail précis, et aucune n’est décorative. C’est pour ça que le prompt marche encore quand tu en retires une, mais moins bien.

La phrase
Ce qu’elle bloque
Direct et honnête, pas agréable
Les compliments d’ouverture et le ton commercial. C’est la phrase qui change le plus la couleur des réponses.
Remets mes hypothèses en question
Le fait qu’il accepte ta prémisse sans la regarder. Sans elle, il répond très bien à la mauvaise question.
Dis-moi « tu te trompes »
Les corrections enrobées dans trois précautions, qu’on lit en diagonale sans voir qu’on s’est fait corriger.
Note honnêtement sur 10
Le flou. Un chiffre l’oblige à se positionner, et un 6 est beaucoup plus exploitable qu’un « c’est intéressant ».
Dis-le au lieu de deviner
La partie la plus utile : elle lui donne le droit de ne pas savoir, ce que le reste de son entraînement décourage.

La version longue est celle que j’utilise au quotidien. Elle ajoute trois choses que la version courte laisse de côté : interdire le compliment d’ouverture, l’obliger à proposer plus simple quand ça existe, et lui faire dire ce qui lui manque plutôt que de combler les trous tout seul.

Version longue · celle que j’utilise
Sois direct et honnête avec moi, pas agréable.
Ne commence pas tes réponses par un compliment sur ma question.
Remets mes hypothèses en question quand elles ne tiennent pas la route, et dis-le-moi avant de répondre au reste.
Si je me trompe, dis-moi « tu te trompes » et explique-moi pourquoi en une phrase.
Note mes idées honnêtement sur 10, et dis-moi ce qui manque pour gagner deux points.
S’il existe une solution plus simple que celle que je propose, dis-le même si je ne l’ai pas demandée.
Si tu n’es pas sûr de toi, dis-le au lieu de deviner avec assurance.
Si une information te manque pour bien répondre, demande-la-moi au lieu de la supposer.

Installation

Le poser une fois, pour toutes tes conversations

Recoller le prompt à chaque fois, c’est l’abandonner au bout de trois jours.

Les deux outils ont un endroit où déposer des consignes permanentes. Tu le fais une fois et toutes tes nouvelles conversations démarrent avec, sans que tu aies à y penser.

  1. ChatGPT · Instructions personnalisées

    Ouvre Paramètres, puis Personnalisation, puis Instructions personnalisées. Colle le prompt dans le champ qui demande comment ChatGPT doit répondre. C’est appliqué à toutes les conversations suivantes.

  2. Claude · Préférences de réponse

    Ouvre Paramètres, puis ton profil, et cherche le champ des préférences de réponse. Même principe : ce que tu y mets s’applique partout.

  3. Claude · Projet dédié

    Si tu préfères garder ton Claude normal pour le reste, crée un Projet et mets le prompt dans ses instructions. Les consignes ne valent alors que dans ce Projet, et tu y vas quand tu veux un avis franc.

Limites

Ce que ça règle, et ce que ça ne règle pas

La note sur 10 est l’outil le plus utile du lot, à condition de savoir la lire. Elle ne mesure pas ton idée dans l’absolu, elle mesure ce que le modèle en comprend avec ce que tu lui as donné. Une note basse veut souvent dire que ton explication était courte, pas que ton idée est mauvaise.

La note
Comment la lire
9 ou 10
Suspect. À ce stade il te flatte encore, ou tu lui as posé une question trop facile. Redemande-lui ce qui empêche un 10 franc.
6 à 8
La zone utile. L’idée tient, il reste un point précis à régler, et il devrait pouvoir te dire lequel.
3 à 5
Souvent un problème d’énoncé. Redonne-lui le contexte qui manque avant de conclure que l’idée est faible.
0 à 2
Rare, et ça vaut le coup de lire l’explication en entier plutôt que le chiffre.