L’IA destinée à la clientèle représente votre marque et exige un savoir-faire radicalement différent de celui des outils internes.
La différence entre un agent fonctionnel et un agent convaincant est plus conceptuelle que technique, car la plupart des invites sont rédigées comme des ensembles d’instructions plutôt que comme des modèles de dialogue.
La linguistique et la psychologie cognitive offrent un meilleur cadre : les conversations ont une structure et les invites créent un environnement attentionnel. Ce que vous placez au début, ce que vous répétez et votre façon de conclure orienteront invariablement le comportement de l’agent.
Les contraintes sont utiles, mais seulement lorsqu’elles sont précises. Trop de cas limites rendent les interactions guindées et les invites lourdes; avoir moins de décisions à prendre permet donc de se concentrer sur les plus importantes.
Créer une IA conversationnelle destinée à la clientèle est intimidant pour une entreprise.
Même pour les entreprises qui adoptent la technologie avec enthousiasme, qui ont intégré la collaboration avec l’IA au travail de chaque employé et qui ont peut-être même conçu des outils d’IA sur mesure à l’interne, faire de l’IA l’interface entre leur entreprise et le monde est une tout autre affaire.
Et il s’agit bien d’une promotion. Lorsqu’elle interagit avec la clientèle, l’IA passe du statut de stagiaire assidue à celui d’employée officiellement reconnue : elle enfile l’uniforme et représente la marque aux yeux des clients.
Les enjeux sont importants. Chaque faux pas est désormais public et potentiellement enregistré.
Les produits que nous créons sont souvent des systèmes multiagents aux interactions complexes sur le plan opérationnel. Cette logique peut toutefois être la partie la plus facile. Le plus grand défi consiste à convaincre les utilisateurs qu’ils parlent constamment au même agent et que ses propos en valent la peine.
Nous rédigeons et réécrivons donc les invites, encore et encore.
Certains agents sont le fruit de centaines d’itérations d’invites. Tous ont le même objectif : rester concentrés sur leur tâche et s’exprimer d’une voix qui trouve écho chez les utilisateurs humains.
Notre expérience du processus de perfectionnement des invites nous a poussés à chercher l’inspiration de façon créative. Nous avons commencé à emprunter des idées à d’autres disciplines. Bien sûr, tout n’a pas fonctionné, et ce qui a fonctionné a rarement réussi du premier coup. Ces explorations ont fait émerger au sein de notre équipe un paradigme différent pour la conception d’invites.
L’écart entre un agent systématiquement fonctionnel et un agent brillant en conversation n’est pas purement technique : il est conceptuel. Il correspond à la distance entre le monde dans lequel votre invite situe l’agent et le monde réel de la communication humaine dans lequel il évolue.
Ce dernier se définit par son ambiguïté, à laquelle les humains sont bien adaptés et dans laquelle les interlocuteurs de bonne foi évoluent de concert grâce à un ensemble de règles discursives subtiles et tacites. Un agent mal outillé se remarque immédiatement.
Pour préserver le quatrième mur, ou l’illusion de Turing, nous pouvons ancrer nos agents dans l’art du dialogue en nous inspirant de la linguistique et de la psychologie cognitive.
La linguistique offre toute une boîte à outils pour étudier le langage en action, notamment l’analyse conversationnelle, qui examine comment les gens structurent et gèrent leurs conversations à chaque instant. Appliqué aux invites, ce cadre nous donne un vocabulaire pour envisager la conversation non pas comme un échange de mots, mais comme un échange d’actions.
Certaines actions sont pratiques, comme obtenir ou transmettre de l’information, tandis que d’autres sont sociales, comme entretenir le lien ou éviter les frictions. Ces interventions s’inscrivent dans la structure générale du dialogue et de ses phases, chacune comportant des actions attendues. Les dialogues ont un début et une fin, mais aussi des changements de sujet et même des prétransitions : ces moments parfois gênants où une nouvelle direction est subtilement proposée, négociée et décidée entre les lignes.
Les malentendus sont fréquents, même lorsque toutes les parties ont les meilleures intentions. Bien que les gens maîtrisent l’art du dialogue à divers degrés, le fait est que le LLM derrière votre agent n’est pas doté d’emblée de l’intuition que possède même la personne moyenne en matière de communication.
En complément de l’analyse linguistique, la psychologie cognitive apporte une autre perspective. Elle nous explique le fonctionnement réel de l’attention, de la mémoire et de la prise de décision : l’importance accordée à ce qui vient en premier plutôt qu’en dernier, la façon dont des déclencheurs précis produisent un comportement fiable et la façon dont les contraintes peuvent libérer en réduisant la charge cognitive.
Une invite n’est pas un contenant neutre pour des instructions. C’est un environnement attentionnel. Ce qui se trouve au début compte donc. Ce qui se trouve à la fin compte. Ce qui est répété compte. Devant une liste, les gens ont tendance à se souvenir plus facilement du début et de la fin que du milieu. Les psychologues appellent ce phénomène l’effet de position sérielle : primauté et récence.
En pratique, nous observons un phénomène semblable chez les LLM. Les premières consignes établissent le cadre : qui est l’agent, quel rôle il joue et à quel genre de monde il s’attend. Les consignes finales agissent souvent comme « la dernière chose qu’il entend ». Si nous y plaçons nos instructions les plus importantes, elles ont plus de chances d’être appliquées.
Tout en choisissant soigneusement où placer les différentes instructions dans notre invite, nous devons aussi suivre la forme générale de la limite qu’elles créent pour notre agent.
Les instructions imposent des contraintes à notre agent, réduisant le nombre de possibilités concurrentes qu’il doit départager et circonscrivant l’espace global du problème. Nos invites doivent imposer assez de contraintes pour rendre la tâche de l’agent gérable.
Lorsque nous donnons des instructions à des employés, surtout aux moins expérimentés, la psychologie nous enseigne qu’il vaut mieux lever l’ambiguïté de la tâche afin de réduire autant que possible la charge cognitive. Les contraintes peuvent sembler limiter notre liberté, mais avoir moins de décisions à prendre nous permet de nous concentrer sur les quelques décisions importantes qui restent et de faire preuve de créativité dans l’exécution de nos actions à l’intérieur de ces limites.
À l’inverse, tenter de ne laisser à notre agent aucune décision à prendre en couvrant tous les cas limites imaginables avec des listes d’exemples de comportements est un excellent moyen de créer un interlocuteur guindé, sans parler d’une invite Frankenstein, lourde et truffée de conditions, qui devient un cauchemar à gérer.
(Les exemples few-shot, c’est de vous qu’on parle.)
Une invite bien délimitée fournit une orientation assez claire sans surcharger les consignes ni paralyser l’agent. Cela signifie souvent de présenter moins de cas limites ou de cibles à l’agent, tant pour ce qu’il doit ou ne doit pas dire que pour la façon dont il doit ou ne doit pas le dire.


D’après notre expérience, si vous avez recours à une approche few-shot pour ajuster votre limite, celle-ci manque de précision. Revenez aux instructions fondamentales et peaufinez-les.
Du point de vue de la psychologie cognitive, nous avons réfléchi à l’emplacement des différentes instructions dans une invite ainsi qu’à la quantité et à la qualité des instructions nécessaires pour bien circonscrire l’espace du problème de notre agent.
En reprenant nos observations précédentes sur l’art du dialogue du point de vue linguistique, nous pouvons compléter notre paradigme de conception d’invites en intégrant les instructions axées sur le dialogue aux limites générales de la tâche de notre agent.
Pour une IA destinée à la clientèle, le dialogue est toujours la métatâche, que nous le reconnaissions ou non. Lorsque nous choisissons d’aborder délibérément le dialogue dans notre invite, nous consacrons une partie de la capacité, ou « charge cognitive », de notre agent à la compréhension du dialogue et à la réactivité, améliorant ainsi son aptitude conversationnelle.
En contrepartie, nous devrons probablement réduire l’ampleur de la tâche principale afin que l’espace global du problème demeure gérable et bien délimité.
Pour une IA destinée à la clientèle, nous concevons donc les conditions propices à de meilleurs dialogues et à de meilleures décisions dans une perspective globale. Nous privilégions de petits agents bien délimités, dont la tâche principale est contextualisée dans la métatâche du dialogue ou l’inclut. Nous ne rédigeons pas des montagnes d’instructions à peaufiner au moyen d’exemples. Nous rédigeons plutôt un petit ensemble d’instructions peaufinées, assez précises pour rendre les exemples superflus.
Voilà le paradigme de conception d’invites que nous utilisons pour créer des agents qui restent concentrés sur leur tâche tout en faisant preuve d’élégance conversationnelle.
Maintenant que le paysage conceptuel est tracé, notre prochain billet sera plus pratique. Nous examinerons certains modèles clés issus de nos efforts visant à appliquer ces principes aux invites par des essais et des erreurs en conditions réelles. Fait intéressant, les fournisseurs de modèles de pointe commencent à présenter des tendances semblables dans leurs propres conseils sur la conception d’invites. Nous poursuivrons la prochaine fois.