La IA orientada als clients representa la teva marca i exigeix un treball d'una naturalesa completament diferent del de les eines internes.
La diferència entre un agent funcional i un de convincent és més conceptual que tècnica, perquè la majoria d'indicacions s'escriuen com a conjunts d'instruccions, no com a dissenys de diàleg.
La lingüística i la psicologia cognitiva ofereixen un marc millor: les converses tenen una estructura i les indicacions creen un entorn d'atenció. El que escrius al principi, el que repeteixes i la manera d'acabar determinaran de manera fiable el comportament de l'agent.
Les restriccions ajuden, però només quan són precises. Un excés de casos límit genera interaccions encarcarades i indicacions difícils de gestionar; tenir menys decisions per prendre permet centrar-se en les més importants.
Crear una IA conversacional orientada als clients és una tasca intimidant per a qualsevol empresa.
Fins i tot per a qui ha adoptat la tecnologia amb gran entusiasme, ha incorporat la col·laboració amb la IA a la feina de cada empleat i potser fins i tot ha desenvolupat eines d'IA personalitzades per a ús intern, situar la IA a la interfície entre l'empresa i el món és tota una altra qüestió.
I també tot un ascens. Quan la IA passa a tractar amb els clients, deixa de ser una becària diligent i es converteix en una empleada amb el suport de l'empresa: es posa l'uniforme i representa la marca davant dels clients.
Hi ha molt en joc. Ara, cada error és públic i pot quedar enregistrat.
Els productes que creem solen ser sistemes multiagent amb interaccions complexes en l'àmbit empresarial. Tanmateix, aquesta lògica pot ser la part més fàcil. El repte principal és convèncer els usuaris que parlen amb un únic agent tota l'estona i que el que diu aquest agent val la pena.
Per això escrivim i reescrivim les indicacions tantes vegades.
Alguns agents són el resultat de centenars d'iteracions de les indicacions. Tots tenen el mateix objectiu: mantenir-se centrats en la tasca i parlar amb una veu que connecti amb els usuaris humans.
L'experiència adquirida refinant indicacions ens ha portat a buscar inspiració de manera creativa. Hem començat a manllevar idees d'altres disciplines. Naturalment, no tot ha funcionat, i el que sí que ho ha fet gairebé mai no ha sortit bé al primer intent. Com a resultat d'aquesta exploració, dins del nostre equip ha sorgit un paradigma diferent per crear indicacions.
La distància entre un agent que funciona sistemàticament i un de brillant en la conversa no és purament tècnica, sinó conceptual. És la distància entre el món on has situat l'agent mitjançant la indicació i el món real de la comunicació humana on opera.
Aquest darrer món es caracteritza per l'ambigüitat, a la qual les persones estan ben adaptades i que els interlocutors de bona fe aborden cooperativament mitjançant un conjunt de regles discursives subtils i tàcites. Un agent mal preparat es detecta de seguida.
Per preservar la quarta paret, o la il·lusió de Turing, podem fonamentar els nostres agents en l'art del diàleg aplicant coneixements de lingüística i psicologia cognitiva.
La lingüística disposa de tot un conjunt d'eines per estudiar la llengua en acció, com ara l'anàlisi de la conversa, que examina com les persones estructuren i gestionen les converses moment a moment. Aplicat a la creació d'indicacions, aquest marc ens proporciona un vocabulari per entendre la conversa no com un intercanvi de paraules, sinó d'accions.
Algunes accions són pràctiques, com obtenir o donar informació, mentre que d'altres són socials, com mantenir la sintonia o evitar friccions. Aquests moviments tenen lloc dins l'estructura més àmplia del diàleg i les seves fases, cadascuna de les quals comporta unes accions esperades. Els diàlegs tenen inicis i finals, però també canvis de tema i fins i tot pretransicions: aquells moments de vegades incòmodes en què es proposa subtilment un nou rumb, es negocia i es decideix entre línies.
Els malentesos són habituals, fins i tot quan totes les parts tenen les millors intencions. Tot i que les persones dominen l'art del diàleg en graus diversos, la qüestió és que l'LLM que hi ha darrere de l'agent no incorpora la intuïció que té fins i tot un interlocutor humà d'allò més corrent.
A més de l'anàlisi lingüística, la psicologia cognitiva ofereix una perspectiva complementària. Ens explica com funcionen realment l'atenció, la memòria i la presa de decisions: quin pes donen les persones al que apareix primer respecte al que apareix al final, com certs desencadenants provoquen comportaments fiables i com les restriccions poden alliberar-nos reduint la càrrega cognitiva.
Una indicació no és un contenidor neutre d'instruccions, sinó un entorn d'atenció. Per tant, tant el que hi ha al principi com el que hi ha al final importa i el que es repeteix importa. Davant d'una llista, les persones tendeixen a recordar més fàcilment el principi i el final que no pas la part central. Els psicòlegs ho anomenen efecte de posició serial: primacia i recència.
A la pràctica, observem una cosa semblant amb els LLM. Les primeres directrius estableixen el marc: qui és l'agent, quin paper exerceix i quina mena de món espera trobar-se. Les directrius finals sovint funcionen com "l'últim que sent". Si hi posem les instruccions més importants, és més probable que es duguin a terme.
A més de decidir amb cura on col·loquem cada instrucció dins la indicació, també hem de tenir present la forma global del límit que aquestes instruccions creen per a l'agent.
Les instruccions actuen com a restriccions per a l'agent: redueixen el nombre de possibilitats en conflicte que ha de resoldre i delimiten l'espai global del problema. Les nostres indicacions han d'incloure prou restriccions perquè la tasca de l'agent sigui assumible.
Quan donem instruccions a empleats, sobretot als menys experimentats, la psicologia ens diu que convé eliminar l'ambigüitat de la tasca i reduir tant com sigui possible la càrrega cognitiva. Encara que les restriccions puguin semblar un fre a la llibertat, haver de prendre menys decisions ens permet centrar-nos en les poques que continuen sent importants i aplicar la creativitat en executar les nostres accions dins d'uns límits.
En canvi, intentar que l'agent no hagi de prendre cap decisió cobrint tots els casos límit imaginables amb llistes d'exemples de comportament és una bona manera de crear un interlocutor encarcarat, per no parlar d'una indicació de Frankenstein, plena de condicionals, difícil de manejar i impossible de gestionar.
(Indicacions amb pocs exemples, això va per vosaltres.)
Una indicació ben delimitada orienta amb prou claredat, sense sobrecarregar l'encàrrec ni paralitzar l'agent. Sovint, això equival a introduir menys casos límit o objectius per a l'agent, tant pel que fa a què ha de dir o evitar dir com a la manera de dir-ho o no dir-ho.


Segons la nostra experiència, si recorres a una indicació amb pocs exemples per ajustar el límit, és que aquest límit no és prou precís. Cal tronar a les instruccions fonamentals i refinar-les.
Des de la perspectiva de la psicologia cognitiva, hem reflexionat sobre on cal situar les diverses instruccions dins d'una indicació i sobre la quantitat i la qualitat d'instruccions necessàries per delimitar de la millor manera l'espai del problema de l'agent.
Reprenent les observacions anteriors sobre l'art del diàleg des de la perspectiva lingüística, podem completar el nostre paradigma de creació d'indicacions emmarcant les instruccions orientades al diàleg dins dels límits més amplis de la tasca de l'agent.
En una IA orientada als clients, el diàleg sempre és la metatasca, tant si ho reconeixem com si no. Quan decidim abordar deliberadament el diàleg en la indicació, ens comprometem a destinar part de la capacitat o "càrrega cognitiva" de l'agent a percebre el diàleg i respondre-hi, fet que en millorarà la capacitat conversacional.
Tanmateix, la contrapartida és que probablement haurem de reduir l'abast de la tasca principal per mantenir un espai global del problema ben delimitat i assumible.
Per tant, en la IA orientada als clients, dissenyem de manera integral les condicions per millorar el diàleg i les decisions. Aspirem a crear agents més petits i ben delimitats, amb una tasca principal contextualitzada dins de la metatasca del diàleg o que la inclogui. No escrivim un munt d'instruccions que es refinen mitjançant exemples, sinó un conjunt més reduït d'instruccions refinades, prou precises perquè els exemples siguin innecessaris.
Aquest és el paradigma de creació d'indicacions que fem servir per crear agents que no només es mantenen centrats en la tasca, sinó que també la duen a terme amb elegància conversacional.
Ara que hem traçat el mapa conceptual, dedicarem l'article següent a aspectes més pràctics. Examinarem alguns patrons clau que han sorgit en aplicar aquests principis a les indicacions mitjançant proves i errors en situacions reals. Curiosament, els proveïdors de models d'avantguarda comencen a reflectir patrons semblants en les seves directrius per crear indicacions. En parlarem més la pròxima vegada.