AI komunikujúca so zákazníkmi reprezentuje vašu značku a jej tvorba si vyžaduje úplne iný prístup než interné nástroje.
Rozdiel medzi funkčným a presvedčivým agentom je skôr koncepčný než technický, pretože väčšina príkazov vzniká ako súbor pokynov, nie ako návrh dialógu.
Lepšie východisko ponúkajú lingvistika a kognitívna psychológia: rozhovory majú štruktúru a príkazy vytvárajú prostredie, ktoré usmerňuje pozornosť. Správanie agenta spoľahlivo ovplyvníte tým, čo uvediete ako prvé, čo zopakujete a ako príkaz uzavriete.
Obmedzenia pomáhajú, ale iba vtedy, keď sú presné. Priveľa okrajových prípadov vedie ku kŕčovitým interakciám a neprehľadným príkazom. Menej rozhodnutí preto umožňuje sústrediť sa na tie dôležitejšie.
Vytvoriť konverzačnú AI komunikujúcu so zákazníkmi je pre firmu náročné.
Aj pre najnadšenejších používateľov tejto technológie, ktorí prijali spoluprácu s AI na úrovni jednotlivých zamestnancov a možno si dokonca vyvinuli vlastné interné nástroje AI, je nasadenie AI ako rozhrania medzi firmou a svetom úplne iná záležitosť.
A je to skutočné povýšenie. Keď AI začne komunikovať so zákazníkmi, z usilovného stážistu sa stáva poverený zamestnanec: oblieka si uniformu a v očiach zákazníkov reprezentuje značku.
V stávke je veľa. Každé zaváhanie je teraz verejné a môže zostať zaznamenané.
Produkty, ktoré vytvárame, sú často multiagentové systémy so zložitými interakciami na úrovni firmy. Táto logika však môže byť tou jednoduchšou časťou. Väčšou výzvou je presvedčiť používateľov, že po celý čas hovoria s jedným agentom a že to, čo im hovorí, má hodnotu.
Preto príkazy píšeme a znova prepisujeme, stále dookola.
Za niektorými agentmi sú stovky úprav príkazov. Všetky majú rovnaký cieľ: držať sa úlohy a komunikovať spôsobom, ktorý osloví ľudských používateľov.
Skúsenosti so zdokonaľovaním príkazov nás priviedli k tvorivému hľadaniu inšpirácie. Začali sme čerpať z iných odborov. Samozrejme, nie všetko fungovalo a to, čo fungovalo, sa málokedy podarilo na prvý pokus. Výsledkom tohto skúmania bolo, že sa v našom tíme sformovala nová paradigma tvorby príkazov.
Rozdiel medzi systematicky funkčným agentom a agentom, ktorý vynikajúco konverzuje, nie je len technický, ale aj koncepčný. Je to vzdialenosť medzi svetom, do ktorého ste agenta zasadili príkazom, a skutočným svetom ľudskej komunikácie, v ktorom agent pôsobí.
Skutočný svet je plný nejednoznačnosti. Ľudia ju dobre vnímajú a komunikujúci s úprimným zámerom sa v nej orientujú spoluprácou založenou na súbore jemných, nevyslovených pravidiel rozhovoru. Nedostatočne pripraveného agenta ľahko spoznáte.
Ak chceme zachovať štvrtú stenu či Turingovu ilúziu, môžeme agentov ukotviť v umení dialógu pomocou poznatkov lingvistiky a kognitívnej psychológie.
Lingvistika ponúka celý súbor nástrojov na skúmanie jazyka v praxi vrátane konverzačnej analýzy, ktorá sleduje, ako ľudia priebežne štruktúrujú a riadia rozhovory. Keď tento rámec uplatníme na tvorbu príkazov, získame slovník, pomocou ktorého môžeme o rozhovore uvažovať nie ako o výmene slov, ale ako o výmene konaní.
Niektoré konania sú praktické, napríklad získavanie či poskytovanie informácií, iné sú spoločenské, napríklad udržiavanie dobrého vzťahu alebo predchádzanie napätiu. Takéto kroky prebiehajú v širšej štruktúre dialógu a jeho fázach, pričom s každou sa spájajú očakávané úkony. Dialógy majú úvod a záver, ale aj prechody medzi témami či prípravu na ne – občas rozpačité chvíle, keď sa nový smer nenápadne navrhne, prerokuje a medzi riadkami sa o ňom rozhodne.
K nedorozumeniam dochádza neustále, aj keď majú všetci tie najlepšie úmysly. Hoci ľudia ovládajú umenie dialógu na rôznej úrovni, podstatné je, že LLM poháňajúci vášho agenta nemá automaticky intuíciu, ktorou disponuje aj celkom priemerný človek.
Kognitívna psychológia ponúka popri lingvistickej analýze doplňujúci pohľad. Ukazuje nám, ako pozornosť, pamäť a rozhodovanie skutočne fungujú – akú váhu ľudia pripisujú tomu, čo zaznie ako prvé a čo ako posledné, ako konkrétne podnety spoľahlivo vyvolávajú určité správanie a ako môžu obmedzenia znižovaním kognitívnej záťaže oslobodzovať.
Príkaz nie je neutrálnou nádobou na pokyny. Je to prostredie, ktoré usmerňuje pozornosť. Preto záleží na tom, čo je navrchu. Záleží aj na tom, čo je naspodku. Záleží na tom, čo sa opakuje. Keď ľudia dostanú zoznam, jeho začiatok a koniec si zvyčajne zapamätajú ľahšie než stred. Psychológovia to nazývajú efekt sériovej pozície: efekt prvenstva a efekt nedávnosti.
V praxi pozorujeme niečo podobné aj pri LLM. Úvodné usmernenia vytvárajú rámec: určujú, kto agent je, akú úlohu plní a s akým svetom očakáva stretnutie. Záverečné usmernenie často pôsobí ako „to posledné, čo agent počuje“. Ak tam umiestnime najdôležitejšie pokyny, zvýšime šancu, že sa uplatnia.
Tak ako starostlivo zvažujeme umiestnenie jednotlivých pokynov v príkaze, mali by sme sledovať aj celkový tvar hraníc, ktoré tieto pokyny agentovi vytvárajú.
Pokyny obmedzujú agenta, čím znižujú počet protichodných možností, ktoré musí vyriešiť, a zužujú celkový priestor problému. Príkazy musia obsahovať dosť obmedzení, aby bola úloha agenta zvládnuteľná.
Psychológia nám radí, aby sme pri zadávaní pokynov ľudským zamestnancom, najmä tým menej skúseným, čo najviac odstránili nejednoznačnosť úlohy, a tým znížili ich kognitívnu záťaž. Obmedzenia sa nám síce môžu zdať ako potláčanie slobody, no keď musíme robiť menej rozhodnutí, môžeme sa sústrediť na niekoľko zostávajúcich dôležitých rozhodnutí a tvorivo konať v stanovených medziach.
Ak sa naopak pokúsime zariadiť, aby agent nemusel robiť žiadne rozhodnutia, a každý predstaviteľný okrajový prípad pokryjeme zoznamami príkladov správania, ľahko vytvoríme kŕčovitého spoločníka na rozhovor. Nehovoriac o neprehľadnom frankensteinovskom príkaze plnom podmienok, ktorý je nočnou morou z hľadiska správy.
(Niekoľkopríkladové príkazy, hovoríme o vás.)
Dobre ohraničený príkaz poskytuje dostatočne jasný smer bez toho, aby zadanie preťažil a agenta paralyzoval. Často to znamená uviesť menej okrajových prípadov či cieľov agenta – či už ide o to, čo má alebo nemá povedať, alebo ako to má či nemá povedať.


Podľa našich skúseností platí, že ak chcete hranicu upraviť pomocou niekoľkopríkladového príkazu, hranica nie je dostatočne presná. Vráťte sa k základným pokynom a zdokonaľte ich.
Z pohľadu kognitívnej psychológie sme uvažovali nad tým, kam v príkaze umiestniť jednotlivé pokyny, a zvažovali sme ich množstvo aj kvalitu potrebnú na čo najlepšie ohraničenie priestoru problému agenta.
Ak nadviažeme na predchádzajúce lingvistické postrehy o umení dialógu, môžeme našu paradigmu tvorby príkazov doplniť tým, že pokyny zamerané na dialóg zasadíme do širších hraníc úlohy agenta.
Pri AI komunikujúcej so zákazníkmi je dialóg vždy metaúlohou, či už si to uvedomujeme, alebo nie. Keď sa dialógu v príkaze venujeme zámerne, časť kapacity či „kognitívnej záťaže“ agenta vyhradíme na vnímanie dialógu a primerané reakcie, čím zlepšíme jeho konverzačné schopnosti.
Nevýhodou však je, že zrejme budeme musieť zmenšiť hlavnú úlohu, aby celkový priestor problému zostal zvládnuteľný a dobre ohraničený.
Pre AI komunikujúcu so zákazníkmi preto vytvárame podmienky na lepší dialóg a rozhodovanie ako jeden celok. Usilujeme sa o menších, dobre ohraničených agentov, ktorých hlavná úloha je zasadená do metaúlohy dialógu alebo ju zahŕňa. Nepíšeme hromady pokynov, ktoré sa postupne dolaďujú pomocou príkladov. Píšeme menší súbor prepracovaných pokynov, ktoré sú také presné, že príklady už netreba.
Túto paradigmu tvorby príkazov používame na vytváranie agentov, ktorí sa nielen držia úlohy, ale plnia ju aj s konverzačnou eleganciou.
Keď už máme zmapované koncepčné východiská, v ďalšom blogu prejdeme k praktickejšej stránke. Pozrieme sa na niektoré kľúčové vzorce, ktoré vyplynuli z našich pokusov uplatniť tieto princípy v príkazoch metódou skúšania a omylov v reálnom svete. Je zaujímavé, že poskytovatelia prelomových modelov začínajú podobné vzorce uplatňovať aj vo vlastných odporúčaniach na tvorbu príkazov. Viac nabudúce.