Umetna inteligenca, ki komunicira s strankami, predstavlja vašo blagovno znamko, zato zahteva povsem drugačno veščino kot interna orodja.
Razlika med delujočim in prepričljivim agentom je bolj konceptualna kot tehnična, saj je večina pozivov napisana kot niz navodil, ne kot zasnova dialoga.
Boljši okvir ponujata jezikoslovje in kognitivna psihologija: pogovori imajo strukturo, pozivi pa ustvarjajo okolje za usmerjanje pozornosti. Na vedenje agenta zanesljivo vplivajo vsebina na začetku, ponovitve in način zaključka.
Omejitve pomagajo, vendar le, če so natančne. Preveč robnih primerov povzroči toge interakcije in okorne pozive, manj odločitev pa omogoča osredotočenost na tiste, ki so pomembnejše.
Razvoj pogovorne umetne inteligence za komuniciranje s strankami je za podjetje zahteven podvig.
Tudi za najbolj zavzete uporabnike tehnologije, ki so sodelovanje z umetno inteligenco že vpeljali na ravni posameznih zaposlenih in morda celo razvili lastna interna orodja z umetno inteligenco, je postavitev umetne inteligence na stičišče med podjetjem in svetom nekaj povsem drugega.
In res gre za napredovanje. Ko začne umetna inteligenca komunicirati s strankami, napreduje iz marljivega pripravnika v pooblaščenega zaposlenega, si nadene uniformo in v očeh strank predstavlja blagovno znamko.
Veliko je na kocki. Vsaka napaka je zdaj javna in morda tudi zabeležena.
Produkti, ki jih razvijamo, so pogosto sistemi z več agenti in zapletenimi interakcijami na poslovni ravni. Vendar je lahko prav ta logika lažji del. Večji izziv je uporabnike prepričati, da se ves čas pogovarjajo z enim agentom in da je njegove besede vredno slišati.
Zato pozive pišemo in vedno znova popravljamo.
Nekateri agenti nastanejo šele po več sto različicah poziva. Vsi imajo isti cilj: ostati pri nalogi in govoriti z glasom, ki nagovarja človeške uporabnike.
Izkušnje z izpopolnjevanjem pozivov so nas spodbudile k ustvarjalnemu iskanju navdiha. Začeli smo si izposojati zamisli iz drugih strok. Seveda ni delovalo vse, tisto, kar je, pa le redko že v prvem poskusu. Rezultat tega raziskovanja je bila nova paradigma pozivanja, ki se je izoblikovala v naši ekipi.
Vrzel med sistematično delujočim in pogovorno odličnim agentom ni zgolj tehnična, temveč konceptualna. To je razdalja med svetom, v katerega ste agenta umestili s pozivom, in resničnim svetom človeškega sporazumevanja, v katerem agent deluje.
Za slednjega je značilna dvoumnost, na katero smo ljudje dobro uglašeni in skozi katero dobronamerni sogovorniki sodelovalno krmarijo s pomočjo pretanjenih, neizrečenih pravil sporazumevanja. Slabo opremljenega agenta zlahka prepoznamo.
Da bi ohranili četrto steno oziroma Turingovo iluzijo, lahko agente zasidramo v umetnosti dialoga s spoznanji jezikoslovja in kognitivne psihologije.
Jezikoslovje ponuja celo zbirko orodij za preučevanje jezika v rabi, vključno s konverzacijsko analizo, ki proučuje, kako ljudje iz trenutka v trenutek strukturirajo in vodijo pogovore. Ko ta okvir uporabimo pri oblikovanju pozivov, dobimo besedišče, s katerim lahko pogovor razumemo kot izmenjavo dejanj, ne le besed.
Nekatera dejanja so praktična, denimo pridobivanje ali posredovanje informacij, druga pa družbena, kot sta ohranjanje dobrega odnosa in preprečevanje trenj. Takšne poteze potekajo znotraj širše strukture dialoga in njegovih faz, od katerih ima vsaka pričakovana dejanja. Dialogi imajo uvode in zaključke, pa tudi prehode med temami in celo priprave nanje – tiste včasih nerodne trenutke, ko se nova smer neopazno predlaga, usklajuje in določi med vrsticami.
Nesporazumi se dogajajo ves čas, tudi kadar imajo vsi najboljše namene. Čeprav ljudje umetnost dialoga obvladamo različno dobro, je bistveno, da veliki jezikovni model v ozadju vašega agenta nima prirojene intuicije, ki jo premore celo povprečen človeški sogovornik.
Kognitivna psihologija jezikoslovno analizo dopolnjuje z drugim pogledom. Pojasnjuje nam, kako dejansko delujejo pozornost, spomin in odločanje: kako ljudje različno vrednotijo prvo in zadnje, kako določeni sprožilci zanesljivo povzročijo neko vedenje ter kako lahko omejitve osvobajajo z zmanjšanjem kognitivne obremenitve.
Poziv ni nevtralna posoda za navodila. Je okolje za usmerjanje pozornosti. Zato je pomembno, kaj je na vrhu. Pomembno je, kaj je na dnu. Pomembno je, kaj se ponavlja. Pri seznamu si ljudje navadno lažje zapomnijo začetek in konec kot sredino. Psihologi temu pravijo učinek zaporednega položaja: učinek primarnosti in učinek nedavnosti.
V praksi opažamo nekaj podobnega pri velikih jezikovnih modelih. Začetna navodila vzpostavijo okvir: kdo je agent, kakšno vlogo ima in kakšen svet pričakuje. Zaključna navodila pogosto učinkujejo kot »zadnje, kar agent sliši«. Če tja umestimo najpomembnejša navodila, je verjetneje, da jih bo upošteval.
Ob skrbnem razmisleku, kam v pozivu umestiti posamezna navodila, moramo spremljati tudi celotno obliko meja, ki jih ta navodila ustvarjajo za našega agenta.
Navodila omejujejo agenta, s čimer zmanjšajo število nasprotujočih si možnosti, med katerimi mora izbirati, in zožijo celoten problemski prostor. Pozivi morajo vsebovati dovolj omejitev, da je agentova naloga obvladljiva.
Psihologija nam pravi, da je pri dajanju navodil zaposlenim, zlasti manj izkušenim, smiselno čim bolj razjasniti nalogo in tako zmanjšati kognitivno obremenitev. Čeprav se omejitve morda zdijo kot ovira svobodi, nam manj odločitev omogoča, da se posvetimo preostalim pomembnim odločitvam in ustvarjalno izvajamo dejanja znotraj postavljenih meja.
Če pa skušamo agentu odvzeti prav vse odločitve in vsak predstavljiv robni primer zajeti v sezname vedenjskih zgledov, ustvarimo togega sogovornika ter okoren frankensteinovski poziv iz samih pogojev »če« in »sicer«, ki ga je prava nočna mora upravljati.
(Učenje iz malo primerov, o tebi govorimo.)
Dobro omejen poziv zagotavlja dovolj jasno usmeritev, ne da bi preobremenil navodila in ohromil agenta. To pogosto pomeni, da agentu določimo manj robnih primerov ali ciljev, tako glede tega, kaj naj pove ali česa ne, kot glede tega, kako naj to pove ali kako ne.


Po naših izkušnjah meja ni dovolj natančna, če jo poskušate prilagoditi z učenjem iz malo primerov. Vrnite se k temeljnim navodilom in jih izpopolnite.
Z vidika kognitivne psihologije smo razmišljali o tem, kam v pozivu umestiti različna navodila ter kakšna količina in kakovost navodil najbolje omejita problemski prostor našega agenta.
Če upoštevamo prejšnja jezikoslovna opažanja o umetnosti dialoga, lahko paradigmo pozivanja dopolnimo tako, da navodila, usmerjena v dialog, umestimo v širše meje agentove naloge.
Pri umetni inteligenci, ki komunicira s strankami, je dialog vedno metanaloga, pa naj si to priznamo ali ne. Ko se odločimo dialog načrtno obravnavati v pozivu, del agentove zmogljivosti oziroma »kognitivne obremenitve« namenimo zaznavanju dialoga in odzivanju nanj, s čimer izboljšamo njegovo sposobnost pogovora.
V zameno bomo verjetno morali zmanjšati obseg glavne naloge, da bo celoten problemski prostor ostal obvladljiv in jasno omejen.
Pri umetni inteligenci za komuniciranje s strankami torej celostno oblikujemo pogoje za boljši dialog in odločanje. Prizadevamo si za manjše, jasno omejene agente, katerih glavna naloga je umeščena v metanalogo dialoga oziroma jo vključuje. Ne pišemo kopice navodil, ki jih nato izpopolnjujemo s primeri. Napišemo manjši nabor izpiljenih in tako natančnih navodil, da primeri postanejo odveč.
S to paradigmo pozivanja ustvarjamo agente, ki ne le ostanejo pri nalogi, temveč jo opravljajo tudi s pogovorno eleganco.
Zdaj ko smo začrtali konceptualno krajino, bomo v naslednjem zapisu prešli k praksi. Ogledali si bomo nekaj ključnih vzorcev, ki so se pokazali, ko smo ta načela s preizkušanjem v resničnem svetu in učenjem iz napak uporabljali pri pozivih. Zanimivo je, da ponudniki prelomnih modelov podobne vzorce že vključujejo v lastna navodila za oblikovanje pozivov. Več o tem pa prihodnjič.