ШІ, що взаємодіє з клієнтами, представляє ваш бренд, тому його розробка докорінно відрізняється від створення внутрішніх інструментів.
Різниця між функціональним і переконливим агентом радше концептуальна, ніж технічна, адже більшість запитів пишуть як набори інструкцій, а не як проєкти діалогу.
Кращий підхід пропонують лінгвістика та когнітивна психологія: розмови мають структуру, а запити створюють середовище, що спрямовує увагу. Те, що ви ставите на початку, повторюєте та зазначаєте наприкінці, передбачувано впливає на поведінку агента.
Обмеження допомагають, але лише коли вони точні. Надмірна кількість крайових випадків робить взаємодію неприродною, а запити — громіздкими. Натомість менша кількість рішень дає змогу зосередитися на найважливіших.
Створення розмовного ШІ для взаємодії з клієнтами — складне завдання для бізнесу.
Навіть для компаній, які надзвичайно активно впроваджують цю технологію, уже налагодили співпрацю працівників із ШІ та, можливо, навіть розробили власні внутрішні ШІ-інструменти, зробити ШІ інтерфейсом між бізнесом і світом — це зовсім інша справа.
І це справжнє підвищення. Коли ШІ починає працювати з клієнтами, він із сумлінного стажера перетворюється на повноважного працівника: одягає уніформу й представляє бренд в очах клієнтів.
Ставки високі. Кожна помилка тепер стає публічною і потенційно може бути зафіксована.
Продукти, які ми створюємо, часто є мультиагентними системами зі складною взаємодією на рівні бізнесу. Однак ця логіка може виявитися простішою частиною роботи. Складніше переконати користувачів, що весь час вони спілкуються з одним агентом і що його відповіді варті уваги.
Тож ми знову й знову пишемо та переписуємо запити.
Деякі агенти з’являються лише після сотень ітерацій запиту. Усі вони мають одну мету: не відхилятися від завдання й говорити голосом, що знаходить відгук у людей.
Досвід удосконалення запитів спонукав нас творчо шукати джерела натхнення. Ми почали запозичувати ідеї з інших дисциплін. Звісно, спрацювало не все, а те, що спрацювало, рідко вдавалося з першої спроби. Результатом цих пошуків стала поява в нашій команді нової парадигми формування запитів.
Різниця між системно функціональним агентом і агентом, що блискуче веде розмову, не суто технічна — вона концептуальна. Це відстань між світом, у який ви помістили агента за допомогою запиту, і реальним світом людського спілкування, у якому він діє.
Останній сповнений неоднозначності, яку люди добре відчувають і з якою добросовісні співрозмовники спільно дають раду завдяки набору тонких, невисловлених правил дискурсу. Непідготовленого агента видно одразу.
Щоб не руйнувати четверту стіну, або ілюзію Тюрінга, ми можемо навчити агентів мистецтва діалогу, спираючись на лінгвістику та когнітивну психологію.
Лінгвістика має цілий набір інструментів для вивчення мови в дії, зокрема конверсаційний аналіз, що досліджує, як люди щомиті структурують розмови й керують ними. Застосована до формування запитів, ця система дає нам понятійний апарат, щоб розглядати розмову не як обмін словами, а як обмін діями.
Одні дії практичні — наприклад, отримання чи надання інформації, а інші соціальні — як-от підтримання взаєморозуміння або уникнення напруження. Такі ходи відбуваються в межах ширшої структури діалогу та його етапів, кожен із яких передбачає певні дії. Діалоги мають початок і завершення, а також переходи між темами й навіть підготовку до них — ті часом незручні моменти, коли новий напрямок непомітно пропонують, узгоджують і визначають між рядками.
Непорозуміння трапляються постійно, навіть коли всі мають найкращі наміри. Люди володіють мистецтвом діалогу різною мірою, але суть у тому, що LLM, яка стоїть за вашим агентом, не має вбудованої інтуїції, притаманної навіть пересічному співрозмовнику.
Когнітивна психологія доповнює лінгвістичний аналіз. Вона пояснює, як насправді працюють увага, пам’ять і прийняття рішень: як люди зважують перше й останнє, як конкретні тригери викликають передбачувану поведінку та як обмеження можуть звільняти, зменшуючи когнітивне навантаження.
Запит — не нейтральний контейнер для інструкцій. Це середовище, що спрямовує увагу. Тому важливо, що стоїть на початку. Важливо й те, що стоїть наприкінці. Важливо й те, що повторюється. Отримавши список, люди зазвичай краще запам’ятовують його початок і кінець, ніж середину. Психологи називають це ефектом позиції в ряду: ефектами первинності та недавності.
На практиці ми спостерігаємо щось подібне й у LLM. Початкові настанови задають рамку: хто такий агент, яку роль він виконує і з яким світом очікує зіткнутися. Завершальні настанови часто діють як «останнє, що він чує». Якщо розмістити там найважливіші інструкції, зросте ймовірність, що їх буде виконано.
Ретельно вибираючи місце для різних інструкцій у запиті, слід також стежити за загальною формою межі, яку ці інструкції створюють для агента.
Інструкції обмежують агента, зменшуючи кількість конкуруючих варіантів, між якими він має вибирати, і звужуючи загальний простір задачі. Наші запити мають містити достатньо обмежень, щоб завдання агента було здійсненним.
Як підказує психологія, даючи вказівки працівникам, особливо менш досвідченим, варто максимально усунути неоднозначність завдання й таким чином зменшити когнітивне навантаження. Обмеження можуть здаватися перешкодою для свободи, але менша кількість рішень дає змогу зосередитися на кількох важливих і творчо діяти у встановлених межах.
І навпаки, якщо спробувати позбавити агента всіх рішень, охопивши списками прикладів поведінки кожен можливий крайовий випадок, вийде неприродний співрозмовник. До того ж запит перетвориться на громіздкого Франкенштейна з умов if та else, яким украй складно керувати.
(Запити з кількома прикладами — це про вас.)
Запит із чітко визначеними межами достатньо ясно задає напрямок, не перевантажуючи завдання й не паралізуючи агента. Часто це означає додавати менше крайових випадків або цілей для агента — як щодо того, що йому казати чи не казати, так і щодо способу висловлювання.


З нашого досвіду, якщо для коригування межі вам потрібен запит із кількома прикладами, ця межа недостатньо точна. Поверніться до основних інструкцій і вдоскональте їх.
З погляду когнітивної психології ми міркували, де розміщувати різні інструкції в запиті, а також скільки інструкцій і якої якості потрібно, щоб якнайкраще окреслити простір задачі агента.
Згадавши попередні лінгвістичні спостереження про мистецтво діалогу, ми можемо завершити нашу парадигму формування запитів, розглядаючи орієнтовані на діалог інструкції як частину ширших меж завдання агента.
Для ШІ, що взаємодіє з клієнтами, діалог завжди є метазавданням — визнаємо ми це чи ні. Свідомо приділяючи увагу діалогу в запиті, ми спрямовуємо частину ресурсів агента, або його «когнітивного навантаження», на розуміння діалогу й належне реагування, щоб поліпшити його здатність вести розмову.
Однак заради цього, імовірно, доведеться скоротити основне завдання, щоб загальний простір задачі залишався здійсненним і чітко окресленим.
Тож для ШІ, що взаємодіє з клієнтами, ми комплексно створюємо умови для кращих діалогів і рішень. Ми прагнемо створювати менших агентів із чітко визначеними межами, чиє основне завдання враховує або охоплює метазавдання діалогу. Ми не пишемо гори інструкцій, а потім не вдосконалюємо їх за допомогою прикладів. Ми пишемо менший набір опрацьованих інструкцій, достатньо точних, щоб приклади стали зайвими.
Саме цю парадигму формування запитів ми використовуємо, щоб створювати агентів, які не лише дотримуються завдання, а й роблять це з розмовною витонченістю.
Тепер, окресливши концептуальний ландшафт, у наступній публікації ми перейдемо до практики. Ми розглянемо кілька ключових закономірностей, які виявилися під час наших спроб застосувати ці принципи до запитів методом проб і помилок у реальних умовах. Цікаво, що постачальники передових моделей починають відтворювати схожі закономірності у власних рекомендаціях щодо формування запитів. Далі буде.