Програмне забезпечення для автоматизації клієнтського сервісу вийшло за межі сценарного бота, який зіставляв питання з деревом рішень і здавався, коли формулювання змінювалося. Версія, яку варто купувати зараз, працює поруч з агентом, читає весь тред, готує чернетку відповіді та передає її на перевірку.
Цей зсув змінює саме питання при виборі. Йдеться вже не про те, чи здатен інструмент відповісти, а про те, яку частину відповіді він готує, яку частину все ще контролює людина, і хто платить постачальнику моделі зі зростанням обсягу.
Що робить програмне забезпечення для автоматизації клієнтського сервісу
За назвою категорії стоїть короткий список конкретних завдань. Стиснути довгий тред до трьох рядків. Скласти чернетку відповіді на основі власного контенту довідки. Класифікувати намір і відповідно маршрутизувати. Визначити тональність. Перекладати в обидва боки. Позначати розмову тегами, щоб звітність мала що рахувати.
Жодна з цих функцій сама по собі не вражає. Кожна усуває одну затримку або один ручний крок, а саме затримки й відчувають клієнти.
Накопичувальний ефект проявляється на нових співробітниках. Людина на другому тижні роботи відповідає майже на рівні того, хто працює вже другий рік, тому що чернетка вже містить політику, історію акаунта, правильний тон і останні три замовлення.
Автоматизація тут не означає відповіді без нагляду за замовчуванням. Кожна можливість нижче передбачає, що людина бачить чернетку до її відправлення, а платформа налаштована так, щоб це було звичним шляхом, а не винятком.
Три рівні автоматизації, і який з них обрати
Постачальники використовують одні й ті самі слова для дуже різної поведінки, тому корисно розділяти рівні за тим, хто несе відповідальність за надіслане повідомлення.
| Рівень | Хто пише | Хто надсилає | У чому помилка |
|---|---|---|---|
| Сценарний потік | Ви, заздалегідь | Система | Не розпізнає питання |
| Копілот | Модель | Агент | Марнує клік на перевірку |
| Автономний агент | Модель | Система | Надсилає неправильну відповідь |
Сценарні потоки досі виправдовують себе для вузьких, високооб'ємних питань, формулювання яких майже не змінюється: статус замовлення, години роботи, скидання пароля.
Копілот - це стандарт для всього іншого, тому що його найгірший результат коштує кілька секунд, а найгірший результат автономного агента коштує клієнта.
Найкраще для більшості команд: сценарні потоки на топ-п'ять повторюваних питань, копілот - усюди інде, автономний режим - лише там, де неправильну відповідь дешево виправити.
Модель копілота у вхідних
У моделі копілота модель готує, агент вирішує. Чернетка з'являється поруч із розмовою з прикріпленими джерелами, а агент редагує, замінює або надсилає її.
Етап перевірки - це не формальність. Це контроль, який утримує випадкову неправильну відповідь усередині вашої компанії, а не в поштовій скриньці клієнта.
Це також дає сигнал, який показує, чи працює автоматизація. Кожне редагування - це позначена корекція, а частота таких редагувань - чесний показник якості, описаний далі.
Де автоматизація виходить за межі поля відповіді
Ставлення до ШІ як до віджета, приклеєного до живого чату, витрачає більшу частину його потенціалу даремно. Той самий рівень має роботу в кожному модулі, що торкається розмови.
У базі знань він складає статті з розв'язаних тредів і позначає сторінки, що суперечать новішим відповідям. Програмне забезпечення бази знань клієнтської підтримки, яке ніколи не помічає власну застарілість, - зазвичай причина того, що самообслуговування перестає щось відхиляти.
У маршрутизації він читає намір раніше, ніж це робить людина, тож питання про оплату потрапляє в чергу білінгу без проходження через етап тріажу.
У звітності він групує розмови за тим, про що клієнти справді запитували, а не за тегом, який агент згадав застосувати, і саме це перетворює кількість тікетів на рішення щодо продукту.
В аутбаунд-роботі та сама класифікація формує сегменти кампаній, тож люди, які щойно поскаржилися, не отримують пропозицію апсейлу.
Охоплення модулів також визначає, скільки власного матеріалу може дістати асистент. Асистент, який бачить лише поточний чат, пише виходячи з поточного чату, а асистент, який бачить картку клієнта, історію замовлень і останні три тікети, пише, спираючись на все це.
Власний ШІ: хто утримує обліковий запис моделі
Два питання об'єднуються майже в кожній демонстрації. Що вміє асистент - це питання продукту. Хто утримує обліковий запис у постачальника моделі - це комерційне питання, і воно визначає, чи знижує краща автоматизація вашу загальну вартість, чи підвищує її.
Коли обліковий запис утримує платформа, використання моделі надходить як пункт витрат платформи, зазвичай як кредити або місця. Тоді вартість зростає з успіхом: чим більше розмов обробляє ШІ, тим більше ви купуєте у постачальника з маржею постачальника.
Власний ШІ (bring-your-own-AI) інвертує це. Ви підключаєте власні ключі постачальника, токени постачальник виставляє рахунок безпосередньо вам, а платформа не бере жодної націнки на них. RolChat працює саме так із 62 текстовими моделями від семи постачальників і 23 голосовими моделями від чотирьох, разом 85.
За власного ключа покращення, що подвоює обсяг автоматизації, подвоює рахунок постачальника, який ви бачите і можете обговорювати. За пакетних кредитів те саме покращення подвоює рядок у рахунку, чию одиничну ціну ви не встановлюєте.
Вартість токенів залежить від контексту, а не від розмов
Команди, що вперше отримали власний ключ, зазвичай очікують, що рахунок відстежуватиме кількість розмов. Натомість він відстежує довжину контексту.
Відповідь, складена з останніх чотирьох повідомлень, коштує частку вартості тієї самої відповіді, складеної з треду з шістдесяти повідомлень, а резюме всього цього треду коштує більше за обидва варіанти.
Тому основну роботу виконують три налаштування: наскільки далеко сягає вікно контексту, чи виконуються резюме для кожного треду або лише для довгих, і чи отримує вибірка три статті довідки чи тридцять.
Нічого з цього не видно на сторінці порівняння тарифів. Це видно на панелі постачальника вже в перший тиждень, і саме це є аргументом на користь того, щоб утримувати обліковий запис самостійно.
Вибір моделі під кожне завдання
Одна модель для кожного завдання - дорогий варіант за замовчуванням. Робота чітко ділиться за тим, скільки міркування потребує кожне завдання.
| Завдання | Потребує | Розумний вибір |
|---|---|---|
| Теги та намір | Швидкість, низька вартість, стабільний результат | Невелика швидка модель |
| Складання відповіді | Тон, міркування на основі історії | Середня або велика модель |
| Політика та повернення коштів | Ретельність, точне формулювання | Найпотужніша доступна модель |
| Переклад | Охоплення ваших мов | Той постачальник, що охоплює їх найкраще |
Такий поділ зазвичай скорочує рахунок сильніше, ніж будь-яке налаштування промптів, тому що завдання з високим обсягом - дешеві, а дорога модель працює лише там, де окупає свою вартість.
Практичний початковий поділ: швидка модель для класифікації та тегів, середня модель для чернеток, найпотужніша модель - для грошей і політики.
Зміни маршрутизації до написання будь-якої чернетки
Більшість помітного виграшу з'являється до того, як хтось написав хоч слово. Класифікація відбувається одразу при надходженні, тож розмова вже позначена тегами, вже в правильній черзі та вже має пріоритет, коли агент її відкриває.
Це усуває зміну тріажу - крок, який команди додають, коли обсяг зростає, і прибирають, коли для нього не вистачає людей.
Це також змінює те, що вимірює SLA. Годинник, що стартує з першого прочитання повідомлення людиною, винагороджує швидкість тріажу. Годинник, що стартує з моменту надходження, винагороджує те, що дійсно важливо клієнтам, і саме автоматизована класифікація робить другий варіант життєздатним.
Другий ефект стосується ескалації. Коли намір і тональність прикріплені вже з першого повідомлення, правило, що передає розлючений тред про оплату старшому агенту, може спрацювати негайно, а не після другої відповіді.
Варто перевірити на демонстрації: чи класифікація відбувається при надходженні, чи при першому відкритті, тому що лише перший варіант усуває етап тріажу.
Дані, до яких асистент не повинен мати доступу
Обґрунтування асистента на власному контенті означає рішення про те, що вважати власним контентом. Розв'язані розмови - найкорисніший матеріал для навчання і водночас найбільш імовірне місце, де можуть бути номери карток та документи, що посвідчують особу, які клієнти вставляли в чат.
Основне навантаження несуть три засоби контролю: редагування (видалення чутливих даних) до того, як щось потрапить до моделі, обмеження зберігання транскриптів, і правило, за яким асистент отримує дані з опублікованих статей довідки, а не з необроблених тредів.
Згода належить до того самого рішення. RolChat обробляє це як платне додаткове розширення за $5 за сайт, із трьома згодами на сайт, і воно недоступне на тарифі Lite.
Запити на видалення - це той випадок, який заскочує команди зненацька. Запис, видалений із хелпдеску, але й досі присутній у векторному індексі, все ще є записом, тому перевіряйте, що видалення досягає й вибірки даних, а не лише списку тікетів.
Точність відповідей та відповідність бренду
Два налаштування відрізняють результат, який можна надіслати, від результату, який доведеться переписувати.
Перше - обґрунтованість. Відповіді складаються на основі затвердженого матеріалу: статей довідки та розв'язаних розмов, а чернетка містить джерела, які вона використала. Відповідь без жодного джерела за нею - це здогадка з упевненим тоном.
Друге - голос. Налаштування тону і глосарій термінів, які ви використовуєте і не використовуєте, зберігають звучання чернеток так, ніби це пише ваша команда, а не типовий асистент.
Глосарій важливіший ще й у контексті мов. Назви продуктів і юридичні терміни - це саме ті слова, які шар перекладу охоче перекладе, якщо йому не сказати цього не робити.
RolChat охоплює 40 мов інтерфейсу та віджета, і той самий глосарій застосовується до всіх них.
Голос: те саме питання, жорсткіший дедлайн
Голос підвищує ставки, тому що немає чернетки для перевірки. Відповідь озвучується в момент генерації, тож обґрунтованість має бути правильною заздалегідь, а не виправлятися на ходу.
Практичний поділ відбувається за наслідками. Перетворення мовлення на текст на кожному дзвінку, тому що транскрипт корисний, навіть якщо він недосконалий. Озвучені автоматизовані відповіді - лише там, де помилка дешева: години роботи, статус, маршрутизація.
Хвилини дзвінків у RolChat виставляються окремо від тарифного плану, тож обсяг голосового трафіку - це показник, за яким ви стежите окремо, а не несподіванка всередині ціни за місце.
Порядок впровадження важливий не менше за самі налаштування. Команди, які вмикають усе одразу, не можуть визначити, яка зміна вплинула на який показник, і врешті-решт залишають або все, або нічого.
Послідовність, яка читається зрозуміло: спочатку класифікація, потім чернетки в одній черзі, потім чернетки скрізь, потім будь-яка автономна обробка. Кожен крок має власне «до» і «після».
Вимірювання ефективності автоматизації
Показник відхилення (deflection rate) - метрика, з якою постачальники виступають на перший план, і водночас найменш корисна, тому що розмова, яка завершується без людини, може завершитися відповіддю або тим, що клієнт просто здався.
Чотири показники говорять більше. Частота редагувань чернеток, яка падає з покращенням обґрунтованості. Час першої відповіді, де копілот окупає себе. Частота повторних відкриттів, яка виявляє відповіді, що лише виглядали завершеними. Оцінка клієнтів у розрізі автоматизованої та людської обробки.
Читайте їх разом із рахунком постачальника за той самий період. Якість, що покращується при зниженні вартості на розмову, - результат, який варто зберігати; будь-який з них окремо - ні.
Усі чотири показники потребують виміру до впровадження. Команди, що пропускають базовий рівень, зрештою сперечаються, чи щось взагалі змінилося, не маючи способу це з'ясувати.
Обмеження, які варто озвучити прямо
Варто прямо озвучити два обмеження. Розгортання на власній інфраструктурі - це домовленість рівня Enterprise, а не щось доступне на нижчих тарифах. Моделі, що працюють на власному обладнанні, заплановані, а не доступні зараз, тож вимога локального інференсу сьогодні - це вимога, якій RolChat не відповідає.
Ціноутворення - за компанію, а не за агента, від $19 на тарифі Lite до індивідуальної ціни на Enterprise за запитом, а 30-денний пробний період відкриває всі функції за наявності картки.
Автоматизацію також легше оцінювати, коли канали за нею вже зібрані в одному місці, і саме цьому присвячений супровідний гайд.
Часті запитання
Що саме автоматизує програмне забезпечення для автоматизації клієнтського сервісу?
Стиснення тредів, складання відповідей на основі затвердженого контенту, класифікацію наміру, маршрутизацію, теги та переклад. У моделі копілота він готує все це, а агент вирішує, що надіслати.
Чи замінить ШІ агентів клієнтського сервісу?
Не в моделі копілота, яку варто застосовувати більшості команд. Модель складає чернетку, а агент перевіряє і надсилає. Зникає повторювана підготовка, а не людина, відповідальна за відповідь.
Що таке власний ШІ (bring-your-own-AI)?
Ви підключаєте власні ключі постачальника, тож постачальник виставляє рахунок за токени безпосередньо вам, без націнки платформи. Це також означає, що ви можете змінити модель або постачальника без зміни хелпдеску.
Скільки коштує запуск ШІ?
Це залежить набагато більше від довжини контексту, ніж від кількості розмов. Довгі треди, резюме для кожної розмови, широка вибірка та повторне резюмування - це налаштування, що впливають на рахунок, і всі три ви встановлюєте самостійно.
Яка модель має обробляти яке завдання?
Невелика швидка модель для тегів і наміру, середня чи велика модель для чернеток, і найпотужніша доступна модель для повернення коштів і формулювання політики. Поділ за завданнями зазвичай економить більше, ніж налаштування промптів.
Як зупинити вигадування відповідей ШІ?
Обґрунтовуйте його на затвердженому контенті довідки, щоб кожна чернетка мала свої джерела, зберігайте етап перевірки і відстежуйте частоту редагувань та повторних відкриттів після запуску, а не лише показник відхилення.
Чи можуть моделі працювати на наших власних серверах?
Розгортання на власній інфраструктурі доступне на тарифі Enterprise. Моделі з власним хостингом заплановані, а не доступні сьогодні, тож жорстка вимога локального інференсу поки не виконується.
Чи працює автоматизація в різних мовах?
Так. Вона охоплює 40 мов інтерфейсу та віджета з перекладом в обидва боки. Зберігайте назви продуктів і юридичні терміни у глосарії, щоб шар перекладу їх не чіпав.
Руслан Назаров

