К основному содержимому

Работает

AI-оператор, который отвечает по вашим статьям — и молчит, когда не уверен

Он первым берёт сообщение клиента, ищет ответ в вашей базе знаний и делает ровно одно из трёх: отвечает, задаёт уточняющий вопрос или передаёт диалог человеку. Придумывать ответ «из головы» ему запрещено на уровне правил, а не пожеланий.

Как это работает
Цитата-источник — для ваших статей ответ без неё не уходит клиенту Три исхода — ответить, уточнить или передать человеку Трейс на каждый ответ — видно, что нашлось и почему решение такое

Механика

Как AI принимает решение по каждому сообщению

AI-оператор включается флагом канала и по умолчанию включён: он перехватывает первое сообщение клиента. Поисковый запрос строится по последним входящим сообщениям, дальше идёт векторный поиск — 8 ближайших по смыслу фрагментов и только из опубликованных статей. В промпт уходит история до 12 сообщений диалога. После поиска возможны ровно три исхода; четвёртого — «сказать что-нибудь правдоподобное» — в схеме нет.

  1. Ответить

    Ответ собирается по найденным фрагментам вашей базы. Для ваших статей к нему прикладывается дословная цитата и точный адрес статьи с разделом.

  2. Задать уточняющий вопрос

    Когда вопрос допускает несколько разных ответов, AI уточняет формулировку вместо того, чтобы угадывать, что имел в виду клиент.

  3. Передать человеку

    Нет источника — нет ответа. Диалог уходит оператору со всей перепиской и контекстом посетителя, без просьбы «повторите ваш вопрос».

    Если подходящих фрагментов не нашлось вовсе, решение принимается сразу в пользу передачи человеку.

Главное правило

Нет дословной цитаты — нет ответа

Для курируемых статей — тех, которые написали вы, — модель обязана вернуть вместе с ответом дословную цитату-источник и точный адрес статьи с разделом. Если цитаты нет, ответ отклоняется и до клиента не доходит: это не постобработка и не «оценка уверенности», а жёсткое условие. Для контента, снятого с вашего сайта, правила мягче — там AI может перефразировать, потому что это ваш собственный публичный текст, а не выверенная инструкция. Приоритет при смешанном наборе найденного всё равно у ваших статей.

Что это меняет на практике

  • AI не «сочиняет» условия доставки, скидки и сроки, которых нет в базе
  • Клиент получает ответ, который можно проверить по вашей же статье
  • Пробел в базе становится видимым: вместо выдумки — передача человеку
  • Качество ответов растёт от наполнения базы, а не от «подкрутки» модели

Передача человеку

После handoff AI не возвращается в переписку

Передача необратима в рамках диалога. Даже если оператора потом открепят, AI не подхватит переписку заново — клиент не окажется в ситуации, когда после живого человека ему снова отвечает робот.

  • Оператор уже назначен — AI не вызывается вовсе. Он не вмешивается в диалог, который ведёт человек.
  • Контекст передаётся целиком. Оператор видит переписку с первого сообщения, историю просмотренных страниц, источник трафика, город и часовой пояс, устройство и браузер.
  • Понятно, почему диалог пришёл. По трейсу видно, что AI искал и почему решил передать.

Что видит клиент в виджете

  • Индикацию «AI думает…» с ротацией фраз, пока идёт генерация
  • Статус в шапке — по умолчанию «AI оператор на связи»
  • Переход к человеку без повторного пересказа вопроса

Объяснимость

Любой ответ AI можно разобрать по шагам

На каждый ответ пишется трейс. Это не служебный лог для разработчиков — оператор открывает его сам, из контекстного меню сообщения, пунктом «Анализ ответа AI».

  • Поисковый запрос. С каким запросом AI пошёл в базу знаний — часто уже здесь видно, что клиента поняли не так.
  • Найденные фрагменты. Какие куски статей попали в выборку. Пусто или не то — значит, проблема в базе, и она видна адресно.
  • Принятое решение. Какой из трёх исходов выбран и на каком основании — ответить, уточнить или передать человеку.
  • Снимок промпта. Что именно ушло в модель, включая историю диалога, — разобрать ответ можно и спустя время.

Зачем это нужно в обычной работе

Плохой ответ AI почти всегда означает пробел или неточность в базе знаний. Трейс превращает разбор из спора «модель глупая» в конкретную задачу: дописать раздел, поправить формулировку, опубликовать черновик. Как устроена база — на странице База знаний.

Честно: про скорость и про то, чего AI не делает

До начала ответа проходит около 3 секунд, сама генерация занимает 10–25 секунд. Это десятки секунд, и мы не будем называть это мгновенным ответом. Поэтому в виджете есть индикация «AI думает…»: клиент видит, что его вопрос взяли в работу, а не завис интерфейс. Сравнивать имеет смысл не секунды бота, а реальное время первого ответа в вашей поддержке — эту метрику показывает Growth Insights.

Без настроенного доступа к моделям AI не отвечает — диалог просто передаётся человеку. При единичном сбое на стороне поставщика моделей повторной попытки нет: снова передача человеку. В клиентском чате AI не выполняет действий в других системах — он отвечает, уточняет и передаёт, но ничего не «делает» за вас. Поставщик моделей — OpenAI.

Вне рабочих часов

Ночью чат не выключается — просто честно предупреждает

Многие сервисы вне рабочего окна прячут чат или обрывают диалог. Мы оставляем и чат, и AI: вопрос всё равно будет задан, а ответ по базе знаний не зависит от того, спит ли команда.

  • Чат и AI продолжают работать — посетитель пишет и получает ответ по базе.
  • Через настраиваемую задержку — по умолчанию 20 секунд — приходит офлайн-сообщение, а статус меняется на «Не в сети».
  • Если подключился живой оператор, офлайн-сценарий отменяется: клиент не получит «мы не в сети» во время реального разговора.

Сколько вопросов закроет AI

Зависит не от модели, а от вашей базы знаний: на пустой базе AI будет добросовестно передавать почти всё человеку, и это правильное поведение, а не поломка. Ожидаемая доля для вашей тематики — [обсуждаем на демо по вашим реальным вопросам].

Наполнение базы — главная работа на старте. Не хотите делать её сами — этим займётся Growth Team.

Вопросы

Что спрашивают про AI-оператора

Для ваших курируемых статей — нет: модель обязана вернуть дословную цитату-источник и точный адрес статьи с разделом, а ответ без цитаты отклоняется и клиенту не уходит. Для контента, снятого с сайта, разрешено перефразирование, но опора всё равно на ваш текст, а при смешанном наборе найденного приоритет отдаётся вашим статьям.

Если подходящих фрагментов не нашлось, AI не пытается угадать — диалог сразу передаётся человеку со всей перепиской и контекстом посетителя. Передача необратима в рамках диалога: после неё AI не подхватывает переписку, даже если оператора открепят.

До старта ответа проходит около 3 секунд, генерация занимает 10–25 секунд. То есть речь о десятках секунд, а не о мгновенном ответе — мы предпочитаем сказать это прямо. Пока идёт генерация, в виджете видна индикация «AI думает…» с ротацией фраз.

Да. AI-оператор включается флагом канала: по умолчанию он включён, но вы можете его выключить — тогда все обращения в этом канале сразу идут к людям. Кроме того, если на диалог уже назначен оператор, AI не вызывается вовсе.

Да, вне рабочего окна чат и AI не отключаются. Дополнительно через настраиваемую задержку (по умолчанию 20 секунд) посетитель получает офлайн-сообщение, а статус меняется на «Не в сети». Если к диалогу успел подключиться живой оператор, офлайн-сценарий отменяется.

Поставщик моделей — OpenAI. Если доступ к моделям не настроен, AI не отвечает и передаёт диалог человеку. При единичном сбое на стороне поставщика повторной попытки нет — снова передача человеку, а не тишина в чате.

Проверьте AI-оператора на своих вопросах

Принесите десять реальных вопросов клиентов — покажем, на какие он ответит с цитатой из вашей базы, а какие честно передаст человеку.

Growth Insights