Работает
База знаний, из которой AI берёт ответы — и цитирует источник
Ваши статьи и контент, снятый с вашего сайта, лежат в одном хранилище. Именно оттуда AI-оператор достаёт ответ клиенту — и для ваших статей обязан приложить дословную цитату. Насколько полна база, настолько хорош AI: другого рычага здесь нет.
Два источника
Выверенные статьи и текст сайта — разного веса
Это не одно и то же по качеству, и мы не делаем вид, что одно. Ваша статья — проверенный ответ, за который вы отвечаете. Текст сайта — маркетинговая формулировка, полезная как контекст. Поэтому правила обращения с ними разные.
Ваши статьи — курируемое знание
Написаны вами и считаются точным источником. При ответе модель обязана вернуть дословную цитату и точный адрес статьи с разделом — без цитаты ответ отклоняется.
При смешанном наборе найденного приоритет получают именно они, а не текст с сайта.
Контент сайта — быстрый старт
Снимается с ваших страниц и попадает в то же хранилище. Здесь правила мягче: AI может перефразировать, потому что это ваш собственный публичный текст, а не инструкция.
Хороший способ закрыть базовые вопросы, пока курируемых статей мало.
Как из базы достаётся ответ
По запросу берутся 8 ближайших по смыслу фрагментов и только из опубликованных статей. Если подходящих фрагментов нет, AI не выкручивается, а передаёт диалог человеку — подробнее на странице AI-оператор.
Практика
Как писать статьи, чтобы AI не врал
Текст нарезается на фрагменты по заголовкам, до примерно 1800 символов каждый, и заголовок входит в текст фрагмента. Значит, структура статьи прямо влияет на то, что найдётся по запросу клиента.
-
Короткие разделы с говорящими заголовками
Заголовок раздела — это половина того, по чему фрагмент будет найден. «Возврат товара в течение 14 дней» работает лучше, чем «Дополнительная информация».
-
Один вопрос — один раздел
Если в разделе смешаны доставка, оплата и возврат, во фрагмент попадёт всё сразу, а ответ получится размытым. Разделяйте темы, даже если статья станет длиннее.
-
Конкретные формулировки вместо обтекаемых
«Обычно быстро» процитировать невозможно, а «в течение двух рабочих дней» — можно. Чем точнее фраза, тем полезнее цитата-источник в ответе клиенту.
-
Актуальные цены и условия
AI процитирует то, что написано, — включая прошлогоднюю акцию. Устаревший раздел лучше поправить или отправить в архив, чем оставить «на всякий случай».
Публикация статьи запускает переиндексацию, так что правка доходит до поиска без ручных действий.
В консоли
Страница «База знаний AI агента»
Список статей, поиск и редактирование в одном месте. Первым пунктом идёт системный промпт — глобальный контекст компании, который AI учитывает в каждом ответе.
- Системный промпт компании. Кто вы, что продаёте, как обращаетесь к клиентам, чего не обещаете. Это рамка для всех ответов, а не замена статьям.
- Три статуса статьи. Черновик, опубликовано, архив. В поиск попадают только опубликованные.
- Переиндексация при публикации. Нажали «опубликовать» — статья пошла в индекс.
- Изображения в статьях. Инструкцию можно оформить нормально, а не только текстом.
Документы и как считаются векторы
Документы загружаются в базу с автоматическим извлечением текста — не нужно вручную перепечатывать регламент или прайс в статью.
Векторы пересчитываются только для изменившегося текста: содержимое сверяется по хешу, и неизменённые фрагменты переиспользуются. Правка одного абзаца не тянет за собой пересчёт всей базы.
Каждый фрагмент — до ~1800 символов, нарезка идёт по заголовкам, и заголовок остаётся внутри фрагмента.
Индексация сайта
Как ваш сайт превращается в знание для AI
Это способ быстро закрыть базовые вопросы: у большинства компаний половина ответов уже написана на собственных страницах — просто в виде текста для людей, а не для поиска.
- Сначала карта страниц. Она строится с разницей: что добавилось, что удалено, что осталось без изменений. Удалённые страницы уходят в архив и перестают участвовать в ответах.
- Потом чистый текст. Страницы превращаются в текст без шапки, подвала и меню — навигация не должна засорять ответы клиенту.
- Шапка и подвал — отдельно. Из них создаются служебные статьи «шапка сайта» и «подвал сайта»: именно оттуда AI берёт контакты и навигацию.
- Всё в одном хранилище. Снятый контент лежит рядом с вашими статьями и участвует в том же поиске, но с меньшим приоритетом.
Ограничения, о которых надо знать до старта
Индексацию сайта включаем мы со своей стороны — в кабинете такой кнопки нет. Напишите, и мы запустим обход для вашего домена. В консоли при этом видны только ваши статьи: снятый с сайта контент участвует в поиске, но отдельным списком не отображается.
Границы обхода: до 200 страниц и глубина 5. Если сайт упирается в лимит страниц, индексация не запускается — мы сообщим об этом и обсудим, какие разделы брать. Обходчик не полагается на robots.txt вашего сайта, поэтому область обхода согласуем заранее. И ещё: ограничить область знаний по конкретному каналу пока нельзя — база одна на компанию.
Главная работа на старте
Качество ответов AI — это качество вашей базы
Не «умная модель» и не удачные настройки. Если ответа нет в базе, AI передаст диалог человеку — и будет прав. Поэтому наполнение базы знаний остаётся главной задачей при запуске, и делать её приходится однажды, но всерьёз.
Эту работу можно делегировать: Growth Team проводит аудит, собирает статьи и доводит базу до состояния, в котором AI закрывает частые вопросы сам.
С чего начать самому
- Выписать вопросы, которые чаще всего задают в переписке
- Ответить на каждый отдельным разделом с точной формулировкой
- Опубликовать — черновики в поиск не идут
- Проверить ответы AI и дописать то, чего не хватило
Вопросы
Что спрашивают про базу знаний
Посмотрим, что уже можно взять с вашего сайта
Разберём, какие вопросы закроются контентом ваших страниц, а какие придётся описать статьями — и сколько это примерно работы.