Тон агента — это не только слова в инструкции. Разбираем настройки Савви, которые задают ритм ответа: ожидание мысли, длину, разбивку и случайность.
Живой тон агента складывается из двух вещей сразу: из слов в инструкции и из ритма разговора. Блок «#СТИЛЬ ОТВЕТА» задаёт саму манеру речи, «Время ожидания» дожидается, пока клиент допишет мысль несколькими сообщениями, «Разделение ответа» режет готовый текст на несколько сообщений с паузой, а «Случайность» решает, насколько по-разному звучат похожие ответы.
Клиент в переписке спрашивает: «А сколько стоит?» — и получает три абзаца с маркированным списком: тарифы, условия рассрочки, ссылка на калькулятор и вежливое предложение обращаться при вопросах. Каждое слово в ответе правда. Читается это как выгрузка из прайса, а не как реплика человека, который минуту назад впервые увидел этот вопрос.
Разговор делает живым совпадение нескольких настроек сразу: слова, которые агент выбирает, темп, в котором он отвечает, и то, различаются ли похожие ответы от диалога к диалогу. За это отвечают четыре разных места в кабинете, и работают они вместе.
| Настройка | За что отвечает | Где лежит |
|---|---|---|
| #СТИЛЬ ОТВЕТА | слова, длина фразы, обращение | инструкция агента |
| Время ожидания | пауза перед ответом, объединение сообщений клиента | дополнительные настройки |
| Разделение ответа от агента | разбивка готового текста на несколько сообщений | дополнительные настройки |
| Случайность | насколько по-разному звучат похожие ответы | дополнительные настройки → параметры LLM |
Проверьте на своих диалогах.Регистрация без карты, 500 ₽ на тест по промокоду BLOG500
Собрать агентаЗа словесную сторону тона отвечает блок «#СТИЛЬ ОТВЕТА» системной инструкции. Руководство описывает его так: этот блок отвечает за всё, что связано со стилистикой ответов агента, и здесь можно уменьшить доброжелательность, сократить длину ответа и так далее. Пример: агент получает в этом блоке не прилагательное «дружелюбный», а готовую фразу «Замер бесплатный, займёт около часа»: с этой репликой держится и обращение на «вы», и нужная длина, а подбор фразы под нишу описан в имени и тоне агента.
Слова — только половина дела. Даже с точным примером в инструкции агент выдаёт себя ритмом: отвечает мгновенно на каждый обрывок мысли, присылает один сплошной абзац вместо переписки и звучит одинаково в любом диалоге. Это три отдельные поломки, и чинят их три разные настройки.
Настройка «Время ожидания» — это пауза перед тем, как агент начинает отвечать. Пока она идёт, новые сообщения клиента складываются в один смысловой блок, и агент отвечает на всю мысль целиком, а не на каждую строчку по отдельности. Руководство приводит наглядный пример: клиент пишет подряд «Добрый день!», «У меня есть вопрос», «Подскажите сколько будет стоить ваш товар» и «И есть ли скидки» — четыре сообщения задержка превращает в одну реплику: «Добрый день! У меня есть вопрос. Подскажите сколько будет стоить ваш товар и есть ли скидки», и агент отвечает на неё один раз.
Человек, которому написали четырьмя сообщениями подряд, не отвечает на первую же строчку отдельным приветствием — он дожидается, пока собеседник договорит, и реагирует на всё сразу. Без паузы агент делает наоборот: реагирует на каждое сообщение по отдельности, и в переписке вместо одной живой реплики появляются четыре механических.
Клиент отправил вопрос и ждёт заметно дольше, чем ждал бы от живого собеседника в мессенджере: это одна крайность. Слишком короткая пауза не успевает собрать сообщения в одну мысль, и агент снова отвечает на обрывок: это другая. Стартовое значение стоит подбирать по тому, как реально печатают ваши клиенты — сообщениями по одному слову или цельными абзацами.
У этой же паузы есть вторая причина существования, отдельная от склейки сообщений. Руководство прямо пишет: часто компании не хотят, чтобы клиент понимал, что отвечает агент, и дополнительная задержка в ответе позволяет имитировать поведение человека, который печатает сообщение вручную.
Лимит токенов часто путают с рычагом длины, и это ошибка. «Максимальное количество токенов в ответе агента» определяет максимальный ответ, который может быть обработан от модели, и при превышении лимита в диалоге отобразится ошибка. Это потолок ответа модели, а длину реплики регулирует блок #СТИЛЬ ОТВЕТА. Заниженное значение обрывает ответ на середине фразы вместо того, чтобы сделать его короче; механика этой ошибки и рабочий обход описаны в «Агент отвечает слишком длинно».
Короткий ответ читается живее длинного благодаря тому, как пишут люди в мессенджере: две-три реплики без вводных фраз, где сразу видна суть. Ответ из лид-сцены этой статьи, три абзаца про тарифы и рассрочку на простое «сколько стоит», превращается в живую реплику, если #СТИЛЬ ОТВЕТА требует счётного ограничения: два предложения и один встречный вопрос, а не пересказ всего прайса целиком.
Настройка «Разделение ответа от агента» режет уже готовый текст на несколько сообщений с паузой между отправками. Три шага — тип разделения, размер чанка в предложениях или абзацах и задержка в секундах — показаны на примере в «Агент отвечает слишком длинно». Объём текста разделение не меняет: за него по-прежнему отвечает #СТИЛЬ ОТВЕТА, а эта настройка управляет только тем, как ответ приходит в переписку.
Для тона в этом ценность отдельная. Человек, который печатает быстро, часто отправляет мысль по частям: сначала короткую реакцию, потом уточнение. Агент с включённым разделением ведёт себя похоже — клиент видит первую часть ответа раньше, чем закончилась вторая, и переписка перестаёт выглядеть как ожидание одного большого файла.
Ползунок «Случайность» задаёт разброс формулировок: чем больше значение, тем более креативным будет ответ, чем меньше — тем более точным и формальным. Три готовых режима: «Стабильность» на значении 0, «Сбалансированность» на 10, «Креативность» на 20. Полный список причин, по которым агент вообще звучит по-разному на одинаковый вопрос, собран в материале про разброс формулировок агента.
Для тона это значит одно: совсем ровный, буквально одинаковый ответ на разные формулировки одного вопроса — такая же примета бота, как и слишком вольный текст на теме, где клиент ждёт точности. У «Сбалансированности» есть смысл держать как значение по умолчанию для переписки, где агент и придерживается инструкции, и не звучит как рассылка. «Стабильность» стоит оставлять темам, где цена ошибки в цифре выше цены живости: цена, скидка, срок гарантии, реквизиты.
Перепишите фразу-образец в #СТИЛЬ ОТВЕТА так, чтобы её можно было прочитать вслух за один вдох, и только после этого переходите к времени ожидания, разделению ответа и случайности — они управляют темпом уже написанного текста, а не самими словами.
Прогоните пять живых вопросов клиентов через тестовый чат после каждой правки и читайте ответы вслух — задержку и разделение видно только при отправке в подключённый канал, поэтому финальную проверку ритма стоит повторить уже в Telegram, WhatsApp или на сайте. Полный список параметров ответа и базы знаний собран в руководстве платформы.
Тон складывается сразу из нескольких мест: слова задаёт блок «#СТИЛЬ ОТВЕТА» в инструкции, а ритм разговора — «Время ожидания», «Разделение ответа» и «Случайность» в дополнительных настройках. Менять их стоит по отдельности, а проверять результат вместе, на одних и тех же вопросах.
Потому что пауза перед ответом не выставлена или слишком короткая. Настройка «Время ожидания» собирает несколько сообщений клиента в одну мысль и позволяет ответить на неё целиком, а не на первую же строчку вроде «Добрый день».
Нет, «Максимальное количество токенов в ответе агента» — это потолок, за которым в диалоге появится ошибка, а не регулятор длины реплики. Реальную длину задают в блоке «#СТИЛЬ ОТВЕТА» счётным требованием: два-три предложения и один встречный вопрос.
Разбивает уже написанный ответ на несколько сообщений с паузой между отправками: настраиваются тип разделения, размер чанка в предложениях или абзацах и сама задержка в секундах. Объём текста при этом остаётся прежним, меняется только то, как ответ приходит в переписке.
«Сбалансированность» — среднее из трёх готовых режимов, значение 10. Она сочетает точность с лёгкой долей креативности и подходит для обычной переписки; «Стабильность» стоит оставлять темам, где ошибка в цифре дороже живости ответа: цена, скидка, срок гарантии.
Нет. В Telegram и WhatsApp клиенты чаще пишут несколькими короткими сообщениями подряд, в виджете на сайте — одним развёрнутым. Значение паузы стоит подбирать под привычку клиентов конкретного канала.