Какие российские модели доступны в Савви: YandexGPT, Alice AI LLM, GigaChat-2-Max — чем они отличаются от GPT на практике и как на них перейти.
В Савви пять моделей с размещением в России: YandexGPT 5.1 Pro, YandexGPT-5 Pro, YandexGPT-5 Lite, Alice AI LLM и GigaChat-2-Max. Они не читают изображения и отвечают короче зарубежных аналогов, зато закрывают требование хранить данные в РФ. Стоимость показана относительной шкалой $/$$/$$$, а после переключения инструкцию проверяют заново.
На встрече с банком или госзаказчиком рано или поздно звучит один и тот же вопрос: а где физически считается ответ агента? За ним почти всегда стоит требование не выпускать данные клиентов за границу России. Пока ответ был расплывчатым, сделка стояла на паузе — конкретный список из пяти моделей закрывает этот вопрос за один слайд.
Российская модель — это языковая модель, чьи серверы обработки данных физически расположены в России, а не за рубежом.
В дополнительных настройках агента, в разделе «Параметры LLM», российских моделей пять: YandexGPT 5.1 Pro, YandexGPT-5 Pro, YandexGPT-5 Lite, Alice AI LLM и GigaChat-2-Max. Это единственная группа моделей в списке с размещением в РФ — у остальных серверы стоят в США или Китае.
YandexGPT и Alice AI LLM делает Яндекс, GigaChat-2-Max — Сбер. YandexGPT-5 Lite — самая бюджетная модель группы, уровень стоимости $$; YandexGPT 5.1 Pro, YandexGPT-5 Pro, Alice AI LLM и GigaChat-2-Max идут по верхнему уровню $$$. Требование хранить переписку в РФ иногда путают со сроком её хранения — это отдельный вопрос, разобранный в материале про ИИ-агента и персональные данные, здесь же речь только о том, где стоит сервер модели.
Проверьте на своих диалогах.Регистрация без карты, 500 ₽ на тест по промокоду BLOG500
Собрать агентаМодель отвечает короче и держится инструкции менее гибко: то, что GPT-4.1 или Claude Sonnet 4.6 дотягивают по смыслу сами, YandexGPT и GigaChat ждут прописанным прямо в тексте промпта. Общий принцип подбора модели под задачу агента описан в статье про какую модель выбрать для ИИ-агента; здесь важна именно разница российских моделей с привычными.
Формулировку «постарайся уточнить у клиента» GPT дополнит логикой сама, а российская модель может пропустить шаг, если он не прописан отдельным предложением. Разговорный тон клиента она держит слабее: там, где GPT-4.1 подстроится под неформальное сообщение, YandexGPT иногда отвечает суше, ближе к канцеляриту. Это стоит закладывать в раздел инструкции про стиль ответа заранее, а не чинить после первых жалоб.
Ни одна из пяти российских моделей не читает картинки — так устроены сами YandexGPT, Alice AI LLM и GigaChat, вендоры не добавили в них обработку изображений. Для агента это значит одно: задачу с фото ему решать нечем, и её стоит вывести из-под этой модели заранее, ещё на этапе проектирования канала.
Практический обход простой. Для канала, где клиенты чаще присылают фото (квитанции, VIN-номер, скриншот ошибки), агенту на российской модели стоит оставить стандартную функцию «Вызов менеджера»: она передаёт диалог сотруднику вместо попытки угадать содержимое картинки по подписи клиента. Второй вариант — держать для этого конкретного канала модель OpenAI, Anthropic, Google или xAI, а остальной поток диалогов вести на модели с размещением в РФ.
| Модель | Размещение | Изображения | Относительная стоимость |
|---|---|---|---|
| YandexGPT 5.1 Pro | РФ | Не читает | $$$ |
| YandexGPT-5 Pro | РФ | Не читает | $$$ |
| YandexGPT-5 Lite | РФ | Не читает | $$ |
| Alice AI LLM | РФ | Не читает | $$$ |
| GigaChat-2-Max | РФ | Не читает | $$$ |
Разница внутри группы — в основном в стоимости и в поколении модели. YandexGPT-5 Lite — единственная из пяти, у которой уровень расхода токенов ниже верхнего, и её разумно пробовать первой на несложных сценариях: короткие ответы, маршрутизация, приём заявки.
В кабинете нет цифры в рублях для конкретной модели — только относительная шкала $/$$/$$$, и у четырёх из пяти российских моделей она на верхнем уровне. Точную разницу в деньгах показывает тестовый чат: там есть флаг «Отображать стоимость диалога», и один и тот же сценарий, прогнанный на двух моделях, сразу даёт цифру, а не догадку.
Диалог на платформе в среднем обходится около 15 ₽, тысяча токенов стоит 1 ₽. Для сравнения с ручной обработкой обращений есть один согласованный ориентир: менеджер на окладе около 40 000 ₽ в месяц закрывает порядка 450 обращений, то есть около 89 ₽ за обращение — оценка по средним ставкам, а не тариф платформы. Если поток вырастет резко и стоимость на верхнем уровне шкалы начнёт давить на бюджет, потолок расходов настраивается отдельно — этому посвящены лимиты и контроль расходов.
Если заказчик работает под 152-ФЗ или похожим отраслевым регламентом, размещение данных проверяют до подписания, а не после. Чек-лист перед запуском такого агента — в статье про 152-ФЗ перед запуском.
Закройте вопрос про размещение данных прямо в разговоре: откройте дополнительные настройки при заказчике и покажите пять моделей с пометкой «РФ» рядом с названием. Спор о том, где физически считается ответ, на этом обычно заканчивается.
Дальше прогоните пару тестовых диалогов у него на глазах, чтобы он услышал разницу в тоне и скорости между YandexGPT и GPT-4.1, и отдельно обсудите канал, где клиенты чаще присылают фото. Для него можно оставить модель, которая изображения читает, а остальной поток вести на модели с размещением в России — комбинация в рамках одного агента работает штатно.
Пять: YandexGPT 5.1 Pro, YandexGPT-5 Pro, YandexGPT-5 Lite, Alice AI LLM и GigaChat-2-Max. Все размещены в России, стоимость у них уровня $$–$$$ по относительной шкале кабинета.
Так устроены сами модели — вендоры не добавили в них обработку картинок. Агент на такой модели отвечает только на текст, а вопрос с фото стоит направить оператору или держать для этого канала модель OpenAI, Anthropic, Google или xAI: они изображения читают.
Они короче и требовательнее к формулировкам: фразу «уточни детали заказа, если чего-то не хватает» YandexGPT нередко понимает буквально и спрашивает только то, что перечислено дальше по тексту, а GPT-4.1 сам достраивает список вопросов по смыслу. Разговорный тон клиента российская модель держит слабее и чаще соскальзывает в канцелярит.
Точной цифры в рублях для конкретной модели в кабинете нет — только относительная шкала $/$$/$$$, и у четырёх из пяти российских моделей она на верхнем уровне. Разницу в деньгах показывает тестовый чат с включённым отображением стоимости диалога.
Переключить модель в дополнительных настройках, прогнать 5–10 типовых диалогов в тестовом чате, включая обращения к базе знаний и вызовы функций, и при расхождениях доработать инструкцию под новую модель.
Да, это единственная группа моделей в кабинете Савви с таким размещением. Для банков, госсектора и других сценариев, где расположение серверов проверяют, выбор фактически сведён к этим пяти моделям.