ИИ-агент на DeepSeek: чем V4-Pro отличается от V4-Flash, зачем маскировать персональные данные и почему функции идут по одной за ход.
DeepSeek подходит агенту, когда нужно снизить стоимость диалога и сохранить связность переписки: обе версии Flash стоят дёшево при хорошем качестве. Модель не читает изображения и вызывает функции по одной за ход, а данные обрабатывает в Китае — для ПДн клиентов из России нужна маскировка. Дороже всех в семье DeepSeek-V4-Pro, а её режим рассуждений уходит на нижнюю полку по цене.
Коллега приносит новость: китайская модель обошла западные по бенчмаркам и стоит в разы дешевле. Вопрос закономерный: нельзя ли посадить на неё агента прямо сейчас и сэкономить на каждом диалоге. Отчасти можно — но список условий длиннее одной строчки в новости.
DeepSeek — модель китайской компании DeepSeek, доступная в Савви в четырёх версиях, с обработкой данных на серверах в Китае.
В дополнительных настройках агента, в «Параметрах LLM», у DeepSeek четыре пункта: DeepSeek-V4-Pro, DeepSeek-V4-Pro (Reasoning), DeepSeek-V4-Flash и DeepSeek-V4-Flash (Reasoning). Все размещены в Китае, ни одна не читает изображения.
Стоимость внутри семьи распределена не так, как в других линейках. Обычно младшая версия дешевле старшей, а режим рассуждений дороже обычного — у DeepSeek-V4-Pro получилось наоборот.
| Модель | Стоимость | Когда брать |
|---|---|---|
| DeepSeek-V4-Pro | $$$ | очень большой контекст, длинная история диалога |
| DeepSeek-V4-Pro (Reasoning) | $ | тот же большой контекст, но с рассуждением перед ответом, и дешевле обычной версии |
| DeepSeek-V4-Flash | $ | быстрый поток, качество ответов заявлено высоким при нижнем уровне цены |
| DeepSeek-V4-Flash (Reasoning) | $ | то же самое с рассуждением на сложных репликах |
Перед тем как ставить модель по одной строке из новости, откройте список моделей у себя в кабинете и сверьтесь с актуальными метками. Руководство честно предупреждает: состав и цены меняются вместе с релизами вендора быстрее, чем успевает обновиться любая статья, в том числе эта.
Проверьте на своих диалогах.Регистрация без карты, 500 ₽ на тест по промокоду BLOG500
Собрать агентаЗадача, которую решает DeepSeek, узкая: удержать стоимость диалога и не потерять связность на длинной переписке. Дешёвые модели других вендоров нередко теряют нить разговора уже к пятому-шестому сообщению, если клиент меняет условия на ходу. Короткие FAQ и приветствия они держат нормально, а развёрнутый диалог с уточнениями даётся им хуже. У Flash-версий DeepSeek заявленное качество остаётся высоким при нижнем ценовом уровне, поэтому их берут туда, где раньше стояла модель среднего уровня просто по инерции.
Общий принцип подбора модели под тип задачи и таблица по всем вендорам собраны в статье о том, какую модель выбрать для ИИ-агента. Здесь — только то, что специфично для DeepSeek и не покрыто общей логикой.
Две вещи лучше учесть в проектировании канала заранее, а не обнаружить их на первых живых диалогах.
Первая — картинки. DeepSeek не читает изображения, поэтому вопрос с фото (квитанция, VIN-номер, скриншот ошибки) ему решать нечем. Для такого канала стандартная функция «Вызов менеджера» передаёт диалог сотруднику вместо попытки угадать содержимое по подписи клиента. Тот же обход применяют для российских моделей, разбор есть в статье про ИИ-агентов на российских моделях.
Вторая — порядок вызова функций. DeepSeek не обращается к нескольким функциям за один ход. Если ответ клиенту требует и таблицу с прайсом, и запись в CRM, агент делает это по очереди, не параллельно. На простом сценарии с одной функцией разницы нет вовсе, на многошаговом ответ приходит на пару секунд позже, чем на моделях, которые вызывают функции параллельно.
Сценарий с несколькими последовательными обращениями к CRM или к таблицам лучше проверять тестовым диалогом с реальным числом шагов подряд, а не одним вызовом функции. Разница в скорости накапливается вместе с числом вызовов.
DeepSeek — иностранная модель, и выбор такой модели в настройках Савви расценивается как прямое поручение платформе не обрабатывать через неё персональные данные граждан РФ. Это правило общее для любой модели за пределами России, не только для DeepSeek, и распространяется на весь массив персональных данных клиента, а не только на переписку внутри DeepSeek.
Рабочий обход есть, и он не требует смены модели. В дополнительных настройках, в разделе «Безопасность», включается флаг «Маскировать персональные данные»: номера телефонов, паспортные данные, email и юзернеймы шифруются перед отправкой в модель специальными метками и расшифровываются обратно в ответе. Диалог продолжается на DeepSeek, а в саму модель прямые данные клиента не попадают.
Если агент работает под 152-ФЗ или похожим отраслевым регламентом, порядок действий с моделью и маскировкой короче свести в чек-лист заранее: чек-лист 152-ФЗ перед запуском.
Диалог на платформе в среднем обходится около 15 ₽, а ручная обработка обращения менеджером стоит примерно 89 ₽ при окладе 40 000 ₽ в месяц на 450 обращений — это оценка по средним ставкам, не тариф платформы. DeepSeek-V4-Flash идёт по нижнему уровню стоимости против среднего у GPT-4.1, а обычная DeepSeek-V4-Pro стоит по верхнему: экономия зависит от версии, не от бренда целиком.
Точную разницу в рублях для конкретного сценария показывает тестовый чат с флагом «Отображать стоимость диалога» — один и тот же разговор на двух моделях сразу даёт точную цифру вместо оценки по меткам $ и $$$.
Переключите DeepSeek в дополнительных настройках агента и прогоните 5–10 типовых диалогов в тестовом чате — обязательно с обращением к базе знаний и со сценарием, где нужно подряд вызвать две-три функции. Сравните ответы со старой моделью: тон, длину, скорость на многошаговых сценариях.
Если канал завязан на фото, оставьте под него модель, которая изображения читает, а остальной поток ведите на DeepSeek. Если в диалогах может встретиться телефон, email или паспортные данные клиента из России, включите маскировку в разделе «Безопасность» заранее, до первого реального диалога с клиентом.
Четыре: DeepSeek-V4-Pro, DeepSeek-V4-Pro (Reasoning), DeepSeek-V4-Flash и DeepSeek-V4-Flash (Reasoning). Обе Flash-версии идут по низкому уровню стоимости при хорошем качестве ответов. Обычная V4-Pro стоит как модели верхнего уровня, а дешевле всего в семье — её режим рассуждений.
Нет. Ни одна из четырёх версий не читает картинки: так устроена сама модель. Канал, где клиенты присылают фото, стоит вести на модели OpenAI, Anthropic, Google или xAI, а DeepSeek оставить для текстового потока.
DeepSeek вызывает функции по одной за ход. Если по запросу клиента нужно обратиться и к таблице, и к CRM, агент делает это последовательно, не параллельно. На простых сценариях разница не заметна, на многошаговых прибавляет пару секунд.
Нет напрямую: DeepSeek — иностранная модель, серверы стоят в Китае, и выбор такой модели в кабинете означает поручение не передавать в неё ПДн граждан РФ. Рабочий обход: флаг «Маскировать персональные данные» в разделе «Безопасность» дополнительных настроек шифрует данные перед отправкой в модель и расшифровывает ответ обратно.
По относительной шкале кабинета да, обе версии Flash идут по нижнему уровню стоимости против среднего у GPT-4.1. Точную разницу в рублях показывает тестовый чат с включённым отображением стоимости диалога: у одинаковой инструкции расход токенов на разных моделях отличается заметнее, чем метки $ и $$.
Переключить модель в дополнительных настройках, прогнать 5–10 типовых диалогов в тестовом чате с обращениями к базе знаний и вызовами нескольких функций подряд, сравнить с прежними ответами и при расхождениях уточнить инструкцию под последовательный вызов функций и под более простой стиль формулировок.
Дарим 500 ₽ на баланс при регистрации
Хватит на 33 диалога с ИИ-агентом. Карта не нужна.