Автоматизация бизнес процессов с помощью ИИ отличается от обычной автоматизации одной вещью: в цепочке появляется шаг, результат которого нельзя предсказать заранее. Триггер в CRM сработает одинаково миллион раз, а языковая модель на том же письме может ответить по-разному. Из этого следует всё остальное: тарификация по токенам вместо лицензии, квоты на количество одновременных запросов, отдельный разговор про персональные данные и приёмка не по факту «работает», а по доле правильных ответов на контрольной выборке. Ниже разобрана именно эта, счётная часть: сколько стоит один запрос по прайсам российских платформ, где стоят лимиты и что записать в договор.
Материал сознательно узкий. Пошаговый порядок внедрения, список задач, которые отдают модели первыми, и обзор конструкторов уже разобраны в соседних статьях блога, ссылки на них собраны в предпоследнем разделе.
Практический критерий один. Если для операции можно выписать конечный список условий и он не изменится через месяц, это классическая автоматизация: правило в CRM, сценарий в конструкторе, хранимая процедура. Если условия выписать нельзя, потому что на входе свободный текст, речь, скан или фотография, нужен ИИ-шаг.
Разница видна на приёмке. Обычный сценарий проверяется двумя тестами: сработал на правильном входе, не сработал на неправильном. ИИ-шаг проверяется выборкой: берут 100 или 300 реальных обращений, прогоняют, считают долю верных решений. Ниже порога процесс не запускают, а не «дорабатывают на ходу».
Отсюда второе следствие. У классического сценария стоимость эксплуатации почти нулевая, у ИИ-шага она линейно зависит от объёма: каждый обработанный документ списывает деньги. Поэтому расчёт бюджета делают до пилота, а не после.
Сравнение самих способов автоматизировать шаг, от жёсткого правила до программного робота поверх интерфейса, разобрано в статье AI автоматизация процессов. Дальше здесь только деньги, лимиты и приёмка.
Цены ниже взяты из официальной документации Yandex AI Studio и Сбера на август 2026 года. Схемы оплаты разные. Yandex списывает постфактум за фактически потраченные токены. У Сбера есть и оплата по факту, и пакеты токенов со сроком 12 месяцев, причём удельная цена тысячи токенов в обеих схемах одинаковая: разница в том, что при оплате по факту действует минимальный платёж 600 ₽ в месяц, а неиспользованный пакет сгорает по окончании срока.
| Модель и режим | Цена за 1000 входящих токенов | Цена за 1000 исходящих токенов |
|---|---|---|
| YandexGPT Pro 5.1, синхронно | 0,8 ₽ | 0,8 ₽ |
| YandexGPT Pro 5.1, асинхронно | 0,41 ₽ | 0,41 ₽ |
| YandexGPT Lite, синхронно | 0,2 ₽ | 0,2 ₽ |
| YandexGPT Lite, асинхронно | 0,1 ₽ | 0,1 ₽ |
| Alice AI LLM Flash, синхронно | 0,1 ₽ | 0,2 ₽ |
| GigaChat 2 Lite, пакет 300 млн токенов за 19 500 ₽ | 0,065 ₽ за 1000 токенов любого типа | |
| GigaChat 2 Pro, пакет 50 млн токенов за 25 000 ₽ | 0,5 ₽ за 1000 токенов | |
| GigaChat 2 Max, пакет 30 млн токенов за 19 500 ₽ | 0,65 ₽ за 1000 токенов | |
Все цены Yandex AI Studio указаны с НДС. Пакеты GigaChat для ИП и юрлиц действуют 12 месяцев, цены тоже с НДС, и удельная стоимость внутри одной модели не меняется от размера пакета: и 300 млн, и 1 млрд токенов Lite стоят 0,065 ₽ за тысячу.
Не только генерация текста стоит денег. По прайсу Yandex AI Studio распознавание страницы печатного текста обойдётся в 0,1321 ₽, распознавание таблиц — в 1,22 ₽ за страницу, разбор паспорта или СТС — в 0,71 ₽ за документ. Голосовой агент тарифицируется посекундно: 0,0264 ₽ за секунду входящего аудио и 0,0203 ₽ за секунду исходящего, плюс токены самой модели. Встроенный инструмент веб-поиска стоит 915 ₽ за 1000 вызовов, генерация одной картинки — 2,23 ₽.
Формула простая: количество операций в месяц, умноженное на средний размер запроса в токенах, умноженное на цену тысячи токенов. Единственное, что нужно измерить заранее, это средний размер. Ориентир для делового письма с историей переписки — около 1500 входящих и 300 исходящих токенов, но перед бюджетом его прогоняют через токенизатор на своей почте: у него вызовы не тарифицируются.
Считаем на потоке 3000 писем в месяц по прайсу YandexGPT Pro 5.1:
Вывод из расчёта неочевидный. Плата за модель редко бывает главной статьёй: на 3000 писем разница между самым дорогим и самым дешёвым вариантом около 4000 ₽ в месяц. На таком объёме выбор модели решает меньше, чем интеграция, разметка примеров и поддержка сценария. Экономить на классе модели имеет смысл только там, где объём измеряется сотнями тысяч операций.
Второй вывод: асинхронный режим дешевле синхронного примерно вдвое у обеих моделей YandexGPT. Если ответ не нужен в реальном времени, ночная пакетная обработка почты, заявок или отзывов сразу режет счёт. У пакетного режима есть своя оговорка: минимальная стоимость одного запуска равна 200 000 токенов, поэтому гонять его на десяти документах бессмысленно.
Инструменты автоматизации процессов удобно раскладывать на три слоя, и счёт приходит от каждого.
Ошибка планирования почти всегда одна: бюджет считают по первому слою, а упираются во второй. Сценарий на бесплатном плане Make с минимальным интервалом 15 минут физически не может отвечать клиенту быстрее чем за четверть часа, сколько бы ни стоила модель.
С инструментами автоматизации бизнес процессов регулярно происходит одно и то же: на демо всё летает, на реальной нагрузке упирается в квоту. Значения по умолчанию в Yandex AI Studio стоит выписать до проектирования.
Квоты меняются по заявке в поддержку, лимиты не меняются вообще. Разница принципиальная при проектировании: под квоту закладывают запас времени на согласование, под лимит переделывают архитектуру.
Нужно посчитать, а не гадать
Соберём расчёт по вашему объёму: сколько операций в месяц, какая модель тянет задачу, где упрётесь в квоты и сколько выйдет счёт. Дальше внедрение под ключ с приёмкой по метрике.
Пункт, который пропускают чаще всего. В Yandex AI Studio по умолчанию модели сохраняют все данные запросов. Если в промпт уходят ФИО, телефоны, паспортные данные или коммерческая тайна, логирование отключают явно: в REST-запрос добавляют заголовок x-data-logging-enabled: false, в gRPC ту же опцию в метаинформацию вызова, а в Python SDK при инициализации объекта AIStudio ставят параметр enable_server_data_logging в значение False. Запросы с отключенной опцией на серверах не сохраняются.
Это техническая половина. Юридическая половина в том, что передача персональных данных внешней платформе является поручением обработки и оформляется договором с перечнем действий и требованиями к защите. Отдельно проверяется, не уходят ли данные за пределы России: облачные модели зарубежных вендоров в этом сценарии для большинства российских компаний закрыты не техническими средствами, а требованиями к размещению баз персональных данных.
Рабочая практика: обезличивать данные до вызова модели. Подставлять вместо имени и телефона плейсхолдеры, возвращать их обратно после ответа. Тогда вопрос логирования перестаёт быть критичным, а бюджет на юридическую обвязку не растёт.
Формулировка «бот отвечает на вопросы клиентов» не является техническим заданием, потому что её нельзя проверить. Проверяемая формулировка состоит из пяти чисел. Порядок самого проекта, от пилота до передачи в эксплуатацию, разобран во внедрении ИИ в бизнес-процессы, здесь только цифры, которые уходят в договор.
Отдельным пунктом фиксируют, что происходит при недоступности модели: очередь с повтором, переключение на резервную платформу или передача человеку. Провайдер прямо оговаривает, что при внутренней ошибке сервера запрос не тарифицируется, но обработать этот случай в своей логике всё равно придётся.
Тема разложена по соседним материалам блога, дублировать их здесь нет смысла.
По прайсу Yandex AI Studio на YandexGPT Pro 5.1 запрос в 1500 входящих и 300 исходящих токенов стоит 1,44 ₽ в синхронном режиме и около 0,74 ₽ в асинхронном. На YandexGPT Lite та же операция обойдётся в 0,36 ₽, на пакете GigaChat 2 Lite — примерно в 0,12 ₽.
В Yandex AI Studio квота по умолчанию — 10 одновременных генераций в синхронном режиме и 5000 запросов в час в асинхронном. Vision OCR принимает 1 запрос в секунду синхронно. Квоты увеличиваются по обращению в техподдержку, а лимиты вроде таймаута в 20 минут не меняются.
Отключить логирование заголовком x-data-logging-enabled: false (в SDK параметр enable_server_data_logging=False) и обезличивать данные до вызова, подставляя плейсхолдеры вместо ФИО и телефонов. По умолчанию платформа сохраняет все данные запросов.
Пакет GigaChat 2 Lite на 300 млн токенов стоит 19 500 ₽ и действует 12 месяцев, это 0,065 ₽ за тысячу токенов. Ровно столько же стоит тысяча токенов Lite при оплате по факту, так что дело не в удельной цене. При оплате по факту у Сбера действует минимальный платёж 600 ₽ в месяц, а пакет надо успеть выбрать за 12 месяцев, иначе остаток сгорает. Пакет берут под понятный годовой объём, оплату по факту — когда объём непредсказуем.
Для классификации обращений ориентир от 90% верных решений на выборке минимум в 100 реальных случаев, для извлечения сумм и реквизитов из документов — от 98%. Отдельно фиксируется допустимая доля эскалаций на человека.