ИИ автоматизация для бизнеса: из чего складывается смета

НейросетиИгорь Мельник11 мин чтения
ИИ автоматизация для бизнеса: из чего складывается смета

ИИ автоматизация для бизнеса оплачивается не одним счётом, а восемью строками, и большая часть из них повторяется каждый месяц после запуска. Эта статья только про деньги: из чего собирается смета, что в ней прячут, чем смета пилота отличается от промышленной, как считать стоимость владения за год и как проверить окупаемость.

Тарифы ниже взяты из прайсов вендоров на 22 августа 2026 года. Публичных ставок подрядчиков не существует, поэтому суммы за работы мы не называем, а показываем, как проверить чужую цифру.

Из каких строк собирается смета ИИ-проекта

Смета распадается на восемь позиций. Семь видны в коммерческом предложении, счёт за обращения к модели заказчик узнаёт после запуска.

  1. Обследование процесса. Интервью, снятие шагов, замер базовых метрик до старта. Без него нечего класть в числитель окупаемости.
  2. Лицензии и подписки. CRM, платформа сценариев, телефония. Платёж регулярный, от подрядчика не зависит.
  3. Обращения к модели. Токены, секунды аудио, распознанные страницы, вызовы инструментов. Растёт вместе с нагрузкой.
  4. Интеграции. Обмен с CRM, учётной системой, сайтом, телефонией. Переделывается при каждом изменении на стороне источника.
  5. Данные и разметка. Выгрузка, чистка, приведение к единому виду, ручная разметка примеров.
  6. Инфраструктура. Хранилище, индекс, мониторинг, при закрытом контуре выделенные мощности.
  7. Обучение сотрудников. Регламент, что делать, когда модель ответила неправильно, и кто отвечает.
  8. Поддержка после запуска. Ежемесячный платёж или пакет часов.

Быстрая проверка чужого предложения: если в нём нет позиций 3, 5 и 8, это не смета, а цена демонстрационного стенда. Сами этапы внедрения ИИ в бизнес-процессы разобраны отдельно, здесь только их цена.

Лицензии и подписки: автоматизация бизнеса искусственный интеллект по прайсу вендора

Часть счёта вы платите не подрядчику. Автоматизация бизнеса искусственный интеллект живёт поверх учётной системы, и её модель тарификации влияет на бюджет сильнее работы интегратора.

Битрикс24 берёт деньги за портал целиком: по прайсу на август 2026 года «Базовый» стоит 2 490 рублей в месяц за 5 пользователей, «Стандартный» 6 990 за 50, «Профессиональный» 13 990 за 100, «Энтерпрайз» 33 990 за 250, при годовой оплате скидка 35 процентов. amoCRM считает за каждого пользователя в месяц: «Базовый» 599 рублей, «Расширенный» 1 299, «Профессиональный» 1 799. До 1 сентября 2026 года два старших тарифа продаются по акции за 1 199 и 1 699 рублей, дальше действует базовый прайс.

Сотрудников в системе Битрикс24 «Профессиональный» amoCRM «Профессиональный»
10 13 990 руб/мес 17 990 руб/мес
50 13 990 руб/мес 89 950 руб/мес
100 13 990 руб/мес 179 900 руб/мес

Разница почти в 13 раз на сотне сотрудников возникает из-за модели тарификации, а не качества систем. Если сценарий требует завести в систему всю смену колл-центра, поштучный прайс делает подписку главной строкой бюджета.

Второе ограничение касается бесплатных режимов. Доступ к GigaChat API в режиме freemium даётся исключительно для личного некоммерческого использования, коммерческое допускается после покупки платного пакета. Протестировать бесплатно можно, запустить в продажах нельзя.

Оплата за модель: автоматизация искусственный интеллект тарифицируется по токенам

Автоматизация искусственный интеллект не имеет абонентской платы: вы платите за объём обработанного текста, аудио и изображений. Ставки российских провайдеров на 22 августа 2026 года ниже.

Услуга Цена с НДС Провайдер
1000 токенов, GigaChat Lite, синхронно 0,065 руб GigaChat API
1000 токенов, GigaChat Max, синхронно 0,65 руб GigaChat API
1000 входящих токенов, YandexGPT Pro 5.1 0,8 руб Yandex AI Studio
1000 токенов, YandexGPT Lite 0,2 руб Yandex AI Studio
1000 токенов на векторизацию текста 0,0101 руб Yandex AI Studio
1 страница печатного текста, распознавание 0,1321 руб Yandex AI Studio
1 секунда входящего аудио, голосовой агент 0,0264 руб Yandex AI Studio

Считать надо не ставку, а месячный объём. Поддержка с тысячей диалогов в день и средним диалогом на 4 тысячи токенов даёт 120 миллионов токенов в месяц: 7 800 рублей на GigaChat Lite, 78 000 на GigaChat Max, около 96 000 на YandexGPT Pro 5.1. Выбор модели меняет счёт в десять раз при одном сценарии, поэтому модель в смете обязана быть названа поимённо.

Три способа уменьшить эту строку, не трогая сценарий. Асинхронный режим примерно вдвое дешевле синхронного: 0,41 рубля за тысячу токенов против 0,8, те же 120 миллионов токенов на YandexGPT Pro 5.1 обойдутся в 49 200 рублей вместо 96 000. Пакетный режим открыт только для моделей с открытыми весами (Qwen, Llama, Gemma, phi-4) по ставкам от 0,1 рубля за тысячу токенов, минимальная стоимость запуска 200 000 токенов. Кеширование включается автоматически: у Alice AI LLM Flash кешированная тысяча токенов стоит 0,025 рубля против 0,1 за входящую.

Предоплаченные пакеты скидки не дают: пакет на 1 миллиард токенов GigaChat Lite стоит 65 000 рублей, те же 0,065 рубля за тысячу, что и оплата по факту, и сгорает через 12 месяцев. Смысл пакета в закрывающих документах, а не в цене. Минимальные расходы у GigaChat при оплате по факту 600 рублей в месяц: если наработали меньше, спишут всё равно 600.

Интеграции и внедрение CRM системы: где смета растёт быстрее всего

Интеграция почти всегда дороже модели. Внедрение CRM системы вместе с ИИ-контуром упирается не в логику сценария, а в лимиты обмена данными.

Облачный Битрикс24 ограничивает интенсивность REST-запросов по алгоритму leaky bucket: на всех тарифах кроме «Энтерпрайз» счётчик уменьшается со скоростью 2 запроса в секунду при пороге блокировки 50, на «Энтерпрайз» 5 запросов при пороге 250. Запрос обязан уложиться в 60 секунд, за сутки при 2 запросах в секунду проходит 172 800 обращений. amoCRM держит планку 50 запросов в секунду на аккаунт.

В деньгах это выглядит так. Первичная синхронизация 200 тысяч сделок поштучно займёт около 27,8 часа. Через метод batch, упаковывающий до 50 вызовов в один HTTP-запрос, та же выгрузка укладывается в 33 минуты. Разница между подрядчиком, который знает про batch, и остальными, это несколько суток работ.

Четыре вопроса до подписания сметы: сколько полей синхронизируется и в какую сторону; что делать при конфликте, когда поле изменили с обеих сторон; как обрабатываются дубли; кто платит за переделку, если вендор изменит формат ответа метода.

Данные, разметка и дообучение: строка без фиксированной цены

Публичных прайсов здесь нет ни у кого: объём работы задаёт состояние ваших данных, а не тариф вендора. Зато проверяется то, что идёт после разметки.

Дообучение в Yandex AI Studio на стадии Preview не тарифицируется, а дообученная YandexGPT Lite считается по цене базовой. Само обучение денег не стоит, стоит подготовка выборки.

Классификация показывает, как выбор модели меняет счёт при одном тексте. Единица тарификации у YandexGPT Lite это запрос до 1 000 токенов за 0,1525 рубля, у YandexGPT Pro и дообученного классификатора запрос до 250 токенов за ту же цену. Текст на 770 токенов у Lite считается как один запрос, у Pro как четыре: на потоке в 100 тысяч документов это 45 750 рублей разницы.

Сама векторизация базы знаний почти ничего не стоит: 50 тысяч документов по 1 500 токенов это 75 миллионов токенов, по ставке 0,0101 рубля за тысячу около 758 рублей единоразово. Дорого обходится приведение документов к пригодному виду.

Инфраструктура и закрытый контур: когда выделенные мощности дешевле API

Закрытый контур обсуждают, когда данные нельзя отдавать наружу, и у него есть точная цена. Выделенный инстанс в Yandex AI Studio для Qwen 2.5 VL 32B Instruct в конфигурации S стоит 817,40 рубля в час: 596 702 рубля в месяц и около 7,16 миллиона в год за одну конфигурацию.

Точка безубыточности считается в одно действие. При ставке 0,8 рубля за тысячу токенов выделенный инстанс окупается на объёме около 746 миллионов токенов в месяц. Всё, что меньше, дешевле обслуживать обычным API: компании со 120 миллионами токенов своя мощность обойдётся в шесть раз дороже.

Если данные уходят в зарубежный сервис, добавляется юридическая работа. По части 3 статьи 12 закона 152-ФЗ оператор обязан до начала трансграничной передачи уведомить Роскомнадзор отдельным уведомлением, не тем, что подаётся по статье 22. Решение принимается за десять рабочих дней, и до истечения срока передача в страны вне перечня с адекватной защитой запрещена.

Пилот и промышленная эксплуатация: две разные сметы

Пилот и промышленный запуск отличаются составом работ: в смете пилота законно нет того, без чего боевой контур не живёт.

Позиция Пилот Промышленная эксплуатация
Роли и права доступа обычно нет обязательны
Логирование и мониторинг нет отдельная строка сметы
Поведение при отказе API ошибка на экране очередь, повтор, ручной канал
Соглашение об уровне сервиса нет с временем реакции и компенсацией

Вывод: цену пилота нельзя умножать на количество процессов и получать бюджет внедрения, состав работ другой. Отдельно проверьте акции провайдеров: Yandex Cloud покрывает грантом 100 процентов стоимости ресурсов на первые 60 дней при миграции инфраструктуры, а это ровно срок проверки гипотезы.

Три модели ценообразования подрядчика и чем каждая рискованна

Способ, которым подрядчик берёт деньги, определяет, кто несёт риск неопределённости. Невыгодных моделей нет, есть неподходящие.

Модель Когда работает Чем плоха для заказчика
Фиксированная цена процесс описан, интеграции перечислены, данные выгружены вы платите за резерв на неизвестность, который может не понадобиться; любое изменение уходит в допсоглашение
Время и материалы исследовательская задача, объём данных неизвестен бюджет не ограничен сверху; без недельной отчётности по часам вы платите вслепую
Подписка за результат результат однозначен: обработанное обращение, распознанный документ подрядчик оптимизирует метрику, а не процесс; при росте объёма подписка обгоняет разовую разработку

Правило выбора: фикс уместен ровно настолько, насколько подробно описан предмет. Без обследования фиксированная цена означает либо переплату, либо конфликт по объёму.

Нужна смета, а не вилка от 80 тысяч до 5 миллионов

Разберём процесс, назовём модель и провайдера поимённо, посчитаем месячный счёт за токены и покажем точку окупаемости до старта работ.

Обсудить задачу

Стоимость владения за год вместо цены проекта

Цена проекта это разовый платёж. Стоимость владения это то, во что решение обойдётся за год работы, и складывается она из четырёх строк.

  • Подписки за год. CRM, телефония, хранилище. Берутся из прайса вендора, а не из сметы подрядчика.
  • Модель за год. Месячный объём токенов умножается на 12 и на ставку модели. Закладывайте рост нагрузки, а не текущий уровень.
  • Инфраструктура. Индекс, хранилище, мониторинг, при закрытом контуре мощности по часам.
  • Поддержка и доработки. Пакет часов или ежемесячный платёж по договору.

Пример. Модель за 7 800 рублей в месяц на GigaChat Lite плюс Битрикс24 «Профессиональный» за 13 990 дают 261 480 рублей регулярных расходов за год, до строки за работы подрядчика. Сравнивать с экономией надо эту сумму.

Почему факт расходится со сметой и что можно закрыть своими силами

Расхождение возникает по трём причинам, и все три предсказуемы.

Объём данных оказался другим. В смете было «выгрузить базу знаний», на деле она лежит в четырёх местах в трёх форматах. Лечится так: до сметы вы сами делаете выгрузку и называете число файлов и страниц.

Интеграций оказалось больше. Каждая новая система в контуре добавляет не одну связь, а связь с каждой из уже подключённых. Считать надо по списку до подписания.

Процесс изменился в ходе проекта. Отдел перешёл на другой сценарий продаж, и половина работы устарела. Это не вина подрядчика, но платить будете вы, если в договоре нет порядка изменений.

Четыре позиции заказчик закрывает сам и снимает из счёта целиком: выгрузка и чистка данных до старта; актуализация справочников и полей в CRM; выдача доступов в первый день, а не на третьей неделе; сотрудник, который принимает результат в тот же день. Последний пункт экономит больше остальных: простой на ожидании оплачивается при любой модели.

Как проверить окупаемость: числитель, база, горизонт

Расчёт окупаемости ломается в трёх местах, и все три чинятся до старта.

Числитель. В экономию идёт только то, что превращается в деньги: часы, которые вы перестанете оплачивать или займёте другой работой, штрафы, которых не будет, выручка от потерянных раньше обращений. Стоимость часа берётся из фонда оплаты труда, а не из оклада: сверху идут страховые взносы по единому тарифу 30 процентов в пределах предельной величины базы и 15,1 процента сверх неё (статья 425 Налогового кодекса). Годовая сумма делится на норму рабочего времени: в 2026 году это 1 972 часа при 40-часовой неделе.

База. Цифру «до внедрения» надо снять до внедрения, иначе сравнивать будет не с чем. Минимум: сколько обращений в месяц, сколько минут занимает одно, сколько человек задействовано, какая доля обращений типовая. В расчёт подставляется именно доля типовых обращений, а не полный объём процесса: сто процентов операций ИИ не забирает.

Горизонт. Годовую экономию сравнивают не с ценой проекта, а со стоимостью владения за тот же год. Проект с регулярными расходами 261 480 рублей окупается совсем не там, где такой же проект с расходами в 7 миллионов на выделенные мощности.

Частые вопросы

Сколько стоит месяц работы ИИ-поддержки с тысячей диалогов в день

При среднем диалоге в 4 тысячи токенов это 120 миллионов токенов в месяц: 7 800 рублей на GigaChat Lite, 78 000 на Max, около 96 000 на YandexGPT Pro 5.1. Сверху подписки и поддержка.

Даёт ли предоплаченный пакет токенов скидку

Нет. Пакет на 1 миллиард токенов GigaChat Lite стоит 65 000 рублей, те же 0,065 рубля за тысячу, что и оплата по факту, и сгорает через 12 месяцев. Смысл пакета в закрывающих документах, а не в цене.

Когда выгоднее выделенные мощности, а не оплата по API

Выделенный инстанс конфигурации S в Yandex AI Studio стоит 817,40 рубля в час, 596 702 рубля в месяц. При ставке 0,8 рубля за тысячу токенов он окупается на объёме около 746 миллионов токенов в месяц, ниже порога дешевле платить по факту.

Можно ли протестировать модель бесплатно и запустить в продажи

Бесплатный доступ к GigaChat API даётся только для личного некоммерческого использования, коммерческое допускается после покупки платного пакета. Минимальный платёж при оплате по факту 600 рублей в месяц.

Что закладывать в график, если данные уходят за границу

Десять рабочих дней на рассмотрение Роскомнадзором отдельного уведомления о трансграничной передаче по части 3 статьи 12 закона 152-ФЗ, плюс до десяти рабочих дней на ответ по запросу регулятора.

Поделиться:

About Author: Игорь Мельник

nu_editor_melnik@neurounit.ai

Редактор Neurounit. Пишет про автоматизацию, разработку и внедрение AI в процессы.

Neurounit

Запустить рост с AI

Оставьте заявку или напишите в мессенджер