Российские нейросети закрывают три вопроса, на которых спотыкаются зарубежные сервисы: доступ без VPN, оплата в рублях и договор с российским юрлицом. Для компании это разница между «попробовали в личном аккаунте» и «встроили в процесс с закрывающими документами».
Но под словами «российская нейросеть» скрываются три разных продукта. Бесплатный чат для людей. Платный API, через который модель встраивают в CRM, ботов и документооборот. И открытые веса, которые компания запускает на своём сервере, не отправляя наружу ни одного запроса. У одного разработчика часто есть все три формы, а условия у них разные.
Поэтому выбор начинается не с рейтинга моделей, а с двух вопросов: где будут жить ваши данные и кто за что платит. Ответы сразу отсекают половину вариантов.
Крупных игроков немного. Сбер развивает GigaChat для текста, Kandinsky для картинок и видео, SaluteSpeech для речи. У Яндекса флагманское семейство моделей называется Alice AI: на нём работает чат «Алиса AI», а бизнесу модели Alice AI и YandexGPT доступны в Yandex AI Studio. Картинки Яндекс генерирует и в Алисе, и в отдельном приложении Шедеврум. Т-Банк и Авито выкладывают открытые языковые модели для самостоятельного запуска.
| Семейство | Разработчик | Как получить доступ | Условия |
|---|---|---|---|
| GigaChat, Kandinsky | Сбер | Чат на сайте, в Telegram, VK и MAX; API; открытые веса части моделей | Чат бесплатный; API пакетами или по факту; веса под MIT |
| Alice AI, YandexGPT | Яндекс | Чат «Алиса AI»; API в Yandex AI Studio; открытая YandexGPT 5 Lite | Чат бесплатный, есть опция «Алиса Плюс»; API за токены в рублях; у Lite своя лицензия |
| T-Pro, T-Lite | Т-Банк | Веса на Hugging Face | Apache 2.0, основа Qwen3 |
| A-Vibe | Авито | Веса на Hugging Face | Apache 2.0, основа Qwen3-8B |
| GigaAM, T-one | Сбер, Т-Банк | Веса на Hugging Face | Распознавание русской речи; MIT и Apache 2.0 |
Обратите внимание на последнюю колонку. Часть открытых российских моделей построена на китайской Qwen и дообучена под русский язык. Для качества это не минус, но если заказчик требует собственную разработку, уточняйте происхождение базовой модели.
Оба флагманских чата бесплатны. Различия в доступе и экосистеме.
Последний пункт важен для бизнеса. Картинку для рекламы проверяйте не на красоту, а на права: условия использования результатов у сервисов разные и прописаны в соглашениях. Второй нюанс: бесплатные чаты привязаны к личным аккаунтам, история и файлы остаются в профиле конкретного сотрудника. Для регулярной работы команды это неудобно и небезопасно, поэтому повторяющиеся задачи со временем переезжают на API с общими правилами. Подробности о каждом ассистенте в отдельных разборах: GigaChat от Сбера: модели, лимиты и применение в бизнесе и что умеет Алиса и где её границы.
Чат не подключишь к CRM. Для автоматизации нужен API, и здесь модели отличаются уже условиями, а не интерфейсом.
GigaChat API Сбер продаёт юрлицам и ИП двумя способами: пакетами токенов с фиксированным объёмом или по факту потребления с ежемесячным счётом и минимальным платежом. У физлиц есть бесплатный годовой лимит токенов, но соглашение ограничивает его личными некоммерческими целями. Для рабочих задач компании нужен договор на юрлицо.
Yandex AI Studio тарифицирует генерацию за тысячу токенов в рублях с НДС, асинхронный режим обходится дешевле синхронного. API совместим с форматом OpenAI, так что код, написанный под зарубежные модели, переносится с минимальными правками. Кроме моделей Яндекса, на платформе работают открытые модели других разработчиков, включая DeepSeek и Qwen. По заявлению Яндекса, обработка данных генеративными моделями идёт в России, а при необходимости возможна установка в контуре заказчика или гибридная схема.
Что сравнивать при выборе API:
Прайс в токенах сам по себе ничего не говорит о бюджете. Прогоните через API сотню реальных запросов, посмотрите фактический расход и умножьте на месячный объём. Разница между моделями на вашей задаче может оказаться совсем не такой, как в таблице тарифов.
Если данные нельзя выносить за периметр, внешний API не подходит в принципе. Остаются открытые веса: модель скачивается и работает на вашем оборудовании.
MIT и Apache 2.0 почти ничего не требуют от бизнеса, кроме сохранения текста лицензии и уведомлений об авторстве. Собственные лицензии читайте целиком: пороги объёма и обязательные уведомления прячутся именно там. И считайте железо заранее: компактной модели хватит одного сервера с видеокартой, флагманской версии нужен кластер. Про выбор железа и запуск подробно в материале о локальных LLM на своём сервере.
Текстовые модели лишь часть рынка. Для звонков, контента и дизайна у российских разработчиков есть отдельные инструменты.
Тестируйте на своих данных. Двадцать реальных примеров из вашей работы скажут больше любого рейтинга: публичные бенчмарки меряют не ваши задачи.
Если разбираться с API, лицензиями и серверами самостоятельно не хочется, это делают в команде автоматизации бизнеса Neurounit: подбирают модель под задачу и встраивают её в ваши процессы.