У Т-Банка и Авито есть открытые языковые модели для русского языка: T-Pro и A-Vibe. Обе построены на китайской Qwen. Нейросеть Qwen, которую в России чаще называют Квен, давно служит фундаментом для чужих продуктов, но ей можно пользоваться и напрямую: в бесплатном чате, через API или на своём сервере.
Бизнесу важнее не рейтинги, а три практических вопроса. Как модель пишет по-русски. Доступна ли она из России. Когда она выгоднее GigaChat. Ответы на них стоит брать из официальных документов Alibaba, Сбера и Яндекса, а не из пересказов.
Qwen, по-китайски Tongyi Qianwen, разрабатывает команда Qwen в Alibaba Group. Это не одна модель, а семейство. Номер поколения растёт быстро: после Qwen3 вышли 3.5, 3.6, 3.7 и 3.8. Полезнее понимать устройство линейки, чем запоминать цифры.
В названиях открытых моделей встречается запись вида 35B-A3B. Первое число показывает, сколько параметров у модели всего, второе: сколько из них работает при генерации каждого токена. Такая архитектура (MoE) отвечает быстрее обычной модели того же размера, но в памяти всё равно держит все веса.
Qwen Studio. Веб-чат Qwen, адрес: chat.qwen.ai. На qwen.ai сервис описан как бесплатный и открытый для всех. Внутри режим рассуждений, веб-поиск, глубокое исследование с отчётом, генерация картинок и видео, сборка веб-страниц по описанию. Есть приложения для iOS, Android, Windows и macOS.
API. Для разработчиков есть QwenCloud и Alibaba Cloud Model Studio, на них ведут ссылки с qwen.ai. Формат запросов совместим с OpenAI, поэтому Qwen подключают к инструментам, которые умеют работать с OpenAI, простой заменой адреса и ключа. Оплата в долларах за миллион токенов, без предоплаты и минимального платежа. Модели Flash стоят в разы дешевле Max.
Начиная с Qwen3.5 разработчики заявляют поддержку 201 языка и диалекта, русский в списке. Интерфейс приложения тоже переведён на русский. Писать запросы можно сразу по-русски, без перевода на английский.
Качество зависит от размера и версии модели, поэтому проверяйте её на своих текстах: письмах клиентам, описаниях товаров, ответах поддержки. Смотрите на грамотность, стиль и на то, не переходит ли модель на другой язык в длинных ответах.
Если нужна модель с упором на русский, посмотрите на производные. T-Pro от Т-Банка построена на Qwen3-32B, A-Vibe от Авито на Qwen3-8B, обе под лицензией Apache 2.0. Обе команды поменяли токенизатор под русский язык: в T-Pro это прямо заявлено как способ ускорить генерацию русского текста.
В условиях Qwen Studio и справке QwenCloud нет списка стран, где сервис работает или запрещён. Зато есть несколько проверяемых фактов.
Отсюда правило: персональные данные клиентов в зарубежный чат не отправляйте. Для российской компании это трансграничная передача, о которой нужно заранее уведомить Роскомнадзор (ч. 3 ст. 12 152-ФЗ).
Есть и российский путь. В Yandex AI Studio модели Qwen доступны через OpenAI-совместимый API с оплатой в рублях, а обработку данных генеративными моделями Яндекс заявляет в России. Третий вариант не зависит ни от чьих серверов: открытые веса на вашем оборудовании.
GigaChat делает Сбер, и это продукт для российского рынка. Для чата нужны российский IP-адрес и вход через Сбер ID. API оплачивается в рублях с НДС, компании работают по оферте или договору. Модели и лимиты подробно разобраны в обзоре GigaChat для бизнеса.
| Параметр | Qwen | GigaChat |
|---|---|---|
| Разработчик | Alibaba Group, Китай | Сбер, Россия |
| Чат | Qwen Studio: сайт и приложения, бесплатно | Сайт и боты в Telegram и ВКонтакте, нужны российский IP и Сбер ID |
| API | QwenCloud и Model Studio в долларах, Yandex AI Studio в рублях | GigaChat API в рублях; бесплатный режим для физлиц только для личных некоммерческих целей |
| Открытые веса | Десятки моделей, в основном Apache 2.0 | Несколько моделей на Hugging Face, лицензия MIT |
| Русский язык | Один из 201 заявленного языка | В карточках открытых моделей указаны русский и английский |
Qwen выгоднее, когда нужна открытая модель подходящего размера под своё железо, специализированные модели для кода, изображений и звука или тексты на многих языках. GigaChat удобнее, когда важны договор с российским поставщиком, оплата в рублях и обработка данных российской компанией. Спорные случаи решает тест: прогоните обе модели на двух-трёх десятках ваших типовых задач и сравните ответы вслепую.
Открытые веса снимают главный риск зарубежных сервисов: данные не покидают ваш сервер, а модель не исчезнет вместе с чужим API. Выбор размеров широкий: в одном только семействе Qwen3.5 есть модели от 0,8 до 397 млрд параметров. Для крупных моделей разработчики выкладывают облегчённые версии в форматах FP8 и GPTQ-Int4, им нужно меньше видеопамяти.
Запускают такие модели через Ollama или vLLM. Небольшую модель можно проверить на рабочей станции с видеокартой, флагманам нужен сервер с несколькими GPU. Как подобрать железо, разобрано в материале о запуске локальных LLM.
Лицензию читайте до запуска. Большинство открытых Qwen выходят под Apache 2.0, она разрешает коммерческое использование и дообучение. У части новых моделей своя лицензия: отдельное разрешение Qwen может понадобиться, если вы продаёте доступ к модели как сервис или выпускаете на ней самостоятельного ассистента для программирования и офисной работы. Для внутреннего использования, когда модель и её ответы не выходят за пределы компании, это условие не действует.
ИИ-агент отличается от чата тем, что сам вызывает инструменты: ищет клиента в CRM, пишет письмо, ставит задачу. Модели Qwen для этого приспособлены: они вызывают функции и работают с MCP, открытым стандартом подключения внешних инструментов. Qwen3.7-Max разработчики прямо называют основой для агентов и показывают в связке с Claude Code, OpenClaw и Qwen Code.
Для бизнес-агента схема стандартная: узкая задача с измеримым результатом, короткий список инструментов, подтверждение человеком для необратимых действий, журнал всех шагов. Рутину отдайте быстрой модели, сложное планирование флагману, работу с данными клиентов открытой модели в своём контуре. Веб-чат скриптами не автоматизируйте: условия Qwen Studio запрещают автоматически извлекать из него ответы, для агентов есть API. Путь от задачи до прототипа описан в материале о создании ИИ-агента для бизнеса.
Если не хочется разбираться самому, модели к CRM, почте и документам подключают специалисты Neurounit по автоматизации бизнес-процессов: от выбора модели и контура до работающего агента.