YandexGPT Pro: тарифы Yandex AI Studio и доступ по API

НейросетиМария Соколова11 мин чтения
YandexGPT Pro: тарифы Yandex AI Studio и доступ по API

YandexGPT Pro это платная модель Yandex AI Studio, к которой обращаются по API и платят за фактически потраченные токены, без абонентской платы. Ниже разобрано, сколько стоит тысяча токенов в каждом режиме, какие эндпоинты и роли нужны для первого запроса, что тарифицируется помимо генерации текста и как посчитать месячный счет до того, как код уйдет в продакшен. Все цены приведены из официальной страницы тарификации AI Studio в редакции от 31 июля 2026 года, в рублях с НДС, для региона Россия.

Чем YandexGPT Pro отличается от Lite

Разница между уровнями не в интерфейсе, а в цене токена и в классе задач. YandexGPT Lite стоит 0,2 рубля за 1000 токенов и на входе, и на выходе, YandexGPT Pro 5.1 стоит 0,8 рубля за 1000 входящих и столько же за 1000 исходящих в синхронном режиме. Разрыв ровно четырехкратный, поэтому решение «весь трафик на Pro» обходится бюджету вчетверо дороже связки «простое на Lite, рассуждения на Pro».

Правило простое: Lite закрывает задачи с коротким проверяемым ответом (тег тональности, извлечение поля из письма, нормализация адреса), Pro нужен там, где модель держит длинную инструкцию и связывает несколько документов: ответ по регламенту, разбор договора, сборка коммерческого предложения по данным CRM.

У Pro 5.1 есть отдельная строка: токены инструментов стоят 0,2 рубля за 1000, вчетверо дешевле обычных входящих. Это некешированные токены истории сообщений, которые уходят в модель в момент возврата результата встроенного инструмента, и в агентских сценариях они заметно меняют итог.

Если интеграция пока не нужна и задача звучит как «посмотреть, что модель вообще умеет», начинать в AI Studio необязательно: бесплатные точки входа к моделям Яндекса разобраны в материале YandexGPT онлайн бесплатно. Эта страница про слой разработчика: ключи, эндпоинты, счет за токены.

Линейка моделей: где стоит yandexgpt 5 и 5.1

В прайс-листе AI Studio живут два поколения флагмана. Строка yandexgpt 5 это YandexGPT Pro 5 по 1,2 рубля за 1000 токенов, YandexGPT Pro 5.1 стоит 0,8 рубля. Новое поколение дешевле предыдущего в полтора раза, и оставаться на пятой версии есть смысл только там, где промпты жестко откалиброваны под нее.

Рядом в Model Gallery живут открытые модели со своими ценниками: Qwen3 235B за 0,5 рубля, gpt-oss-120b за 0,3, gpt-oss-20b за 0,1, Qwen3.6 35B за 0,2 на входе и 0,3 на выходе. Отдельная ветка это диалоговые модели Alice AI LLM и Alice AI LLM Flash.

Модель Вход, руб. за 1000 Кешированные, руб. за 1000 Токены инструментов, руб. за 1000 Выход, руб. за 1000
YandexGPT Pro 5.1 0,8 0,8 0,2 0,8
YandexGPT Pro 5 1,2 1,2 1,2 1,2
YandexGPT Lite 0,2 0,2 0,2 0,2
Alice AI LLM 0,5 0,5 0,13 1,2
Alice AI LLM Flash 0,1 0,025 0,025 0,2
DeepSeek V4 Flash 0,3 0,075 0,075 0,5
Qwen3 235B 0,5 0,5 0,5 0,5
gpt-oss-120b 0,3 0,3 0,3 0,3
Qwen3.6 35B 0,2 0,05 0,05 0,3

Кеширование включается платформой автоматически и не гарантируется, на исходящие токены оно не распространяется. У YandexGPT Pro 5.1 и Lite цена кешированного токена равна цене входящего, поэтому экономию дает не кеш, а сокращение промпта.

Сколько стоит нейросеть yandexgpt на реальном объеме

Считать нейросеть yandexgpt в рублях удобнее не по прайсу, а по среднему запросу. Возьмем типовой сценарий поддержки: 2000 входящих токенов (системная инструкция плюс фрагмент базы знаний плюс вопрос) и 500 исходящих, итого 2,5 тысячи токенов на обращение.

  • YandexGPT Pro 5.1, синхронный режим: 2,5 умножить на 0,8 равно 2 рубля за запрос.
  • YandexGPT Lite: 2,5 умножить на 0,2 равно 0,5 рубля за запрос.
  • YandexGPT Pro 5.1, асинхронный режим: 2,5 умножить на 0,41 равно 1,03 рубля за запрос.

При тысяче обращений в сутки это 60 000 рублей в месяц на синхронном Pro 5.1, 30 750 на асинхронном и 15 000 на Lite. Разница между крайними вариантами четырехкратная и определяется маршрутизацией. Деталь для расчета: внутренние ошибки сервера не тарифицируются, упавший на стороне платформы запрос в счет не попадает.

Асинхронный и пакетный режимы: где яндекс yandexgpt дешевле вдвое

Яндекс yandexgpt тарифицирует один и тот же текст по-разному в зависимости от режима работы. Асинхронный режим дешевле синхронного почти вдвое: YandexGPT Pro 5.1 обходится в 0,41 рубля за 1000 токенов вместо 0,8, YandexGPT Pro 5 в 0,61 вместо 1,2, YandexGPT Lite в 0,1 вместо 0,2. Alice AI LLM в асинхронном режиме стоит 0,25 рубля на входе и 1,02 рубля на выходе.

Третий режим это пакетная обработка с порогом: минимальная стоимость одного запуска 200 000 токенов, поэтому гнать пакетом сто карточек товара невыгодно, а сто тысяч выгодно. В пакете свой список открытых моделей: Qwen3-8B и Gemma3 4B it по 0,1 рубля за 1000 токенов, Qwen3-32B и Gemma3 27B it по 0,41, Llama-3.3-70B-Instruct 0,61, Qwen3-235B-A22B 6,1 рубля.

Отсюда правило разнесения нагрузки: диалог с человеком идет синхронно, ночная переразметка базы уходит в асинхронный или пакетный режим.

Как обратиться к yandexgpt по API

Обращение к yandexgpt устроено двумя слоями. Первый это OpenAI-совместимый эндпоинт: POST на https://ai.api.cloud.yandex.net/v1/chat/completions, в клиенте OpenAI достаточно указать base_url «https://ai.api.cloud.yandex.net/v1», ключ и идентификатор каталога в параметре project. Совместимость заявлена и для привычных обвязок, включая LangChain, LlamaIndex и LangGraph.

Второй слой это собственные эндпоинты платформы:

  • https://ai.api.cloud.yandex.net/foundationModels/v1/completion для синхронной генерации;
  • https://ai.api.cloud.yandex.net/foundationModels/v1/completionAsync для асинхронной;
  • https://ai.api.cloud.yandex.net/foundationModels/v1/imageGenerationAsync для генерации изображений;
  • https://ai.api.cloud.yandex.net/foundationModels/v1/textClassification для дообученных классификаторов и /fewShotTextClassification для zero-shot и few-shot вариантов.

Модель адресуется URI вида gpt://<идентификатор_каталога>/yandexgpt/latest, где ветка после имени модели фиксирует версию: latest стабильная, rc кандидатная, deprecated устаревшая. Заголовок авторизации принимает два формата: «Authorization: Bearer <IAM-токен>» и «Authorization: Api-Key <API-ключ>». API-ключ нужен там, где запрашивать IAM-токен автоматически неудобно.

Права выдаются ролями Yandex Identity and Access Management, и это самая частая причина отказа на первом запросе:

  • ai.languageModels.user для моделей генерации текста, эмбеддингов и классификаторов;
  • ai.imageGeneration.user для YandexART;
  • ai.assistants.editor вместе с ai.languageModels.user для Responses API;
  • ai.models.user для Realtime API;
  • serverless.mcpGateways.editor для управления MCP-серверами, а обращение к приватному MCP-серверу требует IAM-токена или API-ключа сервисного аккаунта с областью действия yc.serverless.mcpGateways.invoke;
  • ai.playground.user для экспериментов в консольном плейграунде.

Режим рассуждений и параметры генерации

Точность на задачах с вычислениями поднимает не длинный промпт, а параметр reasoning_options. Значений два: DISABLED (по умолчанию) и ENABLED_HIDDEN, при котором режим включен, но цепочка рассуждений в ответ не возвращается. Модель сама решает, применять ли рассуждения к конкретному запросу.

В OpenAI-совместимом интерфейсе набор параметров шире: max_completion_tokens ограничивает сумму видимых и рассуждающих токенов, есть tools и parallel_tool_calls для вызова функций, response_format для структурированного ответа и stream для потокового ответа. Параметр seed в справочнике помечен как пока не поддерживаемый, а max_tokens объявлен устаревшим в пользу max_completion_tokens. Часть параметров, например frequency_penalty и presence_penalty, в документации помечена как поддерживаемая не всеми моделями, поэтому набор проверяется на выбранной модели, а не переносится из чужого кода.

Что тарифицируется помимо токенов

Счет за AI Studio редко состоит из одной строки. Помимо генерации текста платформа считает вызовы встроенных инструментов, векторизацию, картинки, аудио и хранение поискового индекса.

Услуга Единица Цена, руб. с НДС
Эмбеддинги текста 1000 токенов 0,0101
Классификация через YandexGPT Lite 1 запрос до 1000 токенов 0,1525
Классификация через YandexGPT Pro 1 запрос до 250 токенов 0,1525
Генерация изображения 1 запрос 2,23
Инструмент веб-поиска 1000 вызовов 915
Инструмент поиска по файлам 1000 вызовов 300
Инструмент исполнения кода и MCP вызов не тарифицируется
Хранение поискового индекса AI Search 1 ГБ в сутки 10,6
Голосовой агент, входящее аудио 1 секунда 0,0264
Голосовой агент, исходящее аудио 1 секунда 0,0203

Здесь прячется ловушка классификации. У YandexGPT Lite единица тарификации это запрос до 1000 токенов, у YandexGPT Pro и дообученного классификатора до 250 токенов при той же цене 0,1525 рубля. Текст на 770 токенов через Lite будет одним запросом, а через Pro четырьмя. Токенизация (вызовы TokenizerService) не тарифицируется вообще, поэтому длину промпта меряют заранее и бесплатно.

Для предсказуемой задержки есть выделенные инстансы с посекундной оплатой: T-pro-it-2.0-FP8 стоит 756,40 рубля в час в конфигурации S и 2269,20 в конфигурации L, Qwen 2.5 VL 32B Instruct 817,40 рубля в час в S. Развертывание модели и обслуживание оборудования не тарифицируются.

Агенты, RAG и лимиты Vector Store

Ответы по своим документам собираются не длинным контекстом, а поисковым индексом Vector Store. В хранилище загружается до 10 000 файлов размером до 128 МБ каждый, поддерживаются PDF, DOCX, XLSX, CSV, Markdown, HTML, JSON и JSONL, а также аудио и видео. При индексировании файлы режутся на фрагменты с перекрытием, поэтому смысл на границе теряется частично. Готовые чанки можно залить самому в JSONL, максимальная длина фрагмента 8000 символов.

Поверх индекса работают текстовые агенты через Responses API: File Search для RAG, Web Search с ограничением до 5 доменов и настройкой региона, Code Interpreter для вычислений в изолированной среде, MCP Tool для внешних API. Тариф агента складывается из токенов модели и вызовов инструментов.

Порядок величин виден на расчете по тарифам страницы: минута диалога голосового агента с поиском по базе знаний (7000 токенов, 60 секунд распознавания, 20 секунд синтеза) обходится в 7,89 рубля, из них 5,6 рубля на текст, 1,584 на распознавание, 0,406 на синтез и 0,3 на вызов поиска по файлам.

Нужен не прайс, а работающая интеграция

Соберем контур на Yandex AI Studio под вашу задачу: маршрутизация Lite и Pro, поисковый индекс по вашим документам, роли и ключи, лимит трат на платежном аккаунте. С расчетом счета до старта, а не после первого месяца.

Обсудить задачу

Данные, логирование и разграничение доступа

По умолчанию модели сохраняют данные запросов. Если через API идут персональные или коммерчески чувствительные сведения, логирование отключается явно: в REST-заголовок или метаинформацию gRPC-вызова добавляется опция x-data-logging-enabled: false, а в SDK при инициализации объекта AIStudio выставляется enable_server_data_logging=False. Запросы с отключенной опцией не сохраняются на серверах платформы.

Второй контур это роли. Права назначаются на организацию, облако или каталог и наследуются вложенными ресурсами, а четыре уровня у ассистентов (ai.assistants.auditor, viewer, editor, admin) позволяют дать команде поиск по индексу без права его менять. Платформа отдельно заявляет, что данные клиентов не используются для обучения моделей.

Дообучение, классификаторы и эмбеддинги

Дообучение в AI Studio на стадии Preview, сам процесс обучения не тарифицируется. Платить придется за инференс: дообученная YandexGPT Lite считается по цене базовой Lite, 0,2 рубля за 1000 токенов синхронно, а запрос к дообученному классификатору идет на эндпоинт textClassification и стоит 0,1525 рубля за 250 токенов.

Эмбеддинги самая дешевая операция в прайсе: 0,0101 рубля за 1000 токенов, единица тарификации равна одному токену. Векторизовать миллион токенов документации стоит около десяти рублей, поэтому экономить на полноте индекса смысла нет. Под специфику файлов вместо стандартных моделей эмбеддингов подключаются дообученные.

Как посчитать бюджет до запуска

Порядок расчета, который закрывает большинство сюрпризов в первом счете:

  1. Замерьте типовой промпт бесплатным токенизатором и зафиксируйте среднее число входящих и исходящих токенов на обращение.
  2. Умножьте сумму на цену модели и на прогноз обращений в сутки, отдельно для синхронного и асинхронного сценариев.
  3. Добавьте строки вне генерации: веб-поиск 915 рублей за тысячу вызовов, поиск по файлам 300 рублей, хранение индекса 10,6 рубля за гигабайт в сутки.
  4. Проверьте, что пакетные задачи набирают минимум 200 000 токенов на запуск, иначе счет считается по этому порогу.
  5. Поставьте лимит трат и уведомление на платежном аккаунте: цикл с ошибкой в ретраях сжигает бюджет за ночь.

Отдельно стоит посмотреть программу для продуктовых технологических компаний: AI Studio заявляет по ней грант до 1 миллиона рублей на разработку своих ИИ-приложений и агентов, условия участия на странице программы.

Частые вопросы

Сколько стоит YandexGPT Pro за 1000 токенов

YandexGPT Pro 5.1 стоит 0,8 рубля за 1000 входящих и 0,8 рубля за 1000 исходящих токенов в синхронном режиме и 0,41 рубля в асинхронном. Предыдущее поколение YandexGPT Pro 5 стоит 1,2 рубля синхронно и 0,61 асинхронно. Цены указаны с НДС для региона Россия.

Можно ли перенести код с OpenAI без переписывания

Да, AI Studio отдает OpenAI-совместимый эндпоинт POST https://ai.api.cloud.yandex.net/v1/chat/completions. В клиенте меняются base_url, ключ и идентификатор каталога в параметре project. Поддержка параметров зависит от модели: tools, response_format и reasoning_effort проверяются на выбранной модели.

Как отключить сохранение данных запросов

Добавьте заголовок x-data-logging-enabled: false в REST-запрос или метаинформацию gRPC-вызова, а в Python SDK передайте enable_server_data_logging=False при создании объекта AIStudio. Такие запросы не сохраняются на серверах платформы.

Сколько документов помещается в базу знаний агента

В Vector Store загружается до 10 000 файлов размером до 128 МБ каждый. Готовые фрагменты можно залить в JSONL, длина одного фрагмента до 8000 символов. Хранение поискового индекса стоит 10,6 рубля за 1 ГБ в сутки, хранение самих файлов не тарифицируется.

Дообучение модели оплачивается отдельно

На стадии Preview процесс дообучения не тарифицируется, платите только за работу модели: дообученная YandexGPT Lite считается по цене базовой Lite, 0,2 рубля за 1000 токенов, запрос к дообученному классификатору 0,1525 рубля за 250 токенов.

Поделиться:

About Author: Мария Соколова

nu_editor_sokolova@neurounit.ai

Редактор Neurounit. Пишет про нейросети в маркетинге и работу AI-агентов в рекламе.

Neurounit

Запустить рост с AI

Оставьте заявку или напишите в мессенджер