Парсинг аудитории это сбор идентификаторов пользователей соцсети по заданному признаку: подписка на сообщество, реакция под постом, вступление в чат, оставленный в анкете телефон. На выходе получается список, который загружают в рекламный кабинет как пользовательскую аудиторию. За последние два года смысл этой работы сильно изменился: часть сценариев рекламные системы закрыли нативно и бесплатно, а часть подорожала юридически: с 30 мая 2025 года за утечку персональных данных юрлицу грозит штраф от 3 млн рублей, а тому, кто попался повторно, грозит оборотный штраф от 1 до 3 процентов годовой выручки.
Встроенные интересы это вероятностная метка, присвоенная платформой по косвенным сигналам. Собранный сегмент это фиксированный список тех, кто совершил проверяемое действие.
Практический смысл в трёх вещах: исключения (собранную аудиторию можно вычитать из показа, чтобы не платить за текущих клиентов), пересечения (человек в трёх нишевых сообществах ведёт себя иначе, чем случайный подписчик крупного паблика) и скорость реакции (вступившие к конкуренту на прошлой неделе ведут себя не так, как подписчик пятилетней давности).
Ограничения тоже конкретные: в VK Рекламе аудитория из подписчиков доступна только для сообществ с более чем 50 подписчиками и не более 300 сообществ ВКонтакте или Одноклассников в одной аудитории. Всего в кабинете можно создать до 10 000 аудиторий.
Это первый вопрос до покупки подписки на парсер. В VK Рекламе источники аудитории такие: другая аудитория, списки пользователей, события в мобильном приложении, категории мобильного приложения, ключевые фразы, события на сайте, подписчики сообществ, рекламные события, события в лид-форме и музыканты. Они комбинируются правилами «И» и «ИЛИ», любой можно поставить на исключение. Параметры, которые стоит знать заранее:
Важная оговорка: аудитория из подписчиков внутри кабинета это не выгружаемый список ID. Таргетироваться на неё можно, забрать файлом нельзя. Именно за сырой список и платят парсерам.
Кабинет не закрывает: пересечение аудиторий нескольких сообществ с фильтром по числу совпадений, сбор комментаторов конкретного поста, отбор администраторов и владельцев сообществ для B2B, мониторинг новых вступлений с интервалом в часы, чистку базы от ботов, поиск по атрибутам профиля. Ориентиры по рынку на август 2026 года:
Подписка за 1–4 тысячи рублей в месяц окупается, когда проектов несколько или сегменты обновляются регулярно; для одной разовой кампании хватит нативных источников кабинета.
Любой парсер упирается в опубликованные лимиты API. Актуальная версия VK API 5.199. По частоте: ключ доступа пользователя даёт 3 запроса в секунду, ключ сообщества 20, сервисный ключ от 5 до 60 в зависимости от числа пользователей приложения. При превышении сервер отдаёт ошибку 6 «Too many requests per second». Есть и количественные лимиты на однотипные методы, но точные значения VK не раскрывает: при их превышении метод временно недоступен или требует капчу.
Метод groups.getMembers возвращает список участников сообщества, но сортировка по времени вступления (time_asc и time_desc) доступна только при вызове от модератора сообщества. То есть «свежие вступления к конкуренту» через официальный API вы отсортировать не сможете.
С Telegram жёстче. В Bot API метода, отдающего список участников, нет: есть getChatMemberCount с одним числом и getChatMember, который по чужим пользователям гарантированно работает, лишь если бот администратор чата. В MTProto метод channels.getParticipants есть, но отдаёт ошибку 406 CHANNEL_PRIVATE, если вы не вступили в канал, и 403 CHAT_ADMIN_REQUIRED при нехватке прав. Супергруппа вмещает до 200 000 участников, но список участников администраторы могут скрыть.
Чем легче парсер обещает достать закрытые данные, тем выше вероятность, что он работает через пользовательские сессии на подставных аккаунтах: к цене подписки добавляется риск их блокировки.
Парсинг данных с сайта в рекламных задачах часто вообще не нужен: собственный сайт отдаёт аудиторию через счётчик, а не через скрапер. В VK Рекламе источник «События на сайте» работает на пикселе и аудиторных тегах: задаёте событие и получаете сегмент без единой строки парсинга. В экосистеме Яндекса логика та же: сегмент строится на данных Метрики или AppMetrica, а Яндекс Аудитории отдают его в Директ и Adfox.
Разница принципиальная. Пиксель фиксирует поведение на вашем ресурсе с вашим же основанием для обработки. Скрапер снимает данные с чужого ресурса, где действует другой контур: пользовательские соглашения площадок, rate limit, антибот-защита, охрана базы данных как объекта права. Эту сторону вопроса разбираем отдельно в материале парсинг данных с сайтов: как собирать легально.
Файл, не соответствующий требованиям, кабинет просто не примет. Ключевые параметры на август 2026 года:
| Параметр | VK Реклама, списки пользователей | Яндекс Аудитории, данные CRM |
|---|---|---|
| Формат файла | txt или csv, для единого списка только csv | CSV |
| Минимум записей | 100 уникальных записей | 100 записей |
| Максимальный вес | 128 Мб | 1 ГБ |
| Кодировка | UTF-8 | UTF-8 или Windows-1251 |
| Хеширование | MD5; SHA-256 только для телефонов, без соли | SHA-256; новые MD5-хеши не принимаются с января 2025 года |
| Обязательные поля | заголовок первого столбца «id» | хотя бы одно из полей phone или email |
| Когда сегмент готов | сразу после загрузки, охват пересчитывается при запуске кампании | при охвате не менее 100 анонимных идентификаторов |
Частые ошибки: телефон пишется одной строкой с кодом страны без пробелов и скобок (79011234567, а не +7 (901) 123-45-67), ID ВКонтакте принимается только числом, символьные алиасы отклоняются. Email в VK Рекламе лучше грузить открытым: платформа не рекомендует MD5 для адресов, качество сопоставления падает.
В VK Рекламе есть «единый список»: один csv с колонками phone, email, ok, vk, vid, gaid, idfa, где строка соответствует одному человеку. Он повышает долю распознанных контактов, если в CRM хранится несколько идентификаторов клиента; пропущенные колонки обозначаются подряд идущими запятыми.
Сегмент Яндекс Аудиторий со статусом «Мало данных» или «Слишком много данных» можно пересчитать, но не бесконечно: один сегмент не более двух раз, всего не более 20 пересчётов за 24 часа, каждый до двух часов.
Нужен не список, а работающий процесс
Соберём связку «источник данных, очистка, сегменты, загрузка в кабинет» и поставим обновление на автомат, чтобы база не устаревала между кампаниями. Покажем, где сегменты дадут рост, а где хватит нативных источников.
Парсинг номеров с сайта переводит задачу из маркетинговой плоскости в правовую. Телефон и адрес электронной почты это персональные данные, и статус не меняется от того, что человек сам разместил их в открытом профиле или в шапке сообщества.
Ключевая норма здесь часть 2 статьи 10.1 закона 152-ФЗ. Если человек раскрыл данные неопределённому кругу лиц сам, но согласия на распространение по правилам этой статьи не давал, доказывать законность последующего распространения или иной обработки обязано каждое лицо, которое эти данные распространило или обработало. Проще: «лежало открыто» не аргумент.
Цена вопроса по КоАП в редакции закона 420-ФЗ от 30 ноября 2024 года:
Отдельный слой это рассылка по собранным номерам. Часть 1 статьи 18 закона «О рекламе» допускает рекламу по сетям электросвязи только при предварительном согласии абонента, причём реклама считается разосланной без согласия, если рекламораспространитель не докажет обратное. Часть 2 запрещает автоматический дозвон и автоматическую рассылку. Список, собранный парсером, этим требованиям не удовлетворяет по определению.
Загрузка того же списка в кабинет как аудитории защищённее: вы не обращаетесь к человеку напрямую, а передаёте идентификатор для сопоставления. Но требований к основанию обработки на вашей стороне это не снимает: хеширование по SHA-256 защищает данные при передаче, а не легализует их сбор.
Когда ядро собрано, наращивать его руками дороже, чем отдать расширение алгоритму. В VK Рекламе «Расширение аудитории» доступно при продвижении сайта, сообщества ВКонтакте, лид-формы и мобильного приложения с оптимизацией на установки. Чтобы подбор запустился, система должна распознать не менее 1000 пользователей из источника. Расширенная аудитория обновляется сама: для сайтов, приложений и лид-форм раз в 4 дня, для сообществ раз в неделю.
В Яндекс Аудиториях похожий сегмент строится только на своём сегменте в статусе «Готов»: сегменты, к которым вам дали доступ другие пользователи, источником быть не могут. Обработка занимает не меньше двух часов, готовым сегмент станет при охвате от 100 анонимных идентификаторов. Чем строже точность соответствия, тем меньше идентификаторов в результате.
Планка в 1000 распознанных пользователей и задаёт минимальный разумный размер базы: собирать 300 контактов ради look-alike бессмысленно, расширение не включится.
Проверьте за минуту, нужен ли вам парсер
Три вопроса. Сегменты меняются чаще раза в неделю? Нужны пересечения трёх и более источников или комментаторы конкретных постов? В базе набирается больше 1000 распознанных контактов? Если хотя бы на два ответ «нет», хватит нативных источников кабинета, подписку можно не покупать.
Инциденты. По части 3.1 статьи 21 закона 152-ФЗ оператор обязан уведомить Роскомнадзор об утечке в течение 24 часов с момента выявления и в течение 72 часов сообщить результаты внутреннего расследования. Утечка данных от 1 до 10 тысяч субъектов стоит юрлицу 3–5 млн ₽ (часть 12 статьи 13.11 КоАП). Для того, кто уже наказан по частям 12–14, часть 15 той же статьи вводит оборотный штраф: от 1 до 3 процентов выручки за предшествующий календарный год, но не менее 20 млн и не более 500 млн ₽. База спарсенных контактов в незашифрованном файле на ноутбуке подрядчика это ровно та ситуация, ради которой норму писали.
Где рекламу нельзя показывать вообще. Часть 10.7 статьи 5 закона «О рекламе» запрещает рекламу на информационных ресурсах организаций, признанных нежелательными или запрещённых судом по законодательству о противодействии экстремизму и терроризму, а также на других ресурсах, доступ к которым ограничен. Часть 10.6 той же статьи запрещает рекламу на персональных страницах, владельцы которых не выполнили требования статьи 10.6 закона 149-ФЗ. Смысл для практика: собирать аудиторию из заблокированных в России соцсетей ради рекламы там бессмысленно: размещение противоправно независимо от качества сегмента.
Список идентификаторов денег не приносит. Рабочих маршрутов три.
О долговечности базы. Аудитории на ключевых фразах обновляются ежедневно, расширенные раз в 4 дня или раз в неделю, рекламные события исчезают через 60 дней после остановки кампании. Загруженный вручную список не обновляется вообще. Поэтому обновление ставят в календарь: раз в неделю для активных сегментов, раз в месяц для холодных.
Минимум 100 уникальных записей и в VK Рекламе, и в Яндекс Аудиториях. Но расширение аудитории в VK Рекламе запускается от 1000 распознанных пользователей, поэтому практический ориентир от тысячи контактов.
Для Яндекс Аудиторий только SHA-256: новые MD5-хеши сервис не принимает с января 2025 года. В VK Рекламе доступен MD5, а SHA-256 поддержан только для телефонных номеров и без применения соли; email платформа рекомендует загружать в открытом виде.
Официальными средствами нет. Bot API отдаёт только количество участников через getChatMemberCount, а getChatMember по чужому пользователю гарантированно работает, лишь если бот администратор чата. MTProto-метод channels.getParticipants вернёт ошибку 406 CHANNEL_PRIVATE или 403 CHAT_ADMIN_REQUIRED.
Часть 1 статьи 18 закона «О рекламе» требует предварительного согласия абонента, доказывать его наличие обязан рекламораспространитель. Обработка без письменного согласия там, где оно необходимо, по части 2 статьи 13.11 КоАП обходится юрлицу в 300–700 тыс. ₽.
У TargetHunter при оплате на год: «Стандартный» 999 ₽ в месяц, «Автоматизация» 1 999 ₽, «Pro» 4 165 ₽. У Segmento Target и Pepper.Ninja тарифы открываются после регистрации, актуальные цены смотрите на сайтах сервисов.