Продвижение сайта ключевым запросом: как собрать семантическое ядро

SEOМария Соколова13 мин чтения
Продвижение сайта ключевым запросом: как собрать семантическое ядро

Продвижение сайта ключевым запросом в единственном числе не бывает: поиск оценивает страницу по группе фраз, а не по одной. Работа начинается со сбора спроса и заканчивается таблицей, где у каждой группы есть свой адрес на сайте. Ниже процедура: откуда берутся фразы, какие цифры честные, как отсечь чужой спрос, по какому признаку резать список на группы и как разложить группы по страницам.

Что такое семантическое ядро и что оно решает

Семантическое ядро это не список слов, а три связанных артефакта:

  • перечень фраз с частотой, снятой в конкретном регионе и в конкретном виде (базовом, фразовом или точном);
  • разбивка фраз на группы, каждая из которых может быть закрыта одной страницей;
  • карта релевантности: таблица «группа запросов, главная фраза, адрес страницы, статус».

Пока нет третьего пункта, ядра нет: список фраз в таблице не отвечает на вопрос «что делать в понедельник», а карта релевантности отвечает. Что делать с готовой группой на самой странице (заголовки, метатеги, структура текста) это отдельная работа, здесь она не разбирается.

Сиды: с чего начинается список

Сиды это фразы-затравки, из которых вырастает всё остальное. Брать их из головы бессмысленно: внутренние названия услуг почти никогда не совпадают с формулировкой человека в поиске. Рабочие источники:

  • номенклатура и прайс: названия товаров, услуг, моделей, артикулов;
  • переписка с клиентами и записи звонков: там живая формулировка, включая неправильную;
  • вкладка «Топы запросов» в Вордстате: она отдаёт популярные запросы, содержащие вашу фразу, и запросы, похожие на заданный, за последний месяц;
  • отчёт «Все запросы» в Яндекс Вебмастере: это фразы, по которым сайт уже показывался в ТОП-50 выдачи;
  • поисковые подсказки: то, что строка поиска дописывает за пользователем;
  • меню и названия категорий у конкурентов из выдачи.

Тридцати-пятидесяти сидов на практике хватает: дальше их размножает Вордстат.

Вордстат: продвижение сайта в Яндексе опирается на его цифры

Вордстат доступен только авторизованным пользователям и состоит из трёх вкладок. Что даёт каждая:

Вкладка Что показывает Период
Динамика Общее число запросов с заданной фразой и долю таких запросов от всех запросов к Яндексу По умолчанию последние 2 года с помесячной детализацией
Регионы Распределение запросов по регионам и городам, доля и индекс интереса Последние 30 дней
Топы запросов Популярные запросы, содержащие фразу, и похожие запросы Последний месяц

Детализацию в «Динамике» можно переключить на недели или дни. При детализации по месяцам и неделям доступен период от трёх месяцев или трёх недель соответственно и до пяти лет, самая ранняя дата в системе это январь 2018 года. При детализации по дням показываются данные за период до 60 дней от текущей даты. Фильтр по типу устройства (десктопы, смартфоны, планшеты) работает на всех трёх вкладках, регион выбирается на «Динамике» и в «Топах запросов», результат с любой вкладки выгружается в CSV кнопкой «Скачать».

Два практических ограничения. Первое: капча появляется при слишком частых обращениях к сервису, при работе за пределами СНГ или если браузер не сохраняет cookie fuid01, и вручную её не отключают. Второе: данные приходят с задержкой, и в справке Вебмастера прямо сказано, что в Вордстате разница между получением данных и их отображением может занимать около месяца. Отсюда правило: не делайте выводов по последнему месяцу графика. Программный доступ тоже изменился, все возможности API Вордстата переехали в Wordstat API сервиса Yandex Search API.

Операторы Вордстата и три вида частоты

Без операторов Вордстат отдаёт базовую частоту: сумму по всем запросам, куда фраза входит в любом порядке, в любой словоформе и с любым хвостом. Именно на этой цифре строятся завышенные планы трафика. Поддерживаемые операторы: –, !, +, ” “, [], () и |.

Оператор Что делает Пример из справки
” “ Фиксирует количество слов, показ без дополнительных слов «купить автомобиль» учтёт «автомобиль купить», но не «купить красный автомобиль»
! Фиксирует форму слова: число, падеж, время «купить !собаку» не учтёт «купить собак» и «купить корм для собак»
[] Фиксирует порядок слов, словоформы и стоп-слова при этом учитываются «билеты [из москвы в париж]» не учтёт «билеты из парижа в москву»
+ Фиксирует стоп-слова: предлоги, союзы, местоимения «работа +на дому» не учтёт «работа по дому»
– Исключает слово из запроса «доставка -цветы» уберёт «доставка цветов»
() и | Группируют варианты в одном запросе «заказать (роллы|пицца)»

Операторы комбинируются, и три вида частоты получаются именно комбинацией. Базовая: фраза без операторов. Фразовая: фраза в кавычках, лишние слова отсечены, но словоформы и порядок ещё гуляют. Точная: кавычки плюс восклицательный знак перед каждым словом, а при необходимости и квадратные скобки для порядка. Разрыв между базовой и точной это и есть объём чужих и вложенных запросов внутри вашей фразы. Когда базовая больше точной в десятки раз, планировать по базовой нельзя: вы посчитали спрос, который уйдёт на другие страницы и другие сайты.

И отдельно: Вордстат считает запросы, а не посетителей. В клики они превращаются только через позицию и CTR, то есть это прогноз, а не факт.

Регион: одна фраза, разные города

На вкладке «Регионы» распределение считается за последние 30 дней и показывается тремя полями: число запросов, доля от всех запросов в этом регионе и индекс интереса (он же индекс соответствия, аффинити-индекс). Индекс сравнивает долю запроса в регионе с его долей по стране: значение 100% означает, что регион не выделяется по уровню интереса к теме, значение выше 100% что интерес повышен.

Смысл простой. Фраза с большой федеральной частотой может иметь индекс интереса ниже 100% в вашем городе, и страница под неё окупится медленнее, чем обещает общая цифра. И наоборот: узкая тема с индексом 300% в одном регионе это повод сделать отдельную страницу. Если городов несколько, схему региональных страниц разбирает отдельный материал про SEO по городам. Здесь важно одно: частоту снимают в том регионе, в котором продвигаются, а не «по всем».

Вебмастер и Search Console: сео продвижение сайта яндекс показывает сам

Вордстат показывает спрос рынка, панели вебмастера тот спрос, который уже приходит на ваш сайт: формулировки, по которым сайт показывался, вместе с показами, кликами и позицией по каждой.

Яндекс Вебмастер. Группа «Все запросы» содержит фразы, по которым сайт показывался в ТОП-50 результатов. Краткая статистика (показы, клики, позиция, CTR) это усреднённые значения за последние 7 дней, данные обновляются ежедневно. Группа «Популярные запросы» собирает фразы с наибольшим числом показов за последние три месяца, и в неё попадают первые 3000 запросов. Свои группы тоже ограничены: до 500 запросов в обычную группу, до 1000 в группу «Избранные», не более 100 групп на один сайт. Важное ограничение при сверке цифр: Вебмастер учитывает показы и клики только до 50-й позиции, то есть в статистике заведомо часть данных.

Google Search Console. По умолчанию отчёт об эффективности показывает клики и показы за последние три месяца, диапазон дат меняется фильтром. В интерфейсе таблица отдаёт максимум 1000 строк, за большим объёмом нужно идти в Search Console API, где параметр rowLimit принимает значения от 1 до 25 000 при значении по умолчанию 1000. Часть запросов вы не увидите никогда: редкие запросы в отчётах опускаются ради конфиденциальности пользователей, из-за чего сумма по строкам таблицы меньше итога на графике.

Выгрузите обе панели, объедините с выгрузкой Вордстата по колонке фразы и пометьте источник. Фразы, которые есть в панелях, но которых нет в ядре, это спрос, который вы уже получаете случайно и не оформили страницей.

Чистка: как отсечь чужой спрос

Короткая фраза почти всегда собирает несколько аудиторий, и цифра рядом с ней складывается в том числе из людей, которым вы ничего не продаёте. Примеры из практики сбора ядер по автоматизации и ИТ:

  • «rpa» это не только программные роботы, но и портал РПА Минюста и парковочное место BMW;
  • «lms система» кроме систем обучения ловит аккумуляторы и зарядные устройства;
  • «автокликер» в основном ищет игровая аудитория, а не отдел продаж;
  • «make com» частично распадается на made in china;
  • «bim» подмешивает песню, а не проектирование;
  • «автоматизация технологических процессов и производств» это абитуриенты со своими «кем работать» и кодом специальности, а не заводы.

Фильтр по стоп-словам такой мусор не ловит, потому что чужой спрос сидит в самой короткой фразе, где никаких маркеров нет. Чистка делается вручную и в таком порядке:

  1. Открыть выдачу по фразе в нужном регионе и посмотреть, кому отдан ТОП-10. Если там вуз, маркетплейс аккумуляторов или игровой форум, фраза не ваша, какой бы ни была частота.
  2. Посмотреть «Топы запросов» и похожие запросы: хвосты сразу показывают, о чём на самом деле спрашивают.
  3. Сравнить базовую и точную частоту. Разрыв в десятки раз это сигнал, что основной объём сидит в хвостах, и хвосты надо просмотреть глазами.
  4. Проверить регион и устройство: у части фраз мобильный спрос принципиально другой.
  5. Только после этого применять минус-слова к тому, что осталось.

Экономить на этом просмотре дороже всего: мусорный кластер стоит не только зря написанной страницы, но и статуса «малоценная или маловостребованная» в Вебмастере, который Яндекс присваивает страницам, чей контент не соответствует запросам пользователей.

Кластеризация по выдаче: продвижение сайтов поиск группирует запросы за вас

Группировать фразы на глаз бесполезно: решение о том, можно ли закрыть две фразы одной страницей, принимает не редактор, а поисковая система. Поэтому кластеризация делается по выдаче: сервис собирает ТОП-10 по каждой фразе и сравнивает адреса. Совпали адреса, значит поиск считает запросы одной потребностью и вам хватит одной страницы.

Методы отличаются тем, как именно сравниваются наборы адресов. За основу всегда берётся самый частотный запрос группы.

Метод Как сравнивает Что получается
SOFT Каждый запрос сравнивается только с самым частотным Группы полные, но участники между собой могут быть не связаны
MODERATE Запросы сравниваются попарно по цепочке Компромисс: связи есть, но у крайних участников общих адресов может не быть
HARD Совпадающие адреса должны быть в топах всех запросов группы одновременно Группы мелкие и плотные, каждую точно закрывает одна страница

Второй параметр это степень (порог) группировки: сколько адресов должно совпасть. Чем меньше степень, тем полнее группы и тем их меньше, при степени 8-10 групп будет много, а запросов в каждой мало. Топвизор по итогам своих тестов называет оптимальной степень 3-4 при методе HARD и разрешает перегруппировать ядро другим методом и степенью в течение 7 дней после расчёта по сниженной цене, так что варианты можно сравнить, а не гадать. Порядок величин по времени: обработка 5000 запросов занимает в среднем 10-15 минут.

Две частые ошибки. Регион по умолчанию: если его не указать, кластеризация в Яндексе выполняется по России, а в Google по Великобритании с английским интерфейсом, и к вашему городу результат отношения не имеет. И группа «Запросы без связей», куда сервис отправляет фразы без совпадений по адресам: её просматривают руками, а не удаляют целиком, потому что рядом с явным мусором там оказываются темы, по которым выдача ещё не устоялась.

Карта релевантности: кластеры по страницам

Кластеры превращаются в план работ только в таблице. Минимальный набор колонок:

Колонка Что в ней
Кластер Название группы после кластеризации
Главная фраза Самая частотная фраза группы, проверенная на соответствие теме
Точная частота Сумма точных частот группы в целевом регионе
URL Существующий адрес или пометка «создать»
Тип страницы Статья, услуга, категория, карточка
Статус Есть, переписать, создать, склеить с соседом

Правило одно: одна страница закрывает один кластер. Группе из трёх фраз с точной частотой в единицы запросов отдельная страница не нужна, её присоединяют к близкому кластеру. Обратная ситуация встречается чаще: под один кластер уже есть две-три похожие страницы, и это повод не создавать четвёртую, а решить, какая из них опорная.

Ядро собрано, а страниц под него нет

Соберём семантику по вашему региону, разложим кластеры по страницам и отдадим карту релевантности, с которой можно сразу ставить задачи редакции и разработке.

Обсудить задачу

Каннибализация: две страницы на один запрос

Каннибализация это когда по одному запросу поиск показывает то одну вашу страницу, то другую: позиция плавает, а суммарный трафик ниже, чем был бы у одной сильной страницы. Возникает она там, где страницы делали без карты релевантности.

Как найти:

  • в Search Console отфильтровать отчёт по конкретному запросу и переключить параметр на страницы: если по одному запросу показов набирают два и более адресов, это она. Таблица отдаёт максимум 1000 строк, поэтому фильтруйте по конкретному запросу, а не листайте список;
  • в Яндекс Вебмастере добавить спорный запрос в группу «Избранные» (до 1000 фраз) и смотреть, как средняя позиция скачет между значениями;
  • в карте релевантности отсортировать по колонке URL и найти адреса, к которым привязано больше одного кластера.

Дальше: выбрать опорную страницу по фактическим кликам, перенести на неё уникальную часть второй, переназначить внутренние ссылки и обновить карту релевантности. Судьба лишнего адреса это уже технический вопрос, он решается отдельно.

Проверьте своё ядро за четыре вопроса

1. Частота снята в вашем регионе, а не «по всем»? 2. В таблице есть колонка точной частоты, а не только базовой? 3. У каждого кластера один и только один адрес? 4. Список сверяли с отчётом «Все запросы» в Вебмастере? Если хотя бы один ответ «нет», ядро к планированию работ не готово.

Обсудить задачу

Сезонность и обновление ядра

Сезонность видно до начала работ, и это дешевле, чем узнать о ней постфактум. Инструмент тот же: вкладка «Динамика» в Вордстате, где при помесячной детализации можно задать период вплоть до пяти лет, а самые ранние данные доступны с января 2018 года. Три года подряд с пиком в одном и том же месяце это сезон, единичный всплеск это инфоповод. Короткие всплески ловятся дневной детализацией, но её горизонт всего 60 дней от текущей даты.

Google Trends отвечает на другой вопрос. Он нормализует данные: каждое значение делится на общее число запросов и приводится к относительной шкале, поэтому Trends годится для сравнения динамики двух тем, но не даёт абсолютных цифр для плана.

Периодичность обновления задают три события: новая услуга или товарная группа, начало сезона по «Динамике» и накопление новых фраз в панелях вебмастера. Данные Вебмастера обновляются ежедневно, поэтому сверять «Популярные запросы» с ядром можно ежемесячно, а пересобирать частоты реже, помня про задержку Вордстата около месяца.

Частые вопросы

Сколько фраз должно быть в семантическом ядре

Норматива нет, размер задаёт число страниц, которое вы реально сделаете. Ориентир для сверки: Вебмастер отдаёт в группе «Популярные запросы» первые 3000 фраз с наибольшим числом показов за три месяца, и этого хватает, чтобы понять, весь ли текущий спрос закрыт страницами.

Чем базовая частота отличается от фразовой и точной

Базовая это фраза без операторов, в неё входят все хвосты и словоформы. Фразовая получается кавычками: они фиксируют количество слов, но не порядок и не форму. Точная это кавычки плюс восклицательный знак перед каждым словом, а квадратные скобки дополнительно фиксируют порядок слов.

Можно ли собрать частоту для России в Google Keyword Planner

Планировщик показывает среднее число запросов в месяц по умолчанию за 12 месяцев и объединяет ключевое слово с близкими к нему вариантами, то есть цифра там укрупнённая. Кроме того, проверка частоты в Google по регионам России недоступна, так как Google Ads приостановил поддержку российских регионов, и сервисы кластеризации в этом случае берут частоту из Яндекса.

Какой метод кластеризации выбрать

Для коммерческих разделов надёжнее HARD со степенью 3-4: такова рекомендация Топвизора по итогам его тестов. SOFT даёт более полные группы, но участники внутри могут быть не связаны, и одной страницей такую группу часто не закрыть. Метод и степень меняются в течение 7 дней после расчёта по сниженной цене.

Почему цифры Вордстата и Вебмастера не совпадают

Это разные величины. Вордстат считает запросы к поиску, а Вебмастер показы и клики вашего сайта, причём только до 50-й позиции выдачи. Плюс задержка: в Вордстате разница между получением данных и их отображением может занимать около месяца, а Вебмастер обновляет статистику ежедневно.

Поделиться:
Posted in SEO

About Author: Мария Соколова

nu_editor_sokolova@neurounit.ai

Редактор Neurounit. Пишет про нейросети в маркетинге и работу AI-агентов в рекламе.

Neurounit

Запустить рост с AI

Оставьте заявку или напишите в мессенджер