Коротко. GEO это Generative Engine Optimization, подготовка страниц к тому, чтобы генеративные системы брали их в ответ и ссылались на источник. Работа делится на три слоя: доступ роботов, извлекаемость фактов, замер цитирований. Классическая SEO-оптимизация сайта остаётся фундаментом: если страницы нет в индексе, цитировать нечего.
Три разных значения слова «гео» и какое здесь
Запрос «гео оптимизация сайта» смешивает три несовместимые задачи. Развести их нужно до начала работ.
- Generative Engine Optimization. Оптимизация под генеративные ответы: ChatGPT, Perplexity, Google AI Overviews и AI Mode, Яндекс Нейро, Gemini. Синонимы в отрасли: AEO, AIO, LLMO. Единица успеха здесь не позиция, а факт цитирования. Под этот трафик в Google Analytics 4 заведён отдельный канал по умолчанию AI Assistant: по описанию Google, в него попадают переходы из ChatGPT, Gemini, DeepSeek, Copilot и Grok.
- Гео-таргетинг рекламы. Настройка географии показов в рекламном кабинете, к коду сайта отношения не имеет.
- Локальное и региональное SEO. Продвижение по городам: поддомены или папки, привязка региона в Вебмастере, карточки в справочниках. Отдельная дисциплина, разобрана в материале про региональное SEO и продвижение по городам.
Дальше «гео» означает только первое значение.
Чем GEO отличается от классической SEO-оптимизации сайта
| Критерий | Классическое SEO | GEO |
|---|---|---|
| Где показывается результат | Список ссылок в выдаче | Готовый ответ генеративной системы |
| Главная цель | Клик и трафик на сайт | Цитирование и упоминание бренда в ответе |
| Единица ранжирования | Страница по запросу | Отдельный факт, определение, абзац |
| Единица измерения | Позиция и клик | Факт цитирования и доля упоминаний в серии прогонов |
| Роль ключевых слов | Высокая | Ниже: важнее однозначность формулировки |
| Что оценивается | Ссылки, поведенческие и технические факторы | Экспертность, проверяемые факты, структура, извлекаемость |
| Где видно в аналитике | Organic Search в GA4, отчёт по эффективности в Search Console | Канал AI Assistant в GA4 плюс ручной прогон запросов |
Разделение слоёв нестрогое. Google относит клики из своих ИИ-функций к обычному поиску: в отчёте по эффективности Search Console доступны фильтры по типу поиска «веб», «картинки», «видео» и «новости», отдельного типа для AI Overviews или AI Mode нет, а показы и клики оттуда включены в общую статистику. В GA4 логика та же: AI Overviews и AI Mode считаются Organic Search, а в канал AI Assistant попадают внешние ИИ-сервисы, у которых medium приравнивается к ai-assistant, а campaign к (ai-assistant).
Отсюда вывод: GEO не заменяет SEO и не является отдельным каналом. Это надстройка над индексацией.
Как модель выбирает источник для ответа
Механик три, и они требуют разных действий: страница может быть открыта для обучения и закрыта для поисковой части того же сервиса.
- Живой поиск по индексу сервиса. Perplexity собирает индекс роботом PerplexityBot, который, по документации сервиса, отвечает за показ и ссылки на сайты в результатах и не используется для обучения моделей. У OpenAI за показ в поиске ChatGPT отвечает OAI-SearchBot, у Anthropic за индексацию для поиска Claude-SearchBot. Яндекс обрабатывает контент для быстрых ответов с YandexGPT отдельным роботом YandexAdditionalBot.
- Заход по конкретному запросу пользователя. Когда человек даёт ассистенту ссылку, страницу открывает отдельный агент: Perplexity-User, ChatGPT-User, Claude-User. Деталь, которую почти не пишут: Perplexity прямо указывает, что этот сборщик, поскольку запрос инициировал пользователь, обычно игнорирует правила robots.txt. У OpenAI формулировка мягче: правила robots.txt к ChatGPT-User могут не применяться.
- Ответ из обучающих данных. Сюда собирают GPTBot, ClaudeBot, Google-Extended. Контур долгий и без ссылки: измеримого трафика он не даёт.
Отдельно снимем популярное заблуждение про особую подготовку под ИИ. Google в справке по ИИ-функциям пишет прямо: дополнительных требований для попадания в AI Overviews и AI Mode нет, создавать новые машиночитаемые файлы, «AI text files» или специальную разметку не нужно, отдельной структурированной разметки schema.org под эти функции не существует. Управление показом идёт стандартными инструментами: nosnippet, data-nosnippet, max-snippet, noindex.
На извлекаемость влияет форма подачи: прямой ответ в первых двух-трёх предложениях под заголовком-вопросом, а не в конце раздела. Модель собирает ответ из фрагментов, и фрагмент, начинающийся с определения или цифры, переносится целиком.
Технический доступ: robots.txt и боты
Ниже точные токены user-agent из официальной документации вендоров.
| User-agent | Владелец | Для чего | Что даёт Disallow |
|---|---|---|---|
| GPTBot | OpenAI | Сбор данных для обучения моделей | Контент не используется для обучения |
| OAI-SearchBot | OpenAI | Показ сайтов в результатах поиска ChatGPT | Сайт не появляется в поиске ChatGPT |
| ChatGPT-User | OpenAI | Заход по действию пользователя в ChatGPT и Custom GPTs | Правила robots.txt могут не применяться |
| PerplexityBot | Perplexity | Индексация для показа и ссылок в результатах, не обучение | Сайт не показывается в результатах Perplexity |
| Perplexity-User | Perplexity | Заход на страницу по запросу пользователя | Как правило, robots.txt игнорируется |
| ClaudeBot | Anthropic | Сбор веб-контента для моделей | Контент не собирается для моделей |
| Claude-SearchBot | Anthropic | Индексация контента для качества поиска | Страницы не попадают в поисковый контур Claude |
| Google-Extended | Обучение Gemini, Gemini Apps и Grounding with Google Search | Не влияет на присутствие в Google Поиске и не является сигналом ранжирования | |
| Googlebot | Основной обход для Поиска, Discover, Картинок, Видео, Новостей | Выпадение из Поиска, а значит и из AI Overviews | |
| YandexBot | Яндекс | Основной индексирующий робот | Выпадение из индекса Яндекса |
| YandexAdditionalBot | Яндекс | Обработка контента для быстрых ответов с YandexGPT | Контент не попадает в быстрые ответы |
Главное разграничение: запрет на обучение и запрет на цитирование это разные строки. Закрыв GPTBot, вы не уходите из поиска ChatGPT. Закрыв Google-Extended, вы не выпадаете из AI Overviews, за них отвечает обычный Googlebot. И наоборот: закрытый OAI-SearchBot убирает вас из ответов ChatGPT, но на обучение не влияет.
Технические ограничения самого файла:
- robots.txt лежит только в корне хоста и действует на конкретный хост, протокол и порт. Для поддомена нужен свой файл.
- Google парсит первые 500 кибибайт, всё, что после лимита, игнорируется.
- Кэш содержимого у Google обычно до 24 часов и корректируется заголовком Cache-Control max-age. Правка не вступает в силу мгновенно.
- При конфликте Allow и Disallow побеждает более специфичное правило по длине пути, при равной длине менее ограничивающее.
- У Яндекса приоритет секций жёсткий: явное имя робота важнее User-agent: Yandex, а тот важнее User-agent: *. Если для робота нашлась своя секция, общие уже не читаются.
- Закрытая в robots.txt страница может попасть в индекс по внешним ссылкам, но её содержимое прочитано не будет. Для генеративных систем это худший вариант: URL известен, извлекать нечего.
Отдельный пункт, ставший причиной половины «необъяснимых» провалов. Открытый robots.txt не гарантирует доступ: обход может резаться на уровне CDN. Cloudflare в документации предупреждает, что с 15 сентября 2026 года для новых доменов вступят в силу обновлённые умолчания: боты категорий Training и Agent будут блокироваться на страницах, где показывается реклама, а категория Search останется разрешённой (документация Cloudflare). До этой даты и на уже существующих доменах поведение задаётся текущими настройками аккаунта. Проверять нужно не файл, а логи веб-сервера: приходил ли бот физически и с каким кодом ответа.
Разметка и структура страницы под цитирование
Разметка не заставляет модель вас процитировать, но снимает неоднозначность: кто автор, когда обновлено, что за организация. Рабочий минимум для статьи: Article с автором и датами публикации и изменения, Organization с юридическим названием и контактами, BreadcrumbList, блок вопросов и ответов.
Оговорка про FAQ отменяет типовой совет из большинства статей по теме. В августе 2023 года Google ограничил показ расширенных результатов FAQ известными авторитетными государственными и медицинскими сайтами, а затем убрал документацию по функции, поскольку такой расширенный результат в выдаче больше не показывается. В актуальной галерее структурированных данных Google типа FAQ уже нет, остались Article, Breadcrumb, Organization и Q&A. Вывод: ставить FAQPage ради сниппета бессмысленно, держать блок вопросов ради ясной структуры текста по-прежнему имеет смысл.
Валидация обязательна, и одного инструмента мало. Schema Markup Validator на validator.schema.org проверяет соответствие словарю schema.org. Rich Results Test у Google проверяет только пригодность к расширенным результатам и на валидную, но неподдерживаемую разметку промолчит: разметка, проходящая первый инструмент и не проходящая второй, чаще всего корректна.
По нашим прогонам контрольных запросов фрагменты из таблиц и нумерованных списков переносятся в ответ чаще, чем те же данные внутри сплошного абзаца: у списка есть явная граница. Отраслевого исследования с процентами по этому наблюдению мы не нашли, поэтому подаём его как собственную практику.
Чек-лист страницы, готовой к цитированию
Пункты даны с порогом: без порога проверить нельзя.
- Прямой ответ вверху страницы, 2-3 предложения, до первого H2.
- Заголовки H2 и H3 сформулированы как вопрос или понятие, а не как рубрика вида «Введение».
- Под каждым заголовком сначала ответ, потом раскрытие: первое предложение раздела читается вне контекста.
- Минимум один собственный числовой факт на раздел: срок, лимит, цена, доля, версия, порог. Раздел без такого факта переписывается или удаляется.
- Хотя бы одна таблица сравнения там, где сравнение уместно.
- Список шагов или чек-лист с проверяемыми формулировками.
- Авторство: проверяемое лицо или редакция с указанием опыта, не «Администратор».
- Дата последнего обновления одновременно в тексте и в разметке Article, значения совпадают.
- Ссылки на первоисточники: документация вендора, а не пересказ в стороннем блоге.
- Разметка Article, Organization, BreadcrumbList проходит validator.schema.org без ошибок.
- В логах сервера за последние 30 дней есть заходы хотя бы одного из роботов OAI-SearchBot, PerplexityBot, Claude-SearchBot, YandexAdditionalBot с кодом 200.
Проверьте свою страницу по этому чек-листу за три вопроса
- Первое предложение раздела отвечает на вопрос заголовка или только подводит к ответу?
- Сколько разделов на странице не содержат ни одной цифры, срока или ограничения?
- Приходили ли за последний месяц в логи OAI-SearchBot, PerplexityBot или YandexAdditionalBot и с каким кодом ответа?
Разберём вашу страницу по этому же чек-листу
Пришлём список незакрытых пунктов с приоритетом по трудозатратам: что чинится за час правкой robots.txt и разметки, а что требует переписывания разделов.
Как измерить результат
Главная методическая трудность: ответ модели невоспроизводим. Один и тот же запрос дважды подряд даёт разные формулировки и разный набор источников, поэтому замер делается серией, а единичный прогон не доказывает ни присутствия, ни отсутствия. Рабочих способов три.
- Ручной прогон контрольного списка. Фиксированный список из 20-30 запросов, прогон раз в неделю по одним и тем же системам, результат в таблицу: запрос, система, дата, упомянули или нет, какая страница указана источником. Считается доля прогонов с упоминанием. Список не меняется в течение квартала, иначе динамику не с чем сравнивать.
- Переходы в аналитике. В GA4 смотрится канал AI Assistant с переходами из ChatGPT, Gemini, DeepSeek, Copilot и Grok. Две ловушки: AI Overviews и AI Mode в этот канал не попадают, они относятся к Organic Search, а часть ассистентов не передаёт реферер, и такие визиты уходят в Direct. В Яндекс Метрике готовой группировки под ИИ-сервисы нет, отслеживать приходится по домену перехода в отчётах по источникам.
- Лог-анализ визитов роботов. Самый честный слой, не зависит от реферера. В логах ищутся строки user-agent из таблицы выше и сверяется код ответа. Принадлежность робота проверяют по официальным спискам адресов: у Perplexity это файл perplexitybot.json на их домене, у Яндекса обратный DNS-запрос. Без такой проверки в отчёт попадут подделки под известные user-agent.
Ошибки, которые убирают сайт из ответов
- Боты закрыты, а жалоба на отсутствие цитирований открыта. В robots.txt стоит Disallow для GPTBot и PerplexityBot, а от подрядчика ждут упоминаний в Perplexity. Подслучай: закрыли Google-Extended и ждут изменений в AI Overviews, хотя за них отвечает Googlebot.
- Доступ режется выше robots.txt. Файл открыт, но обход блокирует CDN или WAF. С учётом правил CDN и умолчаний Cloudflare, которые меняются 15 сентября 2026 года, проверка одного файла даёт ложноположительный результат.
- Текст переписан ИИ без добавленной ценности. Яндекс относит к некачественному контенту копирование и переписывание материалов с других ресурсов, низкокачественные автопереводы и автоматически сгенерированный бесполезный контент, а также SEO-тексты, созданные для манипуляции поисковыми системами. Генеративной системе такой текст тоже нечего извлечь: в нём нет ни одного факта, которого нет в десяти других источниках.
- Ставка на «специальные файлы для ИИ» вместо индексации. Google прямым текстом пишет, что новых машиночитаемых файлов и особой разметки для AI Overviews и AI Mode не требуется.
- Вывод по одному прогону. Спросили ChatGPT один раз, себя не увидели, объявили GEO неработающим. При невоспроизводимом ответе решение принимается по серии прогонов.
С чего начать: минимальный набор
Пять действий закрывают базовый уровень. Оценка трудозатрат внутренняя, по работам агентства на типовой информационной странице до 12 тысяч знаков. На сложной странице или в самописной CMS цифры выше.
| Действие | Трудозатраты | Что считается выполненным |
|---|---|---|
| Аудит доступа: robots.txt, правила CDN и WAF, логи за 30 дней | 1-2 часа на сайт | По каждому боту известно: разрешён, приходил, код ответа |
| Прямой ответ вверху и переформулировка заголовков в вопросы | 0,5-1 час на страницу | Каждый раздел читается с первого предложения без контекста |
| Добавление проверяемой конкретики со ссылкой на первоисточник | 1,5-3 часа на страницу | Минимум один числовой факт на раздел, у каждого есть источник |
| Разметка Article, Organization, BreadcrumbList и валидация | 0,5-1 час при готовом шаблоне | validator.schema.org без ошибок, даты совпадают с текстом |
| Запуск замера: список из 20-30 запросов и таблица прогонов | 2-3 часа на настройку, далее 30-40 минут в неделю | Есть первая точка отсчёта по доле упоминаний |
Частые вопросы
GEO заменит классическую SEO-оптимизацию сайта?
Нет. Генеративные системы либо берут документы из поискового индекса, либо ходят на страницу напрямую, и то и другое требует индексируемого сайта.
Сколько ждать первых цитирований?
По нашим проектам первые упоминания по узким и однозначно сформулированным вопросам мы фиксировали в течение нескольких недель после переупаковки страницы, по конкурентным темам заметно дольше. Это наблюдение на своей выборке, а не отраслевой норматив: публичных исследований с воспроизводимыми сроками по русскоязычному сегменту мы не нашли.
Нужен ли файл llms.txt?
Google в справке по ИИ-функциям указывает, что создавать новые машиночитаемые файлы или «AI text files» не требуется. Ни одна из систем, чью документацию мы проверяли, не заявляет поддержку такого файла как условие цитирования.
Как закрыть сайт от обучения, но остаться в ответах?
Развести строки в robots.txt: закрыть GPTBot, ClaudeBot и Google-Extended, оставить открытыми OAI-SearchBot, PerplexityBot, Claude-SearchBot, Googlebot и YandexBot. Учитывать, что агенты, идущие по прямому запросу пользователя, robots.txt могут не соблюдать: Perplexity указывает это в документации явно.
Влияет ли разметка FAQPage на попадание в ответы?
Как источник расширенного результата в Google она больше не работает: функция FAQ ушла из выдачи и из галереи структурированных данных. Блок вопросов остаётся полезным, но это польза от структуры текста, а не от разметки.
Подходит ли GEO малому бизнесу?
Базовый уровень доступен любому: аудит доступа, прямые ответы вверху разделов и разметка занимают порядка 4-8 часов на страницу по оценкам выше и не требуют закупки ссылок. Ограничение другое: без собственных данных, кейсов и цифр отличиться нечем, а пересказ чужих материалов не даёт ни цитирования, ни позиций.
Материал подготовила редакция Neurounit. Технические факты сверены с документацией OpenAI, Anthropic, Perplexity, Google Search Central, Cloudflare и Яндекса на дату публикации. Оценки трудозатрат и сроков основаны на работах агентства и помечены в тексте как собственная практика.








