Как отличить ИИ-трафик от живых пользователей в Яндекс.Метрике

Как отличить ИИ-трафик от живых пользователей в Яндекс.Метрике

Трафик от нейросетей — боты, парсеры, ИИ-ассистенты — завышает посещаемость, искажает поведенческие метрики и мешает видеть реальную картину. Без фильтрации вы рискуете переоценить эффективность SEO и рекламы, а решения принимать на шуме. В статье разберём, как настроить сегменты в Яндекс.Метрике, чтобы отделить ИИ-трафик, и на какие метрики смотреть, чтобы не обманывать себя.

Почему нейросетевые боты искажают данные и в чём риск

Крупные языковые модели (ChatGPT, Gemini, Claude) постоянно сканируют сайты, чтобы обновлять свои обучающие выборки. К ним добавляются парсеры конкурентов, сервисы сбора контента и поисковые роботы нового поколения. Многие из них ведут себя как обычные пользователи: открывают страницы, прокручивают, иногда имитируют клики. Яндекс.Метрика автоматически отсеивает часть роботов, но не всех. В итоге в отчётах растут просмотры, падает показатель отказов (потому что бот «остаётся» на странице заданное время), а конверсии остаются на месте. Это создаёт иллюзию активности — вы думаете, что трафик растёт, а заявок нет.

Особенно опасно, когда такой шум накладывается на сезонные колебания или рекламные кампании. Вы начинаете оптимизировать под несуществующее поведение — например, меняете контент, чтобы удержать «глубину просмотра», хотя реальные пользователи и так всё видят. По данным практических руководств, разрыв между посещаемостью и заявками часто объясняется неучтённым ботами трафиком (как не переоценить влияние нейросетей на трафик в Яндекс.Метрике).

Как настроить сегмент для отсеивания ИИ-трафика

Яндекс.Метрика даёт несколько инструментов. Первый — стандартный фильтр «Исключить роботов» в настройках счётчика. Его стоит включить всегда. Но он может пропускать продвинутые боты, которые маскируются под браузеры. Второй — сегменты в отчётах. Вы можете создать сегмент «Реальные пользователи» с условием «Тип клиента — человек». Однако лучше добавить дополнительные условия: исключить сессии с User Agent, содержащим «GPTBot», «Google-Extended», «Claude-Web», «CCBot» и другие известные строки. Полный список обновляется, но вы можете найти его в открытых источниках и добавить в фильтр.

Третий способ — использовать готовый сегмент из раздела «Умные сегменты» в Метрике (если он доступен в вашем аккаунте). Если нет — создайте вручную через конструктор сегментов: «Device type = Desktop» → «User Agent не содержит bot, GPT, crawler». Подробная настройка описана в материале как настроить сегмент трафика из нейросетей в Яндекс.Метрике.

Какие метрики страдают от шума — и на что переключиться

Главные жертвы ИИ-трафика:

  • Общее число визитов — растёт, но это пустые счётчики.
  • Показатель отказов — становится заниженным, так как боты «задерживаются».
  • Глубина просмотра — усредняется, теряет диагностическую ценность.
  • Время на сайте — не отражает поведение живых людей.

Что делать: переключитесь на конверсионные метрики. Сравнивайте сегмент «Все посетители» и «Реальные пользователи» по целям — заявки, звонки, оформления заказов. Если при исключении ботов конверсия растёт (а общий трафик падает), значит шум был. Используйте A/B-тестирование (продуктовая аналитика в Яндекс.Метрике: почему клиенты не покупают) для проверки гипотез на отфильтрованных данных — иначе вы рискуете оптимизировать под роботов.

Типичные ошибки при работе с ИИ-трафиком

  1. Полагаться только на стандартное отсечение роботов в настройках — оно не покрывает всех новых ботов.
  2. Делать выводы о росте аудитории на основе сырого трафика без фильтрации.
  3. Настраивать ретаргетинг или контекстную рекламу на сегменты, где значительная доля посетителей — боты (бюджет уходит впустую).
  4. Сравнивать периоды без учёта изменения доли ИИ-трафика — можно принять сезонный спад за ухудшение работы сайта.
  5. Не проверять User Agent в логах сервера или через специальные сервисы — только так можно точно идентифицировать ботов.

3 шага, которые можно сделать сегодня:

  1. Зайдите в Яндекс.Метрику → Отчёты → Технологии → Типы клиентов. Посмотрите, сколько процентов сессий приходится на роботов. Если больше 5–7 % — это повод заняться фильтрацией.
  2. Создайте сегмент «Реальные пользователи» (исключите роботов и ботов по User Agent) и сохраните его как основной для всех отчётов. Теперь вы видите чистую картину.
  3. Сравните конверсию в цели «Заявка» в сегменте «Все» и в сегменте «Реальные». Разница покажет, сколько лидов вы теряете из-за шума — или, наоборот, переоцениваете эффективность SEO.
Полезные ссылки как настроить сегмент трафика из нейросетей в Яндекс.Метрике, как не переоценить влияние нейросетей на трафик в Яндекс.Метрике, продуктовая аналитика в Яндекс.Метрике: почему клиенты не покупают.