Не размывают ли UTM-метки и другие параметры URL сигнал canonical для краулера.
Для человека example.ru/tovar и example.ru/tovar?utm_source=email — одна и та же страница. Для краулера, если canonical настроен неверно, это формально два разных URL с одинаковым содержимым — размытие сигнала о том, какая версия основная.
Canonical явно указывает краулеру: «вот основная версия этой страницы, ссылайся на неё, даже если зашёл по адресу с параметрами». Он должен указывать на «чистый» URL без utm_, gclid, fbclid и подобных меток — независимо от того, какие параметры были в запросе.
Загружает конкретный URL (с параметрами, если вы их указали), находит тег canonical и сравнивает: не протекли ли трекинг-параметры из запроса в canonical, и указывает ли canonical на тот же путь, что и запрошенный адрес.
Инструмент анализирует один URL за раз — он не обходит весь сайт и не находит дубли контента между разными страницами. Для полноценного аудита дублей по всему сайту нужен краулер, а не проверка одной страницы.
Частая, но малозаметная причина размытия релевантности между версиями одной и той же страницы.
Позволяет использовать UTM-метки в кампаниях, не переживая за побочный эффект для SEO/GEO.
Быстрая проверка после изменения логики генерации canonical в шаблоне.
Особенно актуально при активной фильтрации/сортировке каталога — она тоже генерирует параметры URL.
Настраивайте canonical на уровне шаблона так, чтобы он всегда указывал на «чистый» URL, независимо от параметров запроса.
Не полагайтесь на robots.txt для решения проблемы дублей по параметрам — это задача canonical, а не блокировки краулинга.
Проверяйте canonical на страницах фильтров и сортировок каталога отдельно — там параметров обычно больше всего.
Используйте Google Search Console / Яндекс.Вебмастер, чтобы увидеть, какие версии URL реально попали в индекс.
Нет — Disallow заблокирует обход, но не объяснит краулеру, какая версия основная, если он уже проиндексировал обе. Canonical — правильный инструмент для этой задачи.
Не всегда — для меток аналитики это избыточно и может сломать отслеживание переходов. Canonical достаточно, чтобы указать основную версию без изменения фактического URL, который видит пользователь.
Нет, только canonical-логику одной конкретной страницы. Обнаружение дублей по всему сайту требует полноценного краулинга.
Это может быть осознанным решением (например, canonical на страницу того же товара в другом регионе), но чаще — ошибка конфигурации, которую стоит перепроверить вручную.
Кто из 8 AI-ботов (GPTBot, ClaudeBot, PerplexityBot и другие) может заходить на ваш сайт, а кто заблокирован.
Проверить →Есть ли у сайта llms.txt и правильно ли он оформлен: заголовок, структура разделов, ссылки, MIME-тип.
Проверить →Соберём корректный по структуре llms.txt из названия сайта, описания и ссылок на ключевые разделы.
Проверить →Аудит разбирает все сигналы сразу: техническую доступность, разметку, репутацию и Entity-сигналы бренда — и даёт приоритетный план действий.
Заказать аудит