Canonical — тег, которым вы говорите поисковику, какая версия страницы главная. Когда одно и то же содержимое доступно по нескольким адресам — со слэшем и без, с UTM-меткой и без, на второй странице пагинации, — поисковик видит несколько разных URL с одинаковым контентом: дубли. Canonical склеивает их сигналы в один адрес, и в выдаче участвует только он.

В этой статье разберём, откуда на сайтах берутся дубли и чем они вредят позициям, как работает canonical и где он обязателен, чем он отличается от robots.txt и noindex — и какие ошибки с ним встречаются чаще всего.

Коротко: главное о canonical
  • Canonical — тег <link rel="canonical"> в блоке head: указывает главную версию страницы среди дублей.
  • Дубли берутся из ненастроенных зеркал (слэш, http/https, www), открытых фильтров каталога, GET-параметров и UTM-меток, пагинации.
  • Вред дублей: релевантность размывается между копиями, краулинговый бюджет уходит на мусор, в выдачу попадает не та страница.
  • Canonical — рекомендация, а не директива: поисковик может его проигнорировать, если посчитает ошибочным.
  • Обязателен: на пагинации интернет-магазинов, страницах с параметрами, версиях для печати.
  • Не путать: robots.txt управляет обходом, noindex — индексацией, canonical — склейкой сигналов между дублями.
  • Полные дубли зеркал (http→https, www, слэш) правильнее клеить не canonical, а 301-редиректом.

Откуда берутся дубли страниц

«Дубли страниц берутся из-за неправильной оптимизации. Если это не Тильда, а что-то вроде самописного сайта или самописной CMS — практически в 90% случаев есть проблема со слэшем и без слэша на конце, http и https, с www и без: этих настроек зеркал нет, и получаются два дубля страницы. Дальше — на сайтах типа Битрикса не закрываются фильтры, да и в целом на любых сайтах, и на WordPress: в индекс попадают тысячи, десятки тысяч, иногда и сотни тысяч страниц. И параметры: если вы занимаетесь рекламой — UTM-метки тоже нужно правильно закрывать через robots и прописывать canonical, потому что это всё летит в индекс»

Эдуард Трубченинов, основатель PrivateSEO

Сведём типовые источники дублей в один список:

  • Ненастроенные зеркалаsite.ru/page и site.ru/page/, http и https, с www и без. Четыре комбинации — четыре «разных» URL с одним содержимым.
  • Фильтры и сортировки каталога — каждая комбинация фильтров рождает новый URL. Часть таких страниц специально оставляют под спрос, остальные — дубли категории.
  • GET-параметры и UTM-метки — каждая рекламная ссылка с меткой для робота отдельный адрес той же страницы.
  • Пагинация — страницы 2, 3, 4… категории с почти одинаковым содержимым.
  • Версии для печати, сессионные параметры, тестовые копии страниц.

Чем дубли вредят позициям

Механика вреда двойная. Первое — размывание релевантности: когда на сайте несколько одинаковых страниц, поисковик сам решает, какую показывать, и часто выбирает не ту, которую продвигаете вы. Сигналы — ссылки, поведение, текст — делятся между копиями вместо того, чтобы работать на одну страницу. Второе — расход краулингового бюджета: робот тратит лимит обхода на десятки тысяч копий, а до страниц, которые приносят деньги, добирается реже. Подробно это разобрано в статье про краулинговый бюджет.

Эффект от чистки — не теоретический:

«Такие ситуации были: мы убирали дубли — и страницы, которые мы хотели, начинали лучше индексироваться, и по ним росли позиции»

Эдуард Трубченинов, основатель PrivateSEO

Как работает canonical

Тег прописывается в блоке <head> каждой страницы-дубля и указывает на главную версию:

<link rel="canonical" href="https://site.ru/catalog/konditsionery/">

Прочитав его, поисковик склеивает сигналы дубля с главной страницей и показывает в выдаче только её. Важных нюанса три:

1. Canonical — рекомендация, а не приказ. И Яндекс, и Google могут проигнорировать тег, если сочтут его ошибочным — например, когда «дубли» на самом деле заметно различаются содержимым. Гарантированные инструменты — noindex и 301-редирект; canonical работает там, где страницы действительно копии или близкие версии.

2. Самоссылающийся canonical — это норма. Хорошая практика: каждая страница указывает canonical на саму себя, а дубли с параметрами автоматически наследуют ссылку на чистый URL. Так любая UTM-версия страницы сразу говорит поисковику, кого считать главным.

3. Полные дубли зеркал клеятся редиректом, а не canonical. Для http→https, www/без www и слэшей правильное решение — 301-редирект: он не оставляет копии в доступе вовсе. Canonical — для случаев, когда обе версии страницы должны оставаться открытыми (фильтры, метки, пагинация).

Где canonical обязателен

«Canonical мы точно прописываем на страницах пагинации в интернет-магазинах — это прямо must have, потому что иначе поисковый робот будет индексировать всё»

Эдуард Трубченинов, основатель PrivateSEO
  • Пагинация каталога — страницы ?page=2, 3… указывают на первую страницу категории.
  • Страницы с GET-параметрами — сортировки, метки, сессии указывают на чистый URL. Для Яндекса это дублирует Clean-param в robots.txt, для Google canonical — основной инструмент.
  • Фильтры, которые не продвигаются — указывают на категорию. Какие фильтры, наоборот, стоит открывать под спрос — отдельный разбор.
  • Версии для печати и AMP-подобные копии — на основную версию.
  • Один товар в нескольких категориях — все URL-варианты карточки указывают на один основной адрес.

Canonical, robots.txt или noindex: что когда

Три инструмента постоянно путают, хотя работают они на разных уровнях:

  • Robots.txt — запрещает роботу заходить на страницу. Обход, а не индексация: закрытая страница может остаться в выдаче по внешним ссылкам. Подробно — в гайде по robots.txt.
  • Noindex — запрещает индексировать. Жёсткий инструмент для страниц, которых в поиске не должно быть вовсе: служебные разделы, черновики, тонкие страницы.
  • Canonical — ничего не запрещает: склеивает сигналы дублей на главной версии. Инструмент для страниц-копий, чей вес должен работать на одну.

Практическое правило: если страница — копия другой и её вес нужен главной версии, ставьте canonical. Если страницы в поиске быть не должно и вес не важен — noindex. Если робот вообще не должен тратить время на раздел — robots.txt. И помните ловушку из статьи про robots: noindex и canonical работают только на страницах, открытых для обхода, — закрытую в robots страницу робот не прочитает и тегов не увидит.

Типовые ошибки

«Я часто вижу, что canonical, например, не прописывают — его просто нет»

Эдуард Трубченинов, основатель PrivateSEO
  • Canonical отсутствует вовсе — самая частая ситуация: сайт живёт с дублями годами, и никто не считал, сколько копий в индексе.
  • Canonical на страницу, закрытую в robots.txt — робот не может зайти на главную версию и проверить её; склейка не работает.
  • Цепочки canonical — A указывает на B, B на C. Поисковик может не пройти цепочку до конца; canonical всегда ставится сразу на конечную версию.
  • Canonical на нерелевантную страницу — например, все фильтры на главную. Поисковик видит, что «главная версия» не похожа на дубль, и игнорирует тег.
  • Canonical + noindex на одной странице — противоречивые сигналы: вы просите склеить страницу с главной и одновременно не индексировать. Выбирайте что-то одно.
  • Разные canonical на мобильной и десктопной версии — рассинхрон, который путает робота.

Как проверить дубли и canonical на своём сайте

  • Точечно: откройте страницу, нажмите Ctrl+U и найдите rel="canonical" — куда указывает href. Быстрее — наше расширение для Chrome: canonical выведен прямо на первый экран плагина — открыли страницу, открыли плагин и сразу видите, прописан ли тег и куда он указывает, без чтения кода. Работает на любом сайте, включая конкурентов.
  • Массово в Яндексе: Вебмастер → «Страницы в поиске» → исключённые: статусы «Дубль» и «Неканоническая» покажут, что Яндекс уже склеил и что он думает о ваших тегах.
  • Массово в Google: Search Console → отчёт об индексировании: группы «Страница является копией» и «Google выбрал другую каноническую версию» — последняя прямо говорит, что ваш canonical проигнорирован.
  • Краулером: любой SEO-краулер соберёт все canonical сайта и подсветит цепочки, пустые и противоречивые.

Чек-лист

  • Зеркала склеены 301-редиректом: одна схема (https), один хост, один вариант слэша.
  • Каждая страница отдаёт самоссылающийся canonical на чистый URL без параметров.
  • Пагинация указывает canonical на первую страницу категории.
  • Непродвигаемые фильтры и сортировки указывают на категорию.
  • Canonical нигде не ведёт на страницу, закрытую в robots.txt, и не образует цепочек.
  • В Вебмастере и GSC проверены отчёты о дублях — поисковики согласны с вашими canonical.
  • Canonical и noindex не стоят на одной странице одновременно.
  • Быстрая самопроверка: пройдитесь по ключевым страницам с открытым расширением PrivateSEO — canonical показан на первом экране для каждой страницы.

Canonical — часть технического фундамента вместе с robots.txt, картой сайта и 301-редиректами. Проверить фундамент целиком поможет технический аудит.

Вопросы и ответы

Что такое canonical простыми словами?

Тег в коде страницы, который говорит поисковику: «главная версия этого содержимого — вот по этому адресу». Когда одна и та же страница доступна по нескольким URL, canonical склеивает их сигналы в один адрес — и в выдаче участвует только он.

Откуда на сайте берутся дубли страниц?

Главные источники: ненастроенные зеркала (со слэшем и без, http и https, с www и без), открытые страницы фильтров и сортировок в каталогах, GET-параметры и UTM-метки от рекламы, версии для печати, пагинация. На самописных CMS дубли зеркал встречаются почти всегда.

Чем дубли вредят SEO?

Поисковик не понимает, какую из одинаковых страниц показывать, — релевантность размывается между копиями, и в выдачу может попасть не та версия. Плюс робот тратит краулинговый бюджет на обход копий вместо страниц, которые приносят деньги.

Canonical — это директива или рекомендация?

Рекомендация. И Яндекс, и Google могут проигнорировать canonical, если считают его ошибочным — например, когда «дубли» на самом деле разные страницы. Для жёсткого запрета индексации используется noindex, для запрета обхода — robots.txt.

Чем canonical отличается от robots.txt и noindex?

Robots.txt запрещает роботу заходить на страницу, noindex — индексировать её, а canonical не запрещает ничего: он склеивает сигналы дублей на главной версии. Canonical — для одинаковых страниц, которые должны передавать вес одной; noindex — для страниц, которых в поиске не должно быть вовсе.

Нужен ли canonical на страницах пагинации?

Да, для интернет-магазинов это обязательная настройка: страницы «?page=2, 3, 4…» указывают canonical на первую страницу категории. Иначе робот индексирует десятки копий категории с почти одинаковым содержимым.

Как проверить canonical на странице?

Откройте код страницы (Ctrl+U) и найдите link rel="canonical" — адрес в href должен указывать на главную версию. Массово дубли ищут в Яндекс Вебмастере («Страницы в поиске» → статусы дублей) и в отчёте об индексировании Google Search Console.