Canonical — тег, которым вы говорите поисковику, какая версия страницы главная. Когда одно и то же содержимое доступно по нескольким адресам — со слэшем и без, с UTM-меткой и без, на второй странице пагинации, — поисковик видит несколько разных URL с одинаковым контентом: дубли. Canonical склеивает их сигналы в один адрес, и в выдаче участвует только он.
В этой статье разберём, откуда на сайтах берутся дубли и чем они вредят позициям, как работает canonical и где он обязателен, чем он отличается от robots.txt и noindex — и какие ошибки с ним встречаются чаще всего.
- Canonical — тег
<link rel="canonical">в блоке head: указывает главную версию страницы среди дублей. - Дубли берутся из ненастроенных зеркал (слэш, http/https, www), открытых фильтров каталога, GET-параметров и UTM-меток, пагинации.
- Вред дублей: релевантность размывается между копиями, краулинговый бюджет уходит на мусор, в выдачу попадает не та страница.
- Canonical — рекомендация, а не директива: поисковик может его проигнорировать, если посчитает ошибочным.
- Обязателен: на пагинации интернет-магазинов, страницах с параметрами, версиях для печати.
- Не путать: robots.txt управляет обходом, noindex — индексацией, canonical — склейкой сигналов между дублями.
- Полные дубли зеркал (http→https, www, слэш) правильнее клеить не canonical, а 301-редиректом.
Откуда берутся дубли страниц
«Дубли страниц берутся из-за неправильной оптимизации. Если это не Тильда, а что-то вроде самописного сайта или самописной CMS — практически в 90% случаев есть проблема со слэшем и без слэша на конце, http и https, с www и без: этих настроек зеркал нет, и получаются два дубля страницы. Дальше — на сайтах типа Битрикса не закрываются фильтры, да и в целом на любых сайтах, и на WordPress: в индекс попадают тысячи, десятки тысяч, иногда и сотни тысяч страниц. И параметры: если вы занимаетесь рекламой — UTM-метки тоже нужно правильно закрывать через robots и прописывать canonical, потому что это всё летит в индекс»
Сведём типовые источники дублей в один список:
- Ненастроенные зеркала —
site.ru/pageиsite.ru/page/, http и https, с www и без. Четыре комбинации — четыре «разных» URL с одним содержимым. - Фильтры и сортировки каталога — каждая комбинация фильтров рождает новый URL. Часть таких страниц специально оставляют под спрос, остальные — дубли категории.
- GET-параметры и UTM-метки — каждая рекламная ссылка с меткой для робота отдельный адрес той же страницы.
- Пагинация — страницы 2, 3, 4… категории с почти одинаковым содержимым.
- Версии для печати, сессионные параметры, тестовые копии страниц.
Чем дубли вредят позициям
Механика вреда двойная. Первое — размывание релевантности: когда на сайте несколько одинаковых страниц, поисковик сам решает, какую показывать, и часто выбирает не ту, которую продвигаете вы. Сигналы — ссылки, поведение, текст — делятся между копиями вместо того, чтобы работать на одну страницу. Второе — расход краулингового бюджета: робот тратит лимит обхода на десятки тысяч копий, а до страниц, которые приносят деньги, добирается реже. Подробно это разобрано в статье про краулинговый бюджет.
Эффект от чистки — не теоретический:
«Такие ситуации были: мы убирали дубли — и страницы, которые мы хотели, начинали лучше индексироваться, и по ним росли позиции»
Как работает canonical
Тег прописывается в блоке <head> каждой страницы-дубля и указывает на главную версию:
<link rel="canonical" href="https://site.ru/catalog/konditsionery/">
Прочитав его, поисковик склеивает сигналы дубля с главной страницей и показывает в выдаче только её. Важных нюанса три:
1. Canonical — рекомендация, а не приказ. И Яндекс, и Google могут проигнорировать тег, если сочтут его ошибочным — например, когда «дубли» на самом деле заметно различаются содержимым. Гарантированные инструменты — noindex и 301-редирект; canonical работает там, где страницы действительно копии или близкие версии.
2. Самоссылающийся canonical — это норма. Хорошая практика: каждая страница указывает canonical на саму себя, а дубли с параметрами автоматически наследуют ссылку на чистый URL. Так любая UTM-версия страницы сразу говорит поисковику, кого считать главным.
3. Полные дубли зеркал клеятся редиректом, а не canonical. Для http→https, www/без www и слэшей правильное решение — 301-редирект: он не оставляет копии в доступе вовсе. Canonical — для случаев, когда обе версии страницы должны оставаться открытыми (фильтры, метки, пагинация).
Где canonical обязателен
«Canonical мы точно прописываем на страницах пагинации в интернет-магазинах — это прямо must have, потому что иначе поисковый робот будет индексировать всё»
- Пагинация каталога — страницы
?page=2, 3…указывают на первую страницу категории. - Страницы с GET-параметрами — сортировки, метки, сессии указывают на чистый URL. Для Яндекса это дублирует Clean-param в robots.txt, для Google canonical — основной инструмент.
- Фильтры, которые не продвигаются — указывают на категорию. Какие фильтры, наоборот, стоит открывать под спрос — отдельный разбор.
- Версии для печати и AMP-подобные копии — на основную версию.
- Один товар в нескольких категориях — все URL-варианты карточки указывают на один основной адрес.
Canonical, robots.txt или noindex: что когда
Три инструмента постоянно путают, хотя работают они на разных уровнях:
- Robots.txt — запрещает роботу заходить на страницу. Обход, а не индексация: закрытая страница может остаться в выдаче по внешним ссылкам. Подробно — в гайде по robots.txt.
- Noindex — запрещает индексировать. Жёсткий инструмент для страниц, которых в поиске не должно быть вовсе: служебные разделы, черновики, тонкие страницы.
- Canonical — ничего не запрещает: склеивает сигналы дублей на главной версии. Инструмент для страниц-копий, чей вес должен работать на одну.
Практическое правило: если страница — копия другой и её вес нужен главной версии, ставьте canonical. Если страницы в поиске быть не должно и вес не важен — noindex. Если робот вообще не должен тратить время на раздел — robots.txt. И помните ловушку из статьи про robots: noindex и canonical работают только на страницах, открытых для обхода, — закрытую в robots страницу робот не прочитает и тегов не увидит.
Типовые ошибки
«Я часто вижу, что canonical, например, не прописывают — его просто нет»
- Canonical отсутствует вовсе — самая частая ситуация: сайт живёт с дублями годами, и никто не считал, сколько копий в индексе.
- Canonical на страницу, закрытую в robots.txt — робот не может зайти на главную версию и проверить её; склейка не работает.
- Цепочки canonical — A указывает на B, B на C. Поисковик может не пройти цепочку до конца; canonical всегда ставится сразу на конечную версию.
- Canonical на нерелевантную страницу — например, все фильтры на главную. Поисковик видит, что «главная версия» не похожа на дубль, и игнорирует тег.
- Canonical + noindex на одной странице — противоречивые сигналы: вы просите склеить страницу с главной и одновременно не индексировать. Выбирайте что-то одно.
- Разные canonical на мобильной и десктопной версии — рассинхрон, который путает робота.
Как проверить дубли и canonical на своём сайте
- Точечно: откройте страницу, нажмите Ctrl+U и найдите
rel="canonical"— куда указывает href. Быстрее — наше расширение для Chrome: canonical выведен прямо на первый экран плагина — открыли страницу, открыли плагин и сразу видите, прописан ли тег и куда он указывает, без чтения кода. Работает на любом сайте, включая конкурентов. - Массово в Яндексе: Вебмастер → «Страницы в поиске» → исключённые: статусы «Дубль» и «Неканоническая» покажут, что Яндекс уже склеил и что он думает о ваших тегах.
- Массово в Google: Search Console → отчёт об индексировании: группы «Страница является копией» и «Google выбрал другую каноническую версию» — последняя прямо говорит, что ваш canonical проигнорирован.
- Краулером: любой SEO-краулер соберёт все canonical сайта и подсветит цепочки, пустые и противоречивые.
Чек-лист
- Зеркала склеены 301-редиректом: одна схема (https), один хост, один вариант слэша.
- Каждая страница отдаёт самоссылающийся canonical на чистый URL без параметров.
- Пагинация указывает canonical на первую страницу категории.
- Непродвигаемые фильтры и сортировки указывают на категорию.
- Canonical нигде не ведёт на страницу, закрытую в robots.txt, и не образует цепочек.
- В Вебмастере и GSC проверены отчёты о дублях — поисковики согласны с вашими canonical.
- Canonical и noindex не стоят на одной странице одновременно.
- Быстрая самопроверка: пройдитесь по ключевым страницам с открытым расширением PrivateSEO — canonical показан на первом экране для каждой страницы.
Canonical — часть технического фундамента вместе с robots.txt, картой сайта и 301-редиректами. Проверить фундамент целиком поможет технический аудит.
Вопросы и ответы
Что такое canonical простыми словами?
Тег в коде страницы, который говорит поисковику: «главная версия этого содержимого — вот по этому адресу». Когда одна и та же страница доступна по нескольким URL, canonical склеивает их сигналы в один адрес — и в выдаче участвует только он.
Откуда на сайте берутся дубли страниц?
Главные источники: ненастроенные зеркала (со слэшем и без, http и https, с www и без), открытые страницы фильтров и сортировок в каталогах, GET-параметры и UTM-метки от рекламы, версии для печати, пагинация. На самописных CMS дубли зеркал встречаются почти всегда.
Чем дубли вредят SEO?
Поисковик не понимает, какую из одинаковых страниц показывать, — релевантность размывается между копиями, и в выдачу может попасть не та версия. Плюс робот тратит краулинговый бюджет на обход копий вместо страниц, которые приносят деньги.
Canonical — это директива или рекомендация?
Рекомендация. И Яндекс, и Google могут проигнорировать canonical, если считают его ошибочным — например, когда «дубли» на самом деле разные страницы. Для жёсткого запрета индексации используется noindex, для запрета обхода — robots.txt.
Чем canonical отличается от robots.txt и noindex?
Robots.txt запрещает роботу заходить на страницу, noindex — индексировать её, а canonical не запрещает ничего: он склеивает сигналы дублей на главной версии. Canonical — для одинаковых страниц, которые должны передавать вес одной; noindex — для страниц, которых в поиске не должно быть вовсе.
Нужен ли canonical на страницах пагинации?
Да, для интернет-магазинов это обязательная настройка: страницы «?page=2, 3, 4…» указывают canonical на первую страницу категории. Иначе робот индексирует десятки копий категории с почти одинаковым содержимым.
Как проверить canonical на странице?
Откройте код страницы (Ctrl+U) и найдите link rel="canonical" — адрес в href должен указывать на главную версию. Массово дубли ищут в Яндекс Вебмастере («Страницы в поиске» → статусы дублей) и в отчёте об индексировании Google Search Console.
