Канонический URL: как побеждать дубли и не терять позиции в поиске

Привет, читатель! Меня зовут Александр, я генеральный директор компании «Сегмент SEO» и один из авторов статей в наших соцсетях. В этой статье предлагаю разобраться в простом, но неочевидном аспекте SEO — каноническом URL. Ошибки в нём — распространённая проблема, с которой нам регулярно приходится работать на аудитах сайтов.

Канонический URL — это как главный ключ для поисковиков. Он говорит им: «Вот эта версия страницы — основная, а остальные — просто её копии». Например, если товар в интернет-магазине доступен по адресам:

  • site.com/product
  • site.com/product?sort=price
  • site.com/product?color=red

канонический URL укажет роботам, что главная страница — site.com/product, а остальные варианты с параметрами сортировки или характеристик — второстепенные.

Зачем это нужно

Представь: у тебя есть товар, который отображается в разных разделах каталога. Поисковики видят два разных URL с почти одинаковым текстом. Без канонизации они начинают путаться: какую версию показывать в поиске? Если добавить тег

html

<link rel="canonical" href="https://site.ru/catalog/razdel1/tovar" />

поисковик поймёт, что именно эта страница — основная (каноническая), и весь трафик и ссылочный вес пойдут туда.

Как это работает

Допустим, у сайта есть фильтры по цене, размеру и цвету. Каждый фильтр создаёт новый URL, но контент почти не меняется — это и есть дубли. Канонический тег «соберёт» вес ссылок на одну страницу, улучшив именно её позиции, вместо того чтобы распылять сигналы между копиями.

Важная оговорка, которую часто упускают: canonical подходит не для любых дублей, а именно для тех случаев, когда параметр не меняет содержание страницы по сути — сортировка, метки трафика (UTM), служебные технические параметры. Если же страница с фильтром действительно показывает другой набор товаров (например, отдельная подборка «красные диваны», которая имеет самостоятельный спрос в поиске), её иногда стоит не канонизировать, а развивать как отдельную страницу — или, если она не нужна в индексе, закрывать через noindex, а не через canonical.

Частая ошибка: canonical на страницы пагинации

Отдельно стоит предупредить про распространённую ошибку, в которую попадают даже опытные специалисты: канонизацию страниц пагинации (site.com/catalog?page=2, page=3 и так далее) на первую страницу каталога. Google прямо называет это одной из самых частых проблем с пагинацией: если сказать роботу, что вторая и последующие страницы — дубли первой, то товары, которые показаны только на них, рискуют вообще не попасть в индекс. Правильный подход — дать каждой странице пагинации собственный self-referencing canonical (то есть canonical, указывающий сама на себя), а не сводить всё к первой странице.

Пример из практики: клиент жаловался, что после запуска акции «Чёрная пятница» страницы каталога с UTM-метками из рекламных кампаний (site.com/sale?utm_source=..., site.com/sale?utm_campaign=...) начали конкурировать в индексе с основной страницей site.com/sale. Мы прописали канонический тег с этих технических дублей на site.com/sale — через месяц трафик на основную страницу вырос на 30%. Обрати внимание: здесь canonical сработал именно потому, что речь шла о служебных параметрах, а не о постраничной навигации по каталогу.

Как внедрить без ошибок

  1. Тег rel=canonical — вставь его в <head>. Например, для site.com/product?color=red пропиши:

html

   <link rel="canonical" href="https://site.com/product" />
  1. 301-редирект — если полностью переносишь контент (например, с HTTP на HTTPS или при смене адреса страницы), настрой переадресацию вместо canonical. Это как сказать пользователям и роботам: «Мы переехали, вот новый адрес» — а не «есть два адреса, но один главнее».
  2. XML-карта сайта — включай в неё только канонические URL, подробнее о том, зачем нужен sitemap.xml. Это ориентир для поисковиков: «Вот основные страницы, сканируйте их в первую очередь».

Чего делать не надо

  • Не канонизируй страницы пагинации на первую страницу каталога — как объяснили выше, это может скрыть от индексации товары со второй и последующих страниц.
  • Не комбинируй noindex с блокировкой в robots.txt. Это одна из самых вредных смешанных инструкций: если страница закрыта в robots.txt, робот вообще не сможет зайти на неё и увидеть тег noindex — а значит, страница всё равно может остаться в индексе (просто без сниппета), только уже без возможности снять её оттуда через noindex. Если хочешь полностью убрать страницу из поиска — используй noindex и оставь её открытой для сканирования; если хочешь просто сэкономить краулинговый бюджет на явно неважных технических страницах — используй disallow, но не для тех, что уже проиндексированы и которые нужно из индекса убрать.
  • Не забывай про HTTPS. Если сайт работает на защищённом протоколе, канонический URL должен вести именно на HTTPS-версию. Сам по себе HTTPS — подтверждённый, но по признанию Google весьма лёгкий сигнал ранжирования, а не решающий фактор; тем не менее указывать canonical на HTTP-версию при работающем HTTPS — явная техническая ошибка, которая путает сигналы.

Отдельно про Яндекс: директива clean_param

Для Яндекса есть дополнительный инструмент, которого нет у Google, — директива Clean-param в robots.txt. Она сообщает роботу Яндекса, какие GET-параметры не влияют на содержание страницы, и он сразу не тратит краулинговый бюджет на такие копии:

User-agent: Yandex
Clean-param: sort_field&order /catalog/category/

Учти: Clean-param работает только для робота Яндекса и не заменяет rel=canonical для Google — для универсального решения, которое поймут обе системы, нужен именно HTML-тег canonical.

Почему это важно для SEO

Канонический URL экономит краулинговый бюджет — время, которое поисковики тратят на сканирование сайта. Если робот видит десяток дублей вместо одной страницы, он может не успеть добраться до действительно важных разделов. А ещё это защита от размывания ссылочного веса: внешние ссылки будут работать на одну версию страницы, а не делиться между несколькими копиями.

Заключение

Канонический URL — это не «магия», а базовый навык для любого, кто работает с SEO. Он помогает избежать путаницы, сохранить трафик и объединить позиции вместо того, чтобы распылять их между дублями. Главное — применять его к месту: для технических дублей и параметров сортировки canonical работает отлично, а вот для пагинации и страниц с самостоятельной ценностью для поиска подойдут другие инструменты — self-referencing canonical, noindex или отдельная стратегия индексации.

Столкнулся с проблемой дублей или каннибализации страниц? Оставляй заявку на бесплатный SEO-разбор — покажем ошибки на твоём сайте и расскажем, как их исправить.


🚀 Раскройте потенциал своего сайта! Бесплатный SEO-разбор от экспертов покажет, почему вы теряете клиентов из-за низкого трафика, выявит ошибки и точки роста — и подарит план оптимизации. Успейте получить разбор от Сегмент SEO!

Поделится:

Мы используем файлы cookie и аналогичные технологии для работы сайта, а также собираем обезличенные данные о посетителях с помощью сервиса Яндекс.Метрика.
Пользуясь сайтом, вы соглашаетесь с Политикой обработки персональных данных.
Принять
Политика конфиденциальности