Дубли страниц на сайте
Дайте адрес сайта, обойдем до трехсот страниц. В таблице: что не так, какое значение повторяется, на скольких URL встречается и на каких именно.
- Бесплатно
- Без регистрации
- Результат таблицей
Работа инструмента 0 руб. Таблица открывается на этой же странице, файл xlsx скачивается после регистрации. Другие инструменты
| Что чинить | Кто чинит | |
|---|---|---|
| 1 | Слово пациентов повторяется на странице 18 раз, у соседей по выдаче реже | копирайтер |
| 2 | У 13 страниц одинаковый заголовок в поиске | сервис, работа за 1900 |
| 3 | 19 страниц с одинаковым содержимым | программист |
| 4 | 7 страниц без описания в поиске | сервис, работа за 1900 |
| 5 | У 13 страниц одинаковое описание в поиске | сервис, работа за 1900 |
Что в отчете
- Четыре колонки. Что не так, значение, число страниц и адреса. Одна строка это одно повторение, а не одна страница.
- Пять проверок. Повтор title, повтор description, совпадение текста, страницы без h1 и страницы без описания.
- Адреса рядом со значением. Видно не абстрактную проблему, а конкретные страницы, которые спорят между собой. С этим списком можно сразу идти в админку.
- Обход до трехсот страниц. Начинаем с главной и идем по внутренним ссылкам. Закрытые от робота разделы в обход не попадают.
Дубли редко заводят нарочно. Их делает шаблон или настройка сервера: подставляет одно название на двух уровнях каталога, открывает один перечень товаров по десятку URL, оставляет описание пустым там, где его некому заполнить. Инструмент собирает такие страницы в одну таблицу и показывает, сколько их.
Четыре версии одного сайта
Самая частая причина дублей лежит не в текстах, а в настройках сервера. Один сайт открывается по четырем адресам сразу: http и https, с www и без. Для поисковой системы это четыре разных URL с одинаковым содержимым, то есть четыре копии каждой страницы.
Лечится это редиректом: три лишние версии отдают код 301 на основную, и поисковый робот сводит их в один адрес. Ту же природу имеет слеш на конце: /catalog и /catalog/ для сервера разные пути, и если оба отвечают кодом 200, получается еще пара копий. Выберите один вариант и настройте на него 301 с другого.
Отдельно стоит канонический адрес. Тег canonical в коде говорит
поиску, какую копию считать основной. Он мягче редиректа, потому что оставляет
страницу доступной человеку, но и слабее: это подсказка, а не команда. Массовые
технические копии лучше закрывать редиректом, а canonical оставить для фильтров
и сортировок.
Повторы title
Заголовок в коде страницы для поиска главная подсказка о том, чему страница посвящена. Когда подсказка у десяти страниц одна и та же, поиску приходится выбирать по остаткам: по ссылкам, по возрасту адреса, по случайным признакам.
Выбирает он обычно не ту страницу. Вы продвигаете категорию, а в выдаче стоит карточка товара из нее. Или наоборот. Трафик при этом размазывается по всей группе, и ни одна страница не набирает достаточно, чтобы подняться.
Массовый повтор почти всегда чинится в одном месте. Шаблон собирает заголовок из названия раздела, а название на двух уровнях совпадает. Добавьте в шаблон родительскую категорию, город или назначение, и строка из таблицы уйдет целиком.
Совпадающий текст: фильтры и сортировки
Совпадение почти всегда означает фильтры. Один перечень товаров открывается по цвету, по цене, по популярности, по размеру и с номером страницы на конце. Человек видит одно и то же, URL при этом разные.
Дальше поисковая система делает ровно то, чего вы не хотите: берет в индекс десяток почти неотличимых страниц и начинает выбирать между ними. Основная категория конкурирует сама с собой.
Решений два, и выбрать надо одно. Либо закрыть URL с параметрами от индексации, либо поставить на них canonical с указанием на основную категорию. Закрытие жестче и надежнее, но после него страница в выдачу не попадет никогда.
Пустой h1 и пустое описание
Страница без h1 обычно выглядит нормально: заголовок на месте, просто он сверстан картинкой или обычным блоком с крупным шрифтом. Человек разницы не видит, поиск не видит самого заголовка.
С описанием сложнее. Если description пустой, поиск соберет текст для выдачи сам, и на длинной статье получится терпимо. На карточке товара и на категории собирать бывает не из чего, и в сниппет попадает кусок меню.
| Что нашли | Обычная причина | Что делать |
| Повтор title | Шаблон собирает заголовок из одного поля | Добавить в шаблон уточнение: родителя, город, назначение |
| Повтор description | Описание задано на весь раздел разом | Собирать из полей страницы или оставить пустым, это честнее копии |
| Совпадение текста | Фильтры, сортировки, пагинация | Закрыть от индексации или свести canonical на основную |
| Нет h1 | Заголовок сверстан картинкой или обычным блоком | Поставить настоящий h1, один на страницу |
| Нет description | Шаблон не заполняет поле | Заполнить там, где текста мало: на карточках и категориях |
Сортировка по числу страниц показывает, с чего начинать. Строка на сорок URL это одна правка в шаблоне. Строка на две страницы подождет: там ручная правка, и она погоды не делает.
Массовые технические копии видно и со стороны поиска. В Search Console такие адреса уходят в отчет об индексировании с пометкой про канонический адрес, выбранный поиском, а не вами. Если пометка встречается часто, дело почти всегда в четырех версиях сайта или в параметрах фильтра.
Что проверить следом
Когда заголовки разведены, стоит посмотреть, из чего они собираются: про шаблоны и длину написано на странице про мета-теги. Если выяснилось, что разные страницы заточены под один и тот же запрос, проблема глубже, и начинать надо с разбивки запросов по страницам: пока две страницы делят один запрос, переписывание заголовков ничего не даст.
Пустые категории дают дубли сами по себе: две страницы без товаров похожи между собой сильнее, чем две наполненные. Такие адреса ищет проверка наполненности категорий. А если совпадает текст, посмотрите разбор текста: часто выясняется, что на обеих страницах текста почти нет, и сравнивать поиску просто нечего.
Кому подходит
- Поиск показывает по запросу не ту страницу, которую вы продвигаете
- В каталоге есть фильтры и сортировки, и никто не проверял, что из этого попало в индекс
- Страницы делали разные люди в разное время, и единого шаблона мета-тегов нет
Когда не нужно
- Если страниц больше трехсот: обход остановится на этом числе
- Если нужно найти чужие сайты, которые скопировали ваш текст
- Если сайт открывается только после входа в личный кабинет
Сколько это стоит
- Разбор и список дел за две-три минуты
- Без регистрации и без банковской карты
- Задание копирайтеру, 490 руб, docx за 5 минут
- Что показывать в поиске, 1 900 руб, xlsx за 20 минут
- Ссылки, которых не хватает, 1 900 руб, xlsx за 20 минут
- Семантика и структура, 3 900 руб, xlsx за 15 минут