Чистка семантического ядра
Чистка семантического ядра убирает мусор до того, как он станет страницей. Вставьте фразы, добавьте минус-слова и предел длины: каждая строка получит пометку и причину отсева.
- Бесплатно
- Без регистрации
- Результат таблицей
Работа инструмента 0 руб. Таблица открывается на этой же странице, файл xlsx скачивается после регистрации. Другие инструменты
| Что чинить | Кто чинит | |
|---|---|---|
| 1 | Слово пациентов повторяется на странице 18 раз, у соседей по выдаче реже | копирайтер |
| 2 | У 13 страниц одинаковый заголовок в поиске | сервис, работа за 1900 |
| 3 | 19 страниц с одинаковым содержимым | программист |
| 4 | 7 страниц без описания в поиске | сервис, работа за 1900 |
| 5 | У 13 страниц одинаковое описание в поиске | сервис, работа за 1900 |
Что в результате
- Четыре колонки. Фраза, решение, причина отсева, число слов. Отсеянное не исчезает, а остается в таблице рядом с причиной.
- Причина у каждой отсеянной строки. Видно, что именно сработало: ваше минус-слово, общий мусорный список, дубль по составу слов или предел длины.
- Дубли по составу слов. Купить диван угловой и угловой диван купить это одна фраза. Вторая уходит в отсев с пометкой про дубль.
- Ничего не уходит наружу. Счет идет на нашем железе, список никуда не отправляется. Поэтому бесплатно и без лимита раз в сутки.
Грязное семантическое ядро стоит дороже, чем кажется. Каждая мусорная фраза доживает до кластеризации, там становится группой, группа становится страницей, и кто-то пишет текст под запрос со словом торрент. Чистка вырезает это на входе, пока строка ничего не стоит.
Почему чистить надо до кластеризации
Этапы идут так: сбор ядра, чистка, частотность, группировка. Если поменять их местами, вы заплатите дважды. Сначала за съем частот по фразам, которые все равно выкинете. Потом за разбор групп, половина которых собралась вокруг мусора.
Есть и вторая причина, менее очевидная. Мусор искажает сами группы. Фразы вроде реферат про диваны или диваны своими руками тянут к себе соседей по словам, и кластеризация склеивает вокруг них то, что склеивать не надо. В продвижении это всплывает позже всего: страница уже написана, а seo-специалист ищет причину, почему она не идет.
Что отсекается
| Причина | Что под нее попадает |
| Ваше минус-слово | Чужие бренды, города, где вы не работаете, услуги, которых у вас нет |
| Общий мусорный список | скачать, бесплатно, торрент, вакансии, резюме, реферат, своими руками, фото, видео, википедия и похожие |
| Дубль по составу слов | Те же слова в другом порядке или в другой форме |
| Слишком длинная фраза | Все, что длиннее вашего предела в словах |
Мусорный набор один на все темы, и в редких случаях он бьет по своим. Слово фото лишнее в мебельной семантике и рабочее в семантике фотостудии. Поэтому нерелевантные строки не удаляются из таблицы: рядом написана причина, и вернуть нужный ключ можно за минуту.
Неявные дубли
Самая нудная часть чистки вручную это перестановки. Купить диван угловой, угловой диван купить, диваны угловые купить. Глазами такие пары ловятся плохо, особенно когда строк двадцать тысяч, и время на них уходит целыми вечерами.
Инструмент разбирает фразу на слова, отбрасывает окончания и получает набор основ. Порядок слов при этом не учитывается. Если у двух фраз наборы совпали, вторая помечается как дубль. Первая остается, поэтому есть смысл подавать фразы отсортированными по частоте: в отборе останется та формулировка, которую чаще набирают.
Длина фразы
Предел ставите вы сами, в словах. Смысл простой: чем длиннее хвост, тем ниже у него частота и тем меньше шансов, что под него кто-то напишет отдельную страницу. Проверить это можно тут же, прогнав спорные фразы через частотность и посмотрев точную колонку.
Единого правильного числа нет. В коммерческой семантике предел обычно жестче, в информационной мягче: там длинные вопросы это нормальный спрос. Темы разные, и подглядеть предел у конкурентов не выйдет.
Что делать с отсевом
Отсев стоит просмотреть один раз, а не удалять не глядя. Особенно строки с причиной про общий мусорный набор: там прячутся ваши рабочие ключи, если тема связана с фото, видео или обучением.
Дальше чистое ядро идет по обычному кругу. Считаем частотность, добираем недостающее через расширение семантики, разводим коммерцию и информацию и только потом раскладываем по страницам.
Чистка бесплатная и без ограничения по числу запусков: она считается у нас и никуда не ходит. Поэтому очистку ядра после каждого расширения семантики можно повторять столько раз, сколько нужно.
Кому подходит
- Выгрузка из Вордстата или другого сервиса, и половина строк явно лишняя
- Надо убрать чужие бренды и чужие города перед тем, как считать частотность
- В списке накопились перестановки одних и тех же слов
Когда не нужно
- Если фраз больше двадцати тысяч: режьте файл на части
- Если надо развести коммерцию и информацию: это другая задача и другой инструмент
- Если список уже чистый: гонять его через чистку смысла нет
Сколько это стоит
- Разбор и список дел за две-три минуты
- Без регистрации и без банковской карты
- Задание копирайтеру, 490 руб, docx за 5 минут
- Что показывать в поиске, 1 900 руб, xlsx за 20 минут
- Ссылки, которых не хватает, 1 900 руб, xlsx за 20 минут
- Семантика и структура, 3 900 руб, xlsx за 15 минут