Seohand

Чистка семантического ядра

Чистка семантического ядра убирает мусор до того, как он станет страницей. Вставьте фразы, добавьте минус-слова и предел длины: каждая строка получит пометку и причину отсева.

До двадцати тысяч фраз. Считается у нас, наружу не ходит, денег не стоит. Без учетной записи: 5 запусков этого инструмента в сутки и 12 запусков на все инструменты вместе.

  • Бесплатно
  • Без регистрации
  • Результат таблицей

Работа инструмента 0 руб. Таблица открывается на этой же странице, файл xlsx скачивается после регистрации. Другие инструменты

разбор ogneva.ru от 15.09.2026 Разбор сайта, бесплатно
Что чинитьКто чинит
1 Слово пациентов повторяется на странице 18 раз, у соседей по выдаче реже копирайтер
2 У 13 страниц одинаковый заголовок в поиске сервис, работа за 1900
3 19 страниц с одинаковым содержимым программист
4 7 страниц без описания в поиске сервис, работа за 1900
5 У 13 страниц одинаковое описание в поиске сервис, работа за 1900
Что чинить 5 строк Запросы без страниц Как читать
Обошли 128 страниц, посчитали 71 запрос, из них закрыто страницами 39 лист листается вбок
Строки настоящие. Это работа, которую сервис собрал по сайту ogneva.ru 15 сентября. Разбор того же сайта открыт целиком.

Что в результате

  • Четыре колонки. Фраза, решение, причина отсева, число слов. Отсеянное не исчезает, а остается в таблице рядом с причиной.
  • Причина у каждой отсеянной строки. Видно, что именно сработало: ваше минус-слово, общий мусорный список, дубль по составу слов или предел длины.
  • Дубли по составу слов. Купить диван угловой и угловой диван купить это одна фраза. Вторая уходит в отсев с пометкой про дубль.
  • Ничего не уходит наружу. Счет идет на нашем железе, список никуда не отправляется. Поэтому бесплатно и без лимита раз в сутки.

Грязное семантическое ядро стоит дороже, чем кажется. Каждая мусорная фраза доживает до кластеризации, там становится группой, группа становится страницей, и кто-то пишет текст под запрос со словом торрент. Чистка вырезает это на входе, пока строка ничего не стоит.

Почему чистить надо до кластеризации

Этапы идут так: сбор ядра, чистка, частотность, группировка. Если поменять их местами, вы заплатите дважды. Сначала за съем частот по фразам, которые все равно выкинете. Потом за разбор групп, половина которых собралась вокруг мусора.

Есть и вторая причина, менее очевидная. Мусор искажает сами группы. Фразы вроде реферат про диваны или диваны своими руками тянут к себе соседей по словам, и кластеризация склеивает вокруг них то, что склеивать не надо. В продвижении это всплывает позже всего: страница уже написана, а seo-специалист ищет причину, почему она не идет.

Что отсекается

ПричинаЧто под нее попадает
Ваше минус-словоЧужие бренды, города, где вы не работаете, услуги, которых у вас нет
Общий мусорный списокскачать, бесплатно, торрент, вакансии, резюме, реферат, своими руками, фото, видео, википедия и похожие
Дубль по составу словТе же слова в другом порядке или в другой форме
Слишком длинная фразаВсе, что длиннее вашего предела в словах

Мусорный набор один на все темы, и в редких случаях он бьет по своим. Слово фото лишнее в мебельной семантике и рабочее в семантике фотостудии. Поэтому нерелевантные строки не удаляются из таблицы: рядом написана причина, и вернуть нужный ключ можно за минуту.

Неявные дубли

Самая нудная часть чистки вручную это перестановки. Купить диван угловой, угловой диван купить, диваны угловые купить. Глазами такие пары ловятся плохо, особенно когда строк двадцать тысяч, и время на них уходит целыми вечерами.

Инструмент разбирает фразу на слова, отбрасывает окончания и получает набор основ. Порядок слов при этом не учитывается. Если у двух фраз наборы совпали, вторая помечается как дубль. Первая остается, поэтому есть смысл подавать фразы отсортированными по частоте: в отборе останется та формулировка, которую чаще набирают.

Длина фразы

Предел ставите вы сами, в словах. Смысл простой: чем длиннее хвост, тем ниже у него частота и тем меньше шансов, что под него кто-то напишет отдельную страницу. Проверить это можно тут же, прогнав спорные фразы через частотность и посмотрев точную колонку.

Единого правильного числа нет. В коммерческой семантике предел обычно жестче, в информационной мягче: там длинные вопросы это нормальный спрос. Темы разные, и подглядеть предел у конкурентов не выйдет.

Что делать с отсевом

Отсев стоит просмотреть один раз, а не удалять не глядя. Особенно строки с причиной про общий мусорный набор: там прячутся ваши рабочие ключи, если тема связана с фото, видео или обучением.

Дальше чистое ядро идет по обычному кругу. Считаем частотность, добираем недостающее через расширение семантики, разводим коммерцию и информацию и только потом раскладываем по страницам.

Чистка бесплатная и без ограничения по числу запусков: она считается у нас и никуда не ходит. Поэтому очистку ядра после каждого расширения семантики можно повторять столько раз, сколько нужно.

Кому подходит

  • Выгрузка из Вордстата или другого сервиса, и половина строк явно лишняя
  • Надо убрать чужие бренды и чужие города перед тем, как считать частотность
  • В списке накопились перестановки одних и тех же слов

Когда не нужно

  • Если фраз больше двадцати тысяч: режьте файл на части
  • Если надо развести коммерцию и информацию: это другая задача и другой инструмент
  • Если список уже чистый: гонять его через чистку смысла нет

Сколько это стоит

0 руб
  • Разбор и список дел за две-три минуты
  • Без регистрации и без банковской карты
За что платят
  • Задание копирайтеру, 490 руб, docx за 5 минут
  • Что показывать в поиске, 1 900 руб, xlsx за 20 минут
  • Ссылки, которых не хватает, 1 900 руб, xlsx за 20 минут
  • Семантика и структура, 3 900 руб, xlsx за 15 минут

Частые вопросы

Что входит в общий мусорный список?
Слова, которые лишние почти в любой теме: скачать, бесплатно, торрент, вакансии, резюме, реферат, своими руками, фото, видео, википедия и похожие на них. Список общий, и в редких темах он может задеть нужное: фотостудии слово фото выкидывать нельзя. Поэтому отсеянные строки остаются в таблице с причиной, и такие случаи видно сразу.
Как ловятся неявные дубли?
Каждая фраза разбирается на слова, у слов отбрасываются окончания, порядок не учитывается. Получается набор основ. Если у двух фраз наборы совпали, вторая помечается как дубль. Так купить диван угловой и угловой диван купить сходятся в одну строку.
Зачем ограничивать длину фразы?
Длинные хвосты чаще всего дают единичную частоту, а места в работе занимают столько же, сколько нормальные запросы. Каждый такой хвост тянет за собой группу, а группа означает страницу, которую кто-то потом будет писать.
Сколько фраз можно прислать за раз?
До двадцати тысяч. Если файл больше, разрежьте его: минус-слова и предел длины для второй части можно задать те же.
Это платно?
Нет. Чистка считается у нас и никуда не ходит, поэтому денег не стоит и лимитов по числу запусков не имеет.

По теме

Частотность запросов Частотность запросов по Яндекс Вордстату: вставьте список фраз и получите широкую, фразовую и точную частоту по выбранному региону плюс долю точной от широкой. Кластеризация запросов Кластеризация запросов онлайн: вставьте список фраз и получите группы. В каждой главная фраза и все, что поиск считает тем же самым. Без регистрации, выгрузка в xlsx. Коммерческие и информационные запросы Коммерческие и информационные запросы разводим по живой выдаче: смотрим первую десятку Яндекса по каждой фразе и считаем, чего в ней больше, магазинов или статей. Проверка мета-тегов страниц Проверка мета-тегов покажет, где title и description дублируются, где их нет и где длина выходит за рабочий ориентир. По каждой странице отдаем готовые значения. Распределение запросов по страницам Распределение запросов по страницам сайта: загрузите список и адрес, получите пары запрос и url, спорные места и запросы, под которые страниц пока нет. Разовая проверка позиций Проверка позиций сайта по списку запросов в Яндексе: один срез на сегодня, глубина сто мест. Историю по дням дает наблюдение за позициями в кабинете.