Чистка семантического ядра
SEO-оптимизация — интересный и полезный процесс. Вы собрали кучу запросов, по которым люди ищут ваши товары или услуги. Но среди них — тонны дублей, нерелевантной ерунды, запросов с непонятными символами и просто пустых строк. Теперь вы отсеиваете все лишнее, чтобы оставить только то, что работает.
Поспешишь — запросы потеряешь: как чистить, чтобы не навредить
Чистка семантического ядра это не аврал, когда вы садитесь и до посинения вычищаете список. Так вы только устанете и обязательно выкинете что-то нужное. Подходите к этому как к многослойной работе — проходимся по списку несколько раз, на каждом шаге отсекая что-то свое.
Вообще, чистку ядра от мусора стоит проводить в разные моменты, под свои текущие задачи:
- Когда собираем минус-слова. Заранее определяем маркеры, которые гарантированно говорят, что этот запрос не про вас. Например, если мы продаем платные услуги, все запросы со словом «бесплатно» летят в корзину. Если мы работаем только в одном городе — вычеркиваем все упоминания других.
- После получения данных по частотности. Смотрим, сколько человек в месяц вбивает эту фразу в поиск. Если запрос не дотягивает до установленного нами минимума, мы его без сожаления удаляем. Зачем тратить силы на то, что почти никто не ищет?
- До того, как группировать запросы по смыслу. Вариант быстрой чистки семантического ядра, если данных так много, что в них легко утонуть. Проходимся и убираем самое очевидное, чтобы сократить объем для дальнейшей работы. Никакого глубокого анализа, тупо вырезаем все, что не вызывает сомнений.
- После того, как разбили запросы по группам. Вот это уже тонкая работа. Мы видим целостную картину по каждой теме и можно точечно убирать лишнее внутри каждой группы, не боясь задеть нужное. Это и удобнее, и безопаснее, потому что вы точно понимаете, что оставляете, а что удаляете.
Не пытайтесь почистить семантику за один присест. Действуйте в несколько заходов. Сначала выкидываете откровенный мусор. Потом отсеиваете то, что не набирает нужную частоту. И уже после группировки проводите финальную проверку. Так вы точно не потеряете ни одного ценного ключа.
Чистка семантического ядра никогда не завершается. К примеру, начинаем писать текст по готовому кластеру, глубже вникаем в тему и вдруг видим, что тут открываются новые запросы, о которых мы даже не подозревали, когда собирали ядро. Особенно часто это случается в сложных специализированных темах — автоматические парсеры просто не добирают глубину.
Реальные запросы живых людей лежат ниже, и мы добираем эти фразы прямо в процессе создания ТЗ. Это нормальная практика, говорящая о том, что вы не просто механически накидали ключи, а действительно разбираетесь в теме.
Что удаляем сразу и без сомнений
Есть типы фраз, которые вылетают на первом же заходе чистки ядра от мусора — тут не важно, чем вы торгуете, каков у вас бюджет и в каком настроении вы сегодня работаете.
Непрямые дубли
Самый коварный вид мусора. Фразы, которые выглядят по-разному, но говорят об одном и том же и не меняются от перестановки слов. К примеру, «уборка квартиры цена» и «цена уборки квартиры». Но иногда порядок слов решает все. Сравните: «билеты Краснодар Владивосток» и «билеты Владивосток Краснодар». Если склеить такие запросы в одну группу и продвигать на них одну страницу, половина пользователей просто уйдет, потому что им покажут не то направление.
Бывают и варианты с разными формами. «Генеральная уборка офиса» и «генеральная уборка офисного помещения» по сути одно и то же. Тут смотрят на частотность, какой запрос люди вбивают чаще, тот и оставляют.
Запросы мимо кассы
Тут вступают в дело минус-слова — фильтр, отсеивающий все, что не относится к делу. Пример: собираете запросы по уборке квартир, а Вордстат подкидывает «уборка квартир после затопления». Если вы работаете только с обычной бытовой уборкой и не занимаетесь устранением последствий потопов, слово «затопление» становится минусом. Все фразы с ним — в корзину.
Что еще в таком случае отправляют в минус:
- Названия чужих компаний — зачем вам приводить трафик к конкурентам?
- Географические привязки к городам, где у вас нет филиалов.
- Орфографические ошибки вроде «уборка кватрир». Даже если поисковик их понимает, загружать ядро откровенным браком не стоит.
Не то намерение
Бывает, что человек печатает одно, а на самом деле ему нужно совсем другое. Допустим, у вас сайт строительной компании, вы продаете услуги по возведению домов под ключ. А в собранное ядро попали запросы вроде «как правильно залить фундамент» или «какой утеплитель лучше для стен».
Если человек хочет изучить вопрос, а не заказывать строительство, а вы на такой запрос покажете страницу с ценами на домокомплекты, он закроет вкладку и уйдет к конкурентам. Подобные фразы отдают на сопутствующий проект (например, в корпоративный блог), чтобы написать полезную статью и заодно ненавязчиво упомянуть свои услуги, или вычеркивают.
Как понять, коммерческий перед вами запрос или информационный? Вбейте его в поиск и посмотрите, из чего состоит выдача.
Бесперспективные запросы
Есть фразы, по которым вы никогда не выстрелите в топ, сколько сил ни вложите. Например, по запросу «уборка квартир в Москве» вся первая страница забита гигантами-агрегаторами и крупными сетями клининга с многомиллионными бюджетами на рекламу. Продвинуться там без серьезных вложений нереально.
Имеет смысл честно оценить свои силы и почистить семантику, вычеркнув такие запросы и не тратя время на заведомо проигрышную битву.
Технический хлам
Точкам, вопросительным и восклицательным знакам, кавычкам скобкам не место в списке запросов. Представьте, что вы открываете меню, а там написано: «Строительство!!! домов?? из бруса». Выглядит как минимум странно. Пустые строки тоже удаляем без обсуждения, ядро должно быть чистым.
Чистка ядра под вашу задачу
Тут уже все упирается в систему, которую выбрали для продвижения. Одни приемы подходят всем, другие — только тем, кто играет по определенным правилам.
Нулевая частотность
На каждом углу твердят: «Нулевая частота? Сразу в корзину, они бесполезны». И большинство послушно вычищает такие фразы без раздумий. Но если посмотреть внимательнее, оказывается, что толпа в очередной раз ошибается.
Нулевиками называют запросы, которые по данным сервисов никто не ищет. Звучит как приговор, но на деле это скрытый ресурс, который почти никто не использует. Конкуренты пробегают глазами по списку, видят ноль, фыркают и удаляют. А вы остаетесь и занимаете то место, которое никто не захотел занимать. Дальше — больше. По таким запросам почти нет контента. Если вы создадите материал, который закрывает этот узкий вопрос, вы будете единственным, кто дает ответ. Никакой конкуренции, просто потому что вы там единственный.
Данные сервисов — не истина в последней инстанции, а приблизительные оценки, собранные с погрешностью. То, что вам показывают ноль, не означает, что запросов в реале нет.
Выбираем по количеству
Другой подход — когда сознательно решают работать только с низко- или среднечастотными запросами. Это классическая стратегия для тех, кто не хочет ввязываться в драку за высокочастотные позиции, на которых сидят монстры с бюджетами под миллион. В этом случае просто берут и отсекают все лишнее по числовому коридору. Допустим, поставили планку от 20 до 200 показов в месяц — все, что ниже или выше, улетает без обсуждения.
Автоматизируем чистку — три сервиса, которые спасут ваше время
Технически можно обойтись экселем. У профи есть свои наработки, макросы, хитрые формулы, автозамены... Но, честно говоря, это долго и муторно, легко ошибиться или что-то пропустить. Разумнее взять готовые решения, которые сделают черновую работу за вас.
PromoPult
В PromoPult есть модель под названием Нормализатор слов, она пройдется по списку запросов и наведет идеальный порядок:
- Вычищает дубли в точном совпадении и с перестановкой слов.
- Срезает спецсимволы с краев фраз
- Удаляет лишние пробелы и пустые строки. Мелочь, но глаз радует.
- Чистит табуляцию, которая часто прилетает при копировании из таблиц.
- Приводит все к одному регистру и заменяет «е» на «е». Поисковикам все равно, но единообразие удобнее.

Сервис бесплатный и работает в браузере. Готовый результат скачивается в XLSX, а все задачи сохраняются в аккаунте.
Topvisor
Topvisor тоже специализируется на том, что находит запросы-двойники. И алгоритмы там довольно изощренные.Сначала работает стемминг — слова обрубают до корневой основы. Чтобы «установщик», «установка» и «монтировать» превратились в однородную массу, которую можно сравнить. Но инструмент грубоват, иногда склеивает то, что лучше не склеивать, поэтому следом подключаются эвристики — алгоритмы-уточнители. Они смотрят на реальное поведение пользователей, контекст и синонимы, решая, действительно ли запросы одинаковые или все-таки разные. В настройках можно назначить игнор порядка слов или стоп-ключей.

Если несколько фраз признаны неявными дублями, система оставляет первую по списку, остальные отправляет в архив.
Rush-Analytics
Удобный сервис для чистки семантического ядра по гео. Достаточно выбрать свой целевой город, и система автоматически вырезает все запросы с упоминанием любых других населенных пунктов. Плюс у них есть заготовленные списки мусорных слов по разным тематикам. Хотите отсеять все, где есть «бесплатно»? Пожалуйста. «Отзывы»? Легко. «Фото» или «картинки»? В один клик. Для редких ниш предусмотрели гибкость: можно загрузить свой стоп-список и использовать его при сборе подсказок в Вордстате и при кластеризации. Загрузили один раз, и больше не надо постоянно копировать одно и то же.

Вот так постепенно мы превращаем массив собранных запросов в стройное, чистое и рабочее семантическое ядро. Это кропотливый процесс, но без него невозможно качественное продвижение. Надеемся, наш опыт поможет вам навести порядок в своей семантике и добиться достойных результатов.