После парсинга семантики специалисты часто получают файл на 5000-15000 строк, из которых реально нужны 10-20%. Остальное - мусор, который съест бюджет без пользы. Ручная чистка такого объёма занимает дни. В этой статье - системный подход к фильтрации, который ускоряет процесс в разы.


Что считается мусором в семантическом ядре

Мусорные запросы - это ключевые слова, по которым ваша реклама либо нецелевая, либо изначально не может принести конверсию. Чистка - не про вкус, а про конкретные критерии.

Основные категории мусора:

Информационный мусор - запросы, где пользователь ищет информацию, а не продукт. «Как сделать кухню своими руками», «что такое CRM», «история компании Nike». Такие запросы могут быть полезны для SEO-контента, но не для платной рекламы с оплатой за клик.

Навигационный мусор - поиск конкретного сайта или бренда. «Wildberries личный кабинет», «Сбербанк онлайн войти», «официальный сайт Росреестра». Пользователь точно знает, куда идёт, чужая реклама его не интересует.

Нерелевантные омонимы - слова с несколькими значениями. Если продаёшь программу для складского учёта, запрос «программа» ловит тех, кто ищет программы телепередач, концертов, учебных курсов.

Запросы со стоп-словами - «бесплатно», «скачать», «торрент», «своими руками», «дипломная работа», «реферат», «вакансии», «отзывы сотрудников».

Детская и учебная аудитория - «для школьников», «реферат», «доклад», «для детей», «проект».

Запросы других регионов - если работаете только по Москве и Московской области, запросы с Казанью, Новосибирском и другими городами - мусор. При геотаргетинге они всё равно будут попадать в выдачу через геонезависимые формулировки.


Система фильтрации: от грубой к тонкой

Чистка семантики строится по принципу воронки - сначала отсекаем явный мусор автоматически, затем разбираем пограничные случаи вручную.

Этап 1: Автоматическая фильтрация по стоп-словам

Собери список универсальных стоп-слов заранее. Вот базовый набор для большинства коммерческих ниш:

Информационные: как, зачем, почему, что такое, определение, значение, история, возникновение Бесплатное: бесплатно, даром, без оплаты, free, freeware Скачивание: скачать, скачивание, download, торрент, crack, ключ активации DIY: своими руками, самостоятельно, сам, самому Учёба: реферат, дипломная, курсовая, доклад, сочинение, презентация Работа: вакансии, работа в [компании], зарплата, трудоустройство Навигация: войти, вход, личный кабинет, авторизация, официальный сайт, контакты

В Key Collector это делается через «Сбор данных → Удалить по стоп-словам». В Excel - через фильтр или ПОИСКПОЗ по отдельному словарю стоп-слов.

После этого шага типично отсеивается 30-50% от общего числа ключей.

Этап 2: Фильтрация по частотности

Запросы с частотой ниже порогового значения стоит убрать или обработать отдельно. Пороги зависят от ниши:

Ниша Минимальная частота Причина
Услуги B2B 20-30/мес Слишком мало показов для оптимизации
Интернет-магазин 5-10/мес Можно брать в динамические группы
Узкоспецифичные товары 3-5/мес Брать точным соответствием
Гео + товар (небольшой город) 10/мес Объединять в широкие группы

Запросы с нулевой или очень низкой частотой не означают, что их нет совсем - Wordstat показывает данные за месяц, реальный спрос за год может быть выше. Но если частота ноль даже в точном соответствии («!купить!»), ключ бесполезен.

Этап 3: Ручная кластеризация и отбор «серых» запросов

Запросы, прошедшие автофильтр, но вызывающие вопросы, разбираются вручную. Критерий один: «Человек с этим запросом - потенциальный покупатель прямо сейчас?»

Примеры пограничных случаев: - «кухня фото» - скорее нет (вдохновение), но для мебельного - можно проверить - «CRM система отзывы» - да, это коммерческий запрос (выбирает между вариантами) - «как выбрать кухонный гарнитур» - зависит от того, есть ли на сайте соответствующий контент


Практические инструменты для чистки

Key Collector

Наиболее распространённый инструмент среди специалистов. Функции для чистки: - «Анализ групп» - определяет тип запроса (коммерческий/информационный) по хорошо/плохо страницам - «Удалить неявные дубликаты» - убирает фактически одинаковые запросы с разным порядком слов - «Пометить по стоп-словам» - не удаляет, а помечает, что удобно для проверки

Excel/Google Таблицы

Для работы с выгрузками из Директа или Wordstat: - Фильтр по столбцу с частотой - убираешь нули - ПОИСКПОЗ + список стоп-слов в отдельном листе - помечаешь строки - Сводная таблица по первому слову - видишь структуру ядра

Яндекс Метрика (для работающих кампаний)

Если кампания уже работает - это лучший источник правды. Запросы с высоким показателем отказов (>60%) и нулевой конверсией за 3+ месяца - мусор с высокой вероятностью. Отчёт: Директ → Поисковые запросы → добавь столбцы «Конверсии», «Отказы», «Время на сайте».


Частые ошибки при чистке семантики

Ошибка 1: Удалять всё с частотой ниже 100 Это уничтожит весь длинный хвост. Лучше собирать НЧ-запросы в отдельные группы и анализировать реальную конверсию.

Ошибка 2: Не проверять омонимы «Замок» - это дверной замок или дворец? «Кисть» - малярная или художественная? «Вал» - деталь механизма или земляная насыпь? Без ручной проверки контекстуальных омонимов реклама будет показываться не той аудитории.

Ошибка 3: Чистить один раз «навсегда» Семантическое ядро - живой организм. Новые запросы появляются постоянно, старые теряют актуальность. Минимум - ревизия раз в квартал на основе данных Метрики.

Ошибка 4: Удалять вместо «отложить» Запрос «как выбрать кухню» сейчас нецелевой для рекламы, но может стать основой для SEO-статьи, которая будет приводить органику. Не удаляй - помечай категорией и сохраняй.

Ошибка 5: Чистить семантику без понимания воронки Запрос «сравнение CRM систем» - это информационный или коммерческий? Для компании, продающей CRM, это тёплый коммерческий запрос, несмотря на информационную форму. Нужно понимать, как работает воронка в конкретной нише.


Работа с минус-словами как инструмент онлайн-чистки

Чистка ядра до запуска - только первый уровень фильтрации. После запуска нужна система работы с поисковыми запросами в реальном времени.

Настрой еженедельный просмотр реальных поисковых запросов в Яндекс Директе (раздел «Мастер отчётов» или «Поисковые запросы»). Всё нецелевое - в минус-слова на уровне кампании или группы объявлений.

Сервисы автоматического аудита минус-слов, такие как ВАудитор, анализируют поисковые запросы за 90 дней и выдают готовый список минус-слов с обоснованием. Это удобно, когда кампаний много и проводить ручной аудит каждой нет времени.


Заключение

Системная чистка семантики - это не разовая процедура, а процесс с несколькими уровнями:

  1. Автофильтрация по стоп-словам (убирает 30-50% сразу)
  2. Фильтрация по минимальной частотности (убирает нерабочие длиннохвостовые)
  3. Ручная проверка омонимов и пограничных случаев
  4. Регулярный аудит поисковых запросов в работающих кампаниях

Не гонись за большим ядром. Чистое ядро из 500 релевантных ключей работает лучше, чем захламлённое из 5000.