После парсинга семантики специалисты часто получают файл на 5000-15000 строк, из которых реально нужны 10-20%. Остальное - мусор, который съест бюджет без пользы. Ручная чистка такого объёма занимает дни. В этой статье - системный подход к фильтрации, который ускоряет процесс в разы.
Что считается мусором в семантическом ядре
Мусорные запросы - это ключевые слова, по которым ваша реклама либо нецелевая, либо изначально не может принести конверсию. Чистка - не про вкус, а про конкретные критерии.
Основные категории мусора:
Информационный мусор - запросы, где пользователь ищет информацию, а не продукт. «Как сделать кухню своими руками», «что такое CRM», «история компании Nike». Такие запросы могут быть полезны для SEO-контента, но не для платной рекламы с оплатой за клик.
Навигационный мусор - поиск конкретного сайта или бренда. «Wildberries личный кабинет», «Сбербанк онлайн войти», «официальный сайт Росреестра». Пользователь точно знает, куда идёт, чужая реклама его не интересует.
Нерелевантные омонимы - слова с несколькими значениями. Если продаёшь программу для складского учёта, запрос «программа» ловит тех, кто ищет программы телепередач, концертов, учебных курсов.
Запросы со стоп-словами - «бесплатно», «скачать», «торрент», «своими руками», «дипломная работа», «реферат», «вакансии», «отзывы сотрудников».
Детская и учебная аудитория - «для школьников», «реферат», «доклад», «для детей», «проект».
Запросы других регионов - если работаете только по Москве и Московской области, запросы с Казанью, Новосибирском и другими городами - мусор. При геотаргетинге они всё равно будут попадать в выдачу через геонезависимые формулировки.
Система фильтрации: от грубой к тонкой
Чистка семантики строится по принципу воронки - сначала отсекаем явный мусор автоматически, затем разбираем пограничные случаи вручную.
Этап 1: Автоматическая фильтрация по стоп-словам
Собери список универсальных стоп-слов заранее. Вот базовый набор для большинства коммерческих ниш:
Информационные: как, зачем, почему, что такое, определение, значение, история, возникновение Бесплатное: бесплатно, даром, без оплаты, free, freeware Скачивание: скачать, скачивание, download, торрент, crack, ключ активации DIY: своими руками, самостоятельно, сам, самому Учёба: реферат, дипломная, курсовая, доклад, сочинение, презентация Работа: вакансии, работа в [компании], зарплата, трудоустройство Навигация: войти, вход, личный кабинет, авторизация, официальный сайт, контакты
В Key Collector это делается через «Сбор данных → Удалить по стоп-словам». В Excel - через фильтр или ПОИСКПОЗ по отдельному словарю стоп-слов.
После этого шага типично отсеивается 30-50% от общего числа ключей.
Этап 2: Фильтрация по частотности
Запросы с частотой ниже порогового значения стоит убрать или обработать отдельно. Пороги зависят от ниши:
| Ниша | Минимальная частота | Причина |
|---|---|---|
| Услуги B2B | 20-30/мес | Слишком мало показов для оптимизации |
| Интернет-магазин | 5-10/мес | Можно брать в динамические группы |
| Узкоспецифичные товары | 3-5/мес | Брать точным соответствием |
| Гео + товар (небольшой город) | 10/мес | Объединять в широкие группы |
Запросы с нулевой или очень низкой частотой не означают, что их нет совсем - Wordstat показывает данные за месяц, реальный спрос за год может быть выше. Но если частота ноль даже в точном соответствии («!купить!»), ключ бесполезен.
Этап 3: Ручная кластеризация и отбор «серых» запросов
Запросы, прошедшие автофильтр, но вызывающие вопросы, разбираются вручную. Критерий один: «Человек с этим запросом - потенциальный покупатель прямо сейчас?»
Примеры пограничных случаев: - «кухня фото» - скорее нет (вдохновение), но для мебельного - можно проверить - «CRM система отзывы» - да, это коммерческий запрос (выбирает между вариантами) - «как выбрать кухонный гарнитур» - зависит от того, есть ли на сайте соответствующий контент
Практические инструменты для чистки
Key Collector
Наиболее распространённый инструмент среди специалистов. Функции для чистки: - «Анализ групп» - определяет тип запроса (коммерческий/информационный) по хорошо/плохо страницам - «Удалить неявные дубликаты» - убирает фактически одинаковые запросы с разным порядком слов - «Пометить по стоп-словам» - не удаляет, а помечает, что удобно для проверки
Excel/Google Таблицы
Для работы с выгрузками из Директа или Wordstat: - Фильтр по столбцу с частотой - убираешь нули - ПОИСКПОЗ + список стоп-слов в отдельном листе - помечаешь строки - Сводная таблица по первому слову - видишь структуру ядра
Яндекс Метрика (для работающих кампаний)
Если кампания уже работает - это лучший источник правды. Запросы с высоким показателем отказов (>60%) и нулевой конверсией за 3+ месяца - мусор с высокой вероятностью. Отчёт: Директ → Поисковые запросы → добавь столбцы «Конверсии», «Отказы», «Время на сайте».
Частые ошибки при чистке семантики
Ошибка 1: Удалять всё с частотой ниже 100 Это уничтожит весь длинный хвост. Лучше собирать НЧ-запросы в отдельные группы и анализировать реальную конверсию.
Ошибка 2: Не проверять омонимы «Замок» - это дверной замок или дворец? «Кисть» - малярная или художественная? «Вал» - деталь механизма или земляная насыпь? Без ручной проверки контекстуальных омонимов реклама будет показываться не той аудитории.
Ошибка 3: Чистить один раз «навсегда» Семантическое ядро - живой организм. Новые запросы появляются постоянно, старые теряют актуальность. Минимум - ревизия раз в квартал на основе данных Метрики.
Ошибка 4: Удалять вместо «отложить» Запрос «как выбрать кухню» сейчас нецелевой для рекламы, но может стать основой для SEO-статьи, которая будет приводить органику. Не удаляй - помечай категорией и сохраняй.
Ошибка 5: Чистить семантику без понимания воронки Запрос «сравнение CRM систем» - это информационный или коммерческий? Для компании, продающей CRM, это тёплый коммерческий запрос, несмотря на информационную форму. Нужно понимать, как работает воронка в конкретной нише.
Работа с минус-словами как инструмент онлайн-чистки
Чистка ядра до запуска - только первый уровень фильтрации. После запуска нужна система работы с поисковыми запросами в реальном времени.
Настрой еженедельный просмотр реальных поисковых запросов в Яндекс Директе (раздел «Мастер отчётов» или «Поисковые запросы»). Всё нецелевое - в минус-слова на уровне кампании или группы объявлений.
Сервисы автоматического аудита минус-слов, такие как ВАудитор, анализируют поисковые запросы за 90 дней и выдают готовый список минус-слов с обоснованием. Это удобно, когда кампаний много и проводить ручной аудит каждой нет времени.
Заключение
Системная чистка семантики - это не разовая процедура, а процесс с несколькими уровнями:
- Автофильтрация по стоп-словам (убирает 30-50% сразу)
- Фильтрация по минимальной частотности (убирает нерабочие длиннохвостовые)
- Ручная проверка омонимов и пограничных случаев
- Регулярный аудит поисковых запросов в работающих кампаниях
Не гонись за большим ядром. Чистое ядро из 500 релевантных ключей работает лучше, чем захламлённое из 5000.