KeyCollector - стандарт де-факто для сборки семантики в Рунете. Программа платная, работает только на Windows, требует настройки перед первым запуском. Но если вы регулярно ведёте контекстную рекламу, она окупится за первый же крупный проект. Разберём, как настроить, как использовать и как не утонуть в процессе сбора.
Почему KeyCollector, а не браузерный Вордстат
Вордстат в браузере - инструмент для быстрой проверки одного-двух запросов. Для серьёзной семантики он не подходит: вы не можете автоматически собрать все подсказки, не можете фильтровать данные, не можете работать параллельно по множеству запросов.
KeyCollector решает эти проблемы:
- парсит Вордстат в автоматическом режиме, без ручного листания
- собирает поисковые подсказки (подсказки Google и Яндекса - отдельный пласт семантики)
- определяет частоты для любого списка запросов
- кластеризует запросы по группам
- позволяет работать с несколькими аккаунтами Яндекса для обхода лимитов
Цена программы - разовая покупка лицензии. На момент написания статьи - около 1800 рублей. Обновления платные отдельно, но программа работает и без них.
Первичная настройка KeyCollector
Аккаунты Яндекса
KeyCollector парсит Вордстат от имени аккаунтов Яндекса. Один аккаунт имеет суточный лимит на количество запросов. Для нормальной работы нужно минимум 3-5 аккаунтов - тогда можно парсить без перерывов.
Важно: использование чужих аккаунтов без разрешения нарушает правила Яндекса. Заводите отдельные аккаунты специально для парсинга. Не используйте рабочий аккаунт от Директа.
Настройка: Настройки - Аккаунты Яндекс/Google - добавляете логины и пароли. Программа проверит доступность.
Прокси (опционально, но рекомендуется)
При интенсивном парсинге Яндекс может начать требовать капчу чаще обычного. Прокси помогают распределить запросы между разными IP.
Для небольших проектов (до 5000 запросов) можно работать без прокси. Для крупных - лучше настроить хотя бы недорогие мобильные прокси.
Настройка задержек
В настройках парсинга выставьте случайные задержки между запросами. Это снижает вероятность блокировки и имитирует человеческое поведение. Рекомендуемые параметры: задержка от 5 до 15 секунд.
Сбор семантики: основные методы
Метод 1: Парсинг из Вордстата
Это базовый способ. Вы задаёте список базовых (маскообразующих) запросов - тех, которые точно характеризуют вашу нишу. Программа парсит левую колонку Вордстата (похожие запросы) и правую (ассоциированные запросы).
Пример для стоматологии. Базовые запросы: - лечение зубов - стоматология - удаление зуба - имплантация зубов - брекеты - детский стоматолог
По каждому базовому запросу Вордстат выдаст десятки вариаций. KeyCollector автоматически пройдёт по всем страницам и соберёт весь список.
Метод 2: Поисковые подсказки
Когда вы вводите запрос в строку поиска Яндекса, появляются подсказки - то, что часто ищут люди после вашего запроса. Это отдельный срез семантики, который не всегда пересекается с Вордстатом.
В KeyCollector: правая кнопка на группе - Сбор данных - Парсинг поисковых подсказок. Выбираете Яндекс, Google или оба. Процесс занимает значительно меньше времени, чем парсинг Вордстата.
Подсказки особенно ценны для сбора хвостовых (длиннохвостых) запросов: "лечение зубов в москве недорого с гарантией", "поставить коронку на зуб цена отзывы".
Метод 3: Анализ конкурентов через SpyWords или Serpstat
Выгружаете список ключей конкурентов из сторонних сервисов - импортируете в KeyCollector как базовый список. Затем прогоняете через сбор частот. Это позволяет обогатить семантику запросами, которые вы могли пропустить при самостоятельном мозговом штурме.
Определение частот
После сбора вариантов запросов у вас будет большой список - возможно несколько тысяч позиций. Теперь нужно узнать, сколько людей реально ищет каждый запрос.
KeyCollector собирает несколько видов частот:
- Базовая частота (без операторов) - показывает запросы, в которых встречается ваше слово в любой форме. Завышена, используется редко.
- Частота в кавычках ("") - запросы в точном словоформе, без учёта порядка слов. Более реальная картина.
- Точная частота ("!слово !слово") - точное совпадение по словоформе и порядку. Наиболее точная оценка реального спроса.
Для принятия решений работайте с точной частотой. Запросы с точной частотой 0-5 в месяц, как правило, не стоят отдельной ставки - их можно объединять в группы или отсекать.
Важно: сбор точных частот занимает время. Для 5000 запросов при нормальной скорости парсинга - несколько часов. Планируйте работу с учётом этого.
Фильтрация мусора
После сбора частот список нужно почистить. В KeyCollector есть встроенный стоп-фильтр: задаёте список слов, и все запросы, содержащие эти слова, помечаются для удаления.
Стандартные стоп-слова для большинства ниш: - бесплатно, бесплатный - своими руками, самостоятельно, сам - отзывы (зависит от стратегии) - фото, видео, картинки - скачать - форум, отзыв, обзор (если чисто коммерческая кампания) - дипломная, курсовая, реферат
Для стоматологии добавляем специфические стоп-слова: - анестезия (если не продаём анестезию отдельно) - симптомы, признаки (информационные запросы) - народными средствами
После фильтрации просматриваем оставшееся глазами - автоматика не поймает всё.
Кластеризация запросов
Кластеризация - группировка похожих запросов в кампании и группы объявлений. В KeyCollector есть встроенный инструмент кластеризации на основе частоты совпадений в поисковой выдаче.
Принцип: если по двум запросам в топе поиска показываются одни и те же сайты - запросы скорее всего близки по смыслу и могут идти в одну группу.
Настройки кластеризации: - порог схожести: обычно 3-4 (сколько общих URL в топе считается достаточным) - режим: мягкий (больше групп, меньше запросов в каждой) или жёсткий (меньше групп, больше смешения)
Для Директа рекомендую мягкую кластеризацию: лучше иметь больше точных групп с релевантными объявлениями, чем несколько больших групп со смешанными запросами.
Реалистичный пример: семантика для стоматологии за 2 часа
Исходные данные: стоматологическая клиника в Москве, нужна семантика для поисковых кампаний.
Первые 30 минут - подготовка
Составляем список базовых запросов (20-30 позиций): лечение зубов, стоматолог, зубная боль, удаление зуба, пломба, имплант, имплантация, протезирование зубов, коронка на зуб, брекеты, выравнивание зубов, детский стоматолог, чистка зубов, отбеливание зубов, зуб мудрости, нервы зуба, кариес, пародонтит, гингивит, ортодонт
Добавляем географические вариации: "стоматолог москва", "стоматология рядом", "стоматология [район]".
Заводим новый проект в KeyCollector, создаём группу "Стоматология Москва".
30-90 минут - парсинг
Запускаем парсинг из Вордстата по базовым запросам. Глубина - 2 уровня (парсим подсказки по найденным запросам). Пока идёт парсинг - параллельно запускаем сбор поисковых подсказок.
Результат через час: 3000-5000 сырых запросов.
90-120 минут - чистка и частоты
Применяем стоп-фильтр (подготовленный список стоп-слов). Отсекаем всё с точной частотой меньше 10 в месяц (для Москвы - можно поднять до 30). Остаётся 800-1500 запросов.
Запускаем сбор точных частот - это уйдёт ещё минут 40-60 (продолжаем в фоне).
После сбора частот - кластеризация
Запускаем кластеризацию. Получаем готовые группы: - Лечение кариеса - Удаление зубов - Имплантация - Протезирование - Детская стоматология - Ортодонтия / брекеты - Экстренная помощь
Экспорт в Директ
KeyCollector экспортирует данные в форматах, совместимых с Директом:
- XLS/XLSX - для ручной загрузки через Директ.Коммандер
- CSV - универсальный формат
В экспорте указываем: фраза, частота, группа (кластер). Заголовки объявлений и тексты добавляем отдельно или в том же файле.
Типичные ошибки при работе с KeyCollector
Ошибка 1: Слишком широкие базовые запросы
"Медицина" как базовый запрос для стоматологии даст тысячи нерелевантных результатов. Базовые запросы должны быть конкретными.
Ошибка 2: Игнорирование точной частоты
Принимать решения на основе базовой частоты без кавычек - значит работать с завышенными в разы цифрами. Всегда собирайте точные частоты перед финальной фильтрацией.
Ошибка 3: Пропуск ручной проверки
Автоматическая фильтрация и кластеризация не идеальны. Обязательно просмотрите итоговый список глазами - особенно мелкие кластеры, которые программа могла неправильно сгруппировать.
KeyCollector и работа с минус-словами
Собранная семантика - это ещё не конец. Важно также правильно проработать минус-слова, чтобы объявления не показывались по нецелевым запросам. KeyCollector помогает выявить потенциальные минус-слова в процессе чистки - все отсеянные стоп-слова становятся кандидатами в минус-список.
После запуска кампании регулярно проверяйте отчёт по поисковым запросам в Директе. Инструменты вроде WAuditor позволяют систематически выявлять нецелевые показы и пополнять список минус-слов - это отдельный процесс, который KeyCollector не автоматизирует.
KeyCollector - мощный инструмент именно для этапа сбора. Дальнейшая работа требует других решений.