Собрал семантическое ядро тремя способами. Один из них не работает с 2022 года, но его до сих пор советуют
Три недели, 11 200 рублей, одна студия разработки и много мата. Коротко о том, что вышло.
Мы делаем сайты и интеграции, шесть человек, живем на сарафане. Сарафан перестал расти, платить за лиды на биржах надоело. Решили запустить свой Директ и блог - а для того и другого нужны ключевые слова с частотами, разложенные по смыслу. То есть семантическое ядро.
Я не сеошник, я управляю студией. Поэтому сделал то же, что сделает любой на моем месте: загуглил, как собрать семантическое ядро, и пошел по инструкциям. Заранее записал, что считаю результатом: коммерческие запросы с частотами для Директа, минус-слова, понимание каких страниц на сайте нет, темы для блога. Одна ниша, регион вся Россия, одни и те же требования на выходе.
Способ первый: подбор слов в Яндексе руками
Вордстат (wordstat.yandex.ru) бесплатный, официальный, данные из первых рук. На этом хорошие новости заканчиваются.
Арифметика такая. Сорок масок - базовых фраз вроде «создание сайтов» или «внедрение CRM». По каждой Вордстат отдает страницу на полсотни фраз, а если тема широкая, страниц набирается десяток. Итого четыреста заходов руками: вписать, дождаться, скопировать, вставить. Минута, если повезет. Если не повезет - капча, которая вылезает даже у авторизованных.
Собрал 2 400 фраз за три вечера. Дальше надо снимать точную частотность, потому что цифра по умолчанию широкая: в «создание сайтов» попадают и курсы, и вакансии, и «сделать самому бесплатно». Точную снимают операторами, по одной фразе.
Две тысячи четыреста фраз. По одной. Со случайной капчей.
Снял по трем сотням верхних и сдался. Тогда же понял, почему у запроса «генератор частот онлайн» три сотни показов в месяц - я сам его и вбил. Рядом живут «комбинатор ключевых фраз», «пересекатор», «генератор минус слов». Кто собирает ядро руками, к концу пользуется не одним сервисом, а восемью, и в каждом свой формат выгрузки.
Итог: 22 часа, 2 400 сырых фраз, точная частота у трехсот. Разложить по смыслу попробовал: за четыре часа разобрал четыреста строк и понял, что размечаю на глазок.
Способ второй: Key Collector, главная программа для сбора семантического ядра
Key Collector (key-collector.ru) советуют в каждой второй статье. В этой нише он примерно как фотошоп в дизайне: стандарт, о котором знают даже те, кто им не пользуется.
Пошел покупать. И на странице оплаты, прямо над формой, увидел вот это:
Перечитал дважды, пошел по ссылке рядом. Там заявление разработчиков от 22 марта 2022 года:
Это вызывает уважение: команда открыто сказала, что не тянет гонку с антиботом Яндекса, вместо того чтобы продавать надежду. В подвале сайта копирайт 2010-2021.
Добило другое. Заявлению четыре года. За эти четыре года вышли сотни статей и роликов, где Key Collector советуют как основной инструмент сбора семантики. Ни в одной из тех, что читал я, про эту плашку не было ни слова.
На практике сейчас так: прямой парсинг Вордстата не работает совсем, ни прокси, ни задержки, ни смена аккаунтов не спасают. Работает обходной путь через платного посредника XMLRiver, с которым программа официально интегрирована. Лицензия 2 200, XMLRiver по моему объему около тысячи. Итого 3 200, не разорение.
Настройка заняла вечер. Дальше программа отработала честно: к утру у меня было 38 000 фраз с частотами.
Тридцать восемь тысяч.
Тут до меня и дошло, что я купил. Я купил экскаватор. Он выкопал мне гору, и гору надо разбирать руками. Внутри вакансии, курсы, самоделкины, тильда с вордпрессом и все конструкторы мира. Чистишь по стоп-словам, смотришь что осталось, дописываешь список, чистишь снова. После шести проходов от 38 тысяч осталось чуть больше четырех.
И главное: нигде нет ответа, коммерческий запрос или информационный. Заказать человек хочет или почитать. Первые идут в Директ, вторые в блог, а если перепутать - платишь за клики тех, кто ничего не покупает. Машина этого не знает. Значит, четыре тысячи строк надо просмотреть глазами.
Итог: 20 часов, 3 200 рублей, 4 100 фраз в группах. Минус-слов набрал восемьдесят и чувствовал, что неполные. Размечал сам и понимал, что неровно: к вечеру критерии плывут.
Способ третий: онлайн-сервис подбора ключевых слов
Взял mysemantic.ru - он собирает ядро по ссылке на сайт, без брифа. Про всю эту категорию я до того думал плохо: казалось, там либо чужая база, либо чат-бот, который выдумывает список. Второе, кстати, реальная проблема - я в самом начале спросил у нейросети, она бодро выдала полторы сотни «ключевых слов для студии разработки», а при проверке оказалось, что части запросов никто никогда не искал. Частот она не знает и знать не может.
Выбрал по скучной причине: у него лежал пример готового файла, который можно скачать до оплаты. У остальных, кого открыл, были скриншоты и обещания.
Механика простая до неприличия: регистрация, адрес сайта, тариф, оплата. Дальше ничего - ни брифа, ни созвона, ни согласования списка. Именно этого я и боялся, потому что обычно после «оставьте заявку» начинается неделя переписки с менеджером. Взял полный тариф за 8 000, есть варианты за 3 000 и 5 000.
Файл пришел на следующий день. Excel на восемь листов: 2 780 коммерческих фраз с частотами и пометкой готовности к покупке (горячих 690), 291 минус-слово готовым списком, рубрикатор на 19 разделов, 4 900 информационных запросов с планом на 2 100 статей, шестьдесят конкурентов из выдачи.
Полезнее всего оказались две вещи. Рубрикатор: сравнил со своим сайтом и увидел четыре темы, под которые у нас страниц нет, хотя услуги такие оказываем. И расчет охвата: 38 статей закрывают половину спроса, 126 - семьдесят процентов, дальше длинный хвост. Это сняло вопрос «а сколько вообще писать».
Зацепила еще одна цифра: обработано 294 тысячи фраз, в ядро вошло 21 400. Остальное - чужие бренды и мусор. Ровно то, что я разгребал руками во втором способе, только там было 38 тысяч, а не 294.
Что мне не понравилось
Я не буду писать, что все прекрасно. Не прекрасно.
Не могу проверить 21 тысячу фраз. Взял двести наугад, сверил с Вордстатом. К шести есть претензии: три отнес бы к другому типу, две притянуты к нашей нише, одна из соседней. Три процента на выборке - терпимо, но на всем объеме это сотни строк.
Дороже остальных. Восемь тысяч против трех двухсот за Key Collector с посредником и нуля за Вордстат. Если вам нужен только список фраз с частотами, а размечать готовы сами - вы переплачиваете. Мне окупилось лишь потому, что я не был готов убить еще неделю на разметку.
Регион только вся Россия. Нам подошло, работаем удаленно. Но если у вас шиномонтаж в Твери, резать придется самому.
Свой список подсунуть некуда. Хотел добавить пару наших формулировок из коммерческих предложений - не нашел куда. Сервис читает сайт и решает сам. Под свой шаблон файл тоже не перестроить.
Три способа рядом
Время только мое, машинное не считаю: пока парсер работает, я занимаюсь другими делами.
Обратите внимание на первые две колонки. Двадцать с небольшим часов там и там, то есть поровну. Разница в том, на что они ушли: в первом случае на механику - вбить, скопировать, разгадать капчу, во втором на разбор того, что натаскал парсер. Работа разная, усталость одинаковая.
И про деньги. Первый способ бесплатный только на бумаге: двадцать два часа моего времени по моей же ставке сильно дороже восьми тысяч. Просто эти деньги не выходят из кассы и потому кажутся бесплатными.
Что я вынес
Я неправильно ставил вопрос. Мне казалось, семантическое ядро - это список фраз, и весь вопрос в том, где его взять. А ядро это не список, это решения по каждой фразе: наша она или чужая, коммерческая или информационная, готов человек платить или просто читает. Список добывается за три вечера. Решения - вот это и есть работа.
Гайдам нужен срок годности. Программа, которую мне советовали в каждой второй статье, четыре года назад объявила, что сбором статистики больше не занимается. Написано красным по белому над кнопкой оплаты. Ни один автор гайда до этой страницы, видимо, не долистал.
И это скорее про меня. Я взялся собирать сам не потому, что дешевле, а потому что казалось - свою нишу я знаю лучше, значит и размечу лучше. Знаю действительно лучше. Но размечать четыре тысячи строк подряд человек не может: к третьему часу критерии съезжают, и половина работы делается вслепую.
Дальше собираю Директ из горячей части, минус-слова заливаю до первого показа - это единственный совет из всей истории, который готов повторять кому угодно.
Если есть опыт с другими сервисами такого рода - расскажите, что на выходе и чего не хватило. Интересно, насколько мой расклад типичный.