Собрал семантическое ядро тремя способами. Один из них не работает с 2022 года, но его до сих пор советуют

Три недели, 11 200 рублей, одна студия разработки и много мата. Коротко о том, что вышло.

Мы делаем сайты и интеграции, шесть человек, живем на сарафане. Сарафан перестал расти, платить за лиды на биржах надоело. Решили запустить свой Директ и блог - а для того и другого нужны ключевые слова с частотами, разложенные по смыслу. То есть семантическое ядро.

Я не сеошник, я управляю студией. Поэтому сделал то же, что сделает любой на моем месте: загуглил, как собрать семантическое ядро, и пошел по инструкциям. Заранее записал, что считаю результатом: коммерческие запросы с частотами для Директа, минус-слова, понимание каких страниц на сайте нет, темы для блога. Одна ниша, регион вся Россия, одни и те же требования на выходе.

Способ первый: подбор слов в Яндексе руками

Вордстат (wordstat.yandex.ru) бесплатный, официальный, данные из первых рук. На этом хорошие новости заканчиваются.

Арифметика такая. Сорок масок - базовых фраз вроде «создание сайтов» или «внедрение CRM». По каждой Вордстат отдает страницу на полсотни фраз, а если тема широкая, страниц набирается десяток. Итого четыреста заходов руками: вписать, дождаться, скопировать, вставить. Минута, если повезет. Если не повезет - капча, которая вылезает даже у авторизованных.

Собрал 2 400 фраз за три вечера. Дальше надо снимать точную частотность, потому что цифра по умолчанию широкая: в «создание сайтов» попадают и курсы, и вакансии, и «сделать самому бесплатно». Точную снимают операторами, по одной фразе.

Две тысячи четыреста фраз. По одной. Со случайной капчей.

Снял по трем сотням верхних и сдался. Тогда же понял, почему у запроса «генератор частот онлайн» три сотни показов в месяц - я сам его и вбил. Рядом живут «комбинатор ключевых фраз», «пересекатор», «генератор минус слов». Кто собирает ядро руками, к концу пользуется не одним сервисом, а восемью, и в каждом свой формат выгрузки.

Итог: 22 часа, 2 400 сырых фраз, точная частота у трехсот. Разложить по смыслу попробовал: за четыре часа разобрал четыреста строк и понял, что размечаю на глазок.

Собрал семантическое ядро тремя способами. Один из них не работает с 2022 года, но его до сих пор советуют

Способ второй: Key Collector, главная программа для сбора семантического ядра

Key Collector (key-collector.ru) советуют в каждой второй статье. В этой нише он примерно как фотошоп в дизайне: стандарт, о котором знают даже те, кто им не пользуется.

Пошел покупать. И на странице оплаты, прямо над формой, увидел вот это:

Собрал семантическое ядро тремя способами. Один из них не работает с 2022 года, но его до сих пор советуют

Перечитал дважды, пошел по ссылке рядом. Там заявление разработчиков от 22 марта 2022 года:

Собрал семантическое ядро тремя способами. Один из них не работает с 2022 года, но его до сих пор советуют

Это вызывает уважение: команда открыто сказала, что не тянет гонку с антиботом Яндекса, вместо того чтобы продавать надежду. В подвале сайта копирайт 2010-2021.

Добило другое. Заявлению четыре года. За эти четыре года вышли сотни статей и роликов, где Key Collector советуют как основной инструмент сбора семантики. Ни в одной из тех, что читал я, про эту плашку не было ни слова.

На практике сейчас так: прямой парсинг Вордстата не работает совсем, ни прокси, ни задержки, ни смена аккаунтов не спасают. Работает обходной путь через платного посредника XMLRiver, с которым программа официально интегрирована. Лицензия 2 200, XMLRiver по моему объему около тысячи. Итого 3 200, не разорение.

Настройка заняла вечер. Дальше программа отработала честно: к утру у меня было 38 000 фраз с частотами.

Тридцать восемь тысяч.

Тут до меня и дошло, что я купил. Я купил экскаватор. Он выкопал мне гору, и гору надо разбирать руками. Внутри вакансии, курсы, самоделкины, тильда с вордпрессом и все конструкторы мира. Чистишь по стоп-словам, смотришь что осталось, дописываешь список, чистишь снова. После шести проходов от 38 тысяч осталось чуть больше четырех.

И главное: нигде нет ответа, коммерческий запрос или информационный. Заказать человек хочет или почитать. Первые идут в Директ, вторые в блог, а если перепутать - платишь за клики тех, кто ничего не покупает. Машина этого не знает. Значит, четыре тысячи строк надо просмотреть глазами.

Итог: 20 часов, 3 200 рублей, 4 100 фраз в группах. Минус-слов набрал восемьдесят и чувствовал, что неполные. Размечал сам и понимал, что неровно: к вечеру критерии плывут.

Собрал семантическое ядро тремя способами. Один из них не работает с 2022 года, но его до сих пор советуют

Способ третий: онлайн-сервис подбора ключевых слов

Взял mysemantic.ru - он собирает ядро по ссылке на сайт, без брифа. Про всю эту категорию я до того думал плохо: казалось, там либо чужая база, либо чат-бот, который выдумывает список. Второе, кстати, реальная проблема - я в самом начале спросил у нейросети, она бодро выдала полторы сотни «ключевых слов для студии разработки», а при проверке оказалось, что части запросов никто никогда не искал. Частот она не знает и знать не может.

Выбрал по скучной причине: у него лежал пример готового файла, который можно скачать до оплаты. У остальных, кого открыл, были скриншоты и обещания.

Механика простая до неприличия: регистрация, адрес сайта, тариф, оплата. Дальше ничего - ни брифа, ни созвона, ни согласования списка. Именно этого я и боялся, потому что обычно после «оставьте заявку» начинается неделя переписки с менеджером. Взял полный тариф за 8 000, есть варианты за 3 000 и 5 000.

Файл пришел на следующий день. Excel на восемь листов: 2 780 коммерческих фраз с частотами и пометкой готовности к покупке (горячих 690), 291 минус-слово готовым списком, рубрикатор на 19 разделов, 4 900 информационных запросов с планом на 2 100 статей, шестьдесят конкурентов из выдачи.

Полезнее всего оказались две вещи. Рубрикатор: сравнил со своим сайтом и увидел четыре темы, под которые у нас страниц нет, хотя услуги такие оказываем. И расчет охвата: 38 статей закрывают половину спроса, 126 - семьдесят процентов, дальше длинный хвост. Это сняло вопрос «а сколько вообще писать».

Зацепила еще одна цифра: обработано 294 тысячи фраз, в ядро вошло 21 400. Остальное - чужие бренды и мусор. Ровно то, что я разгребал руками во втором способе, только там было 38 тысяч, а не 294.

Собрал семантическое ядро тремя способами. Один из них не работает с 2022 года, но его до сих пор советуют

Что мне не понравилось

Я не буду писать, что все прекрасно. Не прекрасно.

Не могу проверить 21 тысячу фраз. Взял двести наугад, сверил с Вордстатом. К шести есть претензии: три отнес бы к другому типу, две притянуты к нашей нише, одна из соседней. Три процента на выборке - терпимо, но на всем объеме это сотни строк.

Дороже остальных. Восемь тысяч против трех двухсот за Key Collector с посредником и нуля за Вордстат. Если вам нужен только список фраз с частотами, а размечать готовы сами - вы переплачиваете. Мне окупилось лишь потому, что я не был готов убить еще неделю на разметку.

Регион только вся Россия. Нам подошло, работаем удаленно. Но если у вас шиномонтаж в Твери, резать придется самому.

Свой список подсунуть некуда. Хотел добавить пару наших формулировок из коммерческих предложений - не нашел куда. Сервис читает сайт и решает сам. Под свой шаблон файл тоже не перестроить.

Три способа рядом

Время только мое, машинное не считаю: пока парсер работает, я занимаюсь другими делами.

Собрал семантическое ядро тремя способами. Один из них не работает с 2022 года, но его до сих пор советуют

Обратите внимание на первые две колонки. Двадцать с небольшим часов там и там, то есть поровну. Разница в том, на что они ушли: в первом случае на механику - вбить, скопировать, разгадать капчу, во втором на разбор того, что натаскал парсер. Работа разная, усталость одинаковая.

И про деньги. Первый способ бесплатный только на бумаге: двадцать два часа моего времени по моей же ставке сильно дороже восьми тысяч. Просто эти деньги не выходят из кассы и потому кажутся бесплатными.

Что я вынес

Я неправильно ставил вопрос. Мне казалось, семантическое ядро - это список фраз, и весь вопрос в том, где его взять. А ядро это не список, это решения по каждой фразе: наша она или чужая, коммерческая или информационная, готов человек платить или просто читает. Список добывается за три вечера. Решения - вот это и есть работа.

Гайдам нужен срок годности. Программа, которую мне советовали в каждой второй статье, четыре года назад объявила, что сбором статистики больше не занимается. Написано красным по белому над кнопкой оплаты. Ни один автор гайда до этой страницы, видимо, не долистал.

И это скорее про меня. Я взялся собирать сам не потому, что дешевле, а потому что казалось - свою нишу я знаю лучше, значит и размечу лучше. Знаю действительно лучше. Но размечать четыре тысячи строк подряд человек не может: к третьему часу критерии съезжают, и половина работы делается вслепую.

Дальше собираю Директ из горячей части, минус-слова заливаю до первого показа - это единственный совет из всей истории, который готов повторять кому угодно.

Если есть опыт с другими сервисами такого рода - расскажите, что на выходе и чего не хватило. Интересно, насколько мой расклад типичный.

5