Как собрать семантическое ядро: пошаговая инструкция

· семантика · инструкция

Семантическое ядро - это список запросов, по которым сайт собирается получать трафик, разложенный по страницам. Не «список ключевиков в экселе ради галочки», а рабочая карта: какие формулировки люди реально вводят в поиск, сколько раз в месяц и какая страница должна отвечать на каждую группу. Ниже - весь путь от пустого листа до готового ядра, с конкретными инструментами на каждом шаге.

Шаг 1. Маркеры: о чём сайт вообще

Начинается всё не с сервисов, а с головы. Выпишите 10-30 базовых фраз, которыми ваш товар или услугу называют клиенты: как они говорят по телефону, что пишут в заявках. Продаёте кухни на заказ - маркеры будут «кухни на заказ», «кухня по индивидуальным размерам», «заказать кухню». Сюда же синонимы и профессиональный жаргон: «кухонный гарнитур» ищут другие люди, чем «кухня модерн», а покупают одно и то же.

Частая ошибка на этом шаге - писать маркеры языком своего прайса, а не языком клиента. У вас в каталоге «мебель для кухонной зоны», а спрос живёт в формулировке «кухня недорого». Проверить, как говорит рынок, можно прямо в Вордстате: вбиваете вариант и смотрите, есть ли по нему жизнь.

Шаг 2. Расширение: Вордстат и подсказки

Каждый маркер прогоняется через Вордстат, и из левой колонки забираются все вложенные запросы: «кухни на заказ недорого», «кухни на заказ от производителя», «кухни на заказ по размерам» - у живой ниши из одного маркера выходит по 100-300 хвостов. Правая колонка («похожие запросы») даёт формулировки, до которых вы сами не додумались бы: из неё регулярно достаются целые новые маркеры.

Второй источник - поисковые подсказки: то, что Яндекс и Google дописывают в строке поиска. Подсказки обновляются быстрее статистики Вордстата, поэтому свежие формулировки часто появляются сначала там.

Руками этот шаг проходят только на маленьких ядрах. Когда маркеров десятки, расширение автоматизируют: наш массовый сбор Вордстата прогоняет список фраз за один запуск и отдаёт таблицу с частотностями, а те же данные доступны по API Вордстата, если сбор встроен в ваш скрипт.

Шаг 3. Частотность: отделяем спрос от иллюзии

У каждой собранной фразы надо снять частотность - иначе ядро наполнится запросами, которые никто не вводит. Подвох в том, что частотность бывает четырёх видов, и они отличаются в разы: базовая частотность фразы «купить окна» включает всё от «купить окна пвх» до «купить окна бу в гараж», а точная - только саму фразу как есть. Ядро фильтруют по точной или фразовой, базовую используют лишь как первичный сигнал. Подробно про эти виды - в статье про виды частотности Вордстата, а расстановка кавычек и восклицательных знаков разобрана в операторах Вордстата.

Практический порог зависит от ниши. В конкурентной коммерческой теме фразы с точной частотностью меньше 5-10 в месяц обычно откладывают; в узкой B2B-нише и запрос с частотностью 3 может приводить клиента на миллион, поэтому режут не по цифре, а по здравому смыслу.

Шаг 4. Чистка: минус-слова и чужой интент

После расширения в списке обязательно окажется мусор трёх сортов. Первый - явно нецелевое: «кухни на заказ своими руками», «скачать проект кухни бесплатно» - человек не собирается ничего покупать. Второй - чужая география, если вы работаете не по всей стране. Третий, самый коварный, - фразы, где слова ваши, а интент чужой: по запросу «яндекс парсер» топ почти целиком занят парсерами Яндекс Карт, и странице про парсинг поисковой выдачи туда пробиться трудно, какой бы релевантной она ни казалась по тексту.

Первые два сорта чистятся минус-словами почти механически. Третий ловится только просмотром выдачи: если в топе по фразе стоят страницы совсем не про ваше - фраза не ваша, сколько бы частотности в ней ни было.

Шаг 5. Кластеризация: группируем под страницы

Осталось разложить очищенный список на группы, каждая из которых получит свою страницу. Главное правило: группировать не по общим словам, а по выдаче. «Проверка позиций сайта» и «съём позиций» - текстуально разные фразы, но топ-10 Яндекса по ним заметно пересекается, значит, поисковик считает их одной темой и им нужна одна страница. И наоборот: похожие на вид фразы с непересекающимися топами требуют разных страниц, как их ни хотелось бы склеить.

Методы и инструменты этого шага - тема отдельного разбора про кластеризацию запросов. Коротко: на малых объёмах группируют вручную с проверкой топов, на больших - автоматически по пересечению выдачи, которую снимают через SERP API.

Сбор ядра с помощью ИИ: что уже работает

Языковые модели заметно ускоряют два шага из пяти. Первый - генерация маркеров: модель хорошо придумывает синонимы и формулировки, которые вы упустили. Второй - чистка: показать модели список в тысячу фраз и попросить пометить нецелевые - быстрее, чем отсматривать список глазами.

Слабое место ИИ без данных - цифры: частотность модель не знает, а угадывает, поэтому доверять ей оценку спроса нельзя. Решается подключением инструментов: через MCP-сервер модель сама ходит в Вордстат за реальной частотностью и в выдачу за реальными топами. В Claude Code это выглядит как диалог: «собери ядро для сайта такого-то, маркеры такие-то, частотность проверяй точную» - и модель прогоняет фразы через Вордстат, отсеивает пустышки и возвращает таблицу с настоящими цифрами. Что такое MCP и как это подключить за пару минут - в статье что такое MCP-сервер.

Бесплатные инструменты для старта

Собрать первое ядро можно вообще без бюджета: сам Вордстат бесплатен, браузерное расширение Yandex Wordstat Assistant избавляет от копипаста, а стартовых 10 ₽ на балансе нашего сервиса хватает на тысячу запросов частотности - для ядра небольшого сайта этого достаточно. Платные комбайны нужны позже, когда ядро переваливает за тысячи фраз и обновляется регулярно; сравнение вариантов - в подборке сервисов для сбора семантического ядра.

Частые вопросы

Сколько фраз должно быть в семантическом ядре?

Сколько наберётся живого спроса - от полусотни для локальной услуги до сотен тысяч для интернет-магазина. Ядро на 200 реальных запросов полезнее ядра на 20 000, где половина фраз с нулевой частотностью.

Как часто обновлять ядро?

Раз в квартал-полгода для стабильных ниш; чаще, если ниша живая - появились новые модели товара, сленг, инфоповоды. Смотреть стоит и на подсказки: новые формулировки сначала появляются там.

Можно ли собрать ядро только по конкурентам?

Как источник маркеров конкуренты полезны: видно, под что у них сделаны страницы. Но копировать чужое ядро целиком - плохая идея: у них другой ассортимент, регионы и сильные страницы, и их приоритеты вам не подойдут.

Чем ядро для Директа отличается от ядра для SEO?

Основа одна, но для Директа жёстче чистка (каждый клик стоит денег) и обязательна проработка минус-слов, а частотность смотрят вместе с прогнозом стоимости клика - его удобно снять через прогноз бюджета Директа по тому же списку фраз.


Читайте дальше