Разберём, как составить семантическое ядро, из которого вырастут структура сайта и план контента под Яндекс в вашем регионе.

Каждый шаг покажем на примере нашего сайта (сентябрь 2026 года, Яндекс, Москва).

Содержание

Что такое семантическое ядро сайта и зачем оно нужно

Семантическое ядро (СЯ), или семантика сайта, — упорядоченный список поисковых запросов и ключевых слов, по которым сайт должен находиться в поиске.

В рабочем виде это запросы с частотностью, разбитые на группы. Одна группа — один URL. В таблице это столбцы: запрос, частотность, кластер, тип страницы или URL.

Например, строки из нашего ядра (Москва, Arsenkin, 29.09.2026):

Запрос Базовая частотность Точная частотность
как собрать семантическое ядро 492 349
семантическое ядро 1 106 108

Кластер и страница появятся на шагах 5 и 6.

По ядру строят структуру сайта, тексты и заголовки, контент-план блога и список запросов для отслеживания позиций в Яндексе и Google. Для SEO-продвижения правильная семантика — путь к целевому трафику и потенциальным клиентам.

Ядро без кластеризации — ещё не рабочий инструмент. Список ключевых слов не говорит, какую страницу создавать или оптимизировать.

Какие бывают поисковые запросы

По интенту

Рабочая классификация: информационные («как собрать семантическое ядро»), коммерческие, транзакционные, навигационные и брендовые. Коммерческий запрос выдают маркеры «купить», «цена», «заказать», «доставка», «сколько стоит».

Но маркер только подсказывает. У нас словарная разметка не определила интент у 1 028 ключей из 1 431, а 264 информационных и 139 коммерческих остались гипотезой. Окончательный интент снимают по выдаче, на шаге кластеризации.

Интент кластера задаёт формат: информационные кластеры уходят в статьи, коммерческие — в услуги и категории, часть с привязкой к региону. Например, у нас «продвижение сайта» легло на услугу с гео-привязкой, а «robots txt» — в статью.

По частотности и региону

Частотность показывает, сколько раз в месяц запрос ищут в Яндексе: на вкладке «Топы запросов» Вордстат даёт данные за последний месяц. Высокочастотные, среднечастотные и низкочастотные запросы сравнивают внутри своей семантики, границы зависят от ниши.

Кроме спроса оценивают уровень конкуренции по запросу. Его показывает, например, бета-инструмент подбора запросов по рынку в Вебмастере.

Частота и выдача зависят ещё и от региона, у нас это Москва.

Как собрать семантическое ядро по шагам

Маршрут такой: маркерные запросы → расширение списка → чистка → проверка частотности → кластеризация по выдаче → распределение по страницам.

Маршрут сбора семантического ядра: от масок до распределения по страницам
Маршрут сбора ядра для creativity-lab.ru: где решает человек, где работает автоматика и платный съём

На деле маршрут не прямой.

У нас приёмка ядра вернула работу к правке минус-словаря и повторной чистке. Пул сократился с 60 215 до 59 236 фраз, ядро — с 1 563 до 1 431. Выброшенное лежит в архиве и ждёт просмотра, а съём 727 фраз без сигнала частоты отложен.

Чистка стоит до платной проверки частотности: каждый лишний ключ на съёме стоит денег или лимитов. У нас бесплатный предфильтр по уже выгруженной базе Букварикса отсеял 47 783 фразы с нулевой точной частотностью по всему миру, 80,7% пула.

Выгрузку, дедупликацию, съём частот и кластеризацию делает машина. 69 099 строк Букварикса выгрузились за 1,9 с, съём частот по 11 312 фразам занял около 11,5 минуты.

Решения у нас остаются за человеком. Он утверждает маски и правила минус-слов, принимает ядро и просматривает выброшенное.

Шаг 1. Составьте список маркерных запросов

Маркерные (базовые) запросы — короткие фразы о товарах и услугах бизнеса. Источники — разделы сайта, потребности и формулировки целевой аудитории, мозговой штурм, синонимы, анализ конкурентов.

Маски определяют охват: сбор физически не может найти то, о чём не спросили.

Это вывод из нашего отчёта. Маски тоже проверяют: из 105 предложенных мы приняли 97, восемь отбраковали.

Шаг 2. Расширьте список ключевых слов через Wordstat, подсказки и конкурентов

Расширяют семантику через Яндекс Вордстат, поисковые подсказки, базы ключевых слов, поисковые запросы конкурентов из сервисов анализа и свои запросы из Вебмастера и Google Search Console.

В Вордстате популярные и похожие запросы видны на вкладке «Топы запросов». Регион и тип устройства задаются фильтром.

Наши восемь выгрузок четырёх типов дали 81 809 строк, без точных дублей — 76 683 фразы. Вклад источников неравный:

Источник Строк Фраз в ядре
База Букварикса 69 099 1 225
Выгрузки по пяти конкурентам 11 155 408
Search Console 1 055 47
Вебмастер 500 4

Сумма в последнем столбце больше 1 431: у одного ключа бывает несколько источников.

Шаг 3. Почистите ядро от мусора и дублей

Убирайте дубли, нецелевые запросы (скачать, бесплатно, работа, чужая вертикаль), бренды конкурентов, обрывки, слишком длинные фразы и запросы с URL. Минус-слова и стоп-слова собирайте в словарь.

У нас 19 правил убрали 17 447 фраз, из 76 683 осталось 59 236. Больше всех — инфо-мусор: 4 079 ключевых слов вроде «seo перевод».

Была и ловушка омонимии. «Seo» оказалось ещё и корейским именем, и отдельное правило убрало 957 фраз вроде «seo taiji».

Правила чистки семантического ядра и сколько фраз они убрали
Чистка ядра: 19 правил убрали 17 447 фраз

Чистка может выбросить и нужное.

Правило тематического якоря убрало «переезд сайта на новый домен», омонимичного — «мониторинг позиций». Поэтому архив выброшенного просматривают и возвращают нужные ключи. У нас этот просмотр ещё впереди.

Неявные дубли (словоформы одной фразы) здесь только помечают. У нас таких кандидатов было 29 534, а схлопывали их уже после съёма частот.

Шаг 4. Проверьте точную частотность в нужном регионе

Базовая частотность Вордстата учитывает и более длинные поисковые запросы с теми же словами, поэтому спрос на саму фразу она завышает.

Точную частоту дают операторы. По справке Вордстата «!» фиксирует форму слова, кавычки — количество слов, квадратные скобки — порядок. Чтобы отсечь и более длинные запросы, и другие словоформы, операторы комбинируют: "!как !собрать !семантическое !ядро".

Мы снимали точную частоту без фиксации порядка слов, то есть без квадратных скобок. У «семантического ядра» из таблицы выше разница больше чем в десять раз.

Базовая и точная частотность запросов в Вордстате
Базовая частотность завышает спрос на фразу: Москва, 29.09.2026

Почему регион меняет цифры

Ручная выгрузка без указанного региона разошлась с московскими данными: по 881 фразе её базовая частотность по медиане в 5,8 раза выше. «Продвижение сайта» — 37 457 против 7 502. Вероятно, выгрузка была не по Москве (не проверено), поэтому в ядро мы взяли только московские частоты.

Регион фиксируйте до съёма.

Какие фразы отсеять после съёма

Ключевые слова с нулевой точной частотностью в ядро не идут, у нас таких было 5 480. После схлопывания 3 815 словоформ и отсева по порогам осталась 1 431 фраза.

Высокое отношение базовой частоты к точной — повод проверить фразу, низкое ничего не доказывает. Медиана отношения в нашем ядре — 3,0.

Шаг 5. Проведите кластеризацию запросов по выдаче

Кластеризация — группировка поисковых запросов, которые можно продвигать одной страницей. Надёжнее группировать по совпадению адресов в топе выдачи, чем по общим словам.

Принцип: один кластер, один интент, одна страница. Иначе страницы конкурируют за одни запросы (каннибализация).

У нас 1 431 фраза дала 260 кластеров (1 054 фразы) и 377 одиночек. URL кластеров брали из выдачи через Arsenkin. Кластер «семантическое ядро», например, — 20 ключевых слов с информационным интентом.

Кластер «семантическое ядро» в таблице семантического ядра
Кластер «семантическое ядро»: 20 фраз с общим топом выдачи → одна статья

Одиночки — не мусор.

У них просто не нашлось общей выдачи: часть станет отдельными страницами, часть уйдёт в тексты. Длинный хвост из пяти и более слов кластеризовали отдельно, с более мягким порогом: общих URL у них меньше.

Шаг 6. Распределите кластеры по страницам

Цепочка: кластер → тип страницы (главная, услуга с гео-привязкой, категория, карточка товара, статья блога) → существующий или новый URL. За каждым URL закрепляйте один кластер.

Формат у нас назначало правило по интенту, гео и вопросности. Правило — подсказка, под нишу его меняют. Одиночки распределяют вручную: в тексты подходящих разделов или в план новых.

Что делать с готовым семантическим ядром

Не оставляйте его файлом в папке.

Сначала структура сайта, затем контент-план: какие статьи и коммерческие страницы создать и в каком порядке. Дальше ТЗ на тексты и заголовки, перелинковка разделов одной темы и оптимизация существующих.

Важные запросы добавьте в «Избранные» в Вебмастере и следите за средней позицией. В отчёте об эффективности Search Console видно, по каким запросам страница начала показываться.

Семантику обновляют при запуске новых услуг или разделов и при изменении спроса.

Пригодится оно и для Яндекс Директа: ключевые слова и минус-фразы.

Как мы собрали семантическое ядро для своего сайта

Воронка ядра creativity-lab.ru целиком (сентябрь 2026, Яндекс, Москва):

Этап Фраз
Собрано из источников 81 809
Без точных дублей 76 683
После чистки 59 236
Отправлено на съём частотности 11 312
Со снятой частотой в итоговом пуле 10 726
В ядре 1 431
Кластеров / одиночных фраз 260 / 377

Про строку 11 312: 586 ключей с уже снятой частотой ушли на приёмке после правки минус-словаря. Лимиты за них потрачены, это цена возврата к чистке.

До ядра дошло меньше 2% собранных строк.

Платная часть — 22 672 лимита Arsenkin: 48 на тесты, остальное на два типа частотности для 11 312 фраз.

Сервисы для сбора семантики и ключевых слов

Инструменты по задачам, доступ указан по страницам сервисов на 1 октября 2026 года:

Задача Примеры Доступ
Частотность и расширение Яндекс Вордстат, Wordstat Assistant аккаунт Яндекса; Assistant — расширение браузера
Базы фраз Букварикс бесплатно
Запросы конкурентов Keys.so, SpyWords, Semrush, Serpstat платные, есть пробный или бесплатный режим
Свои запросы Вебмастер, Search Console, Метрика данные своего сайта
Обработка Key Collector, Excel программа и таблицы
Съём частот и кластеризация Arsenkin платный, по лимитам

Отчёты Вебмастера и Search Console по запросам доступны по подтверждённому сайту: владельцу и тем, кому он выдал доступ.

Ядро для интернет-магазина, нового и работающего сайта

Новый сайт. Составить семантическое ядро нужно до разработки, чтобы структура и разделы сразу строились под спрос. Своих данных поиска нет, опора — маски, базы ключевых слов, конкуренты и подбор запросов по рынку в Вебмастере (бета).

Работающий сайт. Добавьте его запросы: у нас 725 из 1 055 строк Search Console и 489 из 500 строк Вебмастера не встречались в других источниках.

Интернет-магазин. Больше коммерческих запросов и форматов: категории, фильтры, карточки товаров. Информационные кластеры уходят в блог.

Сколько запросов должно быть в ядре? Зависит от ниши и ассортимента. У нас 1 431 фраза, для другого сайта эта цифра ничего не задаёт.

Типичные ошибки при составлении семантического ядра

Только высокочастотные запросы. Теряется низкочастотный хвост с темами для новых материалов.

Частотность без региона. Структура строится на чужом спросе.

Нулевая точная частота. Страницы создаются под спрос, которого нет.

Словарный интент как окончательный. Коммерческие и информационные запросы смешиваются в одной группе, и страница не отвечает ни одному интенту.

Группировка по общим словам и выброшенные одиночки. Страницы конкурируют между собой, темы для текстов теряются.

Забытый архив. Нужные ключи остаются среди выброшенного, а семантика без обновлений отстаёт от бизнеса.

Чек-лист сбора семантического ядра

Проверьте своё ядро или работу подрядчика:

  • маски согласованы;
  • источники собраны;
  • дубли и мусор убраны;
  • архив выброшенного просмотрен;
  • точная частотность снята в нужном регионе;
  • кластеры собраны по выдаче;
  • каждый кластер закреплён за страницей.

Если на сбор семантики нет времени или нужен второй взгляд на готовое ядро, обсудите проект с нашей командой или получите консультацию.

СВЯЗАТЬСЯ

Задать вопрос

Если у вас остались вопросы, напишите или позвоните нам по телефону, оперативно ответим.