Медиана

Семантическое ядро: как собрать и что с ним делать

Семантическое ядро — карта нужных сайту страниц, а не список слов. Разбор интентов, кластеризация по совместной встречаемости в выдаче, таблица соответствий.

Обновлено 12.08.2026 · 6 мин чтения

Семантическое ядро — набор запросов, сгруппированных так, что каждая группа соответствует одной странице сайта. Ценность не в количестве фраз, а в решении, сколько страниц нужно и о чём каждая. Группировка делается по совпадению выдачи: если поисковик показывает по двум запросам одни документы, он считает их одной задачей.

Коротко

  • Ядро отвечает не на вопрос «какие слова вставить», а на вопрос «сколько страниц нужно сайту и о чём каждая».
  • Группировать запросы по совпадению слов бесполезно: «купить ноутбук» и «как выбрать ноутбук» делят слово, но требуют разных страниц.
  • Рабочий признак родства двух запросов — пересечение выдачи по ним, потому что это мнение самой поисковой системы.
  • Порог кластеризации решает архитектуру сайта раньше, чем это делает человек, — строгий порог дробит структуру, мягкий склеивает.
  • Собранное и неразобранное ядро не даёт ничего, кроме иллюзии подготовки.

Ядро описывает страницы, а не слова

Семантическое ядро — это решение о структуре сайта, записанное через запросы. Не таблица фраз с частотностями, а ответ на вопрос: какие страницы должны существовать и что на каждой написано.

Разница видна на выходе. Файл из четырёх тысяч строк с колонкой «частотность» не говорит, что делать завтра. Список из шестидесяти будущих страниц, у каждой из которых понятно назначение, — говорит.

Отсюда следует критерий готовности ядра, который легко проверить: если из документа нельзя составить список URL, ядра ещё нет. Есть выгрузка запросов.

Что поисковая система делает с запросом

Прежде чем искать документы, поисковик решает другую задачу — понимает, чего человек хочет. Это ключ ко всему остальному в теме.

Строки текста система не сопоставляет. «Стоимость разработки сайта» и «сколько стоит сделать сайт» не имеют ни одного общего значимого слова, но описывают одно желание, и выдача по ним будет почти одинаковой. Наоборот, «купить ноутбук» и «как выбрать ноутбук» делят и слово, и предмет — а показывают разное: в первом случае карточки и каталоги, во втором статьи и подборки.

Пока это не усвоено, кластеризация делается по словам и даёт неверную структуру. Как только усвоено, становится ясно, чем группировать: реакцией самой поисковой системы.

Четыре намерения и что каждое требует от страницы

Намерение (интент) — то, что человек рассчитывает получить, набрав запрос. Тип страницы выводится из него почти механически.

ИнтентЧего хочет человекТип страницыПризнак в выдаче
ИнформационныйПонять, разобраться, научитьсяСтатья, руководство, определениеСтатьи, блоки с ответами, видео
НавигационныйПопасть в конкретное местоГлавная, страница бренда, контактыОфициальный сайт первым, мало разнообразия
ИсследовательскийСравнить и выбратьПодборка, сравнение, обзорСписки «лучшие», сравнительные таблицы
ТранзакционныйКупить, заказать, скачатьКарточка, каталог, страница услугиКаталоги, карточки, реклама, цены в описаниях

Локальность — не пятый интент, а надстройка над остальными. Запрос «стоматология рядом» остаётся транзакционным, но выдача добавляет карту и карточки организаций, и конкуренция уходит в локальную выдачу, где сайт — только один из сигналов.

Смешанные случаи встречаются чаще чистых. По запросу «CRM» выдача одновременно показывает определение, обзор систем и сайты вендоров — значит, поисковик не уверен в намерении и страхуется. Такой запрос нельзя брать целевым для одной страницы: любая из них закроет треть спроса.

Откуда берутся запросы

Источников больше, чем обычно используют, и самый ценный часто игнорируют.

Свои показы. Панель вебмастера отдаёт запросы, по которым сайт уже показывался. Это единственный источник, где данные про вас, а не про рынок вообще. Строки с показами и без кликов — прямой список тем, где страница есть, но она мимо.

Подсказки поиска и блоки «похожие запросы». Продолжения строки и связанные формулировки внизу выдачи. Собираются перебором начальных букв, дают живой язык вместо словарного.

Планировщики и статистика показов. Основной массив с частотностями. Ограничение — они склеивают формы и показывают спрос за прошедший период.

Внутренний поиск по сайту. Что люди ищут, уже придя к вам. Обычно это дыры в структуре, описанные их словами.

Страницы конкурентов. Не запросы, а заголовки и разделы — из них видно, какие темы рынок считает обязательными.

Почему кластеризация по выдаче честнее

Механика простая. По каждому запросу берётся верхняя часть выдачи — скажем, первые десять адресов. Два запроса сравниваются по числу общих URL. Много общих — поисковик решает обе задачи одними документами, значит, и вам хватит одной страницы. Пересечения нет — задачи разные.

Ценность приёма в том, что решение принимает не человек с его представлениями о синонимах, а система, которая будет вас ранжировать. Вы не угадываете её мнение — вы его считываете.

Дальше есть развилка в способе сборки групп. При строгом варианте в группу попадают запросы, каждый из которых пересекается с каждым. При мягком достаточно пересечения с центральным запросом группы. Первый даёт узкие и надёжные кластеры, второй — крупные и рыхлые, где крайние элементы уже не связаны друг с другом.

Как порог меняет архитектуру сайта

Порог — минимальное число общих адресов, при котором запросы считаются родственными. Это единственный параметр, который меняет проектируемый сайт сильнее всех остальных решений.

ПорогЧто получитсяРиск
Строгий (много общих URL)Много мелких групп, дробная структураДесятки тонких страниц, конкурирующих между собой
СреднийГруппы размером с полноценную темуТребует ручной проверки спорных стыков
Мягкий (мало общих URL)Несколько крупных группСтраница пытается ответить на всё сразу и не отвечает ни на что

Правильного значения не существует — оно зависит от тематики. В узких нишах выдача устойчивая, и строгий порог работает. В широких коммерческих темах верх выдачи перемешивается от запроса к запросу, и строгий порог рассыплет ядро в пыль.

Практический выход: считать при двух порогах и сравнивать. Разница между результатами — это ровно те решения, которые придётся принять руками.

Что делать с ядром после сборки

Ядро само по себе ничего не улучшает. Дальше идут четыре действия, и порядок здесь важен.

Первое — сопоставить группы с существующими страницами. Часть уже закрыта, часть закрыта дважды (две страницы под одну группу — повод для канонической ссылки или объединения), часть не закрыта совсем.

Второе — расставить приоритет. Не по частотности: высокочастотная группа обычно самая конкурентная и самая далёкая от денег. Разумнее сортировать по близости к сделке и по тому, есть ли у вас что сказать по теме содержательно.

Третье — превратить группу в задание на страницу: главный запрос, второстепенные формулировки, обязательные подтемы, тип страницы, куда она ссылается и откуда получает ссылки.

Четвёртое — связать новые страницы с существующими. Без этого они долго не попадут в индекс: робот узнаёт о страницах в основном по ссылкам, а перелинковка — единственный рычаг, полностью подконтрольный вам.

Где метод перестаёт работать

Кластеризация по выдаче опирается на предположение, что выдача стабильна и отражает намерение. Оба условия выполняются не всегда.

Редкие запросы. По формулировке с единичными показами выдача случайна: система не набрала данных и подставляет что-то похожее. Пересечения по таким запросам ничего не доказывают.

Персонализация и геозависимость. По локальным темам два человека видят разную выдачу. Кластеризация даёт результат, привязанный к одному городу, и молча ломается при переносе на другой.

Новые темы. Ни частотности, ни устойчивой выдачи ещё нет. Ядро тут бесполезно, а страница может быть нужна — спрос виден в переписке с клиентами раньше, чем в статистике.

Запросы без кликов. Часть информационных запросов закрывается прямо в выдаче — блоком с ответом или ответом нейросети. Группа существует, страницу под неё написать можно, а переходов не будет. Проверять это до написания дешевле, чем после.

Устаревание. Кластеризация — снимок выдачи на конкретный день. Через полгода часть групп уже неверна, но файл выглядит так же убедительно, как в день сборки.

Масштаб чистки виден на реальных данных: в разборе видимости 16 сайтов агентств из 305 435 строк выгрузок после схлопывания перестановок осталось 22 862 уникальные темы. Всё остальное было одним и тем же запросом, записанным по-разному.

Спорное место

Кластеризация по выдаче — способ скопировать структуру, которая уже победила. Это её сила и её же потолок.

Вы получаете сайт, устроенный как средний сайт из топа, и соревнуетесь с ним по правилам, где у него фора: возраст, ссылки, накопленные поведенческие данные. Метод хорошо отвечает на вопрос «как не отстать» и почти никогда — на вопрос «чем быть лучше».

Второе неудобство честнее признать прямо: ядро отлично защищает от обвинений. Файл на четыре тысячи строк выглядит как проделанная работа, даже если ни одной страницы по нему не написано. Полезнее держать перед глазами другое число — сколько групп из ядра уже закрыто живыми страницами, получающими показы.

Частые вопросы

Сколько запросов должно быть в ядре?

Правильного числа нет, и погоня за размером обычно вредит. Осмысленный ориентир другой — сколько страниц вы готовы написать и поддерживать. Ядро на десять тысяч фраз при возможности выпускать две страницы в неделю превращается в архив, который устареет раньше, чем его разберут.

Можно ли кластеризовать запросы вручную?

На малых объёмах да, и результат часто честнее автоматического. Ручная группировка ломается, когда интуиция расходится с выдачей. Проверка простая — открыть выдачу по двум запросам и сравнить, кого показывают. Если наборы страниц не пересекаются, объединять запросы нельзя, даже если они кажутся синонимами.

Что делать с запросами нулевой частотности?

Смотреть, не признак ли это новой темы. Ноль в статистике означает, что систему сбора данных запрос ещё не набрал, а не отсутствие спроса. Если формулировка описывает реальную задачу и встречается в вопросах клиентов, она может стать частью страницы — просто не поводом для отдельной.

Нужно ли включать в ядро брендовые запросы конкурентов?

Они собираются для понимания рынка, но ложатся в структуру плохо. Страница, сделанная под чужое имя, почти всегда проигрывает официальному сайту бренда и живёт на остатках трафика. Исключение — честные сравнения, где ваш продукт стоит рядом с чужим и разбор действительно есть.

Как часто пересобирать ядро?

Полностью — редко, точечно — постоянно. Пересборка нужна, когда меняется ассортимент, появляется новая услуга или выдача по важной группе визуально перестроилась. Отдельный повод — свои же запросы из панели вебмастера, по которым уже идут показы, но подходящей страницы нет.

Источники

  1. Поисковый запрос — Wikipedia
Артём Строев
Пишу про измеримый маркетинг и видимость в ИИ-поиске. Публикуюсь под псевдонимом — почему так.