Ядро описывает страницы, а не слова
Семантическое ядро — это решение о структуре сайта, записанное через запросы. Не таблица фраз с частотностями, а ответ на вопрос: какие страницы должны существовать и что на каждой написано.
Разница видна на выходе. Файл из четырёх тысяч строк с колонкой «частотность» не говорит, что делать завтра. Список из шестидесяти будущих страниц, у каждой из которых понятно назначение, — говорит.
Отсюда следует критерий готовности ядра, который легко проверить: если из документа нельзя составить список URL, ядра ещё нет. Есть выгрузка запросов.
Что поисковая система делает с запросом
Прежде чем искать документы, поисковик решает другую задачу — понимает, чего человек хочет. Это ключ ко всему остальному в теме.
Строки текста система не сопоставляет. «Стоимость разработки сайта» и «сколько стоит сделать сайт» не имеют ни одного общего значимого слова, но описывают одно желание, и выдача по ним будет почти одинаковой. Наоборот, «купить ноутбук» и «как выбрать ноутбук» делят и слово, и предмет — а показывают разное: в первом случае карточки и каталоги, во втором статьи и подборки.
Пока это не усвоено, кластеризация делается по словам и даёт неверную структуру. Как только усвоено, становится ясно, чем группировать: реакцией самой поисковой системы.
Четыре намерения и что каждое требует от страницы
Намерение (интент) — то, что человек рассчитывает получить, набрав запрос. Тип страницы выводится из него почти механически.
| Интент | Чего хочет человек | Тип страницы | Признак в выдаче |
|---|---|---|---|
| Информационный | Понять, разобраться, научиться | Статья, руководство, определение | Статьи, блоки с ответами, видео |
| Навигационный | Попасть в конкретное место | Главная, страница бренда, контакты | Официальный сайт первым, мало разнообразия |
| Исследовательский | Сравнить и выбрать | Подборка, сравнение, обзор | Списки «лучшие», сравнительные таблицы |
| Транзакционный | Купить, заказать, скачать | Карточка, каталог, страница услуги | Каталоги, карточки, реклама, цены в описаниях |
Локальность — не пятый интент, а надстройка над остальными. Запрос «стоматология рядом» остаётся транзакционным, но выдача добавляет карту и карточки организаций, и конкуренция уходит в локальную выдачу, где сайт — только один из сигналов.
Смешанные случаи встречаются чаще чистых. По запросу «CRM» выдача одновременно показывает определение, обзор систем и сайты вендоров — значит, поисковик не уверен в намерении и страхуется. Такой запрос нельзя брать целевым для одной страницы: любая из них закроет треть спроса.
Откуда берутся запросы
Источников больше, чем обычно используют, и самый ценный часто игнорируют.
Свои показы. Панель вебмастера отдаёт запросы, по которым сайт уже показывался. Это единственный источник, где данные про вас, а не про рынок вообще. Строки с показами и без кликов — прямой список тем, где страница есть, но она мимо.
Подсказки поиска и блоки «похожие запросы». Продолжения строки и связанные формулировки внизу выдачи. Собираются перебором начальных букв, дают живой язык вместо словарного.
Планировщики и статистика показов. Основной массив с частотностями. Ограничение — они склеивают формы и показывают спрос за прошедший период.
Внутренний поиск по сайту. Что люди ищут, уже придя к вам. Обычно это дыры в структуре, описанные их словами.
Страницы конкурентов. Не запросы, а заголовки и разделы — из них видно, какие темы рынок считает обязательными.
Почему кластеризация по выдаче честнее
Механика простая. По каждому запросу берётся верхняя часть выдачи — скажем, первые десять адресов. Два запроса сравниваются по числу общих URL. Много общих — поисковик решает обе задачи одними документами, значит, и вам хватит одной страницы. Пересечения нет — задачи разные.
Ценность приёма в том, что решение принимает не человек с его представлениями о синонимах, а система, которая будет вас ранжировать. Вы не угадываете её мнение — вы его считываете.
Дальше есть развилка в способе сборки групп. При строгом варианте в группу попадают запросы, каждый из которых пересекается с каждым. При мягком достаточно пересечения с центральным запросом группы. Первый даёт узкие и надёжные кластеры, второй — крупные и рыхлые, где крайние элементы уже не связаны друг с другом.
Как порог меняет архитектуру сайта
Порог — минимальное число общих адресов, при котором запросы считаются родственными. Это единственный параметр, который меняет проектируемый сайт сильнее всех остальных решений.
| Порог | Что получится | Риск |
|---|---|---|
| Строгий (много общих URL) | Много мелких групп, дробная структура | Десятки тонких страниц, конкурирующих между собой |
| Средний | Группы размером с полноценную тему | Требует ручной проверки спорных стыков |
| Мягкий (мало общих URL) | Несколько крупных групп | Страница пытается ответить на всё сразу и не отвечает ни на что |
Правильного значения не существует — оно зависит от тематики. В узких нишах выдача устойчивая, и строгий порог работает. В широких коммерческих темах верх выдачи перемешивается от запроса к запросу, и строгий порог рассыплет ядро в пыль.
Практический выход: считать при двух порогах и сравнивать. Разница между результатами — это ровно те решения, которые придётся принять руками.
Что делать с ядром после сборки
Ядро само по себе ничего не улучшает. Дальше идут четыре действия, и порядок здесь важен.
Первое — сопоставить группы с существующими страницами. Часть уже закрыта, часть закрыта дважды (две страницы под одну группу — повод для канонической ссылки или объединения), часть не закрыта совсем.
Второе — расставить приоритет. Не по частотности: высокочастотная группа обычно самая конкурентная и самая далёкая от денег. Разумнее сортировать по близости к сделке и по тому, есть ли у вас что сказать по теме содержательно.
Третье — превратить группу в задание на страницу: главный запрос, второстепенные формулировки, обязательные подтемы, тип страницы, куда она ссылается и откуда получает ссылки.
Четвёртое — связать новые страницы с существующими. Без этого они долго не попадут в индекс: робот узнаёт о страницах в основном по ссылкам, а перелинковка — единственный рычаг, полностью подконтрольный вам.
Где метод перестаёт работать
Кластеризация по выдаче опирается на предположение, что выдача стабильна и отражает намерение. Оба условия выполняются не всегда.
Редкие запросы. По формулировке с единичными показами выдача случайна: система не набрала данных и подставляет что-то похожее. Пересечения по таким запросам ничего не доказывают.
Персонализация и геозависимость. По локальным темам два человека видят разную выдачу. Кластеризация даёт результат, привязанный к одному городу, и молча ломается при переносе на другой.
Новые темы. Ни частотности, ни устойчивой выдачи ещё нет. Ядро тут бесполезно, а страница может быть нужна — спрос виден в переписке с клиентами раньше, чем в статистике.
Запросы без кликов. Часть информационных запросов закрывается прямо в выдаче — блоком с ответом или ответом нейросети. Группа существует, страницу под неё написать можно, а переходов не будет. Проверять это до написания дешевле, чем после.
Устаревание. Кластеризация — снимок выдачи на конкретный день. Через полгода часть групп уже неверна, но файл выглядит так же убедительно, как в день сборки.
Масштаб чистки виден на реальных данных: в разборе видимости 16 сайтов агентств из 305 435 строк выгрузок после схлопывания перестановок осталось 22 862 уникальные темы. Всё остальное было одним и тем же запросом, записанным по-разному.
Спорное место
Кластеризация по выдаче — способ скопировать структуру, которая уже победила. Это её сила и её же потолок.
Вы получаете сайт, устроенный как средний сайт из топа, и соревнуетесь с ним по правилам, где у него фора: возраст, ссылки, накопленные поведенческие данные. Метод хорошо отвечает на вопрос «как не отстать» и почти никогда — на вопрос «чем быть лучше».
Второе неудобство честнее признать прямо: ядро отлично защищает от обвинений. Файл на четыре тысячи строк выглядит как проделанная работа, даже если ни одной страницы по нему не написано. Полезнее держать перед глазами другое число — сколько групп из ядра уже закрыто живыми страницами, получающими показы.
Частые вопросы
Сколько запросов должно быть в ядре?
Можно ли кластеризовать запросы вручную?
Что делать с запросами нулевой частотности?
Нужно ли включать в ядро брендовые запросы конкурентов?
Как часто пересобирать ядро?
Источники
- Поисковый запрос — Wikipedia