
Кластеризация запросов решает ровно один вопрос: сколько страниц нужно сайту и какие фразы попадут на каждую. Не «сгруппировать по смыслу», не «разложить по темам красиво», а получить проверяемый ответ, можно ли вывести две фразы одной страницей. Ответ этот даёт не человек и не словарь синонимов, а сама выдача — по тому, совпадают ли сайты в топе. Ниже — механика группировки от порога совпадений до ручной проверки готовых групп и до того, что делать с запросами, которые не собираются ни с чем.
Разговор именно про механику. Сбор семантического ядра, чистку и работу с ядром целиком я разбирал отдельно; здесь только шаг, который превращает список фраз в список страниц. Ошибка на нём стоит дороже почти всех остальных: под неверно собранный кластер пишут текст, делают страницу, покупают ссылки, а потом полгода не понимают, почему страница стоит на четвёртой десятке по половине своих запросов.
Почему группировать «по смыслу» нельзя
Человеку кажется очевидным, что «пластиковые окна цена» и «стоимость пластиковых окон» — одно и то же, а «купить окна» и «окна купить» — тем более. Обычно так и есть. Проблема в другом: интуиция ломается ровно там, где цена ошибки самая высокая.
Примеры, на которых спотыкаются регулярно. «Ремонт квартир» и «ремонт квартир под ключ» по смыслу почти одно, а в выдаче могут стоять разные типы страниц: общая услуга и отдельное предложение с фиксированной ценой. «Натяжные потолки» и «натяжные потолки цена» — та же история. «Кондиционер купить» и «кондиционер с установкой» звучат как соседние фразы, а обслуживают разные намерения, и топ по ним пересекается слабо.
Обратное тоже встречается: фразы, которые кажутся разными, поиск обслуживает одной и той же страницей. «Циклёвка паркета» и «шлифовка паркета» — для мастера это разные работы, для поиска чаще всего одна услуга, потому что люди используют оба слова вперемешку.
Вывод простой. Смысл — это ваша гипотеза о том, что человек имел в виду. Выдача — накопленный ответ поиска о том, что людям на самом деле показывают и по чему они кликают. Проверять надо по второму.
Общие URL в топе — единственный проверяемый критерий
Механика в основе простая. Для каждой фразы из списка снимается топ выдачи — обычно первые десять результатов, в нужном регионе, без персонализации. Дальше два запроса сравниваются по числу совпадающих адресов страниц. Не доменов, а именно адресов: если по обеим фразам в топе есть один и тот же сайт, но разными страницами, это не совпадение, а ровно наоборот — признак, что сайт развёл фразы по разным страницам.
Если совпадений достаточно, фразы считаются совместимыми: значит, поиск уже показывает по ним одни и те же страницы, и одна ваша страница тоже сможет отвечать на обе. Если совпадений мало, фразы разводятся, сколько бы близко они ни звучали.
| Что сравнивается | Как считается | Почему именно так |
|---|---|---|
| Адреса страниц в топ-10 | Число полностью совпадающих URL | Показывает, обслуживает ли одна страница оба запроса |
| Домены в топ-10 | Не используется как основной критерий | Один сайт может занимать топ разными страницами |
| Регион | Фиксируется до снятия выдачи | По геозависимым фразам выдача разная в каждом городе |
| Глубина выдачи | Топ-10, иногда топ-20 | Дальше десятки состав нестабилен и портит расчёт |
| Агрегаторы и карты | Часто исключаются из подсчёта | Они стоят почти по всем фразам и склеивают несклеиваемое |
Последняя строка объясняет типичную аномалию. Если в нише топ забит маркетплейсами и справочниками, они попадают в пересечение всех фраз подряд, и алгоритм склеивает в один кластер вещи, которые к друг другу отношения не имеют. Поэтому перед расчётом такие сайты либо исключают, либо снимают выдачу глубже и считают по обычным сайтам.
Порог совпадений: что меняют цифры 3, 4 и 5
Порог — число общих адресов, при котором две фразы признаются совместимыми. От него зависит всё: и число получившихся кластеров, и их надёжность.
| Порог | Что получается | Когда применять | Риск |
|---|---|---|---|
| 2 | Крупные разнородные группы | Почти никогда | В кластер попадают чужие фразы |
| 3 | Умеренно крупные группы | Ниши с малой конкуренцией, широкие темы | Часть групп придётся разбивать руками |
| 4 | Компактные, обычно достоверные группы | Рабочий вариант для большинства коммерческих ниш | Небольшой, требует выборочной проверки |
| 5 | Мелкие, очень надёжные группы | Высококонкурентные тематики, дорогие страницы | Много одиночных фраз, структура разрастается |
| 6 и выше | Почти каждая фраза сама по себе | Только для точечной проверки пары фраз | Сотни страниц под фразы-синонимы |
Практическое правило: начинайте с четырёх. Если кластеров получилось столько, что под них не хватит ни сил, ни контента, снижайте до трёх и проверяйте руками верхние группы. Если внутри групп видна каша из разных намерений, поднимайте до пяти.
Если нужны детали, смотрите «Кластеризация запросов: 80% сайтов тратят бюджет на копирайтинг впустую».
Важный момент, который экономит время: порог не обязан быть одинаковым для всего ядра. Для основных коммерческих направлений, под которые вы всерьёз будете делать страницы, разумно ставить пять — цена ошибки высокая. Для длинного хвоста уточнённых фраз хватает трёх, потому что там ошибка стоит одного абзаца текста, а не целой страницы.
Soft и hard: в чём практическая разница
Помогу с продвижением: вывод сайта в ТОП Яндекса — вывожу сайты в топ Яндекса белыми методами.
Два способа собрать группу из совместимых пар. Разница в том, насколько строго проверяется совместимость внутри группы.
Soft работает так: выбирается опорная фраза — обычно самая частотная, — и к ней притягивается всё, что с ней совместимо. При этом фразы внутри группы между собой не проверяются. В результате в одном кластере могут оказаться две фразы, которые с опорной совместимы, а друг с другом нет.
Hard требует, чтобы каждая фраза группы была совместима с каждой другой. Группа получается меньше и надёжнее: любые две фразы в ней действительно обслуживаются общими страницами.
Если интересно направление с сайтами — базу даю в своём курсе:
| Признак | Soft | Hard |
|---|---|---|
| Проверка внутри группы | Каждая фраза с опорной | Каждая с каждой |
| Размер кластеров | Крупные | Мелкие |
| Число кластеров | Меньше | Больше |
| Достоверность | Средняя, нужна ручная проверка | Высокая |
| Одиночные фразы | Мало | Много |
| Для чего подходит | Первичный обзор ядра, широкие информационные темы | Коммерческие посадочные, конкурентные ниши |
Как я это применяю на практике. Сначала soft при пороге три — чтобы увидеть общую картину: сколько крупных тем в нише и как они соотносятся. Это черновая карта, по ней принимаются решения о структуре разделов. Затем hard при пороге четыре или пять внутри каждой крупной темы — уже под конкретные страницы. Такой двойной проход занимает немного больше времени, зато итог не приходится переделывать после первых же замеров позиций.
Как снимать выдачу и проверять готовые группы
Расчёт настолько хорош, насколько хороши исходные данные. Четыре условия, без которых кластеризация даёт случайный результат.
Подробнее об этом — в статье «Виды поисковых запросов».
- Один регион для всего ядра. По геозависимым фразам топ в Москве и Екатеринбурге разный, и смешивать их нельзя. Если бизнес работает в нескольких городах, кластеризация делается отдельно по каждому основному.
- Одна поисковая система. Яндекс и Google дают разную выдачу, и группы по ним не совпадают. Выбирают ту систему, откуда идёт основной трафик.
- Одномоментность съёма. Выдача меняется, и топ, снятый в понедельник, не сравним с топом, снятым через три недели. Всё ядро снимается за один заход.
- Без персонализации. Собственная история поиска подмешивает знакомые сайты, поэтому проверка руками делается в режиме инкогнито с явно заданным регионом.
Отдельно про устройства. По части тематик мобильная и десктопная выдача расходятся заметно — там, где сильны карты и справочники. Если больше половины трафика приходит с телефонов, снимать выдачу разумно по мобильной версии, а не по десктопной, иначе группировка отражает поведение меньшинства аудитории.
Когда данные сняты правильно и расчёт выполнен, остаётся ручная проверка. Ни один сервис не выдаёт готовый к работе результат. Верхние группы, под которые вы будете делать основные страницы, проверяются глазами. На группу уходит две-три минуты, и это самая окупаемая часть работы.
- Одно ли намерение у всех фраз? Прочитайте группу подряд. Если рядом стоят «монтаж кондиционера цена» и «как установить кондиционер самому» — намерения разные, и вторую фразу надо вынести, каким бы ни был расчёт.
- Можно ли назвать группу одним заголовком? Попробуйте написать h1 для будущей страницы. Если заголовок получается через «и» с перечислением трёх услуг — группа не одна, а три.
- Есть ли в группе фраза, которая тянет в другую сторону? Чаще всего это фраза с чужим брендом, с уточнением «бу», «аренда», «своими руками» или с названием города, где вы не работаете.
Дополнительная проверка для сомнительных групп: возьмите две самые непохожие фразы из неё и откройте выдачу по каждой. Если топы визуально разные — расчёт ошибся, обычно из-за агрегаторов в пересечении. Разбивайте.
Запросы, которые не собираются ни с чем
После любой кластеризации остаётся хвост одиночек. Это нормально и не означает, что расчёт неудачный. Важно правильно разобрать этот хвост, потому что в нём попадаются как мусор, так и самые конверсионные фразы ядра.
| Почему фраза одинока | Как узнать | Что делать |
|---|---|---|
| Слишком редкая, выдача нестабильна | Точная частота — единицы | Дописать в ближайший по смыслу кластер как дополнительный подзаголовок |
| Другое намерение | В топе статьи вместо коммерческих страниц | Вынести в план блога |
| Отдельная услуга или товар | Топ занят узкоспециализированными страницами | Отдельная страница, это находка, а не проблема |
| Ошибка в фразе или опечатка | Выдача не по теме | Удалить |
| Слишком общая фраза | Топ из главных страниц крупных сайтов | Отнести к главной или к разделу, отдельную страницу не делать |
| Порог завышен | При понижении на единицу фраза уходит в кластер | Проверить группу вручную и принять решение |
Третья строка — самая ценная. Одиночная фраза с узкой выдачей часто означает нишу, которую конкуренты не закрыли отдельной страницей. Такие страницы выходят в топ быстро и приносят заявки при небольшом трафике.
Первая строка требует пояснения. У очень редких фраз выдача формируется по расширенному соответствию, и совпадений с соседями почти нет — не потому, что намерение другое, а потому, что поиску не хватает данных. Такие фразы не заслуживают отдельной страницы: их учитывают как подзаголовок или абзац внутри подходящего кластера.
От кластеров к страницам: где ломается переход
Если нужна помощь по теме — обучение SEO-продвижению.
Кластер и страница — не одно и то же. Между ними стоит решение, которое принимает человек, и здесь возникают две симметричные ошибки.
Слишком много страниц. Каждый мелкий кластер получает отдельную страницу, сайт разрастается до сотен почти одинаковых текстов, они начинают конкурировать между собой, и поиск сам выбирает, какую показать, — обычно не ту. Признак: страницы отличаются друг от друга только парой слов в заголовке.
Тему разбирал отдельно: «Язык запросов в интернете».
Слишком мало страниц. Несколько разных кластеров сваливают на одну страницу «чтобы не плодить». Страница получается ни о чём конкретном, по каждому кластеру проигрывает специализированным конкурентам и не выходит в топ ни по одной группе.
Ориентир для принятия решения такой. Отдельная страница нужна, если под кластер есть что написать по существу — состав работ, цена, сроки, отличия, — и если это отличается от соседнего кластера не формулировкой, а содержанием. Если разница только в порядке слов, кластеры объединяют, а редкие формулировки закрывают подзаголовками внутри одной страницы.
- Одна страница — одна группа запросов с одним намерением.
- У каждой страницы свой уникальный заголовок и своё описание, отражающие её кластер.
- Если два кластера просятся на одну страницу, проверьте выдачу: если топы совпадают наполовину, объединяйте.
- Список «кластер — адрес страницы» ведётся отдельным файлом и обновляется при любом изменении структуры.
Ошибки кластеризации и их последствия через полгода
Дефекты группировки проявляются не сразу, а когда страницы уже написаны и проиндексированы. По симптомам можно опознать, где именно ошиблись.
| Симптом | Что произошло | Как чинить |
|---|---|---|
| По одному запросу поиск показывает то одну, то другую страницу | Два кластера пересекаются, страницы конкурируют | Объединить страницы, поставить 301 со слабой на сильную |
| Страница стоит в топе по трети своих фраз и не видна по остальным | Кластер собран мягко, внутри разные намерения | Разделить кластер, вынести лишние фразы на новую страницу |
| Десятки страниц не выходят выше пятой десятки | Кластеры дробные, страницы почти одинаковые | Склеить в укрупнённые страницы с подзаголовками |
| Позиции хорошие, обращений нет | В кластер попали информационные фразы | Перепроверить намерение по выдаче, развести коммерцию и блог |
| В одном городе позиции есть, в другом нет | Кластеризация сделана по одному региону | Пересчитать по каждому основному городу |
Первая строка — та самая каннибализация, и лечится она не переписыванием текстов, а решением на уровне структуры: какая страница остаётся главной по группе, а какая уходит с редиректом. Косметические правки заголовков дают временный эффект и через месяц всё возвращается.
Порядок работы: от списка фраз до карты страниц
- Зафиксировать регион, поисковую систему и тип устройства, по которым будет сниматься выдача.
- Почистить список: убрать нулевые по точной частоте фразы, чужие бренды, города вне зоны работы, явный мусор.
- Снять выдачу по всему списку за один заход.
- Прогнать soft при пороге три — получить черновую карту крупных тем.
- Внутри каждой крупной темы прогнать hard при пороге четыре, для главных коммерческих направлений — пять.
- Проверить руками верхние группы по трём вопросам: одно намерение, один заголовок, нет ли чужой фразы.
- Разобрать одиночки по таблице: часть уходит в соседние кластеры, часть — в блог, часть становится отдельными страницами.
- Свести карту «кластер — заголовок — адрес страницы» и отметить, каких страниц ещё нет.
- Через два-три месяца после публикации сверить позиции по группам и поправить кластеры, где страница выходит лишь по части фраз.
Частые вопросы
Можно ли кластеризовать без сервисов, руками? На сотне фраз — можно, дольше, но реально: снимаете топ по каждой и сравниваете адреса. На тысяче это уже нерентабельно. Ручной остаётся проверка готовых групп, и её не заменяет ничто.
Как часто нужно пересчитывать кластеры? Раз в полгода для устойчивых ниш и после любого заметного изменения выдачи — например, когда в топ пришли агрегаторы или карты. Полностью пересобирать структуру сайта при этом не нужно, обычно правятся отдельные группы.
Что делать, если по фразе выдача полностью занята агрегаторами? Исключить их из подсчёта и посмотреть, что остаётся из обычных сайтов. Если не остаётся ничего, значит, по этой фразе своей страницей вы не пробьётесь, и работать нужно с уточнёнными формулировками.
Сколько фраз нормально иметь в одном кластере? Жёсткой нормы нет. Для коммерческой страницы обычно от пяти до тридцати формулировок одного намерения. Если фраз двести и они требуют разного ответа, кластер собран мягко и его надо делить.
Влияет ли кластеризация на текст страницы? Влияет напрямую: кластер задаёт, какие подзаголовки должны быть на странице. Если в группе есть фразы про цену, сроки и гарантию, эти блоки должны существовать, а не подразумеваться.
Как быть, если в одном кластере оказались фразы с разной частотой в тысячи раз? Это нормально и даже полезно: высокочастотная фраза задаёт заголовок, низкочастотные раскрываются подзаголовками и абзацами. Разводить их по разным страницам не нужно, если выдача показывает, что намерение одно.
Коротко
- Совместимость фраз определяется числом общих адресов страниц в топе, а не близостью смысла: интуиция ошибается там, где ошибка дороже всего.
- Порог совпадений задаёт всё: четыре — рабочий вариант для коммерческих ниш, пять — для конкурентных и дорогих направлений, три — для длинного хвоста.
- Soft даёт крупные группы для черновой карты ядра, hard — мелкие и надёжные под конкретные посадочные страницы.
- Выдача снимается в одном регионе, в одной поисковой системе, за один заход и без персонализации, иначе результат случаен.
- Верхние группы проверяются вручную по трём вопросам: одно ли намерение, помещается ли группа в один заголовок, нет ли чужой фразы.
- Одиночные фразы разбираются, а не выбрасываются: часть уходит подзаголовками в соседние кластеры, часть в блог, часть становится отдельными страницами с быстрым выходом в топ.
Если у вас есть ядро, но непонятно, во сколько страниц оно должно превратиться и почему готовые страницы стоят только по части своих фраз, приходите на SEO-консультацию: посмотрим ваши группы, проверим спорные по выдаче и составим карту соответствия кластеров и страниц с очередью работ.
Увеличьте позиции и продажи вашего сайта
Профессиональное SEO-продвижение с гарантией результата. Выберите подходящую услугу:
Остались вопросы по продвижению?
Меня зовут Анатолий Кузнецов, я SEO-оптимизатор с 20-летним стажем. Разберу ваш сайт, отвечу на вопросы и подскажу, что улучшить для роста позиций в Яндексе и Google.
Связаться со мной →
Комментарии
Тарас Чепрасов
Про домены против адресов — это то, чего я не понимал год. Считал пересечение по сайтам и удивлялся, что всё склеивается в три огромных кластера. Пересчитал по конкретным страницам, получил двадцать восемь групп, и они наконец похожи на структуру сайта.
Родион Холин
Вопрос по регионам. У нас франшиза, восемнадцать городов, в каждом свой поддомен. Кластеризовать отдельно по каждому — это восемнадцать прогонов и восемнадцать разных структур. Реально ли делать одну структуру на всех и не потерять?
Анатолий Кузнецов автор
Восемнадцать разных структур вам и не нужны, это перебор. Порядок такой. Возьмите два-три города, максимально непохожих по размеру: например, миллионник, средний областной центр и небольшой город. Прогоните кластеризацию по каждому и сравните результаты между собой. В подавляющем большинстве ниш крупные группы совпадут, разойдётся только хвост — там, где в маленьком городе выдачу занимают справочники, а в миллионнике обычные сайты. Дальше берите общую структуру по совпавшей части и делайте её единой для всех поддоменов, а расхождения закрывайте отдельными страницами только в тех городах, где они есть. Так вы сохраняете управляемость и не теряете локальную специфику. И обязательно проверьте на трёх городах ещё раз через полгода: выдача в регионах меняется быстрее, чем в столицах.
Иван Цыганков
Не соглашусь про порог четыре как универсальный. У нас узкая b2b-тематика, обычных сайтов в топе штук пять, остальное каталоги предприятий. При пороге четыре почти всё разваливается на одиночки, работает только три, и то с натяжкой.
Анатолий Кузнецов автор
Ваш случай в статье как раз описан, просто с другой стороны. Если из десяти позиций пять занимают каталоги, то у вас фактически не топ-10, а топ-5, и требовать четыре совпадения из пяти — это порог восемьдесят процентов, чрезмерно жёсткий. Есть два выхода. Первый: считать по топ-20 вместо топ-10, тогда обычных сайтов в выборке станет достаточно и порог четыре заработает нормально. Второй: исключить каталоги из подсчёта заранее и оставить порог три, но проверять группы вручную более придирчиво. Я бы начал с первого, он даёт более устойчивый результат в узких нишах. И проверьте заодно, не стоит ли вам занять места в самих каталогах — раз поиск отдаёт им половину топа, это отдельный канал, который в b2b часто окупается лучше собственных страниц.
Вячеслав Чередниченко
Три вопроса к группе выписал себе на бумажку. Особенно про «можно ли назвать одним заголовком» — сразу стало видно, что у меня в одной группе сидят ремонт, замена и диагностика. Заголовок получался через два «и», и это выглядело нормально ровно до момента, пока не попробовал написать.
Илья Хворостов
Про одиночки с узкой выдачей подтверждаю. Нашли в остатке фразу на восемьдесят показов в месяц, под которую ни у кого не было отдельной страницы. Сделали, вышли в тройку за полтора месяца без ссылок. Заявок с неё больше, чем с главной страницы раздела.
Степан Хохлов
А как быть, если выдача по половине фраз ядра сильно скачет от съёма к съёму? Снимаю в понедельник — один набор, в пятницу — другой, пересечения меняются, и кластеры каждый раз получаются разные.
Анатолий Кузнецов автор
Скачущая выдача означает одно из двух, и это надо развести. Первое: фразы низкочастотные, и по ним поиск не имеет устойчивого набора релевантных страниц — тогда кластеризация по ним и не должна быть стабильной, такие фразы нужно относить к соседним группам по смыслу, а не считать. Второе: у вас в топе высокая доля агрегаторов и новостных страниц, которые ротируются, — тогда исключайте их и считайте по остальным. Проверить, какой случай ваш, просто: возьмите двадцать скачущих фраз и посмотрите точную частоту. Если она в единицах, это первый случай. Если частота приличная, а состав топа меняется — второй. И в любом случае снимайте выдачу целиком за один день: сравнение понедельника с пятницей само по себе даёт разницу, которой на самом деле нет.
Агния Хорева
Симптом «то одна страница, то другая» у нас держался год, и подрядчик каждый раз объяснял его нестабильностью выдачи. После вашей таблицы посмотрела внимательно: у двух страниц пересекаются заголовки и половина текста. Никакая это не нестабильность.
Галина Цыпленкова
Двойной проход soft плюс hard попробовала на ядре из тысячи двухсот фраз. Заняло полдня вместо двух часов, но черновая карта тем действительно помогла: сразу стало ясно, что у нас на сайте нет целого раздела, который есть у всех конкурентов.
Глеб Хохряков
Уточните, пожалуйста, момент про мобильную выдачу. Если снимать по мобильной, а сайт продвигается в основном по десктопным позициям в отчётах подрядчика, не будет ли расхождения в оценке результата?
Анатолий Кузнецов автор
Расхождение будет, но проблема не в кластеризации, а в том, что отчёт показывает не ту реальность. Посмотрите в Метрике долю визитов с телефонов и планшетов по вашему сайту. Если она больше половины, отчёт по десктопным позициям описывает меньшинство вашей аудитории, и его надо перенастраивать, а не подгонять кластеризацию под него. Практический порядок: снимайте выдачу для кластеризации по тому устройству, откуда идёт больше трафика, и попросите добавить в отчёт мобильные позиции хотя бы по основным группам. Дальше сравнивайте динамику по показам в Вебмастере — это единственный источник, где видно реальное положение дел по обоим типам устройств сразу, и он не зависит от того, как настроен съём позиций.
Лаврентий Чебыкин
Хорошо, что написали про разные пороги для основных направлений и для хвоста. Обычно везде советуют одну цифру на всё ядро, а потом получается либо каша в главных группах, либо триста страниц под синонимы.
Елизавета Хайрова
Не хватило разбора ситуации, когда кластеризация показывает, что нужна страница, а её физически нельзя сделать: у нас услуга есть, но описать её отдельно нечем, весь текст будет пересказом соседней страницы другими словами.
Анатолий Кузнецов автор
Это как раз сигнал, что страницу делать не надо, и он важнее расчёта. Кластеризация отвечает на вопрос, может ли одна страница обслуживать группу фраз, а не на вопрос, есть ли у вас содержание. Если содержания нет и текст выйдет пересказом, поступайте так: оставьте одну страницу, а фразы второго кластера закройте развёрнутым подзаголовком внутри неё — с ценой, сроками или условиями, которые отличают эту услугу. Дальше смотрите на показы в Вебмастере по этим фразам месяца три. Если страница по ним показывается, но не поднимается выше третьей десятки, значит, поиску действительно нужна отдельная посадочная, и к тому моменту у вас накопится фактура для неё: вопросы клиентов, конкретные работы, фотографии объектов. Делать пустую страницу заранее — верный способ получить два слабых адреса вместо одного нормального.
Артём Цейтлин
Добавлю по опыту: обязательно храните исходные снимки выдачи, а не только итоговые кластеры. Через полгода при пересчёте очень помогает сравнить, что именно изменилось в топе, а не гадать, почему группы разъехались.