Логотип seo-prodvizhenie-biznesa.ru
+7 (921) 333-77-45

Семантический поиск

Семантический поиск
Анатолий Кузнецов
Анатолий Кузнецов
SEO-оптимизатор с 20-летним стажем. Автор блога seo-prodvizhenie-biznesa.ru о продвижении и доработке сайтов.

Семантический поиск объясняет странность, с которой сталкивался каждый владелец сайта: страница, где нужной фразы нет ни разу, стоит выше той, где она повторена десять раз. Система перестала сопоставлять символы и начала оценивать смысл — связывает синонимы, различает значения по контексту, определяет, что человек собирался сделать, а не только что он написал.

Для практики это означает конец целого пласта приёмов: плотность ключей, вписывание всех словоформ, точные вхождения в неестественном виде. Вместо них появились другие задачи — полнота раскрытия темы, лексика предметной области, соответствие типу намерения. Ниже — как устроено понимание смысла, какими слоями оно собирается и что из этого следует для текстов и структуры сайта.

Что изменилось: от совпадения слов к соответствию смысла

Ранние поисковые системы работали как поиск по документу: есть слово — документ подходит, нет слова — не подходит. Отсюда выросла вся эпоха оптимизации под плотность вхождений, а вместе с ней — тексты, которые невозможно читать вслух.

Что сравниваем Поиск по словам Семантический поиск
Единица сопоставления Совпадение символов Соответствие смысла запроса и документа
Синонимы Разные, несвязанные запросы Распознаются как близкие
Словоформы Нужны все варианты в тексте Сводятся к начальной форме
Опечатки Документ не находится Исправляются до обработки запроса
Контекст Не учитывается Определяет значение многозначного слова
Намерение человека Игнорируется Определяет тип и состав выдачи
Полнота ответа Не оценивается Один из основных сигналов качества

Практический вывод из таблицы один: текст, написанный ради алгоритма, сегодня проигрывает тексту, написанному ради человека, — потому что алгоритм научился оценивать примерно то же, что оценивает человек.

Из чего складывается понимание смысла

Понимание собирается слоями, и каждый слой решает свою задачу. Знать их полезно не ради теории: почти каждая практическая рекомендация вырастает из конкретного слоя.

Морфология. Слово приводится к начальной форме. «Окнами», «окон», «окну» становятся «окно». Для русского языка это не отсечение окончаний, а полноценный разбор с определением части речи и снятием неоднозначности: «стекло» как существительное и «стекло» как глагол — разные слова. Отсюда прямое следствие: вписывать все падежи бессмысленно, система сводит их сама.

Синонимия и родственные слова. Система знает, что «автомобиль», «машина» и «авто» — об одном. Знает и обратное: «рейка» в автомобильном контексте и «рейка» в строительном — разные сущности. Отсюда вторая рекомендация: писать нормальным языком, употребляя те слова, которые естественны для темы, а не одну заученную фразу.

Контекст запроса. Слово «ключи» само по себе неоднозначно. «Ключи от квартиры», «гаечные ключи», «ключи к тесту» дают три разные выдачи без единого пересечения. То же самое работает и внутри документа: значение слова на странице уточняется соседними словами.

Векторное представление. Современные модели переводят слова, предложения и целые документы в наборы чисел так, что близкие по смыслу оказываются рядом в этом пространстве. Именно это позволяет находить страницы, где нужных слов нет, но задача решается. И именно это делает бессмысленной погоню за точным вхождением: сопоставляются не строки, а положения в смысловом пространстве.

Поведение пользователей. Верхний слой: система смотрит, какие страницы люди выбирают по конкретному запросу, остаются ли на них и не возвращаются ли в выдачу за другим ответом. Это уточняет понимание запроса. Если по формулировке все выбирают каталоги, система делает вывод о намерении и перестраивает выдачу.

Смежный материал по теме — «Векторные эмбеддинги и семантический поиск: как нейросетевые модели Яндекса (после Палеха и Королёва) понимают смысл, а не слова».

Алгоритмы, которые это принесли

Хронология полезна для понимания направления: каждое поколение добавляло слой, а не заменяло предыдущий.

Этап Год Что добавилось
Матрикснет 2009 Формулу ранжирования собирает машинное обучение, а не человек
Палех 2016 Нейросети для длинных редких запросов, сопоставление смысла заголовка и запроса
Королёв 2017 Понимание смысла всей страницы, а не только заголовка
Вега 2019 Экспертность источника, региональность, скорость получения ответа
Нейросетевые модели 2021 и далее Генеративные модели в ранжировании и в формировании ответа

Помогу с продвижением: раскрутка сайта в Яндексе — вывожу сайты в топ Яндекса белыми методами.

Общее направление за пятнадцать лет читается однозначно: от совпадения слов к пониманию задачи человека. Новые поколения моделей это направление только усилили — теперь система не просто подбирает документы, а собирает из них ответ, и попасть в этот ответ может только источник, из которого факт извлекается однозначно.

Что это значит для текстов на сайте

Список практических следствий, каждое из которых проверяется на любом проекте.

  • Словоформы вписывать не нужно. Система сводит их к одной. Текст «пластиковые окна, пластиковых окон, пластиковыми окнами» не даёт ничего, кроме ухудшения читаемости.
  • Точные вхождения в ломаном виде вредны. «Купить окна Москва недорого» — сигнал низкого качества, а не релевантности.
  • Нужна лексика темы. Слова, которые специалист употребляет неизбежно: для окон это профиль, камеры, стеклопакет, фурнитура, монтажный шов, откосы, теплопроводность. Их отсутствие — признак поверхностного текста.
  • Полнота важнее плотности. Сколько вопросов человека закрыто на странице, а не сколько раз повторена фраза.
  • Заголовки разделов работают как карта смыслов. По ним система понимает, какие подзадачи страница решает.
  • Синонимы и разговорные варианты полезны. Не ради вхождений, а потому что люди спрашивают разными словами, и текст, где встречаются оба варианта, покрывает больше формулировок.
  • Один смысл — одна страница. Две страницы под один смысл конкурируют между собой, и обе проигрывают.

Ещё одно следствие, которое редко проговаривают: понимание смысла работает и в обратную сторону — против страниц, набранных из чужих текстов. Пересказ, собранный из пяти статей конкурентов, попадает ровно в то же место смыслового пространства, где уже стоят эти пять источников, и системе нет причин показывать шестую копию вместо оригиналов. Именно поэтому единственный надёжный способ выделиться — добавить то, чего в этом пространстве ещё нет: собственные цифры, условия работы, описания ситуаций, когда решение не подходит, и ответы на вопросы, которые задают именно вам.

И обратная сторона того же механизма — устойчивость к переписыванию. Раньше страницу можно было вытащить наверх, поменяв формулировки и добавив вхождений; сегодня перестановка слов не меняет положения документа в смысловом пространстве почти никак. Двигает страницу только новое содержание: закрытый вопрос, которого не было, приведённая цифра, разобранный случай. Это неудобно тем, кто привык к быстрым правкам, и выгодно тем, кто действительно разбирается в своей теме.

Как собирать лексику темы вместо ключевых слов

Замена, которую многие пропускают: раньше собирали список фраз для вписывания, теперь собирают словарь предметной области. Порядок работы такой.

  1. Соберите формулировки спроса. Вордстат даёт частотность и подсказывает, как люди спрашивают на самом деле. Подсказки в строке поиска и блок связанных запросов внизу страницы дают продолжения и уточнения. Rush Analytics, Topvisor или Мегаиндекс помогают расширить список, если запросов много.
  2. Разложите их по смыслам, а не по частоте. Формулировки, за которыми стоит одна и та же задача, идут в одну группу — она и станет одной страницей. «Стоимость установки», «цена монтажа», «сколько стоит поставить» — один смысл.
  3. Выпишите словарь темы из практики. Термины, материалы, единицы измерения, названия этапов, типичные проблемы. Источник — ваши коммерческие предложения, договоры, переписка с клиентами, инструкции производителей.
  4. Сравните с топом. Откройте пять первых результатов и выпишите термины, которые встречаются у всех, а у вас отсутствуют. Это и есть пробелы в раскрытии темы.
  5. Соберите вопросы. Что спрашивают по телефону, что в комментариях, что в отзывах. Каждый повторяющийся вопрос — кандидат в раздел страницы.

Дальше текст пишется от этого словаря, а не от списка ключей. Разница видна сразу: в первом случае получается материал, который специалист узнаёт как свой, во втором — набор абзацев вокруг одной фразы.

Если нужны детали, смотрите «Проверка alt у картинок: почему поиск не видит ваши изображения».

Намерение: три типа и что под них ставить

Понимание намерения — та часть семантического поиска, которая приносит больше всего практической пользы и чаще всего игнорируется.

Информационное намерение. Человек хочет разобраться: «как выбрать», «чем отличается», «почему не работает». В выдаче — статьи, инструкции, разборы. Коммерческая страница сюда не поднимется, а если поднимется, то будет получать возвраты в выдачу.

Коммерческое намерение. Человек выбирает исполнителя или товар: «заказать», «цена», «купить», «под ключ», «с установкой». В выдаче — каталоги, страницы услуг, карточки. Здесь решает не текст, а состав страницы: цены, условия, сроки, доставка, отзывы, реквизиты.

Навигационное намерение. Человек ищет конкретную организацию или ресурс. Здесь работает бренд, карточка организации и корректность контактных данных.

Проверка всегда одна и та же: откройте выдачу и посмотрите, страницы какого типа там стоят. Тип страницы важнее качества текста — система показывает лучший материал нужного типа, а не лучший материал вообще. Отдельно стоит смотреть на смешанную выдачу: если в топе половина статей и половина каталогов, система не уверена в намерении, и туда может пройти страница, которая одновременно отвечает на вопрос и даёт возможность заказать.

Где семантический поиск буксует

Если нужна помощь по теме — попадание в ответы ИИ.

Понимание смысла работает не одинаково хорошо везде, и знание слабых мест помогает не строить ложных ожиданий.

  • Узкие профессиональные термины. По редкой номенклатуре и артикулам система по-прежнему опирается на точное совпадение: смысловой близости взять неоткуда, примеров в корпусе мало.
  • Новые понятия. Пока термин не разошёлся по текстам, у него нет устойчивого положения в смысловом пространстве.
  • Местные названия. Разговорные наименования районов, объектов и услуг, которые понимает только местный житель, распознаются хуже.
  • Многозначность без контекста. Короткий запрос из одного слова система разрешает статистикой, то есть в пользу самого частого значения — остальные смыслы получают меньше места.
  • Свежие события. Пока по теме мало документов, выдача нестабильна и меняется несколько раз в сутки.

Из этого следует прикладная вещь: если вы работаете с узкой номенклатурой, точные обозначения на страницу ставить обязательно — артикулы, маркировки, полные наименования. Здесь старое правило про точное соответствие всё ещё в силе.

Подробнее об этом — в статье «Внутренний поиск по сайту плодит тысячи пустых страниц: закройте его от индексации».

Порядок работы над страницей

Как это собирается в последовательность действий для конкретной страницы.

  1. Определите одну задачу читателя, которую страница решает. Если задач две — это две страницы.
  2. Проверьте по выдаче тип страниц, которые под эту задачу показываются, и приведите свою к тому же типу.
  3. Соберите словарь темы и список вопросов, разложите их по разделам будущей страницы.
  4. Напишите заголовок в естественной формулировке, которую люди действительно вводят, и дайте прямой ответ в первом абзаце.
  5. Разбейте материал подзаголовками, каждый из которых закрывает один вопрос.
  6. Добавьте то, что отличает вас от конкурентов: цифры из практики, условия работы, ограничения, случаи, когда решение не подходит.
  7. Свяжите страницу внутренними ссылками с соседними материалами и с целевым разделом.
  8. Через месяц посмотрите в Вебмастере, по каким формулировкам страница получает показы, — и дополните её тем, чего в ней не хватило.

Последний пункт важнее, чем кажется. Реальные формулировки, по которым система показывает вашу страницу, почти всегда шире собранного ядра: это готовый список подтем для доработки, полученный от самой системы.

Частые вопросы

Значит, ключевые слова больше не нужны?

Нужны, но в другой роли. Это уже не то, что вписывают в текст, а то, по чему определяют, о чём страница и какую задачу она решает. Формулировка запроса в заголовке и в первом абзаце в естественной форме по-прежнему полезна — она подтверждает соответствие. Всё остальное вписывание потеряло смысл.

Как проверить, что текст содержит лексику темы?

Дайте прочитать специалисту из отрасли и спросите, что бы он добавил. Более механический способ: выпишите термины из пяти материалов конкурентов из топа, уберите повторы и посмотрите, какие из них отсутствуют у вас. Отсутствующие термины и есть пробелы.

Помогает ли синонимизация текста для уникальности?

Нет, и вредит вдвойне. Механическая замена слов синонимами ломает естественность языка, а система оценивает смысл — переписанный синонимами дубликат остаётся дубликатом по смыслу. Уникальность создаётся не словами, а содержанием, которого нет у других.

Нужно ли писать длинные тексты, раз система понимает смысл?

Длина не фактор. Полнота ответа — фактор. Короткий материал, закрывающий вопрос целиком, обходит длинный, где ответ разбавлен рассуждениями. В нишах, где ответ объективно требует таблиц, характеристик и сценариев подбора, объём вырастет сам, но полезной частью.

Влияет ли семантический поиск на голосовые запросы?

Напрямую. Голосом спрашивают длинными разговорными фразами, и именно понимание смысла делает возможным ответ на них. Практическое следствие: разделы, названные как вопрос, и короткий прямой ответ сразу под подзаголовком повышают шанс, что ответ возьмут именно с вашей страницы.

Как это связано с ответами нейросетей?

Прямо: генеративный ответ собирается из источников, которым система доверяет и из которых факт извлекается однозначно. Структурированная страница с чёткими подзаголовками, конкретными формулировками и указанным автором цитируется чаще, чем расплывчатый текст без структуры. Работа над смысловой полнотой одновременно работает и на классическую выдачу, и на попадание в такие ответы.

Коротко

  • Система сопоставляет не строки, а смыслы: страница без точного вхождения может стоять выше страницы с десятью повторами.
  • Понимание собирается слоями — морфология, синонимия, контекст, векторное представление, поведение пользователей.
  • Вписывание словоформ и точных вхождений в ломаном виде не помогает, а сигнализирует о низком качестве.
  • Вместо списка ключей собирают словарь предметной области и список реальных вопросов аудитории.
  • Тип страницы под намерение важнее качества текста: статья не поднимется туда, где стоят каталоги.
  • Слабые места остались — редкие термины, артикулы, местные названия: там точное написание по-прежнему обязательно.

Если страницы на сайте написаны по старым правилам — под плотность ключей и словоформы, — переделка обычно даёт прирост без единой новой публикации. Разобрать по вашему сайту, какие страницы переписывать первыми и под какие намерения их разводить, можно на SEO-консультации.

Увеличьте позиции и продажи вашего сайта

Профессиональное SEO-продвижение с гарантией результата. Выберите подходящую услугу:

Анатолий Кузнецов — SEO-оптимизатор

Остались вопросы по продвижению?

Меня зовут Анатолий Кузнецов, я SEO-оптимизатор с 20-летним стажем. Разберу ваш сайт, отвечу на вопросы и подскажу, что улучшить для роста позиций в Яндексе и Google.

Связаться со мной →

Комментарии

Геннадий Фалалеев

Продаём промышленные редукторы, номенклатура из тысячи позиций с артикулами. Вот у нас как раз тот случай, когда «смысл» не работает: ищут по маркировке, и если её нет на странице в точном виде, нас не находят. Как совмещать эти две логики на одном сайте?

Анатолий Кузнецов автор

Совмещать надо по типам страниц, а не внутри одной. Карточки номенклатуры пишите по старым правилам: полная маркировка в заголовке, в первом абзаце и в характеристиках, все варианты написания — с пробелом, через дефис, слитно, латиницей и кириллицей, если так пишут в отрасли. Это тот случай, когда точность важнее красоты. А разделы каталога и материалы про подбор пишите уже по смысловой логике: сценарии применения, задачи, ограничения, сравнение типов. Дальше связывайте одно с другим: из статьи про подбор ведите ссылки на конкретные карточки, из карточек — на статью про подбор. И проверьте отдельно, как у вас устроен внутренний поиск по артикулу: в промышленных нишах много людей приходят по общему запросу, а потом ищут маркировку уже на сайте, и если поиск не находит по частичному совпадению, вы теряете готового покупателя.

Рустам Хабибзянов

Проверил свою страницу по совету со словарём темы. Взял пять конкурентов из топа, выписал термины — у нас отсутствовало восемнадцать понятий, которые есть у всех. При этом текст у нас был длиннее любого из них. Наглядно объясняет, почему длина не помогала.

Ирина Цаплина

Вопрос про смешанный интент. У нас по запросу «натяжные потолки в спальню» в топе три статьи и четыре страницы услуг. Делать одну страницу на два стула или две отдельные и как их тогда не столкнуть между собой?

Анатолий Кузнецов автор

Одну страницу, но гибридную. Смешанная выдача означает, что система не разделила намерение, и в такой ситуации выигрывает материал, закрывающий обе задачи в правильном порядке. Порядок такой: сверху короткий ответ на вопрос выбора — какие фактуры и цвета подходят для спальни, чем отличается матовый от сатинового по восприятию света, что делать с точечными светильниками. Дальше блок с ценами и вариантами комплектаций, дальше форма замера. Ошибка, которую делают чаще всего, — ставить прайс в первый экран: люди с информационным намерением уходят, поведение портится, и страница откатывается. Две отдельные страницы делать не надо: они начнут конкурировать друг с другом по одной и той же формулировке, и обе будут расти медленнее. Если позже увидите в Вебмастере, что по чисто коммерческим формулировкам показов много, а по вопросным мало, тогда и разведёте.

Денис Чекмарёв

Не соглашусь с тем, что вписывание вхождений вредно. У нас конкурент сидит в топе с текстом, где «пластиковые окна цена москва» встречается раз двадцать, вёрстка из двухтысячных, и ничего ему не делается. Получается, старые методы работают, если сайт старый?

Анатолий Кузнецов автор

Он держится не благодаря тексту, а вопреки ему. У возрастного сайта в такой нише обычно есть то, что перевешивает плохой текст: накопленные поведенческие сигналы, брендовый спрос, ссылочный профиль, карточка организации с сотнями отзывов, история заказов. Текст в этом наборе — не причина позиции, а её унаследованная деталь. Проверить это можно косвенно: посмотрите, по каким формулировкам он получает показы. Если основная масса — брендовые и навигационные, вопрос закрыт. Практический вывод для вас другой: копировать его текст бессмысленно, потому что у вас нет остальной части его капитала. У нового сайта единственный доступный рычаг — закрыть задачу читателя лучше и полнее, чем он, и параллельно набирать то, чем он силён: карточку организации, отзывы, узнаваемость. Через год такой конкурент обычно проседает сам, потому что накопленный капитал без обновления содержания постепенно обесценивается.

Алексей Шамрай

Отдельное спасибо за пункт про формулировки из Вебмастера. Выгрузил запросы, по которым показывается статья, — оказалось, там сорок вопросов, которых я вообще не предполагал. Дописал по ним три раздела, за месяц показы выросли примерно на треть.

Марина Щавелева

Скажите, а что делать с региональными разговорными названиями? У нас в городе услугу называют одним словом, которого нет ни в одном справочнике, а в Вордстате по нему видна частотность. Ставить его в заголовок или это выглядит непрофессионально?

Анатолий Кузнецов автор

Раз частотность видна, спрос реальный, и игнорировать его глупо. Но в заголовок ставить не обязательно. Рабочая схема: в H1 и title оставляете общепринятое наименование, а разговорный вариант вводите в первом абзаце естественной фразой вроде «у нас эту услугу чаще называют так-то» и дальше используете по тексту наравне с основным. Система связывает варианты через контекст, а вы не теряете лицо перед теми, кто ищет по официальному названию. Дополнительно сделайте отдельный подзаголовок с вопросом, где встречается разговорный вариант, — это увеличит шанс попасть в ответ по такой формулировке. И проверьте по Вордстату с привязкой к региону: часто оказывается, что таких местных вариантов не один, а три-четыре, и все стоит употребить хотя бы по разу.

Пётр Юдахин

Про синонимизацию для уникальности — больная тема. Заказывали рерайт на бирже, получили тексты, где «дом» заменён на «жилое строение», а «купить» на «приобрести». Уникальность по программе 98 процентов, в поиске ноль. Год потеряли.

Наталья Яровенко

Вопрос по структуре. Вы пишете, что каждый подзаголовок должен закрывать один вопрос. А если тема требует длинного последовательного объяснения, где ответ складывается только к концу? Дробить его на вопросы получается искусственно.

Владислав Аверьянчик

Добавлю наблюдение про многозначность. У нас магазин фурнитуры, слово «петли» по короткому запросу даёт выдачу про мебельные петли, а нам нужны дверные. Пока не начали везде писать полное «петли дверные накладные» с уточнениями, из выдачи нас просто не было видно.

Юлия Бакшеева

Поделюсь способом искать конкурирующие страницы. Выгрузила из Вебмастера запросы с показами вместе с адресами и сгруппировала по формулировке. Там, где по одному запросу в разные дни показывались разные адреса моего сайта, — это и есть один смысл на двух страницах, независимо от того, как они названы. Нашла одиннадцать таких пар за вечер.

Сергей Вагапов

Прочитал про голосовые запросы и проверил свою страницу. Оказалось, у меня подзаголовки в стиле «Особенности процесса» и «Основные моменты» — то есть ни одного вопроса. Переписал в вопросы, добавил прямой ответ первой строкой под каждым. Посмотрим через месяц, отпишусь.

Тамара Гурулёва

Меня смущает вот что: если система понимает смысл, зачем вообще собирать ядро? Может, достаточно писать хорошие тексты по темам, которые волнуют клиентов, и не тратить недели на выгрузки?

Анатолий Кузнецов автор

Ядро нужно не для вписывания, а для двух других вещей, и обе без него не делаются. Первая — понять, есть ли спрос вообще. Тема может волновать вас и ваших клиентов, но если её никто не ищет, страница не принесёт трафика, сколько её ни улучшай. Частотность отвечает на этот вопрос за пять минут. Вторая — понять, сколько страниц нужно и как их разделить. Без группировки формулировок по смыслу вы либо сделаете одну страницу там, где нужно пять, либо пять там, где нужна одна, и они начнут конкурировать. Ни то, ни другое не лечится качеством текста. При этом объём работы сильно преувеличен: для сайта услуг на двадцать страниц сбор и группировка занимают день, а не недели. Недели уходят там, где собирают всё подряд и потом не знают, что с этим делать.

Оставьте комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *

 Нажимая «оставить комментарий» вы принимаетеправила конфиденциальности 

Прокрутить вверх