
LSI тексты продают как отдельную услугу с отдельным прайсом, а объясняют так, что после объяснения понятнее не становится: латентно-семантическое индексирование, векторы, скрытые связи. За терминологией стоит вещь простая и проверяемая руками. Поиск умеет определять, каких понятий не хватает странице, чтобы считаться полным ответом по теме, — и отсутствие этих понятий держит хорошую статью на двадцатой позиции при идеальной технической оптимизации.
Ниже — как устроена оценка полноты, откуда берётся карта темы, как проверить готовый текст за десять минут и почему генерация из нейросети сама по себе задачу не решает. Без плотности ключей и процентов: их в алгоритмах нет.
Что на самом деле стоит за аббревиатурой
Сам термин пришёл из работы конца девяностых и к современным алгоритмам отношения почти не имеет: технология, которую им называют, в поиске давно не применяется в исходном виде. Прижилось название, а не метод. Поэтому спор о том, «есть ли LSI в Яндексе», бессмысленный — важно другое: механика, которую этим словом обозначают на рынке, работает.
Механика такая. Раньше страница попадала в выдачу по совпадению слов запроса со словами на странице. Сегодня система сначала определяет, о чём запрос и о чём документ, а потом сопоставляет их по смыслу. У каждой темы есть набор понятий, которые встречаются в текстах, действительно её раскрывающих. Если в вашем тексте этих понятий нет, он выглядит поверхностным — даже когда ключевая фраза расставлена безупречно.
Практическое следствие переворачивает привычную работу с текстом. Страница может занимать высокие позиции по запросу, которого в ней нет дословно ни разу. И наоборот: текст с точным вхождением в заголовке, первом абзаце и подзаголовках может не ранжироваться вообще, потому что тема в нём не раскрыта, а слова расставлены.
Как поиск определяет, что тема раскрыта
Оценка идёт не по абсолютной шкале, а по сравнению с теми страницами, которые уже отвечают на запрос. Никакого эталонного набора слов не существует — есть выдача, и ваша страница сопоставляется с ней.
Возьмём запрос «почему не растут позиции сайта». Страница, где двадцать раз написано «позиции сайта не растут», проиграет странице, где разобраны причины: технические ошибки индексации, слабое содержание, отсутствие внешних упоминаний, поведенческие показатели, санкции, недостаточная структура под спрос. Во втором тексте точная фраза может встретиться один раз — но там есть ответ, а вместе с ответом появляются и все смежные понятия.
Обратите внимание, что «нужные слова» во втором случае никто не подбирал специально. Они появились сами, потому что автор действительно перечислял причины. Это главный признак: тематическая лексика — следствие компетентности, а не отдельная операция по вставке слов из генератора.
Из чего состоит текст, который считается полным
Полнота складывается из нескольких слоёв, и каждый проверяется отдельно. Ниже — рабочая таблица, по которой я прохожу перед публикацией.
Подробнее об этом — в статье «Фильтр Яндекс Баден-Баден — что это и как он работает».
| Элемент | Зачем нужен | Как проверить за минуту |
|---|---|---|
| Ответ в первом абзаце | Читатель не должен искать суть, а система оценивает начало документа внимательнее | Прочитать только первый абзац и спросить, получен ли ответ |
| Подзаголовки под реальные вопросы | Структура повторяет ход мыслей человека, который выбирает | Прочитать подряд только заголовки разделов |
| Термины предметной области | Признак того, что автор в теме, а не пересказывает чужие статьи | Сравнить свой набор терминов с текстами из первой пятёрки выдачи |
| Цифры, сроки, условия | Отличают практику от общих рассуждений | Найти хотя бы три проверяемых факта на всю статью |
| Смежные подтемы | Закрывают следующий вопрос читателя, не выпуская его обратно в поиск | Выписать, что человек спросит после прочтения |
| Таблицы и списки | Упрощают сравнение и удерживают внимание на длинных материалах | Есть ли в теме что сравнивать и перечислять |
Пятый пункт — тот, из-за которого чаще всего проигрывают в конкурентных темах. Человек прочитал вашу статью, у него возник следующий вопрос, он вернулся в поиск и открыл конкурента. Возврат в выдачу — сильный отрицательный сигнал, и лечится он не переписыванием абзацев, а добавлением раздела, который закрывает этот следующий вопрос.
Как собрать карту темы
Нужны не «LSI-фразы из генератора», а перечень понятий, без которых тему не раскрыть. Собирается он из пяти источников, и на средней теме занимает от двадцати минут до часа.
- Подзаголовки страниц из топа. Откройте пять-семь первых результатов по своему запросу и выпишите из каждой только заголовки разделов. Получится карта обязательных подтем: то, что встречается у большинства, обязано быть и у вас.
- Подсказки поисковой строки и блок связанных запросов. Это прямое указание системы на то, что она считает связанным с вашей темой. Формулировки оттуда стоит брать буквально: они отражают язык пользователей, а не отраслевой жаргон.
- Яндекс Вордстат. Даёт реальные формулировки со спросом и, что важнее, уточнения: с какими словами люди спрашивают о вашем предмете. Уточнения обычно и есть недостающие разделы.
- Вопросы ваших клиентов. Переписка, звонки, возражения перед покупкой. Это единственный источник, которого нет у конкурентов, и именно он даёт материал, отличающий вашу страницу от пересказа.
- Ваш собственный отчёт по запросам в Вебмастере. Через месяц после публикации там видно, по каким формулировкам страница уже показывается. Там регулярно обнаруживаются запросы, которых вы не планировали, — их стоит закрыть отдельными абзацами или разделами.
Помогу с продвижением: SEO-продвижение сайтов — вывожу сайты в топ Яндекса белыми методами.
Автоматизировать сравнение с топом умеют Мегаиндекс, Rush Analytics и Topvisor: они сопоставляют лексику вашей страницы с лексикой конкурентов и показывают, чего не хватает. Это экономит время на больших объёмах, но принципиально нового по сравнению с ручным разбором четырёх-пяти страниц не даёт. Начинать я советую руками — так вы видите не список слов, а логику раскрытия темы.
Разбор на конкретном примере
Возьмём страницу услуги «монтаж кондиционера». Типичный текст на такой странице: качественно, быстро, опытные мастера, гарантия, доступные цены. Ключевая фраза встречается восемь раз, тема не раскрыта ни на слово.
Что даст сбор карты. Из подзаголовков конкурентов выпадут: типы кондиционеров и разница в монтаже, штробление против короба, длина трассы и что входит в базовую стоимость, зимний комплект, дренаж и уклон, согласование с управляющей компанией, сроки и порядок работ, обслуживание после установки. Из подсказок — «с высотными работами», «без штробления», «в квартире с ремонтом». Из вопросов клиентов — можно ли ставить зимой, кто отвечает за испорченную отделку, что делать, если течёт.
Ни одного из этих понятий в исходном тексте не было. При этом заметьте: они не про ключевые слова, они про предмет. Страница, где всё это разобрано, будет выглядеть полной и для человека, и для алгоритма — а слова «монтаж кондиционера» в ней встретятся ровно столько раз, сколько нужно по смыслу.
Второй слой того же примера — коммерческая конкретика. Диапазон цен по типам, что входит и что оплачивается отдельно, срок выезда, гарантия и её условия. Для коммерческих запросов эти элементы влияют на оценку страницы не меньше, чем тематическая лексика: система отличает страницу, по которой можно принять решение, от страницы с описанием того, какие мы хорошие.
Чего делать не надо
Услуга «написание LSI-текстов» породила несколько устойчивых способов испортить страницу. Все они встречаются регулярно.
Тему разбирал отдельно: «Длинные тексты для продвижения сайта».
- Вставлять слова списком. Абзац вида «наш кондиционер имеет мощность, площадь, инвертор, трассу, монтаж и дренаж» — это тот же переспам, только словами из другого перечня. Алгоритм оценивает связность, а не наличие лексем.
- Гнаться за объёмом. Раздувание текста ради знаков поднимает отказы: человек не находит ответ, листает и уходит. Длина — следствие полноты, а не её причина.
- Считать проценты. Ни плотности ключей, ни «доли LSI» в алгоритмах не существует. Сервисы, которые показывают такие проценты, считают их по собственным формулам и к оценке в поиске отношения не имеют.
- Копировать структуру конкурента целиком. Карта топа нужна как проверка полноты, а не как шаблон. Если вы повторили чужие разделы один в один, у системы нет причины ставить вас выше оригинала — вы не добавили ничего нового.
- Писать про всё сразу. Попытка закрыть одной страницей и «что такое», и «сколько стоит», и «как выбрать» размывает тему. Часть подтем должна уходить в отдельные страницы, связанные ссылками.
- Прятать ответ в конце. Классическая ошибка длинных статей: три экрана вступления перед сутью. Ответ должен быть в первом абзаце, дальше — детали и обоснования.
Проверка готового текста
Перед публикацией прогоняю материал по короткому списку. Проверка занимает минут десять и снимает большую часть замечаний, которые иначе всплывут через два месяца в статистике.
| Что проверяем | Как | Признак проблемы |
|---|---|---|
| Структура | Прочитать только заголовки разделов подряд | По заголовкам непонятен ход рассуждения |
| Полнота | Сверить разделы с картой подзаголовков из топа | Отсутствует подтема, которая есть у большинства конкурентов |
| Конкретика | Найти три проверяемых факта: цифру, срок, условие | Весь текст состоит из оценок и прилагательных |
| Следующий вопрос | Спросить читателя, что осталось непонятным | Оставшийся вопрос — это недостающий раздел |
| Естественность | Прочитать вслух абзацы с ключевой фразой | Фразы, которые невозможно произнести, — след оптимизации |
| Через месяц | Отчёт по запросам в Вебмастере | Показы идут по формулировкам, которых нет в тексте |
Последняя строка — единственная объективная проверка из всех. До публикации вы работаете с гипотезами, после — с данными: система сама сообщает, по каким запросам считает страницу подходящей. Расхождение между вашими ожиданиями и этим списком показывает, куда тему нужно достроить.
Нейросети и полнота темы
Тексты для сайтов сегодня в основном генерируются, и это меняет условие задачи. Раньше конкурентным преимуществом была способность написать длинный связный текст. Сейчас длинный связный текст умеют получать все за минуту, и он у всех примерно одинаковый — потому что модель выдаёт усреднённое по интернету.
Отсюда две вещи. Первая: тематическая лексика в генерации присутствует по умолчанию — модель по построению выдаёт слова, статистически связанные с темой. То есть та задача, ради которой продавали услугу LSI-текстов, решается сама. Вторая: ровно поэтому она перестала быть преимуществом. Полнота по словам есть у всех, различает страницы теперь другое.
Различает практика: цифры из вашей работы, условия вашей ниши, случаи, которых нет в общем корпусе, ответы на вопросы, которые задают именно вам. Генерация этого не даёт по определению — она не была на ваших объектах и не читала вашу переписку. Рабочая схема, которой держусь: структура и черновик могут быть машинными, содержательные вставки — только свои, и их должно быть достаточно, чтобы страница отличалась от усреднённой.
Как это связано с современной оптимизацией и почему старые приёмы перестали давать эффект, я разбирал в материале почему SEO-тексты и старое SEO не работают. Про то, как одна страница закрывает десятки формулировок сразу, — в разборе полноты ответа и тематического охвата.
Что делать со старыми текстами
Переписывать весь сайт разом смысла нет. Порядок, который даёт результат быстрее всего, такой.
Смежный материал по теме — «Какие тексты выходят в ТОП».
- Выгрузите из Вебмастера страницы с показами, но низкой кликабельностью и позициями во второй-третьей десятке. Это тексты, которые система уже считает релевантными, но недостаточно полными, — им не хватает немногого.
- По каждой соберите карту подзаголовков из топа и отметьте, каких разделов нет.
- Достройте недостающее, не трогая то, что уже написано. Дописывание работает лучше полной переделки: вы не теряете накопленные сигналы.
- Проверьте, что ответ на основной вопрос стоит в первом абзаце, а не на третьем экране.
- Свяжите страницу ссылками с соседними материалами по теме — это помогает и человеку, и определению тематики раздела.
- Через полтора-два месяца сравните позиции и список запросов. Если сдвига нет, проблема не в тексте, и искать её надо в технической части или в коммерческих факторах.
Порядок правок задаётся не вашими предпочтениями, а близостью к результату. Страница на двенадцатой позиции с показами по коммерческим запросам важнее статьи на сотой позиции, какой бы неудачной последняя ни казалась.
Частые вопросы
Сколько раз нужно употребить ключевую фразу?
Столько, сколько требует текст. Обязательные места — заголовок, первый абзац и один-два подзаголовка, дальше по смыслу. Нормы плотности не существует, а попытка добрать вхождения приводит к формулировкам, которые невозможно произнести вслух, и это заметно и человеку, и алгоритму.
Нужен ли отдельный подрядчик на «LSI-оптимизацию»?
Отдельная услуга здесь не нужна: это часть обычной работы над текстом. Если вам предлагают её как самостоятельную позицию в смете, попросите показать, что именно войдёт в результат. Обычно выясняется, что речь про сбор подзаголовков конкурентов и подсказок — то есть про то, что описано выше и делается за час.
Помогают ли сервисы проверки текста на соответствие топу?
Как ускоритель — да, особенно когда страниц много. Но их выводы нужно фильтровать: сервис видит слова, а не смысл, и регулярно требует добавить лексику, которая в вашем случае неуместна. Механическое доведение текста до «зелёной зоны» такого сервиса портит его для читателя.
Работает ли это для интернет-магазинов?
Работает, но иначе. В карточке товара роль тематической лексики играют характеристики, комплектация, условия доставки, совместимость, отзывы с деталями. Длинный описательный текст внизу карточки, наоборот, почти не влияет — он давно превратился в формальность, которую никто не читает.
Как быть, если тема узкая и в топе почти нет страниц?
Тогда карту собирают не из конкурентов, а из вопросов клиентов и смежных тем. В узких нишах это преимущество: вы формируете тему сами, и любая ваша конкретика становится тем самым отличием, которого у остальных нет.
Сколько ждать результата после переработки текста?
От трёх недель до двух месяцев. Сначала страницу должен переобойти робот, потом накопиться статистика поведения. Если через два месяца при выросшей полноте не изменилось ничего, причина почти всегда лежит вне текста: страница не в индексе, есть дубль, или запрос требует другого типа страницы — например, каталога вместо статьи.
Как тексты встраиваются в общую механику продвижения и что даёт эффект помимо них:
Коротко
- За названием LSI стоит простая вещь: поиск оценивает полноту раскрытия темы, а не совпадение фразы.
- Оценка идёт сравнением с теми страницами, которые уже отвечают на запрос, поэтому карта темы собирается из подзаголовков топа, подсказок, Вордстата и вопросов клиентов.
- Тематическая лексика появляется сама у автора, который разбирается в предмете; вставленная списком, она работает как переспам.
- Ни плотности ключей, ни процента LSI в алгоритмах нет — считать их бессмысленно.
- После генерации нейросетью полнота по словам есть у всех, различают страницы конкретика и практика, которых в общем корпусе нет.
- Самая честная проверка — отчёт по запросам в Вебмастере через месяц после публикации: он показывает, чего теме не хватает.
Если нужно понять, почему конкретная страница стоит во второй десятке при нормальном тексте, — это SEO-консультация: сравниваю страницу с топом по запросу, показываю недостающие подтемы и говорю, что дописывать первым. Если текстов много и писать их некому, есть отдельная услуга — заказать SEO-статьи.
Увеличьте позиции и продажи вашего сайта
Профессиональное SEO-продвижение с гарантией результата. Выберите подходящую услугу:
Остались вопросы по продвижению?
Меня зовут Анатолий Кузнецов, я SEO-оптимизатор с 20-летним стажем. Разберу ваш сайт, отвечу на вопросы и подскажу, что улучшить для роста позиций в Яндексе и Google.
Связаться со мной →Комментарии
Назар Сундуков
Копирайтер сдал текст с отчётом сервиса: «соответствие топу 94%». Читать при этом невозможно — там абзацы вроде «услуга по натяжным потолкам матовым глянцевым тканевым с монтажом профиля». Как объяснить, что так нельзя, если формально показатель высокий?
Анатолий Кузнецов автор
Объяснять лучше не через теорию, а через проверку. Дайте копирайтеру прочитать этот абзац вслух — обычно этого достаточно, чтобы вопрос закрылся сам. Второй аргумент: спросите, на какой вопрос читателя отвечает перечисление типов потолков через запятую. Ответа не будет, потому что это не ответ, а список слов. Показатель сервиса считается по совпадению лексики с конкурентами и не различает связный текст и перечисление, поэтому доводить его до высоких значений механически бессмысленно. Правильная работа с тем же списком — превратить каждый тип потолка в раздел с разницей в цене, сроке и условиях монтажа. Тогда и лексика появится естественно, и страница станет полезной.
Оксана Рыбальченко
У меня статья висит на 15–18 месте больше года. Текст подробный, 12 тысяч знаков, всё по теме. Что смотреть в первую очередь — дописывать или переписывать?
Анатолий Кузнецов автор
Ни то, ни другое до того, как посмотрите отчёт по запросам в Вебмастере по этой странице. Он покажет, по каким формулировкам идут показы и какая по ним средняя позиция. Дальше три типичных расклада. Если показы идут по вашей целевой фразе, но позиция низкая — не хватает полноты, собирайте карту подзаголовков из топа и дописывайте недостающие разделы. Если показы идут по совсем другим формулировкам — система поняла тему иначе, чем вы задумывали, и стоит подстроить заголовок с первым абзацем под то, что она видит. Если показов почти нет при нормальной индексации — проблема не в тексте, а в типе страницы: под запрос может требоваться каталог или подборка, а не статья. Начинать переписывание вслепую при объёме 12 тысяч знаков я бы не стал: накопленные сигналы потерять легко, а вернуть долго.
Прохор Селезнёв
А если генерировать текст нейросетью и потом вручную добавлять свою конкретику — это заметно поисковику? Боюсь попасть под фильтр за машинный контент.
Анатолий Кузнецов автор
Под санкции попадают не за способ создания, а за бесполезность результата: массовые страницы без собственной ценности, сделанные ради объёма. Схема, которую вы описываете, как раз обратная — вы добавляете то, чего в общем корпусе нет. На что смотреть при этом: во-первых, проверяйте факты, модель уверенно выдумывает нормативы, цифры и названия документов. Во-вторых, убирайте вводные конструкции и обобщения, по которым генерация опознаётся с первого абзаца. В-третьих, следите, чтобы доля собственного материала была заметной, а не двумя предложениями на статью. И главное правило масштаба: сто сгенерированных страниц с косметической правкой — риск, десяток статей с реальной практикой внутри — нормальная работа.
Регина Стеблова
Собрала подзаголовки у пяти конкурентов из топа — они почти одинаковые. Получается, если я повторю тот же набор, я просто стану шестой такой же?
Анатолий Кузнецов автор
Именно так, и вы поймали главную ловушку метода. Карта топа отвечает на вопрос, чего нельзя пропустить, но не на вопрос, чем вы лучше. Обязательные разделы закройте — без них страницу сочтут неполной. А дальше добавьте то, чего нет ни у кого из пятерых: обычно это вопросы, которые вам задают клиенты перед покупкой, разбор типичных ошибок, конкретные условия и сроки, сравнение вариантов с указанием, кому что подходит. Проверьте ещё, на чём конкуренты обрываются: если все пять заканчиваются на «обращайтесь к профессионалам», значит, следующий шаг читателя не закрыт, и его можно закрыть у себя. Совпадение структуры при разном наполнении — нормально, повторение содержания — бессмысленно.
Савелий Ремнёв
Правильно понимаю, что для карточек товаров всё это не нужно и достаточно характеристик? У нас 4000 карточек, писать в каждую по статье нереально.
Анатолий Кузнецов автор
Писать статьи в карточки не нужно и вредно — их не читают, а на четырёх тысячах товаров это ещё и гарантированные шаблонные дубли. В карточке роль полноты выполняют структурированные данные: полный набор характеристик, комплектация, совместимость, условия доставки и возврата, отзывы с деталями, вопросы к товару. Собственный текст нужен короткий и по делу: для кого товар, чем отличается от соседних моделей в вашем же каталоге, на что смотреть при выборе. Основную работу по тематической полноте в магазинах делают не карточки, а страницы категорий и подборок — вот туда и стоит вкладывать время. И проверьте описания от поставщика: если они стоят у вас в исходном виде, точно такие же есть ещё у двадцати магазинов.
Таисия Ручьёва
Про возврат в выдачу как сигнал — впервые встречаю такую формулировку. Пошла смотреть, на чём наши статьи обрываются. Действительно, у половины нет ответа на очевидный следующий вопрос.
Ульяна Ситко
Не соглашусь про объём. У нас в тематике в топе висят тексты по 30 тысяч знаков, и короткие статьи туда не пробиваются, сколько конкретики в них ни клади.
Фёдор Расторгуев
Проверил отчёт по запросам, как советуете. Страница показывается по 40 формулировкам, из которых я планировал три. Половина — это вопросы, на которые в тексте ответа нет вообще.
Юрий Севрюков
Подскажите, а подсказки поисковой строки надо смотреть с чистой историей? Боюсь, что мне показывают персональные, а не общие.
Яна Смородина
Таблицу с проверкой распечатала и повесила рядом с монитором. Особенно про чтение вслух — сразу видно, где текст писали под ключи, а не для людей.
Артемий Рогулин
Вопрос про разделение тем: как понять, где заканчивается одна страница и начинается вторая? У нас «что такое» и «сколько стоит» пока в одном тексте, и он расползается.
Вероника Сажина
Мне сервис требует добавить в текст про доставку слова «таможня» и «растаможка», хотя мы возим только по стране. Хорошо, что прочитала про фильтрацию рекомендаций, чуть не вставила.
Часто встречаются в поисковой выдаче синонимы, не имеющие одинакового корня в слове. Благодаря такому понятию, как LSI, поисковые системы очень быстро улавливают новые тренды различных неологизмов и могут формировать более релевантную поисковую выдачу, отвечая на потребности пользователя. Эту систему практически можно назвать искусственным интеллектом.
Изначально тексты писались с учетом этого, но прошло много времени и сайт не апается. Толку от этого 0. Приходится переписывать тексты с впихиванием ключей, ровно как и у конкурентов по 20 штук насимволов.