Логотип seo-prodvizhenie-biznesa.ru
+7 (921) 333-77-45

Яндекс Yati — новая технология анализа текста

Яндекс Yati — новая технология анализа текста
Анатолий Кузнецов
Анатолий Кузнецов
SEO-оптимизатор с 20-летним стажем. Автор блога seo-prodvizhenie-biznesa.ru о продвижении и доработке сайтов.

Технология YATI появилась в поиске Яндекса в конце 2020 года и за несколько месяцев обесценила половину приёмов, на которых оптимизаторы зарабатывали предыдущие десять лет. Тексты, вылизанные по плотности ключевых слов, начали проседать. Страницы, написанные нормальным человеческим языком и отвечающие на вопрос по существу, начали расти — без единого «заказать окна недорого Москва» в подзаголовке. Ниже — что именно поменялось внутри поиска, почему точные вхождения перестали быть обязательными, какие требования к тексту пришли им на смену и как переписать старые страницы, чтобы они снова начали приносить трафик.

Как поиск подбирал страницы до нейросетей

Долгие годы поисковая система работала с текстом как с мешком слов. Запрос разбирался на слова, документ разбирался на слова, дальше машина считала, насколько эти два набора пересекаются. Чем чаще нужное слово встречалось в документе и чем реже оно встречалось во всём интернете, тем выше был вес совпадения. На этой арифметике держались классические формулы ранжирования.

Из такой механики прямо следовали приёмы оптимизаторов. Если машина считает слова, значит слова нужно вписать. Если она смотрит на заголовок, значит ключ надо поставить в заголовок. Если она усиливает вес точной формы, значит фразу надо вставить именно в той форме, в которой её вводят люди, — отсюда и знаменитые уродливые конструкции вроде «ремонт стиральных машин Москва недорого» посреди человеческого предложения.

Работало это неплохо ровно до тех пор, пока текстов в интернете было мало. Как только по каждому запросу набралось по сотне документов с идеально подобранной плотностью, различать их по количеству вхождений стало бессмысленно. Поиск начал видеть десятки одинаково «оптимизированных» страниц, из которых половина не отвечала на вопрос вообще.

Чего мешок слов не умел

Главная слабость старого подхода — он не отличал форму от смысла. Для машины «как починить кран» и «протекает смеситель что делать» были разными запросами, хотя человек имел в виду одно и то же. Страница с честной инструкцией по ремонту смесителя проигрывала пустышке, где нужная фраза была вписана в точной форме двенадцать раз.

  • Синонимы не связывались между собой: «стоимость» и «цена» считались разными словами.
  • Перефразировки не распознавались: перестановка слов ломала совпадение.
  • Контекст терялся: «лук» из огорода и «лук» для стрельбы выглядели одинаково.
  • Порядок слов почти не учитывался, хотя он меняет смысл фразы.
  • Полнота ответа не оценивалась никак — только частота совпадений.

Заплатки к этому придумывали годами: словари синонимов, расширение запроса, тематические словари, антиспам-фильтры на переоптимизацию. Каждая заплатка чинила один симптом, но не решала корень: машина по-прежнему не читала текст, а считала совпадения.

Что принесли нейросетевые модели

Нейросетевые модели-трансформеры научились делать то, чего не умела арифметика вхождений: превращать целый кусок текста в набор чисел, который отражает смысл, а не буквы. Такое представление называют вектором. Два текста, которые говорят об одном и том же разными словами, получают близкие векторы. Два текста с одинаковыми словами, но разным смыслом, — далёкие.

Дальше сравнение идёт уже не «слово к слову», а «смысл запроса к смыслу документа». Модель одновременно смотрит и на запрос, и на текст страницы и оценивает, насколько этот текст отвечает на этот вопрос. Слово «смеситель» и слово «кран» в такой схеме стоят рядом сами по себе, без ручного словаря синонимов. Именно поэтому пропадает необходимость вписывать фразу в точной форме.

Второе важное свойство — модель учитывает контекст каждого слова. Одно и то же слово в разных предложениях получает разное представление, потому что рядом стоят разные слова. Так решается проблема многозначности, на которой старый поиск спотыкался постоянно.

YATI — это как раз такая модель, обученная на огромном массиве запросов и оценок асессоров плюс на кликах реальных пользователей. Она не заменила остальные факторы ранжирования, а встала поверх них как сильный текстовый сигнал: определяет, насколько документ по смыслу отвечает запросу.

Подробнее об этом — в статье «Фильтр Яндекс Баден-Баден — что это и как он работает».

До и после: что изменилось по параметрам

Параметр Раньше Сейчас
Основа сопоставления Совпадение слов запроса и документа Близость смыслов запроса и документа
Точное вхождение Обязательно, иначе страница не находилась Желательно в ключевых местах, но не критично в тексте
Плотность ключей Настраиваемый параметр, за который боролись Не даёт прироста, при перегибе вредит
Синонимы Через словари, частично Понимаются моделью сами по себе
Перефразировка запроса Ломала совпадение Распознаётся как тот же смысл
Объём текста Чем больше слов, тем больше вхождений Важна не длина, а закрытые подвопросы
Текст «ни о чём» Мог ранжироваться за счёт вписанных фраз Проигрывает: смысла в нём мало
Структура Заголовки как место для ключей Заголовки как карта подвопросов

Точные вхождения перестали быть обязательными

Самое заметное практическое следствие: текст больше не нужно ломать ради фразы. Если страница про доставку бетона честно объясняет, как рассчитать объём, сколько стоит миксер и что бывает при простое, она будет находиться и по «купить бетон с доставкой», и по «сколько стоит куб бетона привезти», и по «бетон на объект цена» — даже если ни одна из этих фраз не встречается в тексте дословно.

Из этого не следует, что ключи можно игнорировать полностью. Следует другое: ключ перестал быть пропуском в выдачу и стал ориентиром. Он подсказывает поиску тему страницы, но не заменяет содержание. Страница, где ключ есть, а ответа нет, проигрывает странице, где ответ есть, а ключ выражен другими словами.

Почему ключевые слова не исчезли

Ключевые слова остались рабочим инструментом в нескольких конкретных местах. Они выполняют роль указателя: помогают и машине, и человеку за долю секунды понять, о чём страница.

  • Title. Здесь основной запрос нужен почти дословно: это и сигнал релевантности, и то, что человек читает в выдаче перед кликом.
  • H1 и подзаголовки H2. Формулируйте их так, как люди задают вопросы. Ключ вписывается сам собой, без насилия над языком.
  • Первый абзац. Тема должна быть названа сразу — и для читателя, который решает, оставаться ли на странице, и для поиска.
  • Подписи к изображениям и alt. Место, где уточнение темы уместно и естественно.
  • Тексты ссылок внутри сайта. Анкор объясняет, что находится по ссылке.

А вот что перестало работать: перечисление хвостов через запятую, повтор фразы в каждом абзаце, вставка города в каждый второй заголовок, «SEO-текст» внизу страницы мелким шрифтом. Всё это модель считывает как текст без смысла и не начисляет за него ничего.

Что ценится в тексте сегодня

Свойство текста Как это выглядит на практике Что бывает без него
Прямой ответ в начале Суть — в первых двух-трёх предложениях, до всех оговорок Человек уходит обратно в выдачу, не долистав до ответа
Разбивка по подвопросам Каждый H2 закрывает один вопрос читателя Страница отвечает на один запрос вместо десяти близких
Конкретика и цифры Сроки, диапазоны цен, объёмы, условия, ограничения Текст неотличим от десятка таких же общих
Таблицы и списки Сравнения и наборы вариантов вынесены из абзацев Читатель не находит нужную строку и уходит
Отсутствие воды Каждый абзац добавляет новый факт Полезная часть тонет во вступлениях
Опыт автора Случаи из практики, типичные ошибки, оговорки Пересказ того, что уже есть в топе
Честные ограничения Написано, когда способ не подходит Текст читается как реклама, доверия нет

Полнота ответа важнее объёма

Частая ошибка — путать полноту с длиной. Двадцать тысяч знаков вокруг одной мысли полнотой не являются. Полнота — это когда страница закрывает не только заданный вопрос, но и те, что возникают сразу после него.

Человек, который ищет «сколько стоит продвижение сайта», через минуту захочет знать: из чего складывается цена, почему у разных подрядчиков разброс в три раза, что входит в работу за эти деньги, когда будет результат и что будет, если остановиться. Страница, которая отвечает только на первый вопрос, формально релевантна. Страница, которая отвечает на все пять, закрывает потребность целиком — и по смыслу оказывается ближе к запросу, потому что содержит ответы на его естественное продолжение.

Собрать такой список подвопросов несложно: посмотрите блок «Люди спрашивают также» в выдаче, подсказки поисковой строки, вопросы клиентов в переписке и на консультациях. Это и есть план статьи.

Структура как способ показать смысл

Заголовки перестали быть местом для ключей и стали картой документа. Хороший H2 сформулирован так, что по нему одному понятно, какой ответ будет ниже. «Сроки» — плохой заголовок. «Через сколько месяцев виден первый рост трафика» — хороший: он совпадает по смыслу с реальным запросом.

Тему разбирал отдельно: «За что Яндекс банит сайты».

  • Один раздел — один вопрос, без склеивания двух тем в одну.
  • Ответ в первом абзаце раздела, детали и оговорки — дальше.
  • Порядок разделов повторяет логику человека: сначала «что это», потом «сколько», потом «как сделать», потом «что может пойти не так».
  • Сравнения и перечни выносятся в таблицы и списки, а не пересказываются текстом.
Что такое трансформер Yati

Почему тексты «ни о чём» проигрывают

Есть узнаваемый жанр: абзац про важность темы, абзац про то, что каждый бизнес индивидуален, абзац про необходимость комплексного подхода, ключ в каждом третьем предложении. Раньше такой текст жил за счёт вхождений. Сейчас модель оценивает его как слабо связанный с конкретным запросом: слова тематические, а ответа на вопрос нет.

Отличить воду от содержания можно простым тестом. Уберите абзац и перечитайте страницу. Если ничего не потерялось — абзац был водой. Если после удаления страница стала непонятнее или менее конкретной — абзац работал. Пройдите так по всему тексту, и обычно уходит от пятой части до трети объёма.

Проверка страницы: чек-лист

Что проверяем Как проверяем Признак проблемы
Первый экран Прочитать глазами человека с этим запросом, не листая Ответа не видно, только вступление и картинка
Заголовки Выписать все H2 подряд и прочитать как список По списку непонятно, о чём страница
Совпадение с вопросами Сверить H2 с подсказками поиска и вопросами клиентов Половина частых вопросов не закрыта
Абзацы Удалить мысленно каждый абзац по очереди Текст не изменился после удаления
Конкретика Посчитать, сколько в тексте цифр, сроков, условий Ни одного числа на всю страницу
Ключи Проверить title, H1, первый абзац Тема нигде не названа прямо либо ключ повторён десять раз
Уникальность позиции Сравнить с тремя страницами из топа Написано ровно то же самое, другими словами

Почему сырая генерация чаще проигрывает

Текст, сгенерированный и опубликованный без правки, обычно формально безупречен: структура есть, подвопросы закрыты, ключи расставлены. Проблема в другом — он собран из того, что уже написано в интернете. Новой информации в нём нет, а значит нет и причины ставить его выше источников, из которых он собран.

Вторая беда таких текстов — обобщённость. «Сроки зависят от конкурентности ниши», «стоимость определяется индивидуально», «важно учитывать особенности бизнеса». Всё верно и всё бесполезно. Читатель пришёл за диапазоном, а получил формулировку, которая подходит к любому ответу.

Работающая схема — генерация как черновик и обязательная правка руками: подставить реальные цифры из своей практики, добавить случаи из работы, вычеркнуть общие места, дописать оговорки, которые знает только человек, делавший это своими руками. Именно эти вставки отличают страницу от сотни похожих.

Как переписывать старые страницы

Шаг Действие Результат шага
1 Собрать реальные вопросы по теме: подсказки, «Люди спрашивают также», переписка с клиентами Список из 10-15 подвопросов
2 Построить новый план: один вопрос — один H2, в понятном человеку порядке Скелет статьи без текста
3 Переписать первый абзац: прямой ответ и тема названа сразу Первый экран отвечает без прокрутки
4 Перенести из старого текста только то, что несёт факты; воду вычеркнуть Объём падает, плотность пользы растёт
5 Добавить конкретику: числа, сроки, условия, случаи из практики Страница перестаёт быть пересказом
6 Вынести сравнения в таблицы, наборы вариантов — в списки Ответ находится глазами за секунды
7 Проверить title, H1 и первый абзац на наличие темы Ориентир для поиска на месте
8 Обновить дату изменения и отправить страницу на переобход Поиск видит новую версию быстрее

Если нужна помощь по теме — купить SEO-статьи.

Порядок принципиален: сначала план по подвопросам, потом текст. Если начать с правки существующих абзацев, получится та же страница с косметикой — структура останется старой, а именно она чаще всего и мешает.

Чего технология не отменила

Смысловой поиск изменил работу с текстом, но не отменил остальные группы факторов. Идеально написанная страница всё так же может не ранжироваться, если мешает что-то другое.

Смежный материал по теме — «Влияет ли реклама Google Adsense на ранжирование в Яндекс».

  • Техническая чистота. Страница должна открываться, отдавать код 200, быть в индексе, не иметь дублей и корректно работать на мобильных.
  • Скорость. Медленная загрузка бьёт по поведению, а поведение — сильный сигнал.
  • Коммерческие факторы. Цены, ассортимент, доставка, контакты, реквизиты, отзывы — для коммерческих запросов они часто весят больше текста.
  • Поведенческие сигналы. Возврат в выдачу после клика остаётся плохим знаком, каким и был.
  • Ссылки и известность сайта. Роль изменилась, но обнулиться она не обнулилась.
  • Соответствие типу запроса. На коммерческий запрос статья обычно не выйдет, каким бы хорошим ни был текст.

Мифы вокруг темы

Миф Что на самом деле
Ключевые слова больше не нужны Не нужны в виде плотности и точных вставок в текст, но нужны в title, H1 и первом абзаце как ориентир
Теперь можно писать что угодно, поиск сам поймёт Поймёт тему, но оценит и полноту ответа: пустой текст останется пустым
Нейросеть читает текст как человек Она оценивает статистическую близость смыслов, а не понимает в человеческом смысле; результат похож, механизм — нет
Длинные тексты ранжируются лучше Лучше ранжируются полные, а не длинные; лишний объём чаще мешает
SEO-тексты умерли совсем Умер жанр текста под ключи; работа с текстом под запросы никуда не делась, изменились требования
Технология применяется ко всем запросам одинаково Вес текстовых сигналов сильно зависит от типа запроса: у коммерческих на первый план выходят другие факторы
Достаточно один раз переписать страницу Вопросы пользователей и выдача меняются, страницы приходится обновлять

С чего начать на своём сайте

Не нужно переписывать сайт целиком. Выгоднее начать с страниц, которые уже близко к цели и просто недотягивают по содержанию.

  • Выберите страницы, которые стоят во второй-третьей десятке: у них уже есть база, им не хватает смысла.
  • Для каждой соберите список вопросов, на которые она не отвечает.
  • Перепишите по плану выше и отправьте на переобход.
  • Через месяц-полтора сравните позиции и поведение с тем, что было до правки.
  • Тот же приём примените к следующей партии страниц.

Такой подход даёт понятную обратную связь: вы видите, что именно сработало, и переносите рабочий шаблон на остальной сайт, а не переписываете сотни страниц вслепую.

Частые вопросы

Нужно ли теперь вообще подбирать запросы?
Нужно, но задача изменилась. Запросы собирают не для того, чтобы вписать их в текст, а чтобы понять, о чём люди спрашивают и какие подвопросы закрыть на странице. Список запросов превращается в план разделов, а не в список фраз для вставки.

Что делать со старыми SEO-текстами внизу страниц категорий?
Либо переписать в полезный блок, который отвечает на вопросы покупателя, либо убрать. Текст, набитый ключами и не несущий информации, пользы не приносит, а риск попасть под фильтр за переоптимизацию сохраняется.

Насколько важна точная форма запроса в title?
В title лучше использовать формулировку, близкую к тому, как спрашивают люди, но естественную для чтения. Title видит человек в выдаче и решает, кликать ли, поэтому важнее понятность, чем дословность.

Помогает ли добавление слов из выдачи конкурентов?
Механическое добавление слов даёт мало. Полезнее посмотреть, какие темы и подвопросы конкуренты раскрывают, а вы — нет, и закрыть эти пробелы своим содержанием с конкретикой.

Через сколько после переписывания видно результат?
Сначала страницу должен переобойти робот, затем изменения учитываются в ранжировании. Обычно первые сдвиги заметны в интервале от нескольких недель до полутора-двух месяцев, а по конкурентным запросам — дольше.

Разбираю продвижение по шагам — в своём курсе:

Коротко

  • Раньше поиск сопоставлял слова запроса со словами документа, поэтому работали плотность ключей и точные вхождения.
  • Нейросетевые модели сравнивают смысл запроса со смыслом текста целиком, понимают синонимы и перефразировки.
  • Точные вхождения перестали быть обязательными, зато выросла роль полноты ответа и конкретики.
  • Ключевые слова остались нужны в title, заголовках и первом абзаце как ориентир для поиска и читателя.
  • Технология не отменила техническую чистоту, скорость, коммерческие и поведенческие факторы.

Разобрать, каких смыслов не хватает вашим страницам, помогу на SEO-консультации.

Увеличьте позиции и продажи вашего сайта

Профессиональное SEO-продвижение с гарантией результата. Выберите подходящую услугу:

Анатолий Кузнецов — SEO-оптимизатор

Остались вопросы по продвижению?

Меня зовут Анатолий Кузнецов, я SEO-оптимизатор с 20-летним стажем. Разберу ваш сайт, отвечу на вопросы и подскажу, что улучшить для роста позиций в Яндексе и Google.

Связаться со мной →

Комментарии

Сергей

Наконец-то внятное объяснение без формул. Десять лет считал плотность в процентах, а последние года три уже сам чувствовал, что это ни на что не влияет.

Марина

У нас на сайте под каждой категорией висит текст на три тысячи знаков с ключами. Убирать страшно, трогать страшно. Ваш вариант с переписыванием в полезный блок выглядит разумно, попробуем на паре категорий.

Анатолий Кузнецов автор

Правильно, что начинаете с пары категорий, а не со всех сразу. Возьмите две-три близкие по трафику, на одной перепишите текст в блок с ответами на вопросы покупателей, на другой просто уберите. Через полтора-два месяца сравните позиции и поведение. Так вы получите ответ именно по своему сайту, а не по чужому опыту.

Дмитрий

Таблица «до и после» отлично зашла, отправил её копирайтерам вместо технического задания. Половина вопросов отпала сама собой.

Ольга

А как быть, если тема узкая и вопросов пользователей почти нет в подсказках? Откуда тогда брать подвопросы для плана?

Анатолий Кузнецов автор

В узких темах основной источник — не поиск, а ваши же клиенты. Поднимите переписку, записи звонков, вопросы менеджерам, возражения на этапе выбора. Добавьте профильные форумы и отраслевые сообщества, там формулировки живые. Из двадцати таких вопросов обычно получается план сильнее, чем из подсказок.

Игорь

Про тесты с удалением абзаца — приём простой, но работает. Прогнал так свою главную статью, вылетело почти тридцать процентов текста и стало только понятнее.

Наталья

Правильно понимаю, что теперь можно вообще не думать про вхождения и писать как для человека? Или всё-таки где-то ключ обязателен?

Анатолий Кузнецов автор

Писать нужно как для человека, но три места стоит держать под контролем. Это title, заголовок H1 и первый абзац: там тема должна быть названа прямо, теми словами, которыми её ищут. Дальше по тексту можно свободно использовать синонимы и естественные формулировки. Отдельно следите, чтобы заголовки разделов совпадали по смыслу с реальными вопросами.

Павел

Раздел про сырую генерацию попал в точку. Заказывали статьи «под ключ» пачками, вышли ровные, гладкие и абсолютно пустые. Ни одна не поднялась выше третьей страницы.

Екатерина

Переписали пять статей по вашему порядку, дату обновили, на переобход отправили. Пока тишина, прошло три недели. Это нормально или что-то сделали не так?

Анатолий Кузнецов автор

Три недели — это ещё рано, особенно если статьи конкурентные. Проверьте главное: робот действительно переобошёл страницы и в кэше поиска лежит новая версия, а не старая. Если новая версия видна, дальше остаётся ждать: сдвиг обычно приходит в интервале от месяца до двух. Если старая — значит проблема в переобходе, а не в тексте.

Роман

Хорошо, что напомнили про коммерческие факторы. У нас интернет-магазин, тексты вылизали, а цены и условия доставки так и остались спрятаны в подвале. Похоже, тут и лежит основная проблема.

Алексей

Миф про то, что нейросеть читает как человек, встречаю постоянно на конференциях. Формулировка про статистическую близость смыслов гораздо честнее.

Юлия

Есть страницы услуг, где физически мало что можно рассказать: услуга простая, цена одна. Как их наполнять смыслом, чтобы не превратить в воду?

Анатолий Кузнецов автор

Простая услуга не означает мало информации, она означает мало текста о самой услуге. Расскажите, как проходит процесс по шагам, что нужно от клиента, сколько занимает времени, что входит в цену и что оплачивается отдельно. Добавьте случаи, когда услуга не подойдёт, и что делать вместо неё. Такие блоки закрывают реальные вопросы и водой не выглядят.

Виктор

Начал с страниц из второй десятки, как советуете. За два месяца четыре из семи зашли в топ-10 без единой новой ссылки, только переписал структуру и добавил конкретику. Спасибо за подход.

Оставьте комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *

 Нажимая «оставить комментарий» вы принимаетеправила конфиденциальности 

Прокрутить вверх