Логотип seo-prodvizhenie-biznesa.ru
+7 (921) 333-77-45

Алгоритм Matrixnet Yandex

Алгоритм Matrixnet Yandex
Анатолий Кузнецов
Анатолий Кузнецов
SEO-оптимизатор с 20-летним стажем. Автор блога seo-prodvizhenie-biznesa.ru о продвижении и доработке сайтов.

Алгоритм Matrixnet Yandex закрыл эпоху, когда формулу поиска можно было разгадать экспериментом. До конца 2009 года порядок результатов задавали правилами, написанными руками: набор факторов, набор весов, проверка на выдаче, правка. После — порядок задаёт модель, обученная на оценках живых людей, и выписать её коэффициенты не может ни оптимизатор снаружи, ни разработчик внутри, потому что коэффициентов в привычном смысле там больше нет. Из этого следует всё остальное: почему «точных настроек под алгоритм» не существует, почему позиции меняются без ваших действий и почему список задач у владельца сайта за пятнадцать лет изменился куда меньше, чем список модных приёмов.

В SEO я с 2005 года и застал обе картины мира. В первой работали рецепты: подобрал плотность вхождений, поставил ссылку с сильного донора, получил предсказуемый сдвиг. Во второй те же действия дают то результат, то ничего, то минус — и объяснить разницу «изменением алгоритма» нельзя, потому что менялся не алгоритм, а обученная на новых данных модель. Разница между этими двумя объяснениями определяет, на что уйдут ваши деньги в ближайший год.

Как ранжирование выглядело до Матрикснета

Ранняя формула Яндекса собиралась вручную. Разработчики выбирали факторы, назначали им веса, смотрели, как меняется выдача на тестовой выборке запросов, и правили веса дальше. Факторов было немного по нынешним меркам, и каждый имел понятное человеческое объяснение: слово встречается в заголовке, слово встречается в тексте, на страницу ссылаются, домен старый, страница из нужного региона.

Такая конструкция обладала свойством, которое сегодня трудно вообразить: она была обратима. Раз итог складывается из понятных слагаемых, поведение формулы можно восстановить снаружи, ставя опыты. Оптимизаторы этим и занимались — меняли один параметр на группе страниц, смотрели на сдвиг, делали вывод. Из таких опытов выросли легенды тех лет: про идеальную плотность ключевого слова, про вес заголовка относительно тела текста, про то, сколько ссылок нужно на страницу. Часть этих наблюдений тогда действительно работала, и именно поэтому «секретное знание» имело рыночную цену.

У ручной формулы была и обратная сторона, из-за которой её пришлось оставить. Она плохо масштабировалась: чем больше факторов добавляли, тем сложнее было руками подобрать веса так, чтобы улучшение по одному классу запросов не ломало другой. И она была уязвима: раз правила известны, их можно имитировать. Целая индустрия жила на том, чтобы подделать сигналы, которые формула считала признаком качества.

Что изменил переход на машинное обучение

Матрикснет — метод машинного обучения, построенный на градиентном бустинге над решающими деревьями. Практический смысл для владельца сайта в другом: формулу перестали писать и начали обучать. На вход подают огромный набор признаков страницы и запроса плюс эталонные оценки качества, выставленные людьми. Модель сама подбирает такие комбинации признаков, которые лучше всего предсказывают эти оценки.

Ключевое слово здесь — комбинации. Ручная формула складывала вклады факторов. Обученная модель работает иначе: она находит условия вида «если по этому классу запросов страница выглядит так, а вот этот признак ниже обычного, то оценка падает». Такие связи человек не задавал и часто не смог бы сформулировать. Именно поэтому вопрос «какой вес у фактора X» потерял смысл: у фактора нет одного веса, его вклад зависит от значений остальных признаков.

Что сравниваем Ручная формула Обученная модель
Как появляется Пишется разработчиками Обучается на оценках людей
Число признаков Обозримое, каждый объясним Необозримое, публично не раскрывается
Как учитываются Сложение вкладов Сочетания и условия
Единая ли для всех запросов По сути одна Разная для классов запросов и регионов
Обратимость снаружи Отчасти восстанавливалась опытом Восстановить нельзя
Как обновляется Редкие ручные правки Регулярное переобучение на новых данных

Отдельно стоит выделить строку про классы запросов. Возможность строить разные формулы под разные типы запросов и регионы — не побочный эффект, а одна из причин перехода. Коммерческий запрос, информационный и навигационный требуют разного ответа, и универсальный набор весов всегда обслуживал их одинаково плохо. После перехода на обучение поиск получил возможность вести себя по-разному там, где раньше вёл себя одинаково.

Откуда модель берёт представление о хорошем ответе

Модель не знает, что такое «полезная страница». Она знает только то, чему её научили, а учат её на размеченных примерах. Разметку делают асессоры — люди, которые по формальной инструкции оценивают пары «запрос — страница»: насколько результат отвечает на заданный вопрос, от полного соответствия до полного несоответствия.

Если нужны детали, смотрите «Поисковый алгоритм Королёв».

Механика простая по устройству и важная по последствиям. Асессоры дают эталон. Модель ищет, какими признаками этот эталон объясняется. Обученная модель применяется ко всей выдаче, включая запросы, которые никто вручную не оценивал. Накапливаются новые оценки и новые данные — модель переобучают, и порядок результатов меняется, хотя ни один человек не переписывал никаких правил.

Помогу с продвижением: комплексное продвижение сайта — вывожу сайты в топ Яндекса белыми методами.

Из этой цепочки следует вывод, который практичнее любых догадок о весах. Единственный документ, который описывает целевую функцию поиска понятным языком, — это критерии оценки качества, по которым работают асессоры. Они не секретны в своей сути: поиск хочет, чтобы страница отвечала на запрос полностью, не врала, была удобной и заслуживала доверия. Всё, что вы можете сделать со своим сайтом, имеет смысл сверять именно с этим списком, а не с очередным разбором «свежего апдейта».

Если интересно направление с сайтами — базу даю в своём курсе:

Почему «формулу» нельзя вычислить

Периодически появляются исследования, которые обещают восстановить веса факторов по большим выборкам выдачи. Читать их интересно, опираться на них в работе нельзя. Три причины, каждой из которых достаточно по отдельности.

  1. Признаков слишком много, и они взаимозависимы. Корреляция между признаком и позицией не говорит о причине. Классический пример: у страниц из топа в среднем больше входящих ссылок. Это не значит, что ссылки поднимают страницу — сильные страницы одновременно и получают больше ссылок, и лучше отвечают на запрос.
  2. Модель не одна. Разные классы запросов обслуживаются по-разному. Замер, усреднённый по тысяче случайных запросов, описывает несуществующую среднюю выдачу и не описывает вашу нишу.
  3. Модель меняется. Переобучение идёт постоянно. Даже если бы удалось восстановить зависимость точно, к моменту публикации результата она была бы историей, а не инструкцией.

Есть и четвёртая причина, о которой говорят реже. Даже внутри поисковой системы обученная модель не разбирается на понятные коэффициенты — иначе бы существовал документ «веса факторов», и рано или поздно он бы утёк. Разработчик может измерить, насколько ухудшится качество без конкретного признака, но это не то же самое, что «вес фактора» в старом смысле. Продавать вам «настройку под формулу» может только тот, кто не понимает, о чём говорит, или понимает слишком хорошо.

Что оценивают асессоры и как перевести это в задачи

Критерии оценки описаны для людей и человеческим языком, поэтому переводятся в конкретные работы почти дословно. Ниже — перевод, которым я пользуюсь на проектах.

Подробнее об этом — в статье «Панда — алгоритм Google».

Что оценивает человек Что смотрит на странице Что делать на сайте
Соответствие запросу Тот ли тип ответа: каталог, статья, карточка, форма Сверить тип страницы с тем, что стоит в топе по запросу
Полнота ответа Закрыт ли вопрос целиком или нужно искать дальше Добавить цены, сроки, условия, ответы на возражения
Достоверность источника Кто автор, есть ли контакты, реквизиты, подтверждения Подписать материалы, вывести реквизиты и способы связи
Удобство Скорость, мобильная версия, навязчивость рекламы Убрать перекрывающие блоки, ускорить загрузку
Честность заголовка Совпадает ли обещание в сниппете с содержимым Привести title и первый экран в соответствие тексту
Актуальность Не устарели ли данные, цены, условия Датировать и обновлять то, что стареет

Эта таблица не про «понравиться алгоритму». Она про то, чему модель училась. Разница принципиальная: приёмы, найденные подгонкой под текущее состояние выдачи, обесцениваются очередным переобучением, а работа по критериям качества переживает любое обновление, потому что сами критерии и есть цель обучения.

Почему выдача меняется без ваших действий

Самая частая жалоба на консультации звучит так: сайт не трогали месяц, а позиции ходят вверх-вниз, вчера были четвёртые, сегодня девятые. В мире ручной формулы это означало бы, что кто-то что-то поменял. В мире обучаемой модели у колебаний есть штатные причины, и большинство из них к вашему сайту отношения не имеют.

Причина сдвига Как выглядит Что делать
Переобучение модели Сдвиг по многим запросам сразу, у конкурентов тоже Ничего срочного, наблюдать две-четыре недели
Изменения у конкурентов Просадка по узкой группе запросов Сравнить свою страницу с новой страницей соседа
Смена характера запроса В топе поменялся тип страниц Пересобрать страницу под новый тип ответа
Накопление поведенческих данных Медленный дрейф в одну сторону Смотреть отказы и возвраты в выдачу
Персонализация и регион Позиция разная у вас и у клиента Проверять по показам, а не глазами из браузера
Технический сбой Резкое падение по всему сайту сразу Проверить доступность, ответы сервера, индексацию

Практический вывод простой. Позиция конкретного дня — это шум, а не показатель. Работать надо с показами и кликами за две-четыре недели: они показывают спрос и видимость по всей группе запросов, а не результат одного замера в одном регионе. Единственный тип колебаний, который требует реакции в тот же день, — резкое падение по всему сайту, потому что это почти всегда техника, а не модель.

Как проверять гипотезы, когда точных правил нет

Отсутствие формулы не отменяет проверяемости. Оно отменяет только один способ проверки — изолированный опыт на одной странице. Раз результат зависит от сочетания признаков и от конкурентной среды, одиночное наблюдение не отличает эффект правки от обычного дрейфа.

Рабочая замена — проверка на выборке. Порядок такой:

  • Соберите группу однотипных страниц: одинаковый шаблон, сопоставимый спрос, схожая текущая видимость.
  • Разделите её на две части: тестовую и контрольную. Контрольную не трогаете вообще.
  • Внесите одно изменение на тестовой части — одно, а не пять.
  • Дайте время на переобход и накопление статистики: обычно это от трёх-четырёх недель.
  • Сравните динамику показов по группам, а не абсолютные позиции. Если обе группы просели одинаково — это модель, если разошлись — это ваша правка.

Если нужна помощь по теме — мой курс по SEO.

Такой подход требует терпения и достаточного числа страниц, зато даёт ответ, применимый именно к вашему сайту и вашей нише. Чужие исследования отвечают на вопрос «что бывает в среднем по выдаче», а вам нужен ответ на вопрос «что работает у меня». Это разные вопросы, и второй важнее.

Тему разбирал отдельно: «Минусинск — алгоритм Яндекса».

На что тратить силы вместо угадывания алгоритма

Если формулу нельзя просчитать, остаётся работать по её источнику — по тому, что оценивают люди. Ниже направления в том порядке, в котором я их разбираю на проектах, и способ убедиться, что работа сделана, а не имитирована.

Направление Что даёт Чем проверить
Техническая доступность Страница вообще участвует в ранжировании Индексация и ответы сервера в Вебмастере
Структура под спрос Под каждую устойчивую группу запросов своя страница Вордстат, Rush Analytics, отчёт по запросам
Полнота страницы Человек не уходит дообъяснять запрос в поиск Сравнение с топ-5, доля возвратов в выдачу
Признаки доверия Страница проходит проверку на достоверность Реквизиты, авторство, контакты, подтверждения
Скорость и мобильная версия Убирает штраф за неудобство Замеры на реальных страницах, не только на главной
Ссылочное окружение Подтверждает то, что уже есть на сайте Мегаиндекс, разбор доноров вручную

Порядок в таблице не случайный. Вложения в нижние строки не работают, пока не закрыты верхние: ссылки на страницу, которая не отвечает на запрос, дают в лучшем случае ноль. Обученная модель оценивает страницу целиком, и провал по одному направлению тянет вниз общую оценку, каким бы сильным ни было остальное. Именно поэтому «сделаем упор на ссылки» или «зальём тексты» перестало работать как стратегия.

Ошибки, оставшиеся от эпохи ручной формулы

Часть привычек пережила формулу, которая их породила, и до сих пор съедает бюджеты. Разберу самые дорогие.

  • Погоня за плотностью вхождений. Наследие времён, когда текст оценивался по частоте слов. Сегодня переспам скорее вредит: он ухудшает читаемость, а читаемость входит в критерии оценки.
  • Копирование топа один в один. Логика «у лидера так, значит так надо» игнорирует то, что вы видите следствие, а не причину. Копия не даёт того, чего в выдаче ещё нет, — а именно за это страница и получает место.
  • Реакция на каждое движение позиций. Правка сайта в ответ на дневной шум делает историю изменений нечитаемой: через месяц вы не сможете сказать, что именно повлияло.
  • Вера в универсальный чеклист. Раз формула разная для разных типов запросов, единый список требований ко всем страницам сайта заведомо неточен. Каталог и статья решают разные задачи.
  • Ожидание мгновенного эффекта. Модель переобучается на накопленных данных, поведенческие сигналы копятся неделями. Оценка результата раньше месяца — это оценка шума.

Общий знаменатель у всех пяти один: попытка обращаться с обученной моделью как с набором правил. Пока сохраняется эта установка, любая новость про алгоритмы будет читаться как инструкция, а любое колебание — как сигнал.

Частые вопросы

Можно ли где-то узнать веса факторов? Нет. Не потому, что их прячут, а потому, что в обученной модели нет списка коэффициентов, который можно было бы опубликовать. Вклад признака зависит от значений остальных признаков и от класса запроса.

Матрикснет ещё используется? Технологии развивались: у Яндекса появился открытый градиентный бустинг CatBoost, затем нейросетевые модели, которые работают со смыслом запроса, а не только с формальными признаками. Принцип при этом не изменился — ранжирование строится на обучении, а не на написанной руками формуле, и все выводы этой статьи остаются в силе.

Значит, SEO бессмысленно? Бессмысленно угадывание формулы. Работа по критериям, на которых модель обучалась, наоборот, стала предсказуемее: раньше очередное обновление обесценивало найденные приёмы, теперь вложения в соответствие запросу, технику и доверие переносятся из обновления в обновление.

Почему у конкурента страница хуже, а стоит выше? Чаще всего потому, что «хуже» вы оцениваете по одному-двум видимым признакам — объёму текста или дизайну. Модель учитывает совокупность, включая историю домена, поведение людей и соответствие типу запроса. Полезнее не спорить с выдачей, а разобрать, какую потребность закрывает эта страница и чего не хватает вашей.

Есть ли смысл в новостях об апдейтах? Как в наблюдении за погодой — понять, что происходит, полезно, планировать по ним работу нельзя. Ни одно описание апдейта снаружи не даёт инструкции к действию, потому что описывает следствия, а не причины.

Коротко

  • Матрикснет заменил написанную руками формулу моделью, обученной на оценках живых людей, — с 2009 года порядок выдачи задают не правила, а результат обучения.
  • Признаки учитываются в сочетаниях, а не складываются, поэтому у фактора нет постоянного веса и «настроек под алгоритм» не существует.
  • Формула разная для разных классов запросов и регионов: универсальный чеклист по всему сайту заведомо неточен.
  • Ежедневные колебания позиций — следствие постоянного переобучения и действий конкурентов; реагировать стоит на тренд за две-четыре недели по показам.
  • Единственный публичный ориентир — критерии оценки качества: соответствие запросу, полнота, достоверность, удобство, актуальность.
  • Гипотезы проверяются на группе страниц с контрольной выборкой, а не одиночным опытом на одной странице.

Если по вашему сайту непонятно, где именно проседает оценка — в технике, в структуре под спрос или в доверии к страницам, — приходите на SEO-консультацию: посмотрю сайт и статистику Вебмастера вместе с вами и назову те направления, где сейчас теряется больше всего.

Увеличьте позиции и продажи вашего сайта

Профессиональное SEO-продвижение с гарантией результата. Выберите подходящую услугу:

Анатолий Кузнецов — SEO-оптимизатор

Остались вопросы по продвижению?

Меня зовут Анатолий Кузнецов, я SEO-оптимизатор с 20-летним стажем. Разберу ваш сайт, отвечу на вопросы и подскажу, что улучшить для роста позиций в Яндексе и Google.

Связаться со мной →

Комментарии

Роман Дьяконов

Подрядчик третий месяц объясняет просадку «изменением алгоритма». По вашей таблице получается, что если бы это было переобучение, то у конкурентов тоже качало бы. Проверил вручную по десятку запросов — конкуренты стоят ровно, качает только нас. Значит, дело не в алгоритме, а искать надо у себя.

Анатолий Кузнецов автор

Вывод верный, и проверка сделана правильно. Добавлю два шага, чтобы сузить круг. Сначала посмотрите в Вебмастере, не менялось ли число страниц в поиске и не появились ли новые ошибки обхода — падение по всему сайту почти всегда техника. Если с индексацией порядок, сравните просевшие страницы с непросевшими: общий шаблон, общий тип запроса, общий раздел. Чаще всего просадка садится на одну группу, и эта группа сама показывает причину. И зафиксируйте, что вы меняли на сайте за два месяца до падения, включая правки, которые кажутся мелкими: замену шаблона карточки или переезд блока с ценами.

Зинаида Плетнёва

Про плотность ключей всё понятно, но копирайтеры до сих пор берут заказы с ТЗ, где прописано число вхождений. Не потому что верят, а потому что так заказчик привык. Замкнутый круг.

Станислав Гребенщиков

Меня смущает совет проверять на группе страниц. У меня сайт услуг, страниц всего девятнадцать, однотипных из них штук восемь. Какую контрольную группу тут собрать? Получается, метод для интернет-магазинов, а малому сайту остаётся действовать вслепую.

Анатолий Кузнецов автор

На девятнадцати страницах групповой тест действительно не собрать, и притворяться, что соберётся, не надо. Для маленького сайта работает другой порядок. Первое: меняйте по одному и фиксируйте дату правки, чтобы через месяц было с чем сверять график показов. Второе: опирайтесь на показы по группе запросов, а не по одному ключу — по десятку запросов к одной странице шум усредняется. Третье: пока сайт маленький, у вас почти наверняка не исчерпаны очевидные вещи — непокрытые группы спроса, отсутствие цен, слабый первый экран. Их эффект виден без всякой статистики, и заниматься тонкими экспериментами до них смысла нет.

Лидия Черемных

Хорошо показана разница между корреляцией и причиной. У нас маркетолог принёс исследование, где у топовых сайтов в среднем больше объём текста, и предложил дописать всем страницам по три тысячи знаков. Аргумент «это следствие, а не причина» он не принял, а теперь есть на что сослаться.

Артём Кислицын

Вопрос про асессоров. Они же физически не могут оценить каждый сайт. Значит, мою страницу вживую никто никогда не смотрел, и оценка ей выставлена машинно. Тогда какой смысл ориентироваться на критерии, написанные для людей?

Анатолий Кузнецов автор

Вашу страницу почти наверняка никто из асессоров не видел — и это ничего не меняет. Оценки асессоров нужны не для того, чтобы выставить балл каждому сайту, а для того, чтобы обучить модель, которая потом расставляет всю выдачу. Модель ищет, какими признаками объясняются человеческие оценки на обучающей выборке, и переносит найденное на страницы, которых в выборке не было. Поэтому критерии, написанные для людей, действуют и на вашей странице — через модель. Практический смысл именно такой: вы работаете не на конкретного проверяющего, а на признаки, по которым отличается страница, получившая высокую оценку от человека.

Жанна Мамедова

Держим сайт клиники, каждое обновление читаем как приговор. После этой статьи поменяли отчётность: убрали ежедневные позиции, оставили показы за четыре недели. Нервов стало заметно меньше, а картина честнее — оказалось, часть «падений» была разбросом по регионам.

Кирилл Бурмистров

Не соглашусь с тезисом, что ссылки только подтверждают. У нас две одинаковые страницы, на одну поставили ссылки с тематических площадок, на вторую нет. Разница в показах есть и держится. Совокупность совокупностью, но рычаг работает.

Анатолий Кузнецов автор

Ваш результат не противоречит тезису, он его уточняет. Ссылки работают, когда всё остальное на странице уже в порядке: она отвечает на запрос, доступна, не хуже соседей по выдаче. В этом случае внешние упоминания действительно сдвигают оценку, потому что подтверждают то, что уже есть. Спор идёт не о том, работают ли ссылки, а о том, что бывает при обратном порядке — когда ссылки покупают на слабую страницу вместо того, чтобы её доделать. Там эффект стремится к нулю, а иногда уходит в минус из-за качества доноров. Проверьте ещё одну вещь: одинаковый ли спрос у ваших двух страниц, иначе часть разницы в показах объясняется не ссылками.

Ольга Сотникова

Таблица с переводом критериев в задачи — самое полезное. Распечатала и повесила рядом с монитором. Пункт про честность заголовка закрыл давний спор с руководителем, который хотел писать в title «лучшие цены» без всяких оснований.

Дмитрий Хлебников

Интересно, что в статье нет ни одного числа вроде «фактор весит столько-то процентов». Обычно такие материалы этим и заполнены. Теперь понятно, почему их не может быть в принципе, хотя раньше казалось, что авторы просто ленятся уточнить.

Гульнара Юсупова

У нас сезонный бизнес, и характер запроса меняется дважды в год. В таблице причин это есть, но не написано, как отличить сезонную смену типа выдачи от постоянной. Мы дважды перестраивали посадочные под новый формат, а через два месяца всё возвращалось к прежнему.

Анатолий Кузнецов автор

Отличить можно, но только по истории, поэтому её надо вести. Заведите простой журнал: раз в месяц сохраняйте состав топ-10 по десятку опорных запросов — достаточно типа страницы и домена. Через год у вас будет картина за два цикла сезона, и станет видно, что возвращается, а что сменилось насовсем. Правило для решений такое: под колебание, которое повторялось в прошлом сезоне, посадочные не перестраивают — под него готовят второй вариант блока и переключают его, не трогая структуру. Перестраивать страницу стоит только тогда, когда новый тип выдачи держится дольше одного цикла и появляется у нескольких конкурентов сразу.

Павел Ерофеев

Добавлю к разделу про ошибки. Самая дорогая привычка у нас была не в текстах, а в отчётности: платили за «средняя позиция улучшилась», хотя обращений не прибавилось. Когда перешли на показы и заявки, половина работ подрядчика оказалась незаметной ни в одной метрике.

Наталья Скворчевская

Вопрос по последнему разделу. Если новости об апдейтах не дают инструкции, стоит ли вообще их читать? Времени уходит много, а после каждой такой новости в чатах начинается паника и советы срочно что-то откатывать.

Оставьте комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *

 Нажимая «оставить комментарий» вы принимаетеправила конфиденциальности 

Прокрутить вверх