Логотип seo-prodvizhenie-biznesa.ru
+7 (921) 333-77-45

Краулинговый бюджет сливается в никуда, пока вы пишете тексты: куда на самом деле уходит внимание робота

Краулинговый бюджет сливается в никуда, пока вы пишете тексты: куда на самом деле уходит внимание робота
Анатолий Кузнецов
Анатолий Кузнецов
SEO-оптимизатор с 20-летним стажем. Автор блога seo-prodvizhenie-biznesa.ru о продвижении и доработке сайтов.

Краулинговый бюджет сливается в никуда обычно не из-за плохих текстов и не из-за «зарезавшего» алгоритма, а из-за того, что робот тратит отведённое ему время на страницы, которых на сайте вообще не должно быть в открытом виде. Владелец в это время пишет новые статьи, переписывает карточки и ждёт роста — а поисковый робот неделями ходит по фильтрам, сортировкам, дублям и редиректам и до новых материалов просто не доходит.

Ниже — механика: из чего складывается лимит обхода, какие разделы съедают его чаще всего, как за полчаса увидеть реальный маршрут робота по своему сайту и в каком порядке чинить, чтобы новые страницы попадали в поиск за дни, а не за месяцы.

Из чего складывается краулинговый бюджет

Лимит обхода — это количество обращений, которое поисковая система готова сделать к вашему серверу за единицу времени. Он складывается из двух независимых величин, и путать их нельзя.

Первая — техническая пропускная способность. Робот следит за тем, как быстро сервер отвечает и не начинает ли он отдавать ошибки под нагрузкой. Если среднее время ответа растёт с 200 мс до полутора секунд, частота обращений автоматически снижается: система бережёт чужой сервер от падения. Точно так же лимит режется, когда в ответах появляются коды 5xx или таймауты. Это самый прямой способ потерять обход, ничего специально не сделав, — просто переехав на дешёвый тариф хостинга.

Вторая — интерес к сайту. Он складывается из того, насколько часто содержимое обновляется, приходят ли на страницы люди, ссылаются ли на материал снаружи, попадали ли раньше страницы в выдачу и приносили ли клики. Сайт, где половина страниц никогда не показывалась в результатах поиска, постепенно получает всё более редкие визиты робота. Это не наказание, а экономия: система не видит смысла тратить ресурс на то, что в выдаче не участвует.

Отсюда следует неочевидный вывод. Бюджет обхода не выдаётся раз и навсегда — он подвижен в обе стороны. Ускорили ответ сервера, убрали мусорные разделы, начали регулярно обновлять важные страницы — частота обхода растёт. Раздули сайт на сотни тысяч технических адресов — падает, причём падает и по нужным страницам тоже, потому что лимит общий.

Куда утекает бюджет: типовые пожиратели

За годы аудитов список причин почти не меняется. Меняются только пропорции: где-то главный виновник — фильтры каталога, где-то — календарь на движке, где-то — старые редиректы после переезда.

Что съедает обход Как выглядит Типичный масштаб
Фильтры и сортировки каталога Адреса с параметрами вида ?color=&size=&sort= От тысяч до сотен тысяч адресов
Метки рекламных кампаний Одна страница в десятках вариантов с utm-хвостами Кратное дублирование каталога
Пагинация без ограничений Страницы 2, 3, 4 … 400 с почти одинаковым содержимым Сотни адресов на раздел
Цепочки редиректов Адрес ведёт на адрес, тот на третий, третий на конечный Три-четыре обращения вместо одного
Битые внутренние ссылки Ссылки на удалённые страницы, отдающие 404 Десятки процентов обхода на пустоту
Служебные разделы движка Архивы по датам, теги, страницы авторов, поиск по сайту Часто больше, чем полезных страниц
Пустые карточки и разделы Товары без описаний, категории без товаров Растёт вместе с каталогом
Дубли по протоколу и слешу Один документ доступен по четырём-восьми адресам Умножение всего сайта

Обратите внимание на последнюю строку. Если документ открывается с www и без, с завершающим слешем и без него, а вдобавок отвечает по http без принудительного перехода на https, робот честно считает это разными документами. Восьмикратное умножение сайта — это восьмикратное деление бюджета на полезные страницы.

Как посмотреть, чем робот занят на самом деле

Догадки тут не работают. Нужны два источника данных, и оба доступны без платных сервисов.

Первый — панели для вебмастеров. В Яндекс.Вебмастере откройте «Индексирование → Статистика обхода»: там видно, сколько страниц робот загрузил за день, какие коды ответа получил и какие адреса обходил. Выгружайте архив за максимальный доступный период и смотрите не сводные цифры, а сам список адресов. В Search Console аналогичные данные лежат в отчёте «Статистика сканирования» — там же разбивка по типам файлов и по причине обращения.

Второй, куда более честный — логи веб-сервера. Это единственный источник, который показывает все обращения, а не выборку. Попросите доступ к access-логам за две-четыре недели и посчитайте обращения роботов в разрезе разделов сайта. Практический порядок работы такой:

Подробнее об этом — в статье «Проверка текста на уникальность: сколько процентов на самом деле нужно поиску».

  1. Отфильтруйте строки по идентификатору робота в поле User-Agent, отдельно по каждой поисковой системе.
  2. Проверьте, что это действительно робот, а не подделка: у основных систем есть обратная проверка по IP.
  3. Сгруппируйте адреса по первому уровню вложенности и посчитайте долю обращений на каждую группу.
  4. Отдельно посчитайте распределение по кодам ответа: сколько ушло на 200, сколько на 301, 404 и 5xx.
  5. Сравните список часто посещаемых адресов со списком страниц, которые приносят вам показы в поиске.

Дальше начинается самое отрезвляющее. Обычно оказывается, что на страницы, приносящие трафик, приходится меньше трети обращений. Остальное — параметры, редиректы, ошибки и разделы, о существовании которых владелец не подозревал.

Третий источник, вспомогательный, — краулер вроде бесплатных настольных сканеров. Он покажет, куда ведут ваши внутренние ссылки. Важно понимать разницу: краулер показывает, что вы сами предлагаете роботу, а логи — что робот на самом деле делает. Расхождение между этими двумя картинами и есть зона потерь.

Параметры, фильтры и бесконечные комбинации

Помогу с продвижением: раскрутка сайта в Яндексе — вывожу сайты в топ Яндекса белыми методами.

Каталог с фильтрами — главный генератор мусорных адресов. Пять фильтров по десять значений в каждом дают десятки тысяч комбинаций, и каждая из них технически доступна по своему адресу. Робот, находя ссылки на эти комбинации в вёрстке, обходит их одну за другой. Полезного содержимого там нет: те же товары в другом порядке.

Правильный подход состоит из трёх решений, принимаемых осознанно, а не по шаблону.

Первое. Определите, какие комбинации фильтров имеют самостоятельный спрос. «Кроссовки мужские зимние» — имеют, по ним ищут. «Кроссовки, отсортированные по возрастанию цены, вторая страница» — нет. Первую группу превращайте в нормальные страницы с человекопонятным адресом, собственным заголовком, текстом и метаданными. Вторую закрывайте от обхода.

Второе. Закрывайте не только правилом в robots.txt, но и на уровне вёрстки. Ссылки на служебные комбинации не должны попадать в HTML как обычные ссылки: если фильтр реализован без перезагрузки страницы, робот их и не увидит. Правило в robots.txt останавливает загрузку, но не мешает роботу пытаться — а вот отсутствие ссылки решает вопрос полностью.

Третье. Метки рекламных кампаний и идентификаторы сессий должны либо отбрасываться сервером с постоянным перенаправлением на чистый адрес, либо, если это ломает аналитику, страница обязана указывать канонический адрес без параметров. Указание канонического адреса — рекомендация, а не команда: система вправе её проигнорировать. Поэтому в спорных случаях надёжнее перенаправление.

Редиректы, битые ссылки и цепочки

Каждый переход по цепочке — отдельное обращение, потраченное из общего лимита. Адрес, который ведёт на второй, тот на третий, а третий на конечный документ, стоит вчетверо дороже прямой ссылки. На сайте, пережившем два переезда структуры, такие цепочки исчисляются тысячами.

Что делать по порядку:

Тему разбирал отдельно: «Яндекс начал банить ИИ-тексты без правки: проверьте свой сайт, пока не поздно».

  • Выгрузите все внутренние ссылки краулером и найдите те, что отдают код 301 или 302. Замените их в вёрстке на конечные адреса. Перенаправление на сервере оставьте — оно нужно для внешних ссылок и закладок, но внутри сайта ссылаться нужно сразу на конечную точку.
  • Разберите цепочки длиннее одного шага: перенаправление должно вести напрямую на итоговый адрес, а не через промежуточные.
  • Найдите внутренние ссылки на несуществующие страницы. Каждая такая ссылка — приглашение роботу сходить в пустоту, и он это приглашение принимает, причём регулярно.
  • Проверьте, какие адреса отвечают кодом 200, хотя должны отвечать 404. Движки часто отдают «страница не найдена» с успешным кодом — робот считает такие страницы нормальными и продолжает их обходить и переобходить.
  • Замените временные перенаправления на постоянные там, где переезд окончательный. Временное перенаправление заставляет робота возвращаться к старому адресу снова и снова.
  • UTM-метки для Директа: откуда на самом деле пришла заявка

Отдельная история — удалённые разделы. Если категория закрыта навсегда, ей нужен код 410, а не 404: он говорит системе, что возвращаться не нужно. Разница в частоте повторных обращений заметная.

Дубли, пагинация и служебные страницы

Пагинация сама по себе не вредна: это нормальный способ разбить длинный список. Вредна пагинация без границ, когда раздел разворачивается на четыреста страниц, а на каждой из них ещё и дублируется вводный текст категории. Разумный подход — сокращать глубину: увеличить число элементов на странице, ввести дополнительные подразделы, чтобы пользователь попадал в нужное место в два клика, а не листал сорок экранов.

Служебные разделы движка — второй источник объёма. Архивы по месяцам и годам, страницы меток, страницы авторов на сайте с одним автором, результаты внутреннего поиска, печатные версии страниц, ленты вложений. Всё это создаётся автоматически и обходится роботом наравне с полезными материалами. Осмысленное правило: раздел остаётся открытым, только если он собирает собственный поисковый спрос и имеет уникальное содержимое. Метка, под которой лежат три статьи, спроса не собирает.

Третий источник — внутренние дубли содержимого. Карточки товаров, отличающиеся только цветом, при одинаковом описании воспринимаются как повторы. Решение не в том, чтобы переписать сто карточек вручную, а в том, чтобы выбрать одну главную и указать на неё как на каноническую с остальных, оставив различия в характеристиках.

Порядок действий: что чинить первым

Ошибка большинства — начинать с самого заметного. Правильнее начинать с самого дешёвого по трудозатратам и самого крупного по эффекту. Ниже порядок, который я применяю на аудитах.

Шаг Что делаем Что меняется
1 Склеиваем зеркала: один протокол, один вариант с www, один вариант слеша Сайт перестаёт множиться в два-восемь раз
2 Закрываем параметры фильтров и сортировок, убираем ссылки на них из вёрстки Уходит основная масса мусорных адресов
3 Чиним внутренние ссылки на редиректы и 404 Обращения перестают уходить в пустоту
4 Отключаем ненужные служебные разделы движка Освобождается заметная доля обхода
5 Ускоряем ответ сервера и включаем кэширование Растёт технический лимит обращений
6 Приводим в порядок карту сайта: только адреса с кодом 200 и честными датами изменения Робот получает точный список приоритетов
7 Настраиваем перелинковку на важные страницы Обход перераспределяется в пользу нужного

Про карту сайта стоит сказать отдельно, потому что её постоянно портят. В карте не должно быть адресов, закрытых от индексирования, отдающих перенаправление или ошибку, а также страниц с указанием другого канонического адреса. Дата последнего изменения должна меняться только тогда, когда содержимое действительно менялось: если движок проставляет туда сегодняшнее число для всех страниц разом, значение теряет смысл и перестаёт учитываться.

Ошибки, из-за которых становится хуже

Если нужна помощь по теме — разработка сайта под ключ.

Половина проблем с обходом возникает после попыток его «оптимизировать». Самые частые промахи:

  • Закрыть в robots.txt то, что уже в индексе. Запрет на загрузку не удаляет страницу из результатов поиска — он лишь мешает системе увидеть, что страница закрыта мета-тегом. Сначала ставим запрет на индексирование в коде страницы, ждём переобхода, и только потом при необходимости закрываем в robots.txt.
  • Массово удалять страницы без разбора. Прежде чем сносить раздел, посмотрите в отчёте по запросам, приносит ли он показы. Малополезная на первый взгляд страница может держать длинный хвост запросов.
  • Ставить указание канонического адреса вместо перенаправления. На технических дублях с параметрами это работает, на разных документах — нет: система сравнивает содержимое и при расхождении рекомендацию игнорирует.
  • Ограничивать скорость обхода в панели без причины. Такой ползунок есть, и его иногда двигают «на всякий случай». Двигать его нужно только тогда, когда робот действительно создаёт нагрузку — это видно по логам и графикам сервера.
  • Считать, что проблема в бюджете, когда сайт маленький. На сайте в двести страниц с нормальным сервером лимита обхода хватает с запасом. Если страницы не индексируются, причина почти всегда в другом: в качестве содержимого, в дублях или в запретах.
  • UTM-метки для Директа: откуда на самом деле пришла заявка

Последний пункт важнее остальных. Лимит обхода становится реальным ограничением на проектах примерно от нескольких тысяч страниц и на любых каталогах с фильтрами. Для блога на сотню статей объяснять отсутствие роста нехваткой бюджета — значит лечить не ту болезнь.

Смежный материал по теме — «Что Яндекс на самом деле проверяет, когда решает, поднять вас или утопить».

Как понять, что стало лучше

Работа считается сделанной не тогда, когда закрыты параметры, а тогда, когда изменилось поведение робота. Смотрите на четыре показателя и сравнивайте их с периодом до правок.

Доля обращений на полезные страницы. Считается по логам: обращения к разделам, участвующим в выдаче, делённые на все обращения роботов. Рост этой доли — главный признак успеха.

Распределение по кодам ответа. Доля 200 должна расти, доли 301, 404 и 5xx — падать. Если после правок выросла доля перенаправлений, значит, внутренние ссылки не переписали на конечные адреса.

Скорость попадания новых страниц в поиск. Самый понятный владельцу показатель. Заведите простую таблицу: дата публикации, дата первого обращения робота, дата появления в результатах. До и после правок разница обычно видна невооружённым глазом.

Соотношение загруженных и участвующих в поиске страниц. В панелях для вебмастеров это видно напрямую. Здоровая картина — когда обе величины близки. Разрыв в разы означает, что робот тратит ресурс на то, что в выдачу всё равно не попадёт.

Частые вопросы

Сколько времени проходит между правками и изменением частоты обхода? От недели до полутора месяцев в зависимости от размера сайта. Технические ограничения — скорость ответа сервера — отрабатываются быстрее, интерес к сайту пересчитывается медленнее. Делать выводы на третий день бессмысленно.

Помогает ли ручная отправка адресов на переобход? Помогает для отдельных важных страниц и для срочных изменений. Как способ разгрузить обход не работает: лимит на ручную отправку небольшой, а причина потерь остаётся на месте.

Нужно ли закрывать пагинацию от индексирования? Не обязательно и часто вредно: через страницы списка робот добирается до товаров вглубь каталога. Разумнее сократить глубину и убедиться, что на каждой странице списка своя разметка заголовка и метаданных, а вводный текст категории не повторяется на всех страницах подряд.

Влияет ли скорость сайта только через лимит обхода? Нет, влияние двойное. Быстрый ответ увеличивает частоту обращений робота и одновременно улучшает поведение живых посетителей, а поведенческие сигналы учитываются при ранжировании отдельно. Экономия на хостинге бьёт сразу по двум направлениям.

Что делать, если каталог генерирует адреса бесконечно? Такое бывает при связках фильтров и календарей: комбинаций технически бесконечно много. Единственное надёжное решение — на уровне кода запретить генерацию ссылок на комбинации глубже определённого уровня и отдавать по таким адресам код 404. Никакие правила в robots.txt эту дыру полностью не закрывают.

Стоит ли смотреть логи, если сайт на типовом движке? Стоит, и в первую очередь именно на типовом. Массовые движки создают служебные разделы автоматически, и владелец о половине из них не знает, пока не увидит их в списке посещённых роботом адресов.

Коротко

  • Лимит обхода складывается из технической пропускной способности сервера и интереса системы к сайту; обе величины подвижны и управляемы.
  • Основные потери дают фильтры и параметры, зеркала по протоколу и слешу, цепочки редиректов, битые внутренние ссылки и служебные разделы движка.
  • Догадки заменяются логами сервера: они показывают все обращения роботов, а не выборку, и сразу вскрывают перекос.
  • Чинить нужно в порядке «дёшево и крупно»: сначала зеркала и параметры, потом ссылки и служебные разделы, затем скорость и карта сайта.
  • Закрытие в robots.txt страницы, уже попавшей в индекс, не убирает её из выдачи — сначала запрет в коде страницы, потом запрет на загрузку.
  • Результат меряется долей обращений на полезные страницы, распределением кодов ответа и скоростью появления новых страниц в поиске.
  • UTM-метки для Директа: откуда на самом деле пришла заявка

Если по логам видно, что робот занят не тем, а разобраться в причинах самостоятельно не выходит, приходите на SEO-консультацию — разберём распределение обхода по вашему сайту и составим порядок работ под конкретный движок.

Увеличьте позиции и продажи вашего сайта

Профессиональное SEO-продвижение с гарантией результата. Выберите подходящую услугу:

Анатолий Кузнецов — SEO-оптимизатор

Остались вопросы по продвижению?

Меня зовут Анатолий Кузнецов, я SEO-оптимизатор с 20-летним стажем. Разберу ваш сайт, отвечу на вопросы и подскажу, что улучшить для роста позиций в Яндексе и Google.

Связаться со мной →

Комментарии

Осип Перфильев

Полез в логи после статьи. Магазин на 12 тысяч товаров, а половина обращений робота — на адреса с сортировкой по цене. Причём фильтр у нас на ссылках, то есть робот видит их как обычные переходы. Стало понятно, почему новые категории заходят в поиск по два месяца.

Анатолий Кузнецов автор

Сортировка на обычных ссылках — самый распространённый вариант этой проблемы, и чинится он в два приёма. Сначала уберите сортировку и постраничные переходы из HTML как ссылки: переведите их на обработку без перезагрузки либо на форму с методом POST. Робот перестанет их видеть в тот же переобход. Затем правилом на сервере отдавайте по адресам с параметром сортировки постоянное перенаправление на чистый адрес категории — это подчистит то, что уже накопилось в индексе. Одного запрета в robots.txt тут мало: он останавливает загрузку, но адреса продолжают числиться известными и периодически проверяются. И отдельно проверьте, не попали ли адреса с сортировкой в карту сайта — такое встречается чаще, чем можно подумать.

Нинель Ратушная

У нас сайт на 180 страниц, и подрядчик объясняет отсутствие роста именно краулинговым бюджетом. Из статьи поняла, что на таком объёме это вряд ли причина. Что тогда спросить у него по существу?

Анатолий Кузнецов автор

На 180 страницах лимит обхода почти никогда не бывает узким местом, вы правы. Попросите три конкретные выгрузки. Первая — список всех страниц сайта с кодом ответа и статусом в поиске: сколько загружено, сколько участвует в выдаче, сколько исключено и по какой причине. Вторая — отчёт по поисковым запросам за квартал: показы, клики, средняя позиция по страницам. Третья — список страниц, у которых есть показы, но нет кликов, с их заголовками и описаниями. Эти три выгрузки закрывают вопрос о том, где реальная проблема: в индексировании, в релевантности или в сниппетах. Если вместо выгрузок вам объясняют механику бюджета — разговор идёт не о вашем сайте.

Ираида Эгипко

Про код 410 для удалённых разделов не знала. Мы закрывали направление и оставили просто 404. Обращения к этим адресам действительно шли ещё месяцами, я думала, так и должно быть.

Таисия Уфимцева

Не соглашусь с советом убирать метки кампаний перенаправлением. У нас на этом строится вся сквозная аналитика, перенаправление её ломает начисто. Получается, выбор между обходом и данными по рекламе.

Анатолий Кузнецов автор

Выбирать не нужно, я про это и писал: перенаправление — вариант для тех случаев, когда метки не нужны. Если аналитика на них построена, работает другая схема. Метка остаётся в адресе, счётчик её фиксирует, а страница указывает канонический адрес без параметров — этого достаточно, чтобы система склеила варианты. Дополнительно закройте параметр от загрузки правилом в robots.txt: сюда робот приходит не по внутренним ссылкам, а по внешним переходам, поэтому потери обхода тут ощутимо меньше, чем от фильтров. И проверьте одну вещь, на которой часто спотыкаются: канонический адрес должен быть абсолютным и без параметров, а не копией текущего адреса, которую подставляет движок автоматически.

Глафира Щавелева

Табличка с порядком шагов очень пригодилась. Пункт про зеркала оказался про нас: сайт открывался и со слешем, и без, и всё это годами. Программист говорит, что чинить надо на уровне сервера, а не плагином.

Лаврентий Вязников

Вопрос про карту сайта. У нас движок ставит сегодняшнюю дату изменения всем страницам разом при каждой пересборке. Это правда настолько плохо?

Анатолий Кузнецов автор

Плохо не тем, что вас за это накажут, а тем, что вы теряете рабочий инструмент. Дата изменения — это подсказка, куда роботу идти в первую очередь. Когда у всех страниц она одинаковая и меняется каждый день, подсказка перестаёт нести информацию и просто перестаёт учитываться. В итоге страница, которую вы реально переписали, встаёт в общую очередь наравне с той, что не менялась два года. Чинится это на стороне генератора карты: дату нужно брать из поля последнего изменения записи в базе, а не из момента сборки файла. Если движок так не умеет, проще генерировать карту отдельным скриптом по расписанию — это несколько десятков строк кода. И заодно уберите оттуда всё, что отдаёт перенаправление или закрыто от индексирования.

Харитон Обносов

Проверил распределение кодов ответа по логам за месяц. На 301 ушло 22% всех обращений робота. Мы два года назад меняли структуру адресов и внутренние ссылки так и не переписали, оставили работать перенаправления.

Олимпиада Ундольская

Про архивы по датам в блоге спорно. У нас с архивов идёт какой-то трафик, пусть небольшой. Закрывать жалко, но и держать их открытыми, судя по статье, тоже не дело.

Анатолий Кузнецов автор

Критерий простой и он у вас уже есть в данных: посмотрите отчёт по страницам входа из поиска за квартал и отдельно показы по архивным адресам. Если архив за месяц даёт единичные показы и ноль кликов, он не собирает спрос, а просто занимает обход. Если какие-то архивы реально приносят переходы, значит, там либо удачное совпадение с запросом, либо содержимое, которого больше нигде нет; в этом случае логичнее превратить такой архив в нормальную страницу подборки с заголовком, вводным текстом и ручным отбором материалов. Разница принципиальная: страница подборки — самостоятельный документ, автоматический архив по месяцу — служебный список. Половинчатый вариант тоже рабочий: оставить открытыми архивы по годам, закрыть по месяцам и по дням.

Дарина Лыткарина

Заметка про 404 с кодом 200 попала точно. У нас движок отдавал несуществующие адреса с успешным кодом и пустым шаблоном. В логах таких обращений оказалось несколько тысяч за месяц.

Виринея Тарбеева

Хостинг у нас отвечает в среднем 1,2 секунды, иногда до трёх. Сейчас поняла, что это не только про удобство посетителей. Считаю бюджет на переезд.

Модест Мясищев

Есть возражение по фильтрам. Мы часть комбинаций специально сделали посадочными страницами, и они приносят запросы. Значит, закрывать всё подряд нельзя, а как отделить нужное от ненужного — не очень понятно.

Глафира Эйхенвальд

Веду таблицу «дата публикации — дата первого визита робота — дата появления в выдаче» второй месяц. Пока разброс огромный: от двух дней до трёх недель на одинаковых по типу материалах. Похоже, дело как раз в перелинковке, новые статьи почти ниоткуда не связаны.

16 комментариев к “Краулинговый бюджет сливается в никуда, пока вы пишете тексты: куда на самом деле уходит внимание робота”

  1. Полина

    Отличная тема. Теперь понятно, почему свежие статьи так долго не появляются в поиске.

  2. Роман

    Добавлю: чем чище структура и меньше мусорных URL, тем эффективнее робот тратит бюджет на важное.

  3. Жанна

    Спасибо. Иду смотреть, не сливается ли мой бюджет обхода на мусор вместо нужных страниц.

  4. Артём

    Полезно. Дело часто не в количестве текста, а в том, доходит ли до него робот вообще.

  5. Вера

    Почистила мусорные адреса и обновила sitemap — новые страницы стали индексироваться заметно быстрее.

  6. Геннадий

    Уберите дубли и мусорные параметры, настройте sitemap и перелинковку — и бюджет обхода пойдёт на важное.

  7. Инна

    Пишешь контент, радуешься, а он не индексируется, потому что робот до него не дошёл. Знакомая боль.

  8. Владислав

    А для небольшого сайта краулинговый бюджет вообще проблема, или это забота только крупных проектов?

    1. Admin

      Владислав, для небольшого сайта краулинговый бюджет обычно не проблема: страниц мало, робот успевает обойти всё, и приоритизировать обход не нужно. Тема разворачивается на средних и крупных сайтах с тысячами страниц, интернет-магазинах с фильтрами и параметрами. Но и на малом сайте стоит разово проверить, что робот доходит до всех важных страниц и не спотыкается об ошибки и дубли. Так что чем больше и сложнее сайт, тем важнее краулинговый бюджет; на маленьком достаточно базовой чистоты.

  9. Руслан

    Логи сервера показывают, по каким страницам робот ходит чаще, а какие игнорирует. Очень отрезвляет.

  10. Татьяна

    Спасибо, не думала, что дело не в текстах, а в том, куда вообще доходит робот.

  11. Олег

    На больших сайтах краулинговый бюджет реально решает: если робот тратит его на хлам, важное не индексируется.

  12. Николай

    А как направить бюджет обхода на нужные страницы и увести робота от мусорных адресов?

    1. Admin

      Николай, направляют бюджет на нужное так: закройте от обхода мусор — параметрические дубли, UTM, служебные и бесконечные страницы, ошибки. Уберите дубли через canonical и настройку параметров. Соберите чистый sitemap только из важных страниц и поставьте на них внутренние ссылки, чтобы робот легко до них доходил. Исправьте цепочки редиректов и битые ссылки, которые впустую тратят обход. Чем чище структура и меньше мусорных адресов, тем больше внимания робота достаётся страницам, которые вам реально нужны в индексе.

  13. Марина

    Закрыла мусорные параметры от обхода — робот стал чаще заходить на важные страницы. Индексация ускорилась.

  14. Дмитрий

    Робот сначала ходит по мусору, а до новых важных страниц добирается в последнюю очередь. Обидно.

  15. Алина

    А как понять, на что робот реально тратит краулинговый бюджет и куда уходит его внимание?

    1. Admin

      Алина, на что робот тратит бюджет, видно в логах сервера и в Вебмастере. Логи показывают, по каким адресам робот ходит чаще, а какие игнорирует, и сколько времени уходит на мусорные параметры. В Вебмастере есть статистика обхода: сколько страниц обойдено, какие исключены, где коды ошибок вместо нормального ответа. Сопоставьте это с картой важных страниц. Если робот массово ходит по параметрическим клонам и ошибкам, а до важного добирается редко, вот вам и утечка внимания.

  16. Виктор

    Отрезвляет. Пишу тексты, а робот тратит бюджет обхода на мусорные параметры вместо важных страниц.

Оставьте комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *

 Нажимая «оставить комментарий» вы принимаетеправила конфиденциальности 

Прокрутить вверх