Логотип seo-prodvizhenie-biznesa.ru
+7 (921) 333-77-45

Robots.txt, о котором молчат SEO-специалисты: опасные настройки по умолчанию

Robots.txt, о котором молчат SEO-специалисты: опасные настройки по умолчанию
Анатолий Кузнецов
Анатолий Кузнецов
SEO-оптимизатор с 20-летним стажем. Автор блога seo-prodvizhenie-biznesa.ru о продвижении и доработке сайтов.

Robots.txt, о котором молчат SEO-специалисты, умещается в полторы сотни строк текста и решает, увидит ли поиск ваш сайт целиком или половину. Большинство владельцев этот файл никогда не открывали: считается, что «там всё работает по умолчанию». А настройки по умолчанию, доставшиеся от шаблона, от разработчика или от статьи десятилетней давности, регулярно содержат ошибки, из-за которых страницы вылетают из индекса или, наоборот, в индекс попадает мусор. Ниже — что этот файл делает на самом деле, семь опасных конструкций, которые я встречаю чаще всего, и порядок проверки собственного файла.

Что делает robots.txt и чего он не делает

Это текстовый файл в корне сайта, доступный по адресу вида «домен/robots.txt». В нём вы пишете инструкции для поисковых роботов: какие разделы обходить, какие не обходить, где лежит карта сайта. Робот открывает его первым, придя на сайт.

Правильно настроенный файл направляет робота на нужные страницы и бережёт краулинговый бюджет — то количество страниц, которое робот готов обойти за визит. На большом сайте это решающая вещь: если обход тратится на тысячи адресов с фильтрами и сортировками, до новых коммерческих страниц робот доходит месяцами.

Теперь о том, чего файл не делает, — здесь кроется самое опасное заблуждение. Запрет в robots.txt — это не запрет индексации, а рекомендация не обходить. Страница, закрытая таким образом, может всё равно попасть в выдачу — например, если на неё ведут внешние ссылки. Только выглядеть она будет плохо: без описания, с пустым сниппетом, потому что содержание робот не прочитал.

Практический вывод: для реального исключения страницы из выдачи нужен мета-тег запрета индексации на самой странице или заголовок ответа сервера, а не строка в robots.txt. Больше того, если вы закроете страницу в robots.txt, робот не сможет её обойти и не увидит мета-тег запрета — то есть закрытие в двух местах одновременно работает хуже, чем в одном.

Опасность 1: запрет на весь сайт

Самая разрушительная ошибка и при этом самая частая. Разработчик собирает сайт на тестовом домене и закрывает его от индексации директивой запрета на корневой каталог для всех роботов. Сайт переезжает на боевой адрес, файл забывают заменить, и поиск послушно перестаёт обходить всё подряд.

Обнаружение занимает десять секунд: откройте свой файл и найдите строку с запретом на одиночный слэш без дополнительных уточнений. Если она есть и относится ко всем роботам — это оно.

Исправление: убрать строку, оставив конкретные запреты на служебные разделы. Дальше отправить главные страницы на переобход вручную через панель вебмастера, иначе возвращение в индекс займёт недели вместо дней.

Отдельно про профилактику: заведите привычку проверять этот файл после каждого переезда, обновления системы управления и любых работ подрядчика с сервером. Полминуты проверки против месяцев отсутствия в выдаче.

Опасность 2: закрытые стили и скрипты

Совет закрывать от индексации каталоги со стилями и скриптами родился в те годы, когда поисковые роботы не умели отрисовывать страницу и воспринимали её как текст. Сегодня и Яндекс, и Google рендерят страницу как браузер, чтобы увидеть её глазами пользователя.

Что происходит, если стили и скрипты закрыты: робот получает голый текст без оформления. Он не видит, что кнопка на месте, что вёрстка адаптивная, что содержание расположено удобно. В лучшем случае страница оценивается хуже, в худшем — считается неработающей на мобильных.

Тему разбирал отдельно: «Сколько заявок вы теряете ночью, пока сайт лежит: аптайм, о котором молчат».

Исправление: открыть для обхода файлы стилей и скриптов темы и расширений. Проверить результат можно инструментом просмотра страницы глазами робота в панели вебмастера — там видно, как выглядит отрисованная страница. Если она разъезжается или отображается без оформления, значит что-то из ресурсов всё ещё закрыто.

Опасность 3: неаккуратные звёздочки

Символ звёздочки означает «любой набор символов», и применённый без осторожности он убивает половину сайта. Классический пример — запрет на всё, что оканчивается на расширение скриптового файла: автор хотел закрыть служебные скрипты, а закрыл все страницы сайта, если система управления отдаёт их с таким расширением.

Помогу с продвижением: продвижение бизнеса в Яндексе — вывожу сайты в топ Яндекса белыми методами.

Похожие ловушки:

  • запрет на строку, встречающуюся в адресах нужных разделов, — например, слово, которое есть и в служебном пути, и в названии категории;
  • запрет на любые адреса с вопросительным знаком, когда часть работающих страниц использует параметры;
  • запрет на короткий фрагмент вроде двух-трёх букв, который случайно попадает в десятки адресов.

Правило простое: после любой директивы со звёздочкой прогоните через инструмент проверки robots.txt десяток реальных адресов вашего сайта — коммерческих страниц, карточек, статей. Инструмент покажет, разрешён обход или запрещён. Это две минуты работы, которые страхуют от потери раздела.

Опасность 4: конфликт разрешающих и запрещающих правил

Директива разрешения существует, чтобы делать исключения внутри закрытого раздела. Но порядок обработки правил не такой, каким кажется интуитивно: побеждает не то правило, что стоит выше, а более длинное и точное.

Из-за этого возникают ситуации, где владелец уверен, что раздел открыт, а робот считает иначе. Особенно часто это встречается на сайтах, где файл собирали из кусков, найденных в разных статьях: там оказываются противоречащие друг другу правила для одних и тех же путей.

Что делать: не собирать файл из чужих кусков. Написать свой, короткий и понятный, где каждая строка объясняется одной фразой. Если строку невозможно объяснить, она вам не нужна.

Опасность 5: разные правила для разных роботов

В файле можно задавать отдельные блоки для разных поисковых систем. Проблема в том, что робот читает только свой блок и общий блок для всех — но если для него есть отдельный блок, общий он игнорирует полностью.

Отсюда типичная ошибка: в общем блоке прописаны все нужные запреты, а в блоке для конкретной системы — только одна строка с картой сайта. В результате для этой системы сайт открыт целиком, включая служебные разделы, корзину, личный кабинет и результаты поиска по сайту.

Смежный материал по теме — «Почему ваш сайт в индексе, но его не существует для Яндекса — парадокс, о котором молчат сеошники».

Практическое правило: если вам не нужны разные правила для разных систем — не делайте отдельных блоков вовсе. Один блок для всех роботов проще, надёжнее и не создаёт расхождений.

Что нужно закрыть Чем закрывать Почему не robots.txt
Служебные каталоги системы управления robots.txt Здесь он и нужен: экономия обхода
Результаты внутреннего поиска robots.txt плюс мета-тег запрета Бесконечное число адресов съедает обход
Корзина, оформление заказа, личный кабинет robots.txt Обходить нечего, содержания нет
Страницы с конфиденциальными данными Пароль и права доступа Файл публичен: закрытые пути в нём видны всем
Дубли с параметрами сортировки Канонический адрес, мета-тег запрета Закрытую страницу робот не обойдёт и не увидит канонический адрес
Страницы, которые не должны быть в выдаче Мета-тег запрета индексации robots.txt не запрещает попадание в индекс
Устаревшие разделы, которые надо убрать Удаление и перенаправление Закрытие не удаляет страницу из выдачи само по себе

Опасность 6: карта сайта, которой нет

Ссылка на карту сайта в robots.txt — способ сообщить роботу, где лежит список всех страниц. Ошибки здесь встречаются в трёх вариантах: ссылки нет вовсе, ссылка ведёт на несуществующий адрес после переезда, ссылка указана относительным путём вместо полного адреса.

Проверка занимает минуту: скопируйте адрес карты из файла, вставьте в браузер и убедитесь, что он открывается и содержит актуальный список страниц. Отдельно проверьте, что в самой карте нет адресов, закрытых в robots.txt, — такое противоречие поиск воспринимает как ошибку настройки.

Заодно посмотрите на протокол: если сайт работает по защищённому соединению, а в карте перечислены адреса без него, вы указываете роботу на страницы, которых по этим адресам нет.

Опасность 7: файл как карта уязвимостей

Файл robots.txt публичен: его открывает кто угодно. Перечисляя в нём пути к административной панели, к резервным копиям, к тестовым разделам и к служебным скриптам, вы фактически публикуете карту тех мест, где стоит покопаться.

Правильный подход: то, что нужно скрыть от посторонних, закрывается правами доступа и паролем, а не строкой в текстовом файле. В robots.txt перечисляются только те пути, скрывать которые не требуется, — типовые служебные каталоги, которые и так известны для любой распространённой системы управления.

Если сейчас у вас в файле указан нестандартный адрес входа в панель управления, уберите его оттуда и закройте доступ на уровне сервера. Одна эта правка снимает большую часть автоматических попыток подбора.

Проверка и настройка своего файла

Как выглядит нормальный файл

Хороший robots.txt короткий. На типовом сайте услуг это десять-пятнадцать строк, на интернет-магазине с фильтрами — до сорока. Всё, что длиннее сотни строк, почти всегда содержит наслоения от разных исполнителей и противоречия.

Логика построения такая:

Если нужны детали, смотрите «Дубли страниц: тихий убийца трафика, о котором молчат подрядчики».

  • один блок правил для всех роботов, если у вас нет причины разделять;
  • запрет на служебные каталоги системы управления — они известны и скрывать их незачем;
  • запрет на страницы, где нет содержания для показа: корзина, оформление заказа, личный кабинет;
  • запрет на технические адреса с параметрами сортировки и отображения;
  • разрешение на файлы оформления и скриптов, если они лежат внутри закрытых каталогов;
  • полный адрес карты сайта в конце.

Чего в нормальном файле нет: запрета на корневой слэш, длинных списков отдельных страниц, путей к нестандартным служебным разделам, директив, скопированных из статей без понимания, и правил для роботов, которых давно не существует.

Полезная привычка — держать рядом с файлом текстовый комментарий, где каждая строка объяснена одним предложением. Через год вы не вспомните, зачем закрывали конкретный путь, а следующий человек, который откроет файл, тем более. Комментарии в самом файле тоже допустимы: строки, начинающиеся с решётки, роботы игнорируют.

Порядок проверки

  1. Откройте адрес «ваш домен/robots.txt» в браузере. Если файла нет — это не катастрофа, но и не норма: без него робот обходит всё подряд, включая мусор.
  2. Найдите запрет на корневой слэш. Если он есть — это первая и главная правка.
  3. Проверьте, открыты ли файлы оформления и скриптов.
  4. Прогоните через инструмент проверки десяток реальных адресов сайта: главную, две коммерческие страницы, карточку, статью, страницу категории.
  5. Убедитесь, что для каждого робота действует один понятный набор правил, а не противоречивые блоки.
  6. Проверьте адрес карты сайта: открывается ли, актуален ли, совпадает ли протокол.
  7. Уберите из файла всё, что раскрывает нестандартные служебные пути.
  8. Сравните число страниц в индексе до и после правок через неделю и через месяц.

Отдельно советую сохранить копию файла до правок. Если после изменений что-то пойдёт не так, вы вернёте прежнее состояние за минуту, а не будете вспоминать, что там было.

Что делать после правок

Изменение файла — не конец работы, а её начало: последствия проявляются неделями, и за ними нужно наблюдать.

  1. Проверьте файл сразу после загрузки. Откройте его по адресу в браузере в режиме инкогнито и убедитесь, что видите новую версию, а не закешированную старую.
  2. Прогоните контрольный список адресов через инструмент проверки — те же десять адресов, что и до правок, чтобы сравнить результат.
  3. Отправьте важные страницы на переобход вручную. Если вы что-то открыли, естественного обхода придётся ждать неделями.
  4. Снимите число страниц в индексе в день правки и запишите. Через неделю и через месяц сравните.
  5. Следите за статистикой обхода. Если вы закрыли мусорные адреса, доля обхода на нужных страницах должна вырасти — это виден результат, а не догадка.
  6. Проверьте карту сайта на противоречия: в ней не должно остаться адресов, которые вы только что закрыли.
  7. Зафиксируйте дату правки в журнале изменений сайта. При следующей просадке трафика это первое, на что вы посмотрите.

Наблюдать имеет смысл около месяца. Быстрые изменения — перечитывание файла роботом — происходят за сутки-двое, а вот индекс перестраивается медленно, и делать выводы через три дня рано. Если через месяц число нужных страниц в индексе выросло, а обход перестал уходить в мусор, правки были верными.

Частые вопросы

Нужен ли robots.txt маленькому сайту на десять страниц? Строго обязательным он не является, но полезен: даже на маленьком сайте есть служебные адреса и результаты внутреннего поиска, которые незачем обходить. Минимальный файл из нескольких строк с указанием карты сайта лучше, чем его отсутствие.

Как убрать страницу из выдачи, если она уже там? Мета-тегом запрета индексации на самой странице, а в robots.txt её при этом закрывать нельзя — иначе робот не зайдёт и не увидит тег. После этого можно ускорить процесс через инструмент удаления в панели вебмастера.

Через сколько после правок робот увидит изменения? Файл перечитывается при очередном обходе, обычно в течение суток-двух. А вот последствия — возвращение страниц в индекс или их исчезновение — растягиваются на недели.

Можно ли скопировать файл у конкурента? Нет. Структура каталогов, система управления и набор служебных путей у вас другие. Скопированный файл в лучшем случае бесполезен, в худшем закрывает работающие разделы.

Что делать с адресами, которые генерируются фильтрами? Разделять по спросу: комбинации, которые люди ищут, превращать в отдельные страницы с собственными адресами, остальные закрывать от обхода и указывать канонический адрес на основную категорию.

Влияет ли этот файл на позиции напрямую? Нет, он не является фактором ранжирования. Но он определяет, какие страницы вообще будут обойдены и оценены, а значит влияет на всё остальное косвенно и очень сильно.

Коротко

  • Запрет в robots.txt — это указание не обходить, а не запрет индексации: закрытая страница может попасть в выдачу с пустым сниппетом.
  • Закрытие страницы в robots.txt мешает роботу увидеть мета-тег запрета на ней — закрывать в двух местах одновременно нельзя.
  • Запрет на корневой слэш, оставшийся с тестового домена, — самая частая и самая разрушительная ошибка; проверяется за десять секунд.
  • Стили и скрипты должны быть открыты: современные роботы отрисовывают страницу, и без оформления она оценивается как сломанная.
  • После любой директивы со звёздочкой прогоняйте через инструмент проверки десяток реальных адресов сайта — это страхует от потери целого раздела.
  • Файл публичен, поэтому служебные пути закрываются правами доступа, а не строкой в тексте, который может прочитать кто угодно.

Если не уверены, что ваш файл настроен правильно, или страницы пропадают из индекса без понятной причины, приходите на SEO-консультацию: разберём ваш robots.txt построчно, проверим реальные адреса сайта на доступность для обхода и посмотрим, куда на самом деле уходит краулинговый бюджет.

Увеличьте позиции и продажи вашего сайта

Профессиональное SEO-продвижение с гарантией результата. Выберите подходящую услугу:

Анатолий Кузнецов — SEO-оптимизатор

Остались вопросы по продвижению?

Меня зовут Анатолий Кузнецов, я SEO-оптимизатор с 20-летним стажем. Разберу ваш сайт, отвечу на вопросы и подскажу, что улучшить для роста позиций в Яндексе и Google.

Связаться со мной →

Комментарии

Севастьяна Толмачёва

Открыла свой файл после статьи. Там запрет на корневой слэш для одного из роботов, а для остальных нормальные правила. Сайт живёт четыре года, в Яндексе всё в порядке, в Google почти нет страниц. Теперь понятно почему.

Анатолий Кузнецов автор

Диагноз, скорее всего, верный, и это как раз пятая опасность из статьи в чистом виде: робот с отдельным блоком читает только его и полностью игнорирует общие правила. Порядок действий такой. Уберите отдельный блок целиком, оставив один набор правил для всех роботов, — если вам не нужны разные правила, разделять не надо. Дальше отправьте на переобход главную и десяток самых важных страниц вручную, не ждите естественного обхода. Через неделю посмотрите число страниц в индексе, через месяц — ещё раз; возвращение обычно идёт волнами, а не сразу. И заранее приготовьтесь к тому, что позиции в этой системе появятся не мгновенно: страницы вернутся в индекс за недели, а накопление доверия к ним займёт ещё пару месяцев. Заодно проверьте, нет ли на этих страницах мета-тега запрета — иногда одну и ту же ошибку дублируют в двух местах.

Мирослав Ходыкин

Про публичность файла даже не задумывался. У нас там был прописан путь к резервным копиям, чтобы робот их не трогал. Убрал, поставил защиту на уровне сервера. Спасибо, реально не приходило в голову.

Агафья Пожидаева

Не соглашусь про закрытие результатов внутреннего поиска. У нас эти страницы приносят трафик по длинным запросам, мы их специально оставили открытыми и не жалеем. Так что совет не универсальный.

Анатолий Кузнецов автор

Ваш случай — исключение, которое действительно работает, но у него есть условия, и без них он превращается в проблему. Работает это, когда страницы результатов имеют осмысленные адреса, собственный заголовок под конкретный запрос и не создают бесконечного числа комбинаций. Если у вас именно так — вы фактически сделали из внутреннего поиска генератор посадочных страниц, и закрывать его действительно не надо. Опасность возникает в типовой реализации: адреса с параметрами, одинаковый заголовок на всех, пустые результаты по случайным словам и неограниченное число вариантов, которые робот честно обходит вместо ваших коммерческих страниц. Проверить, к какому случаю относится ваш сайт, можно за десять минут: посмотрите в логах или в отчёте по обходу, сколько уникальных адресов результатов поиска робот посетил за месяц. Если счёт идёт на десятки — всё хорошо. Если на тысячи, значит обход уходит туда, а не на карточки товаров.

Ермил Ознобишин

Проверил через инструмент десяток адресов, как советуете. Восемь разрешены, два запрещены — обе страницы категорий, у которых в адресе оказалась та же буквенная комбинация, что и в служебном пути. Никогда бы сам не догадался.

Харлампий Векшин

Вопрос про краулинговый бюджет. У нас магазин на сорок тысяч товаров, робот обходит около двух тысяч страниц в сутки. Как понять, тратится ли он правильно, и что вообще с этим делать?

Анатолий Кузнецов автор

Смотреть надо не на цифру обхода, а на её состав, и он виден в отчёте по статистике обхода в панели вебмастера и в логах сервера. Выгрузите список адресов, которые робот посетил за последнюю неделю, и разложите по типам: карточки товаров, категории, адреса с параметрами, результаты поиска, служебные страницы. На здоровом магазине основная часть обхода приходится на карточки и категории. Если половина уходит на адреса с параметрами сортировки и фильтров, вы нашли утечку. Дальше три действия. Первое: закрыть от обхода сортировки, постраничную навигацию по параметрам и результаты внутреннего поиска. Второе: убрать из карты сайта всё, что не должно индексироваться, — противоречие между картой и запретами робот тоже отрабатывает впустую. Третье: проверить скорость ответа сервера, потому что объём обхода напрямую от неё зависит: чем быстрее отдаются страницы, тем больше их успевает обойти робот за то же время. На сорока тысячах товаров последний пункт часто даёт больше всего.

Милица Забураева

Добавлю про карту сайта: у нас после перехода на защищённое соединение в файле полгода висел адрес карты со старым протоколом. Карта открывалась через перенаправление, но робот на неё жаловался. Мелочь, а нашли случайно.

Феоктист Бурмистров

Меня смущает тезис, что закрытая в robots страница может оказаться в выдаче. Всегда думал, что если закрыл — значит закрыл. Получается, вся логика последних лет работы у меня была построена на неверном понимании.

Анатолий Кузнецов автор

Это самое распространённое заблуждение в теме, и оно объясняется названием: слово «disallow» читается как «запретить», хотя означает «не обходить». Механика такая: робот уважает запрет и не заходит на страницу, но если о её существовании он узнал из другого источника — по внешней ссылке, из карты сайта, из внутренней перелинковки, — сам адрес ему известен. В некоторых случаях он показывает такой адрес в выдаче с пустым описанием или с текстом ссылки, по которой узнал о странице. Практический вывод для вашей работы: разделите задачи. Если цель — не тратить обход на бесполезные разделы, robots.txt правильный инструмент. Если цель — чтобы страницы не было в выдаче, нужен мета-тег запрета индексации, и страница при этом должна оставаться доступной для обхода. Пройдитесь по списку того, что вы закрывали за эти годы, и разложите по этим двум задачам — обычно выясняется, что часть закрытий стоит переделать.

Ульяна Черемисина

Скопировала когда-то файл с сайта из своей же ниши, потому что он выглядел солиднее моего. Через месяц пропал весь раздел с услугами — у них он назывался иначе и попадал под их запрет. Не повторяйте.

Пахом Слепцов

Про открытие стилей и скриптов: посмотрел страницу глазами робота, как советуете. Отрисовка развалилась полностью, вместо сайта столбик текста. Открыл каталоги темы, проверил снова — картинка нормальная. Заняло пятнадцать минут.

Лариса Бурдуковская

Хочу уточнить про длину и точность правил. Правильно ли я поняла, что если у меня есть запрет на раздел и разрешение на подраздел внутри него, то подраздел будет обходиться, потому что путь длиннее?

Анатолий Кузнецов автор

В общем случае да: при конфликте побеждает более точное, то есть более длинное совпадение пути, а не то правило, которое стоит выше в файле. Но полагаться на теорию здесь не стоит по двум причинам. Первая: разные поисковые системы исторически обрабатывали такие конфликты не совсем одинаково, и на сложных наборах правил результат может отличаться. Вторая: длина считается по строке, а не по логике вложенности, и звёздочки внутри правил легко ломают ожидаемый порядок. Поэтому делайте так: после каждой правки берите три-четыре конкретных адреса из того самого подраздела и прогоняйте их через инструмент проверки robots.txt в панели вебмастера — он показывает не только разрешён обход или нет, но и какое именно правило сработало. Это единственный надёжный способ убедиться, что файл понят так, как вы задумали. И общий совет: чем меньше в файле пересекающихся правил, тем меньше поводов гадать.

Аникей Растопчин

Сохранил копию файла перед правками, как написано. Пригодилось на следующий день: закрыл лишнего, страницы стали выпадать, вернул прежнюю версию за минуту. Без копии искал бы причину неделю.

Домна Ярцева

У нас сайт на конструкторе, доступа к файлу нет вообще, редактируется только через настройки панели. Половина советов из статьи неприменима. Что делать в такой ситуации?

16 комментариев к “Robots.txt, о котором молчат SEO-специалисты: опасные настройки по умолчанию”

  1. Полина

    Отличная тема. Иду проверять свой robots на опасные настройки по умолчанию.

  2. Роман

    Добавлю: не закрывайте в robots то, что уже в индексе, — для удаления это работает не так, как думают.

  3. Дарья

    Спасибо, что подсветили. Первым делом проверю robots на своём сайте.

  4. Тимур

    Такие тихие настройки страшнее явных ошибок. Никто не ищет, а трафик режется годами.

  5. Вера

    Нашла закрытые важные страницы через Вебмастер. Открыла, отправила на переобход, ждём.

  6. Геннадий

    Проверяйте robots в Вебмастере через инструмент анализа. Он покажет, что реально закрыто для робота.

  7. Оксана

    Одна неверная директива в robots — и месяцы работы над контентом впустую, его просто не видят.

  8. Владислав

    А если я нашёл лишний запрет и убрал его, как быстро закрытые страницы вернутся в индекс?

    1. Admin

      Владислав, не мгновенно. После снятия запрета робот должен заново обойти страницы и вернуть их в индекс, это занимает от нескольких дней до недель в зависимости от траста сайта и частоты обхода. Ускорить можно: добавьте эти страницы в sitemap, поставьте на них внутренние ссылки и отправьте на переобход в Вебмастере. Но переоценка и стабильные позиции придут не сразу после возврата в индекс. Так что исправьте robots, помогите переобходом и дайте время — возврат страниц пойдёт по мере обхода.

  9. Лариса

    Плагины и шаблоны любят ставить свои запреты в robots. Проверять надо обязательно после установки.

  10. Артур

    Спасибо, побежал проверять. Про robots все забывают, а он решает, что вообще увидит поиск.

  11. Светлана

    Самое коварное, что такие настройки по умолчанию тихие: сайт работает, а половина не в индексе.

  12. Николай

    А что должно быть в правильном robots, а чего там точно быть не должно? Есть базовый ориентир?

    1. Admin

      Николай, в правильном robots закрыты только служебные и мусорные вещи: админка, корзина, страницы поиска по сайту, дубли с параметрами, технические разделы. Обязательно должна быть указана ссылка на sitemap. Чего там быть не должно: запретов на важные разделы, товары, статьи, категории, а также глобального запрета всего сайта, который иногда остаётся с этапа разработки. Ориентир простой: закрываем от робота только то, что не должно попадать в поиск, и никогда не закрываем то, что должно продвигаться.

  13. Марина

    Проверила свой robots после статьи — там висел лишний запрет от прошлого разработчика. Убрала.

  14. Дмитрий

    У меня движок по умолчанию закрывал целый раздел. Нашёл случайно, трафик сразу подрос.

  15. Алина

    А как самому проверить, не закрыл ли мой robots по умолчанию что-то важное от индексации?

    1. Admin

      Алина, проверяется за пять минут. Откройте свой robots.txt по адресу сайт плюс слеш robots.txt и посмотрите на строки Disallow — что именно закрыто. Затем в Вебмастере есть инструмент проверки robots: вставляете нужный URL и видите, разрешён он к обходу или запрещён. Так вы поймёте, не закрыты ли важные страницы. Ещё в Вебмастере смотрите раздел с исключёнными страницами: если важное исключено из-за запрета в robots, это сразу видно. Проверьте так каждую ключевую страницу.

  16. Виктор

    Важная тема. Одна строчка в robots по умолчанию может годами закрывать от индексации половину сайта.

Оставьте комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *

 Нажимая «оставить комментарий» вы принимаетеправила конфиденциальности 

Прокрутить вверх