
Страницы-сироты живут на сайте как в комнате без двери: адрес открывается, текст на месте, картинки грузятся, а попасть туда изнутри сайта нельзя ни одним кликом. На такие материалы не ведёт ни одна внутренняя ссылка — ни из меню, ни из рубрики, ни из соседней статьи. Формально страница есть. Практически её нет ни для посетителя, ни для робота, который ходит по ссылкам.
Ниже — как отличить сироту от обычной страницы без трафика, как найти всех сирот за вечер сверкой двух списков, что показывают панели вебмастера и что делать с находками. В SEO с 2005 года, и на сайтах старше трёх лет сироты находятся почти всегда — вопрос только в том, десять их или три сотни.
Чем сирота отличается от страницы без трафика
Эти два состояния постоянно путают, а лечатся они противоположными способами. Страница без трафика проиндексирована и показывается в выдаче, но по её запросам никто не приходит: причина внешняя — слабая позиция, мёртвый спрос, неудачный сниппет. Внутри сайта с ней всё в порядке.
Сирота — это состояние навигации, а не спроса. Текст может быть отличным и под живой запрос, но робот не находит к странице маршрута. Проверяется разница просто: откройте главную и попробуйте дойти до страницы кликами, не пользуясь адресной строкой и поиском по сайту. Если маршрута нет — это сирота, независимо от числа визитов.
Важный нюанс: у сироты трафик бывает — из закладок, рассылки, внешней ссылки, старой публикации в соцсети. В отчёте по посещаемости страница выглядит живой, и никто не догадывается, что для внутренней структуры сайта её не существует. Искать сирот по нулевому трафику поэтому бесполезно.
Есть и промежуточное состояние — «почти сирота»: на страницу ведёт одна ссылка, причём с четырнадцатой страницы пагинации архива. Маршрут формально есть, но робот доходит туда раз в несколько месяцев. Такие адреса ставьте в ту же очередь, что и полных сирот.
Откуда берутся сироты
Ни одна сирота не появляется по злому умыслу — все источники следуют из обычной жизни сайта и повторяются от проекта к проекту.
Закончившиеся акции и сезонные посадочные. Под распродажу сделали страницу, повесили баннер на главную, запустили рекламу. Акция кончилась — баннер сняли, рекламу остановили, страницу оставили «на всякий случай». За пять лет таких адресов набираются десятки.
Удалённые разделы и перестроенное меню. Меню переделали, три пункта убрали, но разделы остались висеть по прежним адресам вместе со всем содержимым. Страницы никто не удалял, просто перестали на них ссылаться.
Материалы вне рубрик. Статья опубликована без категории или с категорией, которая нигде не выводится. Материал виден только через ленту последних записей, а уходя с первой страницы, исчезает и оттуда. В WordPress это классическая «Без рубрики».
Товары снятых категорий. Категорию скрыли из каталога, товары остались опубликованными: адреса открываются и попадают в карту сайта, но из каталога до них не дойти.
Перенос с прежней CMS. При переезде содержимое переносят базой, а навигацию собирают заново вручную. Всё, что не попало в новые списки и рубрики, становится сиротой в момент запуска — сотни адресов сразу.
Удалённый блок перелинковки. Виджет «читайте также», блок похожих товаров: если такой элемент убрали или он сломался после обновления шаблона, целый пласт материалов теряет входящие ссылки одномоментно.
Навигация на скриптах. Меню или подгрузка карточек сделаны так, что ссылки нет в разметке: вместо тега со ссылкой стоит кнопка с обработчиком события. Для пользователя переход работает, для краулера ссылки нет. Формально это не сирота, но ведёт себя страница именно так.
Как устроены маршруты внутри сайта и почему уровень вложенности важнее, чем кажется, — в материале «Структура сайта».
Чем сироты реально вредят
Вред не в самом факте существования такой страницы, а в трёх последствиях, которые накапливаются.
Первое — страница не получает внутреннего веса. Он передаётся по ссылкам, и если входящих нет, наследовать от главной и разделов нечего. Даже попав в индекс через карту сайта, страница конкурирует при нулевом внутреннем ресурсе. Отсюда типичная картина: текст объективно лучше конкурентов, а позиции во второй сотне.
Второе — нестабильная индексация. Робот приходит на такую страницу из карты сайта, по внешней ссылке или по памяти о прошлых обходах, и частота этих визитов низкая. Правки поисковик замечает через недели, а при чистке индекса от малоценного страница вылетает первой.
Третье — искажение картины при анализе. В карте сайта девятьсот адресов, в поиске четыреста, разницу списывают на «дубли» и правят не то. Отдельно стоит расход обхода: на каталоге в десятки тысяч адресов робот тратит визиты на страницы без маршрутов, и новые товары ждут индексации неделями.
Основной способ поиска: сверка карты сайта с обходом краулера
Рабочий метод один и не требует платных сервисов: сравнить полный список страниц сайта со списком страниц, до которых краулер дошёл по ссылкам, начав с главной. Разница между этими двумя множествами и есть сироты.
- Соберите полный список адресов. Лучший источник — не карта сайта, а сама CMS: в WordPress это выгрузка через REST API запросом вида
/wp-json/wp/v2/posts?per_page=100&_fields=link, отдельно для записей, страниц и товаров. У карты сайта есть слепая зона: плагин может исключать целые типы записей, и тогда часть сирот не попадёт даже в список кандидатов. - Запустите обход краулером строго с главной. В Screaming Frog SEO Spider или Netpeak Spider стартуйте с корневого адреса в обычном режиме. Ничего не подсовывайте списком — смысл в том, чтобы программа повторила путь робота по ссылкам.
- Подключите к обходу карту сайта и внешние данные. В настройках включается чтение карты сайта, а через интеграцию подтягиваются адреса из панелей и аналитики. После обхода запускается отдельная операция анализа связей, и появляется фильтр с адресами, найденными только в карте или только в аналитике, но не встреченными по ссылкам. Это и есть готовый список сирот.
- Сверьте вручную, если краулера нет. Два текстовых файла со списками адресов сравниваются одной командой в терминале или формулой поиска соответствия в таблице.
- Проверьте находки поштучно. Половина списка обычно оказывается ложными срабатываниями: адреса с параметрами, страницы пагинации, ссылки, отрисованные скриптом.
Главная ловушка — навигация на скриптах. Если меню, фильтры или подгрузка карточек работают через JavaScript, краулер в обычном режиме объявит сиротами половину каталога. Перед выводами включите режим рендеринга страниц и повторите обход: список обычно сокращается в разы.
Что показывают панели вебмастера
Отчёта «ваши сироты» нет ни в одной панели. Но они дают данные, из которых сироты вычисляются, и без них картина будет неполной.
В Яндекс.Вебмастере полезны три раздела. «Индексирование → Страницы в поиске» даёт выгрузку всего, что в индексе, — это второй список для сверки. «Индексирование → Статистика обхода» показывает адреса с кодами ответа и датами: страницы, посещаемые раз в квартал, — почти всегда сироты или страницы с одной ссылкой из глубины. «Ссылки → Внутренние ссылки» покажет битые ссылки: часть сирот появилась ровно тогда, когда ссылка на них сломалась.
В Google Search Console смотрите отчёт по индексированию, в частности состояние «Страница обнаружена, но пока не проиндексирована»: адреса, известные только по карте сайта, оседают именно там. Второй отчёт — «Ссылки → Внутренние ссылки», он сортирует страницы по числу входящих ссылок. Строки с одной-двумя — те самые «почти сироты».
Третий источник — аналитика и логи сервера: выгрузка адресов, куда были входы за год, покажет сирот, собирающих визиты в обход навигации. Их нельзя закрывать, их нужно перелинковывать.
| Источник данных | Что даёт | Чего не покажет | Трудоёмкость |
|---|---|---|---|
| Обход краулером с главной | Все страницы, до которых ведут ссылки, и вложенность каждой | Страницы вне маршрутов — их в отчёте не будет | От получаса до ночи на каталоге |
| Выгрузка из CMS (REST API, экспорт базы) | Полный список опубликованных адресов без пропусков | Ничего о ссылках и об индексации | 15–30 минут |
| Карта сайта sitemap.xml | Быстрый список кандидатов, доступен без доступов к сайту | Типы записей, исключённые настройками плагина | 5 минут |
| Яндекс.Вебмастер: индекс и статистика обхода | Что в индексе, как часто робот заходит, коды ответов | Наличие внутренних ссылок на конкретный адрес | 20 минут |
| Search Console: отчёт по внутренним ссылкам | Число входящих ссылок на страницу, «почти сироты» | Страницы вне индекса и свежие публикации | 15 минут |
| Аналитика и логи сервера | Какие сироты живые: собирают визиты и запросы робота | Страницы совсем без визитов, даже полезные | Час с обработкой |
Разбор находок: перелинковать, объединить или закрыть
Список сирот сам по себе бесполезен. Ценность появляется, когда каждый адрес получает решение, а решений ровно три, и выбирается оно по двум признакам: есть ли по теме живой спрос и нет ли на сайте страницы сильнее.
Перелинковать. Когда тема нужная, текст рабочий, а конкурента внутри сайта нет. Сюда попадает большинство статей вне рубрик и часть старых разделов.
Объединить. Когда на сайте уже есть материал на ту же тему и он сильнее. Тогда сирота не оживает, а отдаёт содержимое: разделы, вопросы и таблицы переносятся в основную страницу, а со старого адреса ставится 301. Голый редирект без переноса теряет релевантность по запросам, которые вела старая страница.
Закрыть. Когда тема мертва: прошлогодняя акция, снятая с продажи модель, техническая страница. Если внешних ссылок и визитов нет — отдавайте 410, это самый быстрый способ убрать адрес из индекса. Если внешние ссылки есть — 301 на профильный раздел, а не на главную: массовые редиректы на главную поисковик обрабатывает как ошибку «страница не найдена».
| Тип находки | Как распознать | Решение | Что проверить через месяц |
|---|---|---|---|
| Статья вне рубрик | Спрос по теме есть, дублей нет, визиты единичные | Назначить рубрику, добавить 2–4 контекстные ссылки из смежных статей | Вложенность снизилась до 3, адрес есть в «Страницах в поиске» |
| Старая акция или сезонная посадочная | Дата в тексте, условия неактуальны, визитов нет | 410, если ссылок извне нет; 301 на действующий раздел, если есть | Адрес ушёл из индекса, у 301 нет цепочки переходов |
| Раздел из удалённого меню | Категория живая, материалы актуальны | Вернуть в меню и хлебные крошки, дать ссылки из родительского раздела | Робот заходит регулярно, страницы раздела снова обходятся |
| Дубль по теме с более сильной страницей | Две страницы конкурируют за один запрос, одна без ссылок | Перенести содержимое в сильную, поставить 301 со слабой | Позиции объединённой не ниже, чем у сильной до склейки |
| Товар скрытой категории | Карточка опубликована, категория снята с вывода | Перепривязать к живой категории либо снять с публикации | Карточка доступна из каталога в 3 клика от главной |
| Ложная сирота на скриптовой навигации | После обхода с рендерингом страница из списка исчезает | Заменить обработчики событий ссылками в разметке | Обход без рендеринга находит страницу по ссылкам |
Как перелинковать сироту, чтобы это сработало
Самая частая ошибка на этом шаге — собрать все находки в один список и вывести его сквозным блоком в подвале. Формально ссылки появились, фактически не изменилось ничего: блок из полусотни ссылок передаёт каждой странице ничтожную долю веса и не даёт ни одного сигнала о теме. Работает другой порядок.
- Вернуть страницу в иерархию. Рубрика, раздел каталога, пункт меню, хлебные крошки. Это даёт постоянный маршрут и определяет уровень вложенности — параметр, по которому робот оценивает значимость страницы внутри сайта.
- Поставить контекстные ссылки из смежных материалов. Две-четыре ссылки прямо в тексте близких по теме страниц, с анкором, который описывает содержание, а не «здесь» и «подробнее». Ссылка внутри абзаца весит заметно больше, чем ссылка в списке в конце.
- Дать ссылку с сильной страницы. Одна ссылка с раздела, который сам получает трафик, даёт больше, чем десять со страниц четвёртого уровня. Доноры ищутся по отчёту о посещаемости.
- Добавить обратные ссылки. Ожившая страница должна ссылаться в ответ — иначе она станет тупиком, который собирает вес и никуда его не передаёт.
- Отправить на переобход. Иначе робот дойдёт до правок по обычному расписанию, то есть через недели.
Подробный разбор приёмов и типовых ошибок — в статье «Внутренняя перелинковка страниц сайта». Про склейку конкурирующих между собой материалов — «Каннибализация ключевых слов».
Помогу с продвижением: вывод сайта в топ Яндекса — веду проекты лично, без менеджеров и посредников.
Когда искать сирот не нужно
Задача не универсальная, и есть ситуации, где она не даст ничего.
Сайт до тридцати страниц с плоской структурой: всё доступно из меню в один-два клика, сирот неоткуда взяться. Сайт младше полугода, который никто не перестраивал: сироты — накопительная проблема, они появляются при редизайнах, переносах и удалении разделов.
Сайт с открытыми техническими проблемами. Если закрыт от индексации нужный раздел, отдаётся неверный код ответа или главное зеркало не склеено, сироты — не первая задача. Сначала убирается то, что рушит индексацию целиком, потом чинится навигация.
И отдельно — ситуация, когда сирот нашли, но лечить нечем. Если триста адресов — устаревшие карточки снятых с продажи товаров, перелинковка их не спасёт: это работа по чистке индекса. Оживлять имеет смысл то, по чему есть спрос.
Проверка индексации и кодов ответа делается раньше поиска сирот — порядок описан в материале «Технический аудит сайта». О том, как страницы вообще попадают в индекс, — «Индексация сайта: что это такое и как она работает».
Разовая чистка держится до следующей переделки сайта, поэтому её закрепляют регламентом: обязательная рубрика при публикации, решение о судьбе адресов сразу при удалении раздела, квартальная сверка обхода с выгрузкой из CMS и внеочередная — после переезда.
Частые вопросы
Может ли сирота быть в индексе? Да, и это обычное дело: робот находит её по карте сайта или по внешней ссылке. Просто позиции будут ниже возможных — внутреннего веса у страницы нет.
Достаточно ли добавить страницу в sitemap.xml? Нет. Карта помогает роботу узнать об адресе, но не передаёт вес и не заменяет ссылку. Страница из карты без входящих ссылок часто застревает в состоянии «обнаружена, но не проиндексирована».
Сколько сирот считается нормой? Смотреть надо на долю, а не на число: единицы адресов на тысячу страниц — фон. Если сирот больше десятой части сайта, это последствия переноса или редизайна.
Через сколько виден результат перелинковки? Обычно от двух недель до полутора месяцев: сначала растёт частота обхода, потом меняются позиции. Ускорить можно отправкой адресов на переобход.
Краулер объявил сиротами почти весь каталог — это правда? Почти наверняка нет. Так выглядит навигация на скриптах: краулер не выполняет их и не видит ссылок. Включите рендеринг страниц в настройках обхода и повторите — список сократится до реального.
Что делать, если у сироты есть внешние ссылки? Не удалять с кодом 410. Либо оживить перелинковкой, если тема живая, либо поставить 301 на ближайший по смыслу раздел, чтобы вес не пропал.
Коротко
- Сирота — это страница без входящих внутренних ссылок, а не страница без трафика. Визиты у неё бывают, и это сбивает с толку при поиске.
- Находится сверкой двух списков: полной выгрузки адресов из CMS и результатов обхода краулером строго с главной. Разница между списками и есть сироты.
- Перед выводами включайте рендеринг страниц в краулере, иначе навигация на скриптах даст сотни ложных срабатываний.
- Решений три: перелинковать живое, объединить дублирующее с переносом содержимого, закрыть мёртвое через 410 или 301 на профильный раздел, но не на главную.
- Сквозной блок ссылок в подвале сирот не оживляет — нужны место в иерархии и контекстные ссылки из смежных материалов.
- Чистка держится до следующей переделки сайта, поэтому нужна квартальная сверка и обязательная проверка после любого переезда.
Если карта сайта и число страниц в поиске расходятся в разы, а свежие материалы месяцами не попадают в индекс, дело чаще в структуре, чем в текстах. Разобрать состав индекса, найти сирот и определить, что оживлять, а что закрывать, можно на SEO-консультации.
Увеличьте позиции и продажи вашего сайта
Профессиональное SEO-продвижение с гарантией результата. Выберите подходящую услугу:
Остались вопросы по продвижению?
Меня зовут Анатолий Кузнецов, я SEO-оптимизатор с 20-летним стажем. Разберу ваш сайт, отвечу на вопросы и подскажу, что улучшить для роста позиций в Яндексе и Google.
Связаться со мной →
Комментарии
Викентий Шаньгин
Прогнал краулером — 640 сирот при 900 страницах в карте сайта. Это же почти весь сайт. Не верится, что всё так плохо, где я ошибся?
Анатолий Кузнецов автор
Почти наверняка нигде не ошиблись в действиях, ошибка в настройке. Такая пропорция — типичный признак навигации на скриптах: каталог или меню подгружаются обработчиками событий, а обычных ссылок в разметке нет, поэтому краулер физически не находит маршрутов. Проверяется за минуту: откройте исходный код страницы категории через просмотр кода, а не через инспектор, и поищите адреса товаров. Если их там нет, а в инспекторе они есть — диагноз подтверждён. Включите в настройках краулера режим рендеринга страниц и повторите обход, список сократится в разы. И параллельно ставьте задачу разработчику: настоящие ссылки в разметке нужны не только краулеру, но и роботу поисковика, который ведёт себя так же.
Зинаида Пудовкина
Нашла 80 старых акционных страниц. Часть с трафиком из поиска, хоть и небольшим. Удалять жалко, оставлять непонятно зачем. Что с ними делать?
Анатолий Кузнецов автор
Разделите их по одному признаку: актуально ли предложение сегодня. Если акция кончилась навсегда, а трафик идёт по общим запросам вроде названия товарной группы со словом «скидки», значит, спрос живой, а страница просто устарела. Такие переделываются в постоянные подборки: убираете даты и условия акции, добавляете актуальный ассортимент, оставляете адрес и подключаете к каталогу ссылками. Это выгоднее, чем закрывать, — у страницы уже есть история и позиции. Если же трафик шёл по названию конкретной прошлогодней акции и повторять её вы не будете, ставьте 301 на профильный раздел каталога. Проверьте только, что редирект ведёт на релевантный раздел, а не на главную: массовые редиректы на главную обрабатываются как ошибка «страница не найдена», и вес не переходит.
Тарас Мозгунов
Вопрос по методике: почему выгрузка из CMS, а не карта сайта? Карта же и делается для того, чтобы перечислить все страницы.
Анатолий Кузнецов автор
Потому что карту сайта формирует плагин по своим настройкам, а не по фактическому составу базы. В настройках почти всегда есть переключатели: какие типы записей включать, включать ли вложения, страницы рубрик, метки. Если тип записей отключён, его страниц в карте нет — и они не попадут даже в список кандидатов на проверку. Получится, что вы искали сирот и не нашли самых запущенных. Выгрузка из системы управления даёт то, что реально опубликовано, без фильтров посредника. Идеальный вариант — взять оба списка: карта сайта дополнительно покажет обратную проблему, когда в ней есть адреса удалённых или закрытых страниц.
Лукерья Заволокина
Перелинковала 40 найденных статей: добавила блок со ссылками на все сорок в конец каждой статьи блога. Прошло два месяца, никакого движения. Почему?
Анатолий Кузнецов автор
Потому что сорок ссылок в одном блоке — это не перелинковка, а сквозной список, и вес по нему делится на сорок частей до полной незначимости. Плюс такой блок не даёт роботу никакого сигнала о теме: он одинаковый на всех страницах, значит, не связан с содержанием конкретной. Переделайте иначе. Сначала верните каждую статью в рубрику, чтобы появился постоянный маршрут из архива и хлебных крошек. Затем на каждую поставьте по две-три контекстные ссылки из статей, которые действительно близки по теме, — ссылка внутри абзаца с осмысленным анкором работает в разы сильнее. И начните с двадцати самых перспективных по спросу, а не со всех сорока сразу: так быстрее увидите, работает ли схема.
Демьян Ярош
Переехали с самописной CMS на готовую. После переезда в поиске осталось 300 страниц из 1200. Это про сирот или про что-то другое?
Анатолий Кузнецов автор
Скорее всего, и то и другое, но проверять надо по порядку. Сначала коды ответов: пройдите краулером по списку старых адресов из выгрузки прежнего сайта и посмотрите, что они отдают. Если 404 — вопрос не в сиротах, а в непоставленных редиректах, и это первая задача. Если старые адреса корректно переадресуются на новые, а новые открываются с кодом 200, тогда смотрите вторую причину: при переезде переносят базу, а навигацию собирают заново, и всё, что не попало в новые рубрики и списки, остаётся без входящих ссылок. Обход с главной покажет, до скольких из 1200 адресов реально можно дойти по ссылкам. По моему опыту разборов после переездов расхождение обычно между этими двумя причинами и делится примерно поровну.
Регина Матюшина
В Search Console в отчёте по внутренним ссылкам показываются не все страницы сайта. Значит ли это, что отсутствующие — сироты?
Аполлинария Ошуркова
Не обязательно. В этот отчёт попадают только страницы, известные поисковику, свежих публикаций там может не быть неделями. Мы сверяли: из полусотни «отсутствующих» реальными сиротами оказались двенадцать, остальные были просто новыми.
Родион Ключарёв
Про «почти сирот» с одной ссылкой из глубины пагинации — это прямо про наш блог. Двести статей доступны только через ленту, которая листается до 30-й страницы. Рубрики сделали, стало заметно лучше по обходу.
Стефания Бабичева
Сравнивала два списка обычной таблицей, без краулера. Функция поиска соответствия справилась за пять минут на 700 адресах. Платные инструменты для маленького сайта реально не нужны.
Наум Перевозчиков
Добавлю про логи сервера. У нас нашлись сироты, на которые робот ходил регулярно, — оказалось, на них вели ссылки с чужого агрегатора. Если бы удалили с 410, потеряли бы неплохие внешние ссылки.
Ираида Полуэктова
Не хватает раздела про многоязычные версии. У нас английская версия оказалась целиком сиротой: переключатель языка сделан скриптом, ссылок в разметке нет вообще.
Савелий Тонких
Обязательная рубрика при публикации — простая мера, а сработала лучше всех остальных. За полгода ни одной новой сироты в блоге, хотя раньше набегало по десятку в квартал.