Noindex

Noindex — это директива для поисковых систем, которая запрещает добавлять конкретную страницу в индекс, то есть показывать её в выдаче. Её задают либо мета-тегом robots в коде страницы, либо HTTP-заголовком X-Robots-Tag на уровне сервера. Страницу с noindex Google может сканировать, но не индексирует и не покажет по запросам.

Простыми словами: noindex — это табличка «не выставлять на витрину». Товар на складе есть, робот его видит, но в зал к покупателям вы его сознательно не пускаете.

Что такое noindex и зачем он нужен

Не каждая страница должна попадать в поиск. Страницы благодарности после заказа, результаты внутреннего поиска, тестовые или дублирующие страницы, служебные разделы — всё это лишь засоряет индекс и размывает релевантность сайта. Noindex убирает такие страницы из выдачи, не удаляя их с самого сайта: пользователь по прямой ссылке их откроет, а вот в Google они не появятся.

Важный нюанс: чтобы Google увидел директиву noindex, страница должна быть доступна для сканирования. Если вы одновременно закроете её ещё и в robots.txt, робот просто не зайдёт на страницу и не прочитает тег — и она может даже остаться в индексе как «URL без описания». Поэтому noindex и запрет в robots.txt вместе не сочетают.

Как задать noindex

  • Мета-тег robots — в <head> HTML-страницы. Самый распространённый способ для обычных страниц.
  • HTTP-заголовок X-Robots-Tag — на уровне сервера. Единственный вариант для не-HTML файлов (PDF, изображения).

Синтаксис и пример кода

Мета-тег в <head>: <meta name="robots" content="noindex, follow">
Только для Google: <meta name="googlebot" content="noindex">
HTTP-заголовок (напр. для PDF): X-Robots-Tag: noindex

Значение noindex, follow означает «не индексируй страницу, но переходи по ссылкам на ней». Это типичный выбор для страниц пагинации или фильтров.

Пример

Интернет-магазин имеет сотни страниц фильтров вроде «?color=red&size=xl». В поиске они не нужны и создают дубли. На них ставят noindex, follow — Google не добавляет их в выдачу, но вес по внутренним ссылкам дальше передаёт. Индекс остаётся чистым, а краулинговый бюджет не тратится впустую.

Часто путают с…

  • robots.txt (Disallow) — запрещает сканирование, а не индексацию. Закрытая в robots.txt страница всё равно может попасть в индекс без описания.
  • nofollow — касается ссылок (не передавать вес), а не индексации страницы.
  • Canonical — лишь указывает главную версию дубля, но не гарантирует исключение из индекса.

Вопросы и ответы

Чем noindex отличается от robots.txt?

Noindex запрещает показывать страницу в выдаче, но разрешает её сканировать. Robots.txt запрещает именно сканирование. Чтобы noindex сработал, страница не должна быть закрыта в robots.txt.

Noindex удаляет страницу с сайта?

Нет. Страница остаётся на сайте и доступна по прямой ссылке. Директива убирает её только из поискового индекса.

Как быстро Google уберёт страницу с noindex?

Только после повторного сканирования — от нескольких дней до недель. Ускорить можно, отправив URL на переобход в Google Search Console.

В выдачу лезут служебные или дублирующие страницы? Наведём порядок с индексацией — SEO-аудит и исправление ошибок на сайте.

Похожие термины: Meta robots, robots.txt, X-Robots-Tag, Canonical, nofollow.

Опишіть свій запит
і ми зробимо для Вас
пропозицію

Напишіть мені, щоб бути в ТОП

    [telegram]
    • icon-google-ads-color
    • icon-google-analytics
    • icon-google-partner