Noindex

Noindex — це директива для пошукових систем, яка забороняє додавати конкретну сторінку до індексу, тобто показувати її у видачі. Її задають або мета-тегом robots у коді сторінки, або HTTP-заголовком X-Robots-Tag на рівні сервера. Сторінку з noindex Google може сканувати, але не індексує й не покаже за запитами.

Простими словами: noindex — це табличка «не виставляти на вітрину». Товар на складі є, робот його бачить, але в зал до покупців ви його свідомо не пускаєте.

Що таке noindex і навіщо він потрібен

Не кожна сторінка має потрапляти в пошук. Сторінки подяки після замовлення, результати внутрішнього пошуку, тестові чи дублюючі сторінки, службові розділи — усе це лише засмічує індекс і розмиває релевантність сайту. Noindex прибирає такі сторінки з видачі, не видаляючи їх із самого сайту: користувач за прямим посиланням їх відкриє, а от у Google вони не з’являться.

Важливий нюанс: щоб Google побачив директиву noindex, сторінка має бути доступною для сканування. Якщо ви одночасно закриєте її ще й у robots.txt, робот просто не зайде на сторінку й не прочитає тег — і вона може навіть лишитися в індексі як «URL без опису». Тому noindex і заборону в robots.txt разом не поєднують.

Як задати noindex

  • Мета-тег robots — у <head> HTML-сторінки. Найпоширеніший спосіб для звичайних сторінок.
  • HTTP-заголовок X-Robots-Tag — на рівні сервера. Єдиний варіант для не-HTML файлів (PDF, зображення).

Синтаксис і приклад коду

Мета-тег у <head>: <meta name="robots" content="noindex, follow">
Лише для Google: <meta name="googlebot" content="noindex">
HTTP-заголовок (напр. для PDF): X-Robots-Tag: noindex

Значення noindex, follow означає «не індексуй сторінку, але переходь за посиланнями на ній». Це типовий вибір для сторінок пагінації чи фільтрів.

Приклад

Інтернет-магазин має сотні сторінок фільтрів на кшталт «?color=red&size=xl». У пошуку вони не потрібні й створюють дублі. На них ставлять noindex, follow — Google не додає їх у видачу, але вагу за внутрішніми посиланнями далі передає. Індекс лишається чистим, а краулінговий бюджет не витрачається намарно.

Часто плутають з…

  • robots.txt (Disallow) — забороняє сканування, а не індексацію. Закрита в robots.txt сторінка все одно може потрапити в індекс без опису.
  • nofollow — стосується посилань (не передавати вагу), а не індексації сторінки.
  • Canonical — лише вказує головну версію дубля, але не гарантує виключення з індексу.

Питання та відповіді

Чим noindex відрізняється від robots.txt?

Noindex забороняє показувати сторінку у видачі, але дозволяє її сканувати. Robots.txt забороняє саме сканування. Щоб noindex спрацював, сторінка не має бути закрита в robots.txt.

Noindex видаляє сторінку із сайту?

Ні. Сторінка лишається на сайті й доступна за прямим посиланням. Директива прибирає її лише з пошукового індексу.

Як швидко Google прибере сторінку з noindex?

Тільки після повторного сканування — від кількох днів до тижнів. Прискорити можна, надіславши URL на переобхід у Google Search Console.

У видачу лізуть службові чи дублюючі сторінки? Наведемо лад з індексацією — SEO-аудит та виправлення помилок на сайті.

Схожі терміни: Meta robots, robots.txt, X-Robots-Tag, Canonical, nofollow.

Опишіть свій запит
і ми зробимо для Вас
пропозицію

Напишіть мені, щоб бути в ТОП

    • icon-google-partner
    • icon-google-analytics
    • icon-google-ads-color