Noindex — це директива для пошукових систем, яка забороняє додавати конкретну сторінку до індексу, тобто показувати її у видачі. Її задають або мета-тегом robots у коді сторінки, або HTTP-заголовком X-Robots-Tag на рівні сервера. Сторінку з noindex Google може сканувати, але не індексує й не покаже за запитами.
Простими словами: noindex — це табличка «не виставляти на вітрину». Товар на складі є, робот його бачить, але в зал до покупців ви його свідомо не пускаєте.
Що таке noindex і навіщо він потрібен
Не кожна сторінка має потрапляти в пошук. Сторінки подяки після замовлення, результати внутрішнього пошуку, тестові чи дублюючі сторінки, службові розділи — усе це лише засмічує індекс і розмиває релевантність сайту. Noindex прибирає такі сторінки з видачі, не видаляючи їх із самого сайту: користувач за прямим посиланням їх відкриє, а от у Google вони не з’являться.
Важливий нюанс: щоб Google побачив директиву noindex, сторінка має бути доступною для сканування. Якщо ви одночасно закриєте її ще й у robots.txt, робот просто не зайде на сторінку й не прочитає тег — і вона може навіть лишитися в індексі як «URL без опису». Тому noindex і заборону в robots.txt разом не поєднують.
Як задати noindex
- Мета-тег robots — у
<head>HTML-сторінки. Найпоширеніший спосіб для звичайних сторінок. - HTTP-заголовок X-Robots-Tag — на рівні сервера. Єдиний варіант для не-HTML файлів (PDF, зображення).
Синтаксис і приклад коду
Мета-тег у <head>: <meta name="robots" content="noindex, follow">
Лише для Google: <meta name="googlebot" content="noindex">
HTTP-заголовок (напр. для PDF): X-Robots-Tag: noindex
Значення noindex, follow означає «не індексуй сторінку, але переходь за посиланнями на ній». Це типовий вибір для сторінок пагінації чи фільтрів.
Приклад
Інтернет-магазин має сотні сторінок фільтрів на кшталт «?color=red&size=xl». У пошуку вони не потрібні й створюють дублі. На них ставлять noindex, follow — Google не додає їх у видачу, але вагу за внутрішніми посиланнями далі передає. Індекс лишається чистим, а краулінговий бюджет не витрачається намарно.
Часто плутають з…
- robots.txt (Disallow) — забороняє сканування, а не індексацію. Закрита в robots.txt сторінка все одно може потрапити в індекс без опису.
- nofollow — стосується посилань (не передавати вагу), а не індексації сторінки.
- Canonical — лише вказує головну версію дубля, але не гарантує виключення з індексу.
Питання та відповіді
Чим noindex відрізняється від robots.txt?
Noindex забороняє показувати сторінку у видачі, але дозволяє її сканувати. Robots.txt забороняє саме сканування. Щоб noindex спрацював, сторінка не має бути закрита в robots.txt.
Noindex видаляє сторінку із сайту?
Ні. Сторінка лишається на сайті й доступна за прямим посиланням. Директива прибирає її лише з пошукового індексу.
Як швидко Google прибере сторінку з noindex?
Тільки після повторного сканування — від кількох днів до тижнів. Прискорити можна, надіславши URL на переобхід у Google Search Console.
У видачу лізуть службові чи дублюючі сторінки? Наведемо лад з індексацією — SEO-аудит та виправлення помилок на сайті.
Схожі терміни: Meta robots, robots.txt, X-Robots-Tag, Canonical, nofollow.