noindex
Dyrektywa „nie indeksuj tej strony”.
noindex w 30 sekund
- 01 · Zrozum: noindex to dyrektywa (meta tag lub nagłówek HTTP), która mówi wyszukiwarce: nie pokazuj tej strony w wynikach.
- 02 · Sprawdź: Sprawdź meta robots w <head> lub nagłówek X-Robots-Tag.
- 03 · Unikaj: noindex zostawiony z wersji deweloperskiej na produkcji
Co to jest noindex?
noindex to dyrektywa (meta tag lub nagłówek HTTP), która mówi wyszukiwarce: nie pokazuj tej strony w wynikach. Strona może być normalnie pobrana i przeczytana, ale nie trafi do indeksu.
To właściwe narzędzie do ukrywania stron przed wyszukiwarką — inaczej niż robots.txt, który blokuje pobranie, ale nie gwarantuje usunięcia z wyników. Przydaje się na stronach logowania, koszyka, podziękowania czy wewnętrznych wynikach wyszukiwania.
Dlaczego to ważne dla SEO
Dobrze użyty noindex trzyma poza Google strony bez wartości wyszukiwawczej. Przypadkowy noindex (np. zostawiony z wersji testowej) potrafi znienacka usunąć ważne strony z wyników.
Jak to sprawdzić
Sprawdź meta robots w <head> lub nagłówek X-Robots-Tag. SEOMaster ostrzega, gdy istotne strony mają noindex. W Search Console widać „Wykluczone przez tag noindex”.
Częste błędy
- noindex zostawiony z wersji deweloperskiej na produkcji
- Jednoczesny noindex i blokada w robots.txt (Google nie zobaczy noindex)
- noindex na stronie, którą chcesz pozycjonować
Przykład
<meta name="robots" content="noindex, follow">
Najczęstsze pytania
Dlaczego strona z noindex nadal jest w Google?
Najczęściej dlatego, że robot nie może jej pobrać: adres jest zablokowany w robots.txt, więc znacznik noindex nigdy nie został przeczytany. Trzeba odblokować pobieranie, żeby wykluczenie zadziałało.
noindex w meta czy w nagłówku HTTP?
Oba działają tak samo. Nagłówek X-Robots-Tag jest jedynym wyjściem dla plików innych niż HTML, na przykład dla PDF-ów.
Czy noindex usuwa stronę natychmiast?
Nie. Usunięcie następuje przy kolejnym pobraniu strony przez robota, co może potrwać od kilku dni do kilku tygodni.
Poradniki na ten temat
- Dlaczego strona nie jest w Google i jak to naprawić — Zanim zaczniesz cokolwiek poprawiać, ustal, na którym z trzech etapów strona wypada: pobranie, indeksacja czy ranking. Każdy ma inne objawy i zupełnie inną naprawę.
- robots.txt, noindex czy canonical — co wybrać i kiedy — Te trzy mechanizmy rozwiązują trzy różne problemy: robots.txt steruje pobieraniem, noindex obecnością w wynikach, a canonical wyborem głównej wersji treści. Pomylenie ich potrafi utrzymać niechciany adres w Google przez miesiące.
- Duplicate content: jak znaleźć duplikaty i wybrać canonical — Duplikat treści nie jest automatycznie karą. Problem zaczyna się wtedy, gdy kilka adresów konkuruje o ten sam cel, rozprasza linki i utrudnia Google wybór właściwej wersji. Naprawa zależy od tego, czy wariant ma zniknąć, pozostać dostępny czy być indeksowany osobno.