Indeksacja
Indeksacja to proces, w którym wyszukiwarka zapisuje przeanalizowaną stronę w swojej bazie danych i dopuszcza ją do udziału w rankingu. Jest to etap pośredni: następuje po crawlowaniu, czyli odwiedzeniu adresu przez robota, a przed rankingiem, czyli ustaleniem kolejności wyników. Strona, która nie została zaindeksowana, nie pojawi się w wynikach wyszukiwania niezależnie od tego, jak dobrze jest napisana.
Crawlowanie, indeksacja, ranking — trzy różne etapy
Te trzy pojęcia bywają mylone, a różnica między nimi decyduje o tym, gdzie szukać przyczyny problemu. Crawlowanie to odwiedzenie adresu przez robota. Indeksacja to decyzja, czy treść trafi do bazy. Ranking to ustalenie pozycji wśród innych zaindeksowanych stron.
Robot może odwiedzić stronę i jej nie zaindeksować — na przykład gdy uzna treść za duplikat innego adresu albo gdy strona zawiera znacznik noindex. Odwrotna sytuacja też jest możliwa: adres bywa zaindeksowany bez crawlowania, jeśli Google zna go z linków prowadzących z innych serwisów, ale nie mógł pobrać zawartości.
Jak sprawdzić, czy strona jest zaindeksowana
Najpewniejszym źródłem jest raport „Strony” w Google Search Console. Pokazuje liczbę adresów zaindeksowanych i niezaindeksowanych wraz z powodem wykluczenia — od „Wykryto, obecnie bez indeksu” po „Strona z przekierowaniem”.
Narzędzie „Sprawdzenie adresu URL” w tej samej usłudze diagnozuje pojedynczy adres: mówi, kiedy robot odwiedził stronę, jaką wersję zapisał i czy adres kanoniczny wybrany przez Google zgadza się z tym, który wskazałeś.
- operator site: — szybka, ale przybliżona kontrola; nie zastępuje raportu w GSC
- raport „Strony” — pełna lista adresów z powodem wykluczenia
- Sprawdzenie adresu URL — diagnoza pojedynczego adresu i wybór wersji kanonicznej
Najczęstsze przyczyny braku indeksacji
Blokada w pliku robots.txt uniemożliwia pobranie treści, przez co robot nie ma czego zaindeksować. Znacznik noindex w sekcji head lub w nagłówku HTTP jawnie zabrania umieszczenia strony w indeksie.
Częstszą przyczyną bywa jednak jakość: jeśli treść powiela inny adres w serwisie albo nie wnosi nic ponad to, co jest już w indeksie, Google może świadomie ją pominąć. W raporcie GSC pojawia się wtedy status „Wykryto, obecnie bez indeksu” albo „Zeskanowano, obecnie bez indeksu”.
Indeksacja a szybkość działania
Zgłoszenie adresu przez Search Console przyspiesza pierwszą wizytę robota, ale nie gwarantuje indeksacji ani jej terminu. Dla nowych serwisów bez linków przychodzących proces bywa rozłożony na tygodnie.
Mapa witryny sitemap.xml i spójne linkowanie wewnętrzne działają skuteczniej niż ręczne zgłaszanie pojedynczych adresów, bo pokazują robotowi strukturę serwisu i hierarchię ważności stron.
Najczęściej zadawane pytania
Crawlowanie to odwiedzenie adresu przez robota i pobranie zawartości. Indeksacja to decyzja o zapisaniu tej zawartości w bazie wyszukiwarki. Strona może zostać zcrawlowana i mimo to nie trafić do indeksu.
Od kilku godzin do kilku tygodni. Czas zależy od autorytetu domeny, częstotliwości publikacji i tego, czy do nowego adresu prowadzą linki wewnętrzne lub zewnętrzne. Google nie podaje gwarantowanego terminu.
Nie. Blokada uniemożliwia pobranie treści, ale adres znany z linków może pozostać w indeksie bez opisu. Do usunięcia strony służy znacznik noindex, który wymaga, by robot mógł stronę odwiedzić.
Google pobrał treść, ale zdecydował jej nie indeksować. Zwykle powodem jest niska unikalność albo brak wartości względem stron już obecnych w indeksie. To sygnał o jakości treści, nie o błędzie technicznym.
Nie. Strony wyników wyszukiwania wewnętrznego, koszyk, panele logowania czy warianty filtrowania zwykle wyklucza się z indeksu, by nie rozpraszać budżetu crawlowania i nie tworzyć duplikatów.