Informatyk tłumaczy właścicielowi firmy proces indeksacji strony
Blog

Odkrycie, pobranie, renderowanie, indeks – cztery etapy drogi strony do Google

Właściciel kancelarii pyta informatyka, dlaczego nowa podstrona o prawie spadkowym nie pojawia się w Google. Informatyk odpowiada: „bo jeszcze się nie zaindeksowała”. To prawda, ale mało przydatna. Brak w indeksie to efekt, a nie przyczyna. Żeby coś naprawić, trzeba wiedzieć, na którym z czterech etapów strona utknęła, bo na każdym z nich pomaga coś innego.

Etap pierwszy – odkrycie adresu

Google musi najpierw dowiedzieć się, że dany adres istnieje. Robi to na trzy sposoby:

  • przez linki z innych stron, które już zna – wewnętrzne i zewnętrzne,
  • przez mapę strony XML zgłoszoną w Search Console lub wskazaną w robots.txt,
  • przez ręczne zgłoszenie adresu w narzędziu sprawdzania URL.

Strona, do której nie prowadzi żaden link i której nie ma w mapie, dla wyszukiwarki po prostu nie istnieje. W raporcie Search Console takie adresy w ogóle się nie pojawiają, co bywa mylące – brak błędu nie oznacza, że wszystko jest w porządku.

Etap drugi – pobranie przez robota

Znany adres trafia do kolejki. Robot pobiera go, gdy przyjdzie jego kolej, a kolejność zależy od ważności strony i wydajności serwera. Na tym etapie blokadą bywa plik robots.txt, błąd serwera albo zbyt długi czas odpowiedzi. Status „wykryto – obecnie nie zindeksowano” oznacza właśnie, że adres jest znany, ale robot jeszcze go nie pobrał. Przy małych stronach to zwykle kwestia kilku dni, przy dużych serwisach sygnał, że Google nie uważa tych adresów za pilne.

Etap trzeci – renderowanie

Pobrany kod HTML to nie zawsze cała strona. Jeśli treść dociągana jest skryptami, Google musi ją wyrenderować, czyli uruchomić jak przeglądarka. Renderowanie odbywa się w osobnej kolejce i może nastąpić z opóźnieniem. Treść, która pojawia się dopiero po kliknięciu, przewinięciu albo zalogowaniu, może zostać pominięta. Dla kancelarii oznacza to, że opis usługi schowany w rozwijanym akordeonie ładowanym skryptem może być dla Google niewidoczny.

Etap czwarty – decyzja o indeksacji

Dopiero teraz Google ocenia, czy strona zasługuje na miejsce w indeksie. Odrzuca duplikaty, strony z tagiem noindex, strony o bardzo cienkiej treści i te, których tag kanoniczny wskazuje inny adres. Status „strona przeskanowana – obecnie nie zindeksowana” to właśnie negatywna decyzja na tym etapie. Robot stronę widział, ale uznał, że nie wnosi wystarczająco dużo.

Szafa serwerowa, z której robot wyszukiwarki pobiera strony

Na którym etapie utknęła strona – tabela diagnostyczna

Etap Sygnał w Search Console Typowa przyczyna Co pomaga
Odkrycie Adres nieznany Google Brak linków i brak w mapie strony Link z menu lub ważnej podstrony, dodanie do mapy
Pobranie Wykryto – obecnie nie zindeksowano Blokada w robots.txt, wolny serwer, niski priorytet Odblokowanie, poprawa wydajności, wzmocnienie linkowania
Renderowanie Zrzut strony w narzędziu URL bez treści Treść ładowana skryptem lub po interakcji Treść w kodzie HTML, renderowanie po stronie serwera
Indeksacja Strona przeskanowana – obecnie nie zindeksowana Cienka treść, duplikat, kanoniczny na inny adres Rozbudowa treści, usunięcie duplikatów, poprawa kanonicznego

Jeśli strona nie jest w indeksie – ustal etap, zanim zaczniesz poprawiać

Rekomendacja: zacznij od narzędzia sprawdzania adresu w Search Console, które pokazuje, czy adres jest znany, kiedy był pobrany i jak wygląda po wyrenderowaniu. Warunek – sprawdzasz konkretny adres, a nie ogólny raport. Wyjątek to duże serwisy z tysiącami brakujących podstron, gdzie sprawdzanie pojedynczych adresów nie ma sensu i lepiej szukać wzorca w grupach stron, na przykład wszystkich produktów jednej kategorii.

Porównanie dwóch podejść do diagnozy:

  1. Diagnoza od etapu – najpierw ustalasz, gdzie strona utknęła, potem stosujesz poprawkę właściwą dla tego etapu. Wolniej na starcie, ale bez zbędnych zmian.
  2. Poprawki „na wszelki wypadek” – rozbudowa treści, zgłoszenie, nowe linki naraz. Szybko, ale nie wiadomo, co zadziałało, a czasem poprawka dotyczy nie tego etapu.

Jak długo trwa każdy etap

Nie ma jednego czasu dla wszystkich stron, ale przy typowej firmowej witrynie można przyjąć orientacyjne widełki. Odkrycie adresu z linku na często odwiedzanej stronie następuje w ciągu godzin lub dni, z samej mapy strony – zwykle w ciągu kilku dni. Pobranie przez robota przy małych serwisach trwa od dnia do tygodnia. Renderowanie bywa opóźnione o dodatkowe godziny lub dni, jeśli strona intensywnie korzysta ze skryptów. Sama decyzja o indeksacji zapada najczęściej zaraz po renderowaniu, ale w przypadku stron ocenionych jako słabe może być odkładana i ponawiana przy kolejnych wizytach.

Najczęstsze pytania

Czy mogę pominąć któryś etap?

Nie. Każda strona przechodzi przez wszystkie cztery. Można jedynie skrócić czas poszczególnych etapów – dobrym linkowaniem, szybkim serwerem i treścią dostępną bez skryptów.

Czy strona może wypaść z indeksu, mimo że przeszła wszystkie etapy?

Tak. Google okresowo odwiedza zaindeksowane strony ponownie i może zmienić decyzję, jeśli strona zacznie zwracać błędy, pojawi się noindex albo wyszukiwarka uzna, że inna strona lepiej odpowiada na te same zapytania.

Dlaczego podstrona o prawie spadkowym nie trafiła do indeksu?

W przypadku kancelarii przyczyna leżała na etapie pierwszym – podstrona była dostępna tylko przez formularz wyszukiwania na stronie, bez linku z menu i bez wpisu w mapie strony. Po dodaniu jej do menu usług i mapy trafiła do indeksu w ciągu tygodnia.

Typowe pomyłki przy diagnozie

  • uznanie braku błędów w raporcie za dowód, że strona jest w porządku – adres może być po prostu nieznany Google,
  • ponowne zgłaszanie strony, która została odrzucona na etapie czwartym – zgłoszenie nie zmieni oceny treści,
  • sprawdzanie strony wyłącznie w przeglądarce administratora zamiast w narzędziu, które pokazuje wersję widzianą przez robota,
  • wprowadzanie kilku zmian jednocześnie, przez co nie wiadomo, która z nich pomogła.

Każdy z tych etapów ma swoje typowe problemy i sposoby ich obejścia. Całość procesu, krok po kroku, opisuje tekst o tym, w jaki sposób Google indeksuje witrynę, łącznie z tym, jak robot wybiera kolejne adresy do odwiedzenia i co decyduje o włączeniu strony do indeksu.

Back To Top