Indeksiranje je korak u kojem Google odlučuje hoće li stranicu koju je pročitao dodati u svoj indeks — bazu iz koje se sastavljaju rezultati pretrage. To je zaseban korak nakon crawlanja: bot je stranicu vidio, ali to još ne znači da će je zadržati.
Zašto Google odbija indeksirati
Indeksacija je danas selektivna. Tipičan zdrav sajt ima 60–80% stranica u indeksu, a ostatak je isključen s razlogom:
- Thin content — manje sadržaja i vrijednosti od konkurencije za isti upit
- Duplikati — Google je odabrao drugi URL kao canonical
- Krivi format — top rezultati su vodiči, a vi imate kratku uslužnu stranicu
- Premalo internih linkova — stranica djeluje nevažno unutar vlastitog sajta
- Noindex ili blokada — često nenamjerno, ostatak s razvojnog okruženja
Kako provjeriti
U Search Consoleu, izvještaj Pages pokazuje broj indeksiranih stranica i točan razlog isključenja za svaku ostalu. “Crawled – currently not indexed” znači problem s kvalitetom; “Discovered – currently not indexed” znači da bot nije ni stigao doći.
Realan timing
Nova stranica: otkrivanje 1–7 dana, crawl 1–14 dana, odluka o indeksaciji 1–60 dana. Nakon popravka i zahtjeva za ponovnom indeksacijom Google se obično vrati u 3–14 dana.
Ubrzavaju ga sitemap, interni linkovi s jakih stranica i brz server. Ništa od toga ne pomaže ako je sadržaj tanak — tada se prvo popravlja sadržaj.
Povezani pojmovi
Crawling
Proces kojim Googleovi botovi 'pregledavaju' web stranice kako bi otkrili i pročitali sadržaj. Prvi korak prije indeksacije i rangiranja.
Google Search Console
Besplatan Googleov alat koji pokazuje kako Google vidi vašu stranicu — indeksaciju, pozicije u pretrazi, upite, klikove i tehničke greške.
Sitemap
XML datoteka koja tražilicama popisuje sve važne stranice web sjedišta. Pomaže Googleu brže i potpunije indeksirati sadržaj.
Canonical tag
HTML oznaka koja Googleu govori koja je 'glavna' verzija stranice kad postoji više sličnih ili dupliciranih URL-ova. Sprječava probleme s duplikatima.