Miksi sillä on väliä
Kaikki muu SEO-työ on turhaa, jos sivu ei ole indeksissä. Paras palvelusivu ei tuo yhtään yhteydenottoa, jos Google ei ole ottanut sitä mukaan.
Tavallisin syy ei ole rangaistus vaan arkinen virhe: julkaisun jälkeen unohtunut noindex, testiympäristöstä kopioitu robots.txt tai sivu, johon mikään ei linkitä. Nämä löytyvät kymmenessä minuutissa, kun tietää, mistä katsoa.
Näin se tehdään
1. Tarkista tilanne Search Consolesta. Sivut-raportti kertoo, montako sivua on indeksoitu ja miksi loput eivät ole. Yksittäisen sivun tilan näet URL-tarkistuksella. Kiinnitä huomiota tiloihin, joissa sivu on haettu tai löydetty mutta jätetty indeksoimatta: ne kertovat yleensä ohuesta sisällöstä, kaksoiskappaleesta tai heikosta linkityksestä.
2. Käytä noindexiä oikein. noindex pitää sivun poissa hakutuloksista. Se toimii vain, jos Google pääsee lukemaan sivun. Jos robots.txt estää sivun, Google ei koskaan näe noindex-merkintää, ja sivu voi silti päätyä indeksiin ilman sisältöä.
3. Kerro pääversio canonicalilla. Kun sama sisältö löytyy useasta osoitteesta (esimerkiksi seurantaparametrien kanssa), rel="canonical" kertoo, mikä osoite on pääversio. Se on vihje, ei käsky: Google voi valita toisen osoitteen, jos muut signaalit puhuvat sitä vastaan.
4. Pidä pääsisältö HTML:ssä. Google renderöi JavaScriptin, mutta viiveellä. Tekoälyjen hakurobotit eivät Vercelin ja MERJ:n selvityksen mukaan suorita JavaScriptiä lainkaan. Jos palvelukuvaus ilmestyy sivulle vasta skriptin ajettua, ChatGPT ja Claude eivät sitä näe. Tarkista asia katsomalla sivun lähdekoodia selaimessa.
5. Älä murehdi crawl budgetia turhaan. Hakurobotin resurssirajat koskevat käytännössä suuria sivustoja, joilla on satojatuhansia osoitteita. Pk-yrityksen sivustolla ongelma on lähes aina jokin yllä olevista.
Musta hattu
Temppu: Sivustolle tehdään satoja lähes samanlaisia sivuja, esimerkiksi sama palvelu jokaiselle paikkakunnalle, jotta indeksiin saataisiin mahdollisimman monta osumaa.
Miten kävi: Google kutsuu näitä doorway-sivuiksi, ja ne ovat spam-käytäntöjen vastaisia. Useimmiten ne eivät edes päädy indeksiin: Google jättää ohuet kaksoiskappaleet pois, ja ne näkyvät Search Consolessa indeksoimattomina.
Tarkistuslista
Käy kohdat läpi omalla sivustollasi. Valinnat tallentuvat vain tähän selaimeen.
Lähteet
- Google Search Central: Block Search indexing with noindex
- Google Search Central: How to specify a canonical URL
- Google Search Central: Crawl budget management for large sites
- Vercel ja MERJ: The rise of the AI crawler (joulukuu 2024)
- Google Search Central: Spam policies for Google web search (doorway-sivut)
Tarkistettu 28.9.2026. Hakukoneiden ja tekoälypalveluiden käytännöt muuttuvat, joten päivitämme oppaan säännöllisesti.