Útmutató · Indexelés

Indexelés és feltérképezés megértése: Így kerül az oldalad a Google-indexbe

Három szakasz, három eszköz, egy ellenőrzési pont

A Google három szakaszban dolgozza fel az oldaladat: feltérképezés, renderelés, indexelés. Hogy egy URL az indexben van-e, egy percen belül ellenőrzöd a Google Search Console URL-ellenőrzésével. A három leggyakoribb blokkoló a noindex, a hibás canonicalek és a robots.txt-zárolások – három eszköz, amelyeket folyton összekevernek.

Feltérképezés, renderelés, indexelés: a három szakasz

Feltérképezés: a Googlebot lekéri az URL-t. Linkeken, az XML-sitemapen vagy már ismert URL-ek újraellenőrzésén keresztül találja meg.

Renderelés: a Google lefuttatja az oldal JavaScriptjét – egy Chromium-alapú renderelő szolgáltatással. Csak ezután látja a Google az oldalt úgy, ahogy a látogatód.

Indexelés: a Google értékeli a renderelt tartalmat, kiválasztja a kanonikus verziót, és felveszi az oldalt az indexbe. Vagy éppen nem.

A pont, ahol a legtöbb félreértés keletkezik: a feltérképezett nem jelent indexeltet. A Google lényegesen több URL-t térképez fel, mint amennyit indexel. És még az indexelés sem garantál látogatókat – egy mintegy 14 milliárd oldalt vizsgáló elemzés azt mutatja, hogy a vizsgált oldalak 96,55 százaléka nulla forgalmat kap a Google-keresésből (Ahrefs, 2023). Index nélkül nincs rangsorolás, bármilyen jó is a szöveg.

Hány oldal kap egyáltalán Google-forgalmat? A mintegy 14 milliárd elemzett oldal aránya organikus Google-keresési forgalom nélkül 0% 25% 50% 75% 100% Oldalak Google-forgalom nélkül Oldalak Google-forgalommal 96,55 % 3,45 % Mintegy 14 milliárd oldalt vizsgáltak az Ahrefs-webindexből. Forrás: Ahrefs-tanulmány 2023 viktorpasztor.de · Indexelés
A mintegy 14 milliárd vizsgált oldal 96,55 százaléka nem kap organikus forgalmat a Google-keresésből (Ahrefs, 2023).
Három szakasz az indexig A feltérképezett nem jelent indexeltet – minden szakasz megállíthat egy oldalt 1. Feltérképezés A Googlebot lekéri az URL-t – linkeken vagy az XML-sitemapen keresztül 2. Renderelés A Google JavaScriptet futtat, és úgy látja az oldalt, mint egy valódi látogató 3. Indexelés A Google kiválasztja a kanonikus verziót, és felveszi az oldalt – vagy éppen nem Minden szakasz megállíthat egy oldalt: robots.txt az 1. szakaszban, hibás renderelés a 2.-ban, noindex vagy minőség a 3.-ban.
A három szakasz: feltérképezés, renderelés és indexelés – a feltérképezett nem jelent indexeltet.

Ellenőrzés a Search Console-ban, hogy egy URL az indexben van-e

Felejtsd el a site: lekérdezést – durva becslés, nem riport. A megbízható forrás a Google Search Console, és 0 euróba kerül.

Egyetlen URL: írd be a címet az URL-ellenőrzésbe. Másodpercek alatt látod: az URL a Google-nál van? Mikor volt utoljára feltérképezve? Melyik kanonikus URL-t választotta a Google?

Teljes weboldal: az „Indexelés → Oldalak” jelentés az összes nem indexelt URL-t listázza indoklással. Két státusz jön elő folyton: „Feltérképezve – jelenleg nincs indexelve” (minőségi vagy duplikátum-probléma) és „Megtalálva – jelenleg nincs indexelve” (még nincs feltérképezve, gyakran a crawl-priorizálás kérdése).

robots.txt, noindex, canonical: három eszköz, három feladat

A robots.txt a feltérképezést vezérli

Egy disallow-szabály a robots.txt-ben megtiltja a lekérést. Az indexelést azonban nem akadályozza meg: ha az URL linkelve van, ettől még az indexbe kerülhet – üres bejegyzésként, tartalom nélkül.

A noindex az indexelést vezérli

A meta robots tag noindex azt mondja: „Ne vedd fel ezt az oldalt az indexbe.” Hogy a Google ezt el tudja olvasni, az oldalnak feltérképezhetőnek kell lennie. Ebből következik az 1. számú hiba szinte minden auditban: az oldalt robots.txt-vel zárolni és egyszerre noindexre állítani. A Google sosem látja a noindexet. Ha ki akarsz venni egy oldalt: noindexet beállítani, a feltérképezést engedélyezni.

A canonical utalás, nem utasítás

A canonical tag duplikátumoknál egy előnyben részesített verziót ajánl a Google-nak. A Google többnyire követi – de nem mindig. Zároló eszköznek nem alkalmas.

Crawl-büdzsé: csak ötszámjegyű URL-számoktól téma

A technikai SEO legtúlértékeltebb témája. A kb. 10 000 URL alatti weboldalaknak gyakorlatilag nem kell aggódniuk. Kb. 1 millió URL-től válik relevánssá – vagy kb. 10 000 naponta változó tartalmú URL-től, például nagy shopoknál facettás navigációval.

Ha a weboldaladnak 300 oldala van, és egyikük nincs indexelve, az nem a crawl-büdzsén múlik. Blokkolva van, túl vékony vagy duplikátum.

JavaScript-renderelés: amikor a tartalom csak a böngészőben jön létre

Ha a CMS-ed kliensoldali JavaScripttel szállítja a tartalmakat, a Google az első lekéréskor adott esetben egy szinte üres oldalt lát. Így ellenőrzöd 2 perc alatt: nyisd meg az URL-ellenőrzést a Search Console-ban, indítsd el az élő tesztet, nézd meg a renderelt HTML-t. Ha ott szövegek vagy termékek hiányoznak, renderelési problémád van.

A legrobusztusabb megoldás: a szerveroldali renderelés – WordPressnél, Shopify-nál és Shopware-nél a normál eset, headless-setupoknál a leggyakoribb problémás terület.

Több rendszerezettség – státuszkódok, átirányítások, sitemapek – a technikai SEO útmutatóban.

Indexelési jelek áttekintve

JelMit vezérelHatás
noindexIndexelésAz oldal kimarad az indexből – előfeltétel, hogy feltérképezhető legyen
CanonicalDuplikátumokAjánlás a Google-nak, nem zárolás
robots.txt (disallow)FeltérképezésMegakadályozza a lekérést, de nem feltétlenül az indexelést
XML-sitemapMegtalálásCsak indexre érdemes, 200-as státuszkódú URL-eket tartalmazzon

A négy jel különböző feladatokat old meg. Aki keveri őket – például a robots.txt-t deindexelő eszközként használja –, pontosan a következő szakasz hibáit produkálja.

Egy Shopware-shop feltérképezési problémával

„Egy mintegy 60 000 URL-es Shopware-shopnál a feltérképezések körülbelül kétharmada keresési kereslet nélküli szűrő-URL-ekbe ment. A paraméterm intákat robots.txt-vel zároltuk, megtisztítottuk a sitemapet, és a belső linkelést a kategóriákra összpontosítottuk. Nyolc hét után az új termékek a korábbi kb. két hét helyett két-három nap alatt jelentek meg az indexben.”

— Pásztor Viktor, SEO-szabadúszó

A példa megmutatja, miért csak nagy, dinamikus weboldalaknál válik témává a crawl-büdzsé: nem az oldalak száma önmagában dönt, hanem hogy abból mennyit pazarol a Google irreleváns URL-ekre.

Gyakori hibák az indexelésnél és a feltérképezésnél

robots.txt-zárolás noindexszel kombinálva

A Google sosem látja a noindexet, ha az oldal egyszerre robots.txt-vel is zárolva van. Az oldal üres bejegyzésként marad az indexben.

A canonical deindexelésként félreértve

Ez duplikátumokra vonatkozó ajánlás, nem kidobás. A Google többnyire követi a canonicalt – de garancia nélkül.

A staging noindexe élesbe vive

Minden relaunch után ellenőrizd: egy elfelejtett noindex a staging-környezetből a teljes éles weboldalt kiveszi az indexből.

Szeméttel teli sitemap, crawl-büdzsé-pánik kis oldalaknál

A sitemapbe csak indexre érdemes, 200-as státuszkódú URL-ek valók. És 10 000 URL alatt az indexproblémákat minőséggel és belső linkeléssel oldod meg, nem crawl-büdzsével.

Gyakori kérdések az indexelésről

Mennyi idő, mire a Google indexel egy új oldalt?

Néhány óra és több hét között. Bejáratott weboldalaknál tiszta sitemappel és belső linkeléssel 1–7 nap reális.

Miért van feltérképezve az oldalam, de nincs indexelve?

A Google jelenleg nem tartja indexre érdemesnek az oldalt – tipikus duplikátumoknál, nagyon vékony tartalmaknál vagy gyenge belső linkelésnél. Az indexelésre nincs jogosultság.

Hogyan távolítok el gyorsan egy oldalt a Google-indexből?

Az azonnali hatáshoz használd az eltávolítási eszközt a Search Console-ban – kb. 6 hónapra elrejti az URL-t. Tartósan csak a noindex hat egy feltérképezhető oldalnál, vagy a 410-es státuszkód.

Segít az Indexing API normál oldalaknál?

Nem. A Google az Indexing API-t hivatalosan csak két tartalomtípushoz támogatja: álláshirdetésekhez és livestream-videókhoz.

Viktor Pásztor

Pásztor Viktor SEO-szabadúszó Berlinben, több mint 15 éve dolgozik a digitális marketingben, és párhuzamosan mintegy 15 ügyfélprojektet visz, főleg e-commerce és B2B területen. Több mint öt éve 100 %-ban távolról dolgozik – WordPress, Shopify, Shopware és TYPO3 rendszerekkel. Több Pásztor Viktorról

Olvass tovább

Technikai SEO

Mit talál egy feltérképezés, és mi történik utána.

On-page optimalizálás

Hogyan készülnek elő a tartalmak a rangsoroláshoz és az indexeléshez.

SEO-költségek

Mibe kerül a velem való együttműködés.

Indexelési problémák a weboldaladon?

Egy SEO-audit pontról pontra ellenőrzi a feltérképezést, a renderelést és az indexelést – beleértve a betekintést a Search Console-odba. Válasz munkanapokon 24 órán belül.

→ Kérj SEO-auditot most