Útmutató · Indexelés
Indexelés és feltérképezés megértése: Így kerül az oldalad a Google-indexbe
Három szakasz, három eszköz, egy ellenőrzési pont
A Google három szakaszban dolgozza fel az oldaladat: feltérképezés, renderelés, indexelés. Hogy egy URL az indexben van-e, egy percen belül ellenőrzöd a Google Search Console URL-ellenőrzésével. A három leggyakoribb blokkoló a noindex, a hibás canonicalek és a robots.txt-zárolások – három eszköz, amelyeket folyton összekevernek.
Feltérképezés, renderelés, indexelés: a három szakasz
Feltérképezés: a Googlebot lekéri az URL-t. Linkeken, az XML-sitemapen vagy már ismert URL-ek újraellenőrzésén keresztül találja meg.
Renderelés: a Google lefuttatja az oldal JavaScriptjét – egy Chromium-alapú renderelő szolgáltatással. Csak ezután látja a Google az oldalt úgy, ahogy a látogatód.
Indexelés: a Google értékeli a renderelt tartalmat, kiválasztja a kanonikus verziót, és felveszi az oldalt az indexbe. Vagy éppen nem.
A pont, ahol a legtöbb félreértés keletkezik: a feltérképezett nem jelent indexeltet. A Google lényegesen több URL-t térképez fel, mint amennyit indexel. És még az indexelés sem garantál látogatókat – egy mintegy 14 milliárd oldalt vizsgáló elemzés azt mutatja, hogy a vizsgált oldalak 96,55 százaléka nulla forgalmat kap a Google-keresésből (Ahrefs, 2023). Index nélkül nincs rangsorolás, bármilyen jó is a szöveg.
Ellenőrzés a Search Console-ban, hogy egy URL az indexben van-e
Felejtsd el a site: lekérdezést – durva becslés, nem riport. A megbízható forrás a Google Search Console, és 0 euróba kerül.
Egyetlen URL: írd be a címet az URL-ellenőrzésbe. Másodpercek alatt látod: az URL a Google-nál van? Mikor volt utoljára feltérképezve? Melyik kanonikus URL-t választotta a Google?
Teljes weboldal: az „Indexelés → Oldalak” jelentés az összes nem indexelt URL-t listázza indoklással. Két státusz jön elő folyton: „Feltérképezve – jelenleg nincs indexelve” (minőségi vagy duplikátum-probléma) és „Megtalálva – jelenleg nincs indexelve” (még nincs feltérképezve, gyakran a crawl-priorizálás kérdése).
robots.txt, noindex, canonical: három eszköz, három feladat
A robots.txt a feltérképezést vezérli
Egy disallow-szabály a robots.txt-ben megtiltja a lekérést. Az indexelést azonban nem akadályozza meg: ha az URL linkelve van, ettől még az indexbe kerülhet – üres bejegyzésként, tartalom nélkül.
A noindex az indexelést vezérli
A meta robots tag noindex azt mondja: „Ne vedd fel ezt az oldalt az indexbe.” Hogy a Google ezt el tudja olvasni, az oldalnak feltérképezhetőnek kell lennie. Ebből következik az 1. számú hiba szinte minden auditban: az oldalt robots.txt-vel zárolni és egyszerre noindexre állítani. A Google sosem látja a noindexet. Ha ki akarsz venni egy oldalt: noindexet beállítani, a feltérképezést engedélyezni.
A canonical utalás, nem utasítás
A canonical tag duplikátumoknál egy előnyben részesített verziót ajánl a Google-nak. A Google többnyire követi – de nem mindig. Zároló eszköznek nem alkalmas.
Crawl-büdzsé: csak ötszámjegyű URL-számoktól téma
A technikai SEO legtúlértékeltebb témája. A kb. 10 000 URL alatti weboldalaknak gyakorlatilag nem kell aggódniuk. Kb. 1 millió URL-től válik relevánssá – vagy kb. 10 000 naponta változó tartalmú URL-től, például nagy shopoknál facettás navigációval.
Ha a weboldaladnak 300 oldala van, és egyikük nincs indexelve, az nem a crawl-büdzsén múlik. Blokkolva van, túl vékony vagy duplikátum.
JavaScript-renderelés: amikor a tartalom csak a böngészőben jön létre
Ha a CMS-ed kliensoldali JavaScripttel szállítja a tartalmakat, a Google az első lekéréskor adott esetben egy szinte üres oldalt lát. Így ellenőrzöd 2 perc alatt: nyisd meg az URL-ellenőrzést a Search Console-ban, indítsd el az élő tesztet, nézd meg a renderelt HTML-t. Ha ott szövegek vagy termékek hiányoznak, renderelési problémád van.
A legrobusztusabb megoldás: a szerveroldali renderelés – WordPressnél, Shopify-nál és Shopware-nél a normál eset, headless-setupoknál a leggyakoribb problémás terület.
Több rendszerezettség – státuszkódok, átirányítások, sitemapek – a technikai SEO útmutatóban.
Indexelési jelek áttekintve
| Jel | Mit vezérel | Hatás |
|---|---|---|
| noindex | Indexelés | Az oldal kimarad az indexből – előfeltétel, hogy feltérképezhető legyen |
| Canonical | Duplikátumok | Ajánlás a Google-nak, nem zárolás |
| robots.txt (disallow) | Feltérképezés | Megakadályozza a lekérést, de nem feltétlenül az indexelést |
| XML-sitemap | Megtalálás | Csak indexre érdemes, 200-as státuszkódú URL-eket tartalmazzon |
A négy jel különböző feladatokat old meg. Aki keveri őket – például a robots.txt-t deindexelő eszközként használja –, pontosan a következő szakasz hibáit produkálja.
Egy Shopware-shop feltérképezési problémával
„Egy mintegy 60 000 URL-es Shopware-shopnál a feltérképezések körülbelül kétharmada keresési kereslet nélküli szűrő-URL-ekbe ment. A paraméterm intákat robots.txt-vel zároltuk, megtisztítottuk a sitemapet, és a belső linkelést a kategóriákra összpontosítottuk. Nyolc hét után az új termékek a korábbi kb. két hét helyett két-három nap alatt jelentek meg az indexben.”
— Pásztor Viktor, SEO-szabadúszó
A példa megmutatja, miért csak nagy, dinamikus weboldalaknál válik témává a crawl-büdzsé: nem az oldalak száma önmagában dönt, hanem hogy abból mennyit pazarol a Google irreleváns URL-ekre.
Gyakori hibák az indexelésnél és a feltérképezésnél
robots.txt-zárolás noindexszel kombinálva
A Google sosem látja a noindexet, ha az oldal egyszerre robots.txt-vel is zárolva van. Az oldal üres bejegyzésként marad az indexben.
A canonical deindexelésként félreértve
Ez duplikátumokra vonatkozó ajánlás, nem kidobás. A Google többnyire követi a canonicalt – de garancia nélkül.
A staging noindexe élesbe vive
Minden relaunch után ellenőrizd: egy elfelejtett noindex a staging-környezetből a teljes éles weboldalt kiveszi az indexből.
Szeméttel teli sitemap, crawl-büdzsé-pánik kis oldalaknál
A sitemapbe csak indexre érdemes, 200-as státuszkódú URL-ek valók. És 10 000 URL alatt az indexproblémákat minőséggel és belső linkeléssel oldod meg, nem crawl-büdzsével.
Gyakori kérdések az indexelésről
Mennyi idő, mire a Google indexel egy új oldalt?
Néhány óra és több hét között. Bejáratott weboldalaknál tiszta sitemappel és belső linkeléssel 1–7 nap reális.
Miért van feltérképezve az oldalam, de nincs indexelve?
A Google jelenleg nem tartja indexre érdemesnek az oldalt – tipikus duplikátumoknál, nagyon vékony tartalmaknál vagy gyenge belső linkelésnél. Az indexelésre nincs jogosultság.
Hogyan távolítok el gyorsan egy oldalt a Google-indexből?
Az azonnali hatáshoz használd az eltávolítási eszközt a Search Console-ban – kb. 6 hónapra elrejti az URL-t. Tartósan csak a noindex hat egy feltérképezhető oldalnál, vagy a 410-es státuszkód.
Segít az Indexing API normál oldalaknál?
Nem. A Google az Indexing API-t hivatalosan csak két tartalomtípushoz támogatja: álláshirdetésekhez és livestream-videókhoz.
Viktor Pásztor
Pásztor Viktor SEO-szabadúszó Berlinben, több mint 15 éve dolgozik a digitális marketingben, és párhuzamosan mintegy 15 ügyfélprojektet visz, főleg e-commerce és B2B területen. Több mint öt éve 100 %-ban távolról dolgozik – WordPress, Shopify, Shopware és TYPO3 rendszerekkel. Több Pásztor Viktorról
Olvass tovább
Technikai SEO
Mit talál egy feltérképezés, és mi történik utána.
On-page optimalizálás
Hogyan készülnek elő a tartalmak a rangsoroláshoz és az indexeléshez.
SEO-költségek
Mibe kerül a velem való együttműködés.
Indexelési problémák a weboldaladon?
Egy SEO-audit pontról pontra ellenőrzi a feltérképezést, a renderelést és az indexelést – beleértve a betekintést a Search Console-odba. Válasz munkanapokon 24 órán belül.
→ Kérj SEO-auditot most