Hogyan működik a Google kereső? Crawlingtól a rangsorolásig
A crawlingtól a találati listáig: lásd át a kereső működésének teljes folyamatát.
Röviden
A Google először URL-eket fedez fel, majd crawllal letölti őket, renderelheti az oldalt, feldolgozza és indexelheti a tartalmat, végül egy konkrét keresésnél rangsorolja az indexből kiválasztott találatokat.
A teljes folyamat
Egy oldal nem attól kerül a Google-be, hogy elkészült és publikáltad. A Google-nek először fel kell fedeznie az URL-t, le kell töltenie az oldalt, értelmeznie kell a tartalmát, majd döntenie kell arról, hogy bekerüljön-e az indexbe.
Felfedezés
→
Crawling
→
Rendering
→
Indexelés
→
Rangsorolás
1. Felfedezés
A Google új URL-eket többek között linkeken és sitemapeken keresztül talál. Ha egy oldalra semmilyen másik oldal nem hivatkozik, és sitemapben sincs benne, a felfedezése nehezebb lehet.
2. Feldolgozás
A Googlebot lekéri az oldal erőforrásait, majd szükség esetén JavaScriptet is futtat. Ezután a rendszer megpróbálja megérteni az oldal fő tartalmát, kapcsolatait és célját.
3. Rangsorolás
Amikor valaki keres, a Google nem az egész internetet vizsgálja át újra. Az indexben lévő dokumentumok közül választja ki és rendezi azokat, amelyek a lekérdezéshez a legrelevánsabbnak tűnnek.
Miért fontos ezt sorrendben látni?
Sok SEO-problémát rossz szinten próbálnak megoldani. Ha egy oldal noindex, hiába finomítod a szövegét. Ha a Google nem találja meg az URL-t, a rangsorolási faktorok elemzése még túl korai. Először mindig azt érdemes megtalálni, a folyamat melyik pontján akad el az oldal.
Az URL útja a találati listáig
Felfedezés
Crawling
Rendering
Indexelés
Rangsorolás
Mi történik akkor, amikor valaki keres?
A Google nem a teljes webet járja be minden egyes keresésnél. A korábban felfedezett és feldolgozott dokumentumok indexéből próbál olyan találatokat kiválasztani, amelyek megfelelnek a lekérdezés jelentésének, a keresési szándéknak és más relevanciajeleknek.
Ez azért fontos SEO szempontból, mert a rangsorolás csak a folyamat vége. Ha egy oldal nem fedezhető fel, nem tölthető le vagy nem kerül az indexbe, akkor egy releváns keresésnél sem tud normál organikus találatként versenyezni.
Hol akadhat el egy oldal a folyamatban?
- Felfedezés: nincs belső link, sitemap vagy más út az URL-hez.
- Crawling: robots.txt, szerverhiba vagy jogosultság akadályozza a lekérést.
- Rendering: a lényegi tartalom csak hibás JavaScript futása után jelenne meg.
- Indexelés: noindex, duplikáció, canonicalizáció vagy alacsony hozzáadott érték miatt nem kerül be.
- Rangsorolás: indexelve van, de a kereséshez kevésbé releváns vagy hasznos más találatoknál.
Gyakori kérdések
A Google minden feltérképezett oldalt indexel?
Nem. A crawling azt jelenti, hogy a Googlebot lekérte az URL-t; az indexelés külön feldolgozási döntés. Egy crawled URL később kimaradhat az indexből.
Mi a különbség az indexelés és a rangsorolás között?
Indexeléskor a Google feldolgozza és tárolhatja az oldalt. Rangsoroláskor egy konkrét kereséshez választ és rendez találatokat az indexelt dokumentumok közül.
Források és további olvasnivaló
A technikai állítások ellenőrzéséhez elsődlegesen hivatalos dokumentációt érdemes használni. A keresők működése és támogatott funkciói idővel változhatnak.