A keresőmotor-botok nyomon követése szervernapló-fájlok (log fájlok) elemzésével a legmegbízhatóbb módja annak, hogy valós képet kapj arról, a Googlebot, a Bingbot és más keresőrobotok mely URL-eket, milyen gyakorisággal, milyen HTTP-állapotkódokkal és mekkora erőforrás-felhasználással látogatják meg a webhelyedet. Míg a SEO-eszközök becsléseket adnak, a szervernaplók közvetlenül a kiszolgálód által rögzített tényleges kéréseket mutatják; ennek köszönhetően pontosan mérheted a feltérképezési keret (crawl budget) pazarlását, a 404-es és 500-as hibákat, az átirányítási láncokat, a felesleges paraméteres URL-ek pásztázását, valamint azt, hogy a fontos oldalakat a botok kellő mértékben felkeresik-e.
A technikai SEO-munkálatok gyakran a látható területekre összpontosítanak, mint az on-page optimalizálás, a sebesség, a strukturált adatok és a backlinkek. Ahhoz azonban, hogy megértsd, hogyan látja a keresőmotor a webhelyedet, a botok viselkedését is vizsgálni kell. A botviselkedés legnyersebb és legmegbízhatóbb forrása pedig az access log néven ismert hozzáférési napló. Különösen nagy e-kereskedelmi oldalak, hírportálok, SaaS-projektek, többnyelvű webhelyek és gyakran publikáló blogok esetében a naplóelemzés kritikus szerepet játszik az indexelési problémák megoldásában.
Ebben az útmutatóban a Hostragons blog számára gyakorlatias és alkalmazható megközelítéssel lépésről lépésre áttekintjük, hol találhatók a szervernapló-fájlok, mely mezőket kell kiolvasni, hogyan lehet megkülönböztetni a valódi keresőmotor-botokat a hamisaktól, milyen SEO-metrikákat érdemes nyomon követni, és hogyan ültetheted át a gyakorlatba az elemzés eredményeit. Ha saját webhelyeden szeretnél rendszeres naplóelemzést végezni, és ehhez megbízható hosting infrastruktúrára van szükséged, érdemes megfontolnod a Hostragons webes hoszting és a nagy forgalmú projektekhez kínált Hostragons VPS Szerver lehetőségeket is.
Mi az a szervernapló-fájl, és miért fontos a SEO szempontjából?
A szervernapló-fájl egy olyan naplóállomány, amelyben a webszerveredhez érkező minden egyes kérés rögzítésre kerül. Amikor egy felhasználó megnyitja a főoldaladat, amikor a Googlebot letapogat egy kategóriaoldalt, vagy amikor egy biztonsági ellenőrző kérést küld a webhelyedre, ez az esemény bejegyzésre kerül a naplófájlba. Általában olyan információkat tartalmaz, mint a dátum, az időpont, az IP-cím, a kért URL, a HTTP-metódus, az állapotkód, a válasz mérete, a user-agent és néha a válaszidő.
A SEO szempontjából a naplófájlok azért lényegesek, mert közvetlenül mutatják, hogyan pásztázzák a keresőmotorok a webhelyedet. A Google Search Console ugyan kínál feltérképezési statisztikákat, de nem mindig ad részletes tájékoztatást URL-szinten minden egyes kérésről, az összes botról és a kiszolgálón fellépő pillanatnyi hibákról. A naplóelemzéssel például láthatod, hogy az elmúlt 7 napban a Googlebot 12 400 kérést intézett, melyek 18%-a 301-es átirányításra, 6%-a 404-es hibára, 2%-a 500-as hibára futott, és hogy a fontos termékoldalaidat mindössze 9%-ban pásztázták.
Ezek az adatok különösen a feltérképezési keret kezelése szempontjából értékesek. A feltérképezési keret (crawl budget) felfogható úgy, mint az a mennyiségű URL, amelyet a keresőmotor-botok egy adott időszak alatt képesek letapogatni a webhelyeden. Ha túl sok a felesleges szűrő, lapozó, keresési találat, paraméteres URL vagy hibás átirányítás, a botok kevesebb időt fordíthatnak az értékes oldalaidra. A naplófájlok bizonyítékokkal tárják fel ezt a pazarlást.
Milyen kérdésekre keressük a választ a keresőmotor-botok nyomon követésekor?
A sikeres naplóelemzés nem merül ki abban, hogy megnyitjuk a fájlt és elolvassuk a sorokat. Először a megfelelő kérdéseket kell feltenni. A technikai SEO-csapatok általában az alábbi kérdésekre keresik a választ:
- A Googlebot mely URL-csoportokat pásztázza a leggyakrabban?
- A fontos oldalak kellő gyakorisággal kerülnek-e meglátogatásra?
- A feltérképezési kérelmek mekkora hányada kap 200-as, 301-es, 302-es, 404-es, 410-es vagy 5xx-es állapotkódot?
- A botok továbbra is küldenek-e kéréseket a robots.txt által letiltott területekre?
- A paraméteres, ismétlődő vagy alacsony értékű URL-ek felemésztik-e a feltérképezési keretet?
- Van-e különbség a mobil Googlebot és az asztali Googlebot viselkedése között?
- A kiszolgáló válaszideje lassítja-e a botok általi pásztázást?
- A hamis botok Googlebotnak adva ki magukat fogyasztják-e az erőforrásokat?
Ezen kérdések mindegyike közvetlenül cselekvésre váltható. Ha például azt látod, hogy a Googlebot nagyszámú régi kampány-URL-t 404-es hibával pásztáz, átirányíthatod ezeket az URL-eket 301-gyel a megfelelő kategóriába, vagy ha véglegesen eltávolítottad őket, használhatsz 410-es állapotkódot. Ha a botok kéréseinek 30%-a a webhelyen belüli keresési eredményekre irányul, szükség lehet a robots.txt, a canonical, a noindex vagy az URL-paraméterek kezelésének újratervezésére.
Hol találhatók a naplófájlok?
A naplófájlok helye a használt hosting típusától, a vezérlőpulttól és a webszervertől függően változik. A megosztott hostingot használó webhelyek esetében a hozzáférési naplók általában a cPanel, a Plesk vagy a tárhelyszolgáltató paneljének statisztikák és nyers hozzáférési naplók (raw access logs) szekcióiban érhetők el. A VPS-t vagy dedikált szervert használó projekteknél a naplók SSH-n keresztül férhetők hozzá.
Gyakori Apache és Nginx naplóútvonalak
Linux-alapú szervereken Apache esetén a gyakori hozzáférési napló útvonala a /var/log/apache2/access.log vagy a /var/log/httpd/access_log. Nginx-et használó szervereken a /var/log/nginx/access.log fájl az elterjedt. Domain-specifikus virtuális hoszt konfigurációk esetén minden webhelyhez külön naplófájl tartozhat. Ez több webhelyet tartalmazó struktúrákban növeli az elemzés pontosságát.
Egy példa naplóbejegyzés a következő információkat tartalmazhatja: 66.249.66.1 - - [12/Mar/2026:10:15:22 +0300] GET /blog/technikai-seo HTTP/2.0 200 18432 Googlebot/2.1. Ebből a sorból kiolvashatod az IP-címet, a kérés időpontját, az URL-t, az állapotkódot, a válasz méretét és a user-agent információt. Ha a naplóformátumod tartalmazza a válaszidőt is, akkor még erőteljesebb adatkészlettel rendelkezel a teljesítményelemzéshez.
Naplófájlok letöltése a hosting vezérlőpultból
A korlátozott technikai tudással rendelkező felhasználók számára a naplók letöltése a hosting panelből a legpraktikusabb módszer. A panelen keresheted az access logs, raw logs, visitors vagy web statistics szekciókat. Nagy webhelyek esetében a napi naplófájlok több százezer sort is tartalmazhatnak, ezért hatékonyabb a fájlokat tömörített formában letölteni és úgy elemezni. A rendszeres hozzáférés, a biztonságos biztonsági mentés és a teljesítménykövetés érdekében az olyan könnyen kezelhető megoldások, mint a Hostragons cPanel hosting, felgyorsíthatják a munkádat.
A naplóbejegyzés SEO szempontjából fontos mezői
Nem minden naplóbejegyzés egyenértékű. A SEO szempontjából elsősorban néhány mezőre kell összpontosítani. Az IP-cím a bot valódiságának ellenőrzésére szolgál. A dátum és az időpont lehetővé teszi a pásztázási intenzitás napokra és órákra lebontott mérését. A HTTP-metódus általában GET kell, hogy legyen; a szokatlan POST kérések biztonsági szempontból vizsgálhatók. A kért URL megmutatja, melyik oldalt pásztázzák. Az állapotkód az oldal elérhetőségét jelzi. A user-agent segít azonosítani a kérést végző bot kilétét. Ha van válaszidő vagy "time taken" mező, az rendkívül értékes a botélmény és a szerverterhelés szempontjából.
Tételezzük fel például, hogy az utolsó 30 nap naplójában 50 000 Googlebot kérés van. Ha ezekből a kérésekből 38 000 kap 200-as, 7 500 kap 301-es, 2 000 kap 404-es, 1 200 kap 304-es, 800 kap 5xx-es és 500 kap 302-es válaszkódot, akkor a probléma egyértelmű: az átirányítási és hibaarány összesen meghaladja a 20%-ot. A technikai SEO célja az 5xx-es hibák nullához közelítése, a 404-es hibák értelmes szintre csökkentése és a felesleges átirányítások visszaszorítása.
Hogyan lehet megkülönböztetni a valódi Googlebotot a hamis bottól?
A user-agent önmagában nem megbízható. A rosszindulatú keresőrobotok Googlebotnak adhatják ki magukat. Ezért a valódi keresőmotor-botok ellenőrzéséhez fordított DNS (reverse DNS) és előre irányuló DNS (forward DNS) ellenőrzést kell végezni. A Google által javasolt módszer az, hogy az IP-címet fordított DNS-sel (reverse DNS) vissza kell fejteni egy hosztnévre, majd ellenőrizni kell, hogy a kapott hosztnév a googlebot.com vagy a google.com domainre végződik-e, végül ezt a hosztnevet újra fel kell oldani ugyanarra az IP-címre.
A folyamat a következő: Vedd ki a naplóból a Googlebot user-agent információval érkező IP-címet. Terminálban futtass egy fordított DNS-lekérdezést a `host 66.249.66.1` vagy `nslookup 66.249.66.1` paranccsal. Ha a kapott domain név egy megbízható Google domainhez tartozik, például crawl-66-249-66-1.googlebot.com, akkor lépj a második lépésre. Oldd fel ezt a domain nevet újra IP-címre. Ha az eredmény megegyezik az eredeti IP-címmel, akkor a bot nagy valószínűséggel valódi. Ha nem egyezik, vagy nem kapcsolódó domain név jelenik meg, akkor hamis botnak kell tekinteni.
Ez az ellenőrzés különösen fontos az erőforrás-igényes botok kiszűréséhez. A hamis Googlebotok felemészthetik a szerver erőforrásait, biztonsági réseket kereshetnek, vagy tartalmat másolhatnak. Amikor ilyen forgalmat észlelsz, WAF-ot, sebességkorlátozást (rate limit), IP-tiltást vagy tűzfalszabályokat léptethetsz életbe. A HTTPS és a biztonságos kapcsolat konfigurálásához tekintsd meg a Hostragons SSL Tanúsítványok oldalt.
Naplóelemzéshez használható eszközök
A naplóelemzéshez nincs egyetlen üdvözítő eszköz. A webhely méretétől, a technikai csapat tapasztalatától és a költségvetéstől függően különböző módszerek választhatók. Kis webhelyek esetében az Excel, a Google Sheets vagy az egyszerű parancssori szűrők elegendőek lehetnek. Közepes méretű oldalaknál a Screaming Frog Log File Analyser, a GoAccess vagy a Python szkriptek hatékonyabbak. Vállalati struktúrákban Elasticsearch, Logstash, Kibana, BigQuery vagy SIEM-megoldások használhatók.
| Módszer | Legalkalmasabb felhasználás | Előny | Korlát |
|---|---|---|---|
| Excel vagy Sheets | Kis blogok, alacsony forgalom | Könnyen elsajátítható, gyors szűrést biztosít | Nagy fájloknál lelassul és sorkorlátba ütközik |
| Parancssor | Technikai felhasználók, VPS szerverek | Gyors, ingyenes, automatizálásra alkalmas | Linux parancs-ismeretet igényel |
| SEO naplóelemző eszközök | Közepes és nagy webhelyek | Bot, URL és állapotkód riportok készen állnak rendelkezésre | Licencköltséggel járhat |
| ELK vagy BigQuery | Vállalati és nagy forgalmú webhelyek | Valós idejű, skálázható és részletes | A telepítés és karbantartás szakértelmet igényel |
Egy praktikus kezdéshez elegendő, ha letöltöd az utolsó 7 vagy 14 nap naplóit, és kiszűröd kizárólag a Googlebot, Bingbot, YandexBot és más fontos botok user-agent-jeit. Ezt követően készíthetsz pivot táblákat az URL, az állapotkód és a dátum mezők alapján. A cél az első elemzés során nem egy tökéletes adattárház felépítése, hanem a legnagyobb SEO-veszteségek gyors áttekintése.
A szervernapló-fájl elemzése lépésről lépésre
1. Határozd meg az elemzés célját
Először tisztázd, mit szeretnél megtudni. Az újonnan közzétett tartalmak nem indexelődnek? A kategóriaoldalak nincsenek eléggé letapogatva? A szerverhibák befolyásolják az organikus láthatóságot? Ha a célod világos, a naplófájlban keresendő jelek is egyértelművé válnak. Például indexelési probléma esetén azt vizsgáljuk, hogy a fontos URL-eket a Googlebot az utolsó hány napban pásztázta; teljesítményprobléma esetén az 5xx kódokat és a válaszidőket elemezzük.
2. Válaszd ki a megfelelő időintervallumot
A túl rövid intervallumok félrevezetőek lehetnek, a túl hosszúak pedig feleslegesen növelik a fájlméretet. Kis és közepes méretű webhelyek esetében 14-30 nap jó kiindulópont. A gyorsan frissülő struktúráknál, mint a híroldalak, már a 3-7 napos időszakok is értelmezhetőek. Nagy e-kereskedelmi oldalaknál a szezont, a kampányokat és a kategóriafrissítéseket külön címkézni kell.
3. Szűrd ki a botforgalmat
A user-agent mezőben különítsd el az olyan botokat, mint a Googlebot, Googlebot-Image, Googlebot-News, Bingbot, YandexBot, DuckDuckBot, Applebot. A kritikus riportoknál azonban ne feledkezz meg a valódi botok ellenőrzéséről. A mobil elsődleges indexelés (mobile-first indexing) miatt a Googlebot Smartphone kéréseket külön is nyomon kell követni. Ha az asztali bot nagyon aktívnak, a mobil bot viszont passzívnak tűnik, az konfigurációs vagy hozzáférési problémákra utalhat.
4. Hozz létre URL-csoportokat
Az egyedi URL-ek elemzése nagy webhelyek esetében nem hatékony. Kategorizáld az URL-eket sablonok szerint: főoldal, kategória, termék, blog, címke, szűrő, keresés, lapozás, kép, API, statikus fájl. Így láthatod, hogy a botok a webhely mely részeire helyezik a hangsúlyt. Ha például egy e-kereskedelmi oldalon a Googlebot kéréseinek 42%-a szűrt URL-ekre, 18%-a pedig termékoldalakra irányul, akkor priorizálási probléma állhat fenn.
5. Értékeld az állapotkódokat
A SEO naplóelemzésben az állapotkódok az egyik fő mutatót jelentik. A 200-as kód sikeres hozzáférést, a 301-es végleges átirányítást, a 302-es ideiglenes átirányítást, a 304-es "nem módosult" választ, a 404-es "nem található" hibát, a 410-es végleges eltávolítást, a 429-es "túl sok kérés" állapotot, az 5xx-es kódok pedig szerverhibákat jeleznek. A cél az, hogy a fontos oldalak lehetőleg közvetlenül 200-as kóddal térjenek vissza, és a botok ne vesztegessék az időt hibákra vagy felesleges átirányítási láncokra.
6. Mérd a válaszidőt és a szerverterhelést
Ha a naplóformátumod tartalmazza a válaszidőt, vizsgáld meg a botkérések átlagos és 95. percentilis értékeit. A 180 ms-os átlag jónak tűnhet, de ha a 95. percentilis értéke 2 800 ms, az azt jelenti, hogy bizonyos URL-típusok lassíthatják a botokat. Különösen a szűrt kategóriaoldalakat, a webhelyen belüli kereséseket, a dinamikus riportokat és a nagy adatbázis-lekérdezéseket futtató oldalakat kell alaposan megvizsgálni. Ha teljesítményproblémákat tapasztalsz, érdemes megfontolnod a Hostragons Felhő Szerver opciókat a nagyobb erőforrásokért.
A SEO szempontjából legkritikusabb naplóelemzési megállapítások
A feltérképezési keret pazarlása
A feltérképezési keret pazarlása azt jelenti, hogy a botok a szükségesnél több időt töltenek nem fontos URL-eken. A paraméteres URL-ek, a rendezési szűrők, a munkamenet-azonosítók, a nyomtatási oldalak, a végtelen naptárarchívumok és a webhelyen belüli keresési eredmények a leggyakoribb források. Ha a naplóelemzés során azt látod, hogy ezek az URL-ek magas arányt képviselnek, vizsgáld felül együttesen a canonical, robots.txt, noindex, paraméter-egyszerűsítési és belső linkelési lehetőségeket.
A fontos oldalak alacsony pásztázási gyakorisága
Néha a probléma nem az, hogy a botok túl sokat pásztáznak, hanem hogy rossz helyeket pásztáznak. Az új termékoldalakat, a magas konverziós potenciállal rendelkező landing oldalakat vagy a frissített útmutató tartalmakat nem biztos, hogy kellőképpen felkeresik. Ennek oka lehet a gyenge belső linkelés, a webhelytérkép (sitemap) elavultsága, az alacsony webhelysebesség vagy az, hogy az URL túl mélyen helyezkedik el az architektúrában. Ebben az esetben frissítsd az XML-webhelytérképet, adj belső linkeket a fő kategóriából és a kapcsolódó tartalmakból, azonosítsd az árva oldalakat, és csökkentsd az URL-mélységet. Ha a domain név és a projektstruktúra tervezési fázisában vagy, a Domain Ellenőrzés segítségével máris egy márkakompatibilis kezdést valósíthatsz meg.
Átirányítási láncok
A naplókban gyakori, hogy a botok a /regi-url címről a /koztes-url címre, onnan pedig a /uj-url címre irányítódnak. Ezek a láncok rontják a felhasználói élményt és a botok hatékonyságát. Az ideális struktúra az, ha a régi URL közvetlenül 301-es átirányítással mutat a végső URL-re. Nagy webhelyköltöztetési projektek során a régi átirányítási szabályok felhalmozódhatnak és láncot alkothatnak. A havi naplóellenőrzés korán felfedi ezeket a láncokat.
5xx hibák és ingadozó elérhetőség
Ha a keresőmotor-botok gyakran találkoznak 500-as, 502-es, 503-as vagy 504-es hibával a webhelyeden, csökkenthetik a pásztázás gyakoriságát. Ez különösen kampányidőszakokban befolyásolhatja az organikus teljesítményt. A naplókban vizsgáld meg az 5xx hibák időpontját, URL-típusát és a bot típusát. Ha például minden éjjel 02:00-kor a biztonsági mentés ideje alatt megszaporodnak az 503-as hibák, akkor a karbantartási ablakot, az erőforrás-tervezést vagy a gyorsítótár (cache) stratégiát módosítani kell.
A robots.txt, a webhelytérkép és a naplóadatok együttes értelmezése
A naplóelemzés önmagában is hatékony, azonban a robots.txt-vel, az XML-webhelytérképpel és a Google Search Console adataival együtt olvasva sokkal több értelmet nyer. Hasonlítsd össze, hogy a webhelytérképen szereplő URL-eket a bot letapogatja-e. Találd meg a webhelytérképen nem szereplő, de gyakran pásztázott URL-eket. Ellenőrizd, hogy a robots.txt által letiltott területekre érkeznek-e botkérések. Ha a letiltott URL-ek továbbra is megjelennek a keresési eredményekben, a robots.txt önmagában nem biztos, hogy elegendő; szükség lehet noindexre vagy eltávolítási stratégiára.
Jó gyakorlat, ha havonta három listát készítesz: a webhelytérképen szereplő, de nem pásztázott fontos URL-ek; a webhelytérképen nem szereplő, de gyakran pásztázott alacsony értékű URL-ek; valamint a hibakódot visszaadó botkérések. Ez a három lista képezi a technikai SEO ütemterved alapját.
Milyen metrikák szerepeljenek a naplóelemzési riportban?
Egy kezelhető riport érdekében ahelyett, hogy túl sok metrikába fulladnánk, a cselekvésre ösztönző mutatókat kell kiválasztani. Az alábbi metrikák a legtöbb webhely számára elegendő kiindulási készletet jelentenek:
- Összes botkérés és botok szerinti megoszlás
- Googlebot Smartphone és Desktop arány
- Állapotkód megoszlás: 200, 3xx, 4xx, 5xx
- URL-típus szerinti pásztázási arány
- A legtöbbet pásztázott első 100 URL
- Egyáltalán nem vagy alig pásztázott fontos URL-ek
- Átlagos és 95. percentilis válaszidő
- A leggyakoribb 404-es és 5xx-es hibát adó URL-ek
- Paraméteres URL-ek kérési aránya
- Hamis bot vagy gyanús user-agent lista
A riportot heti vagy havi összehasonlításban készítsd el. Ha például januárban az 5xx arány 1,8% volt, februárban pedig 0,2%-ra csökkent, azzal bizonyítottad az elvégzett infrastrukturális fejlesztés hatását. Hasonlóképpen, ha a blogtartalmakra érkező Googlebot kérések 35%-kal nőttek az új belső linkelés után, a tartalmi architektúrával kapcsolatos döntésedet adatokkal támasztottad alá.
Alkalmazható példa: 30 napos naplóelemzési forgatókönyv
Képzeljük el, hogy egy technológiai blog utolsó 30 napos hozzáférési naplóját (access log) elemezzük. Az összesen 320 000 kérésen belül 48 000 keresőmotor-bot kérést azonosítottak. A Googlebot kérések száma 39 500, a Bingbot kéréseké 5 200, az egyéb botoké pedig 3 300 volt. Az állapotkódok megoszlásában a 200-as válaszok aránya 78%, a 301-eseké 11%, a 404-eseké 7%, az 5xx-eseké 1,5%, az egyéb válaszoké pedig 2,5% volt.
Az URL-csoportosítás elvégzésekor kiderült, hogy a Googlebot kéréseinek 28%-a címkeoldalakra, 22%-a régi archívumokra, 19%-a blogbejegyzésekre, 8%-a kategóriaoldalakra, a fennmaradó rész pedig képekre és statikus fájlokra irányult. A webhely organikus forgalmi célja azonban a friss útmutató cikkek és a kategóriacsoportok voltak. Intézkedésként az alacsony értékű címkeoldalak noindexet kaptak, az archív oldalakra mutató belső linkeket csökkentették, a friss útmutató tartalmakat a főoldalról és a kapcsolódó kategóriákból linkelték, a webhelytérképet pedig csak az indexelni kívánt URL-ekkel egyszerűsítették.
A következő 30 napban a Googlebot blogbejegyzésekre fordított kéréseinek aránya 19%-ról 34%-ra, a kategóriaoldalakra fordított arány 8%-ról 14%-ra nőtt. A 404-es arány a régi URL-átirányításoknak köszönhetően 7%-ról 2,1%-ra csökkent. Ez a példa azt mutatja, hogy a naplóelemzés nem csupán egy technikai riport, hanem egy közvetlenül az organikus növekedési stratégiát támogató döntési mechanizmus.
Gyakori hibák
A naplóelemzés során a leggyakoribb hiba a user-agent információ vakon való elfogadása. Ha a hamis botokat nem vesszük figyelembe, a riportok félrevezetőek lesznek. A második hiba, hogy minden URL-t azonos értékűként kezelünk. Egy adatvédelmi irányelvek oldal alacsony pásztázási gyakorisága nem ugyanolyan hatású, mint egy fő kategóriaoldalé. A harmadik hiba, hogy egyetlen nap adataiból vonunk le nagy következtetéseket. A botok viselkedése napról napra változhat, ezért értelmezhető időszakokat kell választani.
A negyedik hiba azt gondolni, hogy a robots.txt minden problémát megold. A robots.txt korlátozhatja a pásztázást, de az indexelés kezeléséhez nem mindig elegendő. Az ötödik hiba pedig az, hogy a megállapításokat nem fordítjuk le cselekvésre. Ha a naplóelemzés eredményeként nem születnek döntések az átirányításokról, a belső linkelésről, a webhelytérképről, a canonicalokról, a teljesítményről és a biztonságról, a riport csupán egy fájláttekintés marad.
Biztonsági és adatvédelmi szempontok
Mivel a naplófájlok IP-címet és kérési információkat tartalmaznak, körültekintően kell tárolni őket. Ne oszd meg illetéktelen személyekkel, az elemzéshez letöltött fájlokat ne tárold feleslegesen hosszú ideig személyi számítógépeken, és ha lehetséges, alkalmazz maszkolást. Vállalati projektekben a naplók megőrzési idejének összhangban kell lennie a GDPR-nek és a vállalati irányelveknek megfelelő szabályozásokkal. Továbbá, ha a naplófájlokban tokenek, munkamenet-paraméterek vagy érzékeny query string információk láthatók, az alkalmazás oldalán felül kell vizsgálni a naplózási házirendet.
Biztonsági szempontból a naplók nemcsak a SEO, hanem a támadások észlelése szempontjából is értékesek. A hirtelen megnövekvő 404-es próbálkozások, az adminisztrációs panel pásztázása, a szokatlan POST kérések vagy bizonyos IP-blokkokból érkező intenzív forgalom biztonsági riasztást jelenthetnek. Ezért előnyös, ha a SEO- és a rendszerüzemeltetési csapatok közösen értékelik a naplóadatokat.
Összegzés: A naplóelemzés a SEO valós adatrétege
A keresőmotor-botok nyomon követése a szervernapló-fájlok elemzésével csökkenti a találgatáson alapuló döntéseket a technikai SEO-ban, és láthatóvá teszi a valós pásztázási viselkedést. A naplóknak köszönhetően mérheted, hogy mely URL-ek részesülnek előnyben, mely hibák fárasztják a botokat, mikor küzd a szerver, és hol vész kárba a feltérképezési keret. A rendszeres elemzés különösen a növekvő webhelyek esetében erőteljes szokás az indexelési minőség és az organikus láthatóság megőrzéséhez.
Egy gyors kezdéshez töltsd le az utolsó 14 nap hozzáférési naplófájlját, szűrd ki a valódi Googlebot kéréseket, és nyerd ki az állapotkódokat és az URL-csoportokat. Ha a megállapításaid teljesítmény-, biztonsági vagy erőforrásigényre utalnak, az infrastruktúrád felülvizsgálata jó lépés lehet. A Hostragons hosting, VPS, felhő szerver, domain és SSL megoldásaival megerősítheted webhelyed technikai alapjait, és a naplóelemzésből származó fejlesztéseket egy stabilabb környezetben valósíthatod meg.
Gyakran Ismételt Kérdések
Miben különbözik a szervernapló-fájl a Google Search Console-tól a SEO szempontjából?
A Google Search Console összegző és Google-központú adatokat kínál, míg a szervernapló-fájl a szerveredre érkező valós kéréseket mutatja URL, idő, IP, user-agent és állapotkód szinten. Ezért a naplóelemzés egy nyersebb, részletesebb és ellenőrizhetőbb adatforrás.
Hány napnyi adat elegendő a naplóelemzéshez?
A legtöbb webhely számára 14-30 napnyi naplóadat jó kiindulópont. Híroldalak vagy nagyon gyakran frissülő projektek esetében már 3-7 nap elemzése is értelmezhető lehet. A szezonális forgalmú webhelyeknél a kampányidőszakokat külön kell vizsgálni.
Hogyan állapíthatom meg, hogy a Googlebot valódi-e?
Ne bízz meg kizárólag a user-agent információban. Végezz fordított DNS-ellenőrzést az IP-címre, ellenőrizd, hogy a kapott domain név a googlebot.com vagy google.com végződésű-e, majd oldd fel ezt a domain nevet újra ugyanarra az IP-címre. Ha egyezés van, a bot nagy valószínűséggel valódi.
A 404-es hibák mindig SEO-problémát jelentenek?
Nem minden 404-es hiba probléma; az eltávolított vagy soha nem létezett oldalak esetében ez természetes lehet. Azonban a fontos belső linkekből érkező, backlinkkel rendelkező vagy a Googlebot által gyakran pásztázott 404-es URL-ek pazarolhatják a feltérképezési keretet. Ezeknél az URL-eknél megfelelő átirányítási vagy 410-es stratégiát kell fontolóra venni.
Milyen gyakran kell naplóelemzést végezni?
Kis webhelyek esetében a havi elemzés elegendő lehet. Nagy e-kereskedelmi, hír- és nagy forgalmú projekteknél heti, sőt kritikus időszakokban akár napi nyomon követés javasolt. Webhelyköltöztetés, infrastrukturális változás vagy nagy tartalomfrissítések után mindenképpen el kell végezni a naplóellenőrzést.