Vodiči

Analiza strežnih logov za sledenje botom iskalnikov

  • 17 min branja
  • Ekipa Hostragons
Analiza strežnih logov za sledenje botom iskalnikov

Analiza strežnih logov za sledenje botom iskalnikov, kot so Googlebot, Bingbot in drugimi brskalniki, je najbolj zanesljiv način, da vidite, katere URL-je obiskujejo na vaši spletni strani, kako pogosto, s katerimi statusnimi kodami in katero porabo virov. Medtem ko orodja za SEO ponujajo ocene, strežni logi neposredno prikazujejo dejanske zahteve, ki jih je vaš strežnik zabeležil; tako lahko jasno izmerite izgubo proračuna za indeksiranje, napake 404/500, verige preusmeritev, nepotrebne URL-je s parametri in ali so pomembne strani dovolj obiskane s strani botov.

Tehnična SEO dela se pogosto osredotočajo na vidne elemente, kot so optimizacija na strani, hitrost, strukturirani podatki in povratne povezave. Vendar pa je za razumevanje, kako iskalnik vidi vašo stran, potrebno preučiti obnašanje botov. Najbolj surov in zanesljiv vir bot obnašanja so dostopni dnevniški zapisi, znani kot access log. Še posebej za velike e-trgovine, novinarske portale, SaaS projekte, večjezične spletne strani in bloge z pogosto vsebino je analiza logov ključnega pomena pri reševanju težav z indeksiranjem.

V tem priročniku bomo korak za korakom obravnavali, kje se nahajajo strežni logi, katere podatke je treba prebrati, kako razlikovati prave iskalniške bote od lažnih botov, katere metrike je treba spremljati z vidika SEO in kako pretvoriti rezultate analize v dejanja, vse to s praktičnim in uporabnim pristopom za blog Hostragons. Če potrebujete zanesljivo gostiteljsko infrastrukturo za redno analizo logov na svoji strani, lahko razmislite o možnostih Hostragons spletno gostovanje in Hostragons VPS strežnik za projekte z velikim prometom.

Kaj je strežni log in zakaj je pomemben za SEO?

Strežni log je dnevniška datoteka, v katero so zabeležene vse zahteve, ki jih prejme vaš spletni strežnik. Ko uporabnik odpre vašo domačo stran, ko Googlebot indeksira stran kategorije ali ko varnostni skener pošlje zahtevo na vašo stran, se ta dogodek zabeleži v dnevniku. Običajno vsebuje informacije, kot so datum, čas, IP naslov, zahtevani URL, HTTP metoda, statusna koda, velikost odgovora, user-agent in včasih čas odziva.

Z vidika SEO so logi pomembni, ker neposredno prikazujejo, kako iskalniki indeksirajo vašo stran. Google Search Console vam ponuja statistiko indeksiranja; vendar pa ne daje vedno podrobnih informacij o vsaki zahtevi na ravni URL, vseh botih in trenutnih napakah na vašem strežniku. Z analizo logov lahko na primer vidite, da je Googlebot v zadnjih 7 dneh izvedel 12.400 zahtev, od katerih je 18 % šlo na 301 preusmeritev, 6 % na napako 404, 2 % na napako 500, in da je bilo pomembne strani vaših izdelkov indeksirane le v 9 % primerov.

Te podatke je še posebej koristno imeti za upravljanje proračuna za indeksiranje. Proračun za indeksiranje lahko razumemo kot količino URL-jev, ki jih lahko iskalniški bot v določenem časovnem obdobju indeksira na vaši spletni strani. Če je preveč nepotrebnih filtrov, paginacij, rezultatov iskanja, URL-jev s parametri ali napačnih preusmeritev, lahko botom zmanjka časa za vredne strani. Logi to izgubo dokazujejo z dokazili.

Na katera vprašanja je treba odgovoriti pri sledenju botom iskalnikov?

Uspešna analiza logov ni le odpiranje datoteke in branje vrstic. Najprej je treba postaviti prava vprašanja. Tehnične SEO ekipe običajno iščejo odgovore na naslednja vprašanja:

  • Katere skupine URL-jev Googlebot najbolj pogosto indeksira?
  • Ali so pomembne strani dovolj obiskane?
  • Kakšen delež indeksirajo zahteve s statusnimi kodami 200, 301, 302, 404, 410 ali 5xx?
  • Ali botom še vedno uspeva pošiljati zahteve na območja, ki jih blokira robots.txt?
  • Ali URL-ji s parametri, podvojeni ali nizko vredni URL-ji porabljajo proračun za indeksiranje?
  • Ali obstajajo razlike v obnašanju mobilnega Googlebota in namiznega Googlebota?
  • Ali časi odziva strežnika upočasnjujejo indeksiranje botov?
  • Ali lažni boti delujejo kot Googlebot in porabljajo vire?

Vsako od teh vprašanj lahko neposredno vodi do ukrepov. Na primer, če opazite, da Googlebot pogosto indeksira stare URL-je kampanj kot 404, lahko te URL-je preusmerite na ustrezno kategorijo z 301 ali uporabite statusno kodo 410, če so bile trajno odstranjene. Če 30 % botov gre na rezultate iskanja na vaši strani, boste morda morali ponovno oblikovati robots.txt, kanonikalne oznake, noindex ali upravljanje URL-jev s parametri.

Kje se nahajajo logi?

Lokacija logov se razlikuje glede na vrsto gostovanja, nadzorni panel in spletni strežnik, ki ga uporabljate. Na spletnih straneh, ki uporabljajo skupno gostovanje, lahko dostopne zapise običajno najdete v cPanelu, Plesku ali v razdelku statistik in surovih dostopnih dnevnikov v nadzornem panelu. Pri projektih, ki uporabljajo VPS ali namenski strežnik, pa se do logov dostopa preko SSH.

Pogoste lokacije dnevnikov Apache in Nginx

Na strežnikih, ki temeljijo na Linuxu, je pogosta pot do dostopnega dnevnika za Apache /var/log/apache2/access.log ali /var/log/httpd/access_log. Na strežnikih, ki uporabljajo Nginx, je pogosta lokacija /var/log/nginx/access.log. V konfiguracijah virtualnih gostiteljev, specifičnih za domeno, se lahko za vsako spletno mesto vodi ločen dnevnik. To povečuje natančnost analize v večstranskih strukturah.

Primer vrstice iz dnevnika lahko vsebuje naslednje informacije: 66.249.66.1 - - [12/Mar/2026:10:15:22 +0300] GET /blog/tehnicni-seo HTTP/2.0 200 18432 Googlebot/2.1. Iz te vrstice lahko preberete IP naslov, čas zahteve, URL, statusno kodo, velikost odgovora in user-agent informacije. Če vaš format dnevnika vsebuje tudi čas odziva, boste imeli močnejši niz podatkov za analizo zmogljivosti.

Pridobivanje logov iz nadzorne plošče

Za uporabnike z omejenim tehničnim znanjem je prenos logov iz nadzorne plošče najpraktičnejši način. V nadzorni plošči lahko iščete razdelke, kot so dostopni logi, surovi logi, obiski ali spletne statistike. Velike spletne strani lahko vsebujejo dnevne log datoteke, ki vsebujejo na desetine tisoč vrstic; zato je učinkoviteje prenesti datoteke v stisnjeni obliki in jih analizirati. Za redni dostop, varno varnostno kopiranje in spremljanje zmogljivosti lahko rešitve, kot je Hostragons cPanel gostovanje, pospešijo vaše delo.

Pomembna področja v vrstici dnevnika za SEO

Vsaka vrstica dnevnika nima enake vrednosti. Za SEO je treba najprej osredotočiti na nekatera področja. IP naslov se uporablja za potrditev, ali je bot pravi ali ne. Datum in čas omogočata merjenje intenzivnosti indeksiranja na dnevni in urni ravni. HTTP metoda bi morala biti običajno GET; nenavadni POST zahtevki se lahko preučujejo z vidika varnosti. Zahtevani URL prikazuje, katera stran je bila indeksirana. Statusna koda izraža dostopnost strani. User-agent vam pomaga razumeti identiteto bota, ki je poslal zahtevo. Če je na voljo tudi čas odziva ali time taken, je to zelo dragoceno z vidika izkušnje bota in obremenitve strežnika.

Na primer, recimo, da je v zadnjih 30 dneh bilo 50.000 zahtev Googlebota. Od teh je 38.000 imelo status 200, 7.500 status 301, 2.000 status 404, 1.200 status 304, 800 status 5xx in 500 status 302, kar jasno kaže na težavo: stopnja preusmeritev in napak znaša več kot 20 %. Tehnični SEO cilj je približati 5xx napake ničli, zmanjšati 404 na smiselne ravni in zmanjšati nepotrebne preusmeritve.

Kako razlikovati pravi Googlebot od lažnega bota?

User-agent sam po sebi ni zanesljiv. Zlonamerni brskalniki se lahko predstavljajo kot Googlebot. Zato je treba za potrditev resničnih iskalniških botov opraviti obratno DNS in napredno DNS preverjanje. Metoda, ki jo priporoča Google, vključuje obratno pretvorbo IP naslova v ime gostitelja, nato pa je treba preveriti, ali se ime gostitelja konča z googlebot.com ali google.com, in nato še enkrat rešiti ime gostitelja na isti IP.

Pozornejši postopek je sledeč: V dnevniku vzemite IP naslov z informacijami user-agent Googlebota. V terminalu izvedite obratno DNS poizvedbo z ukazom host 66.249.66.1 ali nslookup 66.249.66.1. Če je pridobljeno ime domene, na primer crawl-66-249-66-1.googlebot.com, zanesljivo Google ime, preidite na drugi korak. To ime domene ponovno rešite na IP. Če se rezultat ujema s prvim IP, je verjetnost, da je bot resničen, visoka. Če se ne ujema ali se prikaže nepovezana domena, ga je treba obravnavati kot lažnega bota.

To preverjanje je še posebej pomembno za ločevanje botov, ki porabijo veliko virov. Lažni Googleboti lahko porabijo strežniške vire, pregledujejo varnostne luknje ali kopirajo vsebino. Ko zaznate tovrstni promet, se lahko aktivirajo pravila WAF, omejitve hitrosti, blokiranje IP ali pravila požarnega zidu. Za konfiguracijo HTTPS in varne povezave si lahko ogledate Hostragons SSL Sertifikati stran.

Orodja za analizo logov

Za analizo logov ni enega samega pravega orodja. Odvisno od obsega spletne strani, izkušenj tehnične ekipe in proračuna se lahko izberejo različne metode. Za manjše spletne strani so lahko Excel, Google Sheets ali preprosti filtri ukazne vrstice dovolj. Za srednje velike spletne strani so bolj učinkoviti Screaming Frog Log File Analyser, GoAccess ali Python skripte. V korporativnih nastavitvah se lahko uporabljajo rešitve, kot so Elasticsearch, Logstash, Kibana, BigQuery ali SIEM.

Orodja za analizo logov
MetodaNajboljša uporabaPrednostOmejitev
Excel ali SheetsMajhni blogi, nizki prometEnostavno se naučite, hitro filtriraPri velikih datotekah je lahko počasno in naleti na omejitve vrstic
Ukazna vrsticaTehnični uporabniki, VPS strežnikiHitro, brezplačno, primerno za avtomatizacijoZahteva znanje ukazov za Linux
Orodja za analizo logov SEOSrednje velike in velike straniBot, URL in poročila o statusnih kodah so že na voljoStroški licence so lahko
ELK ali BigQueryKorporativne in visoko prometne straniRealnočasovno, razširljivo in podrobnoNamestitev in vzdrževanje zahtevata strokovno znanje

Za praktičen začetek je dovolj, da prenesete zadnje 7 ali 14 dnevnih logov in filtrirate samo realne zahteve Googlebota, Bingbota, YandexBota in drugih pomembnih botov. Nato lahko ustvarite pivot tabele glede na URL, statusno kodo in datum. Cilj ni postaviti popoln skladišče podatkov v prvi analizi, temveč hitro ujeti največje izgube SEO.

Korak za korakom analiza strežnih logov

1. Določite cilj analize

Najprej razjasnite, kaj želite izvedeti. Ali nove objavljene vsebine niso indeksirane? Ali strani kategorij niso dovolj indeksirane? Ali strežne napake vplivajo na organsko vidnost? Če je vaš cilj jasen, so tudi signali, ki jih boste iskali v dnevniku, jasni. Na primer, za težave z indeksiranjem je treba preveriti, koliko pomembnih URL-jev je Googlebot indeksiral v zadnjih dneh; za težave z zmogljivostjo se preverjajo 5xx kode in časi odziva.

2. Izberite pravilen časovni okvir

Prekratki časovni okviri so lahko zavajajoči; predolgi pa nepotrebno povečujejo velikost datoteke. Za majhne in srednje velike strani je 14 do 30 dni dober začetek. Pri novinarskih straneh, ki se hitro posodabljajo, so lahko tudi 3 do 7-dnevni časovni okviri smiselni. Velike e-trgovine morajo dodatno označiti sezono, kampanje in posodobitve kategorij.

3. Filtrirajte promet botov

V polju user-agent ločite Googlebot, Googlebot-Image, Googlebot-News, Bingbot, YandexBot, DuckDuckBot, Applebot in druge bote. Vendar ne pozabite na preverjanje resničnosti botov pri ključnih poročilih. Zaradi prednostnega indeksiranja mobilnih naprav je treba posebej spremljati zahteve mobilnega Googlebota. Če je namizni bot zelo aktiven, mobilni bot pa pasiven, bi lahko obstajale težave pri konfiguraciji ali dostopu.

4. Ustvarite skupine URL-jev

Analiza posameznih URL-jev je pri velikih spletnih straneh neučinkovita. URL-je razdelite na predloge: domača stran, kategorija, izdelek, blog, oznaka, filter, iskanje, paginacija, slika, API, statična datoteka in druge. Tako lahko vidite, v katere dele spletne strani so botu najbolj usmerili pozornost. Na primer, če 42 % zahtev Googlebota na e-trgovini gre na URL-je s filtri in le 18 % na strani izdelkov, to lahko kaže na težave s prioritizacijo.

5. Ocenite statusne kode

Statusne kode so eden glavnih kazalnikov pri analizi logov za SEO. Status 200 pomeni uspešen dostop, 301 pomeni trajno preusmeritev, 302 začasno preusmeritev, 304 ni se spremenilo, 404 ni najdeno, 410 trajno odstranjeno, 429 preveč zahtev in 5xx napake strežnika. Cilj je, da se pomembne strani čim bolj pogosto vrnejo s statusom 200 in da botom ne zmanjka časa zaradi napak ali nepotrebnih verig preusmeritev.

6. Merite čas odziva in obremenitev strežnika

Če vaš format dnevnika vsebuje čas odziva, preučite povprečne in 95. percentilne čase za zahteve botov. Povprečni 180 ms se morda zdi dober; vendar, če 95. percentil znaša 2.800 ms, lahko to pomeni, da nekatere vrste URL-jev upočasnjujejo bot. Še posebej je treba previdno preučiti strani s filtri, iskanjem po strani, dinamičnimi poročili in težkimi poizvedbami v bazi podatkov. Če imate težave z zmogljivostjo, lahko razmislite o močnejših virih, kot so Hostragons oblačni strežnik.

Najpomembnejše ugotovitve analize logov z vidika SEO

Izguba proračuna za indeksiranje

Izguba proračuna za indeksiranje se zgodi, ko botom namenimo preveč časa na nepomembne URL-je. URL-ji s parametri, filtri razvrščanja, ID-ji sej, strani za tiskanje, neskončni arhivi koledarjev in rezultati iskanja na spletni strani so najpogostejši viri. Če v analizi logov vidite, da ti URL-ji predstavljajo visok delež, razmislite o skupni uporabi možnosti kanonikalnega, robots.txt, noindex, poenostavitve parametrov in prestrukturiranja notranjih povezav.

Nizko indeksiranje pomembnih strani

Včasih težava ni prevelika indeksacija botov, temveč napačna indeksacija. Nove strani izdelkov, strani z visokim potencialom konverzije ali posodobljena vsebina vodilnih člankov morda ne prejemajo dovolj obiskov. Razlogi za to so lahko slaba notranja povezava, zastareli zemljevid spletnega mesta, nizka hitrost spletne strani ali globoka struktura URL. V tem primeru posodobite XML zemljevid spletnega mesta, zagotovite notranje povezave iz glavnih kategorij in povezanih vsebin, odkrijte osirotele strani ter zmanjšajte globino URL. Če ste v fazi načrtovanja domene in strukture projekta, lahko začnete z vprašanje domene, da zagotovite skladnost blagovne znamke.

Verige preusmeritev

Pogosto je videti, da se botom v dnevnikih preusmerja iz /stara-url na /iskalna-url in nato na /nova-url. Te verige zmanjšujejo uporabniško izkušnjo in učinkovitost botov. Idealen način je, da se stara URL neposredno preusmeri na končno URL z 301. Pri velikih projektih selitve spletnih strani se lahko stari pravila preusmeritev kopičijo in ustvarjajo verige. Mesečna kontrola logov lahko te verige ujame zgodaj.

5xx napake in nihajoča dostopnost

Če iskalniški boti pogosto naletijo na napake 500, 502, 503 ali 504 na vaši strani, lahko zmanjšajo pogostost indeksiranja. To lahko še posebej vpliva na organsko učinkovitost v časih kampanje. Preučite čas, tip URL in tip bota za 5xx napake v dnevniku. Na primer, če se vsako noč ob 02:00 poveča število napak 503 med varnostnimi kopijami, je treba reorganizirati čas vzdrževanja, načrtovati vire ali strategijo predpomnjenja.

Skupna analiza Robots.txt, Sitemap in Log podatkov

Analiza logov je močna sama po sebi; vendar pa postane še bolj smiselna, ko se prebere skupaj z robots.txt, XML zemljevidom spletnega mesta in podatki iz Google Search Console. Primerjajte, ali so URL-ji, ki so vključeni v zemljevid spletnega mesta, indeksirani s strani botov. Poiščite URL-je, ki niso v zemljevidu spletnega mesta, vendar so pogosto indeksirani. Preverite, ali botom uspeva pošiljati zahteve na območja, ki jih blokirate z robots.txt. Če se blokirani URL-ji še vedno prikazujejo v rezultatih iskanja, robots.txt morda ne bo dovolj; morda bo potrebna strategija noindex ali odstranitve.

Dobro prakso je, da vsak mesec ustvarite tri sezname: pomembne URL-je, ki so v zemljevidu spletnega mesta, vendar niso bili indeksirani, URL-je, ki niso v zemljevidu spletnega mesta, vendar so pogosto indeksirani, in zahteve botov, ki dajejo napake. Ti trije seznami predstavljajo osnovo vašega tehničnega SEO načrta.

Kateri kazalniki naj bodo vključeni v poročilo o analizi logov?

Za obvladljivo poročilo je treba izbrati kazalnike, ki ustvarjajo dejanja, namesto da bi se pretiravali s številnimi metričnimi podatki. Spodnji kazalniki so dovolj dober začetni paket za večino spletnih strani:

  • Skupno število zahtev botov in razdelitev med boti
  • Razmerje med Googlebot Smartphone in Desktop
  • Razdelitev statusnih kod: 200, 3xx, 4xx, 5xx
  • Delež indeksiranja glede na tip URL
  • Prvih 100 najbolj indeksiranih URL-jev
  • Pomembni URL-ji, ki sploh niso bili indeksirani ali so bili malo indeksirani
  • Povprečen in 95. percentilni čas odziva
  • Najpogostejši URL-ji, ki dajejo 404 in 5xx napake
  • Delež zahtev URL-jev s parametri
  • Seznam lažnih botov ali sumljivih user-agentov

Pripravite poročilo za primerjavo na tedenski ali mesečni ravni. Na primer, če je bila stopnja 5xx januarja 1,8 %, februarja pa se je zmanjšala na 0,2 %, ste dokazali učinek izboljšav infrastrukture. Enako velja, če so zahteve Googlebota za blog vsebine po novi notranji povezavi narasle za 35 %, kar podpira vašo odločitev o strukturi vsebine.

Praktičen primer: Scenarij analize logov za 30 dni

Predpostavimo, da je bil analiziran dostopni log na tehnološkem blogu za zadnjih 30 dni. Med skupno 320.000 zahtevami je bilo odkritih 48.000 zahtev iskalnih botov. Zahteve Googlebota so znašale 39.500, zahteve Bingbota 5.200, druge botov 3.300. Pri razdelitvi statusnih kod so bili: 200 - 78 %, 301 - 11 %, 404 - 7 %, 5xx - 1,5 % in druge - 2,5 %.

Ko so bile URL-je razvrščene, se je izkazalo, da je 28 % zahtev Googlebota šlo na strani oznak, 22 % na arhive z zgodovino, 19 % na blog objave, 8 % na strani kategorij, preostalo pa na slike in statične datoteke. Vendar je bil cilj organskega prometa spletne strani, da bi se osredotočili na aktualne vodnike in skupine kategorij. Kot ukrep so bile strani z nizko vrednostjo oznak označene z noindex, notranje povezave na arhivske strani so se zmanjšale, aktualne vodilne vsebine pa so bile povezane iz domače strani in ustreznih kategorij, zemljevid spletnega mesta pa je bil poenostavljen le na URL-je, ki jih je želelo indeksirati.

V naslednjih 30 dneh se je delež zahtev Googlebota za blog objave povečal s 19 % na 34 %, delež zahtev za strani kategorij pa s 8 % na 14 %. Stopnja 404 je z nekdanjimi URL preusmeritvami padla z 7 % na 2,1 %. Ta primer prikazuje, da analiza logov ni le tehnično poročilo, ampak tudi mehanizem za odločanje, ki neposredno podpira strategijo organskega rasti.

Pogoste napake

Najpogostejša napaka pri analizi logov je slepa vera v informacije user-agent. Če se lažni boti ne upoštevajo, so poročila lahko zavajajoča. Druga napaka je, da se vse URL-je obravnava enako. Nizko indeksiranje strani pravilnika o zasebnosti nima enakega vpliva kot nizko indeksiranje glavne strani kategorij. Tretja napaka je, da se iz enodnevnih podatkov izpeljejo veliki rezultati. Obnašanje botov se lahko spreminja glede na dneve; zato je treba izbrati smiselne časovne okvire.

Četrta napaka je prepričanje, da bo robots.txt rešil vse težave. Robots.txt lahko omeji indeksiranje; vendar pa morda nikoli ne zadostuje za upravljanje indeksov. Peta napaka je, da ugotovitve niso pretvorjene v dejanja. Če po analizi logov niso sprejeti ukrepi glede preusmeritev, notranjih povezav, zemljevida spletnega mesta, kanonikalov, zmogljivosti in varnosti, ostane poročilo le pregled datoteke.

Varnost in zasebnost: na kaj morate biti pozorni

Ker strežni logi vsebujejo IP naslove in informacije o zahtevah, jih je treba hraniti previdno. Ne smejo biti deljeni z nepooblaščenimi osebami, datoteke prenesene za analizo ne smejo ostati na osebnih računalnikih dlje časa, kot je potrebno, in kjer je to mogoče, je treba uporabiti maskiranje. V korporativnih projektih mora biti čas hranjenja logov v skladu z zakonom o varstvu osebnih podatkov in politikami podjetja. Poleg tega, če se v log datotekah pojavijo tokeni, parametri seje ali občutljive informacije o poizvedbah, je treba pregledati politiko zapisovanja na aplikacijski strani.

Z vidika varnosti so logi koristni ne le za SEO, ampak tudi za odkrivanje napadov. Nenaden porast poskusov napak 404, skeniranj nadzornih plošč, nenavadnih zahtev POST ali intenziven promet iz določenih IP blokov lahko sproži varnostne alarme. Zato je koristno, da SEO in sistemi za upravljanje analizirajo podatke logov skupaj.

Zaključek: analiza logov je realna plast podatkov SEO

Analiza strežnih logov za sledenje botom iskalnikov zmanjšuje napovedne odločitve v tehničnem SEO in razkriva dejansko obnašanje indeksiranja. S pomočjo logov lahko izmerite, katere URL-je so vredne, katere napake utrudijo bote, kdaj je strežnik pod pritiskom in kje se proračun za indeksiranje zapravi. Redna analiza je močna navada za ohranjanje kakovosti indeksiranja in organske vidnosti, zlasti pri rastočih spletnih straneh.

Za kratek začetek prenesite zadnje 14-dnevne dostopne loge, filtrirajte resnične zahteve Googlebota, ugotovite statusne kode in skupine URL-jev. Če vaši rezultati kažejo na težave z zmogljivostjo, varnostjo ali potrebnimi viri, je lahko pregled vaše infrastrukture dober korak. S pomočjo rešitev za gostovanje, VPS, oblačne strežnike, domene in SSL podjetja Hostragons lahko okrepite tehnično osnovo svojega spletnega mesta in izboljšave iz analize logov uvedete v bolj zdravem okolju.

Pogosto zastavljena vprašanja

Zakaj se strežni log razlikuje od podatkov Google Search Console za SEO?

Google Search Console ponuja povzetke in Google usmerjene podatke; strežni log pa prikazuje dejanske zahteve, ki prihajajo na vaš strežnik, na ravni URL, čas, IP, user-agent in statusno kodo. Zato je analiza logov bolj surov, podroben in preverljiv vir podatkov.

Koliko dnevnih podatkov je dovolj za analizo logov?

Za večino spletnih strani je 14 do 30 dni log podatkov dober začetek. Za novinarske strani ali zelo pogosto posodobljene projekte so lahko tudi 3 do 7 dni analize smiselni. Sezonski prometni spletni strani morajo še posebej pregledati obdobja kampanj.

Kako prepoznam, ali je Googlebot pravi?

Ne zanašajte se le na informacije user-agent. Opravite obratno DNS preverjanje za IP naslov, potrdite, da se konča z googlebot.com ali google.com, in ponovno rešite to ime domene na isti IP. Če se ujema, je bot verjetno pravi.

Ali so napake 404 vedno težava za SEO?

Ne vsaka napaka 404 je težava; to je lahko naravno za odstranjene ali nikoli neobstoječe strani. Vendar pa lahko 404 URL-ji, ki prihajajo iz pomembnih notranjih povezav, dobivajo povratne povezave ali se pogosto indeksirajo s strani Googlebota, zapravljajo proračun za indeksiranje. Za te URL-je je treba razmisliti o primerni preusmeritvi ali strategiji 410.

Kako pogosto naj se izvaja analiza logov?

Za manjše strani lahko mesečna analiza zadostuje. Pri velikih e-trgovinah, novinarskih in visoko prometnih projektih se priporoča tedensko, tudi dnevno v kritičnih obdobjih. Po selitvi spletne strani, spremembi infrastrukture ali velikih posodobitvah vsebine je treba obvezno izvesti kontrolo logov.

Delite to objavo:

Ekipa Hostragons

Aktualni vodniki naše strokovne ekipe o gostovanju, strežnikih in domenskih imenih. Skupaj poiščimo pravo rešitev za vaš projekt.

Kontaktirajte nas