የ ሰርቨር log (የቅድሚያ መዝገብ) ፋይሎችን በማንበብ የፍለጋ ሞተር ቦቶችን መከታተል፣ Googlebot፣ Bingbot እና ሌሎች ተመሳሳይ ቦቶች በድር ጣቢያዎ የተጎበኙት የURL ዝርዝሮች፣ በምን ደቂቃ፣ በምን የሁኔታ ኮድ፣ እና በምን የምድብ አውታረ ሃይል ተጠቅመው እንደተጎበኙ ማየት በጣም የታመነ መንገድ ነው። SEO መሳሪያዎች ትንታኔ ሲሰጡ፣ የሰርቨር log ፋይሎች በቀጥታ የሰርቨርዎ የጭነት ጥያቄዎችን ያሳያሉ፤ ይህንን በመሰረት የcrawl በጀት በዋስትና፣ 404/500 ስህተቶች፣ የredirect ሰንድሮች፣ አሳሳቢ የፋርማተር ያሉ URL ዝርዝሮች፣ እና ቦቶች በአስፈላጊ ገጾች በቂ ሁኔታ እንደተጎበኙ በግልጽ ሁኔታ ማስተካከል ይችላሉ።
የቴክኒክ SEO ሥራዎች ብዙ ጊዜ በገፅ ውስጥ ኦፕቲሚዜሽን፣ ፍጥነት፣ የተዋበ መረጃና በbacklink በማድረግ ተመሳሳይ የሚታዩ ቦታዎች ላይ ያተኮራሉ። ነገር ግን፣ የፍለጋ ሞተር ድር ጣቢያዎን እንዴት እንደሚያየው ለማረዳት የቦት አፈላላይነትን ማስተካከል ይገባዋል። የቦት አፈላላይነት በጥሩ እና ታመነ ምንጭ access log በተባለው የመድረሻ ቅድሚያ መዝገብ ነው። በተለይ ትልቅ የ e-commerce ጣቢያዎች፣ የዜና ፖርታሎች፣ SaaS ፕሮጀክቶች፣ ብዙ ቋንቋ ያሉ ድር ጣቢያዎች፣ እና በቅድሚያ የይዘት እንደሚያበሩ ብሎጎች ለ log ትንተና የአግባቡ ድር ጣቢያ አገልግሎት አሳያ ጠቃሚ አካል ይሆናሉ።
በዚህ መምሪያ Hostragons ብሎግ የሚገባ እና በተግባር የሚሰራ አካል በመድረሻ log ፋይሎች የሚገኙበት ቦታ፣ የሚያነበቡበት ቦታ፣ እውነተኛ የፍለጋ ሞተር ቦቶችን ከሐሰት ቦቶች እንዴት አካፋፉ፣ በSEO እንደምን የሚከታተሉ መትረክቶች፣ የትንተና ውጤቶቹን ለተግባር እንዴት ያዋል በእየነው ይጠብቃል። በድር ጣቢያዎ የቅድሚያ log ትንተና በቅድሚያ ማድረግ ከፈለጉ፣ ሆስትሮጎን ድር ማስተናገጃ የታመነ የhosting መስክን ይመለከቱ፣ ለትልቅ ትርፍ ያላቸው ፕሮጀክቶችም ሆስትሮጎኖች VPS አገልጋይ አማራጮችን ትክክለኛ ይመርምሩ።
ሰርቨር Log ፋይል ምንድነው? ለ SEO ለምን በጣም አስፈላጊ ነው?
ሰርቨር log ፋይል ወደ Hostragons የሚሰጡ ሁሉንም ጥያቄዎች የሚመዝገብ የዕለታዊ ፋይል ነው። ተጠቃሚው የአንተን ዋና ገፅ ሲከፍት፣ Googlebot የአንተን ምድብ ገጽ ሲመረምር፣ ወይም የደህንነት እውነተኛ ስርጭት በ WordPress ላይ ጥያቄ ሲሰጥ፣ እነዚህ ክስተቶች log ፋይሉ ውስጥ ይመዝገባሉ። ብዙ ጊዜ ቀን፣ ሰዓት፣ IP አድራሻ፣ የተጠየቀው URL፣ HTTP መቶድ፣ የሁኔታ ኮድ፣ የምላሽ መጠን፣ user-agent እና አንዳንዴ የምላሽ ጊዜ የሚያካትት ነው።
ለ SEO አነፃፃፀ ፣ log ፋይሎች አስፈላጊ ናቸው ምክንያቱም የመፈለጊያ ማሽኖች ስፍራዎን እንዴት እንደሚመረምሩ በቀጥታ ያሳያል። Google Search Console የተመረምሩ ስታቲስቲክስ ይሰጣል፤ ነገር ግን በ URL ደረጃ ሁሉንም ጥያቄ፣ ሁሉንም bot፣ እና በ Hostragons ሰርቨርዎ ላይ በቅርብ ጊዜ በሚከሰቱ ስህተቶች የበለጠ ዝርዝር ማቅረብ አይደለም። Log ትንተና በማድረግ፣ ለምሳሌ ባለፈው 7 ቀናት Googlebot 12,400 ጥያቄ አደረገ፣ እነዚህ ጥያቄዎች በ 18% 301 የማቅረም ማዕከል፣ በ 6% 404 ስህተት፣ በ 2% 500 ስህተት ሄደዋል፣ አስፈላጊ የእቃ ገፆችህ በ 9% ብቻ ተመረምሩ ብለህ ትወቃላችሁ።
እነዚህ ውሂቶች በተለይም ለ የምረምር በጀት አስተዳደር በጣም አስተዋዋቂ ናቸው። የምረምር በጀት ማለት፣ የመፈለጊያ bot በ Hostragons ላይ በተወሰነ የጊዜ ክልል ውስጥ የሚችሉትን URL መጠን ማስተዳደር ነው። ብዙ CDN፣ ውስጥ-ሊንክ፣ የተወሰኑ የፍለጋ ውጤቶች፣ መለያየት ያላቸው URL፣ የ DNS ስህተቶች ወይም የተጠናቀቀ የማቅረም ካለ፣ bot ከአስፈላጊ ገፆችህ LCP, CLS, TTFB የሚመርምሩበት ጊዜ ይቀንስ ይችላል። Log ፋይሎች ይህን በትክክል በማስረጃ ያሳያሉ።
የፍለጋ ሞተር ቦቶችን ሲከታተል የሚለው ጥያቄ ምንድነው?
ስኬታማ የሎግ ትንተና ማንኛውንም ፋይል ማብራሪያ ብቻ አይደለም። በመጀመሪያ ትክክለኛ ጥያቄዎችን መጠየቅ አስፈላጊ ነው። የቴክኒክ SEO ቡድኖች ብዙውን ጊዜ በሚከተሉት ጥያቄዎች መልስ ይፈልጋሉ፦
- Googlebot በጣም የሚቃኘው የURL ቡድኖች ውስጥ ምንድን ናቸው?
- አስፈላጊ ገፆች በቂ ሚና ይቀናበራሉ?
- የተቃኘው ትእዛዝ ከፍተኛ ደረጃ 200, 301, 302, 404, 410 ወይም 5xx የሁኔታ ኮድ ይቀበላሉ?
- ቦቶች robots.txt በተዘጋጀ ቦታዎች ላይ ጥያቄ መላክ ይቀጥላሉ?
- በፋይላት ፣ የተደጋጋሚ ወይም ዝቅተኛ ዋጋ ያላቸው URL ተቃኝ ቦጀት ይወጣሉ?
- በሞባይል Googlebot እና በዴስክቶፕ Googlebot አካል ውስጥ ፍላጎት አለ?
- የሰርቨር ምላሽ ጊዜ ቦቶችን በቃኝ ሂደት ይቀራሉ?
- የተዋሸ ቦቶች እንደ Googlebot ተዋም ተግባራት እየሰሩ ምንጭ ይበትናሉ?
እያንዳንዱ ከነዚህ ጥያቄዎች በቀጥታ ተግባር ሊደርስ ይችላል። ለምሳሌ Googlebot ብዙ የድሮ የካምፓኒያ URL የ404 እንደሚቃኘ ብቻ ቢያይ፣ እነዚህ URL ወደ ተያያዘ ምድብ በ301 ማዘዝ ወይም በቋሚ ስለተወገዱ 410 ኮድ ማቅረብ ይችላሉ። ቦቶች 30% የሲት ውስጥ የፍለጋ ውጤት ይደርሳሉ ብለው ቢያዩ፣ robots.txt፣ canonical፣ noindex ወይም URL parameter አስተዳደርን አዲስ አድርጉ ማለት ይሆናል።
ሎግ ፋይሎች የት አሉ?
ሎግ ፋይሎች የሚገኙበት ቦታ የሚጠቀሙት ሆስቲንግ አይነት፣ ኮንትሮል ፓነልና የድህረ መረብ ሰርቨርን በተመለከተ ይለያያል። በተካፋይ ሆስቲንግ ላይ ያሉ ድህረ ገፆች በዚህ ዓይነት ሆስቲንግ ፓነል ውስጥ ያሉ access logs፣ raw access logs እና የድህረ ገፅ ስታቲስቲክስ ቦታዎችን በመፈለግ ሎግ መዝገቦችን ማግኘት ይቻላል። VPS ወይም dedicated ሰርቨር ላይ ያሉ ፕሮጀክቶች ግን ሎግ ፋይሎችን በSSH መጠቀም ይደርሳሉ።
በApache እና Nginx ላይ የሚገኙ የሎግ ቦታዎች
በLinux መሠረት ያሉ ሰርቨሮች ላይ Apache አንደኛ የተለመዱ access log ቦታዎች /var/log/apache2/access.log ወይም /var/log/httpd/access_log ናቸው። በNginx የሚሰሩ ሰርቨሮች ላይ ግን /var/log/nginx/access.log ፋይሉ ተለመዶ ይገኛል። በየድህረ ገፅ virtual host እንደሚሰራ ማዋቀር ሆኖ ሎግ ፋይሎች በየስት ልዩ ልዩ ሊቀርበው ይችላል። ይህ በብዙ ስት የሚገኙ ድህረ ገፆች ላይ የትክክለኛ ትንተና ማድረግን ያሳድጋል።
ምሳሌ የሎግ መዝገብ መስመር እንዲሁ መረጃዎችን ሊያካትት ይችላል፡ 66.249.66.1 - - [12/Mar/2026:10:15:22 +0300] GET /blog/teknik-seo HTTP/2.0 200 18432 Googlebot/2.1። ከዚህ መስመር የIP አድራሻን፣ የትእዛዝ ጊዜን፣ URL፣ የሁኔታ ኮድን፣ የምላሽ መጠንን እና user-agent መረጃን ማንበብ ይቻላል። በሎግ format ውስጥ response time ከተካተተ የውጤት ትንተና ለማድረግ የበለጠ አስተማማኝ የውሃ ሰንደቅ ይኖረዋል።
ከHosting Panel ሎግ ፋይሎችን ማውረድ
ለቴክኒክ ማዕከል መረጃ የሚያውቁ ተጠቃሚዎች hosting panel የሎግ ፋይሎችን ማውረድ ቀላል የሆነ መንገድ ነው። በፓነል access logs፣ raw logs፣ visitors ወይም web statistics ያሉበትን ክፍሎች መፈለግ ይችላሉ። በትልቅ ድህረ ገፆች ላይ የዕለኛ ሎግ ፋይሎች በሚቆጠሩት ቦታ አስር ሺህ በላይ መስመሮችን ሊያካትት ይችላል፣ ስለዚህ ፋይሎቹን በተጠቃላይ ሁኔታ ማውረድና ማትከከል ይሻላል። በዘመናዊ መግለጫ፣ በማህበረሰብ በማስተናገድና በውጤት ትንተና ላይ Hostragons cPanel እንግዳ እንደዚህ ዓይነት የቀላል አስተዳደር መፍትሄዎች ስራውን ይፋጠናሉ።
Log ሰንደቅ ውስጥ SEO ለሚገባው ቦታዎች
በሁሉም log ሰንደቅ አንደኛ ዋጋ አይታየውም። SEO አሻሻይ ለማድረግ በተለይ በአንዳንድ ቦታዎች ማተኮር ያስፈልጋል። IP አድራሻ ፣ የbot እውነተኛ መሆኑን ለማረጋገጥ ይጠቅማል። ቀንና ሰዓት ፣ የተመረምረውን ጭነት በቀንና በሰዓት ለመለከት ይረዳል። HTTP መቶድ በተለምዶ GET መሆን አለበት፤ የተለመዱ ያልሆኑ POST ጥያቄዎች የደህንነት ምልክት ሊሆኑ ይችላሉ። የተጠየቀው URL ፣ የተመረምረውን ገፅ ያሳያል። የሁኔታ ኮድ ፣ የገፁ ልዩነትን ይገልጻል። User-agent ፣ ጥያቄውን የሚሰጠው bot ማን እንደሆነ የሚያሳውቅ አስተዋጽኦ ነው። የጥሪ ጊዜ ወይም time taken አካል ካለ፣ በbot ልምድና በሰርቨር ጭነት አደጋ አስተዋጽኦ ያለው ቦታ ነው።
ለምሳሌ፣ በአስተዋይ 30 ቀናት log ውስጥ 50,000 የGooglebot ጥያቄዎች ካሉ በሚታይ፣ ከእነዚህ 38,000 የ200 ፣ 7,500 የ301 ፣ 2,000 የ404 ፣ 1,200 የ304 ፣ 800 የ5xx እና 500 የ302 ኮዶች ከሆኑ፣ ችግሩ ግልጽ ነው፤ የredirect እና የስህተት መጠን አጠቃላይ በ20% በላይ ነው። የቴክኒክ SEO ዓላማ፣ 5xx ስህተቶችን በስተመጨረሻ ማስገደብ፣ 404 ኮዶችን በተገቢ ደረጃ ማስቀነስ እና ያልወሰኑ የredirect ጥያቄዎችን ማሳካት ነው።
እውነተኛ Googlebot ከውሸት Bot እንዴት ይለያያል?
User-agent ብቻ ተስፋ ማድረግ አይቻልም። ክፉ ዓላማ ያላቸው አሳሳቢዎች ራሳቸውን Googlebot እንደሆኑ ሊያሳዩ ይችላሉ። ስለዚህ እውነተኛ የውስጥ መፈለጊያ bot መረጃ ለማረጋገጥ በተቃራኒ DNS እና በፊት DNS ማረጋገጫ ማድረግ ይገባዋል። የGoogle ምክር የሚሰጠው ዘዴ የIP አድራሻውን በreverse DNS ወደ host ስም ማቀየር፣ የተወጣ host ስም googlebot.com ወይም google.com በሚል የሚያበቃ መሆኑን ማረጋገጥ እና ይህን host ስም አንድ ጊዜ ወደ ተመሳሳይ IP ማቅረብ ነው።
ምሳሌ ሂደት እንዲህ ነው፡ Log ውስጥ በGooglebot user-agent የመጣውን IP አድራሻ ይውሰዱ። በterminal host 66.249.66.1 ወይም nslookup 66.249.66.1 በማድረግ በተቃራኒ DNS ይጠይቁ። የሚወጣ domain ስም crawl-66-249-66-1.googlebot.com እንደ Google የታመነ domain ከሆነ ወደ ሁለተኛ ደረጃ ይውሰዱ። ይህ domain አንድ ጊዜ ወደ IP ይተረጉም። ውጤቱ ከመጀመሪያው IP ጋር ከተጣጠረ እውነተኛ bot መሆኑ የተወሰነ ነው። ከተጣጠረ ካልሆነ ወይም በሌላ domain ቢወጣ ውሸት bot ይቆጠራል።
ይህ ማረጋገጫ በተለይ ብዙ ሃብት የሚጠቀሙ bot ለማለያየት አስፈላጊ ነው። ውሸት Googlebot ማህደር ሃብቶችን ሊወጡ፣ የደህንነት ክፍተቶችን ሊያሳስቡ ወይም ይዘት ለመቅዳት ሊያገለግሉ ይችላሉ። እንደዚህ ያለውን ትራፊክ ሲያገኙ WAF, rate limit, IP መከልከል ወይም የደህንነት መደበኛ ደንቦችን ማሰራራት ይችላሉ። HTTPS እና የደህንነት ግንኙነት ለማዘጋጀት Hostragons SSL መድረክ ማህበረሰቦች ገፅን ይመልከቱ።
ለLog ትንተና ሚጠቀሙ የሚችሉ መሳሪያዎች
ለLog ትንተና አንድ ብቻ ትክክለኛ መሳሪያ የለም። የሳይት መጠን፣ የቴክኒክ ቡድን ልምድ፣ በጀት ያሉበት መንገድ በተለያዩ ዘዴዎች ሊመረጡ ይችላሉ። ለትንሽ ሳይቶች Excel፣ Google Sheets ወይም ቀላል ኮማንድ ላይን ማጣሪያዎች በቂ ናቸው። ለመካከለኛ ሳይቶች Screaming Frog Log File Analyser፣ GoAccess ወይም Python script የተሻሉ ናቸው። በኩርፖሬት መዋቅር Elasticsearch፣ Logstash፣ Kibana፣ BigQuery ወይም SIEM መፍትሄዎች ሊስተሰር ይችላሉ።
| ዘዴ | ምርጥ አጠቃቀም | ውሉድ | ግዴታ |
|---|---|---|---|
| Excel ወይም Sheets | ትንሽ blog, ዝቅተኛ ትራፊክ | በቀላሉ ማወቅ, ፈጣን ማጣሪያ | በትልቅ ፋይል ይዘገያል እና የሳት መጠን ያቆማል |
| ኮማንድ ላይን | ቴክኒክ ተጠቃሚዎች, VPS ሰርቨሮች | ፈጣን, ነፃ, ለአውቶሜሽን ይገባል | የLinux ኮማንድ እውቀት ያስፈልጋል |
| SEO log ትንተና መሳሪያዎች | መካከለኛ እና ትልቅ ሳይቶች | Bot, URL እና የሁኔታ ኮድ ሪፖርቶች ዝግጁ ናቸው | የፈቃድ ዋጋ ሊኖረው ይችላል |
| ELK ወይም BigQuery | ኩርፖሬት እና ከፍተኛ ትራፊክ ሳይቶች | በቅድሚያ ሰዓት, ይስተካል እና ዝርዝር ነው | ማጠናቀር እና ጥገና ልዩ ችሎታ ያስፈልጋል |
በጥቅም ማስጀመር ለማድረግ የቅርብ 7 ወይም 14 ቀናት log አውርዶ Googlebot፣ Bingbot፣ YandexBot እና ሌሎች አስፈላጊ bot user-agent በማጣሪያ አይቻላችሁ። በኋላ URL፣ የሁኔታ ኮድ እና ቀን መስኮች በመጠቀም pivot table አብራሪያ ማዘጋጀት ይችላሉ። ዓላማው በመጀመሪያ ትንተና የፈጣን አውታረ ውሂብ መዋቅር ማቋቋም ሳይሆን፣ ትልቁን SEO ጉዳቶች በፍጥነት ማየት ነው።
በእርምጃ እርምጃ የሰርቨር Log ፋይል ትንተና
1. የትንተና ዓላማውን ይቅረቡ
በመጀመሪያ የሚያውቁትን ያበረታቱ። አዲስ ትውልድ የተሰጠ ይዘት የ Google ማስተዳደር ውስጥ አይገባም? የምድብ ገጾች በቂ ምርመራ አያገኙም? የሰርቨር የተሳሳተ ምልክቶች በኦርጋኒክ ስርዓት ላይ ተጽንቶ እንዳለ? ዓላማዎ ግልፅ ከሆነ በlog ፋይል ውስጥ የሚፈልጉትም ግልፅ ይሆናል። ለምሳሌ ለindex ችግር በ Googlebot በሚታዩ ቀናት ውስጥ አስፈላጊ URL የተመረምሩ ወቅት ይታያል፤ ለperformance ችግር 5xx ኮዶችና የምላሽ ጊዜዎች ይታያሉ።
2. ትክክለኛ የጊዜ ሰፊነት ይምረጡ
አንዳንድ ጥቂት ጊዜ ሰፊነት የተሳሳተ ምልክት ሊሆን ይችላል፤ በጣም ረዘም የጊዜ ሰፊነት ደግሞ ፋይሉን በርካታ ያድናል። በትንሽና መካከለኛ የሚሆኑ ድር ጣቢያዎች ውስጥ 14 እስከ 30 ቀን መጀመሪያ ይሆናል። እንደ ዜና ጣቢያዎች በፍጥነት የሚታየው ማዕከል ላይ 3 እስከ 7 ቀን የሚሆኑ ጊዜዎች አስፈላጊ ይሆናሉ። በትልቅ የe-commerce ጣቢያዎች ውስጥ የወቅት፣ የውሎ እና የምድብ ማሻሻያ በተጨማሪ እንዲሰር ይችላሉ።
3. የBot ትራፊክን ይታጣጡ
በuser-agent ሜዳ Googlebot, Googlebot-Image, Googlebot-News, Bingbot, YandexBot, DuckDuckBot, Applebot ያሉ ቦቶችን ይለዩ። ነገር ግን በአስፈላጊ ሪፖርቶች ቦቶቹ እውነተኛ እንደሆኑ ያረጋግጡ። በሞባይል ቅድሚያ የindex ምክንያት Googlebot Smartphone ትእዛዞች በተጨማሪ ይታያሉ። የdesktop bot በጣም ንቁ ሲታይ፣ የmobile bot ዝቅተኛ ከሆነ የአዋቂነት ወይም የተደራጀ ችግር ሊኖር ይችላል።
4. የURL ቡድኖችን ያቅርቡ
በትልቅ ጣቢያዎች አንድ አንድ URL ትንተና አይረባም። URL በስብስብ ያከፍሉ፤ ዋና ገጽ፣ ምድብ፣ ምርት፣ blog፣ tag፣ filter፣ search፣ pagination፣ image፣ API፣ static file ወይም ሌሎች። ቦቶች የባለው ድር ክፍሎችን በዝቅተኛ ወይም በላይ ይታያሉ። ለምሳሌ በe-commerce ድር ጣቢያ ውስጥ Googlebot ትእዛዞች 42% በfiltered URL ላይ፣ 18% በምርት ገጾች ላይ ከሆነ የpriority ችግር አለ ማለት ነው።
5. የሁኔታ ኮዶችን ያወጡ
በSEO log ትንተና የሁኔታ ኮዶች ዋና መንገድ ናቸው። 200 ኮድ የተሳካ መድረሻ፣ 301 የቆይታ መሪ፣ 302 የጊዜያዊ መሪ፣ 304 ያልተቀየረ ምላሽ፣ 404 የማይገኝ ስህተት፣ 410 የቆይታ ማጥፋት፣ 429 በጣም ብዙ ጥያቄ፣ 5xx የሰርቨር ስህተቶችን ያመለከቱ። ዓላማው አስፈላጊ ገጾች በቀጥታ 200 ኮድ እንዲመለሱ እና ቦቶች በስህተት ወይም በማይወዳደር መሪ ሰንአት ላይ ጊዜ አያጠፋ ይሆናል።
6. የምላሽ ጊዜና የሰርቨር ጭነትን ይለካ
Log ፋይሉ የምላሽ ጊዜ ከፈለገ ለbot ትእዛዞች የአማካይና የ95% ምላሽ ጊዜ ይመልከቱ። አማካይ 180 ms በጥሩ ሆኖ ሊታይ ይችላል፤ ነገር ግን 95% ዋጋ 2,800 ms ከሆነ በአንዳንድ URL አይነቶች bot በዝቅተኛ ፍጥነት ይሄዳሉ። በተለይ በfiltered category፣ የድር ፍለጋ፣ የdynamic report፣ እና ከባድ የdatabase query የሚሰሩ ገጾች በጥንቃቄ ይመልከቱ። የperformance ችግር ከሆነ ለበለጠ ኃይል የሚያበረታቱ Hostragons የድንጋይ አንባሳ አማራጮች ይመዘገቡ።
SEO አንፃፃፃፃፃፃፃፃ በጣም አስፈላጊ የLog ትንታኔ ውጤቶች
የቅኝ ትንታኔ ገቢ ማቆም
የቅኝ ትንታኔ ገቢ ማቆም ማለት ቦቶች በምንም አይነት ዋጋ የሌለው የURL ላይ በማነፃፀሪያ ጊዜ የበዛ ስራ ማድረግ ነው። የፋርማትር ያሏቸው URL፣ የማደራጃ ፊልተሮች፣ session IDዎች፣ የታተሙ ገጽታዎች፣ የማያቋረጡ ቀን አርክቪዎችና የድር ውስጥ የፍለጋ ውጤቶች በጣም የሚታወቁ ምንጮች ናቸው። በLog ትንታኔ እነዚህ URLዎች ከፍተኛ መጠን እንደሚያሳዩ ብታዩ፣ canonical, robots.txt, noindex, ፋርማትር ማቀናበሪያና የአብራሪ አገናኝ ማስተካከያን በአንድ ላይ ያያዙ።
አስፈላጊ ገፆች በቦቶች በቂ አይታዩ
አንዳንድ ጊዜ ችግሩ ቦቶች ብዙ ገፆችን ማሳየት አይደለም፣ የተሳሳተ ገፅ ማሳየት ነው። አዲስ የምርት ገፆች፣ ከፍተኛ የትርፍ ችሎታ ያላቸው landing pageዎች ወይም የተዘምኑ መመሪያ ይዘቶች በቂ አይታዩም። ይህ በዚህ የተንቀሳቃሽ አገናኝ ደካማነት፣ የsitemap አዳዲስነት፣ የsite ፍጥነት ዝቅተኛነት ወይም URL በመስክ በጣም ውስጥ መኖር ምክንያት ሊሆን ይችላል። በዚህ ሁኔታ XML sitemapን ያድሱ፣ ከዋና ምድብና ከተዛማዥ ይዘቶች ውስጥ አገናኝ ያድርጉ፣ የተዘጋ ገፆችን ያግኙና URL ውስጥነትን ያሳንሱ። የDomain እና የፕሮጀክት መስክን ከመጀመሪያ ትንታኔ በማድረግ የጎራ መጠይቅ በማህበራዊ ምርኮ መጀመር ይችላሉ።
የRedirect ሰንሰንት
በLog ውስጥ ቦቶች /eski-url ማህደር ከ /ara-url ማህደር ወደ /yeni-url ማህደር በማዘምን እንደሚሄዱ ማየት በጣም የተለመደ ነው። ይህ ሰንሰንት የተጠቃሚ ልምድና የቦቶች አስተዋጽኦን ያነሳሳል። የሚመከረው የቆላ የURL ቀጥታ ወደ መጨረሻ URL 301 redirect ነው። በትልቅ የsite migration ፕሮጀክትዎች የቀድሞ redirect አዋጅ በመደበቅ ሰንሰንት ሊፈጥር ይችላል። የወርሃዊ Log መከላከያ ይህን ሰንሰንት በቀድሞ ያግኛል።
5xx ስህተቶችና የግራ አገናኝ ግምገማ
የፍለጋ ማስተናገድ ቦቶች በsiteዎት በቂ 500, 502, 503 ወይም 504 ስህተቶችን ቢያዩ የቅኝ ትንታኔን ማነፃፀር ይቅር ይላሉ። ይህ በተለይ በየውድድር ወቅት የኦርጋኒክ ውጤትን ይጎዳል። በLog ውስጥ የ5xx ስህተቶች ጊዜ፣ የURL አይነትና የbot አይነት ያስተካክሉ። ለምሳሌ በሁሉም ሌሊት 02:00 በbackup ወቅት 503 ቢበዛ የmaintenance window፣ የምንጭ አሰራር ወይም የcache ስትራቴጂ ይታያል።
Robots.txt, Sitemap እና Log ውሂብን በአንድነት መንበብ
Log ትንተና ብቻውን ኃይለኛ ነው፤ ነገር ግን robots.txt, XML sitemap እና Google Search Console ውሂብ ጋር ሲያንበብ የበለጠ አስፈላጊ ይሆናል። በSitemap ውስጥ ካሉት URL የbot ተንቀሳቃሽ ተቀናጀን አይደለን እንደሆነ አንጻጸፉ። Sitemap ውስጥ የማይኖሩ ነገር ግን በብዛት የተተነቀሱ URL ያግኙ። Robots.txt ውስጥ የተዘጉትን አካባቢዎች bot ተጠያቂ መጥቶ እንደሆነ ያረጋግጡ። የተዘጉ URL በመፈለጊያ ውጤት ውስጥ መቀጠል ከተታየ robots.txt ብቻ ሊበቃ አይችልም፤ noindex ወይም የማስወገድ ዘዴ ሊያስፈልግ ይችላል።
የተሻለ ልምድ በየወሩ ሶስት ዝርዝሮች ማቅረብ ነው፡ Sitemap ውስጥ ያሉ ነገር ግን የማይተነቀሱ አስፈላጊ URL; Sitemap ውስጥ የማይኖሩ ነገር ግን በብዛት የተተነቀሱ ዝቅተኛ ዋጋ URL; እና የስህተት ኮድ የሚሰጡ bot ጥያቄዎች። ይህ ሶስቱ ዝርዝሮች የእርስዎ የቴክኒክ SEO መንገድ መሰረት ይሆናሉ።
የሎግ ትንተና ሪፖርት ውስጥ የሚካተቱ መትረቶች ምንድን ናቸው?
እውነተኛ እና የሚያደርጉ ህይወት ያሳያሉ መሳሰሉ መትረቶችን መምረጥ ይገባዋል። ብዙ መትረቶችን ማካተት በማይተከለው ሪፖርት ውስጥ የተመረጡ መትረቶች እንደ ቀድሞ የሚቀርቡት ምሳሌዎች በብዙ ሳይቶች ለመጀመሪያ ደረጃ በቂ የሆኑ መስተዋቶች ናቸው፦
- የቦት ጠየቃ ጠቅላላ ብዛት እና በቦት የተከፋፈለ መትረት
- Googlebot Smartphone እና Desktop ግንዛቤ ምዝገባ
- የሁኔታ ኮድ ተከፋፈል፡ 200, 3xx, 4xx, 5xx
- በURL አይነት የተመረጡ ተመሳሳሉ ግንዛቤዎች
- በጣም የተተከለ 100 URL የመጀመሪያ
- አልተተከለም ወይም በጥቂት የተተከለ አስፈላጊ URL’ዎች
- አማካኝ እና የ95% የምላሽ ጊዜ
- በብዛት 404 እና 5xx ምላሽ የሚሰጡ URL’ዎች
- በፋይል ፓራሜትር የURL ጠየቃ መትረት
- የሐሰት ቦት ወይም የተጠረጠረ user-agent ዝርዝር
ሪፖርትዎን የሳምንት ወይም የወር ስምንት አካባቢ በእርስዎ ውስጥ በየጊዜው ማድረግ ይገባል። ምሳሌ እንደ Hostragons ውስጥ በጥሩ አዳዲስ የአማራጭ የማይተከለው አይነት በጥሩ 5xx መትረት 1.8% ነበር፣ ለፍላጎት ወር በ0.2% ወደቅ ከሆነ፣ የተደረገው የመስመር ስር ማሻሻያ ውጤቱን በግልጽ አሳያል። በ WordPress ውስጥ ለ blog ይዘቶች የGooglebot ጠየቃዎች ከአዲስ iç-link: አገባበር በኋላ በ35% ከበደ፣ የይዘት አስተዳደር ውሳኔዎ በትክክል በውሂብ ይደገፋል።
ተግባራዊ ምሳሌ: 30 ቀናት የሎግ ትንተና ሴነርዮ
በአንድ ቴክኖሎጂ ብሎግ የቆይቷቸው 30 ቀናት access log ተትንተና ይደረጋል ብለን እንደተሰበሰበ እንቅስቃሴ እንደምንታየ. ከጠቅላላ 320,000 ጥያቄ ውስጥ 48,000 የሚስከር ቦት ጥያቄ ተገኘ። Googlebot ጥያቄዎች 39,500 ነበሩ፣ Bingbot 5,200 ነበሩ፣ ሌሎች ቦቶች 3,300 ነበሩ። በውስጥ status code በተደረገ አየት 200 መልስ 78% ነው፣ 301 11%፣ 404 7%፣ 5xx 1.5%፣ ሌሎች መልሶች 2.5% ነበሩ።
URL በመደበቅ ሲደረግ፣ ከGooglebot ጥያቄዎች 28% tag ገፆችን፣ 22% አሮማ የድሮ ማህደስ፣ 19% blog ማህደስ፣ 8% የቅድሚያ ክፍል ገፆችን፣ ቀሪው ጥያቄ ደግሞ ፎቶና static ፋይሎች ላይ እንደተሄደ ታየ። ነገር ግን የሳይቱ ኦርጋኒክ ትራፊክ ዓላማ በዘመናዊ የመምሪያ ንግግርና የክፍል የቡድን ገፆች ላይ ነበር። እንደ እርምጃ ዝቅተኛ ዋጋ tag ገፆች noindex ተደረጉ፣ መውጫ የሚስከር አሮማ ገፆች ላይ ... ተቀነሰ፣ የዘመናዊ የመምሪያ ንግግሮች ከመነሻ ገፅና በተዛማጅ ክፍሎች ... ተደረገ፣ sitemap ለማንበብ የተፈለጉ URL ብቻ እንዲካተት ተቀየረ።
በሚቀጥለው 30 ቀናት Googlebot ወደ blog የሚስከር ጥያቄ እሴት ከ19% ወደ 34% ወጣ፣ ወደ ክፍል ገፆች ከ8% ወደ 14% ወጣ። 404 እሴት በድሮ URL redirect ከ7% ወደ 2.1% ወረደ። ይህ ምሳሌ log ትንተና በቴክኖሎጂ ብቻ ሳይኖረው፣ በቀጥታ የኦርጋኒክ እድገት ስታቴጅን እንደሚያግዝ የውሳኔ መካከለኛ አካል እንደሆነ ያሳያል።
ብዙ የሚደርሱ ስህተቶች
በlog አናሳስ ላይ በጣም የሚገኙት ስህተቶች ከመጀመሪያ user-agent መረጃን አያውቅም በተለያዩ መልኩ ተጠየቀ። ሐሰት bot ካልተቀናበሩ የተገኙት ሪፖርቶች የተሳሳተ መረጃ ያቀርባሉ። ሁለተኛው ስህተት የሚታየው ነገር ሁሉንም URL በአንደኛ እሴት ማየት ነው። የprivacy policy ገፅ የተሰየረ ብዛት ከዋና ምድብ ገፅ የተሰየረ ብዛት በአንደኛ እሴት አይደለም። ሶስተኛ ስህተት ከአንድ ቀን የተገኙ ውሂብ ላይ ትልቅ ውሳኔ ማድረግ ነው። Bot ባህሪ በቀናት ሊለያይ ይችላል፤ ስለዚህ የተሳሳተ ጊዜ ማምረጥ አስፈላጊ ነው።
አራተኛ ስህተት robots.txt በማጠቃለያ ሁሉንም ችግር ይፈታል በማሰብ ነው። Robots.txt ተሰየረን ሊገደብ ይችላል፤ ነገር ግን ለindex አስተዳደር ሁልጊዜ የበቂ መፍትሄ አይሆንም። አምስተኛ ስህተት ደግሞ የተገኙትን አሳየቶች በተግባር መቀየር አለመቻል ነው። በlog አናሳስ መጨረሻ redirect, ... link, sitemap, canonical, አፈጻጸም እና የደህንነት ውሳኔዎች ካልተወሰኑ ሪፖርቱ በተለመደ ፋይል እየተመረምረ ይቆያል።
የደህንነትና የቅድሚያ ጥንቃቄ ማድረግ የሚገባው
Log ፋይሎች IP አድረስና የጥያቄ መረጃ ስለሚያካትቱ በጥንቃቄ መያዝ ይገባቸዋል። ወደ ያልተፈቀደ ሰዎች አካፋፋፍ አይደለም፣ ለትንበያ የተወሰዱ ፋይሎች በውስጥ የአንዱ ኮምፒውተር ላይ የበዛ ጊዜ አይቆዩም፣ እንዲቻል በስተቀር መሸፈኛ መንገድ ይደርስበታል። በኩርንታዊ ፕሮጀክቶች log የመያዝ ጊዜ ከKVKKና የኩባንያ ፖሊሲዎች ጋር ይዛመዳል። ከዚህ በስተቀር log ፋይሎች ውስጥ token፣ session parameter ወይም ህይወታዊ query string መረጃ ቢታየ፣ በመተግበሪያ በኩል የመመዝገብ ፖሊሲ እንዲወሰን ይገባዋል።
በደህንነት ዕይታ log ፋይሎች ለSEO ብቻ ሳይሆን ለጥቃት መቆጣጠርም አስፈላጊ ናቸው። ድንገት የተጨመረ 404 ሙከራዎች፣ admin panel የሚታዩ ስነሰርዓት፣ የተለመደ ከPOST ጥያቄዎች፣ ወይም ከተወሰኑ IP block የሚመጡ ጭነት ትርጉም የደህንነት ማስጠንቀቂያ ሊሆን ይችላል። ከዚህ በላይ SEO እና የስርዓት አስተዳደር ቡድኖች log ውስጥ መረጃን በተያያዥ አካል መተዳደር ይገባቸዋል።
ውሎ: Log ትንተና SEO የእውነት የመረጃ አይነት ነው
የሰርቨር log ፋይሎችን በመትንተና የፍለጋ ማሽን bot-ን መከታተል በቴክኒክ ስኦ ላይ ተግባራዊ መውሰድን ይቀንሳል፤ እውነተኛ የመቃኘት ባህሪን ግልጽ ያደርጋል። የተከበሩ URL-ዎች የት እንደሆኑ፣ ምን ዓይነት ተሳሳቶች bot-ን ያደናቅቋሉ፣ ሰርቨሩ መቼ እንደሚደክምና የመቃኘት budget የት እንደሚደፈር log-ን በመትንተና መረጃ ማግኘት ይችላሉ። በተደጋጋሚ ትንተና ማድረግ በእድገት ላይ ያሉ ሳይትዎች የindex ጥራትንና የበይነ ውህድ ትርኢትን ለማጠናከር አጠናክረ ባህሪ ነው።
ለአጭር መጀመሪያ፣ የቅርብ 14 ቀናት access log ፋይልዎን ያውርዱ፣ እውነተኛ Googlebot ጥያቄዎችን ያሳይ፣ የstatus code-ዎችና URL group-ዎችን ያወጡ። በሚያገኙት ውጤት፣ የperformance፣ የsecurity ወይም የምንዛሬ ፍላጎት አመለካከት ካለ፣ በማህበረሰቡ መርማሪያ መመልከት ጥሩ ዕድል ሊሆን ይችላል። Hostragons የhosting፣ VPS፣ ብሉድ ሰርቨር፣ domainና SSL መፍትሄዎች ሳይትዎን በቴክኒክ ደረጃ ለማጠናከር ይረዳዎታል፤ ከlog ትንተና የተገኙ ማሻሻያዎችን በጤናማ አካባቢ ማድረግ ይችላሉ።
ብዙውን ጊዜ የተጠየቁ ጥያቄዎች
የሰርቨር log ፋይል SEO ለምን ከGoogle Search Console የተለየ ነው?
Google Search Console አጠቃላይና Google ተመካች መረጃዎችን ይሰጣል፤ የሰርቨር log ፋይል ግን ወደ ሰርቨርዎ የሚደርስ እውነተኛ ጥያቄዎችን በURL, ጊዜ, IP, user-agent እና ሁኔታ ኮድ ደረጃ ይሳያል። ስለዚህ log ትንተና ለመረጃ አይነት በጣም ዝርዝርና እውነተኛ ምንጭ ነው።
ለlog ትንተና ምን ያህል ቀናት መረጃ በቂ ነው?
በአብዛኛው የድህረገፅ ለ14 እስከ 30 ቀናት ያለው log የመጀመሪያ ትንተና ይሆናል። ለአዲስ ዜና የሚለጠፉ ድህረገፆች እና በቅድሚያ የሚለያዩ ፕሮጀክቶች ለ3 እስከ 7 ቀናት ትንተና ደረጃ ይሆናል። ለየወቅቱ ትራፊክ የሚያገኙ ድህረገፆች የካምፓኒያ ጊዜዎች በተለይ ይታየዋል።
Googlebot እውነተኛ መሆኑን እንዴት እንደምታውቅ?
በuser-agent መረጃ ብቻ አትታመን። በIP አድራሻ የተመለሰ DNS መከላከያ አድርግ፣ የተገኘው የድህረገፅ ስም googlebot.com ወይም google.com በሚጨምር መሆኑን አረጋግጥ፣ ከዚህም የተገኘውን ድህረገፅ አሁን በአንድ IP አድራሻ ተመልከት። የሚዛመድ ቢኖር bot እውነተኛ መሆኑ የሚታመነው ነው።
404 ስህተቶች ሁልጊዜ SEO ችግር ናቸው?
ሁሉም 404 ስህተት አይደለም፤ የተወገዱ ወይም መኖር ያልተቻለ ገጾች ለተለመደ ሁኔታ ይሆናሉ። ነገር ግን ከአስፈላጊ ... የሚመጡ፣ የbacklink ያሉ፣ ወይም በGooglebot ብዙ የተቃኘ 404 URL የትንተና በጀት በውድ ይጠቀማሉ። ለእነዚህ URL ተገቢ መልከት ወይም 410 ስታሬጅ ይወያዩ።
Log ትንተና በምን ያህል ይደረግ?
በትንሹ ድህረገፅ በወር አንድ ጊዜ ትንተና በቂ ይሆናል። በትልቅ Hostragons ኢ-ንትራክት፣ ዜና እና ከፍተኛ ትራፊክ ፕሮጀክቶች በሳምንት አንድ ጊዜ ወይም በአስፈላጊ ጊዜ በቀን ትንተና ይተካ። የsite ቅደም ተከተል፣ የመረጃ መቀየር ወይም በየትኛውም ትልቅ የይዘት ዘምና በኋላ log መቆጣጠር አስፈላጊ ነው።