.htaccess ഉപയോഗിച്ച് വ്യാജ Googlebot-കളെ കണ്ടെത്തി തടയുന്നത്, സൈറ്റിലേക്ക് Googlebot എന്നുള്ളത് പോലെ കാണിച്ച് വരുന്ന ദോഷകരമായ ബോട്ടുകളെ യൂസർ ഏജന്റ്, IP പരിശോധന, ആക്സസ് ലോഗുകൾ എന്നിവ അടിസ്ഥാനമാക്കി തിരിച്ചറിയുകയും യഥാർത്ഥ Google ക്രോളറുകളെ ബാധിക്കാതെ 403 എന്ന സ്റ്റാറ്റസ് കോഡ് ഉപയോഗിച്ച് തടയുകയും ചെയ്യുന്നതാണ്. ഏറ്റവും സുരക്ഷിതമായ മാർഗം; യൂസർ ഏജന്റ് മൂല്യം മാത്രം വിശ്വസിക്കാതെ, ഗൂഗിളിന്റെ ഔദ്യോഗിക IP പരിധികളും റിവേഴ്സ് DNS പരിശോധനയും ആശ്രയിച്ച്, ആദ്യം ലോഗ് ചെയ്ത്, പിന്നീട് നിയന്ത്രിതമായ .htaccess നിയമങ്ങൾ ഉപയോഗിച്ച് തടയലാണ്.
ചില ആക്രമണ ബോട്ടുകൾ, സെക്യൂരിറ്റി ഫയർവാളുകളും ലളിത ബോട്ട് ഫിൽട്ടറുകളും മറികടക്കാൻ Googlebot, Google-InspectionTool, AdsBot-Google, Googlebot-Image തുടങ്ങിയ പേരുകൾ ഉപയോഗിച്ച് സ്വയം പ്രചരിപ്പിക്കുന്നു. കാരണം സൈറ്റ് ഉടമകൾ ഗൂഗിൾ ക്രോൾ ചെയ്യുന്നത് തടയാൻ തയാറാകാറില്ല. ഈ ഒഴിവ് ഉള്ളടക്കം കവർച്ച, അമിതമായ റിസോഴ്സ് ഉപഭോഗം, വ്യാജ ട്രാഫിക്, ഫോമുകൾക്ക് സ്പാം, ലോഗിൻ ശ്രമങ്ങൾ, SEO ഡാറ്റയുടെ മലിനീകരണം എന്നിവക്ക് കാരണമായി മാറുന്നു. പ്രത്യേകിച്ച് ഷെയർഡ് ഹോസ്റ്റിംഗ്, WordPress, WooCommerce, വാർത്താ സൈറ്റുകൾ, പതിവായി അപ്ഡേറ്റ് ചെയ്യുന്ന ബ്ലോഗുകൾ എന്നിവയിൽ ഈ ട്രാഫിക് കുറഞ്ഞ സമയത്തിനുള്ളിൽ CPU, RAM, I/O പരിധികൾ കടക്കാൻ ഇടയാക്കും. ഈ ഗൈഡിൽ വ്യാജ Googlebot-കളുടെ പെരുമാറ്റം വായിക്കാൻ, Apache .htaccess ഉപയോഗിച്ച് സുരക്ഷിത നിയമങ്ങൾ എഴുതാൻ, യഥാർത്ഥ Googlebot തെറ്റിദ്ധരിപ്പിക്കാതെ തടയാൻ വേണ്ട പരിശോധനകൾ എങ്ങനെ നടത്താമെന്നു ഘട്ടം ഘട്ടമായി പഠിക്കാം. നിങ്ങളുടെ വെബ്സൈറ്റിന് സുരക്ഷിതവും വേഗതയേറിയതുമായ, സ്കെയിലബിളുമായ ഒരു അടിസ്ഥാന ഘടന ആവശ്യമാണെങ്കിൽ Hostragons വെബ് ഹോസ്റ്റിംഗ് പരിഹാരങ്ങൾ ഉം SSL സർട്ടിഫിക്കറ്റിന്റെ ഇൻസ്റ്റലേഷൻ ഉം നിങ്ങളുടെ പദ്ധതിയിൽ ഉൾപ്പെടുത്തുക.
വ്യാജ Googlebot എന്നത് എന്ത്, അത് എങ്ങനെ അപകടകാരിയാണ്?
വ്യാജ Googlebot എന്ന് പറയുന്നത് HTTP അഭ്യർത്ഥനയിൽ User-Agent ഫീൽഡ് Googlebot എന്നുപറയുന്നെങ്കിലും ഗൂഗിളിന് ಸೇರಿದ IP വിലാസങ്ങളിൽ നിന്ന് അല്ലാത്ത ഓട്ടോമാറ്റിക് ക്രോളറുകളാണ്. User-Agent ഒരു ലളിതമായ ടെക്സ്റ്റ് ഫീൽഡ് ആണ്; അതായത് സാങ്കേതികമായി ഏതൊരു ഉപഭോക്താവും തന്റെ അഭ്യർത്ഥനയിൽ Googlebot എന്ന് എഴുതാം. അതുകൊണ്ട് User-Agent മാത്രം പരിശോധിക്കുന്നത് സുരക്ഷയ്ക്ക് മതിയല്ല.
യഥാർത്ഥ Googlebot-ന്റെ ലക്ഷ്യം നിങ്ങളുടെ സൈറ്റ് ക്രോൾ ചെയ്യുക, ഇൻഡെക്സിൽ ചേർക്കുക, പേജുകൾ അപ്ഡേറ്റ് ചെയ്യുന്നതു കണ്ടെത്തുക, തിരയൽ ഫലങ്ങൾക്കായി ഗുണനിലവാരം സൂചിപ്പിക്കുന്ന സിഗ്നലുകൾ ശേഖരിക്കുക എന്നിവയാണ്. വ്യാജ Googlebot പലപ്പോഴും വ്യത്യസ്ത ലക്ഷ്യങ്ങൾക്കായി എത്തുന്നു. ഉദാഹരണത്തിന് ഉൽപ്പന്നങ്ങളുടെ വിലകൾ ശേഖരിക്കുക, ഉള്ളടക്കം നകൽ ചെയ്യുക, അഡ്മിൻ പാനൽ URL-കൾ പരീക്ഷിക്കുക, തിരയൽ പേജുകളെ ഭാരം കൂടാൻ ഇടയാക്കുക, അല്ലെങ്കിൽ ദുർബലമായ പ്ലഗിൻ സെക്യൂരിറ്റി ദുർബലത പരിശോധിക്കുക. ചില ആക്രമണക്കാർ സെക്കൻഡിൽ നിരവധി അഭ്യർത്ഥനകൾ അയച്ച് ചെറിയ സൈറ്റിലും പ്രകടനം താഴ്ന്നു പോകാൻ ഇടയാക്കും.
പ്രായോഗികമായി വ്യാജ ബോട്ടുകൾ കൂടുതലായി കാണപ്പെടുന്ന ലക്ഷണങ്ങൾ:
- കുറച്ചു സമയത്തിനുള്ളിൽ നൂറുകണക്കിന് 404, 403, 500 സ്റ്റാറ്റസ് കോഡുകൾ ഉണ്ടാക്കുന്ന അഭ്യർത്ഥനകൾ.
- wp-login.php, xmlrpc.php, admin, phpmyadmin, backup.zip തുടങ്ങിയ സങ്കീർണമായ പാതകൾ സ്കാൻ ചെയ്യുന്നത്.
- User-Agent Googlebot ആണെങ്കിലും IP വിലാസം Google ASN അല്ലെങ്കിൽ ഔദ്യോഗിക IP പരിധികളിൽ ഇല്ലാത്തത്.
- robots.txt നിയമങ്ങൾ പാലിക്കാതെ ഫിൽറ്റർ, തിരയൽ, കാർട്ട്, അക്കൗണ്ട് പേജുകൾ സന്ദർശിക്കുന്നത്.
- സാധാരണ Googlebot-നോട് വ്യത്യസ്തമായി അതീവ ഉയർന്ന ആവൃത്തി കൊണ്ട് ഒരേ URL-കൾ ആവർത്തിച്ച് അഭ്യർത്ഥിക്കുക.
എന്തുകൊണ്ട് User-Agent മാത്രം പരിശോധിക്കുന്നത് മതിയല്ല?
ഒരു ബോട്ടിന്റെ HTTP ഹെഡറിൽ Googlebot എന്ന് കാണിക്കുന്നത് അതിന്റെ ഗൂഗിളിലേക്കുള്ള സത്യസന്ധത തെളിയിക്കുന്നില്ല. ഉദാഹരണത്തിന് കമാൻഡ് ലൈനിൽ ഒരു curl അഭ്യർത്ഥനയിലൂടെ User-Agent എളുപ്പത്തിൽ മായ്ക്കാം. അതുകൊണ്ട് .htaccess-ൽ Googlebot എന്ന പദം മാത്രം പിടിച്ച് ഒട്ടും തടയുകയോ ഒട്ടും അനുവദിക്കുകയോ ചെയ്യുന്നത് തെറ്റാണ്. ഒന്നാമത്തേത് യഥാർത്ഥ Google ക്രോൾ തടയാൻ ഇടയാക്കും, രണ്ടാമത്തേത് ആക്രമണക്കാർക്ക് അവസരം നൽകും.
2026-ലെ SEO, സുരക്ഷ തന്ത്രത്തിൽ ശരിയായ മാർഗം മൂന്ന് പാളികളിലായി നടക്കുന്നത്: അവകാശപ്പെട്ട തിരിച്ചറിയൽ പരിശോധിക്കൽ, IP അല്ലെങ്കിൽ DNS വഴി സ്ഥിരീകരിക്കൽ, അസാധാരണ പെരുമാറ്റങ്ങൾ ലോഗിൽ നിരീക്ഷിക്കൽ. ഈ മാർഗം Google ദൃശ്യത നിലനിർത്തുകയും സേർവർ റിസോഴ്സുകൾ അനാവശ്യ ബോട്ടുകളിൽ നിന്നും സംരക്ഷിക്കുകയും ചെയ്യുന്നു.
യഥാർത്ഥ Googlebot എങ്ങനെ സ്ഥിരീകരിക്കാം?
ഗൂഗിള് യഥാർത്ഥ ക്രോളറുകൾ സ്ഥിരീകരിക്കാൻ രണ്ട് പ്രധാന മാർഗങ്ങൾ ശുപാർശ ചെയ്യുന്നു: റിവേഴ്സ് DNS പരിശോധനയും ഔദ്യോഗിക IP പരിധികളും ഉപയോഗിക്കുന്നതും. റിവേഴ്സ് DNS-ൽ, അഭ്യർത്ഥന അയക്കുന്ന IP വിലാസം googlebot.com അല്ലെങ്കിൽ google.com ഡൊമെയ്ൻ ആകണം, പിന്നീട് ആ ഡൊമെയ്ൻ വീണ്ടും അതേ IP-യിലേക്ക് പരിഹരിക്കപ്പെടണം. ഈ ഇരുവശ പരിശോധന വ്യാജ PTR രേഖകൊണ്ട് തട്ടിപ്പു തടയുന്നു.
രണ്ടാമത്തെ മാർഗം ഗൂഗിള് പ്രസിദ്ധീകരിച്ച ഔദ്യോഗിക IP പരിധികൾ ഉപയോഗിക്കുന്നതാണ്. Googlebot-ന് പ്രത്യേക ക്രോളറുകൾക്കും യൂസർ-ട്രിഗ്ഗർ ചെയ്ത ഉപകരണങ്ങൾക്കുമായി വ്യത്യസ്ത JSON പട്ടികകൾ ഉണ്ട്. പ്രത്യേകിച്ച് ആ പട്ടികകൾ സമയാനുസൃതമായി മാറുന്നതുകൊണ്ട് പ്രൊഡക്ഷൻ പരിതസ്ഥിതികളിൽ പഴയ IP പട്ടികകളിൽ മാത്രം ആശ്രയിക്കുന്നത് ശരിയല്ല. VPS അല്ലെങ്കിൽ സേർവർ മാനേജ്മെന്റ് നിങ്ങളുടെ കൈവശമെങ്കിൽ ഈ പട്ടികകൾ ഇടയ്ക്കിടെ അപ്ഡേറ്റ് ചെയ്ത് ഫയർവാൾ അല്ലെങ്കിൽ Apache include ഫയലായി ഉപയോഗിക്കുക നല്ലതാണ്. ഷെയർഡ് ഹോസ്റ്റിംഗ് ഉപയോഗിക്കുന്നവർക്ക് മാനേജ്മെന്റ് പാനലിലെ ആക്സസ് ലോഗുകൾ, .htaccess, സെക്യൂരിറ്റി മോഡ്യൂളുകൾ ഉപയോഗിച്ച് നിയന്ത്രിതമായി മുന്നോട്ട് പോകാം.
.htaccess ഉപയോഗിച്ച് വ്യാജ Googlebot തടയൽ തന്ത്രം
.htaccess എപാച്ചി വെബ് സേർവറിൽ ഡയറക്ടറി അടിസ്ഥാനത്തിലുള്ള നിയമങ്ങൾ നിർവചിക്കാൻ സഹായിക്കുന്നു. URL റീഡൈരക്ഷൻ, ആക്സസ് നിയന്ത്രണം, കമ്പ്രഷൻ, കാഷിംഗ്, അടിസ്ഥാന സുരക്ഷാ നിയന്ത്രണങ്ങൾ എന്നിവയ്ക്കായി ഉപയോഗിക്കുന്നു. വ്യാജ Googlebot തടയൽ വേണ്ടി, .htaccess-ന്റെ ജോലി വരുന്ന അഭ്യർത്ഥന നിർദ്ദിഷ്ട നിബന്ധനകളിൽ വിലയിരുത്തി സംശയാസ്പദമായവ 403 Forbidden മറുപടി നൽകി തടയുക എന്നതാണ്.
എന്നാൽ പ്രധാനമായ ഒരു പരിമിതിയുണ്ട്: സാധാരണ .htaccess-ൽ റിയൽ ടൈം റിവേഴ്സ് DNS ക്വറി നടത്തുക എളുപ്പമല്ല. എപാച്ചിയിൽ HostnameLookups സാധാരണയായി പ്രകടന പ്രശ്നങ്ങൾ കാരണം ഓഫായിരിക്കുന്നു. അതുകൊണ്ട് .htaccess-ൽ ഏറ്റവും പ്രായോഗിക മാർഗം, User-Agent Googlebot എന്ന് പറയുന്ന അഭ്യർത്ഥനകളെ IP allowlist-നൊപ്പം താരതമ്യം ചെയ്യുക അല്ലെങ്കിൽ സംശയാസ്പദ പാതകൾക്ക് കർശനമായ ഫിൽട്ടറുകൾ ഉപയോഗിക്കുക എന്നതാണ്. കൂടുതൽ മുന്നേറ്റ പരിശോധനയ്ക്ക് WAF, സെർവർ ഫയർവാൾ, CDN, ലോഗ് ഡാറ്റ ഉപയോഗിച്ച് ഓട്ടോമേഷൻ വേണ്ടിവരും. CDN എന്താണ്, വെബ്സൈറ്റിന്റെ പ്രകടനത്തെ എങ്ങനെ സ്വാധീനിക്കുന്നു ഉള്ളടക്കം ഈ ഘട്ടം മനസ്സിലാക്കാൻ സഹായിക്കും.
ഘട്ടം ഘട്ടം വഴി: വ്യാജ Googlebot കണ്ടെത്തി തടയൽ
1. ആക്സസ് ലോഗുകൾ പരിശോധിക്കുക
തടയൽ നിയമം എഴുതുന്നതിന് മുമ്പ് കുറഞ്ഞത് 24-72 മണിക്കൂർ access log പരിശോധിക്കുക. ട്രാഫിക് കൂടുതലെങ്കിൽ ഒരു മണിക്കൂർ ലോഗും മതിയായ സൂചനകൾ നൽകും. പരിശോധിക്കേണ്ടത് IP വിലാസം, തീയതി, അഭ്യർത്ഥിച്ച URL, HTTP സ്റ്റാറ്റസ് കോഡ്, ബൈറ്റിന്റെ വലിപ്പം, റഫറർ, User-Agent എന്നിവയാണ്. ഉദാഹരണത്തിന് ഒരേ IP വിലാസം 10 മിനിറ്റിൽ 800 അഭ്യർത്ഥനകൾ അയയ്ക്കുന്നു, പലതും 404 ആയി തിരിച്ചു വരുന്നു, അതും Googlebot എന്ന് കാണിക്കുന്നു എങ്കിൽ ശക്തമായ സംശയം ഉണ്ട്.
cPanel പോലുള്ള പാനലുകളിൽ Raw Access Logs വിഭാഗത്തിൽ നിന്ന് ലോഗ് ഡൗൺലോഡ് ചെയ്യാം. SSH പ്രവേശനം ഉണ്ടെങ്കിൽ grep, awk, sort പോലുള്ള ടൂൾസ് ഉപയോഗിച്ച് Googlebot എന്ന് പറയുന്ന അഭ്യർത്ഥനകളുടെ IP അടിസ്ഥാനത്തിലുള്ള പ്രവർത്തനങ്ങൾ പരിശോധിക്കാം. ലക്ഷ്യം Googlebot എന്ന് പറയുന്ന ഓരോ അഭ്യർത്ഥനയുമല്ല, ആ അവകാശം വഹിക്കുന്ന IP-കളുടെ പെരുമാറ്റം കാണിക്കുക ആണ്.
2. Googlebot എന്ന് അവകാശപ്പെടുന്ന IP-കൾ പരിശോധിക്കുക
സംശയാസ്പദ IP-കൾ കണ്ടെത്തിയശേഷം റിവേഴ്സ് DNS PTR റെക്കോർഡ് പരിശോധിക്കുക. ഒരു IP-ക്ക് crawl-66-249-66-1.googlebot.com പോലുള്ള PTR ഉണ്ടെങ്കിൽ ആദ്യ ഘട്ടം കടന്നു. പിന്നെ ആ ഡൊമെയ്ൻ വീണ്ടും അതേ IP-യിലേക്ക് പരിഹരിക്കപ്പെടണം. PTR ഇല്ലെങ്കിൽ അല്ലെങ്കിൽ വ്യത്യസ്ത ഡൊമെയ്ൻ കാണിച്ചാൽ യഥാർത്ഥ Googlebot ആണെന്ന് കരുതരുത്.
ഈ പരിശോധന SEO പ്രാധാന്യമുള്ള സൈറ്റുകളിൽ തെറ്റായ തടയൽ ഒഴിവാക്കാൻ സഹായിക്കുന്നു. യഥാർത്ഥ Googlebot തടയുന്നത് പുതിയ ഉള്ളടക്കങ്ങളുടെ വൈകിയ കണ്ടെത്തലും, ഇൻഡെക്സ് പുതുക്കലിന്റെ കുറവും, Google Search Console-ൽ ക്രോൾ പിശകുകളും, ഓർഗാനിക് ട്രാഫിക്കിൽ നഷ്ടങ്ങളും ഉണ്ടാക്കും. അതിനാൽ User-Agent അടിസ്ഥാനമല്ല, സമഗ്ര പരിശോധന അടിസ്ഥാനമാക്കി മാത്രം തടയൽ തീരുമാനിക്കുക.
3. ആദ്യം ലോഗ് ചെയ്യുക, ശേഷം തടയുക
സുരക്ഷിത പ്രവർത്തനത്തിന് നേരിട്ട് തടയുന്നത് ഒഴിവാക്കി, ആദ്യം നിരീക്ഷണ ഘട്ടം എടുക്കുക. ആദ്യ ഘട്ടത്തിൽ സംശയാസ്പദ IP-കളും User-Agent-കളും കുറിച്ച് സൂക്ഷിക്കുക. രണ്ടാം ഘട്ടത്തിൽ വ്യക്തമായ ദോഷകരമായ പാതകൾക്ക് നിയന്ത്രണം ഏർപ്പെടുത്തുക. മൂന്നാം ഘട്ടത്തിൽ Googlebot എന്ന് അവകാശപ്പെടുന്ന, എന്നാൽ Google IP പരിധിയിലാണ് ഇല്ലാത്ത അഭ്യർത്ഥനകൾ തടയുക.
ഈ സമീപനം പ്രത്യേകിച്ച് ഇ-കൊമേഴ്സ് സൈറ്റുകളിൽ നിർണായകമാണ്. തെറ്റായ നിയമം പേയ്മെന്റ്, കാർട്ട്, ഉൽപ്പന്ന വ്യത്യാസങ്ങൾ, സ്റ്റോക്ക് ഇന്റഗ്രേഷൻ പോലുള്ള പ്രധാന പ്രവാഹങ്ങളെ ബാധിക്കാം. സൈറ്റ് ട്രാഫിക് ഉയർന്നാൽ ആദ്യം ടെസ്റ്റ് പരിതസ്ഥിതിയിൽ പരീക്ഷിക്കുക. WordPress സൈറ്റ് മാറ്റൽ & പരീക്ഷണ പരിസ്ഥിതി സൃഷ്ടി പോലുള്ള പ്രക്രിയകൾ സുരക്ഷാ നിയമം മാറ്റങ്ങൾ അപകടരഹിതമാക്കും.
സുരക്ഷിതമായ .htaccess നിയമങ്ങളുടെ ഉദാഹരണങ്ങൾ
താഴെ കൊടുത്തിരിക്കുന്ന ഉദാഹരണങ്ങൾ പ്രൊഡക്ഷൻ പരിതസ്ഥിതിയിൽ നേരിട്ട് പകർത്തുന്നതിന് മുമ്പ് നിങ്ങളുടെ സെർവറിന്റെ Apache പതിപ്പ്, പ്രവർത്തനമോഡ്യൂളുകൾ, ഹോസ്റ്റിംഗ് അനുമതികൾ എന്നിവ പരിഗണിച്ച് പരീക്ഷണം നിർബന്ധമാണ്. Apache 2.4, mod_rewrite സാധാരണയായി പിന്തുണയ്ക്കപ്പെടുന്നു; എന്നാൽ ചില ഷെയർഡ് ഹോസ്റ്റിംഗ് പരിതസ്ഥിതിയിൽ ചില ഡയറക്ടീവുകൾ നിയന്ത്രിക്കപ്പെട്ടു കഴിഞ്ഞിരിക്കാം. .htaccess മാറ്റുന്നതിനു മുമ്പ് അതിന്റെ ബാക്കപ്പ് എടുക്കുക. ചെറിയ തെറ്റുകളും 500 Internal Server Error സൃഷ്ടിക്കാം.
ലളിതമായ പെരുമാറ്റ ഫിൽട്ടർ: സങ്കീർണ്ണ പാതകളിൽ വ്യാജ ബോട്ടുകൾ തടയൽ
Googlebot ആയി കാണുന്ന ബോട്ടുകൾ അഡ്മിൻ, ആക്രമണ ലക്ഷ്യമുള്ള ഫയലുകൾ പരിശോധിക്കുന്നത് തടയാൻ ഈ സമീപനം സഹായിക്കുന്നു. യഥാർത്ഥ Googlebot-ന് wp-login.php, phpmyadmin, ബാക്കപ്പ് ഫയലുകൾ സ്കാൻ ചെയ്യേണ്ടതില്ല. അതിനാൽ തെറ്റായ പോസിറ്റീവ് സാധ്യത കുറവാണ്.
- RewriteEngine On
- RewriteCond %{HTTP_USER_AGENT} (Googlebot|Google-InspectionTool|AdsBot-Google|Mediapartners-Google) [NC]
- RewriteCond %{REQUEST_URI} (wp-login[.]php|xmlrpc[.]php|phpmyadmin|adminer|backup|[.]sql|[.]zip) [NC]
- RewriteRule ^ - [F,L]
ഈ നിയമം Googlebot ആണെന്ന് പറഞ്ഞ ഒരു ക്ലയന്റ് സങ്കീർണ്ണ പാതയിൽ എത്തിയാൽ 403 എന്ന കമാൻഡ് നൽകി തടയുന്നു. SEO ക്രോൾ തകരാറിലായിരിക്കാനുള്ള സാധ്യത വളരെ കുറവാണ്, കാരണം ഈ പാതകൾ Google ഇൻഡെക്സിൽ ഉൾപ്പെടാറില്ല. എങ്കിലും WordPress ഉപയോഗിക്കുന്നവർ സെക്യൂരിറ്റി പ്ലഗിനുകൾ, XML-RPC ആവശ്യകതകൾ, റിമോട്ട് പബ്ലിഷിംഗ് സേവനങ്ങൾ എന്നിവ പരിശോദിക്കുക.
IP Allowlist തന്ത്രം: Googlebot അവകാശപ്പെട്ട IP-കളെ ഔദ്യോഗിക പരിധികളുമായി താരതമ്യം
കൂടുതൽ ശക്തമായ മാർഗം Googlebot ആയി കാണുന്ന അഭ്യർത്ഥനകൾ മാത്രം വിശ്വസനീയമായ IP പരിധികളിൽ നിന്നാണെങ്കിൽ അനുവദിക്കുക എന്നതാണ്. താഴെയുള്ള ഉദാഹരണം ആശയവിനിമയം മാത്രമാണ്; IP പരിധികൾ ഗൂഗിളിന്റെ അപ്ഡേറ്റുചെയ്ത ഔദ്യോഗിക പട്ടിക അനുസരിച്ച് നിർമ്മിക്കണം. പഴയ അല്ലെങ്കിൽ അപൂർണ്ണ പട്ടിക യഥാർത്ഥ Googlebot തെറ്റായി തടയാൻ ഇടയാക്കും.
- RewriteEngine On
- RewriteCond %{HTTP_USER_AGENT} (Googlebot|Googlebot-Image|Googlebot-News|Google-InspectionTool|AdsBot-Google) [NC]
- RewriteCond expr "! ( %{REMOTE_ADDR} -ipmatch '66.249.64.0/19' || %{REMOTE_ADDR} -ipmatch '64.233.160.0/19' || %{REMOTE_ADDR} -ipmatch '72.14.192.0/18' )"
- RewriteRule ^ - [F,L]
ഇവിടെ IP പരിധികൾ ഉദാഹരണമാണ്. പ്രൊഡക്ഷൻ പരിതസ്ഥിതിയിൽ Google-ന്റെ പുതിയ googlebot IP JSON പട്ടികയിൽ നിന്നുള്ള സ്വയം സൃഷ്ടിച്ച പരിധികൾ ഉപയോഗിക്കണം. നിങ്ങളുടെ സെർവറിൽ Apache if അല്ലെങ്കിൽ -ipmatch പിന്തുണ ഇല്ലെങ്കിൽ ഹോസ്റ്റിംഗ് സേവനദാതാവിനോട് Apache 2.4 if പിന്തുണ സ്ഥിരീകരിക്കുക. അല്ലെങ്കിൽ CDN/WAF ലെയറിൽ IP പട്ടിക ഉപയോഗിച്ച് നിയമങ്ങൾ സൃഷ്ടിക്കുക.
സംശയാസ്പദ അഭ്യർത്ഥനകളുടെ വേഗം കുറയ്ക്കൽ
.htaccess നേരിട്ട് ഉയർന്ന തലത്തിലുള്ള റേറ്റ് ലിമിറ്റിംഗിന് മികച്ച മാർഗമല്ല; പക്ഷേ ചില ദോഷകരമായ പെരുമാറ്റങ്ങൾ പ്രാരംഭ ഘട്ടത്തിൽ തടയാൻ സഹായിക്കും. യഥാർത്ഥ വേഗ നിയന്ത്രണത്തിന് mod_evasive, mod_security, CDN റേറ്റ് ലിമിറ്റിംഗ്, അല്ലെങ്കിൽ അപ്ലിക്കേഷൻ ലെവൽ സംരക്ഷണം ഉപയോഗിക്കണം. പ്രത്യേകിച്ച് സെക്കൻഡിൽ 5-10-ൽ കൂടുതൽ അഭ്യർത്ഥനകൾ അയക്കുന്ന ബോട്ടുകൾ ചെറിയ സൈറ്റുകളിലും ഡാറ്റാബേസ് സങ്കേതങ്ങൾ കൂടുതൽ ഉപയോഗിക്കും. WordPress പോലുള്ള ഡൈനാമിക് സിസ്റ്റങ്ങളിൽ തിരയൽ പേജുകളും ഫിൽറ്റർ ചെയ്ത വിഭാഗങ്ങളും ടാഗ് പേജുകളും ബോട്ടുകൾ ഉപയോഗിച്ച് എളുപ്പത്തിൽ ദുർവിനിയോഗം ചെയ്യാം. ഈ ഭാഗങ്ങളിൽ robots.txt, canonical, noindex, സെക്യൂരിറ്റി നിയമങ്ങൾ സംയോജിപ്പിച്ച് പ്രയോഗിക്കണം. WordPress വേഗം മരണവിവരണ മാർഗ്ഗനിർദ്ദേശം പ്രകടന ഭാഗം കൂട്ടും.
തുലനാപട്ടിക: ഏത് മാർഗം എപ്പോൾ ഉപയോഗിക്കണം?
| മാർഗം | ശക്തമായ ഭാഗം | ദുർബലത | ഉപയോഗ ശിപാർശ |
|---|---|---|---|
| User-Agent മാത്രം പരിശോധിക്കൽ | സ്ഥാപനം എളുപ്പമാണ് | സഹജമായി മായ്ക്കപ്പെടുന്നു, തെറ്റായ തീരുമാനം സാധ്യതയുണ്ട് | ഒറ്റയ്ക്ക് ശുപാർശ ചെയ്യപ്പെടുന്നില്ല; മുൻ ഫിൽട്ടറായി മാത്രം ഉപയോഗിക്കുക |
| റിവേഴ്സ് DNS പരിശോധന | യഥാർത്ഥ Googlebot സ്ഥിരീകരണത്തിൽ വിശ്വസനീയം | .htaccess-ൽ പ്രായോഗികമല്ല, ഓട്ടോമേഷൻ ആവശ്യമുണ്ട് | ലോഗ് വിശകലനം, WAF, സർവർ സൈഡ് പരിശോധനകൾക്ക് ഉപയോഗിക്കുക |
| Google IP allowlist | വേഗതയുള്ള തടയൽ സാധ്യമാക്കുന്നു | പട്ടിക പുതുക്കാത്ത പക്ഷം തെറ്റായ തടയൽ ഉണ്ടാകും | Apache, ഫയർവാൾ, CDN നിയമങ്ങളിൽ അനുയോജ്യം |
| പെരുമാറ്റം അടിസ്ഥാനമാക്കിയ തടയൽ | സങ്കീർണ്ണ പാതകൾക്കും ആക്രമണ മാതൃകകൾക്കും സംരക്ഷണം | തിരിച്ചറിയൽ ഉറപ്പില്ല | wp-login, xmlrpc, ബാക്കപ്പ് ഫയലുകൾ, അഡ്മിൻ സ്കാൻ എന്നിവയിൽ ഫലപ്രദം |
| CDN/WAF സംരക്ഷണം | റേറ്റ് ലിമിറ്റ്, ബോട്ട് സ്കോർ, കേന്ദ്രകൃത നിയമ നിയന്ത്രണം | തെറ്റായി ക്രമീകരിച്ചാൽ യഥാർത്ഥ ഉപയോക്താക്കളെ ബാധിക്കും | ഉയർന്ന ട്രാഫിക്, ഇ-കൊമേഴ്സ്, സ്ഥാപന സൈറ്റുകളിൽ ശുപാർശ |
യഥാർത്ഥ Googlebot തെറ്റാതെ തടയാതിരിക്കാൻ പരിശോധന പട്ടിക

വ്യാജ Googlebot തടയുമ്പോൾ ഏറ്റവും വലിയ അപകടം യഥാർത്ഥ Google ക്രോളറുകളെയും തടയുക ആണ്. ഇത് ഒഴിവാക്കാൻ എല്ലാ മാറ്റം ചെയ്തശേഷവും താഴെപ്പറയുന്ന പരിശോധനകൾ ചെയ്യുക:
- Google Search Console-ലെ ക്രോൾ സ്റ്റാറ്റിസ്റ്റിക്സ് റിപ്പോർട്ടിൽ പെട്ടെന്നുള്ള കുറവ് അല്ലെങ്കിൽ 403 വർദ്ധനവ് ഉണ്ടോ എന്ന് പരിശോധിക്കുക.
- സെർവർ ലോഗുകളിൽ യഥാർത്ഥ Google IP-കളിൽ നിന്നുള്ള അഭ്യർത്ഥനകൾക്ക് 200, 301 അല്ലെങ്കിൽ അനുയോജ്യമായ സ്റ്റാറ്റസ് കോഡുകൾ ലഭിക്കുന്നുണ്ടോ എന്ന് നോക്കുക.
- robots.txt ഫയൽ Googlebot-ന് അടച്ചിട്ടിരിക്കുന്ന നിർണായക ഡയറക്ടറികൾക്ക് മാത്രമേ ആക്സസ് തടയുന്നുണ്ടെന്ന് ഉറപ്പാക്കുക.
- .htaccess മാറ്റം മുൻപ് ശേഷവും സൈറ്റ്മാപ്പ്, പ്രധാന പേജ്, വിഭാഗം, പ്രധാന ഉൽപ്പന്ന പേജുകൾ ടെസ്റ്റ് ചെയ്യുക.
- ഉപയോഗിക്കുന്ന IP പട്ടികയുടെ ഉറവിടവും അപ്ഡേറ്റ് തീയതിയും രേഖപ്പെടുത്തുക.
സാങ്കേതിക SEO-യിൽ 403 മറുപടി ശക്തമായ സൂചനയാണ്. യഥാർത്ഥ Googlebot പ്രധാന പേജുകളിൽ 403 നേരിട്ടാൽ ആ പേജുകളുടെ ക്രോൾ കുറയും. അതിനാൽ 403 മറുപടി ആവശ്യമായ ബോട്ടുകൾക്കും സങ്കീർണ്ണ പാതകൾക്കും മാത്രമേ പ്രയോഗിക്കേണ്ടതുള്ളൂ. പരിപാലന സമയത്ത്, താൽക്കാലിക അമിത ഭാരം, വേഗം നിയന്ത്രണം പോലുള്ള സാഹചര്യങ്ങളിൽ 429 Too Many Requests ചിലപ്പോൾ ഉചിതമാണ്; പക്ഷേ .htaccess-ൽ ലളിതമായ ബോട്ട് തടയലിന് 403 കൂടുതൽ ഉപയോഗപ്രദവും മനസ്സിലാകുന്നതുമായതാണ്.
WordPress, ഇ-കൊമേഴ്സ് സൈറ്റുകൾക്കുള്ള അധിക സുരക്ഷാ നടപടികൾ
WordPress സൈറ്റുകളിൽ വ്യാജ Googlebot ട്രാഫിക് സാധാരണയായി xmlrpc.php, wp-login.php, REST API എൻഡ്പോയിന്റുകൾ, തിരയൽ URL-കൾ, എഴുത്തുകാരൻ ആർക്കൈവ് എന്നിവയിൽ ശ്രദ്ധ കേന്ദ്രീകരിക്കുന്നു. ഇ-കൊമേഴ്സ് സൈറ്റുകളിൽ ഫിൽറ്റർ പാരാമീറ്ററുകൾ, സ്റ്റോക്ക് ക്വെറികൾ, കാർട്ട് എൻഡ്പോയിന്റുകൾ, ഉൽപ്പന്ന വ്യത്യാസങ്ങൾ ലക്ഷ്യമാക്കപ്പെടുന്നു. അതുകൊണ്ട് Googlebot മായ്ക്കുന്നവരെ മാത്രം നോക്കാതെ പൊതുവായ ബോട്ട് ശുചിത്വവും കൈകാര്യം ചെയ്യേണ്ടതാണ്.
- ലോഗിൻ പേജിനായി രണ്ട് ഘട്ട തിരിച്ചറിയൽ, ശ്രമ പരിധി വയ്ക്കുക.
- ഉപയോഗിക്കാത്ത XML-RPC ഫംഗ്ഷനുകൾ പ്രവർത്തനരഹിതമാക്കുക അല്ലെങ്കിൽ നിയന്ത്രിക്കുക.
- തിരയൽ, ഫിൽറ്റർ URL-കൾക്കായി noindex, canonical, robots.txt നীতি ചേർന്നുണ്ടാക്കുക.
- പുതിയ PHP പതിപ്പ്, പുതുക്കിയ തീം, വിശ്വസനീയമായ പ്ലഗിനുകൾ ഉപയോഗിക്കുക.
- SSL സർട്ടിഫിക്കറ്റ് സജീവമാക്കി വയ്ക്കുക; സുരക്ഷിത സെഷൻ, ഫോമുകൾക്കായി HTTPS നിർബന്ധമാണ്. Hostragons SSL സർട്ടിഫിക്കറ്റുകൾ
- ഡൊമെയ്ൻ DNS റെക്കോർഡുകൾ പതിവായി പരിശോധിക്കുക; തെറ്റായ DNS/ദുർബലമായ ഇമെയിൽ റെക്കോർഡുകൾ സുരക്ഷാ അപകടം വളർത്തും. ഡൊമെയ്ൻ പരിശോധനം و DNS നിയന്ത്രണം
പ്രകടനത്തിലെ ബാധ: ബോട്ട് ട്രാഫിക് സേർവർ റിസോഴ്സുകൾ എങ്ങനെ ചെലവഴിക്കുന്നു?
ബോട്ട് ട്രാഫിക് വെറും സുരക്ഷാ പ്രശ്നമല്ല, ഹോസ്റ്റിംഗ് പ്രകടന പ്രശ്നവുമാണ്. സ്റ്റാറ്റിക് ഇമേജ് അഭ്യർത്ഥന കുറഞ്ഞ ചെലവുള്ളതിനാൽ, WordPress തിരയൽ ഫലങ്ങൾ അല്ലെങ്കിൽ WooCommerce ഫിൽറ്റർ അഭ്യർത്ഥന ഡാറ്റാബേസ് ക്വെറികൾ സൃഷ്ടിക്കുന്നു. വ്യാജ Googlebot മിനുട്ടിൽ 300 ഡൈനാമിക് അഭ്യർത്ഥന അയച്ചാൽ കാഷ് ചെയ്യാത്ത പേജുകളിൽ PHP പ്രോസസ്സ് നിറഞ്ഞേക്കാം, ഡാറ്റാബേസ് കണക്ഷനുകൾ വർദ്ധിക്കും, യഥാർത്ഥ ഉപയോക്താക്കൾക്ക് വെബ്സൈറ്റ് മന്ദഗതിയാകും.
ഒരു ഉൽപ്പന്ന ഫിൽറ്റർ പേജ് ശരാശരി 250 ms PHP പ്രോസസ്സ് ചെലവഴിക്കുന്നുവെങ്കിൽ, മിനുട്ടിൽ 600 ബോട്ട് അഭ്യർത്ഥനകൾ 150 സെക്കൻഡ് പ്രോസസ്സിംഗ് ലോഡ് സൃഷ്ടിക്കുന്നു. ഈ ലോഡ് സമാന്തരമായി പ്രവർത്തിക്കുമ്പോൾ CPU പരിധിയോട് അടുത്ത് എത്തുകയും TTFB മൂല്യങ്ങൾ ഉയരും. കോർ വെബ് വൈറ്റൽസ് പ്രകാരം മന്ദഗതിയുള്ള സെർവർ പ്രതികരണം ഉപയോക്തൃ അനുഭവത്തെയും പരിവർത്തന നിരക്കും ബാധിക്കുന്നു. അതുകൊണ്ട് ബോട്ട് തടയൽ സുരക്ഷാ ടീമിന്റെ മാത്രമല്ല, SEOയും പ്രകടന മെച്ചപ്പെടുത്തലും ഉൾപ്പെടുന്ന ഭാഗമാണ്.
ടെസ്റ്റ് ചെയ്യൽ: നിങ്ങളുടെ നിയമങ്ങൾ ശരിയായി പ്രവർത്തിക്കുന്നുണ്ടോ?
.htaccess നിയമം ചേർത്തതിന് ശേഷം മൂന്ന് പരീക്ഷണങ്ങൾ നടത്തുക. ആദ്യം സാധാരണ ബ്രൗസറിൽ സൈറ്റിന്റെ പ്രധാന പേജുകളും പ്രധാന വിഭാഗ പേജുകളും ലോഗിൻ പ്രവാഹങ്ങളും പരിശോധിക്കുക. രണ്ടാമത് Google Search Console URL പരിശോധന ഉപകരണത്തിൽ പ്രധാന URL ഒരു ലൈവ് ടെസ്റ്റ് നടത്തുക. മൂന്നാമത് ലോഗുകളിൽ Googlebot User-Agent ഉപയോഗിച്ച് വരുന്ന സംശയാസ്പദ IP-കൾ 403 ലഭിക്കുന്നുവെന്നും യഥാർത്ഥ Google പരിശോധന നടത്തിയ IP-കൾ തടയപ്പെടുന്നില്ലെന്നും ഉറപ്പാക്കുക.
കമാൻഡ്ലൈനിൽ ടെസ്റ്റ് ചെയ്യുമ്പോൾ നിങ്ങൾ Googlebot ആണെന്ന് കാണിക്കാം; പക്ഷേ ഇത് യഥാർത്ഥ Googlebot ആണെന്ന് തെളിയിക്കുന്നില്ല, User-Agent ഭാഗം മാത്രമാണ് പ്രവർത്തിക്കുന്നതെന്ന് നോക്കുന്നതിനുള്ളത്. യഥാർത്ഥ സ്ഥിരീകരണം IP, DNS വഴി നടത്തണം. 500 പിശക് കിട്ടിയാൽ .htaccess-ൽ സിന്ടാക്സ് പിശക് ഉണ്ടാകാം. അവസാന ചേർത്ത വരികൾ തിരിച്ച് നീക്കം ചെയ്യുക, പിശക് ലോഗുകൾ പരിശോധിക്കുക, സെർവറിന്റെ Apache ഡോക്യുമെന്റേഷൻ പരിശോധിക്കുക.
പരിപാലന പദ്ധതി: നിയമങ്ങൾ എത്ര തവണ പുതുക്കണം?
ബോട്ട് തടയൽ ഒരിക്കൽ മാത്രം ചെയ്യുന്ന കാര്യമല്ല. Google IP പരിധികൾ മാറ്റപ്പെടും, ആക്രമണ ബോട്ടുകളുടെ User-Agent മാതൃകകൾ മാറും, സൈറ്റ് URL ഘടന മാറ്റപ്പെടും. കുറവ് ട്രാഫിക്കുള്ള സൈറ്റുകളിൽ മാസം തോറും ലോഗ് പരിശോധന മതിയാകും. വാർത്താ, ഇ-കൊമേഴ്സ്, പ്രചാരണം ഉള്ള സൈറ്റുകളിൽ ആഴ്ച തോറും പരിശോധിക്കുക നല്ലതാണ്. വലിയ സ്കെയിൽ പ്രോജക്റ്റുകളിൽ ഓട്ടോമാറ്റിക് അലർട്ട് സജ്ജമാക്കുന്നത് ഉത്തമം; ഉദാഹരണത്തിന് Googlebot User-Agent ഉള്ള, പക്ഷേ സ്ഥിരീകരിക്കപ്പെടാത്ത IP-കളിൽ നിന്നുള്ള അഭ്യർത്ഥനകൾ ഒരു പരിധി കടന്നാൽ അറിയിപ്പ് ഉണ്ടാക്കാം.
.htaccess ഫയൽ പതിപ്പായി സൂക്ഷിക്കുക. തീയതി ഉൾപ്പെടുത്തിയ ബാക്കപ്പ് എടുക്കുക മാത്രം പ്രശ്നങ്ങളിൽ പെട്ടെന്നു മടങ്ങാൻ സഹായിക്കും. ഉദാഹരണത്തിന് htaccess-2026-02-15.bak എന്ന പോലെ ഫയൽ നാമം ഉപയോഗിച്ച് മാറ്റം ചരിത്രം സൂക്ഷിക്കുക. ഒരേ സൈറ്റിൽ ഒരുമിച്ച് പ്രവർത്തിക്കുന്നവർക്ക് നിയമം ചേർക്കുന്നവർ എന്ത് മാറ്റം എന്തിന് ചേർത്തുവെന്ന് കുറിച്ച് രേഖപ്പെടുത്തുന്നത് തടസ്സങ്ങൾ കുറയ്ക്കും.
സംക്ഷേപം
.htaccess ഉപയോഗിച്ച് വ്യാജ Googlebot-കളെ കണ്ടെത്തി തടയുന്നത് ശരിയായി നടപ്പിലാക്കിയാൽ SEO ദൃശ്യത സംരക്ഷിക്കുകയും സെർവർ റിസോഴ്സുകൾ ദുർവിനിയോഗം ചെയ്യുന്നതിൽ നിന്നും സംരക്ഷിക്കുകയും ചെയ്യും. അടിസ്ഥാന സിദ്ധാന്തം സുതാര്യമാണ്: User-Agent മാത്രം തെളിവല്ല; IP, DNS, പെരുമാറ്റം, ലോഗ് വിശകലനം എല്ലാം കൂടി വിലയിരുത്തണം. ആദ്യം നിരീക്ഷിക്കുക, പിന്നെ കുറഞ്ഞ അപകടമുള്ള പാതകൾ നിയന്ത്രിക്കുക, ഒടുവിൽ അപ്ഡേറ്റുചെയ്ത Google IP പട്ടികകൾ ഉപയോഗിച്ച് സ്ഥിരീകരണം അടിസ്ഥാനമാക്കിയ തടയൽ നടപ്പിലാക്കുക.
Hostragons അടിസ്ഥാനത്തിൽ നിങ്ങളുടെ സൈറ്റ് ഹോസ്റ്റ് ചെയ്യുമ്പോൾ സുരക്ഷിത ഹോസ്റ്റിംഗ്, പുതിയ SSL, ശരിയായ DNS, സ്ഥിരമായ ബാക്കപ്പ് എന്നിവ സംയോജിപ്പിച്ച് നീണ്ടകാലത്തേക്ക് സ്ഥിരതയുള്ള വെബ്ബ് അനുഭവം ഉറപ്പാക്കാം. നിങ്ങൾക്ക് ഇപ്പോഴുള്ള സൈറ്റ് ബോട്ട് ട്രാഫിക് വിശകലനം ചെയ്ത് തുടങ്ങാം, ആവശ്യമായപ്പോൾ Hostragons ഹോസ്റ്റിംഗ് പാക്കേജുകൾ വഴി കൂടുതൽ ശക്തവും സുരക്ഷിതവുമായ ഘടന തെരഞ്ഞെടുക്കാം.
അടിയന്തര ചോദ്യങ്ങൾ
വ്യാജ Googlebot എന്റെ യഥാർത്ഥ Google റാങ്കിംഗിനെ ബാധിക്കുമോ?
പരോക്ഷമായി അതെ. വ്യാജ Googlebot സെർവർ റിസോഴ്സുകൾ ഉപഭോഗിക്കുകയാണെങ്കിൽ യഥാർത്ഥ ഉപയോക്താക്കളും യഥാർത്ഥ Googlebot-ഉം മന്ദഗതിയിൽ പ്രതികരിക്കും. കൂടാതെ ലോഗുകളും വിശകലന വരികളും മലിനമാകുന്നതിലൂടെ SEO തീരുമാനങ്ങൾ തെറ്റിക്കാനും ഇടയാക്കും. ശരിയായ തടയൽ ക്രോൾ ബജറ്റും പ്രകടനവും സംരക്ഷിക്കാൻ സഹായിക്കുന്നു.
.htaccess ഉപയോഗിച്ച് എല്ലാ Googlebot User-Agent-കളും തടയുന്നത് ശരിയാണോ?
ഇല്ല. ഇത് യഥാർത്ഥ Googlebot-ഉം തടയും, ഇൻഡെക്സിംഗ് പ്രശ്നങ്ങൾ ഉണ്ടാക്കും. Googlebot എന്ന് പറയുന്ന അഭ്യർത്ഥനകൾ ആദ്യം IP അല്ലെങ്കിൽ DNS പ്രകാരം പരിശോധിച്ച് വ്യാജം ആണെന്ന് കണ്ടെത്തിയവ മാത്രമേ തടയാവൂ. ഏറ്റവും സുരക്ഷിത മാർഗം allowlist-ഉം പെരുമാറ്റം അടിസ്ഥാനമാക്കിയ നിയമങ്ങളും ചേർന്നാണ്.
Googlebot IP പട്ടിക എത്ര തവണ പുതുക്കണം?
ഉയർന്ന ട്രാഫിക് സൈറ്റുകളിൽ ആഴ്ച തോറും, ചെറു സൈറ്റുകളിൽ മാസം തോറും പരിശോധിക്കുക ശുപാർശ ചെയ്യപ്പെടുന്നു. ഏറ്റവും നല്ല മാർഗം ഗൂഗിളിന്റെ ഔദ്യോഗിക JSON IP സ്രോതസ്സുകളിൽ നിന്നു സ്വയം പട്ടിക സൃഷ്ടിക്കുക ആണ്. പഴയ IP പരിധികൾ കാലക്രമേണം അപൂർണ്ണമാകുകയും യഥാർത്ഥ Googlebot തെറ്റായി തടയപ്പെടുകയും ചെയ്യും.
.htaccess നിയമം ചേർത്തതിന് ശേഷം 500 പിശക് കിട്ടിയാൽ എന്തു ചെയ്യണം?
500 പിശക് സാധാരണയായി സിന്ടാക്സ് പിശക്, പിന്തുണയില്ലാത്ത Apache ഡയറക്ടീവ്, തെറ്റായ എസ്കേപ്പ് ചിഹ്നം മുതലായവ കൊണ്ടാണ്. അവസാന ചേർത്ത നിയമങ്ങൾ പിൻവലിക്കുക, പിശക് ലോഗുകൾ പരിശോധിക്കുക, ഹോസ്റ്റിംഗ് പരിതസ്ഥിതിയിലെ Apache 2.4, mod_rewrite, if എക്സ്പ്രഷൻ പിന്തുണ ഉറപ്പാക്കുക. അതുകൊണ്ട് മാറ്റം ചെയ്യുന്നതിന് മുമ്പ് .htaccess-ന്റെ ബാക്കപ്പ് എടുക്കുക വളരെ പ്രധാനമാണ്.
CDN അല്ലെങ്കിൽ WAF ഉപയോഗിക്കുന്നുവെങ്കിൽ .htaccess നിയമം ആവശ്യമാണ്?
CDN/WAF ബോട്ട് ഫിൽട്ടറിംഗിന് ശക്തമായ ലെയറുകളാണ്; എന്നാൽ .htaccess ഇപ്പോഴും ബാക്കപ്പ് നിലയിൽ, അപ്ലിക്കേഷൻക്ക് അടുത്ത് സുരക്ഷ നൽകുന്നു. മികച്ച ഫലം ലഭിക്കാൻ CDN/WAF-ൽ റേറ്റ് ലിമിറ്റ്, ബോട്ട് സ്ഥിരീകരണം നടപ്പിലാക്കി, സെർവറിൽ സങ്കീർണ്ണ പാതകൾക്ക് .htaccess നിയന്ത്രണങ്ങൾ ഉപയോഗിക്കുക.