Salt la conținut
Garbuz.Online
SEO Wiki · SEO tehnic

robots.txt

Autor: Specialist SEO Publicat

Definiție

robots.txt — robots.txt este un fișier text din rădăcina site-ului care spune roboților ce secțiuni pot sau nu pot fi scanate.

Răspuns scurt

robots.txt controlează scanarea, nu indexarea. Pentru a scoate o pagină din index folosiți noindex — iar pagina trebuie să rămână accesibilă pentru scanare.

Cum funcționează

Fișierul se află la /robots.txt și se aplică doar gazdei și protocolului respectiv. Regulile sunt grupate pe User-agent; când mai multe reguli se potrivesc, câștigă cea mai lungă (mai specifică), iar la egalitate — Allow. Comportamentul este standardizat în RFC 9309.

robots
User-agent: *
Disallow: /admin/
Disallow: /*?sort=

Sitemap: https://garbuz.online/sitemap.xml

Greșeli frecvente

  • Disallow: / lăsat după lansarea de pe staging;
  • blocarea fișierelor CSS/JS necesare randării;
  • blocarea unei pagini cu noindex (robotul nu mai vede directiva);
  • lipsa directivei Sitemap.

Cum verificați

Folosiți raportul robots.txt din Search Console și testerul robots.txt.

Surse

  1. RFC 9309: Robots Exclusion Protocol — IETF
  2. Introduction to robots.txt — Google Search Central
→sitemap.xml→

Descrieți proiectul

Discutăm proiectul dvs.?

Lăsați adresa site-ului și obiectivul — în decurs de o zi lucrătoare primiți primele observații și pașii următori.