Sari la conținut
Marketrix · Agenție SEO și Marketing Digital

Unealtă gratuită · Verificare robots.txt

O singură linie greșită în robots.txt te poate scoate din Google

Lipește adresa site-ului sau conținutul fișierului tău și-ți spunem, pe limba ta, ce blochează, ce e doar o neatenție și ce trebuie corectat urgent. Plus un robots.txt corectat, generat automat.

Ce este

Ce este robots.txt

Robots.txt e un fișier text simplu, așezat mereu în rădăcina site-ului, la adresa site-ul-tau.ro/robots.txt, prin care le spui roboților motoarelor de căutare ce pagini au voie să acceseze și ce pagini nu. Nu ascunde o pagină din rezultatele Google, doar îi blochează crawlerului accesul la citirea ei. E prima oprire a oricărui robot înainte să înceapă să parcurgă site-ul.

Fișierul e public și îl poate citi oricine, nu doar Google, deci nu e locul unde ascunzi pagini private. Pentru asta ai nevoie de autentificare reală, cu parolă și login. Conține grupuri de reguli, fiecare grup începe cu o linie „User-agent”, care spune cărui robot i se aplică regulile de dedesubt (de exemplu „*” înseamnă toate motoarele de căutare), urmată de linii „Disallow” (blochează o cale) sau „Allow” (permite explicit o cale, utilă în special ca excepție dintr-un Disallow mai general).

Vrei să vezi dacă al tău are probleme? Folosește unealta de mai sus, verifică site-ul direct sau lipește textul dacă lucrezi local, înainte să publici.

Un robots.txt corect, față de unul care blochează tot din greșeală

Diferența poate fi o singură linie. Uite cum arată corect și cum arată o greșeală des întâlnită:

Corect: permite tot, blochează doar zonele private

User-agent: *
Disallow: /admin/
Disallow: /cos-de-cumparaturi/

Sitemap: https://site-ul-tau.ro/sitemap.xml

Greșit: „/” în plus blochează absolut tot site-ul

User-agent: *
Disallow: /

A doua variantă apare des exact așa: cineva a pus „Disallow: /” temporar, cât timp site-ul era în lucru, ca să nu-l indexeze Google prea devreme, și a uitat s-o scoată la lansare. Rezultatul: site-ul rămâne complet invizibil în căutări, uneori luni de zile, până observă cineva.

Ce poate strica un robots.txt scris greșit

Cele mai frecvente trei greșeli, în ordinea gravității: prima e blocarea întregului site cu „Disallow: /” sub „User-agent: *”, care scoate din Google absolut tot ce ai publicat. A doua e blocarea unei secțiuni întregi din greșeală, de exemplu „/blog” sau „/produse”, când intenția era să blochezi doar o pagină. A treia, mai subtilă, e blocarea fișierelor CSS și JavaScript: Google are nevoie să încarce aceste resurse ca să vadă pagina exact cum o vede și un vizitator, iar dacă le blochezi riști ca randarea să iasă stricată în ochii lui, chiar dacă pagina arată bine în browser.

Toate trei se întâmplă din același motiv: o linie copiată dintr-un alt site, un plugin care generează reguli implicite prea agresive sau o modificare manuală neverificată înainte de publicare.

Cum îți testezi robots.txt-ul

Cel mai rapid: folosești unealta de mai sus, care citește fișierul direct de pe site-ul tău și-ți arată problemele pe limba ta, nu doar cod roșu fără explicație.

Manual, poți deschide oricând site-ul-tau.ro/robots.txt direct în browser, e un fișier text public, îl vezi exact cum îl vede și Google. Pentru o verificare mai avansată, Search Console are un raport de indexare care-ți arată dacă vreo pagină e „Blocată de robots.txt”, deci dacă efectul chiar se vede în practică, nu doar în teorie.

Reține un detaliu care scapă des: robots.txt e case-sensitive pe căi. „/Admin” și „/admin” sunt tratate ca fiind complet diferite, deci o literă mare pusă din greșeală poate face o regulă inutilă fără ca tu să-ți dai seama.

Robots.txt și noindex nu fac același lucru

E cea mai des întâlnită confuzie legată de robots.txt: robots.txt oprește citirea unei pagini, noindex oprește afișarea ei în rezultate. Sunt două comenzi diferite, cu efecte diferite, și combinate greșit se anulează una pe cealaltă.

Dacă blochezi o pagină în robots.txt, iar pe acea pagină ai și un tag noindex în cod, Google nu va vedea niciodată noindex-ul, pentru că nu are voie să citească pagina ca să ajungă la el. Rezultatul practic e opusul a ceea ce voiai: dacă pagina are linkuri către ea, Google poate afișa totuși URL-ul în căutări (fără titlu, fără descriere), exact situația pe care noindex ar fi trebuit s-o evite.

Regula simplă: dacă vrei ca o pagină să nu apară deloc în Google, folosește noindex și lasă robots.txt s-o citească. Robots.txt îl rezervi pentru pagini pe care nu vrei nici măcar să le parcurgă crawlerul, de obicei din motive de eficiență (zone administrative, filtre cu mii de combinații, coșuri de cumpărături), nu din motive de vizibilitate.

Întrebări frecvente

Ce vrei să știi despre robots.txt

Dacă fișierul lipsește (răspuns 404 la /robots.txt), motoarele de căutare presupun că au voie să acceseze tot site-ul. Nu e o eroare în sine, dar pierzi controlul: nu poți bloca secțiuni pe care nu vrei să le vadă crawlerele și nu ai un loc standard unde să declari sitemap-ul.

Nu direct. Robots.txt blochează doar citirea paginii de către crawler. Dacă pagina e blocată dar are linkuri către ea din altă parte, Google poate totuși afișa URL-ul în rezultate, fără titlu și descriere, pentru că știe că există, dar nu-i poate citi conținutul. Ca să elimini sigur o pagină din rezultate, ai nevoie de noindex, nu de robots.txt.

Da. În loc de „User-agent: *” folosești „User-agent: Googlebot” urmat de regulile tale, într-un grup separat. Fiecare crawler citește doar grupul care i se potrivește (sau grupul „*” dacă nu are unul dedicat).

Pentru că robots.txt controlează accesul la citire, nu indexarea. Dacă pagina are linkuri către ea (interne sau externe), Google poate indexa URL-ul ca atare, fără să-i cunoască conținutul. E confuzia cea mai des întâlnită legată de robots.txt.

Nu. Fișierul e public și oricine îl poate citi la site-ul-tau.ro/robots.txt, deci nu e locul unde ascunzi pagini private. Pentru asta ai nevoie de autentificare reală, cu parolă și login.

Ori de câte ori schimbi platforma, faci o migrare de site sau observi o scădere neobișnuită de trafic organic. E un fișier mic, dar o singură linie greșită poate bloca tot site-ul din Google, așa că merită verificat după orice schimbare majoră.

Robots.txt e doar o piesă. Vrei să vezi tot tabloul?

Auditul gratuit acoperă toată partea tehnică, plus vizibilitatea reală în Google, nu doar un fișier.

Vreau auditul gratuit

Sau sună-ne direct la 0756 737 033

Sună Verifică gratuit