Blog SEO · SEO tehnic

Pagini neindexate în Google Search Console: cauze și soluții

Pe scurt

  • Paginile neindexate nu sunt întotdeauna o problemă: unele sunt excluse intenționat (noindex, redirecturi, duplicate cu canonical). Contează doar paginile care ar trebui să fie în Google și lipsesc.
  • Raportul Indexarea paginilor din Search Console îți spune pentru fiecare adresă motivul exact. Începe de acolo, nu de la presupuneri.
  • Statusurile „Accesată – neindexată momentan” și „Descoperită – neindexată momentan” arată adesea conținut sau semnale insuficiente, nu o defecțiune tehnică.
  • Cauzele tehnice sunt cele mai ușor de reparat: noindex, robots.txt, redirecturi greșite, erori 4xx și 5xx, canonical care indică altă adresă.
  • Google nu garantează indexarea tuturor paginilor. Prioritizează paginile care aduc valoare și îmbunătățește-le înainte să ceri din nou indexarea.

Paginile neindexate sunt adrese pe care Google le cunoaște, dar nu le-a adăugat în indexul de căutare, așa că nu pot apărea în rezultate. Nu sunt întotdeauna o problemă: unele sunt excluse intenționat. Contează doar cele care ar trebui să fie vizibile și lipsesc. Raportul din Google Search Console îți arată motivul pentru fiecare, iar mai jos le parcurgem pe cele frecvente, cu soluții.

Unde găsești paginile neindexate și cum citești raportul

În Search Console, deschide Indexarea paginilor (în engleză, Page indexing). Raportul împarte adresele în două grupe: indexate și neindexate. La cele neindexate, Google afișează un motiv pentru fiecare grup de adrese, cu lista de exemple.

Trei lucruri de ținut minte:

  • Numărul total de pagini neindexate nu este un scor. Un site cu filtre, parametri și variante poate avea mii de adrese excluse corect.
  • Motivul contează mai mult decât cifra. Același status poate fi normal pentru o pagină și o problemă pentru alta.
  • Raportul se actualizează cu întârziere. Nu te aștepta să vezi azi efectul unei modificări făcute azi.

Dacă nu ai lucrat încă cu instrumentul, ghidul Google Search Console pentru începători explică rapoartele de bază. Problemele tehnice de acest tip fac parte din SEO-ul tehnic; urmează pașii de mai jos.

Cele mai frecvente statusuri și ce faci cu fiecare

Denumirile exacte din interfață pot diferi ușor ca traducere, dar sensul este cel din documentația Google.

Status (în engleză)Ce înseamnăCauză frecventăCe faci
Crawled – currently not indexedGoogle a accesat pagina, dar nu a indexat-oConținut slab sau redundant, puține semnaleÎmbunătățești pagina, o legi intern, apoi aștepți
Discovered – currently not indexedGoogle știe adresa, dar nu a accesat-o încăSite nou, semnale slabe, serverul lentLinkuri interne, sitemap, verifici viteza serverului
Excluded by ‘noindex’ tagPagina cere explicit să nu fie indexatăEtichetă noindex pusă intenționat sau din greșealăScoți noindex dacă pagina trebuie indexată
Blocked by robots.txtCrawlarea e interzisăRegulă Disallow prea largăCorectezi robots.txt
Alternate page with proper canonical tagPagina indică altă adresă drept canonicăVariante de pagină, parametriDe obicei nimic: e corect
Duplicate without user-selected canonicalDuplicat, fără canonical declaratAcelași conținut pe mai multe adreseDeclari canonicalul dorit
Duplicate, Google chose different canonical than userGoogle a ales alt canonical decât cel declaratConținutul nu e suficient de similar sau semnalele se contrazicVerifici semnalele contradictorii
Soft 404Pagina pare goală sau de eroare, dar returnează 200Pagini fără conținut, cu mesaj de eroareReturnezi 404 sau completezi conținutul
Not found (404)Adresa nu existăLink rupt, pagină ștearsăRedirecționezi dacă există echivalent
Page with redirectAdresa redirecționează în altă parteRedirect intenționatDe obicei nimic: e corect
Server error (5xx)Serverul a dat eroareSupraîncărcare, configurareRepari serverul
Redirect errorRedirect în buclă sau prea lungLanț de redirecturiCorectezi lanțul

Citește prima coloană ca pe un diagnostic, nu ca pe o vină. Mai jos detaliem grupurile care provoacă cele mai multe întrebări.

„Accesată – neindexată momentan” și „Descoperită – neindexată momentan”

Sunt statusurile cel mai des întâlnite și cel mai des înțelese greșit.

Descoperită – neindexată momentan înseamnă că Google a aflat de pagină (din sitemap sau de la un link), dar încă nu a crawlat-o. Documentația spune că de obicei crawlarea este amânată ca să nu supraîncarce site-ul. Pe un site mic și nou, e adesea o chestiune de timp. Ce poți face: leagă pagina de pagini deja indexate, adaugă-o într-un sitemap curat și verifică dacă serverul răspunde rapid.

Accesată – neindexată momentan este mai neplăcut: Google a vizitat pagina și a decis, cel puțin deocamdată, să n-o păstreze. Documentația notează că pagina poate fi indexată ulterior, fără să o retrimiți. De regulă, motivul ține de pagină, nu de tehnică:

  • conținut subțire, copiat sau foarte asemănător cu alte pagini;
  • pagină fără rol clar sau fără răspuns pentru o interogare reală;
  • pagină izolată, la care nu duce niciun link intern relevant;
  • site cu multe pagini de calitate slabă, ceea ce poate scădea încrederea generală în el.

Soluția este îmbunătățirea paginii: răspuns direct, informații proprii, exemple, structură clară, linkuri interne din pagini puternice. Principiile sunt în articolul despre linkuri interne și arhitectura site-ului. Dacă ai multe pagini asemănătoare, consolidează-le într-una mai bună.

Cauze tehnice, cele mai ușor de reparat

Noindex rămas din greșeală

Eticheta <meta name="robots" content="noindex"> sau antetul X-Robots-Tag: noindex exclud pagina. Apare des după lansări, când rămâne configurarea de test. Verifică sursa paginii, nu doar ce arată pluginul SEO.

Blocarea prin robots.txt

Un Disallow prea larg interzice crawlarea. Atenție la diferență: robots.txt împiedică crawlarea, nu garantează excluderea din index. Dacă vrei ca o pagină să nu apară în rezultate, folosește noindex și lasă pagina crawlabilă, altfel Google nu poate citi eticheta. Pentru un fișier corect, poți folosi generatorul de robots.txt.

Canonical care indică altă adresă

Dacă o pagină declară drept canonică altă adresă, Google o tratează ca alternativă și nu o indexează. Corect pentru variante cu parametri; greșit când canonicalul a fost copiat din alt șablon. Explicația completă este în articolul despre canonical.

Erori 4xx și 5xx

Adresele care returnează 404 nu se indexează (și nici nu trebuie). Problema apare când linkurile interne sau sitemapul trimit către ele. Erorile 5xx indică probleme de server; dacă sunt repetate, Google crawlează mai rar. Curăță linkurile rupte și, unde ai echivalent, folosește un redirect 301; detalii în ghidul despre redirecturi.

Soft 404

Pagini care arată a „nimic găsit” sau sunt aproape goale, dar întorc 200. Fie le faci să returneze 404, fie le dai conținut real. Se întâmplă des la categorii goale și la pagini de căutare internă.

Redirecturi

„Pagină cu redirecționare” este normală pentru adresele vechi. Problemele sunt lanțurile și buclele („Redirect error”): fiecare adresă veche ar trebui să ducă direct către destinația finală.

Conținut care se încarcă prin JavaScript

Dacă textul apare abia după randare, Google poate vedea o pagină goală. Vezi articolul despre JavaScript SEO.

Cum diagnostichezi o pagină, pas cu pas

  1. Deschide inspecția URL-ului pentru adresa respectivă și citește motivul, canonicalul ales de Google și data ultimei crawlări.
  2. Rulează testul live ca să vezi dacă pagina poate fi accesată și randată acum.
  3. Verifică sursa paginii: meta robots, canonical, antete, conținutul principal în HTML.
  4. Verifică robots.txt: adresa nu trebuie blocată.
  5. Verifică prezența în sitemap și că sitemapul conține doar adrese indexabile cu 200; vezi ghidul despre sitemap XML.
  6. Verifică linkurile interne: câte pagini indexate duc spre ea și cu ce anchor.
  7. Evaluează calitatea: pagina răspunde mai bine decât ce există deja pe subiect?
  8. Repară și cere validarea din raport (butonul „Validează remedierea”, în engleză Validate fix) sau cere indexarea unei pagini importante prin inspecția URL-ului. Conform Google, validarea durează de obicei cam două săptămâni, uneori mult mai mult.

Cum prioritizezi când ai multe adrese

Pe un site cu sute sau mii de adrese, nu le poți repara pe toate deodată și nici nu trebuie. Ordonează-le după impactul asupra afacerii:

  1. Paginile care aduc bani: servicii, produse, categorii principale, pagini de contact. Dacă una dintre ele lipsește din index, este urgența numărul unu.
  2. Paginile care susțin pe cele de mai sus: articole și ghiduri legate de servicii, care duc linkuri interne spre ele.
  3. Paginile noi, publicate recent: dă-le câteva săptămâni, apoi verifică.
  4. Restul: adrese tehnice, arhive, variante. Le rezolvi la sfârșit sau le excluzi conștient.

Un exemplu de raționament

Să zicem că raportul arată 120 de adrese în „Accesată – neindexată momentan”. Deschizi lista și vezi că 90 sunt pagini de etichete (tag-uri) cu două articole fiecare, 20 sunt articole vechi, foarte scurte, iar 10 sunt servicii importante. Nu trimiți toate 120 la indexare. Decizia rațională: servicii mai întâi (le îmbunătățești și le legi din pagina principală), articolele vechi le unești sau le extinzi, iar paginile de etichete le pui pe noindex dacă nu au valoare proprie. Rezultatul nu este un raport cu zero adrese neindexate, ci un site în care ce contează este indexat și ce nu contează este exclus intenționat.

Acest tip de decizie se ia mai ușor dacă ai definit ce vrei să măsori; vezi articolul despre KPI SEO.

Când e normal ca paginile să fie neindexate

Un raport „curat” nu înseamnă toate adresele indexate. Sunt normale, între altele:

  • adresele cu noindex puse de tine (pagini de mulțumire, coș, cont, rezultate de căutare internă);
  • variantele cu canonical către pagina principală;
  • adresele vechi care redirecționează;
  • paginile paginate sau filtrate pe care nu vrei să le indexezi;
  • paginile de test sau interne.

Pe un magazin online, filtrele și parametrii generează adesea mii de adrese excluse corect. Ce trebuie urmărit este ca paginile de categorie, produs și articol importante să fie indexate. Reține doar că problemele de buget de crawlare apar în special pe site-uri foarte mari.

Greșeli frecvente

  • Cererea repetată de indexare pentru aceleași pagini, în loc să fie reparată cauza.
  • Ștergerea paginilor valoroase doar pentru a micșora numărul din raport.
  • Blocarea în robots.txt a paginilor pe care le vrei scoase din index.
  • Canonicale copiate între șabloane.
  • Sitemap cu adrese redirecționate, 404 sau noindex.
  • Ignorarea calității: repari tehnica, dar conținutul rămâne subțire.
  • Panica la fiecare variație a numărului de pagini.
  • Presupunerea că „indexat” înseamnă „va rankea”.

Limite: ce nu poți controla

Google spune explicit că nu garantează indexarea tuturor paginilor. Chiar și un site tehnic impecabil poate avea pagini pe care Google nu le consideră suficient de utile. De asemenea:

  • indexarea unei pagini noi nu are un termen garantat;
  • nu poți obliga Google să indexeze o pagină, doar îi poți elimina obstacolele;
  • raportul din Search Console are întârzieri și eșantioane limitate la exemple;
  • la site-uri foarte mici, câteva pagini neindexate sunt statistic normale.

Concluzie: pașii următori

Pagina neindexată este un simptom, iar motivul se află în raport. Procedează astfel:

  1. Deschide raportul de indexare și sortează grupurile după importanța paginilor, nu după număr.
  2. Rezolvă întâi cauzele tehnice clare: noindex, robots.txt, canonical, 4xx, 5xx, redirecturi.
  3. Pentru „Accesată – neindexată”, îmbunătățește pagina și leag-o de alte pagini indexate, apoi dă-i timp.
  4. Cere validarea sau indexarea doar după ce ai reparat cauza.

Dacă ai sute de adrese în situații neclare sau pagini importante care nu intră în Google, auditul de SEO tehnic identifică și prioritizează cauzele. Mai multe ghiduri găsești pe blog.

Surse și lectură suplimentară

Întrebări frecvente

Întrebări frecvente

Cât timp trebuie să aștept înainte să consider o pagină neindexată?

Pentru o pagină nouă, câteva zile până la câteva săptămâni sunt normale, mai ales pe un site tânăr. Dacă după două–trei săptămâni pagina importantă tot nu e indexată, verifică motivul în inspecția URL-ului. Nu cere indexarea de zeci de ori: nu accelerează procesul.

Merită să cer indexarea manual pentru fiecare pagină?

Doar pentru pagini importante sau recent modificate, după ce ai verificat că nu au probleme tehnice. Cererea nu garantează indexarea; ea doar pune adresa în coada de crawlare. Pentru un site întreg, mai eficient este un sitemap corect și linkuri interne către paginile noi.

Pot reduce numărul de pagini neindexate prin ștergerea lor?

Uneori da, dar nu e un scop în sine. Pagini subțiri, duplicate sau fără utilitate pot fi unite, îmbunătățite sau scoase cu 404 ori 410. Dar paginile excluse intenționat, cum ar fi filtrele sau variantele cu canonical, nu trebuie șterse doar ca raportul să arate mai curat.

De ce apar în raport pagini pe care nu le-am creat?

Pot veni din parametri de URL, din filtre, din pagini de căutare internă, din variante cu și fără slash final sau din adrese vechi. Google le descoperă prin linkuri sau sitemap. Dacă nu au valoare, controlează-le cu canonical, noindex sau prin eliminarea linkurilor care duc spre ele.

Ce înseamnă „Indexată, deși blocată de robots.txt”?

Google a indexat adresa deși fișierul robots.txt o blochează la crawlare, de obicei pentru că a descoperit-o prin linkuri externe sau interne. Dacă vrei să o scoți din rezultate, folosește noindex și permite crawlarea, ca Google să poată citi eticheta. Robots.txt singur nu împiedică indexarea.

Serviciul asociat

SEO tehnic & viteză

Vezi serviciul →

Hai să creștem traficul organic al site-ului tău

Trimite-ne adresa site-ului și îți răspundem cu o analiză inițială gratuită și o strategie concretă de optimizare SEO — fără obligații.