Blog SEO · SEO tehnic

Canonical și conținut duplicat: când și cum folosești rel=canonical

Pe scurt

  • Canonical URL este adresa pe care o recomanzi Google ca versiune principală dintre mai multe pagini identice sau foarte asemănătoare.
  • Rel=canonical este un semnal puternic, nu o comandă: Google poate alege altă adresă dacă semnalele tale se contrazic.
  • Conținutul duplicat nu atrage, în sine, o penalizare; problema este dispersarea semnalelor și alegerea greșită a paginii afișate.
  • Fiecare pagină indexabilă ar trebui să aibă un canonical absolut către ea însăși sau către echivalentul ei preferat, pus în head.
  • Verifică în Inspecția URL diferența dintre canonicalul declarat de tine și cel ales de Google.

Canonical URL este adresa pe care o recomanzi Google ca versiune principală, atunci când același conținut sau unul foarte asemănător apare la mai multe adrese. O declari cu eticheta rel="canonical" în <head>, cu un antet HTTP sau prin redirect. Google tratează eticheta ca un semnal puternic, nu ca pe o comandă, și decide singur adresa afișată în rezultate.

Duplicatele apar aproape fără să le vezi: aceeași pagină cu și fără www, cu ?utm_source=, cu sortare diferită, în variantă print sau în mai multe categorii. Fără indicații, Google alege singur o variantă, iar alegerea poate să nu fie cea dorită. În ghid vezi cum judecă Google duplicatele, când folosești canonicalul, cum arată codul, ce se întâmplă în magazine online și cum verifici rezultatul. Este o parte centrală a SEO-ului tehnic.

Ce este conținutul duplicat și de ce nu înseamnă penalizare

Conținutul duplicat este text identic sau foarte asemănător care poate fi accesat la mai multe URL-uri, în interiorul unui site sau între site-uri. Cauzele frecvente sunt tehnice, nu intenționate:

  • variante http și https, www și fără www, cu slash final sau fără;
  • parametri de urmărire sau de sortare (?utm_medium=, ?sort=pret);
  • aceeași pagină de produs în mai multe categorii;
  • pagini de arhivă, etichete sau tipărire care repetă articole;
  • conținut republicat pe alt site, cum se întâmplă cu advertorialele.

Contrar unei idei răspândite, Google nu are o „penalizare pentru duplicate” în cazurile normale. El grupează paginile similare, alege o variantă reprezentativă și o afișează. Penalizările vizează duplicarea făcută cu intenția de a păcăli, nu o pagină accesibilă prin trei adrese.

Problemele reale sunt altele:

  1. Dispersarea semnalelor. Linkurile și interacțiunile se împart între variante, în loc să se adune la una.
  2. Alegerea greșită. Google poate afișa varianta cu parametri sau o pagină secundară.
  3. Risipa de crawlare. Google cheltuiește cereri pe copii, nu pe pagini noi.

Nu confunda duplicatul tehnic cu canibalizarea cuvintelor-cheie: acolo paginile sunt diferite, dar concurează pentru aceeași căutare.

Cum funcționează rel=canonical

Google acceptă mai multe metode de a spune care adresă este preferată, cu forță diferită, conform documentației:

MetodăCum o puiForță
Redirect permanent301 sau 308 de la duplicat la pagina principalăSemnal puternic
rel="canonical" în <head><link rel="canonical" href="...">Semnal puternic
Antet HTTP LinkLink: <url>; rel="canonical"Puternic; util pentru PDF-uri și fișiere
Includere în sitemapDoar adresa canonică în sitemapSemnal slab

Observă că redirectul face ca duplicatul să dispară pentru utilizatori, pe când canonicalul păstrează ambele pagini accesibile. Dacă varianta nu trebuie să mai existe, alege redirectul; despre tipuri și configurare vezi ghidul despre redirecturile 301 și 302. Dacă ambele pagini trebuie să rămână accesibile (filtre, parametri, variante), alege canonicalul.

Fiecare metodă poate fi combinată cu celelalte, atât timp cât toate indică aceeași adresă. Semnalele care se contrazic scad șansele ca Google să respecte preferința ta.

Cum implementezi canonicalul corect

Regulile din documentația Google:

  1. Folosește URL absolut, cu protocol și domeniu complet, nu cale relativă.
  2. Pune un singur canonical pe pagină, în <head>. O etichetă apărută în <body> este, în general, ignorată.
  3. Pune canonicalul și pe pagina preferată, către ea însăși (auto-referențial).
  4. Indică o pagină accesibilă, cu răspuns 200, nu o pagină redirecționată, blocată sau inexistentă; altfel Google poate ignora semnalul.
  5. Fii consecvent. Nu declara canonicale diferite prin HTML, antet și sitemap.
  6. Pune-l în HTML-ul servit, nu injectat cu JavaScript, ori de câte ori e posibil.

Exemplu în HTML, pe pagina de categorie, care poate fi accesată și cu parametri în adresă:

<head>
  <link rel="canonical" href="https://www.exemplu.ro/pantofi-sport/" />
</head>

Exemplu pentru un PDF, în antetul HTTP (Apache):

<Files "ghid-copie.pdf">
  Header add Link '<https://www.exemplu.ro/ghid.pdf>; rel="canonical"'
</Files>

Pe WordPress, pluginurile SEO adaugă implicit un canonical auto-referențial. Verifică pe câteva tipuri de pagini (articole, categorii, pagini paginate, arhive) că etichetele sunt cele așteptate. Setările de bază ale platformei sunt în ghidul WordPress SEO.

Ce faci în cazurile practice

Aici se pierde cel mai mult timp, deci un tabel cu decizii uzuale:

SituațieCe faci
http/https, www/fără wwwRedirect 301 către versiunea aleasă, plus canonical auto-referențial
Parametri UTM și de sesiuneCanonical către adresa fără parametri
Sortări și filtre fără valoare de căutareCanonical către categoria de bază sau noindex, nu ambele fără motiv
Filtru cu cerere reală (categorie + brand)Pagină proprie indexabilă, cu conținut și canonical propriu
Pagini paginate (?pagina=2)Fiecare pagină are canonicalul ei; nu indica pagina 1 pentru toate
Produs în mai multe categoriiUn singur URL canonic al produsului, folosit în linkuri interne
Conținut republicat pe alt siteCanonical către sursa originală sau noindex la partener
Versiuni de limbăFiecare versiune cu canonical către ea însăși și adnotări hreflang

Pentru magazine, regula paginării merită reținută: indicarea paginii 1 ca versiune canonică pentru întregul set ascunde produsele din paginile următoare. Structura paginilor de categorie e tratată în ghidul despre categoriile din magazin.

Pentru conținutul republicat, de exemplu un articol publicat și pe un site partener, cere un canonical către sursa ta. Dacă lucrezi cu publicații externe, diferența dintre formatele de publicare este explicată în comparația dintre comunicat de presă și advertorial. Pentru limbi, canonicalul trebuie să rămână în aceeași limbă; vezi ghidul hreflang și generatorul de hreflang.

Exemplu: aceeași categorie, cinci adrese

Să presupunem un magazin cu categoria „Pantofi sport”. Aceeași listă de produse poate fi deschisă astfel:

  1. https://www.exemplu.ro/pantofi-sport/
  2. https://www.exemplu.ro/pantofi-sport/?sort=pret
  3. https://www.exemplu.ro/pantofi-sport/?utm_source=newsletter
  4. https://www.exemplu.ro/pantofi-sport/?pagina=2
  5. https://www.exemplu.ro/pantofi-sport/nike/

Decizia, adresă cu adresă:

  • Adresa 1 este versiunea preferată: are canonical către ea însăși.
  • Adresele 2 și 3 afișează aceleași produse, doar altfel ordonate sau urmărite. Au canonical către adresa 1, iar linkurile interne nu trebuie să le folosească niciodată.
  • Adresa 4 este o pagină diferită din serie, cu alte produse. Are canonical către ea însăși, nu către adresa 1.
  • Adresa 5 este o categorie plus brand, cu cerere reală de căutare. Merită conținut propriu (titlu, text introductiv, produse relevante) și canonical către ea însăși.

Fără aceste decizii, un crawler poate descoperi sute de combinații și le poate trata ca pagini distincte. Cu ele, Google primește aceeași poveste din mai multe surse: HTML, linkuri interne și sitemap, toate indicând aceleași adrese.

Canonical, noindex, redirect sau robots.txt: ce alegi

Instrumentele se confundă des, deși fac lucruri diferite:

InstrumentEfectFolosește-l când
CanonicalConsolidează semnalele pe o singură adresă; ambele pagini rămân accesibileDuplicate care trebuie să existe
Redirect 301Mută utilizatorii și semnalele; duplicatul disparePagina veche nu mai trebuie accesată
noindexScoate pagina din indice, fără consolidarePagini fără valoare de căutare (mulțumiri, căutări interne)
robots.txtBlochează crawlarea, nu indexareaZone care nu trebuie crawlate; nu pentru consolidare

Documentația Google recomandă explicit să nu folosești robots.txt pentru canonicalizare: dacă blochezi accesul, Google nu poate citi eticheta canonical. Despre noindex, documentația nu îl recomandă pentru a influența alegerea canonicalului în interiorul aceluiași site, pentru că scoate complet pagina din Search. Nu combina nici noindex cu canonical către altă pagină, pentru că trimiți mesaje opuse. Pentru robots.txt, generatorul te ajută să eviți blocările accidentale.

Cum verifici ce canonical alege Google

Canonicalul tău este o sugestie. Verifică ce a ales Google:

  1. În Search Console, deschide Inspecția URL pentru pagina respectivă.
  2. Citește „Canonical declarat de utilizator” și „Canonical ales de Google”. Dacă diferă, există un conflict de semnale.
  3. Deschide raportul Pagini și caută motivele de excludere legate de canonical: „Duplicate without user-selected canonical”, „Duplicate, Google chose different canonical than user” și „Alternate page with proper canonical tag”.
  4. Pentru ultimul, nu e neapărat o problemă: înseamnă că pagina duplicat a fost corect asociată cu originalul.

Dacă Google alege altă adresă decât a ta, verifică linkurile interne (indică variante diferite?), sitemap-ul, redirecturile și diferențele de conținut între pagini. Cum se citesc aceste rapoarte este explicat în ghidul Search Console, iar cauzele excluderilor în ghidul despre pagini neindexate.

Greșeli frecvente

  • Canonical relativ. href="/pantofi-sport/" poate fi interpretat greșit; folosește adrese complete.
  • Canonical către o pagină redirecționată sau cu 404. Google poate ignora semnalul.
  • Mai multe canonicale pe aceeași pagină. De obicei una vine din temă, alta din plugin.
  • Canonical în <body>. Eticheta trebuie să fie în <head>.
  • Toate paginile paginate către prima. Pierzi produsele sau articolele din paginile următoare.
  • Canonical spre pagina principală pe tot site-ul. Un șablon greșit poate indica toate paginile spre homepage, ceea ce le scoate din indice.
  • Sitemap cu adrese necanonice. Slăbește mesajul; vezi ghidul despre sitemap XML.
  • Canonical între pagini diferite ca subiect. Canonicalul e pentru conținut echivalent, nu un mod de a „muta” autoritatea.

Când canonicalul nu rezolvă problema

Fii realist cu limitele:

  • Este un indiciu: Google poate să-l ignore dacă paginile sunt prea diferite sau dacă alte semnale (linkuri interne, redirecturi) indică altceva.
  • Nu rezolvă conținutul subțire sau scris pe șablon. Dacă pagini diferite spun practic același lucru, soluția este unificarea sau diferențierea conținutului.
  • Nu înlocuiește arhitectura: dacă site-ul produce mii de variante prin filtre, trebuie limitat și modul în care se creează aceste URL-uri.
  • Nu poate corecta o pagină blocată sau neindexabilă.

Concluzie și pașii următori

Un plan simplu:

  1. Alege versiunea unică a domeniului (HTTPS, cu sau fără www) și redirecționează restul.
  2. Verifică ca fiecare pagină indexabilă să aibă un canonical absolut, în <head>, auto-referențial.
  3. Tratează parametrii și filtrele după regula „are cerere de căutare sau nu”.
  4. Urmărește în Search Console diferențele dintre canonicalul declarat și cel ales de Google.
  5. Păstrează linkurile interne și sitemap-ul pe adresele canonice.

Dacă vrei ca verificarea să fie făcută pe site-ul tău, de la canonicale la indexare, vezi serviciul de optimizare SEO tehnică sau scrie-ne prin contact.

Surse și lectură suplimentară

Întrebări frecvente

Întrebări frecvente

Conținutul duplicat duce la penalizare din partea Google?

De regulă nu. Google grupează paginile similare și alege una pentru afișare. Penalizările apar pentru duplicare făcută cu scopul de a manipula rezultatele, nu pentru situații tehnice normale, precum parametri sau variante de produs. Riscul real este că Google afișează altă pagină decât cea dorită de tine.

Trebuie să pun canonical și pe pagina originală?

Da, este recomandat un canonical care indică pagina însăși, numit auto-referențial. Protejează în fața parametrilor adăugați de campanii sau de linkuri externe și arată clar care este adresa preferată. Multe pluginuri SEO îl adaugă automat; merită să verifici dacă îl adaugă corect.

Pot folosi canonical între două domenii diferite?

Da, Google acceptă canonicale între domenii, de exemplu când un conținut este republicat pe alt site. Rămâne un indiciu, nu o obligație. Funcționează mai bine când paginile sunt aproape identice și când partenerul chiar adaugă eticheta către sursa originală.

Cât durează până Google respectă schimbarea canonicalului?

Nu există un termen fix. Google trebuie să recrawleze paginile implicate și să reevalueze grupul de duplicate; poate dura de la câteva zile la câteva săptămâni. Poți cere reindexarea paginii cheie din Inspecția URL, dar nu garantează o schimbare imediată.

Canonicalul ajută cu paginile de categorie cu filtre?

Poate ajuta, dacă filtrul produce variante aproape identice cu categoria de bază. Dacă un filtru răspunde unei căutări reale, cum ar fi o categorie plus un brand, merită o pagină proprie, indexabilă, cu conținut distinct. Decizia ține de cererea reală din căutări, nu de regula tehnică.

Serviciul asociat

SEO tehnic & viteză

Vezi serviciul →

Hai să creștem traficul organic al site-ului tău

Trimite-ne adresa site-ului și îți răspundem cu o analiză inițială gratuită și o strategie concretă de optimizare SEO — fără obligații.