Acasă › Blog › Cum raportați și rezolvați conținut duplicat în Google
Cum raportați și rezolvați conținut duplicat în Google
4 august 2025 · Dorel Tănase, specialist în servicii SEO din 2007 · Google
Cum raportați și rezolvați conținut duplicat în Google sunt două întrebări diferite, cu răspunsuri diferite. Duplicatele din propriul site se rezolvă tehnic, cu canonical, redirecționări și noindex. Conținutul copiat de alt site se raportează, prin cererea de eliminare pentru drepturi de autor sau prin formularul de spam, și se apără prin semnale care spun cine e originalul. Ghidul le tratează pe amândouă.
Pornim de la ce spune Google: conținutul duplicat nu este o penalizare, cu excepția cazurilor deliberate, de tip site copiat integral. Costul lui este altul: Google alege o singură versiune, uneori nu pe cea dorită, împarte semnalele între adrese și cheltuie buget de accesare pe copii.
Cum raportați și rezolvați conținut duplicat în Google
Tipurile de duplicate din propriul site
- Variante de adresă ale aceleiași pagini: http și https, cu și fără www, cu și fără slash final, majuscule în cale, index.php la final.
- Parametri în adresă: sortări, filtre, id-uri de sesiune, etichete de campanie (utm_), paginare cu parametru.
- Același produs în mai multe categorii, cu adrese diferite, sau același articol sub mai multe etichete.
- Versiuni pentru tipărire, AMP, versiuni mobile pe subdomeniu.
- Pagini de arhivă (autor, dată, etichetă) care repetă rezumatele articolelor.
- Descrieri de produs copiate de la producător, identice cu ale altor zeci de magazine.
- Pagini de oraș sau de serviciu generate din același șablon, cu doar numele schimbat.
- Site de test sau de dezvoltare indexat, cu tot conținutul producției.
Cum le găsiți
Raportul Page indexing din Search Console are trei stări care indică duplicate: Duplicate without user-selected canonical (Google a găsit copii, iar dumneavoastră nu ați spus care e principala), Duplicate, Google chose different canonical than user (ați spus, dar Google a ales altfel) și Alternate page with proper canonical tag (duplicat tratat corect, doar informativ). Lista de adrese de sub fiecare stare arată exact ce trebuie rezolvat. Interpretarea completă a raportului este în ghidul despre rapoartele de acoperire.
Pentru duplicatele pe care Google nu le-a raportat încă: unealta URL Inspection arată, pentru orice adresă, ce canonică a ales Google; o căutare de tip site:domeniu.ro urmată de un fragment de text arată toate adresele indexate cu acel text; iar un crawler propriu sau analizorul de site GOAI listează titlurile și descrierile identice între pagini, cel mai rapid indicator de duplicare.
Rezolvarea, unealtă cu unealtă
Redirecționarea 301
Pentru variantele de adresă (punctul 1) și pentru paginile care nu mai au motiv să existe. O singură versiune canonică a domeniului (https, www sau fără), cu redirecționare de la toate celelalte, într-o singură săritură. Verificați cu curl -I că fiecare variantă răspunde 301 direct spre versiunea finală; lanțurile de două-trei redirecționări sunt o pierdere descrisă în articolul despre bugetul de accesare. Configurarea în panou este în ghidul despre redirecționările din cPanel.
rel=canonical
Pentru duplicatele care trebuie să existe ca pagini (produsul din mai multe categorii, filtrele utile, parametrii de urmărire): fiecare variantă declară, în head, adresa principală. Reguli pe care le respectăm: canonical absolut, spre o adresă care răspunde 200 și care se declară pe ea însăși canonică; un singur canonical pe pagină; conținutul variantei chiar asemănător cu al principalei, altfel Google ignoră eticheta. Canonical este o sugestie, nu o comandă; Google o urmează în majoritatea cazurilor, dar poate alege altfel dacă semnalele (legături, hartă, canonical intern) spun altceva. Când alege altfel, raportul o spune, iar cauza este aproape întotdeauna un semnal contradictoriu: legăturile interne merg spre variantă, nu spre principală.
noindex
Pentru paginile care trebuie să existe pentru vizitatori, dar nu au ce căuta în index: arhivele de autor și de dată, paginile de căutare internă, versiunile de tipărire. Meta robots noindex (sau antetul X-Robots-Tag) scoate pagina din index la următoarea accesare. Nu combinați noindex cu canonical spre altă pagină: sunt semnale contradictorii.
robots.txt
Pentru volum mare de adrese cu parametri, unde accesarea în sine e problema. Blocarea nu scoate din index ce era deja indexat și împiedică Google să vadă canonical-ul din pagină, deci se aplică doar pe adrese care nu au fost niciodată indexate sau după ce au ieșit prin noindex.
hreflang, pentru versiuni în alte limbi
Traducerile nu sunt duplicate, dar versiunile pentru două țări în aceeași limbă (ro-RO și ro-MD, en-GB și en-US) da. Etichetele hreflang spun lui Google care versiune e pentru cine, iar fiecare versiune rămâne indexabilă. Regula: fiecare pagină listează toate variantele, inclusiv pe sine, cu adrese reciproce.
Rescrierea
Pentru descrierile de produs copiate de la producător și pentru paginile-șablon (punctele 6 și 7), nu există soluție tehnică. Google indexează o singură versiune a unei descrieri identice în 40 de magazine, iar șansele ca aceea să fie a dumneavoastră sunt mici. Descrierile proprii, cu detalii de utilizare, comparații și răspunsuri la întrebări, sunt singura cale; modelul pe care îl folosim este în articolul despre exemplele de descrieri de produs. Pentru paginile de oraș, fiecare are nevoie de conținut specific locului: proiecte, distanțe, particularități, nu doar numele schimbat.
Când alt site vă copiază
Situația: un articol scris de dumneavoastră apare, integral sau aproape integral, pe alt site, uneori clasat mai sus. Google spune că încearcă să identifice originalul, dar nu garantează. Ce puteți face, în ordine:
- Asigurați semnalele de original: data publicării vizibilă și în datele structurate, autor identificat, articolul în harta site-ului cu lastmod corect, și, ideal, indexat înainte de copie (publicați și trimiteți la indexare în aceeași zi).
- Cereți eliminarea copiei printr-un mesaj scris către administratorul site-ului sau către găzduirea lui; datele de contact sunt de obicei în whois sau pe pagina de contact. Multe copii dispar la prima cerere.
- Trimiteți către Google o cerere de eliminare pentru încălcarea drepturilor de autor (formularul de raportare a conținutului pentru motive legale, din contul Google), cu adresele originalului și ale copiei. Este procedura DMCA, valabilă și pentru site-uri din România; Google elimină din rezultate adresele raportate dacă cererea este completă.
- Pentru site-uri care copiază la scară (agregatoare automate, site-uri făcute din conținut furat), folosiți și formularul de raportare a spamului din Search Central; nu produce o acțiune imediată, dar alimentează sistemele automate.
Ce nu funcționează: cererile către Google de a „recunoaște originalul” fără eliminare legală, și textele de avertizare pe site. Ce funcționează pe termen lung este autoritatea: un site cu semnale puternice de E-E-A-T este ales ca original mai des decât copia.
Sindicalizarea și conținutul preluat cu acord
Dacă dați voie altor site-uri să vă republice articolele (parteneri, portaluri), cereți-le un canonical spre original sau, dacă nu pot, un noindex pe copie. Din 2023, Google nu mai consideră canonical-ul suficient pentru știri sindicalizate și recomandă noindex pe copie, fiindcă versiunea parteneră ajungea des în locul originalului. Pentru comunicate de presă publicate identic în zeci de locuri, acceptați că Google va alege una și concentrați efortul pe pagina proprie, cu context suplimentar față de comunicat.
Duplicatele din versiunile de limbă și din paginare
Două cazuri care produc confuzie. Paginarea: paginile 2, 3, 4 ale unei categorii nu sunt duplicate ale primei și nu trebuie să aibă canonical spre ea; fiecare are propriul canonical, iar Google le tratează ca o serie. Un canonical de pe pagina 5 spre pagina 1 ascunde produsele de pe pagina 5. Versiunile de limbă: o pagină în română și traducerea ei în engleză nu sunt duplicate; se leagă prin hreflang și fiecare rămâne canonică pentru limba ei. Duplicatul apare doar când două versiuni au aceeași limbă și aproape același conținut (aceeași pagină pentru România și Republica Moldova), și atunci hreflang cu coduri de țară le diferențiază.
Cum preveniți duplicatele noi
- O regulă de generare a adreselor în aplicație: litere mici, fără slash final sau cu, consecvent, fără parametri în legăturile interne.
- Canonical automat pe fiecare șablon, cu adresa curată a paginii, verificat la fiecare lansare de temă.
- noindex implicit pe arhivele pe care nu le vreți indexate și pe căutarea internă.
- Site-ul de test pe subdomeniu protejat cu parolă, cum arătăm în ghidul despre protecția directorului cu parolă, nu doar cu noindex.
- O verificare lunară a raportului Page indexing, cu atenție la creșterile bruște ale stărilor de duplicat după actualizări de module.
Un caz din practică
Un magazin online avea 2.400 de produse și 31.000 de adrese indexate. Raportul arăta 19.000 de adrese în Duplicate without user-selected canonical: fiecare produs exista în trei-patru categorii, cu adresa categoriei în cale, plus variantele de sortare. Am aplicat: o singură adresă canonică pe produs, fără categorie în cale, cu canonical pe toate variantele și cu legăturile interne rescrise spre adresa canonică; noindex pe sortări; robots.txt pentru parametrii de urmărire. În opt săptămâni, adresele indexate au scăzut la 4.100, iar afișările pe paginile de produs au crescut cu 38%, fără conținut nou. Restul verificărilor pentru magazine sunt în ghidul despre optimizarea SEO a unui magazin online, iar ordinea în care le abordăm într-un audit SEO începe exact cu inventarul duplicatelor.
Surse
- Google Search Central, consolidarea adreselor duplicate: canonical, redirecționări și cum alege Google versiunea principală.
- Google Search Central, politicile privind spamul: conținutul copiat, conținutul la scară și raportarea.
Cum a fost realizat acest articol
- Autor
- Dorel Tănase
- Publicat
- 4 august 2025
- Ultima actualizare
- 18 septembrie 2026
- Surse
Lucrăm după principiile noastre de publicare, politica pentru corectare, politica pentru etică.

