Duplicate content
Duplicate content (zduplikowana treść) to identyczne lub bardzo zbliżone fragmenty treści dostępne pod różnymi adresami URL — zarówno wewnątrz jednej witryny (duplikacja wewnętrzna), jak i pomiędzy różnymi serwisami (duplikacja zewnętrzna). Z perspektywy SEO problem polega na tym, że wyszukiwarka musi zdecydować, którą wersję pokazać w wynikach, przez co sygnały rankingowe rozpraszają się między kopiami zamiast wzmacniać jedną, docelową stronę.
Na czym polega problem duplicate content
Zduplikowana treść rzadko wynika ze złej woli — najczęściej powstaje przypadkowo. Typowe źródła to:
- ta sama strona dostępna z www i bez, po HTTP i HTTPS lub z ukośnikiem na końcu i bez;
- parametry URL sortowania, filtrowania i sesji generujące wiele wersji tej samej listy;
- karty produktów kopiowane z opisów producenta lub między wariantami;
- wersje do druku oraz treści powielane w paginacji.
Efektem bywa kanibalizacja słów kluczowych oraz nieefektywne wykorzystanie budżetu indeksowania.
Zastosowanie w praktyce
Eliminowanie duplikacji to stały element pracy nad SEO on-page. Podstawowym narzędziem jest tag canonical, który wskazuje wyszukiwarce wersję preferowaną, a tam gdzie duplikat jest zbędny — przekierowanie 301 do oryginału. Pomocne bywa też wymuszenie jednej wersji domeny (z www lub bez, wyłącznie po HTTPS) na poziomie serwera oraz blokowanie zbędnych parametrów w pliku robots i mapie strony. W sklepach internetowych kluczowe jest uporządkowanie parametrów URL sortowania i filtrowania oraz spójna struktura adresów, bo to właśnie tam duplikacja rozrasta się najszybciej. Osobnym przypadkiem jest duplikacja zewnętrzna, czyli kopiowanie treści przez inne serwisy — tu pomaga publikowanie oryginału jako pierwszego, dbałość o unikalne opisy oraz w skrajnych sytuacjach zgłoszenia o naruszeniu praw autorskich. Regularne audyty za pomocą narzędzi do crawlowania pomagają wychwycić duplikaty, zanim rozmyją one widoczność witryny, osłabią jej pozycje i zmarnują cenny budżet indeksowania na kopie zamiast na wartościowe podstrony.
Powiązane pojęcia
Najczęstsze pytania
Czy Google nakłada karę za duplicate content?
W większości przypadków nie ma osobnej kary. Google po prostu wybiera jedną wersję do zaindeksowania i pomija pozostałe. Problem pojawia się, gdy duplikacja rozprasza sygnały rankingowe albo gdy treść kopiowana jest masowo w celu manipulacji wynikami.
Jak najszybciej wyeliminować duplicate content?
Najczęściej stosuje się tag canonical wskazujący wersję preferowaną, przekierowania 301 z duplikatów do oryginału oraz spójną strukturę adresów URL. W sklepach pomaga też porządkowanie parametrów sortowania i filtrowania.
