Duplicate content: co to je a jak se ho zbavit

3. Noindex tag
Pro stránky, které chcete zachovat dostupné pro uživatele, ale nechcete je v Google indexu (například stránky s URL parametry, tiskové verze nebo interní vyhledávací výsledky), použijte meta tag noindex:
<meta name="robots" content="noindex, follow" />
Noindex řekne Googlu, aby stránku neindexoval, ale přesto mohl sledovat její odkazy. Vhodné pro stránky s filtrováním v e-shopech nebo stránky s URL parametry.
4. Konsolidace obsahu
Pokud máte více stránek s podobným nebo překrývajícím se obsahem, zvažte jejich sloučení do jedné komplexnější stránky. Výsledkem je silnější stránka s vyšší autoritou a lepšími pozicemi. Například dva krátké články o podobném tématu sloučte do jednoho obsáhlého průvodce.
5. Přepište duplicitní obsah
Zejména v e-shopech, kde používáte produktové popisky od výrobce, je nejlepším řešením napsat vlastní unikátní texty. Nejde jen o SEO – unikátní popis, který odpovídá otázkám vašich zákazníků, konvertuje lépe než generický text zkopírovaný od výrobce.
6. Nastavení preferované domény
Rozhodněte se, zda chcete používat www nebo bez www variantu, a HTTP nebo HTTPS. Poté:
- Nastavte 301 přesměrování z nepreferované varianty na preferovanou
- Nastavte preferovanou doménu v Google Search Console
- Ujistěte se, že všechny interní odkazy vedou na preferovanou variantu
- Nastavte canonical tag na všech stránkách tak, aby odkazoval na preferovanou variantu
Nejčastější situace a jejich řešení
E-shop s URL parametry
Filtry a řazení v e-shopu generují stovky URL adres pro stejný obsah (/boty/?barva=cerna&velikost=42&razeni=cena). Řešení: nastavte canonical tag na všech filtrovaných stránkách odkazující na základní URL kategorie. Pokud používáte WooCommerce, Rank Math nebo Yoast to řeší automaticky – ověřte nastavení.
Produkt ve více kategoriích
Produkt dostupný pod /kategorie-a/produkt/ i /kategorie-b/produkt/ vytváří duplicate content. Řešení: zvolte jednu URL jako kanonickou a na druhou nastavte canonical tag nebo 301 přesměrování.
Stránky s tagem a kategorií se stejným obsahem
WordPress automaticky vytváří archivní stránky pro kategorie, tagy, autory a data. Tyto stránky mohou obsahovat stejné příspěvky a vytvářet duplicity. Řešení: nastavte noindex pro tagy a archivní stránky autorů (pokud máte jen jednoho autora), nebo zajistěte, aby měly unikátní popisy.
Syndikace obsahu
Pokud sdílíte své články na jiných webech (syndikace), požádejte tyto weby, aby na originální verzi článku nastavily canonical tag. Pokud to není možné, publikujte na svém webu dříve – Google obvykle za originál považuje stránku, která byla zaindexována jako první.
Jak duplicate content preventivně předcházet
- Nastavte hned od začátku preferovanou doménu (www nebo bez www, HTTPS) a vždy používejte jen tuto variantu
- Pište unikátní texty pro každou stránku – zejména produktové popisky, meta titulky a meta popisky
- Zkontrolujte nastavení canonical tagů po spuštění webu a po každé větší změně struktury
- Pravidelně auditujte web pomocí Google Search Console nebo Screaming Frog
- Při migraci webu nastavte přesměrování pro všechny URL, které mění adresu – jak na to podrobně popisuje průvodce migrací webu bez ztráty pozic
Shrnutí
Duplicate content není katastrofa, ale je to zbytečná zátěž, která vám krade SEO hodnotu. Většina duplicit vzniká technickými příčinami – různé verze URL, parametry, špatně nastavené přesměrování – a dá se systematicky odstranit. Začněte kontrolou v Google Search Console, identifikujte nejzávažnější případy a postupně je řešte pomocí canonical tagů, přesměrování nebo noindex.
Pokud si nejste jisti, zda váš web duplicate content má a jak závažný je, SEO audit to odhalí přesně a s konkrétními doporučeními.
Chcete zkontrolovat, zda váš web trpí duplicitním obsahem? Napište mi – podívám se na to a navrhnu konkrétní řešení.
Duplicate content – duplicitní obsah – je jeden z nejčastějších technických SEO problémů, který zůstává dlouho nepovšimnut. Web může mít skvělé texty a kvalitní zpětné odkazy, ale pokud Google narazí na duplicitní obsah, nevíte s jistotou, která stránka se zobrazí ve výsledcích vyhledávání. A to je problém.
V tomto článku vám vysvětlím, co přesně duplicate content znamená, proč ho Google nemá rád, jak ho na svém webu najít a – hlavně – jak se ho zbavit.
Co je duplicate content
Duplicate content jsou stránky nebo části obsahu, které jsou identické nebo velmi podobné na více než jedné URL adrese. Může jít o obsah v rámci jednoho webu (interní duplikace) nebo o obsah zkopírovaný z jiného webu (externí duplikace).
Google sám definuje duplicitní obsah jako „obsah, který se výrazně překrývá nebo je zcela totožný s obsahem na jiných místech na internetu.” Klíčové slovo je překrývá – nemusí jít o doslova zkopírovaný text, stačí velmi podobná struktura a formulace.
Interní duplicate content
Nejčastější typ – stejný obsah dostupný na více URL adresách v rámci vašeho vlastního webu. Příklady:
- HTTP vs. HTTPS verze –
http://example.czahttps://example.czjsou pro Google dvě různé URL - www vs. bez www –
www.example.czaexample.czjsou technicky různé adresy - Lomítko na konci URL –
example.cz/strankaaexample.cz/stranka/mohou být indexovány jako dvě různé stránky - Parametry v URL –
example.cz/produkt?barva=modraaexample.cz/produkt?razeni=cenaobsahují stejný produkt, ale mají různé URL - Stránkování – stránky
/blog/,/blog/page/2/,/blog/page/3/mohou mít podobné úvodní části - Tiskové verze stránek –
example.cz/stranka/print/ - Kategorie a tagy – v e-shopech stejný produkt dostupný pod více kategoriemi
Externí duplicate content
Obsah zkopírovaný z jiného webu nebo zkopírovaný z vašeho webu jiným webem. Patří sem:
- Produktové popisky zkopírované od výrobce nebo dodavatele (velmi časté v e-shopech)
- Citace a syndikace obsahu bez označení originálního zdroje
- Scraping – někdo zkopíroval váš obsah bez vašeho vědomí
Proč duplicate content škodí SEO
Google nechce zobrazovat uživatelům stejný obsah vícekrát – to by bylo pro ně zbytečné. Když narazí na duplicitní obsah, musí se rozhodnout, kterou verzi stránky zaindexuje a zobrazí ve výsledcích. Toto rozhodnutí nemusí padnout ve váš prospěch.
Konkrétní dopady duplicate content na SEO:
- Diluce SEO hodnoty – zpětné odkazy a autorita se rozdělí mezi více verzí stejné stránky místo toho, aby se soustředily na jednu
- Špatná volba kanonické stránky – Google může jako hlavní verzi zvolit tu, kterou nechcete
- Plýtvání crawl budgetem – Googlebot tráví čas procházením duplicitních stránek místo těch unikátních
- Zhoršené pozice – stránky s unikátním obsahem se zpravidla umísťují výše než ty s duplicitním
Důležité: Google za duplicate content zpravidla nepřímo penalizuje (tedy neuděluje manuální penalizaci), pokud nevznikl záměrně za účelem manipulace výsledků. Ale i bez přímé penalizace vás duplicate content poškozuje tím, že rozmělňuje SEO signály.
Jak duplicate content najít
Google Search Console
Nejjednodušší bezplatný nástroj. V záložce Pokrytí indexem hledejte upozornění na „Duplikát bez kanonické stránky označené uživatelem” nebo „Duplikát – Google zvolil jinou kanonickou stránku, než jste označili”. Obě upozornění signalizují problém s duplicitním obsahem. Jak Google Search Console nastavit a co v ní sledovat popisujeme v průvodci Google Search Console.
Screaming Frog SEO Spider
Bezplatná verze umí prochcrawlovat weby do 500 URL a najít duplicitní titulky, meta popisky i obsah stránek. Po crawlu přejděte do záložky Content → Duplicate a uvidíte, které stránky mají stejný nebo velmi podobný obsah.
Siteliner
Bezplatný online nástroj na adrese siteliner.com, který prochází váš web a zobrazuje procento duplicitního obsahu na každé stránce. Přehledně ukazuje, které stránky jsou si navzájem nejpodobnější.
Copyscape
Specializovaný nástroj pro hledání externího duplicate content – zjistíte, zda někdo zkopíroval váš obsah, nebo zda váš obsah náhodou existuje někde jinde na internetu. Základní kontrola je zdarma, pokročilé funkce jsou placené.
Ahrefs nebo Semrush
Placené nástroje, které v rámci site auditu automaticky identifikují duplicitní obsah, duplicitní titulky a meta popisky a navrhnou konkrétní řešení.
Jak duplicate content vyřešit
1. Canonical tag (rel=”canonical”)
Canonical tag je HTML element, který Googlu říká: „Toto je originální, preferovaná verze této stránky.” Vložíte ho do sekce <head> duplicitní stránky a odkazuje na URL preferované verze.
<link rel="canonical" href="https://www.example.cz/preferovana-stranka/" />
Canonical tag je nejčastějším řešením pro stránky s URL parametry, jazykovými variantami nebo stránkováním. Na WordPressu canonical tagy automaticky generuje plugin Rank Math nebo Yoast SEO – ve většině případů je nastaví správně sám, ale je dobré je zkontrolovat.
2. Přesměrování 301
Pokud existuje duplicitní stránka, která by neměla být přístupná vůbec, použijte 301 přesměrování z duplicitní URL na originální. To je správné řešení například pro HTTP → HTTPS nebo www → bez www variantu.
Na WordPressu nastavíte přesměrování přes plugin Redirection nebo přes Rank Math. Přesměrování je silnější signál než canonical tag – Google ho respektuje spolehlivěji.
3. Noindex tag
Pro stránky, které chcete zachovat dostupné pro uživatele, ale nechcete je v Google indexu (například stránky s URL parametry, tiskové verze nebo interní vyhledávací výsledky), použijte meta tag noindex:
<meta name="robots" content="noindex, follow" />
Noindex řekne Googlu, aby stránku neindexoval, ale přesto mohl sledovat její odkazy. Vhodné pro stránky s filtrováním v e-shopech nebo stránky s URL parametry.
4. Konsolidace obsahu
Pokud máte více stránek s podobným nebo překrývajícím se obsahem, zvažte jejich sloučení do jedné komplexnější stránky. Výsledkem je silnější stránka s vyšší autoritou a lepšími pozicemi. Například dva krátké články o podobném tématu sloučte do jednoho obsáhlého průvodce.
5. Přepište duplicitní obsah
Zejména v e-shopech, kde používáte produktové popisky od výrobce, je nejlepším řešením napsat vlastní unikátní texty. Nejde jen o SEO – unikátní popis, který odpovídá otázkám vašich zákazníků, konvertuje lépe než generický text zkopírovaný od výrobce.
6. Nastavení preferované domény
Rozhodněte se, zda chcete používat www nebo bez www variantu, a HTTP nebo HTTPS. Poté:
- Nastavte 301 přesměrování z nepreferované varianty na preferovanou
- Nastavte preferovanou doménu v Google Search Console
- Ujistěte se, že všechny interní odkazy vedou na preferovanou variantu
- Nastavte canonical tag na všech stránkách tak, aby odkazoval na preferovanou variantu
Nejčastější situace a jejich řešení
E-shop s URL parametry
Filtry a řazení v e-shopu generují stovky URL adres pro stejný obsah (/boty/?barva=cerna&velikost=42&razeni=cena). Řešení: nastavte canonical tag na všech filtrovaných stránkách odkazující na základní URL kategorie. Pokud používáte WooCommerce, Rank Math nebo Yoast to řeší automaticky – ověřte nastavení.
Produkt ve více kategoriích
Produkt dostupný pod /kategorie-a/produkt/ i /kategorie-b/produkt/ vytváří duplicate content. Řešení: zvolte jednu URL jako kanonickou a na druhou nastavte canonical tag nebo 301 přesměrování.
Stránky s tagem a kategorií se stejným obsahem
WordPress automaticky vytváří archivní stránky pro kategorie, tagy, autory a data. Tyto stránky mohou obsahovat stejné příspěvky a vytvářet duplicity. Řešení: nastavte noindex pro tagy a archivní stránky autorů (pokud máte jen jednoho autora), nebo zajistěte, aby měly unikátní popisy.
Syndikace obsahu
Pokud sdílíte své články na jiných webech (syndikace), požádejte tyto weby, aby na originální verzi článku nastavily canonical tag. Pokud to není možné, publikujte na svém webu dříve – Google obvykle za originál považuje stránku, která byla zaindexována jako první.
Jak duplicate content preventivně předcházet
- Nastavte hned od začátku preferovanou doménu (www nebo bez www, HTTPS) a vždy používejte jen tuto variantu
- Pište unikátní texty pro každou stránku – zejména produktové popisky, meta titulky a meta popisky
- Zkontrolujte nastavení canonical tagů po spuštění webu a po každé větší změně struktury
- Pravidelně auditujte web pomocí Google Search Console nebo Screaming Frog
- Při migraci webu nastavte přesměrování pro všechny URL, které mění adresu – jak na to podrobně popisuje průvodce migrací webu bez ztráty pozic
Shrnutí
Duplicate content není katastrofa, ale je to zbytečná zátěž, která vám krade SEO hodnotu. Většina duplicit vzniká technickými příčinami – různé verze URL, parametry, špatně nastavené přesměrování – a dá se systematicky odstranit. Začněte kontrolou v Google Search Console, identifikujte nejzávažnější případy a postupně je řešte pomocí canonical tagů, přesměrování nebo noindex.
Pokud si nejste jisti, zda váš web duplicate content má a jak závažný je, SEO audit to odhalí přesně a s konkrétními doporučeními.
Chcete zkontrolovat, zda váš web trpí duplicitním obsahem? Napište mi – podívám se na to a navrhnu konkrétní řešení.