Canonical alebo noindex: ktoré riešenie použiť pri duplicitných stránkach

Duplicitné stránky patria medzi najčastejšie technické SEO problémy webov a e-shopov. Často pritom nejde o to, že by niekto vedome skopíroval rovnaký obsah na viacero URL. Duplicity môžu vzniknúť automaticky cez filtre, parametre, triedenie produktov, varianty, kategórie, interné vyhľadávanie, stránkovanie alebo rôzne verzie tej istej adresy.

A potom prichádza otázka:

Máme použiť canonical alebo noindex?

Na prvý pohľad môžu obe riešenia vyzerať podobne. V skutočnosti však Google dostáva úplne inú informáciu.

  • Canonical: „Táto stránka existuje, ale za hlavnú verziu obsahu považujeme inú URL.“
  • Noindex: „Túto stránku nechceme zobrazovať vo výsledkoch vyhľadávania.“

Nesprávne rozhodnutie môže spôsobiť, že Google bude indexovať URL, ktoré nepotrebujete, ignorovať dôležité stránky alebo dostávať protichodné signály o tom, ktorá verzia obsahu má byť vo výsledkoch vyhľadávania.

Pri SEO analýze a audite preto v ROI index nekontrolujeme iba texty, titulky alebo kľúčové slová. Sledujeme aj indexáciu, canonical značky, interné odkazy, parametre URL a to, aké stránky Google skutočne považuje za hlavné.

Čo je canonical?

Canonical, presnejšie rel="canonical", je spôsob, ktorým vyhľadávaču označujete preferovanú URL z viacerých rovnakých alebo veľmi podobných stránok.

Predstavme si napríklad, že produkt možno otvoriť cez tieto adresy:

eshop.sk/topanky/model-x/

eshop.sk/topanky/model-x/?color=cierna

eshop.sk/topanky/model-x/?utm_source=newsletter

Obsah môže byť prakticky rovnaký, ale technicky existujú tri URL.

Ak má byť hlavnou stránkou:

eshop.sk/topanky/model-x/

ostatné verzie môžu smerovať canonical značkou práve na ňu.

Google canonical používa ako jeden zo signálov pri výbere reprezentatívnej URL zo skupiny duplicitných alebo veľmi podobných stránok. Samotný canonical teda nie je absolútnym príkazom, ale dôležitým signálom pre kanonizáciu.

Kedy canonical dáva zmysel?

Canonical je vhodný najmä vtedy, keď:

  • viacero URL obsahuje rovnaký alebo veľmi podobný obsah,
  • chcete zachovať dostupnosť všetkých URL pre návštevníkov,
  • jedna URL má byť považovaná za hlavnú,
  • vznikajú URL s trackingovými alebo technickými parametrami,
  • ten istý produkt existuje cez viac navigačných ciest,
  • CMS automaticky vytvára duplicity,
  • potrebujete konsolidovať signály viacerých veľmi podobných stránok.

Canonical teda nehovorí, že druhá URL je zlá alebo nepotrebná. Hovorí predovšetkým:

„Ak máte vybrať jednu hlavnú verziu, uprednostnite túto.“

Čo je noindex?

noindex má inú funkciu.

Ak stránka obsahuje:

<meta name="robots" content="noindex">

vyhľadávaču oznamujete, že danú URL nechcete zahrnúť do výsledkov vyhľadávania.

Stránka môže ďalej normálne fungovať pre používateľov. Môže byť dostupná cez menu, interný odkaz alebo priamu URL. Nemala by však zostať indexovaná vo výsledkoch Google po tom, ako Googlebot pravidlo spracuje.

A dôležitý detail: aby Google mohol noindex zistiť, musí mať možnosť URL prehľadať. Ak ju zároveň zablokujete cez robots.txt, Googlebot nemusí značku noindex vôbec vidieť.

Kedy dáva noindex zmysel?

Typickými príkladmi sú:

  • výsledky interného vyhľadávania,
  • používateľské alebo systémové stránky bez SEO hodnoty,
  • niektoré kombinácie filtrov,
  • technické alebo pomocné stránky,
  • stránky vytvorené iba pre konkrétny proces používateľa,
  • veľmi slabé stránky, ktoré nechcete mať vo vyhľadávaní,
  • URL, ktoré sú užitočné pre návštevníka, ale nedávajú zmysel ako samostatný výsledok Google.

Tu už nejde o voľbu medzi dvoma rovnocennými verziami.

Hovoríte:

„Táto konkrétna URL nemá byť vo výsledkoch vyhľadávania.“

Canonical vs. noindex: najdôležitejší rozdiel

Najjednoduchšie sa rozhoduje podľa otázky:

Chcem, aby Google obsah tejto URL priradil k inej hlavnej stránke?

Použite canonical.

Nechcem, aby bola táto stránka indexovaná vôbec?

Použite noindex.

Rozdiel vyzerá jednoducho, ale pri veľkých e-shopoch môže mať zásadný dopad.

Nesprávne nastavený filter môže vytvoriť stovky alebo tisíce URL. Ak každá začne súperiť s hlavnou kategóriou, vzniká chaos v indexácii. Na druhej strane plošné použitie noindex môže odstrániť stránky, ktoré by pri správnom nastavení vedeli prinášať hodnotnú organickú návštevnosť.

Preto pri SEO pre e-shopy neodporúčame pravidlo typu „všetky filtre noindex“. Najskôr treba pochopiť, ktoré kombinácie majú reálny vyhľadávací a obchodný potenciál.

Praktický príklad: produkt s URL parametrom

Máte produkt:

eshop.sk/panska-bunda/

Reklamný systém vytvorí adresu:

eshop.sk/panska-bunda/?utm_source=google

Parameter nemení samotný produkt.

V tomto prípade typicky nepotrebujete vytvárať ďalšiu samostatnú indexovanú stránku.

Logické riešenie je canonical na:

eshop.sk/panska-bunda/

Nie noindex.

Prečo?

Pretože obe URL reprezentujú rovnaký obsah a chcete Googlu pomôcť identifikovať hlavnú verziu.

Praktický príklad: interné vyhľadávanie

Predstavte si adresu:

eshop.sk/?s=cervene+topanky

Ide o výsledky interného vyhľadávania webu.

Takýchto kombinácií môžu vzniknúť prakticky neobmedzené množstvá a väčšinou nechcete, aby Google každú z nich považoval za samostatnú vstupnú stránku.

Tu môže byť vhodnejšie:

noindex

Návštevník môže interné vyhľadávanie používať ďalej, ale nepotrebujete každú výsledkovú URL dostať do organického vyhľadávania.

Praktický príklad: filtrovanie produktov

Práve filtre sú zaujímavé.

Máte kategóriu:

eshop.sk/notebooky/

A filtre:

eshop.sk/notebooky/?znacka=lenovo

eshop.sk/notebooky/?ram=16gb

eshop.sk/notebooky/?znacka=lenovo&ram=16gb

Čo s nimi?

Tu neexistuje univerzálne pravidlo.

Ak napríklad ľudia vo významnom množstve vyhľadávajú „Lenovo notebooky“, samostatná optimalizovaná landing page môže mať veľký obchodný potenciál.

Takú stránku by bolo škoda automaticky označiť ako noindex.

Naopak kombinácia piatich filtrov, ktorú nikto nehľadá a ktorá obsahuje dva produkty, pravdepodobne samostatnú indexovanú stránku nepotrebuje.

Preto odporúčame filtre rozdeliť podľa významu:

SEO hodnotné kombinácie

→ indexovateľná landing page s vlastným obsahom a optimalizáciou.

Duplicitné alebo technické varianty

→ podľa situácie canonical.

Bezvýznamné kombinácie, ktoré nemajú byť vo vyhľadávaní

→ môže byť vhodný noindex alebo iné technické riešenie podľa architektúry webu.

To je jeden z dôvodov, prečo technické SEO nemožno robiť iba podľa univerzálneho checklistu.

A čo triedenie produktov?

Častým zdrojom duplicít sú adresy typu:

/notebooky/?sort=cena

/notebooky/?sort=najpredavanejsie

/notebooky/?sort=najnovsie

Ak sa mení iba poradie rovnakých produktov, z pohľadu vyhľadávania spravidla nechcete vytvárať niekoľko samostatných konkurujúcich stránok.

V takomto prípade často dáva zmysel kanonizácia na hlavnú kategóriu.

Používateľ si môže produkty stále zoradiť podľa svojich preferencií. Google však dostáva jasnejší signál, ktorá URL predstavuje primárnu kategóriu.

Product varianty: pozor na automatické pravidlá

Farba, veľkosť, materiál alebo iná produktová variácia nemusia byť vždy „obyčajná duplicita“.

Ak majú varianty samostatné URL, treba posúdiť:

  • či sa mení iba technický parameter,
  • či ide o reálne odlišný produkt,
  • či existuje dopyt po konkrétnom variante,
  • akú URL má zobrazovať Google,
  • ako sú varianty implementované,
  • ako sú nastavené produktové dáta a štruktúrované údaje.

Google vo svojej dokumentácii pre e-commerce rieši aj samostatné URL produktových variantov a odporúča pracovať s jednoznačnými URL a kanonizáciou podľa spôsobu implementácie.

Pre veľký e-shop preto môže byť chyba zaviesť jednoduché globálne pravidlo:

„Všetky varianty canonical na základný produkt.“

Najprv treba vedieť, ako funguje celý katalóg.

Canonical sám osebe nevyrieši zlú architektúru webu

Jedna z častých chýb je predstava, že stačí na tisíce problematických URL vložiť canonical a technické SEO je vyriešené.

Nie je.

Treba skontrolovať aj:

  • interné prelinkovanie,
  • XML sitemap,
  • robots.txt,
  • URL parametre,
  • generovanie filtrov,
  • navigáciu,
  • presmerovania,
  • stavové HTTP kódy,
  • stránkovanie,
  • faceted navigation,
  • produktové varianty,
  • indexované URL v Google Search Console.

Ak interné odkazy stále masívne smerujú na nepotrebné URL, e-shop ich neustále generuje a Google ich objavuje v ďalších kombináciách, samotná canonical značka nemusí riešiť podstatu problému.

Pre veľký web môže byť nesprávna práca s URL zároveň problémom pre efektívne prehľadávanie webu.

Self-referencing canonical nie je chyba

Na hlavnej stránke môže canonical smerovať sama na seba.

Napríklad:

Stránka:

https://eshop.sk/notebooky/

Canonical:

https://eshop.sk/notebooky/

Takzvaný self-referencing canonical pomáha konzistentne definovať preferovanú URL aj v situáciách, keď sa na stránku návštevník dostane cez rôzne parametre alebo odkazy.

Pozor na canonical chain

Technické SEO by malo byť čo najjednoznačnejšie.

Nevhodná konfigurácia môže vyzerať napríklad takto:

URL A → canonical URL B
URL B → canonical URL C

Ideálne je, keď URL A smeruje canonical priamo na konečnú preferovanú URL C.

Čím jednoduchšie a konzistentnejšie signály Google dostáva, tým menší priestor zostáva na nejednoznačnosť.

A čo canonical na stránku s noindex?

Tomuto nastaveniu sa odporúčame vyhnúť.

Ak jedna značka hovorí:

„Za hlavnú považujte túto URL.“

a cieľová stránka zároveň hovorí:

„Neindexujte ma.“

posielate protichodné informácie.

Google vo svojich odporúčaniach upozorňuje, že canonical cieľ by nemal obsahovať noindex.

Technické SEO má byť konzistentné. Canonical, indexácia, sitemap, interné odkazy aj presmerovania by mali podporovať rovnakú predstavu o tom, ktorá URL je dôležitá.

Noindex a robots.txt nie je to isté

Toto je ďalší veľmi častý omyl.

robots.txt primárne riadi prístup crawlera k URL.

noindex riadi to, či má byť stránka zahrnutá do indexu.

Ak stránku zablokujete cez robots.txt, Googlebot nemusí byť schopný načítať jej HTML, a teda nemusí uvidieť ani značku noindex.

Preto robots.txt nie je náhradou za noindex.

Pri technickom SEO sa vždy treba pýtať zvlášť:

  1. Má Google túto URL prehľadávať?
  2. Má ju indexovať?
  3. Ktorú URL má považovať za canonical?

Sú to tri rozdielne otázky.

Ako zistiť, ktorú canonical URL vybral Google?

To, že do zdrojového kódu vložíte canonical, ešte automaticky neznamená, že Google vyberie presne tú istú URL.

Google Search Console v nástroji na kontrolu URL dokáže pri indexovaných stránkach ukázať rozdiel medzi:

  • canonical URL určenou používateľom,
  • canonical URL vybranou Googlom.

Ak sa nezhodujú, treba hľadať príčinu.

Môže ísť napríklad o nekonzistentné interné odkazy, rozdielny obsah, presmerovania, sitemap alebo iné technické signály.

Práve preto je pri väčších weboch dôležitá pravidelná SEO analýza, nie iba jednorazové vloženie značky do šablóny.

Najčastejšie chyby, ktoré vidíme pri duplicitných URL

1. Canonical na nesúvisiacu stránku

Canonical má spájať duplicitný alebo veľmi podobný obsah.

Nie je to nástroj na „posielanie SEO sily“ ľubovoľnej stránke webu.

2. Všetky stránky canonical na homepage

Takéto nastavenie nevyrieši duplicity. Naopak, môže Googlu výrazne sťažiť pochopenie štruktúry webu.

3. Automatický noindex na všetky filtre

Niektoré filtre môžu predstavovať veľmi hodnotné landing pages.

Ak ich bez analýzy vyradíte, môžete prísť o organickú návštevnosť aj objednávky.

4. Canonical smerujúci na neexistujúcu URL

Cieľ canonical musí dávať technický aj obsahový zmysel.

5. Nekonzistentné interné odkazy

Ak stránka A deklaruje ako canonical stránku B, ale celý web interne odkazuje prevažne na A, vytvárate zbytočne protichodné signály.

6. URL v XML sitemap a zároveň noindex

XML sitemap by mala obsahovať predovšetkým URL, ktoré chcete indexovať.

Ak do nej systematicky posielate stránky s noindex, technické nastavenie si navzájom odporuje.

7. Noindex použitý na stránke, ktorá mala iba konsolidovať duplicitu

Ak chcete, aby Google pochopil vzťah medzi dvoma duplicitnými URL a vybral jednu hlavnú, vhodnejším mechanizmom býva canonical.

Noindex rieši iný problém.

Rozhodovací postup: canonical alebo noindex?

Pri každej problematickej URL si položte niekoľko otázok.

Je obsah rovnaký alebo takmer rovnaký ako na inej URL?

Ak áno a jednu verziu chcete označiť ako hlavnú:

Canonical.

Má byť táto URL samostatným výsledkom Google?

Ak nie:

Zvážte noindex.

Má URL vlastný vyhľadávací zámer a obchodnú hodnotu?

Ak áno:

Možno ju netreba ani kanonizovať, ani vyradiť. Možno potrebuje vlastný kvalitný obsah a optimalizáciu.

Ide iba o zmenu poradia, tracking alebo technický parameter?

Často:

Canonical na čistú URL.

Ide o interné vyhľadávanie alebo inú pomocnú stránku bez SEO významu?

Často:

Noindex.

Ide o filter?

Najskôr analýza vyhľadávacieho dopytu a obchodného potenciálu.

Až potom rozhodnutie.

Duplicita nie je iba technický problém

Pri SEO je ľahké pozerať sa na duplicity iba cez HTML značky.

V skutočnosti však ide aj o obchodné rozhodnutie.

Predstavte si e-shop, ktorý má 30 000 URL, ale iba 5 000 z nich má reálny potenciál privádzať zákazníkov.

Cieľom nie je dostať do Google čo najviac URL.

Cieľom je vytvoriť stav, v ktorom vyhľadávač ľahko rozpozná:

  • ktoré stránky sú dôležité,
  • ktorá verzia je hlavná,
  • ktoré kategórie majú hodnotu,
  • ktoré produkty chcete zobrazovať,
  • ktoré URL sú iba technické,
  • ako jednotlivé stránky spolu súvisia.

Aj preto v ROI index prepájame technické SEO s obsahom, analýzou kľúčových slov a obchodnými cieľmi.

Pozrite si naše SEO služby pre firmy na Slovensku.

Canonical alebo noindex? Rozhoduje účel stránky

Ak si máte zapamätať iba jednu vec, potom túto:

Canonical a noindex nie sú dve alternatívne technické cesty k rovnakému výsledku.

Canonical hovorí, ktorú URL považujete za preferovanú verziu podobného obsahu.

Noindex hovorí, že konkrétnu stránku nechcete vo výsledkoch vyhľadávania.

Pri malom firemnom webe môže ísť o niekoľko URL. Pri e-shope s filtrami a parametrami však môže nesprávne rozhodnutie ovplyvniť tisíce alebo desaťtisíce stránok.

Preto odporúčame nevychádzať iba zo všeobecných poučiek.

Najskôr zistite:

  • čo Google prehľadáva,
  • čo skutočne indexuje,
  • ktoré URL považuje za canonical,
  • ktoré stránky získavajú organickú návštevnosť,
  • aké duplicity vytvára CMS,
  • kde vznikajú zbytočné parametre,
  • ktoré stránky majú reálny obchodný potenciál.

A až potom nastavujte pravidlá.

Neviete, či má byť stránka canonical, noindex alebo index?

Pri technickom SEO môže jedno pravidlo aplikované na celú šablónu ovplyvniť tisíce URL.

V ROI index sa pozrieme na indexáciu vášho webu alebo e-shopu, canonical značky, filtre, parametre, interné prelinkovanie a ďalšie technické signály. Výstupom nie je iba zoznam problémov, ale konkrétne odporúčania, čo ponechať indexované, čo konsolidovať a čo z výsledkov vyhľadávania vyradiť.

Pozrite si SEO analýzu a audit alebo SEO pre e-shopy.

Miloš Vargic
Miloš Vargic
V marketingu sa pohybujem viac ako 22 rokov. Som zakladateľ agentúry ROI index a špecializujeme sa na výkonnostný marketing, ktorý firmám reálne prináša výsledky. Pomáhame značkám rásť vďaka efektívnej reklame na Google, Bingu a Facebooku, výkonnému SEO a GEO, precízne nastaveným marketingovým stratégiám pre B2B aj B2C segment. Pracoval som ako marketingový riaditeľ a spúšťal som reklamy v 23 krajinách a 14 jazykoch, kde sme dosahovali vysokú návratnosť investícií z rozpočtov nad 14 300 € mesačne.