SCOPE-01
Sitemapa uvádí jiný počet adres, než kolik jich audit našel z odkazů
Co kontrola měří
Rozsah webu se odhaduje z několika nezávislých zdrojů: kolik adres uvádí sitemapa a kolik různých adres jsme objevili procházením odkazů. Nález vznikne, když se ta dvě naměřená čísla rozcházejí víc než jedenapůlkrát (poměr většího k menšímu je 1,5 nebo víc). Report uvede obě.
Práh 1,5 je v config/ pod consistency. a je to vědomě tolerantní hodnota. Drobná nepřesnost mezi sitemapou a skutečností je normální; nález má padnout jen tam, kde je rozdíl velký.
Co kontrola nedělá:
- Neříká, který zdroj má pravdu. Sitemapa může být nafouklá starými adresami, nebo naopak procházení odkazů narazilo na limit. Obojí vypadá stejně.
- Nevypisuje konkrétní adresy, které se liší, jen počty. Konkrétní nesoulad hlásí
ACC-06aSEO-07. - Nepočítá s odhadem, jen s měřením. Odhad rozsahu celého webu umí být vyšší než počet objevených adres (dopočítáváme jeden konzervativní krok navíc) - do tohohle nálezu ani do porovnání zdrojů to dopočítané číslo nevstupuje. Do 19. 9. 2026 vstupovalo a nález pak tvrdil, že jsme našli víc adres, než kolik jsme jich doopravdy viděli.
- Nepočítá adresy, které vedou na soubor. Obrázky, videa, zvuk, dokumenty, archivy, styly, skripty a písma poznáme podle přípony v adrese nebo podle typu obsahu, který ohlásil server, a mezi objevené stránky je nezahrnujeme. Galerie, kde klik na náhled otevře rovnou fotku, by jinak počet nafoukla o stovky adres; na jednom auditovaném webu to byly dvě třetiny všech „objevených stránek“. Seznam přípon je v
config/a je vědomě uzavřený: jsou v něm jen formáty, u kterých je odpověď jednoznačná, takžefile- url- extensions. json .phpani.htmlmezi ně nepatří. - Nevyvozuje, že je sitemapa zastaralá. Rozdíl může být i tím, že jsme objevili stránkování a adresy s parametry, které do sitemapy nepatří.
- Nespustí se, když je zdroj odhadu jen jeden (web bez sitemapy).
Nález je na úrovni celého webu, závažnost varování.
Jak silný důkaz za tím stojí
Doporučujeme to, protože to neuškodí nebo to má jiný užitek, ale vliv na to, jestli vás jazykové modely budou citovat, neslibujeme. Nikdo ho zatím nedoložil.
Na viditelnost v odpovědích AI to doložený vliv nemá, a tenhle nález ani není o vašem webu v obvyklém smyslu. Je to nález o spolehlivosti obrazu, který jsme si o vašem webu udělali.
Proč vám to říkáme, místo abychom si to nechali pro sebe: protože z toho plynou důsledky pro zbytek reportu, a je poctivější je přiznat, než je zamlčet.
Když se odhady rozcházejí, nevíme jistě, jak velký váš web je. Audit prochází vzorek a část kontrol se sama vypíná, když nemůže tvrdit nic o webu jako celku: SIT-01 (osiřelé stránky), SEO-12 (stránky bez odkazů) a část ACC-06 mlčí, když crawl nebyl úplný. Velký rozptyl v odhadu tedy znamená, že jste možná dostali méně nálezů, než kolik by jich bylo při úplném průchodu.
Druhý důsledek je obchodní a týká se peněz: rozsah crawlu se promítá do ceny auditu. Když sitemapa uvádí desetkrát víc stránek než jich procházení našlo, odhad se dá snadno netrefit.
Praktický závěr: není to vada webu, kterou byste museli opravit. Je to informace „tomuhle číslu úplně nevěřte“, a návod, kde hledat, když vám rozsah reportu nesedí s tím, co o svém webu víte.
Jak to opravit
Nejdřív zjistěte, který ze dvou zdrojů je mimo. Rozhodují dvě otázky:
| Co vidíte | Co to nejspíš znamená |
|---|---|
| Sitemapa uvádí mnohem víc, než jsme našli | Sitemapa je nafouklá starými nebo neexistujícími adresami, nebo na většinu obsahu nevede žádný odkaz a dostat se k němu jde jen přes ni. |
| Procházením jsme našli mnohem víc, než sitemapa uvádí | Sitemapa je zastaralá, generuje se jen z části webu (typicky jen články, bez produktů a kategorií) - nebo je v pořádku a my jsme objevili adresy, které do ní nepatří: stránkování, filtrované výpisy a varianty s parametrem. Než začnete doplňovat, podívejte se, co ty adresy navíc doopravdy jsou. |
Podle toho pak:
- Nafouklá sitemapa → vygenerujte ji znovu, jen z existujících a indexovatelných adres. Konkrétní adresy, které jsme nenašli, vypisuje
SEO-07. - Neúplná sitemapa → zkontrolujte, co ji generuje. Bývá to plugin, který zná jen jeden typ obsahu.
- Obsah dostupný jen ze sitemapy → doplňte na něj odkazy z webu. Je to zároveň
SIT-01aSEO-12a je to vážnější než samotný nesoulad čísel. - Sitemapa negenerovaná automaticky → to je kořen většiny těchhle případů. Ruční sitemapa zestárne dřív, než si toho někdo všimne.
A jedna věc, na kterou se dá při tom narazit a stojí za víc než tenhle nález: když procházení odkazů najde výrazně méně stránek, než jich doopravdy máte, je to problém navigace, ne sitemapy. Obsah, ke kterému nevede cesta z webu samotného, hůř najdou lidé i vyhledávače; sitemapa to jen zamaskuje.
Co o tom říká report
Popis nálezu
Sitemapa uvádí [sitemapPages] adres; procházením odkazů jsme jich objevili [linksPages]. Obě čísla jsou naměřená, žádné z nich není odhad. Do objevených adres nepočítáme ty, které vedou na soubor místo na stránku: obrázky, videa, dokumenty, archivy a podobné formáty poznáme podle přípony v adrese nebo podle typu obsahu, který ohlásil server. Galerie, kde klik na náhled vede rovnou na fotku, by jinak počet nafoukla o stovky adres. Rozdíl sám o sobě neznamená, že je vaše sitemapa špatně: do sitemapy nepatří stránkování, varianty s parametrem v adrese ani stránky s `noindex`, takže crawler běžně objeví víc adres, než jich sitemapa uvádí. Opačným směrem může být sitemapa naopak úplnější než náš výčet, protože audit má omezený rozsah. Stojí ale za to se podívat, čím je ten rozdíl způsobený. Z odhadu rozsahu webu vychází i předvyplněná cena dalšího auditu, takže čím dál jsou zdroje od sebe, tím míň je ten odhad spolehlivý.
Doporučení
Porovnejte obě množiny a u každé adresy navíc se rozhodněte, jestli do sitemapy patří. Patří tam stránky s vlastním obsahem, které chcete mít v indexu, v kanonické podobě. Nepatří tam stránkování, filtrované a parametrické varianty ani stránky s `noindex` - ty do sitemapy nedoplňujte, zhoršili byste ji. Adresy, které v sitemapě jsou a na webu už nejsou, z ní odstraňte. Nejjistější je nechat sitemapu generovat automaticky při publikaci obsahu a odkázat na ni z robots.txt (`Sitemap: https://
Zdroje
- Google Search Central: Learn about sitemaps (ověřeno 2026-09-12)
Text ověřen 2026-09-22