Strukturovaná data a AI: co je doložené a co ne

Strukturovaná data (JSON-LD, schema.org) patří spolu s llms.txt k tématům, o kterých GEO poradenství, tedy poradenství k přípravě webu pro generativní vyhledávání, mluví nejvíc sebejistě. Realita podle primárních zdrojů je opatrnější: pro klasické vyhledávání je hodnota jasně doložená, pro AI asistenty ne.

Co k tomu říká Google

Google ve svém AI optimization guide výslovně varuje před „overfocusing on structured data" a píše, že strukturovaná data nejsou potřeba pro generativní AI vyhledávání, tedy žádné speciální značkování se pro AI Overviews ani AI Mode nevyžaduje. Stránka o strukturovaných datech (intro-structured-data) navíc neobsahuje ani jednu zmínku o AI Overviews nebo AI Mode. John Mueller v květnu 2025 v článku o AI vyhledávání napsal, že strukturovaná data „makes pages eligible for certain search features and rich results", ale bez jakéhokoli tvrzení o vlivu na AI ranking.

OpenAI, Anthropic ani Perplexity čtení strukturovaných dat nedeklarují. Perplexity navíc přímo píše, že PerplexityBot „is not used to crawl content for AI foundation models", tedy ani u toho bota, který web skutečně navštěvuje, není jisté, k čemu přesně data z něj slouží.

Nejlepší dostupné měření

Ahrefs porovnal 1 885 stránek, které si samy přidaly JSON-LD, proti 4 000 párovaným kontrolním stránkám (srpen 2025 – březen 2026, difference-in-differences metoda). Výsledek: ChatGPT +2,2 %, Google AI Mode +2,4 %, a obě hodnoty jsou statisticky nevýznamné. Google AI Overviews −4,6 %, a tenhle výsledek už signifikantní je. Autoři studie sami napsali, že rozdíl „could easily be random noise".

Kontrolovaný experiment Otterly (březen 2026)

Jediný kontrolovaný experiment v oboru naměřil u Google AI Overviews nárůst, ale u ChatGPT, Gemini, Perplexity i Copilotu pokles. Informaci vloženou pouze do schematu (tedy nikoli do viditelného textu stránky) nepoužila žádná z testovaných platforem. To je klíčové zjištění: schema nenahrazuje obsah, jen ho popisuje strojově čitelnou formou navíc.

Rozdíl mezi Google AI Overviews (nárůst) a ostatními platformami (pokles) má pravděpodobné technické vysvětlení, i když ho žádný ze zdrojů výslovně nepotvrzuje: AI Overviews stojí na stejném indexu a stejném vyhodnocení stránky jako klasické Google Search, takže strukturovaná data tam mohou hrát roli přes kvalifikaci pro rich results, ne přes samotný jazykový model. ChatGPT, Perplexity, Gemini a Copilot naproti tomu skládají odpověď jinak, a to z toho, co jejich vlastní crawler stáhl a jazykový model vyhodnotil jako relevantní text, kde schema není prioritní vstup.

Tvrzením, kterým nevěřit

  • „Microsoft potvrdil, že schema pomáhá Copilotu" (citováno k Fabrice Canel, 3/2025), jenže v Bing blogu o strukturovaných datech taková zmínka není, tvrzení se nepodařilo dohledat.
  • „Generické schema je o 18 procentních bodů horší než žádné": pochází ze self-publikovaného preprintu bez recenze od majitele komerční GEO agentury. Jednotlivá čísla souhlasí, ale souhrnný efekt „má schema vs. nemá schema" vyšel statisticky nevýznamný (p = 0,296) a u citovaného srovnání chybí p-hodnota i velikost podskupiny.
  • „Ahrefs naměřil zlepšení o 2,2 %": číslo je pravé, ale autoři ho sami odmítají číst jako důkaz efektu a citace zamlčuje signifikantní pokles u AI Overviews ve stejné studii.
  • „Experiment dokázal, že modely schema neparsují" (Mark Williams-Cook, 2/2026): experiment je reálný a ověřitelný, ale je to jedna stránka a jeden prompt; autor sám píše, že to neprokazuje, že by modely schema ignorovaly úplně.

Společný jmenovatel všech čtyř tvrzení: každé staví na jednom nedokonalém měření a přidává mu jistotu, kterou samo měření nemá. Je to pochopitelné, protože jednoznačná odpověď „zavádí návštěvnost“ se prodává líp než „efekt je v mezích šumu“, ale je to přesně ten druh zjednodušení, kterému se tenhle text snaží vyhnout.

FAQPage: co zrušil Google, a co ne

Google 7. 5. 2026 zrušil zobrazování FAQPage rich results, tedy rozbalovací otázky a odpovědi přímo pod odkazem ve výsledcích. Search Console report a Rich Results Test k FAQPage zmizely v červnu 2026, API podpora v srpnu 2026. Typ FAQPage samotný je dál platný a Google ho dál parsuje pro porozumění obsahu stránky. Jestli ho čtou i AI platformy, nevíme: Perplexity strukturovaná data ve vlastní dokumentaci crawlerů nezmiňuje, OpenAI ani Anthropic jejich čtení nedeklarují a u Bingu se tvrzení nepodařilo dohledat. Co ale neplatí, je, že FAQPage přinese vizuálně rozbalovací Q&A pod výsledkem v Googlu, protože tuhle funkci Google zrušil.

Kde strukturovaná data nasadit nejdřív

Pokud se rozhodujete, kterými typy začít, drží se pořadí podle toho, co Google skutečně kvalifikuje pro rich results, ne podle domněnek o AI: Organization/WebSite na homepage (identita provozovatele), Article/BlogPosting na články (autor, datum vydání, tedy přesně ty údaje, podle kterých se pozná aktuálnost a důvěryhodnost zdroje), Product na produktových stránkách a FAQPage/HowTo tam, kde na stránce už fakticky je vzorec otázka–odpověď nebo návod krok za krokem. Nevytvářejte FAQ sekci uměle jen kvůli schematu, protože schema popisuje obsah, který na stránce je, ne obsah, který byste tam chtěli mít kvůli značkování.

Co z toho plyne pro váš web

Strukturovaná data smíte popisovat jako strojově čitelný, jednoznačný popis obsahu, díky kterému Google kvalifikuje stránky pro rich results v klasickém vyhledávání. Co ale nejde poctivě tvrdit: že strukturovaná data AI systémy čtou nebo že zvyšují citovanost v jejich odpovědích. To nikdo z velkých poskytovatelů nedeklaruje a nejlepší dostupná měření ukazují efekt v mezích šumu, u některých platforem dokonce pokles.

Na rozdíl od llms.txt (viz samostatný článek) ale strukturovaná data zůstávají doporučením, ne jen neutrální volbou, protože Google je sám doporučuje kvůli klasickému vyhledávání, jen ne jako páku na AI viditelnost.

Poslední poznámka k datům samotným: schema má být přesný, ověřitelný popis toho, co je na stránce doopravdy vidět, tedy datum vydání, které sedí, autor, který existuje, cena, která platí. Nepřesné nebo zastaralé schema je horší než žádné, protože poskytovatelé vyhledávání (Google výslovně) penalizují nesoulad mezi strukturovanými daty a viditelným obsahem stránky.

Krátce shrnuto: schema patří na web kvůli klasickému vyhledávání a strojové čitelnosti obecně, ne jako nástroj na AI citace, a tenhle rozdíl stojí za to mít v hlavě, až vám ho někdo bude prodávat jako první.

Torumata JSON-LD snippety generuje a v auditu je doporučí (kontroly SCH-01–SCH-03), tedy jako investici do klasického vyhledávání a budoucí strojové čitelnosti, ne jako slib citace v AI. Spusťte bezplatný audit a zjistěte, kde vám strukturovaná data chybí.

Zdroje