Co doložitelně zvyšuje šanci, že vás AI ocituje

Když vyloučíte llms.txt (viz samostatný článek) a strukturovaná data (viz Strukturovaná data a AI) jako doložené páky na citovanost, zbývá jedna zásadní otázka: čím se tedy řídit? Tohle je odpověď seřazená podle síly důkazu, tedy od nejtvrdšího faktu po to, co oporu nemá vůbec.

1. Indexovatelnost jako nutná podmínka

„To be eligible to be shown as a supporting link in AI Overviews or AI Mode, a page must be indexed and eligible to be shown in Google Search with a snippet. There are no additional requirements."Google Search Central, AI features in Search

Tohle je nejtvrdší fakt celého přehledu, protože ho má přímo Google ve vlastní dokumentaci. Aby se stránka vůbec mohla objevit jako podpůrný odkaz v AI Overviews, tedy v generovaném souhrnu nad klasickými výsledky, nebo v AI Mode, konverzačním režimu vyhledávání Google, musí být napřed indexovaná a způsobilá k zobrazení v klasickém vyhledávání. Žádné další požadavky Google neuvádí. Microsoft Copilot staví na indexu Bingu, takže platí totéž.

Z toho plyne, že kontroly indexovatelnosti, tedy jestli vás robots.txt nezakazuje, jestli máte sitemap.xml, jestli stránka vrací 200 a ne chybu, nejsou „taky užitečné pro AI". Jsou vstupenkou. Bez ní je zbytek irelevantní.

Základní checklist indexovatelnosti, který si můžete projít sami: stránka není v robots.txt zakázaná pro Googlebot, nemá meta tag noindex (pokyn vyhledávači, aby stránku do indexu nezařazoval), vrací HTTP 200 (ne přesměrování ani chybu), je v sitemap.xml a má aspoň jeden interní odkaz vedoucí na ni odjinud z webu. Chybějící kterýkoli z těchhle pěti bodů znamená, že stránka nemá šanci se objevit v AI Overviews ani AI Mode, a to bez ohledu na to, jak kvalitní je její obsah.

2. AI crawleři nerenderují JavaScript

Analýza edge logů Vercelu (nextjs.org a dva job boardy s odlišnými frameworky, prosinec 2024) ukázala, že GPTBot, ChatGPT-User, OAI-SearchBot, ClaudeBot, PerplexityBot, Bytespider ani Meta-ExternalAgent JavaScript nespouštějí, takže soubory stáhnou, ale nevyhodnotí. Výjimkou jsou Gemini a Applebot, které renderují. Je to jediný nezávislý zdroj s popsanou metodikou, který se nám podařilo dohledat, a druhý se ověřit nepovedlo.

Prakticky to znamená: obsah, který se do stránky dostává až po načtení JavaScriptem (typicky aplikace v Reactu nebo Vue bez server-side renderu, tedy bez vykreslení obsahu už na serveru), většina AI crawlerů prostě nevidí. Detailně to rozebírá samostatný článek JavaScript a AI crawlery.

3. Citovatelnost obsahu a jediný recenzovaný experiment v oboru

Princeton (arXiv 2311.09735, publikováno na KDD 2024) je jediný recenzovaný experiment v celém oboru GEO a AEO, tedy přípravy webu pro generativní vyhledávání a odpovídací asistenty. Autoři položili 10 000 dotazů a měřili zvenčí, bez přístupu do útrob testovaných systémů (black-box test). Změřili, co konkrétně zvedlo viditelnost stránky v generovaných odpovědích:

FaktorNaměřený nárůst viditelnosti
Citáty přímo v textu+41 %
Konkrétní statistiky+33 %
Odkazy na zdroje+28 %

Je to nejlépe podložená páka, jakou v oboru máme, a týká se obsahu, ne techniky webu, tedy psaní, ne konfigurace. Odkazy na zdroje jsou přesně to, co v Torumatě měří kontrola AUTH-01; citáty a konkrétní statistiky dnes v auditu neměříme, ale platí stejně: text s prokazatelnými čísly a odkazy na primární zdroje má měřeně vyšší šanci na citaci.

Co konkrétně to v praxi znamená: věta „naše řešení šetří čas" nemá nic z toho, co experiment měřil. Věta „podle interní studie z roku 2026 u 240 zákazníků řešení zkrátilo průměrný čas zpracování o 31 % (zdroj: [odkaz na studii])" má konkrétní statistiku i odkaz na zdroj zároveň, tedy přesně kombinaci faktorů, která v Princeton experimentu zvedla citovanost nejvíc.

4. Vazba na klasické pořadí ve vyhledávání je slabá a slábne

Dobré umístění v klasických výsledcích pomáhá, ale zdaleka není zárukou citace v AI odpovědi. Ahrefs zaznamenal, že podíl citací v AI Overviews pocházejících z top 10 klasických výsledků klesl přibližně ze 76 % (červenec 2025) na 37,9 % (březen 2026, 863 tisíc dotazů). Semrush na vzorku 200 tisíc klíčových slov naměřil překryv jen kolem 20–26 % a jen 46 % desktopových AI Overviews odkazuje na první organický výsledek.

Shrnuto: dobré pořadí je podle bodu 1 nutné (musíte být indexovaní a způsobilí k zobrazení), ale zdaleka ne dostačující pro citaci v AI odpovědi. Praktický důsledek: web na páté nebo desáté pozici v klasickém vyhledávání může být citovaný v AI odpovědi častěji než web na první pozici, pokud má lepší kombinaci citátů, statistik a odkazů na zdroje z bodu 3. To je z pohledu tradičního SEO kontraintuitivní, ale odpovídá to tomu, jak generativní vyhledávání skládá odpověď, protože nevybírá jeden „nejlepší“ výsledek, ale kombinuje pasáže z více zdrojů.

5. Co nemá oporu

Autorita domény, zpětné odkazy ani stáří domény, to všechno jsou klasická SEO tvrzení přenesená do GEO bez vlastního důkazu. Velké nástroje, které sledují citace v AI odpovědích, tyhle faktory vůbec neanalyzují. Nezavádíme je do skóre a nedoporučujeme na nich stavět strategii, dokud se to nezmění.

To neznamená, že zpětné odkazy nebo stáří domény nemají žádnou hodnotu, vždyť v klasickém SEO ji dál mají, a tenhle text netvrdí opak. Jde jen o to, že pro citovanost v AI odpovědích chybí důkaz, a proto se do tohohle žebříčku nedostaly.

Co s tím prakticky

Pořadí, ve kterém stojí za to na těchhle pěti bodech pracovat, kopíruje sílu důkazu výš: nejdřív indexovatelnost (bod 1), pak ověřit, že AI crawlery vidí hlavní obsah stránky a ne prázdnou schránku čekající na JavaScript (bod 2), a teprve pak se pustit do psaní, tedy doplnit citáty, konkrétní čísla a odkazy na zdroje (bod 3). Investovat čas do bodu 3 dřív, než je vyřešený bod 1 nebo 2, nemá smysl: sebelépe napsaný text, který crawler nikdy nedostane, je z pohledu citovanosti neviditelný.

Co jsme nedohledali

Poctivě: postavení Microsoftu/Bingu k llms.txt jsme nedohledali, druhý nezávislý zdroj k JavaScript renderingu se nepodařilo najít, a korelaci mezi věkem domény a citovaností jsme neměřili ani nenašli měřenou jinde. Tohle nejsou zamlčené detaily, ale přiznaná hranice toho, co dnes jde ověřit.

Doplníme je, jakmile se ty zdroje najdou, a pokud narazíte na zdroj, který nám unikl, budeme rádi za upozornění. Tenhle text není uzavřený dokument, ale živý přehled, který se s novými zjištěními aktualizuje.

Chcete vědět, jak si vaše indexovatelnost a JavaScript rendering stojí konkrétně? Spusťte bezplatný audit.

Zdroje