ACC-02
Web nemá soubor llms.txt
Co kontrola měří
Audit pošle na kořen vaší domény jediný požadavek na /llms.txt (pod naším vlastním User-Agentem, aby bylo v logu vidět, kdo se ptal) a sleduje výhradně návratový kód. HTTP 200 znamená, že soubor existuje, cokoli jiného (404, 5xx, timeout, chyba DNS) se počítá jako „soubor tam není“. Nález ACC-02 vznikne jen v tom druhém případě.
Co kontrola nedělá (a je férové to vědět, než se podle ní zařídíte):
- Obsah souboru se nestahuje ani neukládá. Prázdný
llms.txtprojde přesně tak jako pečlivě sestavený rozcestník. - Neporovnává se se specifikací z llmstxt.org: chybějící H1 nebo rozbité odkazy uvnitř souboru kontrola nepozná.
- Neporovnává se s mapou webu ani se sitemapou. Že soubor odkazuje na stránky, které už neexistují,
ACC-02neodhalí. - Nekontroluje se
/llms-full.txt. Ten není součástí jádra specifikace, je to konvence zavedená nástroji.
Je to tedy kontrola přítomnosti, ne kvality. Platí pro celý web (ne pro jednotlivé stránky), takže se v reportu objeví nanejvýš jednou. A protože je vedená jako informativní, skóre vám nesnižuje ani o bod; informativní nálezy mají v našem modelu váhu nula.
Jak silný důkaz za tím stojí
Doporučujeme to, protože to neuškodí nebo to má jiný užitek, ale vliv na to, jestli vás jazykové modely budou citovat, neslibujeme. Nikdo ho zatím nedoložil.
llms.txt je v každém druhém návodu na „optimalizaci pro AI“ uváděný jako první krok. My u něj říkáme rovnou: efekt na to, jestli vás jazykové modely budou citovat, doložený není. Nejde o opatrnost; jde o to, co stojí v dokumentaci provozovatelů.
| Kdo | Čte cizí llms.txt? | Podle čeho to víme |
|---|---|---|
| Google Search | Ne, výslovně | vlastní dokumentace Google, doplněno v červnu 2026 |
| OpenAI (GPTBot, OAI-SearchBot) | Nedeklaruje | přehled crawlerů popisuje výhradně robots.txt |
| Anthropic (ClaudeBot, Claude- | Nedeklaruje | support článek o crawlování (llms.txt v něm není ani jednou) |
| Perplexity, Microsoft, Meta, Mistral | Nedeklarují | dokumentace jejich crawlerů mluví jen o robots.txt |
| Nástroje na psaní kódu | Ano, doloženo | server-logy v měření Ahrefs, mezi user-agenty i Claude-Code |
K tomu měření provozu na 137 210 doménách (Ahrefs, červen 2026): soubor publikuje 28 % webů, ale 97 % z nich nedostane ani jeden požadavek. Mezi požadavky, které dorazí, jsou největší skupinou SEO auditní nástroje, tedy nástroje jako ten náš, ne jazykové modely.
Pozor na dva argumenty, které v článcích o llms.txt kolují a neobstojí. První: „OpenAI a Anthropic standard podporují, mají vlastní llms.txt.“ Mají, jenže v roli vydavatele obsahu pro cizí nástroje, ne konzumenta cizích souborů. To je opak toho, co se z toho vyvozuje. Druhý: číslo „408 požadavků z 500 milionů událostí“ se šíří bez jakékoli metodiky a navíc chybně připsané firmě, která publikovala úplně jiná čísla. Necitujeme ho.
Proč vám to píšeme, když nám to kazí prodejní argument. Nástroj, který u jedné položky přizná „tohle zatím efekt nemá“, je věrohodný ve zbytku. A zbytek auditu obsahuje kontroly, za kterými stojí vlastní dokumentace Googlu nebo recenzovaný experiment. Kdybychom vám llms.txt prodali jako cestu k citacím v ChatGPT, museli byste stejnou mírou nedůvěry změřit i všechno ostatní.
Soubor přesto dál generujeme a dál doporučujeme, jen z jiného důvodu, než se o něm běžně píše: u dokumentačních a vývojářských webů má užitek hned a prokazatelně, protože nástroje na psaní kódu ho skutečně stahují. A adopce meziročně roste, takže sázka na budoucnost stojí pár minut práce.
Jak to opravit
Nejdřív rozhodnutí, ne psaní. Provozujete dokumentaci, API, návody nebo cokoli, co čtou vývojáři? Pak llms.txt nasaďte, je to nejlevnější doložitelný užitek v celém auditu. Je to běžný firemní nebo e-shopový web? Pak je to volitelná položka: nechte ji až za ACC-01 (aby AI crawlery na web vůbec směly) a ACC-03 (aby na něm něco našly bez JavaScriptu). Tyhle dvě mají oporu, kterou ACC-02 nemá.
Když se pro něj rozhodnete, minimální platný soubor podle specifikace je krátký. Vznikne jako prostý markdown a musí být dostupný přesně na https:// (kořen, ne podadresář, ne přesměrování na jinou doménu; kontrola sleduje návratový kód, takže řetěz přesměrování končící 404 je pro ni neexistující soubor).
- H1 nadpis: jediná povinná část. Název webu nebo produktu.
- Blockquote (
> …): dvě věty o tom, co web je. Specifikace s ním počítá jako s úvodním shrnutím hned za nadpisem; co s ním který konkrétní nástroj udělá, doložené nemáme. - Volitelný volný text bez nadpisů: kontext, který se jinam nevejde.
- Sekce uvozené H2 se seznamy odkazů ve tvaru
- [název](url): krátká poznámka. Poznámka za dvojtečkou je volitelná, ale právě ona rozhoduje, jestli soubor k něčemu je. - Speciální sekce
## Optional: co z ní konzument smí vynechat, když potřebuje kratší kontext.
Tři chyby, které vidíme nejčastěji: soubor se vygeneruje jednou a zůstane roky (odkazy zestárnou dřív než obsah; generujte ho při buildu ze stejného zdroje jako sitemapu); dá se do něj celý web místo dvaceti opravdu důležitých stránek (smysl souboru je výběr, ne úplnost); a servíruje se s Content-Type: text/html, protože ho vygeneroval framework jako stránku. Funkčně to projde, ale je to markdown, patří mu text/plain nebo text/markdown.
A na závěr to hlavní: nečekejte od toho lepší viditelnost v odpovědích AI asistentů. Tu zatím doložit nelze. Čekejte, že vaši dokumentaci lépe pochopí nástroj, který v ní za vývojáře hledá, a že až se konvence prosadí, budete ji mít.
Co o tom říká report
Popis nálezu
Na doméně nebyl nalezen /llms.txt, tedy konvence podle llmstxt.org, kterou web nabízí jazykovým modelům strukturovaný rozcestník po svém obsahu. Vedeme to jako informaci, ne jako chybu: Google v červnu 2026 do své dokumentace výslovně doplnil, že soubor pro vyhledávání ani pro AI přehledy nepoužívá, a OpenAI ani Anthropic v dokumentaci svých crawlerů nedeklarují, že by ho četly. Prokazatelně po něm sahají nástroje pro psaní kódu, když potřebují pochopit cizí dokumentaci nebo API; proto ho mají weby jako Stripe, Vercel nebo Cloudflare.
Doporučení
Pokud provozujete dokumentaci, API nebo obsah určený vývojářům, llms.txt nasaďte: tam má užitek hned a práce je to na pár minut. U běžného firemního webu je to sázka na budoucnost: adopce meziročně roste, standard se může prosadit, a mít soubor rozhodně neuškodí. Nečekejte od něj ale zlepšení viditelnosti v odpovědích AI, to zatím doložit nelze. Přednostně řešte robots.txt (aby AI crawlery na web vůbec směly) a strukturovaná data, u těch je funkčnost doložená. Zdroje: specifikace https://
Zdroje
- llms.txt: kanonická specifikace (ověřeno 2026-08-02)
- Google Search Central: AI optimization guide (ověřeno 2026-08-19)
- OpenAI: Overview of OpenAI crawlers (ověřeno 2026-08-19)
- Anthropic Support: Does Anthropic crawl data from the web? (ověřeno 2026-08-19)
- Ahrefs: llms.txt adoption study (137 210 domén) (ověřeno 2026-08-19)
Text ověřen 2026-09-12