Proč Torumata, a ne jazykový model po vlastní ose
Snadno se řekne, že Torumata je v podstatě totéž, jako když si pustíte ChatGPT nad vlastním webem. Není. Ne proto, že by model byl hloupý, ale proto, že nevidí celý web, neumí měřit a jeho výsledek nejde zopakovat ani doložit. Torumata web stáhne jako robot, 31 věcí změří deterministicky a model použije jen tam, kde má smysl: na hodnocení obsahu, s pojistkami proti vymyšleným tvrzením.
Platí to pro firemní web nebo e-shop o 20 až několika stech stránkách, u kterého chcete vědět, co z něj AI vyhledávače a asistenti opravdu dostanou, výsledek za měsíc porovnat a předat agentuře. Na jednu stránku nebo text, který teprve píšete, je model po vlastní ose dál správná volba.
Co znamená analýza webu pro AI
Mezi webem a odpovědí asistenta stojí tři brány a teprve za nimi obsah. Pořadí vrstev je pořadí důležitosti: stránka, kterou robot nedostane, nemá žádný obsah, ať je napsaná sebelíp.
| Vrstva | Co rozhoduje | Jde změřit zvenčí? |
|---|---|---|
| 1. robots.txt | Kterým robotům web dovoluje číst | Ano, soubor je veřejný |
| 2. síť před webem (CDN) | Zda síť pustí robota podle jména | Částečně: přítomnost sítě ano, nastavení ne |
| 3. hosting | Firewall blokující adresy podle pověsti, i adresy AI služeb | Ne, ví to jen hosting |
| 4. obsah stránky | Text v HTML, nebo až z JavaScriptu; citovatelná fakta | Ano, stažením bez prohlížeče i s ním |
| 5. přístupnost | Kontrast, struktura, odkazy | Ano, podle WCAG |
Google má ve vlastní dokumentaci, že stránka musí být indexovaná a způsobilá pro běžné vyhledávání, aby se mohla objevit v AI Overviews nebo AI Mode (Google Search Central). Je to jediná nutná podmínka, kterou někdo doložil. U obsahu existuje jediný recenzovaný experiment, Princeton, KDD 2024, 10 000 dotazů (arXiv 2311.09735): citáty v textu zvedly viditelnost v odpovědích o 41 %, konkrétní statistiky o 33 %, odkazy na zdroje o 28 %. To je doložený efekt. Strukturovaná data, soubor llms.txt ani autorita domény doložený efekt nemají: dělat se můžou, slibovat ne.
Když web analyzuje jazykový model po vlastní ose
Model v chatu dostane z webu jen to, co mu nástroj na čtení stránek podstrčí, a k tomu vlastní dojem. Šest důvodů, proč z toho analýza webu nevznikne:
- Vidí jednotky stránek, ne web. Nástroj stahuje stránky na požádání, ne celý web podle odkazů a sitemapy. U webu o 120 stránkách model zpravidla přečte titulku a pár podstránek a zbytek si domyslí.
- Nevykresluje JavaScript. Menu, produkty a ceny skládané JavaScriptem v HTML ze serveru nejsou. Model pak hlásí „stránka nemá obsah“, nebo obsah, který si doplnil podle názvu. AI crawleři JavaScript také nevykreslují (s výjimkou Gemini a Applebota), takže právě tenhle rozdíl potřebujete změřit, ne odhadnout.
- Stačí zámek na bráně a model o tom lže. V našem měření z října 2026 vrátil nástroj claude.ai u 19 z 20 webů bez HTTPS hlášku, že web zakazuje automatický přístup. Ty weby nic nezakazovaly, jen neměly šifrované připojení (článek s daty). Stejně dopadne firewall hostingu.
- Neumí měřit. Kontrast textu, které stránky vrací 404, jestli canonical sedí se sitemapou, kolik stran má duplicitní titulek. Model tato čísla jen odhadne, se stejnou jistotou, jako by je změřil.
- Nerozlišuje, co ví a co si domyslel. GPTBot, OAI-SearchBot a ChatGPT-User jsou tři různí roboti jedné firmy, každý s vlastními pravidly v robots.txt. Model zná stav z tréninku a nic ho nenutí říct, že soubor nečetl. Přínos strukturovaných dat nebo
llms.txtpopisuje, jak o nich píše marketing, ne jak je změřily studie. - Výsledek nejde zopakovat ani předat. Dva stejné dotazy dají dva různé seznamy, bez záznamu k porovnání za měsíc.
Tohle není kritika modelu: stejný typ modelu používá Torumata na hodnocení obsahu. Rozdíl je v tom, co mu kdo podstrčí a co se s odpovědí děje dál.
Jak to dělá Torumata
- Crawler stáhne web jako robot, podle sitemapy a odkazů, každou stránku bez prohlížeče i s ním.
- 31 deterministických kontrol nad staženým webem: robots.txt pravidlo za pravidlem pro každého AI robota, 404, canonical, duplicity, kontrast a další, každý nález s naměřenou hodnotou. Co se měří, popisuje manuál kontrol.
- Jazykový model jen na obsah, nad vzorkem stránek, se změřenými fakty na vstupu, se stropem 3 $ na audit a přes poskytovatele s regionem EU.
- Report a soubory k nasazení: tabulka nálezů, CSV, PDF,
llms.txt, JSON-LD a záplata robots.txt vygenerované z toho, co se na webu změřilo.
Pojistky: každý krok zapisuje výsledek průběžně, takže když model nebo prohlížeč selže, změřené nálezy z předchozích kroků zůstanou. Model nikdy nedostane syrový web jako pokyny: obsah je obalený jako nedůvěryhodný vstup a každá odpověď se validuje proti schématu.
A měří se i to, jestli nálezy platí. V září 2026 jsme nálezy produkčních auditů tří domén ověřili ručně proti živému webu, u každého s příkazem a výstupem. Ve třech kolech oprav klesl podíl nepravdivých nálezů z 10,3 % (55 z 533) na 0,17 % (1 z 581). Žádná z nalezených vad nebyla halucinace modelu; všechny byly v deterministických kontrolách a daly se opravit testem, který je nepustí zpátky.
Srovnání bod po bodu
| Kritérium | Model po vlastní ose | Torumata |
|---|---|---|
| Rozsah | Jednotky stránek, které mu zadáte | Celý web: 12 stránek zdarma, desítky až stovky v placeném auditu |
| Hodnocení obsahu | Dobré, ale nad zlomkem webu | Stejný typ modelu, se změřenými fakty a pojistkami |
| Pravdivost | Nejde zjistit | Každé tvrzení zařazené do třídy; 0,17 % nepravd při poslední kontrole |
| Opakovatelnost | Dva dotazy, dva výsledky | Stejný web, stejné deterministické nálezy |
| Předání dodavateli | Odstavec textu | Tabulka: stránka, místo, závažnost, kdo opraví; CSV, PDF |
| Soukromí dat | Podle nastavení vašeho účtu | Model v regionu EU, výstupy na serverech v ČR |
Kde je model po vlastní ose lepší
- Jedna stránka, jeden text. Jestli odstavec odpovídá na otázku zákazníka konkrétně, posoudí model s textem před sebou.
- Obsah, který teprve vzniká. Návrh FAQ, struktura nové stránky, varianty nadpisu. Není co měřit, je co psát.
- Web o pěti stránkách bez JavaScriptu. Ruční průchod zabere stejně dlouho a nic podstatného neunikne.
- Vysvětlení pojmu nebo nálezu. Proč záleží na canonical, model vysvětlí lépe než tabulka.
- Druhý názor na hotový report. Nechat model přečíst výstup Torumaty a zeptat se, co dělat první.
Společný jmenovatel: model je dobrý tam, kde má celý vstup před sebou a nikdo nepotřebuje výsledek zopakovat nebo doložit.
Co Torumata dnes neumí
Stejná poctivost, jakou žádáme od nálezů, platí pro produkt. Stav k 8. 10. 2026; všechny body jsou v plánu oprav:
- Pozná, že web běží za CDN, ale neměří, jestli síť AI roboty pouští. To si ověříte ve správě sítě; report vás na to upozorní.
- Firewall hostingu neměří, zvenčí to nejde. V reportu je to otevřená otázka, ne „v pořádku“.
- Doporučení modelu k obsahu nemají seznam konkrétních stránek ani roli, kdo opraví. U deterministických nálezů seznam stránek je vždy.
- Veřejně dostupné aplikační části webu mohou přidat nálezy o meta popisech místo jednoho nálezu o neveřejné části.
- Při porovnání dvou auditů se nález na stránce, která z crawlu vypadla, počítá jako opravený; sledujte i seznam chybějících stránek.
- Rychlost stránky (LCP) se měří na vzorku a kolísá i u téže stránky; rozhoduje trend přes více auditů.
Čas a náklady
Pro web o 100 stránkách. Čas po vlastní ose je odhad z našich vlastních pokusů, ne měření u zákazníků; ceny Torumaty jsou ceník k 8. 10. 2026.
| Model po vlastní ose | Torumata | |
|---|---|---|
| Stažení webu | Ručně nebo skriptem, 1–3 h včetně JS stránek | 0 h, součást auditu |
| Vyhodnocení | 100 × vložit, zeptat se, zapsat: 3–6 h | ~10–25 min běhu, bez obsluhy |
| Přímé náklady | Předplatné, obvykle 20 € měsíčně; čas 5–10 h | Plný audit 100 stránek v jednotkách kreditů (1 kredit ≈ 1 €), balíčky od 10 € |
Podstatné není, že Torumata je levnější. Podstatné je, že čas po vlastní ose se platí při každém opakování znovu a výsledky dvou běhů se nedají porovnat, protože model dostal pokaždé jiný vstup.
Závěr a doporučení
Model a Torumata nejsou dvě odpovědi na stejnou otázku. Model odpovídá na „co si o tomto textu myslíš“, Torumata na „co je na tomto webu změřitelně v nepořádku a kdo to opraví“. U celého webu model po vlastní ose selhává na prvním kroku: nevidí web tak, jak ho vidí roboti, a nikdo mu nedá změřená fakta, nad kterými by hodnotil.
Doporučený postup: spustit bezplatný audit Torumaty (12 stránek, bez karty), podle výsledku rozhodnout o plném auditu, nálezy předat dodavateli v tabulce a za měsíc zopakovat. Model v chatu použít na to, co Torumata neumí: psaní nového obsahu a vysvětlení nálezů.
Zdroje
- Google Search Central: AI features and your website (ověřeno 2026-10-08)
- Aggarwal et al.: GEO: Generative Engine Optimization (arXiv 2311.09735, KDD 2024) (ověřeno 2026-10-08)
- Hatteria Labs: Co se 15. září stalo s AI roboty na evropském webu (2026-10-05) (ověřeno 2026-10-08)
- Torumata: manuál kontrol (ověřeno 2026-10-08)