Proč Torumata, a ne jazykový model po vlastní ose

Snadno se řekne, že Torumata je v podstatě totéž, jako když si pustíte ChatGPT nad vlastním webem. Není. Ne proto, že by model byl hloupý, ale proto, že nevidí celý web, neumí měřit a jeho výsledek nejde zopakovat ani doložit. Torumata web stáhne jako robot, 31 věcí změří deterministicky a model použije jen tam, kde má smysl: na hodnocení obsahu, s pojistkami proti vymyšleným tvrzením.

Platí to pro firemní web nebo e-shop o 20 až několika stech stránkách, u kterého chcete vědět, co z něj AI vyhledávače a asistenti opravdu dostanou, výsledek za měsíc porovnat a předat agentuře. Na jednu stránku nebo text, který teprve píšete, je model po vlastní ose dál správná volba.

Co znamená analýza webu pro AI

Mezi webem a odpovědí asistenta stojí tři brány a teprve za nimi obsah. Pořadí vrstev je pořadí důležitosti: stránka, kterou robot nedostane, nemá žádný obsah, ať je napsaná sebelíp.

VrstvaCo rozhodujeJde změřit zvenčí?
1. robots.txtKterým robotům web dovoluje čístAno, soubor je veřejný
2. síť před webem (CDN)Zda síť pustí robota podle jménaČástečně: přítomnost sítě ano, nastavení ne
3. hostingFirewall blokující adresy podle pověsti, i adresy AI služebNe, ví to jen hosting
4. obsah stránkyText v HTML, nebo až z JavaScriptu; citovatelná faktaAno, stažením bez prohlížeče i s ním
5. přístupnostKontrast, struktura, odkazyAno, podle WCAG

Google má ve vlastní dokumentaci, že stránka musí být indexovaná a způsobilá pro běžné vyhledávání, aby se mohla objevit v AI Overviews nebo AI Mode (Google Search Central). Je to jediná nutná podmínka, kterou někdo doložil. U obsahu existuje jediný recenzovaný experiment, Princeton, KDD 2024, 10 000 dotazů (arXiv 2311.09735): citáty v textu zvedly viditelnost v odpovědích o 41 %, konkrétní statistiky o 33 %, odkazy na zdroje o 28 %. To je doložený efekt. Strukturovaná data, soubor llms.txt ani autorita domény doložený efekt nemají: dělat se můžou, slibovat ne.

Když web analyzuje jazykový model po vlastní ose

Model v chatu dostane z webu jen to, co mu nástroj na čtení stránek podstrčí, a k tomu vlastní dojem. Šest důvodů, proč z toho analýza webu nevznikne:

  1. Vidí jednotky stránek, ne web. Nástroj stahuje stránky na požádání, ne celý web podle odkazů a sitemapy. U webu o 120 stránkách model zpravidla přečte titulku a pár podstránek a zbytek si domyslí.
  2. Nevykresluje JavaScript. Menu, produkty a ceny skládané JavaScriptem v HTML ze serveru nejsou. Model pak hlásí „stránka nemá obsah“, nebo obsah, který si doplnil podle názvu. AI crawleři JavaScript také nevykreslují (s výjimkou Gemini a Applebota), takže právě tenhle rozdíl potřebujete změřit, ne odhadnout.
  3. Stačí zámek na bráně a model o tom lže. V našem měření z října 2026 vrátil nástroj claude.ai u 19 z 20 webů bez HTTPS hlášku, že web zakazuje automatický přístup. Ty weby nic nezakazovaly, jen neměly šifrované připojení (článek s daty). Stejně dopadne firewall hostingu.
  4. Neumí měřit. Kontrast textu, které stránky vrací 404, jestli canonical sedí se sitemapou, kolik stran má duplicitní titulek. Model tato čísla jen odhadne, se stejnou jistotou, jako by je změřil.
  5. Nerozlišuje, co ví a co si domyslel. GPTBot, OAI-SearchBot a ChatGPT-User jsou tři různí roboti jedné firmy, každý s vlastními pravidly v robots.txt. Model zná stav z tréninku a nic ho nenutí říct, že soubor nečetl. Přínos strukturovaných dat nebo llms.txt popisuje, jak o nich píše marketing, ne jak je změřily studie.
  6. Výsledek nejde zopakovat ani předat. Dva stejné dotazy dají dva různé seznamy, bez záznamu k porovnání za měsíc.

Tohle není kritika modelu: stejný typ modelu používá Torumata na hodnocení obsahu. Rozdíl je v tom, co mu kdo podstrčí a co se s odpovědí děje dál.

Jak to dělá Torumata

  1. Crawler stáhne web jako robot, podle sitemapy a odkazů, každou stránku bez prohlížeče i s ním.
  2. 31 deterministických kontrol nad staženým webem: robots.txt pravidlo za pravidlem pro každého AI robota, 404, canonical, duplicity, kontrast a další, každý nález s naměřenou hodnotou. Co se měří, popisuje manuál kontrol.
  3. Jazykový model jen na obsah, nad vzorkem stránek, se změřenými fakty na vstupu, se stropem 3 $ na audit a přes poskytovatele s regionem EU.
  4. Report a soubory k nasazení: tabulka nálezů, CSV, PDF, llms.txt, JSON-LD a záplata robots.txt vygenerované z toho, co se na webu změřilo.

Pojistky: každý krok zapisuje výsledek průběžně, takže když model nebo prohlížeč selže, změřené nálezy z předchozích kroků zůstanou. Model nikdy nedostane syrový web jako pokyny: obsah je obalený jako nedůvěryhodný vstup a každá odpověď se validuje proti schématu.

A měří se i to, jestli nálezy platí. V září 2026 jsme nálezy produkčních auditů tří domén ověřili ručně proti živému webu, u každého s příkazem a výstupem. Ve třech kolech oprav klesl podíl nepravdivých nálezů z 10,3 % (55 z 533) na 0,17 % (1 z 581). Žádná z nalezených vad nebyla halucinace modelu; všechny byly v deterministických kontrolách a daly se opravit testem, který je nepustí zpátky.

Srovnání bod po bodu

KritériumModel po vlastní oseTorumata
RozsahJednotky stránek, které mu zadáteCelý web: 12 stránek zdarma, desítky až stovky v placeném auditu
Hodnocení obsahuDobré, ale nad zlomkem webuStejný typ modelu, se změřenými fakty a pojistkami
PravdivostNejde zjistitKaždé tvrzení zařazené do třídy; 0,17 % nepravd při poslední kontrole
OpakovatelnostDva dotazy, dva výsledkyStejný web, stejné deterministické nálezy
Předání dodavateliOdstavec textuTabulka: stránka, místo, závažnost, kdo opraví; CSV, PDF
Soukromí datPodle nastavení vašeho účtuModel v regionu EU, výstupy na serverech v ČR

Kde je model po vlastní ose lepší

  • Jedna stránka, jeden text. Jestli odstavec odpovídá na otázku zákazníka konkrétně, posoudí model s textem před sebou.
  • Obsah, který teprve vzniká. Návrh FAQ, struktura nové stránky, varianty nadpisu. Není co měřit, je co psát.
  • Web o pěti stránkách bez JavaScriptu. Ruční průchod zabere stejně dlouho a nic podstatného neunikne.
  • Vysvětlení pojmu nebo nálezu. Proč záleží na canonical, model vysvětlí lépe než tabulka.
  • Druhý názor na hotový report. Nechat model přečíst výstup Torumaty a zeptat se, co dělat první.

Společný jmenovatel: model je dobrý tam, kde má celý vstup před sebou a nikdo nepotřebuje výsledek zopakovat nebo doložit.

Co Torumata dnes neumí

Stejná poctivost, jakou žádáme od nálezů, platí pro produkt. Stav k 8. 10. 2026; všechny body jsou v plánu oprav:

  • Pozná, že web běží za CDN, ale neměří, jestli síť AI roboty pouští. To si ověříte ve správě sítě; report vás na to upozorní.
  • Firewall hostingu neměří, zvenčí to nejde. V reportu je to otevřená otázka, ne „v pořádku“.
  • Doporučení modelu k obsahu nemají seznam konkrétních stránek ani roli, kdo opraví. U deterministických nálezů seznam stránek je vždy.
  • Veřejně dostupné aplikační části webu mohou přidat nálezy o meta popisech místo jednoho nálezu o neveřejné části.
  • Při porovnání dvou auditů se nález na stránce, která z crawlu vypadla, počítá jako opravený; sledujte i seznam chybějících stránek.
  • Rychlost stránky (LCP) se měří na vzorku a kolísá i u téže stránky; rozhoduje trend přes více auditů.

Čas a náklady

Pro web o 100 stránkách. Čas po vlastní ose je odhad z našich vlastních pokusů, ne měření u zákazníků; ceny Torumaty jsou ceník k 8. 10. 2026.

Model po vlastní oseTorumata
Stažení webuRučně nebo skriptem, 1–3 h včetně JS stránek0 h, součást auditu
Vyhodnocení100 × vložit, zeptat se, zapsat: 3–6 h~10–25 min běhu, bez obsluhy
Přímé nákladyPředplatné, obvykle 20 € měsíčně; čas 5–10 hPlný audit 100 stránek v jednotkách kreditů (1 kredit ≈ 1 €), balíčky od 10 €

Podstatné není, že Torumata je levnější. Podstatné je, že čas po vlastní ose se platí při každém opakování znovu a výsledky dvou běhů se nedají porovnat, protože model dostal pokaždé jiný vstup.

Závěr a doporučení

Model a Torumata nejsou dvě odpovědi na stejnou otázku. Model odpovídá na „co si o tomto textu myslíš“, Torumata na „co je na tomto webu změřitelně v nepořádku a kdo to opraví“. U celého webu model po vlastní ose selhává na prvním kroku: nevidí web tak, jak ho vidí roboti, a nikdo mu nedá změřená fakta, nad kterými by hodnotil.

Doporučený postup: spustit bezplatný audit Torumaty (12 stránek, bez karty), podle výsledku rozhodnout o plném auditu, nálezy předat dodavateli v tabulce a za měsíc zopakovat. Model v chatu použít na to, co Torumata neumí: psaní nového obsahu a vysvětlení nálezů.

Zdroje