STR-04

Dlouhý úsek textu bez členění

InfoStruktura

Co kontrola měří

Stránka se rozseká na souvislé úseky textu a u každého se spočítají slova. Nález vznikne, když aspoň jeden úsek přesáhne 600 slov: tedy zhruba dvě a půl normostrany bez jediného předělu. Práh je v config/thresholds.json pod rule_engine.STR-04 jako max_section_words_without_subheading: 600 a pochází ze zadání produktu; text nálezu uvádí naměřenou délku úseku vedle něj.

Na úrovni nadpisů nezáleží. Kontrolu nezajímá, jestli sekci ukončí H2 nebo H4; jde jen o to, jestli je mezi dvěma sousedními děliči (nebo od posledního do konce stránky) víc textu, než práh dovoluje. Stránka bez jediného předělu je jeden úsek od začátku do konce.

Úsek ukončí nadpis h1 až h6, otázka sbalovacího seznamu (<summary>) a termín definičního seznamu (<dt>). Dvanáct sbalovacích otázek ani slovník se čtrnácti hesly se tedy za nečleněný text nepovažují, i když nadpis nemají ani jeden. Do úseku se taky nepočítá obal webu, tedy navigace, hlavička a patička. Obojí je v config/content-scope.json a obojí přibylo 2026-09-19, kdy se na produkci ukázalo, že devět nálezů ze třinácti hlásilo „souvislý text bez podnadpisu“ na obsahu, který členěný byl.

Co kontrola nedělá:

  • Nepozná členění, které nemá vlastní značku. Odstavce, odrážky, tabulky ani vodorovné čáry se nepočítají. Dobře odstavcovaný text o 700 slovech nález dostane.
  • Neposuzuje, jestli tam podnadpis patří. Dlouhá souvislá úvaha může být napsaná správně a rozsekat ji nadpisy by ji zhoršilo.
  • Nerozlišuje jazyky. V jazycích, které skládají slova dohromady, se stejně dlouhý text napočítá kratší.

Nález je na úrovni stránky a je informativní, ne varování. Skóre nesnižuje ani o bod. U kontroly, která měří jen délku, je to na místě.

Jak silný důkaz za tím stojí

Efekt nedoložený

Doporučujeme to, protože to neuškodí nebo to má jiný užitek, ale vliv na to, jestli vás jazykové modely budou citovat, neslibujeme. Nikdo ho zatím nedoložil.

Že rozdělení dlouhého textu podnadpisy zvýší vaši šanci na citaci, doložené nemáme. Žádný provozovatel to nedeklaruje a měření, které by to porovnalo, neznáme. Proto třída „efekt nedoložený“.

Úvaha za doporučením je následující a stojí za to ji znát, abyste si mohli udělat vlastní názor: když má asistent odpovědět na konkrétní otázku, potřebuje z vaší stránky vytáhnout kus, který dává smysl samostatně. Text, ve kterém se dva tisíce slov valí bez jediného předělu, takovou hranici nenabízí. Je to hypotéza odvozená z toho, jak se dlouhé dokumenty běžně zpracovávají, ne měření vašeho případu.

Co v téhle oblasti doložené je, se týká obsahu textu, ne jeho členění. Princetonský experiment (KDD 2024, 10 000 dotazů) naměřil nárůst viditelnosti u citátů (+41 %), konkrétních statistik (+33 %) a odkazů na zdroje (+28 %). Délka sekce mezi měřenými faktory nebyla ani jednou.

Praktický závěr: berte tenhle nález jako redakční připomínku, ne jako technickou vadu. Dlouhý neprodyšný blok textu odrazuje hlavně lidi, a to je důvod sám o sobě, jen není ten, kvůli kterému jste si audit koupili. Když je text napsaný tak, že se souvislý výklad rozdělit nedá, nález ignorujte. Proto je informativní.

Jak to opravit

Nejdřív si stránku přečtěte a zeptejte se, jestli ten dlouhý úsek má vnitřní strukturu, kterou jste jen nevyznačili. Většinou má. Pak stačí doplnit podnadpisy tam, kde už předěly reálně jsou:

  • Podnadpis na každých 200 až 400 slov je pohodlné čtení. Není to pravidlo, je to pozorování.
  • Podnadpis má pojmenovat, co pod ním je, ne oddělit text ozdobou. „Jak dlouho trvá vyřízení“ je podnadpis; „Dále“ není.
  • Držte úroveň podle vnoření, ne podle velikosti písma; jinak si vyrobíte STR-01.

Když text vnitřní strukturu nemá, protože je to jedna souvislá úvaha, pomůže jiná úprava. Ta často funguje líp než umělé nadpisy:

  1. Vytáhněte shrnutí nahoru. Tři odrážky se závěry před dlouhý výklad udělají pro srozumitelnost víc než pět podnadpisů uprostřed.
  2. Vyčleňte výčty do seznamu. Věta, která vyjmenovává šest věcí, je skoro vždycky seznam, který se rozhodl neudělat.
  3. Zvažte rozdělení na dvě stránky. Když text pokrývá dvě témata, jsou to dvě stránky, a každá z nich se pak dá najít a odkázat samostatně.

A jedna věc, kterou nedělejte: nevkládejte podnadpisy jen proto, aby zmizel nález. Stránka se sedmi nadpisy typu „Pokračování“ je horší než stránka bez nich a my za to nikoho chválit nebudeme.

Co o tom říká report

Popis nálezu

Nejdelší souvislý úsek textu na téhle stránce má [words] slov, náš práh je [threshold]. Úseky počítáme mezi dělicími prvky, a to jsou nadpisy h1 až h6, otázky sbalovacího seznamu (`<summary>`) a termíny definičního seznamu (`<dt>`). Obsah členěný jinak, třeba dvanáct sbalovacích otázek nebo seznam hesel, se tedy za nečleněný nepovažuje. Navigace, hlavička ani patička se do úseku nepočítají. Dlouhý nečleněný blok se hůř prochází čtenáři i AI systému a hůř se z něj vybírá odpověď na konkrétní otázku; doložené měření pro to nemáme.

Doporučení

Rozdělte dlouhý úsek na menší celky s vlastními podnadpisy (H2/H3), z nichž každý pokrývá jednu myšlenku nebo dílčí téma. Vkládat podnadpisy jen proto, aby nález zmizel, nemá smysl: souvislý výklad, který se rozdělit nedá, je v pořádku.

Zdroje

Text ověřen 2026-09-12