Proč jsme to měřili
O generativní optimalizaci se píše hodně, ale téměř vždy na amerických datech. Chtěli jsme vědět, jak jsou na tom weby, které známe — slovenské a české e-shopy a agentury, které je staví.
Proto jsme se podívali na 822 e-shopů a na portfolia 454 agentur — tedy na weby, které ty agentury svým klientům staví a spravují. Měřili jsme tři technické signály, které rozhodují o tom, jestli se web vůbec dostane do odpovědi jazykového modelu.
Co jsme měřili
Vybrali jsme signály, které se dají ověřit zvenčí a které má provozovatel webu plně ve svých rukou:
llms.txt— soubor, který jazykovým modelům říká, co je na webu podstatné. Obdobarobots.txt, jen pro AI.- Strukturovaná data (schema.org) — jestli web popisuje svůj obsah strojově čitelně, a jestli to dělá i u produktů.
- Přístup pro AI crawlery — jestli
robots.txtneblokuje GPTBot, ClaudeBot, PerplexityBot a spol.
Vzorek jsme rozdělili na dvě skupiny, protože mají odlišné problémy: e-shopy a agentury, které pro ně weby staví a spravují.
Co z toho vyšlo
První zjištění je nepříjemně jednoduché: převážná většina webů nemá llms.txt vůbec. Není špatně nastavený — neexistuje. Při takovém rozšíření nejde o konkurenční výhodu pro pár průkopníků, ale o standard, který zatím nikdo nezavedl.
Druhé zjištění je vážnější. Část webů aktivně blokuje AI crawlery v robots.txt — zpravidla ne rozhodnutím majitele, ale zděděnou konfigurací nebo výchozím nastavením šablony. Takový web nemá sníženou viditelnost. Nemá žádnou. Do odpovědi se nedostane, i kdyby měl ten nejlepší obsah.
Třetí zjištění se týká strukturovaných dat. Základní schéma má značná část webů, ale produktové schéma chybí mnohem častěji — a právě to rozhoduje, jestli model umí o produktu říct něco konkrétního, nebo ho jen mlčky obejde.
U agentur se to projevuje jinak než u e-shopů. Agentura spravuje desítky klientských webů, takže jedna špatná výchozí volba v její standardní konfiguraci se znásobí do celého portfolia najednou.
Co s tím
Pořadí je dané tím, co nejvíc bolí a co se dá udělat nejrychleji:
- Zkontrolujte
robots.txt. Pokud blokuje AI crawlery, všechno ostatní je zbytečné. Oprava trvá minuty. - Doplňte produktové schéma. Bez něj model o produktu nemá co říct.
- Přidejte
llms.txt. Dnes jím získáte náskok, za rok to bude samozřejmost.
Metodika a co studie netvrdí
Měřili jsme technické signály dostupné zvenčí, k jednomu datu. Netvrdíme, že web s llms.txt bude citovaný častěji — na takový závěr by bylo potřeba měřit samotné odpovědi modelů v čase, což je jiná studie.
Tvrdíme něco skromnějšího, ale ověřitelného: tyto weby si samy zavírají dveře, o kterých většinou nevědí, že existují.
Vzorek není náhodný — vychází z veřejných katalogů e-shopů a partnerských agentur, takže reprezentuje aktivní část trhu, ne internet jako celek.
Chcete vědět, jak je na tom váš web? Zadejte doménu na úvodní stránce a dostanete rozpis během pár minut.