Prečo sme to merali
O generatívnej optimalizácii sa píše veľa, no takmer vždy na amerických dátach. Chceli sme vedieť, ako sú na tom weby, ktoré poznáme — slovenské a české e-shopy a agentúry, ktoré ich stavajú.
Preto sme sa pozreli na 822 e-shopov a na portfóliá 454 agentúr — teda na weby, ktoré tie agentúry svojim klientom stavajú a spravujú. Merali sme tri technické signály, ktoré rozhodujú o tom, či sa web vôbec dostane do odpovede jazykového modela.
Čo sme merali
Vybrali sme signály, ktoré sa dajú overiť zvonku a ktoré má prevádzkovateľ webu plne vo svojich rukách:
llms.txt— súbor, ktorý jazykovým modelom hovorí, čo je na webe podstatné. Obdobarobots.txt, len pre AI.- Štruktúrované dáta (schema.org) — či web popisuje svoj obsah strojovo čitateľne, a či to robí aj pri produktoch.
- Prístup pre AI crawlerov — či
robots.txtneblokuje GPTBot, ClaudeBot, PerplexityBot a spol.
Rozdelili sme vzorku na dve skupiny, lebo majú odlišné problémy: e-shopy a agentúry, ktoré pre ne weby stavajú a spravujú.
Čo z toho vyšlo
Prvé zistenie je nepríjemne jednoduché: prevažná väčšina webov nemá llms.txt vôbec. Nie je zle nastavený — neexistuje. Pri takom rozšírení nejde o konkurenčnú výhodu pre pár priekopníkov, ale o štandard, ktorý zatiaľ nikto nezaviedol.
Druhé zistenie je vážnejšie. Časť webov aktívne blokuje AI crawlerov v robots.txt — spravidla nie rozhodnutím majiteľa, ale zdedenou konfiguráciou alebo predvolbou šablóny. Taký web nemá zníženú viditeľnosť. Nemá žiadnu. Do odpovede sa nedostane, aj keby mal ten najlepší obsah.
Tretie zistenie sa týka štruktúrovaných dát. Základnú schému má značná časť webov, ale produktová schéma chýba oveľa častejšie — a práve tá rozhoduje, či model vie o produkte povedať niečo konkrétne, alebo ho len mĺkvo obíde.
U agentúr sa to prejavuje inak než u e-shopov. Agentúra spravuje desiatky klientskych webov, takže jedna zlá predvoľba v jej štandardnej konfigurácii sa znásobí do celého portfólia naraz.
Čo s tým
Poradie je dané tým, čo najviac bolí a čo sa dá spraviť najrýchlejšie:
- Skontrolujte
robots.txt. Ak blokuje AI crawlerov, všetko ostatné je zbytočné. Oprava trvá minúty. - Doplňte produktovú schému. Bez nej model o produkte nemá čo povedať.
- Pridajte
llms.txt. Dnes ním získate náskok, o rok to bude samozrejmosť.
Metodika a čo štúdia netvrdí
Merali sme technické signály dostupné zvonku, k jednému dátumu. Netvrdíme, že web s llms.txt bude citovaný častejšie — na taký záver by bolo treba merať samotné odpovede modelov v čase, čo je iná štúdia.
Tvrdíme niečo skromnejšie, ale overiteľné: tieto weby si samy zatvárajú dvere, o ktorých väčšinou nevedia, že existujú.
Vzorka nie je náhodná — vychádza z verejných katalógov e-shopov a partnerských agentúr, takže reprezentuje aktívnu časť trhu, nie internet ako celok.
Chcete vedieť, ako je na tom váš web? Zadajte doménu na úvodnej stránke a dostanete rozpis do pár minút.