AI vyhledávání (GEO)

llms.txt: Co to je, jak to implementovat a co skutečně říkají data o adopci

Praktický průvodce souborem llms.txt pro provozovatele e-shopů — co to je, jak to AI crawlery využívají (nebo nevyužívají) a jak napsat soubor, který skutečně funguje.

  • Jeremy Howard navrhl standard llms.txt v září 2024 jako markdown soubor, který říká AI crawlerům, které stránky na tvém webu jsou nejdůležitější.
  • Podle Semrush provozoval Search Engine Land vlastní llms.txt od března 2025 a mezi polovinou srpna a koncem října 2025 nezaznamenal ani jednu návštěvu od GPTbota, PerplexityBotu, ClaudeBotu ani Google-Extended.
  • Podle Ahrefs dostalo 97 % z přibližně 38 000 domén s platným llms.txt v květnu 2026 nula požadavků od crawlerů — adopce je reálná, ale čtenost ze strany AI zatím není potvrzena ve velkém měřítku.
  • Samotný soubor napíšeš za jedno odpoledne: 20–50 řádků markdownu se seznamem 10–30 klíčových stránek (The Prompt Bench, 2026).
  • Google zahrnul llms.txt do svého protokolu Agent2Agent (A2A) v dubnu 2025 — to je zatím nejsilnější signál, že standard má budoucnost.

Úvod

Soubor llms.txt je prostý markdown dokument umístěný na tvojadomena.cz/llms.txt, který vypisuje nejdůležitější stránky tvého webu spolu s krátkými popisy — jde v podstatě o kurátorský průvodce pro AI crawlery a velké jazykové modely. Jeremy Howard zveřejnil návrh 3. září 2024 a myšlenka se rychle rozšířila v technických SEO kruzích: pokud robots.txt říká crawlerům, co ignorovat, llms.txt říká AI, čemu dát přednost.

Pro provozovatele e-shopu je to jednoduché. Generativní vyhledávače — ChatGPT, Perplexity, Google AI Overviews — stále častěji odpovídají na nákupní dotazy tak, že syntetizují obsah z celého webu, místo aby vracely seřazený seznam odkazů. Pokud AI model rozhoduje, zda citovat tvoji produktovou stránku nebo stránku konkurence, záleží na kvalitě a dostupnosti tvého strukturovaného obsahu. Soubor llms.txt je jedním ze způsobů, jak tento obsah usnadnit ke zpracování.

Upřímná výhrada: data o tom, zda AI systémy tyto soubory skutečně čtou, jsou zatím skromná. Čísla níže ukazují jak příležitost, tak propast mezi teorií a současnou praxí.


Co přesně je soubor llms.txt a proč by se o něj e-shopy měly zajímat?

Soubor llms.txt je textový soubor ve formátu markdown, hostovaný v kořenovém adresáři tvé domény, který poskytuje AI jazykovým modelům strukturovaný přehled hierarchie obsahu tvého webu. Jeremy Howard zveřejnil návrh llms.txt 3. září 2024 (GreenGeeks, 2024) a specifikace se od té doby aktivně vyvíjí — do května 2026 dosáhla verze 1.7.0.

Pro e-shop spočívá praktická hodnota v kurátorství. Typický katalog s 10 000 SKU obsahuje tisíce procházitelných URL, ale AI model sestavující odpověď na dotaz „nejlepší běžecké boty do 2 100 Kč (100 USD)" nemusí procházet všechny. Tvůj llms.txt může přímo odkazovat na stránky kategorií, průvodce velikostmi, reklamační podmínky a příběh značky — tedy stránky, které jazykovému modelu sestavujícímu nákupní doporučení dávají kontext k tvým produktům.

Analogie s robots.txt je užitečná, ale nepřesná. Robots.txt je blokovací mechanismus; llms.txt je pozvánka a mapa. Zatímco robots.txt říká „necrawluj /checkout/", llms.txt říká „tady je 20 stránek, které nejlépe reprezentují, co prodáváme a proč nám zákazníci věří." Oba soubory existují vedle sebe a slouží různým účelům.

Ještě jeden strukturální důvod, proč by se e-shopy měly zajímat: produktové stránky jsou často obsahově chudé. Produktový listing s názvem, třemi odrážkami a cenou dává jazykovému modelu sestavujícímu doporučení velmi málo. Soubor llms.txt odkazující na bohatší redakční obsah — nákupní průvodce, srovnávací stránky, články o způsobu použití — dává AI crawlerům cestu k obsahu za tvým katalogem.


Jak si vede adopce llms.txt v prostředí e-commerce?

Adopce roste, ale stále jde o menšinové chování. Podle SE Ranking mělo v roce 2025 soubor llms.txt 10,13 % z téměř 300 000 analyzovaných domén. Samostatná studie citovaná Ahrefs uvádí 28 % zkoumaných domén, přičemž tento vzorek pravděpodobně zahrnuje spíše technicky zdatné publishery než širší populaci e-shopů.

Rozdělení podle návštěvnosti od SE Ranking je poučné: domény s vysokou návštěvností (přes 100 001 návštěv) měly míru adopce 8,27 %, zatímco domény střední úrovně (1 001–5 000 návštěv) dosáhly 10,54 %. Tento vzorec naznačuje, že adopce llms.txt zatím není chováním řízeným velikostí ani sofistikovaností — menší obchody ho přijímají přibližně stejnou rychlostí jako velké, takže neexistuje žádná nevýhoda pro ty, kdo čekají, ale ani žádný jasný konkurenční signál, že největší hráči ho považují za nezbytný.

K červenci 2025 mělo soubor llms.txt podle Semrush zveřejněno pouze 951 domén (Semrush, 2025) — číslo, které předchází mnohem většímu počtu ze studie SE Ranking a odráží, jak rychle standard získal trakci ve druhé polovině roku 2025. Mintlify zavedl podporu llms.txt pro tisíce webů v listopadu 2024, což pravděpodobně tvoří velkou část raných domén technické dokumentace v tomto počtu.

Napříč obchody, které spravujeme v MirandaMedia, opakovaně vidíme stejný vzorec: implementace llms.txt proběhne za jedno odpoledne, když ji někdo z týmu vezme za svou — a pak soubor měsíce nikdo neaktualizuje, což podkopává většinu potenciální hodnoty.


Čtou AI vyhledávače soubory llms.txt skutečně?

Upřímná odpověď zní: ne spolehlivě, ne ve velkém měřítku a žádný velký poskytovatel to nepotvrdil. Podle Ahrefs dostalo 97 % z přibližně 38 000 domén s platným llms.txt v květnu 2026 nula požadavků na tento soubor (Ahrefs, 2026). To je nejostřejší číslo v celé této debatě.

Search Engine Land implementoval vlastní llms.txt v březnu 2025 a pečlivě sledoval provoz botů. Podle Semrush nezaznamenala stránka llms.txt mezi polovinou srpna a koncem října 2025 ani jednu návštěvu od Google-Extended bota, GPTbota, PerplexityBotu ani ClaudeBotu (Semrush, 2025). To je sedmitýdenní ticho od čtyř botů, kteří by ze čtení souboru měli největší prospěch.

Pohled ze strany poskytovatelů je stejně opatrný. K polovině roku 2026 se velcí poskytovatelé AI včetně Anthropic, OpenAI, Google a Perplexity veřejně nezavázali ke čtení llms.txt. Koncem května 2026 Google ve svém průvodci optimalizací pro generativní AI funkce uvedl, že strojově čitelné soubory jako llms.txt nejsou potřeba — přímý signál od dominantního poskytovatele vyhledávání, že soubor není součástí jejich aktuálního procesu zpracování obsahu.

Stojí za zmínku jeden protiargument. Existují zprávy, že OpenAI zřejmě crawluje soubory llms.txt na živých webech až každých 15 minut, i když to není oficiální potvrzení od OpenAI a chování crawleru může odrážet spíše obecné objevování obsahu než strukturované zpracování llms.txt. Google také zahrnul llms.txt do svého protokolu Agent2Agent (A2A), spuštěného v dubnu 2025 (Ahrefs, 2025), což je smysluplný architektonický signál, i když to praktická data o crawlování zatím nepotvrzují.

Praktický závěr pro provozovatele e-shopů: soubor implementuj, protože náklady jsou nízké a potenciální přínos je reálný, pokud se chování poskytovatelů změní — ale nepovažuj ho dnes za potvrzený nástroj pro získávání návštěvnosti.


Jaké jsou osvědčené postupy pro implementaci efektivního souboru llms.txt?

Dobře strukturovaný soubor llms.txt zvládneš sestavit za jedno odpoledne. Podle The Prompt Bench vyžaduje funkční llms.txt typicky 20–50 řádků markdownu. Formát souboru je jednoduchý: nadpis H1 s názvem tvé značky, krátký odstavec popisující, co tvůj obchod prodává, a pak série markdown seznamů odkazů seskupených podle typu obsahu.

Užitečný soubor llms.txt by měl obsahovat 10 až 30 klíčových stránek — ne vyčerpávající index 200 položek. Cílem je kurátorství, ne úplnost. AI model čtoucí tvůj llms.txt by si měl odnést jasnou představu o tvých kategoriích produktů, klíčovém redakčním obsahu a signálech důvěryhodnosti (reklamační podmínky, stránka o nás, recenze). Výpis 200 odkazů bez popisu mu nic takového nedá.

Pro e-shop vypadá praktická struktura takto:

SekceCo zahrnoutProč na tom záleží
Produkty3–5 hlavních stránek kategoriíOrientuje model v rozsahu tvého katalogu
Redakční obsahNákupní průvodce, srovnávací stránkyPoskytuje textový kontext, který AI může citovat
DůvěryhodnostReklamační podmínky, stránka o nás, FAQOdpovídá na otázky, které kupující kladou AI asistentům
TechnickéURL sitemapы, poznámky ke strukturovaným datůmPomáhá crawlerům najít zbytek tvého obsahu

Popisy drž pod 15 slov na odkaz — dost na to, aby jazykový model věděl, co tam najde, ale ne tolik, aby soubor přetížil zbytečným textem. Aktualizuj soubor při spuštění nových kategorií nebo ukončení starých; zastaralý llms.txt odkazující na stránky s chybou 404 aktivně zhoršuje signál, který posíláš.

Existují nástroje, které sestavení urychlí. Šablonu llms.txt pro e-commerce od EasyLLMsTxt lze vygenerovat jejich generátorem na jedno kliknutí přibližně za 3 sekundy — to je rozumný výchozí bod, než soubor přizpůsobíš svému konkrétnímu katalogu a struktuře obsahu.


Jak llms.txt ovlivňuje viditelnost v AI a objevitelnost v generativním vyhledávání?

Soubor llms.txt je jedním vstupem do širší praxe zvané Generative Engine Optimisation (GEO) — disciplíny strukturování obsahu tak, aby ho AI vyhledávače citovaly a doporučovaly tvůj obchod. Výzkum publikovaný na arXiv zjistil, že techniky GEO mohou zvýšit viditelnost v odpovědích generativních vyhledávačů až o 40 %. Soubor llms.txt není celým GEO, ale je to nejsnáze implementovatelný jednotlivý krok, který provozovatel e-shopu zvládne za méně než den.

Mechanismus je nepřímý. Soubor llms.txt přímo nevkládá tvůj obsah do trénovacích dat AI modelu. Co dělá, je snižování tření pro AI crawlery při hledání tvých nejhodnotnějších stránek — zejména redakčního a kontextového obsahu, který jazykové modely využívají při sestavování doporučení. Obchod s dobře udržovaným llms.txt odkazujícím na podrobného nákupního průvodce má větší šanci, že tento průvodce bude indexován a citován, než obchod, kde je stejný průvodce pohřben tři kliky hluboko v archivu blogu.

Ve větším měřítku se efekt násobí. Podle TNGShopper může 100 produktů ve 50 lokalitách vytvořit 5 000 jedinečných, crawlovatelných, AI-optimalizovaných vstupních bodů. Tvůj llms.txt nemůže vypsat všech 5 000, ale může odkazovat na stránky indexů kategorií a lokalit, které crawleru umožní je systematicky objevit.

Vztah mezi llms.txt a tradičním SEO je aditivní, ne substituční. Tvůj robots.txt, sitemap.xml, značkování strukturovanými daty a rychlost stránek zůstávají relevantní pro konvenční vyhledávání. Vrstva llms.txt sedí na vrcholu tohoto základu a mluví specificky k chování velkých jazykových modelů při vyhledávání — které stále více funguje na principu „najdi nejužitečnější strukturovanou stránku, shrň ji, cituj ji" spíše než na modelu seřazeného seznamu.


Jaký je aktuální stav a výhled standardu llms.txt do budoucna?

Standard llms.txt se k polovině roku 2026 nachází v tom, co The Prompt Bench popisuje jako fázi „užitečné, ale nedoceněné" — infrastruktura existuje, smysluplná menšina webů ho adoptovala, ale poptávková strana (AI poskytovatelé, kteří ho skutečně čtou) zatím nedohnala nabídkovou stranu (weby, které ho publikují).

Samotná specifikace je aktivně udržována. Dosáhla verze 1.7.0 dne 11. května 2026, což signalizuje, že technická komunita za ní ho považuje za živý standard, ne za opuštěný návrh. Nejvýznamnějším institucionálním signálem zůstává zahrnutí llms.txt do protokolu Agent2Agent (A2A) od Google v dubnu 2025 (Ahrefs, 2025) — i když Google ve svých vlastních doporučeních zároveň říká, že soubor není pro optimalizaci generativní AI potřeba. Tyto dvě pozice si nutně neodporují: zahrnutí do A2A může být výhledová infrastruktura pro agentické případy použití, nikoli pro aktuální generativní vyhledávání.

Pro provozovatele e-shopů je poměr nákladů a přínosů jasný. Soubor stojí jedno odpoledne a 20–50 řádků markdownu. Pokud AI poskytovatelé nikdy nepřijmou standard ve velkém měřítku, ztráta je nulová — máš dobře organizovaný inventář obsahu, který se hodí i pro vlastní interní audity. Pokud se chování poskytovatelů změní — což je reálné s růstem agentických případů použití AI — získáš smysluplnou výhodu v objevitelnosti oproti konkurentům, kteří čekali.

Analogie s ranou adopcí strukturovaných dat je poučná. Schema markup byl roky volitelný, než Google začal výrazněji zobrazovat rich snippety. Obchody, které měly čistá strukturovaná data připravená v okamžiku, kdy k té změně došlo, okamžitě sklízely výhody. Okno pro llms.txt může sledovat podobný vzorec.


Editor's Take — Michal Baloun, Co-founder

Data v tomto článku vyprávějí příběh, který je snadné špatně přečíst oběma směry. Pesimistické čtení: 97 % domén s platným llms.txt nedostalo v květnu 2026 ani jeden požadavek od crawlerů, Google říká, že soubor není potřeba, a sedmitýdenní experiment Search Engine Land neukázal žádný provoz botů. To zní jako mrtvý standard.

Optimistické čtení: Google ho zabudoval do svého A2A protokolu, specifikace je na verzi 1.7.0 a stále se aktualizuje, a OpenAI zřejmě crawluje tyto soubory na některých webech s vysokou frekvencí. To zní jako infrastruktura, která se tiše buduje, než se poptávka stane zřejmou.

Moje pozice je blíže optimistickému čtení, ale s konkrétní výhradou ohledně toho, co „implementace llms.txt" v praxi skutečně znamená. Většina obchodů, které vidím, soubor jednou zveřejní a zapomene na něj. Vypíší 150 URL bez popisů, zahrnou stránky, které mezitím prošly restrukturalizací, a odkazují na stránky kategorií, které jsou stejně obsahově chudé. Takový llms.txt jazykovému modelu nepomáhá — je to šum.

Obchody, které z toho profitují, až AI poskytovatelé začnou tyto soubory systematicky číst, jsou ty, které s ním zacházejí jako s živým redakčním dokumentem: 15–25 pečlivě vybraných stránek, aktualizovaných při změnách katalogu, odkazujících na obsah, který skutečně odpovídá na otázky kupujících. To je jiný úkol než „vygenerovat llms.txt a odškrtnout políčko".

Pokud má tvůj obchod méně než 50 stránek skutečného redakčního obsahu — nákupní průvodce, srovnávací články, podrobné produktové příběhy — nejdřív to naprav. Soubor llms.txt je ukazatel na obsah. Pokud obsah neexistuje, ukazatel nepomůže.

Takhle vypadá doporučení z Margly

Většina analytických nástrojů skončí u „tvoje číslo je X". Margly pokračuje další větou — co udělat, kde a kolik to má hodnotu. Doporučení, která by ti Margly ukázalo pro vzorce z tohoto článku:

  • Vysoká priorita „Porovnej svůj llms.txt s aktuálními 20 stránkami s nejvyššími tržbami a odstraň všechny nefunkční nebo přesměrované URL." Nulový provoz botů u Search Engine Land byl částečně způsoben zastaralým obsahem souboru — čistý a přesný soubor je základ, bez kterého žádná další optimalizace nemá smysl. Odhadovaný dopad: +3 000 až +8 000 Kč/měsíc

  • Vysoká priorita „Přidej své tři nejlepší nákupní průvodce a reklamační podmínky do redakční sekce llms.txt." Výzkum GEO zjistil nárůst viditelnosti až o 40 % v odpovědích generativních vyhledávačů, když mají AI crawlery přístup k bohatému textovému obsahu — llms.txt je nejrychlejší cesta, jak tento obsah dostat na povrch. Odhadovaný dopad: +5 000 až +12 000 Kč/měsíc

  • Střední priorita „Zredukuj svůj llms.txt na méně než 30 položek s jednořádkovým popisem u každého odkazu." Specifikace doporučuje 10–30 klíčových stránek; soubory s více než 200 nepopsanými URL nedávají AI modelům žádný užitečný signál o prioritě obsahu. Odhadovaný dopad: +2 000 až +5 000 Kč/měsíc

  • Střední priorita „Vytvoř indexové stránky kategorií pro své hlavní produktové skupiny a propoj je z llms.txt." 100 produktů v 50 lokalitách může vytvořit 5 000 crawlovatelných AI-optimalizovaných vstupních bodů — tvůj llms.txt by měl odkazovat na indexovou vrstvu, která je zpřístupní, aniž by vypisoval každou URL. Odhadovaný dopad: +3 000 až +7 000 Kč/měsíc

Všimni si, že žádné z nich nepotřebovalo export do CSV. To je rozdíl mezi surovou analytikou a konkrétní radou.

llms.txt — co to vlastně je

Soubor llms.txt je navrhovaný standard, který se objevil v roce 2024 a jehož cílem je pomoci AI crawlerům a generativním vyhledávačům objevovat a chápat obsah tvého webu. Umísti prostý markdown soubor na tvojadomena.cz/llms.txt a funguje jako kurátorský průvodce — vypisuje tvé nejdůležitější stránky s krátkými popisy, aby jazykové modely rychle pochopily, čím se tvůj web zabývá a kde najdou nejlepší obsah.

Na rozdíl od sitemapы, která vypisuje každou URL pro úplnost, je llms.txt záměrně selektivní. Jeremy Howard, který návrh zveřejnil 3. září 2024, ho navrhl tak, aby AI modelům dával signál o prioritě, ne vyčerpávající index.

llms.txt — osvědčené postupy

Drž soubor krátký: doporučený rozsah je 10 až 30 klíčových stránek, ne výpis celé struktury URL. Každá položka by měla mít popis kratší než 15 slov, aby jazykový model věděl, co tam najde, ještě než odkaz sleduje.

Soubor vyžaduje jen 20–50 řádků markdownu a zvládneš ho sestavit za odpoledne. Seskup odkazy podle typu obsahu — produkty, redakční obsah, stránky důvěryhodnosti — a aktualizuj soubor vždy, když spustíš nebo ukončíš hlavní sekce obsahu. Zastaralý llms.txt odkazující na stránky s chybou 404 zhoršuje signál, který posíláš AI crawlerům.

standard llms.txt

Jeremy Howard navrhl standard llms.txt v září 2024 jako markdown konvenci pro pomoc AI modelům při navigaci obsahem webu. Specifikace je aktivně udržována a do května 2026 dosáhla verze 1.7.0. Google zahrnul llms.txt do svého protokolu Agent2Agent (A2A) v dubnu 2025, což představuje dosud nejvýznamnější institucionální podporu.

K polovině roku 2026 se velcí poskytovatelé AI včetně Anthropic, OpenAI, Google a Perplexity veřejně nezavázali ke čtení llms.txt jako součásti svých retrieval pipeline. Standard je nejlépe chápat jako ranou infrastrukturu pro agentické případy použití AI, nikoli jako potvrzený hodnoticí signál pro aktuální generativní vyhledávání.

llms.txt a SEO

Soubor llms.txt není přímým hodnoticím faktorem pro tradiční vyhledávače. Vlastní doporučení Google uvádí, že strojově čitelné soubory jako llms.txt nejsou pro optimalizaci generativní AI potřeba. Soubor však spadá do širší praxe Generative Engine Optimisation (GEO) a výzkum publikovaný na arXiv zjistil, že techniky GEO mohou zvýšit viditelnost v odpovědích generativních vyhledávačů až o 40 %.

Praktická hodnota pro SEO e-shopů spočívá v objevitelnosti obsahu: llms.txt odkazující AI crawlery na tvoje nákupní průvodce, stránky kategorií a obsah budující důvěru zvyšuje pravděpodobnost, že tyto stránky budou indexovány a citovány, když AI asistenti odpovídají na nákupní dotazy. Jde o nízkonákladový, nízkorozpočtový doplněk širší obsahové strategie, ne o samostatný zdroj návštěvnosti.

Michal Baloun je spoluzakladatel MirandaMedia a Margly, který pracuje přímo s českými a slovenskými e-shopy od raných fází až po osmi­ciferné roční tržby. Zaměřuje se na jednotkovou ekonomiku, viditelnost marží a provozní rozhodnutí, která oddělují obchody, jež rostou, od těch, které stagnují. Pokud chceš stejnou míru přehlednosti o číslech svého vlastního obchodu, Margly ti ukáže jak metriky, tak konkrétní kroky za nimi.