llms.txt

llms.txt prakticky: co to je, k čemu slouží a jestli ho na e-shopu potřebujete

llms.txt je navržený formát textového souboru v kořenovém adresáři webu, který jazykovým modelům nabízí ručně sestavený rozcestník po nejdůležitějším obsahu webu v Markdownu. Není to nástroj, kterým se AI zakazuje přístup k obsahu — a právě tohle nedorozumění je kolem něj nejrozšířenější.

Návrh zveřejnil 3. září 2024 Jeremy Howard ze společnosti Answer.AI. Od té doby se z něj stalo jedno z nejprodávanějších „nutných opatření pro AI viditelnost", přestože Google veřejně a opakovaně říká, že ho nepoužívá. V tomto článku najdete, co soubor doopravdy dělá, kdo ho čte, jaká je jeho reálná návratnost a co dělat místo něj, pokud chcete přístup AI robotů skutečně řídit.

Co llms.txt je a co není

Zdrojem zmatku je, že se jméno souboru podobá robots.txt, a všichni si proto automaticky domyslí, že jde o zákazy. Opak je pravda: robots.txt řídí, kam robot nesmí, zatímco llms.txt navrhuje, co by si model měl přečíst. Jeden zavírá dveře, druhý podává mapu.

Co llms.txt je

Realita
  • +Ručně vybraný seznam odkazů na klíčové stránky
  • +Prostý Markdown, žádný nový formát k naučení
  • +Pomůcka pro AI agenta, který už na webu je
  • +Komunitní návrh bez zaštítění W3C nebo IETF
  • +Vymyšlené primárně pro technickou dokumentaci

Co llms.txt není

Omyl
  • Nástroj, jak zakázat použití obsahu k trénování AI
  • Oficiální standard schválený kýmkoli
  • Signál, který by zohledňoval Google
  • Ochrana citlivých dat nebo placeného obsahu
  • Cesta, jak se dostat do odpovědí AI asistentů
⚠️

llms.txt nechrání nic

Soubor neobsahuje direktivy typu Disallow a nikdo se jimi nezavázal řídit. Kdyby je obsahoval, byl by to jen zdvořilý návrh, stejně jako u robots.txt — rozdíl je v tom, že robots.txt hlavní roboti respektují, zatímco llms.txt většina z nich vůbec nestahuje. Pokud vám někdo prodává llms.txt jako ochranu obsahu před AI, prodává vám něco, co ten soubor neumí ani na papíře. Skutečná řešení najdete níž v kapitole o blokování.

Jak soubor vypadá

Formát je záměrně minimalistický. Podle specifikace je povinný jediný prvek — nadpis první úrovně. Všechno ostatní je volitelné: krátké shrnutí v citaci, volný text a sekce se seznamy odkazů. Soubor patří do kořenového adresáře, tedy na https://vasedomena.cz/llms.txt.

llms.txt

# Název webu nebo projektu > Jednou větou, co tenhle web je a komu slouží. ## Klíčové stránky - [O nás](https://vasedomena.cz/o-nas/): kdo jsme a čím se zabýváme - [Ceník](https://vasedomena.cz/cenik/): aktuální ceny a podmínky - [Kontakty](https://vasedomena.cz/kontakty/): adresa, telefon, e-mail ## Optional - [Blog](https://vasedomena.cz/blog/): články, které lze při nedostatku místa vynechat

Sekce Optional je jediná se zvláštním významem — označuje obsah, který agent může přeskočit, když má málo místa v kontextu. Vedle toho specifikace zmiňuje volitelný soubor llms-full.txt, do kterého se slévá celý obsah odkazovaných stránek, aby si ho model načetl najednou.

Celý princip vychází z technického problému, který nemá nic společného s marketingem: jazykový model má omezené místo v kontextu a HTML stránka je z jeho pohledu z velké části balast — navigace, patička, skripty, cookie lišta. Čistý Markdown mu ušetří práci i tokeny.

Kdo ho čte a kdo ne

Tady se návrh láme. Formát dává technicky smysl, ale odběratelů má výrazně méně, než se v nabídkách slibuje.

Kdo Stav
Google Search Nepoužívá. Uvedeno přímo v oficiální dokumentaci k optimalizaci pro generativní funkce vyhledávání: soubor váš web v Googlu ani nepoškodí, ani nepomůže, protože ho vyhledávač ignoruje.
AI Overviews a AI Mode Nepoužívají. Google je staví na svých běžných systémech hodnocení, ne na zvláštních souborech.
ChatGPT, Claude, Perplexity Žádný z provozovatelů oficiálně nepotvrdil, že soubor ve své retrieval vrstvě používá.
Chrome / Lighthouse Od verze 13.3 (květen 2026) soubor kontroluje v kategorii Agentic Browsing — tedy kvůli agentům, kteří web procházejí za uživatele, ne kvůli pozicím.
Vývojářské AI nástroje Používají. Asistenti v editorech kódu a nástroje pro práci s dokumentací s formátem pracují — to je prostředí, pro které vznikl.

K tomu jedno číslo, které stojí za všechny úvahy. Ahrefs v květnu 2026 prošel 137 210 domén s platným souborem llms.txt a zjistil, že 97 % z nich nedostalo za měsíc ani jeden požadavek na jeho stažení. Soubor tam byl. Nikdo si ho nevyzvedl.

💡

Ověřte si to na vlastním serveru

Jestli už soubor nasazený máte, podívejte se do logů, kolik požadavků na /llms.txt za poslední měsíc přišlo a od koho. Je to pětiminutová kontrola, která vám o návratnosti řekne víc než jakýkoli článek — včetně tohohle.

Jak se AI robot blokuje doopravdy

Pokud je vaším cílem omezit, co si AI společnosti z vašeho webu odnesou, llms.txt je slepá ulička. Nástroj, který na to existuje a který velcí provozovatelé deklarují, že respektují, je pořád robots.txt — jen s jinými jmény robotů.

robots.txt

# zákaz stahování obsahu pro trénování modelů OpenAI User-agent: GPTBot Disallow: / # totéž pro robota Anthropicu User-agent: ClaudeBot Disallow: / # vyloučení z trénování modelů Googlu; indexaci ve vyhledávání neovlivní User-agent: Google-Extended Disallow: /

Jména robotů se mění a přibývají. Před nasazením si aktuální seznam ověřte v dokumentaci každého provozovatele — opsat starý blok z článku znamená blokovat robota, který se už jmenuje jinak.

Dvě věci k tomu patří říct rovnou. Zaprvé je to dobrovolné — robots.txt nikomu technicky nebrání, spoléhá na to, že se provozovatel zachová slušně. Velcí to dodržují, ale menší scrapery se tím neřídí. Zadruhé blokování něco stojí: když modelu zavřete dveře, nemůže vás ani citovat. U e-shopu, který chce být v AI odpovědích vidět, je to obvykle špatný obchod.

Máte ho nasadit?

Odpověď závisí na tom, co provozujete, a je docela jednoduchá.

Dokumentace k softwaru nebo API

Ano, dává smysl. Vaše publikum používá AI asistenty přímo v editoru kódu a ty s formátem umí pracovat. Přesně pro tenhle případ návrh vznikl.

Běžný e-shop nebo firemní web

Není priorita. Nic tím nezkazíte a zabere to hodinu, ale postavit na tom rozpočet znamená neřešit věci, které měřitelný dopad mají.

Web bez kapacity na údržbu

Radši ne. Neaktualizovaný soubor odkazující na zrušené stránky a staré ceny je horší než žádný — modelu naservírujete nepravdivé informace v čitelné podobě.

Rozhodli jste se pro nasazení

Ověřte, že soubor vrací kód 200 a typ obsahu text/plain nebo text/markdown. Na hostovaných platformách nemusí být zápis do kořenového adresáře možný — zjistěte si to dřív, než někomu za nasazení zaplatíte.

Tvrzení, která uvidíte v nabídkách

llms.txt patří mezi nejčastější položky v nabídkách „GEO optimalizace", které nám klienti ukazují. Tady je šest formulací, u kterých má smysl se zeptat na doklad.

Tvrzení 1

„Bez llms.txt vás AI neuvidí"

Modely čerpají z webu, ne ze souboru. Google to má napsané v dokumentaci a měření ukazuje, že drtivá většina souborů nikdo nestahuje. Viditelnost v AI staví na obsahu a technice, ne na jednom textovém souboru.

Tvrzení 2

„Google llms.txt testuje"

Netestuje. Zástupci Googlu opakovaně uvedli, že ho nepoužívají a neplánují to. Když se soubor v prosinci 2025 na pár hodin objevil na jejich vlastní dokumentaci, byl to důsledek nasazení redakčního systému, ne signál.

Tvrzení 3

„Ochrání váš obsah před trénováním AI"

Neochrání. Formát na to nemá prostředky. Kdo tohle tvrdí, buď ho nečetl, nebo počítá s tím, že ho nečtete vy.

Tvrzení 4

„Je to nový oficiální standard"

Je to komunitní návrh jednoho člověka z roku 2024. Neschválilo ho W3C ani IETF a žádný velký provozovatel AI se k jeho používání nepřihlásil.

Tvrzení 5

Cena v desítkách tisíc za jeho vytvoření

Je to textový soubor se seznamem odkazů. U běžného webu je to práce na hodinu. Vysoká cena za tuhle položku spolehlivě prozradí, jak vypadá zbytek nabídky.

Tvrzení 6

Soubor vygenerovaný AI a nikdy nezkontrolovaný

Generátor projde web, vysype odkazy a hotovo. Půlka z nich vede na filtry a stránkování, popisky nedávají smysl. Smysl souboru je v kurátorském výběru — bez něj je to jen další sitemapa, jen horší.

Časté dotazy

Uškodí mi llms.txt, když ho nasadím?

Ne. Google výslovně uvádí, že soubor pozicím ani viditelnosti neuškodí — ignoruje ho. Jediné riziko je nepřímé: neudržovaný soubor s odkazy na neexistující stránky a starými cenami předá nesprávné informace tomu, kdo si ho přece jen stáhne.

Druhé riziko je rozpočtové. Hodina práce nikoho nezruinuje, ale položka za desítky tisíc v nabídce znamená peníze, které nešly tam, kde by byly vidět.

Jaký je rozdíl mezi llms.txt, robots.txt a sitemap.xml?

Každý řeší něco jiného. robots.txt nastavuje pravidla přístupu — kam robot smí a kam ne. sitemap.xml je úplný seznam adres pro indexaci ve vyhledávačích. llms.txt je naopak výběr toho nejdůležitějšího, sestavený ručně a určený jazykovým modelům.

Zásadní rozdíl je ve váze: robots.txt a sitemap.xml jsou zavedené a respektované standardy, llms.txt je návrh bez závazné podpory.

Jak tedy dostanu svůj e-shop do odpovědí AI asistentů?

Stejnou cestou jako do dobrých pozic ve vyhledávání, jen s důrazem na jiné věci. Web musí být technicky průchozí a zaindexovaný, obsah musí obsahovat konkrétní ověřitelná fakta a odpověď hned v prvním odstavci a značka musí být zmiňovaná na místech, ze kterých modely čerpají.

Té disciplíně se říká GEO — Generative Engine Optimization. Nestojí na zvláštních souborech, ale na tom, aby o vás na webu existovaly informace, které se dají použít.

Proč ho tedy mají Anthropic, Stripe nebo Vercel?

Protože jejich publikum jsou vývojáři, kteří pracují s AI asistenty přímo v editoru kódu. Pro tyhle nástroje je llms.txt skutečně užitečný — dostanou dokumentaci v čisté podobě místo toho, aby ji luštily z HTML.

Z toho ale neplyne, že totéž platí pro e-shop s koupelnami. Formát vznikl pro dokumentaci a mimo ni zatím nemá prokázaný přínos.

Může se z llms.txt ještě stát standard?

Vyloučit to nejde. Zajímavé je, že uvnitř Googlu jde signál dvěma směry — vyhledávání soubor ignoruje, zatímco Chrome ho ve svém nástroji Lighthouse kontroluje kvůli agentům, kteří web procházejí za uživatele. Roli může sehrát i to, jak rychle poroste podíl agentů proti klasickému vyhledávání.

Pro rozhodování dnes to ale nic nemění. Nasazovat něco kvůli tomu, že se to jednou možná ujme, dává smysl jen tehdy, když je to levné a bez údržby — což u llms.txt platí jen napůl.

Jak zjistím, jestli si ho někdo stahuje?

V přístupových logech serveru vyfiltrujte požadavky na /llms.txt a podívejte se na hlavičku user-agent u každého z nich. Uvidíte přesně, kdo a jak často soubor stahuje.

Stejným způsobem si ověřte i to, kteří AI roboti vám vůbec chodí na web. Bývá to překvapivější čtení než samotný llms.txt a je to dobrý podklad k rozhodnutí, jestli někoho blokovat.

💬

Máte na stole nabídku na „GEO optimalizaci"? Projdeme ji spolu.

Za 30 minut vám řekneme, které položky mají doložitelný dopad a které jsou tam kvůli ceně. Zároveň se podíváme, jak o vaší značce dnes mluví ChatGPT, Perplexity a Gemini.

Michal Binka, zakladatel SEO PRAKTICKY

Autor článku

Mgr. Michal Binka

Zakladatel SEO PRAKTICKY s.r.o.

V SEO se pohybuje 23+ let. Nabídky na „GEO optimalizaci" plné položek bez doloženého dopadu jsou dnes jedním z nejčastějších témat prvních schůzek s novými klienty. Naše agentura se v květnu 2026 umístila na prvním místě mezi českými SEO agenturami z pohledu viditelnosti v AI nástrojích podle výzkumu Marketing Mineru.

  • 23+ let praxe v SEO
  • Autor 3 SEO knih
  • Zlatý Shoptet Partner
  • Certifikovaný Collabim partner

Zdroje

Údaj o 137 210 doménách a 97 % nulových požadavků pochází z analýzy Ahrefs za květen 2026, citované napříč oborovými médii. Situace kolem llms.txt se vyvíjí — před rozhodnutím si ověřte aktuální stanovisko provozovatelů v jejich dokumentaci.