GEO (Generative Engine Optimization)

GEO (Generative Engine Optimization, česky optimalizace pro generativní vyhledávače) je práce na obsahu a technice webu s cílem dostat se do odpovědí generativních nástrojů — Google AI Overviews, AI Mode, ChatGPT, Gemini, Claude nebo Perplexity — a být v nich citován jako zdroj.

Kolem GEO se nabalilo víc marketingu než dat: prodávají se „GEO audity“, které jsou přejmenovaným SEO auditem, a garantuje se procento citovanosti, které nikdo neumí změřit. Přitom Google má k tématu vlastní dokumentaci a přímo v ní pojmenovává techniky, které nefungují. Tenhle text vychází z primárních zdrojů — dokumentace Googlu, OpenAI, Anthropicu a Perplexity a akademické práce, ve které pojem GEO vznikl.

Odkud se pojem GEO vzal

GEO není zkratka vymyšlená agenturami. Pochází z práce GEO: Generative Engine Optimization, kterou tým z Princetonu, Georgia Tech, IIT Dillí a Allen Institute publikoval na konferenci KDD 2024. Autoři popsali generativní vyhledávač jako systém, který místo seznamu odkazů skládá odpověď z několika zdrojů, a navrhli metriky, jimiž jde měřit, jak moc je v ní konkrétní web vidět.

Na vlastním testovacím souboru GEO-bench autoři dosáhli zvýšení viditelnosti až o 40 %. To číslo se od té doby cituje všude, skoro nikdy ale s tím, co k němu patří: měřilo se na vlastním benchmarku, na modelech roku 2023 a 2024, a účinnost technik se výrazně lišila podle oboru. Není to slib přenositelný na váš e-shop a na dnešní modely.

⚠️

Když někdo garantuje procento citovanosti v AI, ptejte se na zdroj

Provozovatelé AI nástrojů své interní hodnoticí systémy nezveřejňují. Google k tomu píše přímo, že žádný nástroj třetí strany nemá přístup k jeho interním hodnoticím ani AI systémům. Číslo v nabídce, ke kterému nikdo neumí doložit metodiku měření, je marketing, ne příslib výsledku.

Co GEO je a co není

Nejčastější nedorozumění: GEO se prodává jako disciplína, která nahrazuje SEO. Jde přitom z velké části o stejnou práci, jen s jiným měřením.

Co GEO řeší

Dává smysl
  • +Aby stránka byla zaindexovaná a směla se zobrazit s náhledem textu
  • +Aby roboti AI nástrojů měli na web přístup a nebyli blokováni firewallem
  • +Aby obsah nesl něco, co jinde není — vlastní data, zkušenost, měření
  • +Aby se dalo měřit, jak si web v AI funkcích vede

Co GEO neumí

Mýtus
  • Zaručit citaci v konkrétní odpovědi konkrétního modelu
  • Nahradit slabý obsah speciálním formátováním nebo značkováním
  • Fungovat u stránky, kterou vyhledávač nemá v indexu
  • Být oddělenou službou vedle SEO — je to jeho součást

Vedle GEO potkáte ještě AEO, AIO a LLMO. Jsou to různě staré názvy pro víceméně totéž. Nemá smysl řešit, který z nich je „správný“ — má smysl řešit, co konkrétně za tou zkratkou někdo dodá.

Co o GEO říká Google

Google k tématu vydal samostatnou dokumentaci a v červenci 2026 ji rozšířil o kapitolu, která pojmenovává mýty. Postoj je jednoznačný.

Z pohledu Vyhledávání Google je optimalizace pro generativní AI vyhledávání optimalizací pro vyhledávání, a tedy pořád SEO.

Google Search Central, Optimizing your website for generative AI features (překlad)

V téže dokumentaci Google výslovně jmenuje postupy, které pro jeho Vyhledávání nedávají smysl:

Technika Co k ní říká Google
llms.txt a podobné soubory Vyhledávání Google je nepoužívá. Mít je neuškodí ani nepomůže; pokud je udržujete kvůli jiným systémům, je to v pořádku.
„Chunking“ obsahu Není důvod sekat text na drobné bloky. Ideální délka stránky neexistuje.
Přepisování textů „pro AI“ Není potřeba psát jinak. Modely rozumí synonymům i významu bez přesné shody slov.
Nakupované a domluvené zmínky Neautentické zmínky nepomáhají tak, jak se tvrdí; proti nim stojí protispamové systémy.
Strukturovaná data Pro generativní vyhledávání nejsou podmínkou a žádné speciální schéma neexistuje. Pro rozšířené výsledky ve Vyhledávání smysl mají dál.
Stránka pro každý „fan-out“ dotaz Zakládat stránky pro každou variantu dotazu spadá pod pravidlo o hromadné tvorbě obsahu ve spamových zásadách.

Poslední řádek stojí za zdůraznění. Query fan-out je technika, při které model k původnímu dotazu vygeneruje sadu souvisejících hledání. Někteří dodavatelé z toho odvozují, že je potřeba vyrobit stránku ke každému odvozenému dotazu. Podle Googlu je to porušení spamových zásad.

Jak se do AI odpovědi dostanete

U Googlu je vstupenka popsaná jednou větou v dokumentaci: stránka musí být zaindexovaná a způsobilá zobrazit se ve Vyhledávání s náhledem textu. Žádné další technické požadavky nejsou. To má dva praktické důsledky, na které se v auditech naráží pořád dokola.

Za prvé: noindex vyřadí stránku i z AI funkcí. Za druhé — a to je zrádnější — stejně tak zapůsobí značky, kterými omezujete náhled textu. Kdo si kdysi dal na web nosnippet nebo krátký max-snippet, aby se v SERP neukazoval opsaný odstavec, dnes tím zavírá dveře i do AI Overviews.

💡

Google mimochodem uvádí, že tyhle značky jsou zároveň jediný způsob, jak obsah z AI funkcí ve Vyhledávání vyřadit — samostatné vypnutí AI Overviews neexistuje. Robots.txt pravidlo pro Google-Extended se týká jiných systémů Googlu, ne Vyhledávání.

Pod tím vším běží RAG (retrieval-augmented generation, generování s vyhledáním podkladů). Model si nejdřív nechá z indexu vytáhnout relevantní stránky a teprve z nich skládá odpověď — bez indexace si nemá co vytáhnout.

Roboti AI nástrojů a robots.txt

Mimo Google je situace jiná. OpenAI, Anthropic i Perplexity mají vlastní roboty a pro každý účel jiného. Jedním pravidlem v robots.txt tak můžete zakázat trénování a zůstat v odpovědích — nebo se omylem vyřadit z vyhledávání a trénování nechat běžet.

Robot K čemu slouží Co znamená jeho zákaz
Googlebot Procházení pro Vyhledávání Google Web vypadne z Vyhledávání i z jeho AI funkcí
Google-Extended Trénování a grounding v dalších systémech Googlu Na Vyhledávání ani AI Overviews to nemá vliv
OAI-SearchBot Zobrazování webů ve vyhledávání ChatGPT Web se v odpovědích vyhledávání ChatGPT neukáže
GPTBot Sběr dat pro trénování modelů OpenAI Obsah se nepoužije k trénování, vyhledávání běží dál
Claude-SearchBot Index pro vyhledávání v Claude Podle Anthropicu klesá viditelnost ve výsledcích
ClaudeBot Sběr dat pro trénování modelů Anthropicu Budoucí materiály se vyloučí z trénovacích dat
PerplexityBot Index pro vyhledávání v Perplexity Web se v odpovědích Perplexity neukáže

Pokud tedy chcete být citovaní, ale nechcete přispívat do trénovacích dat, vypadá základní nastavení takhle:

robots.txt

# Vyhledávání v AI nástrojích — povoleno User-agent: OAI-SearchBot Disallow: User-agent: Claude-SearchBot Disallow: User-agent: PerplexityBot Disallow: # Trénování modelů — zakázáno User-agent: GPTBot Disallow: / User-agent: ClaudeBot Disallow: /

Prázdný Disallow: znamená „nic není zakázáno“. Rozhodnutí o trénování je byznysové, ne technické — tenhle výpis je ukázka, ne doporučení. OpenAI i Perplexity uvádějí, že promítnutí změny do vyhledávání trvá zhruba 24 hodin.

⚠️

Roboty spuštěné uživatelem se robots.txt řídit nemusí

Když se člověk v ChatGPT nebo Perplexity zeptá na konkrétní adresu, sáhne na ni robot ChatGPT-User, respektive Perplexity-User. Oba provozovatelé u nich uvádějí, že pravidla v robots.txt se na takový požadavek nemusí vztahovat, protože ho vyvolal uživatel. Anthropic naproti tomu píše, že robots.txt respektují všichni jeho roboti včetně Claude-User. Robots.txt tedy není nástroj na ochranu obsahu — na to slouží autorizace.

Co platí a co doložit nejde

U GEO je poměr mezi tvrzeními a doklady horší než jinde v SEO. Vyplatí se obě skupiny oddělit.

Co je doložené. Že u Googlu rozhoduje indexace a způsobilost zobrazit náhled. Že llms.txt Vyhledávání Google ignoruje. Že roboti OpenAI, Anthropicu a Perplexity mají oddělené účely i pravidla. Že v Google Search Console existuje report výkonu v generativních AI funkcích. Vše najdete v dokumentaci pod článkem.

Co doložit nejde. Že konkrétní úprava textu zvedne citovanost o konkrétní procento. Že existuje ideální délka odstavce nebo počet čísel na sto slov. Že llms.txt pomáhá u nástrojů mimo Google — nikdo z provozovatelů to veřejně nepotvrdil. A pozor: nedoložené je i opačné tvrzení, tedy že llms.txt jinde určitě nefunguje. Prostě to nevíme.

Praktický závěr platí bez ohledu na to, jak spor dopadne. Stránka, která je zaindexovaná, přístupná robotům a nese informaci, kterou jinde neseženete, je připravená pro Google i pro AI nástroje. To je jediná strategie, která nezastará s příštím modelem.

Kuchařka: co udělat tento měsíc

Šest kroků, které zvládnete bez nákupu jakéhokoli nástroje. Pořadí odpovídá efektu na jednotku práce.

1. Zkontrolujte náhledy textu

Projděte zdrojový kód šablon a hledejte značky omezující náhled. Bez náhledu se stránka do AI funkcí Googlu nedostane.

<meta name="robots"       content="nosnippet">

2. Ověřte přístup AI robotů

Robots.txt bývá v pořádku a blokuje až firewall nebo CDN. V logu ověřte, jestli roboti chodí a jaký kód dostávají.

# hledejte v logu OAI-SearchBot Claude-SearchBot PerplexityBot

3. Ověřte roboty podle IP

Řetězec v hlavičce se dá podvrhnout. Všichni tři provozovatelé zveřejňují seznamy IP adres k ověření.

openai.com/searchbot.json perplexity.com/   perplexitybot.json

4. Otevřete report v Search Console

Google má v Search Console samostatný report výkonu v generativních AI funkcích — jediný zdroj dat, který nepochází od třetí strany.

# Search Console Výkon > generativní AI funkce

5. Odstraňte duplicity

Google mezi doporučeními pro generativní vyhledávání jmenuje snížení duplicitního obsahu. Dvě stránky o témže si berou signály navzájem.

<link rel="canonical"       href="…">

6. Doplňte, co jinde není

Google mluví o „non-commodity“ obsahu: vlastní měření, zkušenost z provozu, konkrétní čísla. Přehled toho, co je na webu podesáté, nemá model proč citovat.

# co doplnit vlastní data zkušenost z praxe konkrétní příklady

Nejčastější chyby

Chyba

Zablokovaný GPTBot má znamenat konec ChatGPT

Nemá. Vyhledávání v ChatGPT řídí OAI-SearchBot, trénování GPTBot. Kdo zakázal jen jeden, dostal jiný výsledek, než čekal.

Chyba

Blokace na úrovni firewallu, o které nikdo neví

Robots.txt roboty pouští, ale WAF nebo ochrana proti botům jim vrací chybu. Bez pohledu do logů se na to nepřijde.

Chyba

llms.txt místo opravy indexace

Soubor je hotový za hodinu a působí jako práce navíc. Google ho ignoruje — a pokud se přitom polovina kategorií neindexuje, řešíte špatný problém.

Chyba

Stránky vyrobené pro odvozené dotazy

Sada skoro stejných textů ke každé variantě dotazu. Google to řadí pod hromadnou tvorbu obsahu, tedy pod spamové zásady.

Chyba

Zděděný nosnippet ze starého webu

Značka z doby, kdy někdo nechtěl v SERP opsaný odstavec. Dnes tím stránka ztrácí způsobilost pro AI Overviews i AI Mode.

Chyba

Měření podle nástroje třetí strany jako jediného zdroje

Jako orientace mají smysl. Google ale upozorňuje, že žádný nemá přístup k jeho interním systémům — čísla z nich jsou odhad, ne fakt.

Když tohle máte v pořádku, navazuje GEO správa a širší Search Everywhere Optimization. K dílčím tématům máme články o AI Overviews a příležitostech pro SEO a o postoji Googlu k obsahu generovanému AI.

Je GEO něco jiného než SEO?

Z pohledu Googlu ne. Generativní funkce Vyhledávání stojí na stejných hodnoticích systémech jako klasické výsledky, takže optimalizace pro ně je podle dokumentace pořád SEO.

Rozdíl je v tom, co sledujete a kam se díváte na výsledek. Mimo Google navíc přibývá práce s roboty jednotlivých provozovatelů, protože každý má vlastní pravidla. Jako samostatná služba oddělená od SEO ale GEO smysl nedává.

Potřebuju llms.txt, abych se dostal do ChatGPT?

U Vyhledávání Google ne — dokumentace uvádí, že soubor nepoužívá a že jeho existence viditelnosti ani neuškodí, ani nepomůže. U ostatních nástrojů to veřejně doložené není v žádném směru.

Náklad na vytvoření souboru je malý, takže si ho udělat můžete. Nemá ale nahradit práci na indexaci a na přístupu robotů, protože ta má prokazatelný vliv.

Jak zjistím, jestli mě AI nástroje citují?

U Googlu přes report výkonu v generativních AI funkcích v Search Console. To je jediný zdroj, který pochází přímo od provozovatele.

U ChatGPT, Claude a Perplexity chybí oficiální report a zbývají dvě cesty: logy serveru, kde uvidíte, jestli a kam roboti chodí, a nástroje třetích stran, které dotazy simulují. Ty druhé berte jako odhad, ne jako měření.

Mám povolit trénování modelů na svém obsahu?

To je byznysové rozhodnutí, ne technické. Podstatné je vědět, že se odděluje od vyhledávání: u OpenAI i Anthropicu můžete trénování zakázat a ve vyhledávání zůstat.

Zákaz se navíc týká jen budoucího procházení. Co už v trénovacích datech je, tam zůstává.

Musím psát kratší odstavce, aby si je model líp vzal?

Google k tomu píše přímo, že rozsekávat obsah na drobné bloky není potřeba a že ideální délka stránky neexistuje. Jeho systémy si na stránce s více tématy poradí a vyberou relevantní část.

Přehledná struktura s nadpisy a odstavci má smysl kvůli čtenářům. To je ale běžné řemeslo, ne technika pro AI.

Pomůžou mi strukturovaná data k citaci v AI?

Podmínkou nejsou. Google uvádí, že pro generativní vyhledávání strukturovaná data vyžadována nejsou a žádné speciální schéma pro ně neexistuje.

Dělat je má přesto smysl — kvůli rozšířeným výsledkům ve Vyhledávání. Jen to není páka na citovanost, za kterou se občas prodává. Víc v článku o strukturovaných datech.

🎯

Chcete vědět, jak na tom váš e-shop v AI vyhledávání skutečně je?

Projdeme indexaci, přístup robotů a obsah — a řekneme na rovinu, co má smysl řešit a co je jen módní zkratka.

Michal Binka, SEO PRAKTICKY

Autor článku

Mgr. Michal Binka

Zakladatel SEO PRAKTICKY, 23+ let v SEO

GEO sleduju od chvíle, kdy ten pojem vznikl v akademické práci na KDD 2024 — a od té doby hlavně čtu, co k němu píšou provozovatelé vyhledávačů, ne co o něm tvrdí prodejci. Rozdíl mezi těmi dvěma zdroji je přesně to, o čem je tenhle text.

Vedu tým seniorních specialistů v brněnském Technologickém parku. Jsme Zlatý Shoptet Partner a členové metodické skupiny pro SEO na Shoptetu.

  • Autor 3 knih o SEO
  • Zlatý Shoptet Partner
  • Certifikovaný Collabim specialista
  • 23+ let praxe

Zdroje

Dokumentace AI nástrojů se mění v řádu týdnů. Před zásahem do robots.txt si názvy robotů ověřte přímo u zdroje.