Obsah pro AI vyhledávání: jak vás začnou citovat modely
Modely vás začnou citovat ve chvíli, kdy se váš text dá přečíst bez JavaScriptu, odpověď stojí hned v první větě odstavce a čísla v ní si jde ověřit. Zbytek je řemeslo: pustit na web správné roboty, popsat firmu strukturovanými daty a psát sekce, které dávají smysl i vytržené z kontextu. Klasické SEO tím nekončí, jen dostává druhou vrstvu.
V čem se AI odpověď liší od deseti modrých odkazů?
Mění se jednotka, o kterou hrajete. Ve výsledcích hledání soutěží celá stránka o pozici, v AI přehledu nebo v odpovědi ChatGPT soutěží jeden odstavec o to, jestli si ho model vezme jako stavební kámen a přilepí k němu odkaz. Stránka může být sedmá a citovaná. Nebo první a úplně přehlédnutá.
Liší se i dotazy. Do vyhledávače lidé napíšou „účetní program“, do chatu „jaký účetní program pro živnostníka s jedním zaměstnancem a datovou schránkou“. Model si takovou otázku rozloží na dílčí kusy, na každý hledá zdroj a výsledek slepí dohromady. Když váš text odpovídá na jeden z nich jasně a na jednom místě, máte šanci. Když je odpověď rozsypaná do pěti odstavců a dvou dalších stránek, nemáte.
Do třetice se to celé přesunulo do češtiny. Režim AI od Googlu se do Česka rozjel na podzim 2025 a AI přehledy nad českými dotazy vidíte běžně. Seznam pustil Asistenta do testu v listopadu 2025 a v květnu 2026 ho zpřístupnil v beta verzi všem přihlášeným uživatelům. Stojí na vlastním modelu SeLLMa a čerpá mimo jiné z Firmy.cz, Zboží.cz a zpravodajských webů, takže optimalizace pro Seznam dostala nový důvod, proč ji neodkládat.
Roboty rozdělte do tří skupin, ne na „AI“ a „zbytek“
V robots.txt rozhodujete o třech různých věcech: jestli váš obsah smí do tréninku modelu, jestli smí do indexu, ze kterého se skládají odpovědi, a jestli si stránku smí robot stáhnout, když o to uživatel výslovně požádá. Většina webů má přitom povolené všechno, nebo omylem zakázané všechno. Zakázat trénink a pustit vyhledávací index je legitimní kombinace, kterou nasazuju u většiny klientů.
| Robot nebo token | Provozovatel | K čemu slouží |
|---|---|---|
GPTBot |
OpenAI | Sběr obsahu pro trénink modelů. Zákaz neodstraní vaše stránky z odpovědí ChatGPT. |
OAI-SearchBot |
OpenAI | Staví index pro vyhledávání uvnitř ChatGPT. Tohohle robota chcete pustit. |
ChatGPT-User |
OpenAI | Stahuje konkrétní adresu, když o to uživatel požádá. OpenAI uvádí, že u akcí vyvolaných uživatelem se robots.txt nemusí uplatnit. |
ClaudeBot |
Anthropic | Trénink modelů. |
Claude-SearchBot |
Anthropic | Index pro vyhledávání v Claude. |
Claude-User |
Anthropic | Stažení stránky na dotaz uživatele. |
PerplexityBot |
Perplexity | Index pro citace v odpovědích. |
Perplexity-User |
Perplexity | Načtení stránky na vyžádání. Perplexity tvrdí, že jde o agenta, na kterého se robots.txt nevztahuje. |
Google-Extended |
Není robot, jen přepínač v robots.txt od září 2023. Řídí použití obsahu pro Gemini a generativní funkce, na pozice ve vyhledávání nemá vliv. | |
Applebot-Extended |
Apple | Totéž pro Apple Intelligence. Běžný Applebot pro Siri a Spotlight zůstává nedotčený. |
Typická chyba z praxe: klient v dobré víře zakáže GPTBot a pak se diví, že ho ChatGPT dál cituje. Opačný případ je firma, která chce být v AI odpovědích vidět, a přitom má na Cloudflare zapnuté plošné blokování AI robotů, které se u nových domén od července 2025 zapíná samo. Stejně se chovají některé bezpečnostní pluginy pro WordPress a seznamy „špatných botů“, do kterých se roky nikdo nepodíval. Než začnete řešit obsah, otevřete soubor robots.txt a projděte si jeho pravidla a zkontrolujte nastavení CDN. Cloudflare navíc v srpnu 2025 obvinil Perplexity z obcházení zákazů přes rotující IP adresy a falešnou identifikaci prohlížeče, takže log serveru vám o realitě řekne víc než dokumentace.
Má smysl dělat llms.txt, když to není standard?
Má, ale s malým očekáváním a za dvacet minut práce. llms.txt je návrh z roku 2024: textový soubor v kořeni domény, který v markdownu popíše, co web je a kam vedou nejdůležitější stránky. Schválený standard to není a Google jeho podporu opakovaně odmítl. John Mueller ho veřejně přirovnal k meta tagu keywords, tedy k něčemu, co si majitel webu napíše sám, a proto se tomu nedá věřit. Aktualizovaná dokumentace Googlu z června 2026 rovnou uvádí, že vyhledávání llms.txt ignoruje.
Proč ho tedy dělat? Náklad je nulový, riziko nulové a část nástrojů si soubor stahuje. Berte ho jako rozcestník pro lidi i stroje, ne jako signál pro hodnocení. Obsah může vypadat takhle:
# Klempířství Novák
> Realizace plechových střech a okapů v Jihomoravském kraji od roku 2004.
## Služby
- [Falcované střechy](https://priklad.cz/falcovane-strechy/): materiály, ceny za m2, doba realizace
- [Opravy okapů](https://priklad.cz/opravy-okapu/): rozsah prací, ceník
## O firmě
- [Kontakt a fakturační údaje](https://priklad.cz/kontakt/)
Do souboru naopak nepatří klíčová slova naskládaná za sebou, obsah, který na webu vůbec není, a odkazy na stránky s nastaveným noindexem. Skutečnou práci pořád odvede XML sitemapa, protože tu roboti čtou dlouhodobě a prokazatelně.
Odpověď patří do prvních dvou vět, ne do závěru
Model hledá souvislý blok textu, který sám o sobě odpovídá na otázku. Když první věta odstavce zní „Existuje několik faktorů, které je nutné zvážit“, nemá si co vzít. Když zní „Reklamační lhůta na obuv je 24 měsíců a běží ode dne převzetí“, má citaci hotovou.
Prakticky to znamená psát tak, aby každá sekce obstála vytržená z kontextu:
- Jedna sekce, jedna otázka. Rozsah zhruba 150 až 300 slov, delší blok se hůř použije celý.
- První dvě věty odpovídají. Vysvětlení, výjimky a příklady až potom.
- Nadpis formulujte jako otázku nebo tvrzení, ne jako holé podstatné jméno. Pomůže to i lidem, viz pravidla pro osnovu nadpisů H1 až H6.
- Zájmena typu „to“, „tento postup“ nebo „jak jsme psali výše“ ve vytrženém odstavci nedávají smysl. Zopakujte podstatné jméno.
- Konkrétní čísla, ceny v korunách, lhůty, verze a roky. Ověřitelný údaj se cituje mnohem častěji než tvrzení, že „je to rychlé“.
- Datum poslední aktualizace u článku. Modely sahají radši po čerstvém zdroji.
Zdroj čísla uvádějte přímo v textu. „Podle ČSÚ“ nebo „podle ceníku České pošty platného od ledna 2026“ váží víc než holé procento bez původu. Je to stejná logika jako u důvěryhodnosti obsahu podle E-E-A-T, jen se posunula z hodnocení stránky do rozhodování, co je bezpečné odcitovat.
Proč modely nevidí obsah vykreslený JavaScriptem?
Protože většina AI robotů skripty nespouští. Stáhnou HTML tak, jak přišlo ze serveru, a co v něm není, pro ně neexistuje. Googlebot si vykreslení zvládne, byť s odstupem, ale GPTBot, PerplexityBot ani ClaudeBot se s tím podle dostupných informací nepářou.
Nejčastěji na to narazí e-shopy na Reactu, recenze načítané widgetem třetí strany, rozbalovací sekce s parametry a katalog stránkovaný tlačítkem „načíst další“. Zkouška trvá minutu: zobrazte si zdrojový kód stránky přes Ctrl+U a hledejte v něm svůj text. Když ho tam nenajdete, robot ho taky nenajde. Rychlý přehled o tom, co se ze stránky dá vyčíst bez spuštění skriptů, dá bezplatná SEO kontrola webu, detailní postup pak článek o JavaScriptu a SEO.
Strukturovaná data řeknou modelu, kdo jste
Strukturovaná data jsou jediné místo na stránce, kde firmu popíšete strojově jednoznačně. Entita organizace znamená, že si model spojí název firmy, IČO, adresu, telefon, profily na sítích a web do jednoho záznamu a nesplete si vás s jinou firmou podobného jména. U názvů typu „Stavby Novák“ rozhoduje právě tohle o tom, komu se citace připíše.
Minimum, které nasazuju skoro všude: Organization nebo LocalBusiness na hlavní stránce s vyplněným sameAs na Firmy.cz, LinkedIn a Facebook, Product s cenou a dostupností u produktů, FAQPage u stránek s dotazy a Article s autorem a datem u blogu. Shoptet a Upgates většinu produktových značek generují samy, na WordPressu to obstará SEO plugin. Vyplatí se ale zkontrolovat, jestli tam IČO a adresa opravdu jsou, protože výchozí šablona je běžně vynechá. Podrobnosti najdete v návodu na strukturovaná data a souvislosti s podobou značky ve výsledcích hledání.
Jak zjistíte, že vás AI cituje?
Poctivá odpověď zní, že měření je zatím slabé, a kdo tvrdí opak, prodává nástroj. Data se dají získat ze tří míst a žádné z nich není úplné.
Nejpřímější jsou referrery v analytice. Návštěva z odkazu v ChatGPT dorazí jako chatgpt.com, z Perplexity jako perplexity.ai. Google Analytics přidal 13. 5. 2026 vlastní kanál AI Assistant s médiem ai-assistant, zpětně ale nic nepřeřazuje a seznam podporovaných služeb je krátký, takže Perplexity si nejspíš budete muset zachytit vlastním pravidlem v kanálech. Search Console od 3. 6. 2026 postupně zpřístupňuje samostatný přehled pro generativní funkce, zatím jen s impresemi, bez prokliků, CTR a dotazů. Třetí zdroj je log serveru: ve Wedosu i Forpsi si přístupový log stáhnete a spočítáte, kolikrát u vás byl který robot.
K tomu si dělám ruční kontrolu. Sepíšu dvacet dotazů, na které chce klient být vidět, jednou za měsíc je projedu v ChatGPT, Perplexity a v režimu AI na Googlu a zapíšu do tabulky, kdo je citovaný. Je to primitivní. Zabere to hodinu a dá to lepší obrázek než většina placených nástrojů. Návazně sledujte, co ta návštěvnost dělá v měření výsledků SEO, protože objemy z AI jsou u českých webů zatím řádově menší než z organického vyhledávání.
Časté dotazy
Musím kvůli AI vyhledávání psát obsah jinak než pro Google?
Jinak ne, ale přísněji. Pro AI odpovědi patří odpověď do prvních dvou vět odstavce, na jednu sekci připadá jedna otázka a čísla mají mít uvedený zdroj. Stejný text funguje i v klasickém vyhledávání, protože Google vybírá úryvky podobným způsobem. Nejde tedy o dvojí obsah, jen o větší kázeň v členění.
Mám AI roboty v robots.txt pustit, nebo zakázat?
Běžné firmě nebo e-shopu se vyplatí pustit roboty, kteří staví index pro odpovědi, tedy OAI-SearchBot, Claude-SearchBot a PerplexityBot, protože přes ně přicházejí návštěvy. Tréninkové roboty GPTBot, ClaudeBot, Google-Extended a Applebot-Extended můžete zakázat, aniž byste přišli o pozice ve vyhledávání. Vydavatelé placeného obsahu to řeší opačně a mají k tomu důvod.
Kde poznám, že mi chodí návštěvy z ChatGPT?
V Google Analytics se podívejte na akvizici a zdroj chatgpt.com, případně na kanál AI Assistant, který GA4 nabízí od května 2026. Perplexity se objevuje jako perplexity.ai, obvykle mezi odkazujícími weby. Počítejte s tím, že část návštěv z chatů dorazí bez referreru jako přímá návštěva, takže skutečné číslo bude o něco vyšší než to v přehledu.
Související návody
Náhledy při sdílení: značky Open Graph a co s nimi na Facebooku
Bez značek si sítě náhled poskládají samy a obvykle špatně. Nastavení je hotové za deset minut a projeví se u každého sdíleného odkazu.
Jak vypadá vaše značka ve výsledcích hledání a co s tím jde dělat
Název webu, ikona a drobečky se dají ovlivnit. Rozhoduje o nich shoda mezi strukturovanými daty a tím, co je na stránce vidět.
Jak napsat title tag, na který lidé kliknou
Titulek se neměří na znaky, ale na obrazové body. Kolik se jich vejde, proč si ho Google přepisuje po svém a jak titulky projet na celém webu naráz.
Pojmy z tohoto textu
- Vybraný úryvek Odpověď vytažená přímo do výsledků hledání nad ostatní odkazy. Získá ji stránka, která odpoví krátce a přesně.
- llms.txt Textový soubor v kořeni webu, který jazykovým modelům shrnuje, co na webu je a kde to najdou.
- AI přehledy Odpověď sestavená jazykovým modelem přímo nad výsledky hledání, s odkazy na zdroje, ze kterých čerpá.
- Strukturovaná data Strojově čitelný popis obsahu stránky. Neovlivňují pořadí, ale rozhodují o tom, jak výsledek ve vyhledávání vypadá.
- JSON-LD Formát zápisu strukturovaných dat. Vkládá se jako samostatný blok a nemíchá se do značek obsahu.
- Drobečková navigace Řádek odkazů, který ukazuje cestu od úvodní stránky k té, na které stojíte. Ve výsledcích hledání nahrazuje adresu.
Nevíte, jestli se vás to týká?
Pusťte kontrolu na svůj web a uvidíte, jestli tenhle problém máte. Trvá to necelou minutu.