AI vyhledávání · data · 9 minut čtení

Kolik AI botů reálně chodí na český web? 30 dní serverových dat

Patrik Szotkowski
Patrik SzotkowskiCEO Patos Art · 26. srpna 2026

Na začátku srpna jsme zveřejnili první čísla: AI boti si náš nový web vyžádali 11 485× za 14 dní. Slíbili jsme, že budeme měřit dál. Tady je 30 dní dat (27. 7. – 26. 8. 2026), kompletní tabulka botů, CSV ke stažení — a jedno zjištění, které nás naučilo víc než všechna čísla dohromady: o tom, koho AI doporučí, se rozhoduje jinde než na vašem webu.

Rychlá odpověď: na patosart.cz přišlo za 30 dní 15 860 požadavků AI botů — 26× víc než od Googlebotu (612). 84 % z nich má na svědomí Anthropic (Claude-SearchBot + ClaudeBot), následuje Amazon, OpenAI a Perplexity. Nejčtenější soubor webu je robots.txt (599 požadavků AI botů). 85 % požadavků jde od vyhledávacích botů, kteří staví index pro AI odpovědi. Čtení webu je ale jen půlka věci: koho AI doporučí, rozhoduje i to, co se o firmě dozví mimo její web. Čitelnost pro AI a dohledatelnost v AI nejsou totéž. Data jsou v CSV níže.

Jak jsme měřili (a co data neumí)

Zdrojem je analytika firewallu (WAF) našeho hostingu Váš Hosting, která každý požadavek na doménu patosart.cz klasifikuje podle řetězce User-Agent. Období: 27. července až 26. srpna 2026, tedy 30 celých dní; web běží od 23. července. Do tabulky jsme vzali 60 nejaktivnějších botů a ručně jim přiřadili provozovatele a kategorii. Ať můžete čísla správně číst, tři poctivé poznámky:

  • User-Agent lze podvrhnout. Ověřovali jsme IP rozsahy jen namátkou. Pro řádový obraz to stačí, pro soudní spor ne.
  • Část provozu jsme si způsobili sami. Web v tomto období intenzivně testujeme přes AI asistenty (Claude, ChatGPT, Perplexity). Podíl Anthropicu je tím nafouknutý; pořadí ostatních botů odpovídá našemu předchozímu 14dennímu měření.
  • Hostingový panel se v jedné věci mýlí. Claude-SearchBot — nejaktivnější bot vůbec — neoznačuje jako AI bota. Podle panelu přišlo 3 147 požadavků AI botů; po ručním přiřazení je to 15 860, tedy pětkrát víc. Kdo věří přednastaveným reportům, podceňuje AI provoz řádově.

Kolik AI botů přišlo — a od koho

ProvozovatelBoti (User-Agent)ÚčelPožadavků za 30 dní
Anthropic (Claude)Claude-SearchBot 12 124 · ClaudeBot 1 172vyhledávací index + crawl13 296
Amazon (Alexa, Rufus)amzn-searchbot 529 · Amazonbot 527vyhledávání + crawl1 056
OpenAI (ChatGPT)OAI-SearchBot 493 · GPTBot 474vyhledávací index + trénink967
PerplexityPerplexityBot 318vyhledávací index318
ByteDance (TikTok)Bytespider 115trénink115
Common CrawlCCBot 48otevřený dataset pro trénink modelů48
You.comYouBot 35vyhledávání35
DeepSeekDeepSeekBot 25trénink25
AI boti celkem15 860
Pro srovnání: GoogleGooglebot 612 · GoogleOther 61 · Inspection Tool 98klasické vyhledávání (a AI přehledy)771
Pro srovnání: Microsoft BingBingbot 506vyhledávání (z Bingu čerpá i ChatGPT)506
Pro srovnání: Seznam.czSeznamBot 308vyhledávání308
Pro srovnání: AppleApplebot 130Siri, Spotlight, Apple Intelligence130
15 860požadavků AI botů za 30 dní na 24stránkový web
26×víc než Googlebot (612). Před měsícem to bylo 25× — trend drží
85 %AI požadavků jde z vyhledávacích botů (13 499), jen 15 % z tréninkových (2 361)
podceňuje AI provoz hostingový panel — Claude-SearchBota za AI nepovažuje

Nejzajímavější není absolutní číslo, ale poměr: 85 % požadavků AI botů jde z vyhledávacích botů (Claude-SearchBot, OAI-SearchBot, PerplexityBot, amzn-searchbot), ne z tréninkových crawlerů. AI asistenti dnes odpovědi nestaví z toho, co se model kdysi naučil, ale z toho, co si právě teď dohledají v indexu. Pro firmu to znamená: co máte na webu dnes, ovlivňuje odpovědi AI dnes — a čeká se na to řádově dny, ne roky.

Co si AI boti z webu berou

Podle klasifikace panelu (sedm AI botů bez Claude-SearchBota, zhruba 3 150 požadavků) vypadá žebříček souborů takto: robots.txt 599×, sitemap.xml 418×, úvodní stránka 150×, stránka služeb 11×, blog 8×, reference 7×, o nás 5×, kontakt 5×. Zbytek webu jednotky požadavků.

  • robots.txt je brána, kterou AI boti kontrolují 4× častěji, než čtou homepage. Pokud je tam blokujete — třeba pluginem nebo firewallem, o kterém nevíte — dál se nikdy nedostanou. Nejčastější chyba, kterou v bezplatném testu u českých webů vidíme.
  • Sitemapa je druhý nejčtenější soubor. Bez ní AI bot hluboké stránky prostě nenajde; s ní je projde systematicky.
  • Hluboké stránky se čtou zřídka. Zásadní fakta o firmě — co děláte, pro koho, za kolik, kde — patří na úvodní stránku a do llms.txt, ne na čtvrtou úroveň menu.

Většina „botů“ nejsou AI. Jsou to skenery

Ze 61 601 požadavků botů v žebříčku připadá 34 721 na neidentifikovaného „bota“ a další tisíce na generické klienty (go-http-client 3 645, curl 896, Python knihovny přes 580). Když se podíváte, co chtějí, je to jasné: /wp-login.php 1 111×, wp_filemanager.php 691×, xmlrpc a „hello world“ PHP soubory po stovkách — na webu, který na WordPressu neběží. 23. srpna přišlo za jediný den 20 003 požadavků botů a 22 220 odpovědí 4xx: jedna vlna hledání děr. Boti tvoří 37,5 % všech požadavků na web; z lidí je průměrně 326 návštěv denně.

Dvě věci z toho plynou. Firewall a rychlé 404 nejsou luxus, ale hygiena — bez nich by tahle vlna položila sdílený hosting. A statistiky „návštěvnosti“ z běžných panelů, které boty nefiltrují, jsou k ničemu.

Proč čtení nestačí: co rozhoduje o doporučení

V srpnu jsme zadali AI asistentovi Claude rešerši, jakou si dnes zadává každý ředitel, který hledá dodavatele: „Najdi 5 nejlepších webových agentur v Moravskoslezském kraji, které prokazatelně řeší optimalizaci pro AI vyhledávání.“ Asistent provedl osm webových vyhledávání a prošel 30 firem z Google map pro Ostravu, Opavu a Frýdek-Místek. Sestavil žebříček pěti agentur. Zajímavější než pořadí bylo to, čím ho poskládal — a co v něm naopak nehrálo roli.

Když jsme ho pak nechali weby proměřit technickou metodikou — robots.txt, llms.txt, strukturovaná data, Markdown pro AI, MCP server, rychlost — vyšel patosart.cz z celého regionu nejlépe a asistent žebříček přepsal. Jenže to už jsme věděli, na co se ptát. Reálný zákazník se ptá jednou a jinak.

Rozdíl mezi „AI web přečte“ a „AI firmu doporučí“ dělalo pět věcí. Projděte si je na vlastním webu:

  • Cílení stránek na jazyk zákazníka. Asistent hledal „webovou agenturu“. Titulek, který mluví o „marketingové agentuře“, do téhle množiny nespadne — i když ta firma weby staví. AI si nedomýšlí, co ještě umíte.
  • Vlastní stránka pro službu. Kdo nemá stránku „optimalizace pro AI vyhledávání“, nemá co citovat. Asistent vybíral z firem, které ji měly.
  • Lokální stránky. Jedna z agentur v žebříčku se tam dostala přes stránku „web a e-shop Ostrava a okolí“. Města, ve kterých reálně pracujete, potřebují vlastní adresu — samotné město v titulku homepage nestačí.
  • Profil na Google mapách. Asistent se ptal map na Ostravu, Opavu a Frýdek-Místek. Kdo tam nemá profil se správnou kategorií a recenzemi, do výběru se nedostane — ani s dokonalým webem.
  • Zmínky mimo vlastní web. V redakčních přehledech agentur v regionu figurovaly firmy z žebříčku 2–4×. AI doporučuje to, co jí potvrdí i jiný zdroj než vy sami.

Data z logů to potvrzují z druhé strany: 85 % požadavků AI botů (13 499 z 15 860) má na svědomí vyhledávací boti — tedy ta část AI, která staví index a rozhoduje, koho může asistent v odpovědi nabídnout. Tréninkové crawlery (15 %) obsah odnesou do modelů, ale o dnešních doporučeních nerozhodují.

Poslední míle je čitelnost: robots.txt, strukturovaná data, llms.txt, čisté HTML. První míle je dohledatelnost: profil na Googlu, zmínky, katalogy, stránky pro nákupní dotazy. Bez první míle se AI k té poslední nikdy nedostane.

Co s tím děláme (a co můžete udělat vy)

  • Úvodní stránka se nově jmenuje „Marketingová a webová agentura Ostrava“ a říká to i v H1. Banalita — a přesně na ní se láme, do jaké kategorie vás asistent zařadí.
  • Vznikla stránka Optimalizace pro AI vyhledávání (GEO/AEO) s ceníkem. Když službu děláte, musí mít vlastní adresu.
  • Vznikly lokální stránky pro Třinec, Havířov, Karvinou a Frýdek-Místek — s reálnými referencemi z těch měst, ne s vyměněným názvem v šabloně.
  • Do robots.txt jsme doplnili Claude-SearchBot, Perplexity-User, Applebot, Amazonbot, Meta-ExternalAgent a další — a ve strukturovaných datech propojili firmu s profilem v katalogu Shoptet partnerů.
  • Mimo web: profil na Google mapách pro ostravské sídlo se správnou kategorií, sběr recenzí na Googlu, firemní profil na LinkedIn, zápisy do oborových přehledů. Tohle nejde nasadit přes noc — a proto o tom píšeme teď.

Za 30 dní zveřejníme, co se změnilo — v požadavcích botů, v citacích AI asistentů i v pozici při stejné rešerši. Se stejnou metodikou a stejnými daty.

Shrnutí

  • AI boti si český firemní web vyžádali 15 860× za 30 dní, 26× častěji než Googlebot. 85 % z toho jsou vyhledávací boti — AI odpovídá z aktuálního webu, ne z paměti.
  • Nejčtenější soubor je robots.txt. Kdo v něm AI boty blokuje, v odpovědích nefiguruje. Druhý je sitemapa.
  • Většina „botů“ jsou skenery hledající díry ve WordPressu; hostingové panely AI provoz podceňují až 5×. Měřte si to sami.
  • Požadavky botů nejsou totéž co doporučení. Čitelnost bez dohledatelnosti nestačí. Potřebujete stránky pro nákupní dotazy, profil na Googlu, recenze a zmínky mimo web.

Data ke stažení

Obě tabulky poskytujeme pod licencí CC BY 4.0 — použijte je, citujte je, zpochybňujte je. Uvítáme srovnání s daty z vašeho webu.

  • Boti podle požadavků (CSV) — 60 nejaktivnějších botů, provozovatel, kategorie, počet požadavků, přenesená data, příznak panelu.
  • Denní řada (CSV) — požadavky, zobrazení, návštěvy, odpovědi 4xx, požadavky botů a AI botů podle panelu, den po dni.

Nejčastější otázky

Jak poznám AI boty ve vlastních serverových lozích?
Podle řetězce User-Agent. Nejčastější: Claude-SearchBot, ClaudeBot a Claude-User (Anthropic), OAI-SearchBot, GPTBot a ChatGPT-User (OpenAI), PerplexityBot a Perplexity-User, Amazonbot, Bytespider (ByteDance), CCBot (Common Crawl), DeepSeekBot, YouBot, Applebot, Meta-ExternalAgent. Google pro AI přehledy používá běžný Googlebot; token Google-Extended v robots.txt řídí jen využití obsahu pro trénink Gemini. Pozor: řetězec User-Agent lze podvrhnout, u důležitých rozhodnutí ověřte i IP rozsahy, které provozovatelé zveřejňují.
Mám AI boty blokovat, když mi zatím nepřinášejí návštěvy?
Pokud chcete zákazníky, ne. Vyhledávací boti (Claude-SearchBot, OAI-SearchBot, PerplexityBot) rozhodují o tom, zda vás AI asistent může citovat a doporučit — blokací se z odpovědí sami vyřadíte. Řídit je můžete selektivně: povolit vyhledávací a případně omezit čistě tréninkové (GPTBot, CCBot, Bytespider). Má to být vědomé rozhodnutí, ne výchozí nastavení pluginu nebo firewallu.
Proč je Claude od Anthropicu tak dominantní?
Poctivá odpověď: přesně nevíme a část je náš vlastní vliv. Claude-SearchBot plní vyhledávací index Anthropicu a náš web je pro něj snadno čitelný (Markdown verze, llms.txt), takže ho projíždí často a celý. Zároveň jsme web v tomto období sami intenzivně testovali přes AI asistenty, což aktivitu zvyšuje. Podíl Anthropicu proto neberte jako průměr českého webu — pořadí ostatních botů (Amazon, OpenAI, Perplexity) je ale s předchozím 14denním měřením konzistentní.
Jsou požadavky AI botů to samé jako návštěvy z AI?
Ne, a to je pointa celého článku. Požadavek bota znamená, že si AI systém stáhl stránku do indexu nebo pro odpověď. Návštěva z AI znamená, že člověk v ChatGPT, Perplexity nebo Gemini klikl na odkaz na váš web. Mezi tím stojí doporučení: boti čtou weby po tisících, ale v odpovědi skončí ty, které AI zná i odjinud — z Googlu, katalogů, recenzí a zmínek. Proto řešíme dohledatelnost, ne jen čitelnost.

Zdroje: serverové logy a analytika WAF (Váš Hosting) pro doménu patosart.cz, 27. 7. – 26. 8. 2026; rešerše agentur provedená AI asistentem Claude (Anthropic) 26. 8. 2026; předchozí měření Jak se dostat do AI vyhledávání (23. 7. – 6. 8. 2026).

Čitelnost i dohledatelnost

Jak je na tom váš web?

Za minutu zjistíte, jestli AI boty pouštíte dovnitř a co si z webu přečtou. A když chcete i tu první míli, máme na to službu.