Vyhľadávanie na internete sa mení. Je váš web pripravený?
Ešte pred niekoľkými rokmi bolo hlavným cieľom webových stránok získať dobrú pozíciu vo vyhľadávačoch, predovšetkým na Googlu a Sezname. Dnes sa spôsob hľadania informácií rýchlo mení.
Užívateľ už nemusí zadať do Googlu niekoľko kľúčových slov, otvoriť desať výsledkov a jednotlivé weby postupne prechádzať. Stále častejšie položí celú otázku priamo nástroju využívajúcemu umelú inteligenciu:
„Kto mi vyrobí kuchyňu na mieru v Uherskom Hradišti?“
„Nájdi mi firmu na rekonštrukciu strechy v okolí Zlína.“
„Ktorý dodávateľ ponúka priemyselné senzory na meranie tlaku?“
„Kde kúpim detské topánky so širokou špičkou?“
AI systém následne vyhodnocuje informácie z internetu a užívateľovi pripraví konkrétnu odpoveď, odporúčanie alebo odkazy na relevantné firmy.
A práve tu vzniká nový požiadavok na webové stránky:
Nestačí, aby web dobre vyzeral. Musí byť tiež technicky a obsahovo pripravený tak, aby jeho informácie dokázali správne načítať a pochopiť vyhľadávače, AI roboti a ďalšie automatizované systémy.
Neexistuje žiadna úprava webu, ktorá by garantovala, že bude firma v odpovedi ChatGPT, Gemini alebo Claude vždy odporúčaná. Správne pripravený web však môže významne zlepšiť jeho dohľadateľnosť, strojovú čitateľnosť a schopnosť AI systému pochopiť, kto firma je, čo ponúka a kde pôsobí..
Čo sa dnes pri načítaní webu mení
Klasický internetový vyhľadávač využíva roboty, ktorí stránky pravidelne prechádzajú, ukladajú ich obsah do indexu a následne ich používajú pri vyhľadávaní.
S nástupom AI sa k nim pridávajú ďalšie systémy.
Web tak dnes môžu navštevovať napríklad:
- Googlebot,
- roboty OpenAI,
- roboty spoločnosti Anthropic,
- roboty spoločnosti Meta,
- roboty ďalších AI vyhľadávačov,
- systémy načítajúce stránku na priamy požiadavok používateľa,
- nástroje vytvárajúce indexy pre AI vyhľadávanie.
To znamená, že web už nie je pripravený iba pre návštevníka a Google.
Musí byť dobre čitateľný aj strojovo.
Ako web načíta ChatGPT
OpenAI dnes rozlišuje niekoľko typov robotov.
Pre vyhľadávanie v ChatGPT je najdôležitejší robot OAI-SearchBotOpenAI výslovne uvádza, že tento robot slúži na vyhľadávanie a aby sa webové stránky mohli objaviť vo výsledkoch vyhľadávania ChatGPT. Ak je OAI-SearchBot zablokovaný, obsah webu nemusí byť možné v odpovediach ChatGPT bežne zobrazovať a citovať.
OpenAI ďalej používa napríklad:
OAI-SearchBot slúži na vyhľadávanie a zobrazovanie webových stránok vo výsledkoch ChatGPT.
GPTBot slúži na získavanie obsahu, ktorý môže byť využívaný pri vývoji a trénovaní budúcich generatívnych modelov OpenAI.
ChatGPT-User môže navštíviť stránku priamo v situácii, keď o to požiada používateľ ChatGPT. Nejde o klasického automatického indexovacieho robota.
Pre majiteľa webu je teda dôležité rozlišovať medzi indexáciou pre vyhľadávanie a napríklad súhlasom s využívaním obsahu pre vývoj AI modelov.
Je možné napríklad povoliť OAI-SearchBot a súčasne pomocou robots.txt nastaviť iné pravidlá pre GPTBot. OpenAI tieto možnosti oddeľuje.
Ako web načíta Claude
Podobný princíp používa aj spoločnosť Anthropic, ktorá prevádzkuje AI Claude.
Anthropic rozlišuje napríklad:
Claude-SearchBot prechádza internet za účelom zlepšenia výsledkov webového vyhľadávania.
Claude-User môže načítavať webové stránky na základe konkrétneho požiadavku používateľa Claude.
ClaudeBot slúži na získavanie obsahu, ktorý môže byť použitý pri vývoji AI modelov.
Anthropic súčasne uvádza, že jeho roboti rešpektujú pravidlá uvedené v súbore robots.txt.
To znamená, že nevhodne nastavený robots.txt môže spôsobiť, že určitý AI systém nebude mať k dôležitému obsahu vôbec prístup.
Ako web využíva Google a Gemini
Google má jednu z najrozsiahlejších indexovacích infraštruktúr na internete.
Klasické vyhľadávanie využíva predovšetkým Googlebot.
U služieb súvisiacich s Gemini sa používa aj riadenie prostredníctvom tokenu Google-ExtendedGoogle uvádza, že pomocou neho môžu prevádzkovatelia webov riadiť využitie obsahu napríklad pri vývoji modelov Gemini a pri niektorých spôsoboch ich groundingu. Zároveň Google zdôrazňuje, že Google-Extended nie je klasický rankingový signál pre Google Search.
Zjednodušene povedané:
dobrá viditeľnosť webu v klasickom Google vyhľadávaní zostáva veľmi dôležitá aj pre svet AI.
AI a klasické SEO preto nie sú dve oddelené disciplíny. Naopak sa stále viac prelínajú.
Meta AI, Facebook a ďalšie systémy
Aj Meta používa niekoľko rôznych robotov.
Vedľa klasických systémov používaných napríklad na náhľady odkazov sa dnes objavujú aj roboty súvisiace s AI produktmi spoločnosti Meta.
Medzi ne patrí napríklad Meta-ExternalAgent, ktorý je spojený so získavaním obsahu pre AI systémy spoločnosti Meta. Meta zároveň prevádzkuje ďalšie oddelené roboty na iné účely.
Pre správcu webu je preto stále dôležitejšie vedieť:
- kto web prechádza,
- ktoré roboty chceme povoliť,
- ktoré časti webu im chceme sprístupniť,
- či ich neblokuje firewall,
- či ich neblokuje CDN,
- či nedostávajú chybu 403,
- či server ich požiadavky správne obslúži.
Správne nastavenie robots.txt
Jedným zo základných súborov každého webu je:
\/robots.txt
Nájdeme ho napríklad na adrese:
https:\/\/www.domena.sk\/robots.txt
Súbor určuje pravidlá pre roboty, ktoré web prechádzajú.
Google napríklad pred načítaním webu kontroluje pravidlá uvedené v robots.txt a na ich základe rozhoduje, ktoré časti webu smú prechádzať.
Moderná konfigurácia webu preto musí riešiť nielen Googlebot, ale aj jednotlivé AI roboty.
Príklad zjednodušeného nastavenia môže vyzerať napríklad takto:
User-agent: OAI-SearchBot Allow: \/ User-agent: Claude-SearchBot Allow: \/ User-agent: Googlebot Allow: \/ User-agent: * Allow: \/ Sitemap: https:\/\/www.domena.sk\/sitemap.xmlKonkrétnu konfiguráciu je však potrebné pripraviť individuálne podľa typu webu.
Napríklad administráciu, interné vyhľadávanie, košík, objednávkové procesy alebo niektoré parametrické adresy naopak nie je vhodné robotom zbytočne sprístupňovať.
Sitemap.xml – mapa obsahu webu
Ďalšou dôležitou súčasťou je súbor:
sitemap.xml
Ten robotom pomáha zistiť:
- aké stránky web obsahuje,
- aké produkty existujú,
- ktoré články sú dostupné,
- ktoré stránky boli aktualizované,
- ako je web štrukturovaný.
U rozsiahlych webov alebo e-shopov môžu existovať samostatné mapy napríklad pre:
- produkty,
- kategórie,
- články,
- obrázky,
- jazykové verzie.
Sitemap musí byť aktuálny. Ak web obsahuje 20 000 produktov, z ktorých polovica už neexistuje, a sitemap stále odkazuje na staré adresy, vytvárame zbytočné požiadavky a komplikujeme robotom prácu.
Obsah musí byť skutočne dostupný v HTML
Veľmi dôležitým tématom moderných webov je JavaScript.
Web môže na monitore vyzerať perfektne, ale veľká časť jeho obsahu môže vzniknúť až po spustení JavaScriptu v internetovom prehliadači.
To môže pre niektoré automatizované systémy predstavovať problém.
Preto kontrolujeme, či dôležité informácie existujú priamo vo výslednom HTML dokumente, príp. či je použitý vhodný server-side rendering alebo iné riešenie.
Robot by mal byť schopný jednoducho zistiť:
- názov firmy,
- hlavné služby,
- produkty,
- ceny,
- lokality,
- kontaktné údaje,
- dôležité parametre produktu,
- texty kategórií,
- FAQ,
- referencie,
- ďalšie podstatné informácie.
Web nemôže byť "čitateľný len pre človeka".
Správna štruktúra HTML
Umelá inteligencia dokáže spracovávať text veľmi dobre. Napriek tomu jej výrazne pomáha, ak je stránka logicky štruktúrovaná.
Kontrolujeme preto napríklad:
<title>
<meta name="description">
<h1>
<h2>
<h3>
<main>
<article>
<section>
<nav>
<header>
<footer>
Správne použitá štruktúra pomáha určiť:
- čo je hlavná téma stránky,
- čo je nadpis,
- čo je doplňujúca informácia,
- čo je navigácia,
- čo je vlastný obsah,
- ako jednotlivé časti textu spolu súvisia.
Napríklad stránka nazvaná iba:
Služby
poskytuje stroju podstatne menej informácií ako:
Zakázková výroba kuchýň a nábytku – Uherské Hradiště a okolie
Metadata v hlavičke stránky
Dôležitá je tiež správne pripravená HTML hlavička.
Obsahuje napríklad:
<title>Výroba kuchýň na mieru | Firma XY</title> <meta name="description" content="Výroba kuchýň a nábytku na mieru v Uherskom Hradišti a okolí. Návrh, výroba a montáž."> <link rel="canonical" href="https://www.domena.cz/kuchyne-na-miru">Podľa typu webu doplňujeme tiež:
- kanonickú URL,
- jazykové varianty pomocou
hreflang,, - Open Graph metadata,
- metadata pre sociálne siete,
- informácie pre roboty,
- správne stavové HTTP kódy.
Duplicita adries je problém nielen pre klasické SEO.
Ak sa napríklad ten istý obsah zobrazuje na piatich rôznych URL, robot musí riešiť, ktorá adresa je vlastne hlavná.
Štruktúrované dáta – Schema.org
Jednou z najdôležitejších technických vrstiev moderného webu sú štruktúrované dáta.
Nejde o text určený návštevníkovi.
Ide o strojovo čitateľnú informáciu, ktorá robotom explicitne hovorí:
Toto je firma.
Toto je produkt.
Toto je cena.
Toto je adresa firmy.
Toto je telefón.
Toto je článok.
Toto je FAQ.
Toto je autor.
Toto je služba.
Najčastejšie sa používa formát JSON-LD podľa štandardu Schema.org.
Google priamo uvádza, že štruktúrované dáta používa na lepšie pochopenie obsahu stránky.
U lokálnej firmy možno napríklad využiť štruktúru typu LocalBusiness. Schema.org umožňuje opísať napríklad adresu, telefón, lokalitu, logo, ponúkané služby a ďalšie údaje.
Zjednodušený príklad:
<script type="application\/ld+json"> { "@context": "https:\/\/schema.org", "@type": "LocalBusiness", "name": "Firma XY", "url": "https:\/\/www.domena.sk", "telephone": "+421123456789", "address": { "@type": "PostalAddress", "addressLocality": "Uherské Hradiště", "addressCountry": "CZ" } } <\/script>U e-shopu môžu byť štruktúrovanými dátami opísané napríklad produkty, ceny, dostupnosť alebo ďalšie parametre.
Pre stroje je to výrazne jednoznačnejšie než pokúšať sa všetky informácie odhadovať iba z grafického vzhľadu stránky.
Obsah musí odpovedať na skutočné otázky zákazníkov
Nestačí technicky správny web.
AI vyhľadávanie je postavené na otázkach.
Preto sa mení aj spôsob tvorby obsahu.
Užívateľ nehľadá iba:
„tesár Uherské Hradiště“
ale môže sa pýtať:
„Kto mi v Uherskom Hradišti vyrobí vstavanú skriňu na mieru?“
„Koľko stojí kuchyňa na mieru?“
„Kto príde zamerať kuchyňu priamo domov?“
„Ktorá firma vyrába nábytok v okolí Uherského Hradiště?“
Ak web na podobné otázky poskytuje kvalitné a jednoznačné odpovede, dáva AI systému viac použiteľných informácií.
Preto pri optimalizácii kontrolujeme aj:
- stránky jednotlivých služieb,
- lokality,
- FAQ,
- produktové popisy,
- referencie,
- kontaktné informácie,
- informácie o firme,
- odborné články,
- jasnosť a jednoznačnosť textov.
Lokálna dohľadateľnosť
Veľká časť AI dopytov bude lokálna.
Napríklad:
„Nájdite mi pneuservis v Kunoviciach.“
„Kde si nechám vyrobiť pergolu vo Zlíne?“
„Kto opravuje tepelné čerpadlá v Uherskom Hradišti?“
Ak z webu nie je jednoznačne zrejmé, kde firma pôsobí, AI túto informáciu nemá z čoho bezpečne zistiť.
Preto kontrolujeme napríklad:
- adresu,
- mesto,
- región,
- obsluhované lokality,
- kontaktnú stránku,
- strukturované dáta LocalBusiness,
- prepojenie jednotlivých služieb s lokalitou.
Nie je však správne vytvárať stovky prakticky totožných stránok iba so zmeneným názvom obce.
Obsah musí byť predovšetkým kvalitný a užitočný.
Rýchlosť webu
Rýchlosť má význam nielen pre používateľov, ale aj pre automatizované systémy.
Ak robot požaduje stránku a server odpovedá niekoľko sekúnd alebo opakovane vracia chyby, je spracovanie webu zložitejšie a nákladnejšie.
Preto kontrolujeme:
- veľkosť HTML,
- obrázky,
- WebP/AVIF,
- lazy loading,
- JavaScript,
- CSS,
- databázové dotazy,
- cache,
- kompresiu Brotli/GZIP,
- HTTP/2 alebo HTTP/3,
- rýchlosť servera,
- CDN,
- načítanie externých skriptov.
Google používa na hodnotenie používateľského zážitku mimo iného Core Web Vitals.
Aktuálne medzi hlavné metriky patrí:
LCP – Najväčšie zobrazenie obsahu (Largest Contentful Paint) odporúčaná hodnota do 2,5 sekundy.
INP – Interakcia na ďalšie zobrazenie (Interaction to Next Paint) odporúčaná hodnota pod 200 ms.
CLS – Kumulatívny posun rozvrhu (Cumulative Layout Shift) odporúčaná hodnota pod 0,1.
Vyšší počet automatizovaných prístupov
Skôr web navštevovali predovšetkým používatelia a niekoľko hlavných vyhľadávačov.
Dnes pribúdajú ďalšie automatizované systémy.
AI vyhľadávače, indexery, agenti a ďalšie služby vytvárajú ďalšiu vrstvu automatizovaného prevádzky.
U niektorých webov môže byť počet týchto prístupov významný.
Preto je potrebné kontrolovať:
- serverovú kapacitu,
- databázu,
- cache,
- počet požiadaviek,
- logy servera,
- rate limiting,
- ochrana proti nekontrolovaným robotom,
- rozdiel medzi legitímnym robotom a škodlivým scraperom.
Cieľom nie je jednoducho „povoliť všetkých robotov“.
Cieľom je umožniť prístup tým systémom, ktoré pre web dávajú zmysel, a súčasne web chrániť pred nežiaducou automatizovanou záťažou.
Firewall a CDN nesmú omylom blokovať AI roboty
Toto je dnes veľmi častý problém.
Web môže mať správne nastavený robots.txt, ale pred serverom môže fungovať napríklad:
- Cloudflare,
- Web Application Firewall,
- ochrana proti DDoS,
- ochrana proti botom,
- vlastný firewall.
Tá môže robota zablokovať ešte predtým, než sa k webu vôbec dostane.
OpenAI napríklad upozorňuje, že ochrany webov môžu legitímne roboty blokovať a vracať im odpoveď 403 Forbidden.
Preto nestačí skontrolovať iba HTML stránky.
Je nutné kontrolovať celú cestu:
robot → DNS → CDN → firewall → server → aplikácia → databáza
Bezpečnosť webových stránok
S rozvojom automatizácie a AI rastú aj možnosti automatizovaného vyhľadávania zraniteľností, generovania požiadaviek a analyzovania webových aplikácií.
Bezpečnosť webu je preto stále dôležitejšia.
Pri technickom audite kontrolujeme napríklad:
- zastaralé knižnice,
- verziu PHP a ďalších technológií,
- zabezpečenie formulárov,
- SQL injection,
- XSS,
- CSRF,
- prístupové práva,
- administratívne rozhranie,
- upload súborov,
- API,
- hlavičky HTTP,
- SSL/TLS,
- chyba stránky,
- logovanie,
- ochranu proti brute-force útokom,
- rate limiting.
Dôležité je rozlišovať medzi legitímnym AI robotom a automatizovaným útočníkom, ktorý sa za robota iba vydáva.
Samotný text v User-Agent hlavičke nie je spoľahlivý dôkaz identity návštevníka.
HTTP stavové kódy, presmerovanie a canonical
Robot musí tiež správne pochopiť, čo sa s konkrétnou adresou stalo.
Preto kontrolujeme napríklad:
200 OK stránka existuje.
301 Redirect stránka bola trvalo presunutá.
404 Not Found stránka neexistuje.
410 Gone obsah bol odstránený.
429 Too Many Requests príliš veľa požiadaviek.
5xx chyba servera.
Ak web namiesto skutočnej chyby 404 zobrazuje stránku s textom „produkt neexistuje“, ale vracia HTTP 200, robot môže chybnú stránku považovať za platný obsah.
Interné prelinkovanie
Robot sa musí vedieť pohybovať po webe.
Preto analyzujeme:
- hlavné menu,
- drobečkovú navigáciu,
- odkazy medzi službami,
- odkazy medzi kategóriami,
- súvisiace produkty,
- články,
- referencie.
Dôležitá stránka by nemala existovať ako „ostrov“, na ktorý z webu nikde nevedie odkaz.
Obrázky a ďalšie médiá
Takisto musia byť obrázky správne popísané.
Kontrolujeme napríklad:
- názvy súborov,
alttext,- rozmery,
- kompresiu,
- lazy loading,
- dostupnosť obrázku robotom,
- prístup cez CDN.
Napríklad súbor:
IMG_45892.jpg
nedáva žiadnu informáciu.
Naopak:
kuchyne-na-miru-uherske-hradiste.jpg
spolu so správnym ALT popisom poskytuje podstatne viac kontextu.
llms.txt – nový štandard vo vývoji
V súvislosti s AI sa stále častejšie diskutuje aj súbor:
\/llms.txt
Ide o návrh štandardu, ktorého cieľom je ponúknuť AI agentom stručný a dobre štruktúrovaný prehľad dôležitých informácií o webe.
Môže obsahovať napríklad:
- popis spoločnosti,
- hlavné časti webu,
- dôležité dokumenty,
- odkazy na služby,
- dokumentáciu,
- ďalšie informácie vhodné na spracovanie LLM.
Dôležité je zdôrazniť, že llms.txt zatiaľ nie je univerzálny internetový štandard s garantovanou podporou všetkých AI systémov.
Ide však o zaujímavý doplnok, ktorý sa rýchlo vyvíja a u niektorých projektov má zmysel ho pripraviť. Návrh vznikol v roku 2024 a postupne sa ďalej vyvíja.
Nemôže však nahradiť kvalitné HTML, štruktúrované údaje, sitemapu alebo správny robots.txt.
Monitoring AI robotov
Po vykonaní úprav je vhodné sledovať, kto naozaj navštevuje web.
Z logov servera môžeme zistiť napríklad:
- Googlebot,
- OAI-SearchBot,
- GPTBot,
- ClaudeBot,
- Claude-SearchBot,
- ďalšie roboty.
Môžeme sledovať:
- počet ich návštev,
- požadované URL,
- chybové odpovede,
- rýchlosť servera,
- množstvo prenesených dát,
- neobvyklú záťaž.
Vďaka tomu je možné konfiguráciu postupne upravovať podľa skutočného prevádzky.
Čo teda znamená „pripraviť web na AI“?
Nejedná sa o inštaláciu jedného pluginu ani pridanie jedného META tagu.
Kompletná príprava webu zahŕňa kombináciu viacerých oblastí:
Obsah
- jasné opísanie služieb a produktov,
- lokalita,
- FAQ,
- odborné informácie,
- správna hierarchia textu.
Kód
- sémantické HTML,
- metadata,
- canonical,
- hreflang,
- správne HTTP odpovede,
- štruktúrované dáta JSON-LD.
Prístup robotov
- robots.txt,
- sitemap.xml,
- kontrola OAI-SearchBot,
- Claude-SearchBot,
- Googlebot,
- ďalších relevantných robotov.
Výkon
- rýchlosť,
- cache,
- databázové dotazy,
- obrázky,
- JavaScript,
- Core Web Vitals.
Bezpečnosť
- ochrana aplikácie,
- aktualizácie technológií,
- firewall,
- ochrana proti škodlivým robotom,
- rate limiting.
Monitoring
- serverové logy,
- návštevy AI robotov,
- chybný stavy,
- zaťaženie servera.
Prečo to riešiť práve teraz?
Internetové vyhľadávanie prechádza jednou z najväčších zmien za posledné roky.
Google zostáva mimoriadne dôležitý, ale vedľa neho sa používatelia čoraz viac pýtajú priamo AI asistentov.
Firmy by preto mali pripravovať web súčasne pre dva svety:
klasické vyhľadávače
a
AI vyhľadávanie a AI asistenti.
Dobre pripravený web má výhodu v tom, že jeho obsah môžu automatizované systémy ľahšie:
- nájsť,
- načítať,
- pochopiť,
- správne zaradiť,
- spojiť s konkrétnou firmou,
- spojiť s lokalitou,
- spojiť s produktom alebo službou,
- použiť ako zdroj odpovede.
A práve o to pri príprave webu na umelú inteligenciu ide.
Ako postupujeme pri AI audite webových stránok
V rámci nášho auditu najprv web analyzujeme pomocou interného AI agenta a následne výsledky kontroluje náš tím.
Prověřujeme technickú, obsahovú aj prevádzkovú časť webu.
Následne vykonáme odsúhlasené úpravy zamerané predovšetkým na:
- pripravenosť pre AI vyhľadávače,
- klasické SEO,
- roboty a ich prístup na web,
- štruktúrované dáta,
- kód a HTML štruktúru,
- rýchlosť webu,
- bezpečnosť,
- zaťaženie servera,
- mobilné zobrazenie,
- technickú kvalitu webu.
Po dokončení zákazník obdrží podrobný audit a report vykonaných úprav, v ktorom je uvedené, čo bolo na webu skontrolované, upravené a optimalizované.
Cieľom nie je hľadať chyby v pôvodnom webe.
Cieľom je prispôsobiť existujúci web novému prostrediu, ktoré vzniká s rozvojom umelej inteligencie, AI vyhľadávania a automatizovaného spracovania internetového obsahu.
Chcete zistiť, či je váš web pripravený na AI?
Ak máte webové stránky vytvorené pred niekoľkými rokmi, je veľmi pravdepodobné, že v čase ich vzniku dnešné AI vyhľadávače, ich roboti a súčasné požiadavky ešte vôbec neexistovali.
Preto ponúkame kompletný AI audit a modernizáciu webových stránok, ktorá pripraví web na ďalší vývoj internetového vyhľadávania.
Súčasťou je samotná analýza, technické testovanie, realizácia odsúhlasených úprav a záverečný podrobný report.
Nastavenie