Jak dostat web do odpovědí ChatGPT: ověřený návod bez mýtů
Chcete-li, aby ChatGPT mohl váš web zahrnout do vyhledávacích odpovědí, neblokujte crawler OAI-SearchBot a povolte jeho zveřejněné IP rozsahy na hostingu nebo CDN. To je podmínka dostupnosti, nikoliv garance citace. O výběru zdroje rozhoduje také relevance, kvalita, důvěryhodnost a konkrétní dotaz.
Nejdřív rozlišujte tři situace
Věta „chci být v ChatGPT“ může znamenat tři různé cíle:
- ChatGPT zná značku – umí ji správně popsat.
- ChatGPT Search najde a cituje stránku – použije aktuální webový zdroj.
- ChatGPT doporučí firmu nebo produkt – vybere značku u obecného či nákupního dotazu.
Každý cíl vyžaduje jinou práci. Správný robots.txt pomáhá s druhým cílem, ale sám nevytvoří reputaci potřebnou pro doporučení.
OAI-SearchBot není GPTBot
OpenAI zveřejňuje několik user-agentů:
| Robot | Účel |
|---|---|
| OAI-SearchBot | Vyhledávání ChatGPT a zobrazování webů ve výsledcích |
| GPTBot | Možné použití obsahu pro trénování základních modelů |
| ChatGPT-User | Návštěva stránky vyvolaná konkrétním požadavkem uživatele |
Nastavení jsou nezávislá. Můžete povolit vyhledávání a zároveň zakázat použití pro trénink:
User-agent: OAI-SearchBot
Allow: /
User-agent: GPTBot
Disallow: /
OpenAI uvádí, že změna robots.txt se může ve vyhledávacích systémech projevit přibližně do 24 hodin. Zároveň musí hosting, firewall a CDN přijímat provoz z publikovaných IP rozsahů OpenAI.
Krok 1: Ověřte technickou dostupnost
Zkontrolujte:
- zda
robots.txtneblokuje OAI-SearchBot; - zda stránka nevrací
noindex; - zda server odpovídá stavem 200;
- zda obsah není až po přihlášení;
- zda WAF nebo CDN nevrací robotovi 403 či CAPTCHA;
- zda je hlavní obsah dostupný v HTML nebo spolehlivě renderovaný;
- zda canonical míří na správnou veřejnou URL.
Samotná existence stránky nestačí. Pokud robot dostane jinou odpověď než běžný návštěvník, může být web z pohledu vyhledávání nedostupný.
Krok 2: Dejte stránce jasný informační účel
ChatGPT Search potřebuje zdroj, který odpovídá konkrétnímu dotazu. Jedna obecná homepage nemůže kvalitně pokrýt všechny služby, produkty a problémy zákazníků.
Vytvořte samostatné stránky pro:
- hlavní služby a produktové kategorie;
- důležité use cases;
- ceník, podmínky a dostupnost;
- srovnání a rozhodovací otázky;
- návody a odborná témata;
- lokality, pokud mají skutečně odlišnou nabídku.
Každá stránka má mít jasný H1, přímý úvod, konkrétní fakta a odpovídající interní odkazy.
Krok 3: Nahraďte sebechválu ověřitelnými informacemi
Text „nabízíme špičkové řešení na míru“ neříká, pro koho je služba, co obsahuje ani kolik stojí. Užitečnější jsou:
- přesný rozsah služby;
- cena nebo způsob jejího výpočtu;
- doba realizace;
- podporované technologie;
- materiály, rozměry a kompatibilita;
- podmínky dodání nebo vrácení;
- reálné výsledky s uvedenou metodikou;
- limity a situace, kdy služba vhodná není.
Čím méně musí systém domýšlet, tím menší je riziko chybného zařazení.
Krok 4: Ujasněte, kdo za webem stojí
Na webu mají být snadno dohledatelné:
- název provozovatele a IČO;
- kontaktní údaje;
- fyzická adresa, pokud je relevantní;
- profily autorů a jejich praxe;
- datum publikace a aktualizace;
- obchodní a právní informace;
- odkazy na oficiální profily.
Strukturovaná data Organization, Person, Article, Product nebo Service mohou tyto vztahy popsat strojově. Musí ale odpovídat viditelnému obsahu a sama nezaručují citaci.
Krok 5: Budujte reputaci i mimo vlastní web
Vlastní web dokládá, co o sobě tvrdíte vy. Pro doporučení je důležité také to, co potvrzují nezávislé zdroje:
- oborové organizace;
- odborná média;
- partnerští weby;
- recenzní platformy;
- katalogy s reálnou autoritou;
- veřejné případové studie;
- původní výzkumy, které ostatní citují.
Nesnažte se vyrábět množství umělých zmínek. Autentická reference z relevantního zdroje má větší hodnotu než desítky duplicitních katalogových zápisů.
Krok 6: Měřte správný výsledek
Vytvořte sadu dotazů podle nákupní cesty:
- informační: „Jak funguje…?“
- srovnávací: „Jaký je rozdíl…?“
- doporučovací: „Která firma…?“
- lokální: „Kde v Praze…?“
- značkové: „Co je firma X?“
Každý dotaz opakujte vícekrát a zapisujte:
- datum a použitý režim;
- zda se značka objevila;
- zda byla doporučena;
- zda byl web citován odkazem;
- kontext a sentiment;
- které konkurenty odpověď uvedla.
Jedna odpověď není spolehlivá metrika. Sledujte podíl výskytů v čase.
Co nepomůže samo o sobě
- přidání
llms.txt; - přidání FAQ schema bez hodnotného obsahu;
- opakování klíčových slov;
- hromadně generované články bez vlastních informací;
- registrace do náhodných katalogů;
- testování jediného promptu;
- tvrzení, že konkrétní pořadí lze garantovat.
Kontrolní seznam
- OAI-SearchBot má v robots.txt přístup.
- Hosting a CDN povolují publikované IP rozsahy OpenAI.
- Klíčové stránky vracejí 200 a nejsou noindex.
- Hlavní obsah je dostupný bez přihlášení a interakce.
- Každá důležitá otázka má vlastní relevantní stránku nebo sekci.
- Text obsahuje konkrétní a aktualizované informace.
- Autor a provozovatel jsou ověřitelní.
- Entity a profily jsou konzistentní.
- Existují legitimní nezávislé zmínky.
- Viditelnost se testuje více dotazy a opakováními.
Časté otázky
Za jak dlouho se změna projeví?
Robots.txt může OpenAI zohlednit přibližně do 24 hodin. Zařazení konkrétní stránky a změna doporučení ale nemají garantovanou lhůtu.
Musím povolit GPTBot?
Ne. GPTBot a OAI-SearchBot lze řídit samostatně. Pro zobrazování ve vyhledávání ChatGPT je relevantní OAI-SearchBot.
Pomůže mi llms.txt?
Může posloužit jako doplňková mapa webu pro systémy, které jej čtou, ale OpenAI ho ve veřejných pokynech neuvádí jako podmínku zařazení do Search.