Jak AI vybírá zdroje: co víme, co měříme a co si jen domýšlíme
Generativní systém obvykle nejprve vyhledá nebo získá relevantní podklady a poté z nich sestaví odpověď. Přesné váhy zdrojů nejsou veřejné a liší se podle služby. Proto není poctivé vydávat jeden univerzální seznam „GEO ranking faktorů“ za ověřený algoritmus.
Zjednodušený proces
- Systém interpretuje dotaz a jeho kontext.
- Vyhledá kandidátní dokumenty nebo data.
- Vyhodnotí jejich relevanci a použitelnost.
- Z vybraných podkladů vygeneruje odpověď.
- Podle produktu zobrazí citace, odkazy nebo související zdroje.
Dokument použitý při generování nemusí být vždy explicitně citovaný a citovaný odkaz nemusí dokazovat, že byl jediným podkladem.
Co potvrzuje Google
Google uvádí, že AI Overviews a AI Mode stojí na jeho Search indexu a základních ranking a quality systémech. Mohou používat query fan-out, tedy více souvisejících vyhledávání.
Z toho lze bezpečně odvodit:
- stránka musí být indexovatelná a způsobilá k zobrazení;
- technické SEO zůstává relevantní;
- užitečný původní obsah má dlouhodobou výhodu;
- není potřeba llms.txt ani speciální AI schema.
Nelze z toho odvodit přesnou váhu H2, délky odstavce nebo počtu citací pro AI Overview.
Co potvrzuje OpenAI
OpenAI uvádí:
- veřejný web může být zařazen do ChatGPT Search;
- pro souhrny a citace je důležité neblokovat OAI-SearchBot;
- pořadí vychází z více faktorů zaměřených na relevantní a důvěryhodné informace;
- nejvyšší umístění nelze garantovat;
- GPTBot a OAI-SearchBot mají rozdílný účel.
OpenAI veřejně nezveřejňuje úplný seznam ranking faktorů ani jejich váhy.
Co ukazuje výzkum
Akademická práce GEO testovala devět úprav obsahu v konkrétním benchmarku a měřila změnu viditelnosti v generativních odpovědích. Silné výsledky měly například doplnění citací a statistik; keyword stuffing nepomáhal.
Studie je cenný důkaz, ale:
- měří konkrétní experimentální nastavení;
- nepopisuje dnešní interní algoritmus všech produktů;
- procenta nelze automaticky slibovat každému webu;
- účinek se lišil podle tématu a výchozího pořadí.
Co je rozumná, ale ne garantovaná praxe
Přístupnost
Systém nemůže spolehlivě použít obsah, ke kterému se nedostane.
Přímá relevance
Stránka má odpovídat na konkrétní potřebu a obsahovat potřebné detaily.
Ověřitelnost
Primární zdroje, metodika, autor a aktuální data snižují riziko.
Původní hodnota
Vlastní zkušenost a data odlišují web od mnoha stejných souhrnů.
Jednoznačné entity
Konzistentní název, profil autora, organizace a produktová data snižují nejasnost.
Reputace
Nezávislé kvalitní zmínky mohou potvrdit, že značka skutečně patří k tématu.
Tyto body dávají smysl lidem i vyhledávání, ale jejich přesná váha v konkrétní odpovědi není známá.
Jak dělat vlastní test
- Vyberte jednu stránku a skupinu promptů.
- Zaznamenejte výchozí odpovědi ve více opakováních.
- Proveďte jednu významnou změnu.
- Nechte dostatečný čas na crawl a indexaci.
- Zopakujte stejnou sadu ve stejném režimu.
- Sledujte zmínky, citace, zdroje a variabilitu.
- Výsledek označte jako pozorování, ne univerzální zákon.
Mýty
- AI cituje vždy první tři organické výsledky. Query fan-out a produktové rozdíly mohou přivést jiné zdroje.
- Schema zaručí citaci. Ne.
- llms.txt je ranking faktor. Pro Google ne; u dalších systémů není univerzální vliv doložen.
- Čím delší článek, tím lépe. Délka bez hodnoty nepomáhá.
- Více zmínek vždy znamená vyšší autoritu. Kvalita, kontext a autenticita jsou zásadní.