AI a vyhledávání

Information Gain

Definice

Information gain je skóre, kterým Google podle vlastního patentu vyhodnocuje, jestli dokument přináší informace navíc oproti stránkám, které uživatel v rámci hledání už viděl. Patent s prioritou z roku 2018 (udělený až 2024) ho popisuje jako nástroj pro konverzační asistenty, ne jako potvrzený obecný faktor pro řazení klasických výsledků vyhledávání.

Pojem se v SEO diskurzu poprvé objevil v roce 2020, kdy si patentový analytik Bill Slawski všiml tehdy ještě nezveřejněné přihlášky Googlu s názvem Contextual Estimation Of Link Information Gain. Skutečný zájem přišel až o čtyři roky později - patent byl v červnu 2024 oficiálně udělen a souběžně s nástupem AI Overviews a chatbotů jako ChatGPT nebo Perplexity se z okrajové teorie stala jedna z nejcitovanějších frází v anglicky psaném SEO obsahu.

Jak se skóre počítá

Podle patentu systém eviduje, jaké dokumenty uživatel v rámci jednoho hledání už otevřel nebo mu byly zobrazené, a nového kandidáta s nimi porovná pomocí modelu strojového učení. Výsledné skóre vyjadřuje, kolik skutečně nové informace dokument oproti už zobrazeným stránkám přidává. Jakmile uživatel otevře další stránku, skóre zbylých kandidátů se přepočítá a výsledky se podle něj znovu seřadí - patent to popisuje jako průběžný přepočet v rámci jedné session, ne jednorázové ohodnocení.

Z toho plyne důležitá vlastnost: skóre patří vztahu mezi dokumentem a konkrétním uživatelem v jedné session, ne dokumentu samotnému jako univerzální známce kvality. Dvěma lidem, kteří si prošli jiné výsledky, může stejný dokument vyjít jinak.

Hranice patentu: pro koho vlastně je

Přihláška mluví o automatizovaných asistentech, dialogových systémech a čtení obsahu nahlas - tedy o kontextu blízkém konverzačnímu vyhledávání a hlasovým asistentům, ne o klasickém řazení webových výsledků. Search Engine Journal to po vlastním rozboru patentu shrnul jasně: nic v textu nenaznačuje, že by stránka s víc informacemi než konkurence měla automaticky větší šanci na lepší pozici v klasických organických výsledcích.

Backlinko nebo Clearscope přesto information gain prezentují jako obecnou obsahovou strategii pro zvýšení pozic - včetně konkrétních čísel o růstu návštěvnosti u textů s vlastními daty - bez téhle podmínky z patentu: jde o mechanismus pro konverzační systémy, ne o slib lepšího umístění pro každý web, který napíše delší text.

Information gain jako skóre novosti, E-E-A-T jako hodnocení důvěryhodnosti

Oba pojmy se v textech o AI vyhledávání běžně pletou dohromady, protože oba míří na “kvalitu” obsahu. Mechanismus je ale jiný. E-E-A-T je rámec ze Search Quality Rater Guidelines, podle kterého lidští hodnotitelé ručně posuzují, jak moc je stránka a její autor důvěryhodný - jde o kvalitativní úsudek o zdroji. Information gain je algoritmický signál, který se ptá na něco jiného: přináší tenhle konkrétní dokument informaci, kterou konkrétní uživatel ještě neviděl?

Stránka může mít silné renomé a přesto nulový information gain, pokud jen opakuje to, co uživatel před chvílí četl jinde. Méně známý web naopak může mít vysoký information gain, když jako první popíše něco, co jinde chybí. Jedno o druhém nic nevypovídá.

Proč se o tom mluví právě kvůli AI vyhledávání

Skutečný důvod, proč pojem exploduje zrovna teď, leží v tom, jak fungují odpovídací systémy jako AI Overviews, ChatGPT nebo Perplexity, ne v klasickém vyhledávání samotném. Když model skládá jednu syntetizovanou odpověď z několika zdrojů, přirozeně upřednostní dokument, který do odpovědi přidává něco, co v ní ještě není - zbytek jen opakuje totéž jinými slovy a citaci nepotřebuje. Mechanismus tím připomíná přesně to, co patent popisuje: porovnání s tím, co systém, respektive uživatel, už v rámci jedné odpovědi nebo hledání viděl.

Co to prakticky znamená pro obsah

Prakticky jde o totéž, co říká obecné pravidlo hloubky nad šířkou: text má smysl psát, jen když k tématu přidává něco, co tam ještě není - vlastní data, přímou zkušenost, vyvrácení rozšířeného omylu nebo úhel, který zbytek desítky přehlíží. Přeformulovaná osnova konkurence information gain nezvedne, i kdyby výsledný text vyšel o pár set slov delší.

Na českém a slovenském trhu k tomu přibývá jedna okolnost: nízká konkurence tu zatím znamená, že se i průměrný obsah občas dostane na přední pozice bez ohledu na information gain. Je to spíš aktuální mezera než trvalý stav - s rostoucím množstvím AI generovaného obsahu i v češtině se stejná konkurence pravděpodobně zahustí.

Související pojmy
Z teorie do praxe

Proberte to se mnou.

Information gain se neřeší jako jednorázová úprava, ale jako součást obsahové strategie. V měsíční správě posuzuji, kde má obsahu smysl přidat vlastní data nebo zkušenost a kde už podobný text na webu jednou stačí - podle toho, co k tématu reálně chybí, ne podle šablony.

Napište mi

Nebo se podívejte na službu SEO správa →