Pozorio · Metodológia

Ako meriame AI viditeľnosť

Pozorio je jediný GEO tool, ktorý publikuje confidence intervaly pri každom skóre. Tu je ako fungujú a prečo to znamená spoľahlivejšie čísla než u konkurencie.

1. Ako často sledujeme AI enginy

Pre plány Optimize a Dominate spúšťame 5 vzoriek/týždeň per (query × engine) naprieč 5 enginami (ChatGPT, Gemini, Perplexity, Google AI Overviews, Google AI Mode). Sloty sa plánujú deterministicky hash-based per pondelok 00:00 UTC a postupne sa odbavujú každých 15 minút počas celého týždňa, aby boli mereania nezávislé na rovnakom dennom kontexte.

On-demand audit cez tlačidlo „Spustiť audit“ v dashboarde spustí všetky sloty pre brand ihneď (mimo schedule).

2. Koľko vzoriek = koľko spoľahlivosti

Pri 5 vzorkách/týždeň × 5 enginov zachytíme ~108 meraní za mesiac per query (5 × 5 × 4.3 týždňov). Konkurencia (Peec AI, Profound) typicky robí 1× denne bez confidence display — výsledné čísla skáču deň po deň bez reálnej zmeny visibility.

ToolMeraní/mesiac/dotazConfidence display
Pozorio Optimize~86✓ Wilson 95% CI
Peec AI Pro~30
Profound~30

3. Wilsonov interval — čo to znamená pre teba

Wilsonov score interval (Wilson, 1927) je štatistická metóda na výpočet 95% confidence interval-u pre binomický pomer (počet úspechov / počet pokusov). Pri AI viditeľnosti:

Príklad: 12 mentions z 20 vzoriek

p̂ = 12/20 = 0.60 (60%)

z = 1.96 (95% CI)

Wilson interval = [38.7%, 78.1%]

→ tvoja skutočná visibility je s 95% pravdepodobnosťou medzi 39% a 78%. Široký interval signalizuje že potrebuješ viac vzoriek alebo je značka dosiaľ málo viditeľná.

4. Prečo neukazujeme presné čísla bez intervalu

„Tvoje skóre je 64.2 %” znie presne, ale je to ilúzia presnosti. Pri n=21 vzorkách je realistický rozsah 40-77 % — čo je obrovský rozdiel pre rozhodovanie. Ostatné GEO tooly tento detail tají, my ho stavame do popredia.

Široký interval znamená: nerob radikálne rozhodnutia na základe týždenných výkyvov. Počkaj na trend.

5. Limity metódy

Adaptívne sampling

Sampluje 5 vzoriek na (query, engine) každý týždeň naprieč všetkými 5 enginmi (ChatGPT, Gemini, Perplexity, Google AIO, Google AI Mode). Planner vyberá UTC sloty deterministicky hash-based, takže merania sú rozprestreté cez celý týždeň namiesto bursting v jeden moment — to zachytí prirodzenú variabilitu odpovedí AI modelov medzi rannou a večernou prevádzkou.

Cadence škálovaná podľa plánu

Sampling cadence sa líši per plan tier (PLAN_LIMITS.samplesPerWeekPerEngine):

Pri Optimize s 50 sledovanými dotazmi (cap) máte ~5 400 nezávislých dátových bodov mesačne — dosť pre stabilný Wilson CI aj pre malé pohyby (Δpp 3–5).

Adaptívne nastavenie počtu vzoriek

Planner každý pondelok prepočíta variance (Wilson half-width nad posledným 4-týždňovým oknom) a recent change (rozdiel cross-engine center medzi týmto a minulým 7-dňovým oknom). Podľa toho rozhodne koľko vzoriek venovať na tento týždeň:

Hash-based distribúcia v rámci týždňa

Konkrétne časy slotov sú deterministické — kľúčujú sa hashom z (queryId, engineId, weekStarting). Vzorky sú rozhodené naprieč 7 dní × 18-hodinový denný interval (04:00–22:00 UTC) tak aby rovnaký dotaz na rovnaký engine bol vždy samplovaný v rovnakých časoch — eliminuje to denno-cyklickú zaujatosť z AI APIs.

Triple-gate anomaly detection

Aby sa nezachytávali šum pohyby v hraničných oblastiach, anomálie firuju len keď platia všetky tri podmienky súčasne:

  1. |z-score| > 2.5 voči 30-dňovému baselineu
  2. Wilson intervaly tohto a predchádzajúceho 7-dňového okna sa neprekrývajú
  3. Absolútna zmena cross-engine centra > 5 pp

Pri samostatnej jednej podmienke (napr. samotný z-score nad prah) alert nefirne — naivné detektory typicky spamujú Slack pri malých rozsahových pohyboch, triple-gate to eliminuje.

Cost guards

Per-brand denné limity chránia rozpočet: $1.50/deň soft cap (preskočia sa budúce sloty pre dnes — sampling sa obnoví zajtra) a $3.00/deň hard cap (atomická kontrola v RPC, flagne brand ako throttled — budúce týždne dostanú polovicu vzoriek).

Aké modely používame

Presný model je súčasť metodológie — preto ho uvádzame pri každom engine. Zmeny modelov zaznamenávame v changelogu.

EngineZdroj / modelPoznámka
ChatGPTgpt-5.6-luna + web searchlive web search, lokalizácia SK/CZ; bezplatný audit používa rovnaký model. Migrácia z gpt-4o-mini-search-preview (deprecated u OpenAI) validovaná A/B meraním na produkčných dopytoch: zhoda verdiktov 93 %, nezhody obojsmerné = šum (8/2026); predchádzajúca medzi-modelová štúdia 97,5 %, κ 0,93
Geminigemini-2.5-flashGoogle Search grounding vynútené inštrukciou v systémovom prompte; API neponúka tvrdý prepínač, preto podiel reálne vyhľadávajúcich vzoriek priebežne merame a evidujeme pri každej vzorke (od 9/2026 100 % v overovacej vzorke; predtým sa model rozhodoval sám a hľadal len v 8–21 % prípadov). Do 10. 9. 2026 gemini-3-flash-preview; prechod na 2.5 kvôli účtovaniu vyhľadávania za každú query pri Gemini 3
PerplexitysonarPerplexity API, záložne OpenRouter
Google AI Overviewsreálny Google SERP (DataForSEO)žiadny LLM — skutočne vyrenderovaný AIO panel, desktop, SK/CZ lokalizácia
Google AI Modereálny Google AI Mode SERP (DataForSEO)jediní na SK/CZ
Parser odpovedíclaude-haiku-4-5extrakcia zmienky/pozície/sentimentu; deterministický regex fallback

Validácia voči reálnemu UI

API merania sa môžu líšiť od toho, čo vidí reálny používateľ v prehliadači — AI odpovede sú nedeterministické aj medzi dvomi obnoveniami tej istej stránky. Živé porovnanie (august 2026, 30 nákupných dopytov, odhlásený prehliadač so SK lokalitou vs naše API merania): 90 % zhoda v tom, či sa AI Overview zobrazí, a 72 % zhoda v zmienke značky — pričom odchýlky nemali systematický smer (ani v prospech, ani v neprospech API). Presne preto meriame každý dopyt viackrát týždenne a ukazujeme mieru s intervalom spoľahlivosti namiesto jedného merania.

Popri tom pripravujeme anonymný ground-truth program: používatelia našej Chrome extension budú môcť dobrovoľne (opt-in, defaultne vypnuté) prispievať merania z reálnych Google AI Overviews — odosiela sa výhradne vyhľadávaný dopyt, sledovaný výraz a či bol spomenutý. Žiadny obsah stránky, žiadna identita, žiadne cookies. Konzistenčné čísla z tohto programu zverejníme tu, keď dataset dosiahne štatisticky zmysluplnú veľkosť. Ak sa ukáže systematický rozdiel, upravíme metodológiu — poctivé meranie je celý zmysel Pozoria.