Mérés

Havi AI-választeszt protokoll: hogyan mérd ugyanúgy minden hónapban

Havi AI-választeszt protokoll: hány prompt, milyen arány, vendég munkamenet, ismétlés és rögzítés, hogy az AI-láthatósági mérésed hónapról hónapra összevethető legyen.

Scheo · · olvasási idő ~10 perc · Szerző: Schmidt Péter

Összefoglalva: A havi AI-láthatósági mérés csak akkor összehasonlítható, ha a protokoll fagyasztva van: fix promptkészlet, fix munkamenet-típus, fix időzítés, 3 ismétlés és nyers válasz-archívum. Ha rossz az eredmény, a tartalmon változtass, ne a mérésen.

Az AI-válaszokban való megjelenés mérése akkor ér valamit, ha maga a mérés nem mozog. A legtöbb havi AI-láthatósági riport azért használhatatlan, mert minden hónapban kicsit másképp készül: más promptokkal, más gépről, más napszakban, egyszer bejelentkezve, máskor vendégként. Az eredmény ilyenkor nem a láthatóságod változását mutatja, hanem a módszertan változását. Az alábbi protokoll arra való, hogy egyszer beállítsd, leírd, és utána hónapokon át ugyanúgy futtasd. A saját nézőpontom egy mondatban: a mérés akkor hordoz információt, ha fagyasztva van, és nem akkor, amikor a rossz eredmény után új promptokat keresünk.

Havi AI-választeszt protokoll: hogyan mérd ugyanúgy minden hónapban
Havi AI-választeszt protokoll: hogyan mérd ugyanúgy minden hónapban

Miért esik szét a legtöbb havi AI-mérés két hónap alatt?

Rövid válasz: mert a válaszmotorok eleve zajosak, és ha a mérési módszer is változik, a kettőt utólag nem tudod szétválasztani.

Hivatalosan igazolt: a nagy nyelvi modellek mintavételezéssel állítják elő a szöveget, ezért ugyanaz a kérdés kétszer futtatva eltérő választ adhat. Ezt a modellszolgáltatók fejlesztői dokumentációi (OpenAI, Anthropic, Google) is leírják. Ugyancsak dokumentált, hogy a fogyasztói felületek személyre szabnak: a ChatGPT memóriája, az egyéni utasítások és a beszélgetés előzménye befolyásolja a kimenetet, és a modellverzió is cserélődhet a hónap közben.

Saját tapasztalat: a mérések nagyobb részét nem a motor zaja rontja el, hanem a mérő ember. Tipikus torzítók: valaki a saját, márkára tanított fiókjából kérdez, más gépről más nyelvi beállítással fut a teszt, a promptot menet közben átfogalmazzák, mert „így pontosabb”, és a képernyőkép csak akkor készül, ha jó lett az eredmény. Ezek külön-külön is elég nagyok ahhoz, hogy egy valós javulást vagy romlást teljesen elfedjenek.

Hány promptból álljon a havi készlet?

Rövid válasz: motoronként 20-30 fix prompt, azonos sorrendben. Ennél kevesebbel egyetlen véletlen említés is túl nagyot mozdít az arányon.

A matematika egyszerű: 20 promptnál egy említés 5 százalékpontot ér, 10 promptnál már 10-et. Egy 10 elemű készletnél tehát hónapról hónapra ugrálhat a mutatód anélkül, hogy bármi történt volna. A 30 fölötti készlet pontosabb, viszont kézi méréssel három motoron, három ismétléssel már 270 lekérdezés, ami egy délelőttbe nehezen fér bele.

A készlet összetétele legyen tematikusan kiegyensúlyozott. Egy szolgáltató cégnél így szoktam felosztani: 6-8 vásárlás előtti kérdés (ki tud ilyet csinálni, kit ajánlanál), 5-6 összehasonlító kérdés (melyik jobb, mi a különbség), 4-5 probléma-megoldó kérdés (mit csináljak, ha), 3-4 helyi kérdés (Székesfehérváron, Budapesten, a megyében), végül 4-6 márkás kérdés. A promptokat kapod egy azonosítót (p01, p02), és onnantól az azonosító a hivatkozás, nem a szöveg.

Milyen arányban legyen márkás és márka nélküli kérdés?

Rövid válasz: 70-80 százalék márka nélküli, 20-30 százalék márkás.

A kettő ugyanis mást mér. A márkás kérdés (mit tudsz a Példa Kft.-ről, megbízható-e a Példa Kft.) azt mutatja, hogy a modell ismer-e, és milyen forrásokból építi rólad a képet. Ez fontos hírnév-mutató, de kereskedelmi értéke közvetve van: aki a nevedre kérdez, az már ismer.

A márka nélküli kérdés (ki csinál ilyet jól a környéken, mire figyeljek ilyen szolgáltatás kiválasztásánál) az igazi tét: itt derül ki, bekerülsz-e az ajánlott nevek közé. Ezért kapja a kérdések nagyobb részét. Saját tapasztalat: a cégek fordítva szokták csinálni, mert a márkás kérdésre majdnem mindig kapnak valamilyen választ, és attól jó érzésük lesz. Egy fél évig fagyasztott, márka nélküli túlsúlyú készlet sokkal többet mond a tartalmi munkád hatásáról.

A készleten belül a márkás és márka nélküli arány is fix. Ha ma 22 promptból 5 márkás, akkor jövőre is 5 márkás legyen, különben a százalékos mutatóid nem vethetők össze.

Bejelentkezve vagy vendégként mérj?

Rövid válasz: alapértelmezésben vendég (kijelentkezett) munkamenetben, promptonként új beszélgetésben.

A bejelentkezett fiók emlékszik. Ha korábban a saját cégedről kérdeztél, a modell nagyobb eséllyel hoz elő, és ezt a torzítást a riportban nem látod. A vendég munkamenet ezt a rétegét kiüti. Rögzítsd emellett a következőket, és írd is bele a protokollba: böngésző és verzió, privát ablak igen vagy nem, felület nyelve, IP országa (VPN-nel vagy anélkül), a webes keresés kapcsolója be vagy ki.

Ha egy motor csak bejelentkezve érhető el, akkor legyen egy dedikált mérő-fiók, amit semmi másra nem használsz. Ebben a memória kikapcsolva, az egyéni utasítások üresen, a beszélgetéselőzmény havonta törölve. Hivatalosan igazolt: a memória és az egyéni utasítások kikapcsolása a felhasználói beállításokban dokumentált lehetőség a nagy asszisztenseknél.

Szakmai feltételezés: a vendég és a tiszta bejelentkezett fiók eredménye a legtöbb kérdésnél közel áll egymáshoz, de ezt magad is ellenőrizheted: fuss le egyszer mindkettővel, és ha érdemi eltérést látsz, a vendég mód maradjon a hivatalos.

Milyen napszakban és hány ismétléssel fusson a teszt?

Rövid válasz: a hónap azonos munkanapján (például minden hónap első keddjén), délelőtt 9 és 11 között, promptonként 3 ismétléssel.

A három ismétlés páratlan szám, tehát mindig van többségi eredmény: ha háromból kettőben említenek, az a sorban „igen”. Az egyszeri futás félrevezet, az ötszörös már túl sok kézi munka. Az ismétléseket egymás után futtasd, de mindegyiket új, üres beszélgetésben.

A fix nap és napszak nem azért kell, mert a délelőtti válasz jobb, hanem mert így egy változóval kevesebb marad. Szakmai feltételezés: a napszak hatása kicsi, viszont a modellfrissítések és a szolgáltatói terhelés napon belül is hozhat eltérést, és a fix időpont ennek a kockázatnak az ingyenes kivédése. Ha a mérés több motorra megy, ugyanazon a délelőttön fusson mind, ne szórd szét napokra.

A naptárba tedd be ismétlődő eseményként, felelőssel. Ha a felelős szabadságon van, a mérés akkor is a megadott napon fusson, mert egy elcsúsztatott hónap után már nem tudod, mit hasonlítasz mihez.

Hogyan rögzítsd a nyers választ, hogy fél év múlva is bizonyíték legyen?

Rövid válasz: minden egyes lekérdezésről ments teljes szöveget és képernyőképet, fix fájlnév-konvencióval.

A képernyőkép azt bizonyítja, hogy tényleg így nézett ki. A szöveges mentés viszont kereshető és összehasonlítható, tehát a kettő együtt kell. Használj ilyen szerkezetet:

meres/2026-09/chatgpt/2026-09-02_chatgpt_p07_r2.txt

Ahol a p07 a prompt azonosítója, az r2 a második ismétlés. A szöveges fájl elejére kerüljön egy fejléc, hogy a fájl önmagában is értelmezhető legyen:

#datum: 2026-09-02 09:14 | motor: ChatGPT, webes kereses: be | munkamenet: vendeg, HU nyelv, HU IP | prompt_id: p07 | ismetles: 2/3

A válasz alá másold be a hivatkozott forrásokat is, teljes URL-lel. Ez az archívum később többet ér, mint maga a riport: ha egy konkurens megjelenik az ajánlott nevek között, vissza tudod nézni, melyik oldala került be és mikor. Saját tapasztalat: a képernyőkép nélküli mérés fél év múlva vitathatatlanná válik a rossz irányba, mert senki nem emlékszik, pontosan mi hangzott el.

Hogyan nézzen ki a rögzítő táblázat?

Rövid válasz: egy sor egy lekérdezés, hét oszloppal, és semmivel sem többel.

A fejléc:

datum;motor;prompt_id;prompt;emlitve;helyezes;url;megjegyzes

Az oszlopok jelentése:

Két minta sor:

2026-09-02;ChatGPT (web be);p07;Ki javit ipari kaput Fejer megyeben?;igen;3;pelda.hu/ipari-kapu-szerviz;3/3 emlites

2026-09-02;Perplexity;p12;Mennyibe kerul egy ipari kapu felulvizsgalat?;nem;;;forras: ket aggregator oldal

A havi összesítő ebből két számot húz ki: az említési arányt (hány promptnál igen) és az átlagos helyezést azoknál, ahol volt felsorolás. Több mutatóra nincs szükség.

Mikor valódi elmozdulás egy változás, és mikor csak szórás?

Rövid válasz: akkor beszélj elmozdulásról, ha a változás két egymást követő hónapban, azonos irányban, legalább három különböző promptnál jelentkezik.

A gyakorlati küszöbök, amiket használni szoktam:

  1. Egy prompt egy hónapban: zaj. Ne írd bele a riportba magyarázatként.
  2. Az említési arány mozgása egy prompt értékén belül (20 promptnál 5 százalékpont): zaj.
  3. Egy-két helynyi pozíciómozgás a felsorolásban: zaj. Az számít, hogy bekerültél-e a listába vagy kiestél belőle.
  4. Három vagy több promptnál azonos irányú változás két hónapon át: valódi elmozdulás, érdemes okot keresni.
  5. Bejelentett modellfrissítés a két mérés között: a hónap megjelölve, az összevetés fenntartással kezelendő.

Fontos a fogalmazás is. Ha a mérés javulást mutat a tartalmi munka után, az együttjárás, nem bizonyított ok-okozat: a tartalmi fejlesztés segítheti a megjelenést, és jó eséllyel hozzájárult, de a modell oldali változásokat nem látod. A riportban ezt írd is le, mert a túlígért oksági magyarázat az első, ami fél év múlva visszaüt.

Miért ne cseréld a promptokat, ha rossz az eredmény?

Rövid válasz: mert a promptcserével a mérés eredményét javítod, nem a láthatóságodat, és a korábbi hónapokat is elveszíted.

Ez a protokoll lelke. A promptkészlet verziószámot kap (v1.0), és a verzió legalább két negyedévig él. Ha bővíteni akarsz (új szolgáltatás indul, új város), akkor a régi promptok maradnak, az újak hozzájönnek, és a trendmutatót továbbra is csak a régi magra számolod. Törölni csak akkor törölsz promptot, ha a kérdés tárgya megszűnt.

Vezess változásnaplót a protokoll mellé, dátummal: mikor mit módosítottál és miért. Ha mégis módszertant váltasz, egy hónapig fusd párhuzamosan a régit és az újat, hogy legyen átváltási pontod. Saját tapasztalat: az a csapat, amelyik a rossz hónap után átírja a kérdéseket, három hónap múlva nem tudja megmondani, javult-e bármi. Az, amelyik szenved a fagyasztott készlettel, fél év alatt kap egy grafikont, amire lehet döntést építeni.

Milyen ellenőrzőlistával fusson a havi kör?

  1. Naptári nap és időpont megvan, a felelős elérhető.
  2. Privát ablak nyitva, vendég munkamenet, nyelv és ország ellenőrizve.
  3. A promptkészlet a fagyasztott fájlból jön, nem fejből.
  4. Minden prompt új beszélgetésben, ismétlésenként is.
  5. Három ismétlés motoronként, promptonként.
  6. Szöveges mentés és képernyőkép minden futásról, fejléccel.
  7. A táblázat kitöltve, a többségi eredménnyel.
  8. Az összesítő két mutatója kiszámolva, az előző hónappal egy sorban.
  9. A változásokra a fenti küszöbszabály alkalmazva, mielőtt bármit magyarázol.
  10. A protokoll változásnaplója frissítve, ha történt módosítás.

A teljes kör három motorra, 20 prompttal, három ismétléssel nagyjából egy délelőtt kézzel. Ez az ára annak, hogy legyen egy idősorod, ami nem magadnak szóló önigazolás.

Források és további olvasnivalók

Amit érdemes megjegyezni
  • 20-30 fix prompt motoronként, 70-80 százalékban márka nélküli kérdés: ez az alap, amit nem cserélgetsz.
  • Vendég munkamenet, friss beszélgetés promptonként, rögzített nyelv és hely: a személyre szabás a mérés legnagyobb torzítója.
  • Promptonként 3 ismétlés, és a háromból a többségi eredmény kerül a táblázatba.
  • Minden választ ments el teljes szövegként és képernyőképként, fix fájlnév-konvencióval.
  • Valódi elmozdulásnak csak azt vedd, ami két egymást követő hónapban, legalább három promptnál, azonos irányban jelentkezik.

Gyakori kérdések

Elég havonta egyszer mérni az AI-láthatóságot?

A legtöbb cégnél igen. A válaszmotorok napi szinten zajosak, ezért a heti mérés főleg szórást mutat, nem trendet. Havi fix körrel fél év alatt összeáll egy értelmezhető idősor. Ha nagy tartalmi kampány fut, kiegészítheted egy köztes méréssel, de azt jelöld külön, és ne keverd a havi trendbe.

Mit csináljak, ha a motor közben modellverziót vált?

Jelöld a mérés megjegyzés oszlopában és a változásnaplóban, majd az adott hónapot fenntartással kezeld. A promptkészleten ilyenkor sem változtatsz. Két-három hónap után látszani fog, hogy a váltás tartós szintváltozást hozott-e, vagy csak egyszeri kilengés volt.

Hány motorra érdemes mérni?

Kettő vagy három bőven elég a kezdéshez: egy nagy asszisztens, egy keresés-alapú válaszmotor, és ha releváns a közönségednek, a keresőbe épített AI-válasz. Több motor több munkát jelent, a döntéseidet viszont ritkán változtatja meg. Inkább a promptszámot növeld, mint a motorok számát.

Kell VPN a méréshez?

Csak akkor, ha a célpiacod nem az, ahol ülsz. A lényeg, hogy a hely és a nyelv minden hónapban ugyanaz legyen, és ez a protokollban le legyen írva. Ha egyszer VPN-nel mértél, akkor mindig úgy mérj, különben a földrajzi eltérést fogod tartalmi változásnak nézni.

Automatizálható a havi választeszt?

Részben. API-n keresztül a lekérdezés és a mentés gépesíthető, viszont az API-s válasz nem feltétlenül azonos azzal, amit a felhasználó a webes felületen lát, mert ott más a keresési és személyre szabási réteg. Gyakorlati megoldás: az API-s futás adja a napi-heti jelzést, a hivatalos havi riport pedig a kézi, felületen végzett mérésből készüljön.

Mekkora javulás számít jó eredménynek?

Számszerű ígéretet nem érdemes tenni, mert a megjelenés sok tényezőtől függ, amit nem te irányítasz. Reális célkitűzés, hogy a márka nélküli kérdéseknél az említési arány két negyedév alatt tartósan emelkedjen, és hogy a hivatkozott URL-ek között egyre inkább a saját, célzottan erre írt oldalaid szerepeljenek.

Források és további olvasnivalók

Ezen az oldalon a hivatalosan igazolt információt elsődleges forrásokból építjük fel; a saját tapasztalatot és a szakmai becslést mindig külön jelöljük a szövegben.

A cikk szerzője

Schmidt Péter, online marketing szakértő, a Scheo Tanácsadó Kft. alapítója. Székesfehérvárról, országosan dolgozó csapattal végzünk keresőoptimalizálást, AI-láthatóság mérést, Google és Meta hirdetéskezelést, weboldalkészítést. Amit itt leírunk, azt ügyfélmunkában is használjuk. Rólunk bővebben · Szolgáltatásaink

Kapcsolódó olvasnivaló

Kapcsolódó

Ai láthatóság mérés: hogyan kövessem nyomon, hogy a tartalmam szerepel-e ai javaslatokban?: amit tudnod kell róla

Kapcsolódó

AI-láthatósági mérőrendszer: kérdéslista, pontozás és dokumentálás

Kapcsolódó

Ajánláskérő promptkészlet magyar szolgáltatásokra

Helyi szolgáltatás a környékeden

Országosan dolgozunk, online és személyesen. Válaszd ki a városodat, és nézd meg, hogyan segítünk helyben:

Online marketing & AI SEO ZalaegerszegOnline marketing & AI SEO SzekszárdOnline marketing & AI SEO SalgótarjánOnline marketing & AI SEO SzékesfehérvárOnline marketing & AI SEO BudapestOnline marketing & AI SEO Veszprém

Weboldalkészítés városra bontva

Ha először a honlap kell, itt városonként arról írtunk:

Weboldalkészítés GyőrWeboldalkészítés DebrecenWeboldalkészítés SzegedWeboldalkészítés MiskolcWeboldalkészítés PécsWeboldalkészítés Kecskemét

Mind a 20 városunk és az összes szolgáltatás →

15 perces AI-láthatósági gyorselemzés - díjmentesen

Megnézzük három, számodra fontos keresőkérdésnél, hogy megjelenik-e a céged a ChatGPT, a Gemini és a Google AI-válaszaiban, mely versenytársakat ajánlják helyetted, és melyik három területen érdemes először javítani. A weboldaladat előzetesen átnézzük, tehát nem sablonos, automata riportot kapsz.

Adataidat kizárólag a kapcsolatfelvételhez használjuk. Kapcsolat: m@rketinges.hu
💬 Konzultáció