Megírsz egy alapos szakcikket, kiteszed a saját oldaladra, aztán egy szakmai portál és egy hírgyűjtő is átveszi. Néhány hét múlva rákérdezel a témára egy AI-keresőben, és a válasz alatt a portál linkje áll. A tartalom a tiéd, a hivatkozás és a látogató viszont máshová megy. Ez a cikk arról szól, miért történik ez, mi befolyásolható belőle, és hogyan követed nyomon, melyik példány nyer.

A szövegben három címkét használok. Hivatalosan igazolt az, ami a keresőmotorok vagy AI-szolgáltatók nyilvános dokumentációjában szerepel. Saját tapasztalat az, amit ügyféloldalakon és saját teszteken rendszeresen látunk. Szakmai feltételezés az, ami logikusan következik a működésből, de nyilvános megerősítése nincs.
Miért nem mindig az eredeti cikket idézi az AI?
Az AI-kereső ugyanazt a szöveget több URL-en látva jellemzően egyetlen példányt választ ki, és ezt a keresőindex kanonikus döntése, a domain ereje és a hozzáférhetőség alapján teszi. Hogy ki írta először, azt a rendszer csak közvetett jelekből tudja kikövetkeztetni.
Hivatalosan igazolt. A Google Search Central dokumentációja szerint a duplikált oldalak közül a Google kiválaszt egy kanonikus változatot, és a többit ritkábban mutatja. A szindikált tartalomról külön kimondja, hogy a keresőben az a változat jelenhet meg, amelyet a rendszer az adott felhasználónak megfelelőbbnek ítél, és ez nem feltétlenül az eredeti.
Szakmai feltételezés. A Google AI-áttekintései a szokásos keresőindexre épülnek, így a kanonikus döntés jó eséllyel öröklődik az AI-válaszba is. A ChatGPT keresője az OpenAI leírása szerint saját feltérképezőt és külső keresési partnereket használ, a Perplexity saját indexet épít. Mindegyiknél ugyanaz a kérdés merül fel, csak más adatokból dől el.
Milyen jelek alapján dönt a motor a példányok között?
A döntést több jel együtt alakítja, és egyik sem abszolút. A legfontosabbak ezek.
- Kanonikus jelek. A
rel=canonicalcímke, az átirányítások, a belső linkek és a sitemap. Ezek a Google dokumentációja szerint jelzések, a rendszer felülbírálhatja őket. - Robots-szabályok. Ha a partner oldala
noindexjelölést kap, az a példány kiesik a keresőindexből. - Hozzáférhetőség az AI-feltérképezőnek. Ha a saját
robots.txtfájlod tiltja például azOAI-SearchBotvagy aPerplexityBotfeltérképezőt, a partnerét viszont nem, akkor az adott motor szemében csak a partner példánya létezik. - A domain ereje és a hivatkozások. Egy nagy szakmai portál vagy hírgyűjtő sokszor több bejövő linkkel és gyakoribb feltérképezéssel rendelkezik, mint egy cégoldal.
- Az indexelés sorrendje. Amelyik példányt előbb találja meg és dolgozza fel a rendszer, annak előnye lehet, bár ez önmagában nem döntő.
- Illeszkedés a kérdéshez. Ha a két példány bevezetője, címe vagy kiegészítése eltér, az egyik jobban illeszkedhet egy adott kérdéshez.
Saját tapasztalat. A leggyakoribb vesztes helyzet az, amikor a hírgyűjtő órákon belül indexelődik, a cégoldal cikke pedig napokig várakozik. A második leggyakoribb egy régi, elfelejtett robots.txt szabály, amely az AI-feltérképezőket kizárja a saját oldalról.
Mit érdemes a megjelenési sorrenddel kezdeni?
Az eredeti cikk jelenjen meg és indexelődjön először, a partner pedig néhány nap késleltetéssel vegye át. Ez nem dönti el egyedül a versenyt, de megszünteti a leggyakoribb hátrányt.
- Tedd ki a cikket a saját oldaladra, és ellenőrizd, hogy a sitemapben szerepel frissített
lastmoddátummal. - A Search Console URL-ellenőrzés eszközében kérj indexelést.
- A Bing és több más motor felé küldd be az URL-t IndexNow protokollon keresztül, ha a rendszered támogatja. Hivatalosan igazolt, hogy a Bing az IndexNow-t fogadja.
- Várd meg, amíg a Search Console az oldalt indexeltként mutatja, és csak utána add át a szöveget a partnernek.
Saját tapasztalat. Három-hét nap késleltetést a legtöbb partner elfogad, főleg ha előre egyeztetitek. Hírértékű anyagnál ez nehezebb, ott a canonical és a forrásmegjelölés számít többet.
Canonicalt vagy noindexet kérj a partnertől?
Ha a partner elfogadja, a noindex a biztosabb megoldás, ha nem, a domainek közötti canonical és egy követhető forráslink a tartalék.
Hivatalosan igazolt. A Google 2023-ban frissítette a szindikációra vonatkozó ajánlását. Eszerint aki el akarja kerülni, hogy a partner példánya megjelenjen a keresőben, kérje meg a partnert, hogy noindex jelöléssel zárja ki az oldalt. A domainek közötti canonicalt ebben a helyzetben már nem ajánlja elsődleges megoldásnak, mert a szindikált oldalak gyakran erősen eltérnek az eredetitől, és a jelzést a rendszer figyelmen kívül hagyhatja. A Bing irányelvei továbbra is a forrásra mutató linket és a canonicalt említik.
A partner oldalán a két változat így néz ki.
<meta name="robots" content="noindex">
<link rel="canonical" href="https://sajatoldal.hu/eredeti-cikk">
Ha a partner Article típusú strukturált adatot használ, abban az isBasedOn tulajdonság is mutathat az eredeti URL-re. Szakmai feltételezés, hogy ez a döntésben csak kis súlyú jel, de a tartalom eredetét gépileg olvasható formában rögzíti, és semmibe nem kerül.
Saját tapasztalat. A nagyobb portálok ritkán fogadják el a noindexet, mert a saját forgalmukat féltik. A canonicalra és a cikk elején elhelyezett, követhető forráslinkre sokkal nyitottabbak.
Mennyire legyen más a partnernél megjelenő változat?
A partner kapjon önállóan is értékes, de rövidebb változatot, a teljes anyag a saját oldaladon maradjon. Így a két példány már nem ugyanaz a dokumentum, és a teljes válasz csak nálad érhető el.
Eltérő bevezető és cím
Írj a partnernek külön bevezetőt, amely az ő olvasóközönségéhez szól, és adj más címet. Ez segíti, hogy a két példány eltérő kérdésekre illeszkedjen, és kisebb eséllyel mossa össze őket a rendszer.
Többlet a saját oldalon
- Saját adat. Egy mérés, felmérés vagy összesítő táblázat, amely csak nálad szerepel.
- Ábra vagy folyamatrajz magyarázó szöveggel, hogy a tartalma szövegként is kiolvasható legyen.
- Letölthető anyag, például ellenőrzőlista vagy sablon.
- Módszertani rész, amely leírja, hogyan jutottál az eredményhez.
- Frissítési dátum és valóban frissített tartalom.
Szakmai feltételezés. Az AI-válaszok olyan forrást keresnek, amely egy konkrét állítást alátámaszt. Ha egy szám vagy egy lépéssor kizárólag a te oldaladon szerepel, arra az állításra jó eséllyel te leszel az egyetlen idézhető forrás, függetlenül attól, hogy a cikk többi részénél ki nyer.
Saját tapasztalat. A legjobb kompromisszum a teljes szöveg nagyjából fele-harmada a partnernél, a végén egyértelmű hivatkozással arra, hogy a teljes anyag az adatokkal és a letölthető listával a saját oldalon érhető el.
Mit kérj a partnertől a megjelenés feltételeként?
A feltételeket a megjelenés előtt, írásban rögzítsd, mert utólag nehéz őket kiharcolni. Ezt a listát viheted a tárgyalásra, fontossági sorrendben.
- Noindex a szindikált oldalon, vagy ha ez nem megy, domainek közötti canonical az eredeti URL-re.
- Forrásmegjelölés a cikk elején, szerzői névvel és követhető (nem
nofollow) linkkel az eredeti cikkre. - Késleltetett megjelenés, legalább addig, amíg az eredeti indexelődik.
- Eltérő cím és bevezető, amelyet te adsz át, vagy a partner ír és te jóváhagysz.
- Rövidített terjedelem, a saját adatok, ábrák és letölthető anyagok nélkül vagy azokra mutató linkkel.
- Strukturált adat a partner oldalán,
isBasedOnvagy azonos szerzői adat hivatkozással. - Az AI-feltérképezők kezelése. Ha a partner nem vállal noindexet, kérdezd meg, milyen
robots.txtszabályai vannak. Ezt ritkán módosítják miattad, de legalább tudod, mire számíts. - Frissítési szabály. Ha az eredetit javítod, a partner is frissítse, vagy jelezze, hogy régebbi változatot közöl.
- Utólagos módosítás joga. Rögzítsétek, hogy ha a megállapodás technikai része nem teljesül, a partner pótolja.
Hírgyűjtőknél, amelyek automatikusan veszik át az RSS-csatornát, a tárgyalás helyett a saját csatornádon tudsz változtatni. Az RSS-ben elég lehet csak kivonatot és forráslinket közölni a teljes szöveg helyett.
Hogyan ellenőrzöd utólag, melyik példány kap hivatkozást?
Rögzített kérdéskészlettel, több AI-motorban, havi rendszerességgel nézd meg, melyik URL szerepel a válasz forrásai között, és vesd össze a forgalmi adatokkal.
- Kérdéskészlet összeállítása. Írj 10-20 olyan kérdést, amelyre a cikk válaszol, a vevőid szóhasználatával. Legyen köztük általános és a saját adatodra vonatkozó kérdés is.
- Futtatás több motorban. Google AI-áttekintés és AI Mode, ChatGPT keresővel, Perplexity, Copilot. Bejelentkezés nélkül vagy új munkamenetben futtasd, hogy a korábbi beszélgetések ne torzítsanak.
- Rögzítés táblázatban. Dátum, motor, kérdés, a hivatkozott URL, és hogy a te példányod, a partneré vagy egy harmadik forrás szerepelt.
- Kanonikus állapot ellenőrzése. A Search Console URL-ellenőrzés eszköze megmutatja a Google által választott kanonikus URL-t. Ha ott a partner címe áll, a Google a te oldaladat duplikátumnak tekinti.
- Szó szerinti keresés. Egy jellegzetes mondatot idézőjelek között keresve látod, mely példányok vannak az indexben.
- Hivatkozó forgalom a GA4-ben. Szűrj a chatgpt.com, perplexity.ai, copilot.microsoft.com és gemini.google.com hivatkozókra az adott oldalon.
- Szervernapló. Nézd meg, hogy az AI-feltérképezők egyáltalán lekérik-e a saját oldaladat.
Hivatalosan igazolt, hogy a Google az AI-funkciókból érkező megjelenéseket és kattintásokat a Search Console Webes keresés adataiba számolja, külön szűrő nélkül. Ezért a kézi kérdéskészlet nem pótolható teljesen a Search Console-lal.
Saját tapasztalat. Az AI-válaszok forrásai hétről hétre változnak, ezért egyetlen mérésből ne vonj le következtetést. Három egymást követő hónap adata már mutat irányt.
Mit tegyél, ha a partner példánya nyer?
Először a technikai okot keresd meg, utána a tartalmi különbséget növeld, és a saját cikket soha ne töröld.
- Ellenőrizd a saját oldalt. Indexelve van? Nem tiltja-e a
robots.txtaz AI-feltérképezőket? Nincs-e rossz canonical a saját oldaladon, például egy paraméteres változatra? - Ellenőrizd a megállapodást. Kint van-e a noindex vagy a canonical a partnernél, és követhető-e a forráslink? Ha nem, kérd a pótlását a rögzített feltételekre hivatkozva.
- Bővítsd a saját példányt. Adj hozzá új adatot, ábrát, gyakori kérdéseket, frissítsd a dátumot. Így a két példány egyre jobban eltér, és a te oldalad felel több kérdésre.
- Erősítsd a belső linkelést. A saját oldaladon több releváns cikkből mutass az eredetire.
- Szerezz külső hivatkozást az eredetire. Ha a cikkről beszélsz hírlevélben vagy közösségi médiában, mindig a saját URL-t oszd meg.
- Mérd újra négy-hat hét múlva ugyanazzal a kérdéskészlettel.
Szakmai feltételezés. Ha a partner példánya a te nevedet és forráslinkedet tartalmazza, az AI-válasz akkor is erősítheti a márkád ismertségét, még ha a kattintás nem is hozzád érkezik. Ilyenkor érdemes mérlegelni, hogy a kapcsolat a partnerrel többet ér-e, mint egy konfliktus. A cikk törlése viszont szinte mindig rossz döntés, mert azzal végleg a partner marad az egyetlen példány.
Források és további olvasnivalók
- Google Search Central, Duplikált URL-ek konszolidálása és a kanonikus URL megadása
- Google Search Central, Szindikált tartalomra vonatkozó ajánlások
- Google Search Central, AI-funkciók és a webhelyed
- Google Search Console súgó, URL-ellenőrzés eszköz
- Bing Webmaster Guidelines
- IndexNow protokoll dokumentáció
- OpenAI dokumentáció, az OpenAI feltérképezői (OAI-SearchBot, GPTBot)
- Perplexity dokumentáció, PerplexityBot
- Schema.org, Article és isBasedOn tulajdonság
- IETF RFC 9309, Robots Exclusion Protocol
- Az AI-keresők a duplikált példányok közül a keresőindex kanonikus döntésére, a domain erejére és a hozzáférhetőségre támaszkodva választanak, a szerzőség önmagában ritkán dönt.
- A Google a szindikációs partnereknél a noindexet ajánlja, a domainek közötti canonical csak jelzés, amelyet a rendszer figyelmen kívül hagyhat.
- A saját oldalon hagyott egyedi többlet (adat, ábra, letölthető anyag) jó eséllyel az eredetit teszi az egyetlen idézhető forrássá bizonyos állításokra.
- A partneri feltételeket a megjelenés előtt írásban rögzítsd, utólag sokkal nehezebb kiharcolni őket.
- Havonta ellenőrizd egy rögzített kérdéskészlettel, melyik URL kap hivatkozást, és a partner győzelmét tartalmi bővítéssel kezeld, a cikk törlése rossz lépés.
Gyakori kérdések
Elég, ha a partner a cikk végén megjelöli a forrást?
Segít, de gyenge jel. Jobb, ha a forrásmegjelölés a cikk elején áll, követhető linkkel, és mellette noindex vagy canonical is van a partner oldalán.
Miért nem működik mindig a domainek közötti canonical?
A Google dokumentációja szerint a canonical csak jelzés. Ha a két oldal tartalma érdemben eltér, vagy más jelek ellentmondanak neki, a rendszer figyelmen kívül hagyhatja.
Hátrányos, ha a partnernél rövidebb változat jelenik meg?
Nem, ez általában előnyös. A partner olvasói kapnak egy önálló anyagot, a teljes adatokkal és a letölthető részekkel viszont csak a te oldalad szolgál, ami jó eséllyel az eredeti idézését segíti.
Honnan tudom, hogy az AI-feltérképezők elérik a saját oldalamat?
Nézd meg a robots.txt szabályait az OAI-SearchBot, PerplexityBot és a Googlebot kapcsán, majd a szervernaplóban ellenőrizd, hogy ezek a feltérképezők ténylegesen lekérik-e az oldalt.
Mit tegyek, ha egy hírgyűjtő engedély nélkül veszi át a teljes cikket?
Az RSS-csatornában csak kivonatot és forráslinket közölj, és vedd fel a kapcsolatot az oldal üzemeltetőjével a forrásmegjelölés és a noindex ügyében. A saját cikket ne töröld, hanem bővítsd.
Források és további olvasnivalók
Ezen az oldalon a hivatalosan igazolt információt elsődleges forrásokból építjük fel; a saját tapasztalatot és a szakmai becslést mindig külön jelöljük a szövegben.