Sok többnyelvű oldalon a fejlesztő jó szándékkal automatikus átirányítást állít be. A magyar IP-ről érkező látogató a /hu/ változatra kerül, a német böngészőnyelvű a /de/ oldalra, mindenki más az angolra. Elsőre kényelmesnek tűnik. A gond az, hogy ugyanez a szabály a keresőrobotokra és az AI-crawlerekre is lefut, ők pedig jellemzően nem Magyarországról és nem magyar böngészővel érkeznek. Ebben a cikkben végigmegyünk azon, mit lát ilyenkor a Googlebot, miért eshetnek ki nyelvi változatok az indexből, mi a biztonságosabb megoldás, és hogyan ellenőrizheted különböző helyszínekről, hogy az oldalad valóban mindenkinek elérhető-e.

A cikkben háromféle jelölést használunk. Hivatalosan igazolt, amit a Google Search Central vagy más hivatalos dokumentáció leír. Saját tapasztalat, amit oldalak auditálásakor rendszeresen látunk. Szakmai feltételezés, ami logikus következtetés, de nincs rá nyilvános, hivatalos megerősítés.
Miért kockázatos az IP- vagy böngészőnyelv alapú automatikus átirányítás?
Azért, mert ilyenkor a látogató és a robot is azt az oldalt kapja, amit a szerver kitalál róla, és nem azt, amit kért. Ha a találgatás téves, a látogató bosszankodik, a robot pedig egyes nyelvi változatokat soha nem lát.
Az automatikus átirányítás jellemzően két jelre épül. Az egyik az IP-cím alapján becsült ország (geo-IP), a másik a böngésző által küldött Accept-Language HTTP-fejléc. Mindkettő pontatlan. Egy Bécsben dolgozó magyar osztrák IP-ről, de magyar nyelvű böngészővel érkezik. Egy céges VPN mögött ülő budapesti munkatárs holland IP-t kaphat. Egy angol nyelvű operációs rendszert használó magyar felhasználó böngészője angolt kér, pedig magyarul keres. A szerver mindhármukat máshová küldi, mint ahová kattintottak.
A látogatói élménynél is nagyobb baj, hogy a kattintott URL helyett egy másik oldal töltődik be. Ha valaki egy magyar Google-találatra kattint, és az oldal angolra dobja át, jó eséllyel visszalép a találati listára. Ha egy megosztott linket nyit meg, nem azt látja, amit a küldő látott.
Hivatalosan igazolt. A Google többnyelvű és több régiós oldalakról szóló útmutatója kifejezetten azt javasolja, hogy ne irányítsd át automatikusan a felhasználót egyik nyelvi változatról a másikra, mert ez megakadályozhatja, hogy a felhasználó és a kereső is elérje az összes változatot.
Mit lát a Googlebot, ha amerikai IP-ről érkezik?
A Googlebot jellemzően amerikai IP-címekről és Accept-Language fejléc nélkül tölti le az oldalakat. Ha a szervered IP vagy nyelv alapján irányít át, a robot nagy valószínűséggel mindig az amerikai vagy az alapértelmezett (gyakran angol) változatra kerül, a magyar oldalt pedig nem látja.
Hivatalosan igazolt. A Google helyfüggő (locale-adaptive) oldalakról szóló dokumentációja leírja, hogy a Googlebot alapértelmezésben az Egyesült Államokból származó IP-címekről crawlol, és a kéréseiben nem küld Accept-Language fejlécet. Ugyanez a dokumentum megemlíti, hogy a Google bizonyos esetekben más országokból is crawlolhat. Erre azonban nem érdemes építeni, mert nem tudod, mikor és mely oldalakra történik meg. A Google ezért minden nyelvi változatnak külön URL-t ajánl, hreflang jelöléssel.
Nézzük meg egy konkrét helyzeten. Az oldaladon három változat van, /hu/, /de/ és /en/. A szerver szabálya a következő.
- Magyar IP esetén a
/hu/oldal jön. - Német vagy osztrák IP esetén a
/de/. - Minden más IP-ről a
/en/.
A Googlebot lekéri a /hu/szolgaltatasok/ címet. A szerver amerikai IP-t lát, ezért 302-es átirányítással a /en/services/ címre küldi. A robot szemszögéből a magyar URL így nem tartalom, csak egy átirányítás. Ugyanez történik a német oldalakkal. Az indexbe jó eséllyel csak az angol változat kerül be, a magyar és a német URL-ek pedig a Search Console-ban a Page with redirect (átirányítást tartalmazó oldal) állapotban ragadnak.
Ha a szabály csak a böngészőnyelvet figyeli, a helyzet hasonló. Fejléc hiányában a szerver az alapértelmezett ágra fut, ami szinte mindig az angol vagy a fő nyelv.
Miért maradhatnak ki nyelvi változatok az indexből?
Azért, mert amit a robot nem tud letölteni, azt nem tudja indexelni, és a hreflang kapcsolatokat sem tudja ellenőrizni. Az átirányított változat a robot számára gyakorlatilag nem létezik.
A problémának több rétege van.
- A tartalom nem töltődik le. Ha a
/hu/URL-re érkező minden robotkérés átirányítással végződik, a magyar szöveg nem kerül a Google elé, így rangsorolni sem tudja. - A hreflang-klaszter megsérül. A
hreflangakkor működik, ha a változatok kölcsönösen hivatkoznak egymásra, és mindegyik elérhető. Hivatalosan igazolt, hogy visszahivatkozás hiányában a Google figyelmen kívül hagyhatja a jelölést. Ha a robot a magyar oldal helyett az angolt kapja, a magyar oldal visszahivatkozását sem látja. - Kanonikus zavar. Ha a szerver átirányítás helyett ugyanazon az URL-en szolgál ki más nyelvű tartalmat (dinamikus kiszolgálás), a Google egy URL-hez csak egyféle tartalmat társít, jellemzően azt, amit amerikai IP-ről lát.
- AI-crawlerek. Szakmai feltételezés, hogy a nagy AI-szolgáltatók robotjai (például az OpenAI GPTBot vagy OAI-SearchBot nevű crawlere) hasonlóan járnak. Az OpenAI nyilvánosan közzéteszi a robotjai IP-tartományait, és ezek jellemzően amerikai adatközpontokhoz tartoznak. Ha a magyar tartalmad csak magyar IP-ről érhető el, az AI-válaszmotorok jó eséllyel az angol változatot idézik, vagy egyiket sem.
Saját tapasztalat. Többnyelvű oldalak auditálásakor visszatérő minta, hogy a tulajdonos csak a saját nyelvi változatát nézi meg, a saját gépéről. Ott minden rendben van, ezért senki nem veszi észre, hogy a másik két nyelv hónapok óta szinte semmi organikus forgalmat nem kap.
Mi a különbség a 301-es, a 302-es átirányítás és a dinamikus kiszolgálás között?
Mindhárom kockázatos, ha a döntés IP vagy nyelv alapján születik, csak másképp. A 301 a Google szemében tartós áthelyezés, a 302 ideiglenes, a dinamikus kiszolgálás pedig egyetlen URL-en ad többféle tartalmat.
- 301-es átirányítás. Azt üzeni, hogy a magyar URL véglegesen az angolra költözött. Ez a legrosszabb eset, mert a jelek az angol URL-re kerülhetnek át.
- 302-es átirányítás. Ideiglenes, a forrás-URL elvben megmaradhat, de ha a robot soha nem kap tőle tartalmat, a magyar oldal értékelhető formában nem jut be az indexbe.
- Dinamikus kiszolgálás. Ha mégis ezt választod, a válaszban jelezd a
Vary: Accept-Languagefejléccel, hogy a tartalom a nyelvtől függ. Így a CDN és a gyorsítótár sem keveri össze a változatokat. Indexelési szempontból ez is gyengébb a külön URL-eknél.
Egy elfogadott kivétel van. Hivatalosan igazolt, hogy a gyökér-URL (például example.hu/) lehet nyelvválasztó vagy átirányító kezdőoldal, ha x-default értékű hreflang jelölést kap. A feltétel az, hogy a nyelvi aloldalak maguk már ne irányítsanak tovább senkit.
Mi a biztonságosabb alternatíva az automatikus átirányítás helyett?
Minden nyelvi változatnak legyen saját, mindenhonnan elérhető URL-je, ezeket kösd össze hreflang jelöléssel, a látogatónak pedig javasló sávval és jól látható nyelvválasztóval ajánlj fel nyelvet, kényszerítés nélkül.
1. Külön URL minden változatnak
A legegyszerűbb szerkezet az alkönyvtár (/hu/, /de/, /en/), de az aldomain vagy az országos domain is működik. A lényeg, hogy egy URL mindig ugyanazt a nyelvi tartalmat adja, bárhonnan kérik le.
2. Kölcsönös hreflang jelölés
Minden változat head részében szerepeljen az összes változat, önmagát is beleértve, és egy x-default sor a nyelvválasztóra vagy az alapértelmezett oldalra. Egy magyar szolgáltatásoldal fejlécében ez így néz ki.
<link rel='alternate' hreflang='hu' href='https://example.hu/hu/szolgaltatasok/'><link rel='alternate' hreflang='de' href='https://example.hu/de/leistungen/'><link rel='alternate' hreflang='en' href='https://example.hu/en/services/'><link rel='alternate' hreflang='x-default' href='https://example.hu/'>
Ugyanezt a négy sort kell elhelyezni a német és az angol oldalon is. Ha egy változat kimarad a listából, vagy valamelyik URL átirányít, a klaszter megsérül. A jelölés XML oldaltérképbe is kerülhet, ami nagy oldalaknál könnyebben karbantartható.
3. Javasló sáv az oldal tetején
A javasló sáv egy vékony, bezárható értesítés az oldal tetején. Ha a böngészőnyelv vagy az IP alapján úgy tűnik, hogy a látogató más nyelvet szeretne, a sáv felajánlja, például így. „Úgy látjuk, németül olvasnál. Átváltasz a német oldalra?” Két gomb kell rá, az egyik átvisz, a másik bezárja a sávot. A döntést sütiben vagy localStorage-ban tárold, hogy a sáv ne jelenjen meg minden oldalon újra.
Technikailag az a fontos, hogy a sávot kliensoldalon, JavaScripttel jelenítsd meg, és ne cseréld le vele az oldal tartalmát. A robot így a teljes, eredeti nyelvű oldalt látja. Arra is figyelj, hogy a sáv mobilon ne takarja el a tartalmat, mert a tolakodó felugrók rontják a felhasználói élményt.
4. Mindig látható nyelvválasztó
A fejlécben vagy a láblécben legyen állandó nyelvválasztó, ami az aktuális aloldal másik nyelvű párjára visz, és nem a kezdőlapra. A nyelveket a saját nyelvükön írd ki (Magyar, Deutsch, English). Zászlókat inkább ne használj, mert a zászló országot jelöl, nem nyelvet, és egy osztrák vagy svájci látogató nem feltétlenül a német zászlót keresi.
Hogyan ellenőrizd különböző helyszínekről, mit kap a látogató és a robot?
Kérd le ugyanazt az URL-t több országból, több böngészőnyelvvel és robotként is, majd vesd össze a válaszokat. Ha bármelyik kombináció más URL-re dob, vagy más nyelvű tartalmat ad, ott javítani kell.
1. Lekérés parancssorból
A curl parancs megmutatja az átirányítást a teljes tartalom letöltése nélkül.
curl -sI https://example.hu/hu/szolgaltatasok/(nyelvi fejléc nélkül, ahogy a Googlebot kér)curl -sI -H 'Accept-Language: en-US' https://example.hu/hu/szolgaltatasok/curl -sI -A 'Mozilla/5.0 (compatible; Googlebot/2.1; +http://www.google.com/bot.html)' https://example.hu/hu/szolgaltatasok/
Akkor jó az eredmény, ha mindhárom 200 státuszt ad, és nincs Location sor a válaszban. Ha 301 vagy 302 jön, nézd meg, hová mutat. A user-agent átírása nem azonos egy valódi Googlebot-kéréssel, és a saját géped IP-je sem amerikai, ezért ez csak első szűrő.
2. Search Console URL-vizsgálat élő teszttel
Ez a legmegbízhatóbb módszer, mert a Google a saját infrastruktúrájáról kéri le az oldalt. Az URL-vizsgálat eszközben indítsd el az élő tesztet a magyar és a német URL-re is, és nézd meg a letöltött HTML-t és a képernyőképet. Ha angol szöveget látsz a magyar URL-en, vagy az eszköz átirányítást jelez, megtaláltad a hibát. Az Oldalak jelentésben a Page with redirect és a Duplicate, Google chose different canonical than user sorokat is érdemes nyelvenként átnézni.
3. VPN vagy proxy több országból
Kapcsolódj magyar, német, amerikai és még legalább egy, a célpiacaidon kívüli ország szerveréhez, és nyisd meg ugyanazt a három URL-t privát ablakban. Minden helyszínről azt kell kapnod, amire kattintottál. A javasló sáv megjelenhet, átirányítás nem történhet.
4. Böngészőnyelv átállítása
A böngésző beállításaiban tegyél az első helyre egy másik nyelvet, és ismételd meg a próbát. Így külön tudod választani, hogy az IP vagy a nyelvi fejléc okozza-e az átirányítást.
5. Szervernapló
A naplóban szűrj a Googlebot kéréseire, fordított DNS-lekérdezéssel ellenőrizd, hogy valóban a Google-tól jöttek, és nézd meg, milyen státuszkódot kapott a /hu/ és a /de/ útvonal. Ha a magyar URL-ekre túlnyomórészt 3xx válasz megy, a robot nem látja a tartalmat.
Milyen ellenőrzőlistát érdemes végigvinni?
Az alábbi lista segít eldönteni, rendben van-e a többnyelvű oldalad. Ahol egy pont nem teljesül, ott kezdd a javítást.
- Minden nyelvi változatnak saját URL-je van.
- A nyelvi aloldalak semmilyen IP- vagy nyelvi feltétel alapján nem irányítanak tovább.
- Ha a gyökér-URL átirányít vagy nyelvválasztóként működik,
x-defaultjelölést kapott. - A
hreflangkölcsönös, önhivatkozást is tartalmaz, és csak 200-as státuszú, indexelhető URL-ekre mutat. - Minden változat kanonikus címe önmagára mutat, nem egy másik nyelvre.
- A nyelvválasztó az aktuális oldal párjára visz.
- A javasló sáv kliensoldali, bezárható, és megjegyzi a választást.
- Dinamikus kiszolgálás esetén a válasz
Varyfejlécet tartalmaz. - A Search Console élő tesztje minden nyelvi URL-en a saját nyelvű tartalmat mutatja.
- A VPN-es próba legalább négy országból ugyanazt az eredményt adja.
- A CDN vagy a gyorsítótár nem tárol országfüggő átirányítást.
Mikor lehet mégis indokolt az ország szerinti korlátozás?
Akkor, ha jogi vagy üzleti ok miatt egy tartalom bizonyos országokban nem jelenhet meg, például licencelt tartalomnál vagy olyan terméknél, amelynek forgalmazását helyi szabály korlátozza. Ilyenkor se irányíts át csendben, inkább jelezd a látogatónak, miért nem érheti el az oldalt.
Hivatalosan igazolt. A Google azt kéri, hogy a Googlebotot úgy kezeld, mint egy amerikai felhasználót. Ha az amerikai látogatók elől elzársz egy tartalmat, a Googlebot elől is el lesz zárva, és ezt a Google nem tekinti álcázásnak. Ha viszont a robot mást kap, mint az ugyanonnan érkező látogató, az már cloaking, és irányelv-sértésnek számít.
Szakmai feltételezés. Ha a magyar tartalom csak Magyarországról érhető el, az indexelése bizonytalan marad. Ilyenkor érdemes megfontolni, hogy a korlátozott rész mellett legyen egy mindenhonnan elérhető, általános leíró oldal is.
Mit érdemes most rögtön megnézni a saját oldaladon?
Ha többnyelvű az oldalad, három gyors lépéssel kiderül, érint-e a probléma. Kérd le parancssorból a magyar és egy idegen nyelvű aloldalt nyelvi fejléc nélkül. Futtasd le a Search Console élő tesztjét ugyanerre a két URL-re. Végül nézd meg az Oldalak jelentésben, hány nyelvi URL áll átirányított állapotban. Ha bárhol eltérést találsz, a javítás jellemzően a szerver vagy a fordítóbővítmény beállításaiban van, mert sok WordPress-es fordítóbővítménynek van automatikus átirányítás kapcsolója. Utána a javasló sáv és a nyelvválasztó veszi át a feladatot. A javítás nem hoz azonnali helyezést, de jó eséllyel visszaadja a robotnak a lehetőséget, hogy minden nyelvi változatot lásson és indexeljen.
Források és további olvasnivalók
- Google Search Central, Többnyelvű és több régiós webhelyek kezelése
- Google Search Central, A lap honosított változatainak jelzése a Google számára (hreflang)
- Google Search Central, Helyfüggő (locale-adaptive) oldalak feltérképezése
- Google Search Central, A Googlebot és más Google-robotok ellenőrzése
- Google Search Console súgó, URL-vizsgálat eszköz
- OpenAI dokumentáció, Overview of OpenAI Crawlers
- W3C Internationalization, Language tags in HTML and XML
- IETF RFC 9110, HTTP Semantics (Accept-Language és Vary fejléc)
- A Googlebot alapértelmezésben amerikai IP-címekről crawlol, és nem küld Accept-Language fejlécet, ezért az IP- vagy nyelvalapú átirányítás az alapértelmezett változatra viszi.
- Az átirányított nyelvi URL tartalmát a robot nem tölti le, így az nem indexelhető, és a hreflang-klaszter is megsérülhet.
- Egy URL mindig ugyanazt a nyelvi tartalmat adja, a nyelvi ajánlást pedig egy bezárható javasló sáv és egy állandó nyelvválasztó végezze, ne kényszerített átirányítás.
- A gyökér-URL lehet nyelvválasztó vagy átirányító kezdőoldal, ha x-default jelölést kap, a nyelvi aloldalak viszont ne irányítsanak tovább senkit.
- Ellenőrizd parancssorból, a Search Console élő tesztjével, több országból VPN-nel és a szervernaplóból is, hogy minden kombináció a kért URL-t adja-e.
Gyakori kérdések
Honnan crawlol a Googlebot, és küld-e nyelvi fejlécet?
A Google dokumentációja szerint a Googlebot alapértelmezésben amerikai IP-címekről crawlol, és nem küld Accept-Language fejlécet. Ezért az IP- vagy nyelvalapú átirányítás jellemzően az alapértelmezett, gyakran angol változatra viszi.
Szabad-e átirányítani a kezdőoldalt a látogató nyelve szerint?
A gyökér-URL lehet nyelvválasztó vagy átirányító kezdőoldal, ha x-default értékű hreflang jelölést kap. A nyelvi aloldalak viszont ne irányítsanak tovább senkit, mert különben a robot nem éri el őket.
Mi a javasló sáv, és miért jobb az átirányításnál?
A javasló sáv egy bezárható értesítés az oldal tetején, ami felajánlja a látogatónak a valószínűleg kedvelt nyelvet. A döntés a látogatónál marad, az URL tartalma nem változik, így a robot is a teljes, eredeti nyelvű oldalt látja.
Hogyan ellenőrizhetem, mit lát a Google a magyar oldalamon?
A Search Console URL-vizsgálat eszközének élő tesztjével, ami a Google saját infrastruktúrájáról kéri le az oldalt. Ha a magyar URL-en angol szöveget vagy átirányítást látsz, a robot nem éri el a magyar tartalmat.
Elég, ha a hreflang jelölés rendben van, de az átirányítás marad?
Nem elég. A hreflang csak akkor működik, ha minden változat elérhető és kölcsönösen hivatkozik a többire. Ha egy nyelvi URL a robotot átirányítja, a jelölést a Google figyelmen kívül hagyhatja.
Az AI-crawlereket is érinti az IP-alapú átirányítás?
Szakmai feltételezés, hogy igen. Az OpenAI által közzétett crawler IP-tartományok jellemzően amerikai adatközpontokhoz tartoznak, így a csak magyar IP-ről elérhető tartalmat az AI-válaszmotorok jó eséllyel nem látják.
Források és további olvasnivalók
Ezen az oldalon a hivatalosan igazolt információt elsődleges forrásokból építjük fel; a saját tapasztalatot és a szakmai becslést mindig külön jelöljük a szövegben.