2026-07-29 · Uredništvo Baduno · 24 Min. vrijeme čitanja · Blog & Znanje
Crawling i auditi za višejezične web stranice: Kako otkriti pogreške na 24 tržišta
Crawling i auditi ključni su za višejezične web stranice. Saznajte kako sustavno provjeriti hreflang oznake, sitemapove i jezične signale na do 24 tržišta. Naš vodič prikazuje praktične metode za otkrivanje pogrešaka i određivanje prioriteta – od odabira alata do automatizacije.

Osnove višejezičnog crawlinga: Zašto su tehnički auditi za 24 tržišta neophodni
Operateri višejezične web stranice s 24 EU tržišta suočavaju se s izazovom pouzdanog otkrivanja tehničkih grešaka u svim jezičnim varijantama. Ručna provjera svake stranice nije učinkovita u ovom opsegu. Automatizirano indeksiranje omogućuje sustavno prolazak kroz sve URL-ove i bilježenje odstupanja po tržištu. U praksi iskusni timovi koriste alate za indeksiranje kako bi paralelno analizirali hreflang atribute, sitemapove i jezične signale. Na taj način moguće je identificirati probleme poput nedostajućih povratnih veza, netočnih jezičnih oznaka ili pokvarenih internih veza prije nego što negativno utječu na indeksiranje.
Korist je očita: indekser pouzdano provjerava svaku jezičnu verziju upućuje li ispravno na svoje alternative. Primjer: njemačka stranica namijenjena švicarskoj publici mora upućivati i na švicarsku verziju. Ako ta veza nedostaje, korisnici iz Švicarske mogu vidjeti pogrešnu jezičnu varijantu. Slično je i s sitemapovima: ako svako tržište ima vlastiti sitemap, on mora sadržavati sve relevantne URL-ove. Indekser može automatski provjeriti strukturu sitemapa i prijaviti nedostajuće podstranice. Također otkriva nepotrebna preusmjeravanja ili nedostupne resurse koji utječu na vrijeme učitavanja.
Indekser također može simulirati različite Accept-Language zaglavlja kako bi testirao preusmjerava li web stranica ispravno na preferirani jezik. Na taj način prepoznajete pogrešne konfiguracije u procesu pregovaranja sadržaja. Osim toga, može se provjeriti ima li svaka stranica ispravnu hreflang oznaku i odgovara li jezična oznaka u HTML lang atributu stvarnom jeziku. Ako ti signali nisu dosljedno postavljeni, postoji rizik da tražilice isporuče pogrešnu jezičnu verziju – rizik koji se može smanjiti redovitim auditom.
Integracija redovitog indeksiranja u radni tok smanjuje rizik da tehničke greške ostanu dugo neprimijećene. U praksi se pokazalo učinkovitim mjesečni audit ili audit uz svaku novu verziju. Pritom treba paziti da indekser poštuje smjernice za indeksiranje tražilica kako ne bi izazvao negativne posljedice. Napomena: Pravni okviri za indeksiranje vlastitih web stranica razlikuju se od zemlje do zemlje. Stoga preporučujemo da provedbu uskladite sa specijaliziranim pravnim savjetnikom. Dobro osmišljen koncept indeksiranja temelj je dosljedne tehničke kvalitete na svim tržištima.
Tipični izvori grešaka kod hreflanga, sitemapova i jezičnih signala
Kod provjere višejezičnih web stranica uvijek se pojavljuju isti izvori grešaka. Među najčešćim hreflang pogreškama su nedostatak alternativnih upućivanja, netočne jezične kratice (npr. 'de' umjesto 'de-DE') i nedosljedna povratna upućivanja između jezičnih varijanti. U praksi primjećujemo da se često održava samo jedan smjer: francuska stranica povezuje na njemačku, ali njemačka zaboravlja povratnu vezu. Jednako problematične su stranice koje hreflang-om upućuju same na sebe bez navođenja alternativa. To dovodi do nepotpunog signaliziranja tražilicama i može utjecati na indeksiranje tržišta.
I kod sitemapova pojavljuju se specifične greške. Neki projekti objedinjuju sve jezične verzije u jedan sitemap, što smanjuje učinkovitost indeksiranja. Optimalno je izraditi poseban sitemap po tržištu i ispravno ga referencirati u robots.txt. Česta greška je nedostatak određenih podstranica u sitemapu, zbog čega ih tražilice ne otkrivaju. Osim toga, sitemapovi bi trebali sadržavati datum lastmod kako bi signalizirali ažurnost. Indekser može automatski prepoznati takve praznine uspoređujući sitemap sa stvarnom strukturom stranice.
Jezični signali poput HTML lang atributa, hreflanga, Content-Language zaglavlja i vidljivog jezika teksta moraju biti dosljedni. Tipičan izvor greške je proturječnost između HTML lang atributa i hreflang oznake. Primjerice, stranica može imati lang="de", ali sadržavati hreflang="en". Tražilice takve signale tumače nesigurno. Osim toga, trebali biste provjeriti je li svaka jezična verzija stvarno napisana na navedenom jeziku. Mješoviti tekst (npr. njemačka navigacija na engleskom sadržaju) zbunjuje i korisnike i tražilice. Redovita indeksiranja pomažu otkriti ove nedosljednosti.
Kako biste sustavno identificirali ove greške, preporučuje se izrada popisa za provjeru sa svim kriterijima koje treba ispitati. Alati za indeksiranje nude funkcije filtriranja pomoću kojih možete, na primjer, popisati sve stranice bez ispravne hreflang oznake. Obratite pažnju i na obradu poddomena: ako za svako tržište koristite zasebnu poddomenu (npr. de.example.com, fr.example.com), hreflang mora biti ispravno postavljen preko granica domena. Uz dobro konfiguriran indekser možete provjeriti sve ove aspekte u jednom prolazu i time znatno smanjiti napor održavanja.

Odabir odgovarajućeg alata za indeksiranje za vaše potrebe
Izbor odgovarajućeg alata za crawling uvelike ovisi o opsegu vašeg projekta, proračunu i tehničkoj stručnosti vašeg tima. Prvo provjerite koliko URL-ova web stranica ukupno ima i koliko je pretraživanja mjesečno potrebno. Za web stranicu s 24 tržišta brzo se skupi nekoliko stotina tisuća URL-ova. Alati dizajnirani za velike količine podataka ovdje pružaju prednosti. Pazite da vaš crawler podržava vaše specifične konfiguracije, poput prilagodbe korisničkog agenta, zaglavlja Accept-Language ili postavki kolačića. Samo tako možete simulirati realne scenarije sa svakog tržišta.
Još jedan važan kriterij je podrška za višejezične strukture. Alat bi trebao moći parsirati hreflang oznake i provjeriti njihovu dosljednost. Idealno bi bilo da nudi unaprijed definirane provjere za uobičajene pogreške ili mogućnost definiranja vlastitih pravila putem regularnih izraza. Izvoz rezultata također je ključan: potrebna su vam pregledna izvješća koja možete podijeliti sa svojim timom – bilo kao CSV, Excel ili putem API-ja. U praksi se pokazalo korisnim odabrati alat koji je dostupan i u desktop i u cloud verziji, kako biste mogli fleksibilno odgovoriti na različite primjene.
Skalabilnost alata igra središnju ulogu. Desktop alat može biti dovoljan za manje projekte, ali nailazi na ograničenja kod milijuna URL-ova. Cloud rješenja raspoređuju opterećenje na više poslužitelja i znatno ubrzavaju proces pretraživanja. Uzmite u obzir i trajanje: potpuno pretraživanje svih 24 tržišta može potrajati nekoliko sati ili dana, ovisno o veličini. Stoga planirajte dovoljno vremena ili koristite inkrementalna pretraživanja koja provjeravaju samo izmijenjene stranice. Na kraju, važući troškove protiv koristi: skuplji alat često nudi dublje analitičke funkcije, dok jeftiniji možda jednako dobro ispunjava vaše zahtjeve.
Prije konačne odluke preporučujemo korištenje probne verzije alata koji dolaze u obzir. Provjerite je li korisničko sučelje intuitivno i podrška brzo odgovara na pitanja. Također obratite pozornost na poštivanje propisa o zaštiti podataka: crawler ne smije prikupljati ili pohranjivati osobne podatke vanjski, osim ako to nije pravno usklađeno. Napomena: Pravna dopuštenost crawlinga može varirati ovisno o zemlji; u slučaju nedoumica konzultirajte pravnog savjetnika. Uz odgovarajući alat stvorit ćete pouzdanu osnovu za kontinuirano osiguranje kvalitete vaše višejezične web stranice.
Priprema: Definiranje sitemapa, jezičnih varijanti i testnih URL-ova
Prije nego započnete s automatiziranim pretraživanjem, morate stvoriti čvrstu testnu osnovu. Prvo definirajte sve relevantne jezične varijante vaše web stranice. Popišite sve zemlje i jezike koje želite pokriti – za EU je to 24 službena jezika. Za svaku varijantu zabilježite točnu URL strukturu, primjerice domain.de, domain.at ili domain.com/de/. Zatim izradite reprezentativan popis testnih URL-ova koji pokriva sve jezične verzije i važne vrste stranica (početna stranica, stranice proizvoda, kategorije, pravne stranice). Odaberite najmanje pet do deset stranica po jezičnoj varijanti, idealno s različitim hreflang konfiguracijama.
Paralelno provjerite XML sitemape i po potrebi ih očistite. Svaka jezična varijanta trebala bi imati vlastitu sitemapu ili jasno odvojene unose u zajedničkoj sitemapi. Pazite da sitemape upućuju samo na službene URL-ove i ne sadrže preusmjeravanja. Izvezite sitemape kao referencu kako biste kasnije mogli usporediti rezultate pretraživanja s očekivanim unosima. Izbjegavajte uključivanje URL-ova iz drugih jezičnih verzija u pogrešnu sitemapu – česta pogreška koja dovodi do nedosljednih signala.
Također odredite parametre pretraživanja: koje alate koristite? Postavite maksimalnu dubinu pretraživanja, postavke korisničkog agenta i ograničenje brzine kako ne biste preopteretili poslužitelj. Zabilježite očekivane hreflang vrijednosti za svaki testni URL u tablici. Ova priprema štedi vas kasnijeg zahtjevnog popravljanja. U praksi se pokazuje da sustavna definicija testova značajno povećava stopu otkrivanja pogrešaka, jer ne pretražujete naslijepo, već ciljano tražite odstupanja.
Razmislite i o pravnim okvirima: Prilikom testiranja unutar EU-a morate poštivati Opću uredbu o zaštiti podataka. Nemojte koristiti osobne podatke u svojim testnim URL-ovima i osigurajte da vaše aktivnosti pretraživanja ne izazivaju neželjene pristupe. U slučaju sumnje konzultirajte pravnog savjetnika kako biste bili sigurni da vaše revizije zadovoljavaju važeće propise.
Automatska provjera ispravnosti i dosljednosti hreflang oznaka
Nakon pripreme pokrenite automatsko pretraživanje (crawling) s fokusom na hreflang oznake. Moderni alati za pretraživanje mogu analizirati implementaciju hreflanga na web stranici i ukazati na tipične pogreške poput nedostajućih oznaka, pogrešnih jezičnih kodova ili nedosljednih poveznica. Konfigurirajte svoj alat tako da za svaku pretraženu stranicu iščitava hreflang elemente u izvornom kodu ili HTTP zaglavlju. Pritom obratite pozornost na sljedeće kriterije provjere:
Provjerite je li svakoj jezičnoj varijanti dodijeljen valjan jezični kod. Koristite ISO-639-1 oblik (npr. de, fr, es) i za inačice država donju crtu (npr. en-GB, de-AT). Osigurajte dosljednost vrijednosti hreflanga – ako stranica A upućuje na B, B mora upućivati natrag na A (dvosmjerna dosljednost). Neka alat prijavljuje nedostajuće povratne veze ili pogrešne kodove kao pogreške. U praksi se često javljaju problemi s korištenjem x-default: Ova vrijednost treba se koristiti samo za stranice bez specifične jezične orijentacije, a ne kao zamjena za nepostojeće prijevode.
Nakon pretraživanja izradite pregled svih otkrivenih hreflang skupova. Svaki skup treba sadržavati sve jezične verzije jedne logične stranice. Ako nedostaju pojedine inačice ili postoje duplicirani unosi, označite ih kao pogreške. Primjer: Stranica proizvoda postoji na njemačkom i francuskom, ali hreflang skup upućuje samo na njemačku stranicu – tada nedostaje francuski unos. Također provjerite dosljednost URL-ova unutar skupova: Kod različitih putanja (npr. /de/produkt vs /produkt?lang=de) sve inačice moraju biti ispravno navedene.
Dokumentirajte sva otkrivena odstupanja i prioritizirajte ispravke. U višejezičnim projektima s 24 tržišta preporučuje se grupiranje pogrešaka po jezičnim inačicama i ponovno pretraživanje u redovitim intervalima. Automatizirajte ovaj proces uspoređujući rezultate pretraživanja s očekivanom hreflang matricom. Na taj način osiguravate da hreflang oznake dugoročno ostanu ispravne – posebno nakon ažuriranja sadržaja ili restrukturiranja stranica.
Analiza XML mapa web stranice: pokrivenost i ispravno dodjeljivanje jezika
XML mape web stranice čine okosnicu vaše višejezične strukture web stranice. Nakon provjere hreflanga posvetite se analizi mapa web stranice. Namjerno pretražite datoteke mapa i provjerite jesu li sve jezične inačice u potpunosti pokrivene. Česta pogreška je da novi prijevodi nisu uključeni u mapu ili da su zastarjele stranice i dalje navedene. Stoga provjerite broj unosa po jezičnoj inačici: Očekujte sličan broj stranica za svaki jezik (ako je vaš sadržaj dosljedno preveden). Velika odstupanja ukazuju na nedostajuće ili suvišne unose.
Pazite da URL-ovi u mapi odgovaraju stvarnom dodjeljivanju jezika. Svaki URL treba imati jasan jezični kontekst – bilo putem domene, direktorija ili naziva datoteke. Pretražite sve URL-ove iz mape i provjerite upućuju li na ispravnu jezičnu verziju. Pritom iskoristite svoje znanje o hreflangu iz prethodnog koraka: URL-ovi navedeni u mapi moraju biti dosljedni s hreflang oznakama na samoj stranici. Ako mapa sadrži njemački URL, ali stranica nema hreflang oznaku za njemački, to je proturječnost.
Također provjerite indeksne datoteke mape (ako postoje). Često se koristi nadređena mapa koja upućuje na jednojezične mape. Provjerite je li svaka podmapa ispravno referencirana i ne sadrži neispravne poveznice. Alati poput Screaming Frog ili Sitebulb mogu automatizirati ovu analizu i dati vam popis svih unosa u mapu s statusnim kodovima. Obratite pozornost na 404 pogreške ili preusmjeravanja – one se ne bi trebale pojavljivati u mapi jer šalju nepotrebne signale tražilicama.
Dokumentirajte sva odstupanja i izradite akcijski plan. Preporučuje se uključiti provjeru mapa u redovito praćenje – idealno nakon svakog većeg ažuriranja sadržaja. Tako održavate mape čistima i osiguravate da se svih 24 tržišta mogu u potpunosti indeksirati. Ne zaboravite: I ovdje vrijede pravni zahtjevi za zaštitu podataka; ne koristite osobne podatke u mapama.

Otkrivanje i uklanjanje neispravnih poveznica i pogrešaka preusmjeravanja
Neispravne veze (broken links) i pogrešna preusmjeravanja česte su prepreke u višejezičnim web stranicama. Jedna neispravna veza u jezičnoj verziji može narušiti povjerenje i prekinuti tok korisnika. Osim toga, lanci preusmjeravanja ili 404 pogreške signaliziraju tražilicama da stranica nije optimalno održavana – što može utjecati na vidljivost.
Kako biste sustavno otkrili ove pogreške, koristite automatizirane alate za indeksiranje koji prolaze kroz svih 24 jezičnih varijanti. Alati poput Screaming Frog ili Sitebulb omogućuju konfiguraciju indeksiranja s početnim URL-ovima svih jezičnih verzija. Pazite da alat prati alternativne jezične URL-ove (npr. putem hreflanga) kako biste dobili potpunu sliku. Zatim filtrirajte rezultate prema statusnom kodu: 4xx i 5xx pogreške, te 3xx preusmjeravanja koja ne vode na konačni ciljni URL.
Provjerena praksa je izrada popisa svih URL-ova iz sitemapa svih jezika. Neka alat za indeksiranje obradi taj popis i zabilježi svaki neuspješni zahtjev. Imajte na umu da preusmjeravanja nisu nužno negativna: privremeno preusmjeravanje (302) tijekom održavanja je prihvatljivo, dok trajna (301) trebaju voditi samo na ispravan ciljni URL na istom jeziku. Posebno provjerite preusmjeravaju li jezične verzije na pogrešan jezik – primjerice s /de/ na /en/. To zbunjuje korisnike i tražilice.
Za otklanjanje postupite strukturirano: Ispravite neispravne interne veze izravno u CMS-u ažuriranjem ciljnog URL-a. Za vanjske veze koje više nisu dostupne odlučite hoćete li ih ukloniti ili zamijeniti alternativom. Kod preusmjeravanja skratite lance na najviše jedan korak i osigurajte jezičnu dosljednost. Planirajte redovite revizije – najmanje kvartalno – jer svakim ažuriranjem sadržaja mogu nastati nove neispravne veze. Tako vaša višejezična web stranica ostaje tehnički čista i korisnički prijateljska.
Provjera meta-tagova, title-tagova i jezičnih deklaracija
Meta-tagovi, title-tagovi i jezične deklaracije čine temelj za komunikaciju vašeg sadržaja prilagođenu tražilicama. U višejezičnom okruženju ovi elementi moraju biti ispravni ne samo po jezičnoj verziji, već i dosljedni u svih 24 tržišta. Pogreške poput nedostajućih ili netočnih jezičnih oznaka u HTML atributu 'lang' ili nedosljednih title-tagova mogu utjecati na indeksiranje i razumijevanje korisnika.
Iskoristite svoj alat za indeksiranje za izdvajanje svih relevantnih meta podataka. Izradite tablicu sa stupcima: URL, jezična verzija, title-tag, meta opis, HTML lang atribut i po potrebi Open Graph tagove. Zatim filtrirajte prema nepravilnostima: Prazni title-tagovi ili oni kraći od 30 znakova trebaju se preraditi. Pazite da title-tagovi koriste odgovarajući jezik države, a ne primjerice engleski naslov za njemačku stranicu. Meta opisi također trebaju biti napisani na ciljnom jeziku i sažeto opisivati sadržaj.
Jezična deklaracija u HTML elementu (<html lang="de">) mora odgovarati stvarno korištenom jeziku. Česta pogreška je da je lang atribut postavljen na 'en' iako je sadržaj na francuskom. Provjerite i 'xml:lang' atribut za XHTML stranice. Koristite alat za indeksiranje koji čita ove atribute i usporedite ih s jezičnom verzijom iz vaše sitemape ili URL strukture. Ako koristite hreflang tagove, oni također moraju biti usklađeni s lang atributom.
Kako biste dugoročno osigurali dosljednost, uspostavite jasne uredničke smjernice: Svaka jezična verzija dobiva vlastite prevedene meta-tagove, nikad strojne prijevode bez dorade. Prilikom svakog objavljivanja novog sadržaja ili prijevoda provedite automatsku provjeru – primjerice pomoću CI alata koji uspoređuje izlaz alata za indeksiranje s vašim zahtjevima. Time sprječavate pogreške i osiguravate da svih 24 tržišta ima ispravne, za tražilice optimizirane meta informacije.
Duplikati sadržaja i kanonski URL-ovi u višejezičnim postavkama
U višejezičnim web stranicama duplikati često ne nastaju zbog loše namjere, već zbog tehničkih okolnosti: identični opisi proizvoda u različitim zemljama, slične odredišne stranice ili nedostatak kanonskih URL-ova. Tražilice dvostruki sadržaj smatraju problematičnim jer ne znaju koja je verzija relevantna. To može dovesti do razvodnjavanja rangiranja, što je posebno frustrirajuće ako ste prisutni na 24 tržišta.
Alat za indeksiranje (crawling) pomaže vam sustavno identificirati duplikate. Konfigurirajte crawler tako da bilježi sadržaj (npr. tekstualno tijelo) svake stranice i uspoređuje ga pomoću otiska (hash). Stranice s identičnim sadržajem bit će označene – neovisno o jeziku. Imajte na umu: pravi duplikati postoje kada se sadržaj na istom jeziku pojavljuje više puta. Sadržaj preveden na različite jezike ne smatra se duplikatom. Međutim, može se dogoditi da su engleska stranica za američko tržište i ona za britansko tržište u velikoj mjeri identične – tada trebate odlučiti hoćete li jednu verziju postaviti kao kanonsku ili ćete sadržaj razlikovati.
Za jezične inačice koje se preklapaju (npr. njemački u Njemačkoj, Austriji i Švicarskoj) preporučuje se ciljana upotreba kanonskih URL-ova. Ako isporučujete potpuno identičan sadržaj, postavite kanonski URL na preferiranu inačicu. U suprotnom koristite hreflang za označavanje alternativa – ali pazite da oba signala budu usklađena. Česta pogreška je da hreflang upućuje na stranicu koja navodi drugu stranicu kao kanonsku. To dovodi do proturječja.
Za rješavanje duplikata postupajte pojedinačno: za stranice koje su sadržajno bliske, razlikujte ih jezično specifičnim prilagodbama (npr. lokalne mjerne jedinice, kulturne reference). Ako prilagodba nije smislena, spojite verzije i preusmjerite ostale putem 301. Za svaku jezičnu inačicu postavite vlastitu kanonsku vezu koja upućuje na samu sebe – osim ako imate izričit drugi razlog. Dokumentirajte svoje odluke i nakon svakog većeg ažuriranja ponovno provjerite jesu li nastali novi duplikati. Tako će vaša višejezična web stranica ostati čista i prilagođena tražilicama.
Crawling i auditi ključni su za višejezične web stranice. Saznajte kako sustavno provjeriti hreflang oznake, sitemapove i jezične signale na do 24 tržišta. Naš vodič prikazuje praktične metode za otkrivanje pogrešaka i određivanje prioriteta – od odabira alata do automatizacije.
Mjerenje performansi i vremena učitavanja za svaku jezičnu inačicu
Vrijeme učitavanja web stranice izravno utječe na korisničko iskustvo i rangiranje na tražilicama. Kod višejezičnih web stranica morate provesti zasebna mjerenja za svaku jezičnu inačicu jer se lokacije poslužitelja, CDN konfiguracije i veličina lokaliziranih resursa razlikuju. Koristite alate poput Google PageSpeed Insights, Lighthouse ili GTmetrix za bilježenje vremena učitavanja, prvog sadržajnog ispisa (FCP) i najvećeg sadržajnog ispisa (LCP) za svaki URL. Testove idealno provodite s geografski raspršenih lokacija kako biste realno prikazali vrijeme učitavanja – alat poput WebPageTest nudi više testnih lokacija.
Izradite popis svih jezičnih inačica svoje početne stranice te najvažnijih podstranica (npr. stranice proizvoda ili kategorija). Izmjerite svaki URL više puta, najbolje u različito doba dana, i zabilježite prosječne vrijednosti. Obratite posebnu pozornost na LCP prag od 2,5 sekunde; pri više od 4 sekunde stopa napuštanja značajno raste. Također provjerite učitavaju li se jezični resursi poput fontova ili prijevodnih datoteka asinkrono te je li omogućena kompresija (Brotli ili Gzip).
Česta pogreška: jezične inačice koje se isporučuju s drugog poslužitelja ili putem druge CDN konfiguracije imaju različita vremena učitavanja. Zabilježite vrijednosti za svaku jezičnu inačicu i usporedite ih. Ako je neka jezična inačica izrazito spora, provjerite lokaciju poslužitelja, postavke predmemoriranja i broj HTTP zahtjeva. Optimizirajte slike i skripte za pojedini jezik jer lokalizirani sadržaji (npr. drugačiji formati slika ili duži tekstovi) mogu utjecati na vrijeme učitavanja.
Preporuka: uspostavite redovito praćenje koje automatski mjeri vrijeme učitavanja svih jezičnih inačica. Alati poput Sitebulb ili Screaming Frog s odgovarajućim skriptama mogu uključiti i metrike performansi u indeksiranje. Postavite pragove pri kojima je potrebna ručna provjera. Na taj način osiguravate da vaša višejezična web stranica pruža jednako brzo korisničko iskustvo na svim tržištima.

Dokumentacija rezultata i bilježenje pogrešaka
Nakon obavljenog crawla i mjerenja performansi, morate strukturirano dokumentirati rezultate kako biste mogli pratiti i prioritizirati pogreške. Napravite središnji zapisnik pogrešaka, po mogućnosti u tablici (npr. Google Sheets ili Excel) ili sustavu za prijavu. Za svaku pogrešku zabilježite pogođeni URL, jezičnu verziju, datum, vrstu pogreške (npr. pogrešan hreflang, neispravna poveznica, sporo učitavanje) i status (otvoreno, u obradi, riješeno). Dodajte snimke zaslona ili izvatke iz logova kako bi programeri mogli brzo reproducirati pogrešku.
Ne dokumentirajte samo pojedinačne greške, već i obrasce: Javljaju li se problemi češće u određenoj jezičnoj verziji? Koje stranice (početna, stranice proizvoda, blog) pokazuju najviše grešaka? Kategorizacija prema vrsti greške (tehnička, sadržajna, konfiguracijska) olakšava kasnije prioritiziranje. Koristite dosljedno imenovanje za protokoliranje – poput „pogrešan ciljni jezik u hreflangu“ ili „nedostaje Meta-Title“. Povežite greške s odgovarajućim testnim URL-ovima i, ako postoje, s ID-ovima iz alata za crawl.
Provjereni pristup je izrada tjednog ili mjesečnog revizijskog izvješća koje prikazuje razvoj broja grešaka. Tako možete utvrditi funkcioniraju li vaše optimizacije. Koristite funkcije izvoza alata za crawl poput Screaming Frog ili Sitebulb, koji pružaju CSV datoteke sa svim pronađenim greškama. Kombinirajte ih s mjerenjima performansi u cjelokupno izvješće. Pazite da rezultate sortirate po tržištu (jezičnoj verziji) kako biste brzo uočili koje su zemlje posebno pogođene.
Preporuka: Uvedite jasno označavanje može li se greška automatski (alatom) ili ručno (od strane urednika) ispraviti. Zabilježite kratke opise rješenja izravno u protokolu. Planirajte redovite sastanke za pregled na kojima tim raspravlja o otvorenim točkama. Čista dokumentacija temelj je učinkovitog otklanjanja grešaka i sprječava da se problemi više puta obrađuju.
Prioritizacija ispravljanja grešaka prema važnosti tržišta i utjecaju
Nema svaka greška isti utjecaj na vašu višejezičnu web stranicu. Morate prioritizirati ispravljanje grešaka prema važnosti tržišta i potencijalnom utjecaju na korisničko iskustvo. Prvo definirajte važnost tržišta za vaših 24 EU jezičnih verzija: Zemlje s većim prihodom ili strateški važna tržišta dobivaju viši prioritet. Napravite rang-listu jezika prema prometu, konverzijama ili prihodu. Greške na tim tržištima trebali biste otkloniti brže nego u manjim ili manje profitabilnim varijantama.
Procijenite utjecaj greške: Sprječava li da tražilice indeksiraju stranicu (npr. pogrešan hreflang ili neispravna sitemapa)? Dovodi li do lošeg korisničkog iskustva (npr. neispravna poveznica, vrlo sporo učitavanje)? Ili utječe na kvalitetu sadržaja (npr. nedostaje Title tag)? Greške s visokim utjecajem na pronalažljivost (Crawl budžet, indeksiranje) trebali biste odmah otkloniti, kao i one s izravnim negativnim učinkom na stranice važne za konverziju poput naplate.
Koristite jednostavnu matricu za prioritizaciju grešaka: Os X = važnost tržišta (niska do visoka), os Y = utjecaj greške (nizak do visok). Greške u kvadrantu „visoko/visoko“ imaju najveću hitnost. Postupajte praktično: Sortirajte svoj zapisnik grešaka prema ta dva kriterija i dodijelite svakoj grešci razinu prioriteta (1 = odmah, 2 = sljedeći tjedan, 3 = sljedeći mjesec). Raspravite prioritizaciju s timom kako biste osigurali da svi primjenjuju isto ponderiranje.
Preporuka: Uz svaku grešku zabilježite očekivani trud (u satima) i usporedite ga s koristi. Greške koje se brzo mogu ispraviti i istovremeno imaju velik utjecaj najbolje je riješiti odmah. Kod opsežnih tehničkih problema (poput pogrešnog postavljanja hreflanga za sve jezike) izradite projektni plan s prekretnicama. Nakon ispravka provjerite rezultate ponovnim crawlom. Dosljedna prioritizacija osigurava optimalno korištenje resursa i da najvažnija tržišta prva imaju koristi.
Redovite crawl rutine: intervali i mogućnosti automatizacije
Jednokratna revizija nije dovoljna da bi se 24 jezičnih verzija trajno održavalo bez grešaka. Sadržaj se mijenja, dodaju se nove stranice, a tehničke konfiguracije mogu se nenamjerno promijeniti. Stoga se preporučuje uspostavljanje redovitih rutina indeksiranja. Intervali ovise o učestalosti ažuriranja vaše web stranice i dinamici tržišta. Za statične stranice s rijetkim promjenama može biti dovoljno mjesečno indeksiranje. Kod dnevnih novih sadržaja, primjerice u internetskim trgovinama ili novinskim portalima, smisleno je tjedno ili čak dnevno pokretanje.
Za automatizaciju, alati za indeksiranje poput Screaming Frog, Sitebulb ili DeepCrawl nude API-je i CLI sučelja. Indeksiranje možete pokrenuti putem cron posla na poslužitelju ili kroz CI/CD cjevovode. Praktično postavljanje: izvezite konfiguraciju indeksiranja kao projektnu datoteku, izradite shell skriptu koja poziva alat i uključite je u svoj planer. Pazite da se izlaz – po mogućnosti kao CSV ili JSON izvješće – automatski proslijedi središnjoj nadzornoj ploči ili sustavu za praćenje problema poput Jire. Tako svi sudionici ostaju informirani bez ručnog napora.
Ključna točka: Prilagodite postavke indeksiranja za višejezične revizije. Svako indeksiranje jezika treba skenirati samo odgovarajuće URL-ove kako bi se skratilo vrijeme izvođenja. Kod alata koji indeksiraju cijelu domenu, filtrirajte prema putanji ili poddirektoriju. Koristite regularne izraze za isključivanje nevažnih područja (npr. '/en/', '/fr/' itd.). Ako vaša web stranica isporučuje jezične varijante putem poddomena, morate konfigurirati zasebna indeksiranja za svaku poddomenu i kasnije spojiti rezultate. To zahtijeva malo pripremnog rada, ali sprječava da na popis unesete stranice na pogrešnom jeziku.
Redovito provjeravajte tumači li vaš alat za indeksiranje ispravno trenutna hreflang pravila. Za to se preporučuje mjesečna usporedba hreflang referenci s vašom sitemapom. Automatizirajte i validaciju: skripta može provjeriti sadrži li svaka jezična verzija povratnu poveznicu u suprotnom smjeru. Tako izbjegavate nedosljednosti. Dokumentirajte svoju rutinu u internom wikiju kako bi kolege u slučaju kvarova mogli razumjeti što treba učiniti. U praksi se pokazalo korisnim jednom kvartalno provesti potpunu ručnu reviziju i usporediti rezultate s automatski generiranim izvješćima – time se isključuju vremenski pomaci.
Pravna napomena: Ovdje opisani intervali i mogućnosti automatizacije predstavljaju samo opću orijentaciju. Konkretno oblikovanje uvijek treba uskladiti s vašim pravnim odjelom, posebno ako se tijekom indeksiranja obrađuju osobni podaci.
Kontrolni popis za završetak: Potpuno izvješće o reviziji i sljedeći koraci
Temeljito izvješće o reviziji sažima sve rezultate na pregledan način i služi kao osnova za prioritizaciju ispravaka. Sljedeći kontrolni popis pomaže vam da ne propustite nijednu točku:
• Sve 24 jezične verzije u potpunosti su indeksirane – uključujući sve podstranice navedene u sitemapi. • Hreflang oznake prisutne su na svakoj stranici i dosljedno upućuju na sve jezične varijante (uključujući x-default). • XML sitemape sadrže sve relevantne URL-ove, ispravno su povezane specifično za jezik i indeksiraju ih tražilice. • Nijedna stranica ne vraća 404 pogrešku niti vodi kroz lanac preusmjeravanja – posebno nakon promjene jezika. • Meta oznake (Title, Description) i deklaracije jezika (lang atribut) podudaraju se. • Nema značajnih duplikata sadržaja između jezičnih verzija – kanonski URL-ovi su ispravno postavljeni. • Vrijeme učitavanja je ispod 2 sekunde za svaku jezičnu verziju (mjereno alatom za indeksiranje ili vanjskim uslugama poput PageSpeed Insights). • Sve pogreške kategorizirane su prema ozbiljnosti: kritične (neispravan hreflang, 404), srednje (nedostajući naslovi, preusmjeravanja) i niske (kozmetičke meta pogreške).
Nakon revizije izradite središnji dokument za praćenje problema – primjerice kao zajedničku tablicu (Google Sheets, Airtable) – i dodijelite svaku pogrešku odgovornoj osobi. Zabilježite procijenjeni napor i rok. Primjer: "hreflang cirkularna referenca na /de/produkt i /en/product: Max Müller, napor 2 h, do 15.03.". Povežite tablicu sa svojim alatom za upravljanje projektima kako biste pratili napredak.
Sljedeće korake treba prioritizirati – prema važnosti tržišta i tehničkom utjecaju. Započnite s pogreškama koje sprječavaju tražilice da ispravno indeksiraju vaš sadržaj (npr. neispravan hreflang). Zatim riješite tehničke probleme koji utječu na korisničko iskustvo (pokvarene poveznice, spore stranice). Najniži prioritet imaju optimizacije metapodataka. Nakon završetka svih ispravaka planirajte ponovno indeksiranje kako biste provjerili učinkovitost. Osigurajte da svi članovi tima razumiju rezultate i da su sljedeći koraci jasno komunicirani.
Na kraju: Čuvajte izvješće o reviziji kao referencu za sljedeći kvartal. Usporedite stope pogrešaka tijekom vremena kako biste uočili trendove. U praksi se pokazuje da ponovljene revizije postupno smanjuju broj pogrešaka – pod uvjetom da se uzroci ne rješavaju samo površno. Dobar sustav praćenja pomaže u prepoznavanju ponavljajućih problema. Zapamtite: izvješće nije samo sebi svrha, već alat za kontinuirano poboljšanje.
Pravna napomena: Prijedlozi prioritizacije ne zamjenjuju pravni savjet. Za pitanja o usklađenosti (npr. GDPR, obveze impresuma) obratite se svom pravnom odjelu.
Zamke i česte pogreške u višejezičnim revizijama indeksiranja
Čak i iskusni timovi tijekom audita višejezičnih web stranica previde tipične izvore pogrešaka. Primjer: hreflang oznake s x-default ispravno postavljene, ali referencirani URL koristi drugu domenu ili pogrešan protokol (HTTP vs. HTTPS). Crawler ne prikazuje upozorenje jer je ozaka sintaktički ispravna – referentne odredišne stranice, međutim, ne postoje. Stoga uvijek provjerite razlučivost svakog hreflang URL-a. Druga zamka: jezične varijante stranice nalaze se na različitim poddomenama, a sitemap sadrži samo jednu od njih. Crawler ne pronalazi ostale jer ne postoji unutarnje povezivanje. Riješite ovaj problem tako da eksplicitno uključite sve varijante u sitemap i osigurate da je svaka jezična verzija povezana s barem jedne druge stranice. I preusmjerivačke pogreške su podmukle: preusmjeravanje s /de/artikel na /de-seite?lang=de dovodi do lanca preusmjeravanja koji uništava hreflang signale. Crawlajte svoje početne URL-ove s uključenim praćenjem preusmjeravanja i provjerite isporučuje li se svaka jezična verzija izravno. Česta zabluda odnosi se na kanonski URL: kod identičnog sadržaja na različitim jezicima neki postavljaju isti kanonski URL za sve varijante. To je protivno smislu jezičnih alternativa. Svaka jezična varijanta treba upućivati na samu sebe, osim ako se radi o stvarnom duplikatu (npr. DE i AT za isti sadržaj). Također imajte na umu da Google prepoznaje jezik stranice ne samo iz hreflanga, već i iz sadržaja. Crawler koji provjerava samo HTML strukturu ovdje neće prikazati pogreške. Stoga integrirajte detektor jezika za tijelo teksta kako biste otkrili pogrešne deklaracije jezika. Izbjegavajte zamke poput nedostajućih jezičnih kodova u URL strukturi (npr. samo parametri), jer ih crawleri često zanemaruju. Dokumentirajte svaku pronađenu anomaliju snimkom zaslona i izvatkom izvornog koda kako biste spriječili pogrešne interpretacije unutar tima.
Praktični primjer: audit višejezične web stranice s 24 tržišta korak po korak
Uzmimo fiktivnu web stranicu koja se nudi na 24 EU jezika, s URL strukturom example.com/{jezični_kod}/ (npr. /de/, /fr/). Korak 1: Prikupite sve jezične varijante početne stranice i provjerite sadrži li svaka hreflang oznaku s 24 alternative plus x-default. Da biste to učinili, ručno crawlajte svaki početni URL pomoću alata poput Screaming Frog i izdvojite hreflang oznake. Korak 2: Validirajte sitemap. Često nedostaju pojedine jezične varijante ili su pogrešno dodijeljene. Izvoz sitemap URL-ova u Excel s podjelom jezičnog koda pomaže u pronalaženju praznina. Korak 3: Provedite potpuni crawl svih 24 početnih URL-ova (ograničenje: 10.000 URL-ova). Pazite da crawler tretira svaku jezičnu verziju kao zasebno računalo ili barem put. Zabilježite sve 4xx i 5xx pogreške te lance preusmjeravanja. Korak 4: Analizirajte unutarnje poveznice: Povezuje li njemačka početna stranica na francusku? Ako poveznica nedostaje, Google možda neće pronaći francusku stranicu, čak i ako je sitemap ispravan. Alat poput DeepCrawl ili analiza poveznica u Sitebulb-u pokazat će takve praznine. Korak 5: Provjerite kanonske URL-ove. Otvorite svaku jezičnu verziju i pogledajte u izvornom kodu upućuje li kanonski URL na vlastitu verziju. Korak 6: Izmjerite vrijeme učitavanja svakog jezika headless preglednikom. Razlike veće od 2 sekunde ukazuju na neučinkovite resurse po tržištu. Korak 7: Kreirajte izvješće o pogreškama prema prioritetu: visoki prioritet (npr. pogrešan hreflang, nedostajuće jezične verzije), srednji (npr. lanac preusmjeravanja, nedostajuće unutarnje poveznice), niski (npr. optimizacija performansi). U konkretnom slučaju pronašli smo tipfeler u hreflangu za španjolsku verziju: 'es-ES' umjesto 'es'. Takve se tipfelere često previdi jer crawler sintaktički prihvaća oznaku. Dokumentirajte svaku pogrešku s točnim URL-om i preporučenom ispravkom. Nakon otklanjanja ponovite audit kako biste potvrdili ispravnost. Redoviti mjesečni crawl-ovi sprječavaju da nove pogreške ostanu neprimijećene.
Česta pitanja
Koji alati za crawliranje su prikladni za višejezične audite?
Odabir ovisi o vašim zahtjevima. Besplatni alati poput Screaming Frog SEO Spider podržavaju više jezika, ali zahtijevaju ručnu konfiguraciju. Za velike postavke s 24 tržišta preporučuju se enterprise rješenja poput DeepCrawla ili Sitebulba, koji nude automatizirane hreflang provjere i skalabilna izvješća. Obratite pažnju na značajke za detekciju jezika i mogućnosti izvoza za različita tržišna crawliranja.
Kako automatizirano testirati ispravnost hreflang oznaka?
Koristite alate s ugrađenom hreflang validacijom koji provjeravaju međusobne reference i nedostajuće povratne reference. Alternativno, možete koristiti vlastite skripte: indeksirajte sve jezične verzije, izvucite hreflang podatke iz HTML-a i usporedite ih s podacima iz XML mapa. Pritom provjerite i dosljednost jezičnih kodova (ISO 639-1) te podudarnost href atributa sa stvarnim URL-ovima.
Koje intervale preporučujete za redovite rutine indeksiranja?
Učestalost ovisi o stopi ažuriranja vašeg sadržaja. Kod tjednih ažuriranja sadržaja preporučuje se tjedno indeksiranje, a kod mjesečnih promjena mjesečno. Za velike, dinamične trgovine preporučuje se dnevno indeksiranje najvažnijih stranica. Također planirajte ad-hoc revizije nakon većih promjena poput lansiranja proizvoda ili ažuriranja CMS-a. Automatizirajte rutine putem Cron zadataka ili alata poput CloudCrawlera.