2025-05-21 · Baduno szerkesztőség · 7 blog.readMin · Blog és tudás
Gépi fordítás felismerése: Hét tipikus hiba
A MI-fordítások jók lettek – a hibáik is: ritkábbak, de alattomosabbak. Miről ismerik fel a lektorok, mielőtt az ügyfelek megtennék.
A négy szembetűnő
Hamis barátok (‘eventuell’ből ‘eventually’ lesz), inkonzisztens szakmai kifejezések ugyanazon a szövegen belül, szó szerint vett kifejezések és megszólítási törések a tegezés és magázás között: ezeket a klasszikusokat gyakorlott szem percek alatt megtalálja.
A három alattomos
Magabiztosan hibás számok és tulajdonnevek, kulturálisan fura példák, és egy túl sima egységes hang, ami minden márkajelleget eltüntet. Veszélyes, mert a szöveg hibátlannak tűnik – csak nem helyes.

Rendszeres ellenőrzés
A gépek a struktúrát (számok, helykitöltők, teljesség, terminológia) ellenőrzik, az emberek a jelentést és hatást – ebben a sorrendben, dokumentált eredménnyel. A mintavétel nem helyettesíti a rendszerességet a pénzügyi oldalakon.
Következmény a beszerzők számára
Ne azt kérdezze a szolgáltatóktól, hogy használnak-e MI-t – azt kérdezze, hogy hogyan találják meg a hibáit. Aki nem tud leírni egy ellenőrzési folyamatot, annak nincs is. A mi válaszunk nyilvánosan elérhető ezen a weboldalon.
Félrevezető idiómák és metaforák
A gépi fordítások gyakran megbuknak az idiómákon, amelyek nem fordíthatók le egy az egyben. Például az angol 'to kick the bucket' németül gyakran 'den Eimer treten' lesz, pedig a helyes kifejezés 'den Löffel abgeben'. Hasonlóképpen, az olyan metaforákat, mint a 'the ball is in your court', a célpiac függvényében kulturálisan adaptálni kell, például 'Önön a sor'. A lektoroknak itt nemcsak a szó szerinti jelentést, hanem a szándékolt hatást is fel kell ismerniük. Tipikus példa: a 'break a leg' kifejezést az MI gyakran 'brich dir ein Bein'-ként fordítja, ami németül rossz kívánságnak számít – helyesen 'Hals- und Beinbruch'. Marketing szövegekben az ilyen hibák kínosak lehetnek, és eltorzíthatják az üzenetet. Ezért a lektoroknak keresniük kell a forrásszövegben előforduló gyakori idiómákat, és manuálisan ellenőrizniük kell a célnyelvi megfelelőjüket. Egy jó munkafolyamat: az MI fordít, a lektor jelöli az összes idiómát, és validálja azokat egy referenciadatbázis vagy anyanyelvi intuíció segítségével.
Hibák számokban, dátumokban és formátumokban
Az AI-fordítások gyakran helyesen kezelik a számokat, de nem mindig – különösen az ezreselválasztók, tizedeselválasztók és dátumformátumok esetében. Egy amerikai dátum '03/04/2024' értelmezhető április 3.-ként vagy március 4.-ként. Pénznemek: '$1,50' németül '1,50 $' lesz, de egyes AI-ok elhagyják a vesszőt vagy pontot tesznek. Mértékegységek: '10 mérföld' helyett '16 kilométer' kellene. Még trükkösebb a százalékok kulturális eltérése: 'a 50% increase' jelenthet '50%-os növekedést' vagy '150%-ot'. Az ellenőröknek ezért minden számot, dátumot, mértékegységet és pénznemet szisztematikusan össze kell vetniük a forrásszöveggel. Egy ellenőrzőlista segít: tizedeselválasztók, dátumformátum (NN.HH.ÉÉÉÉ vs. HH/NN/ÉÉÉÉ), pénznemszimbólumok (€ vs. $) és mértékegységek (km vs. mérföld) ellenőrzése. Különösen fontos az online áruházak árainál – egy rossz vessző tízszeresére növelheti az árat. Dokumentáljon minden eltérést, és javítsa a formázást a célnyelv szabályai szerint.
Helytelen tulajdonnevek és márkakifejezések
A tulajdonnevek, márkanevek és terméknevek általában fordítatlanul maradnak. Az AI azonban hajlamos ezeket is lefordítani: az 'Apple'-ből 'Apfel' lesz, a 'Microsoft'-ból 'Mikrosoftware'. Még kritikusabb: szakkifejezések, mint az 'SAP' vagy 'CRM', néha vélt megfelelésekkel helyettesítődnek ('Sozialistische Arbeiterpartei' a rendszer helyett). Az akronímák, mint a 'NASA', sem írandók ki, hacsak a célkultúra nem használja a fordítást. Az ellenőröknek ezért terminológiai adatbázist kell vezetniük, amely rögzíti, mely nevek maradnak meg. Az ellenőrzés során minden tulajdonnevet, cégnév, terméknév és akroníma megjelölendő, és összevetendő ezzel az adatbázissal. Gyakori hiba: a 'Köln Bonn Airport' 'Cologne Bonn Airport'-tá válhat – a célnyelvtől függően mindkettő helyes lehet, de a konzisztencia a fontos. Dokumentáljon minden döntést, hogy későbbi fordítások során ugyanaz a név egységesen legyen kezelve.
A MI-fordítások jók lettek – a hibáik is: ritkábbak, de alattomosabbak. Miről ismerik fel a lektorok, mielőtt az ügyfelek megtennék.
Hiányzó hosszú távú kontextus és frissítés
A gépi fordítások általában csak az aktuális mondatot vagy bekezdést veszik figyelembe, nem a teljes szöveget vagy az adott ügyfél korábbi fordításait. Ez inkonzisztenciákhoz vezet az ismétlődő kifejezések, frázisok vagy üzenetek esetében. Példa: Egy vállalat megváltoztatja szlogenjét 'Quality first'-ről 'Quality & Speed'-re. Az AI helyesen lefordítja az új szöveget, de a régi fordítások megmaradnak – a látogatók eltérő állításokat látnak a különböző oldalakon. Termékbevezetéseknél is: az egyik verzió 'Pro 2024', a következő 'Pro 2025'. Hosszú távú kontextus nélkül az AI valószínűleg 'Pro 2024'-t 'Pro 2024'-ként és 'Pro 2025'-öt 'Pro 2025'-ként fordítja, de ha az ügyfél azt kívánja, hogy a márkanév mindig fordítatlan maradjon, annak globálisan kell érvényesülnie. Az ellenőröknek ezért munka előtt meg kell tekinteniük az ügyfél stílusútmutatóját, és ellenőrizniük kell a meglévő fordítások konzisztenciáját. Még jobb: Translation Memory (TM) rendszereket használni, amelyek felismerik a korábbi fordításokat. Ennek ellenére az emberi ellenőrzés továbbra is nélkülözhetetlen annak biztosításához, hogy a márkaidentitás minden csatornán egységes maradjon.
URL-ek, metaadatok és hreflang-utasítások hibái
A gépi fordítások általában a látható szövegre összpontosítanak, és figyelmen kívül hagyják az olyan technikai elemeket, mint az URL-ek, metaadatok és hreflang-tagek. Pedig ezek elengedhetetlenek a többnyelvű keresőoptimalizáláshoz. Tipikus hibák: A MI lefordítja az URL-slugokat, holott ezeknek általában változatlanul kellene maradniuk – a "/de/produkte"-ból tévesen "/en/products" lesz, ami holt linkekhez vezet. A meta címeket és leírásokat is gyakran automatikusan lefordítják anélkül, hogy figyelembe vennék a karakterkorlátot: a 160 karakteres német meta leírások angolra fordítva gyakran túl hosszúak és csonkolódnak. Különösen kritikusak a hreflang-utasítások: ezek a HTML-tagek jelzik a keresőmotoroknak az oldal nyelvi verzióit. Egy MI véletlenül hreflang="de"-t állíthat be egy angol oldalhoz, vagy a kanonikus URL-t a rossz nyelvi verzióra irányíthatja. Ennek következménye: a keresőmotorok rossz oldalakat indexelnek, vagy büntetik a duplikált tartalmat. Az ellenőröknek ezért a fordítás után szisztematikusan át kell nézniük az összes linket, metaadatot és hreflang-taget. Használjon olyan eszközöket, mint a Screaming Frog, vagy végezzen manuális mintavételezést. Ügyeljen arra, hogy az URL-struktúrák konzisztensek maradjanak (pl. /de/, /en/ nyelvi útvonalak), és a metaadatok nyelvspecifikusan optimalizáltak legyenek. Dokumentáljon minden módosítást, hogy a jövőbeli fordítások során megmaradjon a technikai keret.
Jogi szövegek és biztonsági figyelmeztetések lokalizációja
A jogi szövegek, mint az Általános Szerződési Feltételek, adatvédelmi nyilatkozatok vagy impresszum, gyakran tartalmaznak szabványosított megfogalmazásokat, amelyeket a MI ugyan szó szerint helyesen, de jogilag elégtelenül fordít le. Így a német „Einwilligung gemäß Art. 6 DSGVO” angolul gyakran egy általános „consent according to law” lesz, anélkül, hogy megnevezné a konkrét jogalapot. Ez figyelmeztetésekhez vezethet. A termékekre vonatkozó biztonsági utasítások is különösen érzékenyek: a „Nicht in die Hände von Kindern gelangen lassen” figyelmeztetést a MI néha enyhíti („Keep out of reach” a „Keep out of reach of children” helyett). Európában a pontos figyelmeztetések jogilag előírtak; a pontatlanságok veszélyeztetik a termékfelelősséget. Az ellenőröknek ezért a jogi szövegeket nemcsak nyelvi helyesség, hanem jogi egyenértékűség szempontjából is ellenőrizniük kell. Bevált eljárás: készítsen egy glosszáriumot kötelező érvényű fordításokkal záradékok, paragrafusok és jogi fogalmak számára. Dolgozzon egy olyan anyanyelvi szakemberrel, aki ismeri a célország jogrendszerét. Végül egy jogi szakértővel ellenőriztesse át. A MI felgyorsíthatja a munkafolyamatot, de a felelősség továbbra is a vállalaté – ezért a szisztematikus emberi ellenőrzés elengedhetetlen.
Hreflang-címkék és SEO: A láthatatlan buktatók
Míg a nyelvi hibák azonnal szemet szúrnak, a forráskódban rejlő láthatatlan hibák veszélyeztetik többnyelvű weboldala megtalálhatóságát. A gépi fordítások gyakran helyes szövegeket adnak, de elfelejtik a hreflang-címkék, metaadatok és URL-struktúrák módosítását. Egy tipikus példa: a MI lefordítja a tartalmat, de a hreflang-attribútum továbbra is a forrásoldalra mutat – a keresőmotorok ekkor a rossz nyelvi verziót jelenítik meg a találati listában. A meta-címek és -leírások fordítását is gyakran elhanyagolják, így oldala ugyan németül olvasható, de angol snippetek alatt jelenik meg. Még kritikusabb: ha a MI lefordítja az oldalcímeket, de az URL-t változatlanul hagyja, duplicate content problémák lépnek fel. Az ellenőröknek ezért szisztematikusan kell vizsgálniuk minden oldalt a SEO-elemek teljes lokalizációja szempontjából: hreflang, canonical, meta-leírás, alt szövegek és URL-ek. A hiba ördöge a forráskódban rejlik: egy hiányzó nyelvi kód vagy rossz régió (de-DE a de-AT helyett) tönkreteheti nemzetközi láthatóságát. Ellenőrzésünk ezért nemcsak a látható szövegre terjed ki, hanem a lokalizáció technikai infrastruktúrájára is. Csak így biztosíthatja, hogy tartalmai minden célpiacon megtalálhatók legyenek – rangsorolási veszteségek nélkül, a gépi hanyagság miatt.
Terminológia-menedzsment a minőség záloga
A gépi fordítások egyik legnagyobb kihívása a szakmai kifejezések következetlen használata. Míg egyetlen szöveg hibátlannak tűnhet, az ugyanazon ügyfél korábbi fordításaival való összehasonlítás gyakran súlyos eltéréseket tár fel. A MI-nek nincs memóriája a vállalatspecifikus szókincsre – minden előfordulást újrafordít, anélkül, hogy figyelembe venné a kialakult szókincset. Ezért elengedhetetlen a központi terminológia-menedzsment. A fordítás előtt hozzon létre kötelező érvényű glosszáriumokat, amelyek meghatározzák a preferált kifejezéseket, a tiltott szinonimákat és a kontextusfüggő változatokat. Ezt a glosszáriumot integrálni kell mind a MI-környezetbe, mind az ellenőrzési környezetbe. Az ellenőrnek ezután szisztematikusan össze kell vetnie a célnyelvi szöveg minden szakkifejezését a glosszáriumban foglaltakkal. Különösen kritikusak a neologizmusok, a terméknevek és a jogi megfogalmazások. Glosszárium nélkül az a kockázat áll fenn, hogy ugyanazt a kifejezést különböző kiadványokban eltérően fordítják – ez elszalasztott lehetőség a márka konzisztenciájára és bosszúság az ügyfelei számára. Ezért fektessen be terminológiakészlete ápolásába; ez a leghatékonyabb eszköz a gépi fordítások minőségének professzionális szintre emeléséhez.
blog.faqT
Hogyan kezeljem a rosszul lefordított tulajdonneveket?
Hozzon létre egy kötelező érvényű terminológiai adatbázist, amely minden tulajdonnévhez meghatározza a helyes írásmódot a célnyelven. Az ellenőrzőknek meg kell jelölniük az összes tulajdonnevet, és össze kell vetniük az adatbázissal. Az eltéréseket javítani kell, és az adatbázist új esetekkel frissíteni. Így biztosíthatja, hogy a márka- és terméknevek konzisztensek maradjanak.
Milyen eszközök támogatják a szám- és formátumhibák ellenőrzését?
Használjon olyan minőségbiztosítási eszközöket, mint az Xbench vagy a Verifika, amelyek automatikusan ellenőrzik az ezres elválasztójeleket, dátumformátumokat és pénznemeket. Ezek az eszközök felsorolják az eltéréseket, amelyeket aztán manuálisan kell érvényesíteni. Alternatívaként reguláris kifejezések is végezhetnek egyedi ellenőrzéseket. Az eredményeket a vizsgálati jegyzőkönyvben rögzítik.