2025-05-21 · Redakce Baduno · 7 blog.readMin · Blog a znalosti
Rozpoznat strojový překlad: Sedm typických chyb
Překlady AI jsou dobré – a jejich chyby také: méně časté, ale subtilnější. Jak je kontroloři poznají dříve než zákazníci.
Čtyři nápadné
Falešní přátelé (‚eventuell' se stává ‚eventually'), nekonzistentní odborné termíny v rámci jednoho textu, doslovné fráze a zlomy v oslovení mezi tykáním a vykáním: Tyto klasiky najde trénované oko během minut.
Tři subtilní
Sebevědomě chybná čísla a vlastní jména, kulturně pokřivené příklady a příliš hladký jednotný tón, který smazává veškerou značkovou barvu. Nebezpečné, protože text vypadá bezchybně – jen není správný.

Systematicky kontrolovat
Stroje kontrolují strukturu (čísla, zástupné znaky, úplnost, terminologii), lidé kontrolují význam a účinek – v tomto pořadí, s dokumentovaným výsledkem. Náhodné vzorky nenahrazují systematičnost u finančních stránek.
Důsledek pro nákupčí
Neptejte se poskytovatelů služeb, zda používají AI – zeptejte se, jak nacházejí její chyby. Kdo neumí popsat proces kontroly, žádný nemá. Naše odpověď je veřejně na těchto stránkách.
Zavádějící idiomy a metafory
Strojové překlady často selhávají u idiomatických obratů, které nejsou přímo převoditelné. Například 'to kick the bucket' se v němčině často přeloží jako 'den Eimer treten' (kopnout do kbelíku), i když správný idiom je 'den Löffel abgeben' (odevzdat lžíci). Podobně metafory jako 'the ball is in your court' by měly být kulturně přizpůsobeny cílovému trhu, například 'Jste na řadě'. Posuzovatelé musí rozpoznat nejen doslovný význam, ale také zamýšlený účinek. Typický příklad: 'break a leg' je často překládáno jako 'zlom si nohu', což je v němčině chápáno jako špatné přání – správně je 'Hals- und Beinbruch' (zlom vaz). U marketingových textů mohou takové chyby působit trapně a zkreslit sdělení. Proto by měli posuzovatelé hledat běžné idiomy ve zdrojovém textu a ručně ověřit jejich jazykový ekvivalent. Dobrý workflow: AI přeloží, posuzovatel označí všechny idiomy a validuje je pomocí referenční databáze nebo rodilého citu.
Chyby v číslech, datech a formátech
Překlady AI často zacházejí s čísly správně, ale ne vždy – zejména u oddělovačů tisíců, desetinných oddělovačů a formátů dat. Americké datum '03/04/2024' může být interpretováno jako 3. dubna nebo 4. března. Měny: '$1.50' se v němčině stává '1,50 $', ale některé AI vynechají čárku nebo ponechají tečku. Také jednotky: '10 miles' by se mělo stát '16 kilometrů', nikoli '10 mil'. Ještě záludnější jsou procenta s kulturními rozdíly: 'a 50% increase' může znamenat 'zvýšení o 50 %' nebo 'na 150 %'. Kontroloři by proto měli systematicky porovnávat všechna čísla, data, jednotky a měny s výchozím textem. Pomůže kontrolní seznam: kontrola desetinných oddělovačů, formátu data (DD.MM.RRRR vs. MM/DD/RRRR), symbolů měn (€ vs. $) a jednotek (km vs. míle). Zvláště důležité u cen v e-shopech – špatná čárka může cenu znásobit desetinásobně. Každou odchylku zdokumentujte a opravte formátování podle pravidel cílového jazyka.
Nesprávná vlastní jména a značkové výrazy
Vlastní jména, názvy značek a produktů by měla zpravidla zůstat nepřeložena. AI je však má tendenci překládat: z 'Apple' se stane 'Jablko', z 'Microsoft' 'Mikrosoftware'. Ještě kritičtější: odborné termíny jako 'SAP' nebo 'CRM' jsou někdy nahrazovány domnělými ekvivalenty ('Socialistická strana práce' místo systémů). Také akronymy jako 'NASA' by se neměly rozepisovat, pokud cílová kultura nepoužívá překlad. Kontroloři proto musí spravovat terminologickou databázi, která stanoví, které názvy se zachovávají. Při kontrole by měla být všechna vlastní jména, firemní názvy, názvy produktů a akronymy označeny a porovnány s touto databází. Častá chyba: 'Köln Bonn Airport' se stane 'Cologne Bonn Airport' – podle cílového jazyka může být obojí správně, ale rozhodující je konzistence. Každé rozhodnutí zdokumentujte, aby byl stejný název v pozdějších překladech zpracováván jednotně.
Překlady AI jsou dobré – a jejich chyby také: méně časté, ale subtilnější. Jak je kontroloři poznají dříve než zákazníci.
Chybějící dlouhodobý kontext a aktualizace
Strojové překlady obvykle zohledňují pouze aktuální větu nebo odstavec, nikoli celý text nebo dřívější překlady stejného zákazníka. To vede k nekonzistenci u opakujících se pojmů, frází nebo zpráv. Příklad: Společnost změní svůj slogan z 'Quality first' na 'Quality & Speed'. Al přeloží nový text správně, ale všechny staré překlady zůstanou – návštěvníci uvidí na různých stránkách různé claimy. Také při uvedení produktu: jedna verze se jmenuje 'Pro 2024', další 'Pro 2025'. Bez dlouhodobého kontextu přeloží Al možná 'Pro 2024' jako 'Pro 2024' a 'Pro 2025' jako 'Pro 2025', ale pokud si zákazník přeje, aby název značky zůstal vždy nepřeložen, musí to platit globálně. Kontroloři by si proto měli před prací prostudovat zákaznický style guide a zkontrolovat stávající překlady na konzistenci. Ještě lepší: používat systémy Al s překladovou pamětí (TM), které rozpoznávají dřívější překlady. Přesto zůstává lidská kontrola nezbytná, aby byla zajištěna jednotná identita značky napříč všemi kanály.
Chyby v URL, metadatech a hreflang označeních
Strojové překlady se většinou zaměřují na viditelný text a ignorují technické prvky, jako jsou URL, metadata a hreflang tagy. Přitom jsou tyto prvky pro vícejazyčnou optimalizaci pro vyhledávače zásadní. Typické chyby: AI překládá URL slugy, ačkoli by většinou měly zůstat nezměněny – z "/de/produkte" se chybně stane "/en/products", což vede k mrtvým odkazům. Také meta titulky a popisy jsou často automaticky překládány bez ohledu na limit znaků: Německé meta popisy o 160 znacích jsou po překladu do angličtiny často příliš dlouhé a jsou oříznuty. Obzvláště kritická jsou hreflang označení: Tyto HTML tagy ukazují vyhledávačům jazykové verze stránky. AI může omylem nastavit hreflang="de" pro anglickou stránku nebo odkázat kanonickou URL na nesprávnou jazykovou verzi. Důsledek: Vyhledávače indexují nesprávné stránky nebo penalizují duplicitní obsah. Kontroloři by proto měli po překladu systematicky projít všechny odkazy, metadata a hreflang tagy. Využijte nástroje jako Screaming Frog nebo ruční namátkové kontroly. Dbejte na to, aby URL struktury zůstaly konzistentní (např. /de/, /en/ jako jazykové cesty) a meta údaje byly optimalizovány pro daný jazyk. Každou úpravu dokumentujte, aby byl při budoucích překladech zachován technický rámec.
Lokalizace právních textů a bezpečnostních upozornění
Právní texty jako všeobecné obchodní podmínky, prohlášení o ochraně osobních údajů nebo impressum často obsahují standardizované formulace, které AI překládá sice doslovně správně, ale právně nedostatečně. Například z německého „Einwilligung gemäß Art. 6 DSGVO“ se v angličtině stane obecný „consent according to law“, aniž by byl uveden konkrétní právní základ. To může vést k právním výzvám. Také bezpečnostní upozornění u výrobků jsou obzvláště zranitelná: Varování jako „Nicht in die Hände von Kindern gelangen lassen“ AI někdy oslabí („Keep out of reach“ místo „Keep out of reach of children“). V Evropě jsou přesná varování ze zákona povinná; nepřesnosti ohrožují odpovědnost za výrobek. Kontroloři by proto měli právní texty kontrolovat nejen na jazykovou správnost, ale na právní ekvivalenci. Osvědčeným postupem je vytvořit glosář s závaznými překlady pro klauzule, paragrafy a právní pojmy. Spolupracujte s rodilým mluvčím, který zná právní řád cílové země. Nakonec nechte text přehlédnout právním odborníkem. AI může workflow urychlit, ale odpovědnost zůstává na společnosti – proto je systematická lidská kontrola nezbytná.
Hreflang tagy a SEO: Neviditelné nástrahy
Zatímco jazykové chyby jsou okamžitě patrné, neviditelné chyby ve zdrojovém kódu ohrožují dohledatelnost vašeho vícejazyčného webu. Strojové překlady často poskytují korektní texty, ale zapomínají na úpravu hreflang tagů, metadat a URL struktur. Typický příklad: AI přeloží obsah, ale atribut hreflang stále odkazuje na výchozí stránku – vyhledávače pak zobrazí nesprávnou jazykovou verzi ve výsledcích vyhledávání. Překlad meta titulků a popisů je také často opomíjen, takže vaše stránka sice čte německy, ale objevuje se pod anglickými snippety. Ještě kritičtější: když AI přeloží titulky stránek, ale URL zůstane nezměněna, vznikají problémy s duplicitním obsahem. Kontroloři by proto měli systematicky prověřovat každou stránku na úplnou lokalizaci SEO prvků: hreflang, canonical, meta description, alt texty a URL. Ďábel se skrývá ve zdrojovém kódu: chybějící jazykový kód nebo nesprávná oblast (de-DE místo de-AT) může zničit vaši mezinárodní viditelnost. Naše kontrola proto zahrnuje nejen viditelný text, ale i technickou infrastrukturu lokalizace. Jen tak zajistíte, že váš obsah bude nalezen ve všech cílových trzích – bez ztráty rankingu kvůli strojové nedbalosti.
Řízení terminologie jako záruka kvality
Jednou z největších výzev strojových překladů je nekonzistentní používání odborných termínů. Zatímco jednotlivý text se může zdát bezchybný, srovnání s předchozími překlady téhož klienta často odhalí závažné odchylky. AI nemá paměť pro firemní slovní zásobu – každý výskyt překládá znovu, aniž by brala v úvahu zavedenou terminologii. Proto je centrální řízení terminologie nezbytné. Před překladem vytvořte závazné glosáře, které stanoví preferované termíny, zakázaná synonyma a kontextově závislé varianty. Tento glosář musí být integrován jak do prostředí AI, tak do prostředí kontroly. Kontrolor by pak měl systematicky porovnávat každý odborný termín v cílovém textu s glosářem. Zvláště kritické jsou neologismy, názvy produktů a právní formulace. Bez glosáře riskujete, že stejný termín bude v různých publikacích přeložen odlišně – promarněná příležitost pro konzistenci značky a zdroj frustrace pro vaše zákazníky. Investujte tedy do údržby své terminologické databáze; je to nejefektivnější nástroj pro zvýšení kvality strojových překladů na profesionální úroveň.
blog.faqT
Jak naložit s chybně přeloženými vlastními jmény?
Vytvořte závaznou terminologickou databázi, která pro každé vlastní jméno stanoví správný pravopis v cílovém jazyce. Kontroloři by měli označit všechna vlastní jména a porovnat je s touto databází. Odchylky se opraví a databáze se aktualizuje o nové případy. Tím zajistíte, že názvy značek a produktů zůstanou konzistentní.
Jaké nástroje podporují kontrolu číselných a formátových chyb?
Používejte QA nástroje jako Xbench nebo Verifika, které automaticky kontrolují tisícinové oddělovače, formáty dat a měny. Tyto nástroje vypisují odchylky, které je pak nutné ručně validovat. Alternativně lze pomocí regulárních výrazů provádět vlastní kontroly. Výsledky se zaznamenávají do protokolu o kontrole.