2025-12-09 · Redaktion Baduno · 28 blog.readMin · Blog & Wissen
KI-Übersetzung mit Terminologie steuern: Glossare, die wirken
Ein durchdachtes Glossar ist der Schlüssel, um KI-Übersetzungen präzise und konsistent zu steuern. Erfahren Sie, wie Sie Terminologiedatenbanken aufbauen, in MT-Workflows integrieren und typische Fallstricke vermeiden. Praxisnahe Tipps für Übersetzer, Projektmanager und Unternehmen, die ihre mehrsprachige Kommunikation optimieren möchten.

Terminologie in KI-Übersetzung: Grundlagen und Begriffe
Die Integration von Terminologie in maschinelle Übersetzungssysteme (MT) ist ein zentraler Hebel für konsistente und fachlich korrekte Ergebnisse. Anders als in der reinen Statistik- oder Neuronalen Übersetzung arbeiten moderne KI-Übersetzungsmodelle mit kontextuellen Mustern. Eine Terminologiedatenbank (auch Termbase genannt) zwingt das System jedoch, im Zweifelsfall Ihre Vorgaben zu befolgen. Grundsätzlich unterscheidet man zwischen statischen Glossaren (Listen mit festen Übersetzungen) und dynamischen Termbasen, die Zusatzinformationen wie Wortart, Genus, Kontextbeispiele oder Verwendungseinschränkungen enthalten.
Für die Praxis bedeutet dies: Ein Glossar ist kein Wörterbuch, sondern eine Regelvorgabe für fachspezifische Begriffe. Beispiel: Im Maschinenbau darf "Zugspannung" immer mit "tensile stress" übersetzt werden, nicht mit "tension" oder "pull stress". Ohne Terminologiestützung wählt das MT-System je nach Trainingsdaten die wahrscheinlichste Variante – was häufig zu Inkonsistenzen führt. Wichtig ist auch der Unterschied zwischen Präferenz und Pflicht: In den meisten MT-Systemen können Sie pro Eintrag festlegen, ob die Übersetzung bevorzugt oder erzwungen werden soll. Letzteres kann zu grammatikalisch holprigen Sätzen führen, falls der Begriff nicht ins Satzgefüge passt.
Ein weiterer Grundbegriff ist die Morphologie: Einträge in der Grundform (z. B. "Schraube") müssen häufig um Flexionsformen ergänzt werden, da MT-Systeme nicht automatisch deklinieren. Erfassen Sie daher – je nach Sprachpaar – auch Pluralformen und konjugierte Verbformen. Andernfalls greift die Terminologie nur bei exakter Übereinstimmung. In der Praxis hat sich bewährt: Pro Sprache maximal 5.000 bis 10.000 Einträge, priorisiert nach Häufigkeit und Fachrelevanz. Ein gut gepflegtes Glossar reduziert den Nachbearbeitungsaufwand spürbar – insbesondere bei technischen Dokumentationen oder juristischen Texten.
Handlungsempfehlung: Starten Sie mit einem Kernset von 200–500 Begriffen aus Ihrem Produkt- oder Fachbereich. Legen Sie fest, ob die Terminologie "hart" (erzwungen) oder "weich" (bevorzugt) angewendet wird. Testen Sie anhand von 10 repräsentativen Sätzen, ob die Übersetzungen flüssig bleiben. Dokumentieren Sie zudem, warum ein Begriff aufgenommen wurde – das erleichtert die spätere Pflege. Beachten Sie: Je spezifischer die Domain, desto wirkungsvoller ist die Steuerung durch Terminologie.
Aufbau einer Terminologiedatenbank: Struktur und Pflege
Eine effektive Terminologiedatenbank (TDB) lebt von einer durchdachten Struktur und regelmäßiger Pflege. Grundlage ist die Auswahl der richtigen Felder: Minimal erforderlich sind Ausgangsbegriff, Zielbegriff, Sprachkürzel (z. B. DE-DE, EN-US) sowie Status (z. B. "geprüft", "vorläufig", "veraltet"). In der Praxis hat sich zusätzlich die Angabe der Wortart, des Fachgebiets und eines kurzen Definitionskontexts bewährt. Beispiel: Bei "Laufzeit" im IT-Umfeld sollte unterschieden werden zwischen "runtime" (Programmausführung) und "term" (Zeitraum). Ohne Kontextangabe kann das MT-System nicht korrekt zuordnen.
Die Pflege sollte als kontinuierlicher Prozess organisiert sein, nicht als einmalige Aktion. Empfehlenswert ist ein zentrales Terminologie-Management-Tool (z. B. T-Manager oder ein entsprechendes Modul in Ihrem Übersetzungsspeicher-System). Definieren Sie Verantwortlichkeiten: Ein Fachexperte prüft neue Begriffe, ein Übersetzer oder Lokalisierer pflegt die Einträge ein. Achten Sie darauf, dass die TDB sprachneutral aufgebaut ist – also jeder Eintrag für eine Sprache einen eigenen Datensatz erhält. Andernfalls entstehen Probleme bei Mehrfachbedeutungen.
Ein häufiger Fehler ist die Überladung mit seltenen Begriffen. Konzentrieren Sie sich auf Termini, die in Ihren Texten wiederholt auftauchen oder fachlich besonders sensibel sind. Für die Erstbefüllung eignen sich folgende Quellen: vorhandene Kunden-Glossare, Terminologie aus Übersetzungsspeichern (extrahiert mittels Frequenzanalyse), Normen und Standards (z. B. ISO-Terminologie) sowie Produktbeschreibungen. Achten Sie darauf, dass jeder Eintrag eindeutig ist – Synonyme sollten entweder als Verweise oder mit Zusatzmerkmalen wie "bevorzugt"/"erlaubt" gekennzeichnet werden.
Handlungsempfehlung: Erstellen Sie ein Pflegeprotokoll mit monatlichem Rhythmus. Führen Sie dazu eine Abfrage der ungenutzten Einträge (älter als 12 Monate) und prüfen Sie, ob diese gelöscht oder archiviert werden können. Aktualisieren Sie mindestens vierteljährlich die Einträge aus aktuellen Projekten. Testen Sie die TDB regelmäßig mit einer Stichprobe von 50 Sätzen – wenn mehr als 10% der erwarteten Begriffe nicht greifen, prüfen Sie die Morphologie oder die Systemkonfiguration. Ein gut gepflegtes Glossar ist kein statisches Dokument, sondern ein lebendiges Arbeitsmittel, das mit Ihren Inhalten mitwächst.

Glossarformate und Schnittstellen zu MT-Systemen
Die technische Anbindung eines Glossars an ein KI-Übersetzungssystem ist entscheidend für die tatsächliche Nutzung der Terminologie. Gängige MT-Plattformen unterstützen unterschiedliche Importformate. Das häufigste ist CSV (Comma-Separated Values) mit einer Kopfzeile, die die Felder definiert. Beispiel: "source_language","target_language","source_term","target_term","pos","domain". Wichtig: Verwenden Sie UTF-8-Kodierung, um Sonderzeichen korrekt zu übertragen. Manche Systeme erwarten zudem eine bestimmte Spaltenreihenfolge – prüfen Sie in der Dokumentation. Alternativ werden XML-Formate wie TBX (TermBase eXchange) genutzt, das ISO-genormt ist und komplexere Metadaten erlaubt. Auch XLIFF (XML Localisation Interchange Format) kann Terminologie enthalten, jedoch meist als Anmerkung.
Wie steuern Sie die Terminologie nun im Übersetzungsprozess? Moderne MT-Systeme bieten zwei Hauptvarianten: statische Glossare (Listen vor der Übersetzung) und dynamische Glossare (promptbasierte Integration). Bei Plattformen mit API (z. B. DeepL, Google Cloud Translation) können Sie beim API-Aufruf ein Glossar in Echtzeit mitgeben. Achten Sie darauf, dass jedes Glossar auf die jeweilige Sprachkombination und Domäne zugeschnitten ist – ein allgemeines Glossar für alle Fälle verwässert die Wirkung. In der Praxis hat sich bewährt: Pro Sprachkombination und Fachbereich ein separates Glossar mit maximal 1000 Einträgen zu verwenden.
Die Nachkontrolle der Glossarwirkung ist ein oft vernachlässigter Schritt. Nach einer Übersetzung sollten Sie stichprobenartig prüfen, ob die definierten Begriffe korrekt übersetzt wurden. Viele MT-Systeme protokollieren nicht, ob ein Glossareintrag tatsächlich angewendet wurde. Daher empfiehlt sich ein automatischer Abgleich: Exportieren Sie die Übersetzung und suchen Sie mit einem Skript nach den Glossarbegriffen im Zieltext. Wird ein Begriff nicht wie vorgegeben übersetzt, prüfen Sie die Ursache: falsche Morphologie, fehlender Kontext oder Überschreibung durch Satzstruktur. Grenzen der Steuerung zeigen sich vor allem bei stark polysemen Begriffen oder bei Sätzen, die mehrere Glossareinträge gleichzeitig aktivieren – hier kann das System in Konflikte geraten.
Handlungsempfehlung: Starten Sie mit CSV im UTF-8-Format, da dies von den meisten MT-Systemen akzeptiert wird. Nutzen Sie die API des jeweiligen Anbieters, um Glossare direkt zu testen. Führen Sie nach jedem Glossar-Update einen Regressionstest mit 20–30 Testsegmenten durch. Dokumentieren Sie die genauen Einstellungen (z. B. Priorität "force" oder "prefer") für jedes Glossar. Sollten Sie auf unerwartete Abweichungen stoßen, hilft oft eine Reduzierung der Einträge oder die Aufnahme von Kontextbeispielen. Die technische Schnittstelle ist nur so gut wie die Qualität der Daten – investieren Sie deshalb in saubere, einheitliche Glossare.
Integration von Termbases in maschinelle Übersetzungsworkflows
Die Einbindung einer Terminologiedatenbank in den MT-Workflow erfordert eine durchdachte technische und organisatorische Umsetzung. Moderne MT-Systeme wie DeepL, Google Translate oder spezialisierte Plattformen bieten Schnittstellen, um Glossare als separate Dateien (CSV, TBX, XLSX) oder über APIs zu importieren. Entscheidend ist, dass die Termbase in der vom System unterstützten Formatierung vorliegt: TBX (TermBase eXchange) ist ein ISO-Standard, der sich für den Austausch zwischen verschiedenen Tools eignet. CSV-Dateien sind einfacher zu pflegen, erfordern aber eine saubere Spaltenstruktur mit Begriff, Übersetzung, optionaler Definition und Grammatikangaben.
In der Praxis hat es sich bewährt, die Termbase direkt im MT-System zu hosten, falls dies angeboten wird, anstatt sie jedes Mal manuell hochzuladen. Beispielsweise erlauben einige CAT-Tools wie memoQ oder Trados, Termdatenbanken mit dem MT-Engine zu verknüpfen. Bei cloudbasierten Diensten wie DeepL Pro können Sie ein Glossar im Kundenportal hinterlegen. Beachten Sie, dass die maximale Anzahl an Einträgen begrenzt sein kann – bei DeepL sind es 5.000 pro Glossar. Planen Sie daher eine Priorisierung der wichtigsten Fachbegriffe.
Ein häufiger Fehler ist die Annahme, dass die MT-Engine das Glossar automatisch auf jede Satzvariante anwendet. Tatsächlich berücksichtigen viele Systeme die Terminologie nur, wenn der Begriff exakt im Quelltext vorkommt. Flexionen, Zusammensetzungen oder Synonyme werden oft ignoriert. Um dies zu umgehen, können Sie „geschützte Begriffe“ definieren, die auch in gebeugter Form erkannt werden, sofern das System diese Funktion bietet. Testen Sie vor dem produktiven Einsatz, ob Ihre Termeinträge wirklich greifen.
Handlungsempfehlung: Führen Sie eine Testübersetzung mit 50–100 Sätzen durch, die Ihre kritischen Termini enthalten. Prüfen Sie den Output auf korrekte Wiedergabe. Falls das Glossar nicht wirkt, überprüfen Sie das Format, die Schreibweise (Groß-/Kleinschreibung) und die Sprachrichtung. Dokumentieren Sie den Workflow, sodass bei Updates der MT-Engine die Termbase problemlos neu importiert werden kann.
Prompt-Engineering für terminologiegesteuerte Übersetzung
Bei großen Sprachmodellen (LLMs) wie GPT-4 oder Claude, die über API für Übersetzungen genutzt werden, können Sie die Terminologie über Prompts steuern. Statt eines Glossars im herkömmlichen Sinne definieren Sie im Prompt, welche Begriffe wie übersetzt werden sollen. Ein bewährtes Vorgehen ist die Angabe von „Translation Rules“ im System-Prompt: „Übersetze folgende technische Begriffe immer wie angegeben: 'data warehouse' → 'Data-Warehouse', 'machine learning' → 'maschinelles Lernen'.“ Achten Sie darauf, die Regeln präzise und kontextfrei zu formulieren, da das Modell sonst eigene Interpretationen einfließen lässt.
Die Effektivität hängt stark vom Modell und der Prompt-Struktur ab. In der Praxis hat sich gezeigt, dass explizite Beispiele im Few-Shot-Prompt besser wirken als reine Anweisungen. Geben Sie 2–3 Musterpaare mit Quell- und Zieltext, in denen die gewünschte Terminologie vorkommt. Ergänzen Sie dann den zu übersetzenden Text. Vermeiden Sie dabei, dass das Modell die Beispiele als Teil des zu übersetzenden Texts auffasst – trennen Sie diese klar durch Formatierung wie """Beispiele""" und """Zu übersetzen""".
Ein Nachteil der Prompt-Methode ist die fehlende Persistenz: Jeder Prompt muss die Terminologie erneut enthalten, was bei vielen Anfragen unhandlich ist. Zudem reagieren LLMs empfindlich auf kleine Änderungen im Prompt – ein fehlendes Komma kann die Ausgabe verändern. Daher empfiehlt sich, für wiederkehrende Übersetzungen eine API-Anfrage zu programmieren, die den Prompt automatisch generiert und die Terminologie aus einer externen Datenbank lädt.
Handlungsempfehlung: Testen Sie verschiedene Prompt-Varianten mit denselben 20 Testbegriffen und vergleichen Sie die Ergebnisse. Notieren Sie, ob das Modell die Regeln zuverlässig befolgt oder Ausnahmen macht. Für produktive Workflows sollten Sie die Prompts versionieren und bei Modell-Updates erneut validieren. Setzen Sie Prompt-Engineering nur ein, wenn Ihre Infrastruktur die dynamische Generierung von Prompts erlaubt – andernfalls ist die klassische Glossar-Integration in MT-Systeme robuster.
Testen und Validieren von Glossareinträgen im MT-Output
Bevor Sie ein Glossar in den produktiven Übersetzungsworkflow übernehmen, ist eine systematische Prüfung unerlässlich. Erstellen Sie dafür eine Testsuite mit Sätzen, die Ihre wichtigsten Termini in verschiedenen Kontexten enthalten – z. B. im Singular, Plural, in Zusammensetzungen und in unterschiedlichen Satzstellungen. Übersetzen Sie diese mit aktiviertem und deaktiviertem Glossar, um die Wirkung isoliert zu messen. Automatisieren Sie diesen Schritt, wenn möglich, über die API: Vergleichen Sie den Output mit einem Referenzkorpus oder extrahieren Sie gezielt die Termvorkommen.
Die Validierung sollte nicht nur die korrekte Übersetzung des Begriffs selbst prüfen, sondern auch die grammatikalische Einbettung. Ein Glossar, das „Datenbank“ mit „database“ übersetzt, ist nutzlos, wenn im deutschen Satz der Dativ oder Akkusativ nicht korrekt gebildet wird. Manche MT-Systeme passen die Glossareinträge an den Satzkontext an (z. B. Flexion), andere nicht. Testen Sie daher bewusst schwierige Fälle: „mit der Datenbank“ vs. „die Datenbanken“. Wenn Sie Abweichungen feststellen, können Sie Glossareinträge mit erweiterten Attributen (z. B. POS-Tag) versehen, sofern das System dies unterstützt.
Ein weiterer Prüfpunkt ist die Vollständigkeit: Enthält Ihr Glossar alle relevanten Termini für den aktuellen Text? Führen Sie eine Coverage-Analyse durch, indem Sie den Quelltext nach Glossarbegriffen durchsuchen und die Trefferquote berechnen. Lücken können Sie durch zusätzliche Einträge schließen. Achten Sie jedoch darauf, dass ein überladenes Glossar die MT-Engine überfordern kann – manche Systeme priorisieren die ersten Einträge oder brechen bei zu vielen Regeln ab. Halten Sie die Anzahl pro Sprachpaar auf 200–500 Einträge, es sei denn, das System erlaubt explizit mehr.
Handlungsempfehlung: Legen Sie ein Validierungsprotokoll an, das für jeden Testfall das erwartete und das tatsächliche Ergebnis festhält. Führen Sie die Tests nach jedem Glossar-Update oder MT-System-Update erneut durch. Beziehen Sie Fachexperten ein, die die fachliche Richtigkeit bewerten. Nur wenn das Glossar im Test reproduzierbar die gewünschte Terminologie durchsetzt, sollte es in den Produktivbetrieb übernommen werden. Andernfalls müssen Sie die Einträge überarbeiten oder die Integrationstechnik optimieren.

Nachkontrolle und Qualitätssicherung: Terminologietreue prüfen
Die Steuerung der Terminologie durch Glossare ist ein mächtiges Werkzeug, doch die tatsächliche Einhaltung im Übersetzungsoutput muss überprüft werden. Eine reine Vertrauensstellung auf die KI reicht nicht aus. In der Praxis hat sich ein mehrstufiger Prüfprozess bewährt: Zunächst führen Sie automatische Checks durch, beispielsweise mit CAT-Tools oder speziellen QA-Skripten. Diese gleichen den Zieltext gegen Ihre Termbase ab und markieren Abweichungen oder fehlende Übersetzungen für bestimmte Begriffe. Ein praktisches Beispiel: Wenn Ihr Glossar für „Lastenheft“ die Übersetzung „specification document“ vorsieht, ein anderer Übersetzer aber „requirements document“ verwendet, wird dies in der QA-Liste aufgeführt.
Danach folgt die manuelle Prüfung durch einen Fachredakteur oder einen zweiten Übersetzer. Diese Person liest den Zieltext und achtet gezielt auf die im Glossar definierten Begriffe. Ein hilfreiches Vorgehen ist die Nutzung von Suchfunktionen im Dokument oder in der Übersetzungsumgebung, um alle Vorkommen der terminierten Begriffe zu lokalisieren und zu verifizieren. Alternativ können Sie auch eine Stichprobenkontrolle durchführen: Wählen Sie zehn bis zwanzig Schlüsselbegriffe aus dem Glossar aus und prüfen Sie, ob sie im gesamten Dokument konsistent übersetzt wurden. Dies ist insbesondere bei umfangreichen Projekten mit vielen Wiederholungen ein effizienter Ansatz.
Ein weiterer Aspekt ist die Sicherung der Konsistenz über mehrere Dateien oder Projektversionen hinweg. Hier bietet sich eine regelmäßige Terminologierecherche an, bei der alle Übersetzungen aus dem aktuellen Projekt mit der Termbase abgeglichen werden. Ein praktisches Beispiel aus der technischen Dokumentation: In einem Handbuch für eine Maschine taucht der Begriff „Sicherheitsabschaltung“ auf. Das Glossar schreibt „safety shutdown“ vor. Wenn in einer späteren Revision „emergency stop“ verwendet wird, ist dies ein Fall für die Nachkontrolle. Die Entscheidung, ob es sich um einen Fehler handelt oder ob der Begriff je nach Kontext anders übersetzt werden muss, sollte dokumentiert werden.
Abschließend empfehlen wir, die Ergebnisse der Nachkontrolle systematisch zu erfassen und in einem Feedback-Loop an das Glossar zurückzuspielen. Wenn ein Begriff im Glossar nicht zu treffenden Übersetzungen führt, sollten Sie den Eintrag anpassen oder ergänzen. So wird die Termbase kontinuierlich verbessert. Beachten Sie jedoch, dass die Prüfung der Terminologietreue rechtliche Implikationen haben kann – insbesondere in regulierten Bereichen wie Medizin oder Rechtstechnik. Konsultieren Sie hierzu Ihre Rechtsabteilung oder einen externen Berater.
Grenzen der Terminologiesteurung und Umgang mit Ausnahmen
Auch bei sorgfältig gepflegten Glossaren stößt die Terminologiesteurung an Grenzen. Maschinelle Übersetzungssysteme interpretieren Glossare oft strikt, was zu unerwünschten Ergebnissen führen kann, wenn Kontext oder Polysemie nicht berücksichtigt werden. Ein häufiges Problem: Ein Begriff hat je nach Satz oder Fachgebiet unterschiedliche Übersetzungen. Wenn das Glossar nur eine Variante vorgibt, übersetzt die MT diese zwanghaft, selbst wenn der Kontext eine andere Bedeutung erfordert. Beispiel: Das englische Wort „bank“ kann im Deutschen sowohl „Bank“ (Finanzinstitut) als auch „Ufer“ bedeuten. Ein Glossar, das „Bank“ als Finanzinstitut definiert, führt bei „river bank“ zu einer Fehlübersetzung. Hier müssen Sie Ausnahmen zulassen.
Ein pragmatischer Umgang besteht darin, Glossare nicht als starre Regeln, sondern als bevorzugte Übersetzungen zu definieren. Viele MT-Systeme erlauben die Einstellung einer Priorität: Das Glossar wird berücksichtigt, kann aber durch den Kontext überstimmt werden (z. B. über ein Confidence-Level). In der Praxis hat sich bewährt, für mehrdeutige Begriffe separate Glossareinträge mit Bedingungen zu hinterlegen – etwa durch Angabe des Themenbereichs oder einer Beispielphrase. So kann das System bei „river bank“ die Übersetzung „Ufer“ wählen, wenn der Begriff in einem geografischen Kontext erscheint.
Eine weitere Grenze zeigt sich bei Neologismen oder Eigennamen, die noch nicht in der Termbase enthalten sind. Die MT kann diese entweder unübersetzt lassen oder eine kreative, aber falsche Übersetzung liefern. Hier ist eine manuelle Nachbearbeitung unumgänglich. Ein praktisches Beispiel: Der Produktname „SpeedMaster 3000“ sollte im Englischen nicht übersetzt werden. Steht der Begriff nicht im Glossar, riskiert das System eine Übersetzung wie „Geschwindigkeitsmeister 3000“. Um das zu vermeiden, sollten Sie Eigennamen explizit als unveränderlich markieren.
Schließlich kann eine Übersteuerung durch zu viele oder zu detaillierte Glossareinträge die Übersetzungsqualität beeinträchtigen. Wenn jedes Wort eine feste Vorgabe erhält, verliert die MT ihre Fähigkeit, flüssigen und natürlichen Text zu generieren. Die Lösung: Priorisieren Sie Schlüsselbegriffe und lassen Sie bei weniger kritischen Begriffen dem System freie Wahl. Überprüfen Sie nach jedem größeren Projekt, welche Glossareinträge tatsächlich zu Verbesserungen geführt haben und welche eher schaden. Rechtlich relevant kann die Frage der Haftung bei Terminologiefehlern sein – lassen Sie sich hierzu von einem Juristen beraten.
Automatische Termextraktion als Basis für Glossare
Der Aufbau eines Glossars von Hand ist zeitaufwendig. Eine effiziente Alternative ist die automatische Termextraktion aus vorhandenen Referenztexten. Hierbei wird mithilfe von Software – etwa TAUS, Sketch Engine oder integrierten Tools in CAT-Systemen – eine Liste potenzieller Fachbegriffe aus einem Korpus gewonnen. Die Extraktion basiert auf statistischen und linguistischen Methoden: Das System sucht nach wiederkehrenden Wortgruppen (Kollokationen) oder seltenen Wörtern, die für das Fachgebiet typisch sind. Ein typisches Vorgehen: Sie laden eine Sammlung von 10 bis 20 sorgfältig übersetzten Dokumenten in die Software und lassen diese einen Frequenzanalyse durchführen. Begriffe, die häufig und in verschiedenen Kontexten vorkommen, werden als Termkandidaten markiert.
Die so gewonnenen Kandidaten müssen jedoch manuell validiert werden. Nicht jeder häufige Begriff ist ein relevanter Terminus – allgemeinsprachliche Wörter wie „Arbeit“ oder „System“ können als Rauschen auftauchen. Ein praktisches Beispiel: Bei der Extraktion aus einer technischen Dokumentation könnte der Algorithmus den Begriff „Schraube“ als wichtig einstufen, tatsächlich handelt es sich aber um eine alltägliche Bezeichnung. Hier ist ein Fachredakteur gefragt, der die Liste sichtet und irrelevante Einträge entfernt. Bewährt hat sich eine Zweiphasen-Prüfung: Erstens eine automatische Vorauswahl nach Frequenz und statistischer Signifikanz (z. B. mittels TF-IDF), zweitens eine manuelle Überprüfung der Top-100-Kandidaten durch einen Domänenexperten.
Ein weiterer Vorteil der automatischen Termextraktion ist die Möglichkeit, mehrsprachige Glossare zu generieren. Wenn Sie parallele Referenztexte in der Ausgangs- und Zielsprache besitzen, kann die Software auch Übersetzungsvorschläge für die extrahierten Terme liefern. Dies geschieht durch Alignment-Verfahren, die Satz- oder Wortpaare erkennen. Die Qualität dieser Vorschläge variiert: Bei gutem Parallelmaterial (z. B. aus konsistenten Übersetzungen) sind die Ergebnisse oft verwendbar, bei minderwertigen Daten jedoch fehleranfällig. Daher sollte jeder automatisch generierte Übersetzungsvorschlag vor der Aufnahme ins Glossar von einem Muttersprachler geprüft werden.
Die automatische Termextraktion eignet sich besonders als erster Schritt für den Aufbau eines Glossars oder zur Aktualisierung bestehender Termbases. Sie spart Zeit und deckt Begriffe auf, die bei manueller Erstellung übersehen werden könnten. Allerdings ersetzt sie nicht die menschliche Qualitätskontrolle. Ein hybrider Ansatz – automatische Vorauswahl plus manuelle Prüfung – liefert in der Praxis die besten Ergebnisse. Beachten Sie bei der Nutzung von Termextraktionsdiensten zudem datenschutzrechtliche Aspekte, insbesondere wenn Ihre Referenztexte vertrauliche Informationen enthalten. Klären Sie dies im Vorfeld mit Ihrer Rechtsabteilung.
Ein durchdachtes Glossar ist der Schlüssel, um KI-Übersetzungen präzise und konsistent zu steuern. Erfahren Sie, wie Sie Terminologiedatenbanken aufbauen, in MT-Workflows integrieren und typische Fallstricke vermeiden. Praxisnahe Tipps für Übersetzer, Projektmanager und Unternehmen, die ihre mehrsprachige Kommunikation optimieren möchten.
Terminologievarianten: Mehrdeutigkeit und Kontext erkennen
In der Praxis stoßen Übersetzer und Projektmanager häufig auf Begriffe, die je nach Kontext unterschiedlich übersetzt werden müssen. Ein klassisches Beispiel ist das englische „lead“: Im Marketing kann es „Lead“ (potenzieller Kunde) bedeuten, in einem technischen Handbuch aber „Kabel“ oder „Bleiverglasung“. Ohne Kontexterkennung kann die KI-Übersetzung hier falsch liegen. Die Herausforderung besteht darin, solche Mehrdeutigkeiten systematisch zu erfassen und im Glossar mit kontextabhängigen Regeln zu hinterlegen.
Ein wirksamer Ansatz ist die Verwendung von Kontextattributen in der Termbasis. Statt eines einzigen Eintrags für „lead“ legen Sie mehrere an, jeweils mit Angabe des Fachbereichs (z. B. Marketing, Elektrotechnik, Medizin). In Ihrem MT-System können Sie dann Regeln definieren, die je nach Quelldokument-Kategorie oder sogar Satzumgebung die passende Übersetzung wählen. Praktisch bedeutet das: Sie pflegen im Glossar Felder wie „Kontext“, „Quellbeispiel“ und „Zielbeispiel“. So erkennt die Engine bei „lead generation“ sofort den Marketing-Kontext und wählt „Lead-Generierung“. Diese Feingranularität erfordert zwar mehr Pflege, reduziert aber Nachkorrekturen deutlich.
Um den Aufwand zu begrenzen, priorisieren Sie die häufigsten oder kritischsten Mehrdeutigkeiten. Führen Sie eine Liste mit den Top-50-Begriffen, die in Ihren Texten immer wieder falsch übersetzt werden. Analysieren Sie bestehende Übersetzungen und notieren Sie, in welchen Kontexten die Fehler auftreten. Legen Sie dann für diese Begriffe kontextsensitive Einträge an. Nutzen Sie dafür die Möglichkeiten Ihrer MT-Plattform: Viele Systeme erlauben bedingte Übersetzungsregeln, die auf Wortarten, benachbarten Begriffen oder Dokumentmetadaten basieren.
Testen Sie diese Einträge gezielt: Erstellen Sie einen kurzen Satz mit jedem Kontext und prüfen Sie den Output. Beispielsweise für „lead“: „The lead is 2 cm long“ (Elektrotechnik) vs. „The lead clicked on the CTA“ (Marketing). Passen Sie die Regeln iterativ an. Dokumentieren Sie die Entscheidungen im Glossar, damit alle Teammitglieder die Logik nachvollziehen können. Mit der Zeit entsteht so ein fein abgestimmtes Regelwerk, das die Übersetzungsqualität in Ihrem Fachgebiet spürbar steigert.

Kosten-Nutzen-Abwägung: Aufwand für Glossarpflege vs. Qualitätsgewinn
Die Pflege einer Terminologiedatenbank bindet Ressourcen: Zeit für die Recherche, Abstimmung im Team, technische Integration und regelmäßige Aktualisierung. Gleichzeitig sinken durch konsistente Terminologie die Korrekturaufwände in der Nachbearbeitung und die Zufriedenheit der Leser steigt. Eine pauschale Aussage zum ROI ist nicht möglich, da er stark vom Textvolumen, der Fehlerhäufigkeit und den Konsequenzen falscher Übersetzungen abhängt. In der Praxis zeigt sich: Sobald Sie mehr als 50.000 Wörter pro Monat übersetzen oder Ihr Unternehmen in stark regulierten Bereichen (Medizin, Recht, Technik) tätig ist, amortisiert sich der Aufwand meist innerhalb weniger Monate.
Führen Sie eine Aufwandsabschätzung durch: Notieren Sie, wie viele Stunden Sie aktuell für die Korrektur von Terminologiefehlern aufwenden. Messen Sie über zwei bis drei Projekte den Zeitaufwand für die Nachbearbeitung. Schätzen Sie dann, wie viele dieser Fehler durch ein gut gepflegtes Glossar vermeidbar wären – erfahrungsgemäß sind es 30–50 %. Vergleichen Sie dies mit dem geschätzten Pflegeaufwand: Ein Grundglossar mit 200 Einträgen benötigt initial etwa 20–40 Stunden, die monatliche Pflege (bei 10–20 Änderungen) etwa 2–4 Stunden. Rechnen Sie hoch, ob die eingesparte Korrekturzeit diese Investition übersteigt.
Berücksichtigen Sie auch weiche Faktoren: Einheitliche Terminologie stärkt die Markenwahrnehmung und vermeidet Missverständnisse bei Kunden. Bei technischen Dokumenten können falsche Begriffe zu Fehlfunktionen oder Sicherheitsrisiken führen – der Schaden übersteigt dann jeden Glossaraufwand. Starten Sie mit einem minimalen, aber fokussierten Glossar: Legen Sie nur die Begriffe an, die wirklich häufig vorkommen oder kritisch sind. Erweitern Sie es nach und nach basierend auf den häufigsten Korrekturen.
Um den Nutzen messbar zu machen, definieren Sie Metriken: Terminologiefehler pro 1.000 Wörter im MT-Output vor und nach Glossareinführung. Messen Sie diese über einen Zeitraum von drei Monaten. So sehen Sie objektiv, ob die Qualität steigt. Falls der Aufwand den Nutzen übersteigt, prüfen Sie, ob Sie die Pflege automatisieren können – etwa durch Termextraktionstools oder Integration in Ihr CMS. In vielen Fällen lohnt sich die Investition, wenn Sie langfristig denken und die Glossarpflege als festen Bestandteil Ihres Übersetzungsprozesses etablieren.
Praktische Checkliste: Glossareinführung im Team
Die Einführung eines Glossars für die KI-Übersetzung gelingt nur, wenn alle Beteiligten an einem Strang ziehen. Nutzen Sie die folgende Checkliste, um Ihren Prozess strukturiert anzugehen.
1. Bestandsaufnahme und Ziele definieren: Analysieren Sie Ihre häufigsten Terminologiefehler aus den letzten Projekten. Definieren Sie konkrete Ziele, z. B. „Reduzierung der Terminologiefehler im MT-Output um 30 % innerhalb von drei Monaten“. Legen Sie fest, welche Fachbereiche und Sprachen priorisiert werden sollen.
2. Team zusammenstellen und Rollen verteilen: Benennen Sie einen Terminologieverantwortlichen, der das Glossar pflegt und Änderungen koordiniert. Binden Sie Fachexperten (z. B. Techniker, Juristen) ein, die bei strittigen Begriffen entscheiden. Der Übersetzer/Lektor prüft die Einträge auf Praxistauglichkeit.
3. Glossarstruktur festlegen: Entscheiden Sie, welche Felder Ihr Glossar enthalten soll: Quellbegriff, Zielbegriff, Definition, Kontext, Fachbereich, Status (freigegeben/veraltet), Gültigkeitsdatum. Halten Sie die Struktur einfach – zu viele Felder erschweren die Pflege.
4. Erste Einträge sammeln und freigeben: Starten Sie mit 50–100 kritischen Begriffen. Jeder Eintrag sollte von mindestens zwei Teammitgliedern geprüft werden. Dokumentieren Sie Entscheidungen inklusive Begründung, um spätere Diskussionen zu vermeiden.
5. Technische Integration testen: Binden Sie das Glossar in Ihr MT-System ein. Testen Sie mit repräsentativen Texten aus Ihrem Bestand. Prüfen Sie, ob die Regeln wie erwartet greifen. Nehmen Sie Anpassungen vor, bis die Ergebnisse zufriedenstellend sind.
6. Team schulen und Prozesse etablieren: Schulen Sie alle Übersetzer, Editoren und Projektmanager im Umgang mit dem Glossar. Legen Sie fest, wie neue Begriffe vorgeschlagen werden (z. B. über ein Formular) und wer sie freigibt. Etablieren Sie einen monatlichen Review-Zyklus, in dem das Glossar aktualisiert wird.
7. Erfolg messen und iterieren: Messen Sie regelmäßig die Terminologiefehlerquote. Sammeln Sie Feedback aus dem Team und passen Sie das Glossar an. Feiern Sie kleine Erfolge, um die Motivation hochzuhalten.
Mit dieser Checkliste schaffen Sie eine solide Basis für die Glossareinführung. Der Schlüssel liegt in der konsequenten Pflege und der Einbindung aller Beteiligten. Starten Sie klein und erweitern Sie das Glossar schrittweise – so bleibt der Aufwand überschaubar und der Qualitätsgewinn spürbar.
Werkzeuge und Plattformen für Terminologiemanagement
Die Wahl der richtigen Terminologieverwaltung hängt maßgeblich von der Größe des Unternehmens, der Anzahl der Sprachen und der Integration mit bestehenden Übersetzungstools ab. Für Einsteiger bieten cloudbasierte Lösungen einen niederschwelligen Einstieg: Sie ermöglichen zentralen Zugriff, Versionskontrolle und Benutzerrechte. Ein typisches Setup umfasst ein Web-Interface zur Pflege von Einträgen mit Feldern wie Begriff, Definition, Sprache, Status (z. B. „freigegeben“ oder „in Prüfung“) sowie Synonymen und Ungültigkeitsvermerken. Wichtig ist die Exportfunktion in Standardformate wie TBX (TermBase eXchange) oder CSV, damit die Daten in CAT-Tools oder MT-Plattformen importiert werden können.
Für Unternehmen mit hohem Übersetzungsvolumen bieten sich Plattformen an, die eine direkte API-Anbindung an gängige MT-Systeme unterstützen. Dabei wird das Glossar beim Übersetzungsvorgang live abgefragt: Der MT-Engine werden die relevanten Terme als Kontext übergeben. Die Effektivität hängt vom Prompt-Design ab – erfahrungsgemäß sollten Glossareinträge mit Quellenangabe und Kontextbeispielen versehen sein, um Fehlinterpretationen zu vermeiden. Einige Tools erlauben zudem die Regelung von Prioritäten: Wenn ein Begriff in mehreren Glossaren vorkommt, entscheidet die Rangfolge über die Anwendung. Achten Sie bei der Auswahl darauf, dass Übersetzer im CAT-Tool die Möglichkeit haben, nicht korrekt befolgte Terme zu markieren und direkt im Glossar zu ändern.
Die Integration in den QA-Prozess ist ein weiteres Schlüsselkriterium. Moderne Plattformen bieten automatische Prüfungen: Nach der Übersetzung wird der Output gegen das Glossar validiert, Abweichungen werden aufgelistet. In der Praxis hat sich ein Workflow mit zwei Schritten bewährt: Erstens eine maschinelle Konsistenzprüfung, zweitens eine stichprobenartige manuelle Kontrolle durch den Terminologen. Für globale Teams empfehlen sich kollaborative Funktionen wie Kommentare oder Änderungsvorschläge, damit auch Fachabteilungen Feedback geben können. Vorsicht bei zu vielen Freiheiten: Definieren Sie klar, wer Einträge freigeben darf, um Wildwuchs zu vermeiden.
Abschließend sollten Sie die Kosten im Blick behalten: Basislösungen sind oft ab einem bestimmten Volumen kostenlos, Enterprise-Funktionen schlagen mit monatlichen Gebühren zu Buche. Prüfen Sie, ob eine einmalige Lizenz oder ein Abo-Modell für Ihr Budget sinnvoller ist. Berücksichtigen Sie auch die Einarbeitungszeit: Je interaktiver die Oberfläche, desto schneller arbeiten Redakteure. Lassen Sie sich vor der Entscheidung einen Proof of Concept mit Ihren Echtdaten zeigen – nur so sehen Sie, wie gut die Terminologie im MT-Output ankommt. Rechtliche Hinweise zu Datenhaltung und DSGVO beachten Sie bitte mit eigener Rechtsberatung.
Ausblick: Adaptive Terminologie und kontinuierliches Lernen
Die nächste Entwicklungsstufe der terminologiegesteuerten Übersetzung ist die adaptive Terminologie. Dabei handelt es sich um Systeme, die aus Korrekturen der Anwender lernen und ihr Glossar automatisch aktualisieren. Stellen Sie sich vor: Ein Übersetzer ändert im CAT-Tool einen Begriff, der vom MT-System falsch übersetzt wurde. Das Modell merkt sich diesen Eingriff und wendet ihn bei ähnlichen Kontexten an. Dieses kontinuierliche Lernen reduziert den manuellen Pflegeaufwand erheblich. Erste Anbieter integrieren solche Feedback-Loops bereits: Nach jeder genehmigten Übersetzung wird die Term-Übersetzung in die Knowledge Base des MT-Modells übernommen. In der Praxis zeigt sich jedoch, dass die Qualität dieser automatischen Übernahmen variiert – zu viele ungeprüfte Korrekturen können zu Inkonsistenzen führen.
Die technische Grundlage bilden Modelle, die mit Retrieval-Augmented Generation (RAG) arbeiten: Bei jeder Übersetzung wird nicht nur das Glossar abgefragt, sondern auch der Kontext aus dem aktuellen Satz sowie aus früher korrigierten Beispielen. Dadurch entsteht ein dynamisches Profil pro Kunde oder Domäne. Die Herausforderung liegt in der Abwägung zwischen Aktualität und Stabilität: Ein Glossareintrag, der einmal falsch gelernt wurde, kann schwer zu korrigieren sein. Empfehlenswert ist daher ein zweistufiger Prozess: Im Lernmodus werden Vorschläge gesammelt, aber erst nach manueller Freigabe ins Produktivglossar übernommen. Unternehmen sollten regelmäßig einen Export des gelernten Termbestands anfertigen, um ihn mit dem autoritativen Glossar abzugleichen.
Ein weiterer Trend ist die kontextabhängige Terminologie: Nicht jeder Begriff wird in jedem Fachgebiet gleich übersetzt. Adaptive Systeme können erkennen, ob ein Text aus dem juristischen oder technischen Bereich stammt, und automatisch das passende Subglossar aktivieren. Dies setzt voraus, dass die Terminologie mit Metadaten wie Fachgebiet, Kunde oder Dokumenttyp versehen ist. In der Praxis erfordert dies eine saubere Klassifikation der Ausgangstexte. Für viele Unternehmen ist ein pragmatischer Ansatz sinnvoll: Starten Sie mit einem zentralen Glossar und erweitern Sie es um Domänen-Marker, sobald Fehlerhäufungen in bestimmten Bereichen auftreten.
Die Grenzen adaptiver Verfahren liegen in der Transparenz und Kontrolle. Wenn ein System selbstständig lernt, ist nicht immer nachvollziehbar, warum eine bestimmte Übersetzung gewählt wurde. Daher sollte gerade in regulierten Branchen (Medizin, Recht) die finale Entscheidung stets beim Menschen liegen. Ein Ausblick: In Zukunft könnten Glossare direkt in das Fine-Tuning von KI-Modellen einfließen, statt nur per Prompt übergeben zu werden. Das verspricht konsistentere Ergebnisse, erfordert aber hohe Rechenkapazitäten und regelmäßige Updates. Unternehmen, die früh in strukturierte Terminologie investieren, haben hier einen klaren Vorteil. Lassen Sie sich von Ihrem MT-Anbieter die Roadmap zur adaptiven Terminologie erläutern – und testen Sie neue Funktionen stets in einer geschützten Umgebung, bevor Sie sie produktiv einsetzen.
Fallstricke und typische Fehler bei der Glossararbeit
Selbst ein sorgfältig erstelltes Glossar kann seine Wirkung verfehlen, wenn typische Fallstricke nicht beachtet werden. Ein häufiger Fehler ist die Überladung des Glossars mit zu vielen Einträgen. In der Praxis zeigt sich, dass ein Glossar mit 100 bis 200 gepflegten Termini für die meisten Projekte ausreicht. Mehr Einträge führen oft zu Inkonsistenzen und erhöhen den Pflegeaufwand, ohne dass die Qualität proportional steigt. Konzentrieren Sie sich auf die für Ihr Fachgebiet kritischen Begriffe, bei denen Fehlübersetzungen besonders schwer wiegen, etwa juristische oder technische Fachtermini.
Ein weiterer Fallstrick sind unzureichende Kontextangaben. Ein Eintrag wie "Kopf" -> "head" ohne Unterscheidung zwischen "Kopf einer Schraube", "Kopf eines Teams" oder "Kopf einer Liste" führt zu Fehlern. Jeder Eintrag sollte mindestens eine kurze Definition oder einen Beispielsatz enthalten. Auch das Ignorieren von Wortarten ist problematisch: Ein Glossar, das "überweisen" nur als Verb führt, übersetzt das Substantiv "Überweisung" nicht korrekt. Ergänzen Sie daher für jeden Terminus die relevante Wortart und ggf. Flexionsformen.
Die Aktualisierung des Glossars wird häufig vernachlässigt. Sobald neue Produkte eingeführt oder Benennungen geändert werden, muss das Glossar zeitnah angepasst werden. Planen Sie feste Intervalle für die Überprüfung, etwa quartalsweise. Fehlt diese Pflege, wandert das Glossar in die Ablage und wird nicht mehr genutzt. Achten Sie zudem darauf, dass das Glossar im MT-System tatsächlich aktiviert ist. Manche Systeme erlauben mehrere Glossare, die priorisiert werden können. Prüfen Sie nach jedem Update, ob die Änderungen im Output sichtbar sind.
Ein klassischer Irrtum ist die Annahme, ein Glossar allein löse alle Terminologieprobleme. Es kann keine Grammatik- oder Stilfragen klären und stößt bei stark kontextabhängigen Begriffen an Grenzen. Ergänzen Sie daher das Glossar um Übersetzungsregeln im Formular von „Wenn-dann“-Bedingungen, soweit das System dies unterstützt. Und schließlich: Holen Sie Feedback von den Übersetzern ein. Oft können diese praxisnah berichten, welche Einträge fehlen oder fehlerhaft sind. Nur ein lebendiges Glossar, das regelmäßig überprüft und angepasst wird, erfüllt seinen Zweck.
Zusammenarbeit mit Dienstleistern: Briefing und Kontrolle
Wenn Sie die Glossarpflege oder die terminologiegesteuerte Übersetzung an externe Dienstleister vergeben, ist ein klares Briefing entscheidend. Definieren Sie im Vorfeld, welche Termini für Ihr Unternehmen nicht verhandelbar sind. Erstellen Sie dazu eine Prioritätenliste: Must-have-Termini, die exakt übersetzt werden müssen, und Nice-to-have-Termini, bei denen leichte Varianz akzeptabel ist. Übergeben Sie dem Dienstleister kein Roh-Glossar, sondern eine bereinigte Version mit eindeutigen Felddefinitionen (z. B. „Nur im Kontext Maschinenbau“). Fehlt diese Klarheit, übersetzen Dienstleister nach eigenem Ermessen.
Ein bewährtes Vorgehen ist, dem Dienstleister vorab ein Musterkonvolut von 200–300 Segmenten zur Verfügung zu stellen, anhand dessen er die Terminologieanwendung demonstrieren muss. Lassen Sie sich die korrekte Integration des Glossars in dessen MT-Workflow bestätigen. Fragen Sie nach, ob das Glossar als TBX- oder XLSX-Datei importiert werden kann – viele Dienstleister nutzen Standardformate. Prüfen Sie nach der ersten Lieferung stichprobenartig die Terminologietreue. In der Praxis hat sich eine 10%-Stichprobe des Outputs bewährt, bei der Sie die Glossareinträge abgleichen. Treten Fehler auf, fordern Sie eine Korrektur ein, bevor der Dienstleister die Restmenge bearbeitet.
Kontrollmechanismen müssen von Anfang an vereinbart werden. Lassen Sie sich einen Report über die Anzahl der verwendeten Glossareinträge und deren Match-Rate ausstellen. Manche MT-Plattformen bieten standardisierte Logs darüber, welche Termini wie oft gegriffen haben. Dieser Report sollte monatlich oder projektbezogen vorgelegt werden. Falls der Dienstleister eigene Terminologiedatenbanken pflegt, klären Sie, ob diese mit Ihrem Glossar überschrieben oder ergänzt werden. Ein Missverständnis führt sonst zu parallel existierenden, widersprüchlichen Glossaren.
Achten Sie auf die rechtliche Seite: Vereinbaren Sie im Vertrag die Eigentumsrechte am Glossar. Stellen Sie klar, dass das Glossar Ihr geistiges Eigentum bleibt und der Dienstleister es nur für Ihr Projekt nutzen darf. Besprechen Sie auch den Umgang mit Änderungen: Wer aktualisiert das Glossar bei neuen Termini? Wie werden Korrekturschleifen abgerechnet? Ein transparenter Kommunikationskanal, z. B. ein Ticketsystem für Terminologiefragen, verhindert Missverständnisse. Bei größeren Projekten empfiehlt sich ein gemeinsamer Terminologie-Workshop zu Projektbeginn – dieser Aufwand lohnt sich, um spätere Reibungsverluste zu vermeiden. Für rechtliche Details sollten Sie stets Ihren eigenen Rechtsberater hinzuziehen.
blog.faqT
Wie groß sollte ein Glossar für die KI-Übersetzung sein?
Die optimale Größe hängt vom Fachgebiet und der Anzahl der Zielsprachen ab. Für ein spezifisches Projekt reichen oft 50 bis 200 Einträge. Wichtig ist, die relevantesten Begriffe mit hohem Einfluss auf Konsistenz und Korrektheit auszuwählen. Ein zu umfangreiches Glossar kann die Performance von MT-Systemen beeinträchtigen. Experten empfehlen, mit einem Kern-Glossar zu starten und dieses iterativ zu erweitern.
Welche Formate eignen sich für den Austausch von Glossaren mit MT-Systemen?
Gängige Formate sind CSV, TBX (TermBase eXchange) und XLSX. CSV ist universell einsetzbar, während TBX speziell für Terminology-Management entwickelt wurde und komplexe Metadaten unterstützt. Viele MT-Plattformen akzeptieren auch JSON oder proprietäre Formate. Achten Sie auf korrekte Kodierung (UTF-8) und konsistente Spaltenbenennung. Testen Sie vor Produktivbetrieb, ob alle Begriffe korrekt importiert werden.
Wie oft sollte ein Glossar aktualisiert werden?
Die Aktualisierung erfolgt idealerweise kontinuierlich: Jede Übersetzung, die neue oder abweichende Terminologie enthält, sollte geprüft werden. In dynamischen Fachgebieten wie Technik oder Medizin empfiehlt sich eine monatliche Review. Für stabilere Bereiche reicht ein quartalsweises Update. Wichtig ist, dass Änderungen dokumentiert und mit dem Team kommuniziert werden. Ein festgelegter Verantwortlicher für die Glossarpflege erhöht die Nachhaltigkeit.