← Hauptseite Kontakt & Beratung

aikitext.com

Leitfaden & Hinweise zur maschinellen Übersetzung (NMT & KI)

1. Die Grenzen der Maschinenübersetzung

Die Grenzen der Maschinenübersetzung liegen trotz moderner neuronaler Modelle (NMT) und KI-Systeme vor allem im mangelnden echten Sprach- und Kontextverständnis. Während Grammatik und Vokabular meist präzise verarbeitet werden, stoßen Systeme in folgenden Bereichen an klare Grenzen:

  • Kontext & Diskurs: Maschinen übersetzen primär auf Satz- oder Paragraphenebene. Globale Zusammenhänge, Verweise auf vorherige Kapitel oder implizite Informationen gehen häufig verloren.
  • Kultur & Idiomatik: Redewendungen ("Um den heißen Brei herumreden"), Wortspiele, Witze und Metaphern lassen sich selten wortwörtlich übertragen und erfordern kulturelles Adaptieren (Lokalisierung).
  • Nuancen, Ironie & Tonalität: Subtile Zwischentöne, Ironie, Sarkasmus oder die gezielte Wahl von Du/Sie sowie feine Registerunterschiede (formell vs. informell) werden oft nicht korrekt erfasst.
  • Fachsprache & Mehrdeutigkeit: Homonyme (Wörter mit mehreren Bedeutungen wie "Schloss" oder "Bank") führen ohne ausreichend ausgeprägten Kontext zu Fehlübersetzungen.
  • Fehlende Weltkenntnis (World Knowledge): KI besitzt kein reales Weltverständnis, sondern berechnet Wahrscheinlichkeiten. Sie unterscheidet nicht zwischen faktisch logischen und unlogischen Sachverhalten.
  • Datenschutz & Vertraulichkeit: Die Eingabe sensibler Unternehmens- oder Personendaten in öffentliche Übersetzungsdienste birgt erhebliche datenschutzrechtliche Risiken (DSGVO).
Fazit

Maschinenübersetzung eignet sich hervorragend für schnelle Informationserfassungen, standardisierte Fachtexte und als Entwurfsgrundlage. Für juristische Dokumente, Marketingtexte, Literatur oder sicherheitsrelevante Inhalte bleibt das Post-Editing durch menschliche Übersetzer unverzichtbar.

2. Pre-Editing: Ausgangstexte optimieren

Beim Pre-Editing geht es darum, den ausgangssprachlichen Text so aufzubereiten, dass neuronale Übersetzungsmodelle (NMT) ihn ohne Missverständnisse oder Satzbaufehler verarbeiten können. Je klarer und strukturierter das Original, desto präziser ist das maschinelle Ergebnis.

Die wichtigsten Regeln:

  1. Kurze, einfache Satzstrukturen nutzen: Vermeide Schachtelsätze, Bandwurmsätze und Klammereinschübe. Ein Satz sollte idealerweise nur einen Hauptgedanken enthalten (Richtwert: max. 15–20 Wörter).
  2. Eindeutige Wortwahl bevorzugen: Verzichte auf Homonyme (Mehrdeutigkeiten) und Metaphern. Verwendest du z. B. "Leiter", erstelle den Satz so, dass klar wird, ob das Arbeitsgerät oder die Führungsperson gemeint ist.
  3. Terminologie konsequent einhalten: Benutze für denselben Begriff im gesamten Text stets dasselbe Wort (keine Synonyme zur "stilistischen Abwechslung"). Das verhindert Verwirrung im System.
  4. Passivkonstruktionen und Genitive vermeiden: Das Passiv führt in vielen Sprachen zu ungenauen Zuordnungen. Formuliere Sätze lieber aktiv ("Der Techniker prüft die Datei" statt "Die Datei wird vom Techniker geprüft").
  5. Vollständige Sätze formulieren: Vermeide Telegrammstil, elliptische Sätze oder fehlende Pronomen. NMT-Systeme benötigen vollständige grammatikalische Strukturen zur Orientierung.
  6. Rechtschreibung und Interpunktion prüfen: Tippfehler, fehlende Kommas oder falsche Groß-/Kleinschreibung führen bei KI-Modellen schnell zu falschen Satzanalysen und fehlerhaften Begriffen.
  7. Kulturelle Eigenheiten und Idiome streichen: Redewendungen ("Das liegt auf der Hand") oder sprachspezifischer Humor lassen sich nicht eins zu eins übersetzen und sollten durch direkte Beschreibungen ersetzt werden.
  8. Sonderzeichen und Abkürzungen reduzieren: Abkürzungen werden oft falsch interpretiert. Schreibe Begriffe aus oder nutze branchenübliche Standards.
Grundregel

Schreiben für die Maschinenübersetzung entspricht im Wesentlichen den Prinzipien der Leichten Sprache bzw. des Technical Writings (Controlled Language).

3. Post-Editing (PE) nach ISO 18587

Beim Post-Editing wird der von einer Maschine erzeugte Zieltext von einer menschlichen Fachkraft überprüft und korrigiert. Die Tiefe der Nachbearbeitung richtet sich dabei nach dem Verwendungszweck des Textes.

1. Qualitätsstufen

  • Light Post-Editing (LPE): Ziel ist ein rein verständlicher und grammatikalisch korrekter Text. Stilistische Feinheiten werden ignoriert. (Typisch für interne Dokumente, Support-Tickets oder Wissensdatenbanken).
  • Full Post-Editing (FPE): Ziel ist eine Qualität, die von einer rein menschlichen Übersetzung nicht zu unterscheiden ist. Umfasst volle stilistische, terminologische und kulturelle Anpassung. (Typisch für Marketing, Verträge, Veröffentlichungen).

2. Die zentralen Arbeitsschritte

  • Vollständigkeit und Sinngehalt prüfen: Sicherstellen, dass keine Satzteile, Zahlen, Codes oder Aufzählungspunkte von der Maschine ausgelassen oder hinzuerfunden wurden (Halluzinationen). Den Sinn des Ausgangstextes getreu wiedergeben.
  • Terminologie und Glossar-Treue abgleichen: Überprüfen, ob fachspezifische Begriffe und vorgegebene Corporate-Language-Glossare korrekt eingehalten wurden. Konsistenz im Gesamtdokument sicherstellen.
  • Grammatik, Syntax und Rechtschreibung korrigieren: Typische Maschinenzusammenstöße auflösen (z. B. falsche Wortstellung, fehlerhafte Bezüge von Pronomen, falsche Fugen-S bei Zusammensetzungen). Interpunktion und Typos korrigieren.
  • Register, Tonalität und Anrede anpassen: Überprüfen, ob die korrekte Höflichkeitsform (Du/Sie) durchgängig verwendet wurde. Tonalität an Zielgruppe und Texttyp anpassen.
  • Formatierung und Tags kontrollieren: Tags, Links, Platzhalter (z. B. {user_name}) und Formatierungen (Fettung, Kursivierung) auf Richtigkeit und Vollständigkeit im Zieltext prüfen.
Empfohlene Faustregel für effizientes Post-Editing

Korrektur-Grundsatz: Ändere nur so viel wie nötig und so wenig wie möglich. Wenn der Satz der Maschine grammatikalisch, sachlich und terminologisch korrekt ist und dem gewünschten Stil entspricht, belasse ihn – auch wenn du ihn persönlich anders formuliert hättest. Das spart Zeit und sichert die Effizienz des PE-Prozesses.

4. Merkmale unredigierter KI- & Maschinencodes

KI-übersetzte Texte sind heutzutage grammatikalisch meist einwandfrei, weisen aber bei genauerem Hinsehen typische Muster, Systemfehler und stilistische Auffälligkeiten auf:

  • Mangelnde Kohärenz über Satzgrenzen hinweg: KI übersetzt oft Satz für Satz. Pronomen (er, sie, es, dieser) haben im folgenden Satz plötzlich ein falsches Bezugswort oder Zeiten/Tonalitäten springen mitten im Text.
  • Typische Übersetzungsfehler & falsche Freunde:
    • Wörtliche Übertragungen: Englische Redewendungen werden zu nah am Original übersetzt ("It makes no sense" → "Es macht keinen Sinn" statt "Es ergibt keinen Sinn").
    • Kontextblinde Wortwahl: Wörter mit mehreren Bedeutungen werden falsch gewählt (z. B. englisch "spring" als "Frühling" übersetzt, obwohl im technischen Text die "Feder" gemeint war).
  • Syntaktische Monotonie & Holzhammer-Satzbau: KI-Texte neigen zu sehr gleichförmigen Satzstrukturen. Verschachtelte Gedanken wirken hölzern, Nebensätze folgen demselben Schema.
  • Uneinheitliche Anrede & Tonalität: Mitten im Text wechselt die KI gelegentlich unbemerkt zwischen "Du" und "Sie" oder springt zwischen formeller Fachsprache und saloppem Umgangston.
  • Übertriebene Glättung (Hallmark-Effekt): Reinen KI-Texte klingen extrem geglättet, perfekt neutral, aber emotional flach und frei von kreativer Ecken und Kanten.
  • Fehler bei Zahlen, Einheiten und Kulturstandards: Datumsformate (MM/DD/YYYY vs. DD.MM.YYYY), Maßeinheiten (Fehlen der Umrechnung) oder Dezimalkommata (Punkt statt Komma) werden unkorrigiert übernommen.
  • Pseudologik und "Halluzinationen": Die KI wählt Wörter, die grammatikalisch und statistisch zum Satz passen, inhaltlich aber vollkommen unsinnig oder faktisch falsch sind.
Der Schnelltest

Fällt dir beim Lesen auf, dass ein Text zwar absolut fehlerfrei wirkt, aber beim zweiten Durchlesen seltsam blass klingt oder sich inhaltliche Stolpersteine bei Fachbegriffen verstecken, handelt es sich meist um einen unredigierten Maschinen- oder KI-Text.

5. Professionelle Tools & Plattformen

Im Bereich der professionellen Fachübersetzung (Technik, Recht, Medizin, Finanzen) reichen einfache Übersetzungstools nicht aus. Hier kommen spezialisierte NMT-Engines, LLMs mit Kontext-Steuerung sowie Enterprise-TMS zum Einsatz.

1. Spezialisierte NMT-Engines & LLMs

DeepL Pro

Fokus: Europaweit führende NMT für allgemeine Fachtexte, Verträge und technische Dokumentation.
Stärken: Sehr hohe grammatikalische Präzision, Glossareinbindung, DSGVO-konforme Server (EU).

ModernMT

Fokus: Adaptive neuronale Maschinenübersetzung.
Stärken: Lernt in Echtzeit aus den Korrekturen des Übersetzers (Post-Editing) und passt sich an Fachglossare an.

SYSTRAN Translate Enterprise

Fokus: Spezialisierte Branchen-Modelle (Defense, Legal, Healthcare, Engineering).
Stärken: Anpassbare domänenspezifische Modelle, höchste On-Premise- und Cloud-Sicherheitsstandards.

Claude 3.5 Sonnet / Claude 3 Opus (Anthropic)

Fokus: LLM-basierte Übersetzung komplexer und hochsensibler Fachtexte.
Stärken: Überragend bei Nuancen, juristischer Präzision, Tonalitätsanpassung und langem Kontext.

2. Professionelle CAT-Tools & Enterprise-TMS

memoQ (inkl. memoQ AGT)

Fokus: High-End Translation Management für Übersetzungsteams.
Stärken: Mit Adaptive Generative Translation (AGT) kombiniert memoQ Translation Memories (TM) und Termdatenbanken direkt mit LLMs für extrem konsistente Fachübersetzungen.

Trados Studio (RWS)

Fokus: Der globale Marktstandard im professionellen Übersetzungsbereich.
Stärken: Trados Copilot (KI-Unterstützung), tiefe Integration von TMs, Termbanken und Multi-Engine-NMT.

Phrase (ehemals Memsource)

Fokus: KI-gestütztes Lokalisierungsmanagement für Unternehmen.
Stärken: Phrase NextMT wählt automatisch die beste KI-Engine für das jeweilige Sprachpaar/Fachgebiet aus.

3. Spezial- & Enterprise-Plattformen

Pairaphrase

Fokus: Sichere Dokumentenübersetzung für regulierte Branchen (Medizin, Jura, Finanzen).
Stärken: Erhält Layouts (PDF, Word, CAD), bietet HIPAA/DSGVO-Compliance und verbindet TMs mit KI.

Smartcat

Fokus: KI-Übersetzungsmarktplatz und Workflow-Automatisierung.
Stärken: Kombiniert KI-Erstübersetzung aus verschiedenen Quellen direkt mit einem Netzwerk menschlicher Fachlektoren.

GlobalLink (Translations.com)

Fokus: Lokalisierungsplattform für Großkonzerne und stark regulierte Märkte.
Stärken: KI-Workflow-Steuerung, nahtlose CMS-/ERP-Integrationen und strenge Qualitätssicherungs-Algorithmen.

Was zeichnet KI für Fachübersetzungen aus?

Im Gegensatz zu kostenlosen Tools verarbeiten diese Systeme Glossare (Termdatenbanken), nutzen Translation Memories (Satzarchive) und gewährleisten Datenschutz (kein Training öffentlicher Modelle mit deinen Daten).