Zurück zu allen Beiträgen
Artikel

Beste KI-Übersetzungsmodelle im Jahr 2026: Qualität, Terminologie und API-Kosten

Autor:

Vergleichen Sie GPT, Gemini, Claude, DeepSeek, HY-MT2, DeepL und Google Translation für Text-Workflows. Budget für Übersetzung und Überprüfung, ohne Token mit Zeichen zu verwechseln.

Ein aufgeschlagenes Buch mit ausgerichteten abstrakten Textzeilen auf den gegenüberliegenden Seiten und einer kleinen Lasche auf dem Buchrücken

„Backup nicht löschen“ ist ein kurzer Satz. Eine fließende Übersetzung, die „nicht“ verliert, ist immer noch eine gescheiterte Übersetzung. Bei der Produktkopie und -dokumentation bedeutet die Auswahl eines Modells, Bedeutung, Terminologie, Formatierung und die Zeit, die jemand für die Korrektur der Ausgabe aufwendet, abzuwägen.

Unser Budgetspezialist testet HY-MT2-7B über den auf OpenRouter gelisteten Tencent Cloud-Endpunkt für Text, der in seinen 8K-Kontext passt. GPT-5.6 Luna und DeepSeek V4 Flash sind unsere allgemeinen Modellalternativen. Für einen dedizierten Übersetzungsworkflow würden wir auch die qualitätsoptimierte Option von DeepL und Google Cloud Translation vergleichen, anstatt davon auszugehen, dass ein allgemeiner Chatbot immer besser ist. Keiner ist ein durch diesen Artikel ermittelter Gewinner der Genauigkeit in allen Sprachen.

Dokumentation und Preise wurden am 4. September 2026 überprüft. Hierbei handelt es sich um einen Vergleich aus öffentlichen Quellen mit ausgearbeiteten Budgetierungsbeispielen, nicht um ein Übersetzungsexperiment mit mehreren Modellen. Der Schwerpunkt der Praxisbeispiele liegt auf englisch-chinesischen Produktinhalten. Sprachübersetzung, Dolmetschen und Abonnements für Übersetzungs-Apps liegen außerhalb des Vergleichs.

Beginnen Sie mit der Auswahl der Art der Dienstleistung

OptionWarum es in die engere Wahl kommtWas muss überprüft werden
GPT-5.6 LunaNiedrige aufgeführte Token-Kosten für einen ersten ÜbersetzungsdurchgangBedeutung, Platzhalter und tatsächlich abgerechnete Leistung
DeepSeek V4 FlashKostengünstiges allgemeines Modell mit günstigerer Nutzung außerhalb der SpitzenzeitenTiming, Argumentationskonfiguration und Überprüfungsaufwand
Gemini 3.8 FlashAlternative innerhalb der allgemeinen Modell-API von GoogleEinführungspreis und vollständige Token-Nutzung
Claude Sonett 5Ein teurerer Vergleich für Anleitung und RevisionOb es tatsächlich die Bearbeitung Ihrer Inhalte reduziert
HY-MT2-7BKostengünstige gehostete Spezialist- oder herunterladbare GewichteGehostete Längenbeschränkungen, Bereitstellungskosten und Sprachpaar
DeepL qualitätsoptimiertÜbersetzungsspezifische Steuerelemente und Glossar-WorkflowSprachunterstützung, Plan und angefordertes Modellverhalten
Google Cloud-ÜbersetzungNMT- und Übersetzungs-LLM-Endpunkte unter einer Übersetzungs-APIWelcher Endpunkt verwendet wird und welche Zeichen abgerechnet werden

Dabei handelt es sich um unterschiedliche Liefermodelle. Ein heruntergeladenes Modell beinhaltet keinen kostenlosen gehosteten Dienst. Die API-Option von DeepL ist kein öffentlicher Gewichtskontrollpunkt. Google Cloud Translation ist nicht derselbe Endpunkt oder dasselbe Abrechnungsschema wie Gemini. Behalten Sie diese Unterscheidungen beim Kostenvergleich bei.

Was kostet die Übersetzung in Tokenabrechnung?

Alle nachstehenden Zahlen beziehen sich auf USD pro Million Token unter Verwendung der standardmäßigen, nicht zwischengespeicherten Texteingabe. In der letzten Spalte wird von 2 Millionen Eingabe- und 2 Millionen in Rechnung gestellten Ausgabe-Tokens ausgegangen, verteilt auf Anfragen innerhalb der angegebenen Stufe. Hierbei handelt es sich um eine unabhängige Volumenannahme, nicht um eine Umrechnung einer festen Seitenzahl oder einer festen Anzahl chinesischer Schriftzeichen.

ModellEingabe / 1MAusgabe / 1MBeispielkosten
HY-MT2-7B · Tencent Cloud über OpenRouter0,074 $0,295 $0,738 $
GPT-5.6 Luna0,20 $1,20 $2,80 $
DeepSeek V4 Flash, Spitzenwert0,44 $1,32 $3,52 $
Gemini 3.8 Flash0,75 $3,75 $9 $
Claude Sonett 52 $10 $24 $

Luna verwendet die Kurzkontextebene. Das Beispiel von DeepSeek sinkt auf 1,76 US-Dollar, wenn alle Anfragen für den Off-Peak-Preis in Frage kommen. Die Hauptfenster an Wochentagen sind 01:00–04:00 und 06:00–10:00 UTC. Der Einführungspreis von Gemini endet am 31. Dezember 2026, danach verdoppelt sich der angekündigte Preis auf 18 $. Steuern, zusätzliche Tools, Wiederholungsversuche und menschliche Überprüfung sind ausgeschlossen.

In der Tabelle wird unsere Auswahlliste für kostengünstige Starter erläutert. es ist kein Beleg für die Qualität der Übersetzung. Ein Modell, das eine Terminologieanweisung ignoriert, kann die gesamte API-Einsparung innerhalb weniger Minuten Korrektur zunichtemachen. Ebenso kann das Versenden eines kompletten Handbuchs, nur um eine Schaltfläche zu übersetzen, mehr kosten als das Versenden der Schaltfläche mit den wenigen Sätzen, die sie erklären.

Dedizierte Übersetzung ändert die Berechnung

DeepL: Ein Glossar ist eine Workflow-Funktion, keine Qualitätsgarantie

DeepLs Text-API stellt qualitäts- und latenzorientierte Modelloptionen, Kontext und Glossarsteuerelemente bereit. Der Parameter context wird nicht in Rechnung gestellt, während ein allgemeiner LLM den bereitgestellten Kontext normalerweise als Eingabetoken zählt. Ein Glossar muss zum angeforderten Sprachpaar passen und seine Verwendung erfordert die Angabe der Ausgangssprache.

Das macht DeepL zu einem nützlichen Vergleich, wenn kurze Zeichenfolgen von umgebenden Produktinformationen abhängen. Überprüfen Sie die Unterstützung für die genaue Sprache und Option: Ein Steuerelement, das für eine Zielsprache verfügbar ist, ist nicht automatisch für eine andere verfügbar. Verwenden Sie den Tarif in Ihrem API-Plan, anstatt einen Verbraucherabonnementpreis oder das Angebot einer unabhängigen Region zu importieren.

Wir würden diesen Servicestil wählen, wenn ein etablierter Glossar-Workflow Integrations- und Überprüfungsaufwand spart. Wir würden ihn nicht als den genauesten Englisch-Chinesisch-Übersetzer bezeichnen, ohne einen Test mit dem tatsächlichen Material.

Google Cloud Translation: Zeichen, keine Token

Googles Übersetzungspreise listet NMT mit 20 US-Dollar pro Million eingegebener Zeichen nach der geltenden monatlichen Vergütung auf. Sein Standard-Übersetzungs-LLM-Textendpunkt berechnet 10 US-Dollar pro Million Eingabezeichen und 10 US-Dollar pro Million Ausgabezeichen. Adaptive Übersetzung und formatierte Dokumente haben unterschiedliche Preise.

Für hypothetisch eine Million Eingabezeichen und eine Million Ausgabezeichen beträgt der Übersetzungs-LLM-Verbrauch 20 US-Dollar. Die NMT-Nutzung beträgt ebenfalls 20 $, bevor das berechtigte Guthaben angewendet wird. Das ist nicht die gleiche Arbeitslast wie zwei Millionen Eingabe-Tokens und zwei Millionen Ausgabe-Tokens in der vorherigen Tabelle.

Google zählt Unicode-Codepunkte, einschließlich übermittelter Leerzeichen und nicht übersetzter Zeichen. Eine zehnseitige Datei ist keine Abrechnungseinheit, die Sie direkt mit dem Token-Preis eines LLM vergleichen können. Überprüfen Sie den Endpunkt und zählen Sie die übermittelten Inhalte, bevor Sie ein Budget erstellen.

HY-MT2: ein günstiger gehosteter Spezialist oder Ihre eigene Bereitstellung

OpenRouter listet einen Tencent Cloud-Endpunkt auf zu den oben genannten Preisen, mit einem 8.192-Token-Kontext und bis zu 4.096 Abschluss-Tokens. Deshalb lohnt es sich, HY-MT2-7B für kurze, wiederholte Übersetzungsaufträge zu testen. Ein langes Handbuch muss sorgfältig aufgeteilt werden; Glossar- und Kontextaufwand zählen weiterhin. Das Beispiel schließt alle anfallenden Plattformgebühren aus und ist kein Angebot für Selbsthosting.

Die HY-MT2-7B-Modellkarte von Tencent bietet ein spezielles Übersetzungsmodell und Beispiele für Terminologie, Stil und strukturierte Inhalte. Es lohnt sich zu bewerten, wann die Bereitstellungskontrolle wichtig ist und das Team Rückschlüsse aufrechterhalten kann.

Die eigenen Vergleiche der Modellkarte sind vom Anbieter gemeldete Belege und kein unabhängiges Urteil über Ihre Dokumente. Berücksichtigen Sie Rechenleistung, ungenutzte Kapazität, Upgrades und Überprüfungen im Budget. Auch kleinere oder quantisierte Varianten benötigen eigene Prüfungen; ein Ergebnis von einem anderen Prüfpunkt wird nicht automatisch übertragen.

Wie wir entscheiden würden, ob eine Übersetzung verwendbar ist

WMTs Übersetzungsbewertungen sind nach bestimmten Aufgaben und Sprachpaaren organisiert. Das MT Metrics Eval Toolkit bietet menschliche und automatische Bewertungen, einschließlich MQM-Bewertungen für einige Sprachpaare. Beides rechtfertigt nicht die Kombination verschiedener Baujahre, Sprachen und Modellversionen in einem einzigen universellen Ranking.

Für ein Produktteam ist eine kleinere Akzeptanzprüfung oft nützlicher als ein nicht unterstützter Headline-Score. Betrachten Sie diese erfundene englische UI-Zeichenfolge:

Löschen Sie das Backup erst, wenn der Export abgeschlossen ist. Ihre Testversion endet am 30. September. Kontaktieren Sie {support_email} für Hilfe.

Geben Sie jedem Kandidaten das gleiche Glossar und den gleichen Produktkontext. Eine brauchbare chinesische Übersetzung muss das Verbot, die Reihenfolge der Ereignisse, das Datum und den genauen Platzhalter enthalten. Aus „Testversion endet“ darf nicht „Ihr Abonnement verlängert sich“ werden. Dadurch würde ein Abrechnungsereignis erfunden, das in der Quelle nicht vorhanden ist.

Überprüfen Sie dann einen Absatz mit wiederholten Produktbegriffen und eine strukturierte Datei mit Schlüsseln, Links und sichtbaren Zeichenfolgen. Analysieren Sie das Ergebnis, vergleichen Sie Platzhalter und bitten Sie einen zweisprachigen Prüfer, die Bedeutung zu überprüfen. Grammatik, Typografie und bevorzugter Stil sind wichtig, aber lassen Sie sich nicht über eine veränderte Menge oder fehlende Bedingung hinwegtäuschen.

Bitten Sie den Prüfer, kritische Bedeutungsfehler getrennt von kleineren Änderungen aufzuzeichnen. Verstecken Sie Modellnamen, wo es sinnvoll ist. Ein einziges attraktives Beispiel reicht nicht aus; Behalten Sie fehlgeschlagene und unangenehme Ergebnisse im Überprüfungssatz bei, anstatt nur die beste Ausgabe auszuwählen.

Budget zur Überarbeitung, bevor Sie einen Gewinner auswählen

Verwenden Sie den AILesson-Modellpreisrechner, um die Optionen mit Token-Abrechnung zu vergleichen: 2 in der Eingabe und 2 in der Ausgabe reproduzieren das angenommene Volumen unter Verwendung der entsprechenden Katalogtarife. Passen Sie den gehosteten Endpunkt an, nicht nur den Modellnamen. Es werden weder die Plangebühren von DeepL, die Zeichenrechnung von Google Translation noch die Kosten für das Selbsthosting von HY-MT2 geschätzt.

Beginnen Sie mit einem Beispiel und lesen Sie die tatsächliche Token-Nutzung, bevor Sie es auf alle Dokumente hochrechnen. Unterschiedliche Tokenisierer und Übersetzungsrichtungen ändern die Anzahl. Wenn ein zweites Modell die Übersetzung überprüft, umfasst seine Eingabe normalerweise sowohl die Quelle als auch die erste Ausgabe sowie Anweisungen. Die Überprüfung ist kein kostenloser, reiner Ausgabeschritt.

Bei der Beispielmenge kostet Sonnet 21,20 $ mehr als Luna. Bei einem angenommenen Rezensentensatz von 30 US-Dollar pro Stunde würden 42,4 eingesparte Minuten im gesamten Batch diesen Unterschied decken. Dabei handelt es sich um eine Break-Even-Berechnung, nicht um einen gemessenen Sonnet-Vorteil. Der günstigere Kandidat bleibt der bessere Kauf, wenn beide die gleiche Bewertung benötigen.

Vergleichen Sie für kurze Entwürfe mit geringem Einsatz den gehosteten HY-MT2 mit einem allgemeinen Budgetmodell. Vergleichen Sie für öffentlichen Produkttext einen dedizierten Service und ein allgemeines Modell im selben Glossar und derselben Fehlercheckliste. Behalten Sie die menschliche Zustimmung für die daraus resultierende Bedeutung. Wählen Sie die niedrigsten Gesamtkosten, bei denen das erhalten bleibt, was das Original tatsächlich sagt – und nicht die Ausgabe, die lediglich am ausgefeiltesten klingt.

Referenzen