Retour à tous les articles
Article

Meilleurs modèles de traduction IA en 2026 : qualité, terminologie et coût API

Auteur:

Comparez GPT, Gemini, Claude, DeepSeek, HY-MT2, DeepL et Google Translation. Budgétez traduction et révision sans confondre jetons et caractères.

Un livre ouvert dont les pages présentent des lignes abstraites alignées, avec un petit onglet sur la tranche

« Ne supprimez pas la sauvegarde » est une phrase courte. Une traduction fluide qui perd la négation reste un échec. Pour le texte produit et la documentation, choisir un modèle revient à équilibrer sens, terminologie, format et temps de correction.

Notre spécialiste économique à tester est HY-MT2-7B via le point d’accès Tencent Cloud référencé sur OpenRouter, pour les textes tenant dans son contexte de 8 K. GPT-5.6 Luna et DeepSeek V4 Flash sont nos alternatives généralistes. Pour un flux dédié, nous comparerions aussi l’option DeepL optimisée pour la qualité et Google Cloud Translation au lieu de supposer qu’un chatbot est toujours meilleur. Cet article n’établit aucun vainqueur toutes langues.

Documentation et prix ont été vérifiés le 4 septembre 2026. Cette comparaison de sources publiques comporte des budgets travaillés, pas une expérience multimodèle. Les exemples pratiques portent sur du contenu produit anglais-chinois. Traduction orale, interprétation et abonnements d’applications sont exclus.

Commencer par choisir le type de service

OptionPourquoi la sélectionnerÀ vérifier
GPT-5.6 LunaFaible coût affiché en jetons pour une première passeSens, variables et sortie facturée réelle
DeepSeek V4 FlashModèle général économique, moins cher hors pointeHoraire, raisonnement et charge de révision
Gemini 3.8 FlashAlternative dans l’API généraliste GoogleTarif de lancement et jetons de l’exécution complète
Claude Sonnet 5Comparaison plus chère pour consignes et révisionRéduction réelle du travail éditorial
HY-MT2-7BSpécialiste hébergé peu cher ou poids téléchargeablesLimites de longueur, déploiement et paire de langues
DeepL optimisé qualitéContrôles spécialisés et glossairesLangues, offre et comportement du modèle demandé
Google Cloud TranslationPoints d’accès NMT et Translation LLMPoint d’accès choisi et caractères facturés

Ces modes de livraison diffèrent. Un modèle téléchargé n’inclut pas un hébergement gratuit. L’API DeepL n’est pas un point de contrôle public. Google Cloud Translation n’est ni le même point d’accès ni la même facture que Gemini. Préservez ces distinctions.

Coût d’une traduction facturée en jetons

Montants en dollars par million de jetons, entrée texte standard sans cache. La dernière colonne suppose 2 millions en entrée et 2 millions en sortie facturée, répartis dans le palier cité. C’est une hypothèse indépendante, pas la conversion d’un nombre de pages ou de caractères chinois.

ModèleEntrée / 1 MSortie / 1 MCoût de l’exemple
HY-MT2-7B · Tencent Cloud via OpenRouter0,074 $0,295 $0,738 $
GPT-5.6 Luna0,20 $1,20 $2,80 $
DeepSeek V4 Flash, pointe0,44 $1,32 $3,52 $
Gemini 3.8 Flash0,75 $3,75 $9 $
Claude Sonnet 52 $10 $24 $

Luna utilise le contexte court. DeepSeek tombe à 1,76 $ si tout l’usage est hors pointe ; les plages de semaine sont 01:00–04:00 et 06:00–10:00 UTC. Le tarif de lancement Gemini finit le 31 décembre 2026 puis double l’exemple à 18 $. Taxes, outils, reprises et révision sont exclus.

Le tableau explique notre sélection économique, pas la qualité. Ignorer une consigne terminologique peut annuler l’économie en quelques minutes. Envoyer un manuel entier pour traduire un bouton peut aussi coûter plus que le bouton accompagné de son contexte utile.

Un service dédié modifie le calcul

DeepL : le glossaire est une fonction de flux, pas une garantie

L’API texte DeepL propose options orientées qualité ou latence, contexte et glossaires. Son paramètre context n’est pas facturé, tandis qu’un LLM général compte normalement le contexte en entrée. Le glossaire doit correspondre à la paire de langues et exige d’indiquer la langue source.

DeepL mérite donc une comparaison lorsque de courtes chaînes dépendent d’un contexte produit. Vérifiez langue et option exactes : un contrôle disponible pour une cible ne l’est pas automatiquement pour une autre. Utilisez le tarif de votre offre API, non un abonnement grand public ou une autre région.

Nous choisirions ce type de service si un glossaire établi économise intégration et révision. Sans test sur le contenu réel, nous ne le déclarons pas meilleur traducteur anglais-chinois.

Google Cloud Translation : des caractères, pas des jetons

Les tarifs Google affichent 20 $ par million de caractères d’entrée pour NMT après quota mensuel applicable. Le point d’accès texte Translation LLM facture 10 $ par million de caractères d’entrée et 10 $ de sortie. Traduction adaptative et documents formatés ont d’autres tarifs.

Pour un million de caractères d’entrée et un million de sortie, Translation LLM coûte 20 $. NMT coûte aussi 20 $ avant crédit. Ce n’est pas la même charge que deux millions de jetons en entrée et en sortie dans le tableau précédent.

Google compte les points de code Unicode, espaces et caractères non traduits compris. Dix pages ne constituent pas une unité comparable au prix en jetons. Vérifiez le point d’accès et comptez le contenu soumis.

HY-MT2 : spécialiste hébergé bon marché ou déploiement propre

OpenRouter référence un point d’accès Tencent Cloud aux tarifs ci-dessus, avec 8 192 jetons de contexte et jusqu’à 4 096 de complétion. HY-MT2-7B mérite donc un test sur des tâches courtes et répétées. Un long manuel doit être découpé avec soin ; glossaire et contexte restent facturés. L’exemple exclut d’éventuels frais de plateforme et ne chiffre pas l’auto-hébergement.

La fiche du modèle HY-MT2-7B fournit un spécialiste et des exemples de terminologie, style et contenu structuré. Il est pertinent lorsque le contrôle du déploiement compte et que l’équipe sait maintenir l’inférence.

Ses comparaisons restent des preuves du fournisseur, pas un verdict indépendant. Comptez calcul, capacité inutilisée, mises à jour et révision. Les variantes petites ou quantifiées exigent leurs propres contrôles.

Décider si une traduction est utilisable

Les évaluations WMT portent sur des tâches et paires déterminées. La boîte à outils MT Metrics Eval fournit des scores humains et automatiques, dont MQM pour certaines paires. Aucune ne justifie un classement universel mélangeant années, langues et versions.

Pour une équipe produit, un petit contrôle d’acceptation est souvent plus utile. Prenez cette chaîne anglaise fictive :

Do not delete the backup until the export is complete. Your trial ends on September 30. Contact {support_email} for help.

Donnez à tous le même glossaire et contexte. Une traduction chinoise utilisable préserve l’interdiction, l’ordre des événements, la date et la variable exacte. Elle ne transforme pas « la période d’essai se termine » en « l’abonnement se renouvelle », événement de facturation absent.

Testez ensuite un paragraphe avec termes répétés et un fichier structuré contenant clés, liens et chaînes visibles. Analysez le fichier, comparez les variables et faites vérifier le sens par une personne bilingue. Grammaire et style comptent, mais ne doivent pas masquer montant modifié ou condition absente.

Demandez au réviseur de séparer erreurs critiques et retouches mineures, masquez les noms si possible et conservez échecs et maladresses. Un seul bel exemple ne suffit pas.

Budgéter la révision avant de choisir

Dans le calculateur de prix AILesson, saisissez 2 en entrée et 2 en sortie pour reproduire le volume des options à jetons. Faites correspondre le point d’accès hébergé, pas seulement le nom. Le calculateur n’estime ni offre DeepL, ni facture Google en caractères, ni auto-hébergement HY-MT2.

Commencez par un échantillon et lisez l’usage réel avant extrapolation. Tokeniseurs et sens de traduction changent le volume. Si un second modèle relit, son entrée inclut normalement source, première sortie et consignes : la révision n’est pas une étape de sortie gratuite.

Sonnet coûte ici 21,20 $ de plus que Luna. À 30 $/h de relecture, 42,4 minutes économisées sur tout le lot couvriraient l’écart. C’est un seuil, pas un avantage mesuré. Le candidat bon marché reste préférable si les deux demandent autant de contrôle.

Pour de petits brouillons sans enjeu, comparez HY-MT2 hébergé à un généraliste économique. Pour un texte produit public, opposez un service dédié et un modèle général avec le même glossaire et la même liste d’erreurs. Gardez une validation humaine lorsque le sens a des conséquences. Choisissez le plus petit coût total qui préserve ce que dit réellement l’original, pas la sortie seulement la plus élégante.

Références