Meilleurs modèles de traduction IA en 2026 : qualité, terminologie et coût API
Comparez GPT, Gemini, Claude, DeepSeek, HY-MT2, DeepL et Google Translation. Budgétez traduction et révision sans confondre jetons et caractères.

« Ne supprimez pas la sauvegarde » est une phrase courte. Une traduction fluide qui perd la négation reste un échec. Pour le texte produit et la documentation, choisir un modèle revient à équilibrer sens, terminologie, format et temps de correction.
Notre spécialiste économique à tester est HY-MT2-7B via le point d’accès Tencent Cloud référencé sur OpenRouter, pour les textes tenant dans son contexte de 8 K. GPT-5.6 Luna et DeepSeek V4 Flash sont nos alternatives généralistes. Pour un flux dédié, nous comparerions aussi l’option DeepL optimisée pour la qualité et Google Cloud Translation au lieu de supposer qu’un chatbot est toujours meilleur. Cet article n’établit aucun vainqueur toutes langues.
Documentation et prix ont été vérifiés le 4 septembre 2026. Cette comparaison de sources publiques comporte des budgets travaillés, pas une expérience multimodèle. Les exemples pratiques portent sur du contenu produit anglais-chinois. Traduction orale, interprétation et abonnements d’applications sont exclus.
Commencer par choisir le type de service
| Option | Pourquoi la sélectionner | À vérifier |
|---|---|---|
| GPT-5.6 Luna | Faible coût affiché en jetons pour une première passe | Sens, variables et sortie facturée réelle |
| DeepSeek V4 Flash | Modèle général économique, moins cher hors pointe | Horaire, raisonnement et charge de révision |
| Gemini 3.8 Flash | Alternative dans l’API généraliste Google | Tarif de lancement et jetons de l’exécution complète |
| Claude Sonnet 5 | Comparaison plus chère pour consignes et révision | Réduction réelle du travail éditorial |
| HY-MT2-7B | Spécialiste hébergé peu cher ou poids téléchargeables | Limites de longueur, déploiement et paire de langues |
| DeepL optimisé qualité | Contrôles spécialisés et glossaires | Langues, offre et comportement du modèle demandé |
| Google Cloud Translation | Points d’accès NMT et Translation LLM | Point d’accès choisi et caractères facturés |
Ces modes de livraison diffèrent. Un modèle téléchargé n’inclut pas un hébergement gratuit. L’API DeepL n’est pas un point de contrôle public. Google Cloud Translation n’est ni le même point d’accès ni la même facture que Gemini. Préservez ces distinctions.
Coût d’une traduction facturée en jetons
Montants en dollars par million de jetons, entrée texte standard sans cache. La dernière colonne suppose 2 millions en entrée et 2 millions en sortie facturée, répartis dans le palier cité. C’est une hypothèse indépendante, pas la conversion d’un nombre de pages ou de caractères chinois.
| Modèle | Entrée / 1 M | Sortie / 1 M | Coût de l’exemple |
|---|---|---|---|
| HY-MT2-7B · Tencent Cloud via OpenRouter | 0,074 $ | 0,295 $ | 0,738 $ |
| GPT-5.6 Luna | 0,20 $ | 1,20 $ | 2,80 $ |
| DeepSeek V4 Flash, pointe | 0,44 $ | 1,32 $ | 3,52 $ |
| Gemini 3.8 Flash | 0,75 $ | 3,75 $ | 9 $ |
| Claude Sonnet 5 | 2 $ | 10 $ | 24 $ |
Luna utilise le contexte court. DeepSeek tombe à 1,76 $ si tout l’usage est hors pointe ; les plages de semaine sont 01:00–04:00 et 06:00–10:00 UTC. Le tarif de lancement Gemini finit le 31 décembre 2026 puis double l’exemple à 18 $. Taxes, outils, reprises et révision sont exclus.
Le tableau explique notre sélection économique, pas la qualité. Ignorer une consigne terminologique peut annuler l’économie en quelques minutes. Envoyer un manuel entier pour traduire un bouton peut aussi coûter plus que le bouton accompagné de son contexte utile.
Un service dédié modifie le calcul
DeepL : le glossaire est une fonction de flux, pas une garantie
L’API texte DeepL propose options orientées qualité ou latence, contexte et glossaires. Son paramètre context n’est pas facturé, tandis qu’un LLM général compte normalement le contexte en entrée. Le glossaire doit correspondre à la paire de langues et exige d’indiquer la langue source.
DeepL mérite donc une comparaison lorsque de courtes chaînes dépendent d’un contexte produit. Vérifiez langue et option exactes : un contrôle disponible pour une cible ne l’est pas automatiquement pour une autre. Utilisez le tarif de votre offre API, non un abonnement grand public ou une autre région.
Nous choisirions ce type de service si un glossaire établi économise intégration et révision. Sans test sur le contenu réel, nous ne le déclarons pas meilleur traducteur anglais-chinois.
Google Cloud Translation : des caractères, pas des jetons
Les tarifs Google affichent 20 $ par million de caractères d’entrée pour NMT après quota mensuel applicable. Le point d’accès texte Translation LLM facture 10 $ par million de caractères d’entrée et 10 $ de sortie. Traduction adaptative et documents formatés ont d’autres tarifs.
Pour un million de caractères d’entrée et un million de sortie, Translation LLM coûte 20 $. NMT coûte aussi 20 $ avant crédit. Ce n’est pas la même charge que deux millions de jetons en entrée et en sortie dans le tableau précédent.
Google compte les points de code Unicode, espaces et caractères non traduits compris. Dix pages ne constituent pas une unité comparable au prix en jetons. Vérifiez le point d’accès et comptez le contenu soumis.
HY-MT2 : spécialiste hébergé bon marché ou déploiement propre
OpenRouter référence un point d’accès Tencent Cloud aux tarifs ci-dessus, avec 8 192 jetons de contexte et jusqu’à 4 096 de complétion. HY-MT2-7B mérite donc un test sur des tâches courtes et répétées. Un long manuel doit être découpé avec soin ; glossaire et contexte restent facturés. L’exemple exclut d’éventuels frais de plateforme et ne chiffre pas l’auto-hébergement.
La fiche du modèle HY-MT2-7B fournit un spécialiste et des exemples de terminologie, style et contenu structuré. Il est pertinent lorsque le contrôle du déploiement compte et que l’équipe sait maintenir l’inférence.
Ses comparaisons restent des preuves du fournisseur, pas un verdict indépendant. Comptez calcul, capacité inutilisée, mises à jour et révision. Les variantes petites ou quantifiées exigent leurs propres contrôles.
Décider si une traduction est utilisable
Les évaluations WMT portent sur des tâches et paires déterminées. La boîte à outils MT Metrics Eval fournit des scores humains et automatiques, dont MQM pour certaines paires. Aucune ne justifie un classement universel mélangeant années, langues et versions.
Pour une équipe produit, un petit contrôle d’acceptation est souvent plus utile. Prenez cette chaîne anglaise fictive :
Do not delete the backup until the export is complete. Your trial ends on September 30. Contact {support_email} for help.
Donnez à tous le même glossaire et contexte. Une traduction chinoise utilisable préserve l’interdiction, l’ordre des événements, la date et la variable exacte. Elle ne transforme pas « la période d’essai se termine » en « l’abonnement se renouvelle », événement de facturation absent.
Testez ensuite un paragraphe avec termes répétés et un fichier structuré contenant clés, liens et chaînes visibles. Analysez le fichier, comparez les variables et faites vérifier le sens par une personne bilingue. Grammaire et style comptent, mais ne doivent pas masquer montant modifié ou condition absente.
Demandez au réviseur de séparer erreurs critiques et retouches mineures, masquez les noms si possible et conservez échecs et maladresses. Un seul bel exemple ne suffit pas.
Budgéter la révision avant de choisir
Dans le calculateur de prix AILesson, saisissez 2 en entrée et 2 en sortie pour reproduire le volume des options à jetons. Faites correspondre le point d’accès hébergé, pas seulement le nom. Le calculateur n’estime ni offre DeepL, ni facture Google en caractères, ni auto-hébergement HY-MT2.
Commencez par un échantillon et lisez l’usage réel avant extrapolation. Tokeniseurs et sens de traduction changent le volume. Si un second modèle relit, son entrée inclut normalement source, première sortie et consignes : la révision n’est pas une étape de sortie gratuite.
Sonnet coûte ici 21,20 $ de plus que Luna. À 30 $/h de relecture, 42,4 minutes économisées sur tout le lot couvriraient l’écart. C’est un seuil, pas un avantage mesuré. Le candidat bon marché reste préférable si les deux demandent autant de contrôle.
Pour de petits brouillons sans enjeu, comparez HY-MT2 hébergé à un généraliste économique. Pour un texte produit public, opposez un service dédié et un modèle général avec le même glossaire et la même liste d’erreurs. Gardez une validation humaine lorsque le sens a des conséquences. Choisissez le plus petit coût total qui préserve ce que dit réellement l’original, pas la sortie seulement la plus élégante.
Références
- Tarifs OpenAI, DeepSeek, guide Gemini 3.8 Flash et tarifs Anthropic : taux et conditions en jetons.
- API de traduction DeepL : contexte, glossaire et options.
- Tarifs Google Cloud Translation : points d’accès par caractères et documents.
- Fiche HY-MT2-7B : modèle spécialisé et déploiement.
- HY-MT2-7B sur OpenRouter : point d’accès Tencent Cloud tarifé et limites.
- Tâche WMT25 et MT Metrics Eval : périmètre d’évaluation et ressources humaines.







