2026年のAI翻訳モデル比較:品質、用語、API費用
文章処理向けにGPT、Gemini、Claude、DeepSeek、HY-MT2、DeepL、Google Translationを比較。トークンと文字を混同せず翻訳とレビュー費を考えます。

「バックアップを削除しないでください」は短い文です。流暢でも「ない」を落とせば翻訳は失敗です。製品文言やドキュメントのモデル選びでは、意味、用語、形式と、人が修正に使う時間のバランスを取ります。
低価格の専門モデルとして、8Kコンテキストに収まる文章にはOpenRouter掲載のTencent Cloudエンドポイント経由でHY-MT2-7Bを試します。 汎用モデルの候補はGPT-5.6 LunaとDeepSeek V4 Flashです。翻訳専用工程では、汎用チャットボットが常に優れると考えず、DeepLの品質重視オプションとGoogle Cloud Translationも比べます。この記事は、全言語で最も正確なモデルを確立するものではありません。
ドキュメントと価格は2026年9月4日に確認しました。公開情報と予算例による比較で、複数モデルの翻訳実験ではありません。実例は英語・中国語の製品コンテンツを中心にします。音声翻訳、通訳、翻訳アプリのサブスクリプションは対象外です。
まずサービスの種類を選ぶ
| 候補 | 候補に含める理由 | 確認すること |
|---|---|---|
| GPT-5.6 Luna | 初回翻訳の掲載トークン単価が低い | 意味、プレースホルダー、実際の課金出力 |
| DeepSeek V4 Flash | オフピークがさらに安い低価格汎用モデル | 利用時間、推論設定、レビュー負担 |
| Gemini 3.8 Flash | Googleの汎用モデルAPI内の代替 | 導入料金と実行全体のトークン使用量 |
| Claude Sonnet 5 | 指示追従と修正に対する高価格帯候補 | 実際に編集を減らせるか |
| HY-MT2-7B | 低価格のホスト型専門モデルまたはダウンロード可能なウェイト | ホスト版の長さ制限、展開費、言語ペア |
| DeepL quality-optimized | 翻訳専用の制御と用語集工程 | 言語対応、プラン、指定モデルの挙動 |
| Google Cloud Translation | 翻訳API内のNMTとTranslation LLM | 使用エンドポイントと課金文字数 |
提供方法は同じではありません。ダウンロード型モデルに無料のホストサービスは付きません。DeepLのAPIは公開ウェイトのチェックポイントではありません。Google Cloud TranslationはGeminiとエンドポイントも課金方法も異なります。費用比較でもこの違いを保ちます。
トークン課金翻訳の費用
以下は100万トークンあたりの米ドル料金で、標準処理、キャッシュなしの文章入力です。最後の列は、掲載料金帯に収まるリクエスト全体で入力200万、課金対象の出力200万トークンと仮定します。固定ページ数や中国語文字数を換算したものではなく、独立した処理量の仮定です。
| モデル | 入力/1M | 出力/1M | 費用例 |
|---|---|---|---|
| HY-MT2-7B · Tencent Cloud(OpenRouter経由) | $0.074 | $0.295 | $0.738 |
| GPT-5.6 Luna | $0.20 | $1.20 | $2.80 |
| DeepSeek V4 Flash、ピーク | $0.44 | $1.32 | $3.52 |
| Gemini 3.8 Flash | $0.75 | $3.75 | $9 |
| Claude Sonnet 5 | $2 | $10 | $24 |
Lunaは短いコンテキスト料金です。DeepSeekは全リクエストがオフピークなら$1.76になり、平日のピーク時間は01:00〜04:00と06:00〜10:00(UTC)です。Geminiの導入料金は2026年12月31日に終了し、告知済みの料金では例が倍の$18になります。税、追加ツール、再試行、人のレビューは除きます。
この表は低価格の開始候補を説明しますが、翻訳品質は証明しません。用語指示を無視するモデルなら、数分の修正でAPIの節約分が消えます。一つのボタンを訳すためにマニュアル全体を送れば、そのボタンと説明文数行だけを送るより高くなることもあります。
翻訳専用サービスでは計算が変わる
DeepL:用語集は工程の機能で、品質保証ではない
DeepLのテキストAPIには、品質・速度重視のモデル選択、コンテキスト、用語集の制御があります。contextパラメーターは課金されませんが、汎用LLMは通常、渡したコンテキストを入力トークンとして数えます。用語集は指定の言語ペアと一致する必要があり、利用時には原文言語の指定が必要です。
短い文字列が周囲の製品情報に依存するとき、DeepLを比較する理由になります。正確な言語とオプションへの対応を確認してください。一つの対象言語で使える制御が、別の言語でも使えるとは限りません。一般消費者向けサブスクリプションや別地域の料金ではなく、自分のAPIプランの料金を使います。
確立した用語集工程が連携とレビューの手間を減らすなら、この種類のサービスを選びます。実際の素材で試さず、最も正確な英中翻訳とは呼びません。
Google Cloud Translation:トークンではなく文字
Googleの翻訳料金では、対象の月間無料枠後のNMTを入力100万文字あたり$20としています。標準のTranslation LLMテキストエンドポイントは、入力100万文字あたり$10、出力100万文字あたり$10です。適応型翻訳や書式付き文書には別料金があります。
架空の入力100万文字、出力100万文字なら、Translation LLMの使用量は$20です。NMTも対象クレジット適用前で$20です。前表の入力200万・出力200万トークンと同じ処理量ではありません。
Googleは、送信した空白や未翻訳文字を含むUnicodeコードポイントを数えます。10ページのファイルは、LLMのトークン料金と直接比べられる課金単位ではありません。予算を決める前に、エンドポイントと送信内容の文字数を確認します。
HY-MT2:安価なホスト型専門モデル、または自社展開
OpenRouter掲載のTencent Cloudエンドポイントは上記料金、8,192トークンのコンテキスト、最大4,096出力トークンです。そのためHY-MT2-7Bは短い反復翻訳で試す価値があります。長いマニュアルは慎重に分割し、用語集とコンテキストもトークンに含めます。例は該当するプラットフォーム料金を除き、セルフホストの見積もりではありません。
TencentのHY-MT2-7Bモデルカードは、専門翻訳モデルと用語、文体、構造化コンテンツの例を掲載しています。展開の制御が必要で、チームが推論基盤を保守できる場合に評価する価値があります。
モデルカード内の比較は提供元による根拠で、手元の文書に対する独立判定ではありません。計算資源、待機容量、更新、レビューも予算に含めます。小型版や量子化版も別に確認し、別チェックポイントの結果を自動的に移さないでください。
翻訳を使えるか判断する方法
WMTの翻訳評価は、指定された課題と言語ペアごとに構成されています。MT Metrics Evalツールキットは、一部の言語ペアでMQM評価を含む人と自動の点数を提供します。異なる年、言語、モデル版を一つの普遍的順位にまとめる根拠にはなりません。
製品チームには、裏づけのない見出し点数より、小さな合格確認が役立つことがあります。次の架空の英語UI文を考えます。
Do not delete the backup until the export is complete. Your trial ends on September 30. Contact {support_email} for help.
全候補に同じ用語集と製品情報を与えます。使える中国語訳は、禁止、作業順、日付、正確なプレースホルダーを保つ必要があります。「trial ends」を「サブスクリプションが更新される」に変えてはいけません。原文にない課金イベントを作ることになります。
次に、製品用語を繰り返す段落と、キー、リンク、表示文字列を含む構造化ファイルを確認します。結果を解析し、プレースホルダーを比較し、意味をバイリンガルのレビュアーに確認してもらいます。文法、組版、好みの文体も重要ですが、変わった金額や欠けた条件を隠してはいけません。
レビュアーには重大な意味の誤りと軽微な編集を分けて記録してもらいます。可能ならモデル名を隠します。魅力的な一例だけでは不十分で、不自然な結果や失敗もレビュー集合に残します。
勝者を決める前に修正費を含める
AILessonのモデル料金計算ツールでは、トークン課金候補に入力2、出力2を入れると、該当カタログ料金で想定量を再現できます。モデル名だけでなくホストエンドポイントを合わせます。DeepLのプラン料金、Google Translationの文字料金、HY-MT2のセルフホスト費は計算しません。
まず標本で実際のトークン使用量を読み、全資料へ広げてください。トークナイザーと翻訳方向で数は変わります。第2モデルが翻訳をレビューするなら、その入力には通常、原文、初回出力、指示が含まれます。レビューは無料の出力だけの工程ではありません。
例の処理量ではSonnetはLunaより$21.20高くなります。レビュアー時給を$30と仮定すると、一括処理全体で42.4分短縮すれば差額を回収できます。これは損益分岐点の計算で、Sonnetの実測優位ではありません。両方に同じレビューが必要なら安い候補がよい購入です。
重要度の低い短い初稿では、ホスト型HY-MT2と一つの低価格汎用モデルを比較します。公開製品文では、同じ用語集とエラーチェックで翻訳専用サービスと汎用モデルを比べます。重要な意味は人が承認してください。最も洗練されて聞こえる出力ではなく、原文の意味を保つ最小の総費用を選びます。
参考資料
- OpenAI料金、DeepSeek料金、Gemini 3.8 Flashガイド、Anthropic料金:トークン料金と条件。
- DeepLテキスト翻訳API:コンテキスト、用語集、モデル選択。
- Google Cloud Translation料金:文字課金エンドポイントと文書の区別。
- HY-MT2-7Bモデルカード:専門モデルと展開情報。
- OpenRouterのHY-MT2-7B:料金付きTencent Cloudエンドポイントと上限。
- WMT25翻訳課題とMT Metrics Eval:評価範囲と人手評価資料。







