Qwen-MT Turbo リリースノート

Qwen は qwen-mt-turbo を導入しました。これは Qwen-MT 翻訳モデルの更新版です。Qwen3 を基盤とし、数兆の多言語および翻訳トークンで学習されたこのモデルは、強化学習を活用して翻訳精度と語学的流暢さを向上させます。

主な機能と特徴

Qwen-MT は、以下の機能を通じて高性能翻訳と運用効率のバランスを提供します。

  • 広範な言語サポート: 92 の主要公式言語と主要な方言をサポートし、世界人口の 95% 以上をカバーします。
  • カスタマイズツール: 用語介入、ドメインプロンプト、翻訳メモリをサポートします。これにより、重要な用語ペアを事前定義したり、望ましいスタイルやドメイン(例: 法務 vs. ソーシャルメディア)を自然言語で記述したりして、ミッションクリティカルまたはドメイン固有のシナリオ向けに出力を最適化できます。
  • 効率的なアーキテクチャ: 軽量な Mixture of Experts(MoE)アーキテクチャを採用し、レイテンシと API コストを削減します。価格は出力トークン 100 万件あたり $0.5 からです。

翻訳品質とベンチマーク

自動評価

Qwen-MT は WMT24 多言語翻訳ベンチマークおよび中国語‑英語、英語‑ドイツ語のマルチドメインベンチマークでテストされました。結果は、Gemini-2.5-Flash、GPT-4.1-mini、Qwen3-8B など、同等サイズのモデルを上回ることを示しています。また、Qwen3-235B-A22B、Gemini-2.5-Pro、GPT-4.1 といった大規模最先端モデルと比較しても、品質面で競争力を保ちつつ、処理速度が速い点が特徴です。

人間評価

自動指標の限界に対処するため、Qwen は実世界データを用いて 10 の主要言語(アラビア語、中国語、英語、フランス語、イタリア語、日本語、韓国語、ロシア語、スペイン語、タイ語)で人間評価を実施しました。3 人の独立したプロの翻訳者がサンプルを採点し、交差検証で信頼性を確保しました。その結果、Qwen-MT は優秀率と受容率の両方で優れたパフォーマンスを示しました。

対応言語ファミリー

言語ファミリー 対応言語
インド・ヨーロッパ語族 Afrikaans, Armenian, Assamese, Asturian, Belarusian, Bengali, Bosnian, Bulgarian, Catalan, Croatian, Czech, Danish, Dutch, English, French, Galician, German, Greek, Gujarati, Hindi, Icelandic, Italian, Latvian, Lithuanian, Luxembourgish, Macedonian, Maithili, Marathi, Nepali, Norwegian Bokmål, Norwegian Nynorsk, Occitan, Odia, Polish, Portuguese, Romanian, Russian, Serbian, Sicilian, Sindhi, Sinhala, Slovak, Slovenian, Spanish, Swedish, Tosk Albanian, Ukrainian, Urdu, Venetian, Welsh, Western Persian
漢・チベット語族 Chinese (Cantonese, Simplified, and Traditional), Burmese
アフロ・アジア語族 Arabic (Standard, Egyptian, Mesopotamian, Moroccan, Najdi, North Levantine, South Levantine, Ta’izzi-Adeni, and Tunisian), Hebrew, Maltese
オーストロネシア語族 Cebuano, Indonesian, Javanese, Malay, Pangasinan, Tagalog, Waray
ドラヴィダ語族 Kannada, Tamil, Telugu
テルク語族 Kazakh, North Azerbaijani, Northern Uzbek, Turkish
タイ・カダイ語族 Thai, Lao
ウラル語族 Estonian, Finnish, Hungarian
オーストロアジア語族 Khmer, Vietnamese
その他 Basque, Georgian, Japanese, Korean, Swahili

実装とAPI使用方法

Qwen-MT は Qwen API を通じて利用可能です。モデルは API 呼び出しの extra_body パラメータ内の translation_options を受け取り、特定の翻訳要件に対応します。

  • 用語介入: ユーザーは terms リスト(例: "脑䅈搗大吧" を "biological sensor" にマッピング)を渡すことで、用語の一貫した適用を保証できます。
  • ドメインプロンプト: ユーザーは domains パラメータでテキストのドメインを指定できます。たとえば、テキストが "Ali Cloud IT domain" である旨を記述すれば、プロフェッショナルなトラブルシューティング用語や適切な文体が使用されます。

Sources