Qwen-MT模型是基於Qwen3模型最佳化的機器翻譯大語言模型,支援92個語種(包括中、英、日、韓、法、西、德、泰、印尼、越、阿等)互譯,且提供了術語幹預、領域提示、記憶庫等能力,提升模型在複雜應用情境下的翻譯效果。
工作方式
-
傳入待翻譯內容:
messages數組中有且僅有一個role為user的訊息,其content為待翻譯文本。 -
設定語種:參考支援的語言,在
translation_options中設定源語種 (source_lang) 和目標語種 (target_lang)。若需自動檢測源語種,可將source_lang設為auto。指明源語種有利於提升翻譯準確率。
Qwen-MT 模型也支援通過 自訂提示詞 設定語種。
translation_options 參數傳入。
translation_options也可實現術語幹預、翻譯記憶、領域提示等翻譯定製功能。
使用限制:
- 僅支援單輪翻譯:模型專為翻譯任務設計,不支援多輪對話。
- 不支援設定 System Message:不支援通過
system角色的訊息來設定全域行為。翻譯配置通過translation_options中定義。
模型選型
- 通用情境首選
qwen-mt-flash,在翻譯品質、速度和成本之間取得最佳平衡,支援增量流式輸出。 - 最高翻譯品質(專業文獻、正式文書)選
qwen-mt-plus。 - 最低延遲(即時聊天等簡單情境)選
qwen-mt-lite。
| 模型 | 推薦情境 | 效果 | 速度 | 成本 | 支援的語言 | 支援增量流式輸出 |
|---|---|---|---|---|---|---|
| qwen-mt-plus | 專業領域、正式文書、論文、技術報告等對譯文品質要求高的情境 | 最好 | 標準 | 較高 | 92種 | 不支援 |
| qwen-mt-flash | 通用首選,適用於網站/App內容、商品描述、日常溝通、部落格文章等情境 | 較好 | 較快 | 較低 | 92種 | 支援 |
qwen-mt-turbo | turbo模型後續不再更新,建議選用效果與功能均更優的flash模型 | 良好 | 較快 | 較低 | 92種 | 不支援 |
| qwen-mt-lite | 即時聊天、彈幕翻譯等對延遲敏感的簡單情境 | 基礎 | 最快 | 最低 | 31種 | 支援 |
快速開始
以下樣本將 “我看到這個視頻後沒有笑” 翻譯為英文。
您需要已擷取與配置 API Key並配置API Key到環境變數。如果通過OpenAI SDK或DashScope SDK進行調用,還需要安裝SDK。請將範例程式碼中的 DASHSCOPE_API_HOST 替換為擷取的 API Host。
- OpenAI相容
- DashScope
流式輸出
流式輸出可即時返回翻譯內容,減少使用者等待時間。qwen-mt-flash 和 qwen-mt-lite 支援增量流式輸出,通過 incremental_output 參數開啟,每次僅返回新產生的內容。qwen-mt-plus 和 qwen-mt-turbo 僅支援非增量流式輸出,每次返回當前已產生的完整序列。詳情請參見流式輸出。
- OpenAI相容
- DashScope
提升翻譯效果
標準翻譯能滿足日常溝通需求,但在專業情境中可能出現以下問題:
- 術語不統一:產品名或行業術語翻譯錯誤。
- 風格不匹配:譯文風格不符合法律、營銷等特定領域的規範。
術語幹預
當文本包含品牌名、產品名或專業術語時,為保證翻譯的準確性和一致性,可通過 terms 欄位提供一個術語表,引導模型參考術語表進行翻譯。
使用步驟:
-
定義術語
建立JSON數組,賦值給
terms欄位。每個對象代表一條術語:
-
傳入術語
通過
translation_options參數傳入terms數組。
- OpenAI相容
- DashScope
翻譯記憶
需要模型遵循特定翻譯風格或句式時,可通過 tm_list 欄位提供"源文-譯文"句對作為參考。模型將在當次翻譯任務中模仿這些樣本的風格,適合維護大型文檔集的術語一致性,或沿用企業已有的寫作規範。
-
定義翻譯記憶
建立JSON數組賦值給
tm_list,每個對象包含源語句與對應譯文:
-
傳入翻譯記憶
通過
translation_options參數傳入翻譯記憶數組。
- OpenAI相容
- DashScope
領域提示
若需要譯文風格符合特定領域(如法律文書要求嚴肅正式,社交內容要求口語化),可通過 translation_options 參數傳入領域提示句。
- OpenAI相容
- DashScope
自訂提示詞
Qwen-MT 支援通過自訂提示詞(如指定語種、風格)引導翻譯。translation_options 參數與自訂提示詞可同時傳入,但當兩者同時設定時,translation_options 中的配置(如 target_lang、source_lang 等)優先順序高於自訂提示詞中的對應設定,會覆蓋自訂提示詞中的語種或風格指定。
推薦優先使用 translation_options 參數配置翻譯選項,以獲得最佳翻譯效果。
以下以法律領域的漢譯英為例:
- OpenAI相容
- DashScope
應用於生產環境
-
控制輸入 Token 數量
Qwen-MT 模型的輸入 Token 上限為 8,192。輸入內容較長時,可參考以下策略:
- 分段翻譯:按語義邊界(段落或完整句子)分割長文本,而非按字元數截斷,以保證上下文完整性,提升翻譯品質。
- 僅傳入最相關的參考內容:術語、翻譯記憶和領域提示都會作為輸入 Token 拼入提示詞。只傳入與當前翻譯任務直接相關的內容,避免使用大而泛的參考列表。
-
根據情境設定
source_lang- 不確定源語種時(如多語言混雜的社交聊天情境),將
source_lang設為auto,模型自動識別語種。 - 語種固定、準確度要求高的情境(如技術文檔、操作手冊),始終明確指定
source_lang,可有效提升翻譯準確率。
- 不確定源語種時(如多語言混雜的社交聊天情境),將
支援的語言
發起請求時,用下表中的英文名或代碼指定語種。
當不確定源語種時,可為source_lang參數賦值auto以自動檢測。
- qwen-mt-plus/flash/turbo 支援的語言 (92種)
- qwen-mt-lite 支援的語言 (31種)
語言 | 英文名 | 代碼 |
|---|---|---|
英語 | English | en |
簡體中文 | Chinese | zh |
繁體中文 | Traditional Chinese | zh_tw |
俄語 | Russian | ru |
日語 | Japanese | ja |
韓語 | Korean | ko |
西班牙語 | Spanish | es |
法語 | French | fr |
葡萄牙語 | Portuguese | pt |
德語 | German | de |
意大利語 | Italian | it |
泰語 | Thai | th |
越南語 | Vietnamese | vi |
印尼語 | Indonesian | id |
馬來語 | Malay | ms |
阿拉伯語 | Arabic | ar |
印地語 | Hindi | hi |
希伯來語 | Hebrew | he |
緬甸語 | Burmese | my |
泰米爾語 | Tamil | ta |
烏爾都語 | Urdu | ur |
孟加拉語 | Bengali | bn |
波蘭語 | Polish | pl |
荷蘭語 | Dutch | nl |
羅馬尼亞語 | Romanian | ro |
土耳其語 | Turkish | tr |
高棉語 | Khmer | km |
寮國語 | Lao | lo |
粵語 | Cantonese | yue |
捷克語 | Czech | cs |
希臘語 | Greek | el |
瑞典語 | Swedish | sv |
匈牙利語 | Hungarian | hu |
丹麥語 | Danish | da |
芬蘭語 | Finnish | fi |
烏克蘭語 | Ukrainian | uk |
保加利亞語 | Bulgarian | bg |
塞爾維亞語 | Serbian | sr |
泰盧固語 | Telugu | te |
南非荷蘭語 | Afrikaans | af |
亞美尼亞語 | Armenian | hy |
阿薩姆語 | Assamese | as |
阿斯圖里亞斯語 | Asturian | ast |
巴斯克語 | Basque | eu |
白俄羅斯語 | Belarusian | be |
波斯尼亞語 | Bosnian | bs |
加泰羅尼亞語 | Catalan | ca |
宿務語 | Cebuano | ceb |
克羅地亞語 | Croatian | hr |
埃及阿拉伯語 | Egyptian Arabic | arz |
愛沙尼亞語 | Estonian | et |
加利西亞語 | Galician | gl |
格魯吉亞語 | Georgian | ka |
古吉拉特語 | Gujarati | gu |
冰島語 | Icelandic | is |
爪哇語 | Javanese | jv |
卡納達語 | Kannada | kn |
哈薩克語 | Kazakh | kk |
拉脫維亞語 | Latvian | lv |
立陶宛語 | Lithuanian | lt |
盧森堡語 | Luxembourgish | lb |
馬其頓語 | Macedonian | mk |
馬加希語 | Maithili | mai |
馬爾他語 | Maltese | mt |
馬拉地語 | Marathi | mr |
美索不達米亞阿拉伯語 | Mesopotamian Arabic | acm |
摩洛哥阿拉伯語 | Moroccan Arabic | ary |
內志阿拉伯語 | Najdi Arabic | ars |
尼泊爾語 | Nepali | ne |
北阿塞拜疆語 | North Azerbaijani | az |
北黎凡特阿拉伯語 | North Levantine Arabic | apc |
北烏茲別克語 | Northern Uzbek | uz |
書面語挪威語 | Norwegian Bokmål | nb |
新挪威語 | Norwegian Nynorsk | nn |
奧克語 | Occitan | oc |
奧裡亞語 | Odia | or |
邦阿西楠語 | Pangasinan | pag |
西西里語 | Sicilian | scn |
信德語 | Sindhi | sd |
僧伽羅語 | Sinhala | si |
斯洛伐克語 | Slovak | sk |
斯洛文尼亞語 | Slovenian | sl |
南黎凡特阿拉伯語 | South Levantine Arabic | ajp |
斯瓦希裡語 | Swahili | sw |
他加祿語 | Tagalog | tl |
塔伊茲-亞丁阿拉伯語 | Ta’izzi-Adeni Arabic | acq |
托斯克阿爾巴尼亞語 | Tosk Albanian | sq |
突尼斯阿拉伯語 | Tunisian Arabic | aeb |
威尼斯語 | Venetian | vec |
瓦萊語 | Waray | war |
威爾士語 | Welsh | cy |
西波斯語 | Western Persian | fa |