Parameter input dan output untuk memanggil Qwen-MT melalui antarmuka yang kompatibel dengan OpenAI atau API DashScope .
Referensi: Penerjemahan mesin (Qwen-MT)
Kompatibel dengan OpenAI
- Wilayah Singapura
- Wilayah Virginia
- Wilayah Beijing
base_url untuk SDK: https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1Titik akhir HTTP: POST https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1/chat/completionsPertama, buat Kunci API dan konfigurasikan sebagai Variabel lingkungan. Jika Anda menggunakan SDK OpenAI, instal SDK.
Body permintaan |
|
model string (Wajib)Nama model. Model yang didukung: qwen-mt-plus, qwen-mt-flash, qwen-mt-lite, qwen-mt-turbo. | |
messages array (Wajib)Array pesan yang memberikan konteks kepada model. Hanya pesan pengguna yang didukung.
Jenis Pesan Pesan Pengguna object (Wajib)Pesan pengguna yang berisi kalimat yang akan diterjemahkan.
Properti content string (Wajib)Kalimat yang akan diterjemahkan.role string (Wajib)Peran pesan pengguna. Harus diatur ke user. | |
stream boolean (Opsional). Nilai default: false.Aktifkan mode keluaran streaming.Nilai valid:
qwen-mt-flash dan qwen-mt-lite mengembalikan data secara inkremental (setiap potongan hanya berisi konten baru). qwen-mt-plus dan qwen-mt-turbo mengembalikan data secara non-inkremental (setiap potongan berisi seluruh urutan hingga saat itu). Perilaku ini tidak dapat diubah. Contoh:II didnI didn'tI didn't laughI didn't laugh after... | |
stream_options object (Opsional)Item konfigurasi untuk keluaran streaming. Parameter ini hanya berlaku ketika stream diatur ke true.
Properti include_usage boolean (Opsional). Nilai default: false.Sertakan informasi konsumsi token dalam potongan data terakhir.Nilai valid:
| |
max_tokens integer (Opsional)Jumlah maksimum token yang akan dihasilkan. Jika output melebihi nilai ini, respons akan dipotong.Nilai default dan maksimum mengikuti panjang output maksimum model. Untuk informasi lebih lanjut, lihat Pemilihan Model. | |
seed integer (Opsional)Bibit angka acak untuk hasil yang dapat direproduksi. Menggunakan seed dan parameter yang sama menghasilkan output yang konsisten.Rentang nilai: [0, 2<sup>31</sup>-1]. | |
temperature float (Opsional). Nilai default: 0,65.Suhu pengambilan sampel yang mengontrol keragaman teks yang dihasilkan.Nilai yang lebih tinggi menghasilkan teks yang lebih beragam. Nilai yang lebih rendah menghasilkan teks yang lebih deterministik.Rentang nilai: [0, 2)Baik temperature maupun top_p mengontrol keragaman teks. Atur hanya salah satunya. | |
top_p float (Opsional). Nilai default: 0,8.Ambang batas probabilitas untuk pengambilan sampel inti yang mengontrol keragaman teks yang dihasilkan.Nilai yang lebih tinggi menghasilkan teks yang lebih beragam. Nilai yang lebih rendah menghasilkan teks yang lebih deterministik.Rentang nilai: (0, 1,0]Baik temperature maupun top_p mengontrol keragaman teks. Atur hanya salah satunya. | |
top_k integer (Opsional). Nilai default: 1.Ukuran set kandidat untuk pengambilan sampel selama generasi. Misalnya, mengatur nilai ini ke 50 berarti hanya 50 token teratas berdasarkan skor yang membentuk kumpulan pengambilan sampel. Nilai yang lebih besar meningkatkan keacakan; nilai yang lebih kecil meningkatkan determinisme. Jika nilainya None atau lebih besar dari 100, top_k dinonaktifkan dan hanya top_p yang berlaku.Nilai harus lebih besar dari atau sama dengan 0.Parameter non-standar OpenAI. SDK Python: tempatkan dalam objek extra_body extra_body={"top_k": xxx}. SDK Node.js atau panggilan HTTP: teruskan sebagai parameter tingkat atas. | |
repetition_penalty float (Opsional). Nilai default: 1,0.Hukuman untuk pengulangan dalam urutan berturut-turut. Nilai yang lebih tinggi mengurangi pengulangan. Nilai 1,0 tidak menerapkan hukuman. Harus lebih besar dari 0, tanpa batas atas yang ketat.Parameter non-standar OpenAI. SDK Python: tempatkan dalam objek extra_body extra_body={"repetition_penalty": xxx}. SDK Node.js atau panggilan HTTP: teruskan sebagai parameter tingkat atas. | |
translation_options object (Wajib)Parameter penerjemahan.
Properti source_lang string (Wajib)Nama lengkap bahasa sumber dalam bahasa Inggris. Untuk informasi lebih lanjut, lihat Bahasa yang Didukung. Jika Anda mengatur ini ke auto, model secara otomatis mendeteksi bahasa input.target_lang string (Wajib)Nama lengkap bahasa target dalam bahasa Inggris. Untuk informasi lebih lanjut, lihat Bahasa yang Didukung.terms arrays (Opsional)Array istilah yang diatur saat Anda menggunakan fitur Intervensi Istilah.
Properti source string (Wajib)Istilah dalam bahasa sumber.target string (Wajib)Istilah dalam bahasa target.arrays (Opsional)Array memori penerjemahan yang diatur saat Anda menggunakan fitur Memori Penerjemahan.
Properti source string (Wajib)Pernyataan dalam bahasa sumber.target string (Wajib)Pernyataan dalam bahasa target.string (Opsional)Petunjuk domain yang diatur saat Anda menggunakan fitur Pemberian Petunjuk Domain.Petunjuk domain harus dalam bahasa Inggris. extra_body={"translation_options": xxx}. SDK Node.js atau panggilan HTTP: teruskan sebagai parameter tingkat atas. |
Objek respons chat (keluaran non-streaming) | |
id stringID permintaan unik. | |
choices arrayArray konten yang dihasilkan oleh model.
Properti finish_reason stringAlasan penghentian pembuatan konten oleh model.Nilai yang mungkin:
integerIndeks objek saat ini dalam array choices.message objectPesan keluaran dari model.
Properti content stringHasil terjemahan.refusal stringSaat ini diatur ke null.role stringPeran pesan. Nilainya selalu assistant.audio objectSaat ini selalu null.function_call objectSaat ini diatur ke null.tool_calls arraySaat ini diatur ke null. | |
created integerStempel waktu UNIX saat permintaan dibuat. | |
model stringModel yang digunakan dalam permintaan. | |
object stringNilainya selalu chat.completion. | |
service_tier stringSaat ini diatur ke null. | |
system_fingerprint stringSaat ini selalu null. | |
usage objectKonsumsi token untuk permintaan tersebut.
Properti completion_tokens integerJumlah token dalam output model.prompt_tokens integerJumlah token dalam input.total_tokens integerTotal token yang dikonsumsi, yaitu jumlah dari prompt_tokens dan completion_tokens.completion_tokens_details objectSaat ini diatur ke null.prompt_tokens_details objectSaat ini diatur ke null. |
Objek potongan respons chat (keluaran streaming) | |
id stringID unik panggilan. Setiap objek potongan memiliki ID yang sama. | |
choices arrayArray konten yang dihasilkan oleh model. Jika include_usage diatur ke true, array ini kosong pada potongan terakhir.
Properti delta objectKonten output yang dikembalikan dalam mode streaming.
Properti content stringHasil terjemahan. Model qwen-mt-flash dan qwen-mt-lite memberikan pembaruan inkremental, sedangkan qwen-mt-plus dan qwen-mt-turbo memberikan pembaruan non-inkremental.function_call objectSaat ini selalu bernilai null.refusal objectSaat ini selalu bernilai null.role stringPeran objek pesan. Nilai ini hanya tersedia pada potongan pertama.stringModel berhenti menghasilkan karena salah satu dari tiga alasan berikut:
integerIndeks respons saat ini dalam array choices. | |
created integerStempel waktu UNIX saat permintaan dibuat. Setiap potongan memiliki stempel waktu yang sama. | |
model stringModel yang digunakan untuk permintaan. | |
object stringNilai ini selalu chat.completion.chunk. | |
service_tier stringSaat ini selalu bernilai null. | |
system_fingerprint stringSaat ini selalu bernilai null. | |
usage objectToken yang dikonsumsi oleh permintaan. Informasi ini hanya dikembalikan pada potongan terakhir ketika include_usage bernilai true.
Properti completion_tokens integerJumlah token dalam output model.prompt_tokens integerJumlah token input.total_tokens integerJumlah total token, yaitu jumlah dari prompt_tokens dan completion_tokens.completion_tokens_details objectSaat ini selalu bernilai null.prompt_tokens_details objectSaat ini selalu bernilai null. |
DashScope
- Singapura
- Virginia
- Beijing
Titik akhir HTTP:
POST https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/text-generation/generationAtur base_url ke:- Kode Python
- Kode Java
Anda harus membuat Kunci API dan mengekspor Kunci API sebagai Variabel lingkungan. Jika menggunakan SDK DashScope, instal SDK DashScope.
Body permintaan |
|
model string (Wajib)Nama model. Didukung: qwen-mt-plus, qwen-mt-flash, qwen-mt-lite, qwen-mt-turbo. | |
messages array (Wajib)Array pesan yang memberikan konteks kepada model. Hanya pesan pengguna yang didukung.
Jenis pesan Pesan Pengguna object (Wajib)Pesan pengguna yang berisi kalimat yang akan diterjemahkan.
Properti content string (Wajib)Kalimat yang akan diterjemahkan.role string (Wajib)Peran pesan pengguna. Harus diatur ke user. | |
max_tokens integer (Opsional)Jumlah maksimum token yang akan dihasilkan. Jika output melebihi nilai ini, respons akan dipotong.Nilai default dan maksimum adalah panjang output maksimum model. Untuk informasi lebih lanjut, lihat Pemilihan model.Dalam SDK Java, parameter ini adalah maxTokens. Untuk panggilan HTTP, letakkan max_tokens dalam objek parameters. | |
seed integer (Opsional)Bibit angka acak untuk hasil yang dapat direproduksi. Menggunakan seed dan parameter yang sama menghasilkan output yang konsisten.Rentang nilai: [0, 2<sup>31</sup>-1].Saat melakukan panggilan HTTP, letakkan seed dalam objek parameters. | |
temperature float (Opsional) Default ke 0,65.Suhu pengambilan sampel yang mengontrol keragaman teks yang dihasilkan.Nilai yang lebih tinggi menghasilkan teks yang lebih beragam. Nilai yang lebih rendah menghasilkan teks yang lebih deterministik.Rentang nilai: [0, 2)Baik temperature maupun top_p mengontrol keragaman teks. Atur hanya salah satunya.Saat melakukan panggilan HTTP, letakkan temperature dalam objek parameters. | |
top_p float (Opsional) Default ke 0,8.Ambang batas probabilitas untuk pengambilan sampel inti yang mengontrol keragaman teks yang dihasilkan.Nilai yang lebih tinggi menghasilkan teks yang lebih beragam. Nilai yang lebih rendah menghasilkan teks yang lebih deterministik.Rentang nilai: (0, 1,0]Baik temperature maupun top_p mengontrol keragaman teks. Atur hanya salah satunya.Dalam Java SDK, parameternya adalah objek topPparameters. | |
repetition_penalty float (Opsional) Default ke 1,0.Hukuman untuk pengulangan dalam urutan berturut-turut. Nilai yang lebih tinggi mengurangi pengulangan. Nilai 1,0 tidak menerapkan hukuman. Harus lebih besar dari 0, tanpa batas atas yang ketat.Dalam SDK Java, parameter ini adalah repetitionPenalty. Untuk panggilan HTTP, tambahkan repetition_penalty ke objek parameters. | |
top_k integer (Opsional) Default ke 1.Ukuran set kandidat untuk pengambilan sampel selama generasi. Misalnya, mengatur nilai ini ke 50 berarti hanya 50 token teratas berdasarkan skor yang membentuk kumpulan pengambilan sampel. Nilai yang lebih besar meningkatkan keacakan; nilai yang lebih kecil meningkatkan determinisme. Jika nilainya None atau lebih besar dari 100, top_k dinonaktifkan dan hanya top_p yang berlaku.Nilai harus lebih besar dari atau sama dengan 0.Dalam SDK Java, parameter ini adalah topK. Saat melakukan panggilan HTTP, atur top_k dalam objek parameters. | |
stream boolean (Opsional)Aktifkan mode keluaran streaming.Nilai valid:
qwen-mt-flash dan qwen-mt-lite mengembalikan data secara inkremental (setiap potongan hanya berisi konten baru). qwen-mt-plus dan qwen-mt-turbo mengembalikan data secara non-inkremental (setiap potongan berisi seluruh urutan hingga saat itu). Perilaku ini tidak dapat diubah. Contoh:II didnI didn'tI didn't laughI didn't laugh after... Parameter ini hanya didukung oleh SDK Python. Untuk mengimplementasikan keluaran streaming dengan SDK Java, panggil antarmuka | |
translation_options object (Wajib)Parameter penerjemahan.
Properti source_lang string (Wajib)Nama lengkap bahasa sumber dalam bahasa Inggris. Untuk informasi lebih lanjut, lihat Bahasa yang didukung. Jika Anda mengatur ini ke auto, model secara otomatis mendeteksi bahasa input.target_lang string (Wajib)Nama lengkap bahasa target dalam bahasa Inggris. Untuk informasi lebih lanjut, lihat Bahasa yang didukung.terms arrays (Opsional)Array istilah yang diatur saat Anda menggunakan fitur Intervensi istilah.
Properti source string (Wajib)Istilah dalam bahasa sumber.target string (Wajib)Istilah dalam bahasa target.arrays (Opsional)Array memori penerjemahan yang diatur saat Anda menggunakan fitur Memori penerjemahan.
Properti source string (Wajib)Pernyataan dalam bahasa sumber.target string (Wajib)Pernyataan dalam bahasa target.string (Opsional)Petunjuk domain yang diatur saat Anda menggunakan fitur Pemberian petunjuk domain.Petunjuk domain harus dalam bahasa Inggris.
Dalam SDK Java, parameter ini adalah |
Objek respons chat (sama untuk keluaran streaming dan non-streaming) | |
status_code stringKode status permintaan. 200 menunjukkan keberhasilan; nilai lain menunjukkan kegagalan.SDK Java tidak mengembalikan parameter ini. Jika panggilan gagal, pengecualian dilemparkan. Pesan pengecualian berisi konten status_code dan message. | |
request_id stringID permintaan unik.Dalam SDK Java, parameter yang dikembalikan adalah requestId. | |
code stringKode error. Kosong saat berhasil.Hanya SDK Python yang mengembalikan parameter ini. | |
output objectHasil panggilan.
Properti text stringSaat ini tetap null.finish_reason stringAlasan mengapa model berhenti menghasilkan konten. Nilai valid:
arrayOutput model.
Properti finish_reason stringNilai valid:
objectPesan output model.
Properti role stringPeran pesan output. Tetap assistant.content stringHasil terjemahan.stringModel yang digunakan untuk permintaan ini. | |
usage objectPenggunaan token untuk permintaan.
Properti input_tokens integerJumlah token input.output_tokens integerJumlah token output.total_tokens integerTotal token, sama dengan input_tokens + output_tokens. |