Anda dapat memanggil model menggunakan API Chat yang kompatibel dengan OpenAI. Dokumen ini menjelaskan parameter input dan output serta menyediakan contoh pemanggilan.
- Singapura
- AS (Virginia)
- Tiongkok (Beijing)
- Hong Kong (Tiongkok)
- Jerman (Frankfurt)
- Jepang (Tokyo)
base_url: https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1Permintaan HTTP: POST https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1/chat/completions{WorkspaceId} dengan ID ruang kerja Anda yang sebenarnya.
Dapatkan Kunci API dan atur sebagai variabel lingkungan. Jika Anda menggunakan SDK OpenAI, Anda juga harus menginstal SDK.
badan permintaanmodelstring(Wajib)Nama model.Model yang didukung: Model Bahasa Besar Qwen (versi komersial dan sumber terbuka), Qwen-VL, Qwen-Coder, Qwen-Omni, Qwen-Math, DeepSeek, Kimi, GLM, dan MiniMax.Untuk nama model spesifik dan detail penagihan, lihat konsol Studio Model.messagesarray(Wajib)Konteks yang diteruskan ke model bahasa besar, diatur dalam urutan percakapan.
Jenis pesan Pesan Sistem object(Opsional)Pesan sistem yang menentukan peran, nada, tugas, atau batasan untuk model bahasa besar. Biasanya merupakan elemen pertama dalam array messages.Jangan atur pesan sistem untuk model QwQ. Pesan sistem tidak berpengaruh pada model QVQ.
Properti content string(Wajib)Instruksi sistem. Menentukan peran, perilaku, gaya respons, dan batasan tugas model.rolestring(Wajib)Peran untuk pesan sistem. Nilainya tetap system.object(Wajib)Pesan pengguna. Meneruskan pertanyaan, instruksi, atau konteks ke model.
Properti content string atau array(Wajib)Konten pesan. Jenisnya string jika input hanya teks. Jenisnya array jika input berisi data multimodal seperti gambar, atau jika caching eksplisit diaktifkan.
Properti untuk model multimodal atau saat caching eksplisit diaktifkan type string(Wajib)Nilai yang valid:
stringInput teks. Parameter ini wajib saat type adalah text.image_urlobjectInformasi input gambar. Parameter ini wajib saat type adalah image_url.
Properti url string(Wajib)URL atau URL Data Base64-encoded dari gambar. Untuk meneruskan file lokal, lihat Pemahaman gambar dan video.objectInformasi input audio. Parameter ini wajib saat type adalah input_audio.
Properti data string(Wajib)URL atau URL Data Base64-encoded dari audio. Untuk meneruskan file lokal, lihat Input file lokal yang di-encode Base64.formatstring(Wajib)Format input audio, seperti mp3 atau wav.arrayInformasi input video, diberikan sebagai daftar gambar. Parameter ini wajib saat type adalah video. Untuk informasi selengkapnya tentang penggunaannya, lihat Pemahaman video (Qwen-VL), Pemahaman video (QVQ), atau Pemahaman video (Qwen-Omni).Nilai contoh:objectInformasi file video input. Parameter ini wajib saat type adalah video_url.Qwen-VL hanya dapat memahami informasi visual file video, sedangkan Qwen-Omni dapat memahami informasi visual dan audio.
Properti url string(Wajib)URL publik atau URL Data Base64-encoded dari file video. Untuk memasukkan file video lokal, lihat Input file lokal yang di-encode Base64.float(Opsional)Jumlah frame yang diekstraksi per detik. Nilai yang valid: [0.1, 10]. Nilai default: 2.0.Kisaran nilai yang valid untuk MiniMax/MiniMax-M3 adalah [0.2, 5], dan nilai defaultnya adalah 1.
Deskripsi fitur Parameter fps memiliki dua fungsi:
fps yang lebih besar cocok untuk skenario gerakan cepat, seperti acara olahraga atau film aksi. Nilai fps yang lebih kecil cocok untuk video panjang atau adegan dengan konten statis.
Nilai contoh
integer(Opsional)Menetapkan ambang batas piksel minimum untuk input gambar atau frame video. Jika jumlah piksel input kurang dari min_pixels, input tersebut diperbesar hingga jumlah piksel totalnya lebih besar dari min_pixels. Parameter ini berlaku untuk model Qwen-VL dan QVQ.
Kisaran nilai
Nilai contoh
integer(Opsional)Menentukan ambang batas piksel maksimum untuk input gambar atau frame video. Jika jumlah piksel input gambar atau video berada dalam rentang [min_pixels, max_pixels], model memproses gambar aslinya. Jika jumlah piksel lebih besar dari max_pixels, gambar diperkecil hingga jumlah pikselnya kurang dari atau sama dengan max_pixels. Parameter ini berlaku untuk model Qwen-VL dan QVQ.
Kisaran nilai
Nilai contoh
integer(Opsional)Membatasi jumlah piksel total semua frame yang diekstraksi dari video, yang dihitung sebagai (piksel per frame × total frame). Jika jumlah piksel total video melebihi batas ini, sistem memperkecil frame video. Sistem memastikan bahwa jumlah piksel satu frame tetap dalam rentang [min_pixels, max_pixels]. Parameter ini berlaku untuk model Qwen-VL dan QVQ.Untuk video panjang dengan banyak frame yang diekstraksi, Anda dapat mengurangi nilai ini untuk mengurangi konsumsi token dan waktu pemrosesan, tetapi ini dapat menyebabkan hilangnya detail gambar.
Kisaran nilai
Nilai contoh
object(Opsional)Mengaktifkan caching eksplisit. Untuk informasi selengkapnya, lihat Caching eksplisit.
Properti type string(Wajib)Hanya ephemeral yang didukung.string(Wajib)Peran untuk pesan pengguna. Nilainya tetap user.object(Opsional)Balasan model. Biasanya diteruskan kembali ke model sebagai konteks dalam percakapan multi-putaran.
Properti content string(Opsional)Konten teks balasan model. Saat tool_calls disertakan, content bisa kosong. Jika tidak, content wajib diisi.rolestring(Wajib)Peran untuk pesan asisten. Nilainya tetap assistant.partialboolean(Opsional) Nilai default: falseMenentukan apakah akan mengaktifkan mode sebagian.Nilai yang valid:
array(Opsional)Informasi tentang alat dan parameter inputnya yang diputuskan model untuk dipanggil. Berisi satu atau lebih objek dan diperoleh dari field tool_calls dari respons model sebelumnya.
Properti id string(Wajib)ID pemanggilan alat.type string(Wajib)Jenis alat. Saat ini, hanya function yang didukung.function object(Wajib)Alat dan parameter input
Properti name string(Wajib)Nama alat.arguments string(Wajib)Informasi parameter input, sebagai string berformat JSON.integer(Wajib)Indeks pemanggilan alat ini dalam array tool_calls.object(Opsional)Hasil pemanggilan alat.
Properti content string(Wajib)Konten keluaran fungsi alat. Harus berupa string. Jika alat mengembalikan data terstruktur, seperti JSON, data tersebut harus diserialisasi menjadi string.rolestring(Wajib)Nilainya tetap tool.tool_call_idstring(Wajib)ID pemanggilan alat yang menjadi tanggapan pesan ini. Anda dapat memperolehnya dari completion.choices[0].message.tool_calls[$index].id. ID ini digunakan untuk mengaitkan pesan alat dengan pemanggilan alat yang sesuai.boolean(Opsional) Nilai default: falseMenentukan apakah akan membalas dalam mode keluaran streaming. Untuk informasi selengkapnya, lihat Keluaran streaming.Nilai yang valid:
true untuk meningkatkan pengalaman pengguna dan mengurangi risiko timeout.Untuk pemanggilan non-streaming, timeout maksimum minimal 300 detik dan bervariasi berdasarkan wilayah dan model. Jika tidak selesai tepat waktu, layanan menginterupsi permintaan dan mengembalikan konten yang dihasilkan alih-alih error. Kami merekomendasikan agar Anda menggunakan pemanggilan streaming untuk skenario yang memerlukan keluaran panjang. Untuk informasi selengkapnya, lihat deskripsi timeout di Ikhtisar model generasi teks. object(Opsional)Item konfigurasi untuk keluaran streaming. Parameter ini hanya berlaku saat stream diatur ke true.
Properti include_usage boolean(Opsional) Nilai default: falseMenentukan apakah akan menyertakan informasi konsumsi token dalam potongan data terakhir respons.Nilai yang valid:
Untuk keluaran streaming, informasi konsumsi token hanya dapat muncul dalam potongan data terakhir respons. array(Opsional) Nilai default: ["text"]Modalitas data keluaran. Parameter ini hanya berlaku untuk model Qwen-Omni. Untuk informasi selengkapnya, lihat Non-real-time (Qwen-Omni).Nilai yang valid:
object(Opsional)Suara dan format audio keluaran. Parameter ini hanya berlaku untuk model Qwen-Omni dan memerlukan parameter modalities diatur ke ["text","audio"]. Untuk informasi selengkapnya, lihat Non-real-time (Qwen-Omni).
Properti voice string (Wajib)Suara audio keluaran. Untuk informasi selengkapnya, lihat Non-real-time (Qwen-Omni).formatstring (Wajib)Format audio keluaran. Hanya wav yang didukung.float(Opsional)Suhu pengambilan sampel, yang mengontrol keragaman teks yang dihasilkan model.Suhu yang lebih tinggi menghasilkan teks yang lebih beragam, sedangkan suhu yang lebih rendah menghasilkan teks yang lebih deterministik.Kisaran nilai: [0, 2)Baik temperature maupun top_p dapat mengontrol keragaman teks yang dihasilkan. Kami merekomendasikan agar Anda hanya mengatur salah satunya. Untuk informasi selengkapnya, lihat Ikhtisar.Jangan ubah nilai temperature default untuk model QVQ.top_p float(Opsional)Ambang batas probabilitas untuk pengambilan sampel inti, yang mengontrol keragaman teks yang dihasilkan model.Nilai top_p yang lebih tinggi menghasilkan teks yang lebih beragam. Nilai top_p yang lebih rendah menghasilkan teks yang lebih deterministik.Kisaran nilai: (0, 1.0]Baik temperature maupun top_p dapat mengontrol keragaman teks yang dihasilkan. Kami merekomendasikan agar Anda hanya mengatur salah satunya. Untuk informasi selengkapnya, lihat Ikhtisar.Jangan ubah nilai top_p default untuk model QVQ.top_k integer(Opsional)Menentukan jumlah token kandidat untuk diambil selama generasi. Nilai yang lebih besar menghasilkan output yang lebih acak, sedangkan nilai yang lebih kecil menghasilkan output yang lebih deterministik. Jika diatur ke null atau nilai lebih besar dari 100, strategi top_k dinonaktifkan, dan hanya strategi top_p yang berlaku. Nilainya harus integer yang lebih besar dari atau sama dengan 0.
Nilai top_k default Seri QVQ: 10;Seri QwQ: 40;model sebelum seri qwen-vl-plus, dan qwen2.5-omni-7b: 1;Seri Qwen3-Omni-Flash: 50;Semua model lainnya: 20.Seri GLM (disediakan oleh Alibaba Cloud): 20;Seri DeepSeek, Kimi, dan MiniMax tidak mendukung parameter top_k. Parameter ini bukan parameter OpenAI standar. Saat Anda memanggil menggunakan SDK Python, letakkan di objek extra_body. Konfigurasi: extra_body={"top_k":xxx}. Jangan ubah nilai top_k default untuk model QVQ.repetition_penalty float(Opsional)Hukuman pengulangan untuk urutan berturut-turut selama generasi model. Meningkatkan repetition_penalty dapat mengurangi pengulangan dalam output model. Nilai 1.0 berarti tidak ada hukuman. Tidak ada kisaran nilai yang ketat, selama lebih besar dari 0.Parameter ini bukan parameter OpenAI standar. Saat Anda memanggil menggunakan SDK Python, letakkan di objek extra_body. Konfigurasi: extra_body={"repetition_penalty":xxx}. Saat Anda menggunakan model qwen-vl-plus_2025-01-25 untuk ekstraksi teks, atur repetition_penalty ke 1.0. Jangan ubah nilai repetition_penalty default untuk model QVQ.presence_penalty float(Opsional)Mengontrol pengulangan konten saat model menghasilkan teks.Kisaran nilai: [-2.0, 2.0]. Nilai positif mengurangi pengulangan, sedangkan nilai negatif meningkatkannya.Dalam skenario yang memerlukan keragaman, kesenangan, atau kreativitas, seperti penulisan kreatif atau brainstorming, Anda dapat meningkatkan nilai ini. Dalam skenario yang menekankan konsistensi dan akurasi istilah, seperti dokumen teknis atau teks formal, Anda dapat mengurangi nilai ini.
Nilai presence_penalty default Qwen3.8 (mode non-pemikiran), Qwen3.7 (mode non-pemikiran), Qwen3.6 (mode non-pemikiran), Qwen3.5-Omni, Qwen3.5 (mode non-pemikiran), qwen3-max-preview (mode pemikiran), Qwen3 (mode non-pemikiran), seri Qwen3-Instruct/1.7b/4b (mode pemikiran), seri QVQ, qwen-max, seri qwen2.5-vl, seri qwen-vl-max, qwen-vl-plus, Qwen3-VL (non-pemikiran): 1.5;qwen3-8b/14b/32b/30b-a3b/235b-a22b (mode pemikiran), qwen-plus/qwen-plus-latest/2025-04-28 (mode pemikiran), qwen-turbo/qwen-turbo/2025-04-28 (mode pemikiran): 0.5;Semua lainnya adalah 0.0.Seri DeepSeek (disediakan oleh Alibaba Cloud): deepseek-r1, deepseek-r1-0528, versi distilasi deepseek-r1-distill-qwen: 1;Seri Kimi (disediakan oleh Alibaba Cloud): kimi-k2.7-code, kimi-k2.6, kimi-k2.5: 0.0;Seri Kimi (disediakan oleh Moonshot AI): 0.0;Seri MiniMax (disediakan oleh Alibaba Cloud): MiniMax-M2.5, MiniMax-M2.1: 0.0;Model DeepSeek, Kimi, GLM, dan MiniMax lainnya tidak memiliki nilai default.
Cara kerjanya Jika nilai parameter positif, model memberikan hukuman pada token yang sudah ada dalam teks. Hukuman ini tidak terkait dengan jumlah kemunculan token tersebut. Hal ini mengurangi kemungkinan token tersebut muncul kembali, sehingga mengurangi pengulangan konten dan meningkatkan keragaman kata.
Contoh Prompt: Terjemahkan kalimat ini ke dalam Bahasa Mandarin: "Film ini bagus. Alur ceritanya bagus, aktingnya bagus, musiknya bagus, dan secara keseluruhan, seluruh film ini sungguh bagus. Bahkan, film ini sangat bagus. Alur ceritanya sangat bagus, aktingnya sangat bagus, dan musiknya sangat bagus."Nilai parameter 2.0: Film ini bagus. Alur ceritanya fantastis, aktingnya luar biasa, dan musiknya juga sangat indah. Secara keseluruhan, seluruh film ini benar-benar luar biasa. Faktanya, film ini benar-benar hebat. Alur ceritanya sangat menarik, aktingnya sangat baik, dan soundtrack-nya begitu mengharukan.Nilai parameter 0.0: Film ini bagus. Alur ceritanya bagus, aktingnya bagus, dan musiknya bagus. Secara keseluruhan, seluruh film ini sangat bagus. Faktanya, film ini benar-benar hebat. Alur ceritanya sangat bagus, aktingnya juga sangat baik, dan musiknya sama luar biasanya.Nilai parameter -2.0: Film ini bagus. Alur ceritanya bagus, aktingnya bagus, dan musiknya bagus. Secara keseluruhan, seluruh film ini bagus. Faktanya, film ini benar-benar bagus. Alur ceritanya sangat bagus, aktingnya sangat bagus, dan musiknya sangat bagus. Saat Anda menggunakan model qwen-vl-plus untuk ekstraksi teks, atur presence_penalty ke 1.5. Jangan ubah nilai presence_penalty default untuk model QVQ.response_format object (Opsional) Nilai default: {"type": "text"}Format respons. Nilai yang valid:
Untuk informasi selengkapnya, lihat Output terstruktur. Mode Jika Anda menentukan
Properti type string(Wajib)Format konten yang dikembalikan. Nilai yang valid:
object(Opsional)Wajib jika type adalah json_schema. Mendefinisikan struktur JSON yang harus diikuti oleh keluaran model. Untuk informasi selengkapnya, lihat Mendapatkan output terstruktur.
Saat menggunakan metode
Properti name string(Wajib)Nama skema.schemaobject(Wajib)Objek JSON Schema yang menjelaskan struktur keluaran. Gunakan properties untuk mendefinisikan struktur bidang, required untuk mencantumkan bidang yang wajib diisi, dan additionalProperties untuk mengontrol apakah bidang yang tidak didefinisikan dalam skema boleh dikeluarkan. Sebaiknya atur additionalProperties ke false agar hanya bidang yang telah didefinisikan yang dikeluarkan. Tipe data yang didukung: string, number, integer, boolean, object, array, dan enum. Untuk informasi selengkapnya, lihat Panduan konfigurasi.strictboolean(Opsional)Menentukan apakah struktur yang didefinisikan oleh schema harus diikuti secara ketat. Sebaiknya atur parameter ini ke true.integer(Opsional, akan ditinggalkan)
Parameter ini akan ditinggalkan. Untuk integrasi baru, gunakan Makna parameter ini bervariasi berdasarkan model:
integer(Opsional)Panjang maksimum output model, termasuk konten rantai-pikiran dan jawaban model. Jika output model melebihi nilai ini, generasi dihentikan lebih awal, dan finish_reason yang dikembalikan adalah length.Nilai default dan maksimum keduanya adalah panjang output maksimum model.Perbedaan dari max_tokens: max_completion_tokens membatasi output model lengkap (rantai-pikiran + jawaban), sedangkan max_tokens hanya membatasi bagian jawaban. Untuk model pemikiran, kami merekomendasikan agar Anda menggunakan max_completion_tokens.Model yang didukung:
Model yang tercantum di atas tidak termasuk model yang disediakan langsung oleh pihak ketiga.
Mungkin terdapat perbedaan hingga 10 token antara jumlah token output aktual dan nilai vl_high_resolution_imagesboolean(Opsional) Nilai default: falseMenentukan apakah akan meningkatkan batas piksel untuk input gambar ke jumlah piksel yang sesuai dengan 16384 token. Untuk informasi selengkapnya, lihat Memproses gambar resolusi tinggi.
Parameter ini bukan parameter OpenAI standar. Saat Anda memanggil menggunakan SDK Python, letakkan di objek extra_body. Konfigurasi: extra_body={"vl_high_resolution_images":xxx}.n integer(Opsional) Nilai default: 1Jumlah respons yang dihasilkan. Kisaran nilai adalah 1-4. Ini cocok untuk skenario yang memerlukan beberapa respons kandidat, seperti penulisan kreatif atau iklan.Hanya didukung oleh Qwen3 (mode non-pemikiran) models. Jika parameter Meningkatkan n meningkatkan konsumsi token output tetapi tidak meningkatkan konsumsi token input.enable_thinking boolean (Opsional)Saat Anda menggunakan model campuran-pemikiran, yang mendukung mode pemikiran dan non-pemikiran, parameter ini menentukan apakah akan mengaktifkan mode pemikiran. Ini berlaku untuk model Qwen3.7, Qwen3.6, Qwen3.5, Qwen3, Qwen3-Omni-Flash, dan Qwen3-VL, serta seri DeepSeek-V4-Pro/V4-Flash, seri DeepSeek-V3.2/V3.2-exp/V3.1, Kimi-K2.7-code (hanya model pemikiran), seri Kimi-K2.6/K2.5, dan seri GLM. Seri DeepSeek-V4 mengaktifkan pemikiran secara default. Anda dapat menyesuaikan intensitas inferensi dengan parameter reasoning_effort.Nilai yang valid:
Parameter ini bukan parameter OpenAI standar. Saat Anda memanggil menggunakan SDK Python, letakkan di objek extra_body. Konfigurasi: Jika Anda memanggil langsung melalui HTTP (misalnya, dengan curl) alih-alih menggunakan SDK OpenAI, jangan gunakan
Model MiniMax dan MiniMax-M3 dari Xiyu Technology tidak menggunakan parameter ini. Sebagai gantinya, gunakan parameter thinking object (Opsional) Nilai default: {"type":"adaptive"}Mengontrol mode pemikiran MiniMax/MiniMax-M3 yang disediakan oleh MiniMax.Nilai yang valid untuk thinking.type:
Parameter ini bukan parameter OpenAI standar. Saat Anda memanggil menggunakan SDK Python, letakkan di objek extra_body. Konfigurasi: preserve_thinking boolean (Opsional) Nilai default: false (Nilai default untuk qwen3.8-max/qwen3.8-flash:true)Menentukan apakah akan menambahkan reasoning_content dari pesan asisten dalam riwayat percakapan ke input model. Ini cocok untuk skenario di mana model perlu merujuk ke proses pemikiran historis.Saat ini didukung oleh qwen3.7-max, qwen3.7-max-2026-05-20 dan snapshot berikutnya, qwen3.6-max-preview, qwen3.7-plus, qwen3.7-plus-2026-05-26, qwen3.6-plus, qwen3.6-plus-2026-04-02, qwen3.7-flash, qwen3.7-flash-2026-07-15, qwen3.6-flash, qwen3.6-flash-2026-04-16, qwen3.8-max (diaktifkan secara default), qwen3.8-flash (diaktifkan secara default), kimi-k2.6 (dideploy di Alibaba Cloud Model Studio), kimi-k2.7-code (dideploy di Alibaba Cloud Model Studio, diaktifkan secara default), kimi/kimi-k2.7-code-highspeed (disediakan oleh Moonshot AI, diaktifkan secara default), dan kimi/kimi-k2.7-code (disediakan oleh Moonshot AI, diaktifkan secara default).Penting (qwen3.8-max/qwen3.8-flash): Saat menggunakan qwen3.8-max/qwen3.8-flash, preserve_thinking defaultnya true. Anda harus mengirim kembali semua reasoning_content historis di field reasoning_content. JANGAN menggabungkan reasoning_content ke dalam field content. Melakukan hal tersebut dapat menurunkan performa model.
Parameter ini bukan parameter OpenAI standar. Saat Anda memanggil menggunakan SDK Python, letakkan di objek extra_body. Konfigurasi: thinking_budget integer (Opsional)Jumlah maksimum token untuk proses pemikiran. Ini berlaku untuk model Qwen3.8, Qwen3.7, Qwen3.6, Qwen3.5, Qwen3-VL, Qwen3, GLM dan Kimi, kecuali kimi-k3 yang tidak mendukung parameter ini. Untuk informasi selengkapnya, lihat Batasi panjang pemikiran.Nilai default adalah panjang rantai-pikiran maksimum model. Untuk informasi selengkapnya, lihat daftar model.
Parameter ini bukan parameter OpenAI standar. Saat Anda memanggil menggunakan SDK Python, letakkan di objek extra_body. Konfigurasi: reasoning_effort string (Opsional)Mengontrol intensitas inferensi model. Nilai yang valid dan nilai default bervariasi berdasarkan model.Seri DeepSeek-V4 dan GLM (Nilai default: high)Nilai yang valid:
maxNilai yang valid:
enable_thinking hanya mendukung true. Meneruskan false menyebabkan permintaan API gagal.deepseek-v4-flash-0731 & deepseek-v4-pro-0813: Nilai default:highNilai yang valid:
medium dipetakan ke high, xhigh dipetakan ke high.kimi/kimi-k3 (Nilai default: max; hanya max yang didukung)Nilai yang valid:
xhighNilai yang valid:
max dipetakan ke xhigh, high dipetakan ke xhigh, minimal dipetakan ke low, dan none dipetakan ke enable_thinking=False.Mengatur nilai selain nilai valid dan nilai yang dipetakan di atas akan menyebabkan error.Untuk seri qwen3.8, reasoning_effort dan thinking_budget tidak dapat diatur secara bersamaan. Mengatur keduanya akan menyebabkan error. Namun, keduanya mendukung konversi timbal balik:
Parameter ini bukan parameter OpenAI standar. Saat Anda memanggil menggunakan SDK Python, letakkan di objek extra_body. Konfigurasi: tool_stream boolean (Opsional) Nilai default: falseHanya berlaku saat stream=true. Parameter ini saat ini hanya didukung oleh seri Qwen dan GLM.Daftar dukungan seri Qwen:
tool_stream hanya memengaruhi parameter alat kompleks. Untuk parameter alat normal, keluaran streaming diaktifkan selama stream=true. Alat kompleks adalah alat di mana beberapa jenis parameter dalam definisi alat adalah array atau object.
Parameter ini bukan parameter OpenAI standar. Saat Anda memanggil menggunakan SDK Python, letakkan di objek extra_body. Konfigurasi: enable_code_interpreter boolean (Opsional) Nilai default: falseMenentukan apakah akan mengaktifkan fitur interpreter kode. Untuk informasi selengkapnya, lihat Interpreter kode.Nilai yang valid:
Parameter ini bukan parameter OpenAI standar. Saat Anda memanggil menggunakan SDK Python, letakkan di objek extra_body. Konfigurasi: seedinteger(Opsional)Bilangan acak seed. Parameter ini digunakan untuk memastikan hasil yang dapat direproduksi dengan input dan parameter yang sama. Jika Anda meneruskan nilai seed yang sama dalam pemanggilan dan parameter lainnya tetap tidak berubah, model mengembalikan hasil yang sama sebanyak mungkin.Kisaran nilai: [0,2<sup>31</sup>−1].logprobs boolean (Opsional) Nilai default: falseMenentukan apakah akan mengembalikan log probabilitas token output. Nilai yang valid:
Konten yang dihasilkan selama fase pemikiran (
Model yang didukung
integer (Opsional) Nilai default: 0Menentukan jumlah token kandidat paling mungkin yang dikembalikan pada setiap langkah generasi.Kisaran nilai: [0, 5]Parameter ini hanya berlaku saat logprobs adalah true.stopstring atau array(Opsional)Digunakan untuk menentukan kata berhenti. Saat string atau token_id yang ditentukan dalam stop muncul dalam teks yang dihasilkan, generasi segera dihentikan.Anda dapat meneruskan kata sensitif untuk mengontrol output model.Saat stop adalah array, Anda tidak dapat memasukkantools array(Opsional)Array yang berisi satu atau lebih objek alat untuk dipanggil model dalam Pemanggilan Fungsi. Untuk informasi selengkapnya, lihat Pemanggilan fungsi.Jika tools diatur dan model menentukan bahwa alat perlu dipanggil, respons mengembalikan informasi alat dalam tool_calls.
Properti type string(Wajib)Jenis alat. Saat ini, hanya function yang didukung.functionobject(Wajib)
Properti name string(Wajib)Nama alat. Hanya huruf, angka, garis bawah (_), dan tanda hubung (-) yang diperbolehkan. Panjang maksimum adalah 64 token.descriptionstring(Wajib)Deskripsi alat, yang membantu model menentukan kapan dan bagaimana memanggil alat.parametersobject(Opsional) Nilai default: {}Deskripsi parameter untuk alat, yang harus berupa JSON Schema yang valid. Untuk deskripsi JSON Schema, lihat tautan. Jika parameter parameters kosong, alat tidak memiliki parameter input, seperti alat kueri waktu.
Untuk meningkatkan akurasi pemanggilan alat, kami merekomendasikan agar Anda meneruskan string atau object(Opsional) Nilai default: autoStrategi pemilihan alat. Untuk memaksa metode pemanggilan alat tertentu untuk jenis masalah tertentu, seperti selalu menggunakan alat tertentu atau menonaktifkan semua alat, Anda dapat mengatur parameter ini.Nilai yang valid:
boolean (Opsional) Nilai default: falseMenentukan apakah akan mengaktifkan pemanggilan alat paralel. Untuk informasi selengkapnya, lihat Pemanggilan alat paralel.Nilai yang valid:
boolean(Opsional) Nilai default: falseMenentukan apakah akan mengaktifkan pencarian web. Untuk informasi selengkapnya, lihat Pencarian web.Nilai yang valid:
Mengaktifkan fitur pencarian web dapat meningkatkan konsumsi token.
Parameter ini bukan parameter OpenAI standar. Saat Anda memanggil menggunakan SDK Python, letakkan di objek extra_body. Konfigurasi: search_optionsobject(Opsional)Strategi untuk pencarian web. Untuk informasi selengkapnya, lihat Pencarian web.
Properti forced_search boolean(Opsional) Nilai default: falseMenentukan apakah akan memaksa pencarian web. Parameter ini hanya berlaku saat enable_search diatur ke true.Nilai yang valid:
string(Opsional) Nilai default: turboStrategi pencarian. Parameter ini hanya berlaku saat enable_search diatur ke true.Nilai yang valid:
boolean(Opsional) Nilai default: falseMenentukan apakah akan mengaktifkan pencarian vertikal. Parameter ini hanya berlaku saat enable_search diatur ke true.Nilai yang valid:
Parameter ini bukan parameter OpenAI standar. Saat Anda memanggil menggunakan SDK Python, letakkan di objek extra_body. Konfigurasi: clear_thinkingboolean(Opsional) Nilai default: falseMengontrol apakah reasoning_content (proses pemikiran) dari putaran sebelumnya dalam percakapan multi-putaran digunakan sebagai input konteks untuk model. Parameter ini hanya didukung oleh model seri GLM glm-5.2, glm-5.1, glm-5, dan glm-4.7.
Parameter ini bukan parameter OpenAI standar. Saat Anda memanggil menggunakan SDK Python, letakkan di objek extra_body. Konfigurasi:
|
|
Objek respons Chat (keluaran non-streaming)idstringPengenal unik untuk pemanggilan ini.choicesarrayArray konten yang dihasilkan model.
Properti finish_reason stringAlasan mengapa model berhenti menghasilkan.Pertimbangkan tiga skenario berikut:
integerIndeks objek ini dalam array choices.logprobsobjectInformasi probabilitas token output model.
Properti content arrayArray yang berisi setiap token dan log probabilitasnya.
Properti token stringTeks token saat ini.bytes arrayDaftar byte UTF-8 mentah token saat ini. Ini digunakan untuk memulihkan konten output secara akurat, seperti emoji atau karakter Tionghoa.logprob floatLog probabilitas token saat ini. Nilai kembalian null menunjukkan probabilitas yang sangat rendah.top_logprobs arrayToken kandidat paling mungkin pada posisi token saat ini. Jumlah token konsisten dengan parameter permintaan top_logprobs. Setiap elemen berisi:
Properti token stringTeks token kandidat.bytes arrayDaftar byte UTF-8 mentah token saat ini. Ini digunakan untuk memulihkan konten output secara akurat, seperti emoji atau karakter Tionghoa.logprob floatLog probabilitas token kandidat ini. Nilai null menunjukkan probabilitas yang sangat rendah.objectPesan yang dikeluarkan oleh model.
Properti content stringKonten balasan model.reasoning_content stringKonten rantai-pikiran model.refusal stringParameter ini saat ini tetap null.role stringPeran pesan. Nilainya tetap assistant.audio objectParameter ini saat ini tetap null.function_call (akan ditinggalkan)objectNilai ini tetap null. Untuk informasi selengkapnya, lihat parameter tool_calls.tool_calls arrayInformasi tentang alat dan parameter inputnya yang diputuskan model untuk dipanggil.
Properti id stringPengenal unik untuk pemanggilan alat ini.type stringJenis alat. Saat ini, hanya function yang didukung.function objectRincian alat
Properti name stringNama alat.arguments stringInformasi parameter input, sebagai string berformat JSON.Karena respons model bahasa besar bersifat acak, informasi parameter output mungkin tidak sesuai dengan signature fungsi. Anda harus memvalidasi parameter sebelum memanggil fungsi. integerIndeks pemanggilan alat ini dalam array tool_calls.integerTimestamp Unix, dalam detik, saat permintaan dibuat.modelstringModel yang digunakan untuk permintaan ini.object stringNilainya selalu chat.completion.service_tier stringParameter ini saat ini tetap null.system_fingerprintstringParameter ini saat ini tetap null.usage objectInformasi konsumsi token untuk permintaan ini.
Properti completion_tokens integerJumlah token dalam output model.prompt_tokens integerJumlah token input. Untuk informasi selengkapnya, lihat Catatan tambahan.total_tokens integerJumlah total token yang dikonsumsi. Ini adalah jumlah dari prompt_tokens dan completion_tokens.completion_tokens_details object (Opsional)Klasifikasi rinci token output. Field ini hanya dikembalikan oleh beberapa model.
Properti audio_tokens integer (Opsional)Jumlah token audio output. Field ini hanya dikembalikan untuk model output audio.reasoning_tokens integer (Opsional)Jumlah token dalam proses pemikiran. Field ini hanya dikembalikan untuk model penalaran.text_tokens integer (Opsional)Jumlah token dalam teks output.objectKlasifikasi rinci token input.
Properti audio_tokens integerParameter ini saat ini tetap null.cached_tokens integerJumlah token yang mengenai cache. Untuk informasi selengkapnya tentang Context Cache, lihat Context cache.text_tokens integerJumlah token teks input.image_tokens integerJumlah token gambar input.video_tokens integerJumlah token untuk file video atau daftar gambar input.cache_creation objectInformasi pembuatan cache eksplisit.
Properti ephemeral_5m_input_tokens integerJumlah token yang digunakan untuk membuat cache eksplisit.integerJumlah token yang digunakan untuk membuat cache eksplisit.cache_type stringSaat Anda menggunakan cache eksplisit, nilai parameter adalah ephemeral. Jika tidak, parameter ini tidak ada. |
Objek potongan respons Chat (keluaran streaming)idstringPengenal unik untuk pemanggilan ini. Setiap objek potongan memiliki ID yang sama.choicesarrayArray konten yang dihasilkan model, yang dapat berisi satu atau lebih objek. Jika parameter include_usage diatur ke true, choices adalah array kosong dalam potongan terakhir.
Properti delta objectObjek inkremental permintaan.
Properti content stringKonten pesan inkremental.reasoning_content stringKonten rantai-pikiran inkremental.function_call objectNilai ini default ke null. Untuk informasi selengkapnya, lihat parameter tool_calls.audioobjectBalasan yang dihasilkan saat Anda menggunakan model Qwen-Omni.
Properti data stringData audio Base64-encoded inkremental.expires_at integerTimestamp saat permintaan dibuat.objectParameter ini saat ini tetap null.role stringPeran objek pesan inkremental. Memiliki nilai hanya pada potongan pertama.tool_calls arrayInformasi tentang alat dan parameter inputnya yang diputuskan model untuk dipanggil.
Properti index integerIndeks pemanggilan alat ini dalam array tool_calls.id stringPengenal unik untuk pemanggilan alat ini.function objectInformasi tentang alat yang dipanggil.
Properti arguments stringParameter input inkremental. arguments dari semua potongan digabungkan untuk membentuk set parameter input lengkap.Karena respons model bahasa besar bersifat acak, informasi parameter output mungkin tidak sesuai dengan signature fungsi. Anda harus memvalidasi parameter sebelum memanggil fungsi.name stringNama alat. Memiliki nilai hanya pada potongan pertama.stringJenis alat. Saat ini, hanya function yang didukung.stringAlasan mengapa model berhenti menghasilkan. Nilainya dapat berupa salah satu dari berikut:
integerIndeks respons saat ini dalam array choices. Saat parameter input n lebih besar dari 1, Anda dapat menggunakan parameter ini untuk menggabungkan konten lengkap yang sesuai dengan respons berbeda.logprobsobjectInformasi probabilitas objek saat ini.
Properti content arrayArray token dengan informasi log probabilitas.
Properti token stringToken saat ini.bytes arrayDaftar byte UTF-8 mentah token saat ini. Ini membantu saat Anda memproses emoji dan karakter Tionghoa.logprob floatLog probabilitas token saat ini. Nilai null menunjukkan probabilitas yang sangat rendah.top_logprobs arrayToken paling mungkin pada posisi token saat ini dan log probabilitasnya. Jumlah elemen konsisten dengan parameter input top_logprobs.
Properti token stringToken saat ini.bytes arrayDaftar byte UTF-8 mentah token saat ini. Ini membantu saat Anda memproses emoji dan karakter Tionghoa.logprob floatLog probabilitas token saat ini. Nilai null menunjukkan probabilitas yang sangat rendah.integerTimestamp saat permintaan ini dibuat. Setiap potongan memiliki timestamp yang sama.modelstringModel yang digunakan untuk permintaan ini.object stringNilainya selalu chat.completion.chunk.service_tier stringParameter ini saat ini tetap null.system_fingerprintstringParameter ini saat ini tetap null.usage objectToken yang dikonsumsi oleh permintaan ini. Ditampilkan hanya dalam potongan terakhir saat include_usage diatur ke true.
Properti completion_tokens integerJumlah token dalam output model.prompt_tokens integerJumlah token input.total_tokens integerJumlah total token, yang merupakan jumlah dari prompt_tokens dan completion_tokens.completion_tokens_details object (Opsional)Informasi rinci tentang token output. Field ini hanya dikembalikan oleh beberapa model.
Properti audio_tokens integer (Opsional)Jumlah token audio output. Field ini hanya dikembalikan untuk model output audio.reasoning_tokens integer (Opsional)Jumlah token dalam proses pemikiran. Field ini hanya dikembalikan untuk model penalaran.text_tokensinteger (Opsional)Jumlah token teks output.objectKlasifikasi rinci token input.
Properti audio_tokens integerJumlah token audio input.Jumlah token audio dalam file video dikembalikan dalam parameter ini.text_tokens integerJumlah token teks input.video_tokens integerJumlah token untuk video input, yang dapat berupa daftar gambar atau file video.image_tokens integerJumlah token gambar input.cached_tokens integerJumlah token yang mengenai cache. Untuk informasi selengkapnya tentang Context Cache, lihat Context cache.cache_creation objectInformasi pembuatan cache eksplisit.
Properti ephemeral_5m_input_tokens integerJumlah token yang digunakan untuk membuat cache eksplisit.integerJumlah token yang digunakan untuk membuat cache eksplisit.cache_type stringJenis cache. Nilainya tetap ephemeral. |