Dokumen ini menjelaskan cara memanggil layanan inferensi model Kimi yang diterapkan di Alibaba Cloud Model Studio.
- Kompatibel dengan OpenAI
- DashScope
- AS (Virginia)
- Jerman (Frankfurt)
- Singapura
- Jepang (Tokyo)
- China (Beijing)
- China (Hong Kong)
base_url untuk panggilan SDK adalah: https://{WorkspaceId}.us-east-1.maas.aliyuncs.com/compatible-mode/v1URL permintaan HTTP: POST https://{WorkspaceId}.us-east-1.maas.aliyuncs.com/compatible-mode/v1/chat/completions{WorkspaceId} dengan ID ruang kerja aktual Anda.
Prasyarat: Anda harus mendapatkan Kunci API dan menetapkannya sebagai variabel lingkungan. Jika Anda menggunakan SDK, Anda harus menginstal SDK.
Mulai
Contoh berikut menggunakan input teks saja. Untuk contoh multimodal, lihat pemanggilan multimodal.
- Kompatibel dengan OpenAI
- DashScope
- Kompatibel dengan Anthropic
- Python
- Node.js
- HTTP
Respons
Pemanggilan multimodal
Model kimi-k2.7-code, kimi-k2.6, dan kimi-k2.5 dapat memproses teks, gambar, atau video secara simultan. Gunakan parameter enable_thinking untuk mengaktifkan mode berpikir. Contoh berikut menunjukkan cara menggunakan kemampuan ini.
Aktifkan atau nonaktifkan mode berpikir
kimi-k2.6 dan kimi-k2.5 adalah model berpikir hibrida. Model-model ini dapat membalas setelah berpikir atau membalas secara langsung. Anda dapat menggunakan parameter enable_thinking untuk mengontrol apakah akan mengaktifkan mode berpikir:
true: Aktifkan mode berpikirfalse(default): Menonaktifkan mode berpikir
kimi-k2.7-code adalah model berpikir saja: mode berpikir selalu diaktifkan (enable_thinking default ke true dan tidak dapat dinonaktifkan), dan preserve_thinking default ke true.
kimi-k2.6 mendukung meneruskan proses berpikir dalam percakapan multi-putaran dengan menggunakan parameter preserve_thinking. Untuk informasi lebih lanjut, lihat Meneruskan proses berpikir.
Contoh berikut menunjukkan cara menggunakan URL gambar dan mengaktifkan mode berpikir. Contoh utama menunjukkan input gambar tunggal, sedangkan kode yang dikomentari adalah contoh input multi-gambar.
- Kompatibel dengan OpenAI
- DashScope
Pemahaman video
- File video
- Daftar gambar
-
fps: Mengontrol frekuensi ekstraksi frame. Interval antar frame yang diekstraksi adalah f p s 1 detik. Nilainya harus berada dalam rentang [0,1, 10]. Nilai default adalah 2,0.
- Untuk adegan bergerak cepat: Atur nilai fps lebih tinggi untuk menangkap lebih banyak detail.
- Untuk video statis atau panjang: Atur nilai fps lebih rendah untuk meningkatkan efisiensi pemrosesan.
- max_frames: Menentukan jumlah maksimum frame yang diekstraksi dari video. Nilai default dan maksimum adalah 2000. Jika jumlah frame yang dihitung dari nilai fps melebihi batas ini, sistem secara otomatis mengekstraksi frame secara merata agar tetap dalam batas max_frames. Parameter ini hanya tersedia saat Anda menggunakan SDK DashScope.
- Kompatibel dengan OpenAI
- DashScope
Saat meneruskan file video ke model menggunakan SDK OpenAI atau permintaan HTTP, atur parameter"type"dalam pesan pengguna ke"video_url".
Meneruskan file lokal
Contoh berikut menunjukkan cara meneruskan file lokal. API kompatibel OpenAI hanya mendukung encoding Base64, sedangkan DashScope mendukung encoding Base64 dan jalur file.
- Kompatibel dengan OpenAI
- DashScope
Batasan file
- Batasan gambar
- Batasan video
-
Resolusi gambar:
- Ukuran minimum: Lebar dan tinggi masing-masing harus melebihi
10piksel. - Rasio aspek: Rasio sisi terpanjang terhadap sisi terpendek tidak boleh melebihi
200:1. - Resolusi maksimum: Disarankan maksimum
8K(7680x4320). Resolusi yang lebih tinggi dapat menyebabkan timeout panggilan API karena ukuran file besar atau transfer jaringan lambat.
- Ukuran minimum: Lebar dan tinggi masing-masing harus melebihi
-
Format gambar yang didukung
-
Format berikut didukung untuk resolusi di bawah 4K
(3840x2160):Format gambar
Ekstensi file
Jenis MIME
BMP
.bmp
image/bmp
JPEG
.jpe, .jpeg, .jpg
image/jpeg
PNG
.png
image/png
TIFF
.tif, .tiff
image/tiff
WEBP
.webp
image/webp
HEIC
.heic
image/heic
-
Untuk resolusi antara
4K(3840x2160)dan8K(7680x4320), hanya JPEG, JPG, dan PNG yang didukung.
-
Format berikut didukung untuk resolusi di bawah 4K
-
Ukuran gambar:
- Saat menyediakan gambar melalui URL publik atau jalur lokal, ukurannya tidak boleh melebihi
10 MB. - Saat menggunakan encoding Base64, string terenkripsi tidak boleh melebihi
10 MB.
Untuk mengompresi file, lihat Cara mengompresi gambar atau video agar memenuhi batas ukuran.
- Saat menyediakan gambar melalui URL publik atau jalur lokal, ukurannya tidak boleh melebihi
- Jumlah gambar yang didukung: Saat menyediakan beberapa gambar, jumlah total token untuk semua gambar dan teks tidak boleh melebihi batas input maksimum model.
Fitur lainnya
Model | |||||||
|---|---|---|---|---|---|---|---|
kimi-k2.7-code | Didukung | Didukung | Didukung | Tidak didukung | Tidak didukung | Tidak didukung | Didukung |
kimi-k2.6 | Didukung | Didukung | Didukung | Tidak didukung | Tidak didukung | Tidak didukung | Didukung |
kimi-k2.5 | Didukung | Didukung | Didukung | Tidak didukung | Tidak didukung | Tidak didukung | Didukung |
kimi-k2-thinking | Didukung | Didukung | Didukung | Didukung | Tidak didukung | Tidak didukung | Didukung |
Moonshot-Kimi-K2-Instruct | Didukung | Tidak didukung | Didukung | Tidak didukung | Didukung | Tidak didukung | Didukung |
Parameter default
Model | enable_thinking | suhu | top_p | presence_penalty | fps | max_frames |
|---|---|---|---|---|---|---|
kimi-k2.7-code | true (hanya mode berpikir) | 1.0 | 0.95 | 0.0 | 2 | 2000 |
kimi-k2.6 | false | mode berpikir: 1.0 mode non-berpikir: 0.6 | Kedua mode: 0.95 | Kedua mode: 0.0 | 2 | 2000 |
kimi-k2.5 | false | mode berpikir: 1.0 mode non-berpikir: 0.6 | Kedua mode: 0.95 | Kedua mode: 0.0 | 2 | 2000 |
kimi-k2-thinking | - | 1.0 | - | - | - | - |
Moonshot-Kimi-K2-Instruct | - | 0.6 | 1.0 | 0 | - | - |
Model dan penagihan
Seri Kimi adalah model bahasa besar dari Moonshot AI.
- kimi-k2.7-code: Model Kimi paling canggih untuk pemrograman. Model ini mengikuti instruksi konteks panjang lebih andal dan mencapai tingkat keberhasilan lebih tinggi dalam tugas pemrograman. Mendukung input teks, gambar, dan video, mode berpikir, percakapan, dan tugas agen.
- kimi-k2.6: Model terbaru dan paling canggih dalam seri Kimi. Model ini menawarkan peningkatan kinerja dalam pemrograman jangka panjang, mengikuti instruksi, dan koreksi diri. Mendukung input teks, gambar, dan video, mode berpikir dan non-berpikir, percakapan, dan tugas agen.
- kimi-k2.5: Mencapai kinerja teknologi terkini (SOTA) pada benchmark sumber terbuka untuk tugas agen, pembuatan kode, pemahaman visual, dan tugas kecerdasan umum lainnya. Mendukung input gambar, video, dan teks, mode berpikir dan non-berpikir, percakapan, dan tugas agen.
- kimi-k2-thinking: Hanya mendukung mode pemikiran mendalam. Model ini mengekspos proses penalaran melalui bidang
reasoning_content. Model ini unggul dalam pemrograman dan pemanggilan alat, serta cocok untuk kasus penggunaan yang memerlukan analisis logis, perencanaan, atau pemahaman mendalam. - Moonshot-Kimi-K2-Instruct: Tidak mendukung pemikiran mendalam. Model ini menghasilkan respons dengan latensi lebih rendah, dan cocok untuk kasus penggunaan yang memerlukan jawaban langsung dan cepat.
Untuk harga kimi-k2.7-code, lihat penagihan pemanggilan model.Untuk detail harga dan jendela konteks, lihat Konsol Model Studio. Penagihan didasarkan pada jumlah token input dan output.
Dalam mode berpikir, rantai pemikiran dihitung sebagai token output.