Model penambangan data mengekstraksi informasi, memoderasi konten, mengklasifikasikan data, dan menghasilkan ringkasan. Model ini menghasilkan data terstruktur (seperti JSON) secara cepat dan akurat, berbeda dengan model chat umum yang mungkin mengembalikan format tidak konsisten atau mengekstraksi informasi secara salah.
Panduan implementasi
Qwen-Doc-Turbo mendukung ekstraksi informasi dari file melalui tiga cara. Untuk informasi lebih lanjut mengenai batasan ukuran dan jenis file, lihat Batasan.
Fitur | File URL (Direkomendasikan) | ID File | Teks biasa |
|---|---|---|---|
Sumber file | URL publik | File lokal (perlu diupload) | Diteruskan sebagai string |
Batas panjang input | Hingga 10 file tags preserved in actual output) | 1 file | Hingga 9.000 token |
Kompatibilitas SDK | Hanya | Upload: |
|
Keunggulan utama | Tidak perlu upload ke Model Studio. Mendukung panggilan batch. | Menghindari upload berulang. Ideal untuk penggunaan ulang. | Tidak memerlukan manajemen file. |
Prasyarat
- Anda telah membuat API key dan mengekspor API key sebagai variabel lingkungan.
- Jika Anda berencana memanggil model menggunakan SDK, instal OpenAI SDK atau DashScope SDK.
Gunakan URL file
Ekstrak data terstruktur menggunakan URL file (hingga 10 file sekaligus). Contoh ini meneruskan file Manual Produk Contoh A dan Manual Produk Contoh B, lalu meminta model mengembalikan informasi yang diekstraksi dalam format JSON.
Metode URL file hanya mendukung protokol DashScope. Gunakan DashScope Python SDK atau panggilan HTTP (seperti curl).
Contoh respons
Contoh respons
Gunakan ID file
Upload file
Sebelum menjalankan kode, unduh Manual Produk Contoh A dan letakkan di direktori proyek Anda. Upload file melalui antarmuka kompatibel OpenAI untuk mendapatkan file-id. Untuk detail API upload, lihat Referensi API.
file-id dari file yang diupload.
Teruskan informasi dan mulai percakapan menggunakan ID file
Teruskan file-id dalam pesan system (setelah pesan pengaturan role). Pesan user berisi kueri Anda tentang file tersebut.
Contoh lengkap: Upload file dan panggil model
Contoh lengkap: Upload file dan panggil model
Contoh respons
Contoh respons
Gunakan teks biasa
Anda dapat meneruskan konten file langsung sebagai string alih-alih menggunakan file-id. Untuk menghindari kebingungan, letakkan pesan pengaturan role terlebih dahulu dalam array messages.
Jika konten teks melebihi 9.000 token, gunakan URL file atau ID file sebagai gantinya (karena batasan ukuran body API).
Contoh respons
Contoh respons
Harga model
Model | Jendela konteks | Input maks | Output maks | Biaya input | Biaya output | Kuota gratis |
|---|---|---|---|---|---|---|
(Token) | (Juta token) | |||||
qwen-doc-turbo | 262.144 | 253.952 | 32.768 | $0,087 | $0,144 | Tidak ada kuota gratis |
FAQ
- Di mana file disimpan setelah diupload melalui antarmuka file kompatibel OpenAI? File yang diupload melalui antarmuka kompatibel OpenAI disimpan gratis di bucket Model Studio Anda. Untuk menanyakan dan mengelola file, lihat Antarmuka file OpenAI.
- Saat mengupload menggunakan metode URL file, apa perbedaan antara opsi parameter file_parsing_strategy? "auto": secara otomatis mengurai berdasarkan konten. "text_only": hanya mengurai teks. "text_and_images": mengurai teks dan gambar (meningkatkan waktu penguraian).
-
Bagaimana cara mengetahui apakah file telah selesai diurai?
Coba mulai percakapan dengan ID file tersebut. Jika file masih dalam proses penguraian, API akan mengembalikan
File parsing in progress, please try again later.— coba lagi setelah jeda. Jika pemanggilan berhasil, file sudah siap. - Apakah proses penguraian setelah upload file dikenai biaya tambahan? Penguraian dokumen tidak dikenai biaya.
Referensi API
Untuk parameter input dan output Qwen-Doc-Turbo, lihat Referensi API kompatibel OpenAI atau Referensi API DashScope.
Kode error
Jika pemanggilan model gagal dan mengembalikan pesan error, lihat Kode error untuk penyelesaian.
Batasan
-
Ketergantungan SDK:
- URL File (doc_url): Hanya mendukung protokol DashScope. Gunakan
DashScope Python SDKatau panggilan HTTP (seperti curl). - Upload file (file-id): Harus menggunakan SDK kompatibel
OpenAIuntuk upload dan manajemen.
- URL File (doc_url): Hanya mendukung protokol DashScope. Gunakan
-
Upload dan referensi file:
-
URL File (
doc_url): Maksimal 10 URL per permintaan. URL harus dapat diakses publik. -
Upload file (
file-id): Maksimal 150 MB per file. Batas akun: 10.000 file atau total 100 GB (file tidak pernah kedaluwarsa). Setiap permintaan hanya mereferensikan satu file.Permintaan upload gagal jika batas tercapai. Hapus file yang tidak diperlukan untuk membebaskan kuota. Lihat Kompatibel OpenAI - File untuk detailnya.
- Format yang didukung: TXT, DOC, DOCX, PDF, XLS, XLSX, MD, PPT, PPTX, JPG, JPEG, PNG, GIF, dan BMP.
-
URL File (
-
API Input:
- Menggunakan
doc_urlataufile-id: maksimal 262.144 token. - Teks biasa dalam pesan
user/system: maksimal 9.000 token per pesan.
- Menggunakan
-
Output API:
- Panjang output maksimum adalah 32.768 token.
-
Berbagi file:
file-idhanya berfungsi dalam akun yang menghasilkannya — tidak berlaku lintas akun atau dengan kunci API pengguna RAM.
- Batas laju: Lihat Pembatasan laju.