Aliran balik log mengonversi log inferensi SLS (Simple Log Service) menjadi dataset terstruktur yang dapat digunakan untuk penyempurnaan model atau evaluasi model.
Ikhtisar fitur
Fitur aliran balik log mengalirkan kembali data log inferensi dari SLS (Simple Log Service) ke platform Bailian, memformatnya, dan menghasilkan dataset terstruktur (dalam format JSONL) yang dapat digunakan untuk penyempurnaan model atau evaluasi model. Aliran balik ini menghasilkan data terstruktur, bukan salinan langsung dari log mentah.
Cakupan
Aliran balik log mendukung pembuatan dua jenis dataset berikut:
- Training set: Skenario pelatihan adalah generasi teks, dan metode pelatihan mendukung SFT (Supervised Fine-Tuning).
- Evaluation set: Mendukung skenario generasi teks.
Aktifkan dan otorisasi layanan terkait
Sebelum menggunakan aliran balik log, pastikan wilayah saat ini adalah China (Beijing) atau Singapore (entri aliran balik log tidak ditampilkan di wilayah lain), dan selesaikan aktivasi layanan serta otorisasi izin berikut pada halaman Pemantauan model. Setelah semua langkah selesai, panel konfigurasi otorisasi akan otomatis tertutup dan Anda akan masuk ke formulir aliran balik log.

Aktifkan log audit dan log inferensi
Log audit dan log inferensi masing-masing memerlukan tiga langkah yang harus diselesaikan. Anda hanya dapat menggunakan aliran balik log setelah keenam kondisi terpenuhi. Log audit merupakan prasyarat untuk log inferensi, sehingga Anda harus menyelesaikan semua langkah log audit terlebih dahulu.
Log audit
- Otorisasi peran terkait layanan SLS: Klik Authorize Now untuk mengotorisasi peran AliyunServiceRoleForSFMAccessSLS. Jika belum diotorisasi, label merah Not Authorized akan ditampilkan.
- Aktifkan Layanan Log SLS: Jika belum diaktifkan, status Not Activated dan tautan pengalihan akan ditampilkan. Klik tautan tersebut untuk membuka konsol SLS dan menyelesaikan aktivasi.
- Aktifkan log audit: Klik Create and Enable Audit Logs, dan sistem akan membuat instans LogStore serta melakukan polling hingga siap (maksimal 60 detik).
- Otorisasi peran terkait layanan SLS untuk log inferensi.
- Pastikan Layanan Log SLS telah diaktifkan.
- Aktifkan log inferensi: Jika log audit belum diaktifkan, tombol ini akan dinonaktifkan. Anda harus mengaktifkan log audit terlebih dahulu.
Nama peran | Tujuan | Waktu otorisasi |
|---|---|---|
AliyunServiceRoleForSFMAccessSLS | Bailian mengakses data log SLS | Diotorisasi sekali untuk log audit dan sekali untuk log inferensi |
Buat dataset aliran balik log
Aliran balik log menyediakan tiga titik masuk, semuanya mengarah ke formulir konfigurasi untuk membuat dataset:
- Halaman daftar Pemantauan model
- Halaman detail Pemantauan model
- Halaman manajemen data

Konfigurasi parameter aliran balik
Setelah memasuki formulir aliran balik log, konfigurasikan parameter berikut dari atas ke bawah. Beberapa parameter memiliki prasyarat: pemfilteran API Key memerlukan pemilihan rentang waktu terlebih dahulu, dan pemilihan model memerlukan pemilihan rentang waktu dan API Key terlebih dahulu. Mengubah rentang waktu, tipe data, skenario pelatihan, atau metode pelatihan akan mengatur ulang parameter lain secara berjenjang, sehingga disarankan untuk mengisi formulir secara ketat sesuai urutan. Nilai parameter dijelaskan dalam tabel di bawah ini.
Estimated backflow data: Sistem menampilkan perkiraan jumlah entri data aliran balik berdasarkan kondisi filter. Ketika jumlah melebihi 100.000, peringatan merah akan ditampilkan, dan kelebihannya tidak akan dialirkan balik. Ketika hasil kueri terlalu banyak, tombol OK akan dinonaktifkan, dan Anda perlu mempersempit rentang filter.
Parameter | Deskripsi | Wajib | Deskripsi nilai |
|---|---|---|---|
Lokasi aliran balik | Metode penyimpanan dataset | Ya | Platform storage (default). Tidak dapat diubah setelah pembuatan |
Nama dataset | Nama tampilan dataset dalam daftar | Ya | Nama hanya boleh terdiri dari karakter Mandarin, Inggris, angka, underscore (_), garis miring (/), dan tanda hubung (-), dengan panjang maksimal 50 karakter. Format penamaan yang direkomendasikan: function_scenario_model_name_time. Nama tidak dapat diubah setelah dibuat. |
Deskripsi dataset | Deskripsi tambahan mengenai tujuan dataset | Tidak | Maksimal 200 karakter |
Tipe dan format | Tipe tujuan dataset | Ya | Training set atau evaluation set. Saat evaluation set dipilih, skenario pelatihan dan metode pelatihan disembunyikan. Tidak dapat diubah setelah pembuatan |
Skenario pelatihan | Tipe skenario pelatihan (ditampilkan hanya untuk training set) | Ya | Saat ini hanya generasi teks yang didukung |
Metode pelatihan | Metode penyempurnaan (ditampilkan hanya untuk training set) | Ya | SFT; opsi ditampilkan secara dinamis oleh sistem. Dikunci setelah pembuatan |
Rentang waktu | Periode waktu log aliran balik | Ya | 30 hari terakhir (termasuk hari ini), presisi hingga jam, menit, dan detik. Mengubahnya akan mengatur ulang pemilihan API Key dan model |
Filter API Key | Memfilter data log berdasarkan API Key | Ya | All (tanpa filter), Other (mengecualikan Key yang terdaftar), atau pilih Key tertentu (multi-pilih) |
Pemilihan model | Model target untuk aliran balik | Ya | Maksimal 10. Model yang tidak sesuai dengan filter tipe kemampuan akan dinonaktifkan |
Lihat hasil aliran balik
Setelah mengirimkan tugas aliran balik log, lihat dataset dan progres impor pada Data management halaman daftar.

Tampilan halaman daftar
Dataset yang dibuat melalui aliran balik log menampilkan metode impor sebagai Log Ingestion pada halaman daftar, dan lokasi penyimpanan ditampilkan sebagai Platform Storage berdasarkan pilihan saat pembuatan.
Anda dapat melihat status impor tugas pada halaman daftar. Saat tugas gagal, Anda dapat melihat alasan kegagalan spesifik yang dikembalikan oleh sistem.
Dalam mode penyimpanan platform, sistem secara otomatis menerbitkan versi dataset setelah impor selesai, tanpa memerlukan operasi manual.
Informasi halaman detail
Informasi yang ditampilkan pada halaman detail dataset bervariasi tergantung pada metode penyimpanan:
- Platform storage (OSS import): Menampilkan status rilis, volume data, waktu pembuatan, FileID, tipe data, status impor, dan alamat impor OSS.
- Kasus lainnya: Menampilkan status rilis, volume data, waktu pembuatan, FileID, tipe data, dan status impor.
Tambahkan data aliran balik log
Pada halaman Manajemen data, Anda dapat menambahkan batch baru data aliran balik log ke dataset yang sudah ada dengan dua cara berikut:
- Halaman impor data
- Dialog tambah versi
Praktik terbaik aliran balik inkremental
Disarankan untuk melakukan aliran balik secara bertahap, menargetkan periode waktu berbeda atau model berbeda secara terpisah, dan secara bertahap mengumpulkan training set berkualitas tinggi. Setiap batch dapat memilih secara tepat model dengan performa baik dan data dari jam sibuk bisnis, memastikan kualitas data lebih unggul dibandingkan aliran balik besar tunggal.
FAQ
Apa saja permintaan yang termasuk dalam "Other" pada filter API Key?
Apa saja permintaan yang termasuk dalam "Other" pada filter API Key?
Apakah batas 100.000 entri merupakan batas total dataset?
Apakah batas 100.000 entri merupakan batas total dataset?
Apakah log audit dan log inferensi merupakan operasi yang sama?
Apakah log audit dan log inferensi merupakan operasi yang sama?
Mengapa volume data perkiraan tidak konsisten dengan hasil aliran balik aktual?
Mengapa volume data perkiraan tidak konsisten dengan hasil aliran balik aktual?