Topik ini menjelaskan cara menanyakan detail penagihan, menganalisis tagihan, dan menghentikan penagihan.
Kueri tagihan
Tagihan hanya dihasilkan setelah panggilan selesai. Tagihan untuk inferensi model dibuat dengan granularitas per menit, biasanya dalam waktu 2 hingga 10 menit. Tagihan untuk layanan seperti inferensi batch, pelatihan model, dan basis pengetahuan dibuat per jam. Selama jam sibuk, waktu yang ditampilkan di sistem dianggap sebagai waktu penagihan akhir.
Billing Overview
Masuk ke Konsol Model Studio. Klik tab Dashboard di bagian atas. Di panel navigasi kiri, pilih Usage & Billing > Billing Overview, lalu pilih billing month.
Halaman ini hanya menampilkan biaya untuk inferensi model. Untuk melihat biaya layanan seperti pelatihan model dan basis pengetahuan, lihat Billing Details.
- Lihat total konsumsi dan rinciannya: Bagian atas halaman menunjukkan Total amount bulan ini, yang dipecah menjadi Subscription (seperti Token Plan dan Coding Plan) dan Bill (untuk panggilan model dan pelatihan dengan metode bayar sesuai pemakaian). Klik View details pada kartu Subscription atau Bill untuk melihat rincian biaya. Grafik Bill trend di bawah hanya menampilkan jumlah bayar sesuai pemakaian dan tidak termasuk biaya langganan prabayar. Saat melihat data bulan berjalan, jumlah Bill biasanya diperbarui lebih dulu, sedangkan grafik Bill trend mungkin sedikit tertunda.
- Tanyakan biaya berdasarkan model atau API Key: Di bagian Bill trend, pilih model target dari daftar drop-down Model atau filter berdasarkan API Key ID, lalu beralih ke tampilan List. Kolom Payable amount pada tampilan List menunjukkan total biaya bulanan kumulatif untuk item yang dipilih.
- Bandingkan tren pengeluaran: Atur Grouping ke Category dan bandingkan tren pengeluaran untuk inferensi dan pelatihan model secara Daily atau Monthly.
- Atur peringatan penagihan: Pada kartu Bill, klik Edit di samping Bill alert. Di panel Usage limit & alerts, aktifkan batas bulanan, atur ambang batas, dan konfigurasi notifikasi email. Anda akan diberi tahu saat pengeluaran mencapai ambang batas tersebut. Ini membantu Anda menghindari gangguan layanan akibat pembayaran tertunda.
-
Lihat biaya kumulatif historis: Halaman Ikhtisar Penagihan hanya menampilkan total konsumsi bulan berjalan. Cost Analysis mendukung data hingga 12 bulan dengan granularitas bulanan dan hingga 92 hari dengan granularitas harian. Untuk melihat biaya lebih dari 12 bulan atau menghitung total pengeluaran historis Anda, ekspor tagihan bulan per bulan dari Billing Details dan agregasikan secara manual:
- Buka Expenses and Costs > Billing Details.
- Atur Product Name ke Alibaba Cloud Model Studio.
- Ganti bulan penagihan satu per satu dan ekspor tagihan tiap bulan sebagai file CSV. Untuk langkah ekspor, lihat Billing Details.
- Jumlahkan data yang diekspor dari semua bulan untuk mendapatkan total pengeluaran historis Anda.
Billing details
Tagihan untuk inferensi dan pelatihan model skala besar dapat dipecah untuk ditinjau berdasarkan API Key ID, workspace ID, model name, input/output type, invocation channel.
1. Unduh tagihan
- Di halaman Billing Details, pilih billing period.
- Pilih Product sebagai Alibaba Cloud Model Studio, lalu klik Search.
- Di pojok kanan atas daftar tagihan, klik Export Bill CSV untuk mengunduh tagihan.
- Buka file tersebut, temukan kolom Instance ID, lalu interpretasikan menggunakan aturan yang dijelaskan di bagian berikutnya.
2. Interpretasi bidang utama
Bidang "Instance ID" berisi beberapa informasi yang dipisahkan oleh titik koma (;).
- Contoh:
text_token;llm-xxx;qwen-max;output_token;app - Ini merepresentasikan informasi berikut secara berurutan:
billing type;workspace ID;model name;input/output type;invocation channel
3. Ketertelusuran data dan istilah
-
Kueri API Key: Salin
ApiKeyIDdari tagihan Anda dan buka halaman Model Studio API Key Management untuk menemukan nama kunci yang sesuai. -
Kueri workspace: Salin
workspace IDdari tagihan Anda. Buka halaman Workspaces untuk mengidentifikasi workspace spesifik tersebut. -
Deskripsi invocation channel:
app: Panggilan yang dilakukan dari aplikasi (melalui kode).bmp: Panggilan yang dilakukan dari Playground di konsol.assistant-api: Panggilan yang dilakukan melalui Assistant API.
Hentikan penagihan
Jika Anda tidak lagi menggunakan Model Studio, ikuti petunjuk di bawah untuk menghentikan layanan terkait dan mencegah biaya tambahan.
- Hentikan inferensi model: Hentikan panggilan API dari kode Anda dan hentikan penggunaan Playground di konsol untuk mencegah biaya tambahan. Untuk mencegah panggilan tidak sengaja, Anda dapat menghapus kunci Anda di halaman API-KEY.
- Hentikan pelatihan model: Anda tidak dikenai biaya saat tidak ada tugas pelatihan model yang sedang berjalan.
- Batalkan langganan Coding Plan: Coding Plan adalah produk langganan bulanan yang secara otomatis berhenti di akhir periode langganan. Pembatalan di tengah periode dan pengembalian dana tidak didukung. Jika Anda mengaktifkan perpanjangan otomatis, nonaktifkan di halaman Coding Plan.
- Berhenti berlangganan Token Plan Team Edition: Di halaman My Subscriptions Token Plan console, Anda dapat berhenti berlangganan kursi yang belum digunakan, dan pengembalian dana akan dikirim ke akun pembayaran asal. Jika Anda tidak ingin memperbarui langganan, nonaktifkan perpanjangan otomatis.
FAQ
Mengapa saya tidak dapat menemukan tagihan setelah memanggil model?
Mengapa saya tidak dapat menemukan tagihan setelah memanggil model?
- Latensi penagihan: Tagihan inferensi model diagregasi per menit dan biasanya muncul 2 hingga 10 menit setelah panggilan. Tagihan untuk inferensi batch, pelatihan model, dan basis pengetahuan diagregasi per jam. Pembuatan tagihan mungkin semakin tertunda selama jam sibuk.
- Penggunaan model non-komersial: Model dalam pratinjau publik atau pengujian undangan saja tidak menghasilkan catatan penagihan.
Mengapa model yang sama memiliki beberapa entri di tagihan saya?
Mengapa model yang sama memiliki beberapa entri di tagihan saya?
Instance ID di Billing Details untuk memahami rincian tiap item baris.Banyak entri tagihan bernama "Large Model Text Consumption". Bagaimana cara mengidentifikasi model untuk tiap entri?
Banyak entri tagihan bernama "Large Model Text Consumption". Bagaimana cara mengidentifikasi model untuk tiap entri?
12xxx;llm-xxx; qwen3.6-plus ;context_0-128k_input_token;bmp;0, modelnya adalah qwen3.6-plus.Di mana saya dapat melihat jumlah panggilan model dan statistiknya?
Di mana saya dapat melihat jumlah panggilan model dan statistiknya?
Apakah metode bayar sesuai pemakaian ditagih secara real time?
Apakah metode bayar sesuai pemakaian ditagih secara real time?
Mengapa saya memiliki pembayaran tertunda meskipun hampir tidak menggunakan layanan?
Mengapa saya memiliki pembayaran tertunda meskipun hampir tidak menggunakan layanan?
enable_search diaktifkan di aplikasi atau kode yang Anda buat sebelumnya, biaya pencarian web tetap dikenakan untuk tiap panggilan. Selain itu, saldo akun Alibaba Cloud Anda dikelola di tingkat akun. Jika ada produk Alibaba Cloud lain di bawah akun yang sama, seperti ECS atau OSS bayar sesuai pemakaian, memiliki tagihan yang belum diselesaikan, saldo tersedia Anda menjadi negatif, dan Model Studio juga menampilkan pembayaran tertunda, meskipun Anda belum menggunakan Model Studio itu sendiri. Menyelesaikan tagihan yang tertunda untuk produk yang terkena dampak akan memulihkan penggunaan normal Model Studio.Solusi:- Di Billing Details, filter untuk Alibaba Cloud Model Studio dan periksa kolom Instance ID (Billing Granularity) untuk mengidentifikasi nama model dan saluran pemanggilan yang menimbulkan biaya.
- Periksa apakah
enable_searchdiaktifkan di kode aplikasi atau konfigurasi aplikasi Model Studio Anda. Jika Anda tidak lagi membutuhkan pencarian web, atur parameter ini kefalseatau hapus. - Jika Anda telah menghentikan semua panggilan tetapi masih dikenai biaya, periksa apakah kunci API atau aplikasi lain masih berjalan. Anda dapat menemukan dan menghapus kunci yang tidak digunakan di halaman API Key Management.
Mengapa saldo saya cepat habis?
Mengapa saldo saya cepat habis?
- Token input terakumulasi dalam percakapan konteks panjang: Saat dokumen yang sama berulang kali disertakan dalam percakapan konteks panjang, token input tiap permintaan bertambah seiring akumulasi konteks, sehingga satu panggilan mengonsumsi jauh lebih banyak token daripada percakapan singkat. Misalnya, dalam satu investigasi, 43 dari 47 panggilan masing-masing mengonsumsi 580.000 hingga 600.000 token input, dan total token input melebihi 25 juta, yang menghabiskan saldo senilai CNY 120 dalam waktu sekitar 20 menit dan mengakibatkan pembayaran tertunda.
- Pemberitahuan peringatan dikirim dengan frekuensi terbatas: Saat kredit tersedia akun Anda turun di bawah ambang batas peringatan, Anda menerima pemberitahuan.Pemberitahuan dikirim melalui email.Jika Anda tidak memeriksa pemberitahuan tepat waktu, saldo Anda mungkin habis sebelum peringatan berikutnya.
- Latensi penagihan: Tagihan inferensi model diagregasi per menit. Oleh karena itu, Anda mungkin masih menerima tagihan yang dihasilkan akibat latensi penagihan setelah layanan ditangguhkan, dan jumlah tertunda dapat terus meningkat setelah penangguhan.
- Periksa konsumsi token tiap panggilan di halaman Model Usage untuk mengidentifikasi permintaan dengan penggunaan token tinggi.
- Konfigurasi peringatan kredit tersedia di halaman Billing Overview, dan periksa pemberitahuan peringatan segera.
- Untuk segera menghentikan penagihan, hapus kunci API yang tidak lagi Anda gunakan di halaman API Key Management.
Mengapa saya dikenai biaya meskipun tidak aktif melakukan panggilan API?
Mengapa saya dikenai biaya meskipun tidak aktif melakukan panggilan API?
- Buka halaman Model Deployment untuk memeriksa apakah ada model yang diterapkan dengan status Running. Jika Anda tidak lagi membutuhkannya, nonaktifkan untuk menghentikan penagihan.
- Hapus kunci API yang tidak digunakan untuk mencegah panggilan API tidak sengaja yang menghasilkan biaya inferensi (catatan: penghapusan tidak dapat dikembalikan, lakukan dengan hati-hati). Anda dapat mengelola kunci Anda di halaman API Key Management.
Bagaimana cara menentukan apakah akun saya telah disusupi?
Bagaimana cara menentukan apakah akun saya telah disusupi?
- Di Detailed Bill, filter berdasarkan Model Studio, dan periksa
ApiKeyIDdi kolom Instance ID (Billing Granularity) untuk mengidentifikasi API Key yang menghasilkan biaya tersebut. - Buka halaman API Key Management, tinjau waktu pembuatan tiap kunci, dan pastikan apakah kunci tersebut dibuat oleh Anda. Halaman API Key Management hanya menampilkan waktu pembuatan, bukan waktu pemanggilan.
- Tinjau distribusi waktu pemanggilan untuk mengidentifikasi pola pemanggilan abnormal yang mungkin bukan berasal dari Anda: Buka Model Usage, filter berdasarkan Model atau API Key ID, lalu beralih ke tampilan List untuk melihat distribusi waktu pemanggilan.
- Jika ditemukan pemanggilan tidak sah, segera buka halaman API Key Management untuk menghapus API Key yang bersangkutan dan membuat ulang. Perbarui semua pemanggil sah untuk menggunakan kunci baru tersebut.
Mengapa saya dikenai biaya tanpa membeli paket Model Studio?
Mengapa saya dikenai biaya tanpa membeli paket Model Studio?
Bagaimana cara memilih antara bayar sesuai pemakaian, kuota gratis, Coding Plan, paket sumber daya, dan rencana penghematan?
Bagaimana cara memilih antara bayar sesuai pemakaian, kuota gratis, Coding Plan, paket sumber daya, dan rencana penghematan?
Opsi | Model penagihan | Skenario | Tingkat harga | Batasan | Aturan utama |
|---|---|---|---|---|---|
Bayar sesuai pemakaian (default) | Post-paid, reserve and settle monthly | Penggunaan fluktuatif, atau evaluasi sebelum berkomitmen | Ditagih berdasarkan penggunaan token input dan output, tanpa diskon. Harga satuan per token adalah yang tertinggi di antara semua opsi. | Tidak perlu pembelian awal, sehingga opsi ini tersedia kapan saja. Model tidak dapat dipanggil saat pembayaran tertunda. | Tidak perlu pembelian awal. Tagihan akhir dihasilkan dan dikenakan di awal bulan berikutnya. Model tidak dapat dipanggil saat pembayaran tertunda. |
Kuota gratis | Kuota diberikan, diimbangi terlebih dahulu | Validasi fitur dan uji coba skala kecil | Gratis. Diberikan secara otomatis saat Anda mengaktifkan Model Studio. Kuota tidak dapat ditumpuk atau dibeli secara terpisah. | Jumlah kuota dan periode validitasnya tetap. Setelah kuota habis, penagihan secara otomatis kembali ke metode bayar sesuai pemakaian. Saat Stop when free quota is used up (worry-free mode) diaktifkan, rencana penghematan tidak dapat mengimbangi penggunaan. | Aktifkan Stop when free quota is used up (worry-free mode) di pengaturan model untuk menangguhkan panggilan segera setelah kuota habis, sehingga tidak ada biaya bayar sesuai pemakaian yang terakumulasi. Saat sakelar ini diaktifkan, tidak ada rencana penghematan yang diterapkan. Nonaktifkan sakelar untuk melanjutkan panggilan dan membiarkan rencana penghematan berlaku. |
Coding Plan | Langganan bulanan | Anggaran bulanan tetap untuk skenario coding | Biaya bulanan tetap yang tidak berubah dengan penggunaan token. | Hanya dapat digunakan untuk skenario alat pemrograman. Tidak dapat mengimbangi panggilan API reguler atau biaya inferensi model yang ditimbulkan di konsol. Langganan berhenti secara otomatis saat kedaluwarsa, dan pembatalan serta pengembalian dana di tengah periode tidak didukung. | Langganan berhenti secara otomatis saat kedaluwarsa. Pembatalan dan pengembalian dana di tengah periode tidak didukung. Jika perpanjangan otomatis diaktifkan, nonaktifkan di halaman Coding Plan. |
Token Plan | Pembelian kredit satu kali | Berbagi satu kuota di seluruh tim | Kredit dibeli per kursi sebagai pembayaran satu kali. | Hanya beberapa model yang didukung. Kuota independen dari saldo akun Anda. Kursi yang belum mengonsumsi penggunaan apa pun dapat berhenti berlangganan di halaman My Subscriptions. | Hanya beberapa model yang didukung. Anda dapat berhenti berlangganan secara individual untuk kursi yang belum mengonsumsi penggunaan apa pun di halaman My Subscriptions Token Plan console. |
Rencana penghematan umum AI (direkomendasikan) | Komitmen pengeluaran bulanan untuk mendapatkan diskon bertingkat | Penggunaan jangka panjang yang stabil untuk layanan model skala besar | Diskon bertingkat berdasarkan pengeluaran bulanan yang Anda komitmenkan: semakin tinggi komitmen, semakin dalam diskonnya. Untuk diskon tiap tingkat, lihat Rencana penghematan dan paket sumber daya. | Periode komitmen 3, 6, 12, atau 24 bulan tersedia. Kuota diberikan bulanan dan tidak dibawa ke periode berikutnya. Setelah rencana berlaku dan mulai mengimbangi penggunaan, umumnya tidak dapat berhenti berlangganan dan harus berjalan hingga kedaluwarsa. | Mencakup semua model. Setelah rencana berlaku dan mulai mengimbangi penggunaan, umumnya tidak dapat berhenti berlangganan dan harus berjalan hingga kedaluwarsa. |