Topik ini menjelaskan cara menanyakan detail penagihan, menganalisis tagihan, dan menghentikan penagihan.
Kueri tagihan
Tagihan hanya dihasilkan setelah panggilan selesai. Tagihan untuk inferensi model dibuat dengan granularitas per menit, biasanya dalam waktu 2 hingga 10 menit. Tagihan untuk layanan seperti inferensi batch, pelatihan model, dan basis pengetahuan dibuat per jam. Selama jam sibuk, waktu yang ditampilkan di sistem dianggap sebagai waktu penagihan akhir.
Billing Overview
Masuk ke Konsol Model Studio. Klik tab Dashboard di bagian atas. Di panel navigasi kiri, pilih Usage & Billing > Billing Overview, lalu pilih billing month.
Halaman ini hanya menampilkan biaya untuk inferensi model. Untuk melihat biaya layanan seperti pelatihan model dan basis pengetahuan, lihat Billing Details.
-
Lihat total konsumsi dan rinciannya: Bagian atas halaman menunjukkan Total amount bulan ini, yang dipecah menjadi Subscription (seperti Token Plan dan Coding Plan) dan Bill (untuk panggilan model dan pelatihan dengan metode bayar sesuai pemakaian). Klik View details pada kartu Subscription atau Bill untuk melihat rincian biaya. Grafik Bill trend di bawah hanya menampilkan jumlah bayar sesuai pemakaian dan tidak termasuk biaya langganan prabayar. Saat melihat data bulan berjalan, jumlah Bill biasanya diperbarui lebih dulu, sedangkan grafik Bill trend mungkin sedikit tertunda.
-
Tanyakan biaya berdasarkan model atau API Key: Di bagian Bill trend, pilih model target dari daftar drop-down Model atau filter berdasarkan API Key ID, lalu beralih ke tampilan List. Kolom Payable amount pada tampilan List menunjukkan total biaya bulanan kumulatif untuk item yang dipilih.
-
Bandingkan tren pengeluaran: Atur Grouping ke Category dan bandingkan tren pengeluaran untuk inferensi dan pelatihan model secara Daily atau Monthly.
-
Atur peringatan penagihan: Pada kartu Bill, klik Edit di samping Bill alert. Di panel Usage limit & alerts, aktifkan batas bulanan, atur ambang batas, dan konfigurasi notifikasi email. Anda akan diberi tahu saat pengeluaran mencapai ambang batas tersebut. Ini membantu Anda menghindari gangguan layanan akibat pembayaran tertunda.
-
Lihat biaya kumulatif historis: Halaman Ikhtisar Penagihan hanya menampilkan total konsumsi bulan berjalan. Cost Analysis mendukung data hingga 12 bulan dengan granularitas bulanan dan hingga 92 hari dengan granularitas harian. Untuk melihat biaya lebih dari 12 bulan atau menghitung total pengeluaran historis Anda, ekspor tagihan bulan per bulan dari Billing Details dan agregasikan secara manual:
- Buka Expenses and Costs > Billing Details.
- Atur Product Name ke Alibaba Cloud Model Studio.
- Ganti bulan penagihan satu per satu dan ekspor tagihan tiap bulan sebagai file CSV. Untuk langkah ekspor, lihat Billing Details.
- Jumlahkan data yang diekspor dari semua bulan untuk mendapatkan total pengeluaran historis Anda.
Semua opsi statistical period di halaman Billing Details hanya mencakup satu bulan, sehingga agregasi lintas bulan tidak didukung dan harus dilakukan secara manual setelah mengekspor tiap bulan. Di kotak dialog ekspor, Anda dapat memilih content from the last 18 months untuk ekspor batch.
Billing details
Tagihan untuk inferensi dan pelatihan model skala besar dapat dipecah untuk ditinjau berdasarkan API Key ID, workspace ID, model name, input/output type, invocation channel.
1. Unduh tagihan
- Di halaman Billing Details, pilih billing period.
- Pilih Product sebagai Alibaba Cloud Model Studio, lalu klik Search.
- Di pojok kanan atas daftar tagihan, klik Export Bill CSV untuk mengunduh tagihan.
- Buka file tersebut, temukan kolom Instance ID, lalu interpretasikan menggunakan aturan yang dijelaskan di bagian berikutnya.
2. Interpretasi bidang utama
Bidang "Instance ID" berisi beberapa informasi yang dipisahkan oleh titik koma (;).
- Contoh:
text_token;llm-xxx;qwen-max;output_token;app - Ini merepresentasikan informasi berikut secara berurutan:
billing type;workspace ID;model name;input/output type;invocation channel
3. Ketertelusuran data dan istilah
-
Kueri API Key: Salin
ApiKeyIDdari tagihan Anda dan buka halaman Model Studio API Key Management untuk menemukan nama kunci yang sesuai. -
Kueri workspace: Salin
workspace IDdari tagihan Anda. Buka halaman Workspaces untuk mengidentifikasi workspace spesifik tersebut. -
Deskripsi invocation channel:
app: Panggilan yang dilakukan dari aplikasi (melalui kode).bmp: Panggilan yang dilakukan dari Playground di konsol.assistant-api: Panggilan yang dilakukan melalui Assistant API.
Hentikan penagihan
Jika Anda tidak lagi menggunakan Model Studio, ikuti petunjuk di bawah untuk menghentikan layanan terkait dan mencegah biaya tambahan.
- Hentikan inferensi model: Hentikan panggilan API dari kode Anda dan hentikan penggunaan Playground di konsol untuk mencegah biaya tambahan. Untuk mencegah panggilan tidak sengaja, Anda dapat menghapus kunci Anda di halaman API-KEY.
- Hentikan pelatihan model: Anda tidak dikenai biaya saat tidak ada tugas pelatihan model yang sedang berjalan.
- Batalkan langganan Coding Plan: Coding Plan adalah produk langganan bulanan yang secara otomatis berhenti di akhir periode langganan. Pembatalan di tengah periode dan pengembalian dana tidak didukung. Jika Anda mengaktifkan perpanjangan otomatis, nonaktifkan di halaman Coding Plan.
- Berhenti berlangganan Token Plan Team Edition: Di halaman My Subscriptions Token Plan console, Anda dapat berhenti berlangganan kursi yang belum digunakan, dan pengembalian dana akan dikirim ke akun pembayaran asal. Jika Anda tidak ingin memperbarui langganan, nonaktifkan perpanjangan otomatis.
FAQ
Mengapa saya tidak dapat menemukan tagihan setelah memanggil model?
- Latensi penagihan: Tagihan inferensi model diagregasi per menit dan biasanya muncul 2 hingga 10 menit setelah panggilan. Tagihan untuk inferensi batch, pelatihan model, dan basis pengetahuan diagregasi per jam. Pembuatan tagihan mungkin semakin tertunda selama jam sibuk.
- Penggunaan model non-komersial: Model dalam pratinjau publik atau pengujian undangan saja tidak menghasilkan catatan penagihan.
Solusi: Tunggu hingga interval penagihan berlalu, lalu periksa kembali.
Mengapa model yang sama memiliki beberapa entri di tagihan saya?
Penyebab: Model yang sama ditagih secara terpisah berdasarkan jenis penagihan (seperti token input, token output, atau cache hit) dan saluran pemanggilan (seperti panggilan API atau pengalaman konsol). Misalnya, satu panggilan API ke qwen3.6-plus menghasilkan dua entri: satu untuk "token input" dan satu untuk "token output".
Solusi: Gunakan bidang Instance ID di Billing Details untuk memahami rincian tiap item baris.
Banyak entri tagihan bernama "Large Model Text Consumption". Bagaimana cara mengidentifikasi model untuk tiap entri?
Penyebab: Kolom "Billable Item" pada tagihan secara seragam diberi label "Large Model Text Consumption" dan tidak menunjukkan nama model spesifik.
Solusi: Periksa kolom Instance ID (Billing Granularity) di halaman Billing Details. Bidang ini berupa string yang dipisahkan titik koma. Bagian string yang langsung mengikuti ID workspace (seperti llm-xxx) adalah nama modelnya. Misalnya, dalam 12xxx;llm-xxx; qwen3.6-plus ;context_0-128k_input_token;bmp;0, modelnya adalah qwen3.6-plus.
Di mana saya dapat melihat jumlah panggilan model dan statistiknya?
Buka Konsol Alibaba Cloud Model Studio, pilih wilayah target di pojok kanan atas. Klik tab Dashboard di bagian atas. Di panel navigasi kiri, pilih Usage & Billing > Model usage.
Apakah metode bayar sesuai pemakaian ditagih secara real time?
Tidak. Alibaba Cloud menggunakan model "reserve and settle monthly" untuk penagihan bayar sesuai pemakaian. Sistem menyisihkan sejumlah dana dari saldo tersedia Anda untuk menutupi penggunaan, lalu menghasilkan tagihan akhir dan memotong biaya aktual di akhir siklus penagihan (awal bulan berikutnya).
Mengapa saya memiliki pembayaran tertunda meskipun hampir tidak menggunakan layanan?
Alasan: Fitur tambahan Model Studio, seperti pencarian web, ditagih secara terpisah (post-paid) berdasarkan jumlah panggilan dan ditagihkan terpisah dari biaya inferensi model. Bahkan jika Anda belum aktif menggunakan konsol baru-baru ini, jika parameter enable_search diaktifkan di aplikasi atau kode yang Anda buat sebelumnya, biaya pencarian web tetap dikenakan untuk tiap panggilan. Selain itu, saldo akun Alibaba Cloud Anda dikelola di tingkat akun. Jika ada produk Alibaba Cloud lain di bawah akun yang sama, seperti ECS atau OSS bayar sesuai pemakaian, memiliki tagihan yang belum diselesaikan, saldo tersedia Anda menjadi negatif, dan Model Studio juga menampilkan pembayaran tertunda, meskipun Anda belum menggunakan Model Studio itu sendiri. Menyelesaikan tagihan yang tertunda untuk produk yang terkena dampak akan memulihkan penggunaan normal Model Studio.
- Di Billing Details, filter untuk Alibaba Cloud Model Studio dan periksa kolom Instance ID (Billing Granularity) untuk mengidentifikasi nama model dan saluran pemanggilan yang menimbulkan biaya.
- Periksa apakah
enable_searchdiaktifkan di kode aplikasi atau konfigurasi aplikasi Model Studio Anda. Jika Anda tidak lagi membutuhkan pencarian web, atur parameter ini kefalseatau hapus. - Jika Anda telah menghentikan semua panggilan tetapi masih dikenai biaya, periksa apakah kunci API atau aplikasi lain masih berjalan. Anda dapat menemukan dan menghapus kunci yang tidak digunakan di halaman API Key Management.
Mengapa saldo saya cepat habis?
- Token input terakumulasi dalam percakapan konteks panjang: Saat dokumen yang sama berulang kali disertakan dalam percakapan konteks panjang, token input tiap permintaan bertambah seiring akumulasi konteks, sehingga satu panggilan mengonsumsi jauh lebih banyak token daripada percakapan singkat. Misalnya, dalam satu investigasi, 43 dari 47 panggilan masing-masing mengonsumsi 580.000 hingga 600.000 token input, dan total token input melebihi 25 juta, yang menghabiskan saldo senilai CNY 120 dalam waktu sekitar 20 menit dan mengakibatkan pembayaran tertunda.
- Pemberitahuan peringatan dikirim dengan frekuensi terbatas: Saat kredit tersedia akun Anda turun di bawah ambang batas peringatan, Anda menerima pemberitahuan.Pemberitahuan dikirim melalui email.Jika Anda tidak memeriksa pemberitahuan tepat waktu, saldo Anda mungkin habis sebelum peringatan berikutnya.
- Latensi penagihan: Tagihan inferensi model diagregasi per menit. Oleh karena itu, Anda mungkin masih menerima tagihan yang dihasilkan akibat latensi penagihan setelah layanan ditangguhkan, dan jumlah tertunda dapat terus meningkat setelah penangguhan.
- Periksa konsumsi token tiap panggilan di halaman Model Usage untuk mengidentifikasi permintaan dengan penggunaan token tinggi.
- Konfigurasi peringatan kredit tersedia di halaman Billing Overview, dan periksa pemberitahuan peringatan segera.
- Untuk segera menghentikan penagihan, hapus kunci API yang tidak lagi Anda gunakan di halaman API Key Management.
Mengapa saya dikenai biaya meskipun tidak aktif melakukan panggilan API?
Penyebab: Penerapan model di Model Studio ditagih berdasarkan durasi. Penagihan dimulai segera setelah status penerapan model berubah menjadi Running, terlepas dari panggilan API. Meskipun Anda belum memanggil model melalui API, biaya terus terakumulasi selama status penerapan adalah Running. Selain itu, inferensi model ditagih berdasarkan penggunaan token — biaya hanya dikenakan saat panggilan API dilakukan.
Solusi:- Buka halaman Model Deployment untuk memeriksa apakah ada model yang diterapkan dengan status Running. Jika Anda tidak lagi membutuhkannya, nonaktifkan untuk menghentikan penagihan.
- Hapus kunci API yang tidak digunakan untuk mencegah panggilan API tidak sengaja yang menghasilkan biaya inferensi (catatan: penghapusan tidak dapat dikembalikan, lakukan dengan hati-hati). Anda dapat mengelola kunci Anda di halaman API Key Management.
Bagaimana cara menentukan apakah akun saya telah disusupi?
Jika Anda mencurigai akun Anda diakses orang lain dan timbul biaya tak terduga, ikuti langkah-langkah berikut untuk menyelidiki:
- Di Detailed Bill, filter berdasarkan Model Studio, dan periksa
ApiKeyIDdi kolom Instance ID (Billing Granularity) untuk mengidentifikasi API Key yang menghasilkan biaya tersebut. - Buka halaman API Key Management, tinjau waktu pembuatan tiap kunci, dan pastikan apakah kunci tersebut dibuat oleh Anda. Halaman API Key Management hanya menampilkan waktu pembuatan, bukan waktu pemanggilan.
- Tinjau distribusi waktu pemanggilan untuk mengidentifikasi pola pemanggilan abnormal yang mungkin bukan berasal dari Anda: Buka Model Usage, filter berdasarkan Model atau API Key ID, lalu beralih ke tampilan List untuk melihat distribusi waktu pemanggilan.
- Jika ditemukan pemanggilan tidak sah, segera buka halaman API Key Management untuk menghapus API Key yang bersangkutan dan membuat ulang. Perbarui semua pemanggil sah untuk menggunakan kunci baru tersebut.
Mengapa saya dikenai biaya tanpa membeli paket Model Studio?
Penyebab: Panggilan API Model Studio menggunakan metode penagihan bayar sesuai pemakaian secara default. Setelah Anda mengaktifkan Model Studio, Anda dapat segera memanggil API dan membayar berdasarkan penggunaan aktual, tanpa perlu membeli paket sumber daya atau rencana penghematan. Sistem secara otomatis menagih Anda berdasarkan penggunaan token dan harga yang sesuai dari model yang Anda panggil. Untuk informasi harga detail, lihat Harga inferensi model.
Bagaimana cara memilih antara bayar sesuai pemakaian, kuota gratis, Coding Plan, paket sumber daya, dan rencana penghematan?
Model Studio menerapkan kuota diskon dalam urutan offset tetap: kuota gratis > rencana penghematan khusus model > rencana penghematan umum AI > bayar sesuai pemakaian. Tiap lapisan sepenuhnya dikonsumsi sebelum lapisan berikutnya digunakan. Panggilan ditagih dengan metode bayar sesuai pemakaian terhadap saldo akun Anda hanya setelah semua kuota diskon habis.
Tabel berikut membandingkan opsi dan aturan yang berlaku untuk masing-masing.
Opsi | Model penagihan | Skenario | Tingkat harga | Batasan | Aturan utama |
|---|---|---|---|---|---|
Bayar sesuai pemakaian (default) | Post-paid, reserve and settle monthly | Penggunaan fluktuatif, atau evaluasi sebelum berkomitmen | Ditagih berdasarkan penggunaan token input dan output, tanpa diskon. Harga satuan per token adalah yang tertinggi di antara semua opsi. | Tidak perlu pembelian awal, sehingga opsi ini tersedia kapan saja. Model tidak dapat dipanggil saat pembayaran tertunda. | Tidak perlu pembelian awal. Tagihan akhir dihasilkan dan dikenakan di awal bulan berikutnya. Model tidak dapat dipanggil saat pembayaran tertunda. |
Kuota gratis | Kuota diberikan, diimbangi terlebih dahulu | Validasi fitur dan uji coba skala kecil | Gratis. Diberikan secara otomatis saat Anda mengaktifkan Model Studio. Kuota tidak dapat ditumpuk atau dibeli secara terpisah. | Jumlah kuota dan periode validitasnya tetap. Setelah kuota habis, penagihan secara otomatis kembali ke metode bayar sesuai pemakaian. Saat Stop when free quota is used up (worry-free mode) diaktifkan, rencana penghematan tidak dapat mengimbangi penggunaan. | Aktifkan Stop when free quota is used up (worry-free mode) di pengaturan model untuk menangguhkan panggilan segera setelah kuota habis, sehingga tidak ada biaya bayar sesuai pemakaian yang terakumulasi. Saat sakelar ini diaktifkan, tidak ada rencana penghematan yang diterapkan. Nonaktifkan sakelar untuk melanjutkan panggilan dan membiarkan rencana penghematan berlaku. |
Coding Plan | Langganan bulanan | Anggaran bulanan tetap untuk skenario coding | Biaya bulanan tetap yang tidak berubah dengan penggunaan token. | Hanya dapat digunakan untuk skenario alat pemrograman. Tidak dapat mengimbangi panggilan API reguler atau biaya inferensi model yang ditimbulkan di konsol. Langganan berhenti secara otomatis saat kedaluwarsa, dan pembatalan serta pengembalian dana di tengah periode tidak didukung. | Langganan berhenti secara otomatis saat kedaluwarsa. Pembatalan dan pengembalian dana di tengah periode tidak didukung. Jika perpanjangan otomatis diaktifkan, nonaktifkan di halaman Coding Plan. |
Token Plan | Pembelian kredit satu kali | Berbagi satu kuota di seluruh tim | Kredit dibeli per kursi sebagai pembayaran satu kali. | Hanya beberapa model yang didukung. Kuota independen dari saldo akun Anda. Kursi yang belum mengonsumsi penggunaan apa pun dapat berhenti berlangganan di halaman My Subscriptions. | Hanya beberapa model yang didukung. Anda dapat berhenti berlangganan secara individual untuk kursi yang belum mengonsumsi penggunaan apa pun di halaman My Subscriptions Token Plan console. |
Rencana penghematan umum AI (direkomendasikan) | Komitmen pengeluaran bulanan untuk mendapatkan diskon bertingkat | Penggunaan jangka panjang yang stabil untuk layanan model skala besar | Diskon bertingkat berdasarkan pengeluaran bulanan yang Anda komitmenkan: semakin tinggi komitmen, semakin dalam diskonnya. Untuk diskon tiap tingkat, lihat Rencana penghematan dan paket sumber daya. | Periode komitmen 3, 6, 12, atau 24 bulan tersedia. Kuota diberikan bulanan dan tidak dibawa ke periode berikutnya. Setelah rencana berlaku dan mulai mengimbangi penggunaan, umumnya tidak dapat berhenti berlangganan dan harus berjalan hingga kedaluwarsa. | Mencakup semua model. Setelah rencana berlaku dan mulai mengimbangi penggunaan, umumnya tidak dapat berhenti berlangganan dan harus berjalan hingga kedaluwarsa. |
Paket sumber daya tidak tersedia di situs internasional, yang hanya menyediakan rencana penghematan.
Untuk skenario panggilan API reguler, pilih rencana penghematan umum AI terlebih dahulu. Untuk skenario alat pemrograman, pilih Coding Plan terlebih dahulu. Pilih opsi berdasarkan aturan ini: rencana penghematan untuk penggunaan jangka panjang yang stabil, Token Plan saat tim berbagi satu kuota, dan Coding Plan saat Anda menginginkan pengeluaran bulanan tetap untuk skenario coding. Jika Anda hanya memvalidasi fitur, gunakan kuota gratis terlebih dahulu.
Model Studio menggunakan metode bayar sesuai pemakaian secara default dan tidak memberikan kuota token di muka. Beli rencana penghematan jika Anda perlu mengunci kuota atau mengurangi biaya.
Untuk tingkat diskon, langkah pembelian, dan aturan waktu berlaku, lihat Rencana penghematan dan paket sumber daya. Untuk menghentikan penagihan untuk opsi apa pun, lihat Hentikan penagihan.