All Products
Search
Document Center

Alibaba Cloud Model Studio:Penggunaan model

Last Updated:Sep 09, 2026

Lihat penggunaan model Alibaba Cloud Model Studio.

Untuk informasi selengkapnya mengenai kuota gratis, lihat Kuota gratis pengguna baru. Kelola penggunaan kuota gratis di halaman Free Quota.

Ketersediaan

Lihat penggunaan kuota gratis

Di Konsol

  1. Buka halaman Free Quota dan pilih tab jenis model untuk melihat penggunaan kuota gratis setiap model.
  2. Di tabel models, temukan model tertentu menggunakan pencarian, pengurutan, atau filter. Aktifkan atau nonaktifkan Free Quota Only secara individual atau dalam batch untuk mengelola pengaturan kuota gratis.

CatatanFree Quota Only: Saat diaktifkan, layanan akan otomatis berhenti ketika kuota gratis habis (mengembalikan error 403: AllocationQuota.FreeTierOnly). Hal ini mencegah biaya tambahan melebihi kuota gratis. Untuk terus menggunakan dan membayar berdasarkan penggunaan aktual, nonaktifkan fitur ini. Fitur ini hanya tersedia jika akun Anda memiliki kuota gratis yang belum digunakan. Setelah diaktifkan, fitur ini tidak dapat dinonaktifkan hingga kuota gratis sepenuhnya habis. Kuota gratis ditagih dengan granularitas per menit, dan data yang ditampilkan di Konsol mungkin mengalami keterlambatan. Rujuk nilai kuota gratis yang ditampilkan di Konsol.

Lihat penggunaan model

Konsol saat ini hanya mendukung penggunaan kuota gratis. Untuk melihat statistik penggunaan detail, buka halaman Bill Details dan ekspor tagihan untuk melihat token usage.

Lihat ikhtisar penagihan

Di halaman Billing Overview, lihat ringkasan biaya untuk layanan Model Studio, termasuk:

  • Cost cards: Lihat total pengeluaran, biaya langganan, dan biaya tagihan untuk periode penagihan saat ini, dengan tautan ke rincian lengkap.
  • Bill trends: Lihat tren biaya dalam format grafik atau daftar. Filter berdasarkan statistik bulanan atau harian, kategori produk, ID API Key, atau model.
  • Cost alerts: Atur peringatan biaya untuk menerima notifikasi jika terjadi pengeluaran tidak normal.

Unit penggunaan

Di Model Studio, statistik penggunaan untuk model yang berbeda adalah sebagai berikut:

Type

Subcategory

Unit

Billing (invocation)

Large language model

Text generation

Token

Ditagih berdasarkan jumlah token untuk input dan output.

Deep thinking

Visual understanding

Visual model

Image generation

Images

Ditagih berdasarkan jumlah images yang berhasil dihasilkan.

Video generation

Seconds

Ditagih berdasarkan jumlah video seconds yang berhasil dihasilkan.

Speech model

Speech synthesis

Second, character, or token

Dapat ditagih berdasarkan durasi audio (seconds), karakter teks yang sesuai, atau tokens, tergantung modelnya.

Real-time speech synthesis

Audio file recognition

Real-time speech recognition

Audio and video translation

Omni-modal model

Omni-modal

Token

Teks ditagih berdasarkan jumlah token. Modalitas lain (audio, image, video) ditagih berdasarkan jumlah token yang sesuai.

Real-time multimodal

Embedding model

Multimodal embedding

Token

Ditagih berdasarkan jumlah token dalam teks input.

Text embedding

Mulai produksi

Rekomendasi untuk mengelola penggunaan model:

  • Mengontrol panjang output model: Batasi panjang maksimum konten yang dihasilkan per pemanggilan untuk mengendalikan biaya, dengan secara wajar membatasi panjang pemikiran dan mengatur parameter max_tokens.
  • Pilih model berdasarkan jenis tugas: Untuk tugas sederhana seperti kategorisasi dan ringkasan, prioritaskan model ringan berbiaya rendah daripada model canggih yang lebih mahal.
  • Pemantauan dan peringatan: Pantau tren penggunaan. Atur peringatan penggunaan untuk menerima notifikasi tepat waktu jika terjadi penggunaan tidak normal.
  • Optimalkan prompt: Prompt yang ringkas dan jelas meningkatkan kualitas output model serta mengurangi token input yang tidak perlu.
  • Gunakan batch inference: Untuk tugas pemrosesan batch besar yang tidak memerlukan respons real-time, batch inference umumnya lebih hemat biaya dibandingkan pemanggilan real-time.

Glosarium

Noun

Explanation

Token

Large language models memproses input dan output dalam bentuk token. Token dapat berupa:

  • Karakter tunggal: seperti A, I

  • Kata lengkap: seperti large, Model

  • Bagian dari kata panjang: Kata panjang sering kali dipecah menjadi beberapa token. Proses pemecahan ini disebut tokenization.

Berdasarkan pengalaman, rata-rata 1 Token setara dengan sekitar 1,5–2 karakter Tionghoa; 1 huruf Inggris setara dengan sekitar 0,25 Token; 1 kata Inggris setara dengan sekitar 1,3 Token:

  • Alibaba Cloud Model Studio: sekitar 4–5 Token

  • Hello World: sekitar 2 Token

Setiap model memiliki batas maksimum jumlah token input dan output (lihat Model list). Melebihi batas ini menyebabkan kegagalan.

Real-time

Mengacu pada semua pemanggilan model secara langsung maupun tidak langsung, terutama mencakup skenario berikut:

Batches

Pemrosesan data skala besar yang dilakukan secara offline untuk skenario yang tidak memerlukan respons real-time, menggunakan API OpenAI-compatible - Batch (file input).

FAQ

T: Bagaimana cara melihat total penggunaan token untuk Akun Alibaba Cloud saya?

J: Gunakan Akun Alibaba Cloud Anda untuk mengakses halaman Bill Details dan ekspor tagihan.

Di halaman Bill Details, filter dan ekspor tagihan:

  1. Atur Billing Month ke bulan target (misalnya 2025-05).
  2. Di bawah Product Name, pilih Model Studio.
  3. Klik ikon unduh di pojok kanan atas tabel untuk mengekspor data penagihan.