Parameter input dan output untuk memanggil Qwen-MT melalui antarmuka yang kompatibel dengan OpenAI atau API DashScope .
Referensi: Penerjemahan mesin (Qwen-MT)
Kompatibel dengan OpenAI
Wilayah Singapura
base_url untuk SDK: https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1
Titik akhir HTTP: POST https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1/chat/completions
Wilayah Virginia
base_url untuk SDK: https://{WorkspaceId}.us-east-1.maas.aliyuncs.com/compatible-mode/v1
Titik akhir HTTP: POST https://{WorkspaceId}.us-east-1.maas.aliyuncs.com/compatible-mode/v1/chat/completions
Wilayah Beijing
base_url untuk SDK: https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1
Titik akhir HTTP: POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1/chat/completions
PentingAlibaba Cloud Model Studio telah merilis domain khusus ruang kerja untuk wilayah China (Beijing), Singapura, dan China (Hong Kong). Domain khusus baru ini memberikan performa lebih unggul dan stabilitas lebih tinggi untuk permintaan inferensi. Kami merekomendasikan migrasi ke domain baru berikut:
- China (Beijing): dari
https://dashscope.aliyuncs.comkehttps://{WorkspaceId}.cn-beijing.maas.aliyuncs.com - Singapura: dari
https://dashscope-intl.aliyuncs.comkehttps://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com - China (Hong Kong): dari
https://cn-hongkong.dashscope.aliyuncs.comkehttps://{WorkspaceId}.cn-hongkong.maas.aliyuncs.com
{WorkspaceId} adalah ID ruang kerja Anda, yang dapat ditemukan pada halaman Detail Ruang Kerja di Konsol Alibaba Cloud Model Studio. Domain lama tetap berfungsi sepenuhnya.
Pertama, buat Kunci API dan konfigurasikan sebagai Variabel lingkungan. Jika Anda menggunakan SDK OpenAI, instal SDK.
Body permintaan | Penggunaan dasarPythonNode.jscurlTitik akhir dan Kunci API berbeda tergantung wilayah. Berikut adalah titik akhir Singapura. Intervensi istilahPythonNode.jscurlTitik akhir dan Kunci API berbeda tergantung wilayah. Berikut adalah titik akhir Singapura. Memori penerjemahanPythonNode.jscurlTitik akhir dan Kunci API berbeda tergantung wilayah. Berikut adalah titik akhir Singapura. Pemberian petunjuk domainPythonNode.jscurlTitik akhir dan Kunci API berbeda tergantung wilayah. Berikut adalah titik akhir Singapura. |
model Nama model. Model yang didukung: qwen-mt-plus, qwen-mt-flash, qwen-mt-lite, qwen-mt-turbo. | |
messages Array pesan yang memberikan konteks kepada model. Hanya pesan pengguna yang didukung. | |
stream Aktifkan mode keluaran streaming. Nilai valid:
Catatanqwen-mt-flash dan qwen-mt-lite mengembalikan data secara inkremental (setiap potongan hanya berisi konten baru). qwen-mt-plus dan qwen-mt-turbo mengembalikan data secara non-inkremental (setiap potongan berisi seluruh urutan hingga saat itu). Perilaku ini tidak dapat diubah. Contoh: I I didn I didn't I didn't laugh I didn't laugh after ... | |
stream_options Item konfigurasi untuk keluaran streaming. Parameter ini hanya berlaku ketika | |
max_tokens Jumlah maksimum token yang akan dihasilkan. Jika output melebihi nilai ini, respons akan dipotong. Nilai default dan maksimum mengikuti panjang output maksimum model. Untuk informasi lebih lanjut, lihat Pemilihan Model. | |
seed Bibit angka acak untuk hasil yang dapat direproduksi. Menggunakan Rentang nilai: | |
temperature Suhu pengambilan sampel yang mengontrol keragaman teks yang dihasilkan. Nilai yang lebih tinggi menghasilkan teks yang lebih beragam. Nilai yang lebih rendah menghasilkan teks yang lebih deterministik. Rentang nilai: [0, 2) Baik | |
top_p Ambang batas probabilitas untuk pengambilan sampel inti yang mengontrol keragaman teks yang dihasilkan. Nilai yang lebih tinggi menghasilkan teks yang lebih beragam. Nilai yang lebih rendah menghasilkan teks yang lebih deterministik. Rentang nilai: (0, 1,0] Baik | |
top_k Ukuran set kandidat untuk pengambilan sampel selama generasi. Misalnya, mengatur nilai ini ke 50 berarti hanya 50 token teratas berdasarkan skor yang membentuk kumpulan pengambilan sampel. Nilai yang lebih besar meningkatkan keacakan; nilai yang lebih kecil meningkatkan determinisme. Jika nilainya None atau lebih besar dari 100, top_k dinonaktifkan dan hanya top_p yang berlaku. Nilai harus lebih besar dari atau sama dengan 0. Parameter non-standar OpenAI. SDK Python: tempatkan dalam objek extra_body | |
repetition_penalty Hukuman untuk pengulangan dalam urutan berturut-turut. Nilai yang lebih tinggi mengurangi pengulangan. Nilai 1,0 tidak menerapkan hukuman. Harus lebih besar dari 0, tanpa batas atas yang ketat. Parameter non-standar OpenAI. SDK Python: tempatkan dalam objek extra_body | |
translation_options Parameter penerjemahan. Parameter non-standar OpenAI. SDK Python: tempatkan dalam objek extra_body |
Objek respons chat (keluaran non-streaming) | |
id ID permintaan unik. | |
choices Array konten yang dihasilkan oleh model. | |
created Stempel waktu UNIX saat permintaan dibuat. | |
model Model yang digunakan dalam permintaan. | |
object Nilainya selalu | |
service_tier Saat ini diatur ke | |
system_fingerprint Saat ini selalu | |
usage Konsumsi token untuk permintaan tersebut. Properti completion_tokens Jumlah token dalam output model. prompt_tokens Jumlah token dalam input. total_tokens Total token yang dikonsumsi, yaitu jumlah dari completion_tokens_details Saat ini diatur ke prompt_tokens_details Saat ini diatur ke |
Objek potongan respons chat (keluaran streaming) | |
id ID unik panggilan. Setiap objek potongan memiliki ID yang sama. | |
choices Array konten yang dihasilkan oleh model. Jika | |
created Stempel waktu UNIX saat permintaan dibuat. Setiap potongan memiliki stempel waktu yang sama. | |
model Model yang digunakan untuk permintaan. | |
object Nilai ini selalu | |
service_tier Saat ini selalu bernilai | |
system_fingerprint Saat ini selalu bernilai | |
usage Token yang dikonsumsi oleh permintaan. Informasi ini hanya dikembalikan pada potongan terakhir ketika Properti completion_tokens Jumlah token dalam output model. prompt_tokens Jumlah token input. total_tokens Jumlah total token, yaitu jumlah dari completion_tokens_details Saat ini selalu bernilai prompt_tokens_details Saat ini selalu bernilai |
DashScope
Singapura
Titik akhir HTTP: POST https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/text-generation/generation
Atur base_url ke:
Kode Python
dashscope.base_http_api_url = 'https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1'
Kode Java
- Metode 1:
import com.alibaba.dashscope.protocol.Protocol;
Generation gen = new Generation(Protocol.HTTP.getValue(), "https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1");
- Metode 2:
import com.alibaba.dashscope.utils.Constants;
Constants.baseHttpApiUrl="https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1";
Virginia
Titik akhir HTTP: POST https://{WorkspaceId}.us-east-1.maas.aliyuncs.com/api/v1/services/aigc/text-generation/generation
Atur base_url ke:
Kode Python
dashscope.base_http_api_url = 'https://{WorkspaceId}.us-east-1.maas.aliyuncs.com/api/v1'
Kode Java
- Metode 1:
import com.alibaba.dashscope.protocol.Protocol;
Generation gen = new Generation(Protocol.HTTP.getValue(), "https://{WorkspaceId}.us-east-1.maas.aliyuncs.com/api/v1");
- Metode 2:
import com.alibaba.dashscope.utils.Constants;
Constants.baseHttpApiUrl="https://{WorkspaceId}.us-east-1.maas.aliyuncs.com/api/v1";
Beijing
Titik akhir HTTP: POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/services/aigc/text-generation/generation
Anda tidak perlu mengonfigurasi base_url untuk panggilan SDK. Nilai default adalah https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1.
Anda harus membuat Kunci API dan mengekspor Kunci API sebagai Variabel lingkungan. Jika menggunakan SDK DashScope, instal SDK DashScope.
Body permintaan | Penggunaan dasarPythonJavacurlTitik akhir dan Kunci API berbeda tergantung wilayah. Berikut adalah titik akhir Singapura. Intervensi istilahPythonJavacurlTitik akhir dan Kunci API berbeda tergantung wilayah. Berikut adalah titik akhir Singapura. Memori penerjemahanPythonJavacurlTitik akhir dan Kunci API berbeda tergantung wilayah. Berikut adalah titik akhir Singapura. Pemberian petunjuk domainPythonJavacurlTitik akhir dan Kunci API berbeda tergantung wilayah. Berikut adalah titik akhir Singapura. |
model Nama model. Didukung: qwen-mt-plus, qwen-mt-flash, qwen-mt-lite, qwen-mt-turbo. | |
messages Array pesan yang memberikan konteks kepada model. Hanya pesan pengguna yang didukung. | |
max_tokens Jumlah maksimum token yang akan dihasilkan. Jika output melebihi nilai ini, respons akan dipotong. Nilai default dan maksimum adalah panjang output maksimum model. Untuk informasi lebih lanjut, lihat Pemilihan model.
| |
seed Bibit angka acak untuk hasil yang dapat direproduksi. Menggunakan Rentang nilai:
| |
temperature Suhu pengambilan sampel yang mengontrol keragaman teks yang dihasilkan. Nilai yang lebih tinggi menghasilkan teks yang lebih beragam. Nilai yang lebih rendah menghasilkan teks yang lebih deterministik. Rentang nilai: [0, 2) Baik
| |
top_p Ambang batas probabilitas untuk pengambilan sampel inti yang mengontrol keragaman teks yang dihasilkan. Nilai yang lebih tinggi menghasilkan teks yang lebih beragam. Nilai yang lebih rendah menghasilkan teks yang lebih deterministik. Rentang nilai: (0, 1,0] Baik
| |
repetition_penalty Hukuman untuk pengulangan dalam urutan berturut-turut. Nilai yang lebih tinggi mengurangi pengulangan. Nilai 1,0 tidak menerapkan hukuman. Harus lebih besar dari 0, tanpa batas atas yang ketat.
| |
top_k Ukuran set kandidat untuk pengambilan sampel selama generasi. Misalnya, mengatur nilai ini ke 50 berarti hanya 50 token teratas berdasarkan skor yang membentuk kumpulan pengambilan sampel. Nilai yang lebih besar meningkatkan keacakan; nilai yang lebih kecil meningkatkan determinisme. Jika nilainya None atau lebih besar dari 100, top_k dinonaktifkan dan hanya top_p yang berlaku. Nilai harus lebih besar dari atau sama dengan 0.
| |
stream Aktifkan mode keluaran streaming. Nilai valid:
Catatanqwen-mt-flash dan qwen-mt-lite mengembalikan data secara inkremental (setiap potongan hanya berisi konten baru). qwen-mt-plus dan qwen-mt-turbo mengembalikan data secara non-inkremental (setiap potongan berisi seluruh urutan hingga saat itu). Perilaku ini tidak dapat diubah. Contoh: I I didn I didn't I didn't laugh I didn't laugh after ...
| |
translation_options Parameter penerjemahan.
|
Objek respons chat (sama untuk keluaran streaming dan non-streaming) | |
status_code Kode status permintaan. 200 menunjukkan keberhasilan; nilai lain menunjukkan kegagalan.
| |
request_id ID permintaan unik.
| |
code Kode error. Kosong saat berhasil.
| |
output Hasil panggilan. Properti text Saat ini tetap finish_reason Alasan mengapa model berhenti menghasilkan konten. Nilai valid:
choices Output model. Properti finish_reason Nilai valid:
message Pesan output model. Properti role Peran pesan output. Tetap content Hasil terjemahan. model_name Model yang digunakan untuk permintaan ini. | |
usage Penggunaan token untuk permintaan. Properti input_tokens Jumlah token input. output_tokens Jumlah token output. total_tokens Total token, sama dengan input_tokens + output_tokens. |
Kode error
Jika panggilan gagal, lihat Kode error untuk menyelesaikan masalah.