OpenAI 互換インターフェイスまたは DashScope API を使用して Qwen-MT を呼び出す際の入力および出力パラメーター。
リファレンス: Machine Translation (Qwen-MT)
OpenAI 互換
中国 (北京) リージョン
SDK 用の base_url: https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1
HTTP エンドポイント: POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1/chat/completions
シンガポール リージョン
SDK 用の base_url: https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1
HTTP エンドポイント: POST https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1/chat/completions
米国 (バージニア) リージョン
SDK 用の base_url: https://dashscope-us.aliyuncs.com/compatible-mode/v1
HTTP エンドポイント: POST https://dashscope-us.aliyuncs.com/compatible-mode/v1/chat/completions
シンガポール リージョン
SDK 用の base_url: https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1
HTTP エンドポイント: POST https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1/chat/completions
米国 (バージニア) リージョン
SDK 用の base_url: https://dashscope-us.aliyuncs.com/compatible-mode/v1
HTTP エンドポイント: POST https://dashscope-us.aliyuncs.com/compatible-mode/v1/chat/completions
中国 (北京) リージョン
SDK 用の base_url: https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1
HTTP エンドポイント: POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1/chat/completions
Model Studio は、中国 (北京)、シンガポール、および中国 (香港) リージョン向けにワークスペース専用ドメインをリリースしました。新しい専用ドメインは、推論リクエストに対して優れたパフォーマンスと高い安定性を提供します。新しいドメインへの移行を推奨します。
-
中国 (北京):
https://dashscope.aliyuncs.comからhttps://{WorkspaceId}.cn-beijing.maas.aliyuncs.comへ -
シンガポール:
https://dashscope-intl.aliyuncs.comからhttps://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.comへ -
中国 (香港):
https://cn-hongkong.dashscope.aliyuncs.comからhttps://{WorkspaceId}.cn-hongkong.maas.aliyuncs.comへ
{WorkspaceId} はご利用のワークスペース ID です。この ID は Model Studio コンソールの ワークスペース詳細 ページで確認できます。既存のドメインは引き続き完全に機能します。
まず、API キーを作成し、環境変数として設定してください。OpenAI SDK を使用する場合は、SDK をインストールしてください。
リクエスト本文 |
基本的な使用方法Python
Node.js
curlエンドポイントおよび API キーはリージョンによって異なります。以下はシンガポール エンドポイントです。
用語介入Python
Node.js
curlエンドポイントおよび API キーはリージョンによって異なります。以下はシンガポール エンドポイントです。
翻訳メモリPython
Node.js
curlエンドポイントおよび API キーはリージョンによって異なります。以下はシンガポール エンドポイントです。
ドメインプロンプトPython
Node.js
curlエンドポイントおよび API キーはリージョンによって異なります。以下はシンガポール エンドポイントです。
|
|
model モデル名。サポートされているモデル: qwen-mt-plus、qwen-mt-flash、qwen-mt-lite、qwen-mt-turbo。 |
|
|
messages モデルにコンテキストを提供するメッセージの配列。ユーザーからのメッセージのみサポートされます。 |
|
|
stream ストリーミング出力モードを有効にします。 有効値:
説明
qwen-mt-flash および qwen-mt-lite は増分出力 (各チャンクには新しいコンテンツのみ含まれる) を返します。qwen-mt-plus および qwen-mt-turbo は非増分出力 (各チャンクにはそれまでの全シーケンスが含まれる) を返します。この動作は変更できません。例: I I didn I didn't I didn't laugh I didn't laugh after ... |
|
|
stream_options ストリーミング出力の設定項目。このパラメーターは |
|
|
max_tokens 生成されるトークンの最大数。出力がこの値を超える場合、応答は切り捨てられます。 デフォルト値および最大値は、モデルの最大出力長です。詳細については、「モデル選択」をご参照ください。 |
|
|
seed 再現可能な結果を得るための乱数シード。同じ 値の範囲: |
|
|
temperature 生成テキストの多様性を制御するサンプリング温度。 値が高いほど多様なテキストが生成され、値が低いほど決定論的なテキストが生成されます。 値の範囲: [0, 2)
|
|
|
top_p 生成テキストの多様性を制御する核サンプリングの確率しきい値。 値が高いほど多様なテキストが生成され、値が低いほど決定論的なテキストが生成されます。 値の範囲: (0, 1.0]
|
|
|
top_k 生成時のサンプリングにおけるサンプル候補セットのサイズ。たとえば、これを 50 に設定すると、スコア上位 50 トークンのみがサンプリングプールとなります。値が大きいほどランダム性が高まり、値が小さいほど決定論的になります。値が None または 100 を超える場合、top_k は無効化され、top_p のみが有効になります。 値は 0 以上である必要があります。 OpenAI 標準外のパラメーターです。Python SDK の場合は extra_body オブジェクト内に記述してください |
|
|
repetition_penalty 連続するシーケンス内の繰り返しに対するペナルティ。値が高いほど繰り返しが減少します。1.0 の場合はペナルティが適用されません。値は 0 より大きくなければならず、上限はありません。 OpenAI 標準外のパラメーターです。Python SDK の場合は extra_body オブジェクト内に記述してください |
|
|
translation_options 翻訳パラメーター。 OpenAI 標準外のパラメーターです。Python SDK の場合は extra_body オブジェクト内に記述してください |
チャット応答オブジェクト (非ストリーミング出力) |
|
|
id 一意のリクエスト ID。 |
|
|
choices モデルが生成したコンテンツの配列。 |
|
|
created リクエストが作成された UNIX タイムスタンプ。 |
|
|
model リクエストに使用されたモデル。 |
|
|
object 常に |
|
|
service_tier 現在は固定で |
|
|
system_fingerprint 現在は固定で |
|
|
usage リクエストのトークン消費量。 |
チャット応答チャンクオブジェクト (ストリーミング出力) |
増分出力
非増分出力
|
|
id 呼び出しの一意の ID。各チャンクオブジェクトは同じ ID を持ちます。 |
|
|
choices モデルが生成したコンテンツの配列。 |
|
|
created リクエストが作成された UNIX タイムスタンプ。各チャンクは同じタイムスタンプを持ちます。 |
|
|
model リクエストに使用されたモデル。 |
|
|
object 常に |
|
|
service_tier 現在は固定で |
|
|
system_fingerprint 現在は固定で |
|
|
usage リクエストのトークン消費量。 |
DashScope
北京
HTTP エンドポイント: POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/services/aigc/text-generation/generation
SDK 呼び出しの場合、base_url を設定する必要はありません。デフォルト値は https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1 です。
シンガポール
HTTP エンドポイント: POST https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/text-generation/generation
base_url を次のように設定します。
Python コード
dashscope.base_http_api_url = 'https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1'
Java コード
-
方法 1:
import com.alibaba.dashscope.protocol.Protocol; Generation gen = new Generation(Protocol.HTTP.getValue(), "https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1"); -
方法 2:
import com.alibaba.dashscope.utils.Constants; Constants.baseHttpApiUrl="https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1";
バージニア
HTTP エンドポイント: POST https://dashscope-us.aliyuncs.com/api/v1/services/aigc/text-generation/generation
base_url を次のように設定します。
Python コード
dashscope.base_http_api_url = 'https://dashscope-us.aliyuncs.com/api/v1'
Java コード
-
方法 1:
import com.alibaba.dashscope.protocol.Protocol; Generation gen = new Generation(Protocol.HTTP.getValue(), "https://dashscope-us.aliyuncs.com/api/v1"); -
方法 2:
import com.alibaba.dashscope.utils.Constants; Constants.baseHttpApiUrl="https://dashscope-us.aliyuncs.com/api/v1";
シンガポール
HTTP エンドポイント: POST https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/text-generation/generation
base_url を次のように設定します。
Python コード
dashscope.base_http_api_url = 'https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1'
Java コード
-
方法 1:
import com.alibaba.dashscope.protocol.Protocol; Generation gen = new Generation(Protocol.HTTP.getValue(), "https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1"); -
方法 2:
import com.alibaba.dashscope.utils.Constants; Constants.baseHttpApiUrl="https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1";
バージニア
HTTP エンドポイント: POST https://dashscope-us.aliyuncs.com/api/v1/services/aigc/text-generation/generation
base_url を次のように設定します。
Python コード
dashscope.base_http_api_url = 'https://dashscope-us.aliyuncs.com/api/v1'
Java コード
-
方法 1:
import com.alibaba.dashscope.protocol.Protocol; Generation gen = new Generation(Protocol.HTTP.getValue(), "https://dashscope-us.aliyuncs.com/api/v1"); -
方法 2:
import com.alibaba.dashscope.utils.Constants; Constants.baseHttpApiUrl="https://dashscope-us.aliyuncs.com/api/v1";
北京
HTTP エンドポイント: POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/services/aigc/text-generation/generation
SDK 呼び出しの場合、base_url を設定する必要はありません。デフォルト値は https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1 です。
API キーを作成し、環境変数としてエクスポートする必要があります。DashScope SDK を使用する場合は、DashScope SDK をインストールしてください。
リクエスト本文 |
基本的な使用方法Python
Java
curlエンドポイントおよび API キーはリージョンによって異なります。以下はシンガポール エンドポイントです。
用語介入Python
Java
curlエンドポイントおよび API キーはリージョンによって異なります。以下はシンガポール エンドポイントです。
翻訳メモリPython
Java
curlエンドポイントおよび API キーはリージョンによって異なります。以下はシンガポール エンドポイントです。
ドメインプロンプトPython
Java
curlエンドポイントおよび API キーはリージョンによって異なります。以下はシンガポール エンドポイントです。
|
|
model モデル名。サポートされているモデル: qwen-mt-plus、qwen-mt-flash、qwen-mt-lite、qwen-mt-turbo。 |
|
|
messages モデルにコンテキストを提供するメッセージの配列。ユーザーからのメッセージのみサポートされます。 |
|
|
max_tokens 生成されるトークンの最大数。出力がこの値を超える場合、応答は切り捨てられます。 デフォルト値および最大値は、モデルの最大出力長です。詳細については、「モデル選択」をご参照ください。 Java SDK では、パラメーターは maxTokens です。 HTTP 呼び出しの場合は、parameters オブジェクト内に max_tokens を配置してください。 |
|
|
seed 再現可能な結果を得るための乱数シード。同じ 値の範囲: HTTP 呼び出しを行う場合、seed を parameters オブジェクト内に配置してください。 |
|
|
temperature 生成テキストの多様性を制御するサンプリング温度。 値が高いほど多様なテキストが生成され、値が低いほど決定論的なテキストが生成されます。 値の範囲: [0, 2)
HTTP 呼び出しを行う場合、temperature を parameters オブジェクト内に配置してください。 |
|
|
top_p 生成テキストの多様性を制御する核サンプリングの確率しきい値。 値が高いほど多様なテキストが生成され、値が低いほど決定論的なテキストが生成されます。 値の範囲: (0, 1.0]
Java SDK では、パラメーターは topPparameters オブジェクトです。 |
|
|
repetition_penalty 連続するシーケンス内の繰り返しに対するペナルティ。値が高いほど繰り返しが減少します。1.0 の場合はペナルティが適用されません。値は 0 より大きくなければならず、上限はありません。 Java SDK では、パラメーターは repetitionPenalty です。 HTTP 呼び出しの場合は、parameters オブジェクトに repetition_penalty を追加してください。 |
|
|
top_k 生成時のサンプリングにおけるサンプル候補セットのサイズ。たとえば、これを 50 に設定すると、スコア上位 50 トークンのみがサンプリングプールとなります。値が大きいほどランダム性が高まり、値が小さいほど決定論的になります。値が None または 100 を超える場合、top_k は無効化され、top_p のみが有効になります。 値は 0 以上である必要があります。 Java SDK では、パラメーターは topK です。 HTTP 呼び出しを行う場合、parameters オブジェクト内に top_k を設定してください。 |
|
|
stream ストリーミング出力モードを有効にします。 有効値:
説明
qwen-mt-flash および qwen-mt-lite は増分出力 (各チャンクには新しいコンテンツのみ含まれる) を返します。qwen-mt-plus および qwen-mt-turbo は非増分出力 (各チャンクにはそれまでの全シーケンスが含まれる) を返します。この動作は変更できません。例: I I didn I didn't I didn't laugh I didn't laugh after ... このパラメーターは Python SDK のみでサポートされています。Java SDK でストリーミング出力を実装するには、 |
|
|
translation_options 翻訳パラメーター。 Java SDK では、パラメーターは
|
チャット応答オブジェクト (ストリーミングおよび非ストリーミング出力で共通) |
|
|
status_code リクエストの状態コード。200 は成功を示し、その他の値は失敗を示します。 Java SDK はこのパラメーターを返しません。呼び出しが失敗した場合、例外がスローされます。例外メッセージには status_code および message の内容が含まれます。 |
|
|
request_id 一意のリクエスト ID。 Java SDK では、返されるパラメーターは requestId. |
|
|
code エラーコード。成功時は空です。 Python SDK のみがこのパラメーターを返します。 |
|
|
output 呼び出し結果。 |
|
|
usage リクエストのトークン使用量。 |
エラーコード
呼び出しが失敗した場合は、「エラーコード」を参照して問題を解決してください。