本文介绍通过OpenAI兼容接口 或 DashScopeAPI 调用 Qwen-MT 模型的输入与输出参数。
相关文档: 翻译能力(Qwen-MT)
OpenAI 兼容
北京地域
SDK 调用配置的base_url为:https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1
HTTP 请求地址:POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1/chat/completions
新加坡地域
SDK 调用配置的base_url为:https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1
HTTP 请求地址:POST https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1/chat/completions
美国(弗吉尼亚)地域
SDK 调用配置的base_url:https://{WorkspaceId}.us-east-1.maas.aliyuncs.com/compatible-mode/v1
HTTP 请求地址:POST https://{WorkspaceId}.us-east-1.maas.aliyuncs.com/compatible-mode/v1/chat/completions
新加坡地域
SDK 调用配置的base_url为:https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1
HTTP 请求地址:POST https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1/chat/completions
美国(弗吉尼亚)地域
SDK 调用配置的base_url:https://{WorkspaceId}.us-east-1.maas.aliyuncs.com/compatible-mode/v1
HTTP 请求地址:POST https://{WorkspaceId}.us-east-1.maas.aliyuncs.com/compatible-mode/v1/chat/completions
北京地域
SDK 调用配置的base_url为:https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1
HTTP 请求地址:POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1/chat/completions
重要阿里云百炼为华北2(北京)、新加坡、中国香港地域推出了业务空间专属域名,能够为推理请求提供卓越的性能和更高的稳定性,建议迁移至新域名:
- 华北2(北京)地域:从
https://dashscope.aliyuncs.com迁移至https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com - 新加坡地域:从
https://dashscope-intl.aliyuncs.com迁移至https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com - 中国香港地域:从
https://cn-hongkong.dashscope.aliyuncs.com迁移至https://{WorkspaceId}.cn-hongkong.maas.aliyuncs.com
其中 {WorkspaceId} 为您的业务空间 ID,可在阿里云百炼控制台的业务空间详情页面查看。现有域名仍可正常使用。
您需要已 获取与配置 API Key 并 配置API Key到环境变量 。若通过OpenAI SDK进行调用,需要 安装SDK 。
请求体 | 基础使用PythonNode.jscurl各地域的请求地址和API Key不同,以下是新加坡地域的请求地址。 术语干预PythonNode.jscurl各地域的请求地址和API Key不同,以下是新加坡地域的请求地址。 翻译记忆PythonNode.jscurl各地域的请求地址和API Key不同,以下是新加坡地域的请求地址。 领域提示PythonNode.jscurl各地域的请求地址和API Key不同,以下是新加坡地域的请求地址。 |
model 模型名称。支持的模型:qwen-mt-plus、qwen-mt-flash、qwen-mt-lite、qwen-mt-turbo。 | |
messages 消息数组,用于向大模型传递上下文。仅支持传入 User Message。 | |
stream 是否以流式方式输出回复。 可选值:
说明当前仅qwen-mt-flash、qwen-mt-lite模型支持以增量形式返回数据,每次返回仅包含新生成的内容。qwen-mt-plus和qwen-mt-turbo模型以非增量形式返回数据,每次返回当前已经生成的整个序列,暂时无法修改。如: I I didn I didn't I didn't laugh I didn't laugh after ... | |
stream_options 流式输出的配置项,仅在 | |
max_tokens 用于限制模型输出的最大 Token 数。若生成内容超过此值,响应将被截断。 默认值与最大值均为模型的最大输出长度,请参见模型选型。 | |
seed 随机数种子。用于确保在相同输入和参数下生成结果可复现。若调用时传入相同的 取值范围: | |
temperature 采样温度,控制模型生成文本的多样性。 temperature越高,生成的文本更多样,反之,生成的文本更确定。 取值范围: [0, 2) temperature与top_p均可以控制生成文本的多样性,建议只设置其中一个值。 | |
top_p 核采样的概率阈值,控制模型生成文本的多样性。 top_p越高,生成的文本更多样。反之,生成的文本更确定。 取值范围:(0,1.0] temperature与top_p均可以控制生成文本的多样性,建议只设置其中一个值。 | |
top_k 生成过程中采样候选集的大小。例如,取值为50时,仅将单次生成中得分最高的50个Token组成随机采样的候选集。取值越大,生成的随机性越高;取值越小,生成的确定性越高。取值为None或当top_k大于100时,表示不启用top_k策略,此时仅有top_p策略生效。 取值需要大于或等于0。 该参数非OpenAI标准参数。通过 Python SDK调用时,请放入 extra_body 对象中,配置方式为: | |
repetition_penalty 模型生成时连续序列中的重复度。提高repetition_penalty时可以降低模型生成的重复度,1.0表示不做惩罚。没有严格的取值范围,只要大于0即可。 该参数非OpenAI标准参数。通过 Python SDK调用时,请放入 extra_body 对象中,配置方式为: | |
translation_options 需配置的翻译参数。 该参数非OpenAI标准参数。通过 Python SDK调用时,请放入 extra_body 对象中,配置方式为: |
chat响应对象(非流式输出) | |
id 本次请求的唯一标识符。 | |
choices 模型生成内容的数组。 | |
created 本次请求被创建时的时间戳。 | |
model 本次请求使用的模型。 | |
object 始终为 | |
service_tier 该参数当前固定为 | |
system_fingerprint 该参数当前固定为 | |
usage 本次请求的 Token 消耗信息。 属性 completion_tokens 模型输出的 Token 数。 prompt_tokens 输入的 Token 数。 total_tokens 消耗的总 Token 数,为 completion_tokens_details 该参数当前固定为 prompt_tokens_details 该参数当前固定为 |
chat响应chunk对象(流式输出) | |
id 本次调用的唯一标识符。每个chunk对象有相同的 id。 | |
choices 模型生成内容的数组。若设置 | |
created 本次请求被创建时的时间戳。每个chunk有相同的时间戳。 | |
model 本次请求使用的模型。 | |
object 始终为 | |
service_tier 该参数当前固定为 | |
system_fingerprint 该参数当前固定为 | |
usage 本次请求消耗的Token。只在 属性 completion_tokens 模型输出的 Token 数。 prompt_tokens 输入 Token 数。 total_tokens 总 Token 数,为 completion_tokens_details 该参数当前固定为 prompt_tokens_details 该参数当前固定为 |
DashScope
北京地域
HTTP 请求地址:POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/services/aigc/text-generation/generation
SDK 调用无需配置 base_url,其默认值为https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1。
新加坡地域
HTTP 请求地址:POST https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/text-generation/generation
SDK调用配置的base_url:
Python代码
dashscope.base_http_api_url = 'https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1'
Java代码
- 方式一:
import com.alibaba.dashscope.protocol.Protocol;
Generation gen = new Generation(Protocol.HTTP.getValue(), "https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1");
- 方式二:
import com.alibaba.dashscope.utils.Constants;
Constants.baseHttpApiUrl="https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1";
美国(弗吉尼亚)地域
HTTP 请求地址:POST https://{WorkspaceId}.us-east-1.maas.aliyuncs.com/api/v1/services/aigc/text-generation/generation
SDK调用配置的base_url:
Python代码
dashscope.base_http_api_url = 'https://{WorkspaceId}.us-east-1.maas.aliyuncs.com/api/v1'
Java代码
- 方式一:
import com.alibaba.dashscope.protocol.Protocol;
Generation gen = new Generation(Protocol.HTTP.getValue(), "https://{WorkspaceId}.us-east-1.maas.aliyuncs.com/api/v1");
- 方式二:
import com.alibaba.dashscope.utils.Constants;
Constants.baseHttpApiUrl="https://{WorkspaceId}.us-east-1.maas.aliyuncs.com/api/v1";
新加坡地域
HTTP 请求地址:POST https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/text-generation/generation
SDK调用配置的base_url:
Python代码
dashscope.base_http_api_url = 'https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1'
Java代码
- 方式一:
import com.alibaba.dashscope.protocol.Protocol;
Generation gen = new Generation(Protocol.HTTP.getValue(), "https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1");
- 方式二:
import com.alibaba.dashscope.utils.Constants;
Constants.baseHttpApiUrl="https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1";
美国(弗吉尼亚)地域
HTTP 请求地址:POST https://{WorkspaceId}.us-east-1.maas.aliyuncs.com/api/v1/services/aigc/text-generation/generation
SDK调用配置的base_url:
Python代码
dashscope.base_http_api_url = 'https://{WorkspaceId}.us-east-1.maas.aliyuncs.com/api/v1'
Java代码
- 方式一:
import com.alibaba.dashscope.protocol.Protocol;
Generation gen = new Generation(Protocol.HTTP.getValue(), "https://{WorkspaceId}.us-east-1.maas.aliyuncs.com/api/v1");
- 方式二:
import com.alibaba.dashscope.utils.Constants;
Constants.baseHttpApiUrl="https://{WorkspaceId}.us-east-1.maas.aliyuncs.com/api/v1";
北京地域
HTTP 请求地址:POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/services/aigc/text-generation/generation
SDK 调用无需配置 base_url,其默认值为https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1。
您需要已 获取与配置 API Key 并 配置API Key到环境变量 。若通过DashScope SDK进行调用,需要 安装DashScope SDK 。
请求体 | 基础使用PythonJavacurl各地域的请求地址和API Key不同,以下是新加坡地域的请求地址。 术语干预PythonJavacurl各地域的请求地址和API Key不同,以下是新加坡地域的请求地址。 翻译记忆PythonJavacurl各地域的请求地址和API Key不同,以下是新加坡地域的请求地址。 领域提示PythonJavacurl各地域的请求地址和API Key不同,以下是新加坡地域的请求地址。 |
model 模型名称。支持的模型:qwen-mt-plus、qwen-mt-flash、qwen-mt-lite、qwen-mt-turbo。 | |
messages 消息数组,用于向大模型传递上下文。仅支持传入 User Message。 | |
max_tokens 用于限制模型输出的最大 Token 数。若生成内容超过此值,响应将被截断。 默认值与最大值均为模型的最大输出长度,请参见模型选型。
| |
seed 随机数种子。用于确保在相同输入和参数下生成结果可复现。若调用时传入相同的 取值范围:
| |
temperature 采样温度,控制模型生成文本的多样性。 temperature越高,生成的文本更多样,反之,生成的文本更确定。 取值范围: [0, 2) temperature与top_p均可以控制生成文本的多样性,建议只设置其中一个值。
| |
top_p 核采样的概率阈值,控制模型生成文本的多样性。 top_p越高,生成的文本更多样。反之,生成的文本更确定。 取值范围:(0,1.0] temperature与top_p均可以控制生成文本的多样性,建议只设置其中一个值。
| |
repetition_penalty 模型生成时连续序列中的重复度。提高repetition_penalty时可以降低模型生成的重复度,1.0表示不做惩罚。没有严格的取值范围,只要大于0即可。
| |
top_k 生成过程中采样候选集的大小。例如,取值为50时,仅将单次生成中得分最高的50个Token组成随机采样的候选集。取值越大,生成的随机性越高;取值越小,生成的确定性越高。取值为None或当top_k大于100时,表示不启用top_k策略,此时仅有top_p策略生效。 取值需要大于或等于0。
| |
stream 是否以流式方式输出回复。 可选值:
说明当前仅qwen-mt-flash、qwen-mt-lite模型支持以增量形式返回数据,每次返回仅包含新生成的内容。qwen-mt-plus和qwen-mt-turbo模型以非增量形式返回数据,每次返回当前已经生成的整个序列,暂时无法修改。如: I I didn I didn't I didn't laugh I didn't laugh after ...
| |
translation_options 需配置的翻译参数。
|
chat响应对象(流式与非流式输出格式一致) | |
status_code 本次请求的状态码。200 表示请求成功,否则表示请求失败。
| |
request_id 本次调用的唯一标识符。
| |
code 错误码,调用成功时为空值。
| |
output 调用结果信息。 属性 text 该参数当前固定为 finish_reason 模型结束生成的原因。有以下情况:
choices 模型的输出信息。 属性 finish_reason 有以下情况:
message 模型输出的消息对象。 属性 role 输出消息的角色,固定为 content 翻译的结果。 model_name 本次请求使用的模型名称。 | |
usage 本次请求使用的Token信息。 属性 input_tokens 输入 Token 数。 output_tokens 输出 Token 数。 total_tokens 总 Token 数,为input_tokens与output_tokens之和。 |
错误码
如果模型调用失败并返回报错信息,请参见错误码进行解决。
.aliyun-docs-content .one-codeblocks pre {
max-height: calc(80vh - 136px) !important;
height: auto;
}
.tab-item {
font-size: 12px !important; /你可以根据需要调整字体大小/
padding: 0px 5px !important;
}
.expandable-content {
border-left: none !important;
border-right: none !important;
border-bottom: none !important;
}