本文介紹通過 OpenAI 相容介面調用 qwen3-livetranslate-flash 模型的輸入與輸出參數。
相關文檔:音視頻檔案翻譯-千問
不支援通過 DashScope 介面調用。
OpenAI 相容
新加坡地區
SDK 調用配置的base_url為:https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1
HTTP 調用配置的endpoint:POST https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1/chat/completions
北京地區
SDK 調用配置的base_url為:https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1
HTTP 調用配置的endpoint:POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1/chat/completions
重要阿里雲百鍊為華北2(北京)、新加坡地區推出了業務空間專屬網域名稱,能夠為推理請求提供卓越的效能和更高的穩定性,建議遷移至新網域名稱:
- 華北2(北京)地區:從
https://dashscope.aliyuncs.com遷移至https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com - 新加坡地區:從
https://dashscope-intl.aliyuncs.com遷移至https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com
其中 {WorkspaceId} 為您的業務空間 ID,可在阿里雲百鍊控制台的業務空間詳情頁面查看。現有網域名稱仍可正常使用。
您需要已擷取API Key並配置API Key到環境變數。若通過OpenAI SDK進行調用,需要安裝SDK。
請求體model 模型名稱。支援的模型:qwen3-livetranslate-flash、qwen3-livetranslate-flash-2025-12-01。 messages 訊息數組,用於向大模型傳遞上下文。僅支援傳入一個 User Message。 stream 是否以流式方式輸出回複。模型僅支援流式輸出方式調用,僅可設為 stream_options 流式輸出的配置項,僅在 modalities 輸出資料的模態。可選值:
audio 輸出音訊音色與格式。 屬性 max_tokens 用於限制模型輸出的最大 Token 數。若產生內容超過此值,響應將被截斷。 預設值與最大值均為模型的最大輸出長度,請參見模型選型。 seed 隨機數種子。用於確保在相同輸入和參數下產生結果可複現。若調用時傳入相同的 取值範圍: speech_rate 控制輸出音訊語速。1.0為正常語速,小於1.0為慢速,大於1.0為快速。 取值範圍:[0.5, 2.0]。 temperature 採樣溫度,控制模型產生內容的多樣性。temperature越高,產生的內容更多樣,反之更確定。 取值範圍: [0, 2) 為了翻譯的準確性,不建議修改該值。 top_p 核採樣的機率閾值,控制模型產生內容的多樣性。 top_p越高,產生的內容更多樣。反之更確定。 取值範圍:(0,1.0] 為了翻譯的準確性,不建議修改該值。 presence_penalty 控制模型產生文本時的內容重複度。 取值範圍:[-2.0, 2.0]。正值降低重複度,負值增加重複度。為了翻譯的準確性,不建議修改該值。 top_k 產生過程中採樣候選集的大小。例如,取值為50時,僅將單次產生中得分最高的50個Token組成隨機採樣的候選集。取值越大,產生的隨機性越高;取值越小,產生的確定性越高。取值為None或當top_k大於100時,表示不啟用top_k策略,此時僅有top_p策略生效。 取值需要大於或等於0。為了翻譯的準確性,不建議修改該值。 該參數非OpenAI標準參數。通過 Python SDK調用時,請放入 extra_body 對象中,配置方式為: repetition_penalty 模型產生時連續序列中的重複度。提高repetition_penalty時可以降低模型產生的重複度,1.0表示不做懲罰。取值大於0即可。為了翻譯的準確性,不建議修改該值。 該參數非OpenAI標準參數。通過 Python SDK調用時,請放入 extra_body 對象中,配置方式為: translation_options 需配置的翻譯參數。 該參數非OpenAI標準參數。通過 Python SDK調用時,請放入 extra_body 對象中,配置方式為: | |
chat響應chunk對象(流式輸出)id 本次調用的唯一識別碼。每個chunk對象有相同的 id。 choices 模型產生內容的數組。若設定 屬性 delta 請求的增量對象。 屬性 content 增量訊息內容。 reasoning_content 該值固定為 function_call 該值固定為 audio 輸出的音頻資訊。 屬性 data 增量的 Base64 音頻編碼資料。 expires_at 建立請求時的時間戳記。 id 輸出音訊唯一識別碼。 refusal 該參數當前固定為 role 增量訊息對象的角色,只在第一個chunk中有值。 tool_calls 該值固定為 finish_reason 模型停止產生的原因。有以下情況:
index 當前響應在 logprobs 該值固定為 created 本次請求被建立時的時間戳記。每個chunk有相同的時間戳記。 model 本次請求使用的模型。 object 始終為 service_tier 該值固定為 system_fingerprint 該值固定為 usage 本次請求消耗的Token。只在 屬性 completion_tokens 模型輸出的 Token 數。 prompt_tokens 輸入 Token 數。 total_tokens 總 Token 數,為 completion_tokens_details 輸出 Token 的詳細資料。 屬性 audio_tokens 輸出的音頻 Token 數。 reasoning_tokens 該值固定為 text_tokens 輸出文本 Token 數。 prompt_tokens_details 輸入 Token的細粒度分類。 屬性 audio_tokens 輸入音訊 Token 數。
text_tokens 輸入文本的 Token 數。該值固定為0。 video_tokens 輸入視頻的 Token 數。 | |