テキストおよび音声の入出力に対応し、Function Calling、Web検索、音声クローニング機能を備えたリアルタイム双方向音声モデルです。
推論サービスプロバイダーはAlibaba Cloud Model Studioです。デフォルトの音声はlonganqian_v3.1です。統合方法、対応音声、パラメータについては、リアルタイム音声ガイドを参照してください。
enable_searchを使用してWeb検索を有効にします。Web検索とFunction Callingを同時に有効にすることはできません。
コンテキストの制限
| パラメータ | 制限(トークン) |
|---|---|
| Context window | 262,144 |
| Max input length | 245,760 |
| Max output length | 16,384 |
料金とレート制限
Singapore
料金は百万トークンあたりの価格です。
| モデルID | テキスト入力 | 音声入力 | テキスト出力 | 音声出力 |
|---|---|---|---|---|
qwen-audio-3.1-realtime-plus | $0.8 | $6.4 | $6.4 | $24 |
レート制限:60 RPMおよび100,000 TPM。
中国(北京)
料金は百万トークンあたりの価格です。
| モデルID | テキスト入力 | 音声入力 | テキスト出力 | 音声出力 |
|---|---|---|---|---|
qwen-audio-3.1-realtime-plus | $0.688 | $5.501 | $5.501 | $20.628 |
レート制限:60 RPMおよび100,000 TPM。