Qwen Voice-Design モデルは、Qwen Speech Model シリーズの音声デザインモデルです。簡単なテキスト記述だけで、適切な音声を迅速にデザインできます。qwen3-tts-vd-realtime モデルと組み合わせて使用すると、10言語の音声をデザインして出力できます。さらに、合成された音声はテキストに基づいてトーンを適応的に調整でき、複雑なテキスト合成に対しても優れた処理能力を持っています。
推論サービスプロバイダー
qwen-voice-design の推論サービスプロバイダーは Alibaba Cloud Model Studio です。
モデルの機能
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | オーディオ |
モデル体験 | 非対応 | 関数呼び出し | 非対応 |
構造化出力 | 非対応 | ウェブ検索 | 非対応 |
プレフィックス補完 | 非対応 | コンテキストキャッシュ | 非対応 |
バッチ推論 | 非対応 | ファインチューニング | 非対応 |
コンテキスト制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | — | 最大出力長 | — |
コンテキストウィンドウ | — |
料金
このページでは、期間限定のプロモーションを除いた、モデル API 呼び出しの基本料金のみを記載しています。プロモーションオファーについては、Model Studio コンソール をご参照ください。
中国 (北京)
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
音声登録とデザイン | 0.2 | 音声ごと |
シンガポール
範囲:国際
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
音声登録とデザイン | 0.2 | 音声ごと |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 180 |
シンガポール
範囲:国際
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 180 |