Qwen3-TTS-VD モデルは、Tongyi の最新のリアルタイム音声合成モデルです。qwen3-voice-design サービスで設計された音声に対して、忠実度の高いリアルタイム音声合成を実行でき、同一の音声で 11 言語の音声出力をサポートします。このモデルは大量のデータでトレーニングされており、合成された音声はテキストに応じてトーンを適応的に調整でき、複雑なテキスト合成に対して優れた処理能力を発揮します。このモデルは 2026 年 1 月 15 日のスナップショットバージョンです。
推論サービスのプロバイダー
qwen3-tts-vd-realtime-2026-01-15 の推論サービスのプロバイダーは Alibaba Cloud Model Studio です。
モデルの機能
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | オーディオ |
モデル体験 | 非対応 | Function Calling | 非対応 |
構造化出力 | 非対応 | Web 検索 | 非対応 |
プレフィックス補完 | 非対応 | コンテキストキャッシュ | 非対応 |
バッチ推論 | 非対応 | ファインチューニング | 非対応 |
コンテキスト制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | — | 最大出力長 | — |
コンテキストウィンドウ | — |
料金
このページには、期間限定のプロモーションを除いた、モデルの API 呼び出しの元の料金のみが表示されます。プロモーションについては、Model Studio コンソールをご参照ください。
中国 (北京)
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
TTS | 0.143353 | 10,000 文字あたり |
シンガポール
スコープ:国際
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
TTS | 0.13 | 10,000 文字あたり |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 180 |
シンガポール
スコープ:国際
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 180 |
スナップショットバージョン
qwen3-tts-vd-realtime-2026-01-15
Qwen3-TTS-VD モデルは、Tongyi の最新のリアルタイム音声合成モデルです。qwen3-voice-design サービスで設計された音声に対して、忠実度の高いリアルタイム音声合成を実行でき、同一の音声で 11 言語の音声出力をサポートします。このモデルは大量のデータでトレーニングされており、合成された音声はテキストに応じてトーンを適応的に調整でき、複雑なテキスト合成に対して優れた処理能力を発揮します。このモデルは 2026 年 1 月 15 日のスナップショットバージョンです。
推論サービスのプロバイダー
qwen3-tts-vd-realtime-2026-01-15 の推論サービスのプロバイダーは Alibaba Cloud Model Studio です。
モデルの機能
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | オーディオ |
モデル体験 | 非対応 | Function Calling | 非対応 |
構造化出力 | 非対応 | Web 検索 | 非対応 |
プレフィックス補完 | 非対応 | コンテキストキャッシュ | 非対応 |
バッチ推論 | 非対応 | ファインチューニング | 非対応 |
コンテキスト制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | — | 最大出力長 | — |
コンテキストウィンドウ | — |
料金
このページには、期間限定のプロモーションを除いた、モデルの API 呼び出しの元の料金のみが表示されます。プロモーションについては、Model Studio コンソールをご参照ください。
中国 (北京)
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
TTS | 0.143353 | 10,000 文字あたり |
シンガポール
スコープ:国際
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
TTS | 0.13 | 10,000 文字あたり |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 180 |
シンガポール
スコープ:国際
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 180 |
qwen3-tts-vd-realtime-2025-12-16
Qwen 3-TTS-VD モデルは、Tongyi の最新のリアルタイム音声合成モデルです。qwen3-voice-design サービスで設計された音声に対して、忠実度の高いリアルタイム音声合成を実行でき、同一の音声で 11 言語の音声出力をサポートします。このモデルは大量のデータでトレーニングされており、合成された音声はテキストに応じてトーンを適応的に調整でき、複雑なテキスト合成に対して優れた処理能力を発揮します。このモデルは 2025 年 12 月 16 日のスナップショットバージョンです。
推論サービスのプロバイダー
qwen3-tts-vd-realtime-2025-12-16 の推論サービスのプロバイダーは Alibaba Cloud Model Studio です。
モデルの機能
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | オーディオ |
モデル体験 | 非対応 | Function Calling | 非対応 |
構造化出力 | 非対応 | Web 検索 | 非対応 |
プレフィックス補完 | 非対応 | コンテキストキャッシュ | 非対応 |
バッチ推論 | 非対応 | ファインチューニング | 非対応 |
コンテキスト制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | — | 最大出力長 | — |
コンテキストウィンドウ | — |
料金
このページには、期間限定のプロモーションを除いた、モデルの API 呼び出しの元の料金のみが表示されます。プロモーションについては、Model Studio コンソールをご参照ください。
中国 (北京)
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
TTS | 0.143353 | 10,000 文字あたり |
シンガポール
スコープ:国際
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
TTS | 0.13 | 10,000 文字あたり |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 180 |
シンガポール
スコープ:国際
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 180 |