すべてのプロダクト
Search
ドキュメントセンター

Alibaba Cloud Model Studio:qwen3-tts-vd-realtime-2026-01-15

最終更新日:Sep 23, 2026

Qwen3-TTS-VD モデルは、Tongyi の最新のリアルタイム音声合成モデルです。qwen3-voice-design サービスで設計された音声に対して、忠実度の高いリアルタイム音声合成を実行でき、同一の音声で 11 言語の音声出力をサポートします。このモデルは大量のデータでトレーニングされており、合成された音声はテキストに応じてトーンを適応的に調整でき、複雑なテキスト合成に対して優れた処理能力を発揮します。このモデルは 2026 年 1 月 15 日のスナップショットバージョンです。

推論サービスのプロバイダー

qwen3-tts-vd-realtime-2026-01-15 の推論サービスのプロバイダーは Alibaba Cloud Model Studio です。

モデルの機能

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

オーディオ

モデル体験

非対応

Function Calling

非対応

構造化出力

非対応

Web 検索

非対応

プレフィックス補完

非対応

コンテキストキャッシュ

非対応

バッチ推論

非対応

ファインチューニング

非対応

コンテキスト制限

パラメーター値パラメーター値

最大入力長

—

最大出力長

—

コンテキストウィンドウ

—

料金

このページには、期間限定のプロモーションを除いた、モデルの API 呼び出しの元の料金のみが表示されます。プロモーションについては、Model Studio コンソールをご参照ください。

中国 (北京)

課金項目価格 (USD)単位

TTS

0.143353

10,000 文字あたり

シンガポール

スコープ:国際

課金項目価格 (USD)単位

TTS

0.13

10,000 文字あたり

レート制限

中国 (北京)

パラメーター値

RPM (1分あたりのリクエスト数)

180

シンガポール

スコープ:国際

パラメーター値

RPM (1分あたりのリクエスト数)

180

スナップショットバージョン

qwen3-tts-vd-realtime-2026-01-15

Qwen3-TTS-VD モデルは、Tongyi の最新のリアルタイム音声合成モデルです。qwen3-voice-design サービスで設計された音声に対して、忠実度の高いリアルタイム音声合成を実行でき、同一の音声で 11 言語の音声出力をサポートします。このモデルは大量のデータでトレーニングされており、合成された音声はテキストに応じてトーンを適応的に調整でき、複雑なテキスト合成に対して優れた処理能力を発揮します。このモデルは 2026 年 1 月 15 日のスナップショットバージョンです。

推論サービスのプロバイダー

qwen3-tts-vd-realtime-2026-01-15 の推論サービスのプロバイダーは Alibaba Cloud Model Studio です。

モデルの機能

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

オーディオ

モデル体験

非対応

Function Calling

非対応

構造化出力

非対応

Web 検索

非対応

プレフィックス補完

非対応

コンテキストキャッシュ

非対応

バッチ推論

非対応

ファインチューニング

非対応

コンテキスト制限

パラメーター値パラメーター値

最大入力長

—

最大出力長

—

コンテキストウィンドウ

—

料金

このページには、期間限定のプロモーションを除いた、モデルの API 呼び出しの元の料金のみが表示されます。プロモーションについては、Model Studio コンソールをご参照ください。

中国 (北京)

課金項目価格 (USD)単位

TTS

0.143353

10,000 文字あたり

シンガポール

スコープ:国際

課金項目価格 (USD)単位

TTS

0.13

10,000 文字あたり

レート制限

中国 (北京)

パラメーター値

RPM (1分あたりのリクエスト数)

180

シンガポール

スコープ:国際

パラメーター値

RPM (1分あたりのリクエスト数)

180

qwen3-tts-vd-realtime-2025-12-16

Qwen 3-TTS-VD モデルは、Tongyi の最新のリアルタイム音声合成モデルです。qwen3-voice-design サービスで設計された音声に対して、忠実度の高いリアルタイム音声合成を実行でき、同一の音声で 11 言語の音声出力をサポートします。このモデルは大量のデータでトレーニングされており、合成された音声はテキストに応じてトーンを適応的に調整でき、複雑なテキスト合成に対して優れた処理能力を発揮します。このモデルは 2025 年 12 月 16 日のスナップショットバージョンです。

推論サービスのプロバイダー

qwen3-tts-vd-realtime-2025-12-16 の推論サービスのプロバイダーは Alibaba Cloud Model Studio です。

モデルの機能

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

オーディオ

モデル体験

非対応

Function Calling

非対応

構造化出力

非対応

Web 検索

非対応

プレフィックス補完

非対応

コンテキストキャッシュ

非対応

バッチ推論

非対応

ファインチューニング

非対応

コンテキスト制限

パラメーター値パラメーター値

最大入力長

—

最大出力長

—

コンテキストウィンドウ

—

料金

このページには、期間限定のプロモーションを除いた、モデルの API 呼び出しの元の料金のみが表示されます。プロモーションについては、Model Studio コンソールをご参照ください。

中国 (北京)

課金項目価格 (USD)単位

TTS

0.143353

10,000 文字あたり

シンガポール

スコープ:国際

課金項目価格 (USD)単位

TTS

0.13

10,000 文字あたり

レート制限

中国 (北京)

パラメーター値

RPM (1分あたりのリクエスト数)

180

シンガポール

スコープ:国際

パラメーター値

RPM (1分あたりのリクエスト数)

180