すべてのプロダクト
Search
ドキュメントセンター

Alibaba Cloud Model Studio:qwen3-tts-vc-realtime-2026-01-15

最終更新日:Sep 23, 2026

Qwen 3-TTS-Flash モデルは、Tongyi の最新のリアルタイム音声合成モデルです。qwen-voice-enrollment サービスから複製された音声に対して、忠実度の高いリアルタイム音声合成を実行でき、同じ音声で 11 言語の音声出力をサポートします。このモデルは大量のデータでトレーニングされており、合成された音声はテキストに応じてトーンを適応的に調整でき、複雑なテキスト合成に対して優れた処理能力を発揮します。このモデルは、2026 年 1 月 15 日時点のスナップショットバージョンです。

推論サービスのプロバイダー

qwen3-tts-vc-realtime-2026-01-15 の推論サービスのプロバイダーは Alibaba Cloud Model Studio です。

モデルの機能

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

オーディオ

モデル体験

非対応

Function Calling

非対応

構造化出力

非対応

ウェブ検索

非対応

プレフィックス補完

非対応

コンテキストキャッシュ

非対応

バッチ推論

非対応

ファインチューニング

非対応

コンテキスト制限

パラメーター値パラメーター値

最大入力長

—

最大出力長

—

コンテキストウィンドウ

—

料金

このページには、期間限定のプロモーションを除いた、モデル API 呼び出しの基本料金のみが表示されています。プロモーション情報については、Model Studio コンソールをご参照ください。

中国 (北京)

課金項目価格 (USD)単位

TTS

0.143353

10,000 文字あたり

シンガポール

範囲:国際

課金項目価格 (USD)単位

TTS

0.13

10,000 文字あたり

レート制限

中国 (北京)

パラメーター値

RPM (1分あたりのリクエスト数)

180

シンガポール

範囲:国際

パラメーター値

RPM (1分あたりのリクエスト数)

180

スナップショットバージョン

qwen3-tts-vc-realtime-2026-01-15

Qwen 3-TTS-Flash モデルは、Tongyi の最新のリアルタイム音声合成モデルです。qwen-voice-enrollment サービスから複製された音声に対して、忠実度の高いリアルタイム音声合成を実行でき、同じ音声で 11 言語の音声出力をサポートします。このモデルは大量のデータでトレーニングされており、合成された音声はテキストに応じてトーンを適応的に調整でき、複雑なテキスト合成に対して優れた処理能力を発揮します。このモデルは、2026 年 1 月 15 日時点のスナップショットバージョンです。

推論サービスのプロバイダー

qwen3-tts-vc-realtime-2026-01-15 の推論サービスのプロバイダーは Alibaba Cloud Model Studio です。

モデルの機能

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

オーディオ

モデル体験

非対応

Function Calling

非対応

構造化出力

非対応

ウェブ検索

非対応

プレフィックス補完

非対応

コンテキストキャッシュ

非対応

バッチ推論

非対応

ファインチューニング

非対応

コンテキスト制限

パラメーター値パラメーター値

最大入力長

—

最大出力長

—

コンテキストウィンドウ

—

料金

このページには、期間限定のプロモーションを除いた、モデル API 呼び出しの基本料金のみが表示されています。プロモーション情報については、Model Studio コンソールをご参照ください。

中国 (北京)

課金項目価格 (USD)単位

TTS

0.143353

10,000 文字あたり

シンガポール

範囲:国際

課金項目価格 (USD)単位

TTS

0.13

10,000 文字あたり

レート制限

中国 (北京)

パラメーター値

RPM (1分あたりのリクエスト数)

180

シンガポール

範囲:国際

パラメーター値

RPM (1分あたりのリクエスト数)

180

qwen3-tts-vc-realtime-2025-11-27

Qwen3-TTS-Flash モデルは、Tongyi の最新のリアルタイム音声合成モデルです。qwen3-voice-enrollment サービスによって複製された音声に対して、忠実度の高いリアルタイム音声合成を実行でき、同じ音色で 11 言語の音声出力をサポートします。このモデルは大量のデータでトレーニングされており、合成された音声はテキストに応じてトーンを適応的に調整でき、複雑なテキスト合成に対しても優れた処理能力を備えています。このモデルはスナップショットバージョンとして提供されます。

推論サービスのプロバイダー

qwen3-tts-vc-realtime-2025-11-27 の推論サービスのプロバイダーは Alibaba Cloud Model Studio です。

モデルの機能

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

オーディオ

モデル体験

非対応

Function Calling

非対応

構造化出力

非対応

ウェブ検索

非対応

プレフィックス補完

非対応

コンテキストキャッシュ

非対応

バッチ推論

非対応

ファインチューニング

非対応

コンテキスト制限

パラメーター値パラメーター値

最大入力長

—

最大出力長

—

コンテキストウィンドウ

—

料金

このページには、期間限定のプロモーションを除いた、モデル API 呼び出しの基本料金のみが表示されています。プロモーション情報については、Model Studio コンソールをご参照ください。

シンガポール

範囲:国際

課金項目価格 (USD)単位

TTS

0.13

10,000 文字あたり

レート制限

中国 (北京)

パラメーター値

RPM (1分あたりのリクエスト数)

180

シンガポール

範囲:国際

パラメーター値

RPM (1分あたりのリクエスト数)

180