すべてのプロダクト
Search
ドキュメントセンター

Alibaba Cloud Model Studio:qwen3-tts-flash-realtime

最終更新日:Sep 23, 2026

qwen3-tts-flash-realtime モデルは、Tongyi の最新のリアルタイム音声合成基盤モデルです。17 種類の表現力豊かな音声を特徴とし、低遅延かつ高安定性の音声合成を実現します。多言語および方言の出力をサポートし、言語間で一貫した音声特性を維持します。大規模なデータセットでトレーニングされたこのシステムは、テキストのセマンティクスに基づいて声のトーンを自律的に調整し、複雑なコンテンツの合成においても堅牢な能力を発揮します。このモデルバージョンは、スナップショットモデル qwen3-tts-flash-realtime-2025-11-27 と機能的に同等です。

推論サービスプロバイダー

qwen3-tts-flash-realtime の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデルの機能

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

オーディオ

モデル体験

非対応

関数呼び出し

非対応

構造化出力

非対応

Web 検索

非対応

プレフィックス補完

非対応

コンテキストキャッシュ

非対応

バッチ推論

非対応

ファインチューニング

非対応

コンテキスト制限

パラメーター値パラメーター値

最大入力長

—

最大出力長

—

コンテキストウィンドウ

—

料金

このページには、期間限定のプロモーションを除いた、モデル API 呼び出しの基本料金のみが表示されています。プロモーション情報については、Model Studio コンソールをご参照ください。

中国 (北京)

課金項目価格 (USD)単位

TTS

0.143353

10,000 文字あたり

シンガポール

スコープ:国際

課金項目価格 (USD)単位

TTS

0.13

10,000 文字あたり

レート制限

中国 (北京)

パラメーター値

RPM (1分あたりのリクエスト数)

180

シンガポール

スコープ:国際

パラメーター値

RPM (1分あたりのリクエスト数)

180

スナップショットバージョン

qwen3-tts-flash-realtime-2025-11-27

qwen3-tts-flash-realtime-2025-11-27 モデルは、Tongyi の最新の大規模リアルタイム音声合成モデルです。51 種類の表現力豊かな人間のような音色を誇り、低遅延かつ高安定性でリアルタイムに音声を合成できます。また、多言語と方言をサポートし、同じ音色で多言語出力が可能です。膨大なデータでトレーニングされたこのモデルは、テキストに基づいてトーンを適応的に調整し、複雑なテキストの合成にも効果的に対応します。このモデルはスナップショットバージョンとして提供されます。

推論サービスプロバイダー

qwen3-tts-flash-realtime-2025-11-27 の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデルの機能

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

オーディオ

モデル体験

非対応

関数呼び出し

非対応

構造化出力

非対応

Web 検索

非対応

プレフィックス補完

非対応

コンテキストキャッシュ

非対応

バッチ推論

非対応

ファインチューニング

非対応

コンテキスト制限

パラメーター値パラメーター値

最大入力長

—

最大出力長

—

コンテキストウィンドウ

—

料金

このページには、期間限定のプロモーションを除いた、モデル API 呼び出しの基本料金のみが表示されています。プロモーション情報については、Model Studio コンソールをご参照ください。

シンガポール

スコープ:国際

課金項目価格 (USD)単位

TTS

0.13

10,000 文字あたり

レート制限

中国 (北京)

パラメーター値

RPM (1分あたりのリクエスト数)

180

シンガポール

スコープ:国際

パラメーター値

RPM (1分あたりのリクエスト数)

180

qwen3-tts-flash-realtime-2025-09-18

qwen3-tts-flash-realtime-2025-09-18 モデルは、Tongyi の最新のリアルタイム音声合成基盤モデルです。17 種類の表現力豊かな音声を特徴とし、低遅延かつ高安定性の音声合成を実現します。多言語および方言の出力をサポートし、言語間で一貫した音声特性を維持します。大規模なデータセットでトレーニングされたこのシステムは、テキストのセマンティクスに基づいて声のトーンを自律的に調整し、複雑なコンテンツの合成においても堅牢な能力を発揮します。このモデルはスナップショットバージョンとして提供されます。

推論サービスプロバイダー

qwen3-tts-flash-realtime-2025-09-18 の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデルの機能

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

オーディオ

モデル体験

非対応

関数呼び出し

非対応

構造化出力

非対応

Web 検索

非対応

プレフィックス補完

非対応

コンテキストキャッシュ

非対応

バッチ推論

非対応

ファインチューニング

非対応

コンテキスト制限

パラメーター値パラメーター値

最大入力長

—

最大出力長

—

コンテキストウィンドウ

—

料金

このページには、期間限定のプロモーションを除いた、モデル API 呼び出しの基本料金のみが表示されています。プロモーション情報については、Model Studio コンソールをご参照ください。

中国 (北京)

課金項目価格 (USD)単位

TTS

0.143353

10,000 文字あたり

シンガポール

スコープ:国際

課金項目価格 (USD)単位

TTS

0.13

10,000 文字あたり

レート制限

中国 (北京)

パラメーター値

RPM (1分あたりのリクエスト数)

10

シンガポール

スコープ:国際

パラメーター値

RPM (1分あたりのリクエスト数)

10