Qwen3-TTS-Flash は、Tongyi の最新のオフライン音声合成基盤モデルであり、17 種類の表現力豊かな音声を特徴とし、低遅延かつ高安定性の音声合成を可能にします。多言語および方言の出力をサポートし、言語間で一貫した音声特性を維持します。大規模なデータセットでトレーニングされたこのシステムは、テキストのセマンティクスに基づいて声のトーンを自動的に調整し、複雑なコンテンツの合成において堅牢な能力を発揮します。このモデルバージョンは、スナップショットモデル qwen3-tts-flash-2025-11-27 と機能的に同等です。
推論サービスプロバイダー
qwen3-tts-flash の推論サービスプロバイダーは Alibaba Cloud Model Studio です。
モデルの機能
中国 (北京)
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | オーディオ |
モデル体験 | サポート済み | Function Calling | 非サポート |
構造化出力 | 非サポート | Web 検索 | 非サポート |
プレフィックス補完 | 非サポート | コンテキストキャッシュ | 非サポート |
バッチ推論 | 非サポート | ファインチューニング | 非サポート |
シンガポール
スコープ:国際
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | オーディオ |
モデル体験 | 非サポート | Function Calling | 非サポート |
構造化出力 | 非サポート | Web 検索 | 非サポート |
プレフィックス補完 | 非サポート | コンテキストキャッシュ | 非サポート |
バッチ推論 | 非サポート | ファインチューニング | 非サポート |
コンテキスト制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | — | 最大出力長 | — |
コンテキストウィンドウ | — |
料金
このページには、期間限定のプロモーションを除いた、モデル API 呼び出しの基本料金のみが表示されています。プロモーション情報については、Model Studio コンソールをご参照ください。
中国 (北京)
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
TTS | 0.114682 | 10,000 文字あたり |
シンガポール
スコープ:国際
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
TTS | 0.1 | 10,000 文字あたり |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 180 |
シンガポール
スコープ:国際
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 180 |
スナップショットバージョン
qwen3-tts-flash-2025-11-27
Qwen3-TTS-Flash モデルは、Tongyi の最新のオフライン音声合成モデルです。51 種類の表現力豊かな人間らしい音色を誇り、低遅延かつ高安定性で音声を合成できます。また、複数の言語や方言をサポートし、同じ音色で多言語出力が可能です。大量のデータでトレーニングされたこのモデルは、テキストに基づいてトーンを適応的に調整し、複雑なテキストの合成を効果的に処理します。このモデルはスナップショットバージョンとして提供されます。
推論サービスプロバイダー
qwen3-tts-flash-2025-11-27 の推論サービスプロバイダーは Alibaba Cloud Model Studio です。
モデルの機能
中国 (北京)
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | オーディオ |
モデル体験 | サポート済み | Function Calling | 非サポート |
構造化出力 | 非サポート | Web 検索 | 非サポート |
プレフィックス補完 | 非サポート | コンテキストキャッシュ | 非サポート |
バッチ推論 | 非サポート | ファインチューニング | 非サポート |
シンガポール
スコープ:国際
| 機能 | サポート状況 | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | オーディオ |
モデル体験 | 非サポート | Function Calling | 非サポート |
構造化出力 | 非サポート | Web 検索 | 非サポート |
プレフィックス補完 | 非サポート | コンテキストキャッシュ | 非サポート |
バッチ推論 | 非サポート | ファインチューニング | 非サポート |
コンテキスト制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | — | 最大出力長 | — |
コンテキストウィンドウ | — |
料金
このページには、期間限定のプロモーションを除いた、モデル API 呼び出しの基本料金のみが表示されています。プロモーション情報については、Model Studio コンソールをご参照ください。
シンガポール
スコープ:国際
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
TTS | 0.1 | 10,000 文字あたり |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 180 |
シンガポール
スコープ:国際
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 180 |
qwen3-tts-flash-2025-09-18
Qwen 3-TTS-Flash-2025-09-18 は、Tongyi の最新のオフライン音声合成基盤モデルであり、17 種類の表現力豊かな音声を特徴とし、低遅延かつ高安定性の音声合成を可能にします。多言語および方言の出力をサポートし、言語間で一貫した音声特性を維持します。大規模なデータセットでトレーニングされたこのシステムは、テキストのセマンティクスに基づいて声のトーンを自動的に調整し、複雑なコンテンツの合成において堅牢な能力を発揮します。このモデルはスナップショットバージョンとして提供されます。
推論サービスプロバイダー
qwen3-tts-flash-2025-09-18 の推論サービスプロバイダーは Alibaba Cloud Model Studio です。
モデルの機能
中国 (北京)
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | オーディオ |
モデル体験 | サポート済み | Function Calling | 非サポート |
構造化出力 | 非サポート | Web 検索 | 非サポート |
プレフィックス補完 | 非サポート | コンテキストキャッシュ | 非サポート |
バッチ推論 | 非サポート | ファインチューニング | 非サポート |
シンガポール
スコープ:国際
| 機能 | サポート状況 | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | オーディオ |
モデル体験 | 非サポート | Function Calling | 非サポート |
構造化出力 | 非サポート | Web 検索 | 非サポート |
プレフィックス補完 | 非サポート | コンテキストキャッシュ | 非サポート |
バッチ推論 | 非サポート | ファインチューニング | 非サポート |
コンテキスト制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | — | 最大出力長 | — |
コンテキストウィンドウ | — |
料金
このページには、期間限定のプロモーションを除いた、モデル API 呼び出しの基本料金のみが表示されています。プロモーション情報については、Model Studio コンソールをご参照ください。
中国 (北京)
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
TTS | 0.114682 | 10,000 文字あたり |
シンガポール
スコープ:国際
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
TTS | 0.1 | 10,000 文字あたり |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 10 |
シンガポール
スコープ:国際
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 10 |