Qwen-TTS は、Qwen シリーズ初の音声合成モデルで、中国語、英語、およびそれらの混在入力に対応しています。テキストに応じて出力のトーンを自動調整し、自然な音声品質を提供し、ストリーミング出力もサポートします。
推論サービスプロバイダー
qwen-tts の推論サービスプロバイダーは Alibaba Cloud Model Studio です。
モデルの機能
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | オーディオ |
モデル体験 | 非対応 | Function Calling | 非対応 |
構造化出力 | 非対応 | ウェブ検索 | 非対応 |
プレフィックス補完 | 非対応 | コンテキストキャッシュ | 非対応 |
バッチ推論 | 非対応 | ファインチューニング | 非対応 |
コンテキスト制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | 512 | 最大出力長 | 7680 |
コンテキストウィンドウ | 8192 |
料金
このページには、モデル API 呼び出しの基本料金のみが記載されており、期間限定のプロモーションは含まれていません。プロモーション特典については、Model Studio コンソールをご参照ください。
中国 (北京)
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力:テキスト | 0.23 | 100 万トークンあたり |
出力:オーディオ | 1.434 | 100 万トークンあたり |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 10 |
TPM (1 分あたりのトークン数) | 100,000 |
動的更新
qwen-tts-latest
Qwen-TTS は、Qwen シリーズ初の音声合成モデルで、中国語、英語、およびそれらの混在入力に対応しています。テキストに応じて出力のトーンを自動調整し、自然な音声品質を提供し、ストリーミング出力もサポートします。
推論サービスプロバイダー
qwen-tts-latest の推論サービスプロバイダーは Alibaba Cloud Model Studio です。
モデルの機能
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | オーディオ |
モデル体験 | 非対応 | Function Calling | 非対応 |
構造化出力 | 非対応 | ウェブ検索 | 非対応 |
プレフィックス補完 | 非対応 | コンテキストキャッシュ | 非対応 |
バッチ推論 | 非対応 | ファインチューニング | 非対応 |
コンテキスト制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | 512 | 最大出力長 | 7680 |
コンテキストウィンドウ | 8192 |
料金
このページには、モデル API 呼び出しの基本料金のみが記載されており、期間限定のプロモーションは含まれていません。プロモーション特典については、Model Studio コンソールをご参照ください。
中国 (北京)
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力:テキスト | 0.23 | 100 万トークンあたり |
出力:オーディオ | 1.434 | 100 万トークンあたり |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 10 |
TPM (1 分あたりのトークン数) | 100,000 |
スナップショットバージョン
qwen-tts-2025-05-22
Qwen-TTS は、Qwen シリーズ初の音声合成モデルで、中国語、英語、およびそれらの混在入力に対応しています。テキストに応じて出力のトーンを自動調整し、自然な音声品質を提供し、ストリーミング出力もサポートします。
推論サービスプロバイダー
qwen-tts-2025-05-22 の推論サービスプロバイダーは Alibaba Cloud Model Studio です。
モデルの機能
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | オーディオ |
モデル体験 | 非対応 | Function Calling | 非対応 |
構造化出力 | 非対応 | ウェブ検索 | 非対応 |
プレフィックス補完 | 非対応 | コンテキストキャッシュ | 非対応 |
バッチ推論 | 非対応 | ファインチューニング | 非対応 |
コンテキスト制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | 512 | 最大出力長 | 7680 |
コンテキストウィンドウ | 8192 |
料金
このページには、モデル API 呼び出しの基本料金のみが記載されており、期間限定のプロモーションは含まれていません。プロモーション特典については、Model Studio コンソールをご参照ください。
中国 (北京)
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力:テキスト | 0.23 | 100 万トークンあたり |
出力:オーディオ | 1.434 | 100 万トークンあたり |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 10 |
TPM (1 分あたりのトークン数) | 100,000 |
qwen-tts-2025-04-10
Qwen-TTS は、Qwen シリーズ初の音声合成モデルで、中国語、英語、およびそれらの混在入力に対応しています。テキストに応じて出力のトーンを自動調整し、自然な音声品質を提供し、ストリーミング出力もサポートします。
推論サービスプロバイダー
qwen-tts-2025-04-10 の推論サービスプロバイダーは Alibaba Cloud Model Studio です。
モデルの機能
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | オーディオ |
モデル体験 | 非対応 | Function Calling | 非対応 |
構造化出力 | 非対応 | ウェブ検索 | 非対応 |
プレフィックス補完 | 非対応 | コンテキストキャッシュ | 非対応 |
バッチ推論 | 非対応 | ファインチューニング | 非対応 |
コンテキスト制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | 512 | 最大出力長 | 7680 |
コンテキストウィンドウ | 8192 |
料金
このページには、モデル API 呼び出しの基本料金のみが記載されており、期間限定のプロモーションは含まれていません。プロモーション特典については、Model Studio コンソールをご参照ください。
中国 (北京)
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力:テキスト | 0.23 | 100 万トークンあたり |
出力:オーディオ | 1.434 | 100 万トークンあたり |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 10 |
TPM (1 分あたりのトークン数) | 100,000 |