qwen-voice-enrollment モデルは、qwen speech model シリーズの音声複製モデルです。わずか 5 秒以上の音声データを使用するだけで、非常に類似した音声を迅速に複製できます。qwen3-tts-vc-realtime モデルと組み合わせて使用すると、人の声を高忠実度で複製し、10 言語で音声を出力できます。さらに、合成音声はテキストに応じてトーンを適応的に調整でき、複雑なテキスト合成に対しても優れた処理能力を備えています。
モデルの機能
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | オーディオ | 出力モダリティ | テキスト |
モデル体験 | サポート対象外 | Function Calling | サポート対象外 |
構造化出力 | サポート対象外 | ウェブ検索 | サポート対象外 |
プレフィックス補完 | サポート対象外 | コンテキストキャッシュ | サポート対象外 |
バッチ推論 | サポート対象外 | ファインチューニング | サポート対象外 |
コンテキスト制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | — | 最大出力長 | — |
コンテキストウィンドウ | — |
料金
このページには、期間限定プロモーションを除いた、モデル API 呼び出しの基本料金のみが記載されています。プロモーション情報については、Model Studio コンソールをご参照ください。
シンガポール
範囲:国際
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
Voice Enrollment And Design | 0.01 | call(s) |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 180 |
シンガポール
範囲:国際
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 180 |