CosyVoice シリーズの表現力豊かな音声合成モデルで、音声クローニングと設計機能が強化されています。話者の類似性を維持しながら自由なスタイルの命令によるコントロールをサポートし、豊かな合成スタイルを提供します。初音のレイテンシーを短縮し、発音の精度を向上させ、プロソディと音質を強化します。極めて自然な多言語 (中国語、英語、ドイツ語、フランス語、ロシア語、日本語、韓国語、ポルトガル語、タイ語、インドネシア語、ベトナム語) のリアルタイム音声合成を可能にします。
推論サービスプロバイダー
cosyvoice-v3.5-plus の推論サービスプロバイダーは Alibaba Cloud Model Studio です。
モデルの機能
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | オーディオ |
モデル体験 | 非対応 | 関数呼び出し | 非対応 |
構造化出力 | 非対応 | ウェブ検索 | 非対応 |
プレフィックス補完 | 非対応 | コンテキストキャッシュ | 非対応 |
バッチ推論 | 非対応 | ファインチューニング | 非対応 |
コンテキストの制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | — | 最大出力長 | — |
コンテキストウィンドウ | — |
料金
このページには、モデルの API 呼び出しの元の料金のみが表示されており、期間限定の割引は含まれていません。割引キャンペーンについては、Model Studio コンソールをご参照ください。
中国 (北京)
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
TTS | 0.22 | 10,000 文字あたり |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 180 |