CosyVoice シリーズの高性能な音声合成モデルで、音声クローニングと設計機能が強化されています。話者の類似性を維持しながら自由形式の命令コントロールをサポートし、豊富な合成スタイルを提供します。最初の音節のレイテンシーを短縮し、発音の精度とプロソディ、音質を向上させます。超自然な多言語 (中国語、英語、ドイツ語、フランス語、ロシア語、日本語、韓国語、ポルトガル語、タイ語、インドネシア語、ベトナム語) のリアルタイム音声合成を可能にします。
推論サービスプロバイダー
cosyvoice-v3.5-flash の推論サービスプロバイダーは Alibaba Cloud Model Studio です。
モデルの機能
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | オーディオ |
モデル体験 | 非対応 | 関数呼び出し | 非対応 |
構造化出力 | 非対応 | ウェブ検索 | 非対応 |
プレフィックス補完 | 非対応 | コンテキストキャッシュ | 非対応 |
バッチ推論 | 非対応 | ファインチューニング | 非対応 |
コンテキスト長の制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | — | 最大出力長 | — |
コンテキストウィンドウ | — |
料金
このページには、モデルの API 呼び出しの通常料金のみが表示されており、期間限定プロモーションは含まれていません。プロモーション情報については、Model Studio コンソールをご参照ください。
中国 (北京)
| 課金項目 | 価格 (米ドル) | 単位 |
|---|---|---|
TTS | 0.116 | 10,000 文字あたり |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 180 |