HTTP API を使用して、クローンされた音声の作成、一覧表示、クエリ、更新、削除を行います。
ユーザーガイド: 音声クローニング
サービスエンドポイント
シンガポール
POST https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/audio/tts/customization
{WorkspaceId} を実際の ワークスペース ID に置き換えてください。
中国 (北京)
POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/services/audio/tts/customization
{WorkspaceId} を実際の ワークスペース ID に置き換えてください。
Alibaba Cloud Model Studio は、中国 (北京) およびシンガポールリージョン向けにワークスペース固有のドメインをリリースしました。新しい専用ドメインは、推論リクエストに対してより優れたパフォーマンスと高い安定性を提供します。新しいドメインへの移行を推奨します:
中国 (北京):
dashscope.aliyuncs.comから{WorkspaceId}.cn-beijing.maas.aliyuncs.comへシンガポール:
dashscope-intl.aliyuncs.comから{WorkspaceId}.ap-southeast-1.maas.aliyuncs.comへ
{WorkspaceId} を実際の ワークスペース ID に置き換えてください。既存のドメインも引き続き完全に機能します。
リクエストヘッダー
|
パラメーター |
タイプ |
必須 |
説明 |
|
Authorization |
string |
はい |
認証トークン。フォーマットは |
|
Content-Type |
string |
はい |
リクエストボディのメディアタイプ。Qwen-Audio-TTS/CosyVoice/Qwen-TTS の場合は |
音声の作成
リクエストボディ |
この例では、シンガポールリージョンのエンドポイントを使用します。北京リージョンの場合は、
Qwen-Audio-TTS/CosyVoice 音声クローニング
Qwen-TTS 音声クローニング
|
|
model 音声クローニングモデル。有効な値:
|
|
|
input 入力パラメーター。 |
|
レスポンスボディ |
Qwen-Audio-TTS/CosyVoice 音声クローニング
Qwen-TTS 音声クローニング
重要
Qwen-Audio-TTS/CosyVoice は |
|
request_id このリクエストの一意の識別子。 |
|
|
output モデルによって返されるデータ。 |
|
|
usage このリクエストの使用状況情報。 |
音声リストのクエリ
リクエストボディ |
この例では、シンガポールリージョンのエンドポイントを使用します。北京リージョンの場合は、
Qwen-Audio-TTS/CosyVoice
Qwen-TTS 音声クローニング
|
|
model 音声クローニングモデル。有効な値:
|
|
|
input 入力パラメーター。 |
レスポンスボディ |
Qwen-Audio-TTS/CosyVoice
Qwen
重要
Qwen-Audio-TTS/CosyVoice は、各エントリに |
|
request_id このリクエストの一意の識別子。 |
|
|
output モデルによって返されるデータ。 |
|
|
usage このリクエストの使用状況情報。 |
音声詳細のクエリ
Qwen-Audio-TTS/CosyVoice (model が voice-enrollment の場合) にのみ適用されます。Qwen モデルは、音声詳細のクエリ操作をサポートしていません。
リクエストボディ |
この例では、シンガポールリージョンのエンドポイントを使用します。北京リージョンの場合は、
Qwen-Audio-TTS/CosyVoice
|
|
model
|
|
|
input 入力パラメーター。 |
レスポンスボディ |
|
|
request_id このリクエストの一意の識別子。 |
|
|
output モデルによって返されるデータ。 |
|
|
usage このリクエストの使用状況情報。 |
音声の更新
Qwen-Audio-TTS/CosyVoice 音声クローニング (model が voice-enrollment の場合) にのみ適用されます。Qwen モデルは更新操作をサポートしていません。
リクエストボディ |
この例では、シンガポールリージョンのエンドポイントを使用します。北京リージョンの場合は、 |
|
model
|
|
|
input 入力パラメーター。 |
レスポンスボディ |
|
|
request_id このリクエストの一意の識別子。 |
|
|
output モデルによって返されるデータ。更新操作は空のオブジェクトを返します。 |
|
|
usage このリクエストの使用状況情報。 |
音声の削除
リクエストボディ |
この例では、シンガポールリージョンのエンドポイントを使用します。北京リージョンの場合は、
Qwen-Audio-TTS/CosyVoice
Qwen-TTS 音声クローニング
|
|
model 音声クローニングモデル。有効な値:
|
|
|
input 入力パラメーター。 |
レスポンスボディ |
Qwen-Audio-TTS/CosyVoice
Qwen
重要
Qwen-Audio-TTS/CosyVoice は空の出力オブジェクトを返しますが、Qwen は削除された音声名を持つ |
|
request_id このリクエストの一意の識別子。 |
|
|
output モデルによって返されるデータ。Qwen-Audio-TTS/CosyVoice は空のオブジェクトを返し、Qwen は削除された音声の名前を返します。 |
|
|
usage このリクエストの使用状況情報。 |
音声ステータスの説明
音声が作成されると、レビュープロセスを経ます。以下のステータスは、Qwen-Audio-TTS/CosyVoice (model が voice-enrollment の場合) にのみ適用されます。Qwen のクエリおよびリストのレスポンスにはステータスフィールドは含まれません。
|
ステータス |
説明 |
|
DEPLOYING |
レビュー中または処理中です。 |
|
OK |
レビューに合格しました。音声は使用可能な状態です。 |
|
UNDEPLOYED |
レビューが拒否されました。音声は使用できません。 |