O Qwen-Audio-TTS oferece as seguintes vozes do sistema. Além das vozes do sistema, também estão disponíveis vozes base pré-geradas criadas por clonagem de voz. Para mais informações, consulte Lista de vozes base. Se precisar de uma voz mais personalizada, use o recurso de clonagem de voz para criar uma voz personalizada gratuitamente. Para mais informações, consulte Sintetizar fala com uma voz clonada.
Ao sintetizar fala:
- Cada modelo (
model) oferece suporte apenas a um conjunto específico de vozes (voice). Vozes não podem ser misturadas entre modelos. Caso especifique uma voz que não está na lista de vozes do modelo selecionado, o serviço retorna um erroInvalidParameter(por exemplo,[cosyvoice:]Engine error [411]: TTS speak operation failed). Nesse caso, consulte a lista de vozes do modelo correspondente abaixo e verifique se a voz é compatível com o modelo atual. - O
texta ser sintetizado deve estar em um idioma compatível com a voz selecionada. Caso contrário, podem ocorrer erros de pronúncia ou fala não natural.
Vozes do sistema qwen-audio-3.0-tts-plus
| Caso de uso | Detalhes da voz | Pré-visualização de áudio (clique com o botão direito para salvar) |
|---|---|---|
Companhia social (voz principal) | Nome: Long An Ling Xin Parâmetro de voz: longanlingxin Característica: Calorosa e empática Idade: 25 Gênero: Feminino Idioma: Chinês (Mandarim), Inglês | |
Nome: Long An Lu Feng Parâmetro de voz: longanlufeng Característica: Alegre e animado Idade: 25 Gênero: Masculino Idioma: Chinês (Mandarim), Inglês |
Vozes do sistema qwen-audio-3.0-tts-flash
| Caso de uso | Detalhes da voz | Pré-visualização de áudio (clique com o botão direito para salvar) |
|---|---|---|
Companhia social (voz premium em chinês) | Nome: Long An Feng Yue Parâmetro de voz: longanfengyue Característica: Natural e simpática Idade: 30 Gênero: Feminino Idioma: Chinês (Mandarim), Inglês | |
Nome: Long An Yuan Fei Parâmetro de voz: longanyuanfei Característica: Orgulhosa e majestosa Idade: 30 Gênero: Feminino Idioma: Chinês (Mandarim), Inglês | ||
Nome: Long An Ling Xi Parâmetro de voz: longanlingxi Característica: Fofa e doce Idade: 25 Gênero: Feminino Idioma: Chinês (Mandarim), Inglês | ||
Nome: Long An Xiao Xin Parâmetro de voz: longanxiaoxin Característica: Simpática e animada Idade: 22 Gênero: Feminino Idioma: Chinês (Mandarim), Inglês | ||
Nome: Long An Huan Parâmetro de voz: longanhuan_v3.6 Idade: 25 Gênero: Feminino Idioma: Chinês (Mandarim), Inglês | ||
Companhia infantil / brinquedo inteligente (voz premium infantil) | Nome: Long Jie Li Dou Parâmetro de voz: longjielidou_v3.6 Característica: Menino jovem inocente Idade: 5 Gênero: Masculino Idioma: Chinês (Mandarim), Inglês | |
Nome: Long Pao Pao Parâmetro de voz: longpaopao_v3.6 Característica: Suave e adorável Idade: 5 Gênero: Feminino Idioma: Chinês (Mandarim), Inglês | ||
Voz de personagem / jogos (voz premium em chinês) | Nome: Long Huo Huo Parâmetro de voz: longhuohuo_v3.6 Característica: Menino jovem travesso Idade: 8 Gênero: Masculino Idioma: Chinês (Mandarim), Inglês | |
Nome: Long Chuan Shu Parâmetro de voz: longchuanshu_v3.6 Característica: Homem de meia-idade com sotaque de Sichuan Idade: 40 Gênero: Masculino Idioma: Chinês (Mandarim), Inglês | ||
Companhia social / assistente de voz (voz premium em inglês) | Nome: loongmary Parâmetro de voz: loongmary Característica: Sotaque britânico caloroso Idade: 20 Gênero: Feminino Idioma: Inglês | |
Nome: loongeva Parâmetro de voz: loongeva_v3.6 Característica: Sotaque americano com entonação inteligente Idade: 28 Gênero: Feminino Idioma: Inglês | ||
Nome: loongjohn Parâmetro de voz: loongjohn Característica: Sotaque americano calmo e amigável Idade: 28 Gênero: Masculino Idioma: Inglês |
Lista de vozes base
Além das vozes do sistema acima, os modelos qwen-audio-3.0-tts-plus e qwen-audio-3.0-tts-flash oferecem mais de 500 vozes base geradas por clonagem de voz. Elas são chamadas da mesma forma que as vozes do sistema. As vozes base seguem o padrão de nomenclatura qwen-audio-3.0-tts-{plus|flash}-{voice suffix}. O mesmo sufixo em ambos os modelos corresponde ao mesmo conjunto de arquivos de prévia de áudio. Baixe os arquivos Excel abaixo para obter a lista completa de vozes:
- Lista de vozes base do
qwen-audio-3.0-tts-plus(Excel): qwen-audio-3.0-tts-plus base voices.xlsx - Lista de vozes base do
qwen-audio-3.0-tts-flash(Excel): qwen-audio-3.0-tts-flash base voices.xlsx - Pacote de áudio de prévia das vozes base (compartilhado pelos modelos plus e flash): base voice preview audio package.zip
Passos para prévia:
- Baixe os arquivos Excel e o pacote de áudio de prévia e extraia o pacote de áudio na sua máquina local.
- No arquivo Excel, localize a coluna "Preview audio file name" e copie o nome do arquivo de áudio.
- Localize o arquivo correspondente na pasta extraída e abra-o com um reprodutor de mídia para prévia.